Суспільне Мовлення передає архів новин для навчання національної великої мовної моделі України (LLM) “Сяйво”. Про це повідомляється на сайті мовника.

Суспільне стало одним з партнерів ініціативи, надавши ліцензований доступ до перевіреного редакційного контенту. До навчання моделі ввійдуть новини, репортажі, інтерв’ю та спеціальні проєкти про події в Україні та світі.

Мовник зазначає, що цей крок відповідає місії компанії – зробити якісну українську журналістику частиною інформаційної інфраструктури країни. 

Генеральна продюсерка інформаційного мовлення Суспільного Христина Гаврилюк наголосила, що архів медіа є не лише масивом даних для машинного навчання, а й важливим джерелом українськомовного контенту.

“Якщо ми хочемо, щоб AI-моделі розуміли український контекст, працювали з достовірною інформацією, вони мають навчатися саме на такому контенті”, – сказала вона.

За умовами співпраці Суспільне надає “Дії” невиключну ліцензію на використання архіву своїх публікацій. До нього входять понад 764 тисячі матеріалів – заголовки, тексти, а також метадані: рубрики, теги, інформація про авторів і дати публікацій.

Надалі сторони планують розглянути можливість розширення обсягу контенту, який використовуватимуть для навчання моделі.

Ініціатива зі створення національної LLM-моделі “Сяйво” реалізується Міністерством цифрової трансформації України спільно з ДП “Дія” та компанією “Київстар”. Мета проєкту – створити велику мовну модель, адаптовану до української мови та контексту, яка зможе використовуватися в державному секторі, освіті, бізнесі та інших сферах, а також зменшити залежність України від іноземних мовних моделей.

Як повідомляв ІМІ, назву “Сяйво” для національної мовної моделі обрали під час голосування в застосунку “Дія”.