
Суспільне надасть для навчання національної LLM-моделі «Сяйво» ліцензований доступ до верифікованого редакційного контенту — новин, репортажів та інтерв'ю. Про це повідомили на корпоративному сайті Суспільного мовлення.
«Архів новин Суспільного — це не просто масив даних для машинного навчання, а й мовна інфраструктура, що складається з оригінального україномовного контенту. Якщо ми хочемо, щоб AI-моделі розуміли український контекст, працювали з достовірною інформацією, вони мають навчатися саме на такому контенті», — вважає генпродюсерка інформаційного мовлення Суспільного Христина Гаврилюк.
На думку керівника команди розробки цифрових продуктів Суспільного Кирила Єсіна, ця ініціатива допоможе примножити цінність цифрового контенту мовника, оскільки він стане «частиною суверенної мовної моделі та основою якісного цифрового досвіду для кожного українця».
Суспільне надає «Дії» невиключну ліцензію на використання понад 764 тисяч матеріалів з метаданими (рубриками, тегами, інформацією про авторів і час публікації). Обсяг контенту, який використовуватимуть для навчання української національної мовної моделі, згодом можуть розширити.
Нагадаємо, у липні 2025 року стало відомо, що Мінцифри разом з «Київстаром» почали розробляти національну велику мовну модель — штучний інтелект, що має стати українською відповіддю ChatGPT.
У грудні стало відомо, що національну мовну модель тренуватимуть на моделі Gemma 3 від Google. У березні цього року оголосили, що українська ШІ-модель отримає назву «Сяйво».
Фото: Суспільне мовлення