Суспільне надасть для навчання національної великої мовної моделі «Сяйво» ліцензований доступ до понад 764 тисяч матеріалів свого архіву. Про це повідомили на корпоративному сайті Суспільного мовлення.

До архіву увійдуть верифіковані редакційні матеріали — новини, репортажі та інтерв’ю, які стануть основою для тренування української ШІ-моделі. Генпродюсерка інформаційного мовлення Суспільного Христина Гаврилюк підкреслила, що архів — це не просто великий масив даних, а мовна інфраструктура з оригінальним україномовним контентом. За її словами, щоб штучний інтелект розумів український контекст і працював з достовірною інформацією, він має навчатися саме на такому контенті.

Керівник команди розробки цифрових продуктів Суспільного Кирило Єсін додав, що ця ініціатива допоможе примножити цінність цифрового контенту мовника, адже він стане частиною суверенної мовної моделі та основою якісного цифрового досвіду для кожного українця.

Суспільне надає «Дії» невиключну ліцензію на використання матеріалів з метаданими — рубриками, тегами, інформацією про авторів і час публікації. Обсяг контенту, який використовуватимуть для навчання, згодом можуть розширити.

Нагадаємо, що у липні 2025 року Мінцифри разом із «Київстаром» розпочали розробку національної великої мовної моделі — штучного інтелекту, який має стати українською відповіддю ChatGPT. У грудні стало відомо, що модель тренуватимуть на основі Gemma 3 від Google, а в березні цього року їй дали назву «Сяйво».