В Україні створюють мовну модель «Сяйво» для відображення культурного контексту
Національна мовна модель «Сяйво»
В Україні триває активна розробка великої мовної моделі (LLM) під назвою «Сяйво». Головною метою цього проєкту є створення штучного інтелекту, який здатен максимально точно враховувати український культурний контекст, історію та локальні діалекти.
Залучення архівних даних
У рамках проєкту ключовим етапом стало збирання унікальних даних, які не використовувалися для навчання глобальних чат-ботів. Серед понад 50 організацій, що приєдналися до ініціативи, найбільшим постачальником знань став Укрдержархів, який надав 10 терабайтів інформації. Це еквівалентно обсягу бібліотеки з 70 тисяч друкованих книжок.
Оцифрування архівів в Україні
За словами в.о. міністра цифрової трансформації Олександра Борнякова, Україна вже займає провідні позиції у світі за темпами оцифрування архівних документів. Наразі в цифровому форматі доступно близько 150 мільйонів копій документів, і прогнозується, що до кінця 2026 року ця кількість перевищить 200 мільйонів.
Перспективи розвитку «Сяйва»
Всі ці дані стануть основою для навчання мовної моделі «Сяйво», що внесе свій вклад у розвиток цифрових сервісів в Україні. Проєкт відповідатиме сучасним потребам користувачів, а також підвищить якість взаємодії з технологіями на основі штучного інтелекту.
