В Україні створюють мовну модель «Сяйво» для відображення культурного контексту

Національна мовна модель «Сяйво»

В Україні триває активна розробка великої мовної моделі (LLM) під назвою «Сяйво». Головною метою цього проєкту є створення штучного інтелекту, який здатен максимально точно враховувати український культурний контекст, історію та локальні діалекти.

Залучення архівних даних

У рамках проєкту ключовим етапом стало збирання унікальних даних, які не використовувалися для навчання глобальних чат-ботів. Серед понад 50 організацій, що приєдналися до ініціативи, найбільшим постачальником знань став Укрдержархів, який надав 10 терабайтів інформації. Це еквівалентно обсягу бібліотеки з 70 тисяч друкованих книжок.

Оцифрування архівів в Україні

За словами в.о. міністра цифрової трансформації Олександра Борнякова, Україна вже займає провідні позиції у світі за темпами оцифрування архівних документів. Наразі в цифровому форматі доступно близько 150 мільйонів копій документів, і прогнозується, що до кінця 2026 року ця кількість перевищить 200 мільйонів.

Перспективи розвитку «Сяйва»

Всі ці дані стануть основою для навчання мовної моделі «Сяйво», що внесе свій вклад у розвиток цифрових сервісів в Україні. Проєкт відповідатиме сучасним потребам користувачів, а також підвищить якість взаємодії з технологіями на основі штучного інтелекту.

Додати коментар