Україна збирає матеріали з понад 90 держустанов для нацмоделі ШІ

З більш ніж 90 установ збирають судові реєстри, видавництва, регіональні архіви та документи про дії Росії для тренування національної великої мовної моделі на основі відкритої архітектури Gemma.

1104
Поділиться:

Джерела для навчання

З більш ніж 90 державних установ надходять матеріали — від судових реєстрів і видавництв освіти до регіональних архівів та документів, пов'язаних із діями Росії під час повномасштабного вторгнення. Ці корпуси використають як основу для тренування національної великої мовної моделі, яка базуватиметься на відкритій архітектурі Gemma компанії Google.

Місце навчання й захист

Навчання відбуватиметься за кордоном на захищених графічних процесорах, що їх надає Google. Після завершення модель планують розгорнути в українських дата-центрах. Серед технологічних партнерів проєкту — Київстар; точна дата запуску поки не визначена.

Команда розробників готується до можливих кібератак. Мінцифри попереджає, що одразу після публічного запуску система може стати мішенню, як це траплялося з іншими ШІ-сервісами. Розглядають заходи проти 'prompt injection' — спроб вставити шкідливі інструкції в запити користувачів.

Нещодавно оголосили, що українську велику мовну модель навчатимуть із використанням Gemma. В Україні вже сформували команду, яка працюватиме над розробкою національної LLM.

Новини світу

Фінанси

ЄС передає Україні черговий транш прибутків від заморожених активів рф — цього разу на тлі масованої атаки. Але поки Брюссель погоджує сотні мільйонів щоквартально, план на 140 млрд євро "репараційного кредиту" залишається заблокованим.

1 годину тому
Бізнес

Компанія, що будує дороги, стала єдиним учасником аукціону і забрала Котовський виноробний завод удвічі дешевше стартової ціни. Це вже другий випадок за рік, коли актив держвиноробства переходить не профільному гравцю, а орендарю чи суміжному бізнесу.

1 годину тому