Міністерство цифрової трансформації разом із компанією "Київстар" обрали базову модель для національної української великої мовної моделі (LLM).
Про це повідомляє преслужба Мінцифри.
Нею стане Gemma 3 — відкрита мультимодальна модель від Google, яка вже показала високі результати в роботі з українською мовою.
За словами представника Мінцифри Данила Цьвока, українська LLM буде навчена на унікальних даних, які зараз збирають експерти. Розробники планують удосконалити український токенайзерІнструмент, який розбиває текст на маленькі частини (токени), щоб мовна модель могла правильно його аналізувати й опрацьовувати., донавчити модель на великих україномовних корпусах та створити бенчмаркиСпеціальні тести, за допомогою яких оцінюють і порівнюють якість роботи мовних моделей. для точного налаштування системи.
У "Київстарі" зазначають, що Gemma забезпечує оптимальний баланс якості та ресурсів, підтримує понад 140 мов, включно з українською, мультимодальні можливості та розширений контекст до 128 тисяч токенів. Це робить її однією з найефективніших опенсорс-моделейМодель із відкритим кодом, який можна вільно переглядати, використовувати та вдосконалювати. для донавчання.
Вибір України схвалили й у компанії Google. Керівник відділу інженерії замовників Google Cloud у Центральній та Східній Європі Кшиштоф Казьов зазначив, що ефективність та гнучкість Gemma було доведено ще під час створення українських моделей MamayLM і Lapa LLM. Також на основі Gemma було створено сучасну LLM для болгарської мови під назвою INSAIT BgGPT.
Нагадаємо, у квітні в Мінцифри повідомили, що розробляють велику мовну модель, яка пришвидшить інтеграцію ШІ в державу, оборону та бізнес.
Читайте нас у Facebook, Instagram і Telegram, дивіться наш YouTube і TikTok
Поділіться своєю історією з Суспільне Культура. З нами можна зв'язатися у соціальних мережах та через пошту: [email protected]
