Категорії Новини

В Україні розпочнеться створення Національної інфраструктури штучного інтелекту – подробиці

У 2026 році в Україні буде створена перша національна велика мовна модель, яка стане основою для розробки чат-ботів на основі штучного інтелекту та цифрових асистентів у державних структурах і бізнесі.

Цю інформацію оприлюднило Міністерство цифрової трансформації.

Згідно з повідомленням, технічним партнером проєкту є компанія «Київстар», яка відповідальна за фінансування розробки, забезпечення необхідної технічної інфраструктури та передачу моделі державі по завершенні проекту.

Основи української LLM

Як базу обрали модель Gemma від Google, котру адаптуватимуть для української мови, культурних особливостей та специфіки державних служб. Наразі триває процес збору навчальних даних. Зокрема, фахівці працюють не лише з відкритими джерелами, а й з матеріалами з історичних архівів, університетів, наукових установ та державних органів.

Для контролю якості було сформовано експертний комітет, що працює за чотирма напрямками:

  • науково-технічний,
  • правовий,
  • культурно-історичний,
  • мовний.

Експерти розробляють професійні бенчмарки — систему тестування, яка допоможе оцінити якість навчання та безпеку моделі.

Також у Мінцифри повідомили, що найближчим часом буде презентовано:

  • першу базу текстів для тренування моделі;
  • оновлений токенізатор, що працюватиме більш ефективно з українською мовою;
  • власні українські бенчмарки для оцінки якості LLM.

У додатку «Дія» планується запустити голосування, де громадяни зможуть вибрати назву для нової мовної моделі. Одночасно ведеться робота над юридичними підставами для обробки даних, щоб гарантувати прозорість, безпеку та дотримання прав інтелектуальної власності.

Коли очікувати першу версію?

Перша версія української LLM має бути запущена в бета-тестування навесні 2026 року. Модель буде навчена на унікальних українських даних і зможе змагатися з іншими мовними моделями в міжнародних рейтингах.