Українська мова стала лідером за темпами зростання серед ШІ-моделей у 2025 році

Українська мова показала найвищі темпи зростання серед мов, представлених у моделях штучного інтелекту у 2025 році. Про це свідчить аналіз даних платформи Hugging Face, який опублікувало видання AI World. Дослідження охоплює зміни між 2024 і 2025 роками та відображає динаміку розвитку багатомовних ШІ-моделей.

За даними AI World, розвиток штучного інтелекту дедалі активніше відбувається поза межами англомовного середовища. Це пов’язано з ширшою участю різних мовних спільнот у створенні та навчанні моделей, а також зі зростанням відкритих ініціатив у сфері ШІ. Дослідники зазначають, що саме темпи зростання вказують, де інтерес і активність розвиваються найшвидше.

Найвищий річний приріст зафіксовано в українській, шведській, арабській, турецькій та китайській мовах. Ці мови продемонстрували найбільше відсоткове зростання кількості моделей, що свідчить про зміщення фокусу розвитку в бік мов, які раніше були менш представлені в екосистемі штучного інтелекту.

Водночас англійська мова залишається домінантною за загальною кількістю моделей. За нею йдуть китайська, французька, іспанська та німецька. Однак, як зазначають в AI World, відносні темпи зростання цих мов нижчі порівняно з мовами, які лише набирають обертів у багатомовній екосистемі.

Станом на 2025 рік на платформі Hugging Face зареєстровано майже 270 тисяч моделей з підтримкою англійської мови. Для української мови платформа налічує понад 3 000 моделей та 619 датасетів, що є суттєвим показником для мови, яка донедавна була обмежено представлена в глобальних ШІ-проєктах.

Зростання кількості українськомовних моделей пов’язують з активністю локальної спільноти розробників і дослідників, а також із розвитком відкритих проєктів. Одним із прикладів є Lapa LLM — українськомовна велика мовна модель, яку називають однією з найефективніших для роботи з українською мовою. Її створювали українські дослідники у вільний час, зосереджуючись на якості даних і мовній точності.

Дослідники зазначають, що зростання української мови в екосистемі штучного інтелекту сприяє формуванню більш різноманітного та інклюзивного багатомовного середовища, у якому розвиток ШІ перестає бути зосередженим виключно навколо кількох домінантних мов.

Джерело: dev.ua

Читайте також
  • Новини
    Meta закриє платформу Spark AR, встигніть зберегти проєкти до 14 січня
    Софія Старк
  • Новини
    Google тестує новий варіант темного режиму пошукової системи
    Ольга Беспалько
  • Новини
    Постановка задач у месенджерах знижує задоволеність роботою — дослідження PLOS One
    Софія Старк
  • Новини
    Срібний призер Паралімпіади Максим Мурашковський готувався до змагань за допомогою ChatGPT
    Гнатюк Дмитро
  • Новини
    У GA4 більше не буде окремого звіту Key Events — Google оновила Events Report
    Яна Поліщук
  • Новини
    Relevance AI залучила $24 млн для розвитку платформи, що створюватиме команди ШІ-моделям
    Яна Поліщук