SK Telecom очолила оцінювання проєкту суверенних AI-моделей у Південній Кореї
Міністерство науки та ІКТ Південної Кореї оприлюднило детальні результати другого етапу оцінювання проєкту зі створення суверенних базових моделей штучного інтелекту. Найвищий сумарний бал — 70,6 зі 100 — набрала компанія SK Telecom, повідомляє Korea Herald.
Друге місце посіла Upstage з 69,9 бала, третє — LG AI Research Institute з 69 балами. Motif Technologies отримала 65,8 бала та була виключена після другого етапу. Детальні результати оприлюднили на прохання Motif Technologies за згодою інших команд, включених до короткого списку.
Як формували оцінку
Загальний результат складався зі 100 балів. Бенчмаркові оцінювання становили 40 балів: 25 балів припадали на Artificial Analysis Intelligence Index, ще 15 — на бенчмарк Національного агентства інформаційного суспільства. Експертне оцінювання мало вагу 35 балів, а оцінювання користувачів — 25 балів, з яких 15 нараховували професійні користувачі та 10 — громадськість.
Більше актуальних новин читайте у Telegram-каналі UA.News.
У оцінюванні Artificial Analysis Intelligence Index, що використовує глобальні бенчмарки, найкращий результат показала Motif Technologies — 11,9 бала. Upstage набрала 9,4 бала, SK Telecom — 8,8 бала, а LG AI Research Institute — 7,8 бала. У бенчмарку Національного агентства інформаційного суспільства, який охоплював сім напрямів, зокрема можливості корейської мови та надійність, SK Telecom набрала 13,4 бала, а Upstage — 13,3 бала. Результати LG AI Research Institute та Motif Technologies становили 12,8 і 12,7 бала відповідно.
Оцінки експертів і користувачів
Десять зовнішніх експертів із бізнесу, академічних кіл і дослідницьких установ найвище оцінили LG AI Research Institute — у 29,5 бала. SK Telecom отримала 29,3 бала, Upstage — 29,1 бала, Motif Technologies — 27,1 бала. Серед 49 керівників AI-стартапів, які оцінювали практичну придатність моделей, найвищий результат мала SK Telecom — 11,6 бала. У громадському оцінюванні за участю 185 людей лідирувала LG AI Research Institute з 7,6 бала.
Міністерство заявило, що мета проєкту полягає не лише в ранжуванні команд чи виключенні учасників, а в якісному розвитку та розширенні AI-екосистеми Південної Кореї. Цілі розробки переглядають кожні шість місяців, враховуючи швидкий розвиток технологій, а критерії та методику оцінювання погодили після консультацій із командами з короткого списку. Motif Technologies раніше подала заперечення щодо результатів другого етапу. Міністерство повідомило, що розгляне його відповідно до встановленої процедури та ухвалить остаточне рішення протягом 15 днів.