$ 44.73 € 51.37 zł 11.77
+17° +12° +26°

Дослідження у ПАР виявило різницю у відповідях чатботів — Daily Maverick

Лев Шевцов 20 Вересня 2026 20:54
Дослідження у ПАР виявило різницю у відповідях чатботів — Daily Maverick

У ПАР дослідження сервісу LLMEKNOW показали, що різні ШІ-чатботи можуть по-різному відповідати на однакові запити про банки, бренди та суспільно-політичні теми, оскільки використовують різні джерела інформації. Про це пише Daily Maverick.

За даними LLMEKNOW, у дослідженні запитів про південноафриканські банки Claude використовував актуальні вебджерела в усіх відповідях. Grok і GPT-5 шукали інформацію в інтернеті приблизно у дев’яти випадках із десяти, Gemini — менш ніж у двох із десяти, а DeepSeek відповідав на основі наявних навчальних даних без вебпошуку.

Видимість банків і брендів

LLMEKNOW 3 763 рази поставив п’ятьом моделям запитання про найкращий банк у ПАР. Capitec найчастіше був першим згаданим банком — у 53,4% відповідей. Водночас FNB мав найбільшу частку всіх згадок — 21,5%, але рідко називався першим.

Коли моделям задавали профілі користувачів із різними доходами, частка рекомендацій Investec для малозабезпечених користувачів зменшувалася на 87%, а для заможних — зростала на 19%. Частка рекомендацій TymeBank для сегмента середнього класу, що формується, збільшилася на 79%.

Більше актуальних новин читайте у Telegram-каналі UA.News.

В іншому тесті сім моделей 364 рази відповідали на запитання про мережу Nando’s, імітуючи користувачів із п’яти країн. Середній показник тональності щодо бренду становив 50,8 зі 100 в Австралії та 70,5 зі 100 у Малайзії.

Джерела для чутливих тем

Під час запиту про серйозність проблеми вбивств фермерів у ПАР ChatGPT, за даними LLMEKNOW, частіше спирався на урядові ресурси, поліцію та Africa Check. Claude частіше використовував AfriForum й інші сайти на захист фермерів; Gemini залучав ширший набір джерел, зокрема матеріали Institute for Security Studies, наукові журнали та Wikipedia. Grok поєднував урядові дані, адвокаційні й довідкові ресурси, тоді як Kimi майже не наводив посилань.

Daily Maverick також посилається на аналіз Financial Times відповідей ChatGPT, Gemini, Grok і DeepSeek на питання політики та суспільних проблем. За описом цього аналізу, моделі мали тенденцію віддаляти користувачів від крайніх початкових позицій, водночас усі чотири моделі до такого впливу розташовувалися лівіше за загальну популяцію.

Читай нас у Telegram та Sends

Завантажуй наш додаток