$ 44.68 € 51.28 zł 11.75
+16° 基辅 (Kyiv) +11° 华沙 (Warsaw) +24° 华盛顿 (Washington)

南非研究发现聊天机器人回答存在差异——《每日新闻》

列夫·舍夫佐 20 九月 2026 20:54
南非研究发现聊天机器人回答存在差异——《每日新闻》

南非LLMEKNOW服务的一项研究显示,不同的人工智能聊天机器人可能会对有关银行、品牌和社会政治议题的相同提问给出不同回答,因为它们使用的信息来源不同。《每日新闻》对此进行了报道。

根据LLMEKNOW的数据,在针对南非银行的提问研究中,Claude在所有回答中都使用了最新的网络来源。Grok和GPT-5在大约十次中有九次会上网搜索信息,Gemini在十次中不足两次,而DeepSeek则基于现有训练数据作答,不进行网络搜索。

银行和品牌的可见度

LLMEKNOW就南非最佳银行的问题向五个模型提问了3,763次。Capitec最常被作为首个提及的银行,占回答的53.4%。与此同时,FNB在全部提及中占比最高,为21.5%,但很少被首先提及。

当向模型提供收入不同的用户画像时,针对低收入用户的Investec推荐比例下降了87%,而针对富裕用户的比例上升了19%。面向新兴中产阶级群体的TymeBank推荐比例增加了79%。

更多最新消息请关注 UA.News Telegram 频道 Telegram.

在另一项测试中,七个模型围绕Nando’s连锁店的问题回答了364次,模拟来自五个国家的用户。对该品牌的平均情感评分在澳大利亚为100分制的50.8分,在马来西亚为100分制的70.5分。

敏感议题的信息来源

据LLMEKNOW称,在被问及南非农场主谋杀问题的严重性时,ChatGPT更常依赖政府资源、警方和Africa Check。Claude更常使用AfriForum及其他支持农场主的网站;Gemini采用了更广泛的来源,包括Institute for Security Studies的材料、学术期刊和Wikipedia。Grok结合了政府数据、倡导和参考资源,而Kimi几乎不提供引文。

《每日新闻》还援引了《金融时报》对ChatGPT、Gemini、Grok和DeepSeek就政治和社会问题作答的分析。根据对该分析的描述,这些模型倾向于使用户远离极端的初始立场,同时四个模型在产生这种影响之前都比总体人口更偏左。

关注我们在 TelegramSends

下载我们的应用程序