Математик Андреас Том просит OpenAI доказать, что она не использовала его работу — The Verge
Математик Андреас Том заявил, что OpenAI должна предоставить доказательства того, что не использовала непубличные математические наработки пользователей для улучшения своих моделей. Свои опасения он связал с недавними объявлениями компании о математических результатах, один из которых касается его специализации — несофических групп.
Вопросы о данных пользователей
Как сообщает The Verge, Том рассказал в серии публикаций на Mastodon, что он и его коллеги общались с ChatGPT до объявления OpenAI. Один из 10 результатов, о которых компания сообщила в прошлом месяце, касался несофических групп. OpenAI признала, что этот результат в значительной степени опирался на предыдущие работы Тома и его коллеги Габора Куна.
По словам Тома, после объявления он обратил внимание на детальное владение OpenAI методами, которые не были ни наиболее очевидным, ни наиболее перспективным путем к решению задачи. Он написал исследователям OpenAI Sébastien Bubeck и Mark Sellke с вопросом, могли ли его разговоры с чат-ботом быть частью обучающих данных или быть доступными во время процесса рассуждения модели.
Больше актуальных новостей — в Telegram-канале UA.News Telegram.
Требование большей прозрачности
Том заявил, что полученный им ответ касался только прямого доступа к чатам, но не объяснял, попало ли содержание разговоров в массивы данных, которые компания использует для улучшения моделей. По его мнению, только OpenAI располагает сведениями, позволяющими установить, использовались ли конкретные материалы пользователей. Математик считает, что компания должна раскрыть необходимые наборы данных и объяснить условия их использования, если отрицает применение непубличных исследований.
Ранее OpenAI заявляла, что ее исследователи и агенты не видели работы других математиков до ее публичного обнародования, в частности не получали доступ к конкретным данным пользователей для решения задачи Навье — Стокса. В то же время компания отметила, что не может полностью исключить, что обезличенные данные, полученные в результате использования ее продуктов, могли помочь улучшить модели.
Том подчеркнул, что обезличивание может убрать имя, но не интеллектуальное содержание математической идеи. Он назвал этически неприемлемой ситуацию, при которой непубличные исследования пользователей могли бы помогать улучшать модели, которые впоследствии соревнуются с теми же исследователями за первенство в публикации без их согласия, раскрытия информации или надлежащего признания. OpenAI не предоставила The Verge оперативный комментарий.