Firma Anthropic wyjaśniła, jak będą działać znaki wodne w tekstach generowanych przez Claude’a
Firma Anthropic ujawniła szczegóły dotyczące wprowadzania znaków wodnych w tekstach generowanych przez jej chatbota Claude. Firma wprowadza ten mechanizm w celu zapewnienia zgodności z Kodeksem przejrzystości zawartym w unijnej ustawie o sztucznej inteligencji, który przewiduje systemy identyfikacji treści tworzonych przez sztuczną inteligencję, jak podaje TechCrunch.
Zgodnie z wyjaśnieniami firmy Anthropic, Claude będzie tworzył ukryty wzorzec w swoich odpowiedziach, wybierając spośród równoważnych wariantów słów. Na przykład model może wybrać różne słowa do opisania pochmurnej pogody. Dla czytelnika tekst z takim oznaczeniem nie będzie się różnił od zwykłego, jednak będzie mógł go wykryć ten, kto posiada klucz do odszyfrowania znaku wodnego.
Firma oświadczyła, że będzie stosować podejście SynthID-Text, które zespół Google DeepMind zaprezentował w 2024 roku, a także planuje udostępnić API do wykrywania znaków wodnych. Anthropic podkreśliła, że technologia ta różni się od systemów wykrywania tekstów generowanych przez sztuczną inteligencję, które poszukują charakterystycznych konstrukcji językowych i innych cech stylistycznych.
Więcej aktualnych wiadomości można znaleźć na kanale Telegram UA.News.
Według oceny firmy Anthropic, niewielka edycja prawdopodobnie nie usunie znaku wodnego całkowicie. Jednocześnie całkowite przepisanie tekstu z zamianą każdego słowa może go wyeliminować. Jeśli Claude jedynie sprawdził lub nieznacznie edytował tekst napisany przez człowieka, możliwość wykrycia znaku wodnego będzie zależała od zakresu i intensywności takiej edycji. W przypadku niewielkiej edycji prawie wszystkie słowa pozostaną napisane przez człowieka, więc znak wodny nie będzie miał się do czego przyczepić.
W kodzie programowym możliwości oznaczania będą bardziej ograniczone, ponieważ model musi generować działający wynik i nie zawsze może swobodnie wybierać spośród różnych wariantów. Jednocześnie technologia ta może być stosowana do dowolnych elementów kodu, w tym komentarzy, przy niewielkim wpływie na sam kod. Firma Anthropic zaznaczyła również, że inni duzi twórcy modeli, którzy podpisali ten sam kodeks, będą wdrażać własne znaki wodne.