Firma Anthropic wyjaśniła, jak będą działać znaki wodne w tekstach generowanych przez Claude’a
Firma Anthropic ujawniła szczegóły dotyczące wprowadzania znaków wodnych w tekstach generowanych przez jej chatbota Claude. Firma wprowadza ten mechanizm w celu zapewnienia zgodności z Kodeksem przejrzystości zawartym w unijnej ustawie o sztucznej inteligencji, który przewiduje systemy identyfikacji treści tworzonych przez sztuczną inteligencję, jak podaje TechCrunch.
Zgodnie z wyjaśnieniami firmy Anthropic, Claude będzie tworzył ukryty wzorzec w swoich odpowiedziach, wybierając spośród równoważnych wariantów słów. Na przykład model może wybrać różne słowa do opisania pochmurnej pogody. Dla czytelnika tekst z takim oznaczeniem nie będzie się różnił od zwykłego, jednak będzie mógł go wykryć ten, kto posiada klucz do odszyfrowania znaku wodnego.
Firma oświadczyła, że będzie stosować podejście SynthID-Text, które zespół Google DeepMind zaprezentował w 2024 roku, a także planuje udostępnić API do wykrywania znaków wodnych. Anthropic podkreśliła, że technologia ta różni się od systemów wykrywania tekstów generowanych przez sztuczną inteligencję, które poszukują charakterystycznych konstrukcji językowych i innych cech stylistycznych.
Więcej aktualnych wiadomości można znaleźć na kanale Telegram UA.News.
Według oceny firmy Anthropic, niewielka edycja prawdopodobnie nie usunie znaku wodnego całkowicie. Jednocześnie całkowite przepisanie tekstu z zamianą każdego słowa może go wyeliminować. Jeśli Claude jedynie sprawdził lub nieznacznie edytował tekst napisany przez człowieka, możliwość wykrycia znaku wodnego będzie zależała od zakresu i intensywności takiej edycji. W przypadku niewielkiej edycji prawie wszystkie słowa pozostaną napisane przez człowieka, więc znak wodny nie będzie miał się do czego przyczepić.
W kodzie programowym możliwości oznaczania będą bardziej ograniczone, ponieważ model musi generować działający wynik i nie zawsze może swobodnie wybierać spośród różnych wariantów. Jednocześnie technologia ta może być stosowana do dowolnych elementów kodu, w tym komentarzy, przy niewielkim wpływie na sam kod. Firma Anthropic zaznaczyła również, że inni duzi twórcy modeli, którzy podpisali ten sam kodeks, będą wdrażać własne znaki wodne.
Czytaj nas na Telegram i Sends