
AI & Technology
Anthropic обясни как Claude ще маркира генериран текст, как редакциите могат да заличат сигнала и защо той ще е по-слаб при програмен код.

Част от текстовете, създавани от Claude, скоро ще съдържат скрит сигнал. Anthropic добавя статистически воден знак, за да изпълни Кодекса за прозрачност към Акта на ЕС за изкуствения интелект. Определени пасажи ще носят машинно разпознаваем шаблон, без читателят да вижда разлика, съобщава TechCrunch.
Целта на изискването е генерираното от AI съдържание да може да бъде идентифицирано. Подходът на Anthropic покрива тази задача, но няма да разпознава автоматично всеки документ, по който Claude е работил. Именно това ограничение определя реалната полза от системата.
Водният знак се създава чрез подбора на думи. Докато генерира текст, Claude ще избира между подходящи думи така, че да оформи шаблон, проверим със съответния ключ. Представете си обикновени плочки, подредени по скрита схема: нито една не изглежда особена, но цялата подредба носи информация. Anthropic планира да използва SynthID-Text, описан от Google DeepMind през 2024 г., и да пусне API за откриване на водния знак.
Този метод работи само когато Claude разполага с достатъчно свобода при формулирането и генерира достатъчно дълъг текст. Затова водният знак не е постоянен етикет, прикрепен към файла. Той прилича повече на следа от самия процес на генериране. Може да подскаже как е създаден текстът, но последващи редакции могат да отслабят доказателството.
Най-ясно сигналът ще личи при потребители, които публикуват дълги пасажи, генерирани от чатбота. Според Anthropic леките редакции вероятно няма да го унищожат, но подмяната на всяка дума може да го премахне. Регулацията може да изисква проследимост в момента на генериране, но не може да запази следата след неограничено пренаписване.
При корекция и лека редакторска намеса няма прост отговор „има“ или „няма“ воден знак. Откриваемостта ще зависи от дължината на документа и от мащаба на промените, направени от Claude. Ако по-голямата част от текста остава написана от човек, според Anthropic може да няма достатъчно генериран материал, който да носи сигнала. Тоест Claude може да е помогнал по документа, без в него да остане достатъчно негов текст за надеждно засичане.
Тази граница е важна, защото системата измерва генерирания език, а не самото участие на модела. Тя може да разпознае дълъг пасаж от чатбота, но да не остави почти никаква следа при ограничена помощ. Водният знак подпомага проверките за произход, без да превръща всеки редактиран с Claude документ в сигурно маркиран файл.
При програмния код компромисът е още по-видим. Функционалните изисквания ограничават избора на думи и символи, а това оставя по-малко място за статистически шаблон, който да не променя поведението на софтуера. Anthropic посочва, че свободният текст, включително коментарите в кода, може да носи воден знак. Влиянието върху изпълнимия код трябва да е пренебрежимо. Сигналът е най-силен там, където езикът позволява избор, и най-слаб там, където коректността свежда възможностите до минимум.
Спазването на правилата зависи и от проверката. Anthropic трябва не само да вгради шаблона при генерирането, но и да осигури начин той да бъде тестван, вместо да разчита на видимо предупреждение. Затова планираният API е толкова важен, колкото и самият воден знак. Скрит сигнал има ограничена стойност, ако потребители и регулатори не могат да го проверят. Източникът не посочва дата за пускане, правила за достъп или данни за точността на API.
Anthropic твърди, че други големи разработчици на модели са подписали същия кодекс и също ще въведат водни знаци. Публикацията не назовава компаниите и не описва общ стандарт за откриване. Така основният въпрос остава отворен: ще получат ли регулаторите и потребителите съвместими инструменти за проверка, или всеки доставчик ще предлага собствен ключ и API, които разпознават само неговото съдържание?
Източници
Тази статия е изготвена с помощта на изкуствен интелект и е прегледана и редактирана от екипа на LabForty.
Абонирайте се за седмичен обзор, когато сме публикували нещо ново. Без новини — без имейл. Можете да смените езика и темата или да се отпишете по всяко време.
Блог

LabForty разработва висококачествени уебсайтове с внимание към всеки детайл – от архитектурата до потребителското изживяване и бизнес логиката.