Нейронный текст обречен (на обнаружение)?

Автор: Бураков Игорь Витальевич

О, а я вам полыхающего принёс!🐦🔥


Клод ИИ (принадлежит Антропик) отныне научился создавать вотермарку для генерированного... ТЕКСТА! Раньше такое было возможно только с музыкой (ключ прятался в фоновый шум) или с картинками (пара тысяч смещенных пикселей, незаметных глазу). Но с текстом это кажется маловероятным или костыльным. Как прятать там? Добавить определённое число длинных и коротких тире? Увеличить/уменьшить ширину пробелов? Но это легко нейтрализуется через поиск и автозамену символов, или вообще через автоформат. Но теперь есть способ, который лично я не сразу и понял как работает.

Постараюсь как можно проще передать. Условно у вас есть фраза:

"За окном по небу летели..."

А ИИ должен выбрать продолжение из списка:

[птицы, облака, самолёты, динозавры]


Обычно ИИ выбирает наиболее вероятное слово, и с некоторой периодичностью чуть менее вероятное. Таким образом добивается некоторая "реалистичность" сочиненного текста. Но Клод добавляет сюда ещё один алгоритм.

Из широкого списка вероятных слов (а каждое слово в предложении является таковым) он, согласно определённому ключу, выбирает особых кандидатов. Эти кандидаты будут подставляться в предложение каждый раз. Они тайный отряд заранее выбранных агентов!

Готовый текст ничем не отличим от обычно сгенерированного, но сам набор вот этих кандидатов в тексте, который известен только самому Клоду, и будет той самой вотермаркой!


И этот процесс ОБРАТИМ! То есть поддаётся реверсинжинирингу.

Если Клод предоставит ключ, с которым он генерировал тексты, то другая программ анализатор будет распознавать нейронный текст со 100% гарантией. В моём примере речь идёт о словах, но кандидатами могут быть и отдельные символы. Выходит сгенерировать текст, потом переставить самостоятельно что-то и снести вотермарку почти не реально. Потому что вы не знаете, что именно в тексте было изменено согласно ключу. Более того, это касается не только созданного с нуля, но и отредактированного текста!


Что это значит в перспективе? А значит, что больше НИКАКИХ 40, 60 и 70 процентов "вероятно создано нейросетью" не будет. В случае имплементации нового алгоритма во всех современные сервисы, проверить текст на наличие генерации будет не только просто, но и результат станет гарантированным. Ты либо ИСПОЛЬЗОВАЛ, либо НЕ ИСПОЛЬЗОВАЛ. Точка! А дело идёт к этому, учитывая нарастающее давление общественности (на западе) и учебных заведений (ученики и студентики завалили преподов генеративными домашками).


К чему это ведёт? К обязательной пометке "создано с использованием нейросетей". К гарантированной защите на конкурсах не принимающих генеративный контент. К доступной проверке и соответствующим последствиям в случае несоблюдения требований о пометках или запретов об использовании.
Естественно, в новой системе ещё есть уязвимости. Лучше я не стану говорить какие, но они есть)) Однако любая инновация проходит через процесс совершенствования. Рано или поздно не останется места для "сомнений".
Как мне кажется, времена дикого запада кончаются. По крайней мере мне видятся проблески рассвета в этой тёмной эре безалаберной эксплуатации новой технологии.🌄


А вы что думаете? Плохо это, что нейронный текст теперь можно будет обнаружить с гарантией?


На случай, если я непонятно объяснил, или где-то сам недопонял, вот  на статью в журнале NATURE, куда Антропик предоставили информацию о новом алгоритме.

-1
88

0 комментариев, по

1 603 0 43
Мероприятия

Список действующих конкурсов, марафонов и игр, организованных пользователями Author.Today.

Хотите добавить сюда ещё одну ссылку? Напишите об этом администрации.

Наверх Вниз