ЯД: лучше посадить десять невиновных, чем оставить одного виновного гулять на свободе

Автор: SkyFox2026

Я опять об уже задолбавшей охоте на нейротексты при помощи ЯД.

Вот пример двух текстов - фрагмент произведения Гермиона: цепь для Девяти

Как всем, наверное известно, ЯД разбивает текст на блоки примерно по 1000 знаков в каждом, и анализирует каждый блок отдельно. Ниже пример двух почти одинаковых текстовых блоков. Первый вариант ЯД отнес к 100% человеческому, второму дал "желтый" статус (скорее всего ИИ). Отличие между ними - всего в одной фразе:

 — ни одна крупная военная операция теперь не утверждалась без визы Грейнджер

Можете проверить сами, тексты приведены полностью

Совместным решением Министерства магии и британского военного кабинета ей был передан в полное распоряжение бункер «Омега» — колоссальный подземный комплекс, высеченный в гранитных недрах Уэльса. Возведенный в разгар холодной войны для высшего руководства страны на случай глобального ядерного столкновения, теперь он был кардинально модернизирован. Метровые гермодвери из титанового сплава опутывали светящиеся жилы древних защитных чар, а магловские фильтры радиационной и химической защиты дублировались мощнейшими барьерами против ментального воздействия и Аппарации.
Здесь, на глубине трехсот метров под землей, Гермиона вела свои исследования. Их результаты в обязательном порядке учитывались при оперативном планировании всей оборонительной кампании. Шла ли речь о наступлении бронетехники маглов под Ноттингемом или о массированном магическом ударе на позиции орков в Йоркшире. Вся информация с фронта, данные разведки и допросов пленных стекались сюда, преобразуясь в сухие цифры, графики и карты на огромных интерактивных экранах.

Совместным решением Министерства магии и британского военного кабинета ей был передан в полное распоряжение бункер «Омега» — колоссальный подземный комплекс, высеченный в гранитных недрах Уэльса. Возведенный в разгар холодной войны для высшего руководства страны на случай глобального ядерного столкновения, теперь он был кардинально модернизирован. Метровые гермодвери из титанового сплава опутывали светящиеся жилы древних защитных чар, а магловские фильтры радиационной и химической защиты дублировались мощнейшими барьерами против ментального воздействия и Аппарации.
Здесь, на глубине трехсот метров под землей, Гермиона вела свои исследования. Их результаты в обязательном порядке учитывались при оперативном планировании всей оборонительной кампании. Шла ли речь о наступлении бронетехники маглов под Ноттингемом или о массированном магическом ударе на позиции орков в Йоркшире — ни одна крупная военная операция теперь не утверждалась без визы Грейнджер. Вся информация с фронта, данные разведки и допросов пленных стекались сюда, преобразуясь в сухие цифры, графики и карты на огромных интерактивных экранах.

И вот объяснение, почему он так делает (ответ нейросети):

Как это работает на практике

  1. Блок решает всё: Текст разбивается на куски (~1000 знаков).
  2. Сигнал тревоги: Алгоритм сканирует каждое предложение внутри этого куска и присваивает ему "вес подозрительности" (от 0 до 1).
  3. Триггер (порог): Если хотя бы одно предложение в блоке превышает определенный внутренний порог уверенности (например, 0.85), детектор игнорирует все остальные предложения в этом блоке и выносит вердикт: «Весь блок — ИИ».

То есть, одно «слишком красивое» предложение перевешивает десять «живых» и «корявых» в том же самом абзаце. Это связано не с «глупостью» алгоритма, а с тем, как его обучали.

Инженеры Яндекса рассуждают так:

«Если внутри блока есть предложение с идеально ровным распределением вероятностей (нейросетевым почерком), значит, автор использовал ИИ хотя бы для этой фразы. А раз использовал для фразы, значит, и весь блок мог быть написан с помощью ИИ или отредактирован им. Мы не рискуем и маркируем всё».

Это их сознательный выбор в пользу «лучше перебдеть, чем недобдеть».

Из этого правила вытекает забавный, но неприятный факт:

Если вы напишете 99% текста сами (с ошибками, обрывками, простой лексикой), но вставите одно единственное предложение, которое скопировали из классической литературы (например, Толстого или Набокова) или просто случайно сформулировали очень витиевато и литературно — детектор с вероятностью 90% заклеймит весь ваш текст как сгенерированный ИИ.

Он не скажет: «Здесь одно предложение странное». Он скажет: «Весь текст написан роботом».

Именно это и произошло с вашим вторым вариантом: вы дописали всего одну красивую логическую связку с тире («...— ни одна операция не утверждалась...»), и этого хватило, чтобы перевести весь объем в «красную зону».

PS: никаких выводов не делаю, просто информация к сведению.

+27
197

0 комментариев, по

11K 80 209
Мероприятия

Список действующих конкурсов, марафонов и игр, организованных пользователями Author.Today.

Хотите добавить сюда ещё одну ссылку? Напишите об этом администрации.

Наверх Вниз