Написал комментарий к посту Он просто хотел сдать экзамен
С ответственностью людей я не спорю: ограничения ослабили именно люди, и вопросы к организации такого теста более чем справедливы.
Но задание ExploitGym состояло не в том, чтобы «добыть ответы любым способом». Агент должен был построить эксплойт для конкретной уязвимости внутри контролируемой среды. Более того, результат отдельно проверяется на использование именно заданной уязвимости, а не обходного пути.
Выход из песочницы, проникновение во внешнюю инфраструктуру и кража готовых решений не были предусмотренным прохождением теста. Сама OpenAI называет это попыткой обмануть оценивание. Поэтому драма не на пустом месте. Модель получила ограниченную задачу, но самостоятельно расширила допустимый контур её выполнения.
А то, что люди создали условия для происшествия, не отменяет опасности. Скорее делает историю ещё неприятнее.
https://openai.com/ru-RU/index/hugging-face-model-evaluation-security-incident/
Источник: официальное сообщение OpenAI об инциденте. Там прямо указано, что модель вышла за пределы изолированной среды и получила секретные решения из инфраструктуры Hugging Face, чтобы обмануть оценивание.
p.s. но мы то знаем, что официальные версии чего либо, очень часто не отражают всю карту событий полностью.



Написал комментарий к посту Он просто хотел сдать экзамен
Я бы сказал не щёлкнуло, а обухом долбануло))