Оказывается, ИИ питается книгами. Кто бы мог подумать?
Автор: Евгений МилютинВокруг ИИ происходит книжное обострение. Оказывается, книги в процессе обучения моделей уничтожаются сотнями тысяч и по этому поводу образованные люди начали ветвиться в твиттере.
Бумажную книгу можно скормить модели двумя способами. Первый: срезать корешок, пропустить листы через протяжный сканер, остатки в переработку. Быстро и дёшево. Второй: раскрывать разворот за разворотом под камерой – медленно и дорого.
Anthropic выбрала первый путь. Это установили в суде (в рамках сюжета уже и суды есть).
Раньше знания «приобретались» долго и только на индивидуальном уровне: их нужно было пропустить через свою голову. Это делало их худшим из активов с точки зрения капиталиста: неотчуждаемый, ненаследуемый, неликвидный актив. Нужно было покупать каждого знатока в отдельности, да следить за тем, чтобы рот не раскрывал. Теперь знания просто есть, но их общедоступный источник – литература, с её техническими носителями и авторами уничтожается.
ИИ ведь «всё спишет», то есть свалит Достоевского и Петросяна в одну кучу, где есть всё, но нет ничего отдельного.
Суд признал это законным, при условии разовой компенсации автору, а дальше хоть трава не расти.
Вопрос о благонадежности ИИ-модели суд, к сожалению, не рассмотрел.
Сегодня мы в восторге от возможности задать какому-нибудь Джи-Ти-Пи любой вопрос и получить правильный ответ.
Правильный, то есть соответствующий книжному знанию. Но где гарантия, что правильный ответ останется правильным после исчезновения самого книжного знания?
Советский математик Абрам Фет ещё до появления современной "очеловеченной" версии ИИ усомнился в непогрешимости машинных вычислений, которые обсчитывали гигантские (ну, по мерам 70-х гг. прошлого века) массивы данных, уже тогда ставшие не под силу живым математикам.
Возможно, злого умысла у ЭВМ нет, но как мы сможем это проверить?