ИИ помог Папе Римскому написать манифест об опасности ИИ. Исследователи подозревают Claude
Папа Лев XIV выпустил первую в своем понтификате энциклику Magnifica Humanitas — программный документ о защите человека в эпоху искусственного интеллекта, где технологическую гонку он сравнивает с возведением новой Вавилонской башни. Понтифик призывает "разоружить" ИИ, предупреждает о новых формах рабства в цифровой экономике и об эрозии демократии. Ирония в том, что вскоре после публикации детекторы показали: часть текста манифеста против ИИ, похоже, написана самим ИИ.
Первым на это обратил внимание исследователь под ником Линч Чжан: прогнав первую главу через детектор Pangram, он получил отметку "написано ИИ" для 62% фрагмента. Эксперимент повторило издание The Verge — на выборке около двух тысяч слов Pangram дал в среднем 46%, причем по отдельным абзацам разброс шел от 40 до 100%. Картина при этом лоскутная: одни абзацы детектор уверенно считает машинными, другие — стопроцентно человеческими.
Дальше Чжан сделал шаг, который детектор сделать не может, — попытался опознать конкретную модель. По его наблюдению, "почерк" принадлежит Claude от Anthropic: слово "genuinely" встречается в Magnifica Humanitas девять раз против нуля в сопоставимой по объему энциклике Dilexit Nos, а число длинных тире выросло со нуля до 127. Маркеры, которые исследователь связывает с ChatGPT ("delve", "tapestry", "meticulous"), в тексте не нашлись вовсе. Сам автор честно оговаривается, что доказательства слабые и, возможно, ошибочные: и тире, и "genuinely" — обычные черты живого академического и религиозного письма, а не клеймо нейросети.
Из своих же данных Zhang делает аккуратный вывод: раз многие абзацы абсолютно чисты, речь не о том, что весь документ написал бот. Вероятнее, кто-то из высокопоставленных сотрудников Курии активно пользовался
Читать на habr.com