Planet Python на русском
Подписаться
Армин Ронахер: Интерпретация панграма
Детектор ИИ под названием Pangram пометил твит Дэвида Сакса как сгенерированный ИИ, что Сакс оспорил, назвав детекторы ИИ фальшивыми. Pangram имеет низкий процент ложных срабатываний, однако ИИ-помощники для письма часто ошибочно идентифицируют человеческий текст как ИИ. Pangram работает, обучаясь на человеческом тексте, а затем просит ИИ переписать или отредактировать его, учась выявлять паттерны письма ИИ. Автор дал команду ИИ Opus 5 сгенерировать твит в стиле Дэвида Сакса о "Продвижении на переднем крае", основываясь на существующих публикациях Дарио и Сэма Альтмана. Сгенерированный твит утверждал, что OpenAI и Anthropic, обладая дуополией, должны продвигаться на переднем крае, поскольку это приносит им коммерческую и стратегическую выгоду. Твит также отвергал утверждения о том, что модели с открытым весом представляют основную опасность, и критиковал предложенный регуляторный подход. Pangram оценил этот сгенерированный твит как 100% ИИ. Затем автор вручную переписал твит, сохранив его структуру и идеи, стремясь получить от Pangram оценку "человек". Несмотря на значительное перефразирование и удаление скопированных предложений, этот переписанный человеком текст также получил от Pangram оценку 100% ИИ. Автор отмечает, что использование ИИ для первоначальной структуры может привести к плохим результатам обнаружения ИИ даже после обширного редактирования. Автор ценит Pangram за повышение осведомленности о влиянии использования ИИ и растущей зависимости от них при написании текстов. Однако автор задается вопросом, является ли оценка 100% ИИ справедливой для текста, который прошел существенное человеческое редактирование.