AIはまだCAPTCHAに苦戦しているのでしょうか?
Anthropicの最近のセキュリティインシデントに関する文書には、CAPTCHAが依然としてClaudeを悩ませていることについて少し触れられています。トランスクリプトでは、Anthropicがアクセスを制限しているほど強力なClaudeモデルが、単純な画像識別テストを解くのに仮想的に頭を壁に打ち付けているように見えました。エージェントが他の画像と一致しない形状を識別するように求められたテストでは、どの画像を選択するかさえ決定できませんでした。代わりに、同じ画像を繰り返し確認し、自身の結論に疑問を呈しました。「実際、うーん、待って」と、思考連鎖のトランスクリプトで述べ、後に「うっ」と付け加えました。これは、何らかの理由でこれらのマシンに人間の振る舞いを注入する必要があると私たちが決定したためです。このプロセス全体に時間がかかりすぎたため、エージェントは最終的にチャレンジが期限切れになり、プロセスをやり直さなければならないことに気づきました。