Claude Sonnet 4.5、SWE-Bench検証で... ノート
InfoQ 日本語

Claude Sonnet 4.5、SWE-Bench検証でトップの成績、30時間以上のコーディングに焦点を拡大

AnthropicのClaude Sonnet 4.5は、同社の最も高度なコーディングモデルであり、タスクのパフォーマンスと安全性において優れています。安全性スコアは98.7%に達し、実世界のコーディング能力を向上させています。強化された推論スキルにより、継続的なマルチステップタスクが可能になり、ユーザーは著しい利益を得ています。このドロップインの代替モデルは、ユーザーにとって強力な能力とセキュリティのバランスを示しています。著者:Hien Luu
CdXz5zHNQW_OcmOujUG6G.jpeg