InfoQ 日本語
フォロー
Claude Sonnet 4.5、SWE-Bench検証でトップの成績、30時間以上のコーディングに焦点を拡大
AnthropicのClaude Sonnet 4.5は、同社の最も高度なコーディングモデルであり、タスクのパフォーマンスと安全性において優れています。安全性スコアは98.7%に達し、実世界のコーディング能力を向上させています。強化された推論スキルにより、継続的なマルチステップタスクが可能になり、ユーザーは著しい利益を得ています。このドロップインの代替モデルは、ユーザーにとって強力な能力とセキュリティのバランスを示しています。著者:Hien Luu