VentureBeat 한국어
팔로우
SpaceXAI, Kimi K3의 성능을 능가하고 GPT-5.6과 동등한 인공 분석 세계 3위 기록을 달성한 Grok 4.6을 선보이다
SpaceXAI는 장기 에이전트, 코딩 및 지식 작업에 중점을 둔 최신 AI 모델인 Grok 4.6을 출시했습니다. 이 새로운 모델은 이전 모델인 Grok 4.5에 비해 상당한 개선을 보여줍니다. Grok 4.6은 제3자 벤치마크에서 경쟁력 있는 점수를 달성했으며, OpenAI의 GPT-5.6 Sol Max와 동률을 이루고 에이전트 및 코딩 작업에서 상당한 개선을 보였습니다. 성능은 뛰어나지만, Claude Opus 5 및 Fable 5와 같은 최상위 모델을 모든 평가에서 보편적으로 능가하지는 못합니다. Grok 4.6의 핵심 측면은 이러한 까다로운 워크로드에 대해 비용 효율적으로 설계된 가격 전략입니다. API 가격은 입력 토큰 백만 개당 2달러, 출력 토큰 백만 개당 6달러부터 시작하여 다른 선도적인 모델에 비해 중간 가격대에 속합니다. SpaceXAI는 Grok 4.6의 확장된 운영에서 컨텍스트 및 작업 초점을 유지하는 향상된 능력을 강조합니다. 이는 확장된 훈련 데이터와 에이전트 환경에서의 강화 학습을 통해 달성됩니다. 또한 이 모델은 더 강력한 자체 테스트 및 검증 기능을 보여줍니다. 그러나 Intelligence-versus-Cost-per-Task 분석에 따르면 작업당 경제성 측면에서는 일부 이전 모델이나 경쟁사만큼 경제적이지 않을 수 있습니다. 기업은 200,000개 이상의 프롬프트 토큰을 초과하면 요금이 크게 증가하므로 긴 컨텍스트에 대한 가격을 신중하게 고려해야 합니다. 기술적 성능 및 비용 외에도 Grok 브랜드는 안전, 편향 및 오용과 관련된 과거 논란으로 인해 상당한 부담을 안고 있습니다. 이러한 과거 문제는 Grok 4.6의 개선된 기능 및 가격 책정에도 불구하고 기업 채택에 영향을 미칠 수 있습니다.