VentureBeat на русском
Подписаться
SpaceXAI представляет Grok 4.6, превосходящий Kimi K3 по производительности и сравнивающийся с GPT-5.6 Sol по третьему месту в мире в рейтинге Artificial Analysis.
SpaceXAI выпустила Grok 4.6, свою последнюю модель ИИ, ориентированную на долгосрочные агенты, программирование и интеллектуальный труд. Эта новая модель демонстрирует значительные улучшения по сравнению с предшественником, Grok 4.5. Grok 4.6 показывает конкурентоспособный результат на сторонних бенчмарках, сравниваясь с GPT-5.6 Sol Max от OpenAI и значительно улучшаясь в задачах, связанных с агентами и программированием. Хотя модель работает хорошо, она не превосходит лучшие модели, такие как Claude Opus 5 и Fable 5, во всех оценках. Ключевым аспектом Grok 4.6 является его ценовая стратегия, разработанная для экономической эффективности при выполнении этих требовательных рабочих нагрузок. Цена API начинается с 2 долларов за миллион входных токенов и 6 долларов за миллион выходных токенов, что делает ее среднеценовой по сравнению с другими ведущими моделями. SpaceXAI подчеркивает улучшенную способность Grok 4.6 поддерживать контекст и фокусироваться на задачах в течение длительных операций. Это достигается за счет расширенных обучающих данных и обучения с подкреплением в агентных средах. Модель также демонстрирует более сильные возможности самотестирования и верификации. Однако анализ "интеллект против стоимости за задачу" указывает на то, что она может быть не такой экономичной, как некоторые предшественники или конкуренты, в расчете на одну задачу. Предприятия должны тщательно учитывать ценообразование для более длинных контекстов, поскольку ставки значительно возрастают при превышении 200 000 токенов запроса. Помимо технических характеристик и стоимости, бренд Grok несет значительный багаж из-за прошлых споров, касающихся безопасности, предвзятости и злоупотреблений. Эти исторические проблемы могут повлиять на внедрение в предприятиях, независимо от улучшенных возможностей и ценообразования Grok 4.6.