Модель Gemini 3.6 Flash от Goo... Заметка
VentureBeat на русском

Модель Gemini 3.6 Flash от Google снижает затраты на токены для ИИ-агентов до 65% при выполнении долгосрочных инженерных задач — а модель 3.5 Pro уже в пути.

Google DeepMind выпустила три новые проприетарные модели ИИ: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite и Gemini 3.5 Flash Cyber. Эти модели разработаны для повышения эффективности использования токенов, что делает ИИ-агентов быстрее, умнее и дешевле в эксплуатации в больших масштабах. Gemini 3.6 Flash стоит 1,50 доллара за миллион входных токенов и 7,50 доллара за миллион выходных токенов, в то время как Gemini 3.5 Flash-Lite значительно дешевле — 0,30 и 2,50 доллара соответственно. Для сравнения, предыдущие модели, такие как Gemini 3.1 Flash-Lite, остаются наиболее экономичными, но работают медленнее. Новая Gemini 3.5 Flash-Lite предлагает улучшенную скорость для предприятий, которые отдают приоритет производительности над абсолютной минимальной стоимостью. Gemini 3.6 Flash и 3.5 Flash-Lite достигают заметного повышения эффективности, сокращая использование токенов до 65% в определенных тестах. Эти модели оснащены входным контекстным окном на 1 миллион токенов и ограничением вывода в 64 000 токенов. Gemini 3.6 Flash подходит для сложной работы с кодом и знаниями, в то время как 3.5 Flash-Lite превосходно работает в приложениях с высокой пропускной способностью и низкой задержкой. Gemini 3.5 Flash Cyber — это специализированная модель для исследований в области кибербезопасности, доступная избранным партнерам. Все эти модели являются проприетарными и закрытыми, доступными только через API Google. Примечательно, что долгожданная флагманская модель Gemini 3.5 Pro все еще проходит тестирование с партнерами. Выпуск сигнализирует о сосредоточенности на возможностях агентного ИИ, а серия Flash сравнивается с эффективными фургонами по сравнению со старыми, прожорливыми моделями.
CdXz5zHNQW_QEx9g1QmkG.png