Google의 Gemini 3.6 Flash 모델, 장... 노트

Google의 Gemini 3.6 Flash 모델, 장기 엔지니어링 작업에서 AI 에이전트 토큰 비용 최대 65% 절감 — 3.5 Pro도 출시 예정

Google DeepMind가 세 가지 새로운 독점 AI 모델인 Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber를 출시했습니다. 이 모델들은 더 많은 토큰 효율성을 갖도록 설계되어 AI 에이전트를 더 빠르고, 더 똑똑하며, 대규모 운영 시 더 저렴하게 만들었습니다. Gemini 3.6 Flash는 입력 토큰 백만 개당 1.50달러, 출력 토큰 백만 개당 7.50달러로 가격이 책정되었으며, Gemini 3.5 Flash-Lite는 각각 0.30달러와 2.50달러로 훨씬 저렴합니다. 비교하자면, Gemini 3.1 Flash-Lite와 같은 이전 모델들은 여전히 가장 비용 효율적이지만 속도가 느립니다. 새로운 Gemini 3.5 Flash-Lite는 절대적으로 가장 낮은 비용보다 성능을 우선시하는 기업을 위해 향상된 속도를 제공합니다. Gemini 3.6 Flash와 3.5 Flash-Lite는 특정 벤치마크에서 토큰 사용량을 최대 65%까지 줄여 주목할 만한 효율성 향상을 달성했습니다. 이 모델들은 백만 개의 토큰 입력 컨텍스트 창과 64,000개의 토큰 출력 제한을 특징으로 합니다. Gemini 3.6 Flash는 복잡한 코딩 및 지식 작업에 적합하며, 3.5 Flash-Lite는 고처리량, 저지연 애플리케이션에 탁월합니다. Gemini 3.5 Flash Cyber는 사이버 보안 연구를 위한 특수 모델로, 일부 파트너에게 제공됩니다. 이 모든 모델은 독점적이며 폐쇄 소스이며 Google의 API를 통해서만 액세스할 수 있습니다. 주목할 만한 점은, 많은 기대를 모았던 Gemini 3.5 Pro 플래그십 모델은 여전히 파트너 테스트 중이라는 것입니다. 이번 출시는 에이전트 AI 기능에 대한 집중을 나타내며, Flash 시리즈는 이전의 연료를 많이 소비하는 모델에 비해 효율적인 배달 차량에 비유됩니다.
CdXz5zHNQW_QEx9g1QmkG.png