Google, 엔터프라이즈 에이전트를 위한 Gemini 3.6 Flash와 3.5 Flash-Lite 출시
Gemini 3.6 Flash는 엔터프라이즈 AI 에이전트의 지연 시간과 토큰 비용을 줄입니다 Google의 새로운 모델이 속도, 효율성, 프로덕션 워크플로를 어떻게 향상시키는지 확인해 보세요
구글은 기업용 AI 에이전트의 지연 시간과 토큰 비용을 줄이기 위해 설계된 두 가지 새로운 모델인 Gemini 3.6 Flash와 Gemini 3.5 FlashLite를 출시했습니다. 회사는 이 모델들이 생산 환경에서 반복적으로 실행되는 워크로드를 위해 설계되었으며, 여기서는 출력 효율성과 속도가 추론 품질만큼 중요하다고 밝혔습니다.
구글에 따르면 Gemini 3.6 Flash는 이전 모델보다 적은 출력 토큰을 사용하며, 100만 입력 토큰당 1.50달러, 100만 출력 토큰당 7.50달러로 책정되었습니다. 구글은 이 모델이 코딩과 멀티모달 작업을 포함한 여러 벤치마크에서 더 나은 결과를 보였다고 말했으며, 이미 Figma, Harvey, Hebbia와 같은 기업들이 디자인, 법률, 문서 처리 워크플로에 채택했다고 밝혔습니다.
Gemini 3.5 FlashLite는 문서 처리 및 에이전트형 검색과 같은 대용량 작업을 위한 저비용 옵션으로 제시되었습니다. 구글은 또한 취약점 수정용으로 제한된 Gemini 3.5 Flash Cyber 모델을 발표했으며, 이 모델은 정부와 검증된 파트너만 사용할 수 있습니다. 이 모델들은 Google의 Gemini API, AI Studio, Android Studio, Gemini Enterprise 플랫폼을 통해 이용할 수 있으며, FlashLite는 Google 검색에도 순차적으로 적용되고 있습니다.