Alphabet은 화요일에 Anthropic의 사이버 보안 리더십에 대한 가장 명확한 대응을 포함하여 세 가지 새로운 Gemini 모델을 공개했습니다. 회사는 제품 라인 지연과 경쟁 심화에 직면하면서 자사의 발전을 입증하려고 합니다.

Gemini 3.5 Flash Cyber는 소프트웨어 취약점을 감지하고 패치하도록 설계되었으며 처음에는 제한된 액세스 파일럿 프로그램을 통해 정부와 신뢰할 수 있는 파트너에게만 제공될 예정입니다. 구글은 이 특화된 모델이 더 큰 모델보다 단어당 가격이 더 저렴하다고 말합니다. 이는 Google이 자동화된 코드 방어 분야에서 초기 선두를 확립한 Anthropic을 통해 사이버 보안의 격차를 줄이는 데 도움이 됩니다.

Google은 또한 이전 세대 모델보다 최대 17% 적은 토큰을 사용하고 토큰당 단위 비용을 낮추는 동시에 인코딩, 다중 모드 및 지식 작업 성능을 향상시킨 Gemini 3.6 Flash를 출시했습니다. 이는 처리량이 많은 작업 부하를 실행하는 데 상당한 비용 절감을 의미합니다.

한편 Gemini 3.5 Flash-Lite는 Google 3.5 시리즈 중 가장 빠르고 저렴한 모델로 대규모 AI 에이전트 시스템에서 높은 처리량의 워크로드와 소규모 작업을 위해 구축되었습니다. 더 폭넓은 제품 라인은 가격과 효율성이 여러 주요 제품 범주에서 느린 출시를 상쇄하는 데 도움이 될 것이라는 Google의 확신을 반영합니다.

인공 분석 데이터에 따르면 Gemini Flash는 이미 Anthropic, OpenAI 및 중국 경쟁사의 동급 모델보다 비용이 저렴합니다. Google에 따르면 두 가지 새로운 모델 중 더 많은 기능을 갖춘 Gemini 3.6 Flash는 GPT-5.6 Terra Max, Kimi K3 및 Qwen 3.7 Max보다 작업당 비용이 더 저렴하고 3.5 Flash-Lite의 비용은 그보다 훨씬 저렴합니다.

이러한 요구는 AI 경쟁의 또 다른 측면을 강조합니다. 경쟁력 있는 모델을 구축하는 것은 도전의 일부일 뿐입니다. 기업은 또한 규모에 맞게 서비스를 제공할 수 있는 충분한 컴퓨팅 성능도 필요합니다. Google은 자체적으로 용량 제약에 직면했지만 칩, 클라우드 인프라, 소프트웨어 및 하드웨어 공동 엔지니어링 능력을 통해 잠재적인 이점을 갖고 있습니다.

화요일 모델 출시는 Google이 인공 지능 서비스 비용을 낮추기 위한 광범위한 노력의 일환으로 Gemini를 최대 10배 더 효율적으로 실행할 수 있도록 설계된 특수 칩을 개발하고 있는 것으로 알려졌습니다. 구글 클라우드 대변인은 성명을 통해 자사 팀은 "사용자와 고객에게 최대의 성능과 효율성을 제공하기 위해 계속해서 새로운 혁신을 연구하고 시도하고 있다"며 "모든 프로젝트가 프로덕션 단계로 진행되는 것은 아니지만 이러한 엄격한 탐색은 우리의 풀 스택 접근 방식의 핵심"이라고 밝혔습니다. "우리의 하드웨어와 소프트웨어를 처음부터 공동 엔지니어링함으로써 우리는 시스템이 통합되고 실제 작업 부하에 고도로 최적화되도록 보장합니다."라고 성명서는 계속되었습니다.

Google은 또한 지연에 대한 질문에 직면한 후 제품 로드맵을 더욱 투명하게 만들고 있습니다. Gemini 3.5 Pro는 현재 더 폭넓은 출시를 준비하기 위해 파트너와 함께 테스트 중이며 회사는 사상 최대 규모의 Gemini 4 사전 훈련 실행을 시작했습니다.