AI 모델
Google, Gemini 3.8 Flash와 신뢰된 방어자용 Cyber 버전 출시
Google은 Gemini 3.8 Flash와 Gemini 3.8 Flash Cyber를 공개하며 코딩, 추론, 취약점 발견, 자동 패치 능력 향상을 강조했다.
Google은 9월 2일 Gemini 3.8 Flash와 Gemini 3.8 Flash Cyber를 공개하며 장기 코딩, 에이전트형 워크플로, 방어적 사이버 보안을 위한 진전이라고 설명했다. Gemini 3.7 Flash 출시 후 몇 주 만의 업데이트지만 일반 Flash 모델은 2026년 말까지 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러의 도입 가격을 유지한다. Google은 Flash가 단지 저렴한 모델이 아니라 더 복잡하고 긴 작업을 처리할 수 있는 모델임을 강조하고 있다.
Gemini 3.8 Flash는 낮은 비용으로 지속적인 도구 사용이 필요한 개발자와 기업을 겨냥한다. Google에 따르면 새 모델은 소프트웨어 엔지니어링, 에이전트 작업, 전문 영역의 다단계 추론에서 3.7 Flash보다 개선됐다. 회사는 DeepSWE v1.1, Vals Finance Agent V2, Harvey’s Legal Agent Benchmark, HLE-Verified 등의 평가를 언급했고 HLE-Verified에서는 54.9% 점수를 냈다고 밝혔다. 핵심은 짧은 질문에 빠르게 답하는 모델이 아니라 복잡한 작업에서 여러 번 도구를 호출하고 결과를 검토하며 필요할 때 더 많은 추론을 수행하는 시스템이라는 점이다.
Gemini 3.8 Flash Cyber는 훨씬 더 제한적으로 제공된다. Google은 이를 자사의 가장 강력한 사이버 보안 모델이라고 설명하며 새 Fairwind Program을 통해 신뢰된 방어자에게 제공한다고 밝혔다. 이 모델은 Gemini 3.8 Flash와 같은 기반 지능을 공유하지만 취약점 발견과 자동 패치에 맞춰 조정됐다. Google은 CyberGym에서 자율 취약점 발견의 프런티어급 성능을 보였고, 20개 프로그래밍 언어의 복잡한 코드베이스를 포함한 내부 기준에서는 70%가 넘는 성공률을 기록했다고 설명했다.
Google은 공격보다 방어를 강조한다. Gemini 3.8 Flash Cyber는 보안팀이 취약점을 찾고 검증하고 수정하도록 돕는 모델로 설계됐다. Collinear가 운영하는 외부 패치 기준 CWE-Bench에서 Google은 pass@1 47.2%를 기록했다고 밝혔는데, 이는 더 큰 주요 프런티어 모델의 47.8%와 비슷하지만 비용은 훨씬 낮다고 설명했다. Chrome 보안팀은 이 모델이 Chrome 취약점에 대해 더 큰 상용 모델보다 2.6배 더 많은 올바른 패치를 만들었다고 했고, Wiz는 내부 침투 테스트 기준에서 더 높은 재현율과 낮은 비용을 확인했다고 전했다.
이번 출시는 대형 AI 연구소들이 사이버 능력을 별도의 배포 범주로 취급하고 있음을 보여준다. Gemini 3.8 Flash에는 화학, 생물, 방사능, 핵, 사이버 공격 영역의 악용을 막는 보호 조치가 포함된다. Cyber 버전은 사이버 보안 작업에 더 허용적이지만 Google이 신뢰된 방어자로 분류한 조직에만 제공된다. Google은 Gray Swan이 측정한 프롬프트 인젝션 견고성에서도 큰 진전이 있었다고 밝혔다. 신뢰할 수 없는 문서, 웹사이트, 코드를 읽는 에이전트에게 이는 실제 배포에서 중요한 요소다.
시장 관점에서 이번 발표는 경쟁 기준이 단순한 벤치마크 점수에 머물지 않는다는 점을 보여준다. 비용, 접근 제어, 운영 패키징도 중요해졌다. 개발자는 Google AI Studio, Gemini API, Android Studio, Google Antigravity, Gemini Enterprise, Gemini 앱, 검색의 AI Mode 등에서 Gemini 3.8 Flash를 사용할 수 있다. 반면 Cyber 모델은 더 민감한 기능으로 취급된다. 앞으로는 일반 추론 모델은 넓게 제공하고, 영향력이 큰 전문 버전은 심사를 거친 채널로 배포하는 방식이 더 흔해질 가능성이 크다.