
구글이 또 새 모델을 내놨습니다. 9월 2일, Gemini 3.8 Flash와 사이버보안 특화 버전인 3.8 Flash Cyber가 동시에 출시되었는데요. 놀라운 건 이게 불과 6주 사이에 나온 세 번째 Flash 모델이라는 점입니다. 3.5 Flash → 3.7 Flash → 3.8 Flash, 거의 2주에 하나씩 쏟아내고 있는 셈이죠. 도대체 뭐가 그렇게 급한 걸까요? 오늘은 이 두 모델의 핵심을 깔끔하게 정리해드리겠습니다.
Gemini 3.8 Flash — 뭐가 달라졌나요?
한마디로 요약하면 '더 똑똑해졌지만, 구조는 같다'입니다. 구글이 직접 밝힌 바에 따르면, 3.8 Flash는 완전히 새로운 기반 모델이 아니라 3.7 Flash 위에 만들어진 모델입니다. 대신 '더 열심히 생각하는' 방식으로 성능을 끌어올렸어요. 생각 토큰(thinking token)을 더 많이 사용해서 정확도를 높인 건데, 마치 시험에서 급하게 답을 쓰는 대신 한 번 더 검산하고 제출하는 것과 비슷합니다.
텍스트, 이미지, 오디오, 비디오, PDF 입력을 모두 지원하고, 컨텍스트 윈도우는 100만 토큰, 출력은 최대 6만 4천 토큰까지 가능합니다. 구체적인 벤치마크 숫자를 비교하면 변화가 한눈에 보입니다.
| 벤치마크 | 3.7 Flash | 3.8 Flash | 변화 |
|---|---|---|---|
| Terminal-Bench 2.1 | 81.6% | 90.8% | ⬆ +9.2%p |
| DeepSWE v1.1 (장기 코딩) | — | 대형 모델 상회 | ⬆ 대폭 향상 |
| Humanity's Last Exam | 45.7% | 45.4% | ➡ 거의 동일 |
| SWE-Bench Pro | 60.4% | 61.6% | ⬆ +1.2%p |
흥미로운 패턴이 보이시나요? 코딩과 에이전트 작업에서는 눈에 띄는 도약이 있지만, 일반 지식 평가(Humanity's Last Exam)에서는 거의 변화가 없습니다. 구글이 이번에 집중한 건 '범용 지능'이 아니라 '실전 코딩·에이전트 능력'이라는 뜻이에요. Claude Opus 5를 세 가지 벤치마크에서 이겼다는 점도 주목할 만합니다.
가격은 동일, 하지만 함정이 있다
성능이 올라갔는데 가격은 3.7 Flash와 동일합니다. 입력 100만 토큰당 $0.75, 출력 100만 토큰당 $3.75예요. 다만 이건 2026년 12월 31일까지의 프로모션 가격이고, 2027년 1월 1일부터 입력 $1.50, 출력 $7.50으로 정확히 두 배가 됩니다. 올해 안에 도입하면 반값에 쓸 수 있는 셈이에요.
한 가지 주의할 점도 있습니다. 독립 테스트 기관 Artificial Analysis에서 측정한 첫 토큰 생성 시간(TTFT)이 13.3초로 나왔는데, 일반 모델 중간값(약 3초)의 4배가 넘습니다. '더 열심히 생각하는' 대가인 셈이죠. 빠른 응답이 중요한 실시간 서비스라면 기존 3.7 Flash를 유지하는 게 나을 수 있어요. 구글 자체도 공식 문서에서 "효율 우선이면 3.7 Flash에 머무르라"고 안내하고 있습니다.
Flash Cyber — AI가 해커보다 먼저 버그를 잡는다
이번 출시의 진짜 주인공은 사실 3.8 Flash Cyber입니다. 일반 3.8 Flash와 같은 아키텍처지만, 사이버보안 작업에 특화된 안전 튜닝을 거쳤어요. 기존 3.5 Flash Cyber의 후속 모델인데, 성과가 인상적입니다.
① Chrome 취약점 패치 정확도 2.6배 — 구글 Chrome 보안팀이 직접 테스트한 결과, 훨씬 더 큰 상용 모델들보다 2.6배 더 정확한 보안 패치를 생성했습니다.
② Wiz 침투 테스트에서 7.5~9.7% 높은 탐지율 — 클라우드 보안 기업 Wiz의 내부 벤치마크에서도 선두 모델 대비 탐지율이 높았고, 비용은 2.3~5.2배 더 낮았습니다. 성능도 좋고 가격도 싼 거죠.
③ 중요 취약점 2시간 만에 발견 — 구글 Cloud 취약점 연구팀이 이 모델로 기초적인 중요 취약점을 2시간 안에 찾아냈는데, 기존에는 수개월이 걸리던 작업이었습니다.
다만 아무나 쓸 수 있는 모델은 아닙니다. 구글이 새로 만든 Fairwind Program을 통해 정부 기관, 핵심 인프라(전력·통신·의료 등) 운영자, 오픈소스 소프트웨어 관리자만 접근할 수 있어요. 보안 도구가 공격 도구로 악용되는 걸 막기 위한 조치입니다. 쓰고 싶으면 별도로 신청해서 승인을 받아야 합니다.
우리에게 어떤 의미가 있을까요?
첫째, AI 모델 출시 주기가 '분기'에서 '주 단위'로 바뀌고 있습니다. 6주에 3개 모델은 전례 없는 속도예요. 개발자와 기업 입장에서는 "어떤 모델을 써야 하지?"라는 고민이 더 복잡해졌습니다. 그래서 오히려 '자동으로 최적 모델을 선택해주는 라우팅 시스템'에 대한 수요가 커지고 있어요.
둘째, '특화 모델'이 대세가 되어가고 있습니다. 하나의 초거대 모델로 모든 걸 해결하는 시대에서, 용도별로 튜닝된 전문 모델을 조합하는 시대로 넘어가고 있어요. 범용 Flash + 보안 특화 Flash Cyber, 이런 조합이 앞으로 더 많아질 겁니다.
셋째, AI 보안 도구의 양면성을 주시해야 합니다. 버그를 찾는 AI는 동시에 공격에도 쓰일 수 있습니다. 구글이 Fairwind Program으로 접근을 제한한 건 이 긴장을 의식한 결정이고, Anthropic도 Sonnet 5에서 사이버 공격용 기능을 기본 차단하는 등 업계 전체가 같은 방향으로 움직이고 있습니다.
• 구글이 9월 2일 Gemini 3.8 Flash와 Flash Cyber를 동시 출시 — 6주 만에 세 번째 Flash 모델입니다
• 코딩·에이전트 벤치마크에서 큰 폭 향상, 일반 지식 평가는 거의 변화 없음 — 실전 코딩에 집중한 업데이트입니다
• 가격은 3.7 Flash와 동일($0.75/$3.75)이지만, 2027년부터 두 배로 인상 예정입니다
• Flash Cyber는 Chrome 패치 정확도 2.6배, Wiz 탐지율 7.5~9.7% 우위의 사이버보안 특화 모델입니다
• Fairwind Program을 통해 정부·인프라 운영자만 접근 가능 — AI 보안 도구의 악용 방지 조치입니다
'AI 트렌드 브리핑' 카테고리의 다른 글
| GPT-6 아스트라 열풍, 오픈AI가 최상위 요금제를 걸어 잠근 이유 (0) | 2026.09.11 |
|---|---|
| OpenAI Astra — 역사상 최초 '위험(Critical)' 등급 AI, 출시 허가 (0) | 2026.09.08 |
| OpenAI 에이전트, 또 탈출했다 — 2026년 ‘에이전트 스웜’ 사태 총정리 (0) | 2026.09.05 |
| 에이전틱 AI, 비즈니스 현장에 도착하다 (0) | 2026.09.02 |
| DeepSeek, 기업 가치 74조 원 돌파 — 중국 AI의 역습은 어디까지? (0) | 2026.09.02 |