본문 바로가기
성공지식백과 로고성공지식백과

Gemini 3.8 Flash와 Cyber 공개, 같은 Flash 이름 아래에서 달라진 접근 범위와 비용

Google이 Gemini 3.8 Flash와 보안 전용 Gemini 3.8 Flash Cyber를 공개했습니다. 일반 Flash는 더 많은 추론과 도구 호출을 쓸 수 있어, 단가가 같은 도입 기간에도 총 토큰 비용은 작업 방식에 따라 달라집니다.

GeminiGoogle AIAI 코딩사이버 보안
정성준 5분 읽기
공유:
Gemini 3.8 Flash와 3.8 Flash Cyber 이름이 적힌 Google 공식 발표 배너
Google의 Gemini 3.8 Flash·Flash Cyber 공식 발표 배너. · Google

Google은 9월 2일 Gemini 3.8 Flash와 Gemini 3.8 Flash Cyber를 함께 공개했습니다. 이름은 비슷하지만 쓰는 자리와 접근 방식은 다릅니다. 3.8 Flash는 코딩·에이전트·복잡한 기업 업무를 위한 일반 모델이고, 3.8 Flash Cyber는 취약점 탐지와 패치에 초점을 둔 보안 모델입니다. Cyber는 누구나 API에서 바로 고를 수 있는 공개 모델이 아니라 Fairwind Program을 통한 승인된 신뢰 파트너에게 제공됩니다.

이번 발표에서는 3.8 Flash가 어떤 계산을 쓰는지도 봐야 합니다. Google은 3.8 Flash가 복잡한 작업에서 더 많은 추론 단계를 거치고 도구를 반복 호출할 수 있다고 설명합니다. 같은 요청을 처리하는 데 모델이 쓰는 토큰이 늘 수 있으므로, 입력·출력 단가가 낮다고 해서 작업 한 건의 총비용까지 이전과 같다고 단정할 수는 없습니다.

같은 Flash 가격이 곧 같은 사용량은 아니다

Google의 발표 기준으로 3.8 Flash의 도입 가격은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러입니다. 이 가격은 2026년 12월 31일까지 적용됩니다. 2027년 1월 1일부터는 입력 100만 토큰당 1.50달러, 출력 100만 토큰당 7.50달러가 적용된다고 Google은 밝혔습니다.

현재 Gemini API 가격표도 출력 가격에 추론 토큰이 포함된다고 명시합니다. 높은 추론 수준에서 결과를 평가할 때는 응답 품질만 비교할 일이 아닙니다. 같은 프롬프트를 낮은 추론 수준과 높은 추론 수준으로 실행해 입력·출력 토큰, 도구 호출 횟수, 재시도 횟수를 함께 기록해야 합니다. 모델이 한 번에 더 오래 생각해 재작업을 줄이는 경우도 있고, 단순한 작업에 불필요한 토큰을 쓰는 경우도 있을 수 있습니다.

Google은 계산 효율이 가장 중요한 경우 낮은 추론 수준을 쓰거나 3.7 Flash를 계속 선택할 수 있다고 안내합니다. 이 말은 3.8 Flash가 항상 3.7 Flash를 대신해야 한다는 뜻이 아닙니다. 빠른 분류나 짧은 변환처럼 결과를 빠르게 받아야 하는 업무와, 여러 도구를 이어 쓰는 긴 코딩 업무는 같은 기준으로 비교하기 어렵습니다.

모델 문서에서 확인할 수 있는 범위

Gemini 3.8 Flash의 공식 모델 문서는 입력 최대 1,048,576토큰, 출력 최대 65,536토큰을 안내합니다. 텍스트·이미지·동영상·오디오·PDF를 입력으로 받을 수 있고, 출력은 텍스트입니다. Thinking은 low, medium, high를 지원하지만 minimal은 지원하지 않아 오류를 반환한다고 적혀 있습니다.

이 모델 문서에는 코드 실행, 함수 호출, 파일 검색, 검색 그라운딩, 구조화 출력 같은 기능도 지원 항목으로 올라와 있습니다. 컴퓨터 사용은 Preview 상태이고, 이미지 생성·Live API·오디오 생성은 지원하지 않는다고 명시합니다. 모델의 추론 성능을 보고 도입하더라도, 실제 서비스에 필요한 입출력 형식과 도구가 그 모델에서 제공되는지는 별도로 확인해야 합니다.

Google이 제시한 성능 수치도 조건을 붙여 읽어야 합니다. 회사는 3.8 Flash가 HLE-Verified에서 54.9%를 기록했다고 발표했고, DeepSWE v1.1과 전문 분야 벤치마크에서 3.7 Flash 및 다른 모델보다 나았다고 설명합니다. 이는 Google이 선택한 벤치마크와 설정에서의 결과입니다.

Cyber는 일반 Flash의 보안 모드가 아니다

Gemini 3.8 Flash Cyber는 Fairwind Program을 통해 신뢰할 수 있는 방어자에게 우선 제공됩니다. Google은 정부·국가 사이버 기관, 핵심 인프라 운영자, 주요 소프트웨어 기반을 지키는 조직을 접근 우선순위의 예로 듭니다. 파트너는 Cyber에 독점적으로 접근하며, 일반 Gemini API의 모델 목록에 나타나는 3.8 Flash와 같은 방식으로 누구나 사용할 수 있는 구조가 아닙니다.

접근 조건도 모델 성능과 별개로 중요합니다. Fairwind 참여 조직은 사용자 단위 인증, 피싱 저항 MFA, 적용 가능한 접근 통제를 갖추고, Cyber 접근을 내부 사이버 보안·사고 대응·침투 테스트 팀에만 부여해야 합니다. 조직은 직원별 접근과 사용을 추적해야 하며, 접근을 다른 조직에 공유·재배포·판매할 수 없습니다. 승인된 방어·학술 연구 목적의 위협 시뮬레이션, 리버스 엔지니어링, 악성코드 분석은 허용되지만 악성코드 제작은 허용되지 않는다고 Google은 설명합니다.

Cyber 성능 수치는 무엇을 말하나

Google은 CyberGym Pass@1에서 3.8 Flash Cyber가 86.2%를 기록했다고 공개했습니다. 같은 페이지는 20개 프로그래밍 언어에 걸친 Google 내부 취약점 탐지 평가에서 71.0%를 제시합니다. 이 중 전자는 산업 벤치마크라고 Google이 소개하고, 후자는 Google 내부 평가입니다. 둘을 같은 독립 검증 수준으로 묶어서는 안 됩니다.

패치 성능에서 Google은 외부 CWE-Bench의 Pass@1 47.2%를 들며 비교 대상 47.8%와 함께 제시했습니다. 발표문에 적힌 ‘더 낮은 비용’은 해당 벤치마크 조건에서의 비교 결과입니다. 조직의 코드베이스와 취약점 유형, 사람이 검토하는 시간까지 포함한 운영 비용은 이 수치와 별도로 계산해야 합니다.

3.8 Flash Cyber가 일반 Flash보다 보안 관련 완화 조치를 더 넓게 적용할 수 있다는 점도 접근 제한의 이유입니다. Google은 Cyber가 더 포괄적인 보안 역량을 필요로 하는 신뢰할 수 있는 방어자에게만 제공된다고 설명합니다. ‘Cyber’라는 이름만으로 일반 개발 작업의 대체재로 판단하기보다, 승인 가능 여부와 방어 목적의 사용 통제를 확인해야 합니다.

도입 판단은 모델명과 API 단가를 나눠서

일반적인 코딩·에이전트 업무라면 3.8 Flash를 같은 작업 세트로 3.7 Flash와 비교해 보는 방식이 출발점이 될 수 있습니다. 이때는 정확도, 실행 시간, 총 토큰, 재시도, 도구 호출을 함께 기록해야 합니다. 도입 가격은 12월 31일에 끝나고 1월 1일 가격이 바뀐다는 일정도 예산에 따로 반영해야 합니다.

Cyber를 검토하는 조직은 성능 수치와 함께 Fairwind 승인 및 운영 요건을 확인해야 합니다. 승인 대상이 아니면 Cyber는 선택 가능한 API 모델에 포함되지 않습니다. 이번 발표는 Flash 계열이 더 넓은 계산을 쓰는 방향으로 변하고, 보안용 모델의 접근은 더 제한적으로 설계됐다는 사실을 함께 보여 줍니다.

함께 읽으면 좋은 기사

출처

  1. Introducing Gemini 3.8 Flash and 3.8 Flash CyberGoogle · 발행 · 확인
  2. Gemini 3.8 Flash | Gemini APIGoogle AI for Developers · 확인
  3. Gemini Developer API pricingGoogle AI for Developers · 확인
  4. Fairwind ProgramGoogle DeepMind · 확인
  5. Gemini 3.8 Flash CyberGoogle DeepMind · 확인