본문 바로가기
AI2026년 7월 21일2분 읽기

구글, Gemini 3.6 Flash 공개 — 출력 토큰 17% 절감·가격 인하

YS
김영삼
조회 294
구글, Gemini 3.6 Flash 공개 — 출력 토큰 17% 절감·가격 인하

핵심 요약

구글이 7월 21일 Gemini 3.6 Flash를 출시했다. 3.5 Flash 대비 출력 토큰을 약 17% 절감(같은 답변을 더 적은 토큰으로)하고 가격도 내렸다. 지식 컷오프가 2026년 3월로 확장됐고, 같은 날 GitHub Copilot에서도 사용 가능해졌다.

1. 주요 내용

항목내용
효율Artificial Analysis 기준 출력 토큰 약 17% 절감
가격(100만 토큰)입력 $1.50 / 출력 $7.50 (기존 출력 $9)
지식 컷오프2025년 1월 → 2026년 3월
함께 공개3.5 Flash-Lite, CodeMender용 3.5 Flash Cyber

2. 로드맵

  • 구글은 Gemini 4 사전학습 시작을 밝혔다
  • 다만 상위 모델 Gemini 3.5 Pro는 여전히 출시 지연
  • GitHub Copilot에 당일 통합 — 개발 도구 접근성 강화

3. 의미

Flash 계열은 "빠르고 싼" 대량 처리용 모델이다. 토큰 효율을 높이고 가격을 내린 것은, AI 추론 비용 경쟁이 플래그십 성능뿐 아니라 단위 비용에서도 치열해지고 있음을 보여준다.

자주 묻는 질문

출력 토큰 17% 절감이 왜 중요한가요?

API 비용은 토큰 수에 비례하므로, 같은 작업을 더 적은 토큰으로 끝내면 실질 비용이 줄어듭니다. 대량 처리(요약·분류 등)에서 누적 절감이 큽니다.

Flash와 Pro는 어떻게 다른가요?

Flash는 속도·비용에 최적화된 경량 모델, Pro는 복잡한 추론에 강한 상위 모델입니다. 대량·실시간 작업엔 Flash, 어려운 추론엔 Pro를 쓰는 식으로 나눕니다.

댓글 0

아직 댓글이 없습니다.
Ctrl+Enter로 등록