TabbitBlog

Gemini 3.6 Flash: 달라진 점, 가격, 그리고 검증이 중요한 이유

Gemini 3.6 Flash는 100만 토큰 컨텍스트와 멀티모달 도구를 제공하지만 실제 가치는 쿼터, 검증과 버전 전환에서 결정됩니다.

이 글의 목차
  1. 핵심 판단
  2. 사양
  3. 3.5에서 3.6으로, 3.7과의 관계
  4. 공식 결과와 실제 보고
  5. 비용, 데이터와 첫 테스트
  6. 결론
  7. 출처

Gemini 3.6 Flash는 멀티모달 코드, 문서와 범위가 정해진 에이전트의 효율 중심 파일럿 후보입니다. 가치는 벤치마크만으로 결정되지 않습니다. Google은 3.5 Flash보다 출력 토큰이 적다고 말하지만, 커뮤니티는 결과를 빠르게 검증할 수 있을 때만 절약이 실제 가치가 된다고 보여줍니다.

기준은 2026년 7월 21일 Google 발표와 9월 20일 확인한 카드입니다. gemini-3.6-flash, 입력 1,048,576, 출력 65,536, 텍스트·이미지·비디오·오디오·PDF 입력, 유료 Standard 입력/출력 1.50/7.50달러가 기록되어 있습니다. 3.7과 3.8은 인접 경로이지 자동 대체가 아닙니다. Gemini 3.6 모델 페이지 (English)부터 확인하세요.

핵심 판단

  • 멀티모달 입력, 빠른 루프와 낮은 출력 비용이 중요하면 시도합니다.

  • 17% 감소는 날짜가 있는 비교이지 모든 작업 비용의 보장이 아닙니다.

  • 환각, 타임아웃과 지식 기준일 때문에 독립 검증이 필요합니다.

  • API, AI Studio/Antigravity, 기업 계약과 Tabbit을 별도 경로로 봅니다.

  • 쓰기 권한 에이전트는 diff, 테스트와 정지 조건을 요구합니다.

사양

항목확인 내용경계
ID안정형 gemini-3.6-flash클라이언트에서 정확한 ID를 확인합니다.
입력텍스트, 이미지, 비디오, 오디오, PDF클라이언트가 모두 노출한다는 뜻은 아닙니다.
토큰입력 1,048,576, 출력 65,536요금제의 실효 창은 더 작을 수 있습니다.
도구캐시, 코드, computer use preview, 검색, 함수, grounding, 구조화 출력, URL contextAPI 지원이 계정 노출을 보장하지 않습니다.
가격입력 1.50, 출력 7.50달러/백만무료 등급, 도구와 재시도는 별도입니다.
기준일2026년 3월최신 사실은 출처가 필요합니다.

에이전트 브라우저란, AI 브라우저 비교, Tabbit Browser 실전을 함께 보며 API와 제품을 구분하세요.

3.5에서 3.6으로, 3.7과의 관계

Google은 3.6을 3.5 Flash 이후의 작업 모델로 소개하며 출력 토큰 17% 감소, DeepSWE 49 대 37, MLE-Bench 63.9 대 49.7, OSWorld 83.0 대 78.4, GDPval-AA Elo 1421 대 1349를 제시합니다. 제공자가 선택한 비교이지 독립 감사는 아닙니다.

3.7과 3.8이 3.6을 즉시 무효로 만들지는 않습니다. 3.6이 적은 루프로 검증 가능한 작업을 끝내면 효율이 의미 있습니다. 긴 자율 계획은 같은 fixture로 최신 경로를 비교하세요. 에이전트 추론 가이드로 노력 수준, 도구와 수정 횟수를 기록합니다.

공식 결과와 실제 보고

카드는 SWE-Bench Pro 58.7%, DeepSWE 49%, Terminal-Bench 78.0%, MLE-Bench 63.9%, OSWorld-Verified 83.0%, CharXiv(도구 없음) 85.2%, GDM-MRCR 1M 54.0%를 표시합니다. 코드, 컴퓨터 사용, 차트와 장문맥은 서로 다른 작업입니다. 1M 점수는 거대한 입력이 항상 싸고 안정적이라는 뜻이 아닙니다. 조건은 Gemini prompts (English)reviews (English)에서 확인하고 타인의 긴 prompt를 복사하지 마세요.

Promptslove는 OpenCode, high thinking, 24시간, 프론트엔드·브라우저 게임·폼·Instagram 비디오 네 작업을 비교했습니다. 폼, CSV, 편집과 비디오는 작동했지만 스크롤 표시, 카운터, 반응형과 시각 완성도를 놓쳤다고 합니다. Reddit에서는 범위가 좁은 작업의 속도를 칭찬하면서도 검증 불가능한 “확인”, 위험한 자율 행동, 테스트 누락과 Firebase 규칙 누락을 지적했습니다. role-play에서는 글을 칭찬했지만 400 오류, 거절과 장문 반복도 보고했습니다. 자세한 조건은 리뷰 모음 (English)에 남깁니다.

비용, 데이터와 첫 테스트

유료 Standard는 입력/출력 1.50/7.50달러이고 thinking도 출력에 포함됩니다. 무료 등급은 제출 내용이 Google 제품 개선에 사용될 수 있다고 하고 유료 등급은 그렇지 않다고 설명합니다. 지역 조건을 확인하고 캐시, Search grounding, 도구, 재시도와 구독을 따로 계산하세요. API, AI Studio, Antigravity와 Enterprise의 쿼터는 같지 않을 수 있습니다.

Tabbit도 별도 경로입니다. 브라우저 자동화는 작업 설계를 돕지만 세션을 Gemini API 청구로 바꾸지 않습니다. 코드는 작은 저장소와 테스트, 문서는 날짜와 인용, 컴퓨터 사용은 폐기 가능한 페이지, 장문은 반복률을 기준으로 삼습니다.

이 글은 Tabbit 로그인 작업이나 4–8개 적격 스크린샷을 만들지 않았습니다. 따라서 선택기, 실효 문맥, 속도, 쿼터, 구독과 가격을 주장하지 않습니다. 모델이 보이면 공개 문서에서 다섯 사실과 링크를 추출하고 수동 검증한 뒤 쓰기 권한을 주세요.

Tabbit Browser

결론

Gemini 3.6 Flash는 멀티모달 코드와 범위가 정해진 에이전트의 효율형 후보입니다. Google 자료는 3.5 대비 개선을 뒷받침하지만 감독, 쿼터와 검증이 절약을 없앨 수 있습니다. 고정된 작업으로 파일럿하고, 더 긴 자율성이 리뷰 비용을 보상할 때만 3.7이나 3.8로 이동하세요.

출처

자주 묻는 질문

Gemini 3.6 Flash는 무엇인가요?

코드, 지식 작업과 에이전트용 Google의 안정적인 멀티모달 Flash 모델입니다. 텍스트, 이미지, 비디오, 오디오, PDF 입력과 입력 1,048,576 토큰, 출력 65,536 토큰을 지원합니다.

Gemini 3.5 Flash와 무엇이 달라졌나요?

Google이 인용한 Artificial Analysis 비교에서 출력 토큰이 17% 적고 코드와 멀티모달 성능이 개선되었습니다. 날짜가 있는 제공자 비교이지 모든 작업의 비용 보장은 아닙니다.

가격은 얼마인가요?

2026년 9월 20일 Google 유료 Standard 행은 입력 백만 토큰당 1.50달러, 출력 7.50달러였습니다. 무료 등급, 도구와 재시도는 별도 조건입니다.

코딩 에이전트에 적합한가요?

Google 카드는 SWE-Bench Pro 58.7%, Terminal-Bench 2.1 78.0%, OSWorld-Verified 83.0%를 제시합니다. 독립 보고는 범위가 좁고 감독 가능한 작업을 권합니다.

어떤 한계가 있나요?

Google은 환각, 간헐적 지연과 타임아웃, 강화 중인 탈옥 방어, 2026년 3월 지식 기준일을 언급합니다. 사용자들은 쿼터, 누락된 테스트와 긴 문맥 반복도 보고합니다.

Tabbit에서 사용할 수 있나요?

이 글에서는 로그인된 Gemini 3.6 Flash Tabbit 작업을 실행하지 않았습니다. 실시간 선택기와 계정 조건을 확인하세요.

다음 단계

Tabbit 과 함께 일하세요.

탭 간 조사를 하고, 반복적인 브라우저 작업을 자동화하며, 모든 맥락을 손이 닿는 곳에 두세요.