구글 Gemini 3.7 Flash, 104만 입력 토큰과 컴퓨터 사용 미리보기 지원
- Gemini 3.7 Flash는 텍스트, 이미지, 동영상, 오디오, PDF를 입력으로 받고 텍스트를 출력하는 네이티브 멀티모달 추론 모델임
- 입력 한도는 1,048,576토큰, 출력 한도는 65,536토큰으로 정해짐
- 코드 실행, 파일 검색, 함수 호출, Google 검색 및 지도 그라운딩, 구조화 출력, URL 컨텍스트를 지원함
- 컴퓨터 사용은 미리보기로 지원하며, 사고 수준은 low, medium, high를 지원하고 minimal 설정은 오류를 반환함
- 배치 API, Flex 추론, 우선순위 추론과 캐싱을 지원하지만 이미지 생성, 오디오 생성, Live API는 지원하지 않음
Hacker News opinions
연말까지 책정한 도입가가 2026년 12월까지라면, 그전에는 Flash의 큰 업데이트가 없다는 뜻처럼 보임
그건 가격 경쟁력을 맞추려는 조치 같음. 3.6 Flash 나온 지 3주밖에 안 됐고 Gemini 4도 임박했다니, 원하면 3.8도 그 전에 낼 수 있음
Terra는 Cognition 자료상 가격이 절반쯤이고 Grok 4.6은 더 싸고 좋아 보임. 이 조건에서 3.7 Flash를 고를 이유가 뭔지 모르겠고, DeepMind가 아직 프런티어 연구소인지도 의문임
나는 높은 컨텍스트에서 토큰 처리 속도와 지연 시간, 가동률 때문에 아직 3.6 Flash를 씀. Grok 4.6은 내부 벤치에서 점수가 낮거나 더 느렸음
Artificial Analysis 스위트 실행비는 Grok 4.6이 $1,068, Gemini 3.7 Flash가 $485라고 함. 모델마다 작업당 쓰는 토큰이 달라서 토큰 단가만 비교하는 건 별 의미 없다고 봄
내가 해 본 작업에서는 Flash 3.6 High가 Luna xhigh보다 약 10배 빨랐고 결과는 비슷했음
Gemini는 다음 Pro 모델을 언제 내는 건지 궁금함. 빠르지만 능력은 중간 정도인 모델 틈새에만 집중하는 건가 싶음
3.5 Pro 실패작을 3.7 Flash로 다시 붙인 느낌이라 씁쓸함
모델 카드 기준으로는 벤치마크마다 다르지만 GPT 5.6 Tera와 Sonnet 5 근처 성능으로 보임
Sonnet 5 대부분 벤치마크를 이기고 가격도 절반 이하라면 경쟁력은 있다고 봄. 다만 이제 구글이 최선두는 아닌 듯함
Sonnet 5 자체가 별로인 모델이라 그걸 이긴다는 말만으로는 판단하기 어렵다고 봄
Sonnet 5는 Fable보다 비싸고 느린데 품질은 낮을 때도 있어서 비용 대비 최악에 가깝다고 느낌. Luna와의 비교가 더 궁금하고, Flash가 매달 이 정도로 개선되면 몇 달 뒤에는 상위 모델과 경쟁할 수 있을 듯함
텍스트만 쓴다면 더 싸고 여러 추론 제공자에서 쓸 수 있는 DS V4 Flash나 Pro 대신 이 모델을 쓸 이유가 멀티모달과 속도 외에는 잘 안 보임. TPU 덕인지 속도는 매우 좋아 보임
내 테스트에서는 Gemini 3.5와 3.6 Flash가 텍스트 능력에서 DS V4 Flash와 Pro보다 나았음
Artificial Analysis 점수는 3.6 Flash 52에서 3.7 Flash 56으로 올랐지만, 작업당 출력 토큰도 2.6만에서 3.7만으로 늘었음. 그래도 단가를 절반으로 낮춰 작업당 비용은 더 쌈
2027년 1월에 가격을 두 배로 올린다는 예고는 우스움. 그때면 더 새롭고 싼 모델이 나올 텐데, 과거 가격 인상 뒤로 프로덕션 파이프라인의 구글 의존도를 이미 낮췄음