prismBETA
← 개발자 브리핑
2026-08-10 · 01 / 07

Gemini 3.7 Flash 출시, llm에서 바로 붙여 쓴다

구글이 코딩·에이전트용 신모델 Gemini 3.7 Flash를 공개했고, 같은 날 llm-gemini 0.33이 이를 지원한다. LLM 0.32 호환으로 추론 트레이스를 볼 수 있고 `llm -m gemini-3.7-flash -T CodeExecution`처럼 서버 사이드 도구도 켤 수 있다. 사고 강도는 high·medium·low로 나뉘며 3.6에 있던 minimal 옵션은 3.7에서 제거됐다. 플러그인은 gemini-3.6-flash, gemini-3.5-flash-lite와 임베딩 모델 gemini-embedding-2·001도 함께 추가했다.

Gemini 3.7 Flash는 구글이 코딩과 에이전트 용도를 전면에 내세운 '워크호스' 모델이다. Flash 계열은 대형 Pro보다 싸고 빨라 반복 호출이 많은 에이전트·자동화에서 실제 청구서를 결정하는 위치에 있다.

Simon Willison의 llm-gemini 0.33은 출시 당일 gemini-3.7-flash를 지원하며, LLM 0.32와의 호환으로 추론 트레이스 표시와 `-T CodeExecution` 형태의 서버 사이드 도구 실행을 제공한다. 사고 강도는 high·medium·low 세 단계이고, 3.6에 있던 minimal은 사라졌다. 임베딩 모델 gemini-embedding-2·001과 gemini-3.6-flash, 3.5-flash-lite도 같은 릴리스에 포함됐다.

즉 새 모델을 시험하려고 API를 직접 붙일 필요 없이 기존 llm CLI에서 프롬프트·도구·추론 깊이를 바꿔가며 다른 모델과 나란히 비교할 수 있다.

투표
코딩에 주로 쓰는 모델 계열은?
이 글이 도움이 되셨나요?
매주 월요일 아침 갱신 · 요약은 AI가 생성하며 출처 원문을 확인하세요.