속도 티어부터 로컬 27B까지, 골라 쓰는 모델·기법이 쏟아진 한 주
| 월 | 화 | 수 | 목 | 금 | 토 | 일 | |
|---|---|---|---|---|---|---|---|
| W22 | 1 | 2 | 3 | 4 | 5 | 6 | 7 |
| W23 | 8 | 9 | 10 | 11 | 12 | 13 | 14 |
| W24 | 15 | 16 | 17 | 18 | 19 | 20 | 21 |
| W25 | 22 | 23 | 24 | 25 | 26 | 27 | 28 |
| W26 | 29 | 30 | 1 | 2 | 3 | 4 | 5 |
| 월 | 화 | 수 | 목 | 금 | 토 | 일 | |
|---|---|---|---|---|---|---|---|
| W26 | 29 | 30 | 1 | 2 | 3 | 4 | 5 |
| W27 | 6 | 7 | 8 | 9 | 10 | 11 | 12 |
| W28 | 13 | 14 | 15 | 16 | 17 | 18 | 19 |
| W29 | 20 | 21 | 22 | 23 | 24 | 25 | 26 |
| W30 | 27 | 28 | 29 | 30 | 31 | 1 | 2 |
| 월 | 화 | 수 | 목 | 금 | 토 | 일 | |
|---|---|---|---|---|---|---|---|
| W30 | 27 | 28 | 29 | 30 | 31 | 1 | 2 |
| W31 | 3 | 4 | 5 | 6 | 7 | 8 | 9 |
| W32 | 10 | 11 | 12 | 13 | 14 | 15 | 16 |
| W33 | 17 | 18 | 19 | 20 | 21 | 22 | 23 |
| W34 | 24 | 25 | 26 | 27 | 28 | 29 | 30 |
| W35 | 31 | 1 | 2 | 3 | 4 | 5 | 6 |
구글이 Gemini 3.7 Flash를 공개했다. llm-gemini 0.33이 지원하고 minimal 사고는 빠져 high·medium·low만 남았다. CLI에서 추론 트레이스와 서버 도구 호출을 쓴다.
OpenAI가 GPT-5.6 Sol API 티어 Ultrafast를 프리뷰했다. Cerebras 기반으로 최대 14배 빨라 초당 750토큰까지 출력한다. 모델 품질은 그대로, 지연만 줄여 에이전트·실시간 응답에 쓴다.
알리바바가 Apache 2 비전 모델 Qwen 3.8 27B를 냈다. 17GB Q4로 노트북서 돌고 기본 reasoning_effort가 xhigh라 과사고한다. low로 낮추고 컨텍스트를 262144로 키워야 한다.
VS Code 1.133이 Claude 세션 기능을 손봤다. 턴마다 Anthropic API 키와 Copilot 구독을 오가고 로그인 없이 Agents를 연다. github 접근이 막힌 환경서도 Claude를 쓴다.
개발자가 세션 로그로 $20 구독 토큰량을 Codex와 Claude Code로 비교했다. Opus 5·GPT-5.6 Sol은 Medium 티어, Codex는 7일 롤링 한도다. 구독은 한도보다 리셋 방식을 봐야 한다.
Cloudflare 프록시를 켜면 HTML 사이트에도 분석 JS가 기본 삽입된다. 끄려면 Analytics에 등록 후 스니펫을 꺼야 하고, DNS 전용이면 삽입되지 않는다. 프록시 사이트는 지금 확인·차단해야 한다.
기존 태그를 주지 않고 모델이 태그를 자유롭게 지어내게 한다. 벡터 임베딩으로 실제 어휘 중 최근접 태그에 매칭하며, 태그 수천 개일 때 유효하다. 분류를 '생성 후 근접 매칭'으로 바꾸는 재사용 패턴이다.