모델 값은 급락하고, 맡기는 작업은 길어진다
| 월 | 화 | 수 | 목 | 금 | 토 | 일 | |
|---|---|---|---|---|---|---|---|
| W22 | 1 | 2 | 3 | 4 | 5 | 6 | 7 |
| W23 | 8 | 9 | 10 | 11 | 12 | 13 | 14 |
| W24 | 15 | 16 | 17 | 18 | 19 | 20 | 21 |
| W25 | 22 | 23 | 24 | 25 | 26 | 27 | 28 |
| W26 | 29 | 30 | 1 | 2 | 3 | 4 | 5 |
| 월 | 화 | 수 | 목 | 금 | 토 | 일 | |
|---|---|---|---|---|---|---|---|
| W26 | 29 | 30 | 1 | 2 | 3 | 4 | 5 |
| W27 | 6 | 7 | 8 | 9 | 10 | 11 | 12 |
| W28 | 13 | 14 | 15 | 16 | 17 | 18 | 19 |
| W29 | 20 | 21 | 22 | 23 | 24 | 25 | 26 |
| W30 | 27 | 28 | 29 | 30 | 31 | 1 | 2 |
OpenAI가 GPT-5.6 Luna를 80% 인하했다. 입력 $0.20·출력 $1.20으로 Haiku 4.5 입력값의 1/5이다. 저가·대량 처리 모델 선택이 다시 갈린다.
Go 1.27이 제네릭 메서드와 encoding/json/v2를 정식 채택했다. 80B 미만 할당은 최대 30% 빨라지지만 타이머 채널·HTTP 본문 등 기존 동작이 바뀐다. 올리기 전 호환성 점검이 필수다.
Primeagen이 LLM과의 모든 대화를 커밋 해시와 함께 마크다운에 기록하는 기법을 공개했다. 에이전트가 그 기록을 리뷰해 재사용 가능한 '필드 가이드'를 만든다. 코드 신뢰도를 올리는 반복 루프다.
Karpathy가 펠리컨 SVG 대신 절차적 세계 생성을 새 평가로 제시했다. Opus 5는 100만 토큰·약 $10로 2시간에 5,500줄 Three.js를 만들었다. 초맞춤 콘텐츠를 주문형으로 뽑는 시대다.
Kimi K3(2.8T)를 AMD MI355X로 서빙한 벤치가 나왔다. B200 대비 처리량 3.8배, B300보다 GPU가 2.4배 싸 달러당 성능이 앞선다. 오픈 모델 서빙에 AMD가 실전 대안이 됐다.
DeepSeek V4 Flash에 DSpark 투기 디코딩이 적용됐다. A40 4장에서 짧은 생성이 25.6→44.5 tok/s로 1.74배, 수용률 87%를 기록했다. 드래프트 모델이 공개돼 바로 재현된다.
llm 0.32의 기본 모델이 GPT-4o mini에서 GPT-5.6 Luna로 바뀌었다. 새 openai endpoint 명령으로 설정 없이 임의 호환 엔드포인트를 테스트한다. uvx 원라이너로 로컬 모델도 바로 붙는다.