prismBETA

지난주 AI 브리핑

모델 값은 급락하고, 맡기는 작업은 길어진다

개발자 관점 · 7개 스토리
7/27 – 8/02
6월2026
W221234567
W23891011121314
W2415161718192021
W2522232425262728
W26293012345
7월2026
W26293012345
W276789101112
W2813141516171819
W2920212223242526
W30272829303112
주 단위로 선택합니다 — 어느 날짜를 눌러도 그 주 회차로 이동
01

GPT-5.6 Luna 값 80% 인하, 최저가 구도 뒤집혔다

OpenAI가 GPT-5.6 Luna를 80% 인하했다. 입력 $0.20·출력 $1.20으로 Haiku 4.5 입력값의 1/5이다. 저가·대량 처리 모델 선택이 다시 갈린다.

GPT-5.6 Luna80% 인하
02

Go 1.27 — 제네릭 메서드·json/v2 정식, 호환성 주의

Go 1.27이 제네릭 메서드와 encoding/json/v2를 정식 채택했다. 80B 미만 할당은 최대 30% 빨라지지만 타이머 채널·HTTP 본문 등 기존 동작이 바뀐다. 올리기 전 호환성 점검이 필수다.

Go 1.27제네릭 메서드json/v2 정식
03

LLM 대화를 전부 기록해 '필드 가이드'로 만든다

Primeagen이 LLM과의 모든 대화를 커밋 해시와 함께 마크다운에 기록하는 기법을 공개했다. 에이전트가 그 기록을 리뷰해 재사용 가능한 '필드 가이드'를 만든다. 코드 신뢰도를 올리는 반복 루프다.

필드 가이드대화 기록커밋 해시
04

펠리컨 SVG는 끝, 이제 LLM에 세계를 짓게 한다

Karpathy가 펠리컨 SVG 대신 절차적 세계 생성을 새 평가로 제시했다. Opus 5는 100만 토큰·약 $10로 2시간에 5,500줄 Three.js를 만들었다. 초맞춤 콘텐츠를 주문형으로 뽑는 시대다.

절차적 세계 생성Opus 5Three.js
05

Kimi K3 서빙, MI355X가 달러당 성능서 B300 앞선다

Kimi K3(2.8T)를 AMD MI355X로 서빙한 벤치가 나왔다. B200 대비 처리량 3.8배, B300보다 GPU가 2.4배 싸 달러당 성능이 앞선다. 오픈 모델 서빙에 AMD가 실전 대안이 됐다.

Kimi K3MI355X달러당 성능
06

DeepSeek V4 Flash에 DSpark 투기 디코딩 — 1.74배

DeepSeek V4 Flash에 DSpark 투기 디코딩이 적용됐다. A40 4장에서 짧은 생성이 25.6→44.5 tok/s로 1.74배, 수용률 87%를 기록했다. 드래프트 모델이 공개돼 바로 재현된다.

DSpark투기 디코딩1.74배
07

llm 0.32, 기본 모델 Luna로 — 임의 엔드포인트 테스트

llm 0.32의 기본 모델이 GPT-4o mini에서 GPT-5.6 Luna로 바뀌었다. 새 openai endpoint 명령으로 설정 없이 임의 호환 엔드포인트를 테스트한다. uvx 원라이너로 로컬 모델도 바로 붙는다.

llm 0.32기본 모델 Luna
이전 브리핑 · 07-20 MON← Claude Opus 5, 값은 그대로 성능은 두 배로