prismBETA

지난주 AI 브리핑

에이전트, 이제 배포·리뷰까지 맡고 토큰은 줄인다

개발자 관점 · 7개 스토리
←
9/21 – 9/27
6월2026
월화수목금토일
W221234567
W23891011121314
W2415161718192021
W2522232425262728
W26293012345
7월2026
월화수목금토일
W26293012345
W276789101112
W2813141516171819
W2920212223242526
W30272829303112
8월2026
월화수목금토일
W30272829303112
W313456789
W3210111213141516
W3317181920212223
W3424252627282930
W3531123456
9월2026
월화수목금토일
W3531123456
W3678910111213
W3714151617181920
W3821222324252627
W392829301234
주 단위로 선택합니다 — 어느 날짜를 눌러도 그 주 회차로 이동
01

커서, 배포 감시·보안 리뷰 봇 공개

커서가 배포 감시·보안 리뷰 봇을 냈다. Rollouts는 PR→프로덕션 회귀를 잡아 되돌리고, Security Reviewer는 PR마다 취약점과 수정안을 낸다. 코드 작성 이후 단계를 에이전트가 맡는다.

Rollouts보안 리뷰 봇
→
02

Ember-1, K3 품질 유지하며 토큰 40% 절감

Fireworks가 Kimi K3 기반 코딩 모델 Ember-1을 냈다. 품질은 유지하며 토큰을 35~50% 줄여 SWE-bench 92.2%를 기록했다. 대규모 자동 코딩 비용을 낮춘다.

Ember-1토큰 40% 절감
→
03

GLM-5.3-Flash를 결정 모델로 바꿔 쓰기

GLM-5.3-Flash를 미세조정 없이 분류·판별 결정 모델로 쓰는 기법이 공개됐다. JSON 대신 선택지 번호의 다음 토큰 확률만 읽어 한 번의 순전파로 판단한다. Python 라이브러리로 바로 적용할 수 있다.

GLM-5.3-Flash결정 모델
→
04

커서, 하네스 손봐 토큰 비용 7% 절감

커서가 에이전트 하네스를 손봐 토큰 비용을 7% 줄였다. 모델이 좋아져 불필요해진 지시를 없애며 시스템 프롬프트를 66% 걷어냈다. 긴 금지 지시를 줄이는 게 절감의 핵심이다.

시스템 프롬프트 66%토큰 7% 절감
→
05

Claude 프로젝트 '계정 메모리' 기본 켜짐 주의

Anthropic이 Claude 프로젝트에 '계정 메모리 사용' 토글을 추가했고 기존 프로젝트에서 기본으로 켜져 있었다. 프로젝트 메모리가 계정 전체 대화와 연결된다. 격리용 프로젝트라면 지금 설정을 확인해야 한다.

계정 메모리 토글Claude 프로젝트
→
06

에이전트 코딩에 형식 명세 TLA+ 다시 뜬다

Opus 5.5로 Claude Agent SDK를 TLA+·Lean으로 모델링한 사례가 화제가 됐다. 형식 명세로 에이전트 코딩의 정확성을 검증하려는 흐름이다. 명세→증명→구현을 잇는 파이프라인 실험도 나왔다.

TLA+형식 명세
→
07

Claude, 입자물리 9루프 계산 완수

Claude가 8루프를 넘는 9루프 산란 진폭 계산을 완수했다. 경로당 약 1천~2천달러가 들었고 Lance Dixon이 검증했다. 새 발견은 아니지만 최전선 계산을 거의 자율로 해냈다.

9루프 계산Claude Science
→
이전 브리핑 · 09-14 MON← 코딩 에이전트에 보낸 메시지 40%가 실제 작업이 아니었다