GPT-6 Luna가 입력 100만 토큰당 $0.10, 출력 $0.50으로 책정돼, 클로드의 최저가 모델 Haiku 4.5($1/$5)보다 10배 싸다. 캐시 읽기도 Luna가 100만당 $0.01, 하이쿠가 $0.10으로 같은 10배 격차가 유지된다. 에이전트는 호출 대부분을 작고 빠른 워커 모델로 보내 거기서 토큰이 가장 많이 쓰이므로, 이 물량에서의 10배 차이가 어떤 벤더를 쓸지를 가른다.
오케스트레이터가 상위 모델로 계획을 세우고 수많은 하위 호출을 작은 모델에 던지는 에이전트 구조에서는, 실제 토큰 소비의 중심이 워커 모델이다. 그래서 워커 등급의 단가 차이는 전체 운영비에 그대로 곱해진다.
GPT-6 Luna의 입력 $0.10·출력 $0.50은 Haiku 4.5의 $1·$5 대비 정확히 10배 저렴하고, 캐시 읽기도 $0.01 대 $0.10으로 격차가 캐싱을 써도 좁혀지지 않는다. 앤트로픽은 Opus 등 상위 라인의 가격은 내려 왔지만 하이쿠보다 싼 등급은 내놓지 않아, 대량 워커 호출이 필요한 워크로드에서는 비용만 보면 Luna 쪽이 유리하다.
물론 워커 품질·지연·호환 하네스에 따라 결과가 달라지므로 단가만으로 결정할 일은 아니지만, 적어도 비용 모델을 다시 계산해 볼 신호다.