본문으로 건너뛰기
이번 주 팝콘 줍줍 · 5/5시리즈 보기 →

이번 주 팝콘 줍줍 — 같은 주에 나온 Opus 5.5와 GPT-6, 값이 절반으로 (9월 4주)

· 약 5분
Practical AI automation team

데이터팝콘 팀이 한 주 동안 유용하고 재미있게 본 것들을 모았습니다. 여러분에게도 공유합니다.

새로운 게 보이면 일단 슬랙에 던져두는데, 이번 주엔 7개를 골랐습니다. 하필 같은 주에 Anthropic과 OpenAI가 하루 차이로 새 모델을 내놨고, 둘 다 값을 내렸습니다.

2026.09.19 – 09.24

이번 주 팝콘 줍줍 표지


1. Claude Opus 5.5 — 같은 급 성능에 실행 비용 40% 아래

Claude Opus 5.5 · Anthropic · 2026년 9월 22일

새 플래그십 모델입니다. 발표문의 표현은 "Claude Fable 5.1 수준의 성능을 40% 저렴하게" 입니다.

단가는 이렇게 내려갔습니다. 괄호는 Opus 5 가격입니다.

항목Opus 5.5(Opus 5)
입력$4 / 백만 토큰($5)
출력$20 / 백만 토큰($25)
캐시 읽기$0.20 / 백만 토큰($0.50)
캐시 쓰기$5 / 백만 토큰($6.25)

캐시 읽기가 60% 내려간 게 눈에 띕니다. 같은 문서를 계속 물고 도는 작업, 그러니까 긴 지침이나 자료를 매 요청에 얹는 에이전트에서 차이가 큽니다.

속도도 기본 설정에서 Opus 5보다 30% 이상 빠른 출력이라고 적혀 있습니다. 벤치마크는 에이전트 코딩(Terminal-Bench 4.0) 66.4%, 지식 작업(GDPval-AA v2.1) 1846 Elo, 컴퓨터 사용(OSWorld 2.0) 81.8%입니다.

쓸 수 있는 곳은 Claude Code, Claude Cowork, API(claude-opus-5-5)이고, AWS·Google Cloud·Azure에도 올라가 있습니다.

읽다가 걸린 조건이 두 개 있습니다.

  • 사이버보안 작업은 대부분 Opus 4.8로 다시 넘어갑니다
  • 생물학 쪽은 Life Sciences Verification Program을 통과한 조직만 접근할 수 있습니다

에이전트를 돌리는데 캐시 비용이 계속 신경 쓰이셨던 분들이 보시면 좋을 것 같아요.

2. GPT-6 Sol·Luna — 하루 뒤에 나온 절반 가격

GPT-6 Sol과 Luna 소개 · OpenAI · 2026년 9월 23일

두 모델의 자리가 다릅니다.

  • Sol — 복잡한 코딩과 에이전트 워크플로우용
  • Luna — 범위가 좁고 호출이 많은 작업용
모델입력출력인하
GPT-5.6 Sol → GPT-6 Sol$4 → $2$20 → $1050%
GPT-5.6 Luna → GPT-6 Luna$0.20 → $0.10$1.20 → $0.5050%

백만 토큰당 가격입니다. 인하폭은 GPT-5.6의 프로모션 가격과 비교한 값이라고 적혀 있고, 가장 좋은 모델은 여전히 GPT-6 Astra라고 안내합니다.

쓸 수 있는 곳도 조건이 나뉘어 있습니다.

  • 오늘부터 ChatGPT Work와 Codex에서 Plus·Pro·Business·Enterprise·Edu 사용자
  • Free·Go 사용자는 데스크톱 앱에서 Luna만
  • Chat에는 아직 들어가지 않았습니다. 하루에 걸쳐 순차 배포한다고 하니, 안 보이면 나중에 다시 보라고 적혀 있어요
  • API 모델 이름은 gpt-6-sol, gpt-6-luna

앞의 1번과 묶어 보면, 이번 주에 양쪽 다 "같은 일을 더 싸게"로 방향을 잡았습니다.

3. Hermes Agent × Claude 구독 — API 키 없이 구독으로 에이전트 돌리기

Claude Subscription DirectSDK 플러그인 · Nous Research

Hermes Agent가 공식 Claude Code CLI를 통해 내 Claude Pro/Max 구독으로 움직이게 하는 플러그인입니다. 별도 API 키를 넣고 토큰 단위로 결제하지 않아도 됩니다.

설치는 한 줄입니다.

hermes plugins install claude-subscription-directsdk

그다음 로그인하고 모델을 고릅니다.

claude auth login
hermes model # Claude Subscription DirectSDK (Experimental) 선택

필요한 것은 Hermes Agent 0.21.4 이상, Python 3.10 이상, 그리고 공식 Claude Code CLI(npm install -g @anthropic-ai/claude-code)와 Claude Pro 또는 Max 구독입니다.

조건도 분명히 적혀 있습니다.

  • 요청마다 구독의 Agent SDK 한도에서 차감됩니다. 무한이 아닙니다
  • 로그인해 둔 그 계정으로만 돕니다
  • Pro 플랜에서 Fable 5.1은 거부됩니다. 별도 사용 크레딧이 필요합니다
  • 이름 그대로 아직 Experimental입니다
저희는 이렇게 씁니다

데이터팝콘은 Hermes Agent에 Claude를 fallback으로 붙여 두고 있습니다.

API 요금이 부담돼 에이전트를 못 돌리고 계셨다면 한 번 보실 만합니다.


나머지 4개

4. codex-resets.com — Codex 사용량 리셋만 모아 보는 사이트

OpenAI Codex의 사용량 리셋 공지를 한 화면에 모아 둔 페이지입니다. 최근 리셋 시각과 이력을 보여주고, 지금까지 총 54회, 평균 7일 간격, 가장 길게는 67.7일이었다는 통계까지 붙어 있습니다. 로그인은 필요 없습니다. 텔레그램·X 알림과 API·MCP도 열어뒀습니다. Wong2라는 개발자가 만든 비공식 사이트입니다.

5. StepFun Step 5 Preview — Kimi K3와 같은 점수, 작업 비용은 3분의 1

전체 600B 중 토큰당 27B만 쓰는 MoE 모델입니다. 지능 지수는 Kimi K3와 동점(44)인데 작업당 비용은 $0.72 대 $2.00, 속도는 초당 84토큰 대 37토큰입니다. 컨텍스트 1M 토큰, 이미지·영상 입력을 받습니다. 지금은 API(step-5-preview)로만 쓸 수 있고, 10월 15일에 오픈 웨이트로 공개한다고 합니다.

6. NVIDIA의 AI 에이전트 평가 정리 — 도구 호출 말고 과업 완수로 채점하기

"호출이 문법적으로 완벽해도 과업은 실패할 수 있다"는 게 요지입니다. 그래서 보라고 제안하는 지표가 여섯입니다. 과업 성공률, 일관성(3~5회 돌린 성공률의 범위), 도구 호출 정밀도, 인자 정확도, 성공당 단계 수, 성공당 비용. 통과 기준을 에이전트의 마지막 메시지가 아니라 환경 상태(데이터베이스에 행이 생겼는지, PR이 병합됐는지)에 걸라는 말이 가장 실용적이었습니다.

7. Jev 소개 영상 — 글을 쓰지 않고 판단만 하는 모델

제목과 링크만 확인했고 아직 영상은 보지 않았습니다. 문장을 생성하는 대신 분류·점수·확률만 빠르게 돌려주는 방향이라고 합니다.


매주 금요일에 올립니다

수집 범위는 토요일부터 금요일까지입니다. 같은 내용을 금요일 저녁 인스타그램에도 카드로 올립니다.

@data.popcorn 팔로우 하고 매주 받아보세요.