가격은 같다. 대부분의 사람들은 모델만 바꾸고 다른 모든 것을 놓칠 것이다.

Anthropic은 Opus 4.8과 함께 벤치마크 수치보다 Claude Code에서 작업 방식을 더 크게 바꾸는 세 가지를 출시했다: 노력 제어, 동적 워크플로, 더 저렴해진 패스트 모드. 이 기능들을 제대로 설정하는 사람들은 더 나은 결과를 얻고 비용도 덜 쓴다. 여기 그 분석이 있다.
가장 중요한 하나의 수치
69.2%의 코딩 점수가 아니다. 중요한 것은 4.8이 스스로 작성한 코드에서 결함이 빠져나갈 가능성이 약 4배 더 낮다는 점이다.
이전 모델들은 얇은 증거만으로 "완료, 버그 수정됨"이라고 자신 있게 말하는 경향이 있었다. Anthropic은 정직함에 중점을 뒀다: 4.8은 더 자주 속도를 늦추고 확실하지 않은 부분을 표시하며, 조용히 엣지 케이스를 망가뜨리는 그럴듯한 코드를 생성하는 대신 불확실성을 인정한다. 긴 세션에서는 이것이 누적된다. 15번째 턴에서 불확실성을 인정하는 모델은 40번째 턴에서 몇 시간의 디버깅 시간을 절약해준다.
변경된 점: 요약 버전
코딩.
SWE-bench Verified: 87.6% → 88.6% (거의 한계치에 근접).
SWE-bench Pro (더 어렵고, 오염도가 낮음): 64.3% → 69.2%, GPT-5.5보다 10포인트 이상 앞섬.
이것이 가장 주목할 만한 코딩 수치다.
터미널.
Terminal-Bench 2.1: 66.1% → 74.6% (+8.5), 하지만 GPT-5.5가 여전히 선두(78.2%). 7개 벤치마크 중 4.8이 패배한 유일한 항목.
지식 작업.
GDPval-AA: 1890 Elo vs GPT-5.5의 1769 Elo. 전체 테이블에서 가장 큰 격차다.
컴퓨터 사용.
OSWorld-Verified: 83.4% (향상분의 일부는 업데이트된 harness 덕분이며, Anthropic이 이를 솔직히 밝히고 있다).
과학.
GPQA Diamond: 93.6%, 사실상 변동 없음 (두 모델 모두 93% 이상으로, 이는 포화 상태일 뿐 회귀가 아니다).

Anthropic은 이번 출시를 "미미하지만 실질적인 개선"이라고 자평한다. 벤치마크는 플러스 요인이다. 아래의 운영상 변경 사항이 진짜 핵심이다.
기능 1. 노력 제어 (가장 과소평가된 기능)
Opus 4.8은 기본적으로 High(높음) 노력으로 설정된다. 하지만 이제는 사용자가 특정 작업에 모델이 얼마나 많은 사고를 투입할지 결정할 수 있다. 추론을 위한 수동 변속기라고 생각하면 된다.
claude.ai와 Cowork에서는 모델 선택기 옆에 슬라이더가 있으며, Low(낮음), Medium(중간), High(높음, 기본값), Extra(추가), Max(최대)의 다섯 단계와 별도의 Thinking(사고) 토글이 있다. Claude Code에서는 이름이 약간 다르지만 동일한 단계를 사용하며, 자동 모드도 있다:
참고: claude.ai의 "Extra"와 Claude Code의 "xhigh"는 동일한 단계이며, 단지 다른 화면에서 다른 레이블로 표시된다.

혼동을 피하기 위한 핵심 사항이다. 노력 수준별로 별도의 추가 요금이 부과되지 않는다. 모든 수준에서 요율은 동일하다: 입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $25. 차이는 토큰당 가격이 아니라 모델이 소비하는 토큰 수에 있다. Low는 간략하게 답하고 거의 생각하지 않으며, Max는 오래 생각하고 몇 배 더 많은 토큰을 소모한다. 따라서 Max가 "더 비싼" 이유는 요율 때문이 아니라 볼륨 때문이다.
동일한 작업에 대한 상대적 비용에 대한 대략적인 가이드 (수치는 직관을 위한 예시):
비용 예시. High 답변 비용이 약 $0.05라고 가정해보자. 동일한 요청을 Low로 하면 약 $0.005, Max로 하면 쉽게 $0.20-0.40까지 올라갈 수 있다. 프롬프트의 60%가 작은 작업("이 함수는 무엇을 반환하나요?")이라면, 이를 High에서 Low로 변경하면 일일 비용을 몇 배로 줄일 수 있으며, 중요한 곳에서는 품질 저하도 없다.
이것이 비용에 가장 큰 영향을 미치는 이유다. 대부분의 사람들은 모든 것을 High로 두거나 (또는 "안전을 위해" Max로 올리고) 슬라이더를 절대 건드리지 않을 것이다. 작업별로 노력을 조정하는 사람들은 눈에 띄게 적은 비용으로 동일한 결과를 얻는다. 이것이 이번 출시에서 가장 과소평가된 기능이다.
기능 2. 패스트 모드 (3배 저렴)
패스트 모드는 동일한 품질로 Opus를 2.5배 속도로 실행하며, 이제 이전보다 3배 저렴해졌다.
Claude Code에서 /fast로 토글할 수 있다 (활성 세션은 ↯ 아이콘으로 표시됨). API 액세스는 현재 게이트가 설정되어 있다 (claude.com/fast-mode에서 대기자 명단).
패스트 모드를 사용하기 좋은 경우: 대규모 다중 파일 리팩토링, 스펙 기반 코드 생성, 문서화, 테스트 생성. 속도가 깊이보다 중요한 모든 곳. 표준 모드를 유지해야 하는 경우: 복잡한 디버깅, 아키텍처 결정, 보안 검토. 사고의 질이 속도보다 중요한 모든 곳.
기능 3. 동적 워크플로 (가장 큰 변화)
Claude Code는 이제 작업을 위한 JavaScript 오케스트레이션 스크립트를 작성하고, 세션이 응답 가능한 상태를 유지하는 동안 백그라운드에서 실행한다. 계획은 모델의 컨텍스트가 아닌 코드에 존재하므로, 최종 답변만 세션으로 돌아온다.
공식 문서에서 알아야 할 사항:
- 최대 16개의 하위 에이전트를 동시에 실행, 실행당 총 1,000개의 하드 상한.
- 재개 가능: 노트북이 꺼지거나 터미널을 닫아도 중단된 지점부터 실행을 재개.
- Claude Code v2.1.154+ 필요. 연구 프리뷰.
- Max, Team, Enterprise에서는 기본적으로 활성화됨. Pro에서는 /config에서 켜고 (먼저 Opus 4.8로 전환).
- 하위 에이전트는 acceptEdits 모드로 실행되며 사용자의 도구 허용 목록을 상속받음.
/effort ultracode로 트리거하거나 (Claude Code 설정: xhigh + 자동 워크플로 오케스트레이션), 또는 간단히 큰 작업을 단어로 설명하면 된다:

적합한 용도: 200개 이상의 파일 마이그레이션, 전체 코드베이스 보안 감사, 프로젝트 전체 테스트 생성, 대규모 리팩토링, 여러 리포지토리에 걸친 리서치. 적합하지 않은 용도: 간단한 버그 수정, 단일 파일 편집, 빠른 질문. 과잉이다.
비용 측면. 워크플로는 일반 세션보다 의미 있게 더 많은 토큰을 소비한다. 비용을 통제하는 공식적인 방법은 작업 범위를 정하는 것이다: 먼저 한 폴더에서 감사를 실행하여 생성되는 하위 에이전트 수를 확인한 다음, 대규모 실행을 거기에 맞춰 조정한다.
워크플로를 완전히 비활성화하려면:
Claude Code 설정 예시 (시작 템플릿)
환경 변수 (~/.zshrc 또는 ~/.bashrc에 추가):
그리고 유용한 부분인 안전한 권한이 설정된 settings.json 파일이 있다. 이 파일은 모델이 코드를 읽고 편집하고, 테스트를 실행하고, 커밋할 수 있도록 허용하지만, 위험한 작업인 .env 및 SSH 키 읽기, rm -rf, sudo, git push는 하드 블록한다. 에이전트는 자유롭게 작업할 수 있지만, 아무것도 망가뜨리거나 유출할 수 없다.

붙여넣기 가능한 settings.json 파일은 내 Telegram 채널에 있다 (형식이 너무 커서 여기서 깔끔하게 읽을 수 없음): t.me/+JmDeelv5UCwwMTcy

일일 명령어 치트 시트
Opus 4.8 설치: 세 가지 방법
A. 브라우저 또는 앱. claude.ai에서 모델 목록에서 Claude Opus 4.8을 선택하고 노력 슬라이더를 설정한다. 설치 필요 없음.
B. API. 모델 ID claude-opus-4-8. 가격 $5/$25 (100만 토큰당). 컨텍스트 최대 100만 (Microsoft Foundry에서는 20만), 출력 최대 128k. 고정 예산 확장 사고는 지원되지 않음: 적응형 사고(thinking: {type: "adaptive"})와 effort 매개변수를 사용.
C. Claude Code (터미널). 네이티브 설치 프로그램이 이제 권장되는 방법이다 (npm은 레거시):
그런 다음 claude를 실행하고 브라우저를 통해 로그인한 후 /model로 Opus 4.8을 선택한다.
마이그레이션 체크리스트: 4.7에서 4.8로
- 모델 ID를 claude-opus-4-8로 변경
- 동일한 프롬프트로 4.7과 4.8에서 실제 작업 10-20개 실행
- 비교: 완료율, 단계 수, 토큰 수, 테스트 통과율
- 4.7의 동작에 맞춰 조정된 프롬프트 확인
- 작업 유형별로 노력 수준 할당
- 속도가 중요한 곳에서 패스트 모드 테스트
- Claude Code를 v2.1.154+로 업데이트 (워크플로용)
- 1주일 후 API 청구서 재확인
요약 카드: 모든 것을 한 곳에
모델: claude-opus-4-8 · 출시일 2026-05-28
가격: $5 / $25 (100만 토큰당) · 패스트 모드 $10 / $50
컨텍스트: 최대 100만 · 최대 128k 출력
핵심: SWE-bench Pro 64.3% → 69.2% (GPT-5.5보다 +10) · SWE-bench Verified 88.6% · 놓친 버그 4배 감소 · GDPval-AA 1890 Elo
새로운 기능: 노력 제어 · 패스트 모드 3배 저렴 · 동적 워크플로 (16개 동시 / 실행당 1,000개)
읽어주셔서 감사합니다. 여기서 딱 하나만 가져간다면 "작업별로 노력을 조정하라"는 점을 기억하길 바란다.
Claude와 바이브 코딩에 대한 나머지 노트는 여기에서 확인할 수 있다: t.me/+JmDeelv5UCwwMTcy.
거기서 만나자.
@shmidtqq.





