7/24 Opus 5 Claude Max 기본 · 백악관 K3 증류 의혹 · Greenblatt 기술 분석
이번 주 AI 업계의 두 뉴스는 겉보기 무관해 보이지만, 같은 질문을 던집니다——「가성비」와 「능력의 출처」. 2026년 7월 24일 Anthropic은 일상용 주력 모델 Claude Opus 5를 출시하고 Claude Max 기본 모델로 지정했습니다. 한편 월지암면(Moonshot AI)의 Kimi K3는 백악관 고위 관료로부터 「산업 규모 증류」 공개 비난을 받았고, 독립 연구자는 K3가 Claude를 자칭하며 내부 배포 ID를 유출한다고 보고했습니다. 본문은 Opus 5 벤치마크·가격·안전·데이터 보존, K3 2.8T MoE 사양, 증류 논란 타임라인(Fable 7/1 공개→K3 7/16 = 2주), Greenblatt 분석, Anthropic 2월 340만 회 API 주장, r/LocalLLaMA 반응, 7/27 가중치 공개, Anthropic 2월 340만 회 API 주장, r/LocalLLaMA 반응, FAQ를 정리합니다.
2026년 7월 24일(미 태평양 시간), Anthropic은 Claude Opus 5(모델 ID: claude-opus-5)를 공식 출시했습니다. 당일부터 Claude Max 기본 모델이며 Claude Pro 최강 버전입니다. 포지션은 일상 주력: 플래그십 Fable 5에 가까운 지능을 Fable 5 가격의 절반에 제공합니다.
| 항목 | 내용 |
|---|---|
| 가격 | 입력 $5 / 100만 tokens, 출력 $25 / 100만 tokens(Opus 4.8과 동일) |
| 컨텍스트 | 100만 tokens(기본·유일 구간) |
| 최대 출력 | 128K tokens |
| 추론 | Thinking 기본 ON, Effort로 사고량 조절 |
| 플랫폼 | Claude API / Platform / AWS Bedrock / Google Vertex AI / Microsoft Foundry |
| Fast 모드 | 약 2.5배 속도, 가격 2배(Opus 4.8과 동일) |
| 데이터 보존 | 기본 접근 시 강제 보존 없음(Fable 5 / Mythos 5는 30일 opt-in 필요) |
고객 코멘트: Cursor는 「near Fable 5 intelligence at Opus speed and cost」. Zapier는 AutomationBench 1위·token 소비 증가 없음. Box는 분석 워크플로 +11%, 실사 +17%, 전체 정확도 +8% 보고.
자동 행동 감사에서 Opus 5는 지금까지 가장 정렬된 모델로 평가됩니다. 기만 행동률 최저, 악용 유도에 가장 강하고, 되돌리기 어려운 무모한 행동 회피에서도 최안전. 다만 위험 이중용도 능력(사이버공격·바이오보안) 프론티어 갱신은 의도적으로 하지 않음——Mythos 5가 제한 배포로 점유. 사이버보안 분류기는 Fable 5보다 약 85% 완화(차단 빈도 약 85% 감소), 소스코드 취약점 발견에 활용 가능하나 바이너리 스캔·침투테스트·exploit 생성은 계속 차단. Fable 5에서 막히던 바이오 요청은 Opus 5로 라우팅(Opus 4.8 아님).
| 날짜 | 이벤트 |
|---|---|
| 2026-06-09 | Claude Fable 5 / Mythos 5 공식 발표 |
| 2026-07-01 | Fable 5 대중 공개 |
| 2026-07-24 | Claude Opus 5 출시, Claude Max 기본 모델 |
Fable 5 가격 장벽:약 $10/$50 /100만 tokens, 일상 Agent 워크플로 비용 2배
30일 데이터 보존:Fable 5 / Mythos 5 opt-in 보존 필수, 기업 컴플라이언스 제약
과잉 스펙:대부분 코딩·자동화에 Mythos급 이중용도 능력 불필요
전환 비용:Pro/Max가 구 Opus에 머물면 SWE 2× 개선 놓침
검증 환경:Cursor / Claude Code에서 Opus 5 vs Fable 5 비교에 macOS GUI·OAuth 콜백 필요
| 축 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 상대 가격 | 약 절반($5/$25) | 약 $10/$50 |
| CursorBench 3.2(max) | 피크 대비 0.5%p | 피크 기준 |
| 기본 데이터 보존 | 강제 없음 | 30일 opt-in |
| Claude Max 기본 | 예(7/24~) | 아니오 |
| 이중용도 프론티어 | 의도적 미갱신 | Mythos 5 제한 배포 |
Moonshot AI는 2026년 7월 16일 Kimi K3를 발표했습니다. 총 파라미터 2.8조(2.8T), 세계 최초 3T급 오픈웨이트. 896 expert sparse MoE, 토큰당 16 expert 활성(약 500B 상당). 자체 Kimi Delta Attention(KDA) + Attention Residuals + Stable LatentMoE로 K2 대비 학습 효율 2.5배. 100만 token 컨텍스트·네이티브 비전. 전체 가중치 7월 27일 공개 예정(작성 시 미공개).
| 벤치마크 | 점수 | 비고 |
|---|---|---|
| GPQA-Diamond | 93.5% | 출시 당시 오픈웨이트 최고 |
| Terminal-Bench 2.1 | 88.3% | GPT-5.6 Sol 0.5p 뒤 |
| BrowseComp | 91.2% | 출시 당시 최고 |
| Humanity's Last Exam(도구) | 56.0% | — |
| MCP Atlas | 84.2% | — |
| Program Bench | 77.8% | 종합 1위 |
| SWE Marathon | 42.0% | 종합 1위 |
| DeepSearchQA (F1) | 95.0% | — |
공식은 종합 능력이 Claude Fable 5·GPT-5.6 Sol에 이어 3위, 가격은 둘보다 훨씬 낮다고 합니다. K3 아키텍처·7/27 가중치는 오픈웨이트 공개 카운트다운, 심층 평가 참고.
2026년 7월 22–23일, 백악관 과학기술정책실(OSTP) 수석 Michael Kratsios가 X에서 Moonshot을 비난했습니다. 「대규모·은밀한 산업 규모 증류(distillation)」로 Anthropic Fable 능력을 탈취했고, 수출 허가 없는 Nvidia GB300(Grace Blackwell 300) 칩(태국 경유 가능성) 사용 의혹. 원문: 「Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology and undermining American research is unacceptable.」
재무장관 Scott Bessent도 「많은 중국 모델에서 미국 대모델 '워터마크' 발견」이라 맞장구쳤으나, 재무부는 「워터마크」 구체 설명에 응답하지 않았습니다. Kratsios는 공개 증거를 제시하지 않았고 Moonshot은 학습 과정 질의에 무응답입니다.
처음이 아닙니다. 2026년 2월 Anthropic은 Moonshot·DeepSeek·MiniMax 「산업 규모 증류 공격」을 공개 비난했습니다. 가짜 계정으로 Moonshot 340만 회 이상 비정상 API 상호작용 식별, 「정상 사용에서 명백히 벗어나 의도적 능력 추출을 반영」하며 API 메타데이터로 일부 행위가 Moonshot 고위와 연관된다고 주장. Moonshot은 확인·부인 모두 하지 않았습니다.
| 날짜 | 이벤트 |
|---|---|
| 2026-02 | Anthropic, Moonshot/DeepSeek/MiniMax 증류 최초 공개 비난 |
| 2026-07-01 | Claude Fable 5 대중 공개 |
| 2026-07-16 | Kimi K3 API/제품 공식 출시 |
| 2026-07-22/23 | OSTP 수석 Kratsios 증류+불법 칩 의혹 공개 |
| 2026-07-23 | TechCrunch, 전문가 증류설 회의 보도 |
| 2026-07-24 전후 | Ryan Greenblatt 「K3 Claude 자칭」통계 공개 |
| 2026-07-27(예정) | Kimi K3 전체 가중치 공개, 외부 독립 검증 가능 |
TechCrunch(7월 23일)는 다수 독립 연구자를 인터뷰했고, 증류설에 회의적 시각이 우세했습니다——Fable 5는 7월 1일부터 공개, K3 출시(7월 16일)까지 겨우 2주. RL식 증류에 필요한 교사 모델 대량 스코어링을 포함한 심층 증류는 데이터 규모·연산·API 비용 면에서 비현실적이라는 지적입니다.
Braden Hancock(Laude Institute / Snorkel AI 공동창업): 「I don't think you get a model this strong and this quickly on the heels of Fable doing strictly distillation... Fable's only been publicly available since July 1st. You can't distill that much data, train a model, and release it in two weeks.」
Nathan Lambert(Allen Institute for AI): 중국 모델이 프론티어에 가까워질수록 증류 한계효용은 줄고, 격차를 벌리는 건 더 비싼 RL 훈련입니다. 증류가 그렇게 유효했다면 업계 전체가 이미 GLM·K3에 따라잡았을 것——그렇지 않습니다.
「이중 잣대」도 지적됩니다. Elon Musk는 xAI가 Grok 훈련 시 OpenAI 모델을 증류했다고 법정에서 인정했고 업계에서 흔하다고 했습니다——문제는 「정상적 기술 참고」와 「은밀한 산업 규모 탈취」의 경계입니다.
Redwood Research 수석과학자 Ryan Greenblatt이 7월 24일 전후 통계 분석을 공개했습니다(GitHub: rgreenblatt/which_claude_is_k3). 다중 모델 자기 인식 행동 비교:
중요한 단서: Greenblatt는 이 발견이 증류 직접 증명이 아님을 강조합니다. 학습 데이터 오염·시스템 프롬프트 유출·공개 데이터셋 합성도 설명 가능. 다만 Anthropic 2월 주장과 통계적 규칙성을 합치면 증류설의 가장 기술적인 간접 증거입니다. 영어 차별화 KW: Why does Kimi K3 say it's Claude / Kimi K3 self-identifies as Claude——조사 시점 경쟁 기사 거의 없음.
Reddit r/LocalLLaMA에는 세 가지 목소리가 교차합니다. 「오픈과 클로즈드 격차가 몇 달이 아니라 며칠로 줄었다」는 환호. 「2.8T 파라미터는 로컬에서 아무도 못 돌린다」는 자조. K3 진짜 매력은 저가+완화된 콘텐츠 필터이지 「Fable 5 격파」가 아니라는 현실파.
전체 가중치는 7월 27일까지 공개되지 않아, 논란 격화 시점에 외부 연구자는 파라미터 규모·아키텍처·벤치 재현을 독립 검증할 수 없었습니다——여론 지속 발효의 구조적 원인. 산업 정책 파급: 미국은 중국 오픈웨이트 모델 제한을 논의 중, 칩 수출 통제 재점화(2026년 5월 Supermicro 창업자 선단 칩 밀수 기소 연상).
Opus 5는 「반값에 플래그십 추격」으로 시장의 가성비 요구에 답했습니다. Kimi K3는 「오픈+저가+제한 완화」로 공세. K3를 둘러싼 논란의 본질은 가성비 전쟁 속 「당신의 저가는 기술 최적화 결과인가, 타사 모델 무단 이용 결과인가」를 공개적으로 묻는 것입니다.
개발자 현실 조언: 컴플라이언스·데이터 보존·공급망 리스크가 중요하면 Opus 5 「가격 동결·능력 도약」이 매력적. 극한 비용·오픈웨이트 통제를 우선하면 7월 27일 가중치 공개 후 실측 가치——그 전까지는 공식 자평+외부 추측에 불과.
컴플라이언스 우선:Opus 5 + 강제 보존 없음 + Anthropic 공식 API
비용 극한:K3 가중치+독립 벤치 재현 후 자체 호스팅 vs API 판단
Agent 검증:Cursor / Claude Code / Kimi Code에서 CursorBench류 태스크 대조
GUI 세션:OAuth·Gateway·모델 전환 VNC 원격 Mac에서 클릭 검증
7/27 추적:가중치 공개 후 앵커 업데이트, 「K3 가중치 DL」「증류 입증?」롱테일
동일 토큰 단가에서 Opus 5는 Fable 5의 약 절반($5/$25 vs 약 $10/$50 /100만 input/output). CursorBench는 Fable 5 피크와 1% 미만 차이.
예. 7월 24일 출시 당일부터 Opus 5가 Claude Max 기본, Claude Pro 최강 버전.
논란 중, 미확정. 백악관 주장 공개 증거 부족. 전문가는 2주 타임라인으로 심층 증류 비현실적. Greenblatt 「Claude 자칭+내부 ID」가 최강 기술 간접 증거.
공식 약속 2026년 7월 27일. 본문 작성 시 미공개, 외부는 아키텍처·벤치 완전 독립 검증 불가.
open-weight(가중치 DL 가능), 엄밀한 fully open-source 아님. 라이선스 Moonshot modified-MIT 예상. 7/27 LICENSE 원문 확인.
Opus 5는 플래그십급 Agent 능력을 일상 token 청구서에 맞췄습니다. K3는 오픈 내러티브로 프론티어를 여론 중심에——그러나 증류 의혹과 Claude 자칭 통계는 벤치 표만으로 고르지 말라고 일깨웁니다. 컴플라이언스, 데이터 보존, 모델 출처도 동등히 중요합니다.
Cursor, Claude Code, Kimi Code에서 Opus 5·K3 라우팅을 즉시 검증하려면 Windows/Linux 주력기에서 OAuth 콜백, macOS 권한 대화상자, Gateway GUI 대조에 막히기 쉽습니다. Mac 구매에는 슬립 설정·OS 업데이트·감가상각 숨은 비용도 있습니다. VNCMac 원격 Mac + VNC 그래픽 세션이면 Gateway와 동일 환경에서 멀티모델 전환·로그 대조가 가능해, 이번 주 두 대형 이슈를 재현 가능한 Agent 검증으로 바꿀 수 있습니다.