Opus 5 — модель по умолчанию Claude Max · Белый дом обвиняет K3 · доказательства Greenblatt
Две новости — одна тема: соотношение цены и качества и реальный источник интеллекта моделей. 24 июля 2026 Anthropic выпустила Claude Opus 5 как модель по умолчанию Claude Max; свежий Kimi K3 от Moonshot AI Белый дом обвиняет в промышленной дистилляции, а независимые исследователи показывают, что K3 называет себя Claude и выдаёт внутренние ID деплоя. Материал охватывает бенчмарки, цены, безопасность и хранение данных Opus 5, характеристики K3, хронологию скандала, анализ Greenblatt, обвинения Anthropic в феврале, реакцию сообщества, тему стоимости и FAQ для разработчиков.
24 июля 2026 (тихоокеанское время) Anthropic представила Claude Opus 5 (ID: claude-opus-5) как модель по умолчанию Claude Max и самую мощную версию для Claude Pro. Позиционирование: рабочая модель на каждый день — интеллект близок к Fable 5 за полцены.
| Параметр | Значение |
|---|---|
| Цены | Input 5 $ / млн токенов, output 25 $ / млн (как у Opus 4.8) |
| Контекст | 1 млн токенов (единственный уровень по умолчанию) |
| Макс. output | 128K токенов |
| Reasoning | Thinking включён по умолчанию; Effort управляет глубиной |
| Платформы | Claude API / Platform / AWS Bedrock / Google Vertex AI / Microsoft Foundry |
| Fast-режим | ~2,5× быстрее, цена ×2 (как Opus 4.8) |
| Хранение данных | Без принудительного хранения по умолчанию (Fable 5 / Mythos 5: opt-in 30 дней) |
Отзывы клиентов: Cursor: «near Fable 5 intelligence at Opus speed and cost»; Zapier: лидер AutomationBench без лишних токенов; Box: +11 % анализ данных, +17 % due diligence, +8 % общая точность.
Opus 5 назван наиболее aligned моделью на сегодня: минимум обмана, сложнее злоупотребить, безопаснее избегать необратимых ошибок. В dual-use (кибербезопасность, биобезопасность) намеренно не на frontier — там Mythos 5 (ограниченный доступ). Классификатор кибербезопасности ~на 85 % мягче Fable 5 (уязвимости в исходниках — да, бинарные сканы/exploit — нет). Запросы биобезопасности, блокировавшиеся Fable 5, идут в Opus 5, а не Opus 4.8.
| Дата | Событие |
|---|---|
| 2026-06-09 | Релиз Claude Fable 5 / Mythos 5 |
| 2026-07-01 | Fable 5 доступен публично |
| 2026-07-24 | Claude Opus 5, модель по умолчанию Claude Max |
Цена Fable 5: ~10 $/50 $ за млн input/output — agent-workflow в 2× дороже
Хранение 30 дней: Fable 5 / Mythos 5 требуют opt-in — барьер для compliance
Избыточность: большинству задач код/авто не нужен уровень Mythos
Миграция: старый Opus = упущенный ~2× прирост в software engineering
Приёмка: сравнение Cursor / Claude Code часто требует GUI macOS и OAuth
| Измерение | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Относительная цена | ~50 % (5 $/25 $) | ~10 $/50 $ |
| CursorBench 3.2 (max) | 0,5 % ниже пика | Референс пика |
| Хранение по умолчанию | Не принудительно | Opt-in 30 дней |
| Claude Max по умолчанию | Да (с 24.07) | Нет |
| Dual-use frontier | Намеренно не лидер | Mythos 5 (ограничен) |
Moonshot AI выпустила Kimi K3 16 июля 2026: 2,8 трлн параметров (первая open-weight модель класса 3T); sparse MoE, 896 экспертов, 16 активных на токен (~50 млрд активных); Kimi Delta Attention (KDA) + Attention Residuals + Stable LatentMoE; эффективность обучения ~2,5× vs K2; контекст 1 млн токенов и нативное vision. Полные веса обещаны на 27 июля (на момент публикации ещё не вышли).
| Бенчмарк | Оценка | Примечание |
|---|---|---|
| GPQA-Diamond | 93,5 % | Лучший open-weight на релизе |
| Terminal-Bench 2.1 | 88,3 % | 0,5 п.п. ниже GPT-5.6 Sol |
| BrowseComp | 91,2 % | Рекорд на релизе |
| Humanity's Last Exam (с tools) | 56,0 % | — |
| MCP Atlas | 84,2 % | — |
| Program Bench | 77,8 % | Лучший суммарно |
| SWE Marathon | 42,0 % | Лучший суммарно |
| DeepSearchQA (F1) | 95,0 % | — |
Moonshot ставит K3 чуть ниже Claude Fable 5 и GPT-5.6 Sol, существенно дешевле. Подробнее: обратный отсчёт open weights.
22–23 июля 2026 директор OSTP Michael Kratsios обвинил на X Moonshot в «масштабной скрытой промышленной дистилляции» модели Fable Anthropic — плюс предполагаемое использование неэкспортированных Nvidia GB300 (Grace Blackwell 300, возможно через Таиланд). Цитата: «Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology and undermining American research is unacceptable.»
Министр финансов Scott Bessent говорил о «водяных знаках» US-моделей в китайских — без деталей. Kratsios не опубликовал доказательств; Moonshot не ответила на вопросы об обучении.
Не впервые: ещё в феврале 2026 Anthropic обвинила Moonshot, DeepSeek и MiniMax в «промышленных атаках дистилляции» — более 3,4 млн аномальных API-взаимодействий у Moonshot, «явно вне нормального использования», частично прослеженных до руководства. Moonshot ни подтвердила, ни опровергла.
| Дата | Событие |
|---|---|
| 2026-02 | Anthropic: первые публичные обвинения |
| 2026-07-01 | Fable 5 публично доступен |
| 2026-07-16 | Релиз API/продукта Kimi K3 |
| 2026-07-22/23 | Белый дом: дистилляция + чипы |
| 2026-07-23 | TechCrunch: эксперты сомневаются в сроках |
| ~2026-07-24 | Ryan Greenblatt: «K3 называет себя Claude» |
| 2026-07-27 (план) | Open weights K3 — внешняя проверка |
TechCrunch (23 июля) цитирует независимых исследователей: Fable 5 публичен с 1 июля — K3 вышел 16 июля, всего 14 дней. Глубокая дистилляция (особенно RL с миллионами teacher-scores) за такой срок маловероятна.
Braden Hancock (Laude Institute / Snorkel AI): «I don't think you get a model this strong and this quickly on the heels of Fable doing strictly distillation... Fable's only been publicly available since July 1st. You can't distill that much data, train a model, and release it in two weeks.»
Nathan Lambert (Allen Institute for AI): по мере приближения китайских моделей к frontier рычаг дистилляции слабеет; дорогое RL отделяет лидеров. Если бы дистилляция работала так хорошо, все давно догнали бы.
Двойные стандарты: Elon Musk признал, что xAI дистиллировала OpenAI для Grok — граница между «отраслевой практикой» и «промышленной кражей» политическая, не техническая.
Ryan Greenblatt (Redwood Research) опубликовал около 24 июля статистику (GitHub: rgreenblatt/which_claude_is_k3):
Уточнение: это не доказывает дистилляцию напрямую — возможны загрязнение данных или синтетические датасеты. Вместе с данными Anthropic за февраль — сильнейший технический аргумент. Дифференцирующие ключевые слова: Why does Kimi K3 say it's Claude / Kimi K3 self-identifies as Claude.
Reddit r/LocalLLaMA: восторг («open vs closed за дни, не месяцы»); шутки про 2,8T, которые никто не запустит локально; прагматики: низкая цена и меньше модерации, а не «победа над Fable 5».
Полные веса только 27 июля — поэтому внешние исследователи не могли независимо проверить архитектуру и бенчмарки. Спор затрагивает экспорт чипов и возможные ограничения китайских open weights (см. дело Supermicro, май 2026).
Opus 5 отвечает «полцены, почти флагман». K3 — «open weight + дёшево + меньше ограничений». Спор о дистилляции — открытый вопрос: реальная оптимизация или заимствованный интеллект?
Практический совет: compliance и хранение данных → Opus 5; минимальная стоимость и open weights → ждать 27.07 и независимых тестов.
Compliance: Opus 5 + без принудительного хранения + официальный API Anthropic
Минимальная стоимость: веса K3 + репликация бенчмарков
Приёмка agent: Cursor / Claude Code / Kimi Code на задачах типа CursorBench
GUI-сессия: OAuth и gateway на удалённом Mac через VNC
Обновление 27.07: long-tail «скачать K3» / «дистилляция доказана?»
Примерно вдвое: 5 $/25 $ против ~10 $/50 $ за миллион input/output. CursorBench max отстаёт от пика Fable 5 менее чем на 1 %.
Да — с 24 июля 2026 модель по умолчанию Claude Max и самая мощная версия Pro.
Не доказано. Белый дом без публичных доказательств; сроки оспариваются; статистика Greenblatt («идентичность Claude + внутренние ID») — сильнейший технический аргумент.
Официально 27 июля 2026. На момент публикации ещё не вышли.
Open weights (веса скачиваются), не fully open source. Лицензия, вероятно, Modified MIT — проверить LICENSE 27.07.
Opus 5 делает flagship-agent доступным в повседневном token-бюджете; K3 выводит frontier в open-weight-дискурс — но обвинения в дистилляции и статистика Greenblatt напоминают: бенчмарков мало; compliance, хранение данных и происхождение модели тоже важны.
Чтобы сразу проверить Cursor, Claude Code или Kimi Code с Opus 5 и K3, на Windows/Linux часто упираются в OAuth, права macOS и GUI gateway. VNCMac удалённый Mac + VNC — графическая сессия на том же хосте, что gateway: приёмка multi-model, а не только заголовки новостей.