AI дайджест 25 июля 2026 ~24 мин Claude Opus 5 Kimi K3

Claude Opus 5 вдвое дешевле —
Kimi K3 в скандале дистилляции

Opus 5 — модель по умолчанию Claude Max · Белый дом обвиняет K3 · доказательства Greenblatt

Claude Opus 5 релиз и скандал дистилляции Kimi K3 AI дайджест

Две новости — одна тема: соотношение цены и качества и реальный источник интеллекта моделей. 24 июля 2026 Anthropic выпустила Claude Opus 5 как модель по умолчанию Claude Max; свежий Kimi K3 от Moonshot AI Белый дом обвиняет в промышленной дистилляции, а независимые исследователи показывают, что K3 называет себя Claude и выдаёт внутренние ID деплоя. Материал охватывает бенчмарки, цены, безопасность и хранение данных Opus 5, характеристики K3, хронологию скандала, анализ Greenblatt, обвинения Anthropic в феврале, реакцию сообщества, тему стоимости и FAQ для разработчиков.

01

Claude Opus 5: не флагман, но, возможно, самый практичный Claude

24 июля 2026 (тихоокеанское время) Anthropic представила Claude Opus 5 (ID: claude-opus-5) как модель по умолчанию Claude Max и самую мощную версию для Claude Pro. Позиционирование: рабочая модель на каждый день — интеллект близок к Fable 5 за полцены.

ПараметрЗначение
ЦеныInput 5 $ / млн токенов, output 25 $ / млн (как у Opus 4.8)
Контекст1 млн токенов (единственный уровень по умолчанию)
Макс. output128K токенов
ReasoningThinking включён по умолчанию; Effort управляет глубиной
ПлатформыClaude API / Platform / AWS Bedrock / Google Vertex AI / Microsoft Foundry
Fast-режим~2,5× быстрее, цена ×2 (как Opus 4.8)
Хранение данныхБез принудительного хранения по умолчанию (Fable 5 / Mythos 5: opt-in 30 дней)

Ключевые бенчмарки (официально Anthropic)

  • Frontier-Bench v0.1 (software engineering): обходит все модели, более чем в 2× лучше Opus 4.8, ниже стоимость задачи
  • CursorBench 3.2: max effort всего на 0,5 % ниже пика Fable 5, стоимость вдвое меньше; лучшее соотношение цена/качество на high/xhigh/max
  • ARC-AGI 3: результат в выше следующей модели
  • Zapier AutomationBench: ~1,5× pass rate; минимальный effort обходит всех; end-to-end account health 100 %
  • OSWorld 2.0: лидер при любой стоимости; с ~⅓ бюджета Fable 5 превосходит лучший результат Fable 5
  • Наука / life sciences: структурная биология, органическая химия, биоинформатика выше Opus 4.8; спектр→структура +10,2 п.п.; варианты белков +7,7 п.п.

Отзывы клиентов: Cursor: «near Fable 5 intelligence at Opus speed and cost»; Zapier: лидер AutomationBench без лишних токенов; Box: +11 % анализ данных, +17 % due diligence, +8 % общая точность.

Выравнивание и безопасность

Opus 5 назван наиболее aligned моделью на сегодня: минимум обмана, сложнее злоупотребить, безопаснее избегать необратимых ошибок. В dual-use (кибербезопасность, биобезопасность) намеренно не на frontier — там Mythos 5 (ограниченный доступ). Классификатор кибербезопасности ~на 85 % мягче Fable 5 (уязвимости в исходниках — да, бинарные сканы/exploit — нет). Запросы биобезопасности, блокировавшиеся Fable 5, идут в Opus 5, а не Opus 4.8.

ДатаСобытие
2026-06-09Релиз Claude Fable 5 / Mythos 5
2026-07-01Fable 5 доступен публично
2026-07-24Claude Opus 5, модель по умолчанию Claude Max
02

Матрица выбора: Opus 5 vs Fable 5

  1. 01

    Цена Fable 5: ~10 $/50 $ за млн input/output — agent-workflow в 2× дороже

  2. 02

    Хранение 30 дней: Fable 5 / Mythos 5 требуют opt-in — барьер для compliance

  3. 03

    Избыточность: большинству задач код/авто не нужен уровень Mythos

  4. 04

    Миграция: старый Opus = упущенный ~2× прирост в software engineering

  5. 05

    Приёмка: сравнение Cursor / Claude Code часто требует GUI macOS и OAuth

ИзмерениеClaude Opus 5Claude Fable 5
Относительная цена~50 % (5 $/25 $)~10 $/50 $
CursorBench 3.2 (max)0,5 % ниже пикаРеференс пика
Хранение по умолчаниюНе принудительноOpt-in 30 дней
Claude Max по умолчаниюДа (с 24.07)Нет
Dual-use frontierНамеренно не лидерMythos 5 (ограничен)
03

Kimi K3: первая open-weight модель 2,8T и бенчмарки

Moonshot AI выпустила Kimi K3 16 июля 2026: 2,8 трлн параметров (первая open-weight модель класса 3T); sparse MoE, 896 экспертов, 16 активных на токен (~50 млрд активных); Kimi Delta Attention (KDA) + Attention Residuals + Stable LatentMoE; эффективность обучения ~2,5× vs K2; контекст 1 млн токенов и нативное vision. Полные веса обещаны на 27 июля (на момент публикации ещё не вышли).

БенчмаркОценкаПримечание
GPQA-Diamond93,5 %Лучший open-weight на релизе
Terminal-Bench 2.188,3 %0,5 п.п. ниже GPT-5.6 Sol
BrowseComp91,2 %Рекорд на релизе
Humanity's Last Exam (с tools)56,0 %
MCP Atlas84,2 %
Program Bench77,8 %Лучший суммарно
SWE Marathon42,0 %Лучший суммарно
DeepSearchQA (F1)95,0 %

Moonshot ставит K3 чуть ниже Claude Fable 5 и GPT-5.6 Sol, существенно дешевле. Подробнее: обратный отсчёт open weights.

04

Скандал дистилляции: Белый дом и Anthropic

22–23 июля 2026 директор OSTP Michael Kratsios обвинил на X Moonshot в «масштабной скрытой промышленной дистилляции» модели Fable Anthropic — плюс предполагаемое использование неэкспортированных Nvidia GB300 (Grace Blackwell 300, возможно через Таиланд). Цитата: «Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology and undermining American research is unacceptable.»

Министр финансов Scott Bessent говорил о «водяных знаках» US-моделей в китайских — без деталей. Kratsios не опубликовал доказательств; Moonshot не ответила на вопросы об обучении.

Не впервые: ещё в феврале 2026 Anthropic обвинила Moonshot, DeepSeek и MiniMax в «промышленных атаках дистилляции» — более 3,4 млн аномальных API-взаимодействий у Moonshot, «явно вне нормального использования», частично прослеженных до руководства. Moonshot ни подтвердила, ни опровергла.

ДатаСобытие
2026-02Anthropic: первые публичные обвинения
2026-07-01Fable 5 публично доступен
2026-07-16Релиз API/продукта Kimi K3
2026-07-22/23Белый дом: дистилляция + чипы
2026-07-23TechCrunch: эксперты сомневаются в сроках
~2026-07-24Ryan Greenblatt: «K3 называет себя Claude»
2026-07-27 (план)Open weights K3 — внешняя проверка
05

Возражение экспертов: сроки не сходятся

TechCrunch (23 июля) цитирует независимых исследователей: Fable 5 публичен с 1 июля — K3 вышел 16 июля, всего 14 дней. Глубокая дистилляция (особенно RL с миллионами teacher-scores) за такой срок маловероятна.

"

Braden Hancock (Laude Institute / Snorkel AI): «I don't think you get a model this strong and this quickly on the heels of Fable doing strictly distillation... Fable's only been publicly available since July 1st. You can't distill that much data, train a model, and release it in two weeks.»

"

Nathan Lambert (Allen Institute for AI): по мере приближения китайских моделей к frontier рычаг дистилляции слабеет; дорогое RL отделяет лидеров. Если бы дистилляция работала так хорошо, все давно догнали бы.

Двойные стандарты: Elon Musk признал, что xAI дистиллировала OpenAI для Grok — граница между «отраслевой практикой» и «промышленной кражей» политическая, не техническая.

06

Сильнейшее техническое доказательство: K3 называет себя Claude

Ryan Greenblatt (Redwood Research) опубликовал около 24 июля статистику (GitHub: rgreenblatt/which_claude_is_k3):

  • K3 аномально часто называет себя Claude и называет внутренние ID вроде claude-opus-4-5-20250929, claude-sonnet-4-5-20250929
  • Настоящий Claude Sonnet 4.5 говорит только «Я Claude Sonnet 4.5»; Opus 4.5 редко или неверно называет такие ID
  • Greenblatt: ученик знает метаданные деплоя точнее учителя — трудно объяснить имитацией стиля; скорее обучающие данные с API-логами
  • K3 зафиксирован на эре Claude 4.5 (конец 2025), не Fable/Mythos; K2 — более ранние сигналы Sonnet 4 — паттерн «догоняющего поколения»

Уточнение: это не доказывает дистилляцию напрямую — возможны загрязнение данных или синтетические датасеты. Вместе с данными Anthropic за февраль — сильнейший технический аргумент. Дифференцирующие ключевые слова: Why does Kimi K3 say it's Claude / Kimi K3 self-identifies as Claude.

07

Сообщество и интрига 27 июля

Reddit r/LocalLLaMA: восторг («open vs closed за дни, не месяцы»); шутки про 2,8T, которые никто не запустит локально; прагматики: низкая цена и меньше модерации, а не «победа над Fable 5».

Полные веса только 27 июля — поэтому внешние исследователи не могли независимо проверить архитектуру и бенчмарки. Спор затрагивает экспорт чипов и возможные ограничения китайских open weights (см. дело Supermicro, май 2026).

08

Общий знаменатель: цена и ценность

Opus 5 отвечает «полцены, почти флагман». K3 — «open weight + дёшево + меньше ограничений». Спор о дистилляции — открытый вопрос: реальная оптимизация или заимствованный интеллект?

Практический совет: compliance и хранение данных → Opus 5; минимальная стоимость и open weights → ждать 27.07 и независимых тестов.

  1. 01

    Compliance: Opus 5 + без принудительного хранения + официальный API Anthropic

  2. 02

    Минимальная стоимость: веса K3 + репликация бенчмарков

  3. 03

    Приёмка agent: Cursor / Claude Code / Kimi Code на задачах типа CursorBench

  4. 04

    GUI-сессия: OAuth и gateway на удалённом Mac через VNC

  5. 05

    Обновление 27.07: long-tail «скачать K3» / «дистилляция доказана?»

FAQ

Частые вопросы

Примерно вдвое: 5 $/25 $ против ~10 $/50 $ за миллион input/output. CursorBench max отстаёт от пика Fable 5 менее чем на 1 %.

Да — с 24 июля 2026 модель по умолчанию Claude Max и самая мощная версия Pro.

Не доказано. Белый дом без публичных доказательств; сроки оспариваются; статистика Greenblatt («идентичность Claude + внутренние ID») — сильнейший технический аргумент.

Официально 27 июля 2026. На момент публикации ещё не вышли.

Open weights (веса скачиваются), не fully open source. Лицензия, вероятно, Modified MIT — проверить LICENSE 27.07.

Заключение

Opus 5 делает flagship-agent доступным в повседневном token-бюджете; K3 выводит frontier в open-weight-дискурс — но обвинения в дистилляции и статистика Greenblatt напоминают: бенчмарков мало; compliance, хранение данных и происхождение модели тоже важны.

Чтобы сразу проверить Cursor, Claude Code или Kimi Code с Opus 5 и K3, на Windows/Linux часто упираются в OAuth, права macOS и GUI gateway. VNCMac удалённый Mac + VNC — графическая сессия на том же хосте, что gateway: приёмка multi-model, а не только заголовки новостей.