LLM-Trends 27. Juli 2026 ~16 Min. Lesezeit OpenRouter DeepSeek

OpenRouter Rankings Juli 2026
Wer gewinnt den KI-Modell-Wettlauf wirklich?

Echtes Token-Volumen · 46 % China-Anteil · Nutzung ≠ Qualität · Apps-Ebene · August-Ausblick

OpenRouter Juli 2026 Rankings und Marktanteil chinesischer Modelle

Wer sein LLM noch nach einem Benchmark von vor zwei Monaten wählt, liegt bereits zurück.Fazit: OpenRouter bewertet Labs nicht – es routet echten, bezahlten Traffic. Stand 25. Juli 2026 führt Xiaomis Mimo V2.5 mit ~1,4 Billionen Tokens/Tag, chinesische Labs halten ~46 %, und Nutzungsrang ist kein Qualitätssignal – der Markt spaltet sich in günstiges Open-Weight-Volumen und geschlossene Frontier-Preismacht bei schweren Aufgaben.Dieser Leitfaden: Top-12-Modelle, Anbieteranteile, Apps-Ranking (Hermes / Kilo Code / OpenClaw), August-Ausblick, rollenbasiertes Routing und eine fünfstufige Mac-Akzeptanz-Checkliste. Siehe auch Juni-Rankings und OpenRouter-API-Leitfaden.

01

Juli-Leaderboard: Xiaomi auf #1, chinesische Labs über 46 %

Stand 25. Juli sind die Top drei nach täglichem Token-Volumen Mimo V2.5 (1,4T/Tag), DeepSeek V4 Flash (943,9B/Tag) und Tencent Hy3 (590B/Tag). Sieben der Top-10-Modelle sind chinesisch; NVIDIA Nemotron 3 Ultra, Claude und Gemini halten die US-Seite.

RangModellLabTokens/Tag30-Tage-Summe
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (kostenlos)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (neu)
10Ling 3.0 FlashInclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Auf Anbieterebene machen chinesische Labs ~46 % des identifizierten Token-Volumens aus – vor einem Jahr unter 2 %. US-Labs (OpenAI, Anthropic, Google) sanken von ~70 % Mitte 2025 auf 30–36 %. Das ist Preisarithmetik: DeepSeek V4 Flash kostet ~$0,05–$0,14/M Input vs. GPT-5.5 bei ~$5/M – rund 35× Unterschied.

Zitierbar: DeepSeek bleibt stabilstes #1-Lab (~16–18 %), aber die „Modell des Monats“-Krone rotiert – MiniMax M2.5 im Februar, MiMo-V2-Pro im April, Mimo V2.5 im Juli.

02

Was die meisten Berichte übersehen: Nutzungsrang ≠ Qualitätssignal

Ein günstiges, schnelles Modell in einer hochfrequentierten Consumer-App kann ein fähigeres Modell überholen, das für die schwersten 10 % reserviert ist.

Fünf Kosten falscher Leaderboard-Lesart

  1. 01

    Volumen mit Fähigkeit verwechseln: Roleplay, Chat und leichtes Coding dominieren Open-Model-Traffic – nicht Enterprise-Reasoning.

  2. 02

    Ausgabenmix ignorieren: Nach Kategorie: Chat 35,7 %, agentische Workflows 30,4 %, Code 26,5 % – bei Klassifikation Claude Sonnet 4.6 und Opus 4.7 je ~13,5 %.

  3. 03

    Tägliche Volatilität: Claude Opus 4.8 war am 24.7. in den Top 10; Ling 3.0 Flash drängte es bis 25.7. aus den Top 12. Stichtag immer nennen.

  4. 04

    Steigende Sicherheitsgewichtung: OpenAIs Sandbox-Escape-Offenlegung diese Woche bringt „Vendor-Safety-Track-Record“ in Enterprise-Scorecards.

  5. 05

    Single-Model-Lock-in: Claude Opus 5 (24.7.) führt FrontierBench v0.1 mit 43,3 % bei Opus-Preisen $5/$25 – Frontier-Labs behalten Preismacht bei schweren Tasks.

SegmentTypische WorkloadsVolumen-ChartSchwer-Task-Ausgaben
Hochvolumen, tolerantChat, Kreativ, Roleplay, Routine-CodingChinesische Open-Flash-ModelleGeringer Anteil
Niedrigtoleranz, hoher WertKomplexes Reasoning, Agent-Planung, KlassifikationSelten Top 10Claude / GPT Frontier
03

Apps-Ebene: Coding Agents dominieren; Roleplay ist die unsichtbare Hälfte

Modell-Rankings zeigen, welches Gehirn beliebt ist. Das Apps-Leaderboard zeigt, wofür es genutzt wird:

RangAppTypAnteil (~)
1Hermes AgentPersönlicher / CLI-Agent~45 %
2Kilo CodeCoding-Agent~13 %
3OpenClawAllgemeiner Agent~9 %
4Claude CodeCoding-Agent~6 %
5DescriptContent~4,5 %
6–10pi, Lemonade, ISEKAI ZERO, Janitor AI, ClineAgent / Companion / Roleplayje ~1,7 %–3,3 %

Cline → Roo Code → Kilo Code sind drei Forks derselben Linie; der jüngste Fork Kilo Code hat beide Vorgänger überholt – First-Mover-Vorteil in Open-Source-Dev-Tools hält nicht lange.

OpenRouter × a16z State of AI: kreatives Roleplay macht über die Hälfte der Open-Model-Nutzung aus. Wer nur Enterprise-Schlagzeilen liest, verpasst die halbe Marktseite.

04

August-Ausblick und Preis-Snapshot

  1. 01

    Chinesischer Open-Weight-Anteil steigt Richtung 50 %+ – sofern kein US-Anbieter massiv senkt.

  2. 02

    Monatliches #1 rotiert weiter zwischen Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax und Moonshot.

  3. 03

    Anthropic könnte günstigeres Volumen-Tier liefern – Opus 5 ist ihr vierter Flagship in unter zwei Monaten.

  4. 04

    Kimi K3s 1,4TB-Gewichte sollten in 2–4 Wochen Community-Quantisierung sehen.

  5. 05

    Sicherheit und Governance werden Auswahlkriterien – US-„AI Kill Switch“-Gesetz und White-House-Vorab-Review vor August erwartet.

Repräsentative Preise (Juli 2026)

ModellInput/MOutput/MPositionierung
DeepSeek V4 Flash~$0,05–0,14~$0,24–0,28Bestes Preis-Leistungs; agentisches Coding
MiniMax M3$0,10$1,21Langer Kontext günstig
GLM 5.2$0,45$3,31Open-Weight Opus-Planung
Kimi K3~$3~$151,4TB Open Weights
Claude Opus 5$5 (fast $10)$25 (fast $50)Geschlossene Frontier; schwere Tasks
05

Rollenbasierte Empfehlungen + fünfstufige Mac-Routing-Checkliste

RolleEmpfohlener Ansatz
Indie / kleines TeamOpenRouter als Sandbox; Coding mit DeepSeek V4 Flash und GLM 5.2 starten, Opus 5 / GPT-5.6 nur bei echten Fehlern
Infra-LeadNicht nur nach Nutzungsrang wählen; Routen nach Task-Risiko staffeln, Vendor-Safety in Scorecards
Agent- / DevTool-BuilderKilo-Code-Fork-Geschichte studieren; Companion-/Entertainment-Volumen ist real, auch ohne Enterprise-Presse

Auf dem Mac mit Claude Code, OpenClaw oder Kilo Code Barbell-Routing in dieser Reihenfolge umsetzen:

  1. 01

    Tasks staffeln: S-Tier (schwerste 5 %) → geschlossene Frontier-Modelle; A-Tier → DeepSeek / GLM; B-Tier → Flash-Klasse.

  2. 02

    Ein Router: OpenRouter oder OpenClaw-models-Config – kein hardcodierter Provider im App-Code.

  3. 03

    Ausgaben-Alerts: Tages-/Wochenlimits pro Modell, damit Agents nicht versehentlich Opus loopen.

  4. 04

    Qualitäts-Probes: 10–20 feste Regressions-Prompts vor Traffic-Verschiebung auf neues Modell.

  5. 05

    VNC-Akzeptanz: OAuth, Gateway, Browser-MCP und Berechtigungsdialoge in grafischer Mac-Session neben dem Agent prüfen.

Weiterlesen
FAQ

FAQ

Nein – sortiert nach bezahltem Token-Volumen. Bei Schwer-Task-Ausgaben führen Claude Sonnet 4.6 und Opus 4.7.

Stand 25. Juli Xiaomi Mimo V2.5 mit ~1,4T Tokens/Tag, dann DeepSeek V4 Flash und Tencent Hy3.

Rund 46 % zusammen (vor einem Jahr unter 2 %). US-Labs ~30–36 %.

Nous Researchs offener selbstverbessernder Agent hält ~45 % App-Token-Anteil – hohe persönliche Automatisierung, kein Qualitätsvote.

Fazit

Die Juli-Linie zum Merken: Fähigkeit und Popularität divergieren. Chinesische Open-Weight-Modelle kauften mit dem Preis die halbe Marktseite; US-geschlossene Frontier-Labs verteidigen die andere Hälfte bei schweren Tasks und Sicherheitsglaubwürdigkeit.

Wer Windows oder Linux nutzt, aber macOS für Claude Code, OpenClaw oder Kilo Code braucht: Mac-Kauf bedeutet Abschreibung und Sleep-Policy-Overhead; reines SSH verpasst OAuth und Berechtigungsdialoge. VNCMac Remote Mac mit VNC erlaubt Barbell-Routing gegen das OpenRouter-Dashboard auf derselben Maschine wie Ihr Gateway. Preise und Startseite prüfen.

Datenstand 25. Juli 2026 – vor Zitaten live prüfen unter openrouter.ai/rankings.