**Wiederkehrender Bericht von Mozilla**, *The state of open source AI*, **v1.0.1, Juli 2026**, eingeleitet durch einen Brief von **Raffi Krikorian** (CTO): sieben Abschnitte, eine interaktive Website und ein herunterladbarer Bericht. These, formuliert im Titel von Abschnitt 1: *« The model layer has commoditized. Value accrues to the harness above it. »* **Fähigkeitsstand**: Auf dem *Artificial Analysis Intelligence Index v4.1* erzielt das beste geschlossene Modell **61** Punkte (Claude Opus 5) und das beste offene Modell **57** (**Kimi K3**), Rang vier insgesamt und vor drei der größten geschlossenen Labore; auf dem *Epoch Capabilities Index* beträgt der Abstand **6 Punkte** (K3 bei 156 gegenüber GPT-5.6 Sol bei 162), beschrieben als *« about one release cycle »*, bei sich überlappenden Konfidenzintervallen. **Sägezahnförmige Frontier**: Offene Modelle führen bei Frontend-Code (K3 mit 1.679 Elo in der LMArena Frontend Code Arena, sechs von sieben Domänen), liefern sich ein Kopf-an-Kopf-Rennen bei agentischer Terminalarbeit (88,3 gegenüber 88,8 im Terminal-Bench 2.1) und geben bei professioneller Wissensarbeit Boden ab (Fable 5 führt vor K3 mit 92 Elo im GDPval-AA v2). **Nutzungsverschiebung**: Der Anteil der über OpenRouter geleiteten Tokens, die an Open-Weight-Modelle gehen, stieg von einem vernachlässigbaren Niveau auf ein Drittel Ende 2025 und dann auf eine **Mehrheit bis Mitte 2026**, wobei die sieben Modelle mit dem höchsten Volumen alle offen gewichtet sind — der Bericht selbst merkt an, dass *« by request count, closed US providers still lead »*, wobei der Vorsprung der offenen Modelle ein Vorsprung beim Token-Volumen ist, der sich auf Coding- und agentische Workloads konzentriert. **Der zentrale Gegensatz**: *« Open ships easy. Open deploys hard. »* — 79 % der Entwickler, die KI einführen, nutzen offene Modelle gegenüber 71 % bei geschlossenen, aber nur **53 %** der Teams mit offenen Modellen erreichen die Produktion **gegenüber 63 %**, und die Lücke wächst mit der Organisationsgröße (geschlossen 54 % → 73 %, offen 53 % → 57 %), was *« rules out a resources explanation »*. Die Reifegradkarte des Stacks (48 Komponenten, 9 Schichten) zeigt zwei durchgängig kalte Spalten — **Standardisierung** und ***Enterprise Readiness*** — identifiziert als die operative Lücke. **Abschnitt 5**: *« The agentic harness is another user agent »*, und *« The model is eating the harness »* — bei jedem Modell, für das beide Varianten existieren, gewinnt inzwischen der Harness des jeweiligen Labors selbst, wobei sich die Lücke von 21,8 Punkten auf etwa 3 verringert hat. Daher die Formel: *« A harness tuned tightly to one lab's weights… degrades on anyone else's model, so the tighter the tuning, the less swappable the weights underneath. Lock-in arrives as a side effect of optimization. »*
#Mozilla#state of open source AI#Open Weights
**Mozilla** — éditeur du rapport · avec une introduction signée **Raffi Krikorian** · *Chief Technology Officer*. Publié en **juillet 2026** (v1.0.1). Données issues de sources tierces créditées (Artificial Analysis, Epoch AI, OpenRouter, LMArena) et d'une enquête propre menée avec **SlashData** (*Mozilla / SlashData 2026 developer survey*, n = 1 410 sur la question des freins).
Artikel von **Paul Sawers**, veröffentlicht in **The New Stack** am **16. Juni 2026**, über die **Aussetzung durch Anthropic** — *"on the very day it was scheduled to go live"* — der Abrechnungstrennung, die die Nutzung des **Agent SDK** von den Limits des Claude-Abonnements trennen sollte. **Von Anthropic zitierte Botschaft**: *"We're pausing the changes to Claude Agent SDK usage described below. For now, nothing has changed."* **Der Beitrag des Artikels liegt nicht in der Ankündigung, sondern im umgebenden Kontext**, in drei konzentrischen Kreisen. **Kreis 1 — Anthropics Woche**: am 9. Juni die Veröffentlichung von **Fable 5 und Mythos 5**, den ersten allgemein verfügbaren Modellen der Mythos-Klasse mit verschärften Cybersicherheits-Schutzmaßnahmen; wenige Tage später zwingt eine **Exportkontroll-Anordnung der US-Regierung** Anthropic, **beide Modelle weltweit für alle Kunden zurückzuziehen**. Die Aussetzung der Preisänderung wird in diesem Kontext als *"a little good news"* gelesen. **Kreis 2 — Kollateralschaden durch das Timing**: Unternehmen, die die Änderung bereits an ihre eigenen Kunden weitergegeben hatten, sehen sich überrumpelt; **Conductor**, ein auf dem Agent SDK aufbauendes Multi-Agenten-Coding-Tool, muss ein Dementi veröffentlichen (*"Anthropic has delayed the subscription updates to Claude plans"*). **Kreis 3 — die zugrunde liegende Spannung, die über Anthropic hinausreicht**: ein Zitat von **Boris Cherny** (Leiter von Claude Code) vom April, während einer früheren Einschränkung, wonach Abonnements *"weren't built for the usage patterns of these third-party tools"* — ein Eingeständnis, dass sich **Pauschalpreise und uneingeschränkte agentische Nutzung nicht vertragen**; **GitHub** hat die Frage auf dieselbe Weise geregelt und im Juni das Pauschalpreismodell der *premium requests* von **Copilot** zugunsten einer **tokenbasierten Abrechnung** abgeschafft, trotz Protesten. Hinzu kommt, dass **in derselben Woche** vor einem kalifornischen Bundesgericht eine **vorgeschlagene Sammelklage** eingereicht wurde, die behauptet, dass die **Max**-Stufen deutlich hinter den für intensive Coding-Sitzungen beworbenen Nutzungsmultiplikatoren zurückbleiben. Anthropic nennt keinen Zeitpunkt für einen überarbeiteten Ansatz und erklärt lediglich, man *"works to update the plan to better support how users build with Claude subscriptions."* **Schlussfolgerung des Autors**: zwischen dem staatlichen Druck rund um Fable und Mythos, einem geplanten **Börsengang** und **Gerüchten über Preissenkungen bei OpenAI** versucht Anthropic, **seine Entwicklerbasis auf seiner Seite zu halten** — und die Aussetzung ist vorerst ein Mittel zu diesem Zweck.
#Anthropic#Claude Agent SDK#Claude-Abonnement
**Paul Sawers** — journaliste tech · signe ici pour **The New Stack**. Registre de **presse spécialisée** : l'article ne relaie pas seulement l'annonce · il la replace dans une série (les changements de facturation successifs d'Anthropic) · la compare à un précédent sectoriel (GitHub Copilot) et l'articule à trois pressions concomitantes (export control, IPO, concurrence). Sourçage explicite et attribué — le billet de Zed · l'analyse de Matthew Diakonov · le post de Conductor · une déclaration antérieure de Boris Cherny.