Zum Inhalt springen

root / tags / poids-ouverts

#poids ouverts

8 Fiches

Qualität & Sicherheit Automatisch geprüfte Übersetzung

GLM-5.3: Frontier Coding with Emergent Cyber Capabilities

Ankündigungsbeitrag, veröffentlicht im **offiziellen Z.ai-Blog** (ehemals Zhipu AI, chinesisches Labor) am **14. August 2026**, **ohne namentliche Autorenangabe**, ~2.000 Wörter plus Fußnoten. Er kündigt **GLM-5.3** an, den Nachfolger von GLM-5.2, und eröffnet mit einer methodischen These: *« Scaling post-training is all we did for GLM-5.3. »* Dasselbe Basismodell wie GLM-5.2 — *« every gain comes from post-training »*. Drei Ankündigungen. **(A) Ein Coding-Modell mit offenen Gewichten**: +50 % beansprucht auf **Z.ai Code Bench**, einem unveröffentlichten internen Benchmark. **(B) Eine als „emergent" dargestellte Cyber-Fähigkeit**, die der Fließtext auf eine Trainingsentscheidung zurückführt — *« As part of post-training, we introduced vulnerability discovery data and environments into the training mix. We expected this to make the model better at finding and reasoning about vulnerabilities »* — überraschend waren die Geschwindigkeit und der Wandel in der Natur: Das Modell geht von der Identifizierung isolierter Schwachstellen zu *« coherent plans for complete exploitation chains »* über. Die Gewinne wachsen mit der Position in der Exploitation-Kette: CyberGym 77,2 → **84,5 %**, ExploitBench 24,4 → **54,4 %** (×2,2), ExploitGym 29 → **105** Aufgaben in 2 h (×3,6), wobei der Abstand zur geschlossenen Frontier weiterhin groß bleibt (181 und 247 Aufgaben). Z.ai formuliert es so: *« Capability is growing fastest exactly where we are furthest behind. »* Der Beitrag veröffentlicht zudem ein **Z.ai Security Disclosure Ledger**: **2.436 identifizierte Schwachstellen in 269 Open-Source-Projekten** — Kernel, Betriebssysteme, Browser-Engines, Infrastruktur, Webanwendungen, Netzwerkprotokolle — die älteste eingeführt **1981**, durchschnittliche Lebensdauer bis zur Entdeckung **26,6 Jahre**, davon **53 offengelegt** und **2.383 unter Embargo**. **(C) Eine Gewichtsfreigabe** *« within two weeks of launch, once safety evaluation and hardening are complete »*. Der am ehesten übertragbare methodische Beitrag: **Synthese von Umgebungen und Verifiern**, wobei Letztere ohne Zugriff auf die Referenzlösung erzeugt und erst nach einem Triptychon negativer Kontrollen zugelassen werden — **oracle**, **no-op**, **unsolved-state**. Alle agentischen Evaluierungen werden **in Claude Code 2.1.207** durchgeführt.

#GLM-5.3#GLM-5.2#Z.ai

**Z.ai** (anciennement **Zhipu AI**) · laboratoire d'IA chinois · éditeur de la famille **GLM**. Billet **institutionnel et non signé** : aucun auteur nommé · aucun chercheur mis en avant · aucun lien vers un rapport technique ou une carte de modèle. Publié le **14 août 2026**. La page est une SPA React — le HTML servi est un `<div id="root">` vide · et le texte comme les scores ont dû être extraits du bundle `glm-5.3-BCnx8T5_.js` · où ils figurent en valeurs source.

Wirtschaft & Markt Automatisch geprüfte Übersetzung

Mistral AI wants to build 1 gigawatt of European compute by 2030 — and lock in customers now.

Analysierter Newsartikel, veröffentlicht bei **VentureBeat** am **11. August 2026** von **Michael Nuñez**, basierend auf einem **exklusiven Interview mit Timothée Lacroix**, Mitgründer und CTO von **Mistral AI**, geführt im Vorfeld der Ankündigung, ~2.000 Wörter. Mistral erweitert sein Infrastrukturangebot in drei Teilen: **Mistral Regional Endpoints** in allgemeiner Verfügbarkeit (Anbindung von Inferenz und der zugehörigen Verarbeitung an Europa oder die Vereinigten Staaten), eine **Priority Tier** in Public Preview (zugesicherte Service-Level, individuelle Quoten, Verfügbarkeits-SLA) und eine **Koalition europäischer Unternehmen**, deren mehrjährige Verpflichtungen **200 MW bis Ende 2027** und **1 GW bis Ende 2030** finanzieren sollen. Das Vehikel heißt **European Compute Unit (ECU)**: ein Anspruch auf von Mistral aufgebaute Kapazität, fungibel über Inferenz, Training, Modellanpassung oder verwaltetes Kubernetes, über einen angepeilten Fünfjahreshorizont. Lacroix beschreibt den Mechanismus unverblümt — *"The whole point of compute units is to have commitment"* — und zum vorzeitigen Ausstieg: *"There is no getting out."* Der Artikel stuft den Ehrgeiz ein: Mistral erklärt, *"less than 200 MW"* zu betreiben, und benennt drei Standorte mit insgesamt **77 MW** (44 MW bei Paris, 23 MW in Schweden mit EcoDataCenter, 10 MW in Les Ulis); **Epoch AI** beziffert die anfänglichen Kapitalkosten für ein Gigawatt-KI-Rechenzentrum auf **~38 Mrd. $**, und **Goldman Sachs Research** setzt die Kosten der nächsten Rechenzentrumsgeneration auf **15-20 Mio. $/MW ohne Chips** an, gegenüber den insgesamt von Mistral eingeworbenen **~4 Mrd. $** (PitchBook). Hinzu kommt eine Entscheidung, die *"is likely to raise a few eyebrows among sovereignty purists"*: Mistral beginnt, **Open-Source-Modelle Dritter zu hosten**, angefangen mit **GLM-5.2** von **Z.ai**, einem chinesischen Labor — *"It's a great model. Everyone loves it. It's open-weight, so there was no good reason for us not to do it."* Der Artikel geht dem Kleingedruckten in Mistrals Dokumentation nach, das *"limited, controlled transfers"* an Subunternehmer außerhalb der Region erwähnt; auf Details angesprochen, verweist Lacroix auf **Tool Calls**, insbesondere Websuche, und erklärt, dass **Gating das Feature ist, nicht der Bug**. Die Einordnung des Autors: *"full regional control is available, but the moment an AI agent reaches out to the open web, sovereignty becomes a configuration decision, not a default."* Zwei Abhängigkeiten bleiben bestehen: **GPUs** stammen von Nvidia, und **Microsoft** — Ankermieter der europäischen Rechenzentren von Mistral seit Juli — wird als Faktor dargestellt, der den Ausbau absichert.

#Mistral AI#digitale Souveränität#KI-Souveränität

**Michael Nuñez** — journaliste **VentureBeat** · couvre l'IA et l'infrastructure ; déjà présent au corpus. L'article est bâti sur un **entretien exclusif avec Timothée Lacroix** · cofondateur et CTO de Mistral AI · conduit **avant l'annonce** · et fait suite à un entretien de juin avec le même interlocuteur. Publié le **11 août 2026**.

Philosophie & Gesellschaft Automatisch geprüfte Übersetzung

The Future is for Everyone: The Path to a Positive AI Future

Doktrinäres Manifest, veröffentlicht auf **meta.com** am **10. August 2026**, nur mit Vornamen unterzeichnet (*"– Mark"*) von **Mark Zuckerberg**, unter dem Titel *"The Future is for Everyone: The Path to a Positive AI Future"*, ~6.500 Wörter. Von Beginn an werden drei Prinzipien verkündet: individuelle Ermächtigung als Quelle von Wohlstand, Erfindung als primärer Zweck von Superintelligenz, Machtgleichgewicht als Grundlage von Sicherheit. **(A) Das zentrale Argument ist ein politisches Argument**, formuliert als kurze Kette: *"Humanity is not a monoculture"* — die Werte der Menschen kodieren gegensätzliche Kompromisse, keine technische Lösung kann sich gleichzeitig an widersprüchlichen Interessen ausrichten, weshalb jede singuläre Superintelligenz bestimmte Werte gegenüber anderen priorisieren müsste und dadurch unfähig wäre, gegenüber allen wohlwollend zu sein. Daraus die Formel: *"There is no such thing as a singular benevolent superintelligence."* Sicherheit wird als Problem der Machtverteilung neu gerahmt, veranschaulicht durch ein dreifach wiederholtes Gedankenexperiment (ein einziger superintelligenter Anwalt gegenüber der Situation, in der jeder einen hat; dasselbe für Cybersicherheit, dann für Wirtschaft). **(B) Eine Neudefinition von Alignment**: *"Solving alignment is necessary for billions of people to adopt personal superintelligence agents. But it also implies that if we reach a state where billions of people are using and scrutinizing personal superintelligence agents, then we will have solved alignment with their interests."* Das Korollar zielt, ohne sie zu nennen, auf den Rest der Branche: *"the most dangerous scenario would be leading labs training powerful models and keeping them for themselves."* **(C) Datierbare Zusagen**: ein **vollständig privater** Modus, bei dem *"even Meta"* weder Einblick noch Zugriff gewähren kann (eine WhatsApp-Analogie); **kostenlose** Versionen für Milliarden Menschen, gepaart mit einem **dynamischen Gebotsmechanismus** für bezahlte Rechenleistung; die angekündigte **Wiederaufnahme** von Open-Source-Veröffentlichungen — *"we will soon resume releasing some open source models"*; sowie eine Struktur, die dem **unabhängigen Board** die Befugnis gibt, Sicherheitskriterien für Veröffentlichungen zu genehmigen und deren Einhaltung bei jeder Veröffentlichung zu prüfen, wobei der Autor einräumt, dass Meta ein von den Gründern kontrolliertes Unternehmen ist. **(D) Zwei wirtschaftspolitische Vorschläge**, dreifach wiederholt: dass Labore **Zwischen-Trainingscheckpoints** und Ingenieure mit der Regierung teilen statt einer Überprüfung am Ende des Zyklus, und dass die **physische Produktion** gefährlicher Materialien reguliert wird statt der Verbreitung von Wissen. Die Quellenlage des Textes ist nahezu inexistent.

#Mark Zuckerberg#Meta#Meta Superintelligence Labs

**Mark Zuckerberg** — fondateur et PDG de **Meta**. Texte signé du seul prénom (*« – Mark »*) · publié le **10 août 2026** sur un domaine dédié de meta.com. La signature n'est pas « Meta » · et l'alternance des pronoms est régulière : **« we » pour les engagements de l'entreprise** (*« we will offer free versions »*, *« Meta is implementing a governance structure »*) · **« I » pour les affirmations normatives ou contestables** (*« I think this view of alignment is fundamentally flawed »*, *« I propose that companies developing frontier AI should… »*, *« My honest guess, and it is a guess »*). Les engagements produits et de gouvernance sont au « nous » · les propositions de politique publique au « je ».

Qualität & Sicherheit Automatisch geprüfte Übersetzung

Shieldstral : Mistral compile sa doctrine en 3,8 milliards de paramètres

Eine von **Didier Girard** verfasste Watch-Notiz, veröffentlicht auf **X** am **7. August 2026**, die den Launch von **Shieldstral 1.0 3B** (Mistral AI, 4. August 2026) nicht als Produktveröffentlichung liest, sondern als **die produktive Umsetzung einer Doktrin**. Ausgangspunkt: Am **13. Mai 2026** lehnte **Arthur Mensch** vor dem Untersuchungsausschuss der Nationalversammlung zu digitalen Verwundbarkeiten jede Aufsichtsrolle von Mistral über den Endgebrauch seiner Modelle ab – *„wir besitzen keine demokratische Legitimität“* – und wies damit explizit die Haltung von **Anthropic** zurück. Weniger als drei Monate später veröffentlicht Mistral ein **Moderationsmodell**. Der Autor entkräftet den scheinbaren Widerspruch: **Shieldstral trägt keine Taxonomie des Erlaubten und des Verbotenen in sich**, es beantwortet eine **vom Nutzer geschriebene Frage**. **Der Mechanismus steht im Zentrum der Notiz**: ein dreiteiliger Prompt (Kontext + Schweregrad / eine einzige geschlossene Frage / der zu beurteilende Inhalt), eine Antwort mit `yes` oder `no`, und der **Softmax über diese beiden Tokens** erzeugt einen kontinuierlichen Score zwischen 0 und 1. **Die Moderationsrichtlinie steckt nicht in den Gewichten, sie wird zur Inferenzzeit gelesen** – während **Llama Guard 4** die zur Trainingszeit fixierte MLCommons-Taxonomie einbettet, liest Shieldstral die eigene Richtlinie in natürlicher Sprache, änderbar **ohne erneutes Training**. Der technische Bericht (**arXiv:2607.25857**, 28. Juli 2026) beziffert die Kosten dieser Entscheidung: Fine-Tuning allein auf öffentlichen Daten = **61,1 % F1** bei der Anpassungsfähigkeit der Richtlinie; **4,4 Millionen kontrastive Paare**, von einem LLM generiert (derselbe Inhalt umgeschrieben, um eine Richtlinie zu verletzen, aber nicht die benachbarte Richtlinie) = **+23,3 Punkte**; **91,3 %** nach Zusammenführung von drei Checkpoints. Merkmale: **3,8 Mrd. tatsächliche Parameter** (das „3B“ im Namen ist abgerundet), Basis **Ministral 3** + Vision-Encoder **Pixtral**, **12 Sprachen**, **16 GB VRAM in BF16**, **Apache 2.0**. Textleistung: **84,9 % durchschnittlicher F1**, auf Augenhöhe mit **GPT-OSS-Safeguard-20B** (siebenmal größer), vor **Qwen3Guard-8B** (84,0) und weit vor **LlamaGuard-4-12B** (69,1). **Ein vom Autor selbst geäußerter Vorbehalt**: *all diese Zahlen stammen von Mistral, auf von Mistral ausgewählten Testdatensätzen, und bis zum 6. August existierte keine unabhängige Bewertung*. Die zentrale These der Notiz ist ein **Gegensatz der Topologien**: bei **Anthropic** wohnt das Sicherheitsnetz **in den Gewichten**, und der Anbieter entscheidet, wer davon ausgenommen wird (**Claude Fable 5** öffentlich mit Sicherheitsmaßnahmen / **Claude Mythos 5** ohne, vorbehalten zugelassenen Cyberverteidigern des **Project Glasswing**, 9. Juni 2026); bei **Mistral** liegt das Sicherheitsnetz **außerhalb des Modells** – eine separate, offene, selbst hostbare Komponente, deren Richtlinie dem Betreiber gehört. Explizite Kundenausrichtung (Verteidigungsministerium, BNP Paribas, französische und luxemburgische Regierungsverwaltungen). Die Notiz schließt mit einem **in drei Punkten dokumentierten Rückschlag**: **Auditierbarkeit** (binäre Ausgabe, keine Begründungsspur, während der Betreiber die Beweislast im Rahmen eines AI-Act-Audits trägt), **Robustheit** (das erste Kapitel von Voltaires *Traktat über die Toleranz*, von einem Tester im Hacker-News-Thread als „Aufruf zur Gewalt“ eingestuft – eine Verwechslung von Erwähnung und Befürwortung), **Verfügbarkeit** (Stand 6. August: kein kostenpflichtiger Endpunkt auf La Plateforme, kein offizielles Ollama-Angebot). Abschließend drei Einsatzregeln.

#Shieldstral#Shieldstral 1.0 3B#Mistral AI

**Didier Girard** — auteur de la note · publiée sur son compte X. Écrit ici en **analyste de doctrine industrielle** plutôt qu'en testeur : il n'a pas déployé le modèle · il croise une **audition parlementaire** (Mensch, 13 mai) · un **lancement produit** (Shieldstral, 4 août) · un **rapport technique** (arXiv, 28 juillet) et un **contre-exemple concurrent** (Anthropic, 9 juin) pour montrer qu'ils forment une position cohérente. Deux marqueurs de posture : il **borne explicitement la valeur des chiffres** qu'il cite (aucune évaluation tierce) et il **termine par des règles opérationnelles** — l'analyse doit sortir avec sa traduction en décisions de déploiement.

Wirtschaft & Markt Automatisch geprüfte Übersetzung

Mistral ↔ Microsoft : un accord souverain, une stratégie industrielle encore illisible

SFEIR-Analyse (in der Stimme der Firma, „eine Lesart von Ingenieuren“) des am **21. Juli 2026** angekündigten Deals zwischen **Mistral** und **Microsoft**: eine **industrielle Partnerschaft im Wert von mehreren Milliarden Dollar**, gegliedert in drei Teile — (1) **Compute in Europa** (reservierte Azure-Kapazität auf dem Kontinent, Rechenzentren in Frankreich, **NVIDIA Vera Rubin**-Systeme der neuesten Generation, um „das europäische Compute-Defizit zu schließen“); (2) **Mistrals Modelle in Microsofts Tooling** (**Mistral Medium 3.5** und **Mistral OCR 4** in **Microsoft Foundry**, zugänglich in **Copilot Studio** zum Aufbau von Business-Agenten); (3) vor allem **Azure Local bis hin zum getrennten Modus** (Public Cloud, überwachte verbundene Cloud, und **air-gapped**, vollständig vom externen Netzwerk getrennt — für Verteidigungsgeheimnisse, Gesundheitswesen, kritisches Bankwesen). **Bemerkenswerte Tatsache, von Brad Smith bestätigt: keine neue Kapitalbeteiligung** von Microsoft an Mistrals Kapital — eine massive Partnerschaft **ohne Kapitalverflechtung**. SFEIR — Partner von Anthropic und Google Cloud, „ohne Interesse daran, den französischen Champion zu überhöhen“ — betrachtet Mistral als **„die beste europäische Wette auf der Modellebene“** und bietet eine dreiteilige Lesart. **Was der Deal einem CIO bringt**: ein europäisches Spitzenmodell, ausführbar in einer getrennten Umgebung und vom Kunden kontrolliert (In-Memory-Verschlüsselung, lokal verwaltete Schlüssel), erfüllt Kriterien, die nur wenige Angebote erfüllen. **Die Spannung**: diese Souveränität wird **auf der Infrastruktur eines amerikanischen Hyperscalers** eingesetzt; vier Souveränitäten müssen unterschieden werden — **Modell, Ausführung, Infrastruktur, Geschäftsbeziehung** — von denen man „drei von vier bekommen kann, aber man muss trotzdem wissen, welche fehlt“. Das einzige Element, das die Souveränität **wirklich portabel** macht, ist die **Open-Weights-Natur** von Mistrals Gewichten (dieselbe Reversibilitätslogik wie bei **Kimi K3**). Das Fehlen einer Kapitalbeteiligung ist kein Detail: Es bewahrt Mistrals Governance **und** minimiert das Risiko einer kartellrechtlichen Prüfung (FTC, Europäische Kommission) — **bewusst gewähltes regulatorisches Arbitrage**, nicht nur eine technische Entscheidung. **Der eigentliche blinde Fleck**: die **Lesbarkeit von Mistrals Industriestrategie**, die gleichzeitig auf fast allen Fronten präsent ist (B2C mit Le Chat, B2B über Azure-Distribution, Open-Weights-Modell **und** Frontier-Ambition, sehr kapitalintensive Infrastruktur — 200 MW gesichert, eine 1-GW-Obergrenze bis 2030 —, Partnerschaften mit einer Handvoll Großkunden, Robostral/OCR-Vertikalisierung, Bedienung regulierter Sektoren): souveräner Full-Stack (optimistische Lesart) oder die Zersplitterung eines drei Jahre alten, mit ~20 Mrd. € bewerteten Unternehmens über Geschäftsfelder mit divergierenden Wirtschaftsmodellen hinweg (vorsichtige Lesart). Für die technische Führung: **das Modell vom Kanal trennen**, **auf Ausstieg auslegen** (Design to Exit — Open-Weights macht die Ausstiegstür glaubwürdig), **routen statt wetten** (souveräne Multi-LLM-Architektur, RAISE). Fazit: **Souveränität ist eine architektonische Eigenschaft, kein Label** — sie wird Abhängigkeit für Abhängigkeit qualifiziert; die fehlende industrielle Lesbarkeit bleibt die eigentlich offene Frage, geklärt nicht durch Pressemitteilungen, sondern durch „die Kompromisse der nächsten zwölf Monate“.

#Mistral#Mistral AI#Microsoft

SFEIR (voix éditoriale du cabinet)

Philosophie & Gesellschaft Automatisch geprüfte Übersetzung

Some observations on Kimi (thread X)

X-Thread von **Dean W. Ball** — **Head of Strategic Futures bei OpenAI** seit dem 6. Juli 2026, **Hauptautor von America's AI Action Plan** unter der Trump-Administration (eine Positionierung, die man im Hinterkopf behalten sollte, wenn man ein Anti-Open-Weights-Argument liest, das von einem Insider der proprietären Frontier verfasst wurde): **sechs Beobachtungen**, ausgelöst durch das chinesische Open-Weights-Modell **Kimi**, die schnell über das Produkt hinausgehen, um eine gegen den Strich gebürstete **geopolitische und ideologische These** zu vertreten. (1) Kimi ist **ein sehr gutes Modell**, nicht auf Destillation reduzierbar, **auf Augenhöhe mit den besten öffentlichen Modellen des Q1 2026** im agentischen Coding — aber **sehr token-hungrig**, sodass der Betrieb nicht so offensichtlich günstig ist. (2) Ball sagt, er sei **überrascht, dass der chinesische Staat die Open-Source-Stellung** so guter Modelle weiterhin zulässt: Er führt dies **zu ~75 % auf eine „strategische Blindheit" / einen Mangel an „AGI-Pilledness"** zurück (die KPCh vertrete angeblich eine „sehr Yann-LeCun-artige" Sicht auf KI), und zu ~25 % auf einen **Mangel an Inferenz-Rechenleistung** — was die chinesische Open-Weights-Strategie zu einem **unbeabsichtigten Nebenprodukt der US-Exportkontrollen** machen würde — sowie einen Reflex zu aggressiven Exporten; auf Seiten der Unternehmen sei die Offenheit halb ideologisch, halb ein Eingeständnis, dass „wir zurückliegen, niemand würde für sub-frontier chinesische Modelle bezahlen." (3) Zentrale These: **Open-Weights-Modelle sind inhärent dezelerationistisch** — sie **schrecken KI-Investitionsausgaben ab**. Ball zeigt sich überrascht von der Begeisterung der **„Akzelerationisten"** für Open Weights, die er auf deren Vorliebe für den **„Mantel der Unregierbarkeit"** zurückführt (eine Analogie zu James Scotts *The Art of Not Being Governed* und dessen Bergvölkern). (4) Eine von offenen Gewichten dominierte Welt würde zu **„KI-Kommunismus"** führen — KI nicht als Marktprodukt, sondern als **„öffentliches Gut" / „digitale öffentliche Infrastruktur"**, bereitgestellt vom Staat, „genau das, was China vorschlägt"; Ball beurteilt diesen Horizont als **„dystopisch"** und berichtet, während seiner Regierungszeit für ein **elf- bis zwölfstelliges** föderales Rechenzentrum lobbyiert worden zu sein, das Startups subventionieren sollte, die ihre Modelle kostenlos verschenken würden. (5) **Politische Vorhersage**: Die Trump-Administration werde letztlich erkennen, dass ihre beste Strategie **nicht darin besteht, „Open Source zu verbieten"** (eines der albernsten Argumente in der Debatte), sondern **regulatorisches Risiko / FUD zu erzeugen** über **Soft Law** aus jeder Behörde („ein Fed-Bulletin vermutet Backdoors in chinesischen Modellen"), genug, um **regulierte Unternehmen zurückschrecken zu lassen**, ohne die Hyperscaler zu verschrecken (andernfalls würden Startups sich zwielichtigeren Anbietern zuwenden). (6) Diese Modelle machen **die Welt ein wenig gefährlicher**, noch nicht auf spürbare Weise — bis zu dem Tag, an dem sie es sind; eine ironische Schlusszeile über einen „sich selbst replizierenden Agenten, der aus einem chinesischen Labor entkommen ist" (eine COVID-/Lab-Leak-Analogie, „color me shocked"). Zu lesen als **Gegenpunkt** zur Analyse von SFEIR (Kimi K3, Reversibilität, [[sfeir-kimi-k3-moonshot-frontier-open-weights-2026-07-16]]) und zu Xis Pro-Open-Source-Rede auf der WAIC ([[xi-waic2026-gouvernance-mondiale-ia-2026-07-17]]).

#Dean W. Ball#Dean Woodley Ball#OpenAI

Dean W. Ball (Dean Woodley Ball, @deanwball sur X) — expert américain de premier plan en politique de l'IA et gouvernance des technologies émergentes. **Depuis le 6 juillet 2026 : Head of Strategic Futures chez OpenAI** (petite équipe sur la politique de l'IA de pointe — risques catastrophiques, auto-amélioration récursive, impact marché du travail, relations labos-États-société ; rend compte au Chief Strategy Officer Jason Kwon). Reste **Nonresident Senior Fellow** à la Foundation for American Innovation (FAI). **Parcours** : Senior Policy Advisor for AI and Emerging Technology à l'Office of Science and Technology Policy de la Maison Blanche (administration Trump) · où il fut le **principal rédacteur d'America's AI Action Plan** ; Research Fellow au Mercatus Center (George Mason) · Senior Program Manager à la Hoover Institution (Stanford) · Manhattan Institute · ex-Executive Director de la Calvin Coolidge Presidential Foundation. Auteur de la newsletter **Hyperdimensional** (21 000+ abonnés) ; Visiting Lecturer à la Yale Law School (cours sur la gouvernance de l'IA de pointe). Diplômé d'Histoire de Hamilton College (2014, magna cum laude) · ~33-34 ans · vit à Washington D.C. **Sensibilité** : libéral classique / libertarien · mais reconnaissant un rôle nécessaire de l'État face aux risques existentiels de l'IA. (Post X personnel ; date d'ajout à la veille : 2026-07-17.)

Tools & Plattformen Automatisch geprüfte Übersetzung

Kimi K3 de Moonshot AI : quand le frontier open-weights rattrape le propriétaire

SFEIRs Analyse aus dem Ingenieur-Kabinett ("die Lesart eines Ingenieurs") des Launches von **Kimi K3** am **16. Juli 2026** durch das chinesische Labor **Moonshot AI**: ein **Open-Weights-Modell der Spitzenklasse (frontier-class)**, für das der Anbieter **rund 2,8 Billionen Parameter**, einen **Ein-Millionen-Token-Kontext** und eine **Veröffentlichung der Gewichte vor dem 27. Juli 2026** beansprucht (voraussichtlich unter einer Modified-MIT-Lizenz, wie schon bei der K2-Reihe). These: Fähigkeiten, die einst proprietären Giganten (Anthropic, OpenAI, Google) vorbehalten schienen, werden **als offene Gewichte, zum Kampfpreis, aus einem chinesischen Labor** verfügbar. SFEIR – obwohl **Partner von Anthropic und Google Cloud** und damit „ohne Interesse daran, ein chinesisches Modell schönzureden" – legt einen zentralen **methodischen Vorbehalt** an: Am Launch-Tag existiert **keine offizielle, vollständige Benchmark-Tabelle**; Spezifikationen (2,8 Billionen, Kimi Delta Attention, +25% Trainingseffizienz) und Scores stammen **vom Anbieter selbst** oder aus **Community-Arenen** und sind „als Behauptungen, nicht als gemessene Fakten zu behandeln." Die neue Architektur (**Kimi Delta Attention**, hybride lineare Aufmerksamkeit; Dekodierung angeblich bis zu **6,3x schneller** bei 1M Token) bricht mit dem Takt der K2-Reihe (K2 Juli 2025 → K2.7 Code Juni 2026, alle zwei Monate ein Flaggschiff); zwei Varianten begleiten den Launch (**K3 Max**, **K3 Swarm Max**), mit erzwungenem Auslaufen der Reihe kimi-k2.5/moonshot-v1 am **31. August 2026**. **Die eigentliche Waffe ist der Preis** (~3 $/M Input, 0,30 $ gecacht, 15 $ Output laut Sekundärquellen): ein Open-Weights-Modell der Spitzenklasse auf diesem Niveau **zieht die gesamte Preis-Leistungs-Kurve nach unten** – die Kommodifizierung der Modellschicht, beschleunigt durch Open Source. Die entscheidende Singularität ist jedoch kein Score: Es ist die **Reversibilität**. Ein Open-Weights-Modell der Spitzenklasse verwandelt eine konsumierte API (Anbieterabhängigkeit) in eine **Option** (Self-Hosting, Portabilität, Ausstieg aus dem Lock-in) – um den Preis einer schweren Infrastruktur, um 2,8 Billionen Parameter zu hosten. SFEIRs Sicht: **Open Weights verändert die Frage, nicht nur die Antwort** – nicht mehr „welches Modell ist das beste/günstigste?", sondern „wie viel meines Systems bin ich bereit, von einem Anbieter abhängig zu machen, den ich nicht kontrolliere?". Die richtige Haltung bleibt ein **geroutetes Portfolio** (ein Modell pro Aufgabe, ein Modell pro Randbedingung), wobei Kimi K3 dem Entscheidungsraster eine **Spalte „Reversibilität"** hinzufügt. Die Überzeugung „AI Only" bleibt unverändert: Das Modell ist eine Commodity, der dauerhafte Vorteil liegt im Engineering drumherum (Context Engineering, Harness, Kostensteuerung, Fähigkeit, die Meinung zu ändern). Die Zahlen müssen weiterhin „selbst" validiert werden – an den eigenen Repositories, den eigenen Daten.

#Kimi K3#Moonshot AI#Yang Zhilin

SFEIR (voix éditoriale du cabinet)

Wirtschaft & Markt Automatisch geprüfte Übersetzung

The state of open source AI (v1.0.1, juillet 2026)

**Wiederkehrender Bericht von Mozilla**, *The state of open source AI*, **v1.0.1, Juli 2026**, eingeleitet durch einen Brief von **Raffi Krikorian** (CTO): sieben Abschnitte, eine interaktive Website und ein herunterladbarer Bericht. These, formuliert im Titel von Abschnitt 1: *« The model layer has commoditized. Value accrues to the harness above it. »* **Fähigkeitsstand**: Auf dem *Artificial Analysis Intelligence Index v4.1* erzielt das beste geschlossene Modell **61** Punkte (Claude Opus 5) und das beste offene Modell **57** (**Kimi K3**), Rang vier insgesamt und vor drei der größten geschlossenen Labore; auf dem *Epoch Capabilities Index* beträgt der Abstand **6 Punkte** (K3 bei 156 gegenüber GPT-5.6 Sol bei 162), beschrieben als *« about one release cycle »*, bei sich überlappenden Konfidenzintervallen. **Sägezahnförmige Frontier**: Offene Modelle führen bei Frontend-Code (K3 mit 1.679 Elo in der LMArena Frontend Code Arena, sechs von sieben Domänen), liefern sich ein Kopf-an-Kopf-Rennen bei agentischer Terminalarbeit (88,3 gegenüber 88,8 im Terminal-Bench 2.1) und geben bei professioneller Wissensarbeit Boden ab (Fable 5 führt vor K3 mit 92 Elo im GDPval-AA v2). **Nutzungsverschiebung**: Der Anteil der über OpenRouter geleiteten Tokens, die an Open-Weight-Modelle gehen, stieg von einem vernachlässigbaren Niveau auf ein Drittel Ende 2025 und dann auf eine **Mehrheit bis Mitte 2026**, wobei die sieben Modelle mit dem höchsten Volumen alle offen gewichtet sind — der Bericht selbst merkt an, dass *« by request count, closed US providers still lead »*, wobei der Vorsprung der offenen Modelle ein Vorsprung beim Token-Volumen ist, der sich auf Coding- und agentische Workloads konzentriert. **Der zentrale Gegensatz**: *« Open ships easy. Open deploys hard. »* — 79 % der Entwickler, die KI einführen, nutzen offene Modelle gegenüber 71 % bei geschlossenen, aber nur **53 %** der Teams mit offenen Modellen erreichen die Produktion **gegenüber 63 %**, und die Lücke wächst mit der Organisationsgröße (geschlossen 54 % → 73 %, offen 53 % → 57 %), was *« rules out a resources explanation »*. Die Reifegradkarte des Stacks (48 Komponenten, 9 Schichten) zeigt zwei durchgängig kalte Spalten — **Standardisierung** und ***Enterprise Readiness*** — identifiziert als die operative Lücke. **Abschnitt 5**: *« The agentic harness is another user agent »*, und *« The model is eating the harness »* — bei jedem Modell, für das beide Varianten existieren, gewinnt inzwischen der Harness des jeweiligen Labors selbst, wobei sich die Lücke von 21,8 Punkten auf etwa 3 verringert hat. Daher die Formel: *« A harness tuned tightly to one lab's weights… degrades on anyone else's model, so the tighter the tuning, the less swappable the weights underneath. Lock-in arrives as a side effect of optimization. »*

#Mozilla#state of open source AI#Open Weights

**Mozilla** — éditeur du rapport · avec une introduction signée **Raffi Krikorian** · *Chief Technology Officer*. Publié en **juillet 2026** (v1.0.1). Données issues de sources tierces créditées (Artificial Analysis, Epoch AI, OpenRouter, LMArena) et d'une enquête propre menée avec **SlashData** (*Mozilla / SlashData 2026 developer survey*, n = 1 410 sur la question des freins).