Produktkommunikation von **Anthropic**, veröffentlicht am **1. September 2026** auf anthropic.com (~4.000 Wörter, sechs Abschnitte, 22 Erfahrungsberichte von Early-Access-Partnern). Sie kündigt **Claude Fable 5.1** (allgemein verfügbar) und **Claude Mythos 5.1** (verifizierter Zugang) an: *dasselbe Modell, jedoch mit unterschiedlichen Stufen an Schutzmechanismen*.
#Claude Fable 5.1#Claude Mythos 5.1#Foundation Model
Anthropic — communication produit publiée sur anthropic.com · sans signature individuelle.
Beitrag von **Ethan Mollick**, veröffentlicht am **31. August 2026** auf *One Useful Thing* (~2.200 Wörter). Er geht von einem Sicherheitsvorfall aus, um eine organisatorische Frage aufzuwerfen: Wann sollte eine KI einen Menschen um Hilfe bitten?
#Agency#Agency#autonome Agenten
Ethan Mollick — professeur à la Wharton School (University of Pennsylvania) · auteur du blog *One Useful Thing* sur Substack.
Essay, veröffentlicht auf **Gates Notes** am **26. August 2026** von **Bill Gates**, Mitbegründer von **Microsoft** und Vorsitzender der **Gates Foundation**, ~4.500 Wörter, als erster Teil einer Serie angekündigt. Der Text stellt eine Alternative auf – KI wird der größte Gleichmacher sein, der je erfunden wurde, oder die schlimmste Quelle von Ungerechtigkeit – und eine Feststellung: Es existiert kein Plan für den Eintritt in diese Phase. **(A) Drei Risiken**: das dauerhafte Verschwinden von Einstiegs- und Positionen mittlerer Karrierestufe, ebenso im Büro- wie im Handwerksbereich, innerhalb eines Jahrzehnts statt mehrerer Generationen, weil diesmal die Substitution auf die **Kognition** zielt; die Bewaffnung böswilliger Akteure (Cyberangriffe, Bioterrorismus, Betrug, Deepfakes), verbunden mit einer Machtkonzentration bei denjenigen, die sie bereits innehaben; die Wirkung von compagnons IA auf die kindliche Entwicklung und auf das kritische Denken. **(B) Der Nutzen**, verortet in fünf Bereichen – Forschung, Gesundheit, Landwirtschaft in einkommensschwachen Ländern (die Wirkung, die der Autor als die schnellste bezeichnet), öffentliche Dienstleistungen, Bildung – mit einem am Verb festgemachten Vorbehalt: *„das entscheidende Wort ist 'kann'"*. **(C) Drei Vorschläge** eröffnen die Serie: Aufbau eines beispiellosen nationalen und internationalen institutionellen Rahmens, angelehnt an das Inspektionsregime der Nuklearindustrie, die Luftfahrtregulierung und die Ozonabkommen; das Vorbehalten bestimmter Berufe für Menschen, ein Bereich mit dem Namen **Human Reserved**; **die Besteuerung von KI-Token und Robotern**, um die Besteuerung von Arbeit und Kapital neu auszutarieren. Gates legt seine finanziellen Verbindungen zur Branche offen sowie die Übertragung seiner Gewinne an die Stiftung. Der Text setzt Führungskräfte-Essays über die Verteilung des von KI geschaffenen Werts fort – [[nadella-frontier-ecosystem-human-token-capital-2026-06-12]], [[zuckerberg-meta-future-is-for-everyone-superintelligence-2026-08-10]] –, indem er den Fokus auf die öffentliche Macht statt auf das Unternehmen richtet.
#KI und Gerechtigkeit#Übergang in das KI-Zeitalter#Substitution der Kognition
Bill Gates — cofondateur de Microsoft · président du conseil de la Gates Foundation. Blog personnel Gates Notes. Page non capturable par `curl | lynx` (403 Akamai) : extraction navigateur.
Gastbeitrag von **Andy Warfield**, Ingenieur im **S3**-Team bei **AWS**, veröffentlicht am **26. August 2026** auf *All Things Distributed*, dem Blog von **Werner Vogels**, der ihn mit wenigen Zeilen unter „--W" einleitet: **3.554 Wörter** laut Seitenangabe. Der Text dient als Vehikel für die Ankündigung, dass **DuckLabs**, das Team hinter **DuckDB**, zu **AWS** stößt. (A) Die These: In der Systeminformatik geht es darum, den eleganten Kompromiss gegenüber einer sich verändernden „Physik" zu suchen — den Verhältnissen zwischen Speichergeschwindigkeit, Netzwerk und Rechenleistung — und diese Physik hat sich verändert. Warfield beziffert die Kluft: eine **m1.xlarge** aus dem Jahr 2007 bot **15 GB RAM**, **4 virtuelle Kerne** und **~1 Gb/s** Netzwerk; eine **m8g.48xlarge** bietet heute etwa das **50-fache** in jeder der drei Dimensionen. Das Wachstum der Datensätze folgt derweil einer Verteilung, deren Schwanz aus sehr großen Volumina besteht. (B) Die Konsequenz: Verteilte Verarbeitung — **MapReduce**, die **RDDs** von **Spark** — wurde unter den I/O-Beschränkungen der frühen 2000er-Jahre entworfen, und ein Großteil der ihr zugewiesenen Arbeit muss die Anwendung nicht mehr verlassen. Daher die eingebettete, prozessinterne Bibliotheks-Engine, die im Adressraum der Anwendung läuft und für die **DuckDB** das Beispiel liefert. Warfield verankert dies im Paper *Scalability! But at what COST?* (2015) und im Epigraph von **Paul Barham**: „You can have a second computer once you've shown you know how to use the first one." Er formuliert einen expliziten Vorbehalt: „When a job genuinely needs a thousand machines, it needs a thousand machines." Der Korpus enthält bereits [[vogels-tech-predictions-2026-allthingsdistributed-2025-11-25]] vom selben Blog und [[anthropic-self-service-data-analytics-claude-agentic-stack-2026-06-03]] zu Self-Service-Analytics.
#DuckDB#DuckLabs#AWS-Übernahme
Andy Warfield · ingénieur du service S3 chez AWS · en billet invité sur *All Things Distributed* ; introduction de Werner Vogels · CTO d'Amazon.
Essay von **Bill Staples**, CEO von **GitLab**, veröffentlicht am **24. August 2026** im Blog von about.gitlab.com: eine angekündigte Lesezeit von **31 Minuten**, rund **39.000 Zeichen**, dargestellt als Fortsetzung eines im Januar 2026 an den Verwaltungsrat gerichteten Memos, das im Mai teilweise unter dem Titel *GitLab Act 2* veröffentlicht wurde. Der Text versteht sich als Antwort auf das drei Tage zuvor veröffentlichte KI-native-SDLC-Playbook von **Anthropic**, dem er die Eingangszeile entlehnt – „Code is no longer the bottleneck“ –, um die Frage zu stellen, die ihn trägt: Was wird knapp, wenn Code im Überfluss vorhanden ist. (A) Die ökonomische Diagnose: Die nützliche Einheit sind nicht die Kosten pro Zeile, sondern die **Kosten pro akzeptierter Änderung**, die Generierung, Umgebung, Kontext, Verifikation, Review, Behebung und Governance zusammenfasst; KI lässt allein den Generierungsterm kollabieren, wodurch die übrigen proportional schwerer wiegen – eine Organisation, die zehnmal schneller generiert, „wird die Warteschlange lediglich verschieben“. (B) Die architektonische Antwort: vier Fähigkeiten – Agentenplattform, maschinenskalige Ausführung, dauerhafter Kontext, Governance – bilden eine Unternehmensschicht, die das Modell überdauert, „Das Modell sollte austauschbar sein. Der Agent sollte dem Kunden gehören.“ (1) Drei Modi koexistieren dauerhaft, vom menschengesteuerten Altsystem bis zur autonomen Entwicklung, gegen die Vorstellung einer einzigen Reifekurve. (2) Die CI/CD-Pipeline wird zu dem Ort, an dem die innere Schleife läuft, statt ein Gate am Ende der Kette zu sein. Die zitierten Zahlen stammen von Stripe, Spotify und Amplitude; GitLab liefert nur eine einzige, zur eigenen Quellcodeverwaltung. Der Korpus enthält bereits [[claxton-anthropic-ai-native-sdlc-playbook-2026-08-21]], die Quelle, auf die dieser Text antwortet, sowie [[sfeir-sdlc-pdlc-articulation-2026-07-22]] zur Verzahnung von SDLC/PDLC, die Staples sich zu eigen macht.
#Codeüberfluss#Kosten pro akzeptierter Änderung#Theory of Constraints
Bill Staples · directeur général de GitLab (fonction non affichée par la page) · sur le blog about.gitlab.com.
Ausführlicher Leitfaden von **Anthropic** von **Louis Claxton** (Applied-AI-Team), veröffentlicht am **21. August 2026** im claude.com-Blog: eine angegebene Lesezeit von **40 Minuten**, rund **64.000 Zeichen**, präsentiert als Sammlung von *Plays*, die aus der Arbeit des Teams mit seinen Kunden stammen. (A) Die Diagnose: Da Code nicht mehr der Engpass ist, verschiebt sich dieser auf die Phasen vor und nach dem Bau (Planung, Review/Test, Deployment); zeilenweise Kontrollen greifen nicht mehr, sobald der Agent den Großteil des Diffs schreibt, und die Governance-Kosten steigen, da Ausnahmen weiterhin über periodische Ausschüsse laufen. (B) Die Antwort: sechs Phasen (Plan, Design, Build, Test, Deploy, Maintain), organisiert als **Schleife** statt als Kette, jede endet mit einem **committeten Artefakt**, das die nächste Phase liest — `intent.md`, `spec.md`, `plan.md`, der Diff und seine Tests, der PR und seine Befunde, der Vorfallbericht. (1) Institutionelles Wissen wird zu versionierten Dateien: `CLAUDE.md`, Skills, `REVIEW.md`, `bands.yaml`. (2) Governance gliedert sich in zwei Schichten, wobei der Skill als beratende Kontrolle positioniert ist und der Hook als deterministische Schicht dahinter. Funktionstrennung wird als Invariante festgelegt — der Agent, der den Code schreibt, kann ihn nicht genehmigen —, und der Beitrag schließt mit *„The loop keeps running. Human judgement stays above it.“* Der Korpus enthält bereits [[clinton-anthropic-secure-ai-native-sdlc-2026-07-21]] zur Sicherheitsseite desselben Zyklus sowie [[hingel-augment-how-ai-changes-sdlc-six-stages-2026-06-08]] zur selben Sechs-Phasen-Gliederung aus Sicht eines Wettbewerbers.
#AI-native SDLC#software development lifecycle#plays
Louis Claxton (Anthropic, équipe Applied AI) · sur le blog claude.com ; contributions créditées à Jim Blackhurst · Will Steuk et Jamal Arif.
Leitfaden von **Michael Segner**, veröffentlicht am **20. August 2026** im Blog von claude.com in der Kategorie *Claude Code*: ein **5-minütiger** Lesetext mit angekündigten rund **31.500 Zeichen** Fließtext, auch als PDF verfügbar. Angegebenes Material: Interviews mit **mehr als einem Dutzend** Startups, fünfzehn davon namentlich genannt — **Artemis Security**, **Cainex**, **Clay**, **ClickHouse**, **Cognition**, **Commure**, **Crosby**, **Emergent**, **Harvey**, **Heidi**, **Higgsfield**, **Omni**, **Parahelp**, **Translucent**, **Zingage**. (A) Fünf Betriebsregeln: *everyone ships*, *automate the tedium*, *trust, but verify*, *build for rebuilding*, *prototype, dogfood, productionize*, jede abgeschlossen mit Produkt-Tipps und zusammengefasst in einer abschließenden Checkliste. (B) Ein Textkörper aus zugeschriebenen Zitaten, wobei jede Regel durch namentlich genannte Führungskräfte illustriert wird statt durch eine aggregierte Kennzahl. Die vier hervorgehobenen Zahlen stammen von den interviewten Unternehmen: **+30 %** mehr ausgelieferte Features (ClickHouse), **2- bis 3-fache** Engineering-Produktivität (Omni), **100 %** der Bug-Triage automatisiert (Clay), **mehr als 6.000 PRs pro Woche** (Artemis Security). Zwei Passagen weichen vom Erfahrungsbericht-Register ab: **Cainex**s Selbstkorrekturschleife bei der medizinischen Kodierung, Schritt für Schritt beschrieben, sowie der interne Einsatz von **Claude Tag** bei **Anthropic** als Erstreagierer für den CI/CD-Bereitschaftsdienst. Die eingangs gestellte Frage — *„Wie würde es aussehen, wenn eine Organisation ihren Produktentwicklungszyklus von Grund auf mit Claude Code aufbauen würde?"* — knüpft an [[claxton-anthropic-ai-native-sdlc-playbook-2026-08-21]] an, das am folgenden Tag vom selben Verlag veröffentlicht wurde, und führt [[cherny-wu-reflecting-year-claude-code-2026-07-17]] weiter.
#Claude Code#Startups#everyone ships
Michael Segner · auteur du guide sur le blog claude.com (fonction non affichée par la page) ; entretiens avec les dirigeants de quinze entreprises nommées.
Unternehmensblogbeitrag von **Block** (`block.xyz/inside`), nicht namentlich gezeichnet — als Autor wird **„Block“** angegeben —, veröffentlicht am **18. August 2026**, ~930 Wörter, der **die Open-Source-Stellung von Berd** ankündigt, Blocks interne Desktop-Anwendung für die Arbeit mit Agenten, und die Designthese darlegt, die sie geleitet hat: Agenten Charakter zu verleihen *"not only through roles, instructions, skills, and tools, but through distinctive visual identities"* — daher die selbst entwickelten animierten Figuren, die *"Gloopies"*. Der Beitrag geht von einer Beobachtung der Fragmentierung aus (*"The technology was powerful, but the experience around it was fragmented"*) und einem präzise benannten Interface-Problem: *"the product gives people little sense of how the agent is configured, which context and tools are available to it, and how it differs from another agent"*. Zwei strukturierende Beiträge. **(A) Eine dreistufige Gliederung**: **goose** bleibt das Framework und die *Runtime*, die die Agent-Loop trägt; **Berd** ist der Desktop-Client (Projekte, Kontext, Sitzungen, Agenten, Konfiguration); beide kommunizieren über das **Agent Client Protocol**. **Buzz** wird als Fortsetzung bezeichnet, für den Moment, in dem aus Solo-Arbeit Zusammenarbeit wird (*"Start alone, then go multiplayer"*). **(B) Sechs an Buzz weitergereichte Anforderungen**, als Fazit formuliert: *"private space, durable context, recognizable agent identities, reusable skills, visible configuration, and clearer visibility into an agent's configured context, tools, and capabilities"* — ein Raster, das sich direkt zur Bewertung eines Agent-Clients wiederverwenden lässt. Der Text selbst unterscheidet Identität von Fähigkeit: *"The avatars make the agent recognizable. Its role, skills, and tools make it useful."* Es werden keine Nutzungszahlen genannt, und für die Open-Source-Stellung wird keine Lizenz angegeben.
#Berd#Block#Open Source
**Aucun auteur nommé** : le billet est signé **« Block »** — le champ *Author* de la page porte le nom de l'entreprise. Publié le **18 août 2026** sur `block.xyz/inside` · le blog **corporate** · et non sur `engineering.block.xyz`.
Blogbeitrag von **Sonatype** von **Aaron Linskens** (*technical writer*), veröffentlicht am **18. August 2026**, ~1.300 Wörter: Er berichtet über eine Studie von **Sonatype Research Labs** über **49 Monate** (Juni 2022 – Juni 2026) mit einer **festen Kohorte** von Unternehmensanwendungen — eine methodische Entscheidung, die dazu dient, die Entwicklung der Anwendungsflotte statt die des Kundenportfolios zu isolieren. Das Ergebnis wird als Widerspruch dargestellt: Die Behebung wird schneller, doch das Risiko häuft sich weiter an. (A) **Der Bestand wächst** — *Critical*- und *High*-Schwachstellen pro Anwendung **×4,31** (von **14,14** im Juni 2022 auf **54,3** im Jahr 2026, immer noch **×3,91** ohne Legacy-Anwendungen, die neu unter Verwaltung gebracht wurden), neu betroffene Komponentenversionen mit dem **46-Fachen** der Rate vor der KI-Ära, monatliche Anwendungserstellung **×4,84**. (B) **Die Behebung verbessert sich** — mehr als die Hälfte der behobenen Verstöße wird in weniger als einem Tag behoben, das mediane Alter ungelöster *Critical/High*-Schwachstellen sinkt von **228** auf **126 Tage**, dann im Mai 2026 auf **103**; unter Kohorten, die zwölf Monate Zeit hatten, sind **52,6 %** behoben, **44,3 %** offen, **3,1 %** unter Waiver. (C) **Der vorgeschlagene Hebel ist die Komponentenauswahl**: Zum Zeitpunkt der Wahl einer anfälligen Abhängigkeit existierte bereits in **62,2 %** der Fälle bei **Maven**, **46,9 %** bei **npm**, **34,3 %** bei **PyPI** eine deutlich weniger riskante Version — eine Lücke, die der Text eher einer Informationslücke als einem Fehler der Entwickler zuschreibt. Der Beitrag selbst stellt fest, dass KI nicht die alleinige Ursache der Beschleunigung ist, und schließt mit **Sonatype Guide**, das diese Intelligenz an den Punkt der Auswahl bringt. Auf der Supply-Chain-Seite erweitert er, was [[fiches/2026-08/staples-gitlab-when-code-is-abundant-2026-08-24]] wirtschaftlich einordnet und [[fiches/2026-07/clinton-anthropic-secure-ai-native-sdlc-2026-07-21]] im Sinne des sicheren Zyklus.
#Software-Lieferkette#Software-Lieferkette#Sonatype Research Labs
Aaron Linskens · *technical writer* chez Sonatype · sur le blog de l'éditeur ; les chiffres sont produits par Sonatype Research Labs · non par l'auteur.
Produktankündigung von **Block Engineering**, gezeichnet von **Thomas Petersen** (*Principal Designer & Builder*), veröffentlicht am **18. August 2026**, ~1.800 Wörter in dreizehn kurzen Abschnitten, die **Buzz Projects** vorstellt — eine **Software-Forge, gehostet auf dem eigenen Relay**: Git-Repositories, Branches, Pull Requests, Issues, Review und Merge, Multi-Repo-Projekte, ein Activity Feed, alles verknüpft mit Conversation-Channels. Vorspann und These des Beitrags: *« Coding agents are the terminal for your computer. Buzz is the terminal for your network. »* Drei Beiträge. **(A) Eine Vertrauensdoktrin, die auf *ex post*-Nachweis statt auf *ex ante*-Autorisierung beruht**: auf der einen Seite *« No forced guardrails, no limitations on what your agents are allowed to help you with »*, auf der anderen *« Every push, review, approval, and merge is a signed Nostr event. If an agent authors a patch, you can see which agent produced it and which human authorized that agent to act »*; der Abschnitt schließt mit einer angekündigten Richtung — *« we are already exploring ideas around agent trust protocols informed by past behavior »*. **(B) Git-Interoperabilität ohne proprietäres Tooling**: *« These are standard git repositories… You can fetch, clone, pull, and push over plain Smart HTTP, with no custom tooling or wrapper CLI required »*, wobei die clé Nostr als einzige Identität dient — *« The same npub that signs your messages signs your pushes. »* **(C) Eine Unterscheidung zwischen Ausführungsfläche und Netzwerkpräsenz**: *« A terminal gives an agent somewhere to execute commands and change files, but it does not give it a persistent place in the network. Buzz does. »* Der Beitrag liefert keine Zahlen und enthält keine ausgehenden Links; er qualifiziert sich sechsmal selbst als vorläufig (*« still very basic »*, *« fairly elementary »*, *« still under experiments »*), und Projects befindet sich unter dem Tab **Experiments** von Buzz Desktop.
#Buzz#Buzz Projects#Block
**Thomas Petersen** — *« Principal Designer & Builder »* chez **Block** · auteur unique et signataire du billet ; première apparition dans le corpus. Publié le **18 août 2026** sur le blog **Block Engineering**. Troisième signature Block sur Buzz en un mois · après Tyler Longwell (21 juillet) et Atish Patel (6 août) · et la première non-ingénieur.
X-Post von **Andrew Ng** vom **14. August 2026** (16:29 UTC), Wiederaufnahme des "Dear friends"-Briefs aus ***The Batch* #366** (DeepLearning.AI, gleiches Datum), ca. 900 Wörter. Ng stellt **The AI Engineering Skills Map** vor und veröffentlicht **vier Skills**, die als die wichtigsten gelten. **(1) Aufbau und Bereitstellung von KI-Anwendungen** — die Besonderheit wird benannt: *« The key difference between AI and non-AI applications is that the former has unpredictable outputs »*, daher die Betonung von *evals* und Fehleranalyse-Loops. **(2) Grundlagen der Softwareentwicklung**, denn *« Understanding software fundamentals allows you to recognize what tradeoffs even exist »* — der unerfahrene Entwickler scheitert *« because they don't know what context to give their coding agent »*, daher das Ziel, *« steering coding agents using the precise language of software engineering »*. **(3) Einsatz von Coding-Agenten**, in operativer Formulierung: *« help the agent autonomously close loops by providing verifiers or evals »*, sowie *« knowing how much to intervene and how much to leave them alone »*. **(4) *Den Build gestalten***: *« Given a clear spec, coding agents are rapidly improving at delivering to it. Thus, our work as engineers is shifting toward deciding what should be in the spec »*, ergänzt durch *« Engineers should no longer expect to be given a pixel-perfect design and asked only to implement it. »* Ein **Hinweis zur Terminologie** trägt den größten Teil der Rahmung: Ng spricht von **Skills** im AI Engineering und **nicht von der Rolle** "AI Engineer", mit einer expliziten Analogie — *« All developers today should know how to work with the cloud, and only a smaller number have a "Cloud engineer" title. »* Das Ganze stützt sich auf *« an analysis of more than 10,000 job postings, dozens of structured interviews with experts, hiring managers, and recruiters, surveys, and other online data »*, wovon **keine numerischen Ergebnisse veröffentlicht werden**: Ng beschreibt sein Vorgehen als *« informally… akin to running clustering »* und kündigt eine detaillierte Map in künftigen Beiträgen an. Sein Eigeninteresse benennt er im vorletzten Satz: *« DeepLearning.AI's principal focus is to help developers gain these AI engineering skills. »*
#AI Engineering Skills Map#Skills-Map#Andrew Ng
**Andrew Ng** — fondateur de **DeepLearning.AI** · general partner d'**AI Fund** · cofondateur de **Coursera** et de **Google Brain** · ancien chief scientist de Baidu. Texte signé · à la première personne · écrit *« with my team »* sans qu'aucun collaborateur soit nommé. Publié le **14 août 2026** sur X et dans ***The Batch* n°366** — même texte aux deux endroits ; préférer *The Batch* pour toute citation durable. Quatrième fiche Ng du corpus · après les lettres n°350 (24 avril) · n°352 (8 mai) et n°359 (26 juin).
Ankündigungsbeitrag, veröffentlicht im **offiziellen Z.ai-Blog** (ehemals Zhipu AI, chinesisches Labor) am **14. August 2026**, **ohne namentliche Autorenangabe**, ~2.000 Wörter plus Fußnoten. Er kündigt **GLM-5.3** an, den Nachfolger von GLM-5.2, und eröffnet mit einer methodischen These: *« Scaling post-training is all we did for GLM-5.3. »* Dasselbe Basismodell wie GLM-5.2 — *« every gain comes from post-training »*. Drei Ankündigungen. **(A) Ein Coding-Modell mit offenen Gewichten**: +50 % beansprucht auf **Z.ai Code Bench**, einem unveröffentlichten internen Benchmark. **(B) Eine als „emergent" dargestellte Cyber-Fähigkeit**, die der Fließtext auf eine Trainingsentscheidung zurückführt — *« As part of post-training, we introduced vulnerability discovery data and environments into the training mix. We expected this to make the model better at finding and reasoning about vulnerabilities »* — überraschend waren die Geschwindigkeit und der Wandel in der Natur: Das Modell geht von der Identifizierung isolierter Schwachstellen zu *« coherent plans for complete exploitation chains »* über. Die Gewinne wachsen mit der Position in der Exploitation-Kette: CyberGym 77,2 → **84,5 %**, ExploitBench 24,4 → **54,4 %** (×2,2), ExploitGym 29 → **105** Aufgaben in 2 h (×3,6), wobei der Abstand zur geschlossenen Frontier weiterhin groß bleibt (181 und 247 Aufgaben). Z.ai formuliert es so: *« Capability is growing fastest exactly where we are furthest behind. »* Der Beitrag veröffentlicht zudem ein **Z.ai Security Disclosure Ledger**: **2.436 identifizierte Schwachstellen in 269 Open-Source-Projekten** — Kernel, Betriebssysteme, Browser-Engines, Infrastruktur, Webanwendungen, Netzwerkprotokolle — die älteste eingeführt **1981**, durchschnittliche Lebensdauer bis zur Entdeckung **26,6 Jahre**, davon **53 offengelegt** und **2.383 unter Embargo**. **(C) Eine Gewichtsfreigabe** *« within two weeks of launch, once safety evaluation and hardening are complete »*. Der am ehesten übertragbare methodische Beitrag: **Synthese von Umgebungen und Verifiern**, wobei Letztere ohne Zugriff auf die Referenzlösung erzeugt und erst nach einem Triptychon negativer Kontrollen zugelassen werden — **oracle**, **no-op**, **unsolved-state**. Alle agentischen Evaluierungen werden **in Claude Code 2.1.207** durchgeführt.
#GLM-5.3#GLM-5.2#Z.ai
**Z.ai** (anciennement **Zhipu AI**) · laboratoire d'IA chinois · éditeur de la famille **GLM**. Billet **institutionnel et non signé** : aucun auteur nommé · aucun chercheur mis en avant · aucun lien vers un rapport technique ou une carte de modèle. Publié le **14 août 2026**. La page est une SPA React — le HTML servi est un `<div id="root">` vide · et le texte comme les scores ont dû être extraits du bundle `glm-5.3-BCnx8T5_.js` · où ils figurent en valeurs source.
Offizielle Produktseite von **DeepSeek**, veröffentlicht am **13. August 2026**, **nicht namentlich gezeichnet**, ca. 450 Wörter, die die *Developer-Preview*-Veröffentlichung von **DeepSeek Harness** (`dsh`) ankündigt — ein Coding-Agent-Harness, **Open Source unter der MIT-Lizenz**, dessen Repository am selben Tag eröffnet wurde. Eine Drei-Wort-These, wiederholt im Titel und in der Repository-Beschreibung: *« Everything is a plugin »*, gepaart mit einem zweiten Versprechen, *« Every run is traceable »*. Die Seite formuliert die Gleichung *« AGENT = MODEL + HARNESS »* und listet die steckbaren Fähigkeiten auf — *« models, tools, skills, sessions, sandboxes, storage, loops, scheduling, and the UI »*. Vier Modi werden ausgeliefert: **Standard** (vollständiger Coding-Agent), **Code** (Tools, die über das *Code Mode SDK* freigelegt werden und es dem Modell erlauben, mehrstufige Operationen innerhalb eines TypeScript-Programms zu komponieren), **Minimal** (*« two-tool coding agent with persistent bash and str_replace_editor »*, ausdrücklich *« for benchmarking models in a minimal environment »*), und **Creator** (Laufzeitinspektion, In-Memory-Plugin-Tests). Die technische Substanz liegt im Repository, nicht auf der Seite: `docs/architecture.md` formuliert eine Logging-Invariante — *« Model-visible means logged. Anything that reaches a model request must be reconstructable from the log, and a runtime invariant asserts it »* — und stellt fest, dass *« there is no privileged core to patch »*. Der technische Kern stammt nicht von DeepSeek selbst: DSH baut auf **Cordis** auf (dem `cordiverse`-Projekt, einem Dritten), **vendort** in `vendor/` mit Manifest und Sync-Verfahren, und die Seite platziert das *« Cordis paper »* auf derselben Navigationsebene wie „GitHub“ und „Developer docs“. Zwei LLM-Adapter werden ausgeliefert — `dsh-llm-deepseek` und `dsh-llm-pi-ai`, ein generischer Multi-Provider-Adapter. Das Repository warnt in Großbuchstaben: *« THERE WILL BE COMPATIBILITY-BREAKING CHANGES »*, und `CLAUDE.md` legt fest, dass `SESSION_FORMAT_VERSION` bei `0` bleibt, *« with no compatibility promise »*, wobei Backends alte Formate auf der Festplatte ablehnen. Zeitachse: DSH erscheint an dem Tag, an dem **DeepSeek-V4-Pro GA erreicht**, drei Tage bevor am **16. August 2026 um 16:00 UTC** ein neuer API-Preisplan in Kraft tritt, mit Spitzen-/Nebenzeittarifen und einem Nebenzeit-Rabatt von **−50 %**.
#DeepSeek Harness#dsh#Agent-Harness
**DeepSeek** (DeepSeek AI, laboratoire chinois) · en tant qu'institution. Page produit **non signée** : aucun auteur · aucun ingénieur mis en avant · aucun billet de blog ni papier technique associé. Le « nous » n'apparaît qu'une fois · en dernière phrase — *« We look forward to exploring the limits of intelligence with developers worldwide »*. Publiée le **13 août 2026**. La page est rendue en JavaScript : `curl` sur l'URL renvoie **HTTP 202 avec un corps vide** · le texte n'existant qu'après exécution du bundle. Deux documents de politique sont liés en pied de page — *Safe Use Policy* et *Data Processing Statement*.
Interner Rechercheureport vom **12. August 2026**, der zu Präsentationszwecken alles öffentlich Dokumentierte über **Buzz** zusammenfasst — den Workspace für Menschen und Agenten von **Block**, der am **21. Juli 2026** unter der Lizenz **Apache 2.0** eingeführt wurde. Er aggregiert die beiden bereits veröffentlichten Engineering-Beiträge neben der Unternehmensankündigung, das GitHub-Repository, die Presseberichterstattung, X sowie **drei unabhängige Praxisberichte**, die die einzigen nicht selbst berichteten Daten des Dossiers darstellen. **(A) Eine durch Zitat dokumentierte Begriffslücke**: Der Launch-Tweet von **Jack Dorsey** kündigt *„model-agnostic, decentralized, self-sovereign, and open source“* an; Blocks `ARCHITECTURE.md` stellt fest: *„The relay is the single source of truth. All reads and writes flow through it. There is no peer-to-peer event exchange, no gossip, no replication.“* Der Relay ist somit pro Community einzig und maßgeblich: Buzz' „Dezentralisierung“ ist eine **organisatorische Souveränität** — Self-Hosting und portable Identität — keine Netzwerkredundanz. Formulierung von **TFTC**: *„Two of those three hold cleanly. The third needs a qualifier.“* **(B) Eine Asymmetrie zwischen nachgewiesener Rigorosität und Ausnutzungsrisiko.** Auf der einen Seite ein für ein v0.4.x/0.5.x seltenes Maß an Formalismus: Spezifikation der Mandanten-Isolation **mechanisiert in TLA+**, in **Tamarin** verifizierte Autorisierungseigenschaften, ein modellgeprüftes Git-Speicherprotokoll, ein hash-verkettetes Append-only-Audit-Log, 127 *event kinds*, NIP-01/42/98/34. Auf der anderen Seite ist Kanalmitgliedschaft die Berechtigungseinheit — *„channel membership is not fine-grained tool authorization“* (João Queirós) —, Agenten laufen in `--dangerously-skip-permissions` außerhalb jeder Sandbox auf der Maschine eines Menschen, und die Beobachtbarkeit fehlt: *„Buzz tells me an agent got a message. It doesn't tell me what happens next“* (DevTools Daily, das stille OOM-Kills berichtet). Block räumt es ein: *„the agent can do anything, and security rests entirely on restricting who can tell it what to do“*. **(C) Der technische Stack**, der in den veröffentlichten Beiträgen fehlt: **Rust**-Relay (Axum WS + REST), **Postgres**, **Redis**, **S3/MinIO** via Blossom, Desktop-Client **Tauri + React**. Die Agentenintegration erfolgt über **`buzz-acp`**, ein **ACP**-Harness, das goose, Codex und Claude Code einbindet und **ACP ↔ MCP** übersetzt, sowie **`buzz-agent`**, einen hauseigenen Agenten. Der Report korrigiert sich an einem Punkt selbst: Die *„+33% more work“* in Blocks TL;DR sind das **Verhältnis abgeschlossener Aufgaben (20 gegenüber 15 von 44)**, kein Punktzahlgewinn — die Punktzahl selbst steigt von 59,1 % auf 71,5 %, also **+12,4 Punkte**.
#Buzz#buzz.xyz#Block
**Deep Research Veille Interne** — rapport non signé · produit le **12 août 2026** en préparation d'une présentation. Aucune URL publique ; source archivée dans `raw-data/`.
Interner Recherchebericht vom **12. August 2026** (im Format *What? — So What? — Now What?*, Untersuchung durchgeführt am 11.–12. August) zu einer einfachen Frage: Sind die **Desktop**-Anwendungen von ChatGPT und Claude besser als ihre **Web**-Versionen? Die Antwort kommt in zwei Teilen. **(A) Es existiert ein solider, gut belegter qualitativer Konsens.** Der Ausgangspunkt ist unbestreitbar: Desktop und Web rufen exakt dieselben Cloud-Modelle auf, die Anwendung ist lediglich eine Schnittstelle zum Dienst — der Gewinn liegt somit vollständig in der Application Shell (Zugriffslatenz, Stabilität bei langen Sitzungen, Speicherbedarf, Systemintegrationen, Workflow-Flüssigkeit). Was Desktop tatsächlich unterscheidet, bestätigt: auf OpenAI-Seite ein globaler Shortcut (Option/Alt + Space), ein *companion window*, das immer im Vordergrund bleibt, native Screenshots und seit Juli 2026 die agentische **Codex/Work**-Fähigkeit, die in die App integriert ist; auf Anthropic-Seite **Quick Entry** (macOS), **Desktop Extensions** (die Installation eines lokalen **MCP**-Servers wird *„so einfach wie ein Klick auf einen Button“*), Zugriff auf lokale Dateien, **Cowork** und **Computer Use** (Bedienungshilfen-Berechtigungen und Bildschirmaufzeichnung). Das Web behält zwei bestätigte Stärken: mehrere Tabs/Threads und Universalität ohne zu installierenden Client. **(B) Nahezu alle kursierenden Zahlen zur Stützung dieses Konsenses halten einer Überprüfung nicht stand.** Das kritische Audit des Berichts (§1.5) stuft sieben weitverbreitete numerische Behauptungen als **unbestätigt** ein: der *Kaltstart* „2–3 s vs. 8–12 s“ (die einzige Spur ist ein anekdotisches *„lädt in etwa 3 Sekunden“* auf Substack); RAM-Nutzung „200–700 MB vs. 1,2–2 GB“, zugeschrieben einem „Alibaba Product Insights“, dessen Seiten **404** zurückgeben; eine nicht nachvollziehbare Glitch-Rate und eine ebenso nicht nachvollziehbare Zahl zur Sitzungsbindung; ein Claude „+10–20 %“ End-to-End, zugeschrieben **Skywork**, das in Wahrheit seinen eigenen Windows-Agenten und nicht Claude gegen das Web gebenchmarkt hatte; eine nicht nachvollziehbare Quelle „Cosmo Edge“; unbestätigte Zitate von Zenken AI; sowie zwei nicht authentifizierte X-Posts ohne URL. Das Gegensignal ist mit derselben Sorgfalt dokumentiert: Yuri Dvoinos beschreibt eine Claude-Desktop-App, die *„mich dazu bringt, meinen Laptop aus dem Fenster werfen zu wollen“* — 68 % CPU-Auslastung, Eingabeverzögerung auf einem MacBook Pro — und der Bericht vermerkt, dass beide Apps **Electron**-Builds mit nativen Schichten sind. Daher seine Formulierung: *der Desktop-Vorteil ist ein Implementierungsversprechen, kein Naturgesetz.* **Das „So What“**: Da das Modell zum gemeinsamen Nenner geworden ist, wird die Schnittstelle zum Schlachtfeld — die Fusion **Codex + ChatGPT** vom 9. Juli 2026 und das Tandem Cowork/Computer Use erzählen dieselbe Geschichte: *„die Desktop-App ist kein Chat-Client mehr, sondern eine Agenten-Laufzeitumgebung mit Zugriff auf die Maschine.“* Drei Konsequenzen: Der Gewinn ist ein **Reibungs**-Gewinn, kein Leistungsgewinn; für einen CIO **verschiebt** Desktop die **Vertrauensgrenze** — Computer Use erfordert sensible Systemberechtigungen, und die Codex-Fusion bringt Codeausführung, Browser und Konnektoren in *„eine erweiterte Vertrauensgrenze“*, während der Browser über SSO, DLP und CASB weiterhin steuerbar bleibt; und für jeden, der publiziert, ist die Zerbrechlichkeit der Zahlen selbst die Geschichte. **Das „Now What“** liefert individuelle Umstiegskriterien, eine CIO-Checkliste (Berechtigungen inventarisieren, Computer Use und Cowork standardmäßig deaktivieren, festlegen, welche MCP-Erweiterungen autorisiert sind, Verteilung und Updates organisieren — unter Linux, außerhalb des apt-Repositorys, aktualisiert sich Claude Desktop nicht selbst) sowie eine redaktionelle Vorgabe: nur bestätigte Verbatims und Daten zitieren.
#ChatGPT Desktop#Claude Desktop#Web-Version
**Deep Research Veille Interne** — rapport non signé · produit par une enquête sourcée menée les **11-12 août 2026** et rendu le 12.
Erfahrungsbericht, veröffentlicht auf **LinkedIn Pulse** am **12. August 2026** von **Guillaume Dumortier** in seinem Newsletter *Growth Marketing Fit*, mit dem Untertitel *„Four layers, a lot of rebuilding, and the failure modes nobody warns you about"*, ~2.500 Wörter. Thema: ein internes KI-System, gebaut **in Claude** für ein Marketingteam von rund sechzig Personen – etwa dreißig Content- und Sales-**Skills**, ein Dutzend **Source-of-Truth-Module**, **sieben Agenten, von denen sechs ausschließlich Arbeit prüfen statt sie zu produzieren**, ein **Plugin** für alle, die im Terminal arbeiten, eine **Browseranwendung**, die dasselbe Wissen für alle anderen bereitstellt, und eine Orchestrierung, die drei oder vier Assets zu einem *campaign bundle* verkettet. Die These wird früh formuliert: Die Qualität eines KI-Outputs entscheidet sich nicht im Moment der Generierung, sondern durch das, was das System vorher weiß, und durch das, was anschließend mit dem Entwurf geschieht – *„The generation step in the middle is the easy part. It's also the only part most teams have built."* Daraus ergeben sich vier Schichten: **Truth** (fast niemand baut sie), **Production** (jeder), **Verification** (fast niemand), **Internal distribution** (*„where good systems die of neglect"*). Zwei Fehlermechanismen tragen den Artikel. **(A) Das nackte Closed-World-„pass" des Prüfers**: Ein Fact-Checker, der auf Produktdokumentation gestützt ist, erhält einen Entwurf mit einer Behauptung über ein anderes Produkt, das von seinen Quellen nicht abgedeckt wurde – er liefert ein *„pass"*, nicht weil die Behauptung wahr war, sondern weil ihr nichts widersprach. *„It didn't just miss the error, it certified it."* Lösung: ein nacktes Urteil verbieten und von jedem Bericht verlangen, die **eigene Abdeckung** offenzulegen – wie viele Behauptungen geprüft wurden, wie viele mit Quellen abgeglichen werden konnten, welche außerhalb seiner Zuständigkeit lagen, welche keiner Quelle zugeordnet werden konnten. *„\"I can't verify this\" became a first-class result."* **(B) Der Cross-Asset-Widerspruch**: Zwei Assets können jedes für sich korrekt sein, jedes auf eine reale Quelle rückführbar sein, und sich dennoch widersprechen – die Pressemitteilung nennt ein Datum, der Blogbeitrag ein anderes, beide bestehen die Prüfung, das Bundle kann nicht ausgeliefert werden. *„Per-asset verification can't catch that, by construction."* Schlusssatz des Artikels: *„The generation is free. The trust is the product."*
**Guillaume Dumortier** — auteur de la newsletter LinkedIn **Growth Marketing Fit** (~1 300 abonnés à la publication). Il écrit en **praticien-constructeur** : il a passé *« une longue partie de cette année »* à bâtir et exploiter le système décrit. La légende de l'illustration précise le socle technique — *« A custom-built Marketing AI OS within Claude »*. Publié le **12 août 2026**.
Analysierter Newsartikel, veröffentlicht bei **VentureBeat** am **11. August 2026** von **Michael Nuñez**, basierend auf einem **exklusiven Interview mit Timothée Lacroix**, Mitgründer und CTO von **Mistral AI**, geführt im Vorfeld der Ankündigung, ~2.000 Wörter. Mistral erweitert sein Infrastrukturangebot in drei Teilen: **Mistral Regional Endpoints** in allgemeiner Verfügbarkeit (Anbindung von Inferenz und der zugehörigen Verarbeitung an Europa oder die Vereinigten Staaten), eine **Priority Tier** in Public Preview (zugesicherte Service-Level, individuelle Quoten, Verfügbarkeits-SLA) und eine **Koalition europäischer Unternehmen**, deren mehrjährige Verpflichtungen **200 MW bis Ende 2027** und **1 GW bis Ende 2030** finanzieren sollen. Das Vehikel heißt **European Compute Unit (ECU)**: ein Anspruch auf von Mistral aufgebaute Kapazität, fungibel über Inferenz, Training, Modellanpassung oder verwaltetes Kubernetes, über einen angepeilten Fünfjahreshorizont. Lacroix beschreibt den Mechanismus unverblümt — *"The whole point of compute units is to have commitment"* — und zum vorzeitigen Ausstieg: *"There is no getting out."* Der Artikel stuft den Ehrgeiz ein: Mistral erklärt, *"less than 200 MW"* zu betreiben, und benennt drei Standorte mit insgesamt **77 MW** (44 MW bei Paris, 23 MW in Schweden mit EcoDataCenter, 10 MW in Les Ulis); **Epoch AI** beziffert die anfänglichen Kapitalkosten für ein Gigawatt-KI-Rechenzentrum auf **~38 Mrd. $**, und **Goldman Sachs Research** setzt die Kosten der nächsten Rechenzentrumsgeneration auf **15-20 Mio. $/MW ohne Chips** an, gegenüber den insgesamt von Mistral eingeworbenen **~4 Mrd. $** (PitchBook). Hinzu kommt eine Entscheidung, die *"is likely to raise a few eyebrows among sovereignty purists"*: Mistral beginnt, **Open-Source-Modelle Dritter zu hosten**, angefangen mit **GLM-5.2** von **Z.ai**, einem chinesischen Labor — *"It's a great model. Everyone loves it. It's open-weight, so there was no good reason for us not to do it."* Der Artikel geht dem Kleingedruckten in Mistrals Dokumentation nach, das *"limited, controlled transfers"* an Subunternehmer außerhalb der Region erwähnt; auf Details angesprochen, verweist Lacroix auf **Tool Calls**, insbesondere Websuche, und erklärt, dass **Gating das Feature ist, nicht der Bug**. Die Einordnung des Autors: *"full regional control is available, but the moment an AI agent reaches out to the open web, sovereignty becomes a configuration decision, not a default."* Zwei Abhängigkeiten bleiben bestehen: **GPUs** stammen von Nvidia, und **Microsoft** — Ankermieter der europäischen Rechenzentren von Mistral seit Juli — wird als Faktor dargestellt, der den Ausbau absichert.
#Mistral AI#digitale Souveränität#KI-Souveränität
**Michael Nuñez** — journaliste **VentureBeat** · couvre l'IA et l'infrastructure ; déjà présent au corpus. L'article est bâti sur un **entretien exclusif avec Timothée Lacroix** · cofondateur et CTO de Mistral AI · conduit **avant l'annonce** · et fait suite à un entretien de juin avec le même interlocuteur. Publié le **11 août 2026**.
Langform-Artikel, veröffentlicht auf **X** am **11. August 2026** von **Jesse Zhang**, CEO von **Decagon** (KI-Agenten für den Kundenservice), unter einem dilemmaförmigen Titel — *« To FDE, or not to FDE? »* — der dem **Forward Deployed Engineer** gewidmet ist, der zu *« the answer to almost every hard question in AI go-to-market »* geworden ist. Ausgangsbeobachtung: Anthropic und OpenAI haben Enterprise-Deployment-Einheiten aufgebaut, die sich explizit an Palantir orientieren, *« every seed-stage company »* wirbt mit einem FDE-Angebot, und Stellenausschreibungen für diesen Titel sollen binnen eines Jahres um mehrere hundert Prozent zugenommen haben. **(A) Die Palantir-Genealogie** liefert den Rahmen: die Formel von **Shyam Sankar** (CTO), *« FDEs eat pain and excrete product »*, sowie der Hinweis von **Joe Lonsdale**, dass Palantir fast zwei Jahrzehnte lang als *« glorified consultancy »* bezeichnet wurde — auf Grundlage einer zutreffenden Beobachtung. Die maßgeschneiderten Einsätze von **Gotham** (CIA, NSA, militärische Nachrichtendienste) wurden in Plattform-Primitiven kodiert — Ontologie, Objektmodelle, Berechtigungen, Workflow-Engines, Provenienzverfolgung —, woraus **Foundry** wurde, dann Apollo und AIP; die Standardisierung trieb die Bruttomarge in den Bereich von 80 % und Palantir wechselte von einem FDE-Modell zu Account-based Selling, wobei viele FDEs in die Kernentwicklung wechselten. *« The pain was the input to the product, not a cost of sale. »* **(B) Das vorgeschlagene Kriterium** besteht nicht darin, auf FDEs zu verzichten, sondern zu wissen, wann man aufhören muss: früh einsteigen und dann prüfen, ob man noch **entdeckt** — *« The trap is not starting. It's not stopping. »* **(C) Eine Unterscheidung, die kaum jemand trifft: FDE ≠ Implementierung.** *« Building that integration into their ticketing system »* ist echte Arbeit, aber es handelt sich um die Ausführung einer bekannten Spezifikation, nicht um die Entdeckung einer unbekannten; die Vermischung beider *« is how a company convinces itself that a growing services org is a product investment »*. Schlusssatz: *« If your FDEs are eating pain and excreting more pain, you don't have an FDE team. You have a services business. »* Zu Decagon werden zwei Zahlen angeführt — *« two-thirds of deployment work is now done autonomously via Duet »* und *« a few days on average to launch the first AOP, even for large banks, airlines, telcos »* —, ohne dass der Nenner von „deployment work" definiert oder das Akronym AOP ausgeschrieben wird.
**Jesse Zhang** — cofondateur et **CEO de Decagon** (agents IA de service client, San Francisco) · 85 000 abonnés sur X · site personnel `jessezhang.org`. Il cite son cofondateur **Ashwin Sreenivas** · **ex-Palantir** · d'où la profondeur du récit Palantir. Publié le **11 août 2026**.
Doktrinäres Manifest, veröffentlicht auf **meta.com** am **10. August 2026**, nur mit Vornamen unterzeichnet (*"– Mark"*) von **Mark Zuckerberg**, unter dem Titel *"The Future is for Everyone: The Path to a Positive AI Future"*, ~6.500 Wörter. Von Beginn an werden drei Prinzipien verkündet: individuelle Ermächtigung als Quelle von Wohlstand, Erfindung als primärer Zweck von Superintelligenz, Machtgleichgewicht als Grundlage von Sicherheit. **(A) Das zentrale Argument ist ein politisches Argument**, formuliert als kurze Kette: *"Humanity is not a monoculture"* — die Werte der Menschen kodieren gegensätzliche Kompromisse, keine technische Lösung kann sich gleichzeitig an widersprüchlichen Interessen ausrichten, weshalb jede singuläre Superintelligenz bestimmte Werte gegenüber anderen priorisieren müsste und dadurch unfähig wäre, gegenüber allen wohlwollend zu sein. Daraus die Formel: *"There is no such thing as a singular benevolent superintelligence."* Sicherheit wird als Problem der Machtverteilung neu gerahmt, veranschaulicht durch ein dreifach wiederholtes Gedankenexperiment (ein einziger superintelligenter Anwalt gegenüber der Situation, in der jeder einen hat; dasselbe für Cybersicherheit, dann für Wirtschaft). **(B) Eine Neudefinition von Alignment**: *"Solving alignment is necessary for billions of people to adopt personal superintelligence agents. But it also implies that if we reach a state where billions of people are using and scrutinizing personal superintelligence agents, then we will have solved alignment with their interests."* Das Korollar zielt, ohne sie zu nennen, auf den Rest der Branche: *"the most dangerous scenario would be leading labs training powerful models and keeping them for themselves."* **(C) Datierbare Zusagen**: ein **vollständig privater** Modus, bei dem *"even Meta"* weder Einblick noch Zugriff gewähren kann (eine WhatsApp-Analogie); **kostenlose** Versionen für Milliarden Menschen, gepaart mit einem **dynamischen Gebotsmechanismus** für bezahlte Rechenleistung; die angekündigte **Wiederaufnahme** von Open-Source-Veröffentlichungen — *"we will soon resume releasing some open source models"*; sowie eine Struktur, die dem **unabhängigen Board** die Befugnis gibt, Sicherheitskriterien für Veröffentlichungen zu genehmigen und deren Einhaltung bei jeder Veröffentlichung zu prüfen, wobei der Autor einräumt, dass Meta ein von den Gründern kontrolliertes Unternehmen ist. **(D) Zwei wirtschaftspolitische Vorschläge**, dreifach wiederholt: dass Labore **Zwischen-Trainingscheckpoints** und Ingenieure mit der Regierung teilen statt einer Überprüfung am Ende des Zyklus, und dass die **physische Produktion** gefährlicher Materialien reguliert wird statt der Verbreitung von Wissen. Die Quellenlage des Textes ist nahezu inexistent.
#Mark Zuckerberg#Meta#Meta Superintelligence Labs
**Mark Zuckerberg** — fondateur et PDG de **Meta**. Texte signé du seul prénom (*« – Mark »*) · publié le **10 août 2026** sur un domaine dédié de meta.com. La signature n'est pas « Meta » · et l'alternance des pronoms est régulière : **« we » pour les engagements de l'entreprise** (*« we will offer free versions »*, *« Meta is implementing a governance structure »*) · **« I » pour les affirmations normatives ou contestables** (*« I think this view of alignment is fundamentally flawed »*, *« I propose that companies developing frontier AI should… »*, *« My honest guess, and it is a guess »*). Les engagements produits et de gouvernance sont au « nous » · les propositions de politique publique au « je ».
Eine von **Didier Girard** verfasste Watch-Notiz, veröffentlicht auf **X** am **7. August 2026**, die den Launch von **Shieldstral 1.0 3B** (Mistral AI, 4. August 2026) nicht als Produktveröffentlichung liest, sondern als **die produktive Umsetzung einer Doktrin**. Ausgangspunkt: Am **13. Mai 2026** lehnte **Arthur Mensch** vor dem Untersuchungsausschuss der Nationalversammlung zu digitalen Verwundbarkeiten jede Aufsichtsrolle von Mistral über den Endgebrauch seiner Modelle ab – *„wir besitzen keine demokratische Legitimität“* – und wies damit explizit die Haltung von **Anthropic** zurück. Weniger als drei Monate später veröffentlicht Mistral ein **Moderationsmodell**. Der Autor entkräftet den scheinbaren Widerspruch: **Shieldstral trägt keine Taxonomie des Erlaubten und des Verbotenen in sich**, es beantwortet eine **vom Nutzer geschriebene Frage**. **Der Mechanismus steht im Zentrum der Notiz**: ein dreiteiliger Prompt (Kontext + Schweregrad / eine einzige geschlossene Frage / der zu beurteilende Inhalt), eine Antwort mit `yes` oder `no`, und der **Softmax über diese beiden Tokens** erzeugt einen kontinuierlichen Score zwischen 0 und 1. **Die Moderationsrichtlinie steckt nicht in den Gewichten, sie wird zur Inferenzzeit gelesen** – während **Llama Guard 4** die zur Trainingszeit fixierte MLCommons-Taxonomie einbettet, liest Shieldstral die eigene Richtlinie in natürlicher Sprache, änderbar **ohne erneutes Training**. Der technische Bericht (**arXiv:2607.25857**, 28. Juli 2026) beziffert die Kosten dieser Entscheidung: Fine-Tuning allein auf öffentlichen Daten = **61,1 % F1** bei der Anpassungsfähigkeit der Richtlinie; **4,4 Millionen kontrastive Paare**, von einem LLM generiert (derselbe Inhalt umgeschrieben, um eine Richtlinie zu verletzen, aber nicht die benachbarte Richtlinie) = **+23,3 Punkte**; **91,3 %** nach Zusammenführung von drei Checkpoints. Merkmale: **3,8 Mrd. tatsächliche Parameter** (das „3B“ im Namen ist abgerundet), Basis **Ministral 3** + Vision-Encoder **Pixtral**, **12 Sprachen**, **16 GB VRAM in BF16**, **Apache 2.0**. Textleistung: **84,9 % durchschnittlicher F1**, auf Augenhöhe mit **GPT-OSS-Safeguard-20B** (siebenmal größer), vor **Qwen3Guard-8B** (84,0) und weit vor **LlamaGuard-4-12B** (69,1). **Ein vom Autor selbst geäußerter Vorbehalt**: *all diese Zahlen stammen von Mistral, auf von Mistral ausgewählten Testdatensätzen, und bis zum 6. August existierte keine unabhängige Bewertung*. Die zentrale These der Notiz ist ein **Gegensatz der Topologien**: bei **Anthropic** wohnt das Sicherheitsnetz **in den Gewichten**, und der Anbieter entscheidet, wer davon ausgenommen wird (**Claude Fable 5** öffentlich mit Sicherheitsmaßnahmen / **Claude Mythos 5** ohne, vorbehalten zugelassenen Cyberverteidigern des **Project Glasswing**, 9. Juni 2026); bei **Mistral** liegt das Sicherheitsnetz **außerhalb des Modells** – eine separate, offene, selbst hostbare Komponente, deren Richtlinie dem Betreiber gehört. Explizite Kundenausrichtung (Verteidigungsministerium, BNP Paribas, französische und luxemburgische Regierungsverwaltungen). Die Notiz schließt mit einem **in drei Punkten dokumentierten Rückschlag**: **Auditierbarkeit** (binäre Ausgabe, keine Begründungsspur, während der Betreiber die Beweislast im Rahmen eines AI-Act-Audits trägt), **Robustheit** (das erste Kapitel von Voltaires *Traktat über die Toleranz*, von einem Tester im Hacker-News-Thread als „Aufruf zur Gewalt“ eingestuft – eine Verwechslung von Erwähnung und Befürwortung), **Verfügbarkeit** (Stand 6. August: kein kostenpflichtiger Endpunkt auf La Plateforme, kein offizielles Ollama-Angebot). Abschließend drei Einsatzregeln.
#Shieldstral#Shieldstral 1.0 3B#Mistral AI
**Didier Girard** — auteur de la note · publiée sur son compte X. Écrit ici en **analyste de doctrine industrielle** plutôt qu'en testeur : il n'a pas déployé le modèle · il croise une **audition parlementaire** (Mensch, 13 mai) · un **lancement produit** (Shieldstral, 4 août) · un **rapport technique** (arXiv, 28 juillet) et un **contre-exemple concurrent** (Anthropic, 9 juin) pour montrer qu'ils forment une position cohérente. Deux marqueurs de posture : il **borne explicitement la valeur des chiffres** qu'il cite (aucune évaluation tierce) et il **termine par des règles opérationnelles** — l'analyse doit sortir avec sa traduction en décisions de déploiement.