Produktkommunikation von **Anthropic**, veröffentlicht am **1. September 2026** auf anthropic.com (~4.000 Wörter, sechs Abschnitte, 22 Erfahrungsberichte von Early-Access-Partnern). Sie kündigt **Claude Fable 5.1** (allgemein verfügbar) und **Claude Mythos 5.1** (verifizierter Zugang) an: *dasselbe Modell, jedoch mit unterschiedlichen Stufen an Schutzmechanismen*.
#Claude Fable 5.1#Claude Mythos 5.1#Foundation Model
Anthropic — communication produit publiée sur anthropic.com · sans signature individuelle.
X-Post von **Andrew Ng** vom **14. August 2026** (16:29 UTC), Wiederaufnahme des "Dear friends"-Briefs aus ***The Batch* #366** (DeepLearning.AI, gleiches Datum), ca. 900 Wörter. Ng stellt **The AI Engineering Skills Map** vor und veröffentlicht **vier Skills**, die als die wichtigsten gelten. **(1) Aufbau und Bereitstellung von KI-Anwendungen** — die Besonderheit wird benannt: *« The key difference between AI and non-AI applications is that the former has unpredictable outputs »*, daher die Betonung von *evals* und Fehleranalyse-Loops. **(2) Grundlagen der Softwareentwicklung**, denn *« Understanding software fundamentals allows you to recognize what tradeoffs even exist »* — der unerfahrene Entwickler scheitert *« because they don't know what context to give their coding agent »*, daher das Ziel, *« steering coding agents using the precise language of software engineering »*. **(3) Einsatz von Coding-Agenten**, in operativer Formulierung: *« help the agent autonomously close loops by providing verifiers or evals »*, sowie *« knowing how much to intervene and how much to leave them alone »*. **(4) *Den Build gestalten***: *« Given a clear spec, coding agents are rapidly improving at delivering to it. Thus, our work as engineers is shifting toward deciding what should be in the spec »*, ergänzt durch *« Engineers should no longer expect to be given a pixel-perfect design and asked only to implement it. »* Ein **Hinweis zur Terminologie** trägt den größten Teil der Rahmung: Ng spricht von **Skills** im AI Engineering und **nicht von der Rolle** "AI Engineer", mit einer expliziten Analogie — *« All developers today should know how to work with the cloud, and only a smaller number have a "Cloud engineer" title. »* Das Ganze stützt sich auf *« an analysis of more than 10,000 job postings, dozens of structured interviews with experts, hiring managers, and recruiters, surveys, and other online data »*, wovon **keine numerischen Ergebnisse veröffentlicht werden**: Ng beschreibt sein Vorgehen als *« informally… akin to running clustering »* und kündigt eine detaillierte Map in künftigen Beiträgen an. Sein Eigeninteresse benennt er im vorletzten Satz: *« DeepLearning.AI's principal focus is to help developers gain these AI engineering skills. »*
#AI Engineering Skills Map#Skills-Map#Andrew Ng
**Andrew Ng** — fondateur de **DeepLearning.AI** · general partner d'**AI Fund** · cofondateur de **Coursera** et de **Google Brain** · ancien chief scientist de Baidu. Texte signé · à la première personne · écrit *« with my team »* sans qu'aucun collaborateur soit nommé. Publié le **14 août 2026** sur X et dans ***The Batch* n°366** — même texte aux deux endroits ; préférer *The Batch* pour toute citation durable. Quatrième fiche Ng du corpus · après les lettres n°350 (24 avril) · n°352 (8 mai) et n°359 (26 juin).
Beitrag und Bericht von **OpenAI Economic Research**, veröffentlicht am **27. Juli 2026**, erste Folge der Reihe **Work at the Frontier**, basierend auf der Analyse von **mehr als 800.000 Nachrichten von US-amerikanischen ChatGPT-Nutzern**. **Geprägter Begriff**: ***task crossover*** — *« Arbeit, die historisch mit einem Beruf verbunden ist und in der KI-Nutzung von Personen eines anderen Berufs auftritt »*. **Die Schlagzeilenzahl ist eigentlich zwei Zahlen, und genau das geht in der Berichterstattung verloren**: **16,8 % der arbeitsbezogenen Nachrichten** betreffen Aufgaben, die einem anderen Beruf zugeordnet sind, sowie **43,5 % der berufsspezifischen Nachrichten**. Der Trichter erklärt die Diskrepanz: **61,5 % der Nutzung sind generisch** (Schreiben, Zusammenfassen, Planen — zu breit verteilt, um als Beleg für Crossover zu gelten) und werden ausgeschlossen; von den **verbleibenden 38,5 %** liegen **43,5 % außerhalb des Berufs**, und 56,5 % sind *« innerhalb **oder in der Nähe** »* — die Obergrenze wird also auf einer reduzierten Basis berechnet, während die Untergrenze auf der gesamten beruflichen Nutzung berechnet wird. **Nach Beruf** (Anteil der berufsspezifischen Nachrichten, die auf eine fremde Aufgabe verweisen): Kundenerfahrung **77 %**, Design **75 %**, Personalwesen **69 %**, Recht **56 %**, Marketing **53 %**, Vertrieb **40 %**, Finanzen **40 %**, Engineering **28 %** — *« eine Mehrheit in fünf von acht Gruppen »*. **Zwei unterschiedliche Zirkulationsrichtungen**: Design **importiert** (35,2 %) und **exportiert** fast nichts (1,7 %); Engineering verhält sich umgekehrt (Import 18,5 %, Export 7,4 %); **Marketing tut beides** (Import 24,3 %, Export **8,9 %**, der höchste Exportanteil in der Stichprobe). **Zwei Aufgaben erscheinen in den Top 3 der Entlehnungen für die übrigen sieben Gruppen**: **Finanzberechnung** und **Fehlerbehebung bei Technologie**. **Die Heatmap, in der Berichterstattung nicht erwähnt, ist das ergiebigste Element**: Sie liefert die vollständige Verteilung der Aufgaben nach Beruf des Nutzers, und ihre Diagonale ist auffällig — Engineering behält **53 %** der eigenen Arbeit, während Kundenerfahrung nur **11 %**, Personalwesen **10 %** und Design **12 %** behalten. **Größeneffekt**: Der Anteil außerhalb des Berufs sinkt von **18,9 %** (2-5 Beschäftigte) auf **16,3 %** (>100 Beschäftigte) — **aber nur « bei durchschnittlichen Nutzern »**, wobei OpenAI präzisiert, dass *« bei den intensivsten Nutzern zeigt sich nicht dasselbe monotone Muster »*, und schlussfolgert bedingt: *« KI **könnte** besonders nützlich als generalistisches Werkzeug sein, wo spezialisierte Ressourcen knapp sind. »* **Beanspruchter Status**: ein **frühes Signal**, sichtbar *« bevor Unternehmen Stellenbeschreibungen umschreiben oder neue Berufsbezeichnungen schaffen »*. **Struktureller Vorbehalt**: OpenAI misst die eigene Nutzung von OpenAI, ausschließlich bei US-amerikanischen ChatGPT-Nutzern, und stellt diese Position als Vorteil dar — *« unser einzigartiges Fenster darauf, wie sich die Arbeitswelt verändert »*.
#OpenAI Economic Research#Work at the Frontier#task crossover
**OpenAI Economic Research** — équipe de recherche économique d'OpenAI ; la page crédite simplement *« OpenAI »* et la classe sous les tags *Economic Research* et *2026*. Le billet est la porte d'entrée d'un **rapport PDF** (`work-at-the-frontier-report.pdf`) et s'adosse à un cadre antérieur de la même équipe · l'**AI Jobs Transition Framework** · dont il reprend la thèse que de nombreux métiers vont **se réorganiser** plutôt que disparaître.
Lehrreicher Artikel des **MindStudio Team** (Blog der MindStudio-Plattform, Orchestrierung von Multi-Modell-Workflows), der **modèles de langage par diffusion** (*Diffusion Language Models*) anhand des Beispiels von **Diffusion Gemma** erklärt, Googles erster **Open-Weights**-Implementierung (2 Milliarden Parameter, abgeleitet von Gemma 2). Die These: Während **autoregressive** Modelle (GPT-4, Claude, Standard-Gemma) Text **Token für Token, von links nach rechts** generieren (kausale Aufmerksamkeit, jedes Token nach der Erzeugung fixiert), starten **Diffusionsmodelle** von einer **maskierten/verrauschten** Sequenz und **verfeinern sie iterativ** (masked diffusion / *absorbing diffusion*), mit **bidirektionaler Aufmerksamkeit**: Das Modell kann **jede Position zu jedem Zeitpunkt überarbeiten**. Konsequenzen: hohe **Parallelität** (ein Text mit 500 Token würde 50-100 Denoising-Schritte statt 500 sequenzieller Durchläufe erfordern), natürliches **Infilling** und **beschränkte Generierung** (Template-Ausfüllung, Codevervollständigung mit umgebendem Kontext) sowie eingebaute **Überarbeitungsfähigkeit**. Aber im aktuellen Maßstab (2B) **erreicht** Diffusion Gemma die großen autoregressiven Modelle (GPT-4o, Gemini 1.5 Pro) bei Schlussfolgerung, Befolgung von Anweisungen und Allgemeinwissen **nicht**: Die Lücke „schließt sich“, ohne geschlossen zu sein. Die Inspiration stammt aus der Bildgenerierung (Stable Diffusion, DALL-E haben die Autoregression vor Jahren hinter sich gelassen); ob dasselbe Prinzip für Text gilt, bleibt eine offene Frage. Diffusion Gemma wird auf Hugging Face (Google DeepMind), AI Studio und Vertex AI verbreitet.
#modèles de langage par diffusion#Diffusion Gemma#Google DeepMind
Wharton-Studie (Generative AI Labs): Expertenpersonas verbessern die faktische Genauigkeit von LLMs nicht - GPQA Diamond- und MMLU-Pro-Benchmarks - SSRN
#KI-Prompting#Personas#LLM-Genauigkeit
Savir Basil · Ina Shapiro · Dan Shapiro · Ethan Mollick · Lilach Mollick · Lennart Meincke (Generative AI Labs, The Wharton School, University of Pennsylvania)