Zum Inhalt springen

root / tags / jagged-frontier

#jagged frontier

4 Fiches

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

Andrej Karpathy: From Vibe Coding to Agentic Engineering

Interview mit Andrej Karpathy (Mitgründer von OpenAI, ehemals Tesla Autopilot) über den Übergang von *vibe coding* zu *agentic engineering*: December 2025 transition als Wendepunkt – „noch nie so sehr als Programmierer hinterhergehinkt“ –, die Taxonomie Software 1.0/2.0/3.0, das Beispiel openclaw (Bash-Skript → Text zum Kopieren in den Agenten) und MenuGen, das durch Geminis Nanobanana obsolet wird, die *Verifiability*-Theorie, die erklärt, warum LLMs *jagged* sind (Spitzenwerte bei Mathematik/Code, aber Scheitern bei „50 m zu Fuß zur Autowaschanlage“), die Unterscheidung zwischen *vibe coding* (die Einstiegshürde senken) und *agentic engineering* (den Qualitätsanspruch wahren), die Metapher „animals vs ghosts“, die Neuausrichtung der Personalauswahl über Agent-gegen-Agent-Projekte sowie die Kernformel: ***„You can outsource your thinking but you can't outsource your understanding.“***

#Andrej Karpathy#vibe coding#agentic engineering

Andrej Karpathy (co-fondateur OpenAI, ex-Tesla Autopilot, créateur du terme "vibe coding")

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

The Batch n°350 — How Coding Agents Accelerate Different Types of Software Work (Andrew Ng) + GLM-5.1, Digit chez Schaeffler, anti-data-center revolt, assistant axis

Das Editorial von Andrew Ng in The Batch #350 stellt eine Beschleunigungshierarchie für Coding-Agenten nach Art der Softwarearbeit auf: Frontend (maximal) > Backend (moderat) > Infrastruktur (gering) > Forschung (minimal). Die Begründung stützt sich auf die implizite Verifizierbarkeit (Beherrschung von TypeScript/JavaScript plus eine autonome Agent-Browser-Testschleife im Frontend) sowie auf die blinden Flecken der LLMs (Grenzfälle / Sicherheit / DB-Migrationen beim Backend, undurchsichtige Netzwerk-Tradeoffs bei der Infrastruktur, irreduzible Hypothesenbildung bei der Forschung). Die Ausgabe wird durch 4 einordnende Nachrichten abgerundet: GLM-5.1 (Z.ai), ein Modell mit 754B/40B aktiven Parametern unter MIT-Lizenz, das autonome Aufgaben von bis zu 8 Stunden Dauer bewältigt (Spitzenreiter bei SWE-Bench Pro mit 58,4 %); Digit (Agility Robotics) bei Schaeffler, der erste industrielle Einsatz von Humanoiden (1,75 m/65 kg, 10–25 $/h gegenüber 20 $/h für einen Menschen); die Anti-Rechenzentren-Revolte (~64 Mrd. $ blockiert zwischen Mai 2024 und März 2025, Moratorium in Maine für Anlagen ab 20 MW, Molotow-Cocktail am Wohnhaus von Sam Altman); sowie die „Assistant Axis" (Christina Lu, MATS / Oxford / Anthropic), die Persona-Drift und Jailbreaks reduziert (Qwen3 32B: 83 %→41 %; Llama 3.3 70B: 65 %→33 %), ohne IFEval/GSM8k/MMLU-Pro/EQ-Bench zu verschlechtern.

#Andrew Ng#The Batch#DeepLearning.AI

Andrew Ng (édito principal — fondateur DeepLearning.AI, Stanford, ex-Google Brain, ex-Baidu) ; rédaction The Batch (DeepLearning.AI) pour les sections actualités

Transformation & Adoption Automatisch geprüfte Übersetzung

Giving your AI a Job Interview

AI-Benchmarking jenseits von Standardtests - KI-Modelle für spezifische Anwendungsfälle befragen - Jagged Frontier - OpenAI GDPval - Vibes vs. echte Messungen - GuacaDrone-Beispiel - Ethan Mollick - One Useful Thing

#AI-Benchmarking#MMLU-Pro#ARC-AGI

Ethan Mollick

Transformation & Adoption Automatisch geprüfte Übersetzung

An Opinionated Guide to Using AI Right Now

Praktischer Leitfaden zur KI-Nutzung, Modellauswahl, Jagged Frontier, Centaurs vs. Cyborgs, OpenAI-Nutzungsdaten, Claude/Gemini/ChatGPT - Ethan Mollick

#KI-Modellauswahl#ChatGPT vs. Claude vs. Gemini#Jagged Frontier

Ethan Mollick (Associate Professor, Wharton School, University of Pennsylvania ; Auteur "Co-Intelligence: Living and Working with AI" ; TIME 100 Most Influential People in AI 2024)