Saltar al contenido

root / tags / jagged-frontier

#jagged frontier

4 fiches

Agentes de codificación IA y Skills Traducción verificada automáticamente

Andrej Karpathy: From Vibe Coding to Agentic Engineering

Entrevista con Andrej Karpathy (cofundador de OpenAI, ex Tesla Autopilot) sobre el paso de *vibe coding* a *agentic engineering*: December 2025 transition como punto de inflexión ("nunca se sintió más rezagado como programador"), la taxonomía Software 1.0/2.0/3.0, el ejemplo openclaw (script bash → texto para copiar y pegar en el agente) y MenuGen vuelto obsoleto por Nanobanana de Gemini, la teoría de la *verifiability* que explica por qué los LLM son *jagged* (picos en matemáticas/código, fallo al "caminar a un lavadero de coches a 50 m"), la distinción entre *vibe coding* (elevar el piso) y *agentic engineering* (preservar el estándar de calidad), la metáfora "animales vs fantasmas", la refundación de la contratación mediante proyectos agente contra agente, y la fórmula clave: ***"Puedes externalizar tu pensamiento pero no puedes externalizar tu comprensión."***

#Andrej Karpathy#vibe coding#agentic engineering

Andrej Karpathy (co-fondateur OpenAI, ex-Tesla Autopilot, créateur du terme "vibe coding")

Agentes de codificación IA y Skills Traducción verificada automáticamente

The Batch n°350 — How Coding Agents Accelerate Different Types of Software Work (Andrew Ng) + GLM-5.1, Digit chez Schaeffler, anti-data-center revolt, assistant axis

El editorial de Andrew Ng en The Batch #350 establece una **jerarquía de aceleración para agentes de codificación** por tipo de trabajo de software: **Frontend (máxima) > Backend (moderada) > Infraestructura (baja) > Investigación (mínima)**. El razonamiento se basa en la *verificabilidad* implícita (fluidez en TypeScript/JavaScript junto con un bucle autónomo de pruebas agente-navegador en el frontend) y en los puntos ciegos de los LLM (casos límite / seguridad / migraciones de bases de datos para el backend, compensaciones de red opacas para la infraestructura, formación irreducible de hipótesis para la investigación). El número se completa con 4 noticias estructurantes: **GLM-5.1 (Z.ai)**, un modelo con licencia MIT de 754B de parámetros (40B activos) capaz de tareas autónomas de hasta 8 horas de duración (líder de SWE-Bench Pro con 58,4%); **Digit (Agility Robotics) en Schaeffler**, el primer despliegue industrial de humanoides (1,75 m / 65 kg, 10-25 $/h frente a 20 $/h para un humano); la **revuelta antidata centers** (~64.000 M$ bloqueados entre mayo de 2024 y marzo de 2025, moratoria en Maine sobre instalaciones de 20MW o más, cóctel molotov en la casa de Sam Altman); y el **"eje del asistente"** (Christina Lu, MATS / Oxford / Anthropic), que reduce la deriva de persona y los jailbreaks (Qwen3 32B: 83%→41%; Llama 3.3 70B: 65%→33%) sin degradar IFEval/GSM8k/MMLU-Pro/EQ-Bench.

#Andrew Ng#The Batch#DeepLearning.AI

Andrew Ng (édito principal — fondateur DeepLearning.AI, Stanford, ex-Google Brain, ex-Baidu) ; rédaction The Batch (DeepLearning.AI) pour les sections actualités

Transformación y Adopción Traducción verificada automáticamente

Giving your AI a Job Interview

Benchmarking de IA más allá de los tests estándar - Entrevistar a modelos de IA para casos de uso específicos - Jagged Frontier - OpenAI GDPval - Vibes frente a mediciones reales - Ejemplo GuacaDrone - Ethan Mollick - One Useful Thing

#benchmarking de IA#MMLU-Pro#ARC-AGI

Ethan Mollick

Transformación y Adopción Traducción verificada automáticamente

An Opinionated Guide to Using AI Right Now

Guía práctica de uso de IA, selección de modelos, jagged frontier, Centaurs vs Cyborgs, datos de uso de OpenAI, Claude/Gemini/ChatGPT - Ethan Mollick

#selección de modelos de IA#ChatGPT vs Claude vs Gemini#jagged frontier

Ethan Mollick (Associate Professor, Wharton School, University of Pennsylvania ; Auteur "Co-Intelligence: Living and Working with AI" ; TIME 100 Most Influential People in AI 2024)