# curran-intercom-fin-ideas-2x-nine-months-later-3x-rd-productivity-2026-04-16

## Veille

Öffentliches Update von Darragh Curran (F&E, Intercom) neun Monate nach seiner Zusage, die F&E-Produktivität in 12 Monaten durch KI zu verdoppeln. Ergebnis: **das 3-Fache erreicht in 16 Monaten, ohne Anzeichen einer Plateaubildung**. Quantifizierte Daten aus einer 500-köpfigen F&E-Organisation / 8,5 Mio. Zeilen Code: **93,6 % der PRs sind agentengesteuert**, **19,2 % KI-genehmigt** (Ziel > 50 %), Kosten/PR **-50 %**, Defect-Backlog **-54 %**, Time-to-Shipping **-39 %**, Ausfallzeit durch Breaking Changes **-35 %**, die Top 5 % der Performer bei **dem 6-Fachen des Median-PR-Durchsatzes**, **497 autonome PRs** in den ersten 4 Wochen, **153 Beitragende / 267 spezialisierte Skills** in einer privaten *Skills-Based Plugin Architecture*. Curran erklärt: ***„All technical work is becoming agent-first. This is the top priority for R&D.“*** Schlüsselartikel des Dossiers zur *agent-first organization*, im Korpus 2026 nur mit Stripe Minions und StrongDM vergleichbar.

## Titre Article

2× – nine months later: We did it

## Date

2026-04-16

## URL

https://ideas.fin.ai/p/2x-nine-months-later

## Keywords

Darragh Curran, Intercom, Fin Ideas, F&E-Produktivität 3-fach, 2x Principles, Agent-first-Prinzip, agentengesteuerte PRs 93,6 %, KI-genehmigte PRs 19,2 %, Kosten pro PR -50 %, Defect-Backlog -54 %, Time-to-Shipping -39 %, Ausfallzeit durch Breaking Changes -35 %, autonome PRs 497, Top 5 % Performer 6-facher Median, Claude Code Median-Merge 14,6 Min., Productivity Tiering, Skills-Based Plugin Architecture, privater Plugin-Marktplatz, 153 Beitragende 267 Skills, Brian Scanlan Plugin-Thread, Cormac Datenanalyse, Streamlit Snowflake, Fabrikmodell F&E, unvollkommene Metriken akzeptabel, 500 F&E-Mitarbeitende, 8,5 Mio. Zeilen Code, 313 tägliche Produktions-Deployments, 1.100 Claude Code-Nutzer zu Spitzenzeiten, Ramp vergleichbar, keine Anzeichen einer Plateaubildung, Anthropic Claude Code, Agent-first-Organisation, moderne Arbeitsmethodik, interne Reporting-Plattform

## Authors

Darragh Curran (R&D leader, Intercom — publication via Fin Ideas, plateforme média Intercom).

## Ton

**Profil**: Öffentliches Update im *Zeugnis*-Modus einer F&E-Führungskraft eines internationalen Scale-ups (Intercom, 30.000 B2B-Kunden, 1.305 Beschäftigte, 500 in der F&E, 8,5 Mio. Zeilen Code). Follow-up-Format zu einer öffentlichen Zusage — Curran hatte 9 Monate zuvor erklärt, die F&E-Produktivität in 12 Monaten durch KI verdoppeln zu wollen, ein für eine C-Level-Führungskraft ungewöhnlich überprüfbares Versprechen. Zielgruppe: CTOs, VPs of Engineering, F&E-Leiter, Gründer von B2B-SaaS-Scale-ups, die den Wettbewerbsdruck des agentischen Wandels einschätzen. Sekundäre Zielgruppe: Analysten, Tech-Journalisten, Berater für KI-Transformation.

**Stil**: Direkte, faktenbasierte Stimme, verankert in Zahlen. Der Ton ist der einer *Engineering-Führungskraft, die geliefert hat* — kein Hype, keine Spekulation, sondern konkrete Kennzahlen und eine chronologische Erzählung. Keine manipulativen Aphorismen, aber ein paar rahmensetzende Sätze, die die Doktrin verdichten: ***„All technical work is becoming agent-first. This is the top priority for R&D.“*** oder *„Don't paralyze decision-making searching for perfect measures.“* **Ton nach dem Sieg, aber nicht triumphalistisch**: *„3x over 16 months with no signs of plateauing“* — die Entwicklung setzt sich fort.

**Ausgearbeitete Metaphern**: Die F&E als *„factory for producing high-quality increments“* (Erbe von Lean / DORA / Continuous Delivery), wobei der PR-Durchsatz als *Druckpunkt* fungiert, der systemische Engpässe offenlegt. Eine produktive Metapher, weil sie ein aggressives Eingreifen beim Durchsatz legitimiert.

**Autorität**: beruht auf drei Hebeln — (1) eine überprüfbare **frühere öffentliche Zusage** (die 9 Monate zuvor angekündigte Verdopplung), (2) **quantifizierte Transparenz** (jede Kennzahl wird benannt und beziffert), (3) **Beweis durch Masseneffekt** (1.100 Claude Code-Nutzer zu Spitzenzeiten von 1.305 Beschäftigten, 153 Beitragende zum Plugin-Marktplatz, 267 Skills, 313 Deploys/Tag). Dies ist ein seltener Fall von *agent-first-Belegen* im Maßstab eines B2B-Scale-ups — im Korpus nur mit Stripe Minions (2026-02-09/19) und StrongDM (2026-02-06) vergleichbar.

**Epistemische Position**: Curran lehnt sowohl das *Warten auf perfekte Metriken* (Paralyse) als auch die *vibe-vibe productivity* (ohne Zahlen) ab. Seine These: *unvollkommene Messgrößen akzeptieren + ganzheitliches Monitoring der Ergebnisse*. Dies ist die Ethik einer pragmatischen Engineering-Führungskraft, die die Debatte von 2026 *„does AI actually produce value?“* durch einen konkreten, instrumentierten Fall in den Griff bekommt. Die Erzählung ist die einer Organisation, die **agent-first operationalisiert hat**, statt nur darüber zu reden.

## Pense-betes

- **Datum / Quelle**: 16. April 2026, *Fin Ideas* (Substack, Intercoms Medienplattform). Autor: **Darragh Curran**, F&E-Leiter bei Intercom.
- **Frühere Zusage (Juli 2025)**: Curran hatte sich mit Intercom öffentlich verpflichtet, die **F&E-Produktivität in 12 Monaten** durch KI **zu verdoppeln**. Eine seltene und überprüfbare Wette auf C-Level-Ebene.
- **Ergebnis 9 Monate später**: ***das 3-Fache über 16 Monate, „no signs of plateauing“*** — Ziel übertroffen.
- **Größenordnung von Intercom**:
- **500 Personen** in der F&E
- **~8,5 Millionen Zeilen** Anwendungscode (mehrsprachig)
- **über 2 Millionen QPS** in Spitzenzeiten
- **313 Produktions-Deployments / Tag**
- **30.000 Geschäftskunden**
- **1.305 Beschäftigte** insgesamt
- **1.100 Claude Code-Nutzer** zu Spitzenzeiten (*im gesamten Unternehmen* — Finance, Recruiting und Sales bauen ihre eigenen Analytics-Tools)
- **Zentrale Kennzahl**: **gemergte PRs** als *Durchsatzmetrik*, die systemische Engpässe offenlegt. Der Druck wird auf diese Einheit ausgeübt.
- **Fabrikmodell-Doktrin**: Die F&E wird als *„factory for producing high-quality increments“* verstanden — ein bewusstes Erbe von Lean / DORA.
- **Zentrales Prinzip**: ***„All technical work is becoming agent-first. This is the top priority for R&D.“*** Top-down-strategisches Diktat.
- **Ergebnistabelle**: | Kennzahl | Ergebnis | |----------|----------| | **Defect-Backlog** | **-54 %** | | **Produktänderungen** | **> 2-fach** | | **Zeit Idee → Shipping** | **-39 %** | | **Codequalität** | 5 Wochen positiver Entwicklung | | **Ausfallzeit durch Breaking Changes** | **-35 %** | | **Kosten pro PR** | **-50 %** | | **Agentengesteuerte PRs** | **93,6 %** | | **KI-genehmigte PRs** | **19,2 %** *(Ziel > 50 %)* | | **Autonome PRs (erste 4 Wochen)** | **497** | | **Aktive Plugin-Beitragende** | **31 % der F&E** | | **Claude Code Median-Merge-Zeit (auto-genehmigt)** | **14,6 Min. vs. 75,8 Min. (Median der Organisation)** |
- **Ungleichmäßige Produktivität**: *„the top 5% of performers generate 6x the median PR throughput“*. **Der Token-Verbrauch korreliert direkt mit den individuellen Produktivitätsgewinnen**. Dies ist das Karpathy-Muster *„10x is not the speed up — people who are very good at this peak a lot more than 10x“*.
- **Productivity Tiering** (Curran-Framework): 5 Bewertungsdimensionen zur Erfassung des Fortschritts von *„minimal to elite agentic tool usage“*: 1. Intensität der KI-Nutzung 2. Gesamt-Output 3. Nutzungstiefe 4. **Kosteneffizienz ($/PR)** 5. **Prompt-Qualität**
- **Skills-Based Plugin Architecture** (zentrale organisatorische Innovation):
- **Privater Marktplatz**, der spezialisierte Claude Code-Konfigurationen in der gesamten Organisation verteilt
- **Automatisch aktualisierende Plugins** für die schnelle Skalierung von Fähigkeiten
- **153 Beitragende, die in 3 Monaten 267** spezialisierte **Skills** erstellten
- **31 % der F&E tragen aktiv** zum Marktplatz **bei**
- Das *Plugin-Ökosystem* ist der herausragende Aspekt — Brian Scanlan (Intercom-Mitglied) veröffentlichte dazu einen viralen Thread
- **Interner Vorzeige-Use-Case — Cormac (Datenanalyseplattform)**: Prototyp im Februar → breite Adoption, **Streamlit-on-Snowflake**-Deployments auf mehrere Abteilungen ausgeweitet (Finance, Recruiting, Sales).
- **2x Principles** (angekündigt, aber dem nächsten Beitrag vorbehalten): beschreiben Intercoms „modern work methodology“. Curran kündigt eine mehrteilige Serie zur *„messy journey“*, den gelernten Lektionen und der zukünftigen Roadmap an.
- **Öffentliches Webinar angekündigt**: **19. Mai 2026, 9 Uhr PT / 17 Uhr GMT**, gerichtet an Führungskräfte, die Strategien für die KI-Transformation suchen.
- **Methode gegen Analyse-Paralyse**: *„Don't paralyze decision-making searching for perfect measures.“* Unvollkommene Messgrößen akzeptieren + ganzheitliches Monitoring der Ergebnisse. Klug für 2026, da viele Organisationen weiterhin am *measurement problem* hängen bleiben.
- **Methodik der automatischen Genehmigung**: Ein eigener Beitrag zur Methodik der *KI-Auto-Genehmigung* und zum *Risikomanagement* ist geplant. Intercom liegt derzeit bei **19,2 % KI-genehmigt**, mit dem Ziel **> 50 %** — ein gewaltiger Sprung, der Vertrauen in die Governance und ein bewährtes Risikomodell erfordert.
- **Externe Erwähnungen**:
- **Ramp**: vergleichbares Beispiel einer Organisation, die ähnliche Ergebnisse anstrebt (externe Bestätigung des Musters).
- **Brian Scanlan** (Intercom): viraler Thread zum Plugin-Ökosystem.
- **Cormac** (Intercom): Team Lead der Datenanalyseplattform.
- **Claire Vo**: prüfte den Entwurf, mit Dank erwähnt.
- **Anthropic**: Anbieter von Claude / Claude Code (der zentrale technische Stack).
- **Einordnung ins Dossier**:
- **Quantitatives Referenzstück** zum Thema agent-first im Maßstab eines Scale-ups. Vergleichbar mit:
- **Stripe Minions** (Gray, 2026-02-09 und 2026-02-19): 1300+ PRs/Woche, ~500 MCP-Tools.
- **StrongDM Software Factory** (McCarthy, 2026-02-06): nicht-interaktive Entwicklung, $1000 Tokens/Tag.
- **16 parallele Claude-Agenten C-Compiler** (Carlini/Anthropic, 2026-02-05).
- **Bestätigung von Karpathys These** *„the speed up is not 10x, it peaks much higher for those who are good“* (2026-04-29): Intercom misst genau dieses Muster (Top 5 % beim 6-Fachen des Medians).
- **Das „Agent-first“-Diktat** bestätigt Levie *Building for Trillions of Agents* (2026-03-07), Greyling *CLI vs IDE* (2026-03-09), Wescale *Augmented Software Factory* (2026-05-03).
- **Skills-Based Plugin Architecture** = operative Umsetzung von Vincent *Superpowers* (2026-04-02), Anthropic *Skills* (2025-10-16), Karpathy *Skills for Claude Code* (2026-01-27).
- **AI-approved PRs 19,2 % → Ziel 50 %** = konkrete Entwicklung von Sierras *AI-native interview*-These (Taylor, 2026-04-20) auf der Produktionsseite: Wenn der Agent 50 % der PRs automatisch genehmigen kann, ist das ein grundlegend transformiertes *Quality Gate*.
- **Unvollkommene Metriken akzeptabel** steht im Einklang mit Stanford *quantify AI ROI* (Denisov-Blanch, 2025-11-23), Reock *DX Leadership AI Engineering Metrics* (2025-11-23) — ein Schritt von der *measurement*-Debatte hin zum Handeln.
- **Funktionsübergreifende Claude Code-Adoption (1100/1305)** bestätigt die Thesen von Mollick *Real AI Agents* (2025-09-29) und Levie *Building for Trillions of Agents* (2026-03-07) zur Ausweitung über den Tech-Bereich hinaus.
- **Belege für eine eingehaltene öffentliche Zusage**: einzuordnen neben Amodeis *50 % der Jobs verschwinden bis 2030* (Sun NYT, 2026-04-30) — Intercom hat nicht 50 % der F&E verloren, sondern **den Output mit demselben Team verdreifacht**, was die These bestätigt, ohne die Dystopie auszulösen. Klassischer produktivistischer Trade-off.
- **Zu markierende Einschränkungen**: keine unabhängige externe Überprüfung der Zahlen, kein Vergleich mit einer strengen Vor-KI-Baseline außer der internen Entwicklung, *Defect-Backlog -54 %* könnte auch eine parallele, nicht KI-bedingte Bereinigung widerspiegeln. Doch die Größenordnung der Kennzahlen und die Kohärenz des Ökosystems (Plugins, Productivity Tiering, Auto-Genehmigung, funktionsübergreifende Nutzung) machen die Entwicklung glaubwürdig.
- **Verwendbar für**: CFO/CEO-Business-Case zur F&E-Transformation; CTO-Argument zur Förderung von agent-first; Benchmarks zur Präsentation im französischen COMEX; Definition von agent-first-KPIs (Kosten/PR, AI-Approval-Rate, Anteil agentengesteuerter PRs, Plugin-Beitragsquote); Konzeption eines internen privaten Skills-Marktplatzes.

## RésuméDe400mots

Darragh Curran, F&E-Leiter bei Intercom, veröffentlichte am 16. April 2026 auf Fin Ideas ein im Korpus 2026 beispielloses *Zeugnis*. Neun Monate zuvor hatte er sich öffentlich verpflichtet, die F&E-Produktivität in 12 Monaten durch KI zu verdoppeln. Ergebnis: **das 3-Fache über 16 Monate, ohne Anzeichen einer Plateaubildung**. Der Artikel dokumentiert die Entwicklung mit seltener quantitativer Transparenz.

Die Größenordnung von Intercom verleiht dem Fall seine Bedeutung: 500 Personen in der F&E, 8,5 Millionen Zeilen Code, 313 Produktions-Deployments pro Tag, 30.000 B2B-Kunden. Die zentrale Kennzahl ist der **gemergte PR**, behandelt als *Durchsatz*, der Engpässe offenlegt. Die F&E wird explizit als *„factory for producing high-quality increments“* verstanden. Das strategische Diktat: *„All technical work is becoming agent-first. This is the top priority for R&D.“*

Die Zahlen: **Defect-Backlog -54 %**, **Produktänderungen > 2-fach**, **Zeit Idee→Shipping -39 %**, **Ausfallzeit durch Breaking Changes -35 %**, **Kosten pro PR -50 %**. **93,6 % der PRs sind agentengesteuert**, **19,2 % KI-genehmigt** (Ziel > 50 %). **497 autonome PRs** in den ersten 4 Wochen. **Top 5 % der Performer: das 6-Fache des Median-PR-Durchsatzes** — *„token spending correlates with individual gains“*. Claude Code im Modus für automatisch genehmigte Merges bei **14,6 Min.** gegenüber **75,8 Min.** für den Median der Organisation.

Die zentrale organisatorische Innovation ist die **Skills-Based Plugin Architecture**: ein privater Marktplatz, der spezialisierte Claude Code-Konfigurationen mit automatischer Aktualisierung verteilt. **153 Beitragende erstellten in 3 Monaten 267 Skills**, **31 % der F&E tragen aktiv bei**. Das Plugin-Ökosystem war Gegenstand eines viralen Threads von Brian Scanlan. Außerhalb der F&E: **1.100 Claude Code-Nutzer** von 1.305 Beschäftigten — Finance, Recruiting und Sales bauen ihre eigenen Analytics-Tools (Plattform Cormac, Streamlit-on-Snowflake).

Curran schlägt ein **Productivity Tiering** über 5 Dimensionen vor (Intensität der KI-Nutzung, Output, Tiefe, $/PR, Prompt-Qualität), um den Fortschritt von *minimal bis elite* zu erfassen. Anti-Paralyse-Methodik: *„don't search for perfect measures, embrace imperfect ones + monitor holistic outcomes“*. Eine Folgereihe kündigt die *2x Principles* an, und ein öffentliches Webinar ist für den 19. Mai 2026 angesetzt.

Der Fall Intercom ergänzt Stripe Minions, StrongDM Software Factory und Anthropics 16-Claude-Compiler zu einem **quantitativen Referenzstück** zum Thema agent-first in großem Maßstab. Er bestätigt empirisch Karpathys Thesen (die Spitzenwerte liegen bei den Besten weit über dem 10-Fachen), bekräftigt die Entwicklung AI-approved → über 50 % (Sierra) und zeigt, dass ein B2B-Scale-up **mit demselben Team seinen Output verdreifachen** kann — ohne die Dystopie der *permanent underclass* (Sun NYT) auszulösen. Seltene öffentliche Belege.

## GrapheDeConnaissance

- Darragh Curran —dirige→ Intercom (ORGANISATION, 0.97)
- Intercom —mesure→ 3× productivité R&D en 16 mois (MESURE, 0.97)
- Darragh Curran —affirme_que→ engagement public de doubler la productivité R&D en 12 mois (AFFIRMATION, 0.96)
- Darragh Curran —affirme_que→ "All technical work is becoming agent-first" (CITATION, 0.98)
- PR mergé —est_instance_de→ throughput metric R&D (CONCEPT, 0.95)
- Intercom —mesure→ 93,6% PRs agent-driven (MESURE, 0.97)
- Intercom —mesure→ 19,2% PRs AI-approved (MESURE, 0.96)
- Intercom —prédit→ >50% PRs AI-approved (MESURE, 0.95)
- Intercom —mesure→ cost per PR -50% (MESURE, 0.96)
- Intercom —mesure→ defect backlog -54% (MESURE, 0.96)
- Top 5% performers —surpasse→ median PR throughput (6×) (CONCEPT, 0.95)
- Token spending —améliore→ gains individuels productivité (CONCEPT, 0.93)
- Intercom —a_créé→ Skills-Based Plugin Architecture (TECHNOLOGIE, 0.97)
- Plugin marketplace privé —permet→ distribution de 267 skills Claude Code spécialisés (CONCEPT, 0.96)
- contributeurs R&D (153) —a_créé→ 267 skills en 3 mois (TECHNOLOGIE, 0.96)
- Brian Scanlan —publie→ thread viral plugin ecosystem (DOCUMENT, 0.94)
- employés (1100 en pic) —utilise→ Claude Code (TECHNOLOGIE, 0.96)
- R&D —est_instance_de→ factory for producing high-quality increments (CONCEPT, 0.93)
- Darragh Curran —recommande→ embrasser les métriques imparfaites plutôt que la paralysie analytique (AFFIRMATION, 0.94)
- Productivity Tiering —mesure→ progression minimal → elite agentic tool usage (CONCEPT, 0.94)
- Intercom —mesure→ merge auto-approuvé Claude Code médian à 14,6 min (MESURE, 0.95)
- Cormac —a_créé→ data analytics platform (Streamlit-Snowflake) (TECHNOLOGIE, 0.92)
- Ramp —converge_avec→ Intercom (ORGANISATION, 0.88)

---
Canonical: https://www.thekb.eu/de/fiches/curran-intercom-fin-ideas-2x-nine-months-later-3x-rd-productivity-2026-04-16/
