Tiefe
Gleiches Kapitel, drei Tiefen. Die Wahl gilt überall und bleibt gespeichert.

GrundlagenVibe-Coding / Agentic EngineeringKapitel 01von 13 im Pfad

Was Vibe-Coding ist

Tiefe 1: Überblick · Lesezeit 10 Min. · Stand

Softwareentwicklung hat einen neuen Namen bekommen, und er stammt aus einem einzigen Beitrag im Netz. Was seither darunter verstanden wird, hat sich davon ziemlich weit entfernt.

Woher das Wort kommt

Am 2. Februar 2025 schrieb Andrej Karpathy, Mitgründer von OpenAI, einen kurzen Beitrag über eine Arbeitsweise, die er bei sich selbst beobachtet hatte. Er beschreibt darin ein Vorgehen, bei dem man dem Modell sagt, was man möchte, das Ergebnis übernimmt und den Code gar nicht mehr liest. Er gab dem Ganzen einen Namen, und der Name blieb.

Zwei Stellen des Beitrags werden in der späteren Verwendung selten mitzitiert. Erstens: Karpathy beschreibt es als Verfahren für Wegwerfprojekte am Wochenende. Zweitens: Das Nichtlesen des Codes ist bei ihm der Kern der Sache. Wer den Code liest, macht etwas anderes.

Der Beitrag steht unter Karpathys Beschreibung vom Februar 2025 (externe Seite, x.com). Er ist drei Absätze lang.

Das Wort bekam eine Grenze, und zwar von ihm selbst

Fünfzehn Monate später, am 30. April 2026, hat Karpathy die Sache eingeordnet. Er stellt dem Begriff einen zweiten zur Seite und trennt beide an einem Bild:

Vibe coding raises the floor. It lets almost anyone create software by describing what they want. (externe Seite, karpathy.bearblog.dev)

Vibe-Coding hebt also den Boden. Es bringt Leute zu einem Ergebnis, die sonst gar keines bekommen hätten. Daneben stellt er das andere:

Agentic engineering raises the ceiling. It is the professional discipline of coordinating fallible agents while preserving correctness, security, taste, and maintainability. (externe Seite, karpathy.bearblog.dev)

Agentic Engineering heißt das im Deutschen bisher gar nicht, ein eingeführtes Wort dafür gibt es nicht. Gemeint ist die berufliche Fassung: mehrere fehlbare Agenten führen, ohne Richtigkeit, Sicherheit und Wartbarkeit aufzugeben.

Die beiden Begriffe betreffen verschiedene Leute: Vibe-Coding bringt mehr Menschen zu einem Ergebnis, Agentic Engineering bringt geübte weiter. Eine Verteilung über die Erfahrung. Die gestrichelte Kurve ist der Zustand vorher; links wächst sie in die Breite, rechts wird ihr Rand nach oben gezogen. Die beiden Bewegungen setzen damit an verschiedenen Leuten an. WIE VIELE ZU EINEM ERGEBNIS KOMMEN Vibe-Coding HEBT DEN BODEN Agentic Engineering HEBT DIE DECKE OHNE ÜBUNG SEHR GEÜBT Die Kurve ohne Strich ist der Stand davor

seitlich verschiebbar

Die beiden Bewegungen setzen an verschiedenen Enden an. Der Boden steigt, weil Leute zu einem Ergebnis kommen, die vorher keines bekamen; die Decke steigt, weil Geübte weiter kommen als vorher.

eigene Darstellung nach Karpathy, Stand 03.08.2026

Warum das kein Wortstreit ist

An der Grenze hängt, wer für das Ergebnis geradesteht.

Karpathys erste Fassung ist für kleine, ersetzbare Sachen gedacht. Ein Skript für einen Nachmittag, ein Prototyp, der nach der Vorführung gelöscht wird. Fünfzehn Monate später zieht er die Grenze selbst, und er zieht sie weiter als das Wochenende:

Vibe coding is fine for prototypes and personal tools. (externe Seite, karpathy.bearblog.dev)

Ein persönliches Werkzeug wird benutzt, oft jahrelang. Damit hängt die Frage an zwei Dingen, und das erste ist der Zugriff. Was ein Programm anrichten kann, ergibt sich aus dem, was es erreicht: Dateien, die es löschen darf, Zugangsdaten, die herumliegen, Dienste, die Geld kosten. Das entscheidet sich beim Einrichten, und wie, steht in Kapitel 02.

Das zweite kommt dazu, sobald etwas in Betrieb geht. Dann ist der Code, den niemand gelesen hat, genau der Code, den niemand reparieren kann. Und weil ein Modell flüssig formuliert, sieht ein falsches Ergebnis dabei aus wie ein richtiges. Das ist derselbe Mechanismus wie in Grundkurs, Kapitel 07, nur trifft er hier ein laufendes System statt eines einzelnen Satzes.

Wie weit das schon ist

Bleibt die Frage, ob das eine Randerscheinung ist. Die Antwort steht in Geschäftsberichten und Entwicklerblogs, und sie fällt deutlicher aus, als man erwartet.

WerAnteilWann
Anthropic (externe Seite, anthropic.com)über 80 % der übernommenen ZeilenMai 2026
Spotify (externe Seite, newsroom.spotify.com)über 73 % der Beiträge unterstütztMai 2026
Alphabet (externe Seite, s206.q4cdn.com)rund 50 %, von Agenten geschrieben und von den eigenen Leuten geprüftFebruar 2026

Bei Anthropic lag derselbe Wert Anfang 2025 noch im niedrigen einstelligen Bereich. Ein Team bei OpenAI (externe Seite, openai.com) hat fünf Monate lang ein Produkt gebaut, ohne eine einzige Zeile von Hand zu schreiben.

Drei Vorbehalte gehören in denselben Atemzug.

Die drei Zahlen messen Verschiedenes. Anthropic zählt Zeilen, die in die Produktion übernommen wurden. Spotify sagt „unterstützt“ und meint damit auch den Fall, in dem ein Mensch die Hauptarbeit gemacht hat. Alphabet spricht von Code, den Agenten schreiben und Menschen anschließend durchsehen. Nebeneinandergestellt sehen sie aus wie eine Reihe. Sie sind keine.

Alle vier Firmen verkaufen das Werkzeug, über das sie berichten. Das macht die Zahlen nicht falsch, es macht sie zu Angaben über die eigene Lage. Wie es in einem Betrieb aussieht, dessen Bestand zwanzig Jahre alt ist, misst niemand.

Für die Branche insgesamt gibt es keine solche Zahl. Die großen Erhebungen fragen nach der Nutzung, und die liegt hoch: 90 Prozent der Befragten arbeiten mit KI (externe Seite, cloud.google.com), bei Stack Overflow (externe Seite, survey.stackoverflow.co) sind es 84 Prozent, die es tun oder vorhaben. Wie viel von ihrem Code daher kommt, sagt die Frage nicht.

Was bleibt, ist die Richtung, und die ist eindeutig. Die Höhe der Zahlen hängt davon ab, was man zählt.

Warum dieser Kurs trotzdem so heißt

Er behandelt fast durchgehend das zweite, also die Decke. Der Name steht trotzdem darüber, weil danach gesucht wird und weil unter diesem Wort geführt wird, was in Wirklichkeit beides meint.

Wo es darauf ankommt, steht im Text, welche der beiden Fassungen gemeint ist. Sie werden feststellen: Es ist fast immer die zweite.

Was sich wirklich verschiebt

Die Arbeit verschwindet nicht, sie wandert. Vom Schreiben zum Beschreiben, und vom Suchen des Fehlers zum Erkennen des Fehlers.

Das Beschreiben ist dabei die kleinere Hälfte. Eine Aufgabe an einen Agenten liefert in Minuten ein Ergebnis, das plausibel aussieht. Die Zeit geht danach drauf: prüfen, ob es tut, was es soll; prüfen, ob es nebenbei etwas kaputt gemacht hat; entscheiden, ob der Weg dorthin tragfähig ist oder nur zufällig funktioniert.

Deshalb geht es in diesem Kurs nach dem Werkzeug sofort um das, was daneben steht: was der Agent zu Beginn vorfindet, was er zwischen zwei Sitzungen behält, und was ihn davon abhält, dieselbe Sache dreimal falsch zu machen.

Was es nicht ist

Es ist keine Frage der Programmiersprache und keine des Werkzeugs. Man kann mit demselben Agenten sorgfältig oder nachlässig arbeiten, und das entscheidet sich an der Arbeitsweise.

Es ist auch kein Ersatz für Verständnis. Ob eine Lösung taugt, lässt sich mit einem Agenten daneben genauso wenig beurteilen wie ohne. Ein Agent nimmt die Ausführung ab, und die reicht heute weit: nachschlagen, umbauen über viele Dateien, Tests laufen lassen, Fehlern nachgehen. Bei Ihnen bleibt die Frage, ob das Ergebnis richtig ist.

Quellen

14 Einträge, davon 1 Schlüsselarbeitalle erreichbar

Erreichbarkeit automatisch geprüft

  • SchlüsselarbeitOriginalarbeiterreichbar

    Sequoia Ascent 2026 summary (externe Seite, karpathy.bearblog.dev)

    karpathy.bearblog.devgeprüft 24.09.2026

    Karpathys eigene Zusammenfassung seines Vortrags, veröffentlicht am 30.04.2026. Hier zieht derselbe Mann, der den Begriff Vibe-Coding geprägt hat, funfzehn Monate später die Grenze zu dem, was daneben entstanden ist: Vibe-Coding hebt den Boden, Agentic Engineering die Decke. Die Echtheit ist belegt, karpathy.ai verweist selbst auf diesen Bear-Blog.

  • Originalarbeiterreichbar

    Andrej Karpathy: „There's a new kind of coding I call vibe coding“ (externe Seite, x.com)

    x.comgeprüft 24.09.2026

    Der Beitrag vom 02.02.2025, in dem der Begriff zum ersten Mal fällt. Karpathy beschreibt darin ein Vorgehen, bei dem man den Code nicht mehr liest, und nennt es ausdrücklich für Wegwerfprojekte am Wochenende gedacht.

    Archivfassung (externe Seite, archive.ph)

  • Originalarbeiterreichbar

    The Anthropic Institute, When AI builds itself (externe Seite, anthropic.com)

    anthropic.comgeprüft 24.09.2026

    Anthropic legt offen, welchen Anteil Claude am eigenen Quelltext hat, und liefert im selben Text die Einschränkungen mit. Die Zahl bezieht sich auf Zeilen, die in die Produktion übernommen wurden, die Zuordnung hat nach eigener Angabe Lücken, und der zweite Wert von acht mal so vielen Zeilen je Ingenieur wird als wahrscheinlich zu hoch gegriffen bezeichnet. Die Fußnote nennt daneben eine Schätzung der Führung von 90 Prozent samt Skripten und Versuchen, weshalb dieselbe Firma zum selben Zeitpunkt zwei Zahlen im Umlauf hat.

  • Originalarbeiterreichbar

    Spotify, Rückblick auf den Investor Day 2026 (externe Seite, newsroom.spotify.com)

    newsroom.spotify.comgeprüft 24.09.2026

    Der eigene Bericht über die Investorenveranstaltung vom 21. Mai 2026, in dem Chefarchitekt Niklas Gustavsson zwei Zahlen zur Entwicklung nennt. Das Wort in der Angabe ist wichtiger als der Wert: Von unterstützten Beiträgen ist die Rede, was etwas anderes ist als von der Maschine geschriebener Quelltext. Beim Zitieren fällt der Unterschied regelmäßig weg.

  • Originalarbeiterreichbar

    Alphabet, Transkript der Bilanzvorlage zum vierten Quartal 2025 (externe Seite, s206.q4cdn.com)

    s206.q4cdn.comgeprüft 24.09.2026

    Das offizielle Transkript der Bilanzvorlage vom 4. Februar 2026. Auf eine Frage nach der Kapitaleffizienz antwortet Finanzvorständin Anat Ashkenazi mit einer Zahl zum Quelltext: "About 50% of our codes are written by agents, coding agents, which are then reviewed by our own engineers." Der Zusammenhang zählt mit: Die Angabe fällt als Beleg für Sparsamkeit und war nicht das Thema der Frage, und sie nennt die Prüfung durch Menschen im selben Satz. Zum Vergleich der früheste veröffentlichte Wert: Im Oktober 2024 sprach Sundar Pichai von mehr als einem Viertel.

  • Originalarbeiterreichbar

    OpenAI, Harness engineering: leveraging Codex in an agent-first world (externe Seite, openai.com)

    openai.comgeprüft 24.09.2026

    Ryan Lopopolo berichtet am 11. Februar 2026 über ein Team, das fünf Monate lang ein Produkt gebaut hat, ohne eine Zeile von Hand zu schreiben. Der Wert des Berichts liegt in den Nebenwirkungen, die er offenlegt: Der Agent wiederholt vorhandene Muster einschließlich der schlechten, das Team verbrachte einen Tag der Woche mit Aufräumen, bis es die Regeln maschinell verankerte. Auch das Datum zählt, denn der Begriff Harness stand sechs Tage vorher zum ersten Mal geschrieben.

  • Originalarbeiterreichbar

    DORA, State of AI-assisted Software Development 2025 (externe Seite, cloud.google.com)

    cloud.google.comgeprüft 24.09.2026

    Die Vorstellung der Jahreserhebung von DORA mit knapp 5.000 Befragten aus aller Welt. Sie misst Verbreitung und Vertrauen und dazu die Wirkung auf zwei Größen, die auseinanderlaufen: Der Durchsatz steigt, die Stabilität der Auslieferung sinkt. Die Erklärung dazu benennt genau die Vorkehrungen, um die es in diesem Kursbereich geht, nämlich automatische Tests, gepflegte Versionierung und schnelle Rückmeldung.

  • Datenerreichbar

    Stack Overflow Developer Survey 2025, Abschnitt KI (externe Seite, survey.stackoverflow.co)

    survey.stackoverflow.cogeprüft 24.09.2026

    Die größte offene Befragung unter Entwicklern, hier der Abschnitt zur KI. Sie zeigt zwei Kurven, die in verschiedene Richtungen zeigen: Die Nutzung steigt, das Vertrauen fällt. Die häufigste genannte Schwierigkeit trifft den Kern der Sache, nämlich Ergebnisse, die fast stimmen. Die Erfahrenen sind dabei die Vorsichtigsten, sie haben den niedrigsten Anteil an hohem Vertrauen und den höchsten an ausgeprägtem Misstrauen.

  • Artikelerreichbar

    The Anatomy of an Agent Harness (externe Seite, blog.langchain.com)

    blog.langchain.comgeprüft 24.09.2026

    Vivek Trivedy zieht am 11.03.2026 die Definition nach, die sich durchgesetzt hat: Alles, was nicht das Modell ist, gehört zum Harness. Die Quelle für die Formel, mit der der Begriff heute erklärt wird.

  • Artikelerreichbar

    My AI Adoption Journey (externe Seite, mitchellh.com)

    mitchellh.comgeprüft 24.09.2026

    Mitchell Hashimoto beschreibt am 05.02.2026 seinen Weg zur Arbeit mit Agenten. Der fünfte Abschnitt heißt „Engineer the Harness“ und ist die Stelle, an der das Wort seine heutige Bedeutung bekommt: Der Autor sagt selbst, dass er keinen eingeführten Ausdruck dafür kennt, und vergibt einen. Damit ist die Prägung belegt und zugleich, dass es vorher keinen Namen gab.

  • Originalarbeiterreichbar

    Spotify Engineering, Coding Is No Longer the Constraint (externe Seite, engineering.atspotify.com)

    engineering.atspotify.comgeprüft 24.09.2026

    Der technische Bericht hinter der Investorenzahl, und die interessantere Hälfte davon. Er beziffert, was die gestiegene Geschwindigkeit auf der anderen Seite anrichtet: 76 Prozent mehr Beiträge, die jemand durchsehen muss. Der Titel sagt, wohin sich der Engpass verschoben hat. Genannt wird auch, warum es bei Spotify funktioniert, nämlich jahrelange Vorarbeit an internen Plattformen und Standards.

  • Artikelerreichbar

    Harness Engineering, first thoughts (externe Seite, martinfowler.com)

    martinfowler.comgeprüft 24.09.2026

    Birgitta Böckeler greift den Begriff am 17.02.2026 auf, zwölf Tage nach der Prägung. Die Quelle für die Geschwindigkeit der Übernahme und dafür, dass die Herkunft damals noch offen benannt wurde: Sie führt den Ausdruck auf Hashimoto zurück und merkt an, dass der Beitrag von OpenAI, der ihn im Titel führt, ihn im Text ein einziges Mal verwendet.

  • Originalarbeiterreichbar

    Google Research, AI in software engineering at Google (externe Seite, research.google)

    research.googlegeprüft 24.09.2026

    Der Beitrag, der die Rechnung hinter Googles Prozentangabe offenlegt. Gemessen werden angenommene Zeichen aus der Code-Completion im Verhältnis zu allen neu geschriebenen, und Google selbst nennt das ein grobes Maß. Wer die Zahl neben eine andere stellt, sollte diese Definition kennen: Sie beschreibt Tastenanschläge bei einer Annahmequote von 37 Prozent.

  • Originalarbeiterreichbar

    METR, We are Changing our Developer Productivity Experiment Design (externe Seite, metr.org)

    metr.orggeprüft 24.09.2026

    Der Nachtrag zur vielzitierten Verlangsamungsstudie. METR hat ab August 2025 erneut gemessen, bekam ein umgekehrtes Vorzeichen und erklärt die eigenen Daten für unzuverlässig. Der Grund ist selbst ein Befund über die Verbreitung: Zu viele Beteiligte wollten die Vergleichsaufgaben ohne KI gar nicht mehr bearbeiten, auch für Bezahlung. Wer die Zahl von 19 Prozent aus der ersten Arbeit zitiert, sollte diesen Stand mitzitieren.

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.