Ausgabe 39/2026 · Stand: Mittwoch, 23. September 2026 Das Fachmagazin für KI-Transformation im Mittelstand
Briefing abonnieren
Arbeitshilfe

Das Board-taugliche KI-ROI-Modell: von der Baseline bis zur Entscheidungsseite

Diese Arbeitshilfe führt Sie in fünf Schritten zu einer KI-Wirtschaftlichkeitsrechnung, die eine kritische Nachfrage übersteht. Sie richtet sich an Geschäftsführung, CFO, CIO und die Person, die KI-Vorhaben im Haus verantwortet. Vorwissen zu KI ist nicht nötig. Alle Fachbegriffe werden beim ersten Auftreten erklärt. De

Veröffentlicht · Aktualisiert · 15 Min. Lesezeit
Mitarbeiterin prüft ein Drehteil mit dem Messschieber am Wareneingang, daneben eine Prüfliste.
Fehler, die hier auffallen, kosten am wenigsten. Symbolbild, KI-generiert für KIONIER.

Diese Arbeitshilfe führt Sie in fünf Schritten zu einer KI-Wirtschaftlichkeitsrechnung, die eine kritische Nachfrage übersteht. Sie richtet sich an Geschäftsführung, CFO, CIO und die Person, die KI-Vorhaben im Haus verantwortet. Vorwissen zu KI ist nicht nötig. Alle Fachbegriffe werden beim ersten Auftreten erklärt. Der Zeitbedarf für einen einzelnen Anwendungsfall liegt bei rund 90 Minuten, wenn die Ausgangsdaten vorliegen. Am Ende steht eine einseitige Entscheidungsvorlage, die Sie direkt für die nächste Gremiensitzung ausfüllen können.

Der Bedarf ist real. Nach der McKinsey-Befragung „The State of AI“ (2025) nutzen 88 Prozent der Unternehmen KI in mindestens einer Funktion. Aber nur 39 Prozent berichten überhaupt eine messbare Wirkung auf das Betriebsergebnis. Die Lücke zwischen Nutzung und belegtem Ergebnis ist genau die Lücke, die dieses Werkzeug schließt.

Warum die meisten KI-Rechnungen vor dem Gremium zerfallen

Vier Schwächen tauchen in fast jeder gescheiterten Vorlage auf. Erstens fehlt der Vergleichswert: Eine Verbesserung ohne dokumentierten Ausgangszustand ist eine Behauptung. Zweitens wird jede Verbesserung im Messzeitraum der KI zugeschrieben, obwohl parallel anderes verändert wurde. Drittens wird eingesparte Arbeitszeit direkt in Euro verwandelt, obwohl sie nie im Budget ankommt. Viertens stehen die laufenden Kosten unvollständig in der Rechnung.

Die Folgen sind messbar. Das MIT-Projekt NANDA (2025) fand, dass 95 Prozent der untersuchten GenAI-Pilotprojekte keinen messbaren Beitrag zur Gewinn-und-Verlust-Rechnung leisten. S&P Global Market Intelligence (2025) berichtet, dass 42 Prozent der befragten Unternehmen die Mehrheit ihrer KI-Initiativen abgebrochen haben. Im Vorjahr waren es 17 Prozent. Ein Gremium, das solche Zahlen kennt, prüft jede KI-Vorlage härter als früher. Das ist berechtigt.

Die Haltung dieses Werkzeugs: Eine kleinere Zahl mit offenen Annahmen schlägt eine große Zahl, die bei der ersten Rückfrage kippt.

Schritt 1: Die Baseline, messen, bevor das System läuft

Die Baseline ist der dokumentierte Zustand vor der Einführung. Sie ist der Maßstab, an dem später jede Wirkung gemessen wird. Ohne sie gibt es keinen belegbaren Nutzen, nur ein Gefühl.

Was vor dem Piloten gemessen sein muss, hängt vom Anwendungsfall ab. Typisch sind drei bis fünf Größen: die Bearbeitungszeit je Vorgang, die Fehler- oder Nachbearbeitungsquote, die Kosten je Fehlerfall, das Vorgangsvolumen pro Jahr und der interne Stundensatz. Für jede Größe gelten fünf Anforderungen.

Anforderung Bedeutung Prüffrage des CFO
Vorher erhoben Die Messung stammt aus der Zeit vor dem Systemstart, nicht aus der Erinnerung. „Wann genau wurde das gemessen?“
Eingefroren Wert, Methode, Zeitraum und Stichprobe sind schriftlich fixiert und werden nicht mehr angepasst. „Ist das der ursprüngliche Wert?“
Vergleichbar Später wird dieselbe Vorgangsart bei derselben Gruppe gemessen. „Vergleichen Sie Gleiches mit Gleichem?“
Repräsentativ Der Zeitraum deckt normale Schwankungen ab, mindestens vier Wochen bei stabilen Prozessen. „War das ein typischer Monat?“
Systemgestützt Die Quelle ist ein Zeiterfassungs-, Ticket- oder Buchungssystem, nicht allein die Selbstauskunft. „Woher kommt die Zahl?“

Fehlt die Baseline, gibt es nur eine ehrliche Aussage vor dem Gremium: „Die Wirkung ist noch nicht belegbar, die Ausgangsmessung läuft.“ Das kostet eine Sitzung Geduld. Eine nachträglich geschätzte Baseline kostet die Glaubwürdigkeit des ganzen Programms.

Schritt 2: Wirkungszuordnung, welcher Anteil gehört der KI

Nicht jede Verbesserung im Messzeitraum stammt aus dem KI-System. Parallel laufen oft Prozessänderungen, neue Vorlagen, Personalwechsel oder Preisrunden. Die Wirkungszuordnung (Attribution) trennt den KI-Anteil vom Rest. Zwei Stellgrößen leisten das.

Der Zurechnungsanteil beziffert, welcher Teil des gemessenen Effekts plausibel der KI gehört. Wer im selben Quartal auch den Freigabeprozess umgebaut hat, darf nicht 100 Prozent ansetzen. Üblich sind Werte zwischen 0,6 und 0,9, konservativ gewählt und schriftlich begründet.

Die Umsetzungsquote beziffert, welcher Teil eines gemessenen Effekts tatsächlich im Ergebnis ankommt. Das betrifft vor allem Zeiteffekte. Eingesparte Stunden werden erst zu Geld, wenn die frei gewordene Kapazität abgebaut, umgewidmet oder in zusätzlichen Output verwandelt wird. Geschieht das nicht, versickert die Ersparnis in kleineren Pausen und längeren Abstimmungen.

Die Formel für den anrechenbaren Nutzen einer Wirkung lautet:

anrechenbarer Nutzen = gemessener Bruttoeffekt
× Zurechnungsanteil (0 bis 1)
× Umsetzungsquote (0 bis 1)

Wie belastbar der Bruttoeffekt selbst ist, bestimmt die Vergleichsmethode:

Methode Vorgehen Belastbarkeit
Kontrollgruppe Eine vergleichbare Gruppe arbeitet im selben Zeitraum ohne KI weiter. hoch
Gestaffelte Einführung Bereiche starten zeitversetzt; die Differenz der Verläufe isoliert den Effekt. hoch bis mittel
Vorher-Nachher, bereinigt Dieselbe Einheit wird vor und nach dem Start gemessen, bekannte Störfaktoren werden herausgerechnet. mittel
Branchen-Vergleichswert Der eigene Prozess wird gegen einen externen Referenzwert gestellt. niedrig

Für Umsatzaussagen sollte eine Kontrollgruppe vorliegen. Für Kosten- und Qualitätsaussagen reicht meist ein bereinigter Vorher-Nachher-Vergleich. Ein bloßer Branchenvergleich trägt keine Euro-Zahl in einer Entscheidungsvorlage.

Schritt 3: Die fünf Ergebnistreiber

Jeder KI-Nutzen wirkt über einen von fünf Kanälen auf das Unternehmensergebnis. Wer die Kanäle sauber trennt, verhindert Doppelzählung und kann jede Zahl einer Zeile in der Ergebnisrechnung zuordnen.

Treiber Messgröße (Beispiele) Typische Falle
Umsatz Abschlussquote, Wiederkaufrate, Umsatz je Kunde gegen Kontrollgruppe Marktzyklen und Preisänderungen werden der KI zugeschrieben; ohne Kontrollgruppe nicht belastbar.
Kosten Gekündigte Lizenz oder Dienstleistung, vermiedene externe Ausgabe, vermiedene Nachbesetzung in Euro Nur geplante, nie realisierte Einsparungen werden gebucht; „hätte gekostet“ ist kein Beleg.
Qualität und Risiko Fehler- oder Nachbearbeitungsquote, Reklamationsquote, erwarteter Schaden aus Vorfällen Ein gefühltes „weniger Fehler“ ohne Stichprobenmessung; Risikominderung als harte Euro-Zahl verkauft.
Durchlaufzeit Zeit von Eingang bis Abschluss eines Vorgangs, Liegezeiten Schnellere Teilschritte ohne Wirkung auf den Engpass; der Gesamtdurchlauf bleibt gleich.
Kapazität Bearbeitungszeit je Vorgang, Vorgänge je Vollzeitkraft Eingesparte Minuten werden zu 100 Prozent monetarisiert, obwohl keine Kapazitätsentscheidung folgt.

Drei Hinweise zur Härte dieser Treiber. Kostensenkungen sind am härtesten, wenn eine konkrete Ausgabe wegfällt. Kapazitäts- und Qualitätseffekte sind messbar, brauchen aber Zurechnungsanteil und Umsetzungsquote. Umsatz- und Risikoeffekte sind am weichsten. Sie gehören in die Vorlage, aber getrennt ausgewiesen und nicht in der Kernzahl.

Eine Regel gegen Doppelzählung: Dieselbe frei gewordene Stunde darf nur einmal Geld werden. Wer eine vermiedene Nachbesetzung als Kostennutzen bucht, muss genau diese Stunden aus dem Kapazitätsnutzen streichen.

Schritt 4: Amortisationsdauer und Barwert, die zwei Zahlen für die Entscheidung

Ein Gremium braucht zwei Kennzahlen, beide in einem Satz erklärbar.

Die Amortisationsdauer beantwortet: Nach wie vielen Monaten haben die Nettoerträge die einmaligen Kosten zurückverdient? Gerechnet wird mit dem Nettonutzen des ersten Jahres. Wichtig ist der Anlauffaktor: Im ersten Jahr entfaltet sich der Nutzen erst über Monate, die laufenden Kosten fallen aber ab dem ersten Tag voll an. Wer das erste Jahr wie ein Vollnutzen-Jahr rechnet, schönt die Amortisation systematisch.

Der Barwert (auch Kapitalwert) beantwortet: Was ist das Vorhaben über die Laufzeit heute wert, wenn künftige Beträge abgezinst werden? Abzinsen heißt: Ein Euro in zwei Jahren zählt heute weniger als ein Euro sofort, weil Kapital Kosten hat. Der Abzinsungssatz kommt aus dem Controlling; im Mittelstand sind 7 bis 10 Prozent üblich. Ein positiver Barwert bedeutet: Das Vorhaben verdient seine Kapitalkosten und mehr.

„`
Nettonutzen pro Jahr = anrechenbarer Nutzen aller Treiber − laufende Vollkosten

Nettonutzen Jahr 1 = Anlauffaktor × anrechenbarer Nutzen − volle laufende Kosten

Amortisation = Monate, bis die kumulierten Nettonutzen
die Einmalkosten decken

Barwert über 3 Jahre = − Einmalkosten
+ Nettonutzen Jahr 1 / (1 + Zins)
+ Nettonutzen Jahr 2 / (1 + Zins)²
+ Nettonutzen Jahr 3 / (1 + Zins)³
„`

Zu den laufenden Vollkosten zählen Lizenzen und Modellnutzung, Pflege und Überwachung des Systems, die regelmäßige Qualitätsprüfung sowie Dokumentations- und Prüfaufwand. Genau diese Blöcke fehlen in geschönten Rechnungen am häufigsten. Deloitte (2024) berichtet, dass über 40 Prozent der befragten Organisationen Schwierigkeiten haben, die Wirkung ihrer GenAI-Initiativen überhaupt zu definieren und zu messen. Wer die Kostenseite vollständig führt, gehört bereits zur Minderheit.

Schritt 5: Bandbreiten statt Punktwert

Jede KI-Rechnung enthält Annahmen. Zurechnungsanteil, Umsetzungsquote und laufende Kosten sind Schätzungen, keine Messwerte. Ein einzelner Punktwert täuscht deshalb Genauigkeit vor. Die Lösung ist eine Bandbreite mit drei Fällen.

Fall Logik Annahmen-Wahl
Vorsichtig Alle unsicheren Annahmen zugleich ungünstig; die belastbare Untergrenze. niedriger Zurechnungsanteil, niedrige Umsetzungsquote, hohe laufende Kosten, Anlauffaktor aktiv
Erwartet Die begründete mittlere Schätzung; die Kernzahl der Vorlage. konservative Mittelwerte, Anlauffaktor aktiv
Optimistisch Alle Annahmen zugleich günstig; die Obergrenze, kein Erwartungswert. hohe Zurechnung, hohe Umsetzung, niedrige Kosten, kein Anlauf

Zwei Regeln dazu. Erstens: Nur die unsicheren Annahmen werden variiert, die gemessenen Größen bleiben konstant. Zweitens: Ein vorsichtiger Fall, der negativ wird, ist kein Makel. Er zeigt dem Gremium ehrlich, unter welchen Bedingungen das Vorhaben nicht trägt und welche Annahme deshalb zuerst nachgemessen werden muss.

Die Modellrechnung: ein typisierter Anwendungsfall

Das folgende Beispiel ist eine typisierte Modellrechnung. Das Unternehmen ist fiktiv; die Größenordnungen folgen üblichen Mustern im DACH-Mittelstand. Alle Euro-Werte dienen der Illustration der Methode und sind keine Ergebniszusage.

Ausgangslage: Ein Hersteller elektrotechnischer Komponenten mit rund 900 Beschäftigten führt ein KI-System zur Verarbeitung von Eingangsrechnungen und Lieferantendokumenten ein. Das System liest Belege aus, ordnet sie zu und schlägt Buchungen vor. Eine Fachkraft prüft und gibt frei.

Baseline (vor dem Start eingefroren, über acht Wochen erhoben):

Größe Wert Quelle
Eingangsrechnungen pro Jahr 24.000 Buchhaltungssystem, Vollerhebung
Bearbeitungszeit je Rechnung 11 Minuten Zeiterfassung, Stichprobe 400 Belege
Nachbearbeitungsquote (Klärfälle) 4,5 Prozent Ticketsystem, Vollerhebung
Kosten je Klärfall 85 Euro Prozesskostenrechnung Controlling
Interner Vollkostensatz 52 Euro je Stunde Controlling

Messung nach sechs Monaten Betrieb (bereinigter Vorher-Nachher-Vergleich): Die Bearbeitungszeit sinkt auf 5 Minuten je Rechnung. Die Nachbearbeitungsquote sinkt auf 2,0 Prozent. Parallel wurde der Freigabe-Workflow vereinfacht; deshalb wird ein Zurechnungsanteil von 0,75 angesetzt.

Nutzen je Treiber (erwarteter Fall):

Kapazität: 24.000 Rechnungen × 6 Minuten Ersparnis = 144.000 Minuten = 2.400 Stunden. Brutto 2.400 × 52 Euro = 124.800 Euro pro Jahr. Die Umsetzungsquote wird mit 0,5 angesetzt, weil erst die Hälfte der Kapazität nachweislich umgewidmet ist. Anrechenbar: 124.800 × 0,75 × 0,5 = 46.800 Euro.

Qualität: 24.000 × (0,045 − 0,020) × 85 Euro = 51.000 Euro brutto pro Jahr. Umsetzungsquote 0,7, weil ein Teil der Klärarbeit sich verlagert statt zu entfallen. Anrechenbar: 51.000 × 0,75 × 0,7 = 26.775 Euro.

Kosten: Ein externer Erfassungsdienstleister wurde zum Jahresende gekündigt. Das ist kassenwirksam und voll anrechenbar: 18.000 Euro pro Jahr.

Umsatz und Durchlaufzeit: Die schnellere Freigabe verbessert die Skontoausnutzung vermutlich. Ohne Kontrollgruppe bleibt dieser Effekt qualitativ ausgewiesen und außerhalb der Kernzahl.

Anrechenbarer Gesamtnutzen: 46.800 + 26.775 + 18.000 = 91.575 Euro pro Jahr.

Kosten:

Block Betrag
Einmalig: Aufbau und Anpassung 30.000 Euro
Einmalig: Integration ins Buchhaltungssystem 8.000 Euro
Einmalig: Schulung und Prozessumstellung 4.000 Euro
Einmalkosten gesamt 42.000 Euro
Laufend: Lizenzen und Modellnutzung 14.000 Euro/Jahr
Laufend: Pflege, Überwachung, Qualitätsprüfung 16.000 Euro/Jahr
Laufend: Dokumentation und interne Prüfung 6.000 Euro/Jahr
Laufende Kosten gesamt 36.000 Euro/Jahr

Kennzahlen (erwarteter Fall, Abzinsungssatz 8 Prozent, Anlauffaktor 0,6 im ersten Jahr):

„`
Nettonutzen voll (Jahr 2 und 3) = 91.575 − 36.000 = rund 55.600 Euro/Jahr

Nettonutzen Jahr 1 = 0,6 × 91.575 − 36.000 = rund 19.000 Euro
(der Anlauffaktor senkt nur den Nutzen; die laufenden
Kosten fallen ab dem ersten Tag voll an)

Amortisation: nach Jahr 1 sind 42.000 − 18.945 = 23.055 Euro
offen; bei 55.575 / 12 = 4.631 Euro je Folgemonat sind das
rund 5 weitere Monate = rund 17 Monate

Barwert über 3 Jahre
= −42.000 + 18.945/1,08 + 55.575/1,08² + 55.575/1,08³
= −42.000 + 17.542 + 47.647 + 44.117 = rund 67.000 Euro
„`

Bandbreite (nur die unsicheren Annahmen variiert):

Größe Vorsichtig Erwartet Optimistisch
Zurechnungsanteil 0,60 0,75 0,85
Umsetzungsquote Kapazität 0,30 0,50 0,70
Umsetzungsquote Qualität 0,50 0,70 0,85
Laufende Kosten pro Jahr 44.000 Euro 36.000 Euro 32.000 Euro
Anlauffaktor Jahr 1 0,6 0,6 1,0 (kein Anlauf)
Nettonutzen voll pro Jahr rund 11.800 Euro rund 55.600 Euro rund 97.100 Euro
Amortisation nicht in 3 Jahren rund 17 Monate rund 5 Monate
Barwert 3 Jahre (8 %) rund −32.000 Euro rund 67.000 Euro rund 208.000 Euro

Die Lesart für das Gremium: Der erwartete und der optimistische Fall tragen klar. Der vorsichtige Fall kippt ins Negative, wenn Zurechnung, Umwidmung und Kosten zugleich ungünstig laufen. Die wichtigste Steuerungsaufgabe ist deshalb, die Umsetzungsquote der Kapazität früh mit einer Zeiterfassung zu belegen. Genau diese eine Nachmessung entscheidet, ob der Fall Richtung erwartet oder Richtung vorsichtig läuft.

Die Board-Entscheidungsseite: eine Seite, elf Felder

Das Ergebnis aller fünf Schritte passt auf eine Seite. Mehr sollte ein Gremium pro Anwendungsfall nicht lesen müssen. Die Vorlage:

Feld Ihr Eintrag
1. Vorhaben Anwendungsfall in einem Satz, betroffener Bereich, Vorgangsvolumen pro Jahr
2. Status Pilot, kontrollierter Betrieb oder Skalierung, mit Startdatum
3. Baseline Kerngrößen mit Wert, Erhebungszeitraum, Stichprobe und Quelle
4. Vergleichsmethode Kontrollgruppe, gestaffelte Einführung oder bereinigter Vorher-Nachher-Vergleich
5. Nettonutzen pro Jahr erwarteter Fall, mit Bandbreite vorsichtig bis optimistisch
6. Amortisationsdauer in Monaten, mit Anlauffaktor gerechnet
7. Barwert über 3 Jahre mit genanntem Abzinsungssatz
8. Tragende Annahmen Zurechnungsanteil und Umsetzungsquoten mit Ein-Satz-Begründung
9. Top-3-Risiken und Gegenmaßnahmen je Risiko eine Maßnahme mit Termin
10. Beantragte Entscheidung konkret: Freigabe, Budget, Stopp oder Nachmessung
11. Nächster Messtermin Datum, an dem die kritischste Annahme nachgemessen wird

Zwei Ausfüllregeln. Ist eine Zahl unsicher, tragen Sie die Bandbreite ein, keinen erfundenen Punktwert. Und Feld 10 enthält genau eine Entscheidung. Eine Vorlage, die drei Beschlüsse zugleich will, bekommt oft keinen.

Die häufigsten ROI-Selbsttäuschungen

Gefühlte Zeitersparnis. Selbsteinschätzungen zu KI-Produktivität sind systematisch verzerrt. Eine randomisierte Studie von METR (2025) mit erfahrenen Softwareentwicklern zeigt das drastisch: Mit KI-Werkzeugen brauchten die Teilnehmer 19 Prozent länger für ihre Aufgaben. Sie selbst glaubten hinterher, 20 Prozent schneller gewesen zu sein. Wer Nutzen per Umfrage erhebt, misst Stimmung, nicht Wirkung. Nur Zeiterfassung oder Systemdaten tragen eine Euro-Zahl.

Zeitersparnis ohne Ergebniswirkung. Selbst echte Zeitgewinne kommen nicht automatisch im Ergebnis an. Die NBER-Studie von Humlum und Vestergaard (2025) verknüpfte Befragungen von rund 25.000 Beschäftigten in Dänemark mit amtlichen Lohndaten. Ergebnis: durchschnittlich rund 2,8 Prozent Zeitersparnis durch KI-Chatbots, aber keine messbare Wirkung auf Löhne oder Arbeitsstunden. Effekte über 2 Prozent konnten die Autoren statistisch ausschließen. Ohne bewusste Kapazitätsentscheidung bleibt Zeitersparnis ein Buchwert.

Pilot-Verzerrung. Piloten laufen unter Idealbedingungen: motivierte Freiwillige, ausgewählte einfache Fälle, intensive Betreuung durch das Projektteam. Der Skalenbetrieb hat nichts davon. Deloitte (2024) zufolge erwarten über zwei Drittel der befragten Organisationen, dass höchstens 30 Prozent ihrer GenAI-Experimente zeitnah in den vollen Betrieb kommen. Rechnen Sie Pilotwerte deshalb nie ungeprüft hoch. Der Anlauffaktor und eine Nachmessung im Regelbetrieb sind Pflicht.

Doppelzählung. Dieselbe eingesparte Stunde taucht als Kapazitätsnutzen und zugleich als vermiedene Neueinstellung auf. Eine der beiden Buchungen muss gestrichen werden.

Unvollständige Kostenseite. Pflege, Qualitätsprüfung, Dokumentation und interne Audits fehlen in der Rechnung. Gartner (2024) nennt eskalierende Kosten neben unklarem Geschäftswert als Hauptgrund dafür, dass mindestens 30 Prozent der GenAI-Projekte nach der Konzeptphase abgebrochen werden.

Rückwirkend geschätzte Baseline. Nach dem Start wird der Vorher-Zustand aus dem Gedächtnis rekonstruiert, meist zu ungunsten des alten Prozesses. Eine solche Rechnung ist wertlos. Dann lieber ehrlich neu messen.

Grenzen dieses Werkzeugs

Dieses Modell ersetzt keine testierte Wirtschaftlichkeitsrechnung und keine Freigabe durch Ihr Controlling. Es strukturiert die Rechnung, es prüft sie nicht. Für Vorhaben mit hohem Investitionsvolumen oder bilanzieller Wirkung gehört die Rechnung in die Hände der Finanzfunktion.

Das Modell bewertet einen einzelnen Anwendungsfall. Es beantwortet nicht, welcher von mehreren Fällen zuerst gebaut werden sollte; dafür braucht es eine Portfolio-Priorisierung. Es bewertet auch keine strategischen Optionen ohne bezifferbaren Prozessbezug, etwa den Aufbau interner KI-Kompetenz. Solche Vorhaben brauchen eine andere Begründungslogik als eine Amortisationsrechnung.

Die Bandbreitenlogik fängt Annahmeunsicherheit ab, keine Strukturbrüche. Wenn sich Modellpreise, Rechtslage oder das Prozessvolumen grundlegend ändern, muss neu gerechnet werden. Und schließlich: Alle Zahlen der Modellrechnung sind typisierte Illustrationen. Ihre eigenen Werte können erheblich abweichen. Belastbar wird die Rechnung erst mit Ihrer eigenen, eingefrorenen Baseline.

Quellen und Methodik

Die Methodik dieser Arbeitshilfe verbindet klassische Investitionsrechnung (Amortisation, Kapitalwert) mit Attributions- und Messlogik aus der empirischen Wirkungsforschung. Die genannten Studienzahlen wurden im Juli 2026 gegen die Originalquellen geprüft.

  1. McKinsey & Company: „The State of AI“ (Global Survey, November 2025). 88 Prozent der Organisationen nutzen KI in mindestens einer Funktion; 39 Prozent berichten eine Wirkung auf das Betriebsergebnis (EBIT), meist unter 5 Prozent. https://www.mckinsey.com/capabilities/quantumblack/our-insights/the-state-of-ai
  2. MIT Project NANDA: „The GenAI Divide: State of AI in Business 2025“ (Juli 2025). 95 Prozent der untersuchten GenAI-Piloten ohne messbare Wirkung auf die Gewinn-und-Verlust-Rechnung; nur 5 Prozent der maßgeschneiderten Unternehmenslösungen erreichen den Produktivbetrieb.
  3. Humlum, A. / Vestergaard, E.: „Still Waters, Rapid Currents: Early Labor Market Transformation under Generative AI“, NBER Working Paper 33777 (2025). Durchschnittlich rund 2,8 Prozent Zeitersparnis je Nutzer; präzise Nulleffekte auf Löhne und Stunden, Effekte über 2 Prozent ausgeschlossen. https://www.nber.org/papers/w33777
  4. METR: „Measuring the Impact of Early-2025 AI on Experienced Open-Source Developer Productivity“ (2025). Randomisierte Studie, 16 erfahrene Entwickler, 246 Aufgaben: 19 Prozent längere Bearbeitungszeit mit KI bei zugleich wahrgenommener Beschleunigung von 20 Prozent. https://metr.org/blog/2025-07-10-early-2025-ai-experienced-os-dev-study/
  5. Gartner: Pressemitteilung vom 29. Juli 2024. Mindestens 30 Prozent der GenAI-Projekte werden bis Ende 2025 nach der Konzeptphase abgebrochen; Gründe: Datenqualität, Risikokontrollen, eskalierende Kosten, unklarer Geschäftswert.
  6. S&P Global Market Intelligence: „Voice of the Enterprise: AI & Machine Learning 2025“ (2025, 1.006 Befragte in Nordamerika und Europa). 42 Prozent der Unternehmen haben die Mehrheit ihrer KI-Initiativen abgebrochen (Vorjahr: 17 Prozent); im Schnitt scheitern 46 Prozent der Konzepttests vor dem Produktivgang.
  7. Deloitte: „The State of Generative AI in the Enterprise“ (Q4 2024, 2.800 Befragte). Über zwei Drittel erwarten, dass höchstens 30 Prozent ihrer Experimente zeitnah skaliert werden; über 40 Prozent haben Schwierigkeiten, die Wirkung ihrer Initiativen zu definieren und zu messen.

Passende Vertiefung im Journal

  • „Wirtschaftlichkeit von KI belastbar steuern“, der übergeordnete Steuerungsrahmen, in den dieses ROI-Modell eingebettet ist.
  • „KI-Business-Case unter Unsicherheit: Base, Downside und Abbruchkriterien“, vertieft die Bandbreitenlogik und ergänzt Abbruchkriterien.
  • „Der tatsächliche KI-TCO: 24 Kostenpositionen“, die vollständige Kostenseite, die in Schritt 4 zusammengefasst ist.
  • „Von Zeitersparnis zu Ergebnisbeitrag“, vertieft den Weg von der eingesparten Stunde zur Ergebniswirkung.
  • „Pilot fortführen, neu aufsetzen oder stoppen“, die Entscheidungslogik, wenn die Nachmessung den erwarteten Fall nicht bestätigt.

Das Entscheider-Briefing

Ein Briefing pro Woche: Entscheidungsfragen, eingeordnete Zahlen und Fristen. Ihre Adresse geben wir nicht weiter.

Sie erhalten zuerst eine E-Mail mit einem Bestätigungslink. Erst nach dem Klick nehmen wir Sie auf. Abmeldung mit einem Klick in jeder Ausgabe.

Weiterführend im Themenfeld