Der Markin ROI Report für Enterprise Growth TeamsJetzt lesen
MARKIN
Markin Research, erste Auflage2026

Der ROI von Growth Agents 2026

Was agentifying growth tatsächlich erbringt und wie man es beweist

Agentifying growth bedeutet, den gesamten Kreislauf unter die Kontrolle von Agents zu stellen: das Signal lesen, die Hypothese formulieren, die Aktion wählen, das Experiment durchführen und das Ergebnis lesen. Der Ertrag daraus ist nicht der uplift, den es meldet. Es ist der uplift, der einen randomisierten holdout überlebt, abzüglich der Marge, die zur Erzeugung aufgewendet wurde. Fast niemand misst diese Zahl, weshalb fast niemand sein growth-Budget zweimal verteidigen kann.

Titelseite des Markin ROI of Growth Agents 2026 Berichts

Methode

6 Erkenntnisse

Jeder basiert auf unabhängiger, benannter Forschung und nicht auf unserer eigenen Telemetrie.

23 Quellen

Peer-reviewed economics, Beratungsforschung, Sektordaten und Regierungsstatistiken.

2014–2026

Veröffentlichungsfenster der überprüften Beweise, mit Schwerpunkt auf 2025 und 2026.

0 aggregierte Ansprüche

Wir veröffentlichen keine branchenweiten uplift Zahlen, weil wir keine finden konnten, die wir verteidigen würden.

Was dieser Bericht nicht beansprucht

  • Dass agentic growth unvermeidlich ist, oder dass jede Basis den gleichen Spielraum hat.
  • Jeder uplift-Benchmark, der über die gesamte Branche gemittelt wird. Die glaubwürdige Zahl ist die, die dein eigener holdout produziert.
  • Dass von Anbietern in Auftrag gegebene ROI-Studien ein Beweis für incrementality sind. Sie sind ein Beweis für Wertpotenzial, und wir kennzeichnen sie entsprechend.

Die einzige uplift-Zahl, die wir über uns selbst nennen, ist ein Bereich, der bei behandelten Kohorten gegenüber einem randomisierten holdout gemessen wurde: +17–35% ARPU against holdout. Es ist keine Prognose, und es ist nicht die Zahl, die du in deinen eigenen Business Case aufnehmen solltest. Dein eigener holdout ist es.

01

Die Ausgaben für Enterprise AI sind skaliert. Der nachgewiesene ROI nicht.

Die Lücke zwischen Adoption und messbarem Impact ist heute die bestimmende Tatsache der Unternehmens-KI, und im growth Bereich ist sie am sichtbarsten.

Zwei unabhängige Einschätzungen der Unternehmenslandschaft 2025 stimmen hinsichtlich des Problems überein. Die Bereitstellung ist nahezu universell, die Wertschöpfung konzentriert sich auf eine kleine Minderheit, und die Mehrheit der Programme kann keine Zahl vorweisen, die die eigene Finanzabteilung akzeptieren würde. Dies ist kein Technologieversagen. Nichts im Stack hindert ein growth Team daran, den inkrementellen Deckungsbeitrag zu messen. Was es verhindert, ist, dass niemand das Programm so konzipiert hat, dass es vor dem Start messbar ist.

growth ist der akute Fall, weil das Gegenfaktum teuer zu erhalten ist. Fünf Prozent einer Basis aus dem holdout zu nehmen, fühlt sich an, als würde man Umsatz liegen lassen, daher ist es das erste, was gekürzt wird, wenn ein Starttermin verschoben wird. Zwölf Monate später hat das Programm viel Aktivität, ein dashboard, das nach oben und rechts geht, und keine haltbare Antwort auf die einzige Frage, die zählt, produziert.

ROI-Betrachtung

Schreibe vor der nächsten Genehmigung die einzige Zahl auf, nach der das Programm in zwölf Monaten beurteilt wird, und den Mechanismus, der sie erzeugen wird. Wenn dieser Mechanismus ein Dashboard-Vergleich und keine Kontrollgruppe ist, existiert die Zahl noch nicht. Entscheide dich jetzt, solange die Änderung des Designs noch günstig ist.

02

Standardmessungen können den uplift nicht von der Kannibalisierung trennen.

Das ist keine Nuance für Analysten. Es ist der Grund, warum growth Budgets von der Finanzabteilung gekürzt werden, und die Kürzung ist rational.

Attribution beantwortet eine Frage, die niemand gestellt hat: welcher Touchpoint der Konversion am nächsten war. Sie kann nicht zwischen einem Kunden unterscheiden, der aufgrund der Nachricht gehandelt hat, und einem Kunden, der ohnehin handeln wollte und zufällig eine Nachricht erhalten hat. In einer großen installierten Basis ist die zweite Gruppe die Mehrheit, weshalb der zugeschriebene Umsatz routinemäßig den Gesamtumsatz übersteigt, sobald die Kanäle addiert werden.

Die wissenschaftliche Literatur ist hier ungewöhnlich deutlich. Über fünfundzwanzig große Feldexperimente hinweg betrug das Median-Konfidenzintervall für den ROI von Werbung mehr als einhundert Prozentpunkte: Selbst mit Millionen von Probanden und realem Geldeinsatz war die gemessene Rendite häufig nicht von Null zu unterscheiden. Ein separates groß angelegtes Experiment ergab, dass das Abschalten bezahlter Brand-Term-Suchen keine statistisch signifikanten Auswirkungen auf neue oder seltene Käufer hatte, deren Verhalten die Attribution seit Jahren dem Kanal zugeschrieben hatte.

Die praktischen Konsequenzen sind gravierend und spezifisch. Ein Programm, das auf Attribution optimiert ist, driftet zu den Kunden, die zum Zeitpunkt des Kaufs am einfachsten zu erreichen sind, was genau die Bevölkerung ist, bei der die Intervention am wenigsten notwendig war. Die dort ausgegebene Marge ist keine growth Investition. Es ist ein Rabatt.

ROI-Betrachtung

Nimm die letzte uplift-Zahl, die dein Team gemeldet hat, und stelle dazu drei Fragen: War die Kontrollgruppe vor dem Start randomisiert, betrug das Zeitfenster mindestens acht Wochen und wurde die Anreizmarge verrechnet? Wenn eine Antwort „Nein“ ist, ist die Zahl eine Beschreibung von Aktivität, keine Messung der Rendite.

03

Personalisierungsprogramme werden mangels Beweis aufgegeben, nicht mangels Technologie.

Die Prognose, dass achtzig Prozent der investierenden Vermarkter bis 2025 aufgeben würden, bezog sich nicht auf Tools. Sie bezog sich auf die Unfähigkeit, eine Rendite nachzuweisen.

Gartners Vorhersage ist zu einer Beschreibung geworden. Den Teams, die sich zurückgezogen haben, fehlte keine platform: Die meisten hatten zwei gekauft. Was ihnen fehlte, war eine Möglichkeit zu zeigen, dass das Programm Umsatz generierte, den das Unternehmen sonst nicht erzielt hätte, und ohne diesen Nachweis verliert die Budgetposition jedes Argument, in das sie eintritt.

Das Gegengewicht ist, dass der Wert real ist, wo er erfasst wird. Kunden erwarten Relevanz und bestrafen deren Fehlen, und die Unternehmen, die dies operationalisieren, wachsen schneller als ihre Mitbewerber. Beides ist gleichzeitig wahr: Der Wertepool existiert, und die meisten Versuche, ihn zu erreichen, scheitern eher an der Messung als an der Modellierung.

Die ehrliche Lesart ist, dass Personalisierung als Technologiekauf verkauft wurde, obwohl es sich um eine Änderung des Betriebsmodells handelt. Die Technologie kam pünktlich an. Die Messdisziplin, die Unterdrückungsregeln und die Bereitschaft, ein verlorenes Programm einzustellen, nicht.

ROI-Betrachtung

Prüfe deinen eigenen Stack auf das Abandonment-Muster, bevor es dich erreicht: zähle die heute aktiven Personalisierungs-Anwendungsfälle, dann zähle diejenigen mit einer Kontrollgruppe. Wenn die zweite Zahl Null ist, ist das Programm nur einen Budgetzyklus von der Einstellung entfernt, unabhängig davon, wie gut es abschneidet.

04

Die Teams, die am härtesten messen, sind die Teams, die am schnellsten wachsen.

Rigour ist keine Steuer auf growth. In der verfügbaren Forschung ist es der stärkste beobachtbare Korrelat dafür.

Die Messarbeit von BCG zeigt, dass Organisationen mit ausgereifter incrementality-Praxis ein wesentlich höheres Umsatzwachstum als ihre Mitbewerber aufweisen. Die kausale Geschichte ist nicht mysteriös. Ein Team, das einen echten Effekt von einem Zufall unterscheiden kann, finanziert die Zufälle nicht mehr, und das freigegebene Budget potenziert sich in den Programmen, die funktionieren.

Dieselbe Forschung warnt vor den Fehlermodi, die schwache Messungen stark erscheinen lassen: Neuheitseffekte, die die ersten Wochen jedes neuen Programms aufblähen, Halo- und Pull-Forward-Effekte, die Umsatz aus dem nächsten Quartal vorwegnehmen, und Kontamination zwischen überlappenden Experimenten. Jede dieser Verzerrungen geht in dieselbe Richtung, weshalb unkontrollierte Programme fast nie nach unten korrigiert werden.

Das ist das Argument, das du in ein Budget-Meeting mitnehmen solltest. Nicht, dass die Obergrenze höher ist, als die Finanzabteilung glaubt, sondern dass der Grundwert bekannt ist, und dass dieses Wissen einen Pilotversuch in ein operatives Modell verwandelt.

ROI-Betrachtung

Institutionalisiere eine einzige Kennzahl statt eines scorecard: inkrementelle Bruttomarge pro kontaktiertem Kunden, gegen holdout, monatlich gelesen. Jede andere growth metric ist diagnostisch. Diese entscheidet, ob das Programm fortgesetzt wird.

05

Die Akquisition deckt das Leck nicht mehr. Die installierte Basis ist der Ort des growth.

Zwei der größten Abonnementkategorien der Welt überschritten 2025 die gleiche Schwelle: Die Kosten für einen neuen Kunden übersteigen nun das, was die Basis ohne Intervention verliert.

Das growth bei Premium-Streaming-Abonnenten hat sich in einem einzigen Jahr halbiert, und die Kommentare des Sektors haben sich von Akquise auf Retention-Architektur und unit economics verlagert. Telekommunikation zeigt denselben Druck aus der anderen Richtung: Rund ein Drittel der Kunden weltweit erwägt aktiv einen Wechsel, eine Rate, die kein Akquisitionsbudget übertreffen kann.

Wenn die Akquisition aufhört, der Hebel zu sein, wird die Ökonomie der Basis zum ganzen Spiel, und sie wird von vier Fragen bestimmt, die millionenfach pro Monat gestellt werden. Wer ist es wert, kontaktiert zu werden, worüber, wann und zu welchen Kosten. Das ist ein decisioning Problem, kein Kampagnenproblem, und seine Lösung ist der Ursprung des inkrementellen ARPU.

Der Zinseszins ist wichtiger als jeder einzelne Hebel. Ein aktivierter Kunde fördert cross-sell; ein gebundener Kunde mit hohem ARPU versorgt beide jahrelang; ein unterdrückter unnötiger Rabatt bringt Marge zurück, ohne eine einzige zusätzliche Nachricht zu senden. Business Cases, die auf einem einzigen Hebel basieren, sind gerade deshalb anfällig, weil diese Effekte multiplikativ sind.

ROI-Betrachtung

Teile deinen growth Plan in Akquisitions- und Basiskennzahlen auf und bewerte sie auf derselben Basis: die vollumfänglichen Kosten pro inkrementellen Bruttomargen-Euro. In den meisten großen B2C-Basen gewinnt die zweite Spalte mit einem Abstand, den niemand zu quantifizieren gewagt hat.

06

Die Beschränkung liegt nicht im Kampagnenvolumen. Sie liegt darin, wie viele Entscheidungen ein Team verteidigen kann.

Die tatsächliche Kapazität eines growth-Teams ist die Anzahl der Hypothesen, die es pro Jahr generieren, ehrlich testen und abschließen kann. Diese Zahl ist klein und teuer.

Bewerte die Einschränkung richtig. Ein erfahrener data scientist kostet voll ausgelastet weit über sechsstellig, und der Marktpreis für die kausalen Inferenzfähigkeiten, die diese Arbeit erfordert, liegt über dem veröffentlichten Median. Das Ergebnis dieser Person sind keine Dashboards: Es ist eine begrenzte Anzahl gut durchdachter A/B tests pro Jahr, von denen die meisten fehlschlagen werden, weil die meisten Ideen überall scheitern, wo sie richtig gemessen werden.

Die Literatur zur Experimentation zeigt deutlich, dass eine hohe Misserfolgsrate der normale Zustand eines gesunden Programms ist, nicht ein Symptom eines schwachen. Die Implikation ist arithmetisch. Wenn die meisten Hypothesen fehlschlagen, wird der Wert der Funktion davon bestimmt, wie viele sie durchlaufen lassen kann und wie kostengünstig sie die Verlierer eliminieren kann. Ein Team, das zwölf A/B tests pro Jahr durchführt, tätigt zwölf Wetten. Ein System, das dasselbe Design kontinuierlich über Tausende von Segmenten ausführt, tätigt eine völlig andere Art von Investition.

Dies ist der Teil der Argumentation, der üblicherweise als Personaleinsparung geschrieben wird, und diese Formulierung ist sowohl falsch als auch schwach. Nichts wird entfernt. Was sich ändert, ist, wohin die knappen Stunden fließen: weg vom monatlichen Neuerstellen desselben Lift-Berichts und hin zur Entscheidung, was als Nächstes zu testen ist.

ROI-Betrachtung

Zähle die Hypothesen, die dein Team letztes Jahr einem kontrollierten Test unterzogen hat, und teile die vollen Kosten der Funktion durch diese Zahl. Das ist dein aktueller Kosten pro Entscheidung. Es ist die einzige Basis, mit der jede agentic growth-Investition verglichen werden sollte.

07

Die Gleichung und wie du sie auf deine eigene Basis anwenden kannst

Netto-Jahresrendite

( base × contactable % × ARPU × verified lift % × gross margin % ) − incentive margin − programme cost

Verified lift ist der gemeldete uplift nach dem Abzug. Incentive margin ist das, was du aufgegeben hast, um den uplift zu erzeugen. Beides fehlt normalerweise in Anbieter-Modellen, und beides sind die ersten Dinge, nach denen ein CFO fragen wird.

Contactable, nicht gesamt

Die adressierbare Basis ist der Anteil, den du in einem bestimmten Monat rechtlich, technisch und tolerierbar erreichen kannst. Fatigue Caps gehören in das Modell, nicht in eine Fußnote darunter.

Marge, nicht Umsatz

Inkrementeller Umsatz mit einer Bruttomarge von 62 % ist kein inkrementeller Umsatz. Jedes Szenario in diesem Bericht wird in Marge ausgedrückt, denn das ist die Währung, in der der Fall beurteilt wird.

Verifiziert, nicht gemeldet

Wende den Abschlag im Modell, vorab, an. Das Band von BCG impliziert eine Diskontierung des gemeldeten uplift um 20 % bis 40 %, bevor es jemand anderes für dich tut.

Netto nach den Zugaben

Rabatte, Gutschriften und Save-Angebote sind die Kosten, um den lift zu erzeugen. Sie abzuziehen ist der Unterschied zwischen einem Business Case und einer Pressemitteilung.

08

Drei Grundlagen, ein ehrliches Modell

Jede Zeile ist dasselbe Modell, das in einem anderen Maßstab angewendet wird, wobei der zentrale Abschlag von 30 % bereits abgezogen und alles in Bruttomarge statt in Umsatz ausgedrückt ist. Der Sinn der Tabelle ist nicht die Größe der Zahl. Es ist, dass die Zahl nach den Abzügen, die die meisten Fälle weglassen, immer noch positiv ist.

BasisAnsprechbarer UmsatzGemeldeter UpliftVerifizierte MargeNetto nach ProgrammkostenHoldout erforderlich
1M customers$129.6M$3.9M$1.7M$787K8.9% · 8 weeks
5M customers$648.0M$19.4M$8.4M$7.5M1.8% · 8 weeks
20M customers$2.59B$77.8M$33.7M$32.8M0.4% · 8 weeks

Annahmen: ARPU $24/month · 45% contactable · 62% gross margin · 3% reported lift on addressable revenue · programme cost $900K/year. Dasselbe Modell, mit deinen eigenen Eingaben, läuft im ROI-Rechner.

09

Das holdout-Protokoll

Fünf Schritte. Keiner davon ist technisch schwierig, und das Überspringen eines einzigen führt dazu, dass ein Ergebnis zu einer Anekdote wird.

01
holdout, bevor du launchst

Eine randomisierte Kontrollgruppe, die aus derselben Population, zum selben Zeitpunkt und unter denselben Eignungsregeln gebildet wird. Eine nachträglich zusammengestellte Kontrollgruppe ist eine angepasste Stichprobe, und eine angepasste Stichprobe erbt jede Voreingenommenheit, die die behandelte Gruppe unterschiedlich gemacht hat.

02
Skaliere den Test für Umsatz, nicht für Konversion

Der Umsatz pro Nutzer ist stark rechtsschief, daher erfordert die Erkennung eines kleinen relativen uplift weitaus mehr Exposures als ein Conversion-Test mit derselben Effektgröße. Dimensioniere es, bevor du es ausführst, sonst liest du mit Zuversicht nur Rauschen.

03
Das ganze Fenster lesen

Mindestens acht Wochen, zwölf Wochen, wenn der Kaufzyklus lang ist. Alles, was in Woche zwei gelesen wird, misst Neuheit, und Neuheit nimmt in jeder veröffentlichten Reihe ab.

04
Das Give-away netto abziehen

Ziehe jeden Rabatt, jede Gutschrift und jedes Sparangebot vom inkrementellen Umsatz ab, bevor jemand es als Ergebnis bezeichnet. Dieser einzelne Schritt kehrt das Vorzeichen bei mehr Bindungsprogrammen um als jeder andere.

05
Einen dauerhaften holdout beibehalten

Eine kleine, stehende Kontrolle ist das einzige Instrument, das dir ein Jahr später sagt, ob das Programm immer noch einen uplift oder lediglich Aktivität erzeugt. Budgetiere dafür als Infrastruktur, nicht als Test.

10

Die Due Diligence Checkliste

Sechs Fragen, die du jedem Anbieter in dieser Kategorie stellen solltest, auch uns. Ein Anbieter, der die erste Frage nicht beantworten kann, verkauft lediglich Aktivität.

  1. 01Kannst du eine uplift-Zahl zeigen, die gegen einen randomisierten holdout gemessen wurde, mit offengelegtem Fenster und Population?
  2. 02Welcher Anteil der Kandidatenaktionen, die das System vorschlägt, wird unterdrückt und unter welcher wirtschaftlichen Regel?
  3. 03Wie wird die Anreizmarge vom gemeldeten uplift abgezogen?
  4. 04Was passiert mit der Zahl, wenn wir einen permanenten 5 % holdout für zwölf Monate beibehalten?
  5. 05Welche der fünf Wertschöpfungspools wird dadurch adressiert, und welche lässt es unberührt?
  6. 06Wer trifft die Entscheidung, wenn das Modell und der Kampagnenkalender nicht übereinstimmen?
11

Fazit

Das Muster in den Beweisen ist konsistent und unbequem. Unternehmen geben in großem Maßstab für growth intelligence aus, eine Minderheit kann eine Rendite nachweisen, und der Unterschied zwischen den beiden Gruppen ist fast nie die Komplexität des Modells. Es ist, ob vor dem Startdatum eine Kontrollgruppe existierte.

Das sind gute Nachrichten für jeden, der bereit ist, rigoros zu sein, denn die Disziplin ist im Verhältnis zu dem Budget, das sie schützt, günstig. Ein fünfprozentiger holdout, ein achtwöchiges Fenster und eine ehrliche Verrechnung der Anreizmarge kosten einen Rundungsfehler und liefern die einzige Zahl, die einen zweiten Budgetzyklus überlebt.

Markin ist nach diesem Standard und nicht um ihn herum aufgebaut. Wir veröffentlichen keinen industry uplift benchmark, wir berichten unsere eigenen Ergebnisse als Spanne, gemessen gegen holdout, und wir betrachten die obige Checkliste als fair game, um sie bei uns anzuwenden.

Weiterlesen

Lies den Rest des Berichts auf dieser Seite.

Kein Download, kein Warten auf eine E-Mail. Sag uns, wer du bist, und die restlichen Ergebnisse werden sofort hier angezeigt. Wir senden dir auch eine Kopie, damit du sie intern teilen kannst.

  • Ergebnisse 03 bis 06, mit jeder Abbildung nachgewiesen und datiert.
  • Die ROI-Gleichung, mit dem Haircut im Modell angewendet.
  • Eine Drei-Basen-Szenariotabelle, ausgedrückt in Bruttomarge, abzüglich Programmkosten.
  • Das Fünf-Schritte-holdout-Protokoll und die Sorgfalts-Checkliste.
Vollständigen Bericht freischalten