Search vs. Performance Max: Welche Kampagne passt zu KMU?
Search, Performance Max und Demand Gen sind keine drei Stufen einer Rangliste. Sie lösen unterschiedliche Aufgaben: Search reagiert auf bereits formulierte Nachfrage, Performance Max optimiert ein Conversion-Ziel über mehrere Google-Inventare hinweg, und Demand Gen verbindet visuelle Botschaften mit Zielgruppen- und Kanalentscheidungen. Für kleine und mittlere Unternehmen lautet die richtige Frage deshalb nicht: „Welcher Kampagnentyp ist allgemein am besten?“, sondern: „Welche Kampagne kann unsere nächste Geschäftshypothese mit dem vorhandenen Budget, den verfügbaren Daten und den vorhandenen Creatives am saubersten prüfen?“
Dieser Leitfaden liefert dafür eine Kampagnenwahl-Matrix für KMU. Sie ordnet nicht nur Kampagnentypen zu, sondern verlangt für jede Entscheidung einen Nachweis und einen Status: STOP bei fehlender Mess- oder Angebotsbasis, START für eine begründete Primärkampagne, TEST für eine kontrollierte Erweiterung und SCALE erst nach bestätigter Gesamtwirkung. Die Matrix ist weder ein automatischer Budgetrechner noch eine Garantie für Ergebnisse. Sie macht vielmehr sichtbar, an welcher Voraussetzung eine Kampagnenidee trägt oder scheitert.
Die Entscheidung beginnt bei der Nachfrage, nicht beim Kampagnennamen
Drei Geschäftsfragen vor dem Öffnen von Google Ads
Zuerst wird bestimmt, ob Menschen das Angebot bereits aktiv suchen. Eine konkrete Suche wie „Badsanierung Wiesbaden“, „Steuerberater für GmbH“ oder eine genaue Produktbezeichnung enthält eine andere Ausgangslage als ein neues Produkt, dessen Kategorie kaum bekannt ist. Die offizielle Anleitung für Search-Kampagnen beschreibt Search als Möglichkeit, Personen zu erreichen, während sie nach Produkten oder Leistungen suchen. Daraus folgt keine automatische Kaufbereitschaft, aber ein beobachtbares sprachliches Signal, das ein KMU mit Keywords, Suchbegriffen, Anzeigen und Landingpages prüfen kann.
Die zweite Frage betrifft das gewünschte Ergebnis. Ein ausgefülltes Formular ist für einen lokalen Dienstleister nur dann ein sinnvolles Ziel, wenn es echte Anfragen abbildet. Für einen Shop können Umsatz, Marge oder Deckungsbeitrag wichtiger sein als die reine Bestellzahl. Die dritte Frage lautet, wie viel Such- und Kanalbreite das Unternehmen zulassen kann. Search bietet einen engeren Ausgangspunkt. Performance Max sucht kanalübergreifend nach Conversions oder Conversion-Wert. Demand Gen ist sinnvoll, wenn eine visuelle Botschaft und eine definierte Audience-Hypothese selbst Teil des Tests sind.
Damit entsteht die erste Regel der Matrix: Gibt es klare Suchnachfrage, eine passende Landingpage und ein überprüfbares Ziel, erhält Search häufig den Status START. Reicht vorhandene Nachfrage nicht aus und sind Zielsignale sowie Assets belastbar, kann Performance Max als TEST ergänzt werden. Muss der Markt den Nutzen erst sehen oder verstehen, kann Demand Gen den ersten kontrollierten Nachfrage-Test übernehmen. Fehlen hingegen Angebotsschärfe oder Conversion-Messung, lautet der Status für alle drei Varianten STOP.
Search, Performance Max und Demand Gen erfüllen verschiedene Rollen
Eine Vergleichstabelle ersetzt keine Freigabe, schafft aber eine gemeinsame Sprache
Die drei Kampagnentypen können dieselben Oberziele wie Leads oder Verkäufe unterstützen, doch sie erreichen sie über unterschiedliche Auswahlmechanismen. Deshalb darf ein Team nicht nur die Spalten „Conversions“, „Kosten“ und „ROAS“ nebeneinanderstellen. Es muss zusätzlich festhalten, welche Nachfrage, Reichweite und Steuerung in jeder Variante enthalten sind. Erst dann ist erkennbar, ob zwei Kampagnen tatsächlich dieselbe Aufgabe erfüllen oder unterschiedliche Teile des Nachfragewegs bearbeiten.
| Kriterium | Search | Performance Max | Demand Gen | Entscheidungssignal | Typische Fehlentscheidung |
|---|---|---|---|---|---|
| Primäre Aufgabe | Formulierte Suchnachfrage erfassen | Ein Geschäftsziel kanalübergreifend optimieren | Aufmerksamkeit und Handlung über visuelle Flächen entwickeln | Wo entsteht die konkrete Geschäftschance? | Alle Kampagnen nur nach dem letzten Klick vergleichen |
| Auswahlsignal | Suchanfrage, Keyword, Anzeige und Zielseite | Conversion-Ziele, Werte, Assets, Feeds und Signale | Audience, Creative, Format und Kanal | Ist Nachfrage bereits sprachlich sichtbar? | Performance Max als größere Search-Kampagne behandeln |
| Reichweite | Google Search und weitere Search-Network-Flächen; Search-Partner sind konfigurierbar, bei aktivierter Displaynetzwerk-Erweiterung kommt zusätzlich Display-Inventar hinzu | Google-Inventare einschließlich Search, Shopping, YouTube, Discover, Gmail, Display und Maps | Visuelle und unterhaltungsorientierte Google-Flächen | Wie breit darf das System nach Ergebnissen suchen? | Mehr Reichweite automatisch mit zusätzlicher Nachfrage gleichsetzen |
| Steuerung | Keywords, Ausschlüsse, Anzeigen, Zielseiten und Einstellungen | Ziel-, Marken-, URL-, Such- und Asset-Steuerungen | Audiences, Creatives, Formate und Channel Controls | Welche Kontrolle ist geschäftlich unverzichtbar? | Signale mit garantierter Eingrenzung verwechseln |
| Creative-Basis | Relevante Texte, Assets und kongruente Landingpage | Kanalgeeignete Texte, Bilder, Logos, Videos und gegebenenfalls Feed | Eigenständige Bild-, Video- oder Carousel-Hypothesen | Kann das Team echte Creative-Varianten liefern? | Pflichtassets ohne Aussage als Strategie betrachten |
| Entscheidungsnachweis | Suchbegriffe, Leadqualität und Wirtschaftlichkeit | Verbesserung des Gesamtportfolios bei stabilen Schutzmetriken | Nachgelagerte Qualität und gegebenenfalls Lift | Welcher Beleg entscheidet über die nächste Stufe? | Attribuierte Plattformleistung als Kausalbeweis ausgeben |
Die Tabelle legt bewusst keinen Sieger fest. Ein Unternehmen kann Search für eindeutige Leistungsanfragen, Performance Max für zusätzliche profitable Reichweite und Demand Gen für eine neue visuelle Botschaft parallel benötigen. Es kann aber auch nur eine Kampagne finanzieren. Dann gewinnt nicht der technisch umfangreichste Typ, sondern die am engsten prüfbare und wirtschaftlich wichtigste Hypothese.
Wann Search die richtige Primärkampagne ist
Explizite Absicht, klare Sprache und notwendige Kontrolle
Search ist häufig die erste Wahl, wenn Kunden ihr Problem, die Leistung, den Ort oder das Produkt bereits konkret benennen. Das gilt besonders für lokale Services, dringliche Anliegen, klar abgegrenzte B2B-Leistungen und Sortimente mit stabiler Kategoriesuche. Ein KMU kann die Anfrage von der Suchformulierung bis zur Zielseite nachvollziehen, Suchbegriffe prüfen und Botschaften eng an den Bedarf anpassen. Das macht Search nicht automatisch effizient, aber diagnostisch wertvoll: Schlechte Anfragen lassen sich eher auf Suchbegriffe, Anzeigenversprechen, Regionen oder Landingpages zurückführen.
Zielgruppen in Search brauchen eine saubere Lesart. Die Unterscheidung zwischen Targeting und Observation zeigt, dass Observation die Reichweite nicht einschränkt, sondern zusätzliche Kriterien innerhalb der bestehenden Auslieferung beobachtbar macht. Ein Segment in Beobachtung beweist daher weder, dass nur diese Personen erreicht wurden, noch dass die Zielgruppe die Suchabsicht verursacht hat. Die Suchanfrage bleibt der zentrale Kontext; Audience-Daten ergänzen die Diagnose und können Smart Bidding Signale liefern.
Search und Performance Max werden im selben Konto außerdem nicht wie zwei unabhängig isolierte Maschinen ausgeliefert. Für dieselbe Suchanfrage und Domain gilt nach den offiziellen Priorisierungsregeln für Anzeigen- und Asset-Gruppen eine gestufte Auswahl: Zuerst wird ein auslieferungsfähiges Exact-Match-Keyword priorisiert, dessen Text mit der Suchanfrage identisch ist; eine korrigierte Schreibweise zählt dabei als identisch, Pluralformen und Synonyme jedoch nicht. Auf der zweiten Stufe stehen identische Phrase- oder Broad-Match-Keywords und identische PMax Search Themes gleichrangig. Fehlt ein identischer Kandidat, wählt Google zunächst nach KI-basierter Relevanz; bei gleicher Priorität entscheidet der Ad Rank. Die Match-Type-Bezeichnung „Exact“ allein genügt nicht, weil Exact Match auch Suchanfragen mit derselben Bedeutung oder Absicht abdecken kann. Geringes Suchvolumen, abgelehnte Anzeigen oder Zielseiten, nicht erfülltes Targeting oder eine Budgetbegrenzung können ein erwartetes Search-Keyword außerdem ausschließen. Diese Folge gilt nicht für Shopping-Formate oder anderes Google-Inventar. Die Matrix vergibt START deshalb aufgrund einer überprüfbaren Search-Aufgabe, nicht aufgrund eines versprochenen Monopols auf Suchanfragen.
Wann Performance Max sinnvoll ergänzt oder skaliert
Kanalbreite braucht ein belastbares Ziel und geeignete Eingaben
Performance Max ist ein zielbasierter Kampagnentyp, der Google-Inventar aus einer Kampagne zugänglich macht. Google beschreibt ihn ausdrücklich als Möglichkeit, keywordbasierte Search-Kampagnen zu ergänzen und zusätzliche Conversions oder zusätzlichen Conversion-Wert zu finden. Die Grundlagen zu Performance Max nennen dafür Conversion-Ziele und Werte, Assets, Audience Signals, Datenfeeds sowie kampagnenbezogene Steuerungen. Eine manuelle Auswahl einzelner Kanäle oder feste Budgetanteile je Kanal gibt es nicht; Google verteilt das Kampagnenbudget über verfügbares Inventar, während der Kanalbericht die entstandene Verteilung nachträglich diagnostiziert. Ein KMU übergibt also nicht einfach Budget, sondern eine Zielfunktion und die Materialien, aus denen das System mögliche Ausspielungen bildet.
Ein TEST ist sinnvoll, wenn das primäre Ziel technisch korrekt misst, die wirtschaftliche Bewertung feststeht und das Unternehmen nicht auf einen einzigen Kanal beschränkt bleiben muss. Für E-Commerce kann ein sauberer Produktfeed eine starke Basis bilden. Für Leadgenerierung müssen Formulare, Anrufe oder Termine so gefiltert werden, dass Smart Bidding nicht billige, aber wertlose Kontakte bevorzugt. Assets müssen zur Leistung und Zielseite passen; Final URL Expansion, automatisch erzeugte Bestandteile, Marken- und Suchsteuerungen werden bewusst freigegeben oder begrenzt.
Search Themes sind optionale, ergänzende Kontextsignale und keine klassischen Keywords oder Reichweitengrenzen; pro Asset-Gruppe lassen sich bis zu 50 unterschiedliche Themes hinterlegen. Für die kontointerne Priorisierung verhalten sich identische Search Themes jedoch wie identische Phrase- und Broad-Match-Keywords. Die Funktionsbeschreibung der Search Themes erklärt, dass sie Kontext liefern können, den Website, Assets oder Feed nicht eindeutig vermitteln. Das Entfernen eines Themes schließt entsprechende Suchanfragen nicht automatisch aus. Ebenso sind Audience Signals Hinweise für die Optimierung und kein garantiertes Targeting. Wer Performance Max nur startet, um dieselbe Keywordliste in ein anderes Feld zu übertragen, hat noch keine eigene PMax-Hypothese formuliert.
Wenn eine vorhandene Search-Struktur als Basis dient, ist ein kontrollierter Vergleich besser als ein zufälliges Parallelrennen. Performance-Max-Experimente können je nach Eignung unter anderem den Uplift durch das Ergänzen von Performance Max oder bestimmte Upgrade- und Optimierungsfragen untersuchen. Ihre Verfügbarkeit und Aussagekraft hängen von Kampagnenart, Volumen und sauberem Versuchsaufbau ab. Ohne geeignetes Experiment bleibt ein Portfoliovergleich beobachtend; auch dann muss die Entscheidung auf Gesamtwirkung statt auf die attraktivere Einzelkampagnenzahl zielen.
Wann Demand Gen die fehlende Ebene bildet
Creative und Audience werden zur eigenständigen Geschäftshypothese
Demand Gen passt, wenn ein Nutzen visuell demonstriert werden muss, die Kategorie noch nicht ausreichend gesucht wird oder ein Unternehmen eine kreative Botschaft außerhalb klassischer Suchergebnisse prüfen will. Die Übersicht zu Demand Gen grenzt die Rollen direkt ab: Search maximiert Leistung in der Suche, Performance Max über Google-Kanäle hinweg, Demand Gen auf besonders visuellen und unterhaltungsorientierten Flächen. Demand Gen kann auf Klicks, Conversions oder Conversion-Wert ausgerichtet sein und darf daher nicht pauschal als reines Awareness-Produkt bezeichnet werden; welche Gebotsstrategie verfügbar ist, hängt vom Kampagnenziel und Setup ab.
Der Start setzt mehr voraus als vorhandene Bilder. Das Unternehmen braucht eine Aussage darüber, welche Personengruppe welches Problem erkennt, welches Creative den Nutzen vermittelt und welche nachgelagerte Handlung Erfolg bedeutet. Die Einrichtung einer Demand-Gen-Kampagne verbindet Ziel, Conversion-Ziele, Geräte, Sprachen, Standorte, Gebote, Audiences, Anzeigen und bei Bedarf Produktfeeds. Eine ausgewählte Audience ist nicht in jedem Setup eine harte Reichweitengrenze: Bei aktiviertem Optimized Targeting kann Demand Gen über ausgewählte Audience- und demografische Signale hinaus ausliefern. Werden gleichzeitig Audience, Creative, Gebot und Landingpage ausgetauscht, lässt sich ein Ergebnis später kaum einer Hypothese zuordnen.
Demand Gen erhält daher nur dann TEST, wenn mindestens eine testfähige Bild- oder Videoidee, eine nachvollziehbare Audience-Definition, eine geeignete Zielseite und eine belastbare Downstream-Metrik vorhanden sind. Impressionen, Views oder günstige Klicks können Zwischensignale sein, ersetzen aber keine qualifizierte Anfrage, keinen Verkauf und keinen passenden Lift-Nachweis. Fehlt ein Creative-System oder kann das Budget keine aussagefähige Beobachtung tragen, lautet die Entscheidung STOP oder „Creative vorbereiten“, nicht „Algorithmus ausprobieren“.
Kanalwahl und Creative Readiness gemeinsam prüfen
Ein Format ist nur dann verfügbar, wenn seine Aussage funktioniert
Search benötigt ebenfalls Creatives, auch wenn keine große Videoproduktion nötig ist. Überschrift, Beschreibung, Assets und Landingpage müssen das in der Suchanfrage erkennbare Problem konsistent beantworten. Performance Max kann kanalgeeignete Texte, Bilder, Logos und Videos sowie gegebenenfalls Feed-Inhalte nutzen. Fehlende Video-Assets kann Google automatisch erzeugen; nicht jede Kampagne verlangt daher ein selbst produziertes Video. Die vorhandenen Assets und Feeds beeinflussen jedoch, für welche Ausspielungen die Kampagne geeignet ist. Demand Gen braucht nicht einfach mehr Dateien, sondern bewusst variierte Hooks, Bildwelten, Formate und Handlungsangebote.
Demand Gen bietet eine Besonderheit für die Wahlarchitektur: Die Channel Controls werden auf Anzeigengruppenebene gesetzt. Möglich sind „All Google channels“ – mit dem Google Display Network als optionaler Ergänzung – oder eine manuelle Auswahl von YouTube In-stream, YouTube In-feed, YouTube Shorts, Discover, Gmail, Maps und dem Google Display Network. Welche Flächen verfügbar sind, hängt unter anderem von Kampagnenziel, Anzeigenart, Audience und weiteren Einstellungen ab; Maps setzt ein geeignetes Standort-Asset voraus. Die Auswahl garantiert weder Auslieferung noch Mindestvolumen oder eine gleichmäßige Budgetverteilung. Eine enge Auswahl ist deshalb nur begründet, wenn Creative und Nutzungssituation ausdrücklich zu einer Fläche passen.
Messreife ist das erste Gate der Kampagnenwahl
Conversion, Wert und Backendstatus müssen dieselbe Handlung meinen
Ein Kampagnentyp kann nur auf das optimieren, was als Ziel übergeben wird. Bei Leads muss geklärt sein, ob ein abgesendetes Formular, ein erreichter Kontakt, ein qualifizierter Termin oder ein Auftrag zählt. Bei E-Commerce müssen Kaufwert, Währung, Transaktions-ID, Retouren und gegebenenfalls Marge konsistent verarbeitet werden. Mikro-Conversions können der Diagnose dienen, sollten aber nicht unbemerkt dieselbe Priorität wie ein Geschäftsergebnis erhalten. Sonst gewinnt möglicherweise die Kampagne, die am leichtesten eine Zwischenhandlung erzeugt.
Vor der Wahl wird deshalb ein Messblatt angelegt: Conversion-Aktion, Kategorie, Primärstatus, Zählmethode, Wertquelle, Datenverzögerung, verantwortliches System und fachlicher Eigentümer. Eine Testconversion belegt die technische Übertragung. Eine Gegenprobe im Shop oder CRM belegt, dass dieselbe reale Handlung erfasst wurde. Für Leadgen folgt eine Stichprobe der Qualität; für Verkäufe ein Abgleich von Auftrag und Wert. Erst wenn diese Kette geschlossen ist, darf ein Ergebnis als Grundlage für START oder TEST dienen.
Fehlt dieser Nachweis, lautet der Matrixstatus STOP, auch wenn bereits Daten im Konto erscheinen. Mehr Reichweite kann einen Messfehler beschleunigen, aber nicht heilen. Ebenso darf eine neue Kampagne nicht als Diagnosewerkzeug für ein altes Trackingproblem missbraucht werden. Zuerst wird festgelegt, welche Zahl eine Entscheidung tragen darf; danach wird der Kampagnentyp ausgewählt, dessen Mechanik diese Zahl sinnvoll optimieren kann.
Das Geschäftsmodell verändert die sinnvolle Startarchitektur
Lokaler Service, B2B und E-Commerce benötigen unterschiedliche Beweise
Ein lokaler Notdienst mit klarer regionaler Suche kann Search eng nach Leistung, Ort und Erreichbarkeit strukturieren. Entscheidend sind qualifizierte Anrufe oder Aufträge, nicht Klicks. Performance Max kann später zusätzliche Reichweite prüfen, wenn Regionen, Zeiten, Ziele und Ausschlüsse sauber sind. Demand Gen ist nur dann naheliegend, wenn eine visuelle oder frühere Nachfragephase wirtschaftlich relevant ist, etwa bei planbaren Renovierungen statt akuten Reparaturen.
Im B2B-Geschäft ist das Suchvolumen oft geringer und der Verkaufszyklus länger. Search kann hochspezifische Problemanfragen abholen, während CRM- oder Offline-Signale nötig sind, um echte Chancen von Downloads und unpassenden Formularen zu trennen. Performance Max erhält erst dann TEST, wenn das Ziel Qualität statt bloße Leadmenge abbildet. Demand Gen kann Expertise, Anwendung oder Kategorieverständnis aufbauen, benötigt aber eine nachgelagerte Messung über qualifizierte Besuche, Kontakte, Pipeline oder ein geeignetes Experiment.
Die Kampagnenwahl-Matrix für KMU anwenden
Von der Ausgangslage zur belegbaren Freigabe
Die Matrix verbindet sechs Felder: Ausgangslage, Nachfrage, Datenreife, Creative-Reife, vorläufige Entscheidung und Freigabebeweis. Die Entscheidung ist bewusst vorläufig. Sie wird nicht durch Branchenetiketten, Wettbewerber oder Google-Empfehlungen endgültig, sondern durch das tatsächliche Ergebnis. Jede Zeile erhält einen Eigentümer und ein Prüfdatum. Ändern sich Angebot, Tracking, Feed oder Ziel, muss auch die Zuordnung neu bewertet werden.
| Ausgangslage | Nachfrage-Signal | Datenreife | Creative-Reife | Vorläufige Entscheidung | Freigabebeweis |
|---|---|---|---|---|---|
| Lokaler Service mit konkreten Suchanfragen | Hoch und sprachlich eindeutig | Niedrig bis mittel, aber prüfbar | Anzeigen und passende Leistungsseite vorhanden | Search START | Relevante Suchbegriffe, erreichbare Kontakte und qualifizierte Aufträge |
| Neuer Account ohne validierte Conversion | Unklar oder beliebig | Niedrig | Beliebig | Alle Varianten STOP | Testconversion und Backend-Gegenprobe stimmen überein |
| Shop mit sauberem Feed und belastbaren Werten | Hoch mit zusätzlichem Cross-Channel-Potenzial | Hoch | Vollständige Produkt- und Markenassets | Search fortführen, Performance Max TEST | Mehr profitabler Gesamtwert ohne schädliche Verschiebung |
| Bekanntes Angebot mit begrenzter Search-Reichweite | Mittel bis hoch | Mittel bis hoch | Kanalgeeignete Assets vorhanden | Performance Max TEST | Zusätzliche qualifizierte Ergebnisse bei stabilen Schutzmetriken |
| Neues visuelles Produkt mit geringer Suche | Niedrig | Mittel | Starke Bild- und Video-Hypothesen | Demand Gen TEST, Search für entstehende Nachfrage | Nachgelagerte Qualität oder geeigneter Lift statt bloßer Reichweite |
| B2B-Angebot mit langem Verkaufszyklus | Klein, aber spezifisch | Nur mit CRM-Rückmeldung ausreichend | Erklärende Assets vorhanden | Search START, Expansion später TEST | Pipeline-Qualität und Wert nach vollständigem Sales Cycle |
| Kleines Budget für drei parallele Kampagnen | Beliebig | Mittel | Uneinheitlich | Nur eine Primärhypothese START oder TEST | Budget trägt Beobachtungsfenster und Conversion-Lag |
| Starke Brand-, aber schwache generische Nachfrage | Durch bekannte Marke verzerrt | Mittel | Mittel | Brand-Baseline sichern, Expansion separat TEST | Nicht-Brand-Wirkung und Gesamtgrenzkosten bleiben sichtbar |
Der praktische Nutzen liegt in den Ablehnungen. Ein Shop mit großem Sortiment erhält nicht automatisch Performance Max, wenn Kaufwerte doppelt zählen. Ein visuelles Produkt erhält nicht automatisch Demand Gen, wenn nur ein ungeklärtes Image vorhanden ist. Und ein lokaler Dienstleister erhält nicht automatisch Search, wenn die Landingpage ein anderes Gebiet oder eine andere Leistung verspricht. Die Matrix bewertet Einsatzfähigkeit, nicht bloße theoretische Eignung.
Budget begrenzt Beobachtung und Optimierung, nicht nach einer Prozentformel
Eine finanzierbare Hypothese ist besser als drei unterversorgte Kampagnen
Es gibt keine universelle Aufteilung wie „60 Prozent Search, 30 Prozent Performance Max, 10 Prozent Demand Gen“, die für jedes KMU sinnvoll wäre. Budget folgt der Aufgabe. Zuerst werden Zielkosten oder Zielwert, realistische Nachfrage, Conversion-Lag, Datenvolumen und maximal tragbares Risiko bestimmt. Danach wird geprüft, ob die Kampagne innerhalb eines sinnvollen Zeitfensters überhaupt genug Entscheidungen beziehungsweise Geschäftsfälle beobachten kann. Eine Kampagne, deren Auslieferung regelmäßig durch Budgetbegrenzung eingeschränkt ist, liefert eine andere Ausgangslage als ein stabil finanzierter Test.
Für eine Primärkampagne wird ein Baseline-Budget definiert, das die bestehende Nachfrage verlässlich abdeckt, soweit dies wirtschaftlich sinnvoll ist. Ein Erweiterungstest erhält ein eigenes, vorab begrenztes Testbudget und eine Abbruchregel. Dadurch kann ein Team erkennen, ob Performance Max oder Demand Gen das Gesamtportfolio verbessert, ohne die Search-Basis unbemerkt auszuhungern. Shared Budgets oder häufige Umschichtungen sind während einer Entscheidungsmessung kritisch, weil sie Kontroll- und Testzustand vermischen können.
Ein kleines Budget ist kein Qualitätsurteil über das Unternehmen, aber ein Architekturconstraint. Reicht es nur für eine Hypothese, beginnt das Team dort, wo Nachfrage und Geschäftsnutzen am klarsten sind. Reicht es nicht bis zum relevanten Conversion-Lag, lautet die Entscheidung STOP oder „Beobachtungsfenster verlängern“. Skalierung beginnt nicht bei ungenutztem Tagesbudget, sondern wenn zusätzliche Ausgaben bei stabiler Ergebnisqualität und akzeptablen Grenzkosten plausibel sind.
Ergebnisse kampagnenübergreifend und ohne Scheingenauigkeit lesen
Plattformberichte diagnostizieren Wirkung, beweisen sie aber nicht allein
Search bietet Suchbegriffs-, Keyword-, Anzeigen- und Zielseitensignale. Performance Max bietet unter anderem Asset-, Such- und Kanalansichten. Demand Gen stellt Kampagnen-, Anzeigen-, Audience-, Asset- und Kanaldaten bereit. Die Demand-Gen-Berichtsdokumentation beschreibt beispielsweise Segmentierung nach Netzwerk und Anzeigenformat sowie zusätzliche Video- und Asset-Informationen. Diese Ansichten zeigen, wo berichtete Leistung entstand; sie erklären nicht automatisch, warum sie entstand oder was ohne die Kampagne passiert wäre.
Darum wird ein gemeinsames Bewertungsblatt verwendet. Primärmetrik ist das Geschäftsergebnis, etwa qualifizierter Auftrag, Deckungsbeitrag oder bestätigte Pipeline. Schutzmetriken erfassen Nebenwirkungen: Markenanteil, Leadqualität, Retouren, Frequenz, Search-Impression-Share, Gesamt-CAC oder regionale Fehlkontakte. Diagnosemetriken wie CTR, View Rate, Asset-Leistung oder Kanalanteil helfen beim Verbessern, dürfen aber nicht an die Stelle der Freigabemetrik treten.
Jeder Test braucht genau eine Entscheidungsfrage
Der Testvertrag schützt vor nachträglicher Interpretation
Vor dem Start werden Frage, Baseline, kontrollierte Veränderung, Primärmetrik, Schutzmetriken und Entscheidungsregel dokumentiert. Die A/B-Experimente für Demand Gen empfehlen, Kampagnen möglichst nur in einer Variablen unterscheiden zu lassen; Creative, Audience, Produktfeed oder Gebot können je nach Experiment untersucht werden. Welcher Experimenttyp verfügbar und auswertbar ist, hängt von Kampagnenstatus, Setup und Datenvolumen ab. Ein A/B-Vergleich zwischen zwei Demand-Gen-Varianten ist außerdem kein automatischer Nachweis der Inkrementalität gegenüber keiner Werbung. Wer Budget, Audience, Creative und Landingpage gleichzeitig ändert, kann zwar Performance beobachten, aber kaum eine einzelne Ursache isolieren.
| Testfrage | Ausgangsbasis | Kontrollierte Veränderung | Primärmetrik | Schutzmetrik | Entscheidungsregel |
|---|---|---|---|---|---|
| Ergänzt Performance Max eine stabile Search-Struktur? | Dokumentierte Search-Baseline | PMax mit eigenem Budget und identischem Geschäftsziel | Zusätzlicher qualifizierter Wert im Gesamtportfolio | Search-Qualität, Brand-Anteil und Gesamtkosten | Nur skalieren, wenn das Gesamtergebnis die Baseline verbessert |
| Erreicht Demand Gen neue relevante Nutzer? | Bestehende Nachfragekanäle | Eine Creative- und Audience-Hypothese | Qualifizierte Downstream-Handlung oder geeigneter Lift | Frequenz, Absprünge und Leadqualität | Creative iterieren oder Test beenden |
| Lohnt die Ausweitung über Brand hinaus? | Separat dokumentierte Brand-Leistung | Definierter Non-Brand- oder Cross-Channel-Test | Zusätzliche qualifizierte Nachfrage | Brand-Kosten und Gesamtgrenzkosten | Keine Skalierung bei bloßer Verschiebung |
| Verbessert wertbasiertes Bieten die Wirtschaftlichkeit? | Validierte Conversion-Werte | Nur die Gebotslogik ändern | Profitabler Conversion-Wert | Volumen, Marge und Wertqualität | Werte korrigieren, bevor Gebote bewertet werden |
| Welche visuelle Botschaft funktioniert besser? | Kontroll-Creative | Eine definierte Creative-Variante | Downstream-Conversion oder vereinbarte Lift-Metrik | Kosten, Frequenz und Qualitätsquote | Gewinner erst nach ausreichender Datenreife bestimmen |
Der Testvertrag verbietet keine operative Reaktion auf echte Risiken. Falsche Preise, nicht verfügbare Produkte, Policy-Probleme oder unqualifizierte Leads dürfen sofort korrigiert werden. Die Änderung wird jedoch protokolliert, und das Auswertungsfenster beginnt bei wesentlicher Wirkung neu. Ein „Gewinner“ ohne stabile Ausgangsbasis erhält höchstens TEST fortsetzen, nicht SCALE.
Der Entscheidungspfad führt von STOP bis SCALE
Sieben Gates statt einer pauschalen Kampagnenempfehlung
Automatisierte Gebote benötigen nach dem Start oder nach wesentlichen Änderungen Zeit zur Kalibrierung. Die offizielle Erklärung zur Lernphase nennt Conversion-Anzahl, Conversion-Zyklus und Gebotsstrategie als wichtige Einflussfaktoren; je nach Datenlage kann die Kalibrierung bis zu drei Wochen oder ein bis zwei Conversion-Zyklen dauern. Das ist keine Pflichtwartezeit für jeden Test und keine Garantie auf Stabilität. Es ist ein Grund, Entscheidungen nicht täglich zu wechseln und das eigene Beobachtungsfenster an den realen Sales Cycle anzupassen.
- Mess-Gate: Ist die primäre Conversion technisch und fachlich bestätigt? Wenn nein, gilt STOP; Tracking und Backend-Abgleich werden zuerst repariert.
- Wirtschaftlichkeits-Gate: Sind Zielkosten, Wert oder Qualitätskriterien definiert? Wenn nein, gilt STOP, weil keine Kampagne eine belastbare Freigabe erhalten kann.
- Nachfrage-Gate: Gibt es konkrete, relevante Suchnachfrage und passende Zielseiten? Wenn ja, erhält Search für diese Aufgabe START.
- Breiten-Gate: Soll zusätzliche Conversion-Leistung über Google-Inventare gesucht werden und sind Ziel, Daten und Assets tragfähig? Wenn ja, erhält Performance Max TEST.
- Creative-Gate: Muss Nachfrage visuell entwickelt werden und existiert eine testfähige Audience-Creative-Hypothese? Wenn ja, erhält Demand Gen TEST.
- Wirkungs-Gate: Verbessert der Test nach angemessenem Conversion-Lag die Primärmetrik, ohne Schutzmetriken zu verletzen? Wenn nein, wird iteriert oder STOP vergeben.
- Grenzwert-Gate: Bleiben Qualität und Grenzkosten bei kontrollierter Budgeterhöhung tragfähig? Wenn ja, gilt SCALE; andernfalls kehrt die Kampagne zu TEST zurück.
Der Pfad erlaubt unterschiedliche Ergebnisse für verschiedene Angebotsbereiche. Search kann für eine lokale Kernleistung SCALE erhalten, während Performance Max für ein breites Sortiment im TEST bleibt und Demand Gen wegen fehlender Creatives STOP erhält. Die Statuswerte gehören daher an eine konkrete Hypothese, nicht dauerhaft an den Kampagnentyp.
STOP-Regeln verhindern teure Scheinsicherheit
Wann eine Kampagne nicht gestartet oder nicht weiter skaliert wird
Ein sofortiges STOP gilt, wenn die Primärconversion keine reale Geschäftshandlung darstellt, doppelt zählt oder keinen verlässlichen Wert übergibt. Dasselbe gilt bei falschen Preisen, nicht verfügbaren Leistungen, ungeklärten Datenrechten oder einer Zielseite, die das Anzeigenversprechen nicht erfüllt. In diesen Fällen erzeugt mehr Budget keine bessere Erkenntnis. Es vergrößert nur die Menge fehlerhafter Signale oder schlechter Nutzererfahrungen.
Ein Test-STOP greift, wenn Schutzmetriken deutlich verletzt werden: Leadqualität fällt, Retouren steigen, regionale Fehlkontakte dominieren, Brand-Anteil verdrängt die eigentlich getestete Expansion oder die Kampagne kann wegen wiederholter Eingriffe kein stabiles Beobachtungsfenster erreichen. Auch ein scheinbar guter Einzelkampagnen-CPA reicht nicht, wenn das Gesamtkonto keine zusätzliche qualifizierte Nachfrage gewinnt. Bei Performance Max muss vor dem Start deshalb ausdrücklich geklärt werden, wann der Kampagnentyp für das konkrete Unternehmen sinnvoll ist, statt ihn als Standard-Upgrade zu behandeln.
STOP bedeutet nicht zwingend endgültiges Abschalten. Der Status kann „Messung reparieren“, „Creative neu entwickeln“, „Angebot schärfen“, „Budget bündeln“ oder „Testdesign korrigieren“ auslösen. Erst nach dem Nachweis wird neu entschieden. Diese Rückkehrfähigkeit verhindert zwei Extreme: eine Kampagne aus Ungeduld zu früh zu beenden oder aus Hoffnung ohne Freigabebeweis weiterzufinanzieren.
Die Wahl in einem 90-Tage-Freigabeplan umsetzen
Vier Phasen verbinden Baseline, Test und Skalierungsentscheidung
Der Plan ist kein Versprechen, dass jedes Unternehmen nach genau 90 Tagen skalieren kann. Er schafft einen gemeinsamen Takt für Prüfung und Dokumentation. Bei langen B2B-Zyklen kann die finale Wirkungsbewertung später liegen; bei hohem E-Commerce-Volumen können einzelne Diagnosefragen früher beantwortet werden. Wichtig ist, dass Phasen nicht übersprungen werden und jede wesentliche Änderung mit Datum, Hypothese und neuem Beobachtungsbeginn festgehalten wird.
| Phase | Ziel | Zentrale Handlungen | Erforderlicher Nachweis | Gate |
|---|---|---|---|---|
| Tage 0 bis 7 | Einsatzfähigkeit bestätigen | Ziele, Werte, Tracking, CRM, Feed, Creatives, Landingpages und Nachfrage prüfen | Testconversion, Backend-Gegenprobe und dokumentierte Matrix | STOP oder Freigabe |
| Tage 8 bis 30 | Primärarchitektur stabilisieren | Search starten oder vorhandene Baseline ohne größere Paralleländerungen sichern | Suchbegriffe, Qualität, Kosten und Conversion-Lag sind nachvollziehbar | START bestätigen |
| Tage 31 bis 60 | Genau eine Expansion prüfen | Performance Max oder Demand Gen mit eigenem Testvertrag starten | Primär- und Schutzmetriken nach reifem Datenfenster | TEST fortsetzen, korrigieren oder stoppen |
| Tage 61 bis 90 | Gesamtwirkung und Grenzwert bewerten | Brand, Kanalverschiebung, Qualität, Marge und Budgetreaktion prüfen | Verbesserung gegenüber Baseline mit dokumentierten Einschränkungen | SCALE, weiterer TEST oder STOP |
Häufige Fragen zu Search, Performance Max und Demand Gen
Acht Antworten für eine belastbare Kampagnenwahl
Die folgenden Fragen fassen die Entscheidung zusammen. Jede Antwort bleibt an Geschäftsaufgabe, Messreife und Freigabebeweis gebunden; kein Kampagnentyp erhält allein wegen seines Namens Vorrang.
Sollte ein neues Google-Ads-Konto mit Search oder Performance Max starten?
Wenn konkrete Suchnachfrage, passende Landingpages und eine validierte Conversion vorhanden sind, liefert Search häufig die enger prüfbare Startbasis. Performance Max kann direkt sinnvoll sein, wenn ein belastbares Ziel, geeignete Assets oder Produktfeeds und genügend Freiraum für kanalübergreifende Optimierung bestehen. Fehlt die Messbasis, sollte keiner der beiden Typen freigegeben werden.
Kann Performance Max eine Search-Kampagne vollständig ersetzen?
Technisch kann Performance Max auch Search-Inventar nutzen, doch Google beschreibt den Kampagnentyp als Ergänzung keywordbasierter Search-Kampagnen. Ob eine eigene Search-Struktur nötig bleibt, hängt von Kontrollbedarf, Suchaufgaben, Markenführung und Messdesign ab. Eine Ablösung sollte getestet und am Gesamtportfolio bewertet werden, nicht aus einer einzelnen Kampagnenzahl folgen.
Können Search und Performance Max gleichzeitig laufen?
Ja. Für Google Search gelten jedoch die in Abschnitt 3 beschriebenen Auswahlstufen: Nur ein mit der Suchanfrage identisches Exact-Match-Keyword besitzt den ersten Vorrang; identische Phrase- oder Broad-Match-Keywords und identische PMax Search Themes stehen auf der nächsten gemeinsamen Stufe. Eligibility-Ausnahmen und anschließend Relevanz beziehungsweise Ad Rank bestimmen die tatsächliche Auslieferung. Ein niedrigerer CPA in einer Kampagne zeigt deshalb nicht automatisch, dass sie zusätzliche Nachfrage statt nur eine andere Zuordnung erhalten hat.
Wann ist Demand Gen für ein KMU sinnvoll?
Wenn eine visuelle Botschaft, eine definierte Audience und eine nachgelagerte Handlung gemeinsam getestet werden sollen. Das kann bei neuen Produkten, erklärungsbedürftigen Angeboten oder begrenzter Suchnachfrage der Fall sein. Demand Gen sollte nicht nur wegen vorhandener Videos starten; Creative-Hypothese, Zielseite, Budget und Erfolgsnachweis müssen zusammenpassen.
Wie testet man Performance Max bei wenigen Conversions?
Zuerst wird geprüft, ob die geringe Zahl realistisch zur Nachfrage und zum Verkaufszyklus passt oder durch zu enge beziehungsweise fehlerhafte Messung entsteht. Ziele sollten nicht künstlich durch wertlose Mikro-Conversions aufgefüllt werden. Ist ein integriertes Experiment nicht geeignet, wird ein klar dokumentierter Portfolio-Test mit längerer Beobachtung und vorsichtiger Aussage durchgeführt.
Wie sollte das Budget zwischen den Kampagnentypen verteilt werden?
Nicht nach einer universellen Prozentformel. Zuerst wird die wirtschaftlich wichtigste Primärhypothese ausreichend finanziert. Eine Erweiterung erhält ein begrenztes Testbudget, ohne die Baseline unkontrolliert zu verändern. Erst ein bestätigter Grenznutzen rechtfertigt eine dauerhafte Umschichtung oder Erhöhung.
Wie erkennt man Brand-Kannibalisierung oder reine Budgetverschiebung?
Brand- und Non-Brand-Nachfrage werden getrennt beobachtet, ebenso Gesamtconversions, Qualität, Kosten und vorhandene Search-Baseline. Sinkt die Leistung einer Ausgangskampagne im selben Umfang, in dem die neue Kampagne gewinnt, ist Zusatzwirkung nicht belegt. Ein sauberes Experiment ist stärker als ein bloßer Vorher-nachher-Vergleich.
Wann darf eine Kampagne skaliert werden?
Erst wenn ein reifes Datenfenster die Primärmetrik bestätigt, Schutzmetriken stabil bleiben und eine kontrollierte Budgeterhöhung wirtschaftlich tragfähig erscheint. Ein kurzfristiger ROAS-Peak, ein einzelner Großauftrag oder ein Creative mit hoher Klickrate reicht nicht. Bei unklarer Ursache bleibt der Status TEST, bei gebrochener Messung STOP.
Nächster Schritt: die Kampagnenarchitektur prüfen lassen
Aus drei Kampagnentypen wird ein überprüfbarer Investitionsplan
Eine gute Kampagnenwahl beginnt mit einer begrenzten Aussage: Search soll vorhandene Nachfrage erfassen, Performance Max soll das bestehende Portfolio kontrolliert erweitern oder Demand Gen soll eine visuelle Nachfragehypothese prüfen. Danach werden Ziel, Budget, Assets, Baseline, Schutzmetriken und Abbruchregel festgelegt. Die Kampagnenwahl-Matrix hält diese Voraussetzungen zusammen und verhindert, dass eine Produktbezeichnung zum Ersatz für Strategie wird.
Ein Audit sollte deshalb nicht nur bestehende Kampagnen bewerten. Es prüft auch, ob das Angebot suchbar oder erklärungsbedürftig ist, ob Conversion und Wert im Backend stimmen, ob Creatives zur geplanten Reichweite passen und welcher Nachweis eine Skalierung rechtfertigt. Das Ergebnis ist kein pauschales „PMax an“ oder „Search aus“, sondern ein dokumentierter Status je Geschäftshypothese: STOP, START, TEST oder SCALE.