Der Traum jedes Marketers? Mehr Conversions ohne Rätselraten.
A/B-Tests auf Landingpages verschaffen dir genau diesen Vorteil.
A/B-Tests gehören im digitalen Marketing zu den wichtigsten Methoden, um Kampagnenergebnisse zu verbessern. Dabei werden zwei oder mehr Versionen einer Seite, sogenannte Seitenvarianten, miteinander verglichen, um herauszufinden, welche zu mehr Registrierungen, Leads oder Verkäufen führt. Indem du verschiedene Varianten von Elementen wie CTA-Buttons oder Layouts testest, kannst du ermitteln, was am besten funktioniert.
Der Prozess klingt einfach, doch Fehler passieren schnell. Kleine Fehler bei der Einrichtung oder Analyse können Wochen zunichtemachen.
Lass uns die Erwartungen einordnen: Die mediane Conversion-Rate von Landingpages liegt bei etwa 2.35%, während die besten 10% in vielen Kategorien 11.45% überschreiten. In dieser Spanne liegt deine Chance.
A/B-Tests sind eine bewährte Methode zur Conversion-Optimierung. Deine Aufgabe besteht darin, mit gezielten Experimenten, sauberen Daten und konsequenter Umsetzung vom Durchschnitt zur Spitzengruppe aufzusteigen.
Machen wir dir die Arbeit leichter ...
Was Bedeuten A/B-Tests Für Landingpages?
Bei A/B-Tests, auch Split-Tests genannt, wird der Traffic auf mindestens zwei Varianten derselben Seite aufgeteilt (in der Regel werden bei einem A/B-Test jeweils zwei Versionen verglichen).
Version A ist die ursprüngliche Version, auch Kontrollseite genannt. Version B enthält eine Änderung, etwa an der Überschrift, am Formular oder am Angebot. Du teilst den Traffic zwischen beiden Versionen auf, häufig 50 zu 50, und misst, welche Version mehr Conversions erzielt.
Anhand dieses Ergebnisses entscheidest du, welche Version für 100% der Nutzer live bleibt.
Hier ein konkretes Beispiel: Angenommen, du betreibst eine Landingpage für eine kostenlose Testversion mit einer Registrierungsrate von 3% (das ist Version A, die ursprüngliche Version). Für Version B testest du ein kürzeres Formular, aus dem zwei Felder entfernt wurden. Über zwei Wochen leitest du jeweils 10,000 Besucher zu jeder Variante.
Erreicht das neue Formular 3.6% und ist die Steigerung statistisch valide, führst du es ein. Falls nicht, ziehst du deine Erkenntnisse daraus und testest die nächste Idee.
Eine wichtige Zahl ist hier der Ausgangswert von 3%, den du später für die Power-Berechnungen verwendest. Jeder Test sollte auf einer klaren Testhypothese basieren, damit sich aus den Ergebnissen konkrete Maßnahmen ableiten lassen.
Relevante Ziele Und Kennzahlen Festlegen
Dein Ziel sollte die wichtigste Handlung sein, die Besucher ausführen sollen. Bei den meisten Landingpages ist das ein Verkauf, ein Lead, eine Testversion, eine Demo-Anfrage oder das Ausfüllen eines Formulars.
Sekundäre Kennzahlen helfen anschließend dabei, das primäre Ergebnis zu erklären. Dazu gehören häufig die Absprungrate, Klicks zum nächsten Schritt, die Verweildauer auf der Seite und die Klickrate bei Seiten, deren Ziel es ist, Nutzer durch Klicks zur Interaktion zu bewegen. Vermeide oberflächliche Kennzahlen wie reine Seitenaufrufe, sofern sie nicht Teil einer Funnel-Geschichte sind.
Lege unbedingt Vergleichswerte für deine Erwartungen fest. Branchenübergreifend liegt die durchschnittliche Website-Conversion-Rate bei etwa 2.9%, wobei die Durchschnittswerte auf Mobilgeräten in allgemeinen Benchmarks niedriger sind als auf Desktop-Geräten. Liegt deine Seite bei 1.2%, könnte ein ehrgeiziges Ziel eine relative Steigerung um 20% auf 1.44% sein. Startest du bei 4%, ist eine relative Steigerung um 5% bis 10% möglicherweise realistischer. Entscheide dich in jedem Fall für eine primäre Kennzahl und bleibe bei jedem Test dabei. Die Erfassung quantitativer Daten ist unerlässlich, um fundierte Entscheidungen über deine Tests und Optimierungen zu treffen.
Kurz gesagt ...
Primäre Kennzahl: das eine Ergebnis, auf dessen Grundlage du deine Entscheidung triffst.
Schutzkennzahlen: Signale, die negative Auswirkungen wie eine erhöhte Absprung- oder Fehlerrate erkennen lassen.
Diagnosekennzahlen: Klicks auf der Seite, Scrolltiefe, Interaktionen mit Feldern und Klickraten, um die Wirksamkeit von Handlungsaufforderungen zu messen.
Lege sie fest, bevor du beginnst. So vermeidest du, später bloßem Rauschen nachzujagen. Ein Beispiel für eine Schutzkennzahl wäre, die Absprungrate während eines Testlaufs innerhalb von 5% der Kontrollversion zu halten.
Noch etwas: Es ist wichtig, einen A/B-Test lange genug laufen zu lassen, um statistisch signifikante Ergebnisse zu erhalten. Überstürze nichts.
Starke Hypothesen Entwickeln Und Ideen Priorisieren
Starke Hypothesen verbessern deine Erfolgsquote. Doch zunächst einmal: Was ist eine gute Hypothese?
Eine gute Hypothese verknüpft ein Problem der Nutzer mit einer Änderung und einem messbaren Ergebnis. Zum Beispiel: „Die Reduzierung eines Formulars mit 7 Feldern auf 4 Felder verringert die Hürden für Erstbesucher und erhöht die Registrierungen für die Testversion um 10%.“ Diese richtungsweisende und messbare Formulierung sorgt dafür, dass du ehrlich zu dir selbst bleibst.
Die Analyse bisheriger Leistungsdaten und Nutzertests kann wertvolle Erkenntnisse für die Entwicklung von Hypothesen liefern. Nutze ein einfaches Priorisierungsmodell, um auszuwählen, was du zuerst testest.
Das PXL-Framework gewichtet beispielsweise Belege, die erwartete Wirkung und die Einfachheit anhand einheitlicher Kriterien für alle Ideen. Wenn du 20 Ideen hast, bewerte jede davon auf einer Skala von 1 bis 5 nach Wirkung und Einfachheit und sortiere sie anschließend nach der Gesamtpunktzahl. Beginne mit Ideen, die 12 oder mehr von 15 Punkten erreichen, um schneller Erkenntnisse zu gewinnen.
Stellen wir sicher, dass wir hier vom Gleichen sprechen ...
Belege: qualitative Erkenntnisse, Analytics, Nutzertests, durch Tests verschiedener Design- oder Inhaltsoptionen ermittelte Nutzerpräferenzen oder frühere Experimente, die die Idee stützen.
Wirkung: erwartete relative Veränderung der primären Kennzahl in Prozent.
Einfachheit: Zeit und Aufwand für Design, Umsetzung und Qualitätssicherung der Änderung.z
Bei der Priorisierung kann die Auswertung von Conversion-Daten aus früheren Tests dabei helfen, zu entscheiden, welche Ideen als Nächstes getestet werden sollten.
Setzen wir das in die Praxis um.
Angenommen, du möchtest eine Leiste mit Kundenlogos, ein kürzeres Formular und eine neue Hero-Überschrift testen. Wenn Heatmap-Daten zeigen, dass Besucher beim kürzeren Formular seltener abbrechen, und die Umsetzung 1 Tag dauert, wird es wahrscheinlich höher priorisiert. Nimm dir vor, deine ersten 3 Tests innerhalb von 14 Tagen zu starten, um Schwung aufzubauen.
Elemente, Die Du Auf Einer Landingpage Testen Kannst
Wir alle wissen, dass die Optimierung für höhere Conversion-Raten entscheidend ist – aber wo genau solltest du anfangen?
Das Geheimnis besteht darin, die Landingpage-Elemente zu ermitteln, die den größten Einfluss auf die Interaktion und Entscheidungsfindung der Nutzer haben. Denn ohne gut optimierte Elemente riskierst du, potenzielle Kunden in entscheidenden Momenten zu verlieren, Conversions zu verpassen und Besucher nicht in zahlende Kunden zu verwandeln.
Bleib also dabei, während ich mehrere Schlüsselelemente vorstelle, die du testen kannst, um die Wirksamkeit deiner Landingpage zu steigern und mehr Conversions zu erzielen:
Überschriften: Deine Überschrift ist oft der erste Eindruck, den Besucher von deiner Seite bekommen! Durch das Testen verschiedener Überschriften findest du heraus, welche Botschaft wirklich Aufmerksamkeit erregt und Nutzer bei der Stange hält, anstatt sie abspringen zu lassen. Eine Fitnessmarke könnte zum Beispiel „Verwandle deinen Körper in 30 Tagen“ gegen „Werde schnell fit mit unserem bewährten System“ testen, um herauszufinden, welche Botschaft bei ihrer Zielgruppe besser ankommt.
Handlungsaufforderungen (CTAs): Formulierung, Farbe, Größe und Platzierung deiner CTA-Buttons können Klick- und Conversion-Raten erheblich beeinflussen. Unterschätze nicht, wie wertvoll Tests mit Varianten wie „Jetzt starten“, „Kostenlos registrieren“ oder „Angebot sichern“ sind. Vermeide außerdem zu allgemeine Formulierungen. Ein allgemeiner „Absenden“-Button hat oft weniger Wirkung als „Meine kostenlose Testversion freischalten“. Letzteres vermittelt Dringlichkeit und kommuniziert den Mehrwert klar.
Bilder und Videos: Visuelle Elemente sind entscheidend, um die Interaktion der Nutzer zu fördern und den Mehrwert innerhalb von Sekunden zu vermitteln. Teste verschiedene Hero-Bilder, Erklärvideos oder Produktaufnahmen, um herauszufinden, was bei deiner Zielgruppe wirklich ankommt. Ein Softwareunternehmen könnte testen, ob Bilder zufriedener Kunden bei der Nutzung des Produkts oder die tatsächliche Benutzeroberfläche in Aktion besser funktionieren.
Opt-in-Formulare: Interessant: Die Anzahl der Formularfelder, ihre Reihenfolge und die abgefragten Informationen können sich erheblich auf die Einreichungen des Formulars auswirken. Kürzere Formulare reduzieren häufig Hürden und sorgen für mehr Leads. Das richtige Gleichgewicht hängt jedoch vollständig von deinem konkreten Angebot und den Erwartungen deiner Zielgruppe ab.
Social Proof: Kundenstimmen, Sternebewertungen, die Anzahl von Rezensionen und Vertrauenssiegel verändern grundlegend, wie du Glaubwürdigkeit aufbaust und Bedenken abbaust. Teste verschiedene Arten und Platzierungen von Social Proof, um herauszufinden, was bei deinen Besuchern das meiste Vertrauen schafft. Eine Kundenstimme direkt neben deinem CTA kann beispielsweise ganz andere Ergebnisse erzielen als eine prominente Platzierung am oberen Seitenrand.
Countdown-Timer: Mit Countdown-Timern oder zeitlich begrenzten Angeboten Dringlichkeit zu erzeugen, kann Nutzer äußerst wirksam zum schnellen Handeln motivieren. Doch es gibt einen Haken: Du musst testen, ob solche Dringlichkeitselemente tatsächlich die Conversions erhöhen oder auf deine konkrete Zielgruppe zu aggressiv wirken. Was bei einem Blitzangebot funktioniert, kann bei einer Testversion für B2B-Software aufdringlich wirken.
Preispunkte: Wie du Preise, Rabatte oder Zahlungsoptionen präsentierst, kann Conversion-Raten erheblich beeinflussen. Teste verschiedene Preisdarstellungen, Zahlungspläne oder Nutzenversprechen, um herauszufinden, was deinem Unternehmen mehr Conversions bringt. Teste beispielsweise „$99/Monat“ gegen „Weniger als $25 pro Woche“ – die psychologische Wirkung kann bemerkenswert sein!
Mit Split-Tests oder multivariaten Tests kannst du systematisch mit diesen Landingpage-Elementen experimentieren und herausfinden, welche Kombinationen für deine Marketingkampagnen die besten Ergebnisse liefern. Jeder Test wird zu einer Goldgrube wertvoller Erkenntnisse über das Kundenverhalten und hilft dir, deine Landingpages für maximale Wirkung und maximalen ROI zu optimieren.
Denk daran: Optimierung ist eine fortlaufende Reise und kein einmaliges Ziel!
Varianten Für Deinen Test Erstellen
Tauchen wir in die spannende Welt der Erstellung wirksamer Varianten ein.
Okay, vielleicht ist sie nicht ganz so spannend, aber sie ist das Herzstück von A/B-Tests für Landingpages!
Der Prozess beginnt mit deiner ursprünglichen Landingpage, die wir, falls du dich erinnerst, als Kontrollversion bezeichnen. Um nun eine Variante zu erstellen, änderst du nur ein Element (aus der obigen Liste), während alle anderen Aspekte der Seite exakt gleich bleiben.
Behalte bei der Erstellung von Varianten stets deine Zielgruppe und die konkrete Handlung im Blick, die sie ausführen soll. Erstelle und teste deine Landingpages in involve.me, dem KI-Quiz-Funnel-Builder mit integrierter E-Mail-Automatisierung, und nutze Tools wie Google Analytics oder spezialisierte A/B-Test-Plattformen, um die Leistung jeder Version anhand entscheidender Kennzahlen wie Conversion-Raten, Absprungraten und Nutzerinteraktionen zu verfolgen.
Landingpages mit involve.me erstellen und A/B-testen
Termin-Funnel Vorlage
Whitepaper-Download Vorlage
Website-ROI-Rechner Vorlage
Jeweils Eine Variable Testen: Warum Und Wie
Sehen wir uns genauer an, warum ich „nur ein Element“ oben. Mit diesem fokussierten Ansatz, den wir als Testen einer einzelnen Variable bezeichnen, kannst du die Auswirkung dieser einen Änderung auf deine Conversion-Rates isolieren. Und glaub mir: Genau diese Präzision macht den entscheidenden Unterschied!
Doch an diesem Punkt machen viele Unternehmen einen Fehler: Wenn du mehrere Elemente gleichzeitig änderst, lässt sich unmöglich feststellen, welche Änderung sich positiv oder negativ auf die Performance deiner Landingpage ausgewirkt hat. Indem du Variablen isolierst, stellst du sicher, dass deine Testergebnisse statistisch signifikant und praktisch verwertbar sind, anstatt auf Zufall oder Störfaktoren zu beruhen, die deine Optimierungsmaßnahmen in die falsche Richtung lenken könnten.
Ein perfektes Beispiel veranschaulicht das: Wenn du testen möchtest, ob eine neue Überschrift die Zahl der Anmeldungen erhöht, sollte sich deine Variante nur durch den Text dieser Überschrift von der ursprünglichen Landingpage unterscheiden. Alle anderen Elemente der Landingpage, von Bildern bis zu Formularfeldern, müssen unverändert bleiben. So kannst du jeden Performance-Unterschied zwischen der Kontrollversion und der veränderten Version zuverlässig auf die geänderte Überschrift zurückführen – und genau diese klare Erkenntnis suchst du!
Wie setzt du diesen Ansatz also um? Ich erkläre es dir Schritt für Schritt:
Wähle ein Element zum Testen aus: zum Beispiel den Text des CTA-Buttons, der deine Conversions fördert.
Erstelle eine Variante deiner Landingpage, die bis auf das ausgewählte Element mit dem Original identisch ist.
Teile Website-Besucher nach dem Zufallsprinzip auf die Kontrollversion und die Variante auf, um einen fairen Test zu gewährleisten.
Verfolge die Performance und konzentriere dich dabei auf deine primäre Conversion-Kennzahl.
Analysiere die Ergebnisse, um festzustellen, ob die Änderung zu einer statistisch signifikanten Verbesserung der Conversion-Rates geführt hat, auf die du dich verlassen kannst.
Dieser konsequente Ansatz ist entscheidend, um das Kundenverhalten zu verstehen, die Nutzerinteraktion zu verbessern und datenbasierte Entscheidungen zu treffen, die deine Landingpage-Conversion-Rates kontinuierlich steigern! Wenn du im Laufe der Zeit jeweils nur ein Element testest, schaffst du eine grundsolide Basis aus verlässlichen Erkenntnissen. So kannst du Landingpages souverän und präzise optimieren und damit für dein Unternehmen wirklich etwas bewirken.
Berechnung Von Stichprobengröße, Teststärke Und Testdauer
Teststärke und Stichprobengröße bestimmen, ob dein Ergebnis vertrauenswürdig ist.
Kurzer Einschub zu den Begriffen:
Alpha bezeichnet das Risiko, das du bereit bist zu akzeptieren, dass deine Ergebnisse falsch positiv
Beta bezeichnet das Risiko, das du bereit bist zu akzeptieren, dass deine Ergebnisse falsch negativ
Teststärke ist die Wahrscheinlichkeit, dass dein A/B-Test einen echten Unterschied zwischen den Varianten aufdeckt (sie ergibt sich normalerweise aus 100% minus deinem Beta)
Minimal nachweisbarer Effekt, kurz MDE, ist der kleinste relative Anstieg, den du nachweisen möchtest. Logischerweise erfordert ein kleinerer MDE größere Stichproben, während ein größerer MDE schneller getestet werden kann.
Als Richtwert setzen die meisten Teams Alpha auf 5%, Beta auf 20% und die Teststärke auf 80%.
Bei einer grundlegenden Conversion-Rate von 3%, einer Teststärke von 80%, einem Alpha von 5% und einem angestrebten relativen Anstieg von 20% auf 3.6% benötigst du für einen klassischen Z-Test für Anteilswerte ungefähr 100,000 Besucher pro Variante. Diese Größenordnung ergibt sich aus einer Standardformel für die Stichprobengröße und stimmt mit gängigen Rechnern überein. Wenn deine Landingpage 20,000 Sitzungen pro Woche erhält, ergeben sich bei einer Aufteilung von 50 zu 50 pro Variante und Woche 10,000 Sitzungen. Du würdest etwa 10 Wochen benötigen, um diese Stichprobengröße zu erreichen.
Mit einem Rechner für statistische Signifikanz kannst du ermitteln, ob deine Testergebnisse aussagekräftig und statistisch valide sind.
Lege Alpha und Teststärke vor dem Start fest.
Verwende für den MDE einen Prozentsatz, der zum geschäftlichen Nutzen passt.
Berechne die Dauer anhand deines tatsächlichen Traffics und deiner Conversion-Rate.
Behalte noch eine weitere Regel im Hinterkopf. Lass Tests mindestens einen vollständigen Geschäftszyklus lang laufen, um das Verhalten an Wochentagen und Wochenenden zu erfassen. Viele Fachleute empfehlen mindestens 2 Wochen, sofern du die erforderliche Stichprobengröße nicht erst später erreichst. Das trägt dazu bei, Fehlinterpretationen aufgrund saisonaler Schwankungen zu reduzieren. Wenn dein Traffic sprunghaft ansteigt, berechne die Werte nach der Hälfte der Zeit neu und überprüfe den Plan.
Testeinrichtung, Qualitätssicherung Und SEO-sichere Umsetzung
Eine saubere Umsetzung ist wichtig, und Schwierigkeiten können auftreten. Deshalb solltest du sie einplanen.
Ein clientseitiger Test kann beispielsweise einen Flackereffekt verursachen, bei dem Nutzer kurz die Kontrollversion sehen, bevor die Variante angewendet wird. Dieses Aufblitzen kann Nutzer stören und die Ergebnisse verzerren. Verhindere das mit einem synchronen Preloader oder einem empfohlenen Code-Snippet zum Ausblenden, damit keine sichtbaren Änderungen auftreten, bevor die Variante bereit ist. Halte die Ausblenddauer kurz, häufig unter 500 Millisekunden.
A/B-Tests sollten deine Suchmaschinen-Performance nicht beeinträchtigen, solange du die Richtlinien der Suchmaschinen befolgst. Verwende 302-Weiterleitungen für kurzfristige Tests, halte die Seiteninhalte für Crawler konsistent und setze bei Bedarf rel=canonical auf die ursprüngliche URL. Verschleiere keine Inhalte und zeige dem Googlebot keine andere Nutzererfahrung als den Besuchern. Google erklärt bereits seit 2012, dass Tests innerhalb dieser Grenzen unproblematisch sind. Wenn deine Landingpages ausschließlich für Anzeigen bestimmt sind, kannst du ihre Indexierung vollständig unterbinden.
Weitere Schritte für reibungslose A/B-Tests:
Führe für die Varianten eine QA (Qualitätssicherung) in mindestens 3 Browsern und auf 2 Gerätetypen durch.
Validiere Analyse-Events sowohl für die Kontrollversion als auch für die Variante.
Prüfe, ob UTM-Parameter im gesamten Funnel erhalten bleiben.
Vergewissere dich, dass Formularfehler und Validierung weiterhin funktionieren.
Überprüfe bei 5 Testinteraktionen, wie oft Pixel und Tags ausgelöst werden.
Vor dem Start kannst du folgenden Praxistest durchführen: Sende über dein Lead-Formular für jede Variante 10 fingierte Einreichungen ab. Vergewissere dich, dass die 20 Leads mit den richtigen Variantenkennzeichnungen in deinem CRM erscheinen. So vermeidest du später eine unübersichtliche Zuordnung.
Den Test Ohne Verzerrungen Durchführen
Während eines A/B-Tests für eine Landingpage können verschiedene Faktoren die Ergebnisse verzerren.
Wenn du beispielsweise vorzeitig Ergebnisse prüfst und den Test früh beendest, kann das die Zahl falsch positiver Ergebnisse erhöhen. Dieser Effekt ist erheblich.
Das kann bei frequentistischen Tests passieren – häufig dem meistgenutzten Ansatz für A/B-Tests.
Kurz gesagt geht ein frequentistischer A/B-Test davon aus, dass es keinen Unterschied zwischen Version A (der Kontrollversion) und Version B (der Variante) gibt. Das ist die Nullhypothese. Anschließend werden Daten erfasst und ein P-Wert (der Wahrscheinlichkeitswert) berechnet. Er zeigt dir, wie wahrscheinlich deine Ergebnisse sind, wenn tatsächlich kein Unterschied besteht. Je kleiner der P-Wert ist, desto wahrscheinlicher besteht tatsächlich ein Unterschied. Liegt der P-Wert am Ende des Experiments unter einem zuvor festgelegten Schwellenwert (zum Beispiel 0.05), verwirfst du normalerweise die Nullhypothese und schließt daraus, dass ein statistisch signifikanter Unterschied besteht.
Das Problem entsteht, wenn du die Daten wiederholt prüfst und den Test beendest, sobald der P-Wert unter 0.05 fällt, anstatt bis zum Ende des Experiments zu warten. Dadurch entstehen irreführende Ergebnisse, und abhängig davon, wie häufig du nachsiehst, kann sich deine tatsächliche Rate falsch positiver Ergebnisse verdoppeln. Lege unbedingt eine Abbruchregel auf Grundlage einer zuvor festgelegten Stichprobengröße und Dauer fest und halte dich daran. Während des Experiments darfst du nicht vorzeitig in die Daten schauen.
Du solltest außerdem auf ein Missverhältnis der Stichprobenverteilung (SMR) achten. Ein SRM tritt auf, wenn die beobachtete Traffic-Aufteilung stärker als zufällig zu erwarten von deiner beabsichtigten Aufteilung von 50 - 50 abweicht. Ursachen für ein SRM sind unter anderem Fehler beim Targeting, Werbeplattformen, die den Traffic verzerren, oder Messfehler. Du kannst ein SRM mit einem Chi-Quadrat-Test der Zuweisungen erkennen und den Test stoppen, wenn er anschlägt. Diese schnelle Prüfung erspart dir wochenlang fehlerhafte Daten. Als einfache Regel sollte deine Traffic-Aufteilung nur wenige Prozentpunkte vom Plan abweichen.
Zusammengefasst:
Lege deine Abbruchkriterien vor Tag 1 verbindlich fest (insbesondere bei Verwendung der frequentistischen Statistikmethode).
Prüfe SRM und Datenqualität täglich zu einer festen Uhrzeit.
Führe ein Änderungsprotokoll, um Änderungen während des Tests zu vermeiden.
Sei vorsichtig: Eine einzige unbemerkte Tag-Änderung während des Tests kann 100% deiner Daten unbrauchbar machen. Bestimme eine verantwortliche Person, die jede Änderung genehmigen muss. Wenn sich etwas ändert, pausiere den Test und starte ihn mit einer neuen Stichprobe von vorn.
Ergebnisse Analysieren Und Die Richtige Entscheidung Treffen
Primäre Kennzahl Und Signifikanz
Analysiere nach Abschluss des Tests zuerst ausschließlich die vorab ausgewählte primäre Kennzahl.
Zurück zum frequentistischen Test.
Wenn der P-Wert unter deinem Alpha-Schwellenwert liegt, häufig 0.05, und deine Kontrollmetriken unauffällig sind, hast du einen statistischen Erfolg erzielt. Gib den absoluten Unterschied und den relativen Anstieg an. Der Anstieg von 3.0% auf 3.6% entspricht beispielsweise 0.6 Prozentpunkten oder einem relativen Anstieg von 20%.
Eine statistische Analyse ist unerlässlich, um Testergebnisse zu interpretieren und sicherzustellen, dass du statistisch signifikante Ergebnisse erzielst, an denen du deine Entscheidungen ausrichten kannst.
Mehrfachvergleiche Und Korrekturen
Achte bei Mehrfachvergleichen auf das erhöhte Risiko falsch positiver Ergebnisse. Wenn du drei Varianten mit der Kontrollversion vergleichst, steigt die Wahrscheinlichkeit eines falsch positiven Ergebnisses.
Das Testen mehrerer Varianten oder Landingpage-Varianten erfordert sorgfältige Anpassungen, damit deine Ergebnisse valide bleiben. Verwende eine Korrekturmethode wie Bonferroni, um deinen Signifikanzschwellenwert anzupassen, wenn du viele Vergleiche gleichzeitig durchführst. Wenn du A mit B, C und D vergleichst, würdest du dein Alpha für jeden Test anpassen (denk daran, dass dies das Risiko falsch positiver Ergebnisse ist, das du zu akzeptieren bereit bist), damit deine Gesamtrate falsch positiver Ergebnisse in der Nähe deines ursprünglichen Alphas bleibt.
Für die Bonferroni-Korrektur wird dein ursprüngliches Alpha durch die Anzahl der durchgeführten Tests geteilt.
Bei einem ursprünglichen Alpha von 0.05 und 10 Tests läge das neue Signifikanzniveau für jeden Test beispielsweise bei 0.005 (0.05/10)
Fazit:
Gib absolute und relative Unterschiede gemeinsam an.
Zeige 95%-Konfidenzintervalle für deine Schätzwerte. Die statistische Signifikanz zeigt dir, ob die beobachteten Unterschiede wahrscheinlich real oder zufallsbedingt sind.
Halte Hypothese, Aufbau und Entscheidung in einer einseitigen Zusammenfassung fest.
Hier ist ein kurzes Beispiel. Dein Test mit vier Gruppen zeigt für Variante C einen relativen Anstieg von 12% bei einem P-Wert = 0.03. Nach einer Bonferroni-Korrektur für drei Vergleiche liegt dein angepasster Schwellenwert bei ungefähr 0.0167. Variante C überschreitet diese Hürde nun nicht mehr. Du würdest dies als Indiz und nicht als eindeutigen Erfolg werten und den Test erneut durchführen oder das Ergebnis mit einem Folgetest bestätigen.
Mehr Als A/B: Bandits Und Personalisierung
Klassische A/B-Tests dienen der Exploration. Mit einer festen Aufteilung maximieren sie den Erkenntnisgewinn.
Multi-Armed Bandits dienen der Exploitation. Sie leiten mehr Traffic zu den aktuell führenden Varianten, um während des Tests mehr Conversions zu erzielen. Bandits sind für kurzlebige Kampagnen nützlich, bei denen du ein bis zwei Wochen Zeit hast und dir unmittelbare Ergebnisse wichtig sind. Sie eignen sich weniger, wenn langfristige Erkenntnisse dein Ziel sind.
Personalisierung weist Erlebnisse zu anhand von Zielgruppenmerkmalen wie Gerät, Quelle oder Phase im Kundenlebenszyklus. Sie benötigt mehr Traffic pro Segment, um eine ausreichende Teststärke zu erreichen. Als grober Richtwert sollte jedes Segment im Testzeitraum mindestens einige Tausend Besucher pro Variante haben. Wenn deine Seite 60,000 Sitzungen pro Monat erhält und du sie auf 3 Segmente aufteilst, bleiben bei einer Aufteilung von 50 zu 50 pro Variante und Segment 10,000 übrig.
Nutze A/B-Tests, wenn du belastbare Schlussfolgerungen und stabile Erkenntnisse gewinnen möchtest.
Nutze Bandits für zeitlich begrenzte Aktionen oder wenn entgangene Erträge eine Rolle spielen.
Nutze Personalisierung, wenn sich die Absichten der Segmente deutlich unterscheiden.
Ein schneller Filter hilft: Wenn ein Segment weniger als 10% deines gesamten Traffics ausmacht und du monatlich 20,000 Sitzungen erhältst, sind das 2,000 Sitzungen pro Monat. Bei einer Baseline von 3% ergeben sich daraus monatlich 60 Conversions. Dieses Volumen ist möglicherweise zu gering für zuverlässige Tests in diesem Segment.
Performance-, Mobil- Und UX-Faktoren, Die Conversions Beeinflussen
Geschwindigkeit ist bei Landingpages wichtig. Das wissen wir alle.
Überraschender ist jedoch, wie stark sich selbst eine kleine Geschwindigkeitssteigerung auswirken kann.
Eine Deloitte-Studie im Einzelhandel und in der Reisebranche ergab, dass eine Verbesserung der Website-Geschwindigkeit um 0.1 Sekunden in kontrollierten Analysen die Conversion-Rate im Einzelhandel um bis zu 8.4% und in der Reisebranche um bis zu 10.1% steigerte.
Die Verbesserung des Largest Contentful Paint und die Reduzierung blockierender Skripte sind praktische Ausgangspunkte. Behandle Geschwindigkeitsänderungen als separaten Test oder nutze Kontrollgruppen, wenn du sie breit ausrollst. Berücksichtige bei der Optimierung deiner Webseite sowohl Geschwindigkeit als auch Designelemente, um die Interaktion der Nutzer zu maximieren.
Gestalte für die Geräte, die deine Besucher am häufigsten verwenden.
Mobilgeräte machen inzwischen den Großteil des weltweiten Web-Traffics aus und lagen in den vergangenen Jahren bei rund 59%. Achte besonders auf mobile Nutzer, da sich ihr Verhalten und ihre Präferenzen deutlich von denen der Desktop-Besucher unterscheiden können. Das bedeutet, Navigation, Tippflächen und Inhaltslayout für kleinere Bildschirme zu optimieren:
Stelle sicher, dass der ohne Scrollen sichtbare Inhalt auf gängigen Viewports innerhalb von 600 bis 800 Pixeln eine klare Überschrift, Vertrauensbelege und einen einzigen Call-to-Action priorisiert.
Teste Tippflächen und Feldeingaben für Daumen statt für Mauszeiger.
Experimentiere zur weiteren Verbesserung von Interaktion und Conversions mit unterschiedlichen Layouts und Seitenlayouts und passe dabei die Positionierung von Formularen, Personalisierungsfunktionen und die visuelle Hierarchie an.
Komprimiere Hero-Bilder nach Möglichkeit auf unter 200 Kilobyte.
Beschränke Drittanbieter-Tags auf die 5, die einen klaren Mehrwert bieten.
Verwende für Fließtext eine Schriftgröße von mindestens 16 Pixeln.
Das kannst du noch heute umsetzen: Lade deine Analyse- und Tag-Manager-Tools erst nach der Einwilligung, stelle nicht kritische Skripte zurück und wechsle zu einem modernen Bildformat wie WebP. Miss die Conversion jeweils 14 Tage davor und danach. Bei sauberer Umsetzung sollten sich sowohl die Kennzahlen als auch die Lighthouse-Werte verbessern.
Bewährte Testideen Mit Beispielen
Einige Erfolgsmuster tauchen bei Landingpage-Experimenten häufig auf: Weniger Hürden in Formularen, klarere Überschriften, relevante soziale Vertrauensbelege und eine bessere visuelle Hierarchie sind meist hilfreich.
Garantien sind das jedoch nicht. Jede Zielgruppe reagiert anders.
Dennoch sind die folgenden Ideen für die meisten Teams gute Ausgangspunkte. Die Konzentration auf die wesentlichen Elemente deiner Landingpage ist entscheidend, um die Wirksamkeit deiner Tests zu maximieren.
Entferne oder minimiere die obere Navigation auf fokussierten Landingpages zur Lead-Generierung. Yuppiechef steigerte beispielsweise in einem kontrollierten Experiment die Zahl der Neuanmeldungen, nachdem die Navigationsleiste auf einer Landingpage entfernt worden war, und meldete in diesem Kontext eine Steigerung um 100% (deine Ergebnisse können je nach Traffic-Qualität und Angebot abweichen).
Verdeutliche den Nutzen in der Überschrift: Formuliere in unter 12 Wörtern einen einfachen Vorteil plus Ergebnis. Die Optimierung der Texte deiner Landingpage ist entscheidend für Interaktion und Conversions.
Verkürze Formulare: Reduziere die Felder nach Möglichkeit auf maximal 4. Das Testen der Formularlänge ist ein wichtiger Faktor zur Verbesserung der Conversion-Rates. Wenn dein Formular lang sein muss, unterteile es in mehrere Schritte.
Füge Vertrauensbelege hinzu: Kundenlogos, Anzahl der Bewertungen oder konkrete Ergebnisse mit Zahlen.
Verbessere die Hierarchie: ein primärer CTA und höchstens eine sekundäre Aktion.
Reduziere Ablenkungen: Entferne nicht notwendige Links und Karussells.
Der Aufbau einer Landingpage mit hoher Conversion-Rate
Teste dies in deinem eigenen Kontext. Wenn die Abschlussrate deines Lead-Formulars beispielsweise bei 28% liegt, teste das Entfernen von zwei nicht erforderlichen Feldern. Steigt sie dadurch auf 32%, entspricht das einer relativen Steigerung von 14.3%. Stelle sicher, dass die Lead-Qualität stabil bleibt, indem du die nachgelagerte Conversion zu qualifizierten Verkaufschancen verfolgst. Diese Verbesserungen können sich positiv auf die Gesamtleistung deiner Kampagne auswirken.
Bezahlten Traffic Zu Erfolgreichen Varianten Leiten
Bezahlte Medien verstärken den Wert valider Testergebnisse. Weise bewährten Seiten mehr Budget zu und pausiere leistungsschwache Seiten.
Behandle deine A/B-Tests als Checkliste vor dem Start, bevor du eine Kampagne skalierst. Bevor du die Ausgaben erhöhst, solltest du unbedingt Landingpage-Tests durchführen, um die leistungsstärksten Varianten zu ermitteln.
Social-Media-Anzeigen sind ein effektiver bezahlter Kanal, um Traffic zu deinen Landingpage-Tests zu leiten. Sie ergänzen kostenlose Quellen und stellen genügend Daten für präzise A/B-Tests sicher. Diese Feedbackschleife kann deine Kundenakquisitionskosten je nach Unterschied zwischen den Varianten um 10% bis 30% verändern.
Ein Wort der Vorsicht: Verhindere, dass Werbeplattformen den Test während der Lernphasen verzerren. Einige Plattformen führen eigene Experimente durch, was zu Verschiebungen bei der Zuweisung führen kann. Um Verzerrungen zu begrenzen, solltest du während deines Landingpage-Tests weder Werbemittel noch Budgets ändern. Halte die Anzeigengruppe 14 Tage lang stabil und ändere danach jeweils nur eine Variable. Wenn du Budgets um mehr als 20% ändern musst, starte die Testdauer neu.
Ordne jede Anzeigengruppe einer einzigen Landingpage-Variante zu.
Verwende für alle Werbemittel einheitliche UTM-Parameter.
Schließe markenbezogene Suchanfragen aus, wenn du die Leistung bei kaltem Traffic testest.
Angenommen, du betreibst für eine markenunabhängige Kampagne zwei Google-Ads-Landingpages mit einer Baseline-Conversion-Rate von 4%. Variante B erreicht 4.8%. Dieser Zuwachs um 0.8 Prozentpunkte kann bei gleichem CPC die Kosten pro Lead um 16.7% senken. Investiere diese Einsparungen erneut in Keywords mit höherer Kaufabsicht, um zusätzliches Volumen zu erzielen.
Programmrhythmus, Dokumentation Und Erwartete Erfolgsquoten
Ein gleichmäßiger Rhythmus ist wichtig, denn er fördert Erkenntnisse und Vertrauen. Strebe einen wöchentlichen oder zweiwöchentlichen Startrhythmus an, auch wenn einige Tests länger laufen.
Ermutige dein Team, regelmäßig eigene Tests durchzuführen, um eine Kultur des Experimentierens und der kontinuierlichen Verbesserung zu fördern. Pflege für jedes Experiment eine zentrale verlässliche Informationsquelle: Hypothese, Screenshots, Daten, Traffic, Kennzahlen und Entscheidungen. Dieses Protokoll verhindert, dass du dieselben Ideen erneut testest, und bewahrt das Wissen deines Unternehmens.
Setze realistische Erwartungen an die Erfolgsquoten. Große Unternehmen, die Tausende Experimente durchführen, berichten, dass viele Ideen die zentralen Kennzahlen nicht beeinflussen. Öffentliche Quellen legen sogar nahe, dass je nach Produkt und Kennzahlenmix nur 10% bis 20% der Experimente in großem Maßstab positive Ergebnisse liefern.
Das ist normal.
Was bedeutet das für dein Team? Plane 5 bis 10 Tests ein, um 1 überzeugenden Erfolg zu erzielen.
Verpflichte dich zu mindestens 2 Tests pro Monat und wichtigem Funnel.
Besprich die Erkenntnisse jede Woche 30 Minuten lang mit den Stakeholdern.
Archiviere fehlgeschlagene Tests mit einer Erkenntnis in einer Zeile, um Wiederholungen zu vermeiden.
Wenn dein monatlicher Traffic beispielsweise 3 parallele Tests ermöglicht, begrenze deine Warteschlange auf 9 Ideen. So bleibt die Pipeline fokussiert. Nutze bei der Planung deiner Test-Pipeline die Erkenntnisse aus früheren Experimenten für jeden neuen Test, damit jede Iteration einen klaren Zweck erfüllt und auf bisherigen Ergebnissen aufbaut. Jeder Test sollte mit einer klaren Kennzahlenverknüpfung auf 1 deiner 3 Quartalsziele einzahlen.
Häufige Fallstricke Und Wie Du Sie Vermeidest
Einige wiederkehrende Fehler bei A/B-Tests verschwenden Zeit und untergraben das Vertrauen. Der häufigste Fehler besteht darin, einen Test beim ersten positiven Anzeichen zu stoppen. Danach folgt das Ändern der Traffic-Quellen während des Tests. Ebenfalls häufig werden fehlerhafte Varianten bereitgestellt, die Conversions nicht korrekt erfassen.
Jeder dieser Fehler kann Ergebnisse ungültig machen oder dazu führen, dass du die falsche Version veröffentlichst. Fehler wie falsch positive Ergebnisse (Fehler vom Typ I) und falsch negative Ergebnisse (Fehler vom Typ II) sind typisch. Daher sind eine sorgfältige Planung und das Verständnis statistischer Prinzipien entscheidend, um diese Fallstricke zu vermeiden.
Nutze eine kurze Checkliste, um das Risiko zu reduzieren:
Wie bereits erläutert, solltest du nicht vorzeitig in die Ergebnisse schauen und eine auf der Teststärke basierende Laufzeit verwenden, um falsch positive Ergebnisse zu vermeiden.
Prüfe Abweichungen im Stichprobenverhältnis, um verzerrte Aufteilungen frühzeitig zu erkennen.
Führe den Test mindestens über einen Geschäftszyklus durch, um das Verhalten an Wochentagen und Wochenenden abzudecken. Bei Landingpages mit mäßigem Traffic bedeutet das häufig 2 Wochen oder länger.
Bearbeite die Varianten nach dem Teststart nicht mehr, damit deine Split-Tests sauber und die Ergebnisse valide bleiben.
Füge während der Laufzeit keine neuen Traffic-Quellen hinzu.
Validiere Analyse und Tracking in beiden Testgruppen, um die Integrität deiner Split-Tests zu wahren.
Definiere deine Grenzwerte für Schutzmetriken im Voraus.
Hier ist ein kurzes Diagnosebeispiel. Wenn deine vorgesehene Aufteilung 50 zu 50 beträgt, du nach 10,000 Besuchern aber 57 zu 43 siehst, führe eine SRM-Prüfung durch. Wenn sie ein Zuweisungsproblem meldet, pausiere den Test und untersuche deinen Router, dein Geo-Targeting oder deine Anzeigeneinstellungen. Behebe zuerst das Problem und starte dann mit einer sauberen Ausgangslage neu.
Testerfolge in Dauerhafte Verbesserungen Verwandeln
Die Veröffentlichung einer erfolgreichen Variante ist der Anfang, nicht das Ende.
Überwache die bereitgestellte erfolgreiche Variante mindestens 2 bis 4 Wochen lang weiter. Achte auf Neuheitseffekte, eine Regression zum Mittelwert oder saisonale Schwankungen. Wenn die Leistung gegenüber dem Experimentergebnis um 10% sinkt, erwäge einen Folgetest, um die Stabilität zu bestätigen.
Entwickle sie dann weiter.
Erfolgreiche Varianten werfen neue Fragen auf. Wenn ein kurzes Formular gewinnt, teste als Nächstes die konkrete Reihenfolge der Felder. Wenn soziale Vertrauensbelege helfen, teste Quelle, Anzahl und Platzierung. Jeder Erfolg liefert zwei oder drei neue Ideen. Strebe innerhalb von 30 Tagen nach jedem Erfolg 1 Folgetest an, um die Verbesserungen zu festigen und ihre Grenzen auszuloten.
Ziehe einen multivariaten Test in Betracht, um mehrere Variablen gleichzeitig zu untersuchen, insbesondere wenn du verstehen möchtest, wie verschiedene Elemente miteinander interagieren.
Stelle die Änderung hinter einem Feature-Flag bereit, damit du sie bei Bedarf schnell zurücknehmen kannst.
Teste kritische Änderungen alle 6 bis 12 Monate erneut, da sich Zielgruppen verändern.
Teile Ergebnisse und Screenshots in einer monatlichen Besprechung von 30 Minuten.
Ein letztes Beispiel... Dein Headline-Test erzielte eine relative Steigerung von 12%. Du spielst die Variante für 100% des Traffics aus und beobachtest sie 21 Tage lang. Die relative Steigerung hält sich bei 9%. Jetzt testest du, ob konkrete Zahlen im Untertitel die Ergebnisse verbessern. Dieser systematische Kreislauf sorgt über Quartale hinweg für immer größere Erfolge, nicht innerhalb weniger Tage.
Zusammenfassung
Du hast gerade den gesamten A/B-Testing-Workflow für Landingpages durchlaufen, von der Hypothese bis zum Rollout.
Konzentriere dich auf deine primäre Kennzahl, plane deine Stichprobengröße und vermeide Abkürzungen, die Daten verzerren.
Nutze Benchmarks für Plausibilitätsprüfungen und vertraue anschließend deinen eigenen Testergebnissen.
Halte deinen Rhythmus konstant, dokumentiere alles und rechne damit, dass 1 von 5 Tests erfolgreich sein kann.
Wende diese Prinzipien bei deinem ersten Landingpage-Test an. Ermittle die erfolgreiche Variante, ziehe Tests mit mehreren Variablen in Betracht und nutze gegebenenfalls multivariate Tests.
So steigerst du die Conversion-Raten im Laufe der Zeit vom Medianwert von 2.35% in Richtung des Schwellenwerts der besten 10% von 11% plus, sofern der Kontext dies zulässt.
Landingpages schnell erstellen und per A/B-Test optimieren
Kein Programmieren, kein Aufwand, einfach bessere Conversions.
Quellen
Was ist eine gute Conversion-Rate? (Sie ist höher, als du denkst) - WordStream
Benchmarks für E-Commerce-Conversion-Raten – Aktualisierung 2025 - Smart Insights
PXL: Eine bessere Methode zur Priorisierung deiner A/B-Tests - CXL
Rechner für die Stichprobengröße - Evan Miller
So solltest du einen A/B-Test nicht durchführen - Evan Miller
Die Mindestdauer von Tests verstehen - VWO
Anti-Flicker-Snippets aus A/B-Testing-Tools und Seitengeschwindigkeit - DebugBear
Website-Tests und die Google-Suche - Google Search Central
Auswirkungen von A/B-Tests auf die Google-Suche minimieren - Google Search Central
Kurzanleitung zur Abweichung des Stichprobenverhältnisses (SRM) - Statsig
Bonferroni-Korrektur - Wikipedia
Mehrarmiger Bandit - Optimizely
Millisekunden bringen Millionen - Deloitte
Weltweiter Marktanteil von Desktop-, Mobil- und Tablet-Geräten - Statcounter
A/B-Testing-Fallstudie: Das Entfernen des Navigationsmenüs erhöhte die Conversions um 100% - VWO
Die überraschende Kraft von Online-Experimenten - Harvard Business Review