Personyze
Auf Ihrer Website
Website-PersonalisierungInhalte, Angebote und Layout auf jeden Besucher zugeschnitten — ein Profil über alle Seiten und alle Sitzungen.Empfehlungs-EngineWas jeder Besucher als Nächstes will, sortiert von dem Algorithmus, den Sie wählen oder selbst schreiben.KI-Suche und Chat-AgentAntworten aus Ihren eigenen Seiten und Ihrem Katalog, und eine Suche, die in einem Satz antwortet.Banner & Pop-upsDie richtige Botschaft, im richtigen Moment, auf der richtigen Seite — ohne Entwickler.Social ProofLive-Verfügbarkeit, Bewertungen und was andere gerade getan haben.Dynamische Landing-PagesDie ganze Seite pro Besucher neu zusammengesetzt — Überschrift, Bilder und Angebot aus der geklickten Anzeige und den eigenen Interessen. Auf Seiten, die Sie schon haben.A/B-TestsEin Gewinner pro Zielgruppe, mitten in der Kampagne ausgerollt statt danach.
Außerhalb Ihrer Website
E-Mail-PersonalisierungInhalte und Empfehlungen pro Leser beim Öffnen ausgewählt — aus Personyze versendet oder als ein Block in Ihr E-Mail-Tool eingefügt.Push, SMS und WhatsAppAusgelöst von dem, was sie gerade getan haben, nicht von einem Zeitplan.Gehostete Landing PagesDieselbe Seite pro Besucher, von uns ausgeliefert — Ihre Domain oder unsere, keine Website zum Deployen.
Wissen, wer sie sind
Verhaltensbasiertes TargetingSegmente, die sich selbst aus dem aktualisieren, was Menschen wirklich tun.ABM-MarketingDas Unternehmen hinter einem anonymen Besuch, verknüpft mit Ihrem CRM.Website-AnalyticsSitzungen, Absprünge und Umsatz — dann klicken Sie auf eine Zeile, und da ist ein Mensch.
Bauen und verbinden
MCP-ServerSteuern Sie Ihr Konto aus Claude, ChatGPT oder jedem MCP-Client.APIs, SDKs & AutomationEin REST-Endpunkt über jedes Objekt, Server- und Mobile-SDKs, Regeln und Berichte, die von selbst laufen.IntegrationenHubSpot, Salesforce, Twilio Segment, Tealium, GTM und die REST-API.
PreiseVideosProdukttourKurze Videos mit Sprecher zur echten Plattform – eine Funktion nach der anderen.
← All articles
PersonalisierungSeptember 8, 2026

Gewinner wählen oder nie aufhören zu optimieren: zwei Arten, wie ein A/B-Test entscheidet

P
Personyze TeamPersonalization experts
Gewinner wählen oder nie aufhören zu optimieren: zwei Arten, wie ein A/B-Test entscheidet

Jedes A/B-Testing-Tool stellt dieselbe Frage: Welche Version hat gewonnen? Doch damit können zwei verschiedene Dinge gemeint sein, und sie verlangen zwei verschiedene Arten von Test. Manchmal brauchen Sie eine Antwort — ein Redesign schlägt die alte Seite oder eben nicht, Sie gehen mit einer davon live und machen weiter. Manchmal brauchen Sie einen Verwalter — das Hero-Banner läuft das ganze Jahr, die beste Version im Januar ist nicht die beste im Juli, und niemand wird es jedes Quartal neu testen. Personyze führt beide Arten in derselben Kampagne aus, und die Einstellung, die zwischen ihnen wählt, heißt Wie dieser Test entscheidet. Dieser Beitrag erklärt, was jeder Modus tatsächlich tut, was er Sie kostet und wie Sie wählen.

Gewinner bei Signifikanz wählen
Ein Experiment mit Ende
Tag 1
Tag 7
Tag 14
Gewinner
A gewinnt bei 95 % · übernommen, der Test endet
KI: laufend optimieren
Verwaltung ohne Ende
Nacht 1
Nacht 9
Nacht 30
Nacht 90
Jede Nacht neu verteilt · 10 % erkunden immer · endet nie
Version AVersion BZurückgehalten auf der unveränderten Website

Derselbe Test, auf zwei Arten entschieden. Links bleibt die Aufteilung fest, bis sich eine Version bewährt hat, dann bekommt der Gewinner den getesteten Traffic. Rechts verschiebt sich die Aufteilung jede Nacht ein wenig und hört nie auf.

Zwei Fragen, zwei Arten von Test

Ein klassischer A/B-Test ist ein Experiment. Sie legen die Aufteilung fest, warten, bekommen ein Urteil mit Konfidenzangabe, und der Test ist vorbei. Genau diese Fairness ist der Punkt: Weil sich die Aufteilung nie bewegt hat, ist der Vergleich sauber, und Sie können jedem zeigen, warum Sie so entschieden haben. Der Preis ist, dass die unterlegene Version bis zum Ende ihren vollen Traffic-Anteil erhält und dass das Urteil nur für den Zeitraum gilt, in dem der Test lief.

Die andere Art von Test nennen Statistiker einen Bandit: Statt mit der Entscheidung zu warten, entscheidet er immer wieder neu. Jede Nacht sieht er sich an, was zuletzt passiert ist, und gibt der Version, die gerade am besten abschneidet, etwas mehr Traffic – hält aber immer einen Teil zurück, um weiter zu lernen. Ein Urteil liefert er nie, weil er nie eines braucht. Der Preis ist, dass die Aufteilung der Wirklichkeit immer ein paar Tage hinterherläuft und der Vergleich nicht sauber genug ist, um ihn als Erkenntnis zu veröffentlichen. Das ist in Ordnung, wenn eine Erkenntnis nie das Ziel war.

Gewinner bei Signifikanz wählen: das Experiment

In diesem Modus bleibt der Traffic so, wie Sie ihn eingestellt haben, während die Versionen um Ihre Ziele konkurrieren, und der Test endet, wenn sich eine davon bewährt hat. Was „bewährt“ heißt, legen vier Schwellenwerte fest – und Personyze liefert sie strenger aus als die meisten Tools.

  • Ein oder mehrere Ziele. Das erste gewählte Ziel ist das primäre; Bereitschaft und Gewinnerermittlung richten sich danach. Ein Test, der auf Klicks optimiert, und ein Test, der auf Umsatz optimiert, sind sich nicht immer einig – also legen Sie fest, welches Sie meinen.
  • Konfidenz, Sitzungen, Laufzeit. Drei Voreinstellungen setzen alle drei auf einmal: Vorsichtig mit 99 % Konfidenz, 5.000 Sitzungen und 21 Tagen; Ausgewogen mit 95 %, 1.000 Sitzungen und 14 Tagen; Schnell mit 90 %, 500 Sitzungen und 7 Tagen. Oder Sie tragen eigene Werte ein. Die Mindestlaufzeit verhindert, dass ein guter Dienstag am Dienstag gewinnt.
  • Eine Mindestverbesserung. Vorsichtig verlangt mindestens 1 % Lift, Ausgewogen 0,5 %. Eine Version, die mit einem statistisch echten, aber kommerziell bedeutungslosen Vorsprung führt, wird nicht übernommen.
  • Eine Kontrollgruppe, wenn Sie möchten. Geben Sie der unveränderten Website einen eigenen Anteil — zwei Versionen mit je 45 % und 10 % zurückgehalten —, dann ist der Lift, den Sie berichten, der Lift, den Sie bewirkt haben, und nicht der Lift gegenüber einer Vermutung.

Ist die Hürde genommen, wird der Gewinner übernommen: der gesamte getestete Traffic, der Anteil, den Sie festlegen, oder gar nichts, wenn Sie lieber eine E-Mail bekommen und selbst entscheiden. Eine beibehaltene Kontrollgruppe bleibt zurückgehalten, damit die Kampagne auch nach der Entscheidung messbar bleibt. Dann ist es vorbei – genau das, was Sie davon wollten.

KI: laufend optimieren: der Verwalter

In diesem Modus endet nichts. Jede Nacht bewertet ein Durchlauf jede Version anhand dessen, was zuletzt passiert ist, und verschiebt die Aufteilung zu der, die gerade am besten abschneidet. Drei Eigenschaften machen es sicher, ihn laufen zu lassen.

  • Aktueller Traffic zählt am meisten. Views und Klicks verlieren mit einer Halbwertszeit von 28 Tagen an Gewicht, und alles, was älter als 84 Tage ist, fällt heraus. Eine Version, die vor zwei Monaten die beste war, kann heute trotzdem verlieren – genau darum geht es: Er merkt, wenn sich eine Saison dreht.
  • Er bewegt sich nur mit statistischer Sicherheit. Jede Version erhält eine Chance, die beste zu sein, berechnet aus Tausenden simulierter Wiederholungen der Daten. Nahezu gleiche Zahlen bedeuten, dass die Daten die Versionen noch nicht unterscheiden können, und dann bleibt die Aufteilung stehen. Unter ein paar Hundert gewichteten Views berechnet er überhaupt nichts, denn ein Bandit auf einer Handvoll Sitzungen ist ein Zufallszahlengenerator mit ernster Miene.
  • 10 % erkunden immer. Ein Zehntel des Traffics wird jede Nacht gleichmäßig auf die Versionen verteilt, egal was passiert. Eine unterlegene Version sammelt weiter die Daten, die sie rehabilitieren könnten, keine Version wird je auf null gedrückt, und ein Datenausfall kann keine Version bei 100 % einfrieren.
01 · Zusammenfassen
84 Tage, gewichtetDie bestätigten Views und Klicks jedes Tages, nach 28 Tagen nur noch halb gewichtet. Älter als 84 Tage: verworfen.
02 · Bewerten
Klicks oder mehr pro ViewEine angeklickte Sitzung, die danach konvertiert hat, zählt weiterhin als Klick. Views müssen zu zwei Dritteln sichtbar sein.
03 · Simulieren
Chance, die beste zu seinZehntausend Wiederholungen der Daten. Wie oft eine Version vorn liegt, ist ihre Chance, wirklich die beste zu sein.
04 · Aufteilen
10 % erkunden, der Rest nach ChanceEin Zehntel des Traffics immer gleichmäßig verteilt. Unter 300 gewichteten Views wird nichts berechnet.
05 · Anwenden
Nur wenn es sich wirklich bewegt hatUnter 3 Punkten Veränderung wird nichts geschrieben. Versionen bei 0 % bleiben bei 0 %. Die beibehaltene Kontrollgruppe bleibt zurückgehalten.

Was der nächtliche Durchlauf tut, der Reihe nach. Nur der letzte Schritt greift in die Ausspielung ein, und er schreibt nur, wenn die empfohlene Aufteilung um drei Punkte oder mehr von der aktuellen abweicht.

Zwei weitere Regeln respektieren, was Sie eingestellt haben. Eine Version, die Sie auf 0 % setzen, ist Ihre Entscheidung und kein Datenpunkt, und sie bleibt bei 0 %; erst ein manuell vergebener Anteil nimmt sie wieder auf. Und der Optimierer verteilt nur den Traffic neu, den die Aufteilung bereits zuweist — eine Kampagne, die 10 % für die unveränderte Website zurückhält, hält sie weiter zurück.

Eine ehrliche Einschränkung: Der laufende Modus bewertet Interaktion — Klicks oder mehr pro bestätigtem View, wobei ein Klick, der zu einer Conversion führte, weiterhin zählt —, weil das Signal ist, das dauerhaft laufende Inhalte jeden Tag in großer Menge erzeugen. Geht es Ihnen um den Umsatz pro Sitzung bei einer Änderung im Checkout, ist das eine Frage für das Experiment, ausgerichtet auf genau dieses Ziel.

Welchen sollten Sie wählen?

Gewinner bei Signifikanz wählenKI: laufend optimieren
Die FrageWelche Version ist besser, und um wie viel?Welche Version soll heute Nacht den Traffic bekommen?
Wie es endetMit einem Urteil. Der Gewinner wird übernommen, und der Test endet.Gar nicht. Die Aufteilung folgt weiter den aktuellen Daten.
Traffic während der LaufzeitBleibt genau so, wie Sie ihn eingestellt haben, damit der Vergleich fair ist.Verschiebt sich jede Nacht zum Führenden; 10 % immer gleichmäßig verteilt.
Worauf optimiert wirdJedes Ziel, das Sie wählen: Käufe, Umsatz pro Sitzung, Anmeldungen, Klicks, Absprungrate, Verweildauer.Interaktion: Klicks oder mehr pro bestätigtem View, sodass auch ein Klick zählt, der zu einem Kauf führte.
Geeignet fürEine Entscheidung, die Sie einmal umsetzen: Redesign, Preisseiten-Layout, Checkout-Schritt, Seite gegen Seite.Dauerhaft laufende Inhalte, deren beste Version sich verschiebt: Hero-Banner, Angebote, saisonale Blöcke, beworbene Inhalte.
Kosten eines IrrtumsDie unterlegene Version behält ihren vollen Anteil bis zur Entscheidung, und später können Sie ein veraltetes Ergebnis falsch lesen.Eine kurze Verzögerung: Die Aufteilung läuft der Wirklichkeit Tage hinterher, nie Wochen.
Was Sie begründen könnenKonfidenz, Sitzungen, Laufzeit, Mindestverbesserung: eine Entscheidung, die Sie jedem zeigen können.Eine Chance, die beste zu sein, pro Version, jede Nacht aktualisiert, und die daraus folgende Aufteilung.

Eine Faustregel, die sich bewährt hat: Wäre es Ihnen peinlich, es nächstes Quartal immer noch zu testen, wählen Sie einen Gewinner. Wäre es Ihnen peinlich, damit aufgehört zu haben, optimieren Sie laufend. Eine Preisseite gehört in die erste Gruppe. Ein Hero-Bereich auf der Startseite gehört in die zweite. Und Sie können es sich anders überlegen: Der Modus ist eine Einstellung der Kampagne, die beim Speichern greift, und dieselbe Kampagne kann zuerst als Experiment laufen und dann an den Optimierer übergeben werden, sobald sie zum Inventar gehört.

Es gibt eine Mischform, die man kennen sollte. Der Experimentmodus hat eine Option, die Rotation während des Tests schrittweise zum voraussichtlichen Gewinner zu verschieben. Das führt schneller zu einer Entscheidung, kostet aber einen Teil der Strenge, die das Experiment wertvoll gemacht hat. Nutzen Sie sie für zeitkritische Tests, nicht für die, die Sie später begründen müssen.

Die dritte Lesart: pro Zielgruppe

Beide Modi teilen eine Lesart, die die meisten Tools überhaupt nicht haben. Die Funktion Audience Discovery von Personyze durchsucht Ihre Besucherdaten nach Gruppen, die weit über oder unter dem Durchschnitt konvertieren, und der Test wird in jeder dieser Zielgruppen einzeln bewertet: die Rate pro Version, welche Version dort führt und wie sicher das ist.

Welche Version gewinnt, je Zielgruppe
Land ist USA und Gerät ist kein TelefonGruppe B84 % sicher0.4%0.9%
Seitenaufrufe in “/hotels” mindestens 3Gruppe B70 % sicher0.1%0.2%
Erster Besuch kam direktGruppe A77 % sicher0.2%0.1%
Gerät ist Smartphone und Quelle des ersten Besuchs ist nicht die AppGruppe A86 % sicher0.5%0.0%
Land ist USA und Sitzungen mindestens 2Gruppe A70 % sicher0.2%0.2%

Die Urteile pro Zielgruppe bei einem laufenden Test. Eine Version kann auf der gesamten Website gewinnen und bei den Besuchern verlieren, die direkt kommen, und die Zeilen sagen das – mit der Sicherheit jedes Urteils.

Das verändert, was ein „Gewinner“ ist. B hat insgesamt gewonnen, aber A hat bei Smartphone-Besuchern mit 86 % Sicherheit gewonnen. In einem Tool, das nur die Gesamtzahl berichtet, gehen Sie mit B live und verschlechtern unbemerkt das Smartphone-Erlebnis. Hier benennt der Bericht die Abweichung, und der Kampagneneditor zeigt sie bei jedem Test an, egal in welchem Modus er entscheidet.

Was Sie damit tun, ist heute bewusst einfach gehalten: Die Kampagne spielt weiterhin eine Aufteilung an alle aus. Um auf einen Gewinner pro Zielgruppe zu reagieren, richten Sie eine Kopie der Kampagne mit der gewinnenden Version auf diese Zielgruppe aus. Entdeckte Zielgruppen sind eine Kategorie in der Regelauswahl der Kampagne, das sind also ein paar Klicks. Automatisch eine eigene Aufteilung pro Zielgruppe auszuspielen steht auf der Roadmap, und die Bewertung pro Zielgruppe wird das steuern.

Einrichtung

  1. Fügen Sie im Schritt Inhalt der Kampagne Ihre Versionen als Rotationsgruppen hinzu und legen Sie die Aufteilung fest. Für eine Kontrollgruppe bekommt die Option Unveränderte Website einen eigenen Anteil.
  2. Wählen Sie, wie Besucher zugewiesen werden. Benutzerrotation hält einen Besucher bei jedem Besuch auf derselben Version und ist die richtige Standardeinstellung; Besuche weist jeden Besuch neu zu, für Banner und Überschriften, bei denen die Impression gemessen wird.
  3. Unter Ziele wählen Sie ein oder mehrere Ziele; das erste ist das primäre.
  4. Unter Wie dieser Test entscheidet wählen Sie Gewinner bei Signifikanz wählen und eine Voreinstellung oder KI: laufend optimieren. Speichern.
  5. Lesen Sie das Ergebnis im Schritt Performance ab. Im laufenden Modus zeigt die Tabelle Views, Klicks, die Chance, die beste zu sein, die aktuelle und die empfohlene Aufteilung; darunter, welche Version pro Zielgruppe gewinnt.
Let's talk

Book a demo with a personalization expert

30 minutes with a personalization expert. Bring your stack, your goals, your skepticism. We'll show you what changes when every visit feels like the only one.