Online Marketing
Experimentation

6 min Lesezeit

Testing-Freeze in der Black Week: Wir lernen lieber nichts, dann kann nichts schiefgehen

Viele Shops stoppen ihre A/B-Tests vor Black Friday aus Angst vor Fehlern. Warum das teuer ist, was wirklich riskant ist und wie du die Black Week zum Lernen nutzt.

Von André Morys · Veröffentlicht am 07.10.2026

Inhalt

  • Freeze heißt nicht Sicherheit
  • Die Einwände, und wo sie recht haben
  • Was in der Black Week wirklich riskant ist
  • Was du nur jetzt lernen kannst
  • Der Test, der im Sale nichts brachte
  • Der Fall, der vor schönen Zahlen warnt
  • Das Spielbuch in fünf Punkten
  • Die eine Frage fürs Montagsmeeting

Die schlechte Nachricht kommt meistens im Oktober, und sie kommt höflich. Der Head of E-Commerce oder der Head of CRO meldet sich bei uns: In der Black Week könne man leider nicht testen. Jeder Fehler koste da schließlich Millionen.

Gegen diesen Satz ist schwer anzukommen. Er klingt nach Verantwortung. Wer ihm widerspricht, trägt im Zweifel den Millionenschaden gleich mit. Viel Vergnügen.

Ich halte diesen Reflex für einen der teuersten im E-Commerce. Hier ist der Grund:

Freeze heißt nicht Sicherheit

Freeze klingt nach Vorsicht. Freeze heißt, in der Woche mit dem meisten Traffic des Jahres zu beschließen, nichts zu lernen.

Der Handelsverband HDE rechnete für Black Friday und Cyber Monday 2025 mit 5,8 Milliarden Euro Umsatz. Das ist ein Fenster, in dem so viele kaufwillige Menschen gleichzeitig auf deiner Seite sind wie sonst nie. Genau dann schaltet man das Labor ab.

Für dieses Verhalten gibt es sogar einen Namen: den Zero-Risk Bias. Menschen beseitigen lieber ein kleines Risiko komplett, als ein größeres zu verringern. Hier ist das kleine Risiko der kaputte Test: sichtbar, eskalierbar, mit Namen dran. Das große Risiko ist eine Woche ohne Erkenntnis. Das sieht niemand, denn es kommt nie eine Mail mit dem Betreff „Wir haben diese Woche nichts gelernt“.

Das ist keine Experimentierkultur. Das ist Fehlerkultur. Eine Kultur, die nur testet, solange nichts auf dem Spiel steht, testet nicht. Sie dekoriert.

Die Einwände, und wo sie recht haben

An diesem Punkt taucht meistens ein Einwand auf. Eigentlich sind es vier. Alle haben ein Stück Wahrheit.

„Der Traffic in der Black Week ist doch gar nicht typisch.“ Stimmt. Rabattjäger kaufen anders als Stammkunden an einem Dienstag im März. In der Fachsprache heißt das fehlende externe Validität: Ein Gewinner aus der Black Week muss im Februar nicht gewinnen, wie dieser Artikel zu Recht warnt. Daraus folgt aber nur, dass du die Ergebnisse anders auswertest und große Änderungen später noch einmal bestätigst. Ein Grund zum Aufhören ist es nicht.

„Jeder Fehler kostet in dieser Woche Millionen.“ Auch wahr, zumindest für einen Fehler, den niemand bemerkt. Millionen ist aber eine Zahl, und Zahlen kann man prüfen. Was kostet ein Fehler, der nur einen Teil des Traffics trifft und sich in Minuten abschalten lässt? Was kostet dagegen eine Woche, in der du nichts lernst? Gegen den ersten Fall hilft ein Kill-Switch. Gegen den zweiten hilft kein Freeze, er verursacht ihn.

„Die IT hat Code-Freeze.“ Code-Freeze und Learning-Freeze sind zwei verschiedene Dinge, die gern in derselben Mail bestellt werden. Je nach Setup braucht ein Test keinen Release. Klär das mit der IT, bevor du den Freeze einfach hinnimmst.

„Die Laufzeit ist zu kurz.“ Das ist der stärkste Einwand. Die Black Week 2026 geht vom Montag, 23. November, bis zum Cyber Monday am 30. November. Wer erst am Montag startet, hat genau einen Wochenzyklus, und der reicht für manche Fragen, für andere dagegen nicht, weil er bei schwankendem Traffic wenig Spielraum für Ausreißer lässt. Deshalb gilt: Starte früher. Dann läuft der Test schon, wenn die Black Week beginnt, und geht einfach durch sie hindurch.

Was in der Black Week wirklich riskant ist

Damit das hier kein Dogma wird, die ehrliche Liste:

  • Alles mögliche an der Kampagne ändern

  • Preistests mit Folgen für Marge und Retouren

  • Tests, die du nur mit einem Deployment wieder abschalten kannst

Alles andere hat in dieser Woche mehr Testfläche, als die meisten Teams nutzen.

Was du nur jetzt lernen kannst

Wie Kunden auf Rabatte reagieren, wenn sie wirklich kaufen wollen. Ob ein Bundle zieht, wenn alle nach Schnäppchen suchen. Wo deine Versandkostenschwelle plötzlich zu hoch oder zu niedrig wirkt, weil der Warenkorb in dieser Woche ganz anders aussieht als im Rest des Jahres. Ob Knappheit und Dringlichkeit funktionieren, wenn der Kunde den Zeitdruck ohnehin schon spürt. Diese Fragen kannst du im Februar nicht beantworten. Dort fehlt der Kaufdruck.

Der Test, der im Sale nichts brachte

Ein Beispiel aus dem Winter-Sale 2014/15, nicht aus der Black Week, aber mit derselben Mechanik. Tom Tailor testete drei Varianten gegen die Kontrolle: Stimulanz, Verknappung und beides zusammen.

Im normalen Sale-Zeitraum kam wenig dabei heraus. Die Stimulanz steigerte die Conversion Rate um 2,5 Prozent, die Kombination aus beidem blieb unter der Signifikanzschwelle, und die Verknappung landete mit minus 0,5 Prozent bei null. Ernüchternd. Der Bericht hält fest: Verknappung ohne zeitliche Begrenzung zeigt keinen Impact.

Wer nach diesem Ergebnis die Akte schließt, schreibt in die Auswertung: Knappheit funktioniert bei uns nicht. Das Team passte den Test an und wiederholte ihn im Final Sale, dem Schlussspurt mit echter Frist. Das Ergebnis war eindeutig. Die Kombination gewann mit 12,6 Prozent mehr Conversion Rate und rund 15 Prozent mehr Umsatz pro Besucher. Alle drei Varianten waren signifikant.

Der erste Test war also kein Fehlschlag. Er hat gezeigt, dass Knappheit ohne Frist nicht trägt, und die Black Week bringt diese Frist von Natur aus mit, ohne dass du dafür etwas inszenieren musst. Du musst nur testen, was daraus folgt.

Der Fall, der vor schönen Zahlen warnt

Ein Fashion-Händler testete für ein Schuhmodell drei Varianten der Produktseite gegen die Kontrolle. Die Gewinnervariante steigerte die Add-to-Cart-Rate um 244 Prozent und die Bestellungen um 43 Prozent. Gleichzeitig kamen fast dreimal so viele Retouren zurück. Übrig blieben 22 Prozent mehr Deckungsbeitrag. Alle Zahlen stehen in der Case Study zu Conversion, Retouren und Deckungsbeitrag.

Wer in der Black Week mit Rabatten arbeitet, sollte wissen, was nach dem Rabatt zurückkommt. Wer nur auf die Conversion Rate schaut, bekommt ein schönes Ergebnis und eine falsche Antwort.

Das Spielbuch in fünf Punkten

  1. Guardrail-Metriken vor dem Start festlegen. Retourenquote, Deckungsbeitrag, Ladezeit. Wer die Grenze erst im Test zieht, zieht sie dahin, wo das Ergebnis schön aussieht.

  2. Den Kill-Switch testen, bevor der Traffic kommt. Ein Kill-Switch, den noch nie jemand gedrückt hat, ist eine Vermutung.

  3. In drei Phasen auswerten: Vorlauf, Black Week, Nachlauf. Ein Gesamtergebnis ohne diese Trennung mittelt Rabattjäger und Stammkunden zu einer Zahl, die niemand versteht.

  4. Neukunden und Bestandskunden getrennt ansehen. Sie verhalten sich in dieser Woche kaum gleich.

  5. Den Testplan Ende Oktober einfrieren. Den Testplan, nicht die Tests.

Die eine Frage fürs Montagsmeeting

Stell am Montag vor der Black Week eine einzige Frage: Was wollen wir bis Cyber Monday wissen, was wir heute noch nicht wissen?

Wenn niemandem etwas einfällt, weißt du wenigstens, warum der Freeze im Oktober so schnell durchging.