Scoutvo A/B-Testing

Raten Sie nicht. Testen Sie.

Jede Listing-Änderung auf amazon.de ist eine Wette. Scoutvo macht daraus ein kontrolliertes Experiment: strukturierte Split-Tests für Bild, Titel, Bullets, A+ und Preis — mit statistischer Signifikanz statt Bauchgefühl.

Belegt
reale A/B-Tests auf amazon.de — laufend ausgewertet
56 %
Win-Rate der entschiedenen Tests
70 %
als statistisches Rauschen erkannt & verworfen
99 %
höchste Konfidenz eines Sieger-Tests
Das Problem

„Wir haben das Bild getauscht — und der Umsatz ging hoch." Wirklich?

Ohne Kontrollgruppe verwechseln Sie Saison, Werbedruck und Zufall mit echter Wirkung. Die meisten Listing-„Optimierungen" sind nie belegt.

63 %

Bauchgefühl-Änderungen

der Listing-Änderungen werden ohne jede Messung ausgerollt — Wirkung unbekannt, Rückrollen unmöglich.

44 %

verschlechtern das Listing

In den ausgewerteten Tests machten 44 % der entschiedenen Änderungen das Listing schlechter. Ohne Test merken Sie es erst, wenn der Rang weg ist.

0

verwertbares Lernen

bleibt übrig, wenn Sie fünf Dinge gleichzeitig ändern. Was hat gewirkt? Niemand weiß es.

Was Sie testen können

Jedes Element, das über den Klick und den Kauf entscheidet

Scoutvo testet die Hebel, die nachweislich Conversion und Sichtbarkeit bewegen — einzeln und sauber isoliert.

Hauptbild

Freisteller vs. Anwendungskontext, Badges, Größenvergleich. Das Bild entscheidet über die Klickrate im Suchergebnis.

Hebel: CTR + CVR

Titel

Keyword-First vs. Marke-First, Reihenfolge der Nutzenversprechen, Länge. Direkter Einfluss auf Ranking und Klick.

Hebel: CTR + Ranking

Bullet Points

Nutzen-orientiert vs. Feature-Liste, Reihenfolge, Emotion vs. Technik. Der Konversions-Hebel auf der Produktseite.

Hebel: CVR

A+ Content

Vergleichstabelle, Anwendungs-Module, Markengeschichte. Testen Sie, welche Kapitel wirklich verkaufen.

Hebel: CVR + Retoure

Preis

Preisschwellen, Aktions-Mechaniken, Coupon vs. Streichpreis. Maximieren Sie Deckungsbeitrag, nicht nur Volumen.

Hebel: Umsatz + Marge

Varianten-Struktur

Bewertungs-Pool zusammenführen oder trennen? Getestet gegen Sichtbarkeit, Sterne-Schnitt und Conversion.

Hebel: Sichtbarkeit
Aus echten Tests

Was wirklich wirkt — und was Budget verbrennt

Win-Rate je Listing-Element, ausgewertet über reale A/B-Tests auf amazon.de (Anteil der gewonnenen an den entschiedenen Tests). Nicht jede Stellschraube lohnt den Aufwand.

Hauptbild 146 Tests · der wirksamste Bereich
61 %
↳ Badge / Testsiegel aufs Bild 42 Tests · stärkster Einzelhebel
87 %
↳ Lifestyle / Requisiten 10 Tests · selten ein Sieger
25 %
Titel · Keyword-Änderung 91 Tests
56 %
A+ Content 36 Tests · überraschend schwach
30 %
↳ reiner A+-Text-Tausch 9 Tests · kein einziger Sieger
0 %
Aufzählungspunkte 25 Tests
nie entsch.
Die Erkenntnis: Ein Testsiegel aufs Hauptbild gewinnt in 87 % der entschiedenen Fälle — eine Änderung an den Aufzählungspunkten war in den ausgewerteten Tests kein einziges Mal entscheidend. Scoutvo lenkt Ihr Test-Budget auf die Hebel, die nachweislich wirken.
Echtes Beispiel

So liest sich ein echter Test

Ein realer Hauptbild-Test aus dem Scoutvo-Datensatz — Marke anonymisiert, Änderung, Konfidenz und Ergebnis im Original.

Echter Test · Sieger Hauptbild-Test — Küchenmaschine 1800 W Experiment abgeschlossen · 98 % Konfidenz
Variante A · Original
Ohne Siegel, 3/4-Ansicht
3/4-Perspektive mit offener Rührschüssel — das neutrale Standardbild.
Testsiegelnein
Produktwinkel3/4, Schüssel offen
Variante B · Sieger
Mit Testsiegel + frontale Ansicht
Rotes „sehr gut (1,0)"-Testsiegel unten rechts; Gerät frontal mit abgesenktem Rührkopf.
Testsiegel„sehr gut (1,0)"
Produktwinkelfrontal, Kopf gesenkt
Sieger: Variante B
Statistische Konfidenz98 %
Klar signifikant

Echter Test aus unseren ausgewerteten Experimenten. Marke & ASIN anonymisiert; absolute Umsatzzahlen aus Vertraulichkeit ausgelassen.

Weitere echte Tests

Sieger, Verlierer und Nullnummern

Ein Auszug aus dem Datensatz — bewusst inklusive der Tests, die das Listing verschlechtert hätten.

TestElementKonfidenzErgebnis
Testsiegel „haus & garten" aufs HauptbildKategorie: Raclette
Bild · Badge
99 %
Sieger B
„sehr gut"-Siegel + frontale AnsichtKategorie: Küchenmaschine
Bild · Badge
98 %
Sieger B
A+-Modul neu komponiert + Detail-ThumbnailsKategorie: Küchenmaschine
A+ · Komposition
96 %
Sieger B
Größe nach vorn, Titel-Lesbarkeit verbessertKategorie: Bratpfannen
Titel · Keyword
91 %
Sieger B
Testsiegel „Haus & Garten" aufs HauptbildKategorie: Wasserkocher
Bild · Badge
98 %
Variante verlor
Keyword-Reihenfolge im Titel umgestelltKategorie: Massagepistole
Titel · Keyword
99 %
Variante verlor
Testsiegel-Text in die AufzählungspunkteKategorie: Staubsauger
Aufzählungspunkte
kein Effekt
Derselbe Hebel, gegenteiliges Ergebnis: Das „Haus & Garten"-Testsiegel gewann beim Raclette mit 99 % Konfidenz — beim Wasserkocher verlor genau dasselbe Siegel mit 98 %. Genau deshalb wird getestet statt kopiert.
Methodik

In vier Schritten zur belegten Entscheidung

Jeder Test folgt demselben sauberen Ablauf — vom Hypothesen-Satz bis zum dokumentierten Rollout.

1

Hypothese

„Wenn wir X ändern, steigt Y, weil Z." Eine Variable, eine messbare Zielgröße, eine Begründung aus den Scoutvo-Daten.

2

Test-Design

A und B unterscheiden sich in genau einem Element. Rotierender 50/50-Split oder zeitsymmetrische Phasen gegen Saison-Verzerrung.

3

Laufzeit & Signifikanz

Scoutvo berechnet die nötige Stichprobe vorab und stoppt erst, wenn 95 % Konfidenz erreicht ist — kein verfrühtes „Peeking".

4

Auswertung & Rollout

Klares Verdikt mit p-Wert, Uplift und Hochrechnung. Gewinner wird ausgerollt, Erkenntnis dokumentiert, nächste Hypothese priorisiert.

Statistik, verständlich

Die Kennzahlen hinter jedem Verdikt

Keine Black-Box: Scoutvo zeigt jede Größe, die in die Entscheidung einfließt — und was sie bedeutet.

KennzahlWas sie misstWann ein Test zählt
Conversion-Rate (CVR)Anteil der Sessions, die zu einem Kauf führen — die zentrale Zielgröße der meisten Tests.Primärmetrik
Klickrate (CTR)Anteil der Impressionen im Suchergebnis, die zu einem Klick werden — bewertet vor allem Bild & Titel.Primärmetrik
Statistische KonfidenzWahrscheinlichkeit, dass der gemessene Unterschied echt ist und nicht Zufall.≥ 95 %
p-WertGegenstück zur Konfidenz: Wahrscheinlichkeit, das Ergebnis rein zufällig zu sehen.≤ 0,05
Mindest-StichprobeVorab berechnete Session-Zahl je Variante, um einen erwarteten Uplift sicher zu erkennen.vor Start fixiert
UpliftRelative Verbesserung der Zielgröße von B gegenüber A.Effektgröße
Guardrail-MetrikSchutzgröße (z. B. Retourenquote, Marge), die sich nicht verschlechtern darf — auch wenn die CVR steigt.darf nicht fallen
Laufzeit-Planung

Wie lange ein Test laufen muss

Die nötige Laufzeit hängt von Ihrem Traffic und dem erwarteten Effekt ab. Scoutvo berechnet sie für Ihr Listing — Richtwerte für 95 % Konfidenz:

Sessions / Tag (je Variante)Kleiner Effekt (+5 %)Mittlerer Effekt (+10 %)Großer Effekt (+20 %)
100≈ 38 Tage≈ 14 Tage≈ 7 Tage
250≈ 21 Tage≈ 9 Tage≈ 5 Tage
500≈ 14 Tage≈ 6 Tage≈ 4 Tage
1.000+≈ 9 Tage≈ 4 Tage≈ 3 Tage
Faustregel: Mindestens eine volle Woche laufen lassen, um Wochentag-Effekte auszugleichen — auch wenn die Signifikanz früher erreicht scheint.
Im Vergleich

Warum Scoutvo statt Bordmittel

Amazons eigenes „Manage Your Experiments" ist eng limitiert. Scoutvo testet mehr — und sagt Ihnen, was zu testen ist.

FunktionAmazon-BordmittelScoutvo A/B
Brand Registry nötigPflichtAuch ohne testbar (Zeit-Split)
Testbare ElementeBild, Titel, A++ Bullets, Preis, Varianten-Struktur
Hypothesen-Vorschläge keine aus echten Wettbewerbsdaten
Statistik transparentScore, Black-Boxp-Wert, Konfidenz, Stichprobe
Guardrail-Metriken Marge & Retoure überwacht
Ergebnis → Listing-Optimierung fließt direkt zurück
Im System

Tests, die sich selbst priorisieren

A/B-Testing steht nicht allein — es schließt den Kreis mit dem Rest von Scoutvo.

1

Analyse findet den Hebel

Die Kaufkriterien- und Wettbewerbs-Analyse zeigt, wo Ihr Listing gegen den Markt verliert — das wird zur Test-Hypothese.

2

Test belegt die Wirkung

Statt die Empfehlung blind zu übernehmen, beweist der Split-Test sie an Ihrem echten Traffic.

3

Ergebnis schärft die KI

Jeder Testausgang trainiert die Listing-Optimierung — die nächsten Vorschläge werden treffsicherer.

Listing-Optimierung ansehen
Häufige Fragen

Fragen zum A/B-Testing

Brauche ich Amazon Brand Registry?

Für echte parallele Splits (Amazons „Manage Your Experiments") ja. Scoutvo kann zusätzlich zeitbasierte Tests fahren — symmetrische A-/B-Phasen mit Saison-Korrektur —, die auch ohne Brand Registry funktionieren.

Wie viele Sessions brauche ich, damit ein Test aussagekräftig ist?

Das hängt vom erwarteten Effekt ab. Bei ~250 Sessions/Tag und einem mittleren Uplift ist nach gut einer Woche oft Signifikanz erreicht. Scoutvo berechnet die exakte Mindest-Stichprobe vor dem Start — siehe die Laufzeit-Tabelle oben.

Was, wenn ein Test kein klares Ergebnis liefert?

Auch das ist ein Resultat: Die getestete Änderung bewegt Ihre Zielgröße nicht messbar. Sie sparen sich den Aufwand des Rollouts und behalten die einfachere Variante — mit Beleg statt Bauchgefühl.

Kann ich mehrere Dinge gleichzeitig ändern?

Wir raten dringend davon ab. Ändern Sie fünf Dinge auf einmal, wissen Sie hinterher nicht, welches gewirkt hat. Scoutvo isoliert pro Test genau eine Variable — nur so entsteht verwertbares Lernen.

Verfälscht ein laufender Test mein Ranking?

Nein. Beide Varianten laufen unter derselben ASIN; der Traffic wird sauber geteilt bzw. zeitlich rotiert. Guardrail-Metriken überwachen, dass weder Marge noch Retourenquote leiden.

Wie kommen die Test-Ideen zustande?

Aus Ihrer Scoutvo-Analyse: Wo Wettbewerber bei Bild, Titel oder Feldern systematisch anders auftreten und besser konvertieren, schlägt Scoutvo eine konkrete, begründete Hypothese vor — priorisiert nach erwartetem Umsatzeffekt.

Hören Sie auf zu raten

Starten Sie mit einer kostenlosen Analyse — wir identifizieren Ihren ersten lohnenden Test, ganz ohne Abo.

Ersten Test identifizieren