A/B-Test-Rechner: Stichprobengrößen-Schätzung

Berechnen Sie die erforderliche Stichprobengröße für statistische Studien und Experimente unter Berücksichtigung von Signifikanzniveau und Konfidenzintervall.

Stichprobengröße berechnen

Konversionsraten im Graubereich sind von der Basislinie nicht zu unterscheiden.

Der Prozentsatz der Zeit, in der ein minimaler Effekt erkannt wird, wenn er existiert

Der Prozentsatz der Zeit, in der ein Unterschied erkannt wird, wenn er NICHT existiert

Stichprobengröße

1,030

pro Variante

Ergebnis speichern

https://devbox.tools/de/utils/sample-size-calculator/#!rate=20&power=80&alpha=5&effect=5&type=absolute
Ähnliche Tools erkunden

Funktionen des Tools "Stichprobengrößenrechner"

Bestimmung der Mindestanzahl von Beobachtungen

Ermöglicht die Berechnung, wie viele Daten benötigt werden, um statistisch signifikante Ergebnisse zu erhalten.

Berücksichtigt Konfidenzintervall und Signifikanzniveau

Hilft, die Fehlerwahrscheinlichkeit in Experimenten und Marketingtests zu reduzieren.

Nützlich für A/B-Tests

Optimiert den Datenerfassungsprozess und vermeidet übermäßige Ressourcen für die Analyse.

Anleitung und Nutzungsdetails

Was der Stichprobenumfang-Rechner macht

Der Stichprobenumfang-Rechner hilft dabei zu bestimmen, wie viele Beobachtungen erforderlich sind, um statistisch zuverlässige Ergebnisse zu erhalten. Er berechnet den minimal erforderlichen Stichprobenumfang für Experimente und Studien anhand der Basis-Conversion-Rate, des Minimum Detectable Effect (MDE), des Signifikanzniveaus und der statistischen Teststärke.

Das Tool hilft Ihnen dabei:

  • den erforderlichen Stichprobenumfang für A/B-Tests zu berechnen;

  • ein Gleichgewicht zwischen Experimentdauer und Ergebnisgenauigkeit zu finden;

  • abzuschätzen, wie sich der MDE auf die Testdauer auswirkt;

  • das Signifikanzniveau (α) und die statistische Teststärke (1−β) zu berücksichtigen;

  • Berechnungsparameter als teilbaren Link für die spätere Verwendung zu speichern.

Es eignet sich für Produktanalysten, Marketingexperten, CRO-Spezialisten, Forschende und Datenanalysten.

Verwendete Parameter

Parameter

Beschreibung

Basis-Conversion-Rate

Die aktuelle Conversion-Rate der Kontrollgruppe

MDE (Minimum Detectable Effect)

Die kleinste Änderung der Conversion-Rate, die erkannt werden soll

Konfidenzniveau

Das statistische Konfidenzniveau (zum Beispiel 95 %)

Statistische Teststärke

Die Wahrscheinlichkeit, einen tatsächlich vorhandenen Effekt zu erkennen

Effekttyp

Absolute oder relative Änderung der Conversion-Rate

So verwenden Sie das Tool

  1. Geben Sie die aktuelle Conversion-Rate ein.

  2. Wählen Sie den kleinsten Effekt aus, der praktisch relevant ist.

  3. Legen Sie das Konfidenzniveau fest.

  4. Passen Sie bei Bedarf die statistische Teststärke an.

  5. Wählen Sie den Effekttyp – absolut oder relativ.

  6. Lassen Sie sich den minimal erforderlichen Stichprobenumfang für jede Experimentvariante berechnen.

Der berechnete Wert gibt die Anzahl der Benutzer (oder anderer Beobachtungseinheiten) an, die für jede Gruppe benötigt wird – nicht den gesamten Stichprobenumfang des Experiments.

Welche Faktoren den Stichprobenumfang beeinflussen

Faktor

Auswirkung

Kleinerer MDE

Erfordert mehr Teilnehmer

Höhere statistische Teststärke

Erfordert eine größere Stichprobe

Höheres Konfidenzniveau

Erhöht den erforderlichen Stichprobenumfang

Höhere Basis-Conversion-Rate

Die Auswirkung hängt von der erwarteten Effektgröße ab

So wählen Sie einen MDE

Der Minimum Detectable Effect (MDE) ist die kleinste Änderung, die einen praktischen Nutzen für das Unternehmen hat.

Beispiele:

Basis-Conversion-Rate

MDE

Interpretation

5 %

+0,5 %

Sehr kleiner Effekt

5 %

+1 %

Häufig in Produktexperimenten verwendet

5 %

+2 %

Ermöglicht einen schnelleren Abschluss des Experiments

Ein zu klein gewählter MDE erhöht sowohl den erforderlichen Stichprobenumfang als auch die Dauer des Experiments erheblich.

Praktische Empfehlungen

  • Wählen Sie den MDE auf Grundlage des geschäftlichen Nutzens und nicht mit dem Ziel, möglichst kleine Änderungen nachzuweisen.

  • Senken Sie das Signifikanzniveau nicht nur, um den erforderlichen Stichprobenumfang zu verkleinern.

  • Verwenden Sie eine statistische Teststärke von 80–90 %, da dies der Standard für die meisten Produktexperimente ist.

  • Berechnen Sie den erforderlichen Stichprobenumfang vor Beginn des Experiments und nicht erst nach den ersten Ergebnissen.

  • Beenden Sie ein Experiment nicht vor Erreichen des erforderlichen Stichprobenumfangs, es sei denn, Sie verwenden spezielle Verfahren der sequenziellen Analyse.

Ein unzureichender Stichprobenumfang erhöht das Risiko falscher Schlussfolgerungen und kann zur Umsetzung unwirksamer Änderungen führen.

Häufige Fehler

  • Ein Experiment ohne Berechnung des erforderlichen Stichprobenumfangs starten.

  • Einen unrealistisch kleinen MDE wählen, um minimale Unterschiede zu erkennen.

  • Das Experiment unmittelbar nach dem ersten „statistisch signifikanten“ Ergebnis beenden.

  • Die Parameter des Experiments während seiner Durchführung ändern.

  • Statistische Signifikanz als Beweis für einen hohen praktischen Nutzen des Effekts interpretieren.

Einschränkungen des Tools

Die Berechnung setzt Folgendes voraus:

  • unabhängige Beobachtungen;

  • zufällige Zuweisung der Benutzer zu den Experimentvarianten;

  • korrekte Datenerfassung;

  • keine systematischen Messfehler.

Werden diese Voraussetzungen verletzt, kann die tatsächliche Aussagekraft des Experiments von den berechneten Werten abweichen.

Fazit

Die Berechnung des Stichprobenumfangs ist der erste Schritt bei der Planung jedes statistischen Experiments. Sie hilft dabei, den erforderlichen Datenumfang im Voraus zu bestimmen und verhindert, dass Experimente zu früh beendet oder unnötig lange fortgeführt werden.

Nach der Bestimmung des erforderlichen Stichprobenumfangs empfiehlt es sich, weitere Tools für einen vollständigen Analyseprozess zu verwenden:

  • Chi-Quadrat-(χ²)-Rechner — zur Analyse kategorialer Daten und zum Vergleich von Conversion-Raten, wenn dieses statistische Modell geeignet ist.

  • Zwei-Stichproben-T-Test-Rechner — zur Bewertung der statistischen Signifikanz von Unterschieden zwischen Experimentvarianten nach Abschluss eines A/B-Tests.

Wenn Sie außerdem überprüfen möchten, ob die Benutzer korrekt auf die Experimentvarianten verteilt wurden, verwenden Sie zusätzlich den Sample Ratio Mismatch (SRM)-Rechner.

Beschreibung des Tools

alien

Der Stichprobengrößenrechner hilft dabei, die Anzahl der Beobachtungen zu bestimmen, die erforderlich sind, um statistisch signifikante Ergebnisse zu erhalten. Dies ist wichtig für die Planung von Experimenten, Studien und Marketingtests.

Die Stichprobe sollte groß genug sein, um zuverlässige Ergebnisse zu liefern, aber nicht übermäßig groß, um keine unnötigen Ressourcen zu verschwenden. Unser Tool berücksichtigt das Konfidenzniveau, die zulässige Fehlerspanne und die erwartete Variabilität der Daten.

Dieses Tool ist nützlich für Analysten, Forscher, Marketingexperten und alle, die mit statistischen Daten arbeiten und Studien optimal planen möchten.

Häufig gestellte Fragen (FAQ)

Die Stichprobengröße hängt vom gewünschten Konfidenzniveau, der Fehlertoleranz, der Populationsgröße und der erwarteten Effektgröße (MDE) ab. Große Effekte erfordern kleinere Stichproben, während kleinere Effekte größere Stichproben erfordern, um erkannt zu werden.

Das Konfidenzniveau (normalerweise 95 %) gibt an, wie sicher Sie sich Ihrer Ergebnisse sind. Die Fehlertoleranz ist der Unsicherheitsbereich um Ihre Schätzung. Ein höheres Konfidenzniveau oder eine kleinere Fehlertoleranz erfordern größere Stichproben.

Verwenden Sie einen konservativen Ansatz – eine gleichmäßige Aufteilung in zwei Gruppen im Verhältnis 50/50.

Wenn die Population begrenzt ist, verwenden Sie eine Korrektur für endliche Populationen und versuchen Sie, die Abdeckung so weit wie möglich zu maximieren. Bei sehr kleinen Stichproben verwenden Sie nicht-parametrische Analysemethoden und berücksichtigen Sie eine verringerte statistische Power.

Wenn ein zu kleiner MDE gewählt wird, ist eine riesige Stichprobe erforderlich, was unpraktisch sein kann. Wenn ein zu großer MDE gewählt wird, können kleine, aber wichtige Effekte übersehen werden. Ein optimaler MDE sollte den Geschäfts- oder Forschungswert des Effekts widerspiegeln.

Statistische Power ist die Wahrscheinlichkeit, einen tatsächlichen Effekt zu erkennen (falls vorhanden) und einen Fehler vom Typ II (falsch negatives Ergebnis) zu vermeiden. Eine höhere Power (typischerweise 80 % oder mehr) erfordert eine größere Stichprobengröße, um sicherzustellen, dass Sie kein signifikantes Ergebnis übersehen.

Je größer die Variabilität in den Populationsdaten (Standardabweichung), desto größer ist die Stichprobengröße, die zur Erzielung der gleichen Präzision erforderlich ist. Dies liegt daran, dass eine größere Variabilität es schwieriger macht, eine genaue Schätzung des Populationsmittelwerts zu erhalten.

Für Vergleichsstudien benötigen Sie eine Stichprobengrößenberechnung, die den minimalen nachweisbaren Effekt (den kleinsten Unterschied, den Sie für wichtig halten) und die statistische Power berücksichtigt, um sicherzustellen, dass Ihr Experiment diesen Unterschied erkennen kann.

Dieses Tool bewerten
4.5(25 Nutzer haben bewertet)