Home Wie KameraModelle Debüts erfasst — Methodik

Wie KameraModelle Debüts erfasst — Methodik

In Kraft seit: August 26, 2026

KameraModelle ist ein Tracking-Dienst, kein Spiegel (Mirror). Jede Kennzahl, jedes Ranking und jede Seite auf dieser Website wird aus Daten berechnet, die wir selbst erheben. Diese Seite dokumentiert genau, wie — damit Sie die angezeigten Zahlen bewerten, bei Bedarf nachvollziehen und uns zur Rechenschaft ziehen können, wenn sie falsch sind.

Datenquelle

Broadcaster-Daten — Benutzernamen, Tags, Zuschauerzahlen, Vorschaubilder, Geschlecht, Standort — stammen aus dem öffentlichen Chaturbate-Affiliate-Endpunkt:

https://chaturbate.com/api/public/affiliates/onlinerooms/

Dies ist derselbe Feed, der jedem Teilnehmer des Chaturbate-Affiliate-Programms zur Verfügung steht. Wir scrapen nicht das HTML der Website, greifen nicht auf private Daten zu und verwenden keine undokumentierten Endpunkte. Dieser Endpunkt liefert nur Broadcaster zurück, die zum Zeitpunkt einer Abfrage aktiv online sind — das ist eine Beschränkung der Quelle, keine Entscheidung unsererseits.

Abfrageintervall

Wir fragen den Endpunkt alle 15 Minuten ab und blättern durch alle Ergebnisseiten (Stapel von 500), bis der Feed erschöpft ist. Eine typische Abfrage verarbeitet 8 000–12 000 gleichzeitig online befindliche Broadcaster und dauert 15–40 Sekunden. Die vollständige Abfragehistorie wird in einer cron_log-Tabelle mit Startzeit, Dauer und Ergebnis gespeichert.

Wie wir ein „Debüt“ erkennen

Ein Broadcaster gilt als Debüt, wenn sein Benutzername zum ersten Mal in einer Abfrageantwort nach dem Start der Website (29.03.2026) auftaucht. Wir versuchen nicht, die Historie vor diesem Datum nachzutragen, und wir wissen nicht, ob ein Broadcaster vorher gestreamt hat — wir wissen nur, wann wir ihn zuerst gesehen haben. Chaturbates eigenes is_new-Kennzeichen wird separat als stärkeres Bestätigungssignal beibehalten.

Praktische Folge: Ein Broadcaster, dessen erste Cam-Session vor dem 29.03.2026 lag, erscheint in unserem System mit einem first_seen_at, das seiner ersten Abfrage nach diesem Datum entspricht. Es handelt sich nicht wirklich um ein „Debüt“, aber unsere Daten können es nicht von einem solchen unterscheiden. Um Rauschen zu reduzieren, kommen nur von Chaturbate mit is_new=true gekennzeichnete Broadcaster für das stärkste DEBUT-Abzeichen infrage; nicht gekennzeichnete Erstsichtungen erhalten stattdessen das schwächere NEW-Abzeichen.

Debüt-Score

Jeder Broadcaster erhält bei jeder Abfrage einen numerischen debut_score. Formel:

debut_score = viewers × log(tag_count + 1) × (1 + tag_rarity_score) × new_bonus

  where new_bonus = 1.5  if Chaturbate flagged the broadcaster is_new
                    1.0  otherwise

Begründung für jeden Faktor:

  • viewers — rohe Popularität in dem Moment, in dem wir ihn entdeckt haben. Gegenüber Followern bevorzugt, da Follower sich langsam ansammeln und dem tatsächlichen Live-Interesse hinterherhinken.
  • log(tag_count + 1) — belohnt Broadcaster, die sich die Zeit nehmen, sich zu kategorisieren, begrenzt den Effekt jedoch. Ein Broadcaster mit 20 Tags ist nicht doppelt so wertvoll wie einer mit 10; der Logarithmus dämpft Manipulation.
  • 1 + tag_rarity_score — ein Nischen-Broadcaster (ungewöhnliche Tag-Kombination) kann bei gleicher Zuschauerzahl bis zum 2-Fachen eines Mainstream-Broadcasters erreichen. Das bringt markante Neulinge ans Licht, bevor die übliche „Groß ist größer“-Verzerrung des Algorithmus greift.
  • new_bonusis_new ist Chaturbates eigenes Signal, dem wir mehr vertrauen als unserer Erstsichtungs-Ableitung. Bestätigte Debüts rangieren bei gleicher Zuschauerzahl über nicht gekennzeichneten Erstsichtungen.

Tag-Seltenheitswert

Für jeden in einer Abfrage beobachteten Tag berechnen wir seine Häufigkeit in dieser Momentaufnahme:

tag_rarity(t) = 1 - frequency(t) / max_frequency_this_snapshot

Ein Tag, der von 90 % der Broadcaster verwendet wird, erhält eine Seltenheit von ≈ 0,1. Ein Tag, der von 1 % verwendet wird, erhält ≈ 0,99. Der gesamte tag_rarity_score eines Broadcasters ist die durchschnittliche Seltenheit über alle seine Tags. Die Tag-Häufigkeit wird pro Momentaufnahme berechnet — sie spiegelt wider, was gerade jetzt verbreitet ist, nicht historisch. Das bedeutet, dass die Seltenheit von „petite“ oder „18“ von Tag zu Tag schwankt, wenn sich die Online-Population verändert.

Wachstumssignal

growth_signal = viewers_now / max(1, viewers_at_debut)

Wird auf Modellseiten als „ד-Multiplikator angezeigt (z. B. 3.4×). Werte über 1,5× betrachten wir als aussagekräftig; darunter blenden wir sie aus. Ein hohes Wachstumssignal ist der mit Abstand stärkste Indikator dafür, dass ein Broadcaster echte Zugkraft gewinnt — die meisten Modelle stagnieren nahe ihrer Debüt-Zuschauerzahl.

Was wir von indexierten Seiten ausschließen

Ein Broadcaster benötigt mindestens einen Tag, um eine eigene Seite zu erhalten. Tags sind das, woraus eine Profilseite aufgebaut ist — ohne sie gibt es nichts zu beschreiben außer einem Benutzernamen und einer Zuschauerzahl, und eine solche Seite wäre tatsächlich inhaltsarm.

Alles andere, was wir erfassen, wird unabhängig davon behalten. Broadcaster ohne Tags erscheinen weiterhin in aggregierten Statistiken auf der Startseite („Insgesamt erfasst“ usw.) und in den täglichen Debüt-Zählungen; sie haben lediglich keine eigenständige Seite, bis sie sich selbst kategorisieren.

Wie die Sitemap erstellt wird

Die sitemap.xml ist dynamisch und wird als Sitemap-Index ausgeliefert: Die URL, die Sie bei einer Search Console einreichen, listet eine Handvoll untergeordneter Dateien auf, statt aller URLs auf einmal. Jede untergeordnete Datei enthält bis zu 10 000 URLs; Crawler rufen sie unabhängig und in beliebiger Reihenfolge ab.

  • Die erste untergeordnete Datei enthält die Startseite, die Rechts- und Methodikseiten, die letzten 90 Tagesarchive sowie die Tag- und Länder-Hubs.
  • Die übrigen untergeordneten Dateien enthalten Broadcaster-Seiten, absteigend nach debut_score sortiert, insgesamt bis zu 50 000.
  • lastmod auf einer Broadcaster-Seite gibt an, wann wir den Broadcaster zuletzt live gesehen haben, sodass ein Crawler eine Seite nur dann erneut abruft, wenn sich die zugrunde liegenden Daten tatsächlich geändert haben.
  • Erzeugtes XML wird eine Stunde lang auf der Festplatte zwischengespeichert. Ein Crawler, der alle untergeordneten Dateien direkt hintereinander abruft, löst nicht für jede einzelne die Abfragen erneut aus.

Aufbewahrung

Die Tabelle daily_new speichert jedes von uns erkannte Debüt, nach Datum indiziert. Datensätze werden nicht gelöscht — ein Broadcaster, der vor 6 Monaten debütiert hat und jetzt offline ist, hat weiterhin seinen Archiveintrag. Deshalb funktionieren /new/{date}-Seiten unbegrenzt in die Vergangenheit.

Bekannte Einschränkungen

  • Wir können nur Broadcaster sehen, die zum Zeitpunkt einer Abfrage online sind. Ein Broadcaster, der zwischen zwei Abfragen 10 Minuten lang streamt, wird vollständig übersehen.
  • „Zuerst gesehen“ ≠ „allererste Übertragung“. Siehe „Wie wir ein Debüt erkennen“ oben.
  • Vorschaubilder werden per Hotlink vom CDN von Chaturbate eingebunden. Wenn ein Broadcaster offline ist oder sein Konto gelöscht hat, kann die von uns zwischengespeicherte Bild-URL 404 zurückgeben. Wir laden keine Bilder herunter und hosten sie nicht erneut.
  • Zuschauerzahlen spiegeln den Moment der Abfrage wider, nicht den Höchststand der Sitzung. Spitzen-Zuschauerzahlen werden separat über die Spalte peak_viewers erfasst, die bei jeder Abfrage mit GREATEST(peak_viewers, current) aktualisiert wird.

Korrekturen

Wenn Sie glauben, dass eine Zahl auf dieser Website falsch ist — ein Debütdatum, eine Wachstumsberechnung, eine Tag-Seltenheit — schreiben Sie an [email protected] mit der URL und der konkreten Zahl, die Sie beanstanden. Wir veröffentlichen Korrekturen mit einem aktualisierten Datum am Ende der betroffenen Seite.

Zuletzt aktualisiert: 26. August 2026

Siehe auch: Methodology § 2257 DMCA Privacy Terms Contact