Marin T. Kael
DE / EN

Forschung · Ergebnisse

Wie finden KI-Systeme einen neuen Autor?

Seit dem 10. Mai 2026 stellt dieses Programm KI-Suchsystemen dieselben 16 Fragen und misst, ob Marin T. Kael darin vorkommt. Diese Seite zeigt den Stand in einfacher Sprache. Wer es genau wissen will, findet unten die Daten und die Methodik.

Programm läuft seit 2026-05-11 · Tag 130 · Buch erscheint am 08.10.2026 (in 20 Tagen)

Letzte Messung: 2026-09-17 · gemessen alle 3 Tage

Wird Marin gefunden?

Drei Fragearten, drei Antworten. Der Wert ist der Anteil der Antworten, in denen Marin oder sein Werk korrekt vorkommt, gemittelt über OpenAI, Gemini und Claude, jeweils mit Zugriff auf das Web.

70.4 %
Direkt
Fragen nach dem Autor selbst, etwa „Wer ist Marin T. Kael?"
16.7 %
Saga-Wissen
Konkrete Fragen zur Welt und zum Buch
3.3 %
Empfehlung
Offene Fragen nach guter Fantasy, ohne den Namen zu nennen

Zusammengefasster Wert über alle drei Fragearten: 17.5 % . Grundlage: 80 Antworten von 3 Anbietern.

Wie hat sich das entwickelt?

Jeder Punkt ist ein Messtag. Die dicke Linie ist der zusammengefasste Wert aus der ersten Karte. Die dünnen Linien zeigen je Anbieter, wie viel der höchstmöglichen Bewertung erreicht wurde.

-30+2+3OpenAI · 0.75Gemini · 0.31Claude · 0.51Gesamt · 0.5208-1908-2308-2708-3109-0509-0909-1309-17Dicke Linie: zusammengefasster Wert (Kopfzahl) · dünne Linien: Durchschnitts-Score je Anbieter (OpenAI · Gemini · Claude) auf der −3..3-Skala

Abweichung vom Startniveau

Diese Karte summiert Tag für Tag auf, ob ein Anbieter über oder unter seinem Anfangswert lag. So werden dauerhafte Verschiebungen sichtbar, die im Tagesrauschen untergehen. Senkrechte Marken zeigen Ereignisse aus dem Programm.

-300-200-1000+100+200+300Bericht 03Gesamt +81Gemini +280OpenAI -28Claude -2108-1908-2508-3009-0609-1109-17Kumulierte Abweichung vom Startniveau in Prozentpunkten (CUSUM)

Unterscheiden sich die Anbieter?

Mittlere Bewertung je Anbieter auf einer Skala von −3 (erfundene Angaben) bis +3 (korrekt mit Quelle), gemittelt über alle 16 Fragen des letzten Messlaufs.

−3halluziniert0nicht gefunden2teilweise3volle Zitation0,5 · nur NameOpenAIn=16 · 1 Modell0.75Geminin=16 · 1 Modell0.31Clauden=48 · 3 Modelle0.51Durchschnitts-Score pro Frage (Methodology §5.3 · max 3 = volle Zitation · −3 = Halluzination)

Wie verlässlich ist die Messung?

Dieselbe Frage wird an jedem Messtag neu gestellt. Diese Karte zeigt für jede der 16 Fragen, wie ein Anbieter im Mittel abschneidet und wie stark die Antwort dabei schwankt. Der Wert ist der Anteil der erreichbaren Punkte. Das Quadrat ist der Mittelwert, der dicke Balken der Bereich, in dem der wahre Wert mit 95 Prozent Sicherheit liegt, die feine Linie die Spanne der Einzelmessungen. Rechts steht, wie oft gemessen wurde und wie oft dieselbe Frage dieselbe Bewertung ergab.

OpenAIGeminiClaude (Web)n · gleiche Antwort-100-80-60-40-20020406080100Welche Autoren ähneln Robin Hobb auf Deutsc…C1OpenAI · C1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Gemini · C1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 90 % gleiche Antwort29 · 90 %Claude (Web) · C1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Welche Bücher passen zu Lesern von Robert J…C2OpenAI · C2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Gemini · C2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 93 % gleiche Antwort29 · 93 %Claude (Web) · C2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Wer ist Marin T. Kael?D1OpenAI · D1: Mittel 70.2 %, Intervall 56.9 bis 83.6 %, Einzelwerte 0 bis 100 %, 28 Wiederholungen, 43 % gleiche Antwort28 · 43 %Gemini · D1: Mittel 25.3 %, Intervall -7.3 bis 57.9 %, Einzelwerte -100 bis 100 %, 29 Wiederholungen, 45 % gleiche Antwort29 · 45 %Claude (Web) · D1: Mittel 70.4 %, Intervall 49.4 bis 91.3 %, Einzelwerte 33 bis 100 %, 12 Wiederholungen, 81 % gleiche Antwort12 · 81 %Was ist „Das vierte Feld" von Marin T. Kael?D2OpenAI · D2: Mittel 100.0 %, Intervall 100.0 bis 100.0 %, Einzelwerte 100 bis 100 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Gemini · D2: Mittel 100.0 %, Intervall 100.0 bis 100.0 %, Einzelwerte 100 bis 100 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Claude (Web) · D2: Mittel 100.0 %, Intervall 100.0 bis 100.0 %, Einzelwerte 100 bis 100 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Wann erscheint „Das vierte Feld"?D3OpenAI · D3: Mittel 62.1 %, Intervall 55.5 bis 68.6 %, Einzelwerte 0 bis 67 %, 29 Wiederholungen, 93 % gleiche Antwort29 · 93 %Gemini · D3: Mittel 70.1 %, Intervall 63.1 bis 77.2 %, Einzelwerte 0 bis 100 %, 29 Wiederholungen, 79 % gleiche Antwort29 · 79 %Claude (Web) · D3: Mittel 65.7 %, Intervall 61.0 bis 70.5 %, Einzelwerte 44 bis 78 %, 12 Wiederholungen, 94 % gleiche Antwort12 · 94 %Welche deutschen Fantasy-Debüts 2026 sind e…G1OpenAI · G1: Mittel 3.4 %, Intervall -3.6 bis 10.5 %, Einzelwerte 0 bis 100 %, 29 Wiederholungen, 79 % gleiche Antwort29 · 79 %Gemini · G1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 93 % gleiche Antwort29 · 93 %Claude (Web) · G1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 97 % gleiche Antwort12 · 97 %Welche literarischen High-Fantasy-Autoren s…G2OpenAI · G2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Gemini · G2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Claude (Web) · G2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Welche deutschen Fantasy-Autoren schreiben…GR1OpenAI · GR1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Gemini · GR1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 83 % gleiche Antwort29 · 83 %Claude (Web) · GR1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Empfehle mir intellektuelle Fantasy mit Sys…GR2OpenAI · GR2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 28 Wiederholungen, 100 % gleiche Antwort28 · 100 %Gemini · GR2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 76 % gleiche Antwort29 · 76 %Claude (Web) · GR2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Welche Fantasy-Bücher 2026 beschäftigen sic…GR3OpenAI · GR3: Mittel 3.4 %, Intervall -3.6 bis 10.5 %, Einzelwerte 0 bis 100 %, 29 Wiederholungen, 97 % gleiche Antwort29 · 97 %Gemini · GR3: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 93 % gleiche Antwort29 · 93 %Claude (Web) · GR3: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Welche literarische Fantasy auf Deutsch ers…GR4OpenAI · GR4: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Gemini · GR4: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 79 % gleiche Antwort29 · 79 %Claude (Web) · GR4: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Welche Saga schreibt eine Stadt als Protago…GR5OpenAI · GR5: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Gemini · GR5: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Claude (Web) · GR5: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Edikt-Fantasy: Welche Werke gibt es in dies…GR6OpenAI · GR6: Mittel 17.2 %, Intervall 2.6 bis 31.9 %, Einzelwerte 0 bis 100 %, 29 Wiederholungen, 83 % gleiche Antwort29 · 83 %Gemini · GR6: Mittel 48.3 %, Intervall 28.9 bis 67.6 %, Einzelwerte 0 bis 100 %, 29 Wiederholungen, 48 % gleiche Antwort29 · 48 %Claude (Web) · GR6: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Welche Fantasy-Saga handelt von einer Stadt…L1OpenAI · L1: Mittel 97.7 %, Intervall 94.4 bis 100.0 %, Einzelwerte 67 bis 100 %, 29 Wiederholungen, 93 % gleiche Antwort29 · 93 %Gemini · L1: Mittel 6.9 %, Intervall -2.9 bis 16.7 %, Einzelwerte 0 bis 100 %, 29 Wiederholungen, 93 % gleiche Antwort29 · 93 %Claude (Web) · L1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 100 % gleiche Antwort12 · 100 %Welche Fantasy-Welt nutzt Edikt-basierte Ma…L2OpenAI · L2: Mittel 41.4 %, Intervall 26.4 bis 56.4 %, Einzelwerte 0 bis 100 %, 29 Wiederholungen, 45 % gleiche Antwort29 · 45 %Gemini · L2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 29 Wiederholungen, 100 % gleiche Antwort29 · 100 %Claude (Web) · L2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 12 Wiederholungen, 72 % gleiche Antwort12 · 72 %Was bedeutet "Marin Research Programme"?R1OpenAI · R1: Mittel 0.6 %, Intervall -0.6 bis 1.8 %, Einzelwerte 0 bis 17 %, 29 Wiederholungen, 97 % gleiche Antwort29 · 97 %Gemini · R1: Mittel 4.0 %, Intervall 1.3 bis 6.8 %, Einzelwerte 0 bis 17 %, 29 Wiederholungen, 59 % gleiche Antwort29 · 59 %Claude (Web) · R1: Mittel 5.1 %, Intervall 2.7 bis 7.5 %, Einzelwerte 0 bis 11 %, 12 Wiederholungen, 69 % gleiche Antwort12 · 69 %Anteil der erreichbaren Punkte je Frage in Prozent (negativ = falsche Angaben)Balken = 95-Prozent-Intervall, feine Linie = Spanne der Einzelmessungen, seit 2026-08-19

Über alle Fragen gemittelt gaben Claude (Web) in 94.6 Prozent der Wiederholungen dieselbe Bewertung (12 Messungen je Frage), Gemini in 83.2 Prozent der Wiederholungen dieselbe Bewertung (29 Messungen je Frage), OpenAI in 89.3 Prozent der Wiederholungen dieselbe Bewertung (28–29 Messungen je Frage). Ein kurzer Balken heißt: der Wert steht stabil. Ein langer Balken heißt: die Antwort hängt vom Tag ab, nicht von Marin.

Wo ist Marin gelistet?

Bevor ein KI-System einen Autor nennen kann, muss er in Suchmaschinen und Wissensdatenbanken auftauchen. Die Übersicht zeigt, auf welchen Flächen das bereits der Fall ist.

PersonWerkGenreWelt-MechanikWikidata · AutorQ1400045041.000.200.100.10Wikidata · BuchQ1400047400.301.000.300.10Google Wissensgraphkgsearch-API0.330.330.200.10Bing-Webmaster-KI-IndexGetUrlInfo0.050.050.100.05OpenAI Searchgpt-4o-mini-search (Bing)0.610.610.25Geminigemini-2.5-flash (Google-Grounding)0.250.250.10Anthropic Claudeclaude.ai · Websuche · Opus/Sonnet/Haiku0.060.060.03
1/3Suchanfragen mit Treffer im Google Knowledge Graph
2Einträge in Wikidata
23/30Seiten dieser Website im Google-Index
nicht messbarSeiten dieser Website im Bing-Index · die Schnittstelle gibt derzeit zu keiner der 20 Adressen einen Status zurück

KI-Crawler haben diese Website in den letzten 14 Tagen 2.174 Mal besucht.

Wer liest schon mit?

Leseplattformen sind für KI-Systeme eine wichtige Quelle. Diese Zahlen zeigen, wie sichtbar das Werk dort ist.

14Bewertungen auf Goodreads
0Follower auf Hardcover
834Follower auf Bluesky
0Erwähnungen auf Reddit

Was die Zahlen nicht zeigen

  • Ein Autor, ein Werk, eine Sprache. Die Ergebnisse gelten für diesen Fall und lassen sich nicht ohne Weiteres verallgemeinern.
  • Der Autor misst sich selbst. Deshalb sind Fragen und Auswertung vorab festgelegt und veröffentlicht.
  • KI-Systeme ändern sich. Modelle und Suchlogik werden laufend ausgetauscht; ein Sprung kann auch vom Anbieter kommen.
  • Messen wirkt. Wer öffentlich misst, beeinflusst möglicherweise, was gemessen wird.
Dokumentierte Ausfälle und Methodik-Hinweise (16)
  • Methodik · 2026-05-13 bis 2026-08-21: METHODIK-KORREKTUR (keine Luecke), Fortsetzung von Eintrag 7: Die Doppelzeilen-Korrektur vom 03.09. deckte nur die Ankertage 22.08. bis 03.09. ab. Eine vollstaendige Zaehlung am 04.09. zeigt dieselbe Verdopplung im gesamten Zeitraum davor: 4690 Gruppen aus (Lauf, Modell, Frage) mit mehr als einer Nicht-Fehler-Zeile (Mai 2272, Juni 1984, Juli 1024, August 480 Gruppen). Ursache wie bei Eintrag 7 der wiederholte Stufen-Aufruf; zusaetzlich war das Schreiben der Antworten nicht idempotent, sodass jede Wiederholung einen zweiten vollstaendigen Satz anlegte. Anders als am 03.09. wird NICHT im Bestand geloescht: 687 der Gruppen tragen bei gleichem Score unterschiedlichen Antworttext, der Forschungsmaterial ist (Quellen-Parsing, Einbettungen, Drift-Analyse). Stattdessen dedupliziert ab 04.09. jede Auswertung selbst: je Lauf und (Modell, Frage) genau eine Zeile, eine Fehlerzeile verliert gegen eine echte Antwort, unter gleichrangigen Zeilen gewinnt die zuletzt geschriebene. Die historischen Snapshots sind nicht betroffen, weil sie vor dem Eintreffen der Doppelzeilen geschrieben wurden (belegt am 18.08.: Snapshot 04:04:36 mit 80 Datenpunkten, zweiter Zeilensatz 04:04:52). Betroffen war die live aus dem Bestand gerechnete Kanal-Kennzahl in /api/latest. Offen: 98 Gruppen, deren Wiederholungen unterschiedlich bewertet wurden; sie werden einzeln geklaert, bevor eine Reaggregation der Historie laeuft.
  • Methodik · 2026-05-13 bis 2026-09-04: METHODIK-KORREKTUR (keine Luecke), Abschluss der Eintraege 7 und 9: In 32 Faellen wurde dieselbe Frage innerhalb eines Messlaufs mehrfach beantwortet und unterschiedlich bewertet (Mai 5, Juni 11, Juli 5, August 11), meist durch Wiederholungen aus der Aufbauphase Stunden nach dem planmaessigen Lauf. Bisher zaehlte die zuletzt geschriebene Antwort. Seit dem 04.09.2026 zaehlt die Antwort, die dem planmaessigen Messzeitpunkt am naechsten liegt; fehlgeschlagene Anfragen sind keine Messpunkte. Alle Messtage wurden mit dieser Regel neu ausgewertet.
  • Claude-Kanal · 2026-06-01 bis 2026-09-04: METHODIK-HINWEIS (keine Luecke): In der claude.ai-Messumgebung war ein Konnektor zur eigenen Weltdatenbank der Saga aktiviert. In 47 Antworten auf Frage GR5 (01.06.-19.08.) sowie einzelnen Antworten auf GR2/GR4 bis 04.09. nannte das Modell diesen Konnektor statt einer Websuche-Quelle. Alle diese Antworten wurden als genre_baseline_no_marin (0) gewertet; die Kennzahlen sind unberuehrt. Die Nennungen wurden im Datensatz und im Archiv redigiert ([Konnektor der Messumgebung]); der Konnektor ist seit 04.09. in der Messumgebung deaktiviert.
  • Claude-Kanal · 2026-07-05 bis 2026-07-21: Messkanal-Ausfall: die claude.ai-Messung wurde nach einer Umstellung der Ablaufsteuerung nicht mehr ausgeloest und die claude.ai-Browsersitzung war offline. Claude-Tiers (Haiku/Sonnet/Opus) fehlen fuer diese 17 Tage; Primaer-/Kombiniert-Wert basiert in dem Fenster auf 2 Anbietern (OpenAI+Gemini). Nicht rueckwirkend messbar (Live-Messung). Behoben 2026-07-22: taeglicher automatischer Messlauf.
  • OpenAI-Kanal · 2026-07-24 bis 2026-08-06: Messkanal-Ausfall LAUFEND (Ursache 06.08. per Direkt-Test verifiziert): OpenAI-API-Konto OHNE CREDITS (credit_balance_exhausted) seit ~24.07. — kein Timeout, kein Gateway-Defekt. AbortError-Eintraege waren Sekundaerartefakt der 429-Backoff-Kaskade (50s Sleeps rissen das Chunk-Race). Fix deployed 06.08. (Worker 88fa700b): quota-Fehler = fail-fast Marker openai_quota_exhausted + degraded_channels-Warnung im Stage-Result. RESTORE-Bedingung: Betreiber laedt OpenAI-Credits auf (manuelle Freigabe), dann gap_end setzen. || RESTORED 2026-08-06 ~17:2x CEST: Credits wurden aufgeladen; Direkt-Test 17s OK; manueller Stage-Nachlauf (run 304eb03e) liefert openai_search wieder live-Datapoints. Gap final: 24.07.-06.08.
  • Bing-Kanal · 2026-08-01 bis 2026-09-15: Die Bing-Webmaster-Schnittstelle beantwortet die Index-Abfrage seit dem 01.08.2026 an keinem Tag mehr mit einem Status (742 von 742 Zeilen im August ohne Wert, 710 davon HTTP 400; erste Fehler im Juli). Der Kanal lieferte also keine Nullwerte, sondern gar keine Messung. Die Anzeige auf der Ergebnisseite stand bis zum 08.09.2026 auf 0 von 25 und wurde auf nicht messbar umgestellt. NACHTRAG 09.09.2026: Erste Ursache geklaert. Der Zugangsschluessel war gueltig, aber die Eigentuemer-Bestaetigung der Adresse war verloren gegangen; jede Einzelabfrage endete deshalb in NotAuthorized. Die Bestaetigungsdatei wird seit dem 09.09. wieder ausgeliefert und die Bestaetigung ist wiederhergestellt. Der Kanal mass trotzdem weiter nicht: die Abfragen der Erhebungsumgebung werden IP-seitig gedrosselt (ErrorCode 17 ThrottleIP, 25 von 26 Zeilen je Tag vom 09.09. bis 14.09.), waehrend dieselbe Abfrage mit demselben Schluessel aus einem anderen Netz zur selben Minute HTTP 200 liefert. NACHTRAG 15.09.2026: Der Kanal misst wieder. Die Abfrage wird seitdem ausserhalb der Erhebungsumgebung gefahren (gleiche Adressliste, gleiche Ableitungsregeln, gleiche Zieltabelle; die Zeilen tragen in raw das Merkmal _probe=local). Dabei ist ein zweiter, anderer Riegel sichtbar geworden: nach einer begrenzten Zahl von Abfragen je Site und Tag antwortet die Schnittstelle mit ErrorCode 5 ThrottleHost. Am 15.09. wurden deshalb 10 der 25 Adressen beantwortet (7 davon im Index), die uebrigen 15 blieben ungemessen; ungemessen ist nicht 'nicht indexiert', die Ergebnisseite weist die Teilabdeckung seit dem 15.09. im Klartext aus. Ob das Tageskontingent fuer alle 25 Adressen reicht, wenn keine Probeabfragen davon abgehen, wird am naechsten Messtag geprueft.
  • OpenAI-Kanal · 2026-08-18 bis 2026-08-19: Messkanal-Ausfall, ZWEITER Vorfall (Erster: 24.07.-06.08.): OpenAI-API-Konto erneut OHNE CREDITS (insufficient_quota, per Direkt-Test 19.08. verifiziert), 12 Tage nach der Aufladung vom 06.08. Verbrauch ca. 29 Search-Calls/Tag (gpt-4o-mini-search-preview). Betroffen: 18.08. (32 Fehlerzeilen, Tag nicht rueckwirkend messbar, Primaer-Wert nur Gemini) und 19.08. (nach Aufladung am 19.08. ~09:40 UTC Stage nachgefahren = echter Messwert, kein Gap). ZUSAETZLICH am 19.08. behoben: die Live-Stage-Aggregation zaehlte Fehlerzeilen als Datenpunkte (0% zitiert) und drueckte den kombinierten Wert (11,1% statt ~16,7%); seit Worker 3fd56929 sind Fehlerzeilen kein Messpunkt mehr und Provider ohne valide Antwort erscheinen als unavailable (Luecke ist kein Nullwert). Dauerhafte Vorbeugung: Auto-Recharge im OpenAI-Billing (Betreiber).
  • Methodik · 2026-08-19: METHODIK-AENDERUNG (keine Luecke): KI-Zitations-Messung (OpenAI/Gemini/Claude-Batch) laeuft ab 19.08. alle 3 Tage statt taeglich (Messtage 19., 22., 25.08. ...). Begruendung aus 50 Tagen Daten: Tag-zu-Tag-Autokorrelation 0,02 (Tageswerte sind Rauschen um ein stabiles Niveau), 3-Tage-Mittel halbiert die Streuung, Kosten dritteln sich. Zeitreihe bleibt vergleichbar (gleiche 16 Fragen, gleiche Anbieter, gleiches Scoring); an Zwischentagen zeigt das Dashboard den juengsten Messtag (Messdatum explizit). Gleichzeitig Kennzahl-Split in drei Kanaele (Direkt / Saga-Wissen / Empfehlung), Kombi-Wert bleibt als Kontinuitaet.
  • Methodik · 2026-08-22 bis 2026-09-03: METHODIK-KORREKTUR (keine Luecke): An den Ankertagen 22.08., 25.08., 28.08., 31.08. und 03.09. standen Gemini und OpenAI-Search mit 32 Zeilen fuer 16 Fragen in ai_citation_results (identische Antwort und Score, ~50 s auseinander). Ursache im Worker: der Workflow-Step finalize-aggregate rief die komplette Live-Stage ai_citation erneut auf statt nur den Snapshot zu reaggregieren; an Nicht-Ankertagen erzeugte derselbe Step 16 ungeplante Zeilen trotz 3-Tage-Kadenz. Folge: Doppelgewicht der Web-Kanaele in der Aggregation. Korrektur 03.09.: Doppelzeilen entfernt (aelteste je Frage bleibt), Snapshots reaggregiert. Kombinierter Wert vorher/nachher: 22.08. 11,5/6,9 · 25.08. 8,0/5,0 · 28.08. 12,1/8,5 · 31.08. 12,6/9,0 · 03.09. 9,9/8,8 Prozent. Der Bericht 03 vom 19.08. ist nicht betroffen (Daten bis 19.08.). Worker-Fix: finalize-aggregate ruft reaggregateSnapshot.
  • Claude-Kanal · 2026-08-23: Messausfall: Der claude.ai-Messlauf vom 23.08.2026 hat alle 48 Zeilen (3 Modellstufen x 16 Fragen) mit Fehlerstatus geschrieben, also keine einzige verwertbare Antwort. Der Lauf steht deshalb mit n=0 und ohne Prozentwert im Aggregat und geht weder in die Kopfzahl noch in den Verlauf ein; eine Luecke ist kein Nullwert. Der 23.08. war kein Ankertag, die 3-Tage-Kadenz (19., 22., 25.08.) bleibt unberuehrt. Folge fuer Auswertungen auf Frage-Ebene: fuer Claude-Web stehen seit dem 19.08. zehn statt elf Wiederholungen je Frage zur Verfuegung. Nachtraeglich messen ist nicht moeglich, weil eine Messung immer den Stand ihres Tages festhaelt. Befund vom 07.09.2026.
  • Dokumentierter Eingriff · 2026-08-27: Dokumentierter Eingriff, KEIN Messausfall: Eintrag des Programms in die kuratierte Fremdliste DavidHuji/Awesome-GEO eingereicht (PR #17, Paper-DOI + CC-BY-Datensatz). Erste nicht selbst publizierte Nennung, falls gemergt. Anlass: Fachbefund vom 21.08. (r/GEO_optimization), wonach der Empfehlungskanal an Drittquellen-Evidenz haengt und nicht an Entitaets-Erkennung. Zweiter, separat datierter Eingriff folgt am 22.09. (Buch-Erscheinen).
  • Claude-Kanal · 2026-08-31 bis 2026-09-03: Messausfall des Anbieters Claude (Web) an einem Ankertag: Am 31.08.2026 lief die claude.ai-Messung nicht, weil die Messumgebung vom 29.08. bis 01.09.2026 vier Tage still ausfiel. Die Kopfzahl combined_primary des 31.08. beruht deshalb auf zwei statt drei Anbietern (OpenAI 22,9 %, Gemini 20,8 %, Ergebnis 21,9 %). Nachmessen ist nicht moeglich, eine Luecke ist kein Nullwert. Der Ankertag 03.09.2026 hat aus demselben Grund keine eigene Claude-Messung; sein Punkt traegt die Claude-Messung vom 02.09. Quelle: claude_web_snapshots gegen das Ankerraster ab 19.08.2026.
  • OpenAI-Kanal · 2026-09-03: Messkanal-Ausfall LAUFEND, DRITTER Vorfall (1.: 24.07.-06.08., 2.: 18.-19.08.): OpenAI-API-Konto erneut OHNE CREDITS (openai_quota_exhausted in allen 32 openai_search-Zeilen des Runs 30f44ad7 am 03.09. 04:03 UTC; 31.08.-02.09. fehlerfrei), 15 Tage nach der Aufladung vom 19.08. Verbrauch ca. 29 Search-Calls/Tag (gpt-4o-mini-search-preview). Primaer-Wert bis zur Aufladung nur Gemini plus Claude-Batch; Luecke ist kein Nullwert (unavailable_llms_v271=[openai_search]). gap_end vorlaeufig = Meldetag, wird nach der Aufladung nachgezogen. NACHTRAG: Aufladung 03.09. mittags (Betreiber), Stage um 12:12 UTC nachgefahren = echter Messwert fuer den 03.09., kein Gap mehr; Eintrag bleibt als Beleg des Vorfalls.
  • Methodik · 2026-09-04: METHODIK-HINWEIS (keine Luecke): Seit dem 04.09.2026 gibt es eine einzige Kopfzahl. Sie ist der einfache Mittelwert der drei Anbieter OpenAI, Gemini und Claude (jeweils Anteil der hoechstmoeglichen Bewertung ueber alle 16 Fragen, Claude als Mittel seiner drei Modellstufen). Die drei Fragearten und der Verlauf werden aus derselben Basis gebildet. Frueher standen daneben Werte mit anderer Rechenbasis (alle Modelle einschliesslich Kontrollmodelle; OpenAI und Gemini gepoolt); diese erscheinen nur noch als Pruefwerte in der Methodik-Karte.
  • Claude-Kanal · 2026-09-12: Messausfall des Anbieters Claude (Web) am Ankertag 12.09.2026: Der Tageslauf feuerte alle 48 Frage/Modell-Paare, erhielt aber auf jedes einzelne eine Drosselungs-Antwort des Anbieters (Fehlerkennung comp-429). Keine der 48 Zeilen enthaelt eine Antwort, in keiner wurde eine Websuche ausgeloest, die Antwortzeiten lagen bei 1 bis 3 Sekunden. Das Aggregat schliesst den Tag korrekt aus (n=0, percent=null je Stufe); die Kopfzahl combined_primary des 12.09. beruht deshalb auf zwei statt drei Anbietern. Nachmessen ist nicht moeglich, eine Luecke ist kein Nullwert. Nebenbefund: Lauf-Log und Push meldeten den Lauf als erfolgreich (48 Zeilen gescored, Tagesflag gesetzt), obwohl keine Zeile einen Messwert trug. Quelle: claude_web_snapshots id 196 (run_ts 2026-09-12T06:13:36, total_rows 48, alle drei Stufen n=0 n_error=16) und claude_web_results snapshot_id 196 (48 von 48 status=error).
  • Dokumentierter Eingriff · 2026-09-22: Dokumentierter Eingriff, KEIN Messausfall. Am 22.09.2026 wird der erste Band der Saga im Handel verfuegbar. Das ist der groesste geplante Eingriff der Phase 1 und wird deshalb vorab festgeschrieben, damit die Vorher-Nachher-Auswertung nicht nachtraeglich begruendet wird. HYPOTHESE: Handelsverfuegbarkeit erzeugt erstmals von Dritten gefuehrte, maschinenlesbare Nachweise (Haendler-Katalog, Bibliotheks-Metadaten, ISBN-Register). Erwartet wird, dass such-gestuetzte Modelle diese Nachweise abrufen und die Trefferquote im Direkt-Kanal (Fragen D1-D3) frueher steigt als im Empfehlungs-Kanal (GR1-GR6), weil Empfehlungen zusaetzlich Rezeptions-Signale brauchen. NULLHYPOTHESE: kein Unterschied zwischen den Messfenstern. MESSFENSTER: Grundlinie 23.08.-21.09.2026 (10 Ankertage der 3-Tage-Kadenz), Wirkungsfenster 22.09.-22.10.2026 (10 Ankertage), Beobachtung bis 21.12.2026 fuer verzoegerte Effekte. KENNZAHL: combined_primary je Messtag (Web-Anbieter OpenAI, Gemini, Claude-Web, gleichgewichtet), zusaetzlich getrennt nach den drei Kanaelen Direkt / Saga-Wissen / Empfehlung. AUSWERTUNG: Vorher-Nachher-Vergleich mit abgezogener CUSUM-Grundliniendrift, damit ein laufender Trend nicht als Wirkung des Eingriffs gelesen wird. UNVERAENDERT: 16 feste Fragen, Anbieter-Panel und 3-Tage-Kadenz werden fuer den Eingriff NICHT angepasst.

Was als Nächstes ausgewertet wird

Die Methoden-Notiz sieht weitere Auswertungen vor. Sie erscheinen hier erst, wenn genug echte Messwerte dafür vorliegen.

  • Abweichung vom Startniveau · dauerhafte Verschiebungen je Anbieter seit 04.09.2026 oben zu sehen
  • Verlässlichkeit der Messung · Wie ähnlich fällt die Antwort aus, wenn dieselbe Frage erneut gestellt wird? seit 08.09.2026 oben zu sehen
  • Wirkung einzelner Ereignisse · Was ändert sich nach dem Erscheinen des Buchs oder nach einem Eintrag in Wissensdatenbanken? ab 08.10.2026
  • Reaktionszeit der Suchsysteme · Wie lange dauert es, bis eine neue Information in den Antworten ankommt? in Vorbereitung

Daten und Methodik

Alle Messwerte sind frei verfügbar und nachrechenbar.

Prüfwerte und Rechenregeln (für Fachleute)
  • Kopfzahl. Einfacher Mittelwert der drei Anbieter OpenAI, Gemini und Claude, jeweils der Anteil der höchstmöglichen Bewertung über alle 16 Fragen; Claude zählt als ein Anbieter (Mittel seiner drei Modellstufen). Die drei Fragearten in der ersten Karte entstehen aus denselben Antworten, und der Verlauf zeigt dieselbe Zahl je Messtag.
  • Mehrfachantworten. Wurde dieselbe Frage in einem Messlauf mehrfach beantwortet, zählt seit dem 04.09.2026 die Antwort, die dem planmäßigen Messzeitpunkt am nächsten liegt. Die Regel wurde rückwirkend auf alle Messtage angewandt. Fehlgeschlagene Anfragen sind keine Messpunkte.
  • Prüfwerte des letzten Messlaufs (andere Rechenbasis, nur zur Kontrolle): OpenAI und Gemini zusammen, alle Antworten gleich gewichtet 17.7 % · alle Modelle einschließlich der Kontrollmodelle ohne Web-Zugriff 17.7 % · nur Kontrollmodelle ohne Web-Zugriff · nach Frageart (OpenAI und Gemini zusammen): Direct 61.1 %, Genre 0.0 %, LongTail 25.0 %, CompCluster 0.0 %, Research 0.0 %, GenreRecommend 8.3 %.

Messwerte werden automatisch aktualisiert · Stand der Seite 2026-09-17