TRANSPARION: SITZUNGSPROTOKOLL FÜR KI-VERGLEICHE Vorlagenstand: 17.09.2026. Redaktionelle Arbeitshilfe, keine Messung. Kopieren Sie das Formular für jeden Versuch. Lassen Sie nicht einsehbare Angaben ausdrücklich „unbekannt“; das bedeutet nicht „ausgeschaltet“. Trennen Sie Konfiguration, Beobachtung und Bewertung. Speichern Sie Belege ohne Zugangsschlüssel, Sitzungstoken oder vertrauliche Inhalte. FORMULAR Versuch/Wiederholung: [] Vergleichsziel; bewusst veränderter Faktor: [] Exakter Prompt; Versionskennung/Belegdatei: [] Anbieter; Oberfläche oder API-Endpunkt; App-/Clientversion: [] Modell angefordert: []; Modell zurückgemeldet; Beleg: [] Start/Ende (ISO 8601 mit UTC-Offset); Zeitzone: [] Markt/Sprache im Prompt: [] Suchstandort konfiguriert/zurückgemeldet: [] Standort unbekannt? []; nicht aus Prompt oder IP ableiten. Modus; angebotene Tools; Auswahl-/Ausgabekonfiguration (z. B. response_inclusion): [] Tatsächlich beobachtete Toolnutzung; Beleg: [] Kontextreset/neue Sitzung; Nachweis: [] Übergebene Historie: [] Sichtbare System-/Developer-Anweisungen: [] Weitere Anweisungen; Dateien; Personalisierung/Speicher: [] Unterstützte Parameter: reasoning []; temperature []; seed [] Nicht unterstützte/nicht einsehbare Parameter: [] Ausgabelimit: []; Wiederholungsversuche/Retry-Grund: [] Status/vollständig/abgebrochen; Fehler: [] Request-/Response-ID, sofern verfügbar: [] Bereinigte Request-/Response-Belegdateien: [] Originalantwort unverändert gesichert: [] Originalquellenliste/URLs separat gesichert: [] Bewertung nach festgelegten Kriterien: [] Vergleichsentscheidung: [passende Vergleichsbedingung / unbekannt / separater Versuchsarm / technisch unvollständig] Begründung; übrige Unterschiede: [] PLANBEISPIEL 1 - NICHT AUSGEFÜHRT Ziel: angebotene Suche vergleichen. OpenAI Responses, POST /v1/responses. Beide Versuche: identischer Prompt [einsetzen], identisches unterstütztes Modell [einsetzen], neuer Kontext ohne übergebene Historie; übrige Einstellungen angleichen. A: kein Suchtool konfiguriert. B: tools=[{type:"web_search"}], tool_choice="auto". Geplante Einordnung: separate Versuchsarme. B bietet Suche an; tatsächliche Nutzung erst anhand der Response dokumentieren. Beide vollständig protokollieren. Zeit, IDs, Rückgabemodell, Antwort und Toolereignisse: noch nicht erhoben. PLANBEISPIEL 2 - NICHT AUSGEFÜHRT Geplanter Prüffall: Als Beleg wäre nur eine Antwort mit Quellenliste verfügbar. Toolnutzung: unbekannt; die Liste allein belegt keinen Suchaufruf. Geplante Einordnung: Suchmodusvergleich unbekannt, bis belastbare Toolereignisse vorliegen. Quellenliste gesondert bewerten. Prompt, Modell, Zeit, IDs, Antwort und Quellen: noch nicht erhoben.