Transparion – Belegprotokoll zu Topic 103 Programmatic Content: Quelldatensatz und Seite einzeln prüfen Prüfstand: 4. Oktober 2026 (Europe/Berlin) GEGENSTAND UND AUSWAHL Drei echte, öffentlich zugängliche Schema.org-Eigenschaftsseiten wurden mit ihren Datensätzen im offiziellen JSON-LD-Download verglichen: isbn, numberOfPages und bookEdition. Die Auswahl ist gezielt, klein und nicht repräsentativ. Sie veranschaulicht gleiche Seitenstruktur bei unterschiedlichen Nachschlageaufgaben. Es handelt sich nicht um einen Google-Test oder eine Bewertung des gesamten Schema.org-Angebots. HERKUNFT Die offizielle Entwicklerdokumentation beschreibt die maschinenlesbaren Vokabulardefinitionen und die JSON-LD-Daten in den einzelnen Begriffsseiten. Das offizielle Projekt-README beschreibt Software zur Erzeugung einer statischen Ausgabe der Schema.org-Website. Schema.org redigiert das Vokabular; dieses Protokoll behauptet keine automatisch erfundenen Definitionen. https://schema.org/docs/developers.html https://github.com/schemaorg/schemaorg/blob/main/README.md https://schema.org/version/30.1/schemaorg-current-https.jsonld QUELLSTAND Der versionierte Download unter /version/30.1 und der gleichzeitig gelesene Download unter /version/latest waren bytegleich. SHA-256: 0a4b8c4c910fc831ec8695196510973390906a5ee34dc6b862dfec4d21a12f74 Der JSON-LD-Graph enthält in diesem Abruf 3.256 Knoten. Geprüft wurden davon nur die drei ausgewählten Eigenschaften, nicht sämtliche Knoten. Die drei HTML-Seiten zeigen V30.1, das Datum 2026-09-16 und zusätzlich den Hinweis auf die Entwicklungsfassung. Deshalb wird eine aktuelle Begriffs-URL hier nicht pauschal als unveränderlicher Release bezeichnet. Das Abrufdatum ist der 4. Oktober 2026; es ist kein behauptetes Veröffentlichungsdatum. BEOBACHTETE DATENSATZ-ZU-SEITE-ZUORDNUNGEN 1. https://schema.org/isbn Datensatz-ID: schema:isbn Anwendungsbereich (domainIncludes): Book Erwarteter Werttyp (rangeIncludes): Text Redaktionelle Leseraufgabe: Die passende Eigenschaft für die ISBN eines Buchs und ihren erwarteten Werttyp nachschlagen. 2. https://schema.org/numberOfPages Datensatz-ID: schema:numberOfPages Anwendungsbereich (domainIncludes): Book Erwarteter Werttyp (rangeIncludes): Integer Redaktionelle Leseraufgabe: Eine Seitenzahl der richtigen Eigenschaft zuordnen und von einer textlichen Ausgabenangabe unterscheiden. 3. https://schema.org/bookEdition Datensatz-ID: schema:bookEdition Anwendungsbereich (domainIncludes): Book Erwarteter Werttyp (rangeIncludes): Text Redaktionelle Leseraufgabe: Die Ausgabe eines Buchs beschreiben, statt sie mit der Anzahl seiner Seiten gleichzusetzen. Bei allen drei Zuordnungen stimmen die geprüften Angaben im Datensatz, im eingebetteten JSON-LD und im gelieferten HTML überein. Die Seiten nutzen dieselben Überschriften für erwartete Werttypen und Anwendungsbereiche. Die unterschiedlichen Definitionen und Zuordnungen liefern trotz dieser gemeinsamen Struktur verschiedene Informationen. Diese Einschätzung der Leseraufgabe ist redaktionell; eine Nutzerstudie fand nicht statt. domainIncludes und rangeIncludes sind hier keine Pflichtfeldliste und kein geschlossenes Validierungsschema. „Erwarteter Werttyp“ bedeutet nicht, dass dieses Protokoll eine vollständige Schema.org-Validierung durchführt. AUSGEFÜHRTE MECHANISCHE PRÜFUNG Der lokal gespeicherte Prüfablauf kontrolliert 39 benannte Feldprüfungen, verteilt auf die drei echten Datensatz-/Seitenpaare. Dazu gehören eindeutige Datensatzzuordnung, Seitentitel, Definitionsgleichheit, erwarteter Werttyp, Anwendungsbereich, sichtbare kanonische Zielangabe und Versionshinweise. Zusätzlich wurden die Hashes aller acht gespeicherten Quellen geprüft. Ergebnis: Die 39 Prüfungen und acht Hashabgleiche bestanden. In dieser begrenzten Stichprobe wurde keine der geprüften Abweichungen festgestellt. DREI AUSDRÜCKLICH KÜNSTLICHE FEHLERFÄLLE Anschließend wurden ausschließlich lokale Kopien im Arbeitsspeicher absichtlich verändert. Die echten Quelldaten und Webseiten blieben unverändert. A. Die Beleg-URL im eigenen Prüfeintrag wurde entfernt. Die eigene Regel meldete missing_source_url. B. Der seitenbezogene erwartete Typ für numberOfPages wurde künstlich von Integer auf Text geändert; der Quelldatensatz blieb unverändert. Die eigene Regel meldete data_page_expected_type_mismatch. C. Eine zweite identische isbn-Datensatz-ID wurde künstlich ergänzt. Die eigene Regel meldete duplicate_record_id. Alle drei eingebauten Fehler wurden erkannt. Diese Fälle sind weder reale Fehler von Schema.org noch Aussagen über dessen Freigabeprozess. Die eigene Beleg-URL-Regel ist eine Transparion-Prüfregel, kein Schema.org-Pflichtfeld. GRENZEN UND EINORDNUNG Geprüft wurde die Datenübernahme ins tatsächlich ausgelieferte HTML, nicht die Browserdarstellung, alle Interaktionen oder die Veröffentlichungspraxis des Betreibers. Keine Suchmaschinen-Freigabe, Indexaufnahme, Rankingwirkung, KI-Zitation oder Geschäftswirkung wurde gemessen. Ein bestandener technischer Abgleich ersetzt die redaktionelle Prüfung auf eigenständigen Nutzen nicht. Die beobachteten drei Seiten begründen keine automatische Freigabe weiterer Datensätze. Stop-Regeln für eigene Seiten bleiben eigene redaktionelle Regeln. NACHPRÜFBARKEIT IM PROJEKT Quellbelege, Hashes, Prüfprogramm und vollständige Einzelresultate liegen in docs/blog-daily/2026-10-04-topic-103-evidence/schemaorg/ Dateien: capture-manifest.json, selected-records.json, verification.json, verify-sample.py sowie die acht unveränderten dekodierten Quellantworten. Der Prüflauf arbeitet offline mit diesen Belegen. Die Rohantworten hatten teilweise gzip-Transportkodierung; deren Hashes sind zusätzlich dokumentiert. ATTRIBUTION Vokabulardaten: Schema.org; Lizenzhinweis CC BY-SA 3.0 laut https://schema.org/docs/terms.html Die Beobachtungen, deutschen Erläuterungen und eigenen Prüfregeln stammen von Transparion. Der vollständige Datensatz wird nicht als Blogtext übernommen.