Technische Dokumentation für Forscher, Journalisten und Entwickler, die auf OpenPlenum-Daten zugreifen möchten.
Betriebsmetriken ansehenQuelldaten: Bundestag DIP API. Stenografische Berichte und Drucksachen sind amtliche Werke; bitte beachten Sie die Nutzungsbedingungen des Deutschen Bundestages, insbesondere Quellenangabe und Änderungsregeln.
| Feld | Typ | Beschreibung |
|---|---|---|
| speech_id | string | Eindeutige Rede-ID, Format: <sitzung_id>_<index>. Stabil über Pipelineläufe. |
| sitzung_id | string | Sitzungs-ID, Format: WP{wahlperiode}_{sitzungsnummer}, z.B. WP20_145. |
| wahlperiode | integer | Wahlperiode (19, 20 oder 21). Abgeleitet aus sitzung_id. |
| coalition_role | string | null | Koalitionsrolle der Fraktion in dieser Wahlperiode: 'governing' (Regierung) oder 'opposition'. Basiert auf historischen Koalitionsdaten. |
| is_governing | boolean | True wenn die Fraktion in dieser WP Regierungspartei war. Abgeleitet aus coalition_role. |
| heat_score | integer | Heuristischer Intensitätswert: Zurufe zählen 3 Punkte, Lachen 2, andere Kommentarsegmente 1; eine protokollierte Zwischenfrage addiert 5 Punkte. Der Wert misst weder Redequalität noch politische Relevanz. |
| kommentar_count | integer | Anzahl der XML-<kommentar>-Blöcke innerhalb der Rede. Ein Block kann mehrere Reaktionsereignisse enthalten; der Wert ist nicht mit heat_score gleichzusetzen. |
| interjections | JSONB array | Array von Reaktionsobjekten: [{type, speaker, fraktion, text}]. type: "applause" | "heckle" | "laughter" | "comment". |
| blocks | JSONB array | Strukturierte Redeblöcke: [{type, text}]. type: "p" (Absatz), "kommentar" (Reaktion im Text), "chair" (Präsidiumsbemerkung), "speaker_switch". |
| keywords | JSONB array | null | Schlüsselwörter des Tagesordnungspunkts, berechnet mit spaCy und YAKE über die zugeordneten Reden. |
| drucksache | string | null | Drucksachennummer des debattierten Dokuments, z.B. '20/12345'. Verknüpfbar mit /drucksachen. |
| foto_url | string | null | Porträtfoto-URL aus den MdB-Stammdaten. Darf nur zusammen mit foto_credit veröffentlicht werden. |
| foto_credit | string | null | Eindeutig zugeordneter Bildnachweis. Ohne diesen Wert zeigt OpenPlenum kein Porträt. |
| foto_source_url | string | null | Offizielle Quellseite für das Porträt und seinen Bildnachweis. |
Der heat_score ist ein gewichteter, heuristischer Intensitätswert: Zurufe zählen 3 Punkte, Lachen 2, andere Kommentarsegmente 1; eine protokollierte Zwischenfrage addiert 5 Punkte. Er beschreibt keine Redequalität, politische Relevanz oder persönliche Gegnerschaft.
| Kategorie | Score | Bedeutung |
|---|---|---|
| Ruhig | 0–2 | Geringe protokollierte Reaktionsdichte. |
| Niedrig | 3–8 | Vereinzelte protokollierte Reaktionen. |
| Lebhaft |
Die vollständige interaktive API-Dokumentation ist über Swagger UI verfügbar:
Forschungsexporte (JSONL, Interjektionen-CSV, Kantenliste) erfordern einen API-Schlüssel. Schlüssel können selbst ausgestellt werden — keine E-Mail-Verifizierung erforderlich.
/api/v1/export/speeches.csvFreiCSVAlle Reden mit Metadaten inkl. coalition_role und is_governing.
?wp=20/api/v1/export/speeches.jsonlAPI-KeyJSONLVollständige Redenobjekte mit Text, Blöcken und Interjektionen — ideal für NLP.
?wp=20&fraktion=SPD/api/v1/export/interjections.csvAPI-KeyCSVEine Zeile pro Reaktionsereignis (Zuruf/Applaus) — ermöglicht Netzwerkanalyse.
?wp=20/api/v1/export/heckle-edges.csvAPI-KeyCSVKantenliste (Heckler → Zielperson, Gewicht) für igraph/NetworkX.
?wp=20Themen-Monitoring per RSS: Abonnieren Sie neue Reden zu einem Thema in jedem RSS-Reader.
Bitte zitieren Sie OpenPlenum wie folgt in wissenschaftlichen Publikationen:
| 9–16 |
| Engagierte Debatte, regelmäßige Zwischenrufe. |
| Hoch | 17–33 | Hohe protokollierte Reaktionsdichte. |
| Sehr hoch | 34+ | Sehr hohe protokollierte Reaktionsdichte. |