Förderprogramme aus der Förderdatenbank des Bundes

Alle Förderprogramme der Förderdatenbank des Bundes (Bund, Länder und EU), ein Datensatz pro Programm mit 52 Feldern. Die Bundesregierung bietet mit der Förderdatenbank eine Suchmaschine für Förderungen an, veröffentlicht den zugrundeliegenden Datensatz aber nicht als Open Data im normativen Sinne. Grundlage ist der XML-Programmexport der Förderdatenbank. Der Export beinhaltet immer nur den heutigen Stand. Dieser Datensatz führt daher eine Historie: jedes Programm trägt, wann es zuerst erfasst wurde (``on_website_from``), wann sich sein Inhalt zuletzt geändert hat (``dct:modified``), alle bisherigen Änderungszeitpunkte (``previous_update_dates``) und wann es den Export verlassen hat (``on_website_to``). Programme, die aus der Förderdatenbank verschwinden, bleiben mit ihrem letzten bekannten Inhalt und ``absent = true`` enthalten. Der Datensatz umfasst damit mehr Programme als der Export und wächst über die Zeit. Diese Historie wird wöchentlich erhoben und als ISO-Kalenderwoche (z. B. 2026-W34) angegeben. Ein Lauf kann immer nur feststellen, dass sich etwas gegenüber dem vorherigen Lauf geändert hat, also ist die Woche zwischen zwei planmäßigen Läufen die tatsächliche Auflösung; ein Zeitstempel würde eine Genauigkeit vortäuschen, die die Quelle nicht hergibt. Grundlage sind ausschließlich die planmäßigen wöchentlichen Läufe: ein zusätzlicher Lauf zwischendurch fließt nicht in die veröffentlichte Historie ein, damit jede Angabe dieselbe Bedeutung hat. Eine Spalte ist modellbasiert und nicht Teil der Quelle: ``keywords_extracted`` enthält die Stichwörter, die ein finetuned Sprachmodell aus der Rohspalte ``keywords`` herausliest. Upstream sind sie durch Leerzeichen verbunden und in 87,7 % der Fälle nicht trennbar. Jedes Stichwort ist nachweislich ein zusammenhängender Abschnitt des Originalstrings, geprüft bei jeder Veröffentlichung; die Grenzziehung selbst ist eine Modellentscheidung (F1 0,967 auf einer Handstichprobe). ``keywords`` bleibt unverändert daneben stehen. Das Tabellenschema kennzeichnet jede Spalte mit ``fdb:origin`` als ``upstream``, ``derived`` oder ``inferred``.
All funding programmes in the German federal funding database (Förderdatenbank; federal, state and EU programmes), one record per programme with 52 fields. The federal government provides the Förderdatenbank as a search engine for funding programmes, but does not publish the underlying dataset as Open Data in the normative sense. The basis is the Förderdatenbank's XML programme export. The export only ever contains today's state. This dataset therefore maintains a history: each programme carries when it was first recorded (``on_website_from``), when its content last changed (``dct:modified``), all previous change timestamps (``previous_update_dates``) and when it left the export (``on_website_to``). Programmes that disappear from the Förderdatenbank are retained with their last known content and ``absent = true``. The dataset thus covers more programmes than the export and grows over time. This history is observed weekly and stated as an ISO week (e.g. 2026-W34). A run can only ever establish that something differs from the run before it, so the week between two scheduled runs is the resolution actually observed; a timestamp would claim a precision the source does not support. Only the scheduled weekly runs are used: an extra run in between does not enter the published history, so that every value carries the same meaning. One column is model-produced and not part of the source: ``keywords_extracted`` holds the keywords a finetuned language model reads out of the raw ``keywords`` column. Upstream they are joined with spaces and carry no separator at all in 87.7% of cases. Every keyword is verifiably a contiguous span of the original string, checked on every publish; where the boundaries fall is the model's judgement (F1 0.967 on a hand-labelled sample). ``keywords`` is published unchanged beside it. The table schema marks every column with ``fdb:origin`` as ``upstream``, ``derived`` or ``inferred``.

Distributionen

TitelFormatGrößeDownload
Förderprogramme als CSV-Datei54.950.839 Byteshttps://fdb.cdl.correlaid.org/data/programme.csv

Metadaten

Zuletzt geändert
2026-09-14T03:00:55.027394+00:00
Lizenz
http://dcat-ap.de/def/licenses/cc-by-nd/4.0
Konform zu
https://fdb.cdl.correlaid.org/table-schema.json
Landingpage
https://github.com/CorrelAid/fdb_scraper
Themen
ECON, GOVE
Schlagwörter
Förderung, Förderprogramme, Förderdatenbank, Fördermittel

Dieser Datensatz als RDF: Turtle · JSON-LD.