Friedrich & ClementBETA
Woher wir wissen, was wir wissen

Das Modell, die Methode und ihre Grenzen.

Alles, was wir veröffentlichen — jede Ausschreibungsseite, jedes Signal, jede Zahl im Daily Tender — entsteht aus einem Datenmodell und einer Prüfkultur. Diese Seite ist beides, vollständig.

1 · Das Modell: ein Graph, wer was von wem kauft

Der Bestand ist kein Stapel Bekanntmachungen, sondern ein daraus gebauter, verbundener Graph:

  • 24,3 Mio. Bekanntmachungen — die Ereignisse: wer wann was verlangt hat, in welchem Verfahren, ober- oder unterhalb der EU-Schwelle.
  • 17,9 Mio. Zuschläge — die Ergebnisse: Gewinner, Preis, Datum, zurückverknüpft auf ihre Bekanntmachung.
  • 2,0 Mio. Unternehmen — die Gewinner als Rechtssubjekte, 1,3 Mio. davon an amtliche Registernummern gebunden (NIF, SIREN, CUI, EIK, Y-tunnus …), damit Namensvettern nie verschmelzen und Tochtergesellschaften nie verschwimmen.
  • Normalisierte Auftraggeber × CPV-Kategorien × Jahre — der Beschaffungsrhythmus jedes Auftraggebers, maschinenlesbar.

Die meisten Vergabedaten enden beim ersten Punkt. Die Intelligenz sitzt in den Verknüpfungen: dieselben Datensätze, verbunden, beantworten Fragen, die sie einzeln nicht beantworten können.

2 · Die Methode: Schranken statt Bauchgefühl

Die Pipeline wurde um harte Prüfschranken herum neu gebaut, nachdem wir sie in den ersten Monaten dabei ertappt hatten, Felder im großen Stil still zu verlieren. Die Regeln seitdem:

  • Nie ein Feld raten. Jede Quellenanbindung beginnt bei den echten Antworten des Portals; jedes Feld wird zugeordnet oder mit Begründung ausdrücklich übergangen.
  • Ein Datensatz vollständig, bevor eine Million läuft. Probeläufe vergleichen Quelle gegen Speicherung, Feld für Feld, vor jedem Massenlauf.
  • Unbekannt bleibt unbekannt. Die Eignungsprüfung antwortet erfüllt / nicht erfüllt / unbekannt — fehlende Angaben werden nie in ein Urteil verwandelt.
  • Nichts erscheint auf einer einzigen Messung. Maschinell erkannte Signale werden von einem unabhängigen zweiten Verfahren gegengeprüft (andere Vergleichsstatistik, Länder-Normierung, Neuzählung nach Dublettenabgleich). Was durchfällt, wird verworfen — und das Verwerfen protokolliert.
  • Wir prüfen uns öffentlich. Unsere eigenen Fehler werden zu Beiträgen; der Puls der Pipeline ist eine öffentliche Seite.

3 · Was das Modell heute kann

  • Finden — jede offene Ausschreibung aus 27 Ländern, durchsuchbar auf Deutsch, einschließlich der 21.617 unterschwelligen Verfahren, die kein Aggregator listet.
  • Qualifizieren — Eignungskriterien der Auftraggeber strukturiert für 38.774 Vergaben; nachvollziehbare Eignungsurteile gegen ein Firmenprofil.
  • Einordnen — zu jeder Ausschreibung: die Historie des Auftraggebers, das Feld der Platzhirsche, was zuvor gezahlt wurde.
  • Vorhersehen — 54–62 % der Paare aus Auftraggeber × Kategorie wiederholen sich Jahr für Jahr (gemessen); die Zyklusschicht macht daraus einen Kalender nach vorn.
  • Erkennen — tägliche Auffälligkeiten mit historischen Vergleichsfällen, vor der Veröffentlichung unabhängig gegengeprüft.
  • Untersuchen — Quoten knapp unter der Schwelle, Ereigniskorrelationen (Fluten, Kriege, Haushaltszyklen), Konzentrationsmuster — die Befundklasse des Daily Tender.

4 · Was wir bewusst nicht behaupten

  • Keine Gewinnwahrscheinlichkeiten im Produkt. Wir haben ein experimentelles ML-Modell gebaut; sein ehrlicher Messwert liegt weit unter dem, was wir verkaufen würden. Bis ein Modell den nachvollziehbaren Kontext um eine veröffentlichbare Spanne schlägt, bleibt es im Labor. (Anbieter, die beeindruckende Trefferquoten nennen, veröffentlichen ihr Prüfdesign selten. Fragen Sie danach.)
  • Keine Kausalität aus Korrelation. Unsere Ereignisbeiträge behaupten zeitlichen Zusammenhang, keine Ursache — der Methodenkasten sagt bei jedem genau, was gemessen wurde.
  • Keine stillen Abdeckungsversprechen. Quellen veröffentlichen unterschiedlich: manche nur rückblickend, manchen fehlen Kategorien. Wo die Abdeckung dünn ist, sagen unsere Zahlen das — sie sind Untergrenzen, keine Obergrenzen.
  • Übersetzung ist ein Index, kein Rechtstext. Originaltitel bleiben überall erhalten; Aufträge werden auf den Quelldokumenten gewonnen.

Der Bestand hinter dieser Methode: die Datenseite. Die Ergebnisse als einzeln zitierbare Aussagen mit Erhebungsdatum: die Faktenseite. Die Methode täglich angewandt: The Daily Tender.

QUELLE · alle Zahlen dieser Seite am eigenen Bestand gemessen, zuletzt 30. September um 15:59 Uhr