Friedrich & ClementBETA
Le corpus

Le relevé le plus complet des marchés publics européens en mains privées.

Constitué source par source depuis mars 2026 à partir de 108 portails nationaux de marchés publics et de TED, en remontant jusqu'à 2002 partout où les archives le permettent. Chaque chiffre ci-dessous est mesuré sur le corpus lui-même — la méthode complète derrière chaque donnée que nous publions est consultable ici.

24,4 M
avis, 2002–2026
18,0 M
attributions avec titulaire nommément désigné
2,0 M
entreprises · 1,3 M avec numéro d'immatriculation
13,5 M
avis sous les seuils européens — la part qu'aucun agrégateur ne couvre
64 347
procédures ouvertes en ce moment (en direct)
≈10 000
nouveaux avis par jour en régime normal
59 272
procédures ouvertes avec titre traduit
24 → 1
langues en entrée, une en sortie
54–62 %
des paires acheteur × catégorie ayant acheté une année achètent de nouveau l'année suivante — mesuré sur 444 534 paires couvrant six millésimes. La moitié du marché de l'année à venir est déjà prévisible aujourd'hui à partir de ce corpus. Méthode →

Pourquoi ce fonds est difficile à reconstituer

Le corpus n'est pas la copie d'un site, mais 108 intégrations conquises une à une, chacune avec ses propres pièges, surmontés l'un après l'autre :

  • Des portails qui tronquent à 2 000 résultats par requête — résolu par un découpage jour × catégorie ; découvert seulement après que le corpus naïf eut silencieusement perdu 60 % des enregistrements.
  • Des portails qui bloquent les adresses IP de centres de données — contournés via une connexion résidentielle.
  • Pagination liée à la session, encodages ISO-8859-1, interfaces dont le tri ment, flux qui republient à chaque changement de statut.
  • Des archives remontant à 2002 — dont une partie n'est plus servie par les sources elles-mêmes. Cet historique ne peut plus être acquis une seconde fois, à aucun prix.

Reconstituer ce fonds n'est pas qu'une question de budget : ce sont 18 mois de découvertes successives — chaque portail ne révèle ses pièges qu'en conditions réelles.

Comment tout cela tourne

Toute la chaîne — collecte, normalisation, traduction, vérification et publication — fonctionne de manière autonome : plus de 50 services planifiés avec journalisation des erreurs, des modèles de lecture qui se reconstruisent chaque nuit, une rédaction de signaux écrite par la machine et contre-vérifiée par la machine, et un flux public en direct sur son propre fonctionnement. Coût d'infrastructure : moins de 100 € par mois, tout compris. Coût marginal du pays suivant : une intégration, pas une équipe.

De la structure, pas seulement du stockage

Acheteurs normalisés sur 24,4 M avis ; attributions reliées à des entreprises immatriculées (NIF, SIREN, CUI, EIK, Y-tunnus…) ; nomenclature CPV homogène de bout en bout ; critères de sélection structurés là où la source les fournit ; traduction des titres comme couche à part entière ; cycles d'activité par acheteur, prêts pour la prévision.

Couverture en direct par pays — plus foncé = plus de procédures ouvertes. Dans 16 pays, nous lisons aussi sous les seuils européens, directement à la source nationale.

Vous souhaitez les données elles-mêmes ?
Accès API & partenariat de données →