Bureau Lila mesure ce que les systèmes d'IA doivent réellement aux contenus qu'ils consultent. Nos instruments établissent, source par source, ce que la présence de chacune change à la réponse produite. Ce qui ne change rien n'a rien apporté, quelle que soit la ressemblance avec le texte final.

00 Le bureau

Un bureau de mesure, pas un cabinet d'avis

Les systèmes génératifs consomment des contenus produits par d'autres. Sur ce que cette consommation vaut, et à qui elle revient, il n'existe aujourd'hui aucun instrument : la question se règle à l'estime, entre des parties qui n'avancent jamais les mêmes chiffres.

Bureau Lila construit les instruments qui manquent. Nous ne prétendons pas reconstituer l'intérieur des systèmes que nous mesurons, ni détenir une vérité que personne ne pourrait vérifier. Nous établissons une convention de mesure : une méthode publiée, scellée avant exécution, rejouable par un tiers, et sur laquelle des parties qui ne s'accordent sur rien peuvent néanmoins s'accorder.

C'est la différence entre un avis et un étalon. Un avis se conteste, une convention s'adopte. Nous ne plaidons pour personne : nous mesurons, et nous remettons la même mesure à tout le monde, y compris à celui qui est mesuré.

Ayants droit

Une base chiffrée à poser sur la table, là où la négociation repose encore sur des indicateurs qui ne décrivent plus l'usage réel des contenus.

Autorités et régulateurs

Un moyen de contrôler la fiabilité des éléments transmis par les opérateurs, sans dépendre de leurs seules déclarations ni accéder à leurs systèmes.

Opérateurs de systèmes

Un relevé contradictoire et auditable, préférable à une négociation où chacun avance ses propres chiffres sans arbitre.

Le bureau n'est adossé ni à un éditeur, ni à une plateforme, ni à un organisme de gestion, et ne tire aucune rémunération indexée sur le résultat d'une mesure. C'est la condition pour qu'un relevé serve à quelque chose une fois posé sur la table.

01 Le constat · protocole TX68, version 1

La presse fait les réponses. Personne ne sait dans quelle proportion

Première campagne du protocole TX68, du 17 au 24 août 2026. Chaque heure, des articles parus dans une dizaine de quotidiens français ont été transformés en requêtes qu'un internaute aurait pu formuler, puis soumis à Google. Six mille trois cent douze Aperçus IA ont été collectés, horodatés et archivés.

Les chiffres ci-dessous sont établis à partir des seules sources que Google affiche lui-même sous ses réponses. C'est la lecture la plus conservatrice possible, et elle suffit à mesurer la place de la presse.

72,8 %

des Aperçus IA collectés citent au moins un site de presse comme source

24,3 %

des sources citées relèvent de la presse d'information

119

domaines de presse identifiés sur la seule semaine mesurée

Sur des requêtes d'actualité, la presse n'est donc pas une source d'appoint. Reste la question que ces chiffres ne tranchent pas : parmi les sources affichées, lesquelles ont réellement fait la réponse, et dans quelle proportion ? Compter les liens n'y répond pas. C'est là que commence la mesure.

02 La méthode

Ce qui appuie n'est pas ce qui a servi

Les liens affichés sous une réponse indiquent qu'un document appuie une affirmation. Ils n'établissent pas qu'il en a déterminé le contenu. Ce sont deux grandeurs distinctes, et seule la seconde peut fonder une rémunération : on paie ce qui a été apporté au processus, non la ressemblance constatée après coup avec le produit fini. S'y ajoute une difficulté pratique, puisque le nombre de liens affichés dépend de l'ergonomie de la page et de décisions prises par la partie même qui doit la rémunération.

Mesurer la contribution réelle suppose de renoncer aux raccourcis. Deux viennent naturellement à l'esprit, et tous deux conduisent à des répartitions absurdes. Le cas ci-dessous permet de voir où ils cèdent.

Cas d'école · quatre sources Démonstration de méthode
Une réponse contient deux informations d'importance égale : un chiffre et une date. Quatre pages figurent dans le contexte du modèle. A porte le chiffre. B reprend la même dépêche, donc la même information que A. C est le seul document à porter la date. D est hors sujet. La réponse tire ainsi la moitié de son contenu du chiffre, l'autre moitié de la date.
Information portée Part attribuée

Ce qui en découle

Une clé équitable doit satisfaire quelques exigences simples : deux sources qui apportent la même chose reçoivent la même part, une source sans effet ne reçoit rien, la totalité de la valeur est distribuée sans surplus ni déficit, et découper le problème ne change pas le résultat. Un résultat classique de théorie des jeux montre qu'une seule règle les satisfait toutes à la fois.

Reste à savoir mesurer ce qu'apporte réellement un ensemble de sources. C'est là que se loge le contenu opérationnel du protocole TX68, et c'est l'objet du rapport.

Le protocole est versionné et documenté à chaque révision. Il s'exécute en campagnes reconduites, de façon à produire des séries comparables dans le temps plutôt qu'un constat isolé, et s'étend à d'autres moteurs comme à d'autres marchés de contenus.

03 Les résultats

Cent dix-neuf domaines, classés par contribution réelle

Appliquée à l'ensemble des Aperçus collectés, la mesure produit une clé de répartition complète : chaque domaine reçoit une part, assortie de son intervalle de confiance. Les parts s'additionnent exactement à cent pour cent, ce qu'aucune répartition au prorata des citations ne peut garantir.

L'écart avec une répartition uniforme est considérable, et il ne va pas toujours dans le sens que l'on imagine. Certains titres très cités pèsent peu ; d'autres, discrets dans l'interface, portent l'essentiel de la réponse. La distribution obtenue est par ailleurs nettement plus concentrée qu'on ne le suppose généralement.

C'est un fait, non une préconisation. Une mesure explicite rend discutable un arbitrage que les clés actuelles laissaient dans l'ombre : le périmètre des bénéficiaires, l'assiette et les éventuels correctifs de pluralisme demeurent des décisions qui appartiennent aux parties et s'appliquent après la mesure.

Clé de répartition mesurée · domaines et parts sous réserve 119 domaines · IC 95 % · bootstrap 4 000

Le classement nominatif est réservé aux destinataires du rapport. Nous le communiquons aux ayants droit, aux organismes de gestion collective, aux autorités et aux opérateurs qui en font la demande.

Demander le rapport
04 Fondateurs

Nous auditions ces systèmes avant qu'on nous le demande

Bureau Lila ne procède pas d'une étude de marché. Il procède de plusieurs années d'audits menés contre des plateformes qui ne déclaraient pas ce qu'elles faisaient, et du constat qu'il manquait un instrument pour mesurer l'usage.

Paul Bouchaud

Méthode et mesure

Doctorat en audit algorithmique. Post-doctorat au CNRS, rattachement au médialab de Sciences Po, AI Forensics.

A mené avec Mediapart, en février 2026, les tests établissant qu'un grand modèle de langage français restituait de longs passages d'œuvres protégées. A chiffré, au titre de l'article 39 du DSA, une campagne d'influence ayant atteint 38 millions de personnes en France et en Allemagne sans jamais être identifiée comme politique. Travaux également consacrés aux recommandations d'Amazon et aux biais des modèles embarqués.

Amaury Lesplingart

Instrumentation et échelle

Cofondateur et ex-directeur technique de Check First, société finlandaise de recherche adverse. Contributeur aux lignes directrices ObSINT.

A construit les instruments ayant permis de documenter le réseau Pravda avec le DFRLab, c'est-à-dire l'injection méthodique de contenus pro-Kremlin dans Wikipédia et dans les réponses des agents conversationnels. A éprouvé pour la Mozilla Foundation les dispositifs de transparence publicitaire de onze grandes plateformes. Développeur avant tout, avec trente années d'outillage open source derrière lui.

AnnéeTravaux antérieurs des fondateursAvec
2026Restitution d'œuvres protégées par un modèle de langage françaisMediapartP.B.
2025Réseau Pravda : contamination de Wikipédia et des agents conversationnelsDFRLab · Check FirstA.L.
2024Publicités politiques non déclarées et opération d'influence à l'échelle de l'UEAI Forensics · DSA art. 39P.B.
2024Conformité des registres publicitaires de onze grandes plateformesMozilla FoundationA.L.
2023Recommandation de livres et diffusion de contenus complotistesAI Forensics · Check FirstP.B.

Travaux repris par Mediapart · Le Monde · The New York Times · The Washington Post · The Guardian · Politico

05 Demander le rapport

Rapport technique TX68

Seize pages, publiées en août 2026. Protocole complet en version 1, mesure de contribution, clé de répartition sur cent dix-neuf domaines, cas pratiques et limites.

01Pourquoi la citation ne peut pas servir d'unité de compte
02Presse et Aperçus IA : ce que mesure l'échantillon
03Quelle règle de partage, et pourquoi une seule reste possible
04Quelle grandeur partager : corroboration ou contribution
05Pourquoi les approches plus directes échouent
06Application : cas pratique et passage à l'échelle
07Ce que la mesure laisse à la négociation
Demande d'accès