Transparence intégrale
Méthodologie
Le Baromètre de la Presse est un observatoire français indépendant qui compare en temps réel la manière dont plus de 50 médias traitent une même information.
Le Baromètre de la Presse mesure la couverture médiatique : qui parle de quoi, quand, avec quels mots. Cette page explique, chronique par chronique, comment chaque chiffre est calculé, à partir de quelles données, avec quels seuils et quelles limites. Rien n'est saisi à la main : tout est produit par des règles écrites à l'avance et appliquées identiquement à toutes les rédactions.
Le Baromètre a été conçu et programmé dans un souci d'équité parfaite, motivé par la seule volonté de comprendre, d'analyser et d'établir des faits vérifiables.
- Aucun parti, aucun mouvement, aucun candidat n'intervient dans la conception, le paramétrage ou l'exploitation des algorithmes.
- La rédaction est totalement libre de toute influence : elle n'est financée par aucun des médias analysés, par aucune formation politique et par aucun groupe d'intérêt. Nos seules ressources sont les abonnements et un encart publicitaire clairement identifié.
- Le même traitement pour tous : chaque rédaction est passée au même filtre, avec les mêmes listes de mots, les mêmes pondérations, les mêmes seuils. Aucune source ne bénéficie d'un bonus ni ne subit de malus.
- Nous ne jugeons pas les opinions, nous mesurons les traitements. Aucun indicateur ne prétend dire si un média a raison ou tort.
- Une erreur signalée et vérifiée est corrigée, et la correction est appliquée rétroactivement au calcul.
Nous agrégeons les flux RSS publics de la presse francophone : quotidiens nationaux, presse régionale, chaînes d'information en continu, presse chrétienne, magazines et agences de presse.
La collecte est automatique et horaire. Chaque cycle récupère les articles publiés dans les 12 à 24 dernières heures.
Nous stockons uniquement ce que les éditeurs rendent public : titre, chapô, date de publication, illustration du flux et lien d'origine. Aucun article intégral n'est reproduit — chaque titre renvoie au site du média.
Les doublons (même article repris par plusieurs flux, ou republié) sont détectés par similarité de titre et d'URL, puis écartés des comptages.
Fenêtres de calcul standard : 24 h pour les indices du jour, 7 jours pour les chroniques hebdomadaires, 30 à 180 jours pour les archives et dossiers.
Les titres sont d'abord normalisés (minuscules, accents retirés, ponctuation supprimée), puis regroupés par sujet grâce à trois couches successives :
- Entités nommées : personnalités, partis, institutions, pays, villes. Un contrôle d'homonymie évite d'associer deux personnes partageant un patronyme (le prénom et le contexte sont exigés).
- Pondération lexicale (TF-IDF) : les mots rares mais répétés dans plusieurs titres du même créneau horaire deviennent la signature d'un sujet.
- Modèle d'IA : il tranche les cas ambigus, nomme le sujet et rédige les résumés comparatifs. Il ne note jamais un média et n'attribue jamais d'étiquette politique.
Un sujet n'est publié comme « une même info, plusieurs angles » que s'il réunit au minimum trois rédactions distinctes.
Règle absolue : le classement ne tient aucun compte de la réputation, de l'actionnariat ou de l'histoire d'un journal. Il mesure une seule chose : le vocabulaire employé dans les titres publiés pendant les sept derniers jours. Un journal réputé de droite qui titre une semaine sur les inégalités et les salaires apparaîtra à gauche du graphique — c'est voulu, et c'est la preuve que rien n'est pré-attribué.
a. Ce qui est analysé
Uniquement les titres publiés sur la fenêtre de 7 jours glissants. Ni le corps de l'article, ni l'éditorial, ni l'avis des lecteurs, ni les tribunes. Le titre est le seul élément que toutes les rédactions publient publiquement, gratuitement et dans un format comparable.
b. La grille de marqueurs
Une liste publique et figée d'expressions de cadrage, chacune affectée d'un poids signé. Cette liste est la même pour tous les médias et n'est pas modifiée en cours de semaine.
- −2 — cadrage d'extrême gauche : « lutte des classes », « violences policières », « ultrariches », « superprofits », « casse sociale »…
- −1 — cadrage de gauche : « inégalités », « précarité », « services publics », « salaires », « transition écologique », « droit d'asile »…
- +1 — cadrage de droite : « insécurité », « délinquance », « narcotrafic », « assistanat », « matraquage fiscal », « expulsion », « fermeté »…
- +2 — cadrage d'extrême droite : « grand remplacement », « remigration », « submersion migratoire », « ensauvagement », « islamo-gauchisme »…
La détection se fait en mot entier, pluriel toléré : « immigration » ne déclenche pas « immigrationniste », et inversement. Un titre sans aucun marqueur est compté dans le volume analysé mais n'influence pas la position.
c. La formule
Pour chaque rédaction, on additionne les poids de tous les marqueurs relevés, puis on rapporte cette somme au nombre de marqueurs (et non au nombre de titres : un média prolifique n'est ni avantagé ni pénalisé). Le résultat est ramené sur une échelle −100 / +100, le poids maximal étant 2.
score = (somme des poids ÷ nombre de marqueurs) × 50, borné entre −100 et +100
Traduction en cases :
- score ≤ −45 : extrême gauche
- −45 < score ≤ −15 : gauche
- −15 < score < +15 : centre
- +15 ≤ score < +45 : droite
- score ≥ +45 : extrême droite
d. Les seuils de prudence
Une rédaction n'est classée que si elle réunit, sur la semaine, au minimum 10 titres analysés et 3 marqueurs relevés. En dessous, elle n'apparaît pas sur le graphique : nous préférons une absence à un classement bâti sur deux mots.
e. La dérive hebdomadaire
La semaine est coupée en deux moitiés. Le score de la seconde moitié moins celui de la première donne la dérive : elle indique qu'une rédaction a durci ou adouci son cadrage en cours de semaine. Chaque moitié doit contenir au moins 3 marqueurs pour être comparée ; sinon la dérive est nulle.
dérive = score(2ᵉ moitié) − score(1ʳᵉ moitié)
f. Ce que nous publions pour vérification
Pour chaque rédaction classée, nous affichons le nombre de titres analysés, le nombre de marqueurs, les expressions les plus fréquentes qui ont déterminé la position et les titres les plus marqués. Vous pouvez donc refaire le calcul.
g. Ce que ce classement n'est pas
- Ce n'est pas un jugement sur la ligne éditoriale permanente d'un journal : le résultat vaut pour une semaine, et une seule.
- Ce n'est pas une accusation : employer le mot « insécurité » ou le mot « inégalités » est parfaitement légitime. Nous constatons un choix lexical, nous ne le condamnons pas.
- Un média peut employer un marqueur pour le critiquer ; l'analyse automatique ne détecte pas toujours l'ironie ou la citation. C'est la principale limite connue, et elle s'applique à tous de la même façon.
- En interne, nous n'utilisons jamais d'étiquette politique préexistante pour produire ce graphique. Seuls les titres de la semaine parlent.
- Indice Baromètre du jour (0-100)
- Calculé sur 48 h glissantes. Il combine quatre composantes : le volume d'articles consacrés au sujet, l'accélération (volume des dernières heures comparé à la veille), le nombre de rédactions distinctes qui le traitent, et l'écho public (volumes de mentions sur X collectés par notre robot, ou à défaut l'intensité des recherches). Un sujet très couvert par une seule rédaction reste bas ; un sujet moyen mais repris partout et en accélération monte.
- Alerte Baromètre
- Déclenchée lorsque l'indice du sujet de tête dépasse le seuil d'emballement et que l'accélération sur les dernières heures est supérieure à celle de la veille. Purement mécanique, aucune validation humaine.
- L'écart du jour
- Sur un même sujet, nous mesurons la distance lexicale entre les titres des rédactions (mots présents chez l'une et absents chez l'autre, marqueurs de cadrage opposés). Le sujet retenu est celui où cette distance est la plus forte à volume comparable.
- Tendances / classement des personnalités
- Comptage du nombre d'articles dont le titre ou le chapô mentionne une entité, sur 24 h, 7 jours ou 30 jours. Une mention par article, quelle que soit sa fréquence dans le texte, pour éviter qu'un article bavard pèse plus qu'un autre.
- Baromètre d'attention
- Volume d'articles consacrés à un même sujet à l'instant T, tous médias confondus, ramené au volume total publié sur la période. Il répond à : « quelle part de l'attention de la presse ce sujet capte-t-il ? »
- Qui parle de qui
- Co-occurrence média × personnalité : part des titres d'une rédaction qui citent l'entité, rapportée à la part moyenne observée dans l'ensemble de la presse. Un indice supérieur à 1 signifie une sur-couverture relative, inférieur à 1 une sous-couverture.
- Silences et angles morts
- Sujets traités par une large majorité des rédactions sur la période mais totalement absents des titres d'une rédaction donnée. Nous exigeons que la rédaction ait publié suffisamment de titres sur la période pour qu'un silence soit significatif — une panne de flux RSS n'est pas un silence éditorial.
- Vitesse de propagation / réactivité
- Intervalle en minutes entre la première publication détectée sur un sujet et la reprise par chaque autre rédaction. Les horodatages proviennent des flux RSS des éditeurs.
- Température du ton (froid / chaud)
- Analyse du registre d'écriture du titre, jamais de la gravité du sujet. Un titre est dit « alarmiste » lorsqu'il recourt à un vocabulaire de dramatisation (crise, chaos, catastrophe, scandale, psychose…). Les sujets graves mais traités factuellement — violences faites aux femmes, féminicides, décès, accidents, guerre, procès — restent classés « factuels » : un seul marqueur de dramatisation ne suffit alors pas à les requalifier.
- Intensité anxiogène (chaînes info)
- Complète la température : elle mesure la répétition des champs lexicaux inquiétants sur l'ensemble des titres d'une chaîne, et non la dramatisation d'un titre isolé. Une chaîne peut être factuelle titre par titre et très intense sur la journée.
- Le mot que seule une chaîne emploie
- Termes présents dans les titres d'une seule chaîne sur la période, absents de toutes les autres, filtrés des mots outils et des noms propres du sujet. Un tour de rôle garantit que chaque chaîne est examinée avec la même chance d'apparaître.
- Les matchs médias / duels
- Deux rédactions habituellement opposées sont confrontées sur un sujet qu'elles ont toutes deux titré dans la même fenêtre horaire. Les sujets non politiques (météo, sport de loisir, services) sont exclus pour éviter les comparaisons absurdes.
- Presse vs X et pouls du grand public
- Comparaison entre le volume d'articles consacrés à un sujet et le volume de mentions publiques observées sur X, complété par les tendances de recherche et l'intérêt encyclopédique. L'écart révèle les sujets sur-traités par la presse et ceux qui montent d'abord dans le public.
- Le retournement
- Détection d'une inversion de cadrage : une rédaction dont le vocabulaire sur un sujet donné change de signe entre deux périodes comparables.
- Le décalage horaire
- Écart entre le moment où un sujet apparaît chez les agences ou la presse étrangère et le moment où il apparaît dans la presse française.
- Vu d'ailleurs (presse étrangère)
- Titres étrangers portant sur le même sujet, traduits automatiquement. La traduction est indiquée comme telle ; le titre d'origine reste consultable via le lien.
- Présidentielle 2027
- Comptage des mentions de chaque parti et de ses présidentiables dans les titres et chapôs de la période, avec contrôle d'homonymie. Le comptage est brut : il mesure la visibilité, jamais la faveur. Aucun candidat n'est privilégié, aucune liste n'est fournie par un parti.
- Baromètre de la foi (presse chrétienne)
- Mêmes règles appliquées au corpus confessionnel : volumes, sujets dominants et attention portée au Saint-Siège.
- Archives et dossiers permanents
- Historique reconstitué sur plusieurs mois, complété par des bases documentaires ouvertes lorsque les flux RSS ne remontent pas assez loin. Les périodes reconstituées peuvent être moins denses que les journées collectées en direct.
Nos serveurs sont hébergés hors de France. L'infrastructure de calcul et la base de données sont exploitées par des prestataires d'hébergement internationaux, hors du territoire français, ce qui met le traitement et l'archivage des données à l'abri de toute pression locale sur l'hébergeur.
Les échanges sont chiffrés de bout en bout (HTTPS/TLS), les accès administrateurs sont nominatifs et journalisés, et les clés techniques sont stockées dans un coffre chiffré, jamais dans le code.
Nous ne conservons de nos lecteurs que le strict nécessaire : adresse e-mail pour le compte et la lettre quotidienne, état de l'abonnement. Les paiements sont traités par un prestataire certifié ; aucune donnée bancaire ne transite ni n'est stockée chez nous. Aucune donnée de lecteur n'est vendue ni cédée.
Les données analysées sont, elles, entièrement publiques : ce sont les titres publiés par les rédactions dans leurs propres flux.
Nos indicateurs mesurent la visibilité éditoriale, pas l'audience : un sujet très titré n'est pas nécessairement très lu.
Seuls les contenus diffusés en flux RSS sont pris en compte. Un média qui publie peu via RSS, ou dont le flux est momentanément indisponible, sera sous-représenté sur la période.
L'analyse automatique peut se tromper sur un titre ambigu, ironique ou elliptique. Les comparaisons sont des indices de traitement, pas des verdicts sur l'intention d'une rédaction.
Le Baromètre de la Presse est indépendant : il n'est financé par aucun des médias analysés. Toute contestation chiffrée nous est utile — écrivez-nous, nous republions les corrections.
La Boussole des Médias mesure la perception des participants du Baromètre de la Presse. Elle ne constitue ni une classification officielle des médias ni une étude représentative de la population française.
- Recueil des votes : un média est soumis aux lecteurs chaque semaine, sur un axe à cinq positions (gauche, centre gauche, centre, centre droit, droite). Les résultats ne sont visibles qu'après avoir voté.
- Position moyenne : les positions sont codées de −2 (gauche) à +2 (droite) ; la moyenne arithmétique des votes retenus est arrondie au centième et toujours accompagnée de la répartition complète, pour qu'une moyenne ne masque jamais une opinion partagée.
- Participants et période : le nombre de participants et les dates d'ouverture et de clôture sont affichés avec chaque résultat.
- Votes suspects : un vote par visiteur et par consultation ; les rafales issues d'une même empreinte technique sont marquées et exclues des moyennes, sans être supprimées.
- Modération : aucun texte libre n'est publié automatiquement. Chaque argument est relu, approuvé, masqué ou refusé par la rédaction, qui met en avant les points de vue contradictoires lorsqu'ils existent.
- Synthèse IA : l'IA regroupe uniquement les motifs exprimés dans les arguments déjà approuvés. Elle ne juge jamais la véracité d'un argument et ne détermine jamais l'orientation d'un média ; la synthèse est validée avant publication.
Principe fondamental : revendiqué ≠ mesuré ≠ perçu. Le Baromètre présente séparément ce qu'un média dit de lui-même, ce que les données mesurent et ce que les participants perçoivent.