Vitrine Démocratique
Comment nous mesurons la saillance médiatique et parlementaire dans l'espace public québécois.
§ 01
La saillance est définie comme la prépondérance relative d'un enjeu, d'un acteur ou d'une institution dans une sphère d'activité publique donnée, à un moment précis. Ce concept s'inscrit dans la tradition de la théorie de l'agenda-setting (McCombs & Shaw, 1972; Iyengar & Kinder, 1987), selon laquelle les médias et les élus se co-influencent mutuellement dans la construction de l'agenda public.
La Vitrine Démocratique mesure deux dimensions complémentaires de la saillance :
Ces deux mesures sont indépendantes et ne sont pas agrégées en un indice composite. Leur rapprochement sur une même interface vise à offrir une vue croisée de l'espace public québécois, sans présumer d'une hiérarchie entre ces sphères.
§ 02
Le système Radar+, développé et opéré par l'équipe Ellipse Sciences du Centre d'analyse des politiques publiques (CAPP), effectue une capture automatique des pages d'accueil de 13 sources d'information toutes les dix minutes environ, de manière ininterrompue depuis septembre 2018. Pour chaque capture sont enregistrés : la structure HTML de la page, la position verticale et le gabarit visuel de chaque manchette, ainsi que le moment précis de l'extraction (horodatage UTC).
| Code | Source | Langue | Temps moyen en Une (min) |
|---|---|---|---|
| JDM | Journal de Montréal | Français | 143 |
| LAP | La Presse | Français | 121 |
| LED | Le Devoir | Français | 242 |
| RCI | Radio-Canada Info | Français | 160 |
| TVA | TVA Nouvelles | Français | 125 |
| MG | Montreal Gazette | Anglais | 241 |
| CBC | CBC News | Anglais | 159 |
| CTV | CTV News | Anglais | 228 |
| GAM | Globe & Mail | Anglais | 326 |
| GN | Global News | Anglais | 375 |
| NP | National Post | Anglais | 249 |
| TTS | Toronto Star | Anglais | 221 |
| VS | Vancouver Sun | Anglais | 505 |
Le temps moyen en Une est calculé sur trois mois glissants et sert à pondérer l'indice de saillance inter-médias (§ 03).
TVA Nouvelles et le Journal de Montréal appartiennent au même groupe de presse (Québecor) et publient parfois la même manchette à l'identique. Pour ne pas compter deux fois une même décision éditoriale, une manchette syndiquée, c'est-à-dire le même titre publié par les deux sources dans le même bloc de quatre heures (l'unité temporelle de l'analyse, § 03), n'est comptée qu'une seule fois dans les mesures de saillance; les manchettes propres à chaque source comptent normalement.
En parallèle des captures de pages frontales, le système extrait le contenu textuel (titre, corps, auteur·e, source) des articles publiés par ces mêmes médias. Ces articles alimentent les modules de couverture par enjeux et par partis politiques.
Les objets présents dans les manchettes (personnes, enjeux, institutions, lieux) sont identifiés par deux modèles d'intelligence artificielle :
La performance des modèles est évaluée régulièrement par comparaison à environ 1 500 phrases annotées manuellement.
§ 03
La saillance est mesurée en blocs de quatre heures ancrés sur l'heure de Montréal (03–07h, 07–11h, 11–15h, 15–19h, 19–23h, 23–03h), qui constituent l'unité temporelle de base de l'analyse. L'ancrage sur l'heure locale plutôt que sur UTC garantit qu'un bloc reste la même tranche de journée toute l'année, y compris aux changements d'heure.
Une nouvelle peut s'imposer de trois manières différentes, et l'indice les mesure séparément avant de les combiner. Chacune est ramenée sur une échelle de 0 à 1.
| Facette | Question | Mesure |
|---|---|---|
| Visibilité | Combien de médias en ont fait leur Une? | Part des médias suivis de la région qui ont mis l'histoire en Une, en plus du premier. |
| Intensité | Chaque média y consacre-t-il un article ou plusieurs? | Nombre moyen d'articles par média couvrant l'histoire. Un même média ne compte que jusqu'à trois articles : au-delà, un site qui décline abondamment un sujet gonflerait la mesure sans que l'histoire occupe plus de place ailleurs. |
| Durée | Combien de temps est-elle restée en Une? | Temps passé en Une, rapporté au rythme habituel de chaque média : une heure sur une page frontale renouvelée en continu ne vaut pas une heure sur une page qui change deux fois par jour. |
Les trois facettes sont réunies par une moyenne géométrique, et non par une addition. La différence est de fond : une addition serait compensatoire, c'est-à-dire qu'une facette très forte pourrait masquer une facette absente. Un seul média qui laisserait un sujet toute la journée en Une obtiendrait alors un score élevé, alors qu'aucun autre média ne l'a jugé digne de sa page frontale. La moyenne géométrique refuse cette compensation : une histoire doit exister sur les trois plans à la fois pour monter, et le plus faible des trois tire l'ensemble vers le bas. Un plancher empêche toutefois qu'une facette nulle annule tout le reste.
L'indice est calculé séparément pour chaque région (les médias québécois d'un côté, les médias canadiens de l'autre), parce qu'une histoire ne se compare qu'aux Unes du même ensemble de médias. C'est ce qui permet au module « Deux solitudes? » de situer chaque camp chez lui plutôt que dans un panier commun.
Le résultat vaut entre 0 et 1; il est affiché sur 100, avec une décimale.
Toutes les nouvelles présentées dans le module « La Une des Unes » ont fait la Une d'au moins un média : elles sont déjà saillantes. L'étiquette de saillance ne dit donc pas si une nouvelle est importante, mais où elle se situe parmi les autres Unes. Ce qui est classé est l'attention cumulée sur 24 heures, les heures récentes comptant davantage. C'est la même grandeur qui détermine l'ordre des manchettes, de sorte que le niveau affiché et le rang racontent la même chose. Cette valeur est comparée à la distribution des mêmes cumuls sur toutes les Unes récentes, puis classée en six niveaux par percentiles symétriques.
| Niveau | Position (percentile de l'attention cumulée 24h) | Part des Unes |
|---|---|---|
| Très faible | sous le 5e percentile | 5 % |
| Faible | du 5e au 20e percentile | 15 % |
| Modérée | du 20e au 50e percentile | 30 % |
| Élevée | du 50e au 80e percentile | 30 % |
| Très élevée | du 80e au 95e percentile | 15 % |
| Exceptionnelle | au-dessus du 95e percentile | 5 % |
Les bandes sont symétriques : autant de « Très faible » que d'« Exceptionnelle », l'essentiel au centre. La médiane tombe entre « Modérée » et « Élevée », de sorte qu'aucune bande ne représente « la moyenne ». Les seuils sont fixes : ils sont mesurés une fois, sur une année complète de Unes, et ne bougent pas d'une mise à jour à l'autre. Ils ne suivent donc pas l'actualité récente, et c'est délibéré : une même valeur doit porter la même étiquette aujourd'hui et le mois prochain.
Cette référence est provisoire, et il faut le savoir pour lire les niveaux. L'année sur laquelle elle est mesurée n'est pas une année civile, et le panel de médias suivis y a changé en cours de route : elle décrit donc bien la distribution des Unes, mais pas encore une période qu'on puisse nommer proprement. L'indice lui-même, lui, ne bouge pas : il est absolu par construction, et deux valeurs égales mesurent la même chose quelle que soit l'année. C'est la lentille qui est encore à régler, pas l'instrument. Une référence datée et versionnée, mesurée sur une année civile complète, est à l'étude pour la remplacer. Le jour où elle sera posée, le changement sera annoncé : ou bien les niveaux déjà publiés resteront rattachés à la référence sous laquelle ils ont été calculés, ou bien tout sera recalculé sous la nouvelle et ce sera dit. Jamais un mélange des deux, et jamais en silence.
Une propriété mérite d'être signalée, parce qu'elle ne vient d'aucune règle ajoutée : une histoire portée par un seul média reste très bas sur l'échelle. La facette Visibilité y est presque nulle, et comme les trois facettes se multiplient au lieu de s'additionner, aucune des deux autres ne peut compenser : ni le nombre d'articles, ni le temps passé en Une. C'est la traduction d'un principe simple : la saillance décrit une attention collective, et un média seul, aussi insistant soit-il, ne fait pas un agenda. Ce plafond est un constat de mesure et non une impossibilité : un média qui garderait seul une histoire en Une pendant près d'une journée entière peut le franchir. Sur quatorze mois, le cas s'est présenté une fois : un dossier de fond qu'un quotidien a tenu seul en Une une vingtaine d'heures, un samedi d'été, à l'occasion d'une commémoration. Cette histoire a tout juste atteint le bas du niveau « Élevée », loin des valeurs qu'atteignent les nouvelles suivies par l'ensemble des médias : vingt heures de Une continue, chez un seul journal, ne pèsent guère plus qu'une histoire ordinaire suivie par tous. La vérification est refaite à chaque recalibration.
§ 04
Ce module identifie les événements qui dominent l'agenda médiatique québécois au moment de la consultation, en distinguant l'importance relative accordée par les médias francophones québécois et les médias canadiens anglophones.
Le système regroupe les articles qui traitent d'un même fait d'actualité, à partir des captures des pages d'accueil des médias et des articles qui y figurent. Chaque regroupement, appelé « événement », reçoit un enjeu principal et un score de saillance (son importance médiatique), mesuré à la fois à l'échelle de l'ensemble des médias suivis et spécifiquement pour les médias québécois.
Ce regroupement est fait par un modèle de langue, à qui l'on soumet, toutes les quatre heures, les articles passés en Une pendant la période ainsi que la liste des histoires déjà suivies depuis 24 heures. Il répond à deux questions d'un seul tenant : quels articles forment une même histoire, et laquelle poursuit une histoire de la veille. La consigne définit une histoire comme un dossier d'actualité : l'annonce et la réaction politique, la gestion d'un événement et ses conséquences, la version française et la version anglaise d'un même fait vont ensemble. Elle précise aussi ce qui ne suffit pas à faire un même dossier (un personnage commun, un thème commun, une région commune), pour éviter que deux affaires distinctes soient présentées comme une seule.
Cette méthode a remplacé un regroupement fondé sur la similarité statistique du vocabulaire, qui découpait une même actualité en plusieurs morceaux : chacun paraissait alors moins important qu'il ne l'était, et les médias qui la couvraient se retrouvaient répartis entre ces morceaux. Sur onze semaines d'archives rejouées, le nouveau regroupement reconnaît la suite d'une histoire dans 64 % des cas contre 40 % auparavant, et le nombre d'histoires portées par au moins trois médias québécois passe de 159 à 218.
Le système suit aussi chaque histoire au fil de la journée. Sur une fenêtre glissante de 24 heures, il rassemble l'ensemble des médias qui l'ont mise en Une, le dernier article mis en Une par chacun d'eux, et le moment où elle est apparue pour la première fois parmi les Unes saillantes.
Ce panneau compare, sur les 24 dernières heures, ce que mettent de l'avant les médias québécois et les médias canadiens (hors Québec). Il mesure dans quelle mesure les deux espaces médiatiques couvrent les mêmes histoires, et non les mêmes articles.
Un radar à deux formes superposées (le Québec en bleu, le Canada en rouge) montre d'un coup d'œil qui parle de quoi : chaque forme dessine où sa région porte son attention. Le degré de convergence se lit dans le grand chiffre et la jauge, pas dans le recouvrement des formes (voir « Limites et honnêteté »). Autour, chaque sujet porte les logos des médias qui l'ont couvert, cliquables vers leur dernier article. Sur un écran étroit, où les titres ne tiendraient pas autour du radar, les axes sont numérotés et les sujets se lisent dans une liste sous le radar, avec les mêmes logos. Un grand pourcentage indique l'écart avec le niveau habituel de convergence, et le libellé qui l'accompagne en donne le sens et l'intensité (plus divergent ou plus convergent que d'habitude); une bulle d'information en détaille la lecture. Sur l'axe fleur-de-lys/érable, la distance entre les deux symboles encode la convergence : ils se rapprochent quand les deux agendas se recoupent, s'éloignent quand ils divergent. La jauge situe le moment sur l'échelle complète, de la divergence totale à la convergence totale; le survol de son marqueur donne les niveaux absolus du moment et de l'habituel.
§ 05
Ce module mesure la saillance (visibilité dans les médias) et le ton (valence du traitement médiatique) des partis politiques québécois dans la couverture des 13 sources d'information suivies.
| Parti provincial suivi |
|---|
| Coalition avenir Québec (CAQ) |
| Parti québécois (PQ) |
| Parti libéral du Québec (PLQ) |
| Québec solidaire (QS) |
| Parti conservateur du Québec (PCQ) |
Le système analyse la couverture médiatique et produit, pour chaque parti, chaque date et chaque bloc de collecte, deux mesures clés : une saillance pondérée (visibilité) et un ton net pondéré (valence du traitement), disponibles sur les fenêtres jour, semaine et mois.
Classement des partis par saillance. Trois onglets permettent de basculer entre les fenêtres aujourd'hui, cette semaine et ce mois. Le ton est visualisé par un indicateur coloré (positif / neutre / négatif) pour chaque parti.
§ 06
Ce module représente la distribution de la couverture médiatique par grand enjeu de société sur la période sélectionnée (aujourd'hui · cette semaine · ce mois).
| Grand enjeu de société |
|---|
| Économie et travail |
| Gouvernements |
| Santé |
| Environnement |
| Droits et libertés |
| Culture |
| Éducation |
| Aff. internationales |
| Loi et crime |
| Terres publiques |
| Immigration |
| Technologie |
Le système produit, pour chaque fenêtre temporelle et chaque bloc de collecte (matin, midi, après-midi), un score de couverture pour chacun des 12 grands enjeux.
Trois vues, une par fenêtre temporelle, sélectionnables par onglet.
§ 07
Ce module mesure la présence des partis politiques dans les débats de l'Assemblée nationale du Québec (ANQ) selon trois fenêtres : la dernière période de questions (last PDQ), la session en cours et la législature complète.
Le système traite les transcriptions officielles des débats de l'ANQ. Chaque intervention est découpée en phrases, puis chaque phrase reçoit un ou plusieurs enjeux (même taxonomie qu'au § 06) et une valeur de ton. De là viennent, pour chaque parti et chaque période : le nombre d'interventions, le volume de mots prononcés, la richesse lexicale (diversité du vocabulaire), le ton moyen, la répartition par enjeu, un concept distinctif et un angle éditorial. Les mêmes mesures sont calculées par député, sauf l'angle éditorial, qui reste au niveau du parti.
Les segments vides ou sans aucune lettre, produits par le découpage automatique, sont écartés avant toute analyse. Les passages de pure procédure (« je cède la parole à… », les préambules de motion, les formules d'ouverture de séance) sont retirés du corpus servant au concept distinctif et à l'angle éditorial : ils sont très caractéristiques du rôle de qui préside ou lit une motion, pas de son propos politique.
Le nom affiché d'un député provient de l'Assemblée nationale, qui en conserve la graphie officielle, et non du référentiel d'appariement, qui stocke les noms sans accents ni traits d'union. Deux élus homonymes restent deux entrées distinctes, départagées par leur circonscription.
Le module ne couvre que les cinq partis reconnus. Les député.es qui siègent comme indépendant.es en sont absent.es : leurs interventions sont écartées avant agrégation, et aucune carte ne leur est consacrée. Neuf sièges étaient dans cette situation au 5 août 2026. Les totaux affichés par parti ne décrivent donc pas l'ensemble de la chambre.
Les nouvelles séances sont traitées chaque mardi. Lorsque l'Assemblée ne siège pas (relâche estivale ou parlementaire), les chiffres affichés restent ceux de la dernière séance connue.
Une phrase peut porter plusieurs enjeux à la fois : un propos sur le financement des hôpitaux compte à la fois en santé et en économie. La répartition affichée rapporte donc le nombre d'attributions d'un enjeu au total des attributions de la période, de sorte que les douze parts forment un ensemble de 100 %. Elle se lit comme la part de l'attention thématique, pas comme la part des phrases prononcées.
Cette répartition porte sur les phrases auxquelles au moins un enjeu a été attribué. Une part appréciable du discours parlementaire n'en reçoit aucun : environ 56 % des phrases au 30 juillet 2026, l'essentiel étant des interventions courtes, procédurales ou trop peu explicites pour être classées. La répartition décrit donc ce dont il a été question quand un sujet identifiable était abordé, et non l'intégralité de ce qui a été dit en chambre.
Le concept distinctif est l'expression, d'un ou deux mots, qui sépare le plus un parti (ou un député) des autres sur la période. Le calcul établit d'abord une liste de candidats en combinant trois signaux : la fréquence de l'expression chez cette personne ou ce parti, le fait qu'une seule d'entre elles l'emploie, et sa rareté dans l'ensemble du corpus. Ce dernier signal est ce qui distingue un mot d'usage courant en chambre d'un terme employé de façon insistante par une seule voix.
Les candidats sont extraits phrase par phrase, ce qui évite d'assembler des expressions à cheval sur deux phrases. Sont exclus les mots outils français et anglais, le vocabulaire de procédure parlementaire, ainsi que les noms des élus et les noms et sigles de partis : un député n'est pas caractérisé par son propre nom, ni un parti d'opposition par le sigle de celui qu'il critique. Quand une expression de deux mots porte une part substantielle des emplois du mot seul, c'est elle qui est retenue.
Un modèle de langage tranche ensuite entre les soixante meilleurs candidats. Il ne rédige rien : il reçoit la liste calculée et en désigne une seule entrée, celle qui décrit un enjeu de politique publique plutôt que le fonctionnement de la chambre. Sa réponse est vérifiée contre la liste, si bien qu'aucune expression absente du corpus ne peut être publiée. Cette étape existe parce que la statistique seule ne fait pas la différence entre le vocabulaire des travaux parlementaires et celui des politiques débattues : la fréquence, la rareté et la répartition entre élus classent « salle » ou « affaires courantes » aussi haut que « logement abordable ». Quand aucun candidat ne décrit un enjeu substantiel, aucun concept n'est affiché pour cette entité.
Chaque phrase reçoit un ton favorable, défavorable ou neutre, pondéré par la confiance du classement. Le ton d'un parti est la moyenne de ces valeurs, calculée sur les seules phrases porteuses d'un enjeu. Les formules d'ouverture, les remerciements et les civilités de séance en sont écartés : le classificateur les juge favorables, et comme elles représentent une large part des interventions, elles tiraient la mesure vers le haut au point d'afficher des partis d'opposition au ton favorable.
Le ton mesuré reste resserré autour de zéro, si bien qu'une valeur brute ne dirait pas grand-chose. L'échelle affichée place donc un repère sur une règle calée sur l'étendue réellement observée pendant la période : la voix la plus défavorable en occupe la gauche, la plus favorable la droite, et le point neutre reste au centre. Une position se lit par comparaison avec les autres élus de la même période, jamais comme une note absolue. Le sens du ton est la partie fiable de cette mesure; son intensité l'est beaucoup moins.
L'angle éditorial est la seule phrase du module rédigée par un modèle de langage. Il résume ce sur quoi un parti a insisté pendant la période. Le modèle ne reçoit ni statistiques seules ni extraits tirés au hasard : il lit les interventions les plus centrées sur l'enjeu dominant du parti, sur toute la fenêtre de la période, retenues selon leur degré de concentration sur cet enjeu et leur substance, avec un plafond par élu pour qu'une seule voix ne fournisse pas toute la matière.
Deux garde-fous encadrent la rédaction. Le modèle ne peut jamais attribuer à un parti la paternité d'une mesure ou d'un projet de loi : en débattre, même longuement, n'est pas la proposer, et l'angle décrit ce que le parti défend, dénonce ou réclame. Le modèle doit ensuite fournir une citation recopiée des extraits qu'il a lus, et le système vérifie que cette citation figure bien dans les propos de ce parti. Si la vérification échoue, aucun angle n'est publié pour cette période : un espace vide vaut mieux qu'une affirmation invérifiable.
L'onglet « dernière période de questions » couvre la dernière séance connue, « cette session » la session parlementaire en cours. L'onglet « cette législature » remonte à la première séance présente dans nos données, qui n'est pas nécessairement la première séance de la législature : la profondeur de l'historique dépend de la date de mise en service de la collecte.
Le module se présente comme un vestiaire : un casier par parti actif, alignés côte à côte. Les battants de chaque casier portent le bilan du parti : volume de mots, nombre de député.es ayant pris la parole et position du parti sur l'échelle de ton. Cliquer un casier écarte ses battants et déroule, sous la rangée, un tiroir relié au casier ouvert. L'intérieur du casier montre alors ce que les portes cachaient : le nombre d'interventions, les trois principaux sujets abordés et l'élu qui a le plus parlé. Le tiroir porte l'angle éditorial du parti et le présentoir de ses cartes.
Chaque député ayant pris la parole a sa carte, au format d'une carte de collection (63,5 × 88,9 mm). Le recto porte son portrait, son nom, sa circonscription, le sigle de son parti et son enjeu dominant. La retourner d'un clic révèle le verso statistique : volume de mots, nombre d'interventions, richesse lexicale, ton en chambre, répartition par enjeu, concept distinctif et un extrait qui l'illustre.
Les portraits proviennent du site de l'Assemblée nationale du Québec, qui en autorise la reproduction pour un usage non commercial à condition d'en indiquer la source. Ils sont retraités en bichromie pour s'accorder à la mise en page. Ce retraitement est calculé image par image, de façon à ce que le rendu d'un visage ne dépende pas de sa carnation.
Trois onglets permettent de basculer entre la dernière période de questions, la session en cours et la législature. Les partis sans siège à la législature courante sont affichés à part, sous l'intitulé « Hors chambre ». Un jeu de billard caché propose une seconde façon d'explorer les données de parti : chaque parti y est une bille qu'on peut envoyer vers l'une de six poches, chacune révélant une facette différente de sa présence.
§ 08
Ce module suit la couverture médiatique des promesses électorales de la Coalition avenir Québec (CAQ) : il identifie chaque jour, sur une semaine glissante, les promesses les plus saillantes (les plus présentes dans l'actualité) et celles en plus forte progression par rapport à la semaine précédente.
Le module croise la couverture médiatique avec la liste officielle des promesses de la CAQ. L'appariement entre un article et une promesse repose entièrement sur des expressions régulières validées manuellement : c'est la source de vérité de l'identification.
En complément, et sans jamais intervenir dans l'identification (qui demeure entièrement à base de règles), un modèle de langage génératif (Gemma 3) produit deux éléments d'affichage : un libellé court pour chaque promesse et un résumé journalistique (2 à 3 phrases) décrivant comment la promesse a été couverte pendant la période, à partir des titres des articles qui l'ont mentionnée (résumé hebdomadaire, puis synthèse mensuelle des résumés hebdomadaires). Cet enrichissement est optionnel : si le service n'est pas disponible, ces champs restent vides et le reste du module est publié normalement.
Classement des promesses de la CAQ les plus saillantes de la semaine, avec l'indication de leur progression et, lorsque disponible, un libellé court et un résumé de la couverture médiatique récente.
§ 09
Les modules de couverture médiatique sont disponibles selon trois fenêtres temporelles distinctes : le jour, la semaine et le mois.
| Fenêtre | Portée | Fréquence de mise à jour |
|---|---|---|
| Aujourd'hui | Blocs de 4h du jour courant | 6 fois par jour (00h, 04h, 08h, 12h, 16h, 20h, heure de Montréal) |
| Cette semaine | 7 derniers jours glissants | 1 fois par jour (19h35, heure de Montréal) |
| Ce mois | 29 à 31 derniers jours glissants | 1 fois par jour (19h39, heure de Montréal) |
Le système applique une pondération décroissante à l'intérieur de chaque fenêtre : les événements récents contribuent davantage au score final que les événements anciens.
§ 10
Aucune mesure n'est neutre. La Vitrine revendique sa rigueur en exposant aussi ses limites.
Le corpus couvre 13 sources d'information générale établies. Les médias alternatifs, hyperlocalaux, spécialisés et les plateformes de médias sociaux ne sont pas inclus. Ce choix sur-représente les acteurs médiatiques nationaux et les formats de presse traditionnelle.
Les pages d'accueil ne constituent qu'une fraction de la production journalistique. Certains sujets font l'objet d'une couverture approfondie sans jamais atteindre la une. L'indice mesure la visibilité frontale, pas l'ensemble de la couverture.
GLiNER et Gemma 3 peuvent produire des erreurs sur les homonymes, les entités émergentes et les personnalités peu connues. Des validations humaines régulières réduisent ces erreurs, sans les éliminer.
L'approche par dictionnaire ne capte pas l'ironie, le sarcasme ou les nuances contextuelles. La valence d'un mot peut varier fortement selon la phrase qui l'entoure.
Les indices calculés séparément pour les médias francophones et anglophones ne sont pas directement comparables en valeur absolue, en raison des différences stylistiques entre les deux groupes.
Les données publiées sont des instantanés (snapshots) mis à jour automatiquement six fois par jour par un pipeline AWS. Les scores affichés correspondent au dernier cycle de collecte et d'analyse, non à un flux continu en temps réel.
Le module « L'alignement de l'Assemblée » ne traite que les cinq partis reconnus. Les député.es qui siègent comme indépendant.es en sont absent.es, alors qu'ils et elles occupaient neuf sièges au 5 août 2026, dont d'ancien.nes ministres. L'affiliation est par ailleurs une donnée datée : une personne qui change de banquette en cours de mandat garde, dans nos totaux, la parole prononcée sous sa bannière précédente.
Le regroupement des articles en histoires est confié à un modèle de langue. Deux exécutions sur les mêmes articles s'accordent à environ 97 %, sans être identiques : recalculer une journée passée ne redonnerait donc pas exactement les mêmes histoires. Le découpage publié est une décision datée, figée au moment de la publication. Les indices de saillance des objets, eux, restent calculés de façon déterministe et sont reproductibles (§ 03).
Certaines pages ne sont jamais des nouvelles mais occupent parfois la une : flux vidéo continu, page de chaîne. Une page qui ne change jamais accumule du temps‑en‑une sans rien raconter, ce qui gonfle artificiellement la durée mesurée. Ces pages sont donc exclues du calcul, à partir d'une liste d'adresses tenue à la main et révisée par un humain. Le critère est la durée de vie et non le libellé : les pages « en direct » consacrées à un événement réel, qui portent un titre propre et disparaissent en quelques jours, sont conservées. Au 8 août 2026, la liste compte deux adresses.
§ 11
§ 12
Si vous utilisez les données ou les indices de la Vitrine Démocratique dans vos travaux, veuillez citer :
Pour toute demande d'accès aux données brutes ou pour établir une collaboration de recherche, utilisez le formulaire d'accès aux données ou écrivez à capp@ulaval.ca.