Aller au contenu principal
Ressource éditoriale indépendante et gratuite · aucune accréditation ni titre délivré · aucune garantie d'embauche ni de publication.
Rédaction Demain
Observatoire de vocabulaire

Lexique

Vingt-huit termes du journalisme numérique définis dans le sens précis employé sur ce site, avec le piège d'usage associé à chacun.

Pourquoi fixer le vocabulaire

Le vocabulaire du journalisme numérique arrive en anglais, se traduit de plusieurs manières et sert parfois d'argument commercial. Une même page peut ainsi parler d'« algorithme », de « modèle » et d'« IA » pour désigner trois choses différentes, ou la même chose trois fois. Ce lexique fixe le sens employé sur l'ensemble du site, dans une acception volontairement étroite.

Deux règles gouvernent ces entrées. Première règle : une définition décrit une fonction observable, pas une promesse. Un système de recommandation « optimise un objectif défini par son exploitant » ; il ne « comprend » pas les préférences de son lectorat. Deuxième règle : chaque entrée signale, quand c'est utile, le piège d'usage le plus courant — la confusion entre portée et audience, entre absence de filigrane et absence de synthèse, entre diversité disponible et diversité effectivement affichée.

Les vingt-huit entrées ci-dessous sont classées par ordre alphabétique. Elles ne constituent pas des définitions juridiques : lorsqu'un terme possède une définition légale — profilage, données personnelles, contenu synthétique — le texte applicable prime, et l'entrée du lexique sert uniquement à naviguer dans les pages du site.

Vingt-huit entrées

Observatoire des termes employés

Accès réservé
Dispositif technique qui limite la lecture d'un contenu aux personnes disposant d'un compte actif. Il en existe plusieurs variantes : réservation totale, ouverture d'un nombre limité d'articles, réservation partielle par rubrique, ou ouverture conditionnée à la création d'un compte gratuit. Le choix n'est pas seulement technique : il modifie le lectorat atteignable et la manière d'écrire les premiers paragraphes.
Agrégateur
Service qui rassemble des contenus produits par des éditeurs tiers et les présente dans une interface unique, avec ou sans extrait. Un agrégateur ne produit pas d'information mais arbitre sa visibilité, ce qui en fait un intermédiaire éditorial de fait. Sa politique de sélection, ses critères de source et ses règles d'affichage conditionnent une part du trafic reçu par une rédaction.
Assistance machine
Expression employée sur ce site pour désigner tout outil logiciel intervenant dans la production éditoriale sans se substituer à la décision humaine : transcription, traduction, reformulation, suggestion de titres, détection de doublons, résumé de document. Elle est préférée à « intelligence artificielle » parce qu'elle décrit une fonction dans une chaîne de travail plutôt qu'une catégorie technique floue.
Audience
Ensemble des personnes ayant effectivement consulté un contenu, mesuré par un dispositif déclaré et selon une définition explicite : visiteur unique, session, lecture complète. L'audience se distingue de la portée, qui compte des affichages sans garantie de lecture. Comparer deux chiffres d'audience exige de vérifier d'abord qu'ils reposent sur la même unité de comptage et la même période.
Bulle de filtres
Situation dans laquelle la sélection automatique des contenus réduit progressivement la variété des sujets et des points de vue auxquels une personne est exposée. La notion est utile comme hypothèse de travail mais souvent employée de manière trop large : la diversité réelle d'exposition dépend aussi des habitudes de navigation, du nombre de sources suivies et des conversations hors ligne.
Chaîne de provenance
Ensemble structuré de métadonnées documentant l'origine d'un fichier et les transformations qu'il a subies : appareil ou logiciel de création, date, opérations d'édition successives, signature cryptographique éventuelle. Une chaîne de provenance intacte facilite la vérification mais son absence ne prouve rien : la plupart des plateformes suppriment ou réécrivent les métadonnées lors du téléversement.
Classement
Opération par laquelle un ensemble de contenus disponibles est ordonné avant affichage. Le classement est le point de contact le plus concret entre une rédaction et un intermédiaire technique : il détermine ce qui est vu, dans quel ordre et pendant combien de temps. Un classement peut être personnalisé, contextuel, chronologique ou mixte, souvent sans que l'interface l'indique.
Contenu synthétique
Contenu image, son, vidéo ou texte produit ou substantiellement modifié par un système automatique. Le terme est neutre : une illustration générée pour un schéma explicatif et un faux enregistrement attribué à une personne réelle sont tous deux synthétiques, mais leurs enjeux éditoriaux n'ont rien de comparable. C'est l'usage, et non la technique, qui détermine l'obligation d'information du lectorat.
Corpus d'entraînement
Ensemble des données utilisées pour ajuster les paramètres d'un modèle statistique. Sa composition détermine les régularités que le modèle reproduit, y compris les erreurs et les déséquilibres qu'il contient. Pour une rédaction, deux questions comptent : le corpus contient-il des contenus protégés utilisés sans autorisation, et couvre-t-il la langue et le contexte géographique dans lesquels l'outil sera employé.
Dépêche automatisée
Texte court produit par un gabarit alimenté par des données structurées — résultats, indicateurs publiés, relevés officiels — sans rédaction phrase par phrase. La qualité dépend presque entièrement de la source de données et des règles d'exception prévues dans le gabarit. Une dépêche automatisée reste sous responsabilité éditoriale de la rédaction qui la publie, quel que soit son degré d'automatisation.
Diversité d'exposition
Mesure de la variété effectivement affichée à une personne sur une période donnée : nombre de sources distinctes, de thématiques, de points de vue identifiables. Elle se distingue de la diversité disponible, qui décrit l'offre totale. Une offre variée peut coexister avec une exposition étroite si la sélection automatique concentre l'affichage sur quelques types de contenus.
Fabulation de modèle
Production, par un système génératif, d'une information présentée avec assurance mais sans fondement : référence inexistante, citation inventée, chiffre plausible mais faux, article de règlement mal numéroté. Le phénomène n'est pas un dysfonctionnement occasionnel mais une conséquence du mode de génération, ce qui impose une vérification systématique de toute sortie avant publication.
Filigrane numérique
Marquage inséré dans un fichier pour signaler son origine automatique, soit de manière perceptible, soit de manière détectable par un outil dédié. Son efficacité varie fortement : un recadrage, une recompression, une capture d'écran ou une conversion de format peuvent l'effacer. Un filigrane absent ne permet donc pas de conclure qu'un contenu n'est pas synthétique.
Hypertrucage
Contenu audiovisuel dans lequel le visage, la voix ou les gestes d'une personne sont générés ou substitués par apprentissage automatique afin de paraître authentiques. Terme retenu sur ce site pour « deepfake ». Le traitement éditorial d'un hypertrucage suppose de documenter la première apparition du fichier, sa diffusion, les indices techniques relevés et l'état de l'incertitude au moment de la publication.
Indicateur d'engagement
Compteur d'interactions : clics, partages, commentaires, réactions, durée de visionnage. Ces indicateurs mesurent une réaction, pas une compréhension ni une utilité. Leur usage comme objectif éditorial déforme les choix de sujets, parce que les contenus qui provoquent une réaction rapide ne sont pas nécessairement ceux dont le lectorat a besoin.
Infolettre
Envoi périodique par courriel à une liste de destinataires ayant consenti à le recevoir. Format singulier à deux titres : la diffusion ne dépend pas d'un classement automatique, et la relation avec le lectorat est directe, donc soumise au RGPD pour la gestion des adresses, du consentement, des traces d'ouverture et de la désinscription.
Mention d'usage
Information donnée au lectorat sur la manière dont un contenu a été produit : intervention d'un outil génératif, illustration synthétique, texte issu d'un gabarit alimenté par des données. Une mention utile précise ce qui a été fait par la machine, ce qui a été contrôlé par une personne et à quel moment, plutôt que d'ajouter une formule générale en bas de page.
Modération
Ensemble des décisions par lesquelles un service en ligne conserve, restreint, étiquette ou retire un contenu. Pour une rédaction présente sur des plateformes tierces, la modération est un risque de production : un contenu conforme à la déontologie peut être restreint par une règle privée, et les voies de recours prévues par le règlement européen sur les services numériques prennent du temps.
Modèle de langue
Système statistique entraîné à prédire la suite d'une séquence de texte. Il ne dispose ni d'une base de faits vérifiée, ni d'une notion de source : sa sortie est une continuation probable, non une information attestée. Cette propriété explique pourquoi un tel modèle convient à la reformulation d'un texte déjà validé et non à l'établissement d'un fait.
Notification poussée
Message envoyé sur un appareil sans action du destinataire au moment de l'envoi. Canal puissant et coûteux en attention : sa fréquence, son heure et sa formulation engagent la crédibilité d'une rédaction. Une notification mal calibrée produit un désabonnement définitif du canal, souvent sans signal préalable.
Personnalisation
Adaptation des contenus affichés en fonction de données rattachées à une personne ou à un appareil : historique de lecture, position approximative, langue, comportement de navigation. La personnalisation relève du profilage lorsqu'elle repose sur des données personnelles, ce qui déclenche des obligations d'information et, selon les cas, de recueil du consentement.
Portée
Nombre d'affichages potentiels d'un contenu, indépendamment de sa lecture réelle. La portée est le chiffre le plus souvent cité et le moins informatif : elle dépend des règles de comptage de chaque service, mélange des affichages partiels et complets, et ne dit rien de l'attention accordée au contenu.
Profilage éditorial
Construction d'un profil de lecture à partir des traces laissées par une personne, dans le but d'orienter les contenus proposés. Le terme est employé ici dans son sens éditorial, en gardant le sens juridique du RGPD comme référence : dès qu'un traitement automatisé évalue des caractéristiques d'une personne identifiable, les obligations de transparence et de base légale s'appliquent.
Rapport de transparence
Document périodique publié par un service en ligne pour rendre compte de ses décisions de modération, de ses moyens et, pour les très grandes plateformes, de ses évaluations de risques. Ces rapports sont agrégés : ils permettent de comparer des ordres de grandeur, pas de reconstituer une décision individuelle ni le détail d'un dispositif de classement.
Signal de classement
Variable prise en compte pour ordonner des contenus : fraîcheur, langue, proximité géographique, historique d'interaction, réputation de la source, durée de consultation attendue. Les signaux exacts et leur pondération ne sont pas publics ; toute affirmation précise à leur sujet doit être traitée comme une hypothèse, y compris lorsqu'elle circule largement dans le secteur.
Système de recommandation
Dispositif qui sélectionne et ordonne des contenus proposés à une personne à partir de signaux d'usage et de contexte. Un tel système ne juge pas la qualité éditoriale : il optimise un objectif défini par son exploitant. Comprendre l'objectif optimisé importe donc plus que connaître le détail des calculs, rarement accessible.
Temps de lecture attentif
Durée pendant laquelle un contenu est affiché avec des signes d'attention active : défilement, interactions, absence de changement d'onglet. Indicateur plus informatif que le clic, mais fragile : il dépend de la configuration de la mesure, du type d'appareil et de conventions qui varient d'un outil à l'autre, donc difficilement comparable entre deux sites.
Vérification des faits
Procédé consistant à confronter une affirmation à des sources indépendantes et documentées avant publication, ou à examiner publiquement une affirmation déjà diffusée. La vérification porte sur des éléments établissables : date, lieu, auteur d'un document, contenu exact d'une décision. Elle ne tranche pas un désaccord d'opinion et ne remplace pas un droit de réponse.

Trois confusions à éviter

Automatique n'égale pas sans humain. Une dépêche produite par gabarit suppose un choix de source, des seuils, des règles d'exception et une décision de publication. La responsabilité éditoriale ne se délègue pas à un outil.

Indicateur n'égale pas objectif. Un compteur d'interactions mesure une réaction immédiate ; l'utiliser comme finalité déforme la sélection des sujets et fabrique une audience qui n'est pas celle recherchée.

Détection n'égale pas preuve. Les outils de détection de contenus synthétiques produisent des scores, pas des verdicts. Un score élevé justifie une vérification supplémentaire, jamais à lui seul une affirmation publiée.

Voir comment ces termes sont contrôlés → Parcourir les fiches thématiques →