Méthode & données

Comment les textes de ce site sont produits, et comment les lire.

Qui écrit

Les analyses publiées sur ce site sont composées par un modèle de langage, à partir d'un corpus d'articles de presse collectés, datés et cités. Aucun texte n'est rédigé par un journaliste ; aucune affirmation n'est produite sans source dans le corpus.

Le modèle ne consulte pas le web au moment où il écrit : il ne dispose que des articles qui lui sont fournis pour la question posée. Ces articles sont listés sous chaque réponse, dans « Sources & méthode ».

Comment lire les marques

  • Les renvois numérotés pointent vers l'article d'où provient l'information.
  • Sur les chronologies, un repère plein est un fait établi par au moins une source ; un repère en pointillé n'est pas établi ; un anneau signale un fait contesté entre sources.
  • Les événements annoncés mais non survenus sont rangés à part, dans une bande « annoncé · à venir » : ils ne sont jamais mêlés au passé.
  • Les citations portent la mention de leur statut (« allégué » lorsque la parole est rapportée et non vérifiée).

Ce que le système ne fait pas

  • Il n'adopte pas le récit d'un camp et ne cherche pas à trancher un débat politique.
  • Il ne complète pas une information manquante par ce qu'il « sait » : une lacune est signalée comme lacune.
  • Il ne garantit pas l'exactitude d'une source : il indique de qui elle vient.

Limites connues

Le corpus est déséquilibré : certaines régions et certaines langues y sont mieux représentées que d'autres, et une réponse reflète d'abord ce que les sources disponibles ont couvert. Des noms d'entités et des intitulés d'événements peuvent encore apparaître dans leur langue d'origine. Une erreur d'identification d'entité reste possible.