Contexte et définition

Dans le domaine de l’intelligence artificielle, deux repères chronologiques déterminent la fraîcheur d’un modèle : la date de sortie, moment où le laboratoire rend le modèle accessible, et la coupure d’entraînement, date à laquelle le modèle a cessé d’ingérer des données. La différence entre ces deux dates représente le retard inhérent du modèle dès son lancement, indépendamment de toute interaction utilisateur.

Données présentées

Le site stale.jock.pl recense 20 modèles issus de huit laboratoires. Parmi eux, neuf affichent une coupure d’entraînement officielle. Exemple : Llama 4 (Meta) a été publié le 5 avril 2025 alors que son entraînement s’est arrêté en août 2024, soit un écart d’environ 8 mois. Claude Haiku 4.5 (Anthropic) a vu le jour le 15 octobre 2025 avec une coupure en juillet 2025, soit 3 mois de retard. Le modèle le plus récent, GPT‑6 Astra (OpenAI), est sorti le 3 septembre 2026 et ne possède que des données jusqu’au 30 avril 2026, créant un écart de 4 mois. Les laboratoires qui publient au moins une coupure sont Anthropic, Google DeepMind, Meta et OpenAI.

{
  "model": "GPT-6 Astra",
  "lab": "OpenAI",
  "release_date": "2026-09-03",
  "training_cutoff": "2026-04-30"
}

Analyse de l'écart entre sortie et coupure

Un écart de plusieurs mois signifie que le modèle ignore tout événement postérieur à la coupure. Ainsi, un modèle publié en septembre 2026 ne pourra jamais connaître les faits survenus après avril 2026, même si l’utilisateur interroge le système en 2027. Cette lacune se traduit par des réponses erronées ou incomplètes sur des sujets d’actualité, des changements réglementaires ou des avancées scientifiques récentes.

Les outils de navigation ou de recherche web intégrés à certains modèles ne comblent pas ce vide. Le texte source précise que le modèle « lit » les pages demandées, les utilise pour la réponse en cours, puis les oublie dès la prochaine requête. Aucun apprentissage incrémental n’est réalisé, ce qui maintient le fossé entre la connaissance interne et le monde extérieur.

Implications et limites

Pour les applications critiques – veille juridique, assistance médicale ou analyse financière – la staleness peut entraîner des décisions basées sur des informations dépassées. Les développeurs doivent donc envisager des stratégies de mise à jour, comme le fine‑tuning périodique avec des jeux de données récents ou le recours à des systèmes hybrides combinant LLM et bases de connaissances actualisées.

La transparence reste inégale : près de la moitié des modèles listés ne publient aucune date de coupure, rendant impossible l’évaluation du retard. De plus, les compteurs dynamiques du site se recalculent en temps réel, mais ils ne corrigent pas l’absence de données de base. Les utilisateurs doivent donc vérifier les informations auprès de sources officielles avant de se fier à la réponse d’un modèle.