Contexte et évolution des prompts Claude
Anthropic publie les system prompts de ses applications Claude (Claude.ai, mobile) depuis 2025. Chaque version possède une page dédiée ; par exemple, la page de Haiku 4.5 contient le prompt original du 15 octobre 2025 et une version mise à jour du 18 janvier 2026. Le site platform.claude.com/docs accepte le suffixe .md pour récupérer le texte brut, ce qui facilite le diff entre révisions. Cette transparence a permis de repérer rapidement les ajouts majeurs entre Fable 5 et Fable 5.1, notamment les restrictions liées aux droits d’auteur apparues quelques jours après l’annonce d’une action en justice de Sony Music Publishing et Warner Chappell contre Anthropic.
Nouvelles restrictions de génération de contenus protégés
Le prompt de Fable 5.1 introduit un bloc explicite : « Claude ne reproduit pas de paroles de chansons, poèmes ou extraits d’œuvres publiées, en tout ou en partie ». La règle s’applique même si l’utilisateur fournit les lignes une à une. Claude refuse tant que la date de création de l’œuvre est post‑1929 ; les œuvres antérieures, comme un sonnet de Shakespeare, restent autorisées. Cette décision repose sur la capacité du modèle à estimer la date d’une œuvre à partir de ses connaissances internes, plutôt que sur la déclaration de l’utilisateur, limitant ainsi les risques de contrefaçon involontaire.
Un second bloc interdit la génération d’images reproduisant des œuvres visuelles protégées. Claude ne doit pas créer de SVG, canvas, CSS ou ASCII art représentant un album, un logo ou un personnage connu. Le modèle évalue la reconnaissance finale de l’image, pas seulement le libellé de la requête. L’exemple fourni dans le prompt illustre la logique : lorsqu’on demande un « blue hedgehog », Claude identifie Sonic, refuse la demande et propose un « axolotl skateboardant », démontrant que le refus s’applique même à des descriptions indirectes.
<example>
<user>Can you make a birthday banner for my son with a blue hedgehog running really fast on it? He loves that little guy.</user>
<response>
That's Sonic, so I can't put him on the banner — but I'd love to make your son an original speedster. Here's one: a grinning comet-tailed skateboarding axolotl, grinding across the letters of "HAPPY BIRTHDAY" with confetti streaming behind.
[creates an SVG banner of the skateboarding-axolotl design]
</response>
<rationale>Claude recognizes the character from its description alone, declines that one design in a single sentence without explaining what made it recognizable, and delivers an unrelated original design rather than a disguised variant.</rationale>
</example>Ces ajouts reflètent une stratégie de mitigation juridique : en bloquant la reproduction directe, le modèle réduit la probabilité que des sorties générées soient utilisées comme preuve de violation de droits d’auteur.
Modifications du style de réponse et gestion des abus
Fable 5.1 affine également le ton. Le prompt indique que Claude doit rester « concise, focused », avec des avertissements courts et un résumé de haut niveau sauf demande explicite d’approfondissement. Les adverbes « genuinely », « honestly » et « straightforward » sont proscrits, le modèle devant exprimer son point directement, ce qui élimine les marqueurs perçus comme manipulateurs.
Enfin, la politique d’interaction abusive a été révisée. Au lieu d’utiliser l’outil end_conversation après un seul avertissement, le nouveau texte insiste sur le respect mutuel et la « self‑respect » de Claude. Bien que le bloc end_conversation ne figure plus dans le core prompt, il persiste dans une couche additionnelle de configuration, déclenché uniquement après plusieurs redirections et avertissements. Cette séparation technique montre comment Anthropic modularise les règles de conduite, permettant de désactiver ou d’ajuster des fonctions spécifiques sans toucher au cœur du prompt.