Claude et l’écriture créative : régression ou changement d’objectif ?
ClaudeAnthropicтворческое письмо
Aucun effondrement de qualité n’est confirmé
Je ne qualifierais pas la situation de dégradation avérée de Claude. À la fin septembre 2026, la documentation des modèles d’Anthropic présente toujours le système comme performant pour rédiger, éditer, structurer et résumer des textes. Les tâches créatives et littéraires y sont même explicitement citées comme des cas d’usage adaptés.
Les évaluations indépendantes ne décrivent pas non plus une régression générale. Dans les sélections de 2026, Claude Opus 4.6 et Claude Fable 5 figurent souvent parmi les meilleurs modèles pour les usages créatifs, notamment pour la qualité de la prose, la cohérence et le maintien de la structure dans les textes longs. Une analyse d’Opus 5.5 relève également des progrès en lisibilité, en hiérarchisation des priorités et dans le respect des règles définies par l’utilisateur.
Les plaintes concernant un style plus plat ou plus prudent ne sont toutefois pas dénuées de sens. Le blog d’Anthropic consacré à l’alignment décrit un ensemble associant documents alignés constitutionnellement, supervised fine-tuning de qualité et environnements de reinforcement learning. Cette optimisation réduit les comportements non alignés et améliore les refus, mais la liberté créative n’y est pas présentée comme une métrique distincte.
C’est là que le sujet devient intéressant : le modèle peut mieux respecter une instruction tout en choisissant moins souvent une direction inattendue. Pour un texte professionnel, c’est souvent un avantage. Pour une fiction fondée sur l’ambiguïté, des thèmes risqués ou une voix d’auteur affirmée, cela peut devenir un défaut. Il s’agit davantage d’un changement de fonction d’optimisation que d’une perte soudaine de la capacité d’écriture de Claude.
Ce que change réellement un alignment renforcé
La principale conséquence est un éventail de réponses plus restreint. Un respect plus fiable des règles apporte une structure prévisible et une voix stable, mais peut évincer la spontanéité, le risque stylistique et l’ambiguïté volontaire.
Pour un prompt engineer, cela signifie qu’un jugement global du type « il écrit mieux ou moins bien » ne suffit pas. Je testerais séparément le respect de la voix demandée, la diversité des continuations, le nombre de réserves, la tendance à expliquer un procédé littéraire plutôt qu’à le réaliser et le comportement face à des intrigues limites. Une note moyenne de cohérence peut facilement masquer une perte de personnalité.
Pour l’instant, les données étayent l’idée d’un compromis plutôt que celle d’une baisse générale de qualité. Les nouvelles variantes de Claude sont saluées pour leur finition et leur structure longue, tandis que les critiques portent sur leur prudence et une voix moins expressive. La question la plus gênante reste ouverte : peut-on mesurer l’audace littéraire assez bien pour que la prochaine mise à jour de sécurité ne l’efface pas discrètement ?