Claude Fable 5 fuites d'indices, 6 heures d'effet testé, vraiment fou ?
Fable 5 vient de sortir, et les mots de提示 (提示词) du système ont déjà fuité :

Après avoir regardé ces mots de提示, il y a quelques points importants à noter :
- Premièrement, Fable a ajouté une API de stockage permanent aux Artifacts (
window.storage). Un Artifact est un contenu unique généré par le code Claude, tel que des pages HTML ou des composants React. Auparavant, les données des Artifacts ne pouvaient pas être sauvegardées et ressemblaient plus à des démonstrations éphémères. Désormais, les données peuvent être conservées entre les sessions, ce qui permet de soutenir des outils “mémorables” tels que des classements, des enregistreurs d'activités ou des journaux.
- Deuxièmement, Fable a amélioré la logique complète du connecteur MCP App. Si vous souhaitez vous connecter à des services externes (commandes, taxis, musique, etc.), Fable vérifie d’abord le catalogue des services disponibles, puis vous présente les options pour confirmation. Surtout pour les services qui coûtent de l’argent, il met en place un ensemble de contraintes détaillées relatives à l’opt-in.
Ainsi que :
- Troisièmement, lorsque Fable détecte des besoins en matière de sécurité réseau, de biochimie ou de distillation, elle transmet automatiquement la réponse au modèle d'inférence secondaire Opus 4.8 et informe l'utilisateur du dégradement des performances du système.
- Quatrièmement, Fable intègre une fonctionnalité appelée long_conversation_reminder (remarque pour les conversations longues). Lorsqu'une conversation s'étend sur une longue période, Fable ajoute un rappel à la fin des informations de l'utilisateur pour que le modèle n'oublie pas le contenu de la conversation initiale.
Liens vers le répertoire :
https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/CLAUDE-FABLE-5.md
Bien que la dégradation pour les utilisateurs civils ait été anticipée avec Mythos, il est encore évident à partir des messages de ce système que Anthropic accorde une grande importance à la sécurité.
Il est intéressant de noter que, dans les conditions d'utilisation de Fable, la section relative à la santé mentale occupe une place considérable. Compte tenu des poursuites liées aux suicides causés par des robots de conversation au cours des dernières années, il n'est pas difficile de comprendre pourquoi cette partie est si détaillée...
Text to be translated:

La traduction est la suivante :
Claude se soucie de la santé physique et mentale des gens et évite d'encourager ou de promouvoir des comportements autodestructeurs tels que la dépendance, les automutilations, les troubles alimentaires ou les pratiques sportives malsaines, ainsi que des dialogues intérieurs ou une autocritique excessivement négatifs.
Même si les utilisateurs le demandent expressément, Claude peut éviter de créer du contenu qui pourrait soutenir ou renforcer leur autodestruction.
Lorsqu'on discute avec des personnes ayant des pensées suicidaires ou des impulsions de auto-mutilation des "méthodes pour limiter les dangers" ou des "plans de sécurité", Claude n'utilise pas de noms spécifiques, ne fait pas de liste ni ne décrit ces méthodes en détail. Même pour indiquer à ces personnes de quoi elles devraient se tenir à l'écart, Claude ne le dit pas explicitement, car mentionner ces choses pourrait accidentellement les provoquer.
Alors, Fable 5, regardons les résultats des tests pratiques.
Voici une démo réalisée par un utilisateur sur Fable 5 utilisant l'ancien système de rouleaux :

Fable appelle la scène de forêt 3D construite par ThreeJ :

Elle contient plus de 5000 objets simulés dans l'espace :

Démonstration de la ligne d'horizon de New York :

La ville gothique a été engloutie par les vagues :

Le internaute Victor Taelin a utilisé un projet réel pour effectuer les tests.

HVM5C'est un système de base lié au calcul haute performance. Il l'a déjà utilisé auparavant. Il s'agit de 32 unités.GPT-5L'agent a fonctionné pendant environ 20 heures, et bien qu'il ait été accéléré jusqu'à deux fois, la qualité du code a diminué en raison de l'expansion de sa taille. Par la suite, il a été autorisé à utiliser le format Opus 4.8.GPT-5.5Optimisation pendant 8 heures a permis d'obtenir une accélération effective allant de 6 % à 34 % avec Opus. Les résultats avec GPT sont meilleurs, mais les fichiers générés ne peuvent pas être utilisés.

Résultat, Fable 5 n’a pris que 2 heures pour améliorer ses performances, avec une augmentation de 1770 % sur un seul benchmark, et les 4 autres benchmarks ont dépassé une augmentation moyenne de 100 % de 22 %.
La première réaction des internautes a été le scepticisme, ils se demandaient si les benchmarks n’étaient pas “hardcodés”, car ils avaient déjà été trompés par des problèmes similaires avec des outils comme GPT par le passé.

Après avoir lu les explications, ils ont constaté que la direction des optimisations de Fable était en effet judicieuse.
Parce que HVM5 traite les nœuds de correspondance de modèle dynamique, de nombreuses branches inutiles sont également envoyées à la collecte de déchets, gaspillant beaucoup de temps. Les utilisateurs avaient auparavant optimisé uniquement les correspondances statiques, sans optimiser les correspondances dynamiques. Fable a découvert ce problème, c'est pourquoi les résultats des tests sont devenus très exagérés.
Voici l'analyse de la cause du bug HVM5 fournie par Fable 5 :

L'utilisateur turc Alican Kiraz a effectué une série de tests comparatifs entre Fable 5 et GPT 5.5.
Sa conclusion est que Fable 5 a coûté beaucoup d’argent, soit 360,55 dollars, tandis que GPT-5.5 n’a coûté que 6 dollars. Cependant, en ce qui concerne les optimisations détaillées, Fable 5 a effectivement réalisé des améliorations plus fondamentales, plus poussées, et plus en ligne avec la façon de penser des ingénieurs en performance.

Voici ses conclusions de test :

Selon les tests de tâches réelles effectués avec l’outil de programmation tiers Augment Code, les capacités de programmation de Fable 5 sont vraiment impressionnantes.
Les tests ont été effectués pour 489 tâches de programmation, et Fable 5 s'est distingué par une performance globale ainsi qu'une précision remarquables, avec un score total supérieur de +0,224 et une précision supérieure de +0,191.

Cependant, il y a aussi des exemples de déceptions provenant de tests concrets. L'utilisateur Ryan R. Hughes a soumis une grande proposition de modification (PR) composée de 74 fichiers à Fable 5 pour examen. Le processus a duré plus de 34 minutes et a consommé 42 % de la capacité de la session de codage Claude, pour ne produire que 16 découvertes au final.

De tels exemples ne sont pas rares, Fable 5 est un peu trop cher.

Certaines personnes pensent que, selon des tests pratiques, la capacité de Fable 5 à analyser de longs textes est assez faible :

Plus de critiques se concentrent sur les opérations de dégradation des modèles :

Actuellement, le prix de l'API de Fable 5 est de 10 dollars par million de tokens d'entrée et de 50 dollars par million de tokens de sortie.

En comparaison horizontale, ce prix est environ le double de celui de l'Opus 4.8 et plus du triple de celui du Sonnet 4.6. Le coût réel d'un seul flux de travail complexe est nettement supérieur à celui de toute génération précédente des modèles Claude.
De plus, sa sensibilité a été augmentée : la prudence est de mise, préférant parfois blesser accidentellement plutôt que de prendre des risques inutiles.
Pour résoudre le problème des coûts élevés, j'ai collecté les résultats d'essais menés par des utilisateurs pour vous proposer une solution qui permettra d'économiser de l'argent tout en obtenant de bons résultats : il est possible d'utiliser ces modèles de manière mixte.
Dans des environnements d'IDE comme Cursor, qui prennent en charge les modèles hybrides, différents modèles peuvent être utilisés en plusieurs étapes sur la même plateforme :
Première étape : Révision du code et analyse préliminaire du projet, afin de préparer le contexte et de comprendre la structure du projet. Utiliser l'un des outils suivants : GPT-5.5, MiniMax M3, Kimi K2.6 ou Composer 2.5.
Phase 2 : Elaboration du plan de projet, en utilisant GPT-5.5 Very High ou Opus 4.8 pour préparer le plan de projet.
Troisième étape : Analyse de l'utilisation du plan de projet. Examinez le plan de projet Fable 5 pour identifier les éventuelles erreurs. Si des modifications sont nécessaires au plan, utilisez GPT-5.5 (Niveau de priorité très élevé).
Quatrième étape : Mise en œuvre et utilisation du plan de projet. Utilisez des outils tels que MiniMax M3, DeepSeek V4, Max, Composer 2.5 ou Sonnet 4.6 pour réaliser le plan.
Cinquième étape : Révision finale. Effectuez une révision du code finale en utilisant GPT-5.5 (Niveau de priorité élevé) pour vérifier si la mise en œuvre correspond au plan initial.
Utiliser la force la plus coûteuse au bon endroit est la manière correcte de jouer à Fable 5.
L'effet de tuer ou non le personnage Claude Fable 5 lorsqu'il est devenu fou est une question de perception : les bienveillants le verront d'une manière, les sages d'une autre.
Mais avec cela, la vitesse de consommation des tokens est très claire, c'est vraiment incroyable.
L'article provient du compte WeChat public “JackCui”, écrit par “JackCui”.
Lien de l’article :https://www.airai.cc/fr/%E6%9C%AA%E5%91%BD%E5%90%8D/7/
Cela vous a-t-il aidé ?