Introduction
Le 10 juin 2026, Anthropic a annoncé le lancement de Fable, une version publique et limitée de son modèle de cybersécurité très attendu, Mythos. Bien que l'intention derrière Fable soit de minimiser les risques d'utilisation abusive, notamment dans le développement de logiciels malveillants, les chercheurs en cybersécurité ne sont pas convaincus. Selon eux, les "garde-fous" imposés par Anthropic sont trop rigides et nuisent à la recherche constructive.
Les garde-fous de Fable : une bonne intention mal exécutée
Fable est conçu pour refuser toute requête potentiellement liée à la cybersécurité ou à la biologie, afin de prévenir la création d'armes biologiques et de logiciels malveillants. Cependant, Valentina "Chompie" Palmiotti, chercheuse renommée chez IBM X-Force, a souligné que même des tâches innocentes, comme lire un article de blog, sont bloquées. Ces restrictions, bien qu'issues de bonnes intentions, s'avèrent être un obstacle pour les chercheurs qui souhaitent utiliser Fable pour des pratiques de programmation sécurisées ou simplement pour l'éducation.
Les critiques de la communauté
Matt Suiche, vétéran de la cybersécurité, a critiqué le système de garde-fous de Fable, déclarant qu'il repose principalement sur des mots-clés. Cela signifie que toute mention apparentée au champ lexical de la cybersécurité déclenche les garde-fous. Suiche a souligné que cela pose un problème, car demander à Fable de rédiger un code sécurisé est souvent interprété comme une activité liée à la cybersécurité, plutôt qu'une pratique de génie logiciel.
Les conséquences pour les chercheurs
Cette approche basée sur les mots-clés a des conséquences significatives. Les chercheurs sont empêchés d'explorer des scénarios importants ou d'enseigner des pratiques de sécurité essentielles. En conséquence, cela limite la capacité de la communauté à innover et à développer de nouveaux outils de sécurité.
Comparaison avec d'autres solutions
Comparons avec d'autres acteurs du domaine. Par exemple, OpenAI et Google DeepMind ont mis en place des systèmes de sécurité dans leurs modèles, mais ceux-ci semblent être plus flexibles, permettant aux chercheurs d'explorer des cas d'usage tout en assurant la sécurité. Cela met en lumière le besoin pour Anthropic de réévaluer ses restrictions et d'écouter les feedbacks de la communauté.
Vers une solution équilibrée
Pour améliorer Fable, il serait bénéfique qu'Anthropic adopte une approche plus nuancée. Plutôt que de bloquer strictement tout contenu lié à la cybersécurité, une révision des garde-fous pourrait permettre une interaction plus dynamique avec les utilisateurs professionnels tout en maintenant la sécurité.
Conclusion
Les intentions d'Anthropic avec Fable sont louables, mais les critiques des chercheurs montrent un besoin urgent d'équilibrer sécurité et flexibilité. Pour les décideurs et entrepreneurs dans le domaine de la tech, c'est un rappel de l'importance de collaborer avec les chercheurs pour développer des solutions qui favorisent à la fois l'innovation et la sécurité.
Discutons de ton projet en 15 minutes.