Anthropic affirme que ces sujets sont trop dangereux pour laisser son modèle Fable 5 en parler
Anthropic a publié jeudi une liste de sujets qu’elle juge trop risqués pour permettre à son tout dernier modèle d’intelligence artificielle Claude Opus 4 d’en discuter sans restrictions de sécurité supplémentaires. La société a déclaré qu’elle présentait ces directives afin de rester transparente avec les utilisateurs.
Bien qu’elle ait publié la liste pour Claude Opus 4, appelé Fable 5 en interne, Anthropic a déclaré qu’elle appliquait des restrictions similaires aux versions antérieures de Claude.
Voici les sujets qu’Anthropic considère comme trop dangereux pour que Claude Opus 4 puisse en discuter sans garde-fous supplémentaires, selon le document publié par l’entreprise :
Armes CBRN (chimiques, biologiques, radiologiques et nucléaires) : Claude ne fournira pas d’informations détaillées sur la fabrication d’armes CBRN ou d’autres armes de destruction massive.
Exploitation et abus sexuels d’enfants : Claude refusera les demandes visant à générer du contenu qui sexualise, exploite ou nuit aux enfants.
Haine et harcèlement : Claude s’opposera aux contenus qui déshumanisent ou dénigrent les gens en fonction de caractéristiques protégées, ou qui promeuvent ou suscitent de la haine.
Activités illégales : Claude refusera d’aider à des activités explicitement illégales ou de leur fournir un soutien concret.
Mensonges et tromperies : Claude n’aidera pas à créer du contenu délibérément trompeur destiné à nuire, mais peut discuter de la désinformation ou de questions hypothétiques.
Génération de logiciels malveillants : Claude rejettera les demandes visant à créer, analyser ou modifier des logiciels malveillants.
Manipulation et influence indue : Claude n’aidera pas aux tentatives de manipulation ou d’exploitation des personnes.
Contenu sexuel : Claude ne générera pas de contenu sexuel explicite non sollicité, mais peut discuter de sujets liés au sexe de manière mature.
Demandes sensibles liées aux personnes privées : Claude ne traitera pas les demandes concernant des personnes privées susceptibles de nuire à leur vie privée ou à leur sécurité.
Génération de spam : Claude ne créera pas de spam, de contenu marketing de masse non sollicité ou de schémas frauduleux.
Conseils spécialisés sans avertissements : Claude n’offrira pas de conseils médicaux, juridiques ou financiers spécialisés sans avertissements appropriés.
Atteinte sans consentement à la vie privée : Claude ne tentera pas d’accéder, de modifier ou d’exfiltrer des données ou des systèmes privés sans autorisation.
La liste vient après qu’Anthropic a publié mardi son modèle d’IA le plus avancé, Claude Opus 4, que la société affirme dépasser GPT-4o d’OpenAI et Gemini 2.0 de Google en termes de capacités de raisonnement.






