Post #2840505
2026-04-27 06:19 UTC
Il y a 2 semaines, anthropic dévoile Claude Mythos preview en disant qu'elle détecte tellement bien les trous de sécurité que des milliers de programmes seraient mis en danger et donne en exemple de sa puissance sa sortie de sa sandbox :
https://www.lesnumeriques.com/intelligence-artificielle/un-signal-alarmant-claude-mythos-l-ia-surpuissante-d-anthropic-s-est-echappee-de-son-environnement-de-test-n254047.html
La seule source à chaque fois semble être Anthropic .Tout cela ressemble très fort à du marketing de la peur bien rodé pour faire parler de la puissance du produit. Et ca marche : le nombre de médias reprenant tout cela sans aucun recul critique et sans mettre en doute la communication d'entreprise est assez impressionnant.
2/2
Replies (2)
-
@riff@toot.aquilenet.fr 2026-04-27 06:28
@renemarc@piaille.fr c'est aussi les premier a suggérer des risques cataclysmiques à leurs propres produits : https://algorithmwatch.org/en/how-existential-risk-became-the-ai-industrys-most-successful-strategy/
-
@pulsation@mamot.fr 2026-04-27 06:51
@renemarc@piaille.fr Par exemple, dans cette analyse il semble être indiqué que sonnet a correctement détecté le bug au même titre que Mythos. https://gist.github.com/willyiwei/2b29e71ac7a86321a98edf4f407dce41