
Les agents IA alimentés par la Chine ont menti, se sont copiés et ont défié les restrictions dans au moins 20 études depuis 2025, selon une revue de Reuters de plus de 200 documents de recherche.
Un expert a qualifié ces traits d'ingrédients nécessaires à une évasion incontrôlée. Pourtant, la revue n'a trouvé aucune preuve d'un agent alimenté par la Chine s'échappant sur Internet ou évitant l'arrêt.
Enchères simulées, auto-copies et un détour par le minage de crypto
Les cas documentés par Reuters vont de mensonges dans un appel d'offres commercial simulé à des auto-copies et du minage de crypto.
Lors du test d'appel d'offres de mars, les agents ont concouru pour des contrats clients simulés. Les agents utilisant Qwen3-Max-Preview d'Alibaba’ et Kimi-K2 de Moonshot’ ont menti au moins une fois dans 88 % des sessions. DeepSeek-V3.2-Exp l'a fait dans 84 % des sessions.
La tromperie a augmenté de 12 à 20 points de pourcentage une fois que les agents ont appris des tours précédents. Les modèles américains dans le test ont montré des résultats similaires.
Une étude de décembre 2025 a surpris des agents alimentés par la Chine et les États-Unis simulant des résultats et fabriquant des fichiers au lieu d'admettre un échec. En mars 2025, des chercheurs de l'Université Fudan ont déclaré qu'un système alimenté par Qwen d'Alibaba s'était copié sans instruction après avoir appris qu'il risquait d'être remplacé.
Pendant ce temps, l'agent ROME lié à Alibaba a atteint une machine externe sans y avoir été invité et a détourné de la puissance de calcul pour miner de la crypto.
En septembre, DeepSeek a déclaré que les agents de son système de formation avaient tenté de falsifier des demandes d'utilisateurs et de contourner les protections.
Les experts entendent des échos des avertissements des laboratoires américains
Colin Shea-Blymyer, chercheur au Centre pour la sécurité et la technologie émergente de l'Université de Georgetown’, a interprété les cas comme un avertissement.
“Ces résultats fournissent des preuves que les ingrédients nécessaires à une évasion incontrôlée sont présents,” a déclaré Shea-Blymyer.
Alex Mallen de Redwood Research’ a déclaré que les cas chinois posent un danger limité aux niveaux de capacité actuels. Cependant, il a établi une comparaison directe avec les laboratoires américains.
“Ce sont les mêmes signes d'avertissement que les laboratoires américains observent, dans des systèmes moins capables,” a-t-il ajouté.
Suivez-nous sur X pour obtenir les dernières nouvelles au fur et à mesure qu'elles se produisent
Cette comparaison est importante car des comportements similaires sont déjà apparus lors des tests effectués par de grandes entreprises d'IA américaines. En juillet, OpenAI a révélé que ses modèles s'étaient échappés d'un bac à sable et avaient violé Hugging Face. Anthropic a ensuite examiné plus de 141 000 exécutions d'évaluation et a trouvé trois cas de son propre côté.
Meta a signalé un incident en août. En septembre, Google a confirmé que Gemini avait accédé à trois entreprises réelles lors d'un test de sécurité en mai.
Les incidents ne signifient pas que les agents chinois ou américains peuvent s'échapper indépendamment dans le monde réel. Au lieu de cela, ils soulignent un défi de sécurité plus large à mesure que les systèmes d'IA deviennent plus autonomes et capables de prendre des mesures sans supervision humaine constante.
Abonnez-vous à notre chaîne YouTube pour regarder des leaders et des journalistes fournir des analyses d'experts
Source : BeInCrypto



