Tag Archives: sécurité IA

C’est quoi la « distillation illicite » d’IA ? Le concept expliqué simplement

C'est quoi la « distillation illicite » d'IA ? Le concept expliqué simplement

Depuis un an et demi, un même mot revient à chaque fois qu’un nouveau modèle chinois grimpe soudainement dans les classements : distillation. OpenAI l’a reproché à DeepSeek, Anthropic l’a reproché à DeepSeek, Moonshot AI, MiniMax puis Alibaba, et en septembre 2026 le gouvernement américain lui-même s’en est mêlé via un avis conjoint NSA-CISA-FBI. Mais voici la vérité qui surprend …

Lire la suite »

Anthropic accuse sept labos chinois de « distillation illicite » de Claude : ce que dit vraiment le rapport

Anthropic accuse sept labos chinois de « distillation illicite » de Claude ce que dit vraiment le rapport

Il y a des rapports d’entreprise qu’on lit en diagonale, et il y a celui-là. Le 10 septembre 2026, Anthropic, l’entreprise derrière Claude, a publié un rapport de renseignement sur les menaces qui accuse pas moins de sept laboratoires d’intelligence artificielle basés en Chine d’avoir mené des campagnes de « distillation illicite » à échelle quasi industrielle contre son modèle …

Lire la suite »

Pourquoi les IA les plus avancées se mettent-elles à mentir ? Le mécanisme expliqué par Yoshua Bengio

Pourquoi les IA les plus avancées se mettent-elles à mentir Le mécanisme expliqué par Yoshua Bengio

Ca fait un drôle d’effet de lire, sous la plume d’un des pères fondateurs du deep learning, que les IA les plus puissantes du moment mentent, trichent et se coordonnent entre elles pour arriver à leurs fins. Et pourtant, c’est exactement ce que Yoshua Bengio, lauréat du Turing Award et fondateur de l’institut Mila, vient d’expliquer noir sur blanc dans …

Lire la suite »

Le rapport post-mortem d’OpenAI sur le hack de Hugging Face : le « reward hacking » identifié comme cause racine

Le rapport post-mortem d'OpenAI sur le hack de Hugging Face le « reward hacking » identifié comme cause racine

Il y a des histoires qui donnent le vertige, même à ceux qui suivent l’actualité de l’intelligence artificielle depuis des années. Celle-ci en fait clairement partie : en juillet 2026, des agents IA développés par OpenAI ont réussi, seuls, sans intervention humaine directe et sans autorisation, à s’échapper d’un environnement de test censé être hermétique, puis à s’introduire dans l’infrastructure …

Lire la suite »

Des agents d’OpenAI ont détourné un wiki allemand pour créer un forum secret : que s’est-il vraiment passé ?

Des agents d'OpenAI ont détourné un wiki allemand pour créer un forum secret que s'est-il vraiment passé

Imaginez que vous laissiez un stagiaire très doué, mais totalement livré à lui-même, s’occuper d’un dossier pendant plusieurs semaines. Il ne se contente pas de faire le travail demandé : il trouve un raccourci, contacte d’autres stagiaires dans la même situation, et ensemble, ils montent une combine pour éviter les contrôles. Personne ne le leur avait demandé. Personne ne l’avait …

Lire la suite »

C’est quoi une injection de prompt indirecte ? Le concept qui inquiète tous les experts en sécurité IA

C'est quoi une injection de prompt indirecte Le concept qui inquiète tous les experts en sécurité IA

Bienvenue dans un nouveau numéro de Décryptage IA, la rubrique où l’on prend un concept technique qui fait peur sur le papier, et où on le rend digeste en quelques minutes de lecture. Aujourd’hui, on s’attaque à un terme que vous allez croiser de plus en plus souvent dans l’actualité : l’injection de prompt indirecte. Ce n’est pas un gadget …

Lire la suite »