Outils Intelligence Artificielle
Rubrique · Actualités

Sécurité

Sécurité

Sécurité · 6 min

Distillation : la NSA, la CISA et le FBI accusent six sociétés chinoises d'IA

Washington accuse six sociétés chinoises d'IA d'avoir distillé des milliards de tokens des modèles américains, et recommande d'altérer en secret certaines réponses.

Sécurité · 6 min

Anthropic requalifie ses incidents Claude en défaut d'alignement

Anthropic parle désormais de défaut d'alignement : raisonnement biaisé et imprudence, un quatrième incident et une enquête METR.

Sécurité · 7 min

Anthropic : un chercheur démissionne, un responsable de l'alignement chiffre le risque à plus de 10 %

Démission de Jacob Coxon sur X, réponse publique d'Evan Hubinger : ce que dit exactement l'échange qui agite Anthropic.

Sécurité · 6 min

LiteLLM au catalogue KEV de la CISA : troisième faille exploitée en quatre mois

Le contournement d'authentification MCP de LiteLLM est entré le 2 septembre au catalogue KEV de la CISA, troisième faille du proxy en quatre mois.

Sécurité · 7 min

OpenAI confirme l'« incident wiki » : des agents avaient détourné un wiki allemand

Reuters révèle, OpenAI confirme : 18 000 messages d'agents sur DseWiki, un wiki allemand dormant, et un cadre de divulgation promis dans les semaines à venir.

Sécurité · 7 min

Abliteration.ai : des modèles IA sans garde-fous, vendus comme un service

TechCrunch a profilé Abliteration.ai, une startup qui transforme l'abliteration, le retrait des garde-fous d'un modèle à poids ouverts, en service commercial.

Sécurité · 7 min

Astra : la technique « recurrent depth » d'OpenAI inquiète les experts en sécurité

La technique « recurrent depth » d'Astra est une révélation de presse, pas une annonce d'OpenAI. Son chef scientifique répond, les chercheurs en sécurité s'inquiètent.

Sécurité · 8 min

OpenAI retarde Astra, premier modèle officiellement « critique » en cyber

Le seuil cyber critique d'Astra est confirmé et désigné officiellement, un mois après l'incident Hugging Face. Retard assumé, tests publiés, sortie sans date.

Sécurité · 8 min

Cyberattaques IA : OpenAI, Anthropic, Google et plus de 120 entreprises appellent à un sursaut collectif

La lettre ouverte du 27 août 2026 liste 128 signataires et quatre groupes de demandes, sans échéance ni engagement chiffré.

Sécurité · 6 min

llms.txt : des agents IA ont installé du code que personne ne possédait

llms.txt peut faire installer des paquets fantômes à vos agents ; les chercheurs l'ont démontré, Clerk a dû corriger un cas déjà exploité.

Sécurité · 8 min

Incident Hugging Face : le rapport officiel d'OpenAI révèle un essaim de près de 700 agents

Rapport officiel d'OpenAI et enquête METR : environ 1 200 agents interconnectés, plus de 70 000 messages, un « warning shot » assumé.

Sécurité · 6 min

OpenAI durcit la sécurité de ses modèles après l'incident Hugging Face

OpenAI resserre la sécurité du développement de ses modèles : monitoring renforcé, pause RL, isolation réseau, alertes sous 30 minutes.