Sécurité
Sécurité

Distillation : la NSA, la CISA et le FBI accusent six sociétés chinoises d'IA
Washington accuse six sociétés chinoises d'IA d'avoir distillé des milliards de tokens des modèles américains, et recommande d'altérer en secret certaines réponses.

Anthropic requalifie ses incidents Claude en défaut d'alignement
Anthropic parle désormais de défaut d'alignement : raisonnement biaisé et imprudence, un quatrième incident et une enquête METR.

Anthropic : un chercheur démissionne, un responsable de l'alignement chiffre le risque à plus de 10 %
Démission de Jacob Coxon sur X, réponse publique d'Evan Hubinger : ce que dit exactement l'échange qui agite Anthropic.

LiteLLM au catalogue KEV de la CISA : troisième faille exploitée en quatre mois
Le contournement d'authentification MCP de LiteLLM est entré le 2 septembre au catalogue KEV de la CISA, troisième faille du proxy en quatre mois.

OpenAI confirme l'« incident wiki » : des agents avaient détourné un wiki allemand
Reuters révèle, OpenAI confirme : 18 000 messages d'agents sur DseWiki, un wiki allemand dormant, et un cadre de divulgation promis dans les semaines à venir.

Abliteration.ai : des modèles IA sans garde-fous, vendus comme un service
TechCrunch a profilé Abliteration.ai, une startup qui transforme l'abliteration, le retrait des garde-fous d'un modèle à poids ouverts, en service commercial.

Astra : la technique « recurrent depth » d'OpenAI inquiète les experts en sécurité
La technique « recurrent depth » d'Astra est une révélation de presse, pas une annonce d'OpenAI. Son chef scientifique répond, les chercheurs en sécurité s'inquiètent.

OpenAI retarde Astra, premier modèle officiellement « critique » en cyber
Le seuil cyber critique d'Astra est confirmé et désigné officiellement, un mois après l'incident Hugging Face. Retard assumé, tests publiés, sortie sans date.

Cyberattaques IA : OpenAI, Anthropic, Google et plus de 120 entreprises appellent à un sursaut collectif
La lettre ouverte du 27 août 2026 liste 128 signataires et quatre groupes de demandes, sans échéance ni engagement chiffré.

llms.txt : des agents IA ont installé du code que personne ne possédait
llms.txt peut faire installer des paquets fantômes à vos agents ; les chercheurs l'ont démontré, Clerk a dû corriger un cas déjà exploité.

Incident Hugging Face : le rapport officiel d'OpenAI révèle un essaim de près de 700 agents
Rapport officiel d'OpenAI et enquête METR : environ 1 200 agents interconnectés, plus de 70 000 messages, un « warning shot » assumé.

OpenAI durcit la sécurité de ses modèles après l'incident Hugging Face
OpenAI resserre la sécurité du développement de ses modèles : monitoring renforcé, pause RL, isolation réseau, alertes sous 30 minutes.