Modèles
Modèles

GPT-6 Astra : OpenAI lance son modèle « critique » en cyber, un mois après l'affaire
Le dénouement de notre série Astra : qui accède au modèle et quand, ce que la system card dit du monitoring des chaînes de pensée.

Gemini 3.8 Flash : le nouveau modèle de Google, à prix doublé en janvier
Troisième Flash de Google en six semaines : Gemini 3.8 Flash coûte 0,75 $ le million de tokens en entrée, et le double à partir du 1er janvier 2027.

Claude Fable 5.1 : moins cher grâce au cache, filigrane activé
Fable 5.1 remplace Fable 5 aux mêmes tarifs d'API, avec des lectures de cache à 0,25 $ par million de tokens, et devient le premier modèle Claude filigrané.

Gemini 3.5 Transcribe : Google lance un modèle vocal avec un mode Smart de nettoyage automatique
Gemini 3.5 Transcribe transforme la dictée brute en texte net : il retire les « euh », corrige vos reprises et arrive dans Chrome.

Qwen3.8-Flash : Alibaba annonce une API multimodale à 0,16 $ le million de tokens
0,16 $ le million de tokens en entrée, 1 million de tokens de contexte, protocoles OpenAI et Anthropic : ce que l'on sait de la future API Qwen3.8-Flash d'Alibaba.

Qwen3.8-Flash-Next : Alibaba ouvre les poids d'un aperçu de l'architecture Qwen4
125 milliards de paramètres principaux dont 6 milliards actifs, 51 milliards d'embeddings N-gram et un tarif annoncé de 0,16 $ le million de tokens en entrée : Alibaba ouvre les poids de Qwen3.8-Flash-Next, aperçu de l'architecture Qwen4.

Ox Alpha, le modèle IA « stealth » qui intrigue : ce qui est vérifié, ce qui ne l'est pas
Ox Alpha, le modèle « stealth » gratuit d'OpenRouter : l'essentiel vérifié, les pistes GLM et MAI, et ce que l'anonymat change pour vos données.

DeepSeek-V4-Pro arrive en version GA : agents, raisonnement flexible et API Responses
DeepSeek-V4-Pro passe de la préversion au GA avec un mode de raisonnement flexible, une API Responses native et un accès Expert Mode.

Writer lance Palmyra X6 : le harness qui vise les coûts de tokens
Palmyra X6 vise les longues tâches d'entreprise, tandis que le harness de Writer tente de contenir les tokens et les appels d'outils.

OpenAI dévoile Ultrafast : GPT-5.6 Sol jusqu'à 14 fois plus rapide
Ultrafast accélère GPT-5.6 Sol jusqu'à 14 fois dans l'API OpenAI. Accès, prix, mesure du chiffre et limites de cette preview.

Gemini 3.7 Flash : Google lance son modèle de code et d'agents à moitié prix
Gemini 3.7 Flash arrive trois semaines après la 3.6. Les chiffres officiels montrent où Google progresse et combien dure le tarif de lancement.
Made by Google 2026 : ce que les Pixel 11 changent vraiment pour Gemini
Derrière les Pixel 11, Google installe Gemini Intelligence partout : Rambler, langue des signes traduite, photo assistée. En France dès le 20 août.