Outils Intelligence Artificielle
Rubrique · Actualités

Modèles

Modèles

Modèles · 6 min

GPT-6 Astra : OpenAI lance son modèle « critique » en cyber, un mois après l'affaire

Le dénouement de notre série Astra : qui accède au modèle et quand, ce que la system card dit du monitoring des chaînes de pensée.

Modèles · 6 min

Gemini 3.8 Flash : le nouveau modèle de Google, à prix doublé en janvier

Troisième Flash de Google en six semaines : Gemini 3.8 Flash coûte 0,75 $ le million de tokens en entrée, et le double à partir du 1er janvier 2027.

Modèles · 7 min

Claude Fable 5.1 : moins cher grâce au cache, filigrane activé

Fable 5.1 remplace Fable 5 aux mêmes tarifs d'API, avec des lectures de cache à 0,25 $ par million de tokens, et devient le premier modèle Claude filigrané.

Modèles · 6 min

Gemini 3.5 Transcribe : Google lance un modèle vocal avec un mode Smart de nettoyage automatique

Gemini 3.5 Transcribe transforme la dictée brute en texte net : il retire les « euh », corrige vos reprises et arrive dans Chrome.

Modèles · 8 min

Qwen3.8-Flash : Alibaba annonce une API multimodale à 0,16 $ le million de tokens

0,16 $ le million de tokens en entrée, 1 million de tokens de contexte, protocoles OpenAI et Anthropic : ce que l'on sait de la future API Qwen3.8-Flash d'Alibaba.

Modèles · 9 min

Qwen3.8-Flash-Next : Alibaba ouvre les poids d'un aperçu de l'architecture Qwen4

125 milliards de paramètres principaux dont 6 milliards actifs, 51 milliards d'embeddings N-gram et un tarif annoncé de 0,16 $ le million de tokens en entrée : Alibaba ouvre les poids de Qwen3.8-Flash-Next, aperçu de l'architecture Qwen4.

Modèles · 6 min

Ox Alpha, le modèle IA « stealth » qui intrigue : ce qui est vérifié, ce qui ne l'est pas

Ox Alpha, le modèle « stealth » gratuit d'OpenRouter : l'essentiel vérifié, les pistes GLM et MAI, et ce que l'anonymat change pour vos données.

Modèles · 6 min

DeepSeek-V4-Pro arrive en version GA : agents, raisonnement flexible et API Responses

DeepSeek-V4-Pro passe de la préversion au GA avec un mode de raisonnement flexible, une API Responses native et un accès Expert Mode.

Modèles · 6 min

Writer lance Palmyra X6 : le harness qui vise les coûts de tokens

Palmyra X6 vise les longues tâches d'entreprise, tandis que le harness de Writer tente de contenir les tokens et les appels d'outils.

Modèles · 6 min

OpenAI dévoile Ultrafast : GPT-5.6 Sol jusqu'à 14 fois plus rapide

Ultrafast accélère GPT-5.6 Sol jusqu'à 14 fois dans l'API OpenAI. Accès, prix, mesure du chiffre et limites de cette preview.

Modèles · 6 min

Gemini 3.7 Flash : Google lance son modèle de code et d'agents à moitié prix

Gemini 3.7 Flash arrive trois semaines après la 3.6. Les chiffres officiels montrent où Google progresse et combien dure le tarif de lancement.

Modèles · 7 min

Made by Google 2026 : ce que les Pixel 11 changent vraiment pour Gemini

Derrière les Pixel 11, Google installe Gemini Intelligence partout : Rambler, langue des signes traduite, photo assistée. En France dès le 20 août.