Outils Intelligence Artificielle
Accueil/ Actualités/ Modèles/ Hypothèse de Riemann : ce que vaut vraiment l'avancée de Claude, de 41,6 % à 67,2 %
Modèles · 8 min de lecture

Hypothèse de Riemann : ce que vaut vraiment l'avancée de Claude, de 41,6 % à 67,2 %

Un Claude non publié fait passer de 41,6 % à 67,2 % la part prouvée des zéros de la fonction zêta sur la droite critique. Ce que vaut vraiment ce résultat.

Illustration

Le 10 août 2026, Anthropic a publié un billet de recherche au titre volontairement sobre : « Learning more about Claude's mathematical capabilities ». Le contenu l'est moins. Un salarié de l'entreprise, qui n'est pas mathématicien, a demandé à une version de recherche non publiée de Claude de « s'attaquer sérieusement » à l'hypothèse de Riemann, le problème posé en 1859 sur la répartition des nombres premiers, doté d'un prix d'un million de dollars par l'institut Clay. Claude a échoué, comme tout le monde depuis 167 ans. Mais en chemin, il a nettement amélioré un résultat voisin que les mathématiciens faisaient progresser par petites touches depuis des décennies.

L'annonce tombe neuf jours après les dix résultats d'Astra chez OpenAI, et le même jour que deux articles de fond de TechCrunch et The Verge sur l'irruption de l'IA dans la recherche mathématique. La course entre les deux laboratoires s'est déplacée sur un terrain inattendu : les théorèmes.

À retenir · l'essentiel
Le faitUn Claude non publié a fait passer de 41,6 % à 67,2 % la proportion de zéros de la fonction zêta dont on sait prouver qu'ils vérifient l'hypothèse de Riemann.
Ce qui n'est pas résoluL'hypothèse elle-même. Anthropic écrit noir sur blanc ne pas s'attendre à ce que ces techniques mènent à une preuve complète.
La vérificationPreuve formalisée en Lean et publiée sur GitHub, validée par deux mathématiciens d'Anthropic et relue par deux experts extérieurs nommés, Brian Conrey et Dan Goldston.
La limitePas encore de relecture par une revue, et un modèle que personne ne peut essayer.
L'expérience en chiffres
67,2 %
des zéros désormais prouvés sur la droite critique, contre 41,6 % auparavant
31 millions
de tokens produits, sur deux sessions Claude Code
60
sous-agents coordonnés pendant un jour et demi
650
idées testées lors de la première tentative, toutes infructueuses
𝕏Anthropic (@AnthropicAI) · 10 août 2026 · traduit de l'anglais
Nous avons demandé à une version de recherche non publiée de Claude de s'attaquer à l'hypothèse de Riemann. Elle ne l'a pas résolue, mais elle a fait des avancées sur un problème voisin : elle a fait passer de 41,6 % à 67,2 % la borne inférieure de la fraction des zéros de la fonction zêta de Riemann qui vérifient l'hypothèse. https://www.anthropic.com/research/riemann-zeta
Voir le post sur X

Ce que Claude a démontré, et ce qu'il n'a pas démontré

L'hypothèse de Riemann affirme que tous les zéros « non triviaux » de la fonction zêta se trouvent sur une même droite verticale, dite droite critique. C'est de cette régularité que dépend la finesse avec laquelle on comprend la répartition des nombres premiers. Personne n'a jamais prouvé ni réfuté l'énoncé, mais les spécialistes grignotent des résultats partiels. L'un d'eux consiste à prouver qu'au moins une certaine proportion des zéros est bien sur la droite : d'après le billet d'Anthropic, des décennies de travaux avaient porté ce plancher à 41,6 %.

C'est cette borne que Claude vient de faire bondir à 67,2 %, plus de deux tiers. Le modèle n'a rien inventé à partir de rien : sa preuve combine une série de travaux publiés entre 2023 et 2025 par les mathématiciens Baluyot, Goldston, Suriajaya et Turnage-Butterbaugh avec un article d'Enrico Bombieri datant de 2000, d'une façon que personne n'avait tentée. Anthropic cite ces auteurs dès le billet d'annonce, une prudence qui n'a rien d'anodin : OpenAI avait dû réécrire sa page sur Astra après que des chercheurs eurent protesté contre l'effacement des travaux humains sous-jacents.

Le billet officiel d'Anthropic, publié le 10 août 2026, détaille le résultat, la méthode et les documents de preuve.
Le billet officiel d'Anthropic, publié le 10 août 2026, détaille le résultat, la méthode et les documents de preuve.
!
« Progresser sur Riemann » ne veut pas dire s'en approcher

Les titres de presse évoquent un progrès sur « l'un des plus grands problèmes ouverts des mathématiques ». En toute rigueur, le progrès porte sur un problème voisin, pas sur l'hypothèse elle-même. Anthropic écrit d'ailleurs ne pas s'attendre à ce que les techniques employées par Claude mènent un jour à la preuve complète. Fait notable : cette fois, c'est l'entreprise qui freine et certains titres qui emballent, l'inverse de l'épisode Astra, où le billet d'OpenAI était plus prudent que le post viral de son propre chercheur.

Une méthode inédite : 60 sous-agents et des encouragements

Le déroulé, tel que raconté par Anthropic, vaut le détour. Jarred Sumner, salarié d'Anthropic connu pour avoir créé le runtime JavaScript Bun, lance le défi sans consigne mathématique. Première tentative : Claude génère et teste 650 idées, toutes infructueuses. Relancé, le modèle passe alors un jour et demi à coordonner une soixantaine de sous-agents dans Claude Code : 2 400 commandes shell, des centaines de scripts Python, des milliers de vérifications numériques contre les zéros connus de la fonction zêta, et des sous-agents qui arbitrent le travail des autres.

Pendant ce temps, l'apport humain s'est limité, selon le billet, à des messages d'encouragement, du type « continue » ou « crois en toi ». Anthropic précise que cela a aidé le modèle à surmonter son scepticisme initial sur ses propres chances de réussir.

Une note de bas de page du papier, relevée par TechCrunch, décrit la répartition du travail entre les 60 sous-agents. Elle en dit long sur le rendement réel de ce genre d'exploration :

Sous-agentsRôle dans la preuve
2ont développé les idées mathématiques clés
13ont alimenté ces deux agents en idées
30ont tenté d'en développer de nouvelles, sans y parvenir
13ont vérifié la correction des arguments
2ont rédigé le premier jet du papier

Une fois le résultat trouvé, Claude a fait relire ses preuves par d'autres sous-agents, cherché des contre-exemples, téléchargé 54 articles d'arXiv pour vérifier que sa trouvaille n'existait pas déjà, reprouvé le résultat de zéro, puis recommandé de lui-même qu'un théoricien des nombres humain valide le tout.

Qui a vérifié, exactement ?

C'est la question qui avait plombé l'annonce d'Astra, dont le dépôt portait la mention « agent-reviewed ». Anthropic a manifestement retenu la leçon. Deux mathématiciens maison, Levent Alpöge et Ralph Furman, ont étudié et validé le papier, et rédigé une note technique pour les experts. Claude a produit en parallèle une preuve formelle en Lean, publiée sur GitHub, qui passe l'outil de validation standard de l'écosystème. Enfin, deux spécialistes extérieurs du domaine, Brian Conrey et Dan Goldston, ont accepté d'examiner le papier dans l'urgence. Le choix de Goldston n'est pas neutre : il est coauteur de la série de travaux sur laquelle la preuve de Claude s'appuie le plus.

Au regard des standards mathématiques, il serait inapproprié que nous soyons auteurs du papier, puisque notre rôle a plutôt été celui d'un relecteur très intéressé. Mais nous en assumons la responsabilité mathématique.
Ralph Furman, mathématicien chez Anthropic, sur Hacker News le 10 août 2026

Il manque encore l'étape qui fait foi dans la discipline : la relecture par une revue à comité de lecture. Furman indique que le papier sera poli en vue d'une publication. D'ici là, le résultat a le statut d'un préprint très solidement outillé, pas celui d'un théorème estampillé par la communauté.

La course aux théorèmes, et le malaise des mathématiciens

Ce résultat n'arrive pas seul. Il conclut trois mois pendant lesquels les problèmes ouverts sont devenus un terrain d'affrontement direct entre OpenAI et Anthropic, chacun mettant en scène un modèle interne inaccessible au public. Deux semaines plus tôt, c'est déjà Claude qui avait sorti un candidat post-quantique du processus du NIST en affaiblissant le schéma de signature HAWK.

Trois mois de course aux théorèmes
Mai 2026OpenAI annonce qu'un modèle interne a réfuté une conjecture d'Erdős restée ouverte près d'un siècle.
Juin 2026Des mathématiciens publient la déclaration de Leiden contre la surenchère des labos, signée par plus de 3 400 personnes et soutenue par l'Union mathématique internationale.
20 juillet 2026Claude réfute la conjecture jacobienne, posée en 1939, avec un contre-exemple explicite.
28 juillet 2026Claude affaiblit le schéma post-quantique HAWK et accélère une attaque contre une version réduite d'AES.
1er août 2026OpenAI publie les dix résultats d'Astra.
10 août 2026Anthropic annonce la borne des 67,2 % sur les zéros de la fonction zêta.

L'épisode de la conjecture jacobienne, en juillet, avait donné le ton. C'est Levent Alpöge lui-même, l'un des deux valideurs du papier sur Riemann, qui l'avait annoncé avec une décontraction devenue célèbre dans la communauté.

𝕏Levent Alpöge (@__alpoge__) · 20 juillet 2026 · traduit de l'anglais
tiens donc, la conjecture jacobienne est fausse, merci à mon ami proche akhil d'avoir posé la question et à mon autre ami proche fable d'avoir travaillé pendant la finale de la Coupe du monde ((1+xy)^3 z + y^2 (1+xy) (4+3xy), y + 3x (1+xy)^2 z + 3xy^2 (4+3xy), 2x-3x^2 y-x^3 z) : C^3 vers C^3, de déterminant jacobien -2, envoie (0, 0, -1/4), (1, -3/2, 13/2) et (-1, 3/2, 13/2) sur (-1/4, 0, 0)
Voir le post sur X

Chez les mathématiciens indépendants, l'admiration se mêle à l'inquiétude. Dans l'enquête de The Verge publiée le 11 août, le médaillé Fields James Maynard juge les résultats récents de l'IA « très impressionnants » mais estime qu'ils poussent plus loin des techniques existantes qu'ils n'apportent d'idée conceptuellement neuve. Terence Tao, sur Mathstodon, se dit troublé par ces preuves « abandonnées à un stade intermédiaire » par des entreprises qui ne les portent ni en séminaire ni jusqu'à la publication relue. Et de jeunes chercheurs racontent leur peur de voir leurs sujets de thèse moissonnés par des agents. D'autres y voient un basculement à accompagner plutôt qu'à subir.

Si nous arrivons dans un monde où les théorèmes ne sont plus associés à des mathématiciens, ce ne sera peut-être pas plus problématique que le fait que les étoiles ne portent pas le nom d'astronomes, et que la plupart n'ont pas de nom du tout.
Timothy Gowers, médaille Fields, sur son blog le 26 juillet 2026
Astuce

Devant une annonce mathématique d'un labo d'IA, trois questions suffisent à faire le tri : le problème exact est-il l'énoncé célèbre ou un problème voisin ? Qui, nommément, a relu la preuve ? Et le résultat s'appuie-t-il sur des travaux humains récents, correctement cités ?

Questions fréquentes

Claude a-t-il résolu l'hypothèse de Riemann ?

Non, et Anthropic le dit explicitement. Le modèle a amélioré un résultat partiel voisin : la proportion de zéros de la fonction zêta dont on peut prouver qu'ils sont sur la droite critique.

Que valent ces 67,2 % ?

C'est un bond inhabituel pour un domaine qui progressait par fractions de point depuis des décennies, jusqu'au plancher de 41,6 % cité par Anthropic. Le résultat combine des travaux humains publiés entre 2000 et 2025.

La preuve est-elle vérifiée ?

Elle est formalisée en Lean et publiée sur GitHub, validée par deux mathématiciens d'Anthropic et relue par deux experts extérieurs nommés. Il manque encore la publication dans une revue à comité de lecture.

Peut-on utiliser ce modèle ?

Non. C'est une version de recherche non publiée, sans nom, sans date de sortie ni tarif. Le Claude accessible au public n'est pas ce modèle.

Le million de dollars de l'institut Clay est-il en jeu ?

Non. Le prix récompense une preuve ou une réfutation complète de l'hypothèse, pas une borne partielle, aussi spectaculaire soit-elle.

Comment ce résultat se compare-t-il aux dix problèmes d'Astra ?

Les résultats d'Astra couvrent plus de terrain, mais leur relecture initiale était confiée à un agent. Ici, la chaîne de validation humaine est nominative, et les travaux antérieurs sont cités dès l'annonce.