Ollama lève 65 M$ et revendique près de 9 millions d'utilisateurs
Ollama, l'outil open source qui fait tourner les modèles d'IA en local, boucle une série B de 65 M$ menée par Theory Ventures. Pourquoi l'IA sur votre propre machine séduit autant.

L'IA qui tourne sur votre ordinateur, sans envoyer la moindre donnée dans le cloud, vient de recevoir un vote de confiance retentissant. Ollama, l'outil open source qui permet de faire tourner des grands modèles de langage en local, a annoncé le 9 juillet 2026 une levée de 65 millions de dollars (environ 57 M€), une série B menée par le fonds Theory Ventures.
Fondé en 2023 par Jeffrey Morgan et Michael Chiang, Ollama était jusqu'ici un projet de développeurs quasi confidentiel pour le grand public — mais massivement adopté chez les techniciens. L'entreprise revendique aujourd'hui 8,9 millions de développeurs et une présence dans 85 % des entreprises du Fortune 500.
Qui est derrière Ollama
Les deux fondateurs ne sont pas des inconnus du monde du logiciel. Jeffrey Morgan et Michael Chiang s'étaient rencontrés à l'université, où ils avaient lancé Kitematic, un outil qui rendait Docker simple à utiliser, racheté par Docker en 2015. Leur travail est ensuite devenu Docker Desktop, aujourd'hui utilisé par plus de dix millions de développeurs. Dix ans plus tard, ils appliquent la même recette — « rendre simple ce qui est puissant mais compliqué » — aux modèles d'IA ouverts.
Car c'est bien là le cœur du produit. Quand les premiers modèles ouverts et téléchargeables gratuitement sont apparus, ils étaient, de l'aveu même de Morgan, difficiles à faire fonctionner.
Les modèles ouverts ont commencé à sortir en 2023, mais ils étaient vraiment difficiles à utiliser. Résultat : les faire tourner relevait du parcours du combattant.Jeffrey Morgan, cofondateur et CEO d'Ollama (blog officiel, 9 juillet 2026)
Ollama a résolu ce problème : une application à télécharger, et une seule commande pour lancer le dernier modèle ouvert en local, avec une API simple pour construire par-dessus. Aucune clé d'API, aucun serveur coûteux, aucune autorisation requise.

Pourquoi l'IA locale séduit
L'engouement pour Ollama n'est pas qu'une affaire de confort technique. Dans son billet d'annonce, l'entreprise résume sa promesse en trois principes qui parlent directement aux professionnels français, particulièrement sensibles à la protection des données.

La confidentialité d'abord. Avec un modèle qui tourne localement, vos données ne quittent jamais votre machine. Pour un cabinet d'avocats, un professionnel de santé ou une PME qui manipule des informations clients, c'est un argument décisif : là où l'usage d'un ChatGPT ou d'un service cloud pose la question de l'hébergement et du transfert des données, l'IA locale l'évacue par construction. Le sujet est particulièrement sensible dans le cadre du RGPD, qui encadre strictement le traitement et la localisation des données personnelles.
Le coût ensuite. Un modèle qui tourne sur votre propre matériel n'entraîne pas de facturation au token. On peut expérimenter, itérer et déployer sans voir la note grimper à chaque requête — un contraste net avec les API propriétaires facturées à l'usage.
Le contrôle enfin. Les modèles ouverts sont à vous : vous pouvez les garder, les personnaliser, les optimiser, sans risque d'être coupé du modèle dont dépend votre application.
Faire tourner un modèle chez soi suppose du matériel adapté (un ordinateur récent, idéalement avec une bonne carte graphique ou une puce Apple Silicon) et reste plus technique qu'ouvrir un onglet. Ollama pousse d'ailleurs aussi une offre cloud payante (de la gratuité à 100 $/mois), facturée au temps de calcul GPU et non au token, pour ceux qui doivent passer à l'échelle.
Ce que la levée change
Les 65 M$ portent le total levé par Ollama à 88 M$, auprès de Benchmark (qui avait mené la série A de 15 M$ via Peter Fenton), Theory Ventures, 8VC, Y Combinator et plusieurs investisseurs providentiels. Pour une équipe encore réduite — une quinzaine de personnes — c'est un carburant considérable pour accélérer.
Le fonds qui mène le tour ne cache pas sa thèse : la valeur se déplace vers les modèles que l'on possède et fait tourner soi-même.
Le meilleur avantage en IA, ce n'est pas un meilleur modèle : c'est de posséder celui que vous faites tourner. Et @ollama est le moyen d'y parvenir. 8,9 millions de développeurs construisent dessus (avec près d'un million de plus chaque semaine), 67 000 intégrations et une adoption dans 85 % du Fortune 500. Theory est fier de soutenir les fondateurs @jmorgan et @mchiang0610 dans la série B de 65 M$ d'Ollama.Voir le post sur X
L'enjeu de fond dépasse Ollama : il valide l'idée que les modèles ouverts ne sont plus une curiosité de chercheurs, mais une brique sérieuse de l'infrastructure IA en entreprise. Ollama sert d'ailleurs de porte d'entrée vers l'écosystème des modèles ouverts hébergés sur des plateformes comme Hugging Face, et croise la route d'acteurs européens comme Le Chat de Mistral, dont plusieurs modèles sont ouverts.
Envie de tester l'IA locale sans vous engager ? Repérez d'abord un modèle ouvert léger adapté à votre machine, puis vérifiez sur la fiche Ollama les prérequis matériels. Inutile de viser le plus gros modèle : pour de la rédaction ou de la synthèse courante, un modèle de taille moyenne suffit souvent.
Pour un professionnel ou un curieux français, l'annonce du jour envoie surtout un signal clair : l'alternative locale aux grands services cloud gagne en maturité, en financement et en légitimité. De quoi rendre le choix « cloud ou local » enfin crédible des deux côtés.
Questions fréquentes
Qu'est-ce qu'Ollama ?
Un outil open source, lancé en 2023, qui permet de télécharger et faire tourner des grands modèles de langage (LLM) directement sur son propre ordinateur, avec une commande simple et une API. Voir notre fiche Ollama.
Combien Ollama a-t-il levé ?
65 millions de dollars en série B (menée par Theory Ventures), annoncés le 9 juillet 2026, portant le total levé à 88 millions de dollars.
Pourquoi utiliser l'IA en local plutôt que dans le cloud ?
Trois raisons : la confidentialité (les données ne quittent pas la machine, un atout pour le RGPD), le coût (pas de facturation au token) et le contrôle (le modèle vous appartient et ne peut pas vous être retiré).
Faut-il un ordinateur puissant pour utiliser Ollama ?
Un matériel récent aide beaucoup, notamment une bonne carte graphique ou une puce Apple Silicon. Les petits modèles tournent sur des configurations modestes ; les plus gros exigent davantage de mémoire et de puissance.
Ollama est-il gratuit ?
L'application locale est gratuite et open source. Ollama propose en parallèle une offre cloud payante (jusqu'à 100 $/mois), facturée au temps de calcul GPU, pour passer à l'échelle.


