Un pari de 400 millions de dollars sur des puces d'IA moins chères

Une startup appelée General Compute vient d'emprunter 400 millions de dollars pour construire un service cloud autour d'un type de puce d'IA moins coûteux. Cet accord pourrait signaler un changement par rapport au matériel coûteux qui domine l'IA aujourd'hui.

AI2Day NewsdeskUpdated Editor: Lee Brown3 min read
A large industrial control room with rows of glowing screens displaying abstract data flows and status dashboards, some panels showing green indicators and one
Share

Points clés

  • General Compute a levé 400 millions de dollars en financement par dette auprès de la société d'investissement Upper90 en 2025.
  • Le prêt serait le premier jamais garanti par des puces d'inférence, le matériel spécialisé qui exécute les modèles d'IA finis plutôt que d'en entraîner de nouveaux.
  • Les puces SambaNova SN50 de General Compute revendiquent des vitesses d'inférence 16 fois plus rapides que les services cloud basés sur GPU comparables.
  • Cet accord suit l'intérêt croissant des investisseurs pour les modèles d'IA open-source comme alternative moins chère aux modèles de pointe de laboratoires comme OpenAI et Anthropic.

Une petite startup d'IA vient d'emprunter 400 millions de dollars, et l'aspect inhabituel n'est pas le chiffre. C'est ce que le prêteur a accepté comme garantie.

General Compute, fondée par le PDG Finn Puklowski et à peine au-delà de son stade d'amorçage, a obtenu le prêt d'Upper90, une société d'investissement axée sur la technologie. La garantie : des puces d'inférence. Ce sont des processeurs spécialisés conçus pour exécuter rapidement et à moindre coût un modèle d'IA terminé, par opposition aux puces bien plus coûteuses utilisées pour entraîner un modèle à partir de zéro. Pensez aux puces d'entraînement comme l'usine qui fabrique une voiture, et aux puces d'inférence comme au moteur qui la fait réellement fonctionner.

Billy Libby, cofondateur d'Upper90, a déclaré à TechCrunch qu'il croit que c'est le premier prêt jamais garanti par des puces d'inférence spécifiquement. Il a de l'expérience ici. En 2021, sa société a financé des achats de GPU pour une société de centre de données appelée Crusoe, qu'il considère comme le premier prêt sur la valeur des puces avancées. Les banques traditionnelles ne voudraient pas toucher aux puces comme garantie à l'époque car personne ne savait à quelle vitesse elles perdraient de la valeur. Depuis, le géant du cloud CoreWeave a construit tout un business autour des prêts garantis par des puces et a fait son entrée en bourse, et ce type de financement est maintenant courant.

Maintenant, Libby pense que l'inférence est la prochaine vague. « Tout le monde n'a pas besoin d'un superordinateur, mais ils ont tous besoin de l'inférence et de l'IA », a-t-il déclaré à TechCrunch.

General Compute construit son service autour de puces de SambaNova, un fabricant de puces soutenu par Intel. Les puces SN50 sont conçues pour être économes en énergie et éviter les systèmes de refroidissement par eau coûteux que les GPU haut de gamme nécessitent généralement, ce qui signifie qu'elles peuvent être intégrées dans des centres de données plus standard plus rapidement. L'entreprise revendique une inférence 16 fois plus rapide que ses rivales cloud basées sur GPU.

Le discours plus large concerne le coût. Exécuter des tâches d'IA sur des modèles open-source, un logiciel d'IA dont le code sous-jacent est disponible publiquement, est bien moins cher que de payer par requête à un laboratoire de pointe. Notre article du 15 juillet sur les cadres des puces d'IA signalant une demande illimitée notait que les entreprises font déjà une forte pression sur ce qu'elles obtiennent réellement pour leur argent, ce qui est exactement l'écart que General Compute vise. Des startups comme OpenRouter et Fireworks, qui acheminent le trafic vers des modèles open, ont récemment levé des fonds à des valorisations élevées, et K3 de Kimi, que nous avons couverte le 16 juillet, correspond maintenant à OpenAI et Anthropic sur les benchmarks de codage.

Qu'est-ce que cela signifie pour les personnes et les entreprises qui utilisent des outils d'IA ?

Des prix plus bas, potentiellement. Si les entreprises d'infrastructure exécutent des modèles capables sur des puces moins chères et plus efficaces, les coûts devraient baisser pour tous les acteurs en aval : les entreprises construisant des applications, les développeurs écrivant des assistants de codage, quiconque paie un abonnement qui repose sur l'IA.

General Compute n'est pas seule. TensorWave poursuit une stratégie similaire basée sur les puces AMD. Le fil conducteur est la conviction que la quasi-monopole d'Nvidia sur l'informatique d'IA va se relâcher à mesure que les alternatives arrivent à maturité.

Puklowski l'a dit clairement : « C'est le premier signal du capital qui s'organise et de la fragmentation de la domination monopolistique d'Nvidia. »

La question que l'année prochaine devra résoudre est de savoir si les puces SN50 tiendront leurs promesses à grande échelle. Le financement est astucieux ; le matériel doit encore faire ses preuves en production.

© 2026 AI2Day