IBM et Together AI misent sur un grand cluster NVIDIA B300
IBM et Together AI vont déployer un cluster massif de GPU NVIDIA B300 sur IBM Cloud dans le cadre d’un accord de 240 millions de dollars. L’objectif: réduire le coût des inférences et muscler l’infrastructure d’IA d’entreprise.
IBM et Together AI ont signé un accord pluriannuel de 240 millions de dollars pour déployer sur IBM Cloud un grand cluster de systèmes NVIDIA HGX B300. L’installation doit servir à l’inférence de modèles open source à grande échelle et à des usages d’IA d’entreprise, dans un contexte de tension persistante sur les capacités de calcul. Le déploiement est présenté comme le premier cluster d’inférence dédié de cette taille chez IBM avec ce matériel. Sa mise en service est attendue au premier trimestre 2027 selon la source spécialisée [à vérifier].
Un pari sur la capacité, pas seulement sur la puissance brute
La logique de l’accord est très simple: quand la demande explose, celui qui a des GPU disponibles gagne souvent la partie. Together AI, qui fournit une plateforme d’inférence pour modèles ouverts, utilisera IBM Cloud pour soutenir une activité annoncée à 400 000 milliards de tokens par mois, tandis qu’IBM apporte la capacité industrielle nécessaire. La société indique avoir choisi IBM et NVIDIA pour leurs feuilles de route produit et leur aptitude à livrer du calcul au rythme requis, avec un objectif de coût par token plus bas.
Le matériel retenu, HGX B300, n’est pas la vitrine la plus spectaculaire de NVIDIA, mais il reste adapté à des datacenters classiques refroidis à l’air. Chaque système embarque huit GPU B300, avec interconnexion NVLink à l’intérieur de la machine et réseau Ethernet Spectrum-X entre les nœuds. IBM dit attendre jusqu’à 30 fois plus de rendement pour l’« AI factory » par rapport aux générations précédentes. Une formule très datacenter, mais qui dit bien l’enjeu: produire plus d’inférence pour moins cher.
Ce que cherchent IBM, NVIDIA et Together AI
Pour Together AI, l’accord renforce une plateforme déjà centrée sur l’inférence, le fine-tuning, l’entraînement et les workflows agentiques. L’entreprise a récemment levé 800 millions de dollars en série C, pour une valorisation de 8,3 milliards de dollars. En parallèle, elle déploie déjà du calcul dans plusieurs sites, notamment dans le Maryland, à Memphis et en Suède, ce qui montre une stratégie multi-infrastructures assez pragmatique.
IBM, de son côté, élargit son offre d’infrastructure IA en entreprise avec un partenaire qui connaît bien les contraintes d’API et de rendement. Alan Peacock, directeur général d’IBM Cloud, résume l’intention en parlant d’entreprises engagées dans une course à l’adoption de l’IA agentique à grande échelle. NVIDIA pousse la même lecture, mais avec son vocabulaire habituel: selon Dion Harris, les « AI factories » deviennent une infrastructure essentielle, au même titre que l’électricité ou les télécommunications.
Points clés
- 240 millions de dollars sur plusieurs années.
- Premier cluster d’inférence B300 dédié chez IBM.
- 400 000 milliards de tokens mensuels chez Together AI.
- 30 fois plus d’output annoncé par rapport aux générations précédentes.
- Premier trimestre 2027 pour la mise en service [à vérifier].
- IBM, Together AI et NVIDIA cités dans l’accord.
En chiffres
- 240 millions de dollars — montant de l’accord, annoncé en 2026.
- 400 000 milliards de tokens par mois — volume traité par Together AI.
- 800 millions de dollars — série C récente de Together AI.
- 8,3 milliards de dollars — valorisation après la levée.
- 30 fois — gain d’output annoncé par IBM pour l’AI factory.