Multiverse Computing et Qualcomm rendent l’IA des datacenters plus performante et plus sobre

Multiverse Computing annonce une collaboration stratégique avec Qualcomm Technologies afin d’accélérer le déploiement d’une intelligence artificielle plus efficiente dans les datacenters. Dans le cadre de ce partenariat, les modèles d’IA développés par Multiverse Computing seront optimisés pour les accélérateurs Qualcomm Dragonfly™ AI200 et AI250, afin d’offrir davantage de performances tout en réduisant les besoins en ressources informatiques et la consommation énergétique.

En associant les accélérateurs d’IA de Qualcomm Technologies à la technologie de compression et d’optimisation des modèles de Multiverse Computing, les deux entreprises entendent répondre à l’un des principaux défis du secteur : accompagner la montée en puissance des usages de l’IA sans augmenter proportionnellement les coûts d’infrastructure et d’exploitation.

Plus de capacité, sans investissement matériel supplémentaire

Pour les exploitants de datacenters, cette approche permet d’exploiter plus efficacement les infrastructures existantes. En réduisant l’empreinte mémoire et les besoins de calcul des modèles avant leur déploiement sur les accélérateurs Qualcomm Dragonfly AI200 et AI250, les opérateurs peuvent traiter davantage de requêtes d’inférence, exécuter plusieurs modèles simultanément ou développer leurs services d’IA sans ajouter de nouveaux accélérateurs ni agrandir leurs infrastructures.

Les bénéfices de cette approche ont été démontrés lors du Mobile World Congress 2026. À cette occasion, Multiverse Computing et Qualcomm Technologies ont présenté un modèle de langage open source compressé fonctionnant sur un accélérateur Qualcomm® Cloud AI100 Ultra.

Dans un scénario de génération en temps réel de rapports médicaux d’urgence, cette démonstration a permis d’obtenir :

  • Jusqu’à 93 % de réduction du temps de réponse ;
  • Jusqu’à 44 % d’augmentation du débit ;
  • Jusqu’à 45 % de réduction de l’utilisation mémoire ;
  • Jusqu’à 21 % de baisse de la consommation énergétique ;
  • Sans aucune perte de précision.

Une seconde démonstration, portant sur un assistant conversationnel RAG (Retrieval-Augmented Generation) déployé en environnement on-premise pour interroger des documents financiers confidentiels, a également mis en évidence :

  • Jusqu’à 35 % de réduction du temps de réponse ;
  • Jusqu’à 54 % d’augmentation du débit ;
  • Jusqu’à 45 % de réduction de l’utilisation mémoire ;
  • Jusqu’à 14 % de baisse de la consommation énergétique ;
  • Sans perte de précision.

Accompagner une IA plus durable

Cette collaboration s’inscrit dans une évolution de fond du marché des datacenters, où la recherche d’efficacité devient un levier stratégique pour soutenir la croissance des usages de l’intelligence artificielle. En combinant des accélérateurs matériels performants à des modèles optimisés, Qualcomm Technologies et Multiverse Computing offrent aux entreprises une solution concrète pour développer leurs capacités IA tout en maîtrisant leurs coûts, leur consommation énergétique et leur empreinte infrastructure.

Articles connexes