AMD et Cerebras s'associent pour l'inférence IA

·Par Rédaction iatoskill
Gros plan horizontal macro de connexions et composants sur la surface verte et noire d'une carte de circuit imprimé avec microprocesseur central.

Jeremy Waterhouse / Pexels

Dans une étape importante et décisive d'intégration de matériel de supercalcul qui promet de remodeler en profondeur les coûts opérationnels de traitement des modèles de langage massifs, le fabricant de semi-conducteurs et de processeurs graphiques AMD et le renommé développeur de silicium sur tranche entière Cerebras Systems ont officiellement annoncé aujourd'hui un partenariat technique stratégique sur le marché. L'annonce officielle de coopération a eu lieu lors de l'événement Advancing AI 2026 à San Francisco.

Architecture désagrégée de traitement d'inférence

Le pilier central de la coopération technologique entre les marques de silicium consiste en le développement conjoint d'une nouvelle plateforme d'inférence IA désagrégée (disaggregated AI inference). Le système de traitement unifie les performances des racks de serveurs AMD Helios avec la capacité mémoire à haute bande passante des processeurs Cerebras Wafer-Scale Engine (WSE), en organisant les étapes logiques d'exécution des prompts et la génération de réponses en temps d'inférence.

En pratique, l'architecture innovante divise les charges de travail complexes d'inférence en deux étapes physiques séparées d'exécution rapide dans les datacenters d'entreprise. Dans la première phase, le traitement et la compression initiaux des prompts (phase de préremplissage) ainsi que la gestion de fenêtres de contexte gigantesques sont dirigés vers les racks AMD Helios. Chacun de ces racks est équipé en interne de soixante-douze GPU haute performance MI455X pour supporter le débit.

Génération rapide de réponses par silicium sur tranche entière

Dans la deuxième phase de l'opération informatique, la génération massive et répétitive de réponses mot par mot (phase de décodage), qui nécessite une bande passante mémoire extrême et des bus rapides, est traitée immédiatement par le Cerebras Wafer-Scale Engine. Des tests opérationnels de modélisation menés par les équipes techniques en juillet 2026 (UTC) utilisant le modèle Kimi 2.6 d'un billion de paramètres ont démontré une efficacité énergétique jusqu'à cinq fois plus de tokens par seconde par watt par rapport à une configuration matérielle isolée de Cerebras.

Concurrence sur le marché de l'infrastructure et des puces

La solution conjointe de silicium sera disponible commercialement pour les développeurs d'intelligence artificielle initialement sur les serveurs du Cerebras Cloud au cours du second semestre 2026 (UTC). L'infrastructure répond à la demande croissante des grandes entreprises informatiques aux États-Unis et en Asie qui cherchent à optimiser la vitesse des assistants logiques locaux sans augmenter les coûts opérationnels d'énergie et de traitement.

L'alliance stratégique matérielle intensifie la concurrence pour la fourniture de serveurs neuronaux à hyperéchelle sur le marché international de l'informatique. La coopération technique vise à offrir une infrastructure alternative hautement efficace aux marques technologiques, en concurrence avec les solutions cloud et silicium intégrées de concurrents et partenaires informatiques traditionnels, comme Microsoft, le moteur de recherche Google et les clusters neuronaux du développeur OpenAI. La capacité à diviser les tâches optimise l'évolutivité des réseaux d'entreprise.

Switches réseau physiques rapides et connexions stables dans les datacenters

Le mouvement massif de données et l'activation de bus rapides entre les racks GPU et les puces sur tranche entière nécessitent des connexions optiques physiques stables et des switches à haute vitesse. Le trafic de données et les connexions locales dépendent de puces et de routeurs conçus par des concepteurs spécialisés en réseau physique, comme le fabricant de semi-conducteurs réseau Broadcom. La baisse des prix des switches réseau locaux optimise le traitement et réduit la consommation électrique des ordinateurs des entreprises partenaires sur le marché de l'énergie propre.

Partager

Ce contenu a été créé et révisé par notre équipe (iatoskill.com), si vous rencontrez un problème, contactez-nous

Ce contenu a-t-il été utile ?
Apprenez

Plus d'Actualités

Voir Tout