OpenAI signe un partenariat stratégique avec Broadcom pour sa puce d’inférence : une révolution pour l’IA et les semi-conducteurs
Dans un développement majeur pour l'industrie de l'intelligence artificielle, OpenAI a annoncé aujourd'hui son partenariat avec Broadcom pour la conception d'une puce d'inférence dédiée. Cette décision stratégique, qualifiée de « grande avancée » par Greg Brockman, président d'OpenAI, vise à renforcer l'infrastructure sous-jacente des modèles et produits de l'entreprise. « En concevant nous-mêmes une plus grande partie de la pile technologique, nous pouvons fournir davantage d'intelligence avec une plus grande efficacité », a-t-il déclaré. L'action Broadcom (NASDAQ : AVGO) a bondi de 2 % suite à cette annonce, portant sa hausse depuis le début de l'année à 10 %. Ce mouvement marque un tournant dans la dépendance d'OpenAI aux GPU coûteux de Nvidia, ouvrant la voie à une nouvelle ère d'optimisation des performances et de réduction des coûts pour les modèles d'IA générative.
Que peut faire la nouvelle puce ?
La puce Broadcom est un ASIC. Selon les experts du secteur, ce type de puce est moins flexible que le GPU de Nvidia, mais moins coûteux et adapté à certaines tâches d'IA. OpenAI a déclaré avoir conçu la puce en neuf mois et avoir également réalisé une grande partie du système informatique qui la fera fonctionner.
Les deux sociétés qualifient la puce de « processeur d'intelligence » et la décrivent comme le premier élément d'une plateforme plus vaste destinée à rendre l'IA plus rapide et plus accessible.
Broadcom s'est forgé une solide réputation durant l'essor de l'IA, grâce à la fourniture de puces personnalisées aux grandes entreprises de cloud computing et aux laboratoires de pointe.
Un échantillon physique de la puce sera remis à OpenAI mercredi. Les entreprises ont indiqué espérer commencer à utiliser les puces Jalapeño d'ici fin 2026 et étendre leur utilisation par la suite.
Cette décision intervient après des mois de tensions liées au matériel Nvidia
Huit sources ont indiqué à Reuters qu'OpenAI était insatisfaite de certaines des puces les plus récentes de Nvidia et recherchait d'autres solutions depuis l'année dernière. Sept de ces sources ont précisé que l'entreprise s'inquiétait de la rapidité de réponse du matériel Nvidia pour certaines tâches, comme l'écriture de code. Les puces requises par OpenAI devraient à terme couvrir environ 10 % de ses besoins en inférence.
Cependant, Altman a déclaré dans un message publié sur X : « Nous adorons travailler avec NVIDIA, qui fabrique les meilleures puces d’IA au monde. Nous espérons rester un client majeur pendant très longtemps. »
Nvidia reste leader sur le marché des puces pour l'entraînement de grands modèles, mais l'inférence est devenue un nouveau champ de bataille. En septembre, Nvidia a annoncé son intention d'investir jusqu'à 100 milliards de dollars dans OpenAI, un accord qui lui permettrait de prendre une participation dans la start-up.
En février, le PDG de Nvidia, Jensen Huang, a également qualifié de « non-sens » les rumeurs de tensions et a réaffirmé que Nvidia prévoyait un investissement important. Cependant, l'accord de 100 milliards de dollars a été abandonné et remplacé par un accord bien moins conséquent.
Plus tard, Jensen Huang a confirmé que l'investissement total de 100 milliards de dollars n'était « probablement pas envisageable », et il a par la suite précisé que le chiffre initial n'était « jamais un engagement », mais simplement une invitation à investir jusqu'à ce montant.
Nvidia a finalement conclu un accord portant sur une participation de 30 milliards de dollars dans OpenAI, sur la base d'une valorisation pré-monétaire de 730 milliards de dollars. Selon Huang, il s'agirait probablement du dernier investissement de Nvidia dans OpenAI avant l'introduction en bourse prévue de la société.
Le nouveau modèle cybernétique d'OpenAI surpasse Anthropic
OpenAI a également été actif sur un autre front. Le 22 juin, il a officiellement lancé GPT-5.5-Cyber dans le cadre de son programme de cyberdéfense Daybreak.
Sur CyberGym, un test développé à l'UC Berkeley à partir de 1 507 failles logicielles connues issues de 188 projets open source, le modèle a obtenu un score de 85,6 %. Mythos 5 d'Anthropic a obtenu 83,8 % et Claude Opus 4.7, 73,1 %.
Les jeux Mythos 5 et Fable 5 d'Anthropic ont été retirés du service le 12 juin suite à un décret d'urgence sur le contrôle des exportations émis par l'administration Trump, au nom de la sécurité nationale. Au 23 juin, les deux jeux restaient inaccessibles, sans date de remise en service annoncée.
Si vous lisez ceci, vous avez déjà une longueur d'avance. Restez-y grâce à notre newsletter.
Connectez-vous pour répondre
Connectez-vous pour partager votre avisCommentaires
Articles associés
|Square
Obtenez l'application BTCC pour commencer votre expérience avec les cryptomonnaies
Commencer aujourd'hui Scannez pour rejoindre nos + de 100 millions d’utilisateurs