Mise à jour du 2026-06-24. OpenAI et Broadcom ont dévoilé Jalapeño le 24 juin 2026, premier accélérateur d’une plateforme de calcul conçue autour des besoins d’inférence des grands modèles de langage.

Ce qu’il faut retenir

  • OpenAI affirme avoir conçu l’architecture à partir de ses modèles, noyaux, systèmes de service et besoins produits.
  • Broadcom apporte l’implémentation silicium et le réseau, tandis que Celestica participe aux cartes et racks.
  • Des échantillons exécutent déjà des charges ML en laboratoire.
  • Le déploiement initial est annoncé pour la fin de 2026 dans une feuille de route multi-génération.

Pourquoi c’est important

Une puce spécialisée peut réduire les mouvements de données et améliorer le coût, la latence et l’efficacité énergétique de l’inférence à grande échelle.

Les limites à connaître

Les mesures finales ne sont pas encore publiées. Les affirmations de performance par watt proviennent des partenaires et doivent être confirmées par un rapport technique.

Conseil pratique

Pour comparer un accélérateur, examinez les performances réelles du modèle, la mémoire, le réseau, l’utilisation atteinte et le coût total du rack.

Source officielle

OpenAI — Jalapeño inference chip