Vos choix de confidentialité

Nous utilisons des analyses pour améliorer Pollar et, avec votre consentement, des outils marketing (Meta, X) pour mesurer nos publicités. Vous pouvez modifier ce choix à tout moment dans les Paramètres.

Politique de confidentialité
Pollar
AccueilDemanderDirectBriefOriginalsRechercheCarteMarchésNotificationsPour Vous
FilsMarchés
NewsroomSoutenir Pollar
Confidentialité
Financé par les lecteurs

Gratuit, et ça le reste

Sans publicité. L'adhésion préserve l'indépendance de Pollar.

dès3,49 €/mois

Soutenir Pollar
Adhésion

Les membres ne voient pas ce panneau.

  • Soutien3,49 €/mois
  • Mécène7,99 €/mois
Soutenir Pollar

Le Brief du jour

Dolly Parton meurt à 80 ans

Le Canada riposte tandis que les pourparlers sur Ormuz et les décès de la rougeole éprouvent des gouvernements sous tension

Les douze dernières heures l'ont rappelé durement : les frontières économiques, les goulets maritimes et les barrières de santé publique cèdent tous avec fracas quand la politique s'appuie sur eux. Les principaux sujets n'étaient pas sans lien entre eux. Ils avaient un point commun : des gouvernements ont tenté de paraître fermes tout en gérant des systèmes qui réagissent mal aux cris.

Lire le Brief

En direct maintenant

Toutes les couvertures en direct
  • Des drones ukrainiens frappent des raffineries russes

    Plusieurs morts en Russie suite à une série d'attaques de drones ukrainiens. Une escalade meurtrière dans la campagne aérienne en cours.

  • Incendie dans un hôpital d'Islamabad

    Le bilan des nourrissons décédés dans l'incendie de l'hôpital d'Islamabad s'élève à 15. Les autorités confirment un décès supplémentaire.

Sous les projecteurs

Tous les fils

Autres · Mis à jour -3 min

Climat : de l'atténuation à l'adaptation

New findings only reconfirm the 35,000-death figure and tornado already in the anchor and chronicle ; no discrete new occurrence this cycle.

AccueilBriefFilsDemander
Catégories
© EL MUNDO
IA & Tech·-1 h

OpenAI publie des données de benchmark Jalapeño montrant des gains d'efficacité par rapport au Nvidia GB300

Les chiffres de benchmark publiés lors de la conférence Hot Chips indiquent que le processeur d'inférence personnalisé d'OpenAI offre jusqu'à 1.9 fois plus de travail par watt que les systèmes Nvidia GB300.

Résultats des benchmarks et performances d'inférence

Lors de la conférence Hot Chips mardi, OpenAI a présenté les premiers benchmarks de performance pour Jalapeño, son processeur d'inférence d'intelligence artificielle personnalisé. Les tests menés sur le benchmark SemiAnalysis InferenceX ont évalué le processeur par rapport aux systèmes Nvidia GB200 et GB300 sur trois grands modèles de langage : GPT-OSS 120B, DeepSeek R1 et la version à 1 billion de paramètres de Kimi K2.5. Jalapeño a délivré entre 1.5 et 1.9 fois plus de travail IA par watt que le matériel de comparaison en pic de performance. La latence de réponse a diminué d'un facteur compris entre 1.7 et 3.6 sur les modèles évalués, avec la marge de performance la plus large observée sur Kimi K2.5. Richard Ho, vice-président du matériel chez OpenAI, a déclaré que la puce atteignait à la fois un débit plus élevé et une latence plus faible.

En résumé, les résultats montrent une avancée de performance très, très significative par rapport à l'état de l'art.

— Richard Ho

Architecture et spécifications de puissance

Jalapeño est un circuit intégré spécifique à une application développé en collaboration avec Broadcom et Celestica. OpenAI a utilisé ses propres modèles d'intelligence artificielle pendant le développement, achevant le processus de conception du concept initial au silicium final en neuf mois. Le processeur fonctionne avec une consommation nominale de 700 watts, tandis que la puissance soutenue est restée inférieure à 550 watts lors des tests de benchmark. En comparaison, les systèmes Nvidia GB200 consomment 1,200 watts et les systèmes GB300 consomment 1,400 watts. Jalapeño est conçu exclusivement pour des tâches d'inférence plutôt que pour l'entraînement de modèles, optimisant la gestion de la mémoire et la mise en cache locale clé-valeur pour réduire les délais de transmission de données lors des phases de préremplissage et de communication. La société d'analyse indépendante SemiAnalysis a noté que les tests par rapport au matériel de la génération Blackwell précèdent les comparaisons avec la nouvelle architecture Rubin de Nvidia.

Consommation électrique nominale des systèmes d'accélérateur IA · W
OpenAI Jalapeño
700
Nvidia GB200
1 200
Nvidia GB300
1 400
OpenAI Jalapeño
700 W
Nvidia GB200
1200 W
Nvidia GB300
1400 W

Soutenir un Pollar indépendant

Les adhésions Soutien et Mécène gardent chaque article gratuit à lire et ajoutent la lecture hors ligne, l'audio et un brief sans sponsor.

Voir les formules d'adhésion

Calendrier de déploiement et feuille de route multi-générationnelle

OpenAI prévoit de déployer Jalapeño en volumes limités dans son infrastructure de centre de données interne avant la fin de 2026, suivi d'un volume accru en 2027 et d'une production à grande échelle au quatrième trimestre 2027. L'entreprise développe actuellement une puce de deuxième génération dont la sortie est prévue dans les mois à venir, tandis qu'une troisième itération est en phase de conception conceptuelle. OpenAI a confirmé qu'elle n'a pas l'intention de vendre les puces Jalapeño à des clients externes, réservant toute la production pour faire fonctionner des services tels que ChatGPT, Codex, l'API publique et les produits agents. La plateforme multi-générationnelle permet à OpenAI de co-développer des algorithmes, des systèmes de mémoire et des processeurs physiques pour répondre aux exigences futures des modèles.

Calendrier de développement et de déploiement d'OpenAI Jalapeño
  1. 2025-10Développement initial annoncé
  2. 2026-06OpenAI présente le processeur Jalapeño
  3. 25 août 2026Benchmarks de performance dévoilés à la conférence Hot Chips
  4. Late 2026Premier déploiement en petit volume dans l'infrastructure d'OpenAI
  5. 2027-Q4Début prévu de la production à grande échelle

Relations avec les fournisseurs et contexte sectoriel

Parce que Jalapeño ne peut pas entraîner de nouveaux modèles, OpenAI reste dépendant de fournisseurs de semi-conducteurs externes pour son infrastructure informatique plus large. La direction de l'entreprise a affirmé que les accélérateurs commerciaux d'autres fournisseurs continueront à alimenter les charges de travail d'entraînement aux côtés du silicium d'inférence propriétaire.

Nous allons avoir besoin de beaucoup de puissance de calcul. Et Jalapeño en fait partie. Cerberus en fait partie. Nvidia en fait partie. AMD en fait partie.

— Richard Ho

L'effort matériel personnalisé suit des développements similaires dans l'industrie, avec Anthropic concevant du silicium en interne, Google négociant avec Marvell pour des puces d'inférence personnalisées, et Amazon et Microsoft exploitant des processeurs propriétaires. Parallèlement, l'Union européenne a engagé 20 milliards d'euros pour des gigafactories d'IA qui achètent du matériel commercial sur le marché libre, coïncidant avec des augmentations de prix des serveurs de plus de 15% annoncées par Nvidia.

San Francisco
Richard Ho
San FranciscoRichard Ho

7 sources

  • OpenAI reta a Nvidia con su chip Jalapeño: ofrece más velocidad y eficiencia para acelerar la IA
    20 minutos·-2 h
  • OpenAI ya tiene un chip propio y es más eficiente que los de Nvidia
    EL MUNDO·-14 h
  • OpenAI's Jalapeno chip outperformed the GB300 on power and speed, according to OpenAI
    The Next Web·-17 h
  • OpenAI's Jalapeño chip is built for fast inference at scale, benchmarks show
    TechCrunch·-18 h
  • OpenAI Claims Its New Chips Can Outperform Nvidia Processors in Tests
    Bloomberg Business·-18 h
  • OpenAI says its Jalapeño chip bests Nvidia, others
    Axios·-18 h
  • OpenAI says its Jalapeño chip can power faster AI responses than the competition
    The Verge·-18 h

Recevoir Pollar Weekly

La semaine en actu, chaque vendredi. Gratuit.

Gratuit. Sans pub. Désinscription à tout moment.

Plus de Société & Science
Généré par IA·En savoir plus
Sécurité·Depuis 26 août·MÀJ -9 min
© ANSA.it

Quatorze nouveau-nés meurent dans l'incendie d'un hôpital d'Islamabad après l'explosion d'un climatiseur

L'explosion du compresseur d'un climatiseur a déclenché un incendie mortel au troisième étage de l'Institut des sciences médicales du Pakistan à Islamabad, tuant 14 nourrissons et provoquant une enquête.

Lire l'article
Transport·Depuis 25 août·MÀJ -5 h
© rts.ch

SpaceX annonce un complexe de lancement Starbase de 100 milliards de dollars dans le sud de la Louisiane

SpaceX a dévoilé ses plans pour construire un complexe de lancement de fusées de 125 000 acres sur Pecan Island, dans le sud de la Louisiane, s'engageant à investir 100 milliards de dollars pour étendre les opérations Starship, avec un premier lancement prévu en 2029.

Lire l'article
IA & Tech·Depuis 19 août·MÀJ -5 h
© Ars Technica

Le Tiangong Ultra chinois parcourt 100 mètres en 8,86 secondes aux jeux de robots de Pékin

Le robot humanoïde chinois Tiangong Ultra a parcouru 100 mètres en 8,86 secondes aux World Humanoid Robot Games de Pékin, dépassant le record d'Usain Bolt avant de percuter un tapis de protection.

Lire l'article