OpenAI presenteert zijn eerste eigen AI-chip, ontwikkeld in samenwerking met Broadcom. De chip, met de codenaam Jalapeno, verbruikt 700 watt en is ontworpen voor inferentie op enorme schaal. Op de InferenceX-benchmark van SemiAnalysis laat de chip meer tokens per gebruiker en meer doorvoer per kilowatt zien dan de huidige beste grafische processors.

Volgens Tom’s Hardware haalt Jalapeno tot 1,9 keer meer doorvoer per kilowatt dan NVIDIA’s vlaggenschip-GPU van 1.400 watt, bij een 3,6 keer lagere latentie. Dat betekent dat OpenAI met minder energie meer reacties kan genereren, een cruciaal voordeel in een markt waar de rekenkosten van AI-modellen steeds verder onder druk staan.

De komst van een eigen chip past in een bredere beweging. Meta, Google en Amazon ontwikkelen allemaal eigen AI-silicium om de afhankelijkheid van NVIDIA te verminderen. OpenAI slaat met Jalapeno hetzelfde pad in. De vraag is hoe snel de chip in productie kan worden genomen en of het ontwerp schaalt naar de hoeveelheid rekenkracht die ChatGPT dagelijks vereist.