
OpenAI's Jalapeño chip outperforms Nvidia Blackwell on inference throughput per watt
OpenAI's custom AI chip, revealed in a SemiAnalysis report, uses HBM4 memory and a 700W TDP design to deliver over 700 tokens/second per user — potentially ending Nvidia's dominance in AI inference.










