Devices · 7h ago
AMD and Cerebras claim 5x inference efficiency over Nvidia's $20B SRAM approach
AMD and Cerebras partnered on a disaggregated inference system that delivers 5x higher tokens per watt than Nvidia's SRAM-based approach. Nvidia previously spent $20 billion on SRAM decode technology. The partnership aims to challenge Nvidia's dominance in AI inference hardware.
Meridian48 take
The efficiency claim is impressive, but real-world performance and adoption will determine if this partnership can truly dent Nvidia's market lead.
Read the full reporting
Nvidia paid $20 billion for SRAM decode - AMD just partnered for it instead →
TechRadar
ai-hardwareinference-efficiency