How Neon Health Cut Voice-Agent TTFT From 800 ms to 550 ms on WaferRead Case · 5 minutesTTFT cut from 800 ms to ~550 ms
The Inference Alpha: Maximizing Frontier Models on AMDRead Case · 14 minutes11.3× faster Kimi 2.5 on AMD MI355X774B GLM-5 on a single 8-GPU node