Decart CEO claims 5-8x inference efficiency across Nvidia, TPU, Trainium chips
Inference optimization stack (DOSS) enables running models 5-8x more performant on major chips, critical due to chip supply constraints through 2028; supports real-time video worl…