Beharon argues installed base and CUDA moat compound as models scale to 20T parameters
Nvidia's exponentially growing installed base of GPUs and CUDA software ecosystem create a self-reinforcing advantage for training ever-larger models (10T to 20T parameters), and…