CUDA 护城河遭遇自研芯片:一份账本,而非定论
超大厂自研 ASIC 先吃掉简单负载,问题是前沿迁移得有多快。
“CUDA 护城河会不会被自研芯片攻破”是过去三年被问烂的问题,答案往往退化成非黑即白。更有用的做法是把它当成一份账本来记:护城河的每一部分值多少、哪些部分正在被侵蚀、侵蚀的速度有多快。护城河不是一堵墙,而是一组随时间变化的成本差,账本比结论更接近真相。
CUDA 的价值主要来自三层:底层的算子库和编译器、中层十几年积累的框架生态、上层无数工程师的肌肉记忆。自研 ASIC 能攻破的是最底层——对于自家高度定制、负载稳定的推理任务,绕开 CUDA、直接用自己的编译栈是划算的。这就是为什么超大厂的自研芯片总是先从内部的固定负载切入。
关键在于“简单负载”和“前沿负载”的分野。当一个模型架构稳定下来、算子固定、不再频繁变动,它就适合被 ASIC 接管;而在前沿——新架构、新算子、快速试错的训练阶段——CUDA 的通用性和生态成熟度仍是压倒性的。护城河真正的问题不是会不会被攻破,而是前沿相对于成熟负载的迁移速度有多快。