进展

  • 华为昇腾:训练性能接近H100
  • 寒武纪:推理芯片成熟
  • 壁仞、摩尔线程:持续迭代

瓶颈

  1. CUDA生态:英伟达最大的护城河
  2. 先进制程:受限于光刻机
  3. HBM内存:依赖进口
  4. 软件栈:工具链不完善

突破口

  • 推理市场:国产芯片性价比优势明显
  • 特定场景:垂直优化可超越通用芯片
  • 政策支持:大基金持续投入

结论

国产芯片在推理和特定场景已可用,训练和生态仍需时间。乐观估计3-5年追上主流水平。