计算机行业:DeepSeekV3%26R1加速LLM训练%26推理端降本/数据平权,有望开启端侧/AI应用的黄金时代%26传统非AI公司价值重估-250205-方正证券
DeepSeek V3/R1:颠覆行业生态的里程碑式创新,训练/推理成本骤降+不依赖监督数据+蒸馏成为捷径+宽松的开源协议 ➢ DeepSeek V3多方面创新带来对标GPT-4o的性能+远低于4o的训练/推理成本:DeepSeek V3整个训练过程不到600万美金的成本,模型效果对标亿美金 大幅降本的缘由是其在算法架构、训练环节、通信/计算优化/PTX层优化等多方面做出的创新: