Workflow
通信专题报告:Deepseek引爆通信产业新机遇
西南证券·2025-02-16 08:03

专题报告 Deepseek引爆通信产业新机遇 西南证券研究发展中心 通信研究团队 2025年2月 核心要点 1 DeepSeek通过创新算法使推理效率大幅优化,大幅降低了应用成本。DeepSeek-V3的训练成本仅为2.788M H800 GPU小时,同 时其支持FP8混合精度训练,并针对训练框架进行了全面优化,以实现加速训练和降低GPU内存使用,通过算法、框架和硬件的共同 设计,克服了跨节点MoE训练中的通信瓶颈,显著提高了训练效率并降低了训练成本。 DeepSeek每百万输入tokens成本为0.55美 元,每百万输出tokens成本为2.19美元,相较于ChatGPT O1模型,输入和输出成本均降低了96%。DeepSeek-V3采用了多头潜在 注意力(Multi-head Latent Attention,MLA)和DeepSeekMoE架构,显著提高了推理速度和显存利用率,能够在保持模型性能 的同时实现高效的训练和推理。 2 DeepSeek从成本端和技术端对垂类AI小模型(AI Agent)带来了直接催化。从成本端看,更低的推理成本降低了垂类AI Agent的 开发成本,极大刺激了各行业的企业智能 ...