扫描下载APP
其它方式登录
文章探讨北京大学在AI产业化路径上与清华大学的差异:清华以智谱等基础大模型公司为代表走实验室成果转化路线,而北大则聚焦具身智能(如银河通用)、AI for Science(如晶泰科技)、系统工程(如DSpark)等垂直方向,强调解决具体产业问题而非单纯基座模型创业。
DeepSeek推出DSpark推理加速技术,通过置信度调度的半自回归生成机制显著提升响应速度(快60%-85%)与高并发稳定性,降低推理成本约40%,且不牺牲输出质量;该技术源于梁文锋团队对算法优化的长期坚持,体现其以算法替代硬件投入、自主控制成本的独特路径。
DeepSeek通过DSpark推理优化技术,在不增加硬件的前提下实现最高85%的生成速度提升和400%的吞吐量增长,核心在于半自回归生成与置信度调度推测解码,显著减少无效校验带来的算力浪费,推动大模型竞争从参数内卷转向系统级工程(Harness)能力比拼。
DeepSeek V4 更新推出 DSpark 推测性解码框架,通过半自回归生成与置信度调度验证技术,在不改变模型输出分布前提下显著提升推理速度,Flash 和 Pro 版本生成速度提升 60%-85%,并开源全栈工具链 DeepSpec 支持草稿模型训练与评估。