扫描下载APP
其它方式登录
DeepSeek等国内大模型厂商通过算法优化与国产芯片替代大幅降价,推动AI商业化落地;但推理芯片成本飙升成为新瓶颈,正促使企业自研定制推理芯片以突破价格天花板,行业竞争焦点从模型性能转向成本控制与硬件自主能力。
文章围绕AI竞争中算力的核心地位展开,指出算力是AI落地的前提和基础设施,英伟达凭借GPU硬件与CUDA生态构建长期壁垒;国产厂商如华为昇腾通过超节点、高速互联和系统级协同弥补单芯片差距;算力竞争已从单卡性能转向芯片、互联、软件、能耗等全栈系统能力,并延伸至电力、液冷等跨产业协同。
国产AI芯片厂商正从单卡性能竞争转向系统级超节点架构,通过高带宽互连、统一内存编址和全域调度,将数百上千张芯片集成成巨型算力系统,以应对先进制程受限、HBM断供及CUDA生态壁垒等现实约束;该路径虽缓解硬件短板,但带来功耗、散热、液冷改造、软件迁移与商用落地等新挑战,核心目标是实现‘可用’而非单纯峰值性能。
美国加强对高端AI芯片出口管制,尤其针对母公司位于中国等国的企业,以遏制技术扩散;但中东国家借力美国许可建设AI超算项目,同时主动引入中国设备、工程与AI技术(如DeepSeek、华为昇腾),形成美供芯片、中供基建与多元技术、中东出资的三方博弈格局,为中国打开设备配套、基建工程和多元技术布局三扇合作窗口。
Kimi K3采用KDA线性注意力机制,虽降低KV缓存带宽需求,但其2.8万亿参数规模、WideEP专家并行架构及64芯片扩展部署,显著增加对高端GPU、HBM、DRAM和高速网络设备的需求;效率提升可能通过杰文斯悖论刺激AI应用扩张,从而推动整体硬件需求增长。
凯文·凯利在央视访谈中预言中国5年内有望造出全球最先进AI芯片,依据是中国工程师的雄心与工程能力,强调芯片研发属可迭代的工程问题而非纯科学突破;文中列举昇腾、寒武纪、平头哥等国产AI芯片进展及中芯国际制造能力,同时指出EUV光刻机缺失等现实瓶颈,认为更可能率先实现系统级领先而非单芯片制程绝对领先。
文章揭示API厂商通过利用客户对GPU利用率的认知盲区实施定价套利,指出‘自建更便宜’仅在利用率≥52%时成立;多数AI创业公司实际利用率仅30%-50%,自建反而更贵。文中构建五维成本模型,推导出52%盈亏平衡临界点,并提供可验证的Python工具与决策树,强调利用率是核心变量,同时分析国产GPU(如昇腾910B)在中国区的成本优势。
美团发布LongCat-2.0大模型,总参数1.6万亿,采用MoE架构,平均激活参数约480亿。该模型全程基于约5万张华为昇腾910C国产芯片完成预训练与推理,实现“零英伟达”全栈国产化,标志着国产算力支撑万亿级大模型从理论走向工业级闭环。其在OpenRouter匿名测试中调用量跻身全球前三,尤其在Claude Code Agent场景达全球第二,验证了在agentic coding等真实业务场景的实用价值。
国产算力面临‘不好买’与‘不好用’双重困境:硬件产能严重不足,软件生态薄弱导致适配成本高、性能利用率低;尽管2025–2026年国产AI加速卡市场份额升至60%,但银行等信创重点行业仍通过算力服务变相使用英伟达芯片;行业寄望于2025年底起量产的新一代支持FP4/FP8的高性能芯片(如昇腾950、摩尔线程花港架构等),将其视为从‘能用’迈向‘好用’的关键转折。
本周数智周报聚焦AI产业加速发展:DeepSeek拟融资70亿美元、估值590亿美元;Arm称存储芯片供应持续紧张;Alphabet计划融资847.5亿美元加码AI基建,伯克希尔投资100亿美元;高通、英伟达、华为等巨头推进AI智能体、芯片与平台建设;腾讯、宇树、可灵AI等国内企业加快商业化与IPO进程;AI Agent成为行业共识,2026年被普遍视为AI智能体元年。
华为云CEO周跃峰宣布放弃以Token调用量和收入规模为核心指标的价格战,转而聚焦国产化算力底座(昇腾、鲲鹏等)、Agentic Infra新范式及行业AI专区,通过混合云+机密计算服务政企客户,将竞争重心从模型调用效率转向智能体在医疗、制造等行业的实际生产力提升。
华为云在2026 INSPIRE大会上提出Agentic Infra新范式,避开低价Token价格战,聚焦国产算力(昇腾)支撑下的真实生产力提升,通过AICS灵衢智算集群等基础设施及行业落地(如病理诊断、具身智能),打造开放、安全、自主可控的AI云底座。
DeepSeek因用户激增导致算力压力过大,自5月29日起临时限制对话中的‘重新生成’和‘修改消息’次数,普通模式限3–6次、专家模式约3次,属服务降级应对措施;官方未发公告引发用户疑虑,预计华为昇腾新卡下半年上线后算力扩容,限制或解除。
文章聚焦中国AI算力生态的快速发展,以鲲鹏CPU和昇腾AI芯片为核心,讲述极客开发者团队如何通过深度适配与共创,推动国产算力生态从‘荒漠’走向‘黑土地’。AIGCode、清华、中科大、DeepSeek等案例表明,软硬协同、开源开放、高效反馈机制正加速AI落地,支撑大模型训练、气候模拟、金融风控等多场景应用。
DeepSeek永久大幅下调V4-Pro API价格,逆势降价应对全球AI涨价趋势,凸显其以开源普惠为策略的商业模式;文章分析其背后依托国产算力(昇腾)、西部绿电成本优势、AI人才性价比及能源体系竞争力,指出其低价能力源于物理层到软件层的系统性成本控制,而非单纯让利。