扫描下载APP
其它方式登录
智谱AI发布GLM-5.3-Flash多模态大模型,以高性能(Artificial Analysis评分57分,超DeepSeek V4 Pro)和极低价格(输入0.8元/百万Token,限时半价)直接挑战DeepSeek的性价比优势;其技术核心在于稀疏激活(仅激活5.6%参数)与国产算力优化(10万张华为等国产芯片支撑),旨在将大模型变为高频可消耗的Agent基础设施。
文章分析中国AI领域巨头与中小模型公司(如智谱、月之暗面、MiniMax、DeepSeek)在办公Agent赛道上的战略分化:巨头依托企业级组织上下文、权限体系和Runtime能力主攻B端采购市场;小龙们因基因、体量及服务能力限制,转向个人桌面Runtime和开源工具链(如DSH),以技术领先但非产品主导方式参与竞争。
开源大模型公司正调整商业化策略,通过修订许可证限制大型企业将模型用于MaaS等高价值商业场景,或提高API定价、强化私有化部署服务来构建收入来源。Kimi、Qwen、MiniMax、DeepSeek等厂商采取差异化路径,在开放生态与商业变现间寻求平衡。
DeepSeek V4 Flash因低价引发流量洪峰导致算力承压,随后通过峰谷定价(高峰价涨至0.11美元/任务、周末降价)试探开发者价格弹性与收入可持续性;此举收缩‘斩杀线’,使腾讯Hy3、GPT-5.6 Luna、小米MiMo-V2.5-Pro等模型获得喘息并加速增长;其调价本质是向资本市场证明从‘成本效率’转向‘定价权’的能力,平衡规模留存与高估值叙事。
DeepSeek前七个月收入4.75亿元,年化收入达4亿至5亿美元,毛利率44.6%(API达82.9%),但净亏损7.15亿元;MiniMax ARR半年暴涨500%至超8亿美元;智谱、Kimi等国内大模型厂商亦加速扩张与融资,行业普遍高投入、高亏损、高增长,B端 API 成盈利关键路径。
阿里千问开源Qwen3.8-Flash-Next多模态MoE模型,参数量125B+51B N-gram嵌入,支持百万级上下文,训练成本为前代1/9,在编程、智能体、多模态等十余项基准测试中超越DeepSeek-V4-Flash和Claude-Opus-4.6;智谱同步开源GLM-5.3-Flash模型,价格降至原版1/10;二者均以显著性价比推动国产大模型价格战。
DeepSeek一周内两次调整API价格,本质是应对算力供需失衡的调度手段,反映国内AI推理需求爆发式增长与基础设施(电力、算力、网络)结构性短缺的矛盾;涨价推动算力产业链重估,光模块、服务器、芯片代工等环节业绩兑现,同时商业模式正从固定租金转向Token收入分成。
中国首富钟睒睒通过旗下关子创投间接投资AI大模型公司DeepSeek,出资约3.5亿元,标志其首次正式切入AI大模型赛道;文章同时梳理了钟睒睒控制的多家投资主体在硬科技、新材料、具身智能等领域的布局,展现实业巨头向前沿科技延伸的战略动向。
智谱AI因成本压力和行业竞争大幅涨价,实行新老会员价格“双轨制”,导致用户拼单、账号转让等套利行为频发;平台以多设备登录、IP异常为由封禁账号,引发大量用户质疑其判定标准不透明,暴露其在盈利压力与用户体验间的深层矛盾。
英伟达发布新一代AI基础设施Vera Rubin NVL72机柜,实测在DeepSeek-V4-Pro智能体任务中吞吐量较GB300提升30倍、Token成本降低35倍;同步量产Groq 3 LPX推理加速器并推出专为智能体设计的Vera CPU,标志着AI从大模型时代全面迈入智能体(Agent)时代,性能评估标准与硬件架构均发生根本性变革。
文章分析DeepSeek创始人梁文锋对多模态技术战略定位的转变:虽坚持‘多模态不是AGI主线’的观点,但为强化Agent与推理能力,迅速推出V4 Flash Vision Exp这一以视觉原语驱动的多模态视觉理解模型,体现其从追求完美发布转向快速响应、产品优先的务实策略,并通过DSH生态与社区协作加速补齐多模态Agent闭环短板。
开源大模型在两个月内实现Token调用份额从28%跃升至62%,首次反超闭源模型,成为市场主流。英伟达以60亿美元技术授权加10亿美元投资重仓开源阵营,加速推进Nemotron开源模型战略,旨在通过压低推理成本,将利润沉淀回其硬件生态。闭源巨头虽密集推新降价,但技术领先窗口急剧收窄,企业更倾向选择性价比更高的开源模型承担生产级工作流。
宇树科技与DeepSeek合作推进具身智能发展,王兴兴聚焦世界模型驱动的‘物理AI自进化’,而梁文锋坚持持续学习能力为AGI核心,双方在技术路径上存在分歧;文章以Figure AI与OpenAI合作破裂为鉴,探讨该合作能否避免‘队友变对手’的风险。
文章剖析当前AI模型服务市场的严重不透明问题:模型版本缩水、训练数据掺杂、缓存与多Agent编排被厂商加密锁定,导致用户无法迁移、难以验证真实性能;同时指出低价订阅掩盖了高昂的真实token成本,扭曲市场对AI价值的判断,并警示模型公司正逐步丧失对AI行为的控制力,问责机制濒临瓦解。
Omarchy 是一个 AI 原生 Linux 发行版,其 4.0 版本将 AI 深度集成至操作系统底层,使 Agent 能直接读写系统文件、执行操作;发布十天内获社区 1074 个插件,吸引戴尔、Shopify、Cloudflare 等八位科技领袖联合注资 800 万美元成立基金会,押注‘模型之上、硬件之下’的新操作系统层。