扫描下载APP
其它方式登录
智谱AI发布GLM-5.3-Flash多模态大模型,以高性能(Artificial Analysis评分57分,超DeepSeek V4 Pro)和极低价格(输入0.8元/百万Token,限时半价)直接挑战DeepSeek的性价比优势;其技术核心在于稀疏激活(仅激活5.6%参数)与国产算力优化(10万张华为等国产芯片支撑),旨在将大模型变为高频可消耗的Agent基础设施。
DeepSeek前七个月收入4.75亿元,年化收入达4亿至5亿美元,毛利率44.6%(API达82.9%),但净亏损7.15亿元;MiniMax ARR半年暴涨500%至超8亿美元;智谱、Kimi等国内大模型厂商亦加速扩张与融资,行业普遍高投入、高亏损、高增长,B端 API 成盈利关键路径。
智谱发布GLM-5.3-Flash(“牛来”)模型,总参数320B、激活18B,是GLM-5系列首款原生多模态开源模型,在Artificial Analysis智能指数中达57分,与Claude Opus 4.8持平,但API价格仅为后者的约1/40;全部算力由超10万张国产芯片集群承载,并通过EPD分离架构、混合注意力机制等技术创新大幅降低推理成本。
阿里千问开源Qwen3.8-Flash-Next多模态MoE模型,参数量125B+51B N-gram嵌入,支持百万级上下文,训练成本为前代1/9,在编程、智能体、多模态等十余项基准测试中超越DeepSeek-V4-Flash和Claude-Opus-4.6;智谱同步开源GLM-5.3-Flash模型,价格降至原版1/10;二者均以显著性价比推动国产大模型价格战。
智谱AI发布GLM-5.3-Flash,其为GLM-5系列首个原生多模态模型,具备视觉编码能力,显著提升编程闭环效率;在保持媲美Claude Opus 4.8的综合智能评分(57分)的同时,价格仅为后者的约1/40;全部推理负载由国产芯片集群承载,经受真实流量压力测试,验证了国产算力支撑前沿大模型的可行性与经济性。
智谱AI确认匿名上线的Ox Alpha大模型为其GLM系列新一代产品,中文名‘牛来’,具备超长上下文、多模态输入及工具调用能力;上线六天内因免费策略引发全球开发者大规模试用,处理Token量达23.2万亿,引发对其算力部署与技术定位的关注。
智谱AI因成本压力和行业竞争大幅涨价,实行新老会员价格“双轨制”,导致用户拼单、账号转让等套利行为频发;平台以多设备登录、IP异常为由封禁账号,引发大量用户质疑其判定标准不透明,暴露其在盈利压力与用户体验间的深层矛盾。
中国大模型公司如智谱、阿里、小米、蚂蚁等采用匿名方式在OpenRouter等海外平台上线测试模型(如Ox Alpha、HappyHorse、Pony Alpha),借助开发者社区进行真实场景公测、能力验证与身份反向识别,以低成本获取技术反馈、市场反应和产品定位依据,同时规避品牌预设影响。
Anthropic计划进行史上最大IPO,估值或达2万亿美元,融资超1000亿美元,聚焦企业级大模型服务,已实现经营利润转正;同期中国智谱、MiniMax登陆港股,开启大模型公司资本化新阶段,展现高增长与高效商业化能力。
一款匿名大模型Ox Alpha(被网友称为「牛来」)在OpenRouter上线,支持多模态输入和长上下文,代码能力突出,在DeepSWE测试中表现接近顶级模型;其身份被广泛猜测为智谱GLM-5.3 Flash或多模态版本,但官方尚未确认;同期另一匿名模型korrine也在Code Arena引发身份猜测,反映大模型厂商倾向通过匿名方式开展公开压力测试与口碑预热。
智谱发布GLM-5.3大模型,通过扩大后训练显著提升编程(尤其长程软件工程)和网络安全能力,在多项基准测试中进入全球前沿行列,但因升级方向偏专业、缺乏多模态等用户期待亮点,叠加国产模型密集迭代导致能力趋同,市场反响与股价表现明显弱于前代,凸显技术领先难以持续转化为商业优势的挑战。
文章探讨大模型发展从盲目追求参数量转向重视算力效率的范式转变,指出总参数量不能代表实际推理能力,激活参数、FLOPs和任务适配性才是关键标尺,并以Switch Transformer、Chinchilla及智谱GLM-5.3等案例论证参数失灵与Scaling Law的持续演进。
OpenRouter上线匿名模型Ox Alpha,具备100万Token上下文、多模态输入(文本/图像/视频)及工具调用能力,主打长周期Agent任务与生产环境编程,目前免费开放一周供大规模真实场景测试,社区猜测其可能来自小米、智谱、腾讯或Google,但归属尚未确认。
智谱股价两个月内暴跌超66%,市值蒸发逾8000亿港元,主因首批股份解禁及竞品Kimi K3登顶冲击市场信心;联合创始人唐杰反思‘万亿参数’技术路线是行业集体弯路,强调后训练效率、推理成本与商业化能力才是核心护城河;GLM-5.3以相同参数实现能力跃升,获摩根大通上调目标价,但市场反应谨慎。
智谱因新发布的编程大模型GLM-5.3展现出远超预期的网络安全能力(如高成功率复现和利用真实软件漏洞),为防范被恶意用于自动化网络攻击,临时推迟开源其模型权重。该模型在CyberGym和ExploitBench等安全评测中表现突出,但其批量发现高危漏洞的能力引发对现实系统风险的担忧。