扫描下载APP
其它方式登录
智谱发布GLM-5.3大模型,通过扩大后训练显著提升编程(尤其长程软件工程)和网络安全能力,在多项基准测试中进入全球前沿行列,但因升级方向偏专业、缺乏多模态等用户期待亮点,叠加国产模型密集迭代导致能力趋同,市场反响与股价表现明显弱于前代,凸显技术领先难以持续转化为商业优势的挑战。
智谱因新发布的编程大模型GLM-5.3展现出远超预期的网络安全能力(如高成功率复现和利用真实软件漏洞),为防范被恶意用于自动化网络攻击,临时推迟开源其模型权重。该模型在CyberGym和ExploitBench等安全评测中表现突出,但其批量发现高危漏洞的能力引发对现实系统风险的担忧。
文章实测智谱新发布的GLM-5.3大模型,发现其能力呈现显著场景依赖性:在简洁提示下表现平庸,但在详细Prompt或网络安全任务中展现出卓越能力,尤其在漏洞挖掘(CyberGym、ExploitBench)和CVE复现上表现突出,验证了其‘意外涌现’的网安能力,同时揭示模型性能高度依赖输入颗粒度与任务类型。
智谱AI发布GLM-5.3大模型,基座未变但通过极致后训练Scaling显著提升编程与网络安全能力,在Terminal Bench等基准测试中开源模型排名第一,白盒漏洞发现能力接近国际顶尖水平,并已联合安全团队发现2404个漏洞。