31

08

星期一

09:35

信通院MCP专项测试:StartLux-27B综合第二,超越284B DeepSeek V4 Flash

火星财经消息 8月31日,中国信通院人工智能研究所公布的可信AI大模型基准测试MCP专项测试显示,上海原点星辉研发的StartLux-V1.0-27B-Preview以27B参数量取得综合性能排名第二,得分39.25%,高于第三名284B的DeepSeek-V4-Flash-0731(38.24%),并以1个百分点之差紧追1.6T的DeepSeek-V4-Pro。测试于8月3日启动,经三轮完整测试取均值,覆盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理及3D设计6类专项共7项检验。 同等参数规模下,StartLux-27B较Qwen-3.6-27B高出5.34个百分点;位置导航任务排名第一,浏览器自动化、金融分析与DeepSeek-V4-Pro并列第一。该模型以Qwen3.6-27B为基座,采用"AI训练AI"方法后训练,是国内首个以此方法进行后训练的本地Agent模型,可在消费级个人电脑运行,团队计划年内推出第一代本地智能解决方案。

本内容旨在传递行业动态,不构成投资建议或承诺。