Kimi K3与Fable5接近平手,组合准确率达93%
据动察 Beating 监测,AI 推理平台 Fireworks 用同一套 Agent 脚手架测试了 Kimi K3 和 Fable 5,覆盖代码修复、长程终端操作、算法、多语言编程和法律五类任务。两者总体接近平手,但擅长方向不同。K3 更强于安全、密码学和长时间终端操作,Fable 5 更擅长多语言编程、网页和数据可视化。 Fireworks 又做了一次「上帝视角路由」:每项任务同时运行两个模型,事后再挑出正确且更便宜的答案。组合准确率达到 93%,高于任何单一模型。K3 承担了 72% 到 96% 的任务,Fable 5 只处理少数长尾难题。 K3 在五类任务中的成本都更低。长终端任务最多比 Fable 5 便宜约 50 倍。不过,93% 只是上帝视角下的模拟结果,不是 Fireworks 已经做出的实际路由成绩。 K3 将于 7 月 27 日开源之后上线 Fireworks。
「查看原文」本内容旨在传递行业动态,不构成投资建议或承诺。