18

08

星期二

20:04

AI离「自己改进自己」还有多远?Scale推出RSI Bench

动察 Beating AI 快讯,Scale AI 推出 RSI Bench,专门测试 AI 能不能像研究员一样,自己做 AI 研发。 AI 会直接拿到论文、代码和算力,然后自己想实验、跑训练、改方法,再看能不能把原来的 AI 做得更好。 首批测试用了 Claude Opus 5 和 GPT-5.6 Sol。两款模型已经能自己跑实验、调参数、迭代方案,部分任务确实能超过给定基线。 但现在的 AI 还不太会「发明」。让它们挑战最新研究时,大多数尝试仍停留在论文已有方法和调参数上,很少提出真正的新思路。

「查看原文」

本内容旨在传递行业动态,不构成投资建议或承诺。