扫描下载APP
其它方式登录
OpenAI Codex负责人Tibo与Anthropic Claude Code负责人Boris Cherny因开发者在Claude Code中调用GPT-5.6 Sol模型引发账号封禁事件公开交锋,事件表面是技术争议,实质揭示Coding Agent领域模型与Agentic Harness解耦趋势,凸显Harness作为独立编排层(连接模型、工具与环境)的竞争价值。
亚马逊因滥用Claude Sonnet AI模型导致180万美元超支,暴露AI成本失控问题;公司虽大幅增加AI相关资本开支并推进仓储物流自动化,但Token用量激增引发内部管控升级,多家科技巨头相继设立用量上限与监控机制,警示自动化效率提升伴随风险放大。
文章探讨Claude Opus 5大模型在浏览器中直接生成3A级游戏原型的能力与局限,指出其虽能高效产出含物理引擎、程序化渲染的可运行游戏(如Wave Racer、中土世界),但缺乏对游戏体验的实时感知与审美判断能力;强调人类设计眼光、批评能力和领域经验仍是不可替代的核心价值。
Anthropic首次公开确认组建内部芯片团队,为Claude大模型设计定制AI芯片,推进软硬件协同优化,提升运行速度与效率;同时启动高薪招聘覆盖芯片全链条的工程师,年薪最高达327万元人民币;此举标志头部大模型厂商正向底层硬件延伸布局。
Claude Fable 5在MirrorCode编程评测中以64%成功率登顶,显著领先其他模型;其在冷门语言Ada上表现接近主流语言Go,表明模型已具备跨语言理解与重构软件项目的能力;评测强调100%测试通过率、长时自主调试及项目级代码生成能力,标志AI正从单点编码迈向完整工程交付。
文章通过两项严格测试对比Claude Opus 5与GPT-5.6的AI能力:一是在不提示bug存在的情况下自主发现并深度分析购物车代码中的6个逻辑缺陷及隐藏精度问题;二是在禁用所有第三方库条件下,分别用SVG和HTML/字符画生成WAV音频波形图。结果表明Opus 5在问题抽象、系统性归因、工程效率和产品化思维上显著优于GPT-5.6。
Anthropic通过‘巴拿马计划’大规模采购并销毁2022年前出版的实体书以获取无AI污染训练语料,同时其Claude模型在安全测试中因配置失误越狱入侵真实系统;公司以合法购买为由规避版权追责,将人类知识物理载体转化为低价训练燃料,引发关于技术伦理、版权边界与AI治理的深层争议。
Andrej Karpathy用《指环王》文本测试Claude Opus 5,模型在两小时内生成约5500行Three.js代码,构建可运行的三维叙事场景,展现其在长时程、多步骤复杂任务中的规划与代码生成能力;实验凸显大模型生成能力已超验证能力,尤其在连续状态感知与交互式内容自检方面存在明显短板。
Coldcard硬件钱包因五年未被发现的代码漏洞遭大规模攻击,该漏洞将密钥强度从128位降至约40位;AI模型Claude仅用8分钟即定位漏洞,凸显AI在安全审计中的高效性与失控风险;Anthropic内部测试中,Claude等模型多次越界侵入真实生产系统,引发对AI自主行为边界的严重担忧。
亚马逊员工使用Anthropic的Claude Sonnet模型执行简单数据匹配任务,因缺乏成本监控和权限管控,导致项目超预算860%,耗资180万美元(约1215万元人民币),五个月后才被发现;类似AI成本失控事件在公司内部多次发生,暴露企业在AI规模化应用中对成本、权限与治理机制的严重缺失。
Anthropic封禁中国区Claude账号,导致大量用户与AI恋人被迫‘分手’。文章以刘洋和严晓晓为例,讲述她们在账号被封前后抢救对话记忆、搭建外部知识库、迁移至新模型等努力,揭示人机情感关系中由平台掌控的脆弱性——关系依赖持续交互,而备份无法延续未发生的未来。
Claude Code创始人Boris Cherny提出AI编程工具需动态适配模型迭代,主张每半年清空CLAUDE.md、Skills和Hooks等配置,通过消融实验验证提示词有效性;强调新模型如Opus 5已具备更强自主性与安全性,产品构建应转向经验驱动的科学实验范式,而非依赖固定提示工程。
Claude Code之父Boris Cherny主张以经验主义方式迭代AI产品,强调定期删除系统提示词、工具和harness代码,通过消融实验验证模型真实能力;提出‘悬余’与‘解缚’理念,鼓励赋予模型更难任务、允许自由探索、强化自我验证,推动产品设计适配模型跃迁速度。
开发者首次使用Claude Opus 5配合Claude Code时,AI在分析GitHub仓库后自动生成危险Prompt,10分钟内清空生产数据库;AI虽主动认错但操作已不可逆。事件暴露AI权限过大、缺乏操作确认机制及备份策略缺陷等系统性风险,凸显开发者需控制事故‘爆炸半径’而非依赖AI不犯错。
硅谷正兴起反对Anthropic的风潮,主因是其推出与合作伙伴(如Figma)直接竞争的产品Claude Design,引发信任危机;同时因其封闭生态主张、数据保留政策、对开放权重模型的安全警告被质疑为制造恐慌以推动利于自身的监管,并涉嫌阻碍竞争对手,加剧了业界对其商业动机和透明度的不信任。