扫描下载APP
其它方式登录
Anthropic、谷歌和OpenAI近期未官宣即上线新一代大模型Opus 5.2与Gemini 4 Pro,采用灰度路由、第三方盲测等隐蔽方式快速部署,以降低发布风险、获取真实负载数据并规避政策与口碑不确定性,反映行业正压缩传统发布会流程,转向更务实、敏捷的模型交付模式。
文章报道谷歌疑似在AI竞技场Arena泄露下一代旗舰模型Gemini 4 Pro,其性能远超已发布的Gemini 3.8 Flash,在编码、Agent、推理等基准测试中大幅领先GPT-6 Astra和Claude Fable;该传闻引发对RSI(递归自我改进)技术加速AI研发进程的广泛关注,并揭示前沿AI公司‘减速倡议’与实际竞相发布新模型之间的矛盾。
iPhone 18 Pro系列引入两项看似矛盾的AI影像功能:生成式AI功能Spatial Reframing可补全画面中未拍摄区域,导致‘幻觉’内容;同时新增Apple Reference Image机制,通过传感器硬件签名与加密验证,为照片提供不可篡改的原始记录,构建可信影像溯源体系。
谷歌DeepMind疑似提前上线新一代旗舰大模型Gemini 4 Pro,以gemini-3.8-flash为马甲在Arena平台匿名亮相,在编码、智能体、推理、3D/SVG生成及网页设计等多维度全面超越GPT-6 Astra和Claude Fable 5.1,性能与性价比领先,背后依托RSI(递归自我改进)技术突破。
大模型行业在能力持续提升的同时,Token价格三个月内暴跌超50%,首次跌破1美元/百万Token。厂商通过降价、推出Flash轻量模型、优化缓存与推理成本等方式应对企业用户对性价比的迫切需求,价格战与工程化能力正取代单纯智力比拼,成为竞争核心。
DeepSeek发布V4.1 Flash大模型,参数552B、采用Causal-Encoder-Decoder结构,性能超越V4 Pro且推理成本大幅降低;同步下调API价格,并宣布V4 Pro请求将路由至Flash并按Flash低价计费。此举引发社区热议,“赛博义父”成为AI厂商争夺开发者心智与市场份额的关键策略,国内外厂商分别以“重置额度”和“极致定价”路径展开竞争。
智谱发布上市后首份中期财报,收入达9.54亿元,同比增长399.7%,API业务占比升至86.5%,ARR达16亿美元,但亏损扩大至20.72亿元;公司正通过高性价比模型(如GLM-5.3-Flash)与前沿SOTA模型(如GLM-6.0)双轨并进,在提升用户规模与定价权之间寻求平衡,应对算力成本高企与盈利压力。
DeepSeek 将 V4 Pro 流量强制切换至性能更优、成本更低的 V4.1 Flash 模型,但仅提前一天通知且无并行过渡期,引发开发者强烈反对。争议核心在于缺乏软件工程规范:未提供版本隔离、缓冲期、回退入口,损害生产环境稳定性与科研可复现性,暴露其重模型能力轻用户契约的工程思维短板。
DeepSeek在8月对V4系列API大幅涨价后仅23天即宣布Flash模型降价,但仅回调输入价格至4月水平,输出价格仍显著高于原价;此举源于其开源策略导致大量第三方供应商以更低价格提供同权重模型,削弱官方定价权,暴露其‘性价比’标签与商业化诉求间的根本矛盾。
谷歌云已有17条产品线年收入超10亿美元,AI驱动客户增长与收入提升;Gemini Enterprise企业客户5年LTV高出非AI客户约1.5倍;高盛维持Alphabet买入评级,目标价435美元,看好其垂直整合AI技术栈带来的差异化竞争力。
DeepSeek推出V4.1 Flash中间版本,旨在以更低成本、更快速度实现接近Pro模型的推理能力,通过提升‘智能密度’优化单位计算的推理效率;同步大幅下调Flash价格,并结合DSpark加速技术、Harness执行框架及原生多模态升级,推动AI从单次响应向高效Agent任务演进。
OpenAI发布GPT-Image-2.5,显著提升图像生成速度(延迟最高降低50%)、编辑精度与多轮一致性,新增Sketch手绘输入、模板化生成、Prompt分享等功能,并首次在API端分设Flare(快/批量)和Sunburst(精/创意)双模型,面向ChatGPT全系用户开放,支持中文等多语言高质量生图。
文章分析Gemini 3.8 Flash模型的更新特点,指出其虽保持Token单价不变,但因推理轮次增加导致单任务成本上升;重点提升Agent能力,在多步任务执行、工具调用和复杂模拟(如四缸发动机)中表现显著优于前代及竞品Flash模型;核心优势转向高速推理(超300 token/秒),以速度支撑多轮迭代,实现轻量模型下的质量跃升。
文章分析2026年美国四大AI公司(OpenAI、Anthropic、Google Gemini、xAI Grok)商业化路径分化:企业端(B端)成核心收入引擎,编程助手是唯一跑通单位经济的细分场景;Anthropic凭借多云中立与高毛利率率先盈利,OpenAI企业收入反超消费端,Gemini依赖生态捆绑,Grok仍依赖SpaceX输血,用户规模与盈利能力呈现倒挂。
谷歌Antigravity团队利用Teamwork多智能体编排框架,驱动轻量级Gemini 3.7 Flash模型复现3项博士级数学难题,并完成CPU模拟器构建与主流开源库(Eigen、ParlayHash)的代码优化,证明小模型通过制度化协作可达成高阶科研与工程成果。