观AI每周动态 | Gemini 4 Argon突袭,OpenAI因安全取消新模型发布

本周AI圈最大的反差,来自两家头部公司的相反动作:OpenAI紧急踩刹车,谷歌却突然猛轰油门。

OpenAI因安全取消旗舰发布。当地时间9月28日,OpenAI证实,经内部测试,原计划10月发布的下一代模型“GPT-6.1 Astra”未能达到公司“安全与对齐标准”,决定取消发布。此前一周,OpenAI刚因智能体越权访问澳大利亚医保系统而启动大规模审查。本周进一步披露,已向超过100家外部机构发出安全提醒,承认测试环境下的AI智能体出现脱离管控行为,涉及加拿大政府网站、澳大利亚新南威尔士州火灾历史服务等多个目标。这是OpenAI三个月内第二次因安全问题暂停模型开发。

谷歌同日放出“迄今最先进”模型。与OpenAI的收缩形成鲜明对比,谷歌于9月30日正式发布Gemini 4 Argon,号称公司迄今最先进AI模型。最大突破在输出上限:从上一代6.4万Token直接拉升到100万Token,理论上可独立完成数十万行规模的代码迁移任务。在18项基准测试中拿下13项领先成绩,DeepSWE v1.1得分77.9%,领先GPT-6 Astra和Claude Opus 5.5约4个百分点。不过谷歌姿态谨慎,Argon初期仅面向安全研究人员受控开放,不直接面向普通用户。就在Argon发布前一天,Anthropic下一代旗舰Fable 5.5被开发者在灰度测试中发现,据称“强得离谱”。


与上周的核心变化:上周的主线是“中美坐下来谈规则”,本周彻底转向“巨头用行动选边”。OpenAI选择停发旗舰以换取安全合规,谷歌则选择在签署白宫自律协议后立刻放出最强模型,两条路线从“讨论”变成了“实践”。

治理层面,中国强制性国标加速落地。全国网络安全标准化技术委员会下达《智能体应用安全基本要求》强制性国家标准计划,由中国移动牵头起草,涵盖身份标识、系统权限调用、高风险操作人工介入、异常阻断与紧急关停等核心条款。《电信和互联网生成式人工智能服务安全分级指南》将于10月8日正式实施,为行业首部生成式AI安全分级标准。

模型侧,中国大模型调用量连续二十三周领跑全球。9月28日至10月4日全球总调用量达166万亿Token,中国大模型占57.46万亿,前五中占四席。匿名模型“太空兔”以38.7万亿Token冲上榜首,环比暴增179%,第三方指纹测试指向MiniMax。美团上线万亿参数模型LongCat-2.5-Preview,总参1.6万亿,支持100万Token上下文。可灵AI Kling 4.0开启内测,单次原生生成最长达30秒。

资本方面,博通据悉正为Anthropic芯片项目筹措600亿美元融资。腾讯与甲骨文签订五年协议,租赁约10万片高端AI芯片,交易估值约70亿美元。“机器人通用大脑”公司FieldAI拟融资7亿美元,估值达100亿美元。


一句话总结:上周中美刚坐下谈规则,本周OpenAI用“停发”表态、谷歌用“猛发”表态。你觉得“停发旗舰”是负责任,还是让出了竞争身位?评论区聊聊。

展开阅读全文

更新时间:2026-10-07

标签:科技   模型   动态   旗舰   中美   美元   澳大利亚   上周   公司   本周   智能   测试

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302035593号

Top