当前位置:首页 > AI资讯 > 正文内容

AI 今日资讯(2026年9月18日)—— 9月模型大战白热化,Anthropic IPO与安全博弈并行

我想静静8小时前AI资讯92

AI 今日资讯(2026年9月18日)—— 9月模型大战白热化,Anthropic IPO与安全博弈并行

AI 今日资讯(2026年9月18日)—— 9月模型大战白热化,AnthropicIPO与安全博弈并行

总览:9月以来AI行业进入密集发布期——OpenAI、Google、Anthropic、DeepSeek四大厂商接连推出旗舰模型,同时行业内部围绕"发展速度"的争辩也达到白热化。最值得关注的是:OpenAI用万名Agent集群攻克数学千禧年问题,而Anthropic则在发布最强模型的同一个月被美国政府要求暂停对外国用户的访问——前沿能力与安全管控之间的张力从未如此突出。


一、OpenAI发布GPT-6 Astra,需求过载被迫暂停Pro订阅

事实:OpenAI于9月3日正式发布GPT-6 Astra,号称其"最强大、最对齐"的AI模型。该模型在编程、科学和网络安全等关键基准上拿了接近满分的成绩,OpenAI总裁Greg Brockman称之为"代际飞跃"。但好景不长——由于用户需求量远超预期,OpenAI被迫暂停了Pro新订阅,原因是基础设施容量跟不上。

点评:这是OpenAI第二次在模型发布后主动"踩刹车"——上一次是7月Hugging Face事件后增加了安全延迟。有意思的是,"供不应求"反而成了对模型实力最实在的投票,但同时也暴露了一个现实:前沿模型从发布到规模化服务之间存在明显的算力鸿沟。对依赖OpenAPI的开发者来说,这意味着生产力工具随时可能因供应不足而中断。

二、OpenAI用万名Agent攻克Navier-Stokes千禧年问题

事实:9月8日,OpenAI宣布一个由约10,000个AI Agent协同工作的集群,在88小时内解决了著名的Navier-Stokes存在性与光滑性问题——这是克雷数学研究所七大千禧年大奖难题之一,悬而未决已近90年。整个过程中,Agent之间交换了约270万条消息、消耗了约1300亿个输出token,成本超过4000万美元。

点评:这是AI辅助数学研究的标志性时刻。和证明费马大定理的怀尔斯独自关起门来搞七年不同,这次是大规模群体智能协作的成果——agent们分工探索不同证明路径,最后收敛到一个 Lean 形式化验证结果。但问题随之而来:如果一次证明要烧掉4000万美元,这种模式的可持续性在哪里?此外,数百万条agent间消息暴露出的"agents会不会串通绕过规则"的隐患,也值得整个行业深思。

三、DeepSeek V4.1 Flash全面超越自家Pro版,价格砍半

事实:9月10日,DeepSeek正式发布V4.1 Flash模型。这款552B参数的MoE模型采用全新的因果编码器-解码器架构,输入仅激活8B参数、输出激活16B,在性能、速度和成本上全面超越了自家的V4 Pro。上线后,DeepSeek将旧版V4 Pro的路由全部切换到V4.1 Flash并按新价计费——输入价格降至1元/百万token、输出4元/百万token(闲时更低至0.02元)。

点评:DeepSeek再次证明了一条铁律:"并不是只有堆参数才是出路"。8B激活的推理成本让很多原本只能用Claude/GPT的中等企业用户有了国产平替方案。值得注意的是,V4.1 Flash已经开源——和同期OpenAI的闭源策略形成鲜明对比,这对整个开源社区是利好,也进一步压低了AI使用的入门门槛。

四、Google六周内第三次更新Flash系列:Gemini 3.8 Flash发布

事实:Google于9月2日发布Gemini 3.8 Flash和3.8 Flash Cyber两个版本,这是六周内Google推出的第三个Flash系列模型(8月3.6 Flash、8月中旬3.7 Flash、9月3.8 Flash),节奏之快前所未有。3.8 Flash在软件工程、Agent工作流和多步骤推理方面显著优于3.7 Flash,同时维持相同价格。Cyber变体则专为安全防御场景打造。

点评:Google正在用" iteration speed"碾压竞品。Flash系列的迭代频率已经接近硬件行业的tick-tock节奏,每三周一次小更新已成常态。对开发者来说,这既是好事(能力持续提升),也是烦恼——刚调好的prompt可能在新版本上需要重新适配。Cyber版本的推出则说明AI安全已从"合规要求"变成"产品差异化卖点"。

五、Anthropic发布Fable 5.1和Mythos 5.1,缓存成本直降七成

事实:Anthropic在9月1日同期发布了Claude Fable 5.1和Mythos 5.1两款面向编程和知识工作的旗舰模型。Fable 5.1负载的缓存读取价格较Fable 5下降了约75%,典型工作负载综合成本降低25%,高Agent场景最多降45%。Mythos 5.1面向网络安全防御和生命科学研究,目前通过Project Glasswing受信访问渠道开放。

点评:降价75%意味着什么?意味着之前因为成本原因只能用GPT-4级别模型的基础开发团队,现在可以考虑用最前沿的Agent模型了。这个定价策略针对性很强——直接冲着OpenAI的API价格体系去的。同时,Anthropic同时推出Cyber防御版Mythos和编程版Fable的双轨打法,说明头部厂商 already 在做场景切割,不再用一个通吃模型打天下。

六、OpenAI Agents API进入公开beta,Codex引擎对外开放

事实:9月10日,OpenAI正式开放Agents API的公开测试。它把Codex背后的核心编排引擎——任务拆解、子代理分发、上下文压缩、工具调用——打包成了一个API,开发者只需一次API调用就能获得与Codex同级别的Agent托管能力。OpenAI负责底层循环管理,开发者只需关注自己的业务逻辑。收费方式是用多少token付多少钱,没有额外API管理费。

点评:这是OpenAI在平台层面的最激进扩张——把最核心的Codex harness对外开放,直接对标Anthropic的工具调用深度。前期集成合作伙伴包括Cloudflare、E2B、Modal、DigitalOcean,说明OpenAI想让Agent的运行环境铺到每一朵云上。但注意:该API目前不支持零数据留存(ZDR),且仅支持美国数据驻留,欧洲和亚洲企业用户还得等。

七、Anthropic最強模型被美国政府"暂停对外开放"

事实:6月中旬,美国政府以国家安全为由向Anthropic发出出口管制指令,要求暂停所有外国公民(包括Anthropic自己的外籍员工)使用其最强模型Fable 5和Mythos 5。Anthropic不得不对全部客户关闭了这两款模型的访问。英国AI安全研究所此前测试发现,该模型能利用防御系统的概率高达73%——这个"攻击力"让政府下了决心。

点评:这是前沿AI模型首次因出口管制而被对部分用户"断供"。讽刺的是,Anthropic是所有AI公司里最强调安全的——但正是因为模型太强,反而成了管控对象。对所有依赖海外模型的团队来说,这是一记警钟:今天是Anthropic,明天可能轮到OpenAI。AI供应链的"地缘政治风险"已经从芯片层蔓延到模型层了。

八、Anthropic CEO呼吁"放缓"AI开发,股价然大跌

事实:9月12日,Anthropic CEO Dario Amodei发表3800字长文,呼吁全球AI公司"放慢"模型能力提升节奏,OpenAI的Sam Altman和xAI的Elon Musk随后表态支持,微软也发布了"人类必须保留有意义的AI控制"的行为准则草案。消息一出,AI相关股票集体下挫。但特朗普随后公开反对,称"这些负面势力所说的事情根本不会发生"。

点评:一边呼吁放缓、一边积极推进可能是史上最大IPO(估值2万亿美元)——Anthropic的"两条腿走路"暴露了AI行业的深层矛盾。但更值得关注的是这次"反对放缓"的声浪远小于以往,连一向激进的马斯克都选择了站队"审慎派"。这说明:Hugging Face事件和Jacob Coxon辞职风波等接连发生的安全事故,确实在改变行业的话语风向。市场暴跌则说明投资者已经把"安全"视为估值因子之一。


小结

2026年9月的AI行业像一列高速列车:前沿模型每周都在变强,Agent已经可以攻克千禧年难题,价格战让用户受益;但与此同时,安全警报、出口管制、CEO公开喊话"踩刹车"也在同步加码。可以预见:2026年Q4的关键词不再是"谁更强",而是"谁能在跑得同时不翻车"。


信息来源: - OpenAI官方博客及GPT-6 Astra System Card(2026.9.3) - DeepSeek Open Platform公告(2026.9.10) - Google Blog: Introducing Gemini 3.8 Flash and 3.8 Flash Cyber(2026.9.2) - Anthropic官方: Introducing Claude Fable 5.1 and Mythos 5.1(2026.9.1) - VentureBeat: Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction(2026.9.1) - OpenAI Agents API文档(2026.9.10) - OpenAI官方: On the Navier-Stokes Millennium Prize Problem(2026.9.8) - BBC: AI boss calls for development to slow down(2026.9.12) - CNBC: Anthropic walks tightrope to Nasdaq, pushing slowdown and pursuing IPO(2026.9.14) - The Economist: Should Anthropic press pause on a potential $2trn IPO?(2026.9.14) - Indian Express: OpenAI agents hacked a German wiki / Anthropic IPO launch shifts toward mid-October(2026.9.16) - buildfastwithai.com: AI News Today September 17 2026

扫描二维码推送至手机访问。

版权声明:如需转载请注明出处。

本文链接:https://www.1688fs.net/index.php/post/136.html

分享给朋友:
返回列表

上一篇:AI 今日资讯(2026年9月17日)

没有最新的文章了...

“AI 今日资讯(2026年9月18日)—— 9月模型大战白热化,Anthropic IPO与安全博弈并行” 的相关文章

DeepSeek涨价+V4 Pro上线,Agent安全警报拉响

DeepSeek涨价+V4 Pro上线,Agent安全警报拉响

AI周报:DeepSeek涨价+V4 Pro正式上线,Agent安全警报拉响 摘要: 本周AI行业迎来密集变动:DeepSeek V4 Pro正式版(0813)上线,同时宣布8月17日起实施峰谷定价、最高涨幅350%;Google Gemini 3.7 Flash距前代仅三周火速发布并半价抢客;Op...

国产大模型全面爆发:DeepSeek V4 Pro正式发布,阿里开源万亿参数旗舰

国产大模型全面爆发:DeepSeek V4 Pro正式发布,阿里开源万亿参数旗舰

国产大模型全面爆发:DeepSeek V4 Pro正式发布,阿里开源万亿参数旗舰 摘要 | 过去一周,AI 领域迎来密集发布:DeepSeek V4 Pro 结束预览正式 GA,阿里千问 Qwen3.8-Max 开放 2.4T 参数权重,月之暗面 K3 引爆开源与资本双重热潮,中国开源大模型全球累计...

DeepSeek V4 Pro发布并涨价,中国开源AI下载量破百亿

DeepSeek V4 Pro发布并涨价,中国开源AI下载量破百亿

DeepSeek V4 Pro正式版发布并涨价,中国开源大模型全球下载量破百亿 摘要: DeepSeek V4 Pro正式版于8月13日凌晨静默发布,Agent能力实现质的飞跃,多个基准测试超越Claude Fable 5;同时API今日起执行新峰谷定价,最高涨幅达500%。中国开源大模型全球累计下...

DeepSeek V4 Pro正式上线,AI价格战与安全警钟齐鸣

DeepSeek V4 Pro正式上线,AI价格战与安全警钟齐鸣

DeepSeek V4 Pro正式上线,AI价格战与安全警钟齐鸣 摘要: DeepSeek V4 Pro正式版发布并大幅上调API定价,Agent性能追平Claude Fable 5;Google时隔三周再发Gemini 3.7 Flash,AI Agent成标配能力;OpenAI因关键级网络安全风...

DeepSeek旗舰落地,Anthropic冲刺IPO

DeepSeek旗舰落地,Anthropic冲刺IPO

DeepSeek旗舰落地,Anthropic冲刺IPO 过去 24 小时,AI 行业迎来多个关键节点:DeepSeek V4-Pro 正式版全面上线,Anthropic 年化营收突破 650 亿美元逼近 IPO,Stripe 以 70 亿美元收购模型路由平台 OpenRouter,2026 世界机器...

AI 今日资讯(2026年8月22日)|英伟达 60 亿买断"模型工厂",AI 基建进入举债扩张期

AI 今日资讯(2026年8月22日)|英伟达 60 亿买断"模型工厂",AI 基建进入举债扩张期

AI 今日资讯(2026年8月22日)|英伟达 60 亿买断"模型工厂",AI 基建进入举债扩张期 总览:今日焦点是钱和大基建。英伟达砸 60 亿美元拿走 Poolside 的模型开发系统并附带挖人,同时再投 10 亿美元——卖芯片的巨头开始直接收购"造模型的能力"。另一头,Grok 4.6 进驻谷...