国产大模型全面爆发:DeepSeek V4 Pro正式发布,阿里开源万亿参数旗舰

我想静静2026-08-17AI资讯12

国产大模型全面爆发:DeepSeek V4 Pro正式发布,阿里开源万亿参数旗舰

国产大模型全面爆发:DeepSeek V4 Pro正式发布,阿里开源万亿参数旗舰

摘要 | 过去一周,AI 领域迎来密集发布:DeepSeek V4 Pro 结束预览正式 GA,阿里千问 Qwen3.8-Max 开放 2.4T 参数权重,月之暗面 K3 引爆开源与资本双重热潮,中国开源大模型全球累计下载量突破 100 亿次。与此同时,Anthropic 发布中期风险报告上调灾难性错位评级,AI Agent 企业落地正式进入规模化拐点。


DeepSeek V4-Pro 结束预览,正式版 0813 发布

8 月 13 日,DeepSeek 正式发布 V4-Pro 的 GA 版本(build 0813),结束自 4 月 24 日启动的预览期。该模型参数规模达 1.6T,采用 MoE 架构,在 Agent 能力上进行了重大升级,支持 flexible reasoning effort(低/中/高三档),并原生支持 OpenAI Responses API,可一键接入 Codex。

定价方面,V4-Pro 同时引入峰谷计价机制,非高峰时段价格降低 50%,新价格于 8 月 16 日生效。这一灵活定价策略旨在鼓励开发者将推理任务调度至低成本时段,降低 API 调用门槛。

值得注意的是,DeepSeek V4-Flash(304B 参数)早于 7 月 31 日以 MIT 开源许可证开放权重并在 API 上正式上线。独立评测中 Flash 在多项 Agent 维度上甚至超越了 V4-Pro 的预览版本,成为当前性价比最高的开源模型之一。

阿里千问 Qwen3.8-Max:首个开源 Max 级旗舰模型

8 月 3 日,阿里千问团队发布 Qwen3.8-Max,总参数量达 2.4T(激活约 95B),采用 Gated DeltaNet + MoE + Gated Attention 混合架构,支持原生多模态(文本 + 图像输入),上下文窗口标准 128K,可无损扩展至 1M token。

8 月 12 日,Qwen3.8-Max 正式在 Hugging Face 和 ModelScope 开放权重下载,成为千问家族首个 Max 级开源模型。其 API 定价为 $2/M(输入)、$6/M(输出)。在 PaperBench 评测中以 93.0 分领先。阿里将其定位为"仅次于 Claude Fable 5"的前沿模型,并明确采用自定义许可协议,对商用设定了月活和营收门槛。

中国开源大模型全球下载量突破 100 亿

据国家发改委与工信部披露,中国人工智能开源大模型全球累计下载量已突破 100 亿次,占全球总量 41%,超越美国跃居首位。在 OpenRouter 7 月排行榜上,前六名全部为中国开源模型包揽——小米 Mi-Mo-V2.5、DeepSeek V4 Flash、腾讯 Hy3、MiniMax M3、GLM-5.2 及 DeepSeek V4 Pro。

围绕开源模式的价值争议也在发酵。硅谷投资人纳瓦尔 8 月 9 日回应"开源威胁论"时指出,经济中最具价值的领域本质上具有对抗性,开放权重不会削弱的闭源实验室的竞争优势。

月之暗面:K3 开源引发热议,估值半年涨至 350 亿美元

月之暗面 7 月底发布的 Kimi K3(2.8T 参数,Modified MIT 许可)持续发酵。特斯拉创始人马斯克公开称其"令人印象深刻",Vercel CEO 实测后称 K3 是首个在综合性 Web 工程评测中超越所有主流闭源模型的开源模型。K3 以 1679 分登顶 Frontend Code Arena 榜单。

资本层面,月之暗面年内完成 6 轮融资,F 轮融资超 35 亿美元(投后估值 350 亿美元),认购额超额 3 倍。Pre-IPO(G 轮)已提前启动,投前估值升至 500 亿美元,预计最快 6 个月内登录港交所。这是国产大模型公司从产品力到资本市场获得双重认可的标志性案例。

Anthropic 发布风险报告:灾难性错位评级上调

Anthropic 8 月中旬发布的年度风险报告将"灾难性错位"评级从"极低"上调至"低",理由并非某项测试失败,而是整体不确定性增加。报告还披露了一个未发布的内部前沿模型——"Model 2",能力显著强于已发布的 Mythos 5。Anthropic 表示目前没有计划对外发布,因为尚未完成完整的部署前安全评估。

与此同时,未来生命研究所发布 2026 年夏季 AI 安全指数,Anthropic 获最高评级 C+,OpenAI 和 DeepMind 均为 C,Meta 为 D+,xAI、DeepSeek 和 Mistral 被评"实质不合格"。报告指出各实验室正在悄然退步于先前的安全承诺。

AI Agent 步入规模化落地:52% 企业已投产

Google Cloud 发布的《AI Agent Trends 2026》报告显示,52% 使用生成式 AI 的企业已将 Agent 投入生产环境,其中 39% 已部署超过 10 个 Agent。74% 的企业在首年内即实现投资回报,39% 报告生产力提升至少 2 倍。

软件开发(57%)和客户服务(55%)是 Agent 影响最深的领域。编码 Agent 已成主流——86% 的组织已从试验转向生产,42% 的组织信任 Agent 在人类监督下主导开发。A2A(Agent-to-Agent)协议和 MCP(模型上下文协议)正在成为跨系统协同的标准基础设施。


趋势点评:8 月中旬的这波密集发布标志着 AI 行业进入"开源旗舰竞争"的新阶段——中国厂商正在以系统级的工程执行力和灵活的定价策略改写全球模型市场格局。与此同时,AI 安全治理与 Agent 规模化落地形成了两条并行的主线,2026 年下半年将从"模型能力竞赛"逐步转向"基础设施与治理体系建设"。

信息来源: - DeepSeek 官方 API 文档 / 新闻发布页 - Qwen 官方 Hugging Face 发布公告 / LLM Stats - 国家发改委 / 工信部 公开数据 - OpenRouter 2026 年 7 月排行榜 - 证券时报 / 钛媒体 / 界面新闻 - Anthropic 2026 年风险报告 / Future of Life Institute AI Safety Index - Google Cloud AI Agent Trends 2026 - Quartz / Reuters / Financial Times

发表评论

访客

看不清,换一张

◎欢迎参与讨论,请在这里发表您的看法和观点。