新闻详情

新闻详情

首页 / 资讯中心 / 详情

中国大模型“八周五连发“:开源与低成本重写全球选型

发布时间:2026/8/5 18:56:25
中国大模型“八周五连发“:开源与低成本重写全球选型
一、为什么这件事值得在 8 月 5 日这天关注如果你最近在选型大模型大概会有一种追不动的感觉上个月还在比参数这个月又冒出好几个新名字。据《21 世纪经济报道》2026-08-05 的梳理从 7 月到 8 月初的约八周时间里阿里巴巴 Qwen3.8-Max、月之暗面 Kimi K3、深度求索 DeepSeek V4、智谱 Z.ai GLM-5.2、字节跳动 Seedance 2.5 五款国产前沿模型密集亮相被市场称为八周五模型。这背后的真实问题不是又多了几个模型而是选型逻辑变了单纯堆参数的竞争正在让位于成本、本地化部署和 Agent 能力。本文用一份可追溯的发布清单和一张规格图把这个变化讲清楚并给出开发者能直接落地的三条选型建议。二、八周五模型一份可追溯的发布清单按公开报道这五款模型的关键事实如下参数与榜单以各厂商官方发布为准Qwen3.8-Max阿里巴巴2026-08-03 发布总参数 2.4 万亿、激活约 950 亿支持 100 万 Token 上下文采用稀疏 MoE 与混合注意力在 Text Arena 排名第五、Vision Arena 排名第二、CodeArena 排名第四。来源Alibaba Cloud 官方发布、第一财经。Kimi K3月之暗面约 7 月下旬发布总参数约 2.8 万亿刷新开源模型规模纪录。来源公开报道聚合。DeepSeek V4深度求索V4-Pro 与 V4-Flash 双模型MIT 许可证开源支持 100 万 Token 上下文预览期始于 2026-04-24正式版于 8 月初推出。来源公开报道。GLM-5.2智谱 Z.aiMIT 许可证开源据独立观察在部分基准上超越 GPT-5.5GLM-5.5 预计 8 月发布。来源公开报道。Seedance 2.5字节跳动视频 / 多模态方向的前沿模型已纳入八周五模型行列。来源《21 世纪经济报道》。下面用一张时间线把发布节奏可视化图12026 年 7—8 月国产前沿大模型发布时间线日期为公开报道近似窗口精确发布日期以各厂商官方为准本图为示意性时间线非精确排期。五款模型的规格与开源状态集中对比如下图2八周五模型关键规格与开源状态一览数据来自各厂商官方发布与公开报道详见文末来源未公开项标注—本图为信息图而非性能跑分。三、Qwen3.8-Max把旗舰级首次交给开源在五款模型里Qwen3.8-Max 最值得单独展开因为它做了一个此前 Qwen-Max 系列没做过的决定首次开源 Max 级旗舰权重。据第一财经 2026-08-04 报道Qwen3.8-Max 的模型权重预计于下周正式开源这也是 Qwen-Max 级别旗舰模型首次对外开放权重同时开源的还有 Qwen3.8-27B。从工程视角看它的几个数字是有信息量的2.4 万亿总参数但只激活 950 亿靠稀疏 MoE 混合注意力把脑容量和推理成本拆开了。对开发者而言这意味着你为每次请求实际付费的是激活参数而不是总参数。100 万 Token 上下文按官方说法单次可分析 200 页以上文档或约 100 小时视频。榜单位置Text Arena 第 5、Vision Arena 第 2、CodeArena 第 4来源Alibaba Cloud 官方发布与公开报道。成本侧也有一个可对照的数字据第一财经报道Qwen3.8-Max 每百万输出 Token 成本约 6 美元而文中对比的标杆模型Fable 5约 50 美元。这是单源报道建议发布前再核对一次价格页面但它已经说明趋势——旗舰模型的价差正在被快速压缩。四、OpenRouter 榜单中国模型包揽调用量前五参数归参数真正说明问题的是大家实际在用哪个。据央视财经、OpenRouter 与界面新闻 2026-08-02 的报道在全球多模型聚合平台 OpenRouter 的最新一周榜单中调用量前五名均为中国公司研发的模型小米 MiMo-V2.5 以单周约 10.5 万亿 Token 居首其后依次为 DeepSeek V4-Flash、腾讯混元 3、智谱 GLM-5.2、DeepSeek V4-Pro中国模型整体调用份额约 63.5%。另有AI 开发者日报0805提到DeepSeek V4 Flash 正式版发布后流量暴涨OpenRouter 单周调用量超过 7.22 万亿 Token。这两组数字来自不同日期的快照说明低成本 开源权重 Agent 能力是这一轮采用率上升的核心原因而非单纯的性能领先。五、对开发者的三点可落地启示结合上面的事实选型时可以少看参数海报多看三个维度看单位任务成本不看总参数。MoE 的激活参数决定你的推理账单。API 报价、上下文长度和输出长度比2.4 万亿这种总数更影响月底账单。优先能本地化部署的开源权重。MIT / Apache 2.0 等开源许可证允许自托管能规避数据出境与供应商锁定也便于跨多云、异构硬件部署。把 Agent 能力当硬指标。长周期任务执行、工具调用、记忆与自愈正在取代单次对话质量成为新竞争焦点Qwen3.8-Max 的16 天自主交付一个项目案例即属此类。如果你已经拿到 DashScope 的 API Key可以用下面这段最小代码先跑通 Qwen3.8-Max 的兼容接口# 以阿里云 DashScope 兼容 OpenAI 协议调用 Qwen3.8-Max from openai import OpenAI client OpenAI( api_key你的DashScope_API_Key, base_urlhttps://dashscope.aliyuncs.com/compatible-mode/v1, ) resp client.chat.completions.create( modelqwen3.8-max, messages[{role: user, content: 用一句话解释稀疏 MoE 为什么能降低推理成本。}], ) print(resp.choices[0].message.content)本地部署则可以用 vLLM 直接加载开源权重以 Qwen3.8-27B 为例权重开源后可用# 本地用 vLLM 拉起开源权重示例命令实际模型名以官方仓库为准 vllm serve Qwen/Qwen3.8-27B --tensor-parallel-size 2 --max-model-len 131072六、局限与诚实说明部分模型的精确发布日期为公开报道的近似窗口Kimi K3、GLM-5.2、Seedance 2.5、DeepSeek V4 正式版请以各厂商官方公告为准。每百万输出 Token 约 6 美元 vs 约 50 美元为第一财经单源报道Token 调用量为聚合平台不同日期的快照会随时间和优惠波动。本文为技术热点梳理不构成投资建议也不荐股所有数字均来自公开来源未做独立复现。本流程仅产出本地草稿未登录或操作 CSDN发布请作者本人确认。主要来源Alibaba Cloud 官方发布2026-08-03、第一财经2026-08-04、21 世纪经济报道2026-08-05、央视财经 / OpenRouter / 界面新闻2026-08-02、AI 开发者日报2026-08-05。
网站建设 高端定制 企业官网