20260808-浙商证券-计算机周报_中国开源模型能力及价格中枢同步抬升_8页_1mb
报告摘要
中国开源模型能力及价格中枢同步抬升
核心内容
本周大模型行业重点围绕智能成本下降、开放权重模型生态扩张以及自研芯片与模型协同设计三大方向展开。整体来看,开源模型在价格和能力上持续发展,而闭源模型则在成本控制与性能优化上取得进展。
主要观点
1. 智能成本下降与价格策略分化
- 模型智能成本持续下降:OpenAI 下一代模型 Astra 在数学与理论计算机科学领域取得十项重要进展,但按 Sol API 费率计算,其 Token 总成本仅约 2000 美元,单位智能成本显著降低。
- Token 价格出现结构性分化:Silicon Data 数据显示,开源模型 Token 价格指数升至 0.66 美元,而闭源模型降至 3.07 美元。开放权重模型凭借较低价格吸引更多开发者和用户。
- 部分模型价格上调:DeepSeek 预告近期将大幅上调 API 价格,但其当前价格仍显著低于闭源模型。
2. 开放权重模型生态扩张
- 模型能力提升:阿里发布 Qwen3.8-Max,总参数量达 2.4 万亿,位列 Artificial Analysis Agentic Index 全球第一,Intelligence Index 第五。
- 生态适配加速:MiniMax H3 开源后 24 小时内获得超过百家合作伙伴的 Day 0 适配,覆盖多款芯片厂商及平台。
- 调用量增长:DeepSeek V4 Flash 在 OpenCode 单日 Token 消耗量超过 OpenRouter 全平台日均 6.6 万亿 Token,显示其在实际应用中的强大潜力。
- 资本投入加大:DeepSeek 重启第二轮融资,计划募资 500 亿元,投前估值约 5000 亿元;月之暗面 Pre-IPO 轮预计 8 月 27 日完成交割,9 月 30 日前递表。
3. 自研芯片与模型协同设计
- 自研芯片进入组织落地阶段:Anthropic 首次确认组建内部团队为 Claude 设计定制芯片,计划招聘硬件与软件工程师,推动模型与芯片协同优化。
- 头部厂商加速布局:Google 将 Gemini 部分架构固化进 Frozen v2 芯片,OpenAI 联合博通发布 Jalapeño 芯片,显示厂商对底层算力的重视。
- 自研芯片并非替代通用 GPU:当前仍以协同优化为主,提升推理效率和成本控制能力。
关键信息
-
国内厂商动态:
- DeepSeek:V4 Flash 在 OpenCode 单日 Token 消耗量超 OpenRouter 全平台日均;计划上调 API 价格;重启第二轮融资。
- 字节跳动:发布 SeedRealtime 音视频全双工大模型,升级豆包 App 视频通话功能;上线 Seedance 2.5 API,提供不同分辨率的计费方案。
- 通义:发布 Qwen3.8-Max,接入千问办公;支持文档格式输入;推出 CosyVoice Studio 语音平台。
- MiniMax:H3 开源后 24 小时内获得百家合作伙伴适配;在第三方视频评测中排名全球前列。
- Kimi:月之暗面 Pre-IPO 轮进程推进,计划 8 月 27 日完成交割,9 月 30 日前向港交所递表。
-
海外厂商动态:
- Anthropic:组建内部团队为 Claude 设计定制芯片,推动模型与硬件协同。
- OpenAI:Astra 在数学与理论计算机科学领域取得突破;GPT-5.6 Sol 与 Luna 优化权限与功能;计划推出新型 AI 硬件设备“Doughnut”。
- Gemini:Google AI 管理层调整,Jeff Dean 等核心成员成立公益研究公司 Discovery Loop,专注机器学习与科学工程。
风险提示
- 技术迭代不及预期
- 商业化变现节奏不及预期
- 算力供给及资本开支压力超预期
- 模型安全与监管风险
- 上市及融资进展不及预期
- 头部厂商竞争加剧
行业评级
看好(维持):行业指数预期将跑赢沪深 300 指数 10% 以上。
相关报告
- 《DeepSeek: 控本筑壁垒,芯模共协同》 2026.08.07
- 《模型密集发布,头部厂商竞争持续升温》 2026.08.02
- 《国产算力重要性提升》 2026.07.25
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载