20260829-浙商证券-计算机周报_国产算力进入规模化生产验证_14页_1mb
报告摘要
国产算力进入规模化生产验证
核心内容
本周报告聚焦于国产算力进入规模化生产验证,并分析了头部模型公司收入增长、Harness在复杂任务中的作用、开放模型在垂直领域中的应用以及模型与芯片协同优化对推理成本的影响。
主要观点
1. 头部模型市场持续扩张
- OpenAI与Anthropic合计年化收入:从2023年末的21亿美元增至2026年8月13日的1,050亿美元,年化收入增长3.5倍。
- Anthropic客户支出:2026年7月客户总支出同比增长约2,800%,但增速首次放缓,客户增长连续第二个月下降。
- OpenAI商业化扩展:推出ChatGPT Business Premium Seats(100美元/月),用量为标准版的5倍;广告业务扩展至印度和巴西,并启动本地商业运营。
- 市场潜力:Anthropic在IPO招股书中预计潜在市场规模超过30万亿美元,远超SpaceX的估算。
2. Harness成为Agent能力关键组成部分
- Harness性能验证:英伟达为Claude Opus 5定制Harness并加入监督者组件后,ARC-AGI-3得分从30%提升至100%;OpenAI也通过调整Harness设置将模型得分提升三倍。
- 功能拓展:Harness在任务拆解、上下文管理、工具调用和纠错机制方面的作用愈发显著,推动Agent能力从单次回答向复杂工作流程发展。
- 产品更新:OpenAI测试Codex Persistent模式,实现持续运行并主动创建后续任务;Claude Cowork上线内置浏览器,打通聊天与记忆功能;豆包工作与飞书深度整合,继承企业知识与权限。
3. 开放模型进入垂直模型生产环节
- 法律模型Tenet:Harvey基于Kimi K3训练,全通过率由约11%提升至19.7%,推理成本低于闭源模型的1/4。
- 企业模型Thomson:Thomson Reuters基于Qwen3.5-397B开发,研发成本约4,000万美元,强调长期成本与调整自由度。
- 视频模型H3 Max:fal Research基于MiniMax H3后训练,在视频生成质量与速度评测中表现领先。
- 开放模型趋势:开放模型逐渐成为垂直厂商构建行业模型的底座,推动模型能力在实际场景中的应用。
4. 模型—芯片协同降本,国产算力进入规模化验证
- Qwen3.8-Flash:采用MoE架构,1M上下文Prefill吞吐量达Qwen3.7-Plus的8.6倍,支持更长上下文及复杂任务。
- GLM-5.3-Flash:总参数320B、激活参数18B,折后单任务成本仅0.045美元,进入全球智能成本帕累托前沿;匿名测试流量全部由国产AI芯片承载,生产集群覆盖数万颗国产加速器,端到端性能提升3倍。
- 国产芯片应用:MiniMax推进M3与H3的国产芯片适配,大规模国产算力集群将逐步承担真实生产流量。
- 海外厂商进展:OpenAI发布首款定制推理芯片Jalapeño,峰值吞吐量比对比系统高1.5—1.9倍,端到端延迟降低1.7—3.6倍;Anthropic签署约450亿美元算力租赁协议,引入谷歌TPU项目高管。
关键信息
模型发布与商业化数据
- Qwen3.8-Flash:125B总参数、6B激活参数,支持1M上下文,Prefill吞吐量达Qwen3.7-Plus的8.6倍。
- Qwen3.8-Flash-Next:作为Qwen4系列的架构雏形,验证Next新架构。
- GLM-5.3-Flash:标准价格为GLM-5.3的1/10,匿名测试调用量在两大平台登顶,全部由国产芯片承载。
- Gemini 3.5 Transcribe:支持85种语言,流式/非流式平均WER分别为4.0%/2.6%,转录时间较Chirp 3缩短约70%。
- Gemini Omni 1.1 Flash:最高支持4K视频,360p预览速度最高提升60%,成本仅为标准720p的1/3。
- MiniMax M3 Pro:参数规模预计提升至约3T,强化学习和长程任务训练进一步优化。
- Wan3.0:在Arena视频编辑竞技场中位居第一,领先Seedance 2.5和MiniMax H3。
- Qoder:截至8月27日,全球累计用户超600万,使用企业超10万家。
厂商动态
- DeepSeek:调整API峰谷计费规则,引导调用需求向非高峰期迁移。
- 字节跳动:火山引擎建设具身智能数据基础设施,与15家具身智能企业合作。
- 通义:Wan3.0在视频编辑领域表现突出,Qoder用户增长显著。
- 智谱:GLM-5.3-Flash在多项基准测试中表现优异,价格仅为GLM-5.3的1/10。
- MiniMax:推进国产芯片适配,提升算力利用率。
- Kimi:Harvey基于Kimi K3训练法律模型Tenet,全通过率提升至19.7%。
- Anthropic:发布模型硬件标准(MHS),实现AI智能体与多种设备的交互;引入谷歌TPU项目高管。
- OpenAI:发布Jalapeño推理芯片,测试结果优于现有系统;推出ChatGPT Business Premium Seats;开发持续运行的Codex Persistent模式。
- Gemini:推出面向法律与金融场景的插件;Gemini Live升级,支持多语言流式语音识别,错误率最低;发布Gemini Omni 1.1 Flash,支持4K视频生成,价格区间为0.03—0.30美元/秒。
风险提示
- 技术迭代不及预期:模型能力、推理效率及软硬件协同进展可能低于预期。
- Agent商业化变现不及预期:Agent使用增长可能未能有效转化为付费客户、收入及利润。
- 算力供给及资本开支压力超预期:算力需求持续增长可能加剧资源约束,并推高芯片、数据中心及基础设施投入。
- 开放模型海外拓展不及预期:贸易限制、合规要求及生态建设进展可能影响开放模型的海外采用与商业化。
- Agent安全与监管风险:Agent工具调用及执行权限扩大可能带来数据、系统安全与责任认定风险。
- 头部厂商竞争加剧:模型、价格、企业客户、Agent入口及算力资源竞争加剧可能压缩盈利空间。
行业评级
- 行业评级:看好(维持)
- 股票投资评级说明:以报告日后6个月内行业指数相对于沪深300指数的涨跌幅为标准,定义如下:
- 买入:行业指数涨跌幅+20%以上;
- 增持:行业指数涨跌幅+10%~+20%;
- 中性:行业指数涨跌幅-10%~+10%之间波动;
- 减持:行业指数涨跌幅-10%以下。
法律声明
本报告由浙商证券股份有限公司制作,信息来源于公开资料,本公司不对信息的真实性、准确性及完整性作任何保证,亦不保证信息不发生变更。本报告仅供客户参考,不构成投资建议,投资者应独立评估并考虑自身需求。未经授权,不得复制、发布或传播本报告内容。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载