我国人工智能大模型发展动态-中国移动_12页_923kb
报告摘要
我国人工智能大模型发展动态分析总结
一、总体发展现状
截至2023年4月,国内至少有19家企业及科研机构参与人工智能大模型研发,主要分为三大类:大型科技企业(含12家)、科研院校(含3家)和初创团队。大型科技企业已形成"算力层-平台层-模型层-应用层"四位一体布局,百度、阿里、华为等代表企业从芯片到应用进行自主开发。科研院校与垂直领域企业则侧重算法研发与细分应用场景,算力基础设施相对薄弱。
在参数规模方面,科技大厂均达到千亿级及以上,其中阿里通义千问参数量超10万亿,腾讯混元与华为盘古参数量均超万亿。科研院校大模型参数量普遍在千亿级以下。应用场景上,企业普遍先在内部测试,再向B端市场拓展,预计少数企业将进入C端市场。目前百度文心、华为盘古、中科院紫东太初已积累B端应用案例,百度文心一言等三类模型具备C端拓展潜力。
二、典型企业分析
(一)百度文心大模型:累计研发投入超千亿元,专利数量连续五年全国第一。自2019年推出ERNIE系列,现迭代至千亿级参数版本。构建"昆仑芯+飞桨平台+文心大模型+行业应用"完整体系,已在搜索、智能驾驶、地图等内部产品应用。对外提供API接口及开发工具,已吸引600多家企业加入生态。文心一言在文本生成方面表现较强,但存在常识性错误等问题。
(二)阿里通义大模型:依托"含光800芯片+M6-OFA底座+通义大模型+行业应用"体系,2022年9月发布通义系列,同年11月推出魔搭开源平台。通义千问基于10万亿参数大模型底座,具备多模态融合能力,但图像生成能力尚未成熟。内部全面接入阿里全系产品,正在与OPPO、太平洋保险等企业开展合作。在语言翻译领域表现突出,但复杂计算能力待提升。
(三)华为盘古大模型:打造"昇腾芯片+MindSpore框架+盘古大模型+行业应用"全栈体系,聚焦企业级服务。2020年启动研发,2021年发布自然语言处理、计算机视觉等系列模型。在医药领域缩短药物研发周期至1个月,降低70%成本;气象领域实现秒级全球预报,台风预测准确率全球领先;工业质检领域提升样本筛选效率30倍。目前尚未开放对外测试。
(四)腾讯混元大模型:以"太极平台+混元大模型"为基础,2016年成立AILab实验室,2022年发布混元系列。重点服务于腾讯内部业务,已应用于广告投放、游戏、社交等领域。自研太极平台支持10TB级模型训练,对广告主带来15%GMV提升。尚未对外公开明确的行业应用方向。
(五)商汤日日新大模型:构建"SenseCore算力平台+SenseNova大模型"体系,2018年起开展大模型研究。2022年推出320亿参数通用视觉模型,2023年发布日日新SenseNova,涵盖自然语言处理、内容生成等多领域能力。其SenseCore平台为亚洲最大,可支持20个千亿级模型并行训练,最高支持万亿参数模型。目前已向政企客户开放测试,计划应用于智能汽车、智慧商业等场景。
行业评估显示,国内大模型整体处于百花齐放阶段,但与GPT-4仍有较大差距。百度、阿里、腾讯、华为四家企业处于第一梯队,具备较强的综合研发实力和商业化推进能力。当前大模型发展呈现"技术积累-场景验证-生态构建"的演进路径,多数企业仍以内部应用为主,C端市场拓展尚处于初期阶段。
试读结束,高清完整版pdf/doc/ppt,请点下载