国际评测机构:百度文心大模型3.5拿下12项指标的7个满分

2023-07-19 16:10:40 来源:新华网 作者:

  IT市场研究和咨询公司IDC最新发布的《AI大模型技术能力评估报告,2023》中显示,百度文心大模型3.5拿下12项指标的7个满分,这体现了百度文心大模型的基础技术深度和产业应用覆盖广度。

  IDC评估报告围绕产品技术、服务生态以及行业应用三大维度,考察大模型的10余项指标,其中“算法模型”和“行业覆盖”成为衡量大模型能力极其重要的两个指标。

  当前大模型正处于快速发展阶段,产品技术能力、行业应用能力显得尤为重要。

  产品技术能力中,“算法模型”维度是重中之重,是大模型能力最为核心的要素,也是决定大模型应用效果的根本所在。只有通过算法模型技术的突破,实现具有通用效果优势的大模型底座,才能支撑更广泛的行业覆盖,才能使各行各业充分享受技术突破带来的红利,破解AI落地门槛高的困境。

  在行业应用能力中,应用覆盖的广度是当下大模型厂商最为关注的指标。“行业覆盖”通过企业级客户数量和落地行业数,体现了大模型在产业落地上的实力,是大模型效果通用领先性、行业结合能力两方面的综合体现。

  “算法模型”、“行业覆盖”两个核心指标有其内在的关联性,行业覆盖的广度是算法模型通用领先性的集中体现,也将为算法模型能力持续提升提供源源不断的正向反馈,形成持续迭代提升的飞轮。

  这是IDC首次提出AI大模型技术能力评估框架,国内主流大模型,包括百度、阿里、腾讯、华为、科大讯飞、360、商汤等14家厂商参与了本次评估。结果显示,百度AI大模型在模型能力、工具平台、生态布局以及行业覆盖上优势明显,并已提前进入商业化落地探索阶段。

  AI大模型已经从拼参数发展到拼应用,进入大规模可复制的产业落地阶段。百度文心大模型源于产业实践,服务于产业实践,业内首次提出了行业大模型的落地思路,联合国家电网、浦发银行、泰康、吉利、哈尔滨市、深圳燃气、TCL、上海辞书出版社等企业单位,合作发布了11个行业大模型,是业内最早和广泛深入推动行业大模型的厂商。

  据介绍,文心大模型已经拥有中国最大的产业应用规模,目前有15万家企业申请接入文心一言测试。百度智能云与300多家生态伙伴,在超过400个场景中已取得相当不错的测试效果。

  未来,百度文心大模型将持续发挥算法模型基础技术优势,助力千行百业中国企业将大模型内化为自身的生产力工具,走上智能化转型升级的快车道。