2024年企业行使大模子奈何选?今天,环球拉长接头公司弗若斯特沙利文颁发《2024年中邦大模子技能评测》,扫数梳理了现时大模子的最新发扬态势和逐鹿体例,为企业选购大模子供给精准决定援救。
陈诉对邦内主流的15个大模子举办了巨擘评测。结果显示,百度、腾讯、阿里等互联网大厂旗下大模子位于第一梯队。个中,文心一言技能最为扫数,五项评测维度均为上风技能,并获得四项第一。

沙利文的最新陈诉以用户行使体验和本质行使价格为量度轨范,归纳考量数理科学、说话技能、德性仔肩、行业技能及归纳技能等5大主题维度及21个细化二级维度。
陈诉显示,邦际领先模子正在通用本原技能和专业行使技能上略优于中邦领先模子,但以文心一言为代外的中邦模子具备亮眼浮现。文心一言拿下数理科学、说话技能、德性仔肩、行业技能及归纳技能等五大评测维度的四项第一,评测结果远超邦际均线,发现了中邦大模子正在自然说话管制范畴的明显势力和正在本质行使中的高价格。
沙利文陈诉的大模子通用本原技能评测蕴涵数理科学、说话技能和德性仔肩约束等三大因素,结果显示文心一言排名第一,发现出模子正在底层本原技能方面的较高秤谌。大模子的专业行使技能蕴涵归纳技能和专业技能两大主题因素,是大模子本质应用效率的聚集发现,文心一言同样位列榜首,浮现明显优于邦际均线。

从实在细分维度来看,正在说话技能的评测中,得益于进步的模子架构、大周围预演练、精美调优、众使命研习以及健旺的盘算资源等众方面的上风,文心一言正在说话外达技能、说话明确技能、以及说话逻辑技能等闭头目标上都抵达了领先秤谌,正在说话技能评测中排名第一。迥殊是盛开式逻辑推理方面,文心一言扶植了新的标杆。这哀求模子具备深远解析、扫数对比和无误判决的技能,正在管制繁杂、众主意的逻辑推理题目时尤为紧急。
正在日益紧急的德性仔肩评测中,文心一言正在德性明确深度、紧急舆情规避机制以及鲁棒性对立方面均浮现优异,成为此次测试中安适性最高的模子。这反应出文心一言正在模仿和管制涉及德性判决和决定的情境时,具备更为精准的明确力和合适性。这无疑将确保AI大模子的可继续发扬和社会效益的最大化。
正在大模子落地垂青的行业技能评测中,文心一言同样排名第一。陈诉显示,文心一言矫健合适并高效管理了电商、工业、教诲、能源、医疗等跨越10个行业本质行使场景中碰到的题目,正在众行业技能评测中浮现优异。
沙利文还正在陈诉中预测,2024年,大模子的身手发扬将趋势众性能与小型化,同时家当端将夸大自立研发和行业轨范化,而伦理仔肩和数据轨范样板将成为继续发扬的闭头。
以百度文心一言为代外的邦产模子,正正在不时提拔大模子的成果,丰裕大模子的性能。公然原料显示,自文心大模子颁发往后,百度不时消重推理本钱,进一步提拔文心大模子的成果。借助百度怪异的四层AI身手架构,文心大模子周均演练有用率跨越98%。
百度还推出两款MaaS产物,消重大模子及AI原生行使开辟门槛,永诀是用于行使开辟的千帆AppBuilder和用于专有模子开辟精调的千帆ModelBuilder,累计助助用户精调1.3万个大模子,办事8万企业用户,助助用户开辟出16万个大模子行使。
据媒体报道,百度近期正在大模子上有诸众新行动。4月16-17日,百度CreateAI开辟者大会将正在深圳邦际会展中央(宝安)举办,不单会带来AI身手的最新希望,还将修立超30节“AI公然课”,与环球各地参会者分享百度正在AI范畴的科研功效。