国产大模型哪家强？体验报告第一是它

来源：南方Plus 2023-08-14 16:17:49

(资料图片仅供参考)

500道题目、对标接受过高等教育的人类水平、更强调对产业和生活的实际价值，严格按基础能力指数、智商指数、情商指数、工具提效指数四大测评维度进行权重设计……8月12日，新华社研究院中国企业发展研究中心发布《人工智能大模型体验报告2.0》（以下简称《报告》），讯飞星火以总分1013分位列本次国产主流大模型测评榜首位。

《报告》认为，具有7大核心能力（即文本生成、语言理解、知识问答、逻辑推理、数学能力、代码能力、多模态能力）的讯飞星火认知大模型拥有跨领域的知识和语言理解能力，能够基于自然对话方式理解与执行任务。从海量数据和大规模知识中持续进化，实现从提出、规划到解决问题的全流程闭环。在智商评估方面，《报告》认为，人类在智商方面仍然具有明显优势。课题组分别从常识知识（20%）、逻辑能力（50%）和专业知识（30%）方面对大模型进行考量，结果显示，讯飞星火排名第一。

在工作效率提升方面，《报告》认为， AI对人类提供了有力的支持，AI的处理速度远远超过人类。然而，尽管AI具有高速度和高效率的优势，但在某些复杂和具有创新性的任务中，人类的智慧和想象力仍然具有无法替代的作用。

《报告》认为，与2023年6月相比，当前中国大模型产品进步显著。但与接受过高等教育的人类相比，大模型在智商、情商等方面还存在一定程度差距。虽然在不同领域中，AI和人类表现出不同的优劣势，但在整体上，AI大模型的发展为人类工作和生活的提质增效带来了重要的积极影响，大模型正在加速走进生活、走进产业。

（文章来源：南方Plus）

上一篇：截至发稿，南向资金净流入超90亿港元。

上一篇：最后一页