|
|
当前位置:首页 > ai智能 > 新华社研究院发布《人工智能大模型体验报告2.0》 |
新华社研究院发布《人工智能大模型体验报告2.0》 |
来源:新华社研究院 时间:2023/8/18 |
新华社研究院企业发展研究中心发布的《人工智能大模型体验报告2.0》(以下简称报告)显示,讯飞星火、百度文心一言、商汤商量和智谱AI-ChatGLM均表现抢眼,AI大模型的发展为人类工作和生活的提质增效均带来了正向积J的影响。 报告显示,与2023年6月相比,当前大模型产品进步显著。但与接受过G等教育的人类相比,大模型在智商、情商等方面还存在一定程度差距。具体来看,讯飞星火在工作提效方面优势明显,百度文心一言基础能力仍处L军水准,商汤商量则在情商方面表现优秀,智谱AI-ChatGLM整体表现优秀。 针对各维度能力测评,该报告还给出了相应的案例展示和分析。 在基础能力方面,人类与AI之间的差距并不显著。课题组分别从语言能力(35%)、AI向善(10%)、跨模态(20%)和多轮对话(35%)四大指标进行测评。测评显示,科技企业大模型中,百度文心一言表现为抢眼,商汤商量、智谱AI-ChatGLM、360智脑表现优良。 在智商评估方面,人类在智商方面仍然具有明显优势。课题组分别从常识知识(20%)、逻辑能力(50%)和专业知识(30%)方面对科技企业大模型进行考量。结果显示,讯飞星火、智谱AI-ChatGLM表现突出,百度文心一言、昆仑万维天工表现优良。 在情商方面,AI与人类之间的差距为明显。人类在情绪理解和处理方面通常具有更强的优势,和更灵活的处理能力。通过对处理日常事项(35%)、一语双关(30%)、人际关系(35%)问题进行分析发现,科技企业大模型中,商汤商量表现亮眼,百度文心一言、澜舟科技Mchat、智谱AI-ChatGLM及360智脑均表现优良。 在工作效率提升方面,课题组重点在工具提效(50%)和生成创新(50%)方面进行考量。结果显示,讯飞星火表现为抢眼,百度文心一言、商汤商量、智谱AI-ChatGLM表现优良。不过,尽管AI具有G速度和G效率的优势,但在某些复杂和具有创新性的任务中,人类的智慧和想象力仍然具有无法替代的作用。 报告认为,虽然在不同L域中,AI和人类表现出不同的优劣势,但在整体上,AI大模型的发展为人类工作和生活的提质增效带来了重要的积J影响,大模型正在加速走进生活、走进产业。在本次体验测评基础上,研究团队将继续深耕,加强在大模型安全可解释性、工作提效能力、实际落地情况、产业优秀案例等维度上的探索与研究。
![]()
|
相关推荐 |
»
商汤大模型伦理原则与实践白皮书:日日新,思无邪
» AI+办公,AI赋能办公 重塑办公模式 » AI+安防,助力构建安防新形态 » AI+网络安全, 赋能网络安全实现产业升级 » AI+数字政务,为数字政府提供助力 » AI+媒体,助力内容生成赋能数字媒体 » AI+教育,赋能教育要应用于课堂教学,课后辅导 » AI+出版,与出版双向赋能 打破出版传播的时空性 » AI+影视,带动影视IP落地分得流量 与红利 » AI+游戏-虚拟走进现实,AI+游戏赛道提速 » AI+电商-大模型赋能,AI+电商迎来新机遇 » AI+广告营销-全方位助力广告营销 |
![]() ![]() ![]() |
![]() |
|
|
版权所有 © 创泽智能机器人集团股份有限公司 中国运营中心:北京·清华科技园C座五楼 生产研发基地:山东日照太原路71号 电话:4008-128-728 |