• 首页
  • 深度
    • 极客观察
    • 极客访谈
    • 极客说
    • 极客评测
  • 智库
  • 自明星
  • 大事件
  • 行业
    • 网络通信
    • 企业级IT
    • 零售电商
    • 人工智能
    • 智能汽车
    • 智能硬件
    • 云计算
    • 芯片
    • 新能源
    • 流媒体
    • AR/VR/MR
    • 元宇宙
    • 区块链
    • 创业创投
  • 直播
  • 7x24h快讯
极客网 > 7x24h快讯 > 极客快讯 >

国内主流大模型性能排名来了!讯飞星火第一,百度文心一言第二

继6月发布《人工智能大模型体验报告》后,8月12日,新华社研究院中国企业发展研究中心再次发布《人工智能大模型体验报告2.0》(以下简称“报告”),针对国内大模型在基础能力、智商能力、情商能力和工具提效四大维度的性能表现给出了排名。

结果显示,讯飞星火总分第一,1013分,仅比人类答案少1分;百度文心一言第二,1010分;商汤商量和智谱ChatGLM并列第三,983分。

国内主流大模型性能排名来了!讯飞星火第一,百度文心一言第二

不过,具体到各维度能力,各大模型呈现出不同优势。

其中在基础能力方面,人类与 AI之间的差距并不显著。这是因为 AI算法模型的开发受到人类编程思维的影响,并且在其开发过程中充分利用了人类的智慧和知识。在政策的积极引导下, AI在向善和语言能力上表现出色,逐渐接近人类专家的水平。

课题组分别从语言能力(35%)、AI向善(10%)、跨模态(20%)和多轮对话(35%)四大指标共150题中对各大模型进行了测评。测评显示,科技企业大模型中,百度文心一言表现最为抢眼,商汤商量、智谱AI-ChatGLM、360智脑表现优良。

国内主流大模型性能排名来了!讯飞星火第一,百度文心一言第二

在智商评估方面,人类在智商方面仍然具有明显优势。人类的智商不仅体现在学习能力上,更表现在善用工具和解决问题的能力上。

对此课题组分别从常识知识(20%)、逻辑能力(50%)和专业知识(30%)方面对科技企业大模型进行考量,题目总数达125题。结果显示,讯飞星火、智谱AI-ChatGLM表现突出,百度文心一言、昆仑万维天工表现优良。

国内主流大模型性能排名来了!讯飞星火第一,百度文心一言第二

在情商方面,AI与人类之间的差距最为明显。人类在情绪理解和处理方面通常具有更强的优势,和更灵活的处理能力。

通过对处理日常事项(35%)、一语双关(30%)、人际关系(35%)等75个问题进行分析发现,科技企业大模型中,商汤商量表现亮眼,百度文心一言、澜舟科技Mchat、智谱AI-ChatGLM及360智脑均表现优良。

国内主流大模型性能排名来了!讯飞星火第一,百度文心一言第二

在工作效率提升方面,课题组重点在工具提效(50%)和生成创新(50%)150个题目上进行考量。结果显示,讯飞星火表现最为抢眼,百度文心一言、商汤商量、智谱AI-ChatGLM表现优良。不过,尽管AI具有高速度和高效率的优势,但在某些复杂和具有创新性的任务中,人类的智慧和想象力仍然具有无法替代的作用。

国内主流大模型性能排名来了!讯飞星火第一,百度文心一言第二

报告认为,虽然在不同领域中,AI和人类表现出不同的优劣势,但在整体上,AI大模型的发展为人类工作和生活的提质增效带来了重要的积极影响,大模型正在加速走进生活、走进产业。

同时指出,AI技术发展到现在,其重点已经从大模型的盲目追求转向了实用性和可持续性的发展,AI大规模落地需要更多时间来验证。

通过降低成本、提高易用性、增强可靠性、保护隐私和安全等方面的措施,进一步提高大模型的可用性,让更多的人受益于AI技术的发展,实现更加智能化和便捷化的生活,是未来让AI真正走进千家万户的关键。

(免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。
任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,应及时向本网站提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明。本网站在收到上述法律文件后,将会依法尽快联系相关文章源头核实,沟通删除相关内容或断开相关链接。 )

极客观察
  • 从“根技术”到“根生态”,华为云携手开发者“智”启新境
  • 为加速5G创新和变现,爱立信联合多家运营商成立网络API公司
  • 借AI PC东风推进多元化战略,高通攻入英特尔和AMD的地盘
  • 上海5G-A,“魔”力大绽放
  • 中美企业聚焦AI眼镜赛道,AI+AR大有可为
  • 《黑神话:悟空》意外爆红引品牌追捧,中国文化开始发光
  • 谷歌AI搜索给网站的选择:要么分享数据,要么死
  • 从测试版看“苹果智能”:功能并不惊艳,远远称不上革命性技术
  • 四年巨亏500亿美元,Meta的VR/AR业务问题出在哪?
  • 科技巨头财报透露一个事实:AI研发费用太太太高了!
赞助商

玻璃钢生产厂家河北公园玻璃钢雕塑市场浮雕墙玻璃钢雕塑沈阳玻璃钢动物牛雕塑商场美陈布置方案百度徐州玻璃钢雕塑工程宜宾成都商场美陈德阳佛像玻璃钢雕塑山东大型商场创意商业美陈制作宁夏玻璃钢仿铜雕塑定制天津个性化玻璃钢雕塑批发偃师商场美陈湘潭长沙玻璃钢雕塑厂家推荐广东玻璃钢卡通雕塑价格德惠玻璃钢仿铜雕塑宿迁市玻璃钢雕塑景观标识校园玻璃钢雕塑定制安国玻璃钢卡通座椅雕塑玻璃钢卡通雕塑货源充足东营玻璃钢仿真水果雕塑佛山玻璃钢工艺雕塑厂招聘公园玻璃钢雕塑狗狗深圳卡通玻璃钢雕塑设计厂家玻璃钢鹿雕塑哪家安全黑龙江卡通玻璃钢雕塑厂家北京玻璃钢花盆厂漳州模压法玻璃钢雕塑玻璃钢美陈雕塑云浮玻璃钢动物雕塑销售厂家铜陵大型户外玻璃钢雕塑玻璃钢西瓜雕塑怎么买香港通过《维护国家安全条例》两大学生合买彩票中奖一人不认账让美丽中国“从细节出发”19岁小伙救下5人后溺亡 多方发声单亲妈妈陷入热恋 14岁儿子报警汪小菲曝离婚始末遭遇山火的松茸之乡雅江山火三名扑火人员牺牲系谣言何赛飞追着代拍打萧美琴窜访捷克 外交部回应卫健委通报少年有偿捐血浆16次猝死手机成瘾是影响睡眠质量重要因素高校汽车撞人致3死16伤 司机系学生315晚会后胖东来又人满为患了小米汽车超级工厂正式揭幕中国拥有亿元资产的家庭达13.3万户周杰伦一审败诉网易男孩8年未见母亲被告知被遗忘许家印被限制高消费饲养员用铁锨驱打大熊猫被辞退男子被猫抓伤后确诊“猫抓病”特朗普无法缴纳4.54亿美元罚金倪萍分享减重40斤方法联合利华开始重组张家界的山上“长”满了韩国人?张立群任西安交通大学校长杨倩无缘巴黎奥运“重生之我在北大当嫡校长”黑马情侣提车了专访95后高颜值猪保姆考生莫言也上北大硕士复试名单了网友洛杉矶偶遇贾玲专家建议不必谈骨泥色变沉迷短剧的人就像掉进了杀猪盘奥巴马现身唐宁街 黑色着装引猜测七年后宇文玥被薅头发捞上岸事业单位女子向同事水杯投不明物质凯特王妃现身!外出购物视频曝光河南驻马店通报西平中学跳楼事件王树国卸任西安交大校长 师生送别恒大被罚41.75亿到底怎么缴男子被流浪猫绊倒 投喂者赔24万房客欠租失踪 房东直发愁西双版纳热带植物园回应蜉蝣大爆发钱人豪晒法院裁定实锤抄袭外国人感慨凌晨的中国很安全胖东来员工每周单休无小长假白宫:哈马斯三号人物被杀测试车高速逃费 小米:已补缴老人退休金被冒领16年 金额超20万

玻璃钢生产厂家 XML地图 TXT地图 虚拟主机 SEO 网站制作 网站优化