清华发布大模型性能报告：GPT-4第一更懂中文的还是百度

2023-08-10 22:07:53 出处：快科技

(相关资料图)

快科技8月10日消息，AI大模型成为今年的热点，OpenAI的ChatGPT一马当先，微软、谷歌、Meta紧随其后，国内科技巨头也迅速跟进，现在国内据说已经有上百款大模型问世了。

这么多大模型中，实力到底如何？日前清华大学新闻与传播学院发布了《大语言模型综合性能评估报告》，将国内外的大模型做了一番对比。

该报告还探讨了这些模型在不同知识领域，如创意写作、代码编程、舆情分析、历史知识等方面的回答情况，以及其在解决实际问题中的有效性和局限性。

从生成质量、使用与性能、安全与合规三个维度，对目前市场上的7个大型语言模型进行了全面的综合评估。

在这7款大模型中，GPT-4获得了毫无悬念的第一，第二名是百度的文心一言，其次是GPT-3.5，后面就是Claude、讯飞星火、阿里云的通义千问及昆仑的天工。

虽然GPT-4各方面领先，但是对国内用户来说，更懂中文的大模型才是关键，这方面百度的文心一言更好，在部分中文语义理解方面，文心一言以92%的得分率排名榜首，超越讯飞星火、GPT-4。

这跟百度的大模型包含大量中文文本有关系，因此能够更好地处理本土文化相关的内容。

关键词：

理财更多>>

投资更多>>

论坛更多>>

糖尿病患者免疫力低下时易并发结核病 突然暴瘦未必是好事或是身体发出的“求救信号”糖尿病患者免疫力低下时

上市公司更多>>

广东惠州：拟实施更加积极宽松的落户政策优化惠城区、大亚湾开发区等4区的落户条件 每经AI快讯，8月9日，惠州市住建局官网发布关于公开征求《惠州市住房发

消费

产业

中国联通梁宝俊：人工智能已在多个领域广泛应用 8月9日，在中国联通2023年中期业绩发布会上，中国联通副总经理梁宝俊表

东兴证券：上半年净利同比增28% 东兴证券公告，上半年公司实现营业收入18 18亿元，同比增长2%；净利润3

SCXI-1000 SCXI-1180 NI 关键命令的优先级控制 SCXI-1000SCXI-1180NI关键命令的优先级控制MOXA宣布MGateMB3000系列Mod

百姓乐享文化大餐 图为来自北京的艺术家们和拉萨各族人民一起跳锅庄。记者格桑伦珠摄近日

基金

广东电网公司2023年第二批框架招标（10kV及以下瓷质绝缘子）中标候选人公示 广东电网公司2023年第二批框架招标（10kV及以下瓷质绝缘子）中标候选人

清华发布大模型性能报告：GPT-4第一 更懂中文的还是百度