清华权威报告：文心一言4.0多项指标遥遥领先

资讯
24年4月23日
編輯

admin

由清华大学基础模型研究中心最新发布的2024年3月版《SuperBench大模型综合能力评测报告》中，共涵盖了14个具有海内外影响力的模型。

在此次评测中，文心4.0的表现令人瞩目，其性能接近国际顶级模型，且与顶尖模型的差距正在逐步缩小，堪称国内领先模型。

清华权威报告：文心一言4.0多项指标遥遥领先

例如，在人类对齐能力的评测中，文心4.0以卓越的表现位居国内首位。

在中文推理和中文语言的评测中，文心4.0遥遥领先，与其他模型相比，差距明显。在中文理解上，文心4.0的领先优势尤其突出，比第二名的GLM-4高出0.41分。

在语义理解的数学能力评测中，文心4.0与Claude-3并列全球第一，而GPT-4系列模型则位列第四和第五，其他模型的得分主要集中在55分左右，显著落后于领先群体。

在阅读理解能力的评测中，文心4.0超越了GPT-4 Turbo、Claude-3以及GLM-4，取得了最高的成绩。

在企业最关注的安全性评测中，文心4.0同样表现出色，力压国际一流的GPT-4系列模型和Claude-3，获得了最高分（89.1分），而Claude-3仅位列第四。

数据还显示，自去年3月16日文心一言首次亮相以来，用户数量已经突破了2亿，每天的API调用量也超过了2亿次。

声明：内容来源公开的各类媒体平台，若收录的内容侵犯了您的权益，请联系邮箱，本站将第一时间处理。

{{userData.name}}已认证

清华权威报告：文心一言4.0多项指标遥遥领先

苹果下半年大量采用生成式人工智能本地AI处理能力将大幅提升

商汤科技将发布「日日新 SenseNova 5.0」大模型

AI微博

AI应用

5000+AI应用！每日更新

1AICLUB

强烈推荐！官方品牌微博

AI教程

海量教程看不完

AI基础训练营

零基础入门，带你成为AI高手

1ai抖音

1ai大神

抖音号：1ai.net

1ai大神

抖音号：1ai.net

1ai微信

每天五分钟

一年变大神

扫码关注

{{userData.name}}已认证

相关内容：

苹果下半年大量采用生成式人工智能 本地AI处理能力将大幅提升

商汤科技将发布「日日新 SenseNova 5.0」大模型

李彦宏：百度目前20%代码由AI完成 文心一言已有800万开发者

百度智能云发布AI浏览器插件“超级助理” 基于文心一言打造

清华团队发布AI光芯片“太极”：灵感来自周易

百度万象大会2024 百度：已有11%的搜索内容由AI生成

AI应用

5000+AI应用！每日更新

1AICLUB

强烈推荐！官方品牌微博

AI教程

海量教程看不完

AI基础训练营

零基础入门，带你成为AI高手

1ai大神

抖音号：1ai.net

1ai大神

抖音号：1ai.net

每天五分钟

一年变大神

扫码关注

苹果下半年大量采用生成式人工智能本地AI处理能力将大幅提升

李彦宏：百度目前20%代码由AI完成文心一言已有800万开发者