智谱 GLM 大模型在模型幻觉排行榜中居首，事实一致性达 98.7%

1月11日

admin

近日，智谱宣布，旗下 GLM-4-9B 模型在基于幻觉评估模型 HHEM-2.1-Open 的大模型幻觉排行榜中，以 1.3% 的幻觉率排名第一。据悉，智谱 GLM-4-9B 模型在该排行榜中，超过 OpenAI 的 GPT 系列和 Google 的 Gemini 系列在内的一众世界顶尖模型。从具体来看，智谱 GLM-4-9B 模型事实一致性率高达 98.7%，回答率 100%，幻觉率则仅有 1.3%，在参评的 85 个模型中排名第一。据了解，智谱 GLM-4-9B 是智谱 AI 推出的最新一代预训练模型 GLM-4 系列中的开源版本。在语义、数学、推理、代码和知识等多方面的数据集测评中，GLM-4-9B 及其人类偏好对齐的版本 GLM-4-9B-Chat 均表现出较高的性能。

TOP1

用AI制作宠物吃播视频，百万流量爆款视频教程直接抄
8小时前
TOP2

小米突然发布新模型：媲美 DeepSeek-V3.2
8小时前
TOP3

Google、Shopify 前高管加盟 OpenAI
8小时前
OpenAI 发布新生图模型，PK Nano Banana
8小时前
豆包手机：首批货源已售罄，此前行业内传闻的备货数量均不准确
8小时前
OpenAI 宣布：苹果 Apple Music 即将与 ChatGPT 集成
8小时前
Meta 扩大员工使用竞争对手 AI工具权限，含 ChatGPT-5、 Gemini 3 Pro 等
8小时前
AI Diagram Generator：图表生成器，AI一键生成流程图、思维导图、UML图等多种图表
12小时前

❯

搜索

幸运之星即将降临……

点击领取今天的签到奖励！

恭喜！您今天获得了{{mission.data.mission.credit}}积分

今日签到

连续签到

{{item.credit}}

连续{{item.count}}天

查看所有

我的优惠

_￥_優惠

使用時效：无法使用

使用時效：
之前

使用時效：预期有效

优惠编号：
×

限制以下商品使用：限制以下商品分类用途：不限制使用：

[{{ct.name}}]

所有商品及商品类型需求使用

没有优惠可用！

购物车

×

德

空空如也！

清空貨櫃前往

您的有新私信

没有新私信

写新私信查看全部

{{userData.name}}已认证

智谱 GLM 大模型在模型幻觉排行榜中居首，事实一致性达 98.7%

用AI制作宠物吃播视频，百万流量爆款视频教程直接抄

小米突然发布新模型：媲美 DeepSeek-V3.2

Google、Shopify 前高管加盟 OpenAI

OpenAI 发布新生图模型，PK Nano Banana

豆包手机：首批货源已售罄，此前行业内传闻的备货数量均不准确

OpenAI 宣布：苹果 Apple Music 即将与 ChatGPT 集成

Meta 扩大员工使用竞争对手 AI工具权限，含 ChatGPT-5、 Gemini 3 Pro 等

AI Diagram Generator：图表生成器，AI一键生成流程图、思维导图、UML图等多种图表

AI微博

AI应用

5000+AI应用！每日更新

1AICLUB

强烈推荐！官方品牌微博

AI教程

海量教程看不完

AI基础训练营

零基础入门，带你成为AI高手

1ai抖音

1ai大神

抖音号：1ai.net

1ai大神

抖音号：1ai.net

1ai微信

每天五分钟

一年变大神

扫码关注