-
黄震昕:SOTA 模型应该有自己的定价权
7 月 22 日消息,月之暗面企业业务负责人黄震昕在接受 21 世纪经济报道采访时表示,前沿模型的价值不应只用低价衡量。这番回应针对 Kimi K3 发布后围绕定价、算力紧张和开源路线的行业争议。 他表示,Kimi 会继续开源,但开源与闭源服务面向不同需求:需要私有化部署和微调的客户会选择开源模型,希望直接购买托管服务的客户则可能选择闭源服务,开源本身并不决定 Token 的质量和价格。 黄震昕称…- 1.3k
-
OpenAI 战略未来负责人:Kimi K3 性能接近 2026 年第一季度最佳公开模型
7 月 20 日消息,昨天,OpenAI 战略未来负责人 Dean Ball 发文表示,Kimi K3 是一款「非常好的模型」,其表现不能简单归因于蒸馏。 在智能体编程场景中,Kimi K3 基本达到 2026 年第一季度最佳公开模型的水平;不过,根据他的使用体验,该模型消耗的 token 较多,因此实际运行成本未必很低。 Ball 还表示,自己对中国仍允许开放这类高能力模型感到意外。他认为,相关…- 2.5k
-
SpaceXAI 最强模型 Grok 4.5 发布,API 输出价格不到 Opus 4.8 的十分之一
7 月 9 日消息,SpaceXAI 正式发布 Grok 4.5,定位为公司迄今最强模型,主打编码、AI 智能体任务与知识型工作。模型与 Cursor 联合训练,基于全新 V9 基座,参数规模约 1.5 万亿,训练使用数万块英伟达 GB300 GPU。 性能方面,Grok 4.5 在 Terminal-Bench 2.1 和 DeepSWE 1.0 两项基准上优于 Claude Opus 4.8,…- 1.5k
-
封号潮后,Claude Fable 5 解禁
7 月 2 日消息,据 WIRED 报道,美国商务部近日已撤销对 Anthropic 旗下高阶模型 Fable 5 和 Mythos 5 的出口、再出口及境内转让许可要求。 Anthropic 官方也已在 X 上表示,从今天起开始恢复 Claude Fable 5 访问。 值得注意的是,在解禁前夕,中国开发者群体正经历着史上最严苛的「封号潮」。据 Anthropic 在 2026 年初发布的透明度…- 1.9k
-
Claude Sonnet 5 正式上线,想把 AI Agent 运行成本打下来
7 月 1 日消息,当地时间 30 日,Anthropic 发布新一代中型模型 Claude Sonnet 5,核心强化了 AI 智能体能力。官方表示,该模型在自主规划、浏览器及终端工具调用方面的表现,已达到此前大型昂贵模型的水平。 性能方面,Sonnet 5 在编程基准测试中得分 63.2%,接近顶级模型 Opus 4.8,并显著优于前代 Sonnet 4.6。 早期合作伙伴反馈显示,该模型能自…- 1.3k
-
Grok Imagine Video 1.5 模型正式上线:生成 6 秒 720P 视频仅需 25 秒
6 月 18 日消息,马斯克旗下 xAI 公司昨天(6 月 17 日)发布公告,宣布正式上线 Grok Imagine Video 1.5 模型,并在 xAI API 中结束预览正式上线。 xAI 于 2026 年 6 月 3 日推出 Grok Imagine Video 1.5 Preview 预览版,主打“静态图一键生成带同步音频的短视频”,相比前代,主要升级音画同步、运动真实性和生成速度。 …- 2.3k
-
巴西模型 Rio 3.5 引发「缝合」Qwen 质疑
6 月 16 日消息,近日,一个由巴西里约热内卢市政府旗下 IT 公司开源的 Rio 3.5 Open 397B 模型在 AI 社区引发讨论。模型页面显示,它以 MIT 协议开放,总参数约 397B,单 token 激活约 17B,并支持较长上下文。 然而,模型发布不到 24 小时,开源 AI 团队 Nex-AGI 即在 X 平台发声,指出 Rio 3.5 实质上是通过模型合并(Model Mer…- 1.9k
-
微软发布七款自研模型,还有一台「梦中神机」
6 月 3 日消息,刚刚,微软举办 Build 2026 开发者大会,集中发布了自研模型家族、本地 AI 开发设备、新型 AI 终端形态及企业 AI 治理工具,宣示其在 AI 基础设施层面的全面布局。 本次大会一次性推出七款 MAI 模型,覆盖推理、代码、图像、语音和转录方向。 推理模型 MAI Thinking 1 采用稀疏 MoE 架构,活跃参数 35B,总参数规模约 1T,支持 256K t…- 5.3k
-
迈入百万上下文普惠时代:DeepSeek-V4 模型预览版正式上线并同步开源
4 月 24 日消息,今天上午,DeepSeek-V4 模型预览版正式上线并同步开源。 DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。模型按大小分为两个版本: 即日起登录官网 chat.deepseek.com 或官方 App,即可与最新的 DeepSeek-V4 对话,探索 1M 超长上下文记忆的全新体验。API 服务已同步更…- 4.3k
-
月之暗面最强模型 Kimi K2.6 发布并开源,代码能力对标 GPT-5.4
4 月 21 日消息,昨天,月之暗面正式发布并开源了新模型 Kimi K2.6,重点升级了代码、AI 智能体和办公能力。 代码能力更强:内部基准测试得分提升约 20%,可不间断编码 13 小时、处理超 4000 行代码,支持 Rust、Go、Python 等多种语言; AI 智能体集群扩容:最多支持 300 个子 AI 智能体并行协作,完成 4000 个步骤,任务完成质量显著提升; 长时自主运行:…- 4.6k
-
曝 Claude Opus 4.7 本周到来,还有一款设计工具
4 月 16 日消息,据 The Information 报道,Anthropic 正准备推出下一代旗舰模型 Claude Opus 4.7,并将同步发布一款 AI 驱动的设计工具,两款产品最快本周面世。 新推出的 AI 设计工具旨在通过自然语言提示,帮助用户做 ppt、网站、落地页及产品原型,直接对标 ppt 生成工具 Gamma 以及 Google Stitch。消息公布后,Adobe、Wix…- 2.9k
-
会撒谎、会抹痕迹:Anthropic 最强模型发布,但普通用户用不了
4 月 8 日消息,当地时间 7 日,Anthropic 发布了新一代旗舰模型 Claude Mythos Preview,并同步宣布启动 Project Glasswing 计划,将该模型限定授权给苹果、微软、亚马逊等 12 家科技巨头,专门用于防御性网络安全工作,不对公众开放。 Mythos Preview 在多项基准测试中呈现断崖式领先。Anthropic 表示,这是其训练过的最大模型,能力…- 3.7k
-
小米深夜上线三大自研 MiMo-V2 系列模型
3 月 19 日消息,今天凌晨,小米集中发布了 MiMo V2 系列三款模型:旗舰语言基座 MiMo-V2-Pro、全模态 Agent 基座 MiMo-V2-Omni,以及语音合成模型 MiMo-V2-TTS。 MiMo-V2-Pro: 总参数量超过 1T,激活参数为 42B,采用混合注意力(Hybrid Attention)架构,混合比例从前代的 5:1 提升至 7:1,并支持 1M 超长上下文…- 3.7k
-
OpenAI 发布「最强小模型」GPT-5.4 mini 与 nano
3 月 18 日消息,今天,OpenAI 正式发布了 GPT-5.4 mini 与 GPT-5.4 nano 两款新模型,官方称其为「迄今为止能力最强的小型模型」。这两款模型将 GPT-5.4 的核心能力引入更轻量的架构,专为高吞吐量、对延迟敏感的工作负载而设计。 GPT-5.4 mini 在代码编写、推理、多模态理解及工具调用方面均较 GPT-5 mini 有显著提升,运行速度提升超过 2 倍。…- 2.6k
-
Anthropic 发布 Sonnet 4.6 模型,上下文窗口翻倍至 100 万 token
2 月 18 日消息,Anthropic 发布了其中等规模 Sonnet 模型的新版本,延续了公司每四个月更新一次的节奏。在宣布新模型的公告中,Anthropic 重点强调了其在代码能力、指令遵循与计算机操作方面的改进。 Sonnet 4.6 将成为免费版与 Pro 版用户的默认模型。 本次推出的 Sonnet 4.6 测试版将支持 100 万 token 的上下文窗口,是此前 Sonnet 最大…- 2.8k
-
智谱上线全新模型 GLM-5
2 月 12 日消息,刚刚,智谱正式上线并开源最新模型 GLM-5。 据介绍,GLM-5 是迈向 Agentic Engineering 的产物:在 Coding 与 Agent 能力上,其取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务。 GLM-5 采用全新基座:参数规模从 355B(激活 32B)扩展至 744B…- 4.9k
-
神秘模型「Pony Alpha」上线引发热议,它会是国产大模型中的谁
2 月 9 日消息,2 月 6 日,全球模型服务平台 OpenRouter 上架了一个名为「Pony Alpha」的神秘模型,并且模型很快跑到了搜索前几名。 据模型介绍页信息显示,Pony Alpha 为新一代通用大模型,在编码、代理工作流程、推理和角色扮演方面表现出色,非常适合实际编码和现实世界使用。 模型拥有 200k 上下文窗口,支持 131k 输出,并且支持免费使用。 据博主…- 5k
-
OpenAI 与 Anthropic 同时发布重磅模型更新
2 月 6 日消息,今天凌晨,OpenAI 与 Anthropic 先后发布重磅模型更新,分别推出 GPT‑5.3‑Codex 与 Claude Opus 4.6。 OpenAI 宣称,GPT‑5.3‑Codex 是其首个在自身研发过程中发挥关键作用的模型,团队使用早期版本参与调试训练、部署管理与评估分析。 该模型在 SWE‑Bench Pro、Terminal‑Bench 2.0 与 OSWor…- 4.5k
-
OpenAI「备战负责人」官宣上任,加速布局前沿模型风险防护
2 月 5 日消息,昨天,OpenAI CEO 山姆 · 奥特曼(Sam Altman)宣布 Dylan Scand 加入公司,出任全新的「备战负责人」(Head of Preparedness)一职,负责前沿模型的高风险场景评估与缓解工作。 该职位此前因最高可达 55.5 万美元的薪酬(另含股权)在业内引发讨论。 奥特曼表示,OpenAI 即将进入「与极其强大的模型共事」的阶段,进展速度会「非常…- 1.9k
-
OpenAI 宣布下月退役 GPT‑4o,多款旧模型将同步下线
1 月 30 日消息,OpenAI 宣布将于 2026 年 2 月 13 日在 ChatGPT 中正式下线多款旧模型,包括 GPT‑4o、GPT‑4.1、GPT‑4.1 mini 以及 OpenAI o4‑mini,同时此前已公布的 GPT‑5 Instant 与 GPT‑5 Thinking 也将在同日退役。 GPT‑4o 曾在 GPT‑5 发布期间短暂下线,随后因部分 Plus …- 3.2k
-
小米突然发布新模型:媲美 DeepSeek-V3.2
12 月 17 日消息,刚刚,小米正式发布并开源新模型 MiMo-V2-Flash,先看表现: MiMo-V2-Flash 总参数 3090 亿,活跃参数 150 亿,采用专家混合架构 (MoE),性能还能和 DeepSeek-V3.2、Kimi-K2 这些头部开源模型掰掰手腕。 除去「开源」这一标签,MiMo-V2-Flash 真正的杀手锏在于架构设计上的激进创新,把推理速度拉到了 150 to…- 5.5k
-
腾讯混元 0.5B、1.8B、4B、7B 模型开源发布,消费级显卡即可运行
8 月 4 日消息,腾讯混元今日发布了四款开源的小尺寸模型,参数分别为 0.5B、1.8B、4B、7B,消费级显卡即可运行,适用于笔记本电脑、手机、智能座舱、智能家居等低功耗场景,且支持垂直领域低成本微调。 目前,四个模型均在 Github 和 Huggingface 等开源社区上线,Arm、高通、英特尔、联发科技等多个消费级终端芯片平台也都宣布支持部署。 新开源的 4 个模型属于融合推理模型,具…- 7.1k
-
Mistral AI 旗下 Codestral 模型获 25.01 更新:支持超 80 种编程语言、上下文长度提至 25.6 万个 Token
近日,Mistral AI 宣布为旗下 Codestral 编程模型推出 25.01 版本,官方强调相关版本主要在处理上下文长度和代码完成效率方面获得较大改进。 具体来说,Codestral 25.01 将模型支持的上下文长度提升 25.6 万个 Token,号称能够有效应对大型项目和复杂代码的生成需求,此外新版模型还支持超过 80 种编程语言,覆盖 Python、Java、JavaScript …- 5.8k
-
腾讯研发全球首个大熊猫模型:实时识别、统计、分析大熊猫行为并生成报告
腾讯 10 月 25 日宣布,为了帮助饲养员全方位观察大熊猫,腾讯、中国大熊猫保护研究中心、广东工业大学,联合打造了全球首个大熊猫行为智能识别模型及智慧系统。 该模型可以识别大熊猫进食、喝水、睡觉等日常行为,并自动生成日报、周报、月报等可视化数据报表。项目组通过优化 SlowFast 算法,大幅提升了系统在遮挡环境下的行为识别能力,目前室内遮挡场景下的大熊猫行为识别准确率提升到了 80% 以上。 …- 14.7k
❯
搜索
扫码打开当前页
返回顶部
幸运之星即将降临……
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠
-
¥優惠使用時效:无法使用使用時效:
之前
使用時效:预期有效优惠编号:×
没有优惠可用!






















