-
面壁智能开源 MiniCPM5-2B,AA v4.2 评测位列 4B 以下开源模型第一
9 月 9 日消息,面壁智能发布并开源 MiniCPM5-2B。这是一款 26 亿参数的稠密模型,Artificial Analysis 的 Intelligence Index v4.2 得分为 15,在该机构收录的 40 亿参数以下开源权重模型中排名第一。 MiniCPM5-2B 支持 13.1 万 token 上下文,采用 Apache 2.0 许可证,可部署在手机、平板和边缘设备上。模型卡…- 1.9k
-
阿里千问开源 Qwen-Drive-1.0-4B:首个面向自动驾驶的视觉语言基础模型
9 月 6 日消息,阿里千问本周开源了 Qwen-Drive-1.0-4B,这是一款基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型。 官方表示,Qwen-Drive-1.0 是首个面向自动驾驶的视觉语言基础模型,在预训练阶段统一了 3D 感知与视觉问答,并进一步扩展至运动规划,同时完全保留了预训练 VLM 的原始架构。 模型采用分阶段训练方案,将驾驶监督与通用视觉语言数据结合,在获得驾驶特…- 3.6k
-
Deep Face Cam:本地运行的开源人脸替换软件,支持图片、视频和实时摄像头
Deep Face Cam是一款本地人脸交换桌面应用,兼容macOS和Windows。支持图像、视频及实时摄像头换脸,所有处理均在设备本地完成,保障数据隐私。以开源、可审计的方式提供透明可控的使用体验。 Deep Face Cam功能 本地数据处理:所有换脸操作在设备本地完成,媒体文件不需上传,确保数据隐私安全。 开源可审计:完整源代码公开,遵循AGPL-3.0协议,可自由检查、构建和修改。 模型…- 4.3k
-
端侧唯一百万 Token 上下文模型开源:科大讯飞词元星火 X2.5-4B&1.7B 正式发布
9 月 1 日消息,科大讯飞旗下词元星火今日宣布推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。 据介绍,两款模型原生支持最长 100 万 Token 上下文窗口,是目前端侧模型中唯一支持该量级上下文的产品。 两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化。基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进…- 4.5k
-
腾讯发布并开源 Hy4 preview,上下文长度达 1M
8 月 29 日消息,腾讯混元发布并开源新一代旗舰模型 Hy4 preview。模型采用混合专家架构,总参数为 770B、激活参数为 49B,上下文长度达到 1M,重点提升软件工程、游戏开发、办公和科学研究等生产力任务。 腾讯组织 163 名内部专家完成 203 项工程任务盲测,Hy4 preview 平均得分 2.99 / 4.00;官方还展示了模型通过 MCP 操作 Unreal 5 制作射击…- 4.9k
-
Ox Alpha 现身:智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20
8 月 27 日消息,智谱昨晚上线并开源 GLM-5.3-Flash (320B-A18B),这是 GLM-5 系列的首个原生多模态模型。该模型总参数量为 320B(3200 亿),激活参数仅 18B(180 亿)。 智谱在正式发布前,以匿名模型 Ox-Alpha(中文社区称作牛来)在 OpenCode 和 OpenRouter 上进行了大规模测试。Ox-Alpha 迅速成为当周最受欢迎的模型,创…- 5.7k
-
原生支持 4K 图像输出,商汤开源 8B 参数量多模态大模型 SenseNova U1.5 Lite
8 月 21 日消息,商汤科技今日宣布开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite。 据介绍,SenseNova U1.5 Lite 原生支持 3-4k 上下文长度,能够同时处理主体、数量、空间关系、文字、布局、风格等多重约束,提升复杂视觉任务的执行稳定性。 此外,SenseNova U1.5 Lite 还有以下特点: 更高质量的视觉生成:改善整体构图、色彩、材质、光影…- 11k
-
SpeakoFlow:免费开源语音转文字工具,支持听写、AI生成、翻译和润色
SpeakoFlow 是一款免费开源的跨平台语音转文字工具。它让用户在任何应用中通过语音完成听写、翻译、润色和 AI 助手操作,速度可达每分钟 150 字以上。默认本地处理、开源可定制,是追求效率与隐私的理想选择。 SpeakoFlow 功能 任意应用听写:按下按键并说话,文字实时输入到任意应用的邮件、编辑器或聊天框;支持每分钟 150 字以上,比打字快 3 倍,全程免手操作。 本地隐私保护:语音…- 15.7k
-
Dario Amodei:从未主张禁止开源权重模型
7 月 29 日消息,据 TechCrunch 报道,Anthropic CEO Dario Amodei 于当地时间 27 日发布博文,就外界关于 Anthropic 支持禁止开源权重模型的传言作出回应。 Amodei 在博文中明确表示,「Anthropic 从未主张禁止开源权重模型」,并强调不具备危险能力的开源权重模型「是一种公共品」,能为企业、开发者和研究人员带来价值。 他同时指出,即便是来…- 9.6k
-
Anthropic 迟迟不签公开信成“众矢之的”,CEO Dario Amodei 解释称公司从未主张禁止开源 AI模型
7 月 28 日消息,近期关于 AI 是否要开放权重(Open-weight)的话题成为行业讨论焦点。 上周五,包括英伟达、Meta 和微软在内的 20 多家公司共同签署了题为《开放权重与美国 AI 领导力》(Open Weights and American AI Leadership)的公开信,支持开放权重 AI。 到了周末,OpenAI、谷歌和 SpaceX 也签署了这封信。Anthropi…- 7.8k
-
吴恩达开源桌面 AI 智能体 OpenWorker,已获 3.7k Star
7 月 26 日消息,吴恩达(Andrew Ng)(7 月 24 日)在领英(LinkedIn)发布动态,宣布推出开源 AI 智能体 OpenWorker,不仅满足聊天交互,还能高效完成用户交代的任务。 在运行平台上,适用于苹果 macOS 的 OpenWorker 已经上线,Github 页面显示 Windows 版已支持运行,但尚未签名。 OpenWorker 基于 Ng 的 aisuite …- 16k
-
黄仁勋:美国无需害怕中国开源 AI 模型,应警惕国内「封禁」呼声
7 月 23 日消息,英伟达 CEO 黄仁勋接受 Axios 采访时表示,美国无需害怕中国开源 AI模型,更应警惕要求封禁这些模型的声音。他称中国模型「非常出色」,优秀的开源模型应当被使用,美国企业也应被允许采用这些模型。 这番表态出现在月之暗面发布 Kimi K3、美国政界重新讨论中国开放模型风险之后。OpenAI 与 Anthropic 指责中国竞争者通过蒸馏获取其模型能力,并提醒华盛顿关注开…- 9.3k
-
港大开源 AI 智能体导师 DeepTutor v1.5
7 月 8 日消息,港大数据智能实验室(HKUDS)近日发布了开源 AI 智能体导师 DeepTutor v1.5,该版本在文档解析引擎、RAG 摄取管线及 Python 3.14+ 兼容性上完成了多项升级。 DeepTutor 的核心设计思路是将聊天、测验、研究、可视化、解题与学习路径规划六个教学环节并入同一个智能体运行闭环,学生在不同任务间切换时无需中断后台引擎,学习上下文与多层级记忆会自动同…- 8k
-
葡萄牙发布首个欧洲葡语开源大语言模型 AMALIA
7 月 2 日消息,葡萄牙政府当地时间本月 1 日宣布,首个基于欧洲葡萄牙语开发的开源大语言模型 AMALIA 正式发布。 1AI了解到作为葡萄牙的国家战略项目,AMALIA 模型由来自葡萄牙多家学术机构的 60 余位研究人员历时 18 个月开发而成,先期投资 550 万欧元,利用了 Deucalion、MareNostrum 5 等算力基础设施。 其开发的首个阶段利用约 4 万亿个葡语单词训练出…- 5.9k
-
网易有道开源 Confucius4-TTS,3 秒音频即可克隆音色
6 月 25 日消息,网易有道昨日宣布推出「子曰 4.0」TTS 语音合成引擎 Confucius4-TTS。官方称,这是业内首个支持 14 种语言跨语种无口音、且无需参考文本即可完成语音克隆的开源模型。 Confucius4-TTS 支持零样本语音克隆。用户提供 3 秒音频素材后,无需参考文本和前期训练,模型即可完成音色克隆;官方称克隆音色与原声相似度超过 85%,克隆任务准确度达…- 6.4k
-
京东开源实时视频视觉语言交互模型 JoyAI-VL-Interaction
6 月 23 日消息,昨天,京东宣布开源实时视频视觉语言交互模型 JoyAI-VL-Interaction。官方称,这是全球首个全栈开源的 interaction 模型和系统,并获得 vLLM-Omni 的 day-0 原生支持。 JoyAI-VL-Interaction 支持语音输入输出、可视化界面、长期记忆、后台模型接口和 vLLM 部署方案。京东称,开发者可替换 ASR、TTS、后台模型、外…- 6.4k
-
蔡崇信:阿里全面投入 AI,开源的主要推动力量来自中国企业
6 月 19 日消息,昨日,阿里巴巴集团主席蔡崇信在欧洲科技峰会 VivaTech 2026 上,阐述了阿里巴巴全栈 AI 的发展战略。 蔡崇信在一场对谈中提出,AI 的总潜在市场规模(TAM)应当对标人类生产力本身。“AI 正在创造等同于人类智能和人类生产力的价值单元。放眼全球,超过 100 万亿美元的 GDP 中,至少有一半 ——50 万亿美元,是关于人类生产力和人类智能的,这就是 AI 的总…- 9.1k
-
智谱开源 GLM-5.2,主打 1M 上下文和长程 Coding 任务
6 月 18 日消息,智谱昨日宣布上线并开源 GLM-5.2,新模型专注 Coding 与长程任务。 智谱称,GLM-5.2 具备 1M 无损上下文,面向自动化研究、性能优化、复杂系统工程和深度调试等 Coding Agent 场景训练; 在 FrontierSWE 长程任务评测中,GLM-5.2 Max 10 Hrs 得分 72.6%,低于 Claude Opus 4.8 Max 20 Hrs …- 7.4k
-
MiniMax M3 模型正式开源:原生多模态、百万上下文
6 月 16 日消息,MiniMax 昨日宣布,已正式开源旗下多模态旗舰模型 MiniMax M3 的模型权重,并同步公开了 MSA(MiniMax Sparse Attention)技术论文。 MiniMax M3 总参数量 428B,激活参数 23B,官方将其定位为首个从训练第一步(Step 0)起便引入多模态混合训练的开源大模型。 训练阶段大量融入了文本、图像及多模态交错数据,以期在预训练阶…- 10.9k
-
巴西模型 Rio 3.5 引发「缝合」Qwen 质疑
6 月 16 日消息,近日,一个由巴西里约热内卢市政府旗下 IT 公司开源的 Rio 3.5 Open 397B 模型在 AI 社区引发讨论。模型页面显示,它以 MIT 协议开放,总参数约 397B,单 token 激活约 17B,并支持较长上下文。 然而,模型发布不到 24 小时,开源 AI 团队 Nex-AGI 即在 X 平台发声,指出 Rio 3.5 实质上是通过模型合并(Model Mer…- 5.7k
-
网易有道“子曰 4”多模态模型、语音合成模型全量开源
5 月 23 日消息,网易有道昨日宣布,决定将“子曰”大模型 4.0 的核心双引擎 ——“多模态模型”与“语音合成(TTS)模型”,正式面向全球全量开源。开发者可以免费下载、部署,并基于此进行二次开发。 此次开源的“子曰 4”多模态模型(27B 参数规模)面向教育场景,支持视觉输入的数理能力,做到了行业顶尖水平(SOTA)。 在同等参数的规模模型中,处理带图表的高难度视觉数理问题。 纯文本的中文数…- 7.2k
-
面壁智能开源 MiniCPM-V 4.6
5 月 14日消息,昨日,面壁智能正式发布并开源 1.3B 端侧多模态大模型 MiniCPM-V 4.6,提供 Instruct 与 Thinking 两个版本。 Instruct 版本:面向通用图文理解、STEM 数理推理、文档 OCR、视频时序理解及目标定位等任务,超越 Qwen3.5-0.8B 与 Gemma4-E2B-it; Thinking 版本:面向多图像关联推理、幻觉抑制等高阶任务,…- 9.5k
-
小米开源 OmniVoice 多语言语音克隆 TTS
5 月 8 日消息,昨日,小米 AI 实验室发布并开源多语言语音克隆 TTS 模型 OmniVoice,团队基于 50 个开源数据集构建了 58 万小时的训练数据,覆盖 646 种语种。 中英文合成质量优于主流同类模型,推理速度达到 40 倍实时; 在 24 种语言上,其语音相似度和可懂度超越多款商用系统; 在 102 种语言上,可懂度逼近真实语音,即便是训练数据不足 10 小时的小语种,也能正常…- 7.8k
-
未来三年小米 AI 投入超 600 亿元:MiMo-V2.5 将开源,几乎适配国内所有芯片
4 月 27 日消息,据博主 @粮厂研究员Will 分享,在今天的小米投资者日上,小米集团副总裁、技术委员会主席屈恒发表主题为“Agent 范式重塑小米与人车家全生态”的演讲。 博主总结核心观点如下: Agent 将范式重塑小米与「人车家全生态」 ,未来三年 AI 投入超过 600 亿元,这个数字只是保底,会更高; 小米拥有 AI 时代的全栈能力:基建层、数据层、模型层、框架层和生态层;一方面重塑…- 9.1k
❯
搜索
扫码打开当前页
返回顶部
幸运之星即将降临……
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠
-
¥優惠使用時效:无法使用使用時效:
之前
使用時效:预期有效优惠编号:×
没有优惠可用!























