9 月 4 日消息,据 AI 前线援引知情人士消息,原 DeepSeek 研究员魏浩然近日带队转入百度基础模型研发部,出任文心大模型多模态算法负责人。他今年上半年加入百度,此前主要负责 OCR 等多模态方向的研发。

魏浩然是《DeepSeek-OCR: Contexts Optical Compression》与《DeepSeek-OCR 2: Visual Causal Flow》的第一作者。两篇论文分别于去年 10 月和今年 1 月发布,前者使用视觉表征压缩长文本信息,后者进一步让编码器按图像语义动态重排视觉 token。
AI 前线称,魏浩然加入百度后参与了 Unlimited-OCR 模型的研发。百度在 6 月公开该模型,官方项目将其定位为长文档单次解析方案。