通义千问:推出Qwen2.5-Turbo开源AI模型

阿里通义千问发布博文推出Qwen2.5-Turbo开源AI模型。该模型经数月优化打磨,将上下文长度从12.8万个扩展至100万个tokens,可容纳大量文本内容。它在1M-token的Passkey检索任务中准确率达100%,RULER长文本评估得分超GPT-4和GLM4-9B-1M。团队通过整合稀疏注意力机制,使处理100万tokens的时间大幅缩短,速度提升4.3倍,且处理成本为每百万个tokens 0.3元,在经济性上更具竞争力。但团队也意识到模型在真实场景长序列任务中表现可能不稳定,推理成本需进一步优化,承诺会继续优化相关方面并探索更强大的长上下文模型。

官网:https://qwen2.org/qwen2-5-turbo/

DEMO地址:https://huggingface.co/spaces/Qwen/Qwen2.5-Turbo-1M-Demo

搜索