OpenAI Day 12,下一代推理模型o3,AGI评测基准达87.5%

OpenAI发布o3模型,数学、编程等多项测试超越前代o1,刷新多项AI记录;o3-mini具备三种推理模式,低成本高效表现优秀,尤其在代码生成和数学测试中表现出色;虽然o3在通用性和性能上接近人类水平,但其高成本和简单任务上的局限性表明仍未达到AGI标准。

搜索