o3并非独门秘技,谷歌曾发布Monkey,来自于无限猴子定理

谷歌团队通过重复采样扩展推理计算,提升小模型性能,成本更低,性能可超越大型模型;重复采样提高覆盖率和精确度,适用于多种数学和编程任务,成本效益显著;这套方法重复采样简单,适合编码和数学任务,但在结构化推理任务中的表现不如o3。

搜索