semianalysis分析师:Claude 3.5超大杯内部自留用于训练

Claude 3.5 Opus未失败,而是用于内部数据合成和强化学习奖励建模;该模型的作用是通过合成数据提升Claude 3.5 Sonnet的性能,未公开发布因为用于内部训练更具价值;大型AI实验室依然坚持Scaling Law,但AI开发依赖新范式,包括合成数据、强化学习与搜索推理等技术。

搜索