DeepMind用语言游戏让AI学AlphaGo自我博弈,突破数据限制

DeepMind引入“苏格拉底式学习”,通过语言游戏实现智能体自我博弈,打破数据限制;语言游戏机制为智能体提供了无限的数据生成与自我完善途径,同时提供反馈以改进技能;该方法支持递归自我改造,使智能体不仅能从环境中学习,还能调整自身结构,推进AGI的发展。

搜索