欢迎回来

登录 EAKE AI,继续您的智能之旅

忘记密码?
还没有账号?立即注册

TerraZero:面向零演示自博弈的大规模程序化驾驶仿真

2026-07-16 · AI 论文

摘要(译文):训练鲁棒的自动驾驶智能体需要足够快(支撑大规模强化学习)、足够真实(锚定真实地图结构)、足够多样(覆盖安全关键长尾)的仿真器。TerraZero 是程序化驾驶仿真器+自博弈训练栈:可配置 C 引擎在 CPU 跑仿真、GPU 跑策略推理,零拷贝路径下单服务器 GPU 达 130 万 agent 步/秒,远快于现有对象级仿真器,同时保留异构智能体、多动力学模型与完整交规执行。仅用强化学习从零训练,无人类演示。策略跨城市零样本泛化,登顶 InterPlan 长尾基准。

作者:Zhouchonghao Wu 等|发布:2026-07-14|原文:arxiv.org/abs/2607.13028

评论区

发表评论