高德宣布ABot-World-0完成新一轮技术升级 实现24小时稳定推理
高德宣布ABot-World-0完成新一轮技术升级 实现24小时稳定推理!8月3日,阿里巴巴集团旗下高德宣布其自研的通用交互式世界模型ABot-World-0完成新一轮技术升级。该模型在单张消费级GPU上实现连续24小时超长时稳定推理,推理过程中画质、物理一致性与交互响应无明显衰减。这是全球首个将交互式世界模型连续推理时长从“分钟级”提升至“天级”的模型。
当前世界模型进行长时间连续生成时,容易出现画面崩坏、物体形变漂移、物理规则失真以及交互指令响应错位等问题。这些问题主要是由于自回归视频生成过程中的误差累积:模型持续依赖此前生成结果,微小预测偏差可能随着生成序列延长不断累积。
为了解决这一问题,ABot-World-0提出LongForcing长程训练范式,将长时间尺度的稳定性以及场景、动态的开放性纳入模型学习目标。这种方法引入具备更长时域建模能力的教师模型,并在训练过程中持续将模型自身生成结果作为后续输入,将训练目标从短片段的局部生成质量扩展至多轮自回归后的长程生成分布,从而缓解长时间推理中的误差累积和分布漂移问题。
基于LongForcing,ABot-World-0无需持续调整Prompt,也可以伴随用户移动和交互不断拓展新的空间、物体及事件,使生成内容从固定的视频序列进一步转变为能够持续演化和响应用户操作的世界状态。
目前,ABot-World-0已经开源,并支持在单张消费级显卡上进行本地部署。其超长推理相关论文上线Hugging Face后,登顶平台论文日榜和周榜第一。
该技术已应用于高德推出的通用世界模型工坊ABot-World Studio。用户输入一段文字或一张图片,即可生成可实时交互的AI世界,并支持将生成结果以视频和3DGS文件形式导出。
最新结果显示,ABot-World-0已能够连续进行24小时交互式推理。长时序稳定性的突破有望进一步拓展世界模型在持续交互、虚拟环境以及空间智能等场景中的应用边界。
所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。
举报邮箱:1002263188@qq.com