TrAct的核心创新是什么?
TrAct提出用视觉轨迹作为机器人动作与世界模型之间的统一翻译层,让机器人动作和视觉预测通过轨迹实现对齐,从而提升世界模型预演的准确性和跨本体泛化能力。

作者丨 幸丽娟 编辑丨岑 峰  
本文介绍李飞飞、吴佳俊团队提出的TrAct框架,以视觉轨迹作为中间翻译层,统一机器人动作控制与世界模型预测。实验显示,TrAct在仿真和真机任务中显著提升成功率,尤其在跨本体、跨任务泛化上表现突出,并降低了对机器人动作标注数据的需求。
TrAct提出用视觉轨迹作为机器人动作与世界模型之间的统一翻译层,让机器人动作和视觉预测通过轨迹实现对齐,从而提升世界模型预演的准确性和跨本体泛化能力。
由于人类视频没有机器人动作标注,传统VLA难以使用。TrAct只需视觉轨迹作为监督信号,因此可以混合DROID机器人数据与EgoDex人类视频进行预训练,扩大了训练数据规模。
从担心AI失控 到AI造福人类:比尔盖茨怎么想Meta新研究:字节模型蒸馏后,天花板破了
当AI能解千禧难题,再次证明答案不再是门槛英伟达带动AI数据中心大变革,中国厂商不想当边缘人
穿透查询怎样升级为穿透管控?7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开
早报|iOS27正式推送/比亚迪高管:燃油车在中国没有未来/iPhone 18 Pro渠道降价900元,苹果称不干预
号称人类造的最后一个 AI 要来了,刷屏全网的 RSI 是什么被英伟达点名的杭州团队,补上了AI for Science的「最后一公里」
清晰法案有概率通过?市场可能并未定价
现在参与以太坊原生质押为什么要先排队一个月?
实测豆包新模型2.1-pro,这次审美和长时间Agent任务都追上第一档了
华为坤灵升级“4+10+N”场景化方案,发布“经纬计划”和50个样板点Build a serverless PII redaction pipeline with Amazon Bedrock Data Automation
做了两年AI落地,我总结了这7点思考B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首
HTTP 新增 QUERY 方法:有人叫好,也有人质疑“这不就是 GET?”圆桌:中国之光成为新共识| 36氪 2026产业未来大会Windows 11 的 9 月例行安全更新再次引发了大量故障前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了
字节6年,如何一步步走上带20人团队的leader
百度做了一堆AI产品,却没有一个能代表百度?
AI风口之下,明星们又想“挤上”牌桌了
字节将发布独立智能网盘“ADrive”,腾讯网盘先已布局,网盘AI大战打响
从 270 分钟到 18 分钟:B 端产品经理如何主导一个 AI 达人撮合系统企业案例分享:玉盘量智-离子阱量子计算芯片化集成工程实践 | 36氪 2026产业未来大会高性能电动船艇动力系统公司获近亿A轮融资,海外收入增长450%丨36氪首发SDL3 移植到 HarmonyOS / OpenHarmony云岫资本合伙人宋旭文:量子计算:工程化与产业化并进,拐点将至 | 36氪 2026产业未来大会
AMC 炮轰 Robinhood:股票归谁做主?