ZHEJIANG UNIVERSITY PHD · EMBODIED AI

张涛

魔法原子具身模型负责人
算法 VP

Tao Zhang 在 VLA 世界模型访谈中
观看 VLA 世界模型访谈
当前角色 魔法原子具身模型负责人 · 算法 VP
核心方向 VLA · WAM · Embodied Foundation Models · Data Flywheel
00

PROFILE · 关于

从视觉算法到具身智能,
让前沿模型走进真实世界

博士毕业于浙江大学,先后在阿里巴巴、蔚来汽车从事视觉算法研发与自动驾驶工作。2016 年 1 月加入魔法原子,现任具身模型负责人、算法 VP。

负责公司具身智能大模型研发及相关技术体系建设,覆盖数据、平台、模型、评测和部署,持续推动机器人智能系统能力升级。

01

浙江大学博士

以系统化科研训练建立视觉与智能算法基础。

02

视觉算法研发

参与产业级视觉算法研发,积累算法工程化与规模化落地经验。

03

自动驾驶

面向复杂真实环境开展感知与自动驾驶技术研发。

04

具身模型负责人 · 算法 VP

统筹具身大模型研发、技术体系建设与近 60 人团队协同。

学术服务与人才认可

ICRA / ICLR / IROS 等会议审稿人

杭州市高层次人才 · 上海市高层次人才

行业交流

WAIC · GEIA ASIA · 焉知人形机器人大会

受邀发表主旨演讲与直播分享,并接受粉丝近千万的头部具身智能媒体个人专访,持续推动技术路线与产业认知升级。

01

SYSTEM · 能力体系

不只做模型,
也搭建让模型持续进化的系统

从组织与基础设施出发,打通数据生产、模型研发、评测部署和真实业务交付。

01

TEAM & ORGANIZATION

多学科团队与研发组织

从 0 到 1 搭建近 60 人 团队,形成跨平台、数据、模型、部署和评测的协同机制。

1,495筛选简历 367面试人次 ≈60团队规模
  • 具身平台前后端 · 遥操 · 数采 · 评测
  • 模型工程 · 量化部署 · 感知 · 大模型
  • VLA · WAM · Reinforcement Learning
02

DATA & INFRASTRUCTURE

数据闭环与基础设施

建设数据、算力、遥操和数采平台,让高质量机器人数据能够持续生产、治理和回流。

  • 数据平台 · 算力平台 · 基础/超视距遥操
  • 规模化数据增强 · 自动化处理流水线
  • 多类预标模型 · 质量评估与训练回流
03

MODELS & DELIVERY

基础模型与工程交付

围绕世界模型与 VLA+WM 形成模型研发主线,并把强化学习、记忆、后训练和推理优化带入完整交付链路。

  • 世界模型 · VLA+WM · 强化学习
  • Memory · 后训练 · 推理加速优化
  • 从模型训练、量化到真机部署与评测

DATA FLYWHEEL

每一次执行都沉淀数据资产,每一轮训练都释放新的端侧能力

具身智能平台统一编排

端侧 / 仿真执行

产生真实结果

01

数据自动回传

结果与 Episode

02

清洗与治理

筛选有效样本

03

标注与质检

自动化质量门禁

04

导出与训练

构建训练数据集

05

模型评测

验证能力提升

06

新模型下发

进入下一轮执行

07
失败样本优先回流 全程保留数据与模型血缘 训练完成后一键重新部署
持续迭代 执行 → 数据 → 模型 → 再执行
02

IMPACT & WORK · 成果与代表工作

以技术成果、真实交付
与代表工作共同验证进展

从榜单、真机,到开源项目与完整技术方案,集中呈现可验证的研究与产业成果。

03REAL ROBOT
94.6%

真机任务成功率

REAL ROBOT 真机任务验证

OPEN SOURCE & BENCHMARKS

开源成果与榜单验证

发布 Magic-W0、Toward Real-Time VLAs 等工作,并在 RoboDojo、MolmoSpaces 等具身模型榜单取得 Top 1。

RoboDojo-Sim · TOP 1 MolmoSpaces · TOP 1 Magic-W0 · 94.6% Real Robot 21.956 ms · Model Inference

REAL-WORLD DELIVERY

真机效果与展会呈现

整套能力支持上交会、WAIC、WRC、IFA、外滩大会等重要活动展示,并形成近千万元外售订单,验证技术系统的可交付性。

上交会WAICWRCIFA外滩大会

SELECTED WORK

从基础模型到真实机器人

实时 VLA 分布式推理与执行架构

REAL-TIME INFERENCE

Toward Real-Time VLAs

把标准 Flow 的 10 步采样压缩到非均匀两步,并以系统级评测连接模型速度与真实双臂执行。

Magic-Brain 视觉引导管线

EMBODIED AGENT

Magic-Brain

让上层 VLM 找目标、分割模型生成三色视觉协议、VLA 执行动作,把语义指令转化为可见引导。

Dual-Stream Memory 模型示意

MEMORY FOR VLA · ICRA 2027 UNDER REVIEW

Dual-Stream Memory

以时序记忆追踪执行状态,以空间检索找回历史视觉证据,让 VLA 处理依赖历史的操作任务。

03

PUBLICATIONS · 论文

研究论文与技术报告

* 表示通讯作者&项目负责人;Under Review 状态按 2026 年 10 月材料整理。

2026

TECHNICAL REPORT

Magic-W0: A Structured World–Action Foundation Model for Physical Intelligence

Xuhua Chen, Zhenhan Yin, Yuan Zhang, Tao Zhang*, et al.

arXiv
2026

TECHNICAL REPORT

Toward Real-Time VLAs: Stage-Aware Two-Step Flow Denoising and System-Level Evaluation

Di Wu, Rongtian Shen, Ping Liu, Yan Shen, Zhenhan Yin, Shun Zuo, Xuhua Chen, He Zheng, Lingfeng Zhang, Jianglin Zhang, Tao Zhang*

arXiv
2026

ICRA 2027 · UNDER REVIEW

RM-WAM: Reliable Memory-Augmented World Action Models for Long-Horizon Robot Manipulation

Cui Miao, Junhao Yu, Ping Liu, Ning Yang, Xuhua Chen, He Zheng, Xiaodong Wang, Tao Zhang*

2026

ICRA 2027 · UNDER REVIEW

Execution-Aligned Progressive Noise for Consistent Asynchronous Replanning in Generative Robot Policies

Di Wu, Ping Liu, Xuhua Chen, He Zheng, Lingfeng Zhang, Rongtian Shen, Tao Zhang*

arXiv
2026

ICRA 2027 · UNDER REVIEW

Conditional Trajectory Peaks: Single-Pass Multimodal Policies over Action Chunks

Di Wu, Rongtian Shen, Ping Liu, Xuhua Chen, He Zheng, Lingfeng Zhang, Tao Zhang*

arXiv
2026

ICRA 2027 · UNDER REVIEW

Dual-Stream Memory for Vision-Language-Action Policies

Yang Wang, Ping Liu, Ruiyu Wang, Xuhua Chen, Lingfeng Zhang, Tao Zhang*, Jiangning Zhang

项目主页
2026

ICRA 2027 · UNDER REVIEW

Atomic-WAM: Execution-Grounded Atomic-Motion Reasoning for World Action Models

Shijun Shi*, Zhe Liu, Zhi Hou, Yinan Chen, Tao Zhang, Kai Hu, Yong Liu, Jiangning Zhang

2026

ICLR 2027 · UNDER REVIEW

VLMs are Native Action Models: Unleashing the Manipulation Capabilities of VLMs with Explicit Action-Space Grounding

Jingkun Yi, Shujie Zhang, Zirui Zhou, Haoxiao Wang, Haiyang Sun, Yuhang Dong, Xudong Xu, Xing Shen, Tao Zhang, Yong Liu, Jiangning Zhang

2026

ICLR 2027 · UNDER REVIEW

TARSphere: A Robot-Oriented Full-Stack Framework for Long-Horizon Embodied Agents in Evolving Physical and Social Environments

Yicheng Xu, Zhikai Xu, Ziyuan Chen, Yuhang Dong, Tao Zhang, Zhucun Xue, Yong Liu, Jiangning Zhang

OpenReview
2026

AAAI 2027 · UNDER REVIEW

Rubrics4VLA: Shaping Safer and More Reliable VLA Trajectory with Evolving Rubrics

Qiuting Yu, Miao Pan, Jiarun Li, Kaili Liu, Sicheng He, Tao Zhang, Jintao Chen, Yongliang Shen, Xuhong Zhang, Wenqi Zhang

2026

AAAI 2027 · UNDER REVIEW

Entity-Factorized Spatial Evidence Compression for Embodied Question Answering

Bo-Cheng Hu, Xinyuan Liu, Kewei Wei, Tao Zhang, Yue Zhao, Lingfeng Zhang, Hongwei Wang, Gaoang Wang

04

DEMOS · 演示

让方法回到真实任务

代表性真机演示与 WAIC、WRC、IFA 等展演。

CONTACT · 合作交流

关于具身智能、机器人基础模型
与研究协作,欢迎交流