魏大峰 Dafeng Wei

研究员 · 智元机器人 (AgiBot)

我的研究方向是视觉语言模型(VLM)视觉语言动作模型(VLA)——让机器人理解世界,并在真实世界中行动。

此前我在理想汽车智能驾驶团队任高级算法工程师,是 DriveVLM 的核心贡献者——行业首创、首个大规模量产落地的"大小脑"双系统自动驾驶方案;并搭建了服务数据闭环的多模态检索系统。更早在字节跳动任算法工程师。硕士毕业于上海交通大学,师从卢宏涛教授

魏大峰的照片

动态

论文

* 表示共同一作。完整列表见 Google 学术

2026

τ0-VLA 框架图

τ0-VLA: a Hierarchical Robot Foundation Model with World-Model-Guided Test-Time Computation

Shanghai Innovation Institute & AgiBot(作者按姓氏字母序,含 Dafeng Wei)

技术报告, 2026

分层机器人基础模型:高层规划器以世界模型引导的束搜索在子任务空间做测试时计算,配合可纠错执行记忆,驱动跨本体 VLA——将最长约 12 分钟的真机长程任务成功率从 27.5% 提升到 45.0%。

核心贡献者——从零搭建 AgibotVLA 训练框架,完成初版 VLA 预训练,并端到端完成高层 VLM 规划器的任务定义、数据生产、模型训练与评测。

2025

GenieReasoner 概览图

Unified Embodied VLM Reasoning with Robotic Action via Autoregressive Discretized Pre-training

Yi Liu, Sukai Wang, Dafeng Wei, Xiaowei Cai, Linqing Zhong, Jiange Yang, Guanghui Ren, Jinyu Zhang, Maoqing Yao, Chuankang Li, Xindong He, Liliang Chen, Jianlan Luo

arXiv 预印本, 2025

GenieReasoner 联合优化具身推理与动作执行,提出 ERIQ 推理基准(6000+ 问答对)与流匹配动作分词器 FACT。

AgiBot World Colosseo 概览图

AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems

AgiBot-World-Contributors(含 Dafeng Wei)

IROS 2025 🏆 最佳论文奖入围 · IEEE T-RO 2026

开放平台:5 大场景 217 项任务、超 100 万条真机轨迹,并提出基于隐式动作表征的通用策略 GO-1。

BEV-TSR 概览图

BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous Driving

Tao Tang*, Dafeng Wei*, Zhengyu Jia, Tian Gao, Changwei Cai, Chengkai Hou, Peng Jia, Kun Zhan, Haiyang Sun, Jingchen Fan, Yixing Zhao, Fu Liu, Xiaodan Liang, Xianpeng Lang, Yang Wang

AAAI 2025

在 BEV 特征空间用自由文本检索复杂驾驶场景。

2022

Efficient SlowFast 缩略图

Efficient Dual Attention SlowFast Networks for Video Action Recognition

Dafeng Wei, Ye Tian, Liqing Wei, Hong Zhong, Siqian Chen, Shiliang Pu, Hongtao Lu

Computer Vision and Image Understanding (CVIU), 2022

轻量级双流视频动作识别网络,提出跨模态双注意力融合模块 CMDA。

2021

主动学习框架图

Towards Dynamic and Scalable Active Learning with Neural Architecture Adaption for Object Detection

Fuhui Tang*, Dafeng Wei*, Chenhan Jiang, Hang Xu, Andi Zhang, Wei Zhang, Hongtao Lu, Chunjing Xu

BMVC 2021

随标注池扩增动态调整网络结构的目标检测主动学习,已在华为亿级自动驾驶数据上落地。

2020

TableCell 数据集概览(来自 ICPR 海报)

Image-based Table Cell Detection: a Novel Table Structure Decomposition Method with New Dataset

Dafeng Wei, Hongtao Lu, Yi Zhou, Kai Chen

ICPR 2020

以目标检测方式检测表格单元格并恢复表格结构,开源含 17 万单元格标注的 TableCell 数据集。

工作经历

实习经历

教育经历

其他