↓Skip to main content

Github

LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion ↗ ↖
Jiangran Lyu*
, 
Kai Liu*
, 
Xuheng Zhang*
, 
Haoran Liao
, 
Yusen Feng
, 
Wenxuan Zhu
, 
Tingrui Shen
, 
Jiayi Chen
, 
Jiazhao Zhang
, 
Yifei Dong
, 
Wenbo Cui
, 
Senmao Qi
, 
Shuo Wang
, 
Yixin Zheng
, 
Mi Yan
, 
Xuesong Shi
, 
Haoran Li
, 
Dongbin Zhao
, 
Ming-Yu Liu
, 
Zhizheng Zhang
, 
Li Yi
, 
Yizhou Wang
, 
He Wang
Arxiv Github RSS 在投
Recent robot foundation models largely rely on large-scale behavior cloning, which imitates expert …
Neural Force Field: Few shot learning of generalized physical reasoning ↗ ↖
Shiqian Li
, 
Ruihong Shen
, 
Yaoyu Tao
, 
Chi Zhang
, 
Yixin Zhu
Arxiv Github ICLR
We present NFF, a modeling framework built on NODE that learns interpretable force field …
MCPMark: A Benchmark for Stress-Testing Realistic and Comprehensive MCP Use ↗ ↖
Zijian Wu
, 
Xiangyan Liu
, 
Xinyuan Zhang
, 
Lingjun Chen
, 
Fanqing Meng
, 
Lingxiao Du
, 
Yiran Zhao
, 
Fanshi Zhang
, 
Yaoqi Ye
, 
Jiawei Wang
, 
Zirui Wang
, 
Jinjie Ni
, 
Yufan Yang
, 
Arvin Xu
, 
Michael Qizhe Shieh
Arxiv Github ICLR 2026
The MCP standardizes how LLMs interact with external systems, forming the foundation for general …
Learning Physics-Grounded 4D Dynamics with Neural Gaussian Force Fields ↗ ↖
Shiqian Li
, 
Ruihong Shen
, 
Junfeng Ni
, 
Chang Pan
, 
Chi Zhang
, 
Yixin Zhu
Arxiv Github ICLR
Predicting physical dynamics from visual data remains a fundamental challenge in AI, as it requires …
Generalized Threshold Optimization with Harmony Multi-Threshold Neurons for Accurate ANN-to-SNN Conversion ↗ ↖
Wenhan Zhang
, 
Zihan Huang
, 
Tong Bu
, 
Tiejun Huang
, 
Zhaofei Yu
Github AAAI-26 CCF A
Spiking Neural Networks (SNNs) are a promising paradigm designed to emulate the brain’s energy …
ProgressGym: Alignment with a Millennium of Moral Progress
Tianyi Qiu*†
, 
Yang Zhang*
, 
Xuchuan Huang
, 
Jasmine Xinze Li
, 
Jiaming Ji
, 
Yaodong Yang
Github NeurIPS2024
Benchmarking Open-instruction 6-DoF Object Rearrangement and A VLM-based Approach ↗ ↖
Yufei Ding*
, 
Haoran Geng*
, 
Chaoyi Xu
, 
Xiaomeng Fang
, 
Jiazhao Zhang
, 
Songlin Wei
, 
Qiyu Dai
, 
Zhizheng Zhang
, 
He Wang†
Github IROS2024
MacDiff: Unified Skeleton Modeling with Masked Conditional Diffusion ↗ ↖
Lehong Wu
, 
Lilang Lin
, 
Jiahang Zhang
, 
Yiyang Ma
, 
Jiaying Liu†
Github ECCV2024
Exploring Conditional Multi-Modal Prompts for Zero-shot HOI Detection
Ting Lei
, 
Shaofeng Yin
, 
Yuxin Peng
, 
Yang Liu†
Github ECCV2024
Language Models Represent Beliefs of Self and Others
Wentao Zhu
, 
Zhining Zhang
, 
Yizhou Wang
Github ICML2024
Scaling up dynamic human-scene interaction modeling ↗ ↖
Nan Jiang
, 
Zhiyuan Zhang
, 
Hongjie Li
, 
Xiaoxuan Ma
, 
Zan Wang
, 
Yixin Chen
, 
Tengyu Liu
, 
Yixin Zhu†
, 
Siyuan Huang†
Arxiv Github CVPR2024
Exploring the Potential of Large Foundation Models for Open-Vocabulary HOI Detection
Ting Lei
, 
Shaofeng Yin
, 
Yang Liu†
Github CVPR2024
Diff-BGM: A Diffusion Model for Video Background Music Generation
Sizhe Li
, 
Yiming Qin
, 
Minghang Zheng
, 
Xin Jin
, 
Yang Liu†
Github CVPR2024