DeepRead
Search
Search
Dark mode
Light mode
Explorer
Popular Tags
#VLM
#agentic-RL
#gui-agent
#web-agent
#LLM
#VLA
#computer-use
#task-planning
#manipulation
#imitation-learning
Tag: embodied-reasoning
81 items with this tag.
Aug 20, 2026
Vision-Language Navigation Survey
VLN
navigation
embodied-reasoning
Aug 20, 2026
Vision-Language-Action Models
VLA
manipulation
embodied-reasoning
Aug 20, 2026
Embodied AI Survey
survey
VLA
manipulation
navigation
embodied-ai
robotics
embodied-reasoning
mobile-manipulation
Aug 20, 2026
In-Context VLA: Endowing Vision-Language-Action Models with Language via In-Context Post-Training and Agentic Tool Use
VLA
embodied-reasoning
manipulation
Aug 20, 2026
PhiZero: A World Model Built Around Physical Language
world-model
embodied-reasoning
cross-embodiment
Aug 20, 2026
Scaling Spatial Intelligence with Multimodal Foundation Models
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
SAGE: Scalable Agentic 3D Scene Generation for Embodied AI
3D-representation
embodied-reasoning
mobile-manipulation
Aug 20, 2026
Rethinking Intermediate Representation for VLM-based Robot Manipulation
manipulation
VLM
embodied-reasoning
Aug 20, 2026
KITE: Keyframe-Indexed Tokenized Evidence for VLM-Based Robot Failure Analysis
embodied-reasoning
manipulation
VLM
Aug 20, 2026
Counterfactual VLA: Self-Reflective Vision-Language-Action Model with Adaptive Reasoning
VLA
embodied-reasoning
task-planning
Aug 20, 2026
Gemini Robotics ER 1.6: Enhanced Embodied Reasoning
embodied-reasoning
spatial-reasoning
scene-understanding
Aug 20, 2026
Do Vision-Language Models Truly Perform Vision Reasoning? A Rigorous Study of the Modality Gap
VLM
LLM
embodied-reasoning
Aug 20, 2026
ABot-N1: Toward a General Visual Language Navigation Foundation Model
VLN
navigation
embodied-reasoning
Aug 20, 2026
ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory
task-planning
spatial-memory
embodied-reasoning
Aug 20, 2026
Chain-of-Thought Degrades Visual Spatial Reasoning Capabilities of Multimodal LLMs
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
Dreaming when Necessary: Advancing World Action Models with Adaptive Multi-Modal Reasoning
VLA
world-model
embodied-reasoning
task-planning
Aug 20, 2026
Does VLA Even Know the Basics? Measuring Commonsense and World Knowledge Retention in Vision-Language-Action Models
VLA
embodied-reasoning
VLM
Aug 20, 2026
World-Language-Action Model for Unified World Modeling, Language Reasoning, and Action Synthesis
VLA
world-model
embodied-reasoning
manipulation
Aug 20, 2026
WALL-WM: Carving World Action Modeling at the Event Joints
world-model
VLA
manipulation
embodied-reasoning
Aug 20, 2026
AT-VLA: Adaptive Tactile Injection for Enhanced Feedback Reaction in Vision-Language-Action Models
VLA
manipulation
embodied-reasoning
Aug 20, 2026
MIRAGE: Mobile Agents with Implicit Reasoning and Generative World Models
gui-agent
world-model
embodied-reasoning
Aug 20, 2026
ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models
VLA
embodied-reasoning
manipulation
Aug 20, 2026
VLM-Guided Group Preference Alignment for Diffusion-based Human Mesh Recovery
VLM
3D-representation
embodied-reasoning
Aug 20, 2026
Learning 3D Representations for Spatial Intelligence from Unposed Multi-View Images
3D-representation
spatial-reasoning
embodied-reasoning
Aug 20, 2026
Keep it SymPL: Symbolic Projective Layout for Allocentric Spatial Reasoning in Vision-Language Models
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
StateVLM: A State-Aware Vision-Language Model for Robotic Affordance Reasoning
VLM
scene-understanding
embodied-reasoning
Aug 20, 2026
HybridDriveVLA: Vision-Language-Action Model with Visual CoT reasoning and ToT Evaluation for Autonomous Driving
VLA
embodied-reasoning
world-model
Aug 20, 2026
TRM-VLA: Temporal-Aware Chain-of-Thought Reasoning and Memorization for Vision-Language-Action Models
VLA
embodied-reasoning
manipulation
Aug 20, 2026
SyncMos: Scalable Motion Synchronisation for Multi-Agent Scene Interaction
embodied-reasoning
task-planning
scene-understanding
Aug 20, 2026
HandVQA: Diagnosing and Improving Fine-Grained Spatial Reasoning about Hands in Vision-Language Models
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
SpatialScore: Towards Comprehensive Evaluation for Spatial Intelligence
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
SpaceTools: Tool-Augmented Spatial Reasoning via Double Interactive RL
spatial-reasoning
agentic-RL
embodied-reasoning
Aug 20, 2026
Geometrically-Constrained Agent for Spatial Reasoning
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
MolmoAct2: Action Reasoning Models for Real-world Deployment
VLA
embodied-reasoning
manipulation
Aug 20, 2026
GTR-Turbo: Merged Checkpoint is Secretly a Free Teacher for Agentic VLM Training
agentic-RL
VLM
embodied-reasoning
Aug 20, 2026
From Manuals to Actions: A Unified VLA Model for Chain-of-Thought Manual Generation and Robotic Manipulation
VLA
manipulation
embodied-reasoning
Aug 20, 2026
From Indoor to Open World: Revealing the Spatial Reasoning Gap in MLLMs
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
Exploring Spatial Intelligence from a Generative Perspective
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
Robix: A Unified Model for Robot Interaction, Reasoning and Planning
embodied-reasoning
task-planning
VLM
Aug 20, 2026
Experience Transfer for Multimodal LLM Agents in Minecraft Game
embodied-reasoning
task-planning
VLM
Aug 20, 2026
Pure Vision-Language-Action (VLA) Models: A Comprehensive Survey
VLA
manipulation
embodied-reasoning
Aug 20, 2026
OmniEVA: Embodied Versatile PlAnner via Task-Adaptive 3D-Grounded and Embodiment-aware Reasoning
embodied-reasoning
spatial-reasoning
task-planning
Aug 20, 2026
Revisiting Embodied Chain-of-Thought for Generalizable Robot Manipulation
VLA
embodied-reasoning
manipulation
Aug 20, 2026
How Good are Foundation Models in Step-by-Step Embodied Reasoning?
embodied-reasoning
VLM
spatial-reasoning
Aug 20, 2026
UniPlan: Vision-Language Task Planning for Mobile Manipulation with Unified PDDL Formulation
task-planning
mobile-manipulation
embodied-reasoning
Aug 20, 2026
RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation
VLA
manipulation
embodied-reasoning
Aug 20, 2026
Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation
embodied-reasoning
VLA
agentic-RL
manipulation
spatial-reasoning
Aug 20, 2026
One Agent to Guide Them All: Empowering MLLMs for Vision-and-Language Navigation via Explicit World Representation
VLN
navigation
embodied-reasoning
Aug 20, 2026
Thinker: A vision-language foundation model for embodied intelligence
VLM
embodied-reasoning
task-planning
Aug 20, 2026
A Survey on Vision-Language-Action Models: An Action Tokenization Perspective
VLA
embodied-reasoning
manipulation
Aug 20, 2026
CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding
VLA
manipulation
embodied-reasoning
LLM-subtasks
gripper-state-segments
Aug 20, 2026
SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
Visual Agentic AI for Spatial Reasoning with a Dynamic API
spatial-reasoning
VLM
embodied-reasoning
Aug 20, 2026
Visual Embodied Brain: Let Multimodal Large Language Models See, Think, and Control in Spaces
VLA
spatial-reasoning
embodied-reasoning
Aug 20, 2026
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
VLN
navigation
embodied-reasoning
Aug 20, 2026
Robot-R1: Reinforcement Learning for Enhanced Embodied Reasoning in Robotics
embodied-reasoning
agentic-RL
VLM
Aug 20, 2026
GFlowVLM: Enhancing Multi-step Reasoning in Vision-Language Models with Generative Flow Networks
VLM
agentic-RL
embodied-reasoning
Aug 20, 2026
Mind to Hand: Purposeful Robotic Control via Embodied Reasoning
VLA
embodied-reasoning
manipulation
Aug 20, 2026
CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models
VLA
embodied-reasoning
manipulation
Aug 20, 2026
Unified Embodied VLM Reasoning with Robotic Action via Autoregressive Discretized Pre-training
VLA
embodied-reasoning
flow-matching
Aug 20, 2026
RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control
VLA
manipulation
embodied-reasoning
Aug 20, 2026
Embodied-R: Collaborative Framework for Activating Embodied Spatial Reasoning in Foundation Models via Reinforcement Learning
spatial-reasoning
embodied-reasoning
video-LLM
agentic-RL
Aug 20, 2026
MiMo-Embodied: X-Embodied Foundation Model Technical Report
VLM
embodied-reasoning
spatial-reasoning
Aug 20, 2026
PaLM-E: An Embodied Multimodal Language Model
VLM
embodied-reasoning
task-planning
Aug 20, 2026
BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation
mobile-manipulation
embodied-reasoning
task-planning
Aug 20, 2026
Gemini Robotics: Bringing AI into the Physical World
VLA
manipulation
embodied-reasoning
Aug 20, 2026
WalkVLM: Aid Visually Impaired People Walking by Vision Language Model
VLM
navigation
embodied-reasoning
Aug 20, 2026
Vlaser: Vision-Language-Action Model with Synergistic Embodied Reasoning
VLA
embodied-reasoning
flow-matching
Aug 20, 2026
Cosmos-Reason1: From Physical Common Sense To Embodied Reasoning
embodied-reasoning
VLM
spatial-reasoning
Aug 20, 2026
Robotic Control via Embodied Chain-of-Thought Reasoning
VLA
embodied-reasoning
manipulation
Aug 20, 2026
RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete
embodied-reasoning
manipulation
task-planning
Aug 20, 2026
RAGNet: Large-scale Reasoning-based Affordance Segmentation Benchmark towards General Grasping
manipulation
embodied-reasoning
scene-understanding
Aug 20, 2026
RoboMamba: Efficient Vision-Language-Action Model for Robotic Reasoning and Manipulation
VLA
manipulation
embodied-reasoning
Aug 20, 2026
NaviTrace: Evaluating Embodied Navigation of Vision-Language Models
navigation
VLM
embodied-reasoning
Aug 20, 2026
Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models
VLA
instruction-following
task-planning
manipulation
embodied-reasoning
Aug 20, 2026
EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
embodied-reasoning
VLM
task-planning
Env
Tasks
Aug 20, 2026
Gemini Robotics 1.5: Pushing the Frontier of Generalist Robots with Advanced Embodied Reasoning, Thinking, and Motion Transfer
VLA
cross-embodiment
embodied-reasoning
Aug 20, 2026
EmbodiedBrain: Expanding Performance Boundaries of Task Planning for Embodied Intelligence
embodied-reasoning
task-planning
agentic-RL
Aug 20, 2026
CombatVLA: An Efficient Vision-Language-Action Model for Combat Tasks in 3D Action Role-Playing Games
VLA
embodied-reasoning
VLM
Aug 20, 2026
CoA-VLA: Improving Vision-Language-Action Models via Visual-Textual Chain-of-Affordance
VLA
embodied-reasoning
spatial-reasoning
Aug 20, 2026
CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving
VLA
scene-understanding
embodied-reasoning