DeepRead
Search
Search
Dark mode
Light mode
Explorer
Popular Tags
#VLM
#agentic-RL
#gui-agent
#web-agent
#LLM
#VLA
#computer-use
#task-planning
#manipulation
#imitation-learning
Tag: world-model
101 items with this tag.
Aug 20, 2026
World Model Survey
world-model
agent
simulation
planning
MBRL
VLA
diffusion-policy
cross-embodiment
Aug 20, 2026
Quo Vadis, World Modeling? Towards Interactive World Proxies for Continually Improving Agents
world-model
agentic-RL
task-planning
Aug 20, 2026
WorldExam: Benchmarking World Models from Apparent Appearance to Inherent Reactivity
world-model
spatial-reasoning
VLM
Aug 20, 2026
MobileWAM: Bridging World Action Models to Mobile Manipulation with Chain-of-Foresight
world-model
mobile-manipulation
VLA
Aug 20, 2026
EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning
agentic-RL
world-model
Aug 20, 2026
DreamGuard: Efficient Runtime Guardrail for LLM Agents via Risk-Aware World Model
world-model
LLM
Aug 20, 2026
RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation
world-model
manipulation
imitation-learning
Aug 20, 2026
RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation
world-model
manipulation
flow-matching
Aug 20, 2026
AppDeltaWorld: Transition-Grounded Delta Code World Model for Mobile GUI Agents
gui-agent
world-model
agentic-RL
Aug 20, 2026
QQWorld: Quantile-Quantile Matching for World Model Regularization
world-model
RL
Aug 20, 2026
From Pixels to States: Rethinking Interactive World Models as Game Engines
world-model
Aug 20, 2026
World Action Planner: Generalizable Decision-Making with Action-Conditioned World Models
world-model
task-planning
manipulation
Aug 20, 2026
PhiZero: A World Model Built Around Physical Language
world-model
embodied-reasoning
cross-embodiment
Aug 20, 2026
Wonder: Video World Model Done Better
world-model
Aug 20, 2026
Object-Centric Environment Modeling for Agentic Tasks
world-model
task-planning
Aug 20, 2026
dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model
world-model
robotics
policy-evaluation
diffusion
Aug 20, 2026
World-R1: Reinforcing 3D Constraints for Text-to-Video Generation
world-model
video-generation
RL
3D-consistency
Aug 20, 2026
WCM: A World Critic Model for Vision-Language-Action Reinforcement Learning
VLA
RL
world-model
Aug 20, 2026
World2VLM: Distilling World Model Imagination into VLMs for Dynamic Spatial Reasoning
VLM
world-model
spatial-reasoning
Aug 20, 2026
Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modeling
world-model
VLM
agentic-RL
Aug 20, 2026
N_0-TWAM: Scaling Tactile-Native World-Action Model for Contact-Rich Manipulation
world-model
manipulation
flow-matching
Aug 20, 2026
Tube Diffusion Policy: Reactive Visual-Tactile Policy Learning for Contact-rich Manipulation
diffusion-policy
world-model
manipulation
tactile
Aug 20, 2026
SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction
gui-agent
world-model
Aug 20, 2026
Mental World Modeling
world-model
LLM
VLM
Aug 20, 2026
ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts
world-model
manipulation
VLA
Aug 20, 2026
STARRY: Spatial-Temporal Action-Centric World Modeling for Robotic Manipulation
world-model
VLA
manipulation
diffusion-policy
Aug 20, 2026
Privileged Foresight Distillation: Zero-Cost Future Correction for World Action Models
world-model
VLA
manipulation
Aug 20, 2026
MultiWorld: Scalable Multi-Agent Multi-View Video World Models
world-model
video-understanding
manipulation
Aug 20, 2026
M²-VLA: Boosting Vision-Language Models for Generalizable Manipulation via Layer Mixture and Meta-Skills
VLA
world-model
manipulation
embodied-AI
Aug 20, 2026
GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation
world-model
manipulation
VLA
Aug 20, 2026
RehearseVLA: Simulated Post-Training for VLAs with Physically-Consistent World Model
VLA
world-model
agentic-RL
Aug 20, 2026
HY-World 2.0: A Multi-Modal World Model for Reconstructing, Generating, and Simulating 3D Worlds
world-model
3D-representation
VLM
Aug 20, 2026
FlowWAM: Optical Flow as a Unified Action Representation for World Action Models
world-model
manipulation
VLA
Aug 20, 2026
Generative World Renderer
world-model
3D-representation
dataset
Aug 20, 2026
RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning
world-model
RL
Aug 20, 2026
Generative World Renderer
world-model
3D-representation
Aug 20, 2026
Qwen-AgentWorld: Language World Models for General Agents
world-model
agentic-RL
computer-use
Aug 20, 2026
Embodied.cpp: A Portable Inference Runtime of Embodied AI Models on Heterogeneous Robots
VLA
world-model
manipulation
Aug 20, 2026
DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation
manipulation
world-model
VLA
Aug 20, 2026
Externalization in LLM Agents: A Unified Review of Memory, Skills, Protocols and Harness Engineering
agentic-RL
task-planning
world-model
Aug 20, 2026
Emotion-Conditioned Short-Horizon Human Pose Forecasting with a Lightweight Predictive World Model
world-model
human-pose
prediction
multimodal
Aug 20, 2026
Thinking with Imagination: Agentic Visual Spatial Reasoning with World Simulators
spatial-reasoning
world-model
agentic-RL
VLM
Aug 20, 2026
BadWAM: When World-Action Models Dream Right but Act Wrong
world-model
manipulation
Aug 20, 2026
PiL-World: A Chunk-Wise World Model for VLA Policy-in-the-Loop Evaluation
VLA
world-model
manipulation
Aug 20, 2026
AlayaWorld: Long-Horizon and Playable Video World Generation
world-model
3D-representation
Aug 20, 2026
Orca: The World is in Your Mind
world-model
VLM
VLA
Aug 20, 2026
ABot-M0.5: Unified Mobility-and-Manipulation World Action Model
world-model
VLA
mobile-manipulation
Aug 20, 2026
Disentangled Robot Learning via Separate Forward and Inverse Dynamics Pretraining
VLA
imitation-learning
world-model
Aug 20, 2026
WorldFly: A World-Model-Based Vision-Language-Action Model for UAV Navigation
VLA
world-model
navigation
UAV
Aug 20, 2026
Dreaming when Necessary: Advancing World Action Models with Adaptive Multi-Modal Reasoning
VLA
world-model
embodied-reasoning
task-planning
Aug 20, 2026
MoReGen: Multi-Agent Motion-Reasoning Engine for Code-based Text-to-Video Synthesis
world-model
LLM
VLM
Aug 20, 2026
World-Language-Action Model for Unified World Modeling, Language Reasoning, and Action Synthesis
VLA
world-model
embodied-reasoning
manipulation
Aug 20, 2026
WALL-WM: Carving World Action Modeling at the Event Joints
world-model
VLA
manipulation
embodied-reasoning
Aug 20, 2026
CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies
VLA
world-model
action-generation
efficiency
Aug 20, 2026
Intercepting the Future: Latent-Space Predictive World Model for Dynamic VLA Manipulation
VLA
world-model
manipulation
Aug 20, 2026
MIRAGE: Mobile Agents with Implicit Reasoning and Generative World Models
gui-agent
world-model
embodied-reasoning
Aug 20, 2026
Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond
world-model
gui-agent
agentic-RL
Aug 20, 2026
AgenticCache: Cache-Driven Asynchronous Planning for Embodied AI Agents
world-model
planning
embodied-AI
cache
Aug 20, 2026
Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligence
agentic-RL
web-agent
world-model
Aug 20, 2026
LARA: Latent Action Representation Alignment for Vision-Language-Action Models
VLA
imitation-learning
world-model
flow-matching
Aug 20, 2026
InterAgent: Physics-based Multi-agent Command Execution via Diffusion on Interaction Graphs
diffusion-policy
instruction-following
world-model
Aug 20, 2026
SenseNova-U1: Unifying Multimodal Understanding and Generation with NEO-unify Architecture
VLM
world-model
Aug 20, 2026
HybridDriveVLA: Vision-Language-Action Model with Visual CoT reasoning and ToT Evaluation for Autonomous Driving
VLA
embodied-reasoning
world-model
Aug 20, 2026
PROSPECT: Unified Streaming Vision-Language Navigation via Semantic–Spatial Fusion and Latent Predictive Representation
VLN
VLA
world-model
spatial-reasoning
Ep
Aug 20, 2026
HiF-VLA: Hindsight, Insight and Foresight through Motion Representation for Vision-Language-Action Models
VLA
world-model
manipulation
Aug 20, 2026
Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
VLN
spatial-memory
world-model
Aug 20, 2026
HybridMemory: Out of Sight but Not Out of Mind: Hybrid Memory for Dynamic Video World Models
world-model
spatial-memory
Aug 20, 2026
OA-WAM: Object-Addressable World Action Model for Robust Robot Manipulation
world-model
manipulation
VLA
Aug 20, 2026
How Mobile World Model Guides GUI Agents?
gui-agent
world-model
VLM
Aug 20, 2026
Enhancing Train-Free Infinite-Frame Generation for Consistent Long Videos
world-model
video-LLM
Aug 20, 2026
LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation
world-model
VLM
Aug 20, 2026
Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application
agentic-RL
LLM
world-model
Aug 20, 2026
World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy
world-model
VLA
agentic-RL
Aug 20, 2026
World-Model-Augmented Web Agents with Action Correction
web-agent
world-model
task-planning
Aug 20, 2026
Rethinking Cross-Layer Information Routing in Diffusion Transformers
VLM
world-model
Aug 20, 2026
GigaBrain-0.5M*: a VLA That Learns From World Model-Based Reinforcement Learning
VLA
world-model
manipulation
Aug 20, 2026
World Action Models are Zero-shot Policies
world-model
VLA
manipulation
cross-embodiment
Aug 20, 2026
WebSynthesis: World-Model-Guided MCTS for Efficient WebUI-Trajectory Synthesis
web-agent
world-model
task-planning
Aug 20, 2026
Genie: Generative Interactive Environments
world-model
video-LLM
Params
Aug 20, 2026
MobileDreamer: Generative Sketch World Model for GUI Agent
world-model
task-planning
web-agent
Aug 20, 2026
V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning
world-model
video-understanding
manipulation
Samples
Aug 20, 2026
ManiVideo: Generating Hand-Object Manipulation Video with Dexterous and Generalizable Grasping
manipulation
3D-representation
world-model
Aug 20, 2026
Motus: A Unified Latent Action World Model
VLA
world-model
flow-matching
Aug 20, 2026
DreamGen: Unlocking Generalization in Robot Learning through Video World Models
world-model
VLA
manipulation
Aug 20, 2026
Understanding World or Predicting Future? A Comprehensive Survey of World Models
world-model
VLA
RL
Aug 20, 2026
Is Your LLM Secretly a World Model of the Internet? Model-Based Planning for Web Agents
web-agent
world-model
task-planning
Aug 20, 2026
Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets
world-model
diffusion-policy
manipulation
imitation-learning
Aug 20, 2026
Reasoning with Language Model is Planning with World Model
LLM
task-planning
world-model
Aug 20, 2026
LAPA: Latent Action Pretraining from Videos
VLA
world-model
imitation-learning
Aug 20, 2026
Scaling Agent Learning via Experience Synthesis
agentic-RL
world-model
web-agent
Aug 20, 2026
Diffusion Models Are Real-Time Game Engines
world-model
video-understanding
Aug 20, 2026
LLMs as Scalable, General-Purpose Simulators For Evolving Digital Agent Training
web-agent
world-model
gui-agent
Aug 20, 2026
R-WoM: Retrieval-augmented World Model For Computer-use Agents
computer-use
world-model
web-agent
Aug 20, 2026
IRASim: A Fine-Grained World Model for Robot Manipulation
world-model
manipulation
diffusion-policy
Aug 20, 2026
HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation
world-model
scene-understanding
3D-representation
Aug 20, 2026
Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability
world-model
Aug 20, 2026
Robotic World Model: A Neural Network Simulator for Robust Policy Optimization in Robotics
world-model
RL
legged
Aug 20, 2026
OccSora: 4D Occupancy Generation Models as World Simulators for Autonomous Driving
world-model
3D-representation
Aug 20, 2026
Cosmos World Foundation Model Platform for Physical AI
world-model
VLA
manipulation
Aug 20, 2026
Diffusion for World Modeling: Visual Details Matter in Atari
world-model
RL
diffusion-policy
Superhuman
Jul 03, 2026
2026-07-03-Autoresearch-AllTopics-Update
computer-use
gui-agent
agentic-RL
VLA
world-model