DeepRead
Search
Search
Dark mode
Light mode
Explorer
Popular Tags
#VLM
#agentic-RL
#gui-agent
#web-agent
#LLM
#VLA
#computer-use
#task-planning
#manipulation
#imitation-learning
Tag: reinforcement-learning
5 items with this tag.
Aug 20, 2026
TGPO: Tree-Guided Preference Optimization for Robust Web Agent Reinforcement Learning
web-agent
reinforcement-learning
preference-optimization
credit-assignment
Aug 20, 2026
WebSailor: Navigating Super-human Reasoning for Web Agent
web-agent
deep-research
information-seeking
reinforcement-learning
reasoning
Aug 20, 2026
WebDancer: Towards Autonomous Information Seeking Agency
web-agent
deep-research
information-seeking
reinforcement-learning
react
Aug 20, 2026
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
web-agent
reinforcement-learning
curriculum-learning
self-evolving
llm-agent
Aug 20, 2026
WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning
web-agent
deep-research
information-seeking
reinforcement-learning
synthetic-data