DeepRead

Popular Tags
#VLM#agentic-RL#gui-agent#web-agent#LLM#VLA#computer-use#task-planning#manipulation#imitation-learning
Home

❯

Papers

❯

Archive

Folder: Papers/Archive

3 items under this folder.

  • Aug 20, 2026

    LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model

    • VLM
    • multimodal-understanding
  • Aug 20, 2026

    EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training

    • VLA
    • VLM
    • manipulation
  • Aug 20, 2026

    Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation

    • VLM
    • gui-agent

Created with Quartz v4.5.2 © 2026

  • GitHub