SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning Paper • 2607.14777 • Published 5 days ago • 93
UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning Paper • 2607.04425 • Published 16 days ago • 72
UI-MOPD/Qwen3-VL-32B-Thinking-Desktop-Teacher Image-Text-to-Text • 33B • Updated 13 days ago • 61 • 1
UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning Paper • 2607.04425 • Published 16 days ago • 72