Beyond the Current Observation: Evaluating Multimodal Large Language Models in Controllable Non-Markov Games
Shengyuan Ding
ChrisDing1105
AI & ML interests
None yet
Recent Activity
liked a model 8 days ago
internlm/Intern-S2-Preview-397B upvoted a paper 8 days ago
AgentCompass: A Unified Evaluation Infrastructure for Agent CapabilitiesOrganizations
None yet