Kun Wang
- AgentAuditor: Human-level Safety and Security Evaluation for LLM Agents
- Auditing Meta-Cognitive Hallucinations in Reasoning Large Language Models
- Breaking the Discretization Barrier of Continuous Physics Simulation Learning
- Can LLMs Outshine Conventional Recommenders? A Comparative Evaluation
- CellVerse: Do Large Language Models Really Understand Cell Biology?
- G-Memory: Tracing Hierarchical Memory for Multi-Agent Systems
- GoT: Unleashing Reasoning Capability of MLLM for Visual Generation and Editing
- GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
- Improved Regret and Contextual Linear Extension for Pandora's Box and Prophet Inequality
- Improving Deep Learning for Accelerated MRI With Data Filtering
- LIFEBENCH: Evaluating Length Instruction Following in Large Language Models
- Seg-VAR:Image Segmentation with Visual Autoregressive Modeling
- Unleashing Foundation Vision Models: Adaptive Transfer for Diverse Data-Limited Scientific Domains