Command Palette
Search for a command to run...
Papers
Daily updated cutting-edge AI research papers to help you keep up with the latest AI trends
papers

SemanticMoments: Training-Free Motion Similarity via Third Moment Features

RLinf-Co: Reinforcement Learning-Based Sim-Real Co-Training for VLA Models






























ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning
What does RL improve for Visual Reasoning? A Frankenstein-Style Analysis
MedXIAOHE: A Comprehensive Recipe for Building Medical MLLMs
Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Less is Enough: Synthesizing Diverse Data in Feature Space of LLMs
GigaBrain-0.5M*: a VLA That Learns From World Model-Based Reinforcement Learning
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation
DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing
Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models
The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies
Towards Autonomous Mathematics Research
When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
ASA: Activation Steering for Tool-Calling Domain Adaptation
PhyCritic: Multimodal Critic Models for Physical AI
GENIUS: Generative Fluid Intelligence Evaluation Suite
Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters
World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy
Towards Autonomous Mathematics Research
Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
P1-VL: Bridging Visual Perception and Scientific Reasoning in Physics Olympiads
Chain of Mindset: Reasoning with Adaptive Cognitive Modes
UI-Venus-1.5 Technical Report
Code2World: A GUI World Model via Renderable Code Generation
OPUS: Towards Efficient and Principled Data Selection in Large Language Model Pre-training in Every Iteration
BagelVLA: Enhancing Long-Horizon Manipulation via Interleaved Vision-Language-Action Generation
THINGS-data: A multimodal collection of large-scale datasets for investigating object representations in human brain and behavior
Accurate Predictions of Novel Biomolecular Interactions with IsoDDE
SKILLRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning
LLaDA2.1: Speeding Up Text Diffusion via Token Editing