deepseek-ai/DeepSeek-V4-Pro-0813 Text Generation • 1.7T • Updated 28 days ago • 172k • • 816
meta-models/Muse-Glimmer-30B Image-Text-to-Text • 30B • Updated about 1 month ago • 578k • • 1.88k
LEXIS: LatEnt ProXimal Interaction Signatures for 3D HOI from an Image Paper • 2604.20800 • Published Apr 22 • 6
Sleeping RL 2 Reasoning Gym Environment Server 🧠2 Interact with an environment by submitting answers and viewing state
Sleeping RL 2 Reasoning Gym Environment Server 🧠2 Interact with an environment by submitting answers and viewing state
Sleeping RL 2 Reasoning Gym Environment Server 🧠2 Interact with an environment by submitting answers and viewing state
Taming LLMs by Scaling Learning Rates with Gradient Grouping Paper • 2506.01049 • Published Jun 1, 2025 • 40
REASONING GYM: Reasoning Environments for Reinforcement Learning with Verifiable Rewards Paper • 2505.24760 • Published May 30, 2025 • 74 • 4