orcarouter/OrcaSAQ-2-Cyber-27B-Uncensored-GGUF Text Generation • 27B • Updated 9 days ago • 22.7k • 497
Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening Paper • 2609.18708 • Published 25 days ago • 84
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published Sep 7 • 376
DavidAU/Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NEO-CODER-MAX-MTP-GGUF Image-Text-to-Text • 27B • Updated 16 days ago • 1.96M • 1.65k
Studying Image Tokenizers as Visual Languages in Unified Multimodal Models Paper • 2609.09143 • Published Sep 8 • 29
RoboTok: An Internet-Scale Data Engine for Human Demonstration Retrieval and Dexterous Manipulation Learning Paper • 2609.03199 • Published Sep 2 • 31
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 266
GaussianSelector: Lightweight Human-Guided Object Selection in 3D Gaussian Splatting with Graph Optimization Paper • 2608.01492 • Published Aug 2 • 15
DataSpace: Benchmarking Data Agents for Verifiable Analytics over Heterogeneous Workspaces Paper • 2608.03451 • Published Aug 4 • 34
Poly-OPD: Heterogeneous Multi-Teacher On-Policy Distillation for Capability-Selectable Flow Models Paper • 2608.04349 • Published Aug 5 • 13