Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning Paper • 2607.18722 • Published 19 days ago • 35
SupraLabs/reasoning-summarizer-800m-pre-gguf Text Generation • 0.8B • Updated 11 days ago • 2.06k • 21
Tangram: Unlocking Non-Uniform KV Cache Compression for Efficient Multi-turn LLM Serving Paper • 2606.06302 • Published Jun 15 • 10
Embodied-R1.5: Evolving Physical Intelligence via Embodied Foundation Models Paper • 2606.11324 • Published Jun 9 • 172
electricsheepasia/asia-owid-armed-forces-personnel-of-total-labor-force Viewer • Updated Jun 2 • 1.38k • 75 • 1
blockblockblock/LFM2.5-8B-A1B-uncensored-abliterated-exl3-8.0bpw Text Generation • 5B • Updated May 31 • 13 • 1