heegyu/ko-reward-model-safety-1.3b-v0.2 Text Classification • 1B • Updated Jan 13, 2024 • 16 • 7
Base Models Can Reason By Taking a Cue From Training Data Paper • 2610.06851 • Published 6 days ago • 24
Where Does Retrieval-Based Open-Ended Evaluation Fail? Automatic Taxonomy Induction from Long-Form Medical Answer Factuality Verification Paper • 2609.30467 • Published 17 days ago • 23
Pivot-SD: Efficient Self-Distillation for Masked Diffusion Language Models Paper • 2610.03665 • Published 9 days ago • 62
MpMan123/Hallucination_Detection-Legendary-and-Mighty-Capybara Text Classification • 0.2B • Updated Sep 18, 2025 • 20 • 3
Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence Paper • 2609.34563 • Published 13 days ago • 219
leomaurodesenv/bert-base-uncased-jailbreakv-28k Text Classification • 0.1B • Updated 25 days ago • 443 • 13
ROSS: Relearning from Self-Generated Rollouts through Selective Supervision Paper • 2609.35954 • Published 13 days ago • 53
In-Flight KV Cache with Clean Anchors for Faster Autoregressive Video Diffusion Paper • 2609.32540 • Published 15 days ago • 35