SimpleOPD: Simple Tokenizer-Agnostic On-Policy Distillation for Long-Context Reasoning
Paper • 2608.14277 • Published • 35
None defined yet.
RankE: End-to-End Post-Training for Discrete Text-to-Image Generation with Decoder Co-Evolution
Self-Adversarial One Step Generation via Condition Shifting