MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement By Core Team, Zongming Qiao, Ziyue Hua, Zirui Ou, Zihao Yue · HF Daily Papers · Oct 8, 2026 HF Daily Papers' note score 6 Categories: Model Releases, Research