Xiaomi Unveils MiMo-V2.6, Claiming Major Reinforcement-Learning Gains Across Coding, Design and Cybersecurity
Xiaomi unveils MiMo-V2.6, an omni-modal AI model family it says significantly improves coding, design and cybersecurity through groupwise reinforcement learning, with its Pro version reaching 72.6 average@3 on DeepSWE v1.1 after the team freezes an unstable Mixture-of-Experts router.