Qwen2.5-Max превъзхожда DeepSeek V3 в бенчмаркове като Arena-Hard, LiveBench, LiveCodeBench и GPQA-Diamond, като също така демонстрира конкурентни резултати в други оценки, включително MMLU-Pro.
Китайските компании изглежда се развиват много бързо в областта на ИИ и се превръщат в много сериозна заплаха за балонизираните им конкурентни в САЩ.