عذرًا mimo v2.5 pro حقًا لا يعمل

بعض الأشخاص يشاركون أن نموذج شاومي يمكنه تنفيذ مهام طويلة المدى، ومئات استدعاءات الأدوات دون أخطاء، ولا أعرف من أطلق اتجاه الاختبار هذا، وكأنك تقول إن طالبًا يمكنه الصمود في قاعة الامتحان لمدة 100 دقيقة دون الذهاب إلى الحمام، لا معنى لذلك. نحن الأشخاص العاديون نفهم أنه بالنسبة لامتحان تنافسي، الشيء الوحيد المهم هو الدرجة فقط، وإذا كنا أكثر تساهلًا، فإن الدرجة تمثل أكثر من 95% من وزن نظام التقييم…

بعض الأشخاص يشاركون أن نموذج شاومي يمكنه تنفيذ مهام طويلة المدى، ومئات استدعاءات الأدوات (tool call) دون أخطاء، ولا أعرف من أطلق اتجاه الاختبار هذا، وكأنك تقول إن طالبًا يمكنه الصمود في قاعة الامتحان لمدة 100 دقيقة دون الذهاب إلى الحمام، لا معنى لذلك. نحن الأشخاص العاديين نفهم أنه بالنسبة لامتحان تنافسي، الشيء الوحيد المهم هو الدرجة فقط، وإذا كنا أكثر تساهلًا، فإن الدرجة تمثل أكثر من 95% من وزن نظام التقييم، وعادةً ننظر إلى الدرجة أولاً ثم الأداء الآخر، وإذا كانت الدرجة منخفضة فلا داعي للنظر في الأشياء الأخرى. من المؤكد أن mimo يمكنه إكمال مهمة، لكن المشكلة أنه لا ينجزها بشكل صحيح. فيما يلي مشاركة ذاتية غير كمية حول mimo2.5pro، تقارن فقط مع المعيار الرائد في الصناعة سلسلة GPT5 وسلسلة opus. الالتزام بالتعليمات ضعيف، والاسترجاع ضعيف، وعلى هذا الأساس رغم وجود سياق 1M، فإن معنى السياق الكبير محدود إذا كان الاسترجاع منخفضًا. حتى عندما حددت بوضوح في الوكيل (agent) استخدام عملية تطوير ATDD، لم يُنشئ mimo وثيقة الحالة (case) والحالات الاختبارية لي. فهم النية ضعيف، مما يؤدي إلى انحراف المهمة ربما من البداية. كل من GPT5 وopus يجمعان الكثير من المعلومات في بداية المحادثة، ومرحلة جمع المعلومات عند بدء المحادثة تكون بطيئة، ثم تصبح أسرع لاحقًا. ميزة هذه البطء هي تقليل انحراف فهم النية، وعيبه استهلاك واضح أكبر للرموز (token). يفتقر mimo2.5pro إلى رغبة جمع المعلومات في مرحلة بدء المحادثة، لذلك أعتقد أن هذا النموذج يمكنه فقط تنفيذ مهام برمجة صغيرة جدًا، رغم أنه يمتلك سياق 1M. بسبب ضعف رغبة النموذج في جمع معلومات البيئة، فإن دعم mimo للأدوات على نظام windows ضعيف جدًا، والأوامر الافتراضية التي يقدمها هي أوامر linux، ولكن ما لم يكن ضروريًا أطور افتراضيًا على محرك تطوير windows (windows dev drive)، أما GPT5/opus فلا داعي للحديث، النماذج المعيارية لا تواجه هذه المشكلة، وglm5.1 وDeepSeekv4flash/pro أيضًا يؤديان أداءً طبيعيًا. المعرفة العامة شحيحة، ولا يمكنه التعرف على الأخطاء الواضحة غير المعقولة، بل يستمر بعناد في العمل. وفي النهاية يستهلك الكثير من الرموز (token) ليعطي حلًا وتعديلًا سخيفًا، من الأفضل حقًا تعزيز رغبة النموذج في بناء السياق. ختامًا، mimo v2.5 pro يمتلك رغبة قوية في العمل، ورغبة ضعيفة في الاستكشاف، وذاكرة ضعيفة، ومعرفة عامة ضعيفة، ومنطق ضعيف، ودعم ضعيف لـ windows، وهو نموذج لا يذكر من محاسنه. رغم شكري للرئيس لي على خطة الرموز (token) المهداة، لكن مقارنة بـ GPT5 هي كالفارق بين تلميذ ابتدائي مجتهد ودكتور، وليس كما يقول بعض الأشخاص أنه يمتلك 80% من القدرات. تجاربي الذاتية كلها مهام برمجة، حوالي 10 طلبات، استهلكت 6% من باقة pro بقيمة 329 يوان، وبحسبة تقريبية باقة 329 يوان يمكنها فقط إرسال 200 طلب في سيناريو استخدامي. باستثناء تعديل صفحة واحدة بسيطة تم قبوله، تم التراجع عن جميع التطبيقات الأخرى. ربما هو نموذج مناسب لكتابة المقالات؟ على أي حال، هو غير مناسب لكتابة الكود.

عذرًا mimo v2.5 pro حقًا لا يعمل صورة مرفقة 1

عذرًا mimo v2.5 pro حقًا لا يعمل صورة مرفقة 2