Üzgünüm mimo v2.5 pro gerçekten işe yaramıyor
Categories:
Bazı kişiler Xiaomi’nin modelinin uzun süreli görevleri yürütebildiğini, yüzlerce tool call hatasız gerçekleştirebildiğini paylaşıyor; bu test yönünün kim tarafından başlatıldığını bilmiyorum, sanki bir öğrencinin sınav salonunda 100 dakika tuvalete gitmeden dayanabileceğini söylemek gibi, anlamsız. Biz normal insanlar anlıyoruz ki, bir sınav için önemli olan tek şey sadece puandır, biraz daha esnek olursak, puan değerlendirme sisteminin ağırlığının %95’inden fazlasını oluşturur, genellikle önce puana sonra diğer performanslara bakılır, puan düşükse diğerlerine bakmaya gerek yoktur. mimo gerçekten bir görevi tamamlayabilir, ancak sorun doğru yapamamasıdır. Aşağıda mimo 2.5 pro ile ilgili öznel, nicelendirilmemiş bir paylaşımdır; yalnızca sektörün referans noktası olan GPT5 serisi ve opus serisi ile karşılaştırılmıştır. Talimatlara uyma zayıf, geri çağırma zayıf; bunun üzerine 1M bağlama penceresi olmasına rağmen, geri çağırma düşükse büyük bağlamın anlamı sınırlıdır. Agent içinde ATDD geliştirme sürecini kullanmamı açıkça belirtsen de, mimo benim için case belgesi ve kullanım örnekleri üretmedi. Niyet anlama zayıf, bu da görevin başlangıçta sapmasına yol açabilir. GPT5 ve opus, oturumun başlangıcında çok fazla bilgi toplar; oturum başlatma ve bilgi toplama aşaması yavaştır, sonrası hızlıdır. Bu yavaşlığın getirisi niyet anlama sapmasının az olması, dezavantajı ise token tüketiminin belirgin şekilde fazla olmasıdır. mimo 2.5 pro, oturum başlatma aşamasında bilgi toplama isteğinden yoksundur, bu nedenle bu modelin yalnızca çok küçük ölçekli programlama görevlerini yürütebileceğini düşünüyorum, 1M bağlam penceresine sahip olmasına rağmen. Modelin ortam bilgilerini toplama isteği düşük olduğundan, mimo modelinin Windows üzerindeki araçlara desteği çok zayıftır, varsayılan olarak verdiği komutlar linux komutlarıdır, ancak gerekmedikçe varsayılan olarak Windows dev drive üzerinde geliştirme yapıyorum; GPT5/opus’a söylemeye gerek yok, referans modellerde bu sorun yok, glm5.1 ve DeepSeekv4flash/pro da normal performans gösteriyor. Genel kültür eksikliği, belirgin şekilde sağduyuya aykırı hataları tanıyamıyor, inatla devam edebiliyor. Sonunda bir sürü token harcayıp saçma bir çözüm ve düzeltme veriyor, gerçekten modelin bağlam oluşturma isteğini güçlendirmekten çok daha kötü. Sonuç olarak özetlersek, mimo v2.5 pro çalışma isteği güçlü, keşif isteği zayıf, hafızası kötü, genel kültürü kötü, mantığı kötü, Windows desteği kötü, vasat ötesi bir model. Bay Lei’nin hediye ettiği token planına teşekkür etsem de, GPT5 ile karşılaştırıldığında çalışkan bir ilkokul öğrencisi ile doktora arasındaki fark gibidir, bazı kişilerin söylediği gibi %80 yeteneğe sahip falan değildir. Öznel deneyimlerim programlama görevleriyle ilgili, yaklaşık 10 istek, 329 yuan’lık pro paketinin %6’sını tüketti, kaba bir hesapla 329 yuan’lık paket benim kullanım senaryomda yalnızca 200 istek gönderebilir. Basit bir tek sayfa değişikliği kabul edilmesi dışında, diğer tüm uygulamalar geri alındı. Belki yazı yazmak için uygun bir modeldir? Her neyse, kod yazmaya uygun değil.

