Ce qui compte, c’est le modèle, l’écart des harness n’est pas si grand. Récemment, A/ a assoupli certaines restrictions sur les proxies inverses, n’hésitez pas à essayer d’autres outils harness. opencode, copilot cli, etc. sont très bien.
Créez plusieurs espaces de travail, chaque espace peut souscrire à un go, les espaces de travail peuvent être créés librement. Inutile de créer plusieurs comptes, sauf pour profiter des 5 dollars.
La deuxième image prouve sans aucun doute qu’il s’agit de la version officielle, la saveur familière de 1302. Utilisable de façon stable le 6.18, la vitesse est aussi assez bonne, le fournisseur n’utilise probablement plus z.ai. En expérience, sur le code il est supérieur à deepseekv4pro, le taux d’erreur des scripts a pas mal diminué. Bien sûr, le prix est aussi plusieurs fois plus élevé. Parmi les modèles nationaux, je ne recommande que deepseek, en attendant avec impatience son support multimodal.
J’avais publié un article critiquant le fait que les performances de mimo-2.5-pro ne justifiaient pas son prix, ses performances ne peuvent vraiment pas être comparées à gpt5.x et opus4.x, ce n’est pas moi qui veux les comparer, c’est Xiaomi qui veut les comparer, c’est pourquoi j’ai publié un article soulignant un écart évident. Mais maintenant Xiaomi vise plutôt deepseek, je pense donc qu’il pourrait encore avoir une chance de lutter. Vendre des LLM…
Les caractéristiques d’une architecture pourrie sont : de nombreux traitements spéciaux, traitements de compatibilité, couplage sévère, fardeau accumulé difficile à renverser. Toutes les architectures se dégradent lentement. Une architecture pourrie rend difficile le développement de nouvelles fonctionnalités, la correction des bugs, tout changement affecte l’ensemble, ce qui rend aussi les tests et le QA difficiles à faire. J’ai vu un amateur de développement interdisciplinaire poster que limiter le comportement d’abstraction du modèle lors de l’écriture de code rend le code plus facile à comprendre. Le code que les humains comprennent plus facilement, les LLM le comprennent aussi plus facilement, permettant ainsi un développement rapide et moins d’erreurs. Je pense que les développeurs interdisciplinaires ont probablement de petits volumes de travail, habitués à une logique de ligne d’assemblage, s’il y a une attente d’expansion, la façon de penser ne doit pas se limiter à la ligne d’assemblage, mais adopter l’esprit d’un ouvrier du bâtiment. Prévoir un immeuble de 30 étages, il faut creuser des fondations de 10 mètres, prévoir l’eau et l’électricité, il faut réserver des puits d’eau et d’électricité. C’est une conception à objectif clair, il y a aussi des conceptions à objectif flou, comme réserver une prise là où on mettra un appareil électrique plus tard sans savoir lequel.
Le 2,5 fois moins cher devient directement 1/4 permanent, pas besoin d’achat flash, pas besoin de forfait, pas besoin de cumuler 5h de quota hebdomadaire, pas besoin de calculer le multiplicateur heures creuses/pleines, pas besoin de calculer le taux de change entre token et credit, vente au détail directement égalée au gros, aucun stratagème, que de la sincérité.
La série GPT5 présente un taux de rappel élevé et peut réaliser une logique très rigoureuse, excellente pour le débogage, et elle détecte rapidement les contradictions dans le contexte, une expérience unique parmi les nombreux modèles actuels. Mais récemment, j’ai découvert dans mon projet de rétro-ingénierie personnel que GPT5 a des capacités de rétro-ingénierie limitées, nettement inférieures au modèle opus. Il répond souvent clairement que c’est impossible, alors qu’en passant à opu…
L’IA écrit tellement que les bugs/lignes sont sûrement moins nombreux, mais le nombre de lignes explose, les fonctionnalités qu’on ne voulait pas écrire avant sont maintenant ajoutées à la chaîne, et les bugs augmentent aussi. De plus, l’IA est imbattable pour trouver les bugs des autres, certains bugs cachés sont mis au jour. Les grands éditeurs ou bibliothèques populaires n’ont jamais autant révélé de bugs majeurs à quelques jours d’intervalle qu’aujourd’hui. Le reverse engineering et les attaques deviennent plus simples, et peu à peu on réalise que l’IA ne se contente pas de créer, la guerre offensive et défensive qui suivra sera peut-être plus intéressante.
Mon cas d’usage principal est l’écriture de code, mes projets sont surtout des outils en ligne de commande. Tencent HY3 Preview se comporte très bien dans mon cas d’usage, le respect des instructions et la logique dialectique sont bons. Le modèle de codage CoBuddy de Baidu récemment sorti sur openrouter que j’ai aussi testé est très mauvais, on sent la faiblesse du modèle après seulement deux utilisations simples, le contexte n’est que de 131…
Tout d’abord, l’ancien ami openrouter, après avoir déposé 10 dollars, vous bénéficiez de 1000 appels gratuits par jour, et la plupart du temps il y a plusieurs modèles corrects parmi les modèles gratuits. La politique officielle se réserve le droit de fixer une validité du montant, il pourrait y avoir une validité d’un an, mais mes 10 dollars de plus d’un an sont toujours valides. Récemment, expérience limitée dans le temps de inclusionAI:Ling-2.6-1T et tencent:hy3 preview, dont la version preview de Hunyuan 3 est le premier modèle Tencent que j’utilise…
Certaines personnes partagent que le modèle de Xiaomi peut exécuter des tâches à long terme, avec des centaines d’appels tool call sans erreur. Je ne sais pas qui a lancé cette direction de test, c’est comme dire qu’un élève peut tenir 100 minutes aux examens sans aller aux toilettes, ce qui n’a aucun sens. Nous, les gens normaux, comprenons que pour un examen, la seule chose importante est la note. Si l’on est plus indulgent, la note représente plus de 95 % du système d’évaluation…
Il est peut-être un peu tard pour parler de quitter cursor, mais en réalité, au cours des six derniers mois, j’ai progressivement réduit mon usage de cursor, car mes habitudes de codage ont changé, et les points forts de cursor ne sont plus les raisons pour lesquelles je le choisis. La caractéristique de cursor qui occupe encore la première place à ce jour est son modèle de complétion unique, prenant en charge la complétion transversale avant-arrière-gauche-droite et inter-fichiers, que ce soit en vitesse de réponse ou en taux d’acceptation, aucun concurrent ne lui est comparable. Mais je n’utilise plus la complétion pour écrire du code à la main, je me suis tourné vers l’achat de divers forfaits de codage et j’utilise massivement les agents pour coder…
Encore remboursable, je libère des ressources pour les potes. 40 yuans par mois c’est pas cher, mais impossible de l’utiliser le jour, et la nuit je dois dormir, c’est pas un forfait lite, c’est un forfait night ! Questionnaire de remboursement, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
C’est la troisième fois que je me fais avoir par Zhipu. Ils disaient retenir les anciens utilisateurs en offrant un quota sans limite hebdomadaire, alors j’ai réessayé, et je me suis fait avoir à nouveau. Il n’y a pas de limite hebdomadaire, mais quand j’en ai besoin, cela ne fonctionne tout simplement pas. Tôt le matin au travail et juste après le travail, cela revient à la vie, on se retrouve au sommet. En février, j’ai dit que Zhipu lite avait une concurrence unique, et Zhipu a utilisé son certificat d’exploitation d’entreprise pour signaler mon compte sur xhs, m’accusant de diffamation…
Le récit des coûts ne convient pas à l’industrie des grands modèles, tout le monde perd de l’argent, même les gagnants, les perdants pensent que cela ne peut continuer ainsi, n’ont pas les moyens de convaincre les gagnants d’augmenter les prix, décident d’abord d’augmenter le prix de leurs produits obsolètes, c’est se saborder et creuser sa propre tombe. Les fabricants de modèles open-source nationaux se font un nom, et une fois leur modèle compétitif, ils deviennent tous propriétaires, qwen3.6/minimax2.7/glm5.1turbo etc. ne sont pas open-source, d’autres petits acteurs bricolent sur les modèles de base, distillent le modèle des gagnants, et veulent déjà être payés, c’est trop facile.
Depuis la sortie de la série GPT5 il y a six mois, sa rigueur logique est en tête, mais ce qui est le plus critiqué est sa vitesse plutôt lente, surtout GPT5.2, d’une lenteur insupportable, pour beaucoup de requêtes ordinaires opus commence déjà à modifier après 20 secondes de collecte de contexte, alors que GPT5.2 met probablement 20 minutes à commencer à agir. Le modèle GPT5.2codex de la même période…
Ne recense et organise que les fabricants nationaux jouissant d’une certaine réputation, pas des stations de transit, la sécurité est donc relativement garantie. Dans l’utilisation réelle, la latence du premier token, le débit des tokens, le nombre de requêtes concurrentes, la quantification ou non sont très importants mais peu mentionnés par les fabricants. En comparaison, la vitesse est plus importante, vraiment. #jqknono.github.io/coding-plans-for-…
Au pic d’abonnement, j’avais souscrit plusieurs forfaits en même temps, que je n’arrivais pas à épuiser, gaspillant au moins la moitié de plusieurs centaines de yuans par mois. OpenAI a récemment ouvert codex cli aux utilisateurs gratuits, avec un certain quota hebdomadaire gratuit ; ceux qui connaissent codex savent que son quota est très différent de celui de claudecode, et qu’il est très durable. J’ai personnellement 6 comptes, connectés à un…
Ceux qui connaissent l’évaluation des LLM savent qu’opus domine souvent gpt dans les classements, mais en utilisation réelle, la capacité de résolution de problèmes de gpt est inégalée. Au moment de la publication, les derniers modèles principaux de la série gpt5 sont gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
Au départ, cette tâche consistait simplement à traduire un mermaid en image via une application nodejs du chinois vers l’anglais. C’est un outil pur, et la tâche se limitait à la traduction. Jusqu’à présent, voici les problèmes que j’ai rencontrés avec le modèle Zhipu : 1. Limite de concurrence extrêmement faible, plus on en a besoin, plus la concurrence est basse 2. Vitesse de génération de tokens plutôt lente 3….
Beaucoup de gens disent que la concurrence du forfait lite est faible, mais ils n’ont peut-être pas précisé à quel point elle est faible. Je vais l’expliquer plus clairement. Une seule concurrence Cela signifie que dans les outils avec un mécanisme de subagent, lite ne peut tout simplement pas fonctionner. J’achète divers produits IA depuis quatre ou cinq ans, et le forfait de Zhipu est la plus grosse arnaque que j’aie subie, il est presque inutilisable pour le codage. Il ne peut maintenant être utilisé que pour la traduction monothread…
Après avoir rechargé 10 dollars sur openrouter, on dispose d’un quota quotidien de 1000 utilisations des modèles gratuits. 1000 fois pour faire de la validation me suffit largement. Mais pendant assez longtemps, beaucoup de ses modèles renvoyaient toujours des erreurs 429, comme openai/gpt-oss-120b:free, etc. Aujourd’hui j’ai testé manuellement diverses méthodes et confirmé finalement…
L’application Qwen utilise une navigation par glissement dans quatre directions : à gauche, l’historique des conversations et les agents ; à droite, le marché d’agents. Lorsque le mouvement sur l’écran n’est pas strictement vertical, mais ressemble à un trait oblique (丿) ou à un trait descendant, le contenu latéral est invoqué. Pour revenir à la conversation, il faut effectuer une action de retour en glissant depuis le bord de l’écran. Une direction confuse bloque l’application. L’application Qwen…
Difficile de créer une nouvelle conversation ; après en avoir créé une, un simple message contextuel s’affiche et les messages historiques restent à leur place. Le fait de voir encore la réponse à la question précédente lorsqu’on change de sujet donne l’impression que le contexte n’a pas basculé, ce qui est rare parmi les applications de dialogue IA. Mais le seuil d’utilisation de Doubao est bel et bien plus bas, ce qui favorise son acquisition d’utilisateurs.