Ce qui compte, c’est le modèle, l’écart des harness n’est pas si grand. Récemment, A/ a assoupli certaines restrictions sur les proxies inverses, n’hésitez pas à essayer d’autres outils harness. opencode, copilot cli, etc. sont très bien.
Le modèle stepfun utilisé par défaut juge les données personnelles récupérables via l’API github, c’est plutôt amusant https://githubroast.dev/ #vibecoding大赏[话题]#
Auparavant, je recommandais toujours le chatgpt plus, mais il y a quelques jours chatgpt a bloqué mon codex. Pour me reconnecter à codex, une authentification à deux facteurs par SMS est requise. Comme le numéro de téléphone provenait d’une plateforme de réception de SMS, openai ne prend pas en charge le changement de numéro autonome, le compte principal est donc inutilisable. Je suis passé à supergrok pour l’essayer, le composeur qu’il propose…
Les modèles de Zhipu sont plutôt corrects, mais ses capacités d’ingénierie sont limitées, ce que les abonnés peuvent ressentir au niveau de la qualité du service. Le glm5.2 a l’avantage d’une pensée rigoureuse, au prix d’une faible efficacité des tokens, ce qui entraîne un coût global élevé. Si la plupart des utilisateurs apprécient réellement les modèles performants, mais que leurs pieds votent pour les modèles au meilleur rapport qualité-prix, alors les fabricants au meilleur rapport qualité-prix gagneront les utilisateurs. En supposant que la rentabilité réelle des fournisseurs de modèles d’IA ressemble à celle d’une usine, accordant de l’importance aux économies d’échelle et au contrôle des coûts, alors les fabricants au meilleur rapport qualité-prix obtiennent plus facilement des profits…
Créez plusieurs espaces de travail, chaque espace peut souscrire à un go, les espaces de travail peuvent être créés librement. Inutile de créer plusieurs comptes, sauf pour profiter des 5 dollars.
La deuxième image prouve sans aucun doute qu’il s’agit de la version officielle, la saveur familière de 1302. Utilisable de façon stable le 6.18, la vitesse est aussi assez bonne, le fournisseur n’utilise probablement plus z.ai. En expérience, sur le code il est supérieur à deepseekv4pro, le taux d’erreur des scripts a pas mal diminué. Bien sûr, le prix est aussi plusieurs fois plus élevé. Parmi les modèles nationaux, je ne recommande que deepseek, en attendant avec impatience son support multimodal.
Première page, à l’approche de la date d’échéance, le plus important est « rembourser », et non « remboursement facile », mais l’accent visuel est sur « remboursement facile ». « Remboursement facile » désigne en réalité le remboursement en plusieurs fois. Deuxième page, le plus important est « quel est le taux d’intérêt », et non « de combien le taux d’intérêt a été réduit », la page entière n’affiche pas quel est le taux d’intérêt, l’accent visuel est sur « subvention d’intérêt nationale ». Troisième page, l’accent visuel est sur le taux annuel fixe de 15,16 %, le montant total des intérêts n’est toujours pas affiché, mais le montant par période de 62,8 yuans est affiché, le calcul manuel donne 1507,32 yuans, le taux annuel composé est de 16,5 %
Pas donné, surtout la façon dont la consommation de quota est comptabilisée, les entrées et sorties sont toutes incluses dans le plan. J’utilise souvent 20M de tokens par requête unique, le palier à 59 yuans ne me suffit que pour 3 requêtes. Pour le codage, environ 99% des entrées sont en cache d’entrée, compter les hits de cache d’entrée au tarif plein est plutôt absurde. Si vous voulez que des gens l’utilisent, ne comptez pas les entrées, incluez seulement les sorties dans le quota,…
copilot était utilisable sans limite dans vscode insider de février à juillet de l’année dernière, j’ai pu observer durant cette période le déclin progressif des capacités agent de copilot. Difficile à imaginer, la première version d’aperçu de copilot était en fait la meilleure, puis les capacités agent ont diminué progressivement. Quel a été le changement exact ? C’est que copi…
Au cours des dix-huit derniers mois, certaines entreprises ont surestimé le rôle de l’IA et lancé des licenciements. Avec le temps, elles ont peu à peu réalisé que l’IA n’était ni aussi intelligente ni aussi peu coûteuse que prévu, et ont commencé à réduire leur consommation de tokens IA et à ralentir les licenciements. Une raison très importante est que l’IA n’est pas bon marché et ne peut pas servir de bouc émissaire. Par le passé, certains secteurs plaisantaient sur le fait que l’IA ne pouvait pas aller en prison, mais selon mon expérience de travail réelle…
Bien que certaines publications de internautes posent en effet le problème du petit cheval traversant la rivière, ce n’est tout de même pas une raison pour empêcher l’écureuil de dire que l’eau est très profonde. Dans les publications comparatives, il y a souvent des perdants et des gagnants, je ne sais pas si à l’avenir on interdira d’avoir des perdants. Certains fabricants exagèrent vraiment leurs fanfaronnades, ou bien les qualificatifs de leurs classements sont tirés par les cheveux, ce qui induit facilement le consommateur ordinaire en erreur. Auparavant, critiquer les produits consistait à partager, sur la base de sa propre expérience, des pièges à éviter, mais…
J’avais publié un article critiquant le fait que les performances de mimo-2.5-pro ne justifiaient pas son prix, ses performances ne peuvent vraiment pas être comparées à gpt5.x et opus4.x, ce n’est pas moi qui veux les comparer, c’est Xiaomi qui veut les comparer, c’est pourquoi j’ai publié un article soulignant un écart évident. Mais maintenant Xiaomi vise plutôt deepseek, je pense donc qu’il pourrait encore avoir une chance de lutter. Vendre des LLM…
Les caractéristiques d’une architecture pourrie sont : de nombreux traitements spéciaux, traitements de compatibilité, couplage sévère, fardeau accumulé difficile à renverser. Toutes les architectures se dégradent lentement. Une architecture pourrie rend difficile le développement de nouvelles fonctionnalités, la correction des bugs, tout changement affecte l’ensemble, ce qui rend aussi les tests et le QA difficiles à faire. J’ai vu un amateur de développement interdisciplinaire poster que limiter le comportement d’abstraction du modèle lors de l’écriture de code rend le code plus facile à comprendre. Le code que les humains comprennent plus facilement, les LLM le comprennent aussi plus facilement, permettant ainsi un développement rapide et moins d’erreurs. Je pense que les développeurs interdisciplinaires ont probablement de petits volumes de travail, habitués à une logique de ligne d’assemblage, s’il y a une attente d’expansion, la façon de penser ne doit pas se limiter à la ligne d’assemblage, mais adopter l’esprit d’un ouvrier du bâtiment. Prévoir un immeuble de 30 étages, il faut creuser des fondations de 10 mètres, prévoir l’eau et l’électricité, il faut réserver des puits d’eau et d’électricité. C’est une conception à objectif clair, il y a aussi des conceptions à objectif flou, comme réserver une prise là où on mettra un appareil électrique plus tard sans savoir lequel.
Le 2,5 fois moins cher devient directement 1/4 permanent, pas besoin d’achat flash, pas besoin de forfait, pas besoin de cumuler 5h de quota hebdomadaire, pas besoin de calculer le multiplicateur heures creuses/pleines, pas besoin de calculer le taux de change entre token et credit, vente au détail directement égalée au gros, aucun stratagème, que de la sincérité.
La série GPT5 présente un taux de rappel élevé et peut réaliser une logique très rigoureuse, excellente pour le débogage, et elle détecte rapidement les contradictions dans le contexte, une expérience unique parmi les nombreux modèles actuels. Mais récemment, j’ai découvert dans mon projet de rétro-ingénierie personnel que GPT5 a des capacités de rétro-ingénierie limitées, nettement inférieures au modèle opus. Il répond souvent clairement que c’est impossible, alors qu’en passant à opu…
L’IA écrit tellement que les bugs/lignes sont sûrement moins nombreux, mais le nombre de lignes explose, les fonctionnalités qu’on ne voulait pas écrire avant sont maintenant ajoutées à la chaîne, et les bugs augmentent aussi. De plus, l’IA est imbattable pour trouver les bugs des autres, certains bugs cachés sont mis au jour. Les grands éditeurs ou bibliothèques populaires n’ont jamais autant révélé de bugs majeurs à quelques jours d’intervalle qu’aujourd’hui. Le reverse engineering et les attaques deviennent plus simples, et peu à peu on réalise que l’IA ne se contente pas de créer, la guerre offensive et défensive qui suivra sera peut-être plus intéressante.
Je ressens en fait une certaine répulsion envers l’entreprise anthropic, mais elle est très en vogue, je dois donc l’utiliser à contrecœur. J’ai pris un abonnement claudecode pro, dont le quota est très faible, il ne peut servir que pour la planification. Les modèles nationaux sont un peu moins performants, mais leur quota est plus important, avec un rapport qualité-prix nettement supérieur. Les fournisseurs de modèles nationaux ne proposent actuellement pas d’API response, il est donc impossible de…
Certains partagent des invites très longues et sophistiquées prétendant améliorer les performances de GPT5, ce qu’il convient de considérer avec prudence. Contrairement aux modèles sonnet ou opus4.6 antérieurs dans claudecode, les effets négatifs d’écrire des invites personnalisées au hasard sont assez marqués. L’invite système de GPT5 doit être soigneusement pesée, sinon elle risque de dégrader facilement les performances du modèle.
Mon cas d’usage principal est l’écriture de code, mes projets sont surtout des outils en ligne de commande. Tencent HY3 Preview se comporte très bien dans mon cas d’usage, le respect des instructions et la logique dialectique sont bons. Le modèle de codage CoBuddy de Baidu récemment sorti sur openrouter que j’ai aussi testé est très mauvais, on sent la faiblesse du modèle après seulement deux utilisations simples, le contexte n’est que de 131…
Tout d’abord, l’ancien ami openrouter, après avoir déposé 10 dollars, vous bénéficiez de 1000 appels gratuits par jour, et la plupart du temps il y a plusieurs modèles corrects parmi les modèles gratuits. La politique officielle se réserve le droit de fixer une validité du montant, il pourrait y avoir une validité d’un an, mais mes 10 dollars de plus d’un an sont toujours valides. Récemment, expérience limitée dans le temps de inclusionAI:Ling-2.6-1T et tencent:hy3 preview, dont la version preview de Hunyuan 3 est le premier modèle Tencent que j’utilise…
J’ai deux cents comptes free et un compte plus, connectés à cliproxyapi, puis redirigés via proxy inverse vers différents cli pour utilisation. Ces comptes suffisent à une utilisation personnelle intensive. Si l’on active le contexte 1M, le mode fast, les subagents et l’analyse d’images haute définition, le token de ces centaines de comptes restera insuffisant, il faut encore planifier leur usage. f…
GPT5.5 a doublé son prix par rapport à GPT5.4, et GPT5.4 a augmenté d’environ 40% par rapport à GPT5.3codex. Les deux augmentations de prix reposent sur une logique de base : l’amélioration de l’efficacité des tokens. GPT5.2 est un modèle terriblement lent, mais la série GPT5 présente un taux de localisation précise des problèmes élevé et peu de bugs, réduisant considérablement la charge mentale de relecture…
Certaines personnes partagent que le modèle de Xiaomi peut exécuter des tâches à long terme, avec des centaines d’appels tool call sans erreur. Je ne sais pas qui a lancé cette direction de test, c’est comme dire qu’un élève peut tenir 100 minutes aux examens sans aller aux toilettes, ce qui n’a aucun sens. Nous, les gens normaux, comprenons que pour un examen, la seule chose importante est la note. Si l’on est plus indulgent, la note représente plus de 95 % du système d’évaluation…
Et a obtenu le temps de réponse du premier caractère et la vitesse de token de certains fournisseurs à 16h00 heure de Pékin. Utilisé pendant plusieurs mois, n’hésitez pas à visiter et à donner vos précieux commentaires ! Lien du projet : #https://github.com/jqknono/coding-plans-for-copilot
J’ai obtenu un plan Xiaomi Pro grâce à mon petit projet, je vais tester ce mois-ci. Le projet est un plugin VSCode qui connecte n’importe quelle API compatible chat-completion/responses/anthropic à github copilot. Adresse du projet : #https://github.com/…
J’ai encore quelques doutes : si j’avais une stratégie permettant de gagner de l’argent, je souscrirais certainement un prêt pour tout miser, et je ne partagerais jamais cette stratégie à la légère. Alors, que cherchent ceux qui partagent des stratégies en ligne ? #TradingQuantitatif[Sujet]# #Quantification[Sujet]# #InvestissementFinancier[Sujet]#
Il est peut-être un peu tard pour parler de quitter cursor, mais en réalité, au cours des six derniers mois, j’ai progressivement réduit mon usage de cursor, car mes habitudes de codage ont changé, et les points forts de cursor ne sont plus les raisons pour lesquelles je le choisis. La caractéristique de cursor qui occupe encore la première place à ce jour est son modèle de complétion unique, prenant en charge la complétion transversale avant-arrière-gauche-droite et inter-fichiers, que ce soit en vitesse de réponse ou en taux d’acceptation, aucun concurrent ne lui est comparable. Mais je n’utilise plus la complétion pour écrire du code à la main, je me suis tourné vers l’achat de divers forfaits de codage et j’utilise massivement les agents pour coder…
Archivage d’une courte publication Xiaohongshu sur l’utilisation d’un prompt simple dans ChatGPT pour consulter ses propres statistiques d’utilisation.
L’avantage bien connu d’Anthropic est le bon sens, c’est-à-dire le common sense. Certains travaux de développement s’appuient sur le bon sens, d’autres sur une logique propriétaire. Le style de raisonnement d’opus est de conjecturer de nombreuses possibilités, puis de les vérifier rapidement. GPT5 a tendance à raisonner selon l’implémentation du code, en réorganisant continuellement le métier. Le style ressemble à la différence entre la recherche en largeur et la recherche en profondeur. Au fil de…
Encore remboursable, je libère des ressources pour les potes. 40 yuans par mois c’est pas cher, mais impossible de l’utiliser le jour, et la nuit je dois dormir, c’est pas un forfait lite, c’est un forfait night ! Questionnaire de remboursement, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
C’est la troisième fois que je me fais avoir par Zhipu. Ils disaient retenir les anciens utilisateurs en offrant un quota sans limite hebdomadaire, alors j’ai réessayé, et je me suis fait avoir à nouveau. Il n’y a pas de limite hebdomadaire, mais quand j’en ai besoin, cela ne fonctionne tout simplement pas. Tôt le matin au travail et juste après le travail, cela revient à la vie, on se retrouve au sommet. En février, j’ai dit que Zhipu lite avait une concurrence unique, et Zhipu a utilisé son certificat d’exploitation d’entreprise pour signaler mon compte sur xhs, m’accusant de diffamation…
Le récit des coûts ne convient pas à l’industrie des grands modèles, tout le monde perd de l’argent, même les gagnants, les perdants pensent que cela ne peut continuer ainsi, n’ont pas les moyens de convaincre les gagnants d’augmenter les prix, décident d’abord d’augmenter le prix de leurs produits obsolètes, c’est se saborder et creuser sa propre tombe. Les fabricants de modèles open-source nationaux se font un nom, et une fois leur modèle compétitif, ils deviennent tous propriétaires, qwen3.6/minimax2.7/glm5.1turbo etc. ne sont pas open-source, d’autres petits acteurs bricolent sur les modèles de base, distillent le modèle des gagnants, et veulent déjà être payés, c’est trop facile.
J’utilise vscode depuis dix ans, et c’est la première fois que je vois une mise à jour de thème. Par rapport au thème par défaut d’origine, les blocs de couleur sont réduits, le noir est plus noir, le blanc est plus blanc. #vscode[sujet]#
Depuis la sortie de la série GPT5 il y a six mois, sa rigueur logique est en tête, mais ce qui est le plus critiqué est sa vitesse plutôt lente, surtout GPT5.2, d’une lenteur insupportable, pour beaucoup de requêtes ordinaires opus commence déjà à modifier après 20 secondes de collecte de contexte, alors que GPT5.2 met probablement 20 minutes à commencer à agir. Le modèle GPT5.2codex de la même période…
Côté claude, le prix du max5x est cinq fois celui du pro, le volume aussi est quintuplé, le prix du max20x est décuple, le volume est vingtuplé. Côté OpenAI, le pro est à 6 fois le plus, le review à 10 fois, le rapport qualité-prix est difficile à évaluer. Bien sûr, il dispose aussi du privilège de traitement prioritaire des requêtes, je ne sais pas trop à quel point ça peut être plus rapide. J’utilise quotidiennement la conversation chat, en activant l’extend thinking, la sensation moyenne est d’environ cinq minutes par question. La limite hebdomadaire du plus est de 3000 conversations, de loin suffisant…
#https://jqknono.github.io/coding-plans-for-copilot/ Forfaits de modèles open source nationaux et étrangers collectés, ainsi que la latence des fournisseurs et le débit de tokens
Ne recense et organise que les fabricants nationaux jouissant d’une certaine réputation, pas des stations de transit, la sécurité est donc relativement garantie. Dans l’utilisation réelle, la latence du premier token, le débit des tokens, le nombre de requêtes concurrentes, la quantification ou non sont très importants mais peu mentionnés par les fabricants. En comparaison, la vitesse est plus importante, vraiment. #jqknono.github.io/coding-plans-for-…
Au pic d’abonnement, j’avais souscrit plusieurs forfaits en même temps, que je n’arrivais pas à épuiser, gaspillant au moins la moitié de plusieurs centaines de yuans par mois. OpenAI a récemment ouvert codex cli aux utilisateurs gratuits, avec un certain quota hebdomadaire gratuit ; ceux qui connaissent codex savent que son quota est très différent de celui de claudecode, et qu’il est très durable. J’ai personnellement 6 comptes, connectés à un…
Ceux qui connaissent l’évaluation des LLM savent qu’opus domine souvent gpt dans les classements, mais en utilisation réelle, la capacité de résolution de problèmes de gpt est inégalée. Au moment de la publication, les derniers modèles principaux de la série gpt5 sont gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
La fenêtre de remboursement ouvrira dans une semaine après les vacances, jusqu’au 6 mars 2026. À ce moment, accédez à la page Mon forfait, cliquez sur Annuler et rembourser pour terminer en un clic. Notez que cette fenêtre de remboursement se termine le 3.6. Les frères programmeurs, repensez à votre expérience d’utilisation de Zhipu ces deux derniers mois, faites confiance à vos sentiments et prenez une décision rationnelle.
Au départ, cette tâche consistait simplement à traduire un mermaid en image via une application nodejs du chinois vers l’anglais. C’est un outil pur, et la tâche se limitait à la traduction. Jusqu’à présent, voici les problèmes que j’ai rencontrés avec le modèle Zhipu : 1. Limite de concurrence extrêmement faible, plus on en a besoin, plus la concurrence est basse 2. Vitesse de génération de tokens plutôt lente 3….
Beaucoup de gens disent que la concurrence du forfait lite est faible, mais ils n’ont peut-être pas précisé à quel point elle est faible. Je vais l’expliquer plus clairement. Une seule concurrence Cela signifie que dans les outils avec un mécanisme de subagent, lite ne peut tout simplement pas fonctionner. J’achète divers produits IA depuis quatre ou cinq ans, et le forfait de Zhipu est la plus grosse arnaque que j’aie subie, il est presque inutilisable pour le codage. Il ne peut maintenant être utilisé que pour la traduction monothread…
Après avoir rechargé 10 dollars sur openrouter, on dispose d’un quota quotidien de 1000 utilisations des modèles gratuits. 1000 fois pour faire de la validation me suffit largement. Mais pendant assez longtemps, beaucoup de ses modèles renvoyaient toujours des erreurs 429, comme openai/gpt-oss-120b:free, etc. Aujourd’hui j’ai testé manuellement diverses méthodes et confirmé finalement…
Adresse open-source github:jqknono/reference-Harmony Fonction principale voir image, affiche les raccourcis et commandes courantes de divers outils de développement populaires, ce qui peut aider à améliorer l’efficacité du travail. L’architecture de “Référence rapide de développement” est claire, la fonction est simple et concentrée, il n’y aura pas de publicité à l’avenir, et elle est entièrement conforme à la politique d’examen des applications de Huawei. Soumis en décembre…
J’ai été surpris en voyant cela, puis j’ai réalisé que “plan” avait été traduit par “forfait”. GPT5.2high est terriblement lent, GPT5.3 n’est pas encore sorti, mais 5.3-codex est arrivé en premier. Après test, la vitesse est nettement améliorée, la baisse de capacité logique n’est pas aussi marquée que celle de GPT-5.2-Codex par rapport à GPT5.2, c’est un modèle de codage spécialisé qui vaut le changement…
L’application Qwen utilise une navigation par glissement dans quatre directions : à gauche, l’historique des conversations et les agents ; à droite, le marché d’agents. Lorsque le mouvement sur l’écran n’est pas strictement vertical, mais ressemble à un trait oblique (丿) ou à un trait descendant, le contenu latéral est invoqué. Pour revenir à la conversation, il faut effectuer une action de retour en glissant depuis le bord de l’écran. Une direction confuse bloque l’application. L’application Qwen…
Difficile de créer une nouvelle conversation ; après en avoir créé une, un simple message contextuel s’affiche et les messages historiques restent à leur place. Le fait de voir encore la réponse à la question précédente lorsqu’on change de sujet donne l’impression que le contexte n’a pas basculé, ce qui est rare parmi les applications de dialogue IA. Mais le seuil d’utilisation de Doubao est bel et bien plus bas, ce qui favorise son acquisition d’utilisateurs.
Lors du lancement d’une nouvelle version par certains éditeurs de modèles, la vitesse de réponse est idéale et l’intelligence n’est pas réduite. Si le nombre d’utilisateurs augmente, la vitesse et la qualité diminuent. C’est le comportement d’un leader : une fois la performance à la traîne, les utilisateurs partent et les cartes stockées restent inactives. Pour éviter cela, on peut envisager de découpler les actifs lourds et les actifs de propriété intellectuelle, vendre les droits d’utilisation du modèle, ou louer des ressources matérielles.
Archivage du post court Xiaohongshu « Le ciel le sait, la terre le sait, tu le sais, je le sais, les dieux le savent, les fantômes le savent, qu’est-ce que l’ignorance ? ».