Ciò che conta è il modello, la differenza negli harness non è così grande. Di recente A/ ha aperto alcuni canali per il reverse proxy, vale la pena provare altri strumenti harness come opencode, copilot cli, ecc.
il modello stepfun predefinito giudica i dati personali ottenibili tramite l’API di github, è abbastanza divertente https://githubroast.dev/ #vibecoding大赏[话题]#
in precedenza raccomandavo sempre chatgpt plus, ma qualche giorno fa chatgpt ha bloccato il mio codex, per accedere di nuovo a codex è richiesta l’autenticazione a due fattori via SMS, poiché il numero di telefono era di una piattaforma di ricezione codici, openai non supporta il cambio automatico del numero, l’account principale è di fatto inutilizzabile. Sono passato a provare supergrok, il composer che offre…
Le prestazioni dei modelli di Zhipu sono accettabili, ma le capacità ingegneristiche sono limitate, e gli utenti abbonati possono percepire la qualità del servizio. Il vantaggio di glm5.2 è il rigore del pensiero, a scapito di una bassa efficienza dei token, che porta a un prezzo complessivo più elevato. Supponendo che la maggior parte degli utenti apprezzi effettivamente i modelli dalle buone prestazioni, ma i piedi voteranno per i modelli convenienti, allora i produttori convenienti conquisteranno gli utenti. Supponendo che la forma di profitto reale dei fornitori di modelli AI sia simile a quella di una fabbrica, puntando su economie di scala e controllo dei costi, allora i produttori convenienti otterranno più facilmente profitto…
Crea più spazi di lavoro, ogni spazio di lavoro può sottoscrivere un go, gli spazi di lavoro possono essere creati liberamente. Non c’è bisogno di creare più account, a meno che non sia per ottenere i 5 dollari di bonus.
La seconda immagine è sufficiente a provare che è originale, il familiare sapore 1302. Il 6.18 è utilizzabile in modo stabile, la velocità è anche abbastanza buona, forse il fornitore non usa più z.ai. Nell’uso la percezione è che sia superiore a deepseekv4pro nel codice, il tasso di errore degli script è diminuito parecchio. Certo, il prezzo è anche aumentato di molte volte. Tra i modelli nazionali si consiglia solo deepseek, speriamo supporti presto il multimodale.
Non è economico, specialmente il modo in cui viene conteggiato il consumo della quota, input e output sono entrambi inclusi nel piano. Spesso una singola richiesta mi costa 20 milioni di token, la fascia da 59 yuan basta solo per 3 richieste. Se usato per la codifica, circa il 99% dell’input è cache di input, calcolare la cache di input hit al prezzo pieno è abbastanza assurdo. Se vogliono che qualcuno lo usi, non conteggiare l’input, includi solo l’output nella quota…
copilot da febbraio a luglio dell’anno scorso su vscode insider era utilizzabile illimitatamente, in questo periodo ho assistito al declino graduale delle capacità agent di copilot. Difficile immaginare che la versione di anteprima del primo mese di copilot fosse in realtà la migliore, poi le capacità agent sono diminuite progressivamente. Qual è stato esattamente il cambiamento? È stato il modo in cui copi…
Nell’ultimo anno e mezzo, alcune aziende hanno sovrastimato il ruolo dell’AI avviando licenziamenti; col passare del tempo, le aziende hanno gradualmente scoperto che l’AI non è così intelligente ed economica come previsto, e hanno iniziato a ridurre il consumo di token AI e a rallentare i licenziamenti. Un motivo molto importante è che l’AI non è economica e non può essere il capro espiatorio. In passato alcuni settori scherzavano sul fatto che l’AI non possa finire in prigione, ma in base alla mia esperienza lavorativa reale…
In precedenza ho pubblicato un post criticando il fatto che le prestazioni di mimo-2.5-pro non giustificavano il suo prezzo, le sue prestazioni non possono davvero reggere il confronto con gpt5.x e opus4.x, non sono io a volerle paragonare, è Xiaomi a volerle paragonare, quindi ho scritto per evidenziare il divario evidente. Ma ora Xiaomi ha cambiato riferimento puntando a deepseek, e penso che potrebbe ancora avere una chance. Vendere LLM…
Le caratteristiche di un’architettura corrotta sono: molti trattamenti speciali, gestione della compatibilità, forte accoppiamento, peso accumulato difficile da recuperare. Tutte le architetture marciscono lentamente. Un’architettura corrotta rende difficile sviluppare nuove funzionalità, correggere bug è difficile, toccare una parte ne muove altre, rendendo anche test e QA molto difficili da fare. Ho visto un appassionato di sviluppo trasversale postare che limitare il comportamento di astrazione del modello quando scrive codice rende il codice più facile da capire. Il codice che le persone capiscono più facilmente, anche l’LLM lo capirà più facilmente, permettendo uno sviluppo rapido e riducendo gli errori. Immagino che gli sviluppatori trasversali abbiano probabilmente progetti più piccoli, abituati alla logica a flusso, se c’è l’aspettativa di scalare, il modo di pensare non può limitarsi al flusso, ma deve usare la mentalità dell’operaio edile. Aspettarsi un edificio di 30 piani, cioè bisogna fare fondamenta di 10 metri, aspettarsi acqua ed elettricità, cioè bisogna riservare pozzi per acqua e elettricità. Questo è un design con obiettivo chiaro, inoltre c’è il design con obiettivo non chiaro, come in un punto della casa si metterà in futuro un elettrodomestico, ma non si sa quale, basta riservare una presa.
La serie GPT5 ha un alto tasso di richiamo, può realizzare una logica molto rigorosa, ed è imbattibile per risolvere bug; inoltre può rilevare tempestivamente le contraddizioni nel contesto, un’esperienza unica tra i numerosi modelli attuali. Ma di recente nel mio progetto di reverse engineering personale ho scoperto che la capacità di reverse di GPT5 è limitata, chiaramente inferiore al modello opus. Molte volte risponde esplicitamente che non è fattibile, mentre passando a opu…
L’AI scrive troppo, i bug per riga sono sicuramente meno, ma non regge l’esplosione del numero di righe: richieste che prima non si volevano scrivere ora si scrivono a raffica, e i bug aumentano. Inoltre l’AI è imbattibile nel trovare i bug altrui, portando alla luce bug nascosti. Le grandi aziende o le librerie popolari di un tempo non esponevano bug gravi così di frequente come ora. Reverse engineering e attacchi…
In realtà provo un certo fastidio per l’azienda anthropic, ma essendo al culmine della fama, non posso che usarla a malincuore. Ho sottoscritto un abbonamento claudecode pro, con una quota molto limitata, utilizzabile solo per pianificare. I modelli nazionali, sebbene leggermente inferiori, hanno una quota maggiore, con un rapporto qualità-prezzo nettamente vantaggioso. Al momento i fornitori di modelli nazionali non offrono l’API response, quindi non è possibile integrarli bene in codex, a patto che non consideriamo la vecchia versione di codex…
Alcuni condividono prompt molto lunghi e ricercati che pretendono di migliorare le prestazioni di GPT5, ma bisogna essere cauti. A differenza di sonnet in claudecode o dei modelli precedenti a opus4.6, GPT5 subisce effetti negativi più evidenti se si scrivono prompt personalizzati a caso. Il prompt di sistema di GPT5 dovrebbe essere ponderato con cura, altrimenti è facile peggiorarne le prestazioni.
Il mio scenario d’uso è principalmente la scrittura di codice, i progetti sono principalmente strumenti a riga di comando. Tencent HY3 Preview si comporta molto bene nel mio scenario d’uso, sia il rispetto delle istruzioni che la logica dialettica sono buoni. Ho anche provato il modello di codifica CoBuddy di Baidu, recentemente uscito su openrouter, è pessimo, basta usarlo un paio di volte per percepire scarse capacità, il contesto è solo 131…
Per prima cosa il vecchio amico openrouter, dopo aver depositato 10 dollari, ci sono 1000 chiamate gratuite al giorno, nella maggior parte dei casi tra i modelli free ce ne sono alcuni con prestazioni accettabili. La politica ufficiale si riserva il diritto di impostare una scadenza per l’importo, potrebbe esserci una validità di un anno, ma i miei 10 dollari dell’anno scorso sono ancora validi. Recentemente in prova limitata nel tempo inclusion…
Ho duecento account free e un account plus, collegati a cliproxyapi, con reverse proxy verso vari cli per l’uso. Questi account bastano per un uso personale intensivo; se si attiva il contesto da 1M, la modalità fast, si usano i subagent, l’analisi immagini ad alta definizione, il token di questi centinaia di account sarà comunque insufficiente, bisogna pianificarne l’uso. f…
GPT5.5 costa il doppio rispetto a GPT5.4, GPT5.4 ha un prezzo superiore di circa il 40% rispetto a GPT5.3codex, entrambi gli aumenti di prezzo hanno una logica di base, ovvero l’aumento dell’efficienza dei token. GPT5.2 è un modello lento in modo esasperante, ma i modelli della serie GPT5 hanno un’elevata precisione nell’individuazione dei problemi e pochi bug, riducendo significativamente il carico mentale di revisione…
Alcune persone condividono che il modello di Xiaomi può eseguire task a lungo termine, centinaia di tool call senza errori, non so chi abbia avviato questa direzione di test, è come dire che uno studente può resistere 100 minuti in aula d’esame senza andare in bagno, non ha senso. Noi persone normali comprendiamo, per un esame competitivo, l’unica cosa importante è solo il punteggio, se più indulgenti, il punteggio occupa oltre il 95% del peso del sistema di valutazione…
E ha ottenuto il primo tempo di risposta e la velocità dei token di alcuni fornitori alle 16:00 ora di Pechino, lo uso da alcuni mesi, vi invito a visitare e a lasciare preziosi commenti! Link del progetto: #https://github.com/jqknono/coding-plans-for-copilot
Ho ottenuto un piano Xiaomi Pro grazie al mio piccolo progetto, proviamolo questo mese. Il progetto è un plugin per VSCode che collega qualsiasi API compatibile con chat-completion/responses/anthropic a github copilot. Indirizzo del progetto: #https://github.com/…
Ho ancora qualche dubbio: se avessi una strategia in grado di generare profitto, sicuramente ci investirei tutto a leva col mutuo, e non la condividerei certo così facilmente. Allora, tutte quelle persone che condividono strategie online, cosa ci guadagnano? #tradingquantitativo[argomento]# #quantitativo[argomento]# #investimentofinanziario[argomento]#
Dire ora di fuggire da cursor potrebbe essere un po’ tardi, in realtà nell’arco di sei mesi ho gradualmente ridotto l’uso di cursor, perché le mie abitudini di coding sono cambiate e i punti di forza di cursor non sono più la ragione per cui lo scelgo. La caratteristica per cui cursor mantiene saldamente il primo posto è ancora il suo modello di completamento unico, che supporta completamenti trasversali a righe e file, in avanti e indietro, a sinistra e a destra, sia in…
Il vantaggio ben noto di Anthropic è il buon senso comune, cioè common sense. Alcuni lavori di sviluppo dipendono dal buon senso comune, altri dalla logica proprietaria. Lo stile di ragionamento di opus è indovinare molte possibilità e poi verificarle rapidamente. GPT5 tende a ragionare in base all’implementazione del codice, riordinando ripetutamente il business. A livello di stile è simile alla differenza tra ricerca in ampiezza e ricerca in profondità. Con l’aumento…
Si può essere rimborsati di nuovo, lascio le risorse ai fratelli. 40 yuan al mese sono certamente economici, ma di giorno non si può usare, di notte devo dormire, questa non è una tariffa lite, è una tariffa night! Questionario di rimborso, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Questa è la terza volta che casco nella trappola di Zhipu. Dicono di voler trattenere i vecchi utenti, offrendo una quota senza limite settimanale, così sono tornato a provarlo, ma sono stato ingannato di nuovo. Non ha limite settimanale, ma quando ne ho bisogno non funziona affatto; solo quando inizio e finisco il lavoro si ‘riprende’, ci si incontra al culmine. A febbraio ho detto che Zhipu lite ha una sola concorrenza, e Zhipu ha denunciato su xhs usando il certificato aziendale…
La narrazione dei costi non si adatta al settore dei grandi modelli, tutti stanno perdendo soldi, persino chi vince perde, i perdenti sentono di non poter andare avanti così, non hanno la capacità di convincere i vincitori ad alzare i prezzi, decidono prima di aumentare il prezzo dei propri prodotti obsoleti, questo è rompere le uova nel paniere, scavarsi la fossa da soli. I produttori domestici di modelli open-source si fanno un nome, dopo che i propri modelli hanno una certa competitività chiudono il codice, qwen3.6/minimax2.7/glm5.1turbo ecc. non sono stati open-source, altre piccole aziende modificano un po’ i modelli base, distillano il modello del vincitore, e vogliono già guadagnarci, pensandola troppo facile.
Uso vscode da dieci anni e per la prima volta vedo un aggiornamento dei temi. Rispetto al tema predefinito originale, i blocchi di colore sono diminuiti, il nero è più nero e il bianco è più bianco. #vscode[argomento]#
Da quando la serie GPT5 è stata rilasciata sei mesi fa, il suo rigore logico è all’avanguardia, ma il difetto più criticato è la sua velocità piuttosto lenta, specialmente GPT5.2, lento in modo incredibile; per molte richieste comuni opus potrebbe impiegare 20 secondi a raccogliere il contesto e iniziare le modifiche, mentre GPT5.2 potrebbe analizzare per 20 minuti prima di iniziare a modificare. Il modello GPT5.2codex dello stesso periodo è leggermente più veloce, ma la logica è notevolmente ridotta. Successivamente il modello GPT5.3codex ha bilanciato logica e velocità, e il modello codex è diventato utilizzabile. Le capacità di codice di GPT5.4 sono state integrate nel modello principale, senza più rilasciare separatamente il modello codex, e la sua velocità è notevolmente migliorata. Si dice che l’efficacia per token sia aumentata, quindi può ragionare di meno per raggiungere una precisione simile.
Da parte di claude, il prezzo di max5x è cinque volte quello di pro, e la quantità è anch’essa cinque volte; il prezzo di max20x è dieci volte, la quantità è 20 volte. Da parte di OpenAI, pro è 6 volte plus, review è 10 volte, rapporto qualità-prezzo discutibile.Ovviamente ha anche il privilegio di priorità di elaborazione delle richieste, non sono sicuro di quanto possa essere veloce.Nel mio uso quotidiano della chat, con extend thinking la sensazione media è di circa cinque minuti per domanda. Il limite settimanale di plus è di 3000 conversazioni, non si finisce mai…
#https://jqknono.github.io/coding-plans-for-copilot/ Pacchetti di modelli open source nazionali ed esteri raccolti, insieme alla latenza del fornitore e alla velocità dei token
Vengono raccolti e organizzati solo produttori nazionali con una certa reputazione, non stazioni di inoltro, con una sicurezza relativamente garantita. Nell’uso reale, la latenza del primo token, la velocità dei token, il numero di concorrenze e se sia quantizzato sono molto importanti ma i produttori ne parlano poco. A confronto, la velocità è più importante, davvero. #jqknono.github.io/coding-plans-for-…
Quando ordinavo di più avevo sottoscritto diversi piani contemporaneamente, e poi non riuscivo a usarli tutti, ogni mese almeno la metà di alcune centinaia di yuan finiva sprecata. OpenAI ha recentemente aperto codex cli agli utenti gratuiti, con una certa quota settimanale gratuita, chi conosce codex sa che la sua quota è molto diversa da quella di claudecode, ed è molto più durevole. Ho personalmente 6 account, collegati a…
Chi conosce le valutazioni degli LLM sa che opus supera spesso gpt nelle classifiche di benchmark, ma nell’uso reale la capacità di gpt di risolvere problemi è imbattibile. Al momento della pubblicazione, i principali modelli più recenti della serie gpt5 includono gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
La finestra di rimborso aprirà entro una settimana dopo la festa, con scadenza il 6 marzo 2026. Accedi alla pagina del mio piano, clicca su annulla e rimborsa per completare con un clic. Nota: la finestra di rimborso termina il 3.6. Fratelli programmatori, ripensate alla vostra esperienza con Zhipu negli ultimi due mesi, credete alle vostre sensazioni e decidete con razionalità.
Inizialmente il compito era solo tradurre da cinese a inglese un’app nodejs che converte un mermaid in immagine, è uno strumento puro, il compito è solo tradurre. A questo punto, nell’uso del modello Zhipu ho incontrato i seguenti problemi: 1. limite di concorrenza estremamente basso, più ne hai bisogno, più la concorrenza è bassa 2. bassa velocità di generazione token 3….
Molti dicono che il pacchetto lite abbia una bassa concorrenza, ma forse non è chiaro quanto sia bassa. Lo spiego più chiaramente. C’è solo una concorrenza, il che significa che negli strumenti con meccanismo subagent, lite non può proprio funzionare. Ho acquistato vari prodotti AI per quattro o cinque anni, il pacchetto Zhipu è la più grande fregatura che abbia preso, è quasi inutilizzabile per la codifica. Ora può essere usato solo per la traduzione a thread singolo…
Dopo aver ricaricato 10 dollari su openrouter, si ha a disposizione una quota giornaliera di 1000 utilizzi dei modelli gratuiti; 1000 volte sono più che sufficienti per me per fare verifiche. Ma per un periodo di tempo piuttosto lungo, molti dei suoi modelli restituivano sempre errori 429, come openai/gpt-oss-120b:free ecc. Oggi ho testato manualmente vari metodi e alla fine ho confermato…
Indirizzo open source github:jqknono/reference-Harmony Le funzioni principali sono nell’immagine, mostra le scorciatoie e i comandi comuni di vari popolari strumenti di sviluppo, che possono aiutare a migliorare l’efficienza lavorativa. L’architettura di “Riferimento rapido” è chiara, la funzione è semplice e mirata, in futuro non inserirà annunci e rispetta pienamente le politiche di revisione delle app di Huawei. A dicembre la sottomissione…
Sono rimasto sorpreso vedendolo, solo dopo ho capito che “plan” era stato tradotto come “pacchetto” GPT5.2high è lento in modo esasperante, GPT5.3 non è ancora uscito, ma 5.3-codex è uscito prima, nei test reali la velocità è migliorata nettamente, il calo della capacità logica non è così evidente come quello da GPT-5.2-Codex rispetto a GPT5.2, è un modello di codifica specializzato che vale la pena adottare…
L’app Qwen utilizza un’operazione di scorrimento a quattro direzioni, con la cronologia delle conversazioni e gli agenti a sinistra e il mercato degli agenti a destra. Quando la traiettoria di scorrimento sullo schermo non è verticale, ma somiglia a un tratto discendente (丿) o ascendente, il contenuto laterale viene richiamato, e per tornare all’interfaccia di conversazione non si scorre lo schermo, ma occorre eseguire un’operazione di ritorno, scivolando dal bordo dello schermo. Se la direzione è confusa, l’app si blocca. L’app Qwen…
Scomodo creare una nuova conversazione; dopo averne creata una nuova appare solo un popup di notifica, i messaggi storici rimangono al loro posto. Anche cambiando argomento si vede ancora la risposta alla domanda precedente, dandomi la sensazione che il contesto non sia stato cambiato, il che è insolito tra le numerose app di dialogo AI. Ma la soglia di utilizzo di Doubao è effettivamente più bassa, il che favorisce lo sviluppo dei suoi utenti.
Alcuni sviluppatori di modelli, all’inizio del lancio di una nuova versione, offrono una velocità di risposta ideale e senza degrado dell’intelligenza; se gli utenti aumentano, velocità ed effetti diminuiscono. Questa è la performance del leader: una volta che le prestazioni restano indietro, gli utenti se ne vanno e le schede accumulate restano inutilizzate. Per evitare questa situazione, si può considerare il disaccoppiamento tra asset pesanti e asset di proprietà intellettuale, vendendo i diritti d’uso del modello o noleggiando risorse hardware.
Archivio del breve post di Xiaohongshu: ‘Mia moglie mi ha chiesto perché non andassi a giocare a pallone insieme, dopo cinque secondi è rimasta scioccata’.