aumento prezzi deepseek
prezzo raddoppiato negli orari lavorativi
prezzo raddoppiato negli orari lavorativi
il modello stepfun predefinito giudica i dati personali ottenibili tramite l’API di github, è abbastanza divertente https://githubroast.dev/ #vibecoding大赏[话题]#
Le prestazioni dei modelli di Zhipu sono accettabili, ma le capacità ingegneristiche sono limitate, e gli utenti abbonati possono percepire la qualità del servizio. Il vantaggio di glm5.2 è il rigore del pensiero, a scapito di una bassa efficienza dei token, che porta a un prezzo complessivo più elevato. Supponendo che la maggior parte degli utenti apprezzi effettivamente i modelli dalle buone prestazioni, ma i piedi voteranno per i modelli convenienti, allora i produttori convenienti conquisteranno gli utenti. Supponendo che la forma di profitto reale dei fornitori di modelli AI sia simile a quella di una fabbrica, puntando su economie di scala e controllo dei costi, allora i produttori convenienti otterranno più facilmente profitto…
Crea più spazi di lavoro, ogni spazio di lavoro può sottoscrivere un go, gli spazi di lavoro possono essere creati liberamente. Non c’è bisogno di creare più account, a meno che non sia per ottenere i 5 dollari di bonus.
La seconda immagine è sufficiente a provare che è originale, il familiare sapore 1302. Il 6.18 è utilizzabile in modo stabile, la velocità è anche abbastanza buona, forse il fornitore non usa più z.ai. Nell’uso la percezione è che sia superiore a deepseekv4pro nel codice, il tasso di errore degli script è diminuito parecchio. Certo, il prezzo è anche aumentato di molte volte. Tra i modelli nazionali si consiglia solo deepseek, speriamo supporti presto il multimodale.
L’AI arriva impetuosa, prepariamoci per tempo
Non è economico, specialmente il modo in cui viene conteggiato il consumo della quota, input e output sono entrambi inclusi nel piano. Spesso una singola richiesta mi costa 20 milioni di token, la fascia da 59 yuan basta solo per 3 richieste. Se usato per la codifica, circa il 99% dell’input è cache di input, calcolare la cache di input hit al prezzo pieno è abbastanza assurdo. Se vogliono che qualcuno lo usi, non conteggiare l’input, includi solo l’output nella quota…
Nell’ultimo anno e mezzo, alcune aziende hanno sovrastimato il ruolo dell’AI avviando licenziamenti; col passare del tempo, le aziende hanno gradualmente scoperto che l’AI non è così intelligente ed economica come previsto, e hanno iniziato a ridurre il consumo di token AI e a rallentare i licenziamenti. Un motivo molto importante è che l’AI non è economica e non può essere il capro espiatorio. In passato alcuni settori scherzavano sul fatto che l’AI non possa finire in prigione, ma in base alla mia esperienza lavorativa reale…
In precedenza ho pubblicato un post criticando il fatto che le prestazioni di mimo-2.5-pro non giustificavano il suo prezzo, le sue prestazioni non possono davvero reggere il confronto con gpt5.x e opus4.x, non sono io a volerle paragonare, è Xiaomi a volerle paragonare, quindi ho scritto per evidenziare il divario evidente. Ma ora Xiaomi ha cambiato riferimento puntando a deepseek, e penso che potrebbe ancora avere una chance. Vendere LLM…
Le caratteristiche di un’architettura corrotta sono: molti trattamenti speciali, gestione della compatibilità, forte accoppiamento, peso accumulato difficile da recuperare. Tutte le architetture marciscono lentamente. Un’architettura corrotta rende difficile sviluppare nuove funzionalità, correggere bug è difficile, toccare una parte ne muove altre, rendendo anche test e QA molto difficili da fare. Ho visto un appassionato di sviluppo trasversale postare che limitare il comportamento di astrazione del modello quando scrive codice rende il codice più facile da capire. Il codice che le persone capiscono più facilmente, anche l’LLM lo capirà più facilmente, permettendo uno sviluppo rapido e riducendo gli errori. Immagino che gli sviluppatori trasversali abbiano probabilmente progetti più piccoli, abituati alla logica a flusso, se c’è l’aspettativa di scalare, il modo di pensare non può limitarsi al flusso, ma deve usare la mentalità dell’operaio edile. Aspettarsi un edificio di 30 piani, cioè bisogna fare fondamenta di 10 metri, aspettarsi acqua ed elettricità, cioè bisogna riservare pozzi per acqua e elettricità. Questo è un design con obiettivo chiaro, inoltre c’è il design con obiettivo non chiaro, come in un punto della casa si metterà in futuro un elettrodomestico, ma non si sa quale, basta riservare una presa.
Sconto 2,5 direttamente a 1/4 permanente, niente acquisti a tempo, niente pacchetti, niente ricarica quota 5h settimanale, niente calcolo moltiplicatore ore tranquille/occupate, niente calcolo tasso di cambio token e credit, vendita al dettaglio è all’ingrosso, nessun trucco, tutta sincerità.
La serie GPT5 ha un alto tasso di richiamo, può realizzare una logica molto rigorosa, ed è imbattibile per risolvere bug; inoltre può rilevare tempestivamente le contraddizioni nel contesto, un’esperienza unica tra i numerosi modelli attuali. Ma di recente nel mio progetto di reverse engineering personale ho scoperto che la capacità di reverse di GPT5 è limitata, chiaramente inferiore al modello opus. Molte volte risponde esplicitamente che non è fattibile, mentre passando a opu…
L’AI scrive troppo, i bug per riga sono sicuramente meno, ma non regge l’esplosione del numero di righe: richieste che prima non si volevano scrivere ora si scrivono a raffica, e i bug aumentano. Inoltre l’AI è imbattibile nel trovare i bug altrui, portando alla luce bug nascosti. Le grandi aziende o le librerie popolari di un tempo non esponevano bug gravi così di frequente come ora. Reverse engineering e attacchi…
In realtà provo un certo fastidio per l’azienda anthropic, ma essendo al culmine della fama, non posso che usarla a malincuore. Ho sottoscritto un abbonamento claudecode pro, con una quota molto limitata, utilizzabile solo per pianificare. I modelli nazionali, sebbene leggermente inferiori, hanno una quota maggiore, con un rapporto qualità-prezzo nettamente vantaggioso. Al momento i fornitori di modelli nazionali non offrono l’API response, quindi non è possibile integrarli bene in codex, a patto che non consideriamo la vecchia versione di codex…
Alcuni condividono prompt molto lunghi e ricercati che pretendono di migliorare le prestazioni di GPT5, ma bisogna essere cauti. A differenza di sonnet in claudecode o dei modelli precedenti a opus4.6, GPT5 subisce effetti negativi più evidenti se si scrivono prompt personalizzati a caso. Il prompt di sistema di GPT5 dovrebbe essere ponderato con cura, altrimenti è facile peggiorarne le prestazioni.
Il mio scenario d’uso è principalmente la scrittura di codice, i progetti sono principalmente strumenti a riga di comando. Tencent HY3 Preview si comporta molto bene nel mio scenario d’uso, sia il rispetto delle istruzioni che la logica dialettica sono buoni. Ho anche provato il modello di codifica CoBuddy di Baidu, recentemente uscito su openrouter, è pessimo, basta usarlo un paio di volte per percepire scarse capacità, il contesto è solo 131…
Per prima cosa il vecchio amico openrouter, dopo aver depositato 10 dollari, ci sono 1000 chiamate gratuite al giorno, nella maggior parte dei casi tra i modelli free ce ne sono alcuni con prestazioni accettabili. La politica ufficiale si riserva il diritto di impostare una scadenza per l’importo, potrebbe esserci una validità di un anno, ma i miei 10 dollari dell’anno scorso sono ancora validi. Recentemente in prova limitata nel tempo inclusion…
Ho duecento account free e un account plus, collegati a cliproxyapi, con reverse proxy verso vari cli per l’uso. Questi account bastano per un uso personale intensivo; se si attiva il contesto da 1M, la modalità fast, si usano i subagent, l’analisi immagini ad alta definizione, il token di questi centinaia di account sarà comunque insufficiente, bisogna pianificarne l’uso. f…
GPT5.5 costa il doppio rispetto a GPT5.4, GPT5.4 ha un prezzo superiore di circa il 40% rispetto a GPT5.3codex, entrambi gli aumenti di prezzo hanno una logica di base, ovvero l’aumento dell’efficienza dei token. GPT5.2 è un modello lento in modo esasperante, ma i modelli della serie GPT5 hanno un’elevata precisione nell’individuazione dei problemi e pochi bug, riducendo significativamente il carico mentale di revisione…
Alcune persone condividono che il modello di Xiaomi può eseguire task a lungo termine, centinaia di tool call senza errori, non so chi abbia avviato questa direzione di test, è come dire che uno studente può resistere 100 minuti in aula d’esame senza andare in bagno, non ha senso. Noi persone normali comprendiamo, per un esame competitivo, l’unica cosa importante è solo il punteggio, se più indulgenti, il punteggio occupa oltre il 95% del peso del sistema di valutazione…
E ha ottenuto il primo tempo di risposta e la velocità dei token di alcuni fornitori alle 16:00 ora di Pechino, lo uso da alcuni mesi, vi invito a visitare e a lasciare preziosi commenti! Link del progetto: #https://github.com/jqknono/coding-plans-for-copilot
Ho ottenuto un piano Xiaomi Pro grazie al mio piccolo progetto, proviamolo questo mese. Il progetto è un plugin per VSCode che collega qualsiasi API compatibile con chat-completion/responses/anthropic a github copilot. Indirizzo del progetto: #https://github.com/…
Ho ancora qualche dubbio: se avessi una strategia in grado di generare profitto, sicuramente ci investirei tutto a leva col mutuo, e non la condividerei certo così facilmente. Allora, tutte quelle persone che condividono strategie online, cosa ci guadagnano? #tradingquantitativo[argomento]# #quantitativo[argomento]# #investimentofinanziario[argomento]#
Dire ora di fuggire da cursor potrebbe essere un po’ tardi, in realtà nell’arco di sei mesi ho gradualmente ridotto l’uso di cursor, perché le mie abitudini di coding sono cambiate e i punti di forza di cursor non sono più la ragione per cui lo scelgo. La caratteristica per cui cursor mantiene saldamente il primo posto è ancora il suo modello di completamento unico, che supporta completamenti trasversali a righe e file, in avanti e indietro, a sinistra e a destra, sia in…
Il vantaggio ben noto di Anthropic è il buon senso comune, cioè common sense. Alcuni lavori di sviluppo dipendono dal buon senso comune, altri dalla logica proprietaria. Lo stile di ragionamento di opus è indovinare molte possibilità e poi verificarle rapidamente. GPT5 tende a ragionare in base all’implementazione del codice, riordinando ripetutamente il business. A livello di stile è simile alla differenza tra ricerca in ampiezza e ricerca in profondità. Con l’aumento…
Si può essere rimborsati di nuovo, lascio le risorse ai fratelli. 40 yuan al mese sono certamente economici, ma di giorno non si può usare, di notte devo dormire, questa non è una tariffa lite, è una tariffa night! Questionario di rimborso, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Questa è la terza volta che casco nella trappola di Zhipu. Dicono di voler trattenere i vecchi utenti, offrendo una quota senza limite settimanale, così sono tornato a provarlo, ma sono stato ingannato di nuovo. Non ha limite settimanale, ma quando ne ho bisogno non funziona affatto; solo quando inizio e finisco il lavoro si ‘riprende’, ci si incontra al culmine. A febbraio ho detto che Zhipu lite ha una sola concorrenza, e Zhipu ha denunciato su xhs usando il certificato aziendale…
La narrazione dei costi non si adatta al settore dei grandi modelli, tutti stanno perdendo soldi, persino chi vince perde, i perdenti sentono di non poter andare avanti così, non hanno la capacità di convincere i vincitori ad alzare i prezzi, decidono prima di aumentare il prezzo dei propri prodotti obsoleti, questo è rompere le uova nel paniere, scavarsi la fossa da soli. I produttori domestici di modelli open-source si fanno un nome, dopo che i propri modelli hanno una certa competitività chiudono il codice, qwen3.6/minimax2.7/glm5.1turbo ecc. non sono stati open-source, altre piccole aziende modificano un po’ i modelli base, distillano il modello del vincitore, e vogliono già guadagnarci, pensandola troppo facile.
Uso vscode da dieci anni e per la prima volta vedo un aggiornamento dei temi. Rispetto al tema predefinito originale, i blocchi di colore sono diminuiti, il nero è più nero e il bianco è più bianco. #vscode[argomento]#
#https://jqknono.github.io/coding-plans-for-copilot/ Pacchetti di modelli open source nazionali ed esteri raccolti, insieme alla latenza del fornitore e alla velocità dei token
Vengono raccolti e organizzati solo produttori nazionali con una certa reputazione, non stazioni di inoltro, con una sicurezza relativamente garantita. Nell’uso reale, la latenza del primo token, la velocità dei token, il numero di concorrenze e se sia quantizzato sono molto importanti ma i produttori ne parlano poco. A confronto, la velocità è più importante, davvero. #jqknono.github.io/coding-plans-for-…
Quando ordinavo di più avevo sottoscritto diversi piani contemporaneamente, e poi non riuscivo a usarli tutti, ogni mese almeno la metà di alcune centinaia di yuan finiva sprecata. OpenAI ha recentemente aperto codex cli agli utenti gratuiti, con una certa quota settimanale gratuita, chi conosce codex sa che la sua quota è molto diversa da quella di claudecode, ed è molto più durevole. Ho personalmente 6 account, collegati a…
Chi conosce le valutazioni degli LLM sa che opus supera spesso gpt nelle classifiche di benchmark, ma nell’uso reale la capacità di gpt di risolvere problemi è imbattibile. Al momento della pubblicazione, i principali modelli più recenti della serie gpt5 includono gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
La finestra di rimborso aprirà entro una settimana dopo la festa, con scadenza il 6 marzo 2026. Accedi alla pagina del mio piano, clicca su annulla e rimborsa per completare con un clic. Nota: la finestra di rimborso termina il 3.6. Fratelli programmatori, ripensate alla vostra esperienza con Zhipu negli ultimi due mesi, credete alle vostre sensazioni e decidete con razionalità.
Inizialmente il compito era solo tradurre da cinese a inglese un’app nodejs che converte un mermaid in immagine, è uno strumento puro, il compito è solo tradurre. A questo punto, nell’uso del modello Zhipu ho incontrato i seguenti problemi: 1. limite di concorrenza estremamente basso, più ne hai bisogno, più la concorrenza è bassa 2. bassa velocità di generazione token 3….
Molti dicono che il pacchetto lite abbia una bassa concorrenza, ma forse non è chiaro quanto sia bassa. Lo spiego più chiaramente. C’è solo una concorrenza, il che significa che negli strumenti con meccanismo subagent, lite non può proprio funzionare. Ho acquistato vari prodotti AI per quattro o cinque anni, il pacchetto Zhipu è la più grande fregatura che abbia preso, è quasi inutilizzabile per la codifica. Ora può essere usato solo per la traduzione a thread singolo…
Dopo aver ricaricato 10 dollari su openrouter, si ha a disposizione una quota giornaliera di 1000 utilizzi dei modelli gratuiti; 1000 volte sono più che sufficienti per me per fare verifiche. Ma per un periodo di tempo piuttosto lungo, molti dei suoi modelli restituivano sempre errori 429, come openai/gpt-oss-120b:free ecc. Oggi ho testato manualmente vari metodi e alla fine ho confermato…
Sono rimasto sorpreso vedendolo, solo dopo ho capito che “plan” era stato tradotto come “pacchetto” GPT5.2high è lento in modo esasperante, GPT5.3 non è ancora uscito, ma 5.3-codex è uscito prima, nei test reali la velocità è migliorata nettamente, il calo della capacità logica non è così evidente come quello da GPT-5.2-Codex rispetto a GPT5.2, è un modello di codifica specializzato che vale la pena adottare…
L’app Qwen utilizza un’operazione di scorrimento a quattro direzioni, con la cronologia delle conversazioni e gli agenti a sinistra e il mercato degli agenti a destra. Quando la traiettoria di scorrimento sullo schermo non è verticale, ma somiglia a un tratto discendente (丿) o ascendente, il contenuto laterale viene richiamato, e per tornare all’interfaccia di conversazione non si scorre lo schermo, ma occorre eseguire un’operazione di ritorno, scivolando dal bordo dello schermo. Se la direzione è confusa, l’app si blocca. L’app Qwen…
Scomodo creare una nuova conversazione; dopo averne creata una nuova appare solo un popup di notifica, i messaggi storici rimangono al loro posto. Anche cambiando argomento si vede ancora la risposta alla domanda precedente, dandomi la sensazione che il contesto non sia stato cambiato, il che è insolito tra le numerose app di dialogo AI. Ma la soglia di utilizzo di Doubao è effettivamente più bassa, il che favorisce lo sviluppo dei suoi utenti.
Alcuni sviluppatori di modelli, all’inizio del lancio di una nuova versione, offrono una velocità di risposta ideale e senza degrado dell’intelligenza; se gli utenti aumentano, velocità ed effetti diminuiscono. Questa è la performance del leader: una volta che le prestazioni restano indietro, gli utenti se ne vanno e le schede accumulate restano inutilizzate. Per evitare questa situazione, si può considerare il disaccoppiamento tra asset pesanti e asset di proprietà intellettuale, vendendo i diritti d’uso del modello o noleggiando risorse hardware.
Archiviazione di un breve post su Xiaohongshu: Condiviso per chi è in gravidanza o si prepara al parto: un servizio molto conveniente del Tongji.
Archivio di un breve post su Xiaohongshu: Il mio primo computer con 16MB di RAM.
Archivio di un breve post su Xiaohongshu: Condividi un’impostazione di rimappatura del mouse adatta ai programmatori.
Archivio di un breve post su Xiaohongshu: Per favore impara a cucinare, va bene?.
Archivio di un breve post su Xiaohongshu: Computer per imparare solo programmazione, niente giochi.
Archivio di un breve post su Xiaohongshu: Proteggi te stesso, stai lontano da chi ha bisogno delle regole della community per essere protetto.
Archivio di un breve post su Xiaohongshu: Cattive abitudini d’uso del computer classiche che portano a intrusioni.
Archivio di un breve post su Xiaohongshu: Che mal di testa ha Alipay per aggiungere la funzione video.
Archivio di un breve post su Xiaohongshu: Avrò l’autismo?
Archivio di un breve post su Xiaohongshu: Ho calmato mia moglie e ora sono ansioso anch’io.
Archivio di un breve post su Xiaohongshu riguardante la ricerca vittime di acquisto auto con garanzia di merce a Suzhou.
Archivio di un breve post su Xiaohongshu: La colpa di Apple è l’avidità.
Archivio di un breve post su Xiaohongshu: Nessuno scenario d’uso per le chiamate satellitari trovato, segnale anche in montagna selvaggia.