Questa sensazione è irresistibile

Da quando la serie GPT5 è stata rilasciata sei mesi fa, il suo rigore logico è all’avanguardia, ma il difetto più criticato è la sua velocità piuttosto lenta, specialmente GPT5.2, lento in modo incredibile; per molte richieste comuni opus potrebbe impiegare 20 secondi a raccogliere il contesto e iniziare le modifiche, mentre GPT5.2 potrebbe analizzare per 20 minuti prima di iniziare a modificare. Il modello GPT5.2codex dello stesso periodo è leggermente più veloce, ma la logica è notevolmente ridotta. Successivamente il modello GPT5.3codex ha bilanciato logica e velocità, e il modello codex è diventato utilizzabile. Le capacità di codice di GPT5.4 sono state integrate nel modello principale, senza più rilasciare separatamente il modello codex, e la sua velocità è notevolmente migliorata. Si dice che l’efficacia per token sia aumentata, quindi può ragionare di meno per raggiungere una precisione simile.

Da quando la serie GPT5 è stata rilasciata sei mesi fa, il suo rigore logico è all’avanguardia, ma il difetto più criticato è la sua velocità piuttosto lenta, specialmente GPT5.2, lento in modo incredibile; per molte richieste comuni opus potrebbe impiegare 20 secondi a raccogliere il contesto e iniziare le modifiche, mentre GPT5.2 potrebbe analizzare per 20 minuti prima di iniziare a modificare. Il modello GPT5.2codex dello stesso periodo è leggermente più veloce, ma la logica è notevolmente ridotta. Successivamente il modello GPT5.3codex ha bilanciato logica e velocità, e il modello codex è diventato utilizzabile. Le capacità di codice di GPT5.4 sono state integrate nel modello principale, senza più rilasciare separatamente il modello codex, e la sua velocità è notevolmente migliorata. Si dice che l’efficacia per token sia aumentata, quindi può ragionare di meno per raggiungere una precisione simile. Chi osserva la catena di pensiero degli LLM noterà che, presupponendo una conclusione corretta, non tutti i ragionamenti nella catena sono corretti: vi sono numerosi errori. GPT5.4 ha ridotto i ragionamenti inefficaci per aumentare la velocità; personalmente lo interpreto come un modello più intelligente. Allo stesso tempo, la CLI codex ha aperto la modalità fast; si stima che consumi il doppio della quota, con una velocità 1,5 volte superiore. Recentemente mi sono concesso lusso attivando fast, e ritengo che la velocità percepita sia ormai molto vicina a opus, con al contempo una capacità di analisi logica superiore. Inoltre ho notato che, dopo aver attivato fast, i due intervalli di cinque ore potrebbero esaurire la quota settimanale in un solo giorno, ovvero con carico elevato (GPT5.4 fast), la quota settimanale plus/team può essere consumata in un solo giorno. In precedenza avevo raccomandato cliproxyapi, dedicato alla commutazione degli account codex; di recente ho scoperto che la sua implementazione API è incompleta, quindi ho sviluppato un proprio commutatore di account per sfruttare bene la falla di team per un po’. Open source su: github.com/jqknono/codex-account-switch Modo rapido per usarlo: npx codex-account-switch

Immagine 1 per Questa sensazione è irresistibile

Immagine 2 per Questa sensazione è irresistibile