Het belangrijkste is het model, het verschil in harness is niet zo groot. Onlangs heeft A/ enkele openingen vrijgegeven voor reverse proxy, het is de moeite waard om andere harness-tools te proberen. opencode, copilot cli zijn allemaal goed.
Standaard wordt het stepfun-model gebruikt om de persoonlijke gegevens die via de GitHub-API kunnen worden verkregen te beoordelen, best leuk https://githubroast.dev/ #vibecoding大赏[话题]#
Ik raadde altijd het liefst chatgpt plus aan, maar een paar dagen geleden blokkeerde chatgpt mijn codex. Bij het opnieuw inloggen op codex is sms-tweefactorauthenticatie vereist. Omdat het een telefoonnummer van een SMS-ontvangstplatform was, ondersteunt openai geen zelfservice voor het wijzigen van het gebonden telefoonnummer, dus het hoofdaccount is eigenlijk waardeloos. Ik ben overgestapt om supergrok te proberen, en de composer die het biedt…
Het model van Zhipu presteert redelijk, maar de engineeringcapaciteit is beperkt, wat abonnees kunnen merken aan de servicekwaliteit. De sterkte van glm5.2 is streng logisch denken, ten koste van lage token-efficiëntie, wat leidt tot een relatief hoge totale prijs. Stel dat de meeste gebruikers inderdaad goede modellen waarderen, maar met hun voeten stemmen op kosteneffectieve modellen, dan winnen de kosteneffectieve aanbieders de gebruikers. Stel dat de werkelijke winstgevendheid van AI-modelaanbieders lijkt op…
Maak meerdere werkruimtes aan, elke werkruimte kan een go abonneren, werkruimtes kunnen vrij worden aangemaakt. Je hoeft geen meerdere accounts aan te maken, tenzij je de 5 dollar wilt scoren.
De tweede afbeelding bewijst onmiskenbaar dat het officieel is, de vertrouwde 1302-smaak. Vanaf 6.18 stabiel te gebruiken, de snelheid is ook behoorlijk goed, misschien gebruikt de leverancier z.ai niet meer. In gebruik voelt het op codegebied sterker dan deepseekv4pro, het foutpercentage van scripts is flink gedaald. Natuurlijk is de prijs ook vele malen hoger. Van Chinese modellen raad ik alleen deepseek aan, ik kijk uit naar hun snelle ondersteuning voor multimodaal.
Eerste pagina, vlak voor de aflossingsdatum is het belangrijkst om “te gaan aflossen”, niet om “gemakkelijk af te lossen”, maar de visuele nadruk ligt op “gemakkelijk af te lossen”. “Gemakkelijk af te lossen” is eigenlijk aflossing in termijnen. Tweede pagina, het belangrijkste is “hoeveel is de rente”, niet “hoeveel rente is verlaagd”, de hele pagina toont niet hoeveel de rente is, de visuele nadruk ligt op “nationale rentevergoeding”. Derde pagina, de visuele nadruk ligt op een jaarlijks effetief tarief van 15,16%, nog steeds geen totaal rentebedrag weergegeven, maar wel 62,8 yuan per termijn weergegeven, handmatig berekend is 1507,32 yuan, de samengestelde jaarlijkse rente is 16,5%
Niet goedkoop, vooral de manier waarop het verbruik van het tegoed wordt berekend, invoer en uitvoer tellen beiden mee in het plan. Ik heb vaak 20 miljoen tokens per enkele aanvraag, het 59 yuan-abonnement is slechts genoeg voor 3 aanvragen. Voor coderen is ongeveer 99% van de invoer invoercache, cache-hits worden tegen de normale prijs berekend wat nogal belachelijk is. Als ze willen dat mensen het gebruiken, tel dan de invoer niet mee en reken alleen de uitvoer tot het tegoed,…
copilot was van afgelopen februari tot juli onbeperkt te gebruiken in vscode insider, ik heb in deze periode gezien hoe de agent-capaciteiten van copilot geleidelijk achteruitgingen. Het is moeilijk voor te stellen dat de eerste maand preview-versie van copilot eigenlijk het beste werkte, waarna de agent-capaciteiten geleidelijk daalden. Wat is er precies veranderd? Het is dat copi…
In het afgelopen anderhalf jaar hebben sommige bedrijven de rol van AI overschat en ontslagen doorgevoerd. Naarmate de tijd verstreek, ontdekten bedrijven geleidelijk dat AI niet zo slim en goedkoop was als verwacht, en begonnen ze het AI-tokenverbruik te verminderen en ontslagen te vertragen. Een heel belangrijke reden is dat AI niet goedkoop is en geen schuld kan dragen. Voorheen maakten sommige sectoren grappen over het feit dat AI niet in de gevangenis kan belanden, maar op basis van mijn eigen werkervaring zit daar zeker enige logica in.
Hoewel sommige berichten van netizens inderdaad het probleem van ‘het paard dat de rivier oversteekt’ hebben, is het toch niet nodig om de eekhoorn niet te laten zeggen dat het water erg diep is. In vergelijkende berichten zijn er vaak verliezers en winnaars, ik weet niet of er in de toekomst geen verliezers meer mogen zijn. Sommige fabrikanten overdrijven inderdaad met hun gebluf, of de beperkingen in hun ranglijsten zijn exotisch, wat gewone consumenten gemakkelijk kan misleiden. Eerder werd productkritiek gedeeld op basis van eigen ervaring om valkuilen te vermijden, daarna…
Ik publiceerde eerder een bericht waarin ik mimo-2.5-pro bekritiseerde omdat de prestaties de prijsstelling niet rechtvaardigden. De prestaties kunnen echt niet tippen aan gpt5.x en opus4.x. Niet dat ik ze wilde vergelijken, maar Xiaomi wilde ze vergelijken, dus wees ik op het duidelijke verschil. Maar nu Xiaomi deepseek als vergelijking neemt, denk ik dat er misschien nog een strijd mogelijk is. LLM’s verkopen…
Kenmerken van vervallen architectuur zijn: veel speciale afhandeling, compatibiliteitsafhandeling, ernstige koppeling, onomkeerbare last. Architectuur vervalt langzaam. Een vervallen architectuur maakt het moeilijk om nieuwe functies te ontwikkelen, bugs zijn moeilijk te repareren, alles hangt samen, waardoor testen en QA ook moeilijk te doen zijn. Ik zag ooit een bericht van een hobbyist in een andere branche die zei dat het beperken van het abstractiegedrag van het model bij het schrijven van code, de code begrijpelijker maakt. Code die makkelijker te begrijpen is voor mensen, is ook makkelijker te begrijpen voor LLM, dus snelle ontwikkeling en minder fouten. Ik denk dat de hobbyist in een andere branche waarschijnlijk een kleinere projectomvang heeft en gewend is aan lopende-band-logica. Als er verwachting is van schaalvergroting, mag de denkwijze niet beperkt blijven tot de lopende band, maar moet de mentaliteit van een bouwvakker worden gebruikt…
2,5 korting wordt direct permanent 1/4, geen hoeven te snelkopen, geen pakketten, geen 5u quotum wekelijks quotum te grinden, geen rustige/drukke tijden multiplier te berekenen, geen token- en credit-wisselkoers te berekenen, direct detailhandel is groothandel, geen trucs, allemaal oprecht.
De GPT5-serie heeft een hoog recall-percentage, kan zeer strikte logica realiseren, is ongeëvenaard voor het oplossen van bugs, en kan tegelijkertijd tijdig tegenstrijdigheden in de context opmerken, een ervaring die uniek is onder de huidige modellen. Maar onlangs ontdekte ik in mijn persoonlijke reverse-engineering project dat GPT5 beperkte reverse-engineering capaciteiten heeft, duidelijk minder dan het opus-model. Het geeft vaak expliciet aan dat iets niet werkt, terwijl opus…
AI schrijft veel te veel, bugs/regel zijn zeker minder, maar de regels exploderen in aantal, behoeften die je vroeger niet wilde schrijven worden nu snel geschreven, dus bugs nemen ook toe. Bovendien is AI ongeëvenaard in het opsporen van bugs van anderen, sommige verborgen bugs worden ontdekt. Populaire bibliotheken van grote bedrijven hebben niet zoals nu om de paar dagen grote bugs onthuld. Reverse engineering en aanvallen…
Ik heb eigenlijk een beetje een hekel aan het bedrijf anthropic, maar het is momenteel erg populair, dus ik moet het met tegenzin gebruiken. Ik heb een claudecode pro-abonnement genomen, de quota zijn erg klein, dus kan ik het alleen voor planning gebruiken. De prestaties van Chinese modellen zijn iets minder, maar de quota zijn groter, de prijs-kwaliteitverhouding is duidelijk beter. Chinese modelaanbieders bieden momenteel geen response API aan, dus…
Iemand deelt zeer lange en fancy prompts die beweren de prestaties van GPT5 te verbeteren, dit moet voorzichtig worden bekeken. GPT5 verschilt van de modellen vóór sonnet of opus4.6 in claudecode, de negatieve effecten van willekeurig aangepaste prompts schrijven zijn duidelijker. De systeemprompt van GPT5 moet zorgvuldig worden overwogen, anders verslechtert de modelprestatie gemakkelijk.
Mijn toepassingsscenario is voornamelijk coderen, en mijn projecten zijn voornamelijk commandoregeltools. Tencent HY3 Preview presteert goed in mijn toepassingsscenario, met goede instructieopvolging en dialectische logica. De CoBuddy coderingsmodel van Baidu dat onlangs op openrouter verscheen heb ik ook geprobeerd, het is slecht, na slechts twee keer gebruiken merk je de slechtere capaciteiten, de context is slechts 131…
Eerst de oude bekende openrouter, na het storten van 10 dollar, zijn er dagelijks 1000 gratis aanroepingen, meestal zijn er in de free-modellen enkele modellen met een redelijke prestatie. Het officiële beleid behoudt het recht om een geldigheidsduur voor het bedrag in te stellen, mogelijk een geldigheidsduur van een jaar, maar mijn 10 dollar van meer dan een jaar geleden is nog steeds geldig. Onlangs tijdelijk uit te proberen inclusionAI:Ling-2.6-1T en tencent:hy3 preview…
Ik heb tweehonderd free-accounts en één plus-account, aangesloten op cliproxyapi, en via reverse proxy gebruikt in verschillende cli’s. Deze accounts zijn voldoende voor zwaar persoonlijk gebruik. Als je 1M context, fast-modus, subagenten, en hd-beeldanalyse aanzet, dan reiken de tokens van deze honderden accounts nog steeds niet toe, en moet je ze gepland gebruiken. f…
GPT5.5 is dubbel zo duur als GPT5.4, GPT5.4 is ongeveer 40% duurder dan GPT5.3codex, beide prijsverhogingen hebben een basislogica, namelijk verbetering van de token-efficiëntie. GPT5.2 is een model dat verschrikkelijk traag is, maar de GPT5-serie modellen hebben een hoge nauwkeurigheid bij het lokaliseren van problemen, weinig bugs, en kunnen de mentale belasting van het reviewen aanzienlijk verlagen…
Sommige mensen delen dat het model van Xiaomi langdurige taken kan uitvoeren, honderden tool calls zonder fouten, ik weet niet wie deze testrichting is begonnen, het is alsof je zegt dat een student 100 minuten in de examenzaal kan blijven zonder naar de wc te gaan, het heeft geen zin. Wij normale mensen begrijpen dat voor een examengerichte test, het enige wat echt belangrijk is het cijfer, als we iets soepeler zijn, het cijfer meer dan 95% van het beoordelingssysteem weegt, meestal kijk je eerst naar het cijfer en dan naar andere prestaties, als het cijfer laag is hoef je niet verder te kijken…
En verkreeg de eerste responstijd en token-snelheid van een deel van de fabrikanten om 16:00 uur Beijing-tijd, heb het enkele maanden zelf gebruikt, iedereen is welkom om te bezoeken en waardevolle feedback te geven! Projectlink: #https://github.com/jqknono/coding-plans-for-copilot
Met mijn kleine project een Xiaomi pro plan bemachtigd, deze maand even proberen. Het project is een vscode-plugin die elke chat-completion/responses/anthropic-compatibele API aansluit op github copilot. Projectadres: #https://github.com/…
Ik ben nog steeds een beetje in de war. Als ik een strategie had die geld kon verdienen, zou ik zeker een lening afsluiten en alles erin gooien, en zou ik die strategie nooit zomaar delen. Wat willen die vele mensen online dan bereiken door strategieën te delen? #kwantitatieve handel[onderwerp]# #kwantitatief[onderwerp]# #financiële investering[onderwerp]#
Het is misschien een beetje laat om nu te zeggen dat ik vlucht uit cursor, maar eigenlijk ben ik in een half jaar geleidelijk minder cursor gaan gebruiken, omdat mijn codeergewoonten zijn veranderd en de sterke punten van cursor niet langer de reden zijn om het te kiezen. De eigenschap waarmee cursor tot op heden nog steeds op de eerste plaats staat, is zijn unieke aanvullingsmodel dat aanvulling over regels en bestanden heen ondersteunt, en op het gebied van…
Het algemeen bekende voordeel van Anthropic is gezond verstand, d.w.z. common sense. Sommige ontwikkelingswerkzaamheden steunen op gezond verstand, andere op eigen logica. De redeneerstijl van opus is om veel mogelijkheden te gissen en deze vervolgens snel te verifiëren. GPT5 neigt te redeneren volgens de code-implementatie en ontleedt het bedrijf herhaaldelijk. Qua stijl lijkt het op het verschil tussen breedte-eerst en diepte-eerst. Naarmate…
Weer geld terug, ik geef de resources door aan de jongens. 40 euro per maand is goedkoop, maar overdag mag je het niet gebruiken en ’s nachts moet ik slapen, dit is geen lite-abonnement, dit is een night-abonnement! Terugbetalingsvragenlijst, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Dit is de derde keer dat ik in de val van Zhipu trap. Ze zeiden dat ze oude gebruikers wilden behouden en gaven een onbeperkte weeklimiet, dus kwam ik terug om het opnieuw te proberen, maar weer werd ik bedrogen. Er is geen weeklimiet, maar wanneer ik het nodig heb, werkt het gewoon niet. Als ik net op mijn werk aankom of net klaar ben met werken, komt het weer tot leven, alsof we op het hoogtepunt elkaar ontmoeten. In februari zei ik dat Zhipu lite single concurrency had, en Zhipu gebruikte het bedrijfscertificaat om bij xhs te rapporteren dat ze mijn account wilden blokkeren wegens laster.
Het kostennarratief is ongeschikt voor de grote-modelindustrie. Iedereen maakt verlies, zelfs de winnaars. De verliezers vinden dat het zo niet verder kan, hebben niet de macht om de winnaars tot prijsverhoging te bewegen, en besluiten eerst hun eigen achterlopende producten in prijs te verhogen. Dat is het kapotmaken van wat toch al kapot is en je eigen graf graven. Binlandse open-source modelleveranciers die naam maken, sluiten hun modellen altijd nadat ze enige concurrentiekracht hebben, qwen3.6/minim…
Ik gebruik vscode al tien jaar en zie voor het eerst een thema-update. Vergeleken met het oorspronkelijke standaardthema zijn er minder kleurblokken, het zwart is zwarter en het wit is witter. #vscode[onderwerp]#
Sinds de release van de GPT5-serie een half jaar geleden, loopt deze voorop in logische nauwkeurigheid, maar het meest bekritiseerde is de relatief trage snelheid, vooral GPT5.2, die verschrikkelijk traag is; veel gewone verzoeken beginnen met opus mogelijk al na 20 seconden contextverzameling met de wijzigingen, terwijl GPT5.2 waarschijnlijk 20 minuten analyseert voordat het begint met wijzigen. Het GPT5.2codex-model uit dezelfde periode is iets sneller, maar de logica is duidelijk verminderd. Daarna bracht het GPT5.3codex-model logica en snelheid in balans, en het codex-model werd bruikbaar. GPT5.4 integreerde codemogelijkheden in het hoofdmodel, zonder apart codex-model uit te brengen, en de snelheid nam duidelijk toe. Naar verluidt is de effectiviteit per token toegenomen, waardoor met minder denken een vergelijkbare nauwkeurigheid wordt bereikt.
Ook zonder server werd inbreuk beoordeeld, omdat werd verwezen naar illegale boekbronnen en werd verdiend via een officieel account. Zelfs als je de illegale kopie niet zelf hebt gemaakt, is delen niet toegestaan #persoonlijkeontwikkelaar[onderwerp]# #letopzefraude[onderwerp]#
Aan de kant van Claude is de prijs van max5x vijf keer die van pro, en ook het verbruik is vijf keer; de prijs van max20x is tien keer, het verbruik is 20 keer. Aan de kant van OpenAI is pro zes keer plus, review is tien keer, de prijs-kwaliteitverhouding is moeilijk te beoordelen. Natuurlijk heeft het ook het voorrecht van prioriteitsbehandeling van verzoeken, ik weet niet zeker hoeveel sneller het is. Ik gebruik dagelijks chatdialogen, met extend thinking voelt het gemiddeld ongeveer vijf minuten per vraag…
#https://jqknono.github.io/coding-plans-for-copilot/ Verzamelde binnenlandse en buitenlandse open-source modelpakketten, evenals de latentie en token-snelheid van aanbieders
Alleen geselecteerd en georganiseerd van binnenlandse fabrikanten met enige reputatie, geen doorverkoopstations, veiligheid enigszins gegarandeerd. In de praktijk zijn eerste-teken-latentie, token-snelheid, gelijktijdige verbindingen, of het gekwantiseerd is, erg belangrijk maar worden door fabrikanten weinig genoemd. Daarentegen is snelheid belangrijker, echt. #jqknono.github.io/coding-plans-for-…
Toen ik het meest bestelde, had ik tegelijkertijd verschillende abonnementen genomen, die ik allemaal niet op kon maken; honderden per maand waren minstens de helft weggegooid geld. OpenAI heeft onlangs codex cli opengesteld voor gratis gebruikers, met een bepaald gratis wekelijks quotum; wie codex kent weet dat zijn quotum heel anders is dan dat van claudecode, en het is erg duurzaam. Ik heb zelf 6 accounts, aangesloten op c…
Zij die bekend zijn met LLM-evaluaties weten dat opus in diverse benchmarks vaak boven gpt staat, maar in de praktijk is het probleemoplossend vermogen van gpt ongeëvenaard. Op het moment van posten zijn de nieuwste hoofdmodellen van de gpt5-serie gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
Het terugbetalingsvenster opent binnen een week na het festival en sluit op 6 maart 2026. Ga dan naar de pagina Mijn abonnement en klik op Annuleren en terugbetalen om het met één klik te voltooien. Let op: dit terugbetalingsvenster sluit op 3.6. Programmeurs, denk terug aan uw ervaring met Zhipu in de afgelopen twee maanden, geloof uw eigen gevoel en neem een rationele beslissing.
Ten eerste was de taak slechts het vertalen van Chinees naar Engels voor een nodejs-applicatie die een mermaid omzet in een afbeelding. Dit is een puur hulpmiddel en de taak was alleen vertalen. Tot nu toe ben ik tijdens het gebruik van het Zhiwu-model de volgende problemen tegengekomen: 1. Zeer lage gelijktijdige limiet, hoe meer je het nodig hebt, hoe lager de gelijktijdigheid 2. Lage token-genereratiesnelheid 3….
Veel mensen zeggen dat het lite-abonnement een lage gelijktijdigheid heeft, maar zeggen misschien niet duidelijk hoe laag het precies is. Ik zal het iets duidelijker uitleggen. Slechts één gelijktijdige verbinding. Dit betekent dat in tools met een subagent-mechanisme lite helemaal niet kan draaien. Ik koop al vier of vijf jaar allerlei AI-producten en het Zhipu-abonnement is de grootste zwendel die ik heb meegemaakt; het kan bijna niet worden gebruikt voor coderen. Nu kan het alleen nog worden gebruikt voor eendraadse vertaling…
Na het storten van 10 dollar op openrouter krijg je dagelijks 1000 gratis modelgebruiksquota, en 1000 keer is ruimschoots voldoende voor mij om te valideren. Maar gedurende een behoorlijk lange periode gaven veel van zijn modellen altijd 429-fouten terug, zoals openai/gpt-oss-120b:free enz. Vandaag heb ik handmatig verschillende methoden getest en uiteindelijk bevestigd…
Open-source adres github:jqknono/reference-Harmony Belangrijkste functies zie figuur, toont sneltoetsen en veelgebruikte commando’s van diverse populaire ontwikkeltools, deze kunnen helpen de werkefficiëntie te verbeteren. “Ontwikkelsnelreferentie” heeft een heldere architectuur, eenvoudige en gefocuste functies, zal in de toekomst geen advertenties plaatsen, en voldoet volledig aan het app-beoordelingsbeleid van Huawei. In december…
Was even in de war toen ik het zag, pas toen begreep ik dat “plan” vertaald was als “abonnement” GPT5.2high is verschrikkelijk traag, GPT5.3 is er nog niet, 5.3-codex kwam eerst uit, in de praktijktest is de snelheid duidelijk verbeterd, de afname in logische capaciteit is niet zo sterk als die van GPT-5.2-Codex ten opzichte van GPT5.2, het is een gespecialiseerd coderingsmodel dat het waard is om naar over te stappen…
De Qianwen-app werkt met vier-richtingen veegbewegingen, links de chatgeschiedenis en agents, rechts de agent-markt. Wanneer het veegspoor op het scherm niet recht omhoog of omlaag is, maar lijkt op een haal naar links (丿) of naar rechts, wordt de zijinhoud geopend. Om terug te keren naar het chatscherm moet je niet over het scherm vegen, maar een terug-actie uitvoeren en vanaf de schermrand naar binnen vegen om terug te keren. Als de richtingen verward raken, crasht de app. De Qianwen-app…
Het is onhandig om een nieuw gesprek te starten; na het starten van een nieuw gesprek verschijnt er slechts een pop-upmelding, terwijl de geschiedenis op de oorspronkelijke plek blijft staan. Wanneer je van onderwerp wisselt, zie je nog steeds het antwoord op de vorige vraag, wat het gevoel geeft dat de context nog niet is gewisseld. Dit is ongebruikelijk onder de vele AI-chatapps. Maar de drempel om Doubao te gebruiken is inderdaad lager, wat gunstig is voor het werven van gebruikers.
Sommige modelontwikkelaars bieden bij de lancering van een nieuwe versie een ideale responssnelheid en geen verminderde intelligentie; als er meer mensen gaan gebruiken, nemen snelheid en effect af. Dit is het gedrag van een marktleider: zodra de prestaties achterblijven, lopen gebruikers weg en staan de gehamsterde kaarten idle. Om dit te voorkomen kan men overwegen zwaar activa en intellectuele eigendomsactiva te ontkoppelen, het gebruiksrecht van het model te verkopen, of hardwarebronnen te huren.
Archief van een kort Xiaohongshu-bericht: Huawei dacht er om twee uur ’s nachts drie keer over na en zag uiteindelijk af van het bestellen van een late snack voor mij.
Archief van de korte Xiaohongshu-post getiteld ‘Alleen de hemel weet het, alleen de aarde weet het, jij weet het, ik weet het, de goden weten het, de geesten weten het, wat is dan onwetendheid?’.