Het belangrijkste is het model, het verschil in harness is niet zo groot. Onlangs heeft A/ enkele openingen vrijgegeven voor reverse proxy, het is de moeite waard om andere harness-tools te proberen. opencode, copilot cli zijn allemaal goed.
Standaard wordt het stepfun-model gebruikt om de persoonlijke gegevens die via de GitHub-API kunnen worden verkregen te beoordelen, best leuk https://githubroast.dev/ #vibecoding大赏[话题]#
Ik raadde altijd het liefst chatgpt plus aan, maar een paar dagen geleden blokkeerde chatgpt mijn codex. Bij het opnieuw inloggen op codex is sms-tweefactorauthenticatie vereist. Omdat het een telefoonnummer van een SMS-ontvangstplatform was, ondersteunt openai geen zelfservice voor het wijzigen van het gebonden telefoonnummer, dus het hoofdaccount is eigenlijk waardeloos. Ik ben overgestapt om supergrok te proberen, en de composer die het biedt…
De tweede afbeelding bewijst onmiskenbaar dat het officieel is, de vertrouwde 1302-smaak. Vanaf 6.18 stabiel te gebruiken, de snelheid is ook behoorlijk goed, misschien gebruikt de leverancier z.ai niet meer. In gebruik voelt het op codegebied sterker dan deepseekv4pro, het foutpercentage van scripts is flink gedaald. Natuurlijk is de prijs ook vele malen hoger. Van Chinese modellen raad ik alleen deepseek aan, ik kijk uit naar hun snelle ondersteuning voor multimodaal.
Niet goedkoop, vooral de manier waarop het verbruik van het tegoed wordt berekend, invoer en uitvoer tellen beiden mee in het plan. Ik heb vaak 20 miljoen tokens per enkele aanvraag, het 59 yuan-abonnement is slechts genoeg voor 3 aanvragen. Voor coderen is ongeveer 99% van de invoer invoercache, cache-hits worden tegen de normale prijs berekend wat nogal belachelijk is. Als ze willen dat mensen het gebruiken, tel dan de invoer niet mee en reken alleen de uitvoer tot het tegoed,…
In het afgelopen anderhalf jaar hebben sommige bedrijven de rol van AI overschat en ontslagen doorgevoerd. Naarmate de tijd verstreek, ontdekten bedrijven geleidelijk dat AI niet zo slim en goedkoop was als verwacht, en begonnen ze het AI-tokenverbruik te verminderen en ontslagen te vertragen. Een heel belangrijke reden is dat AI niet goedkoop is en geen schuld kan dragen. Voorheen maakten sommige sectoren grappen over het feit dat AI niet in de gevangenis kan belanden, maar op basis van mijn eigen werkervaring zit daar zeker enige logica in.
Kenmerken van vervallen architectuur zijn: veel speciale afhandeling, compatibiliteitsafhandeling, ernstige koppeling, onomkeerbare last. Architectuur vervalt langzaam. Een vervallen architectuur maakt het moeilijk om nieuwe functies te ontwikkelen, bugs zijn moeilijk te repareren, alles hangt samen, waardoor testen en QA ook moeilijk te doen zijn. Ik zag ooit een bericht van een hobbyist in een andere branche die zei dat het beperken van het abstractiegedrag van het model bij het schrijven van code, de code begrijpelijker maakt. Code die makkelijker te begrijpen is voor mensen, is ook makkelijker te begrijpen voor LLM, dus snelle ontwikkeling en minder fouten. Ik denk dat de hobbyist in een andere branche waarschijnlijk een kleinere projectomvang heeft en gewend is aan lopende-band-logica. Als er verwachting is van schaalvergroting, mag de denkwijze niet beperkt blijven tot de lopende band, maar moet de mentaliteit van een bouwvakker worden gebruikt…
2,5 korting wordt direct permanent 1/4, geen hoeven te snelkopen, geen pakketten, geen 5u quotum wekelijks quotum te grinden, geen rustige/drukke tijden multiplier te berekenen, geen token- en credit-wisselkoers te berekenen, direct detailhandel is groothandel, geen trucs, allemaal oprecht.
De GPT5-serie heeft een hoog recall-percentage, kan zeer strikte logica realiseren, is ongeëvenaard voor het oplossen van bugs, en kan tegelijkertijd tijdig tegenstrijdigheden in de context opmerken, een ervaring die uniek is onder de huidige modellen. Maar onlangs ontdekte ik in mijn persoonlijke reverse-engineering project dat GPT5 beperkte reverse-engineering capaciteiten heeft, duidelijk minder dan het opus-model. Het geeft vaak expliciet aan dat iets niet werkt, terwijl opus…
AI schrijft veel te veel, bugs/regel zijn zeker minder, maar de regels exploderen in aantal, behoeften die je vroeger niet wilde schrijven worden nu snel geschreven, dus bugs nemen ook toe. Bovendien is AI ongeëvenaard in het opsporen van bugs van anderen, sommige verborgen bugs worden ontdekt. Populaire bibliotheken van grote bedrijven hebben niet zoals nu om de paar dagen grote bugs onthuld. Reverse engineering en aanvallen…
Ik heb eigenlijk een beetje een hekel aan het bedrijf anthropic, maar het is momenteel erg populair, dus ik moet het met tegenzin gebruiken. Ik heb een claudecode pro-abonnement genomen, de quota zijn erg klein, dus kan ik het alleen voor planning gebruiken. De prestaties van Chinese modellen zijn iets minder, maar de quota zijn groter, de prijs-kwaliteitverhouding is duidelijk beter. Chinese modelaanbieders bieden momenteel geen response API aan, dus…
Mijn toepassingsscenario is voornamelijk coderen, en mijn projecten zijn voornamelijk commandoregeltools. Tencent HY3 Preview presteert goed in mijn toepassingsscenario, met goede instructieopvolging en dialectische logica. De CoBuddy coderingsmodel van Baidu dat onlangs op openrouter verscheen heb ik ook geprobeerd, het is slecht, na slechts twee keer gebruiken merk je de slechtere capaciteiten, de context is slechts 131…
Eerst de oude bekende openrouter, na het storten van 10 dollar, zijn er dagelijks 1000 gratis aanroepingen, meestal zijn er in de free-modellen enkele modellen met een redelijke prestatie. Het officiële beleid behoudt het recht om een geldigheidsduur voor het bedrag in te stellen, mogelijk een geldigheidsduur van een jaar, maar mijn 10 dollar van meer dan een jaar geleden is nog steeds geldig. Onlangs tijdelijk uit te proberen inclusionAI:Ling-2.6-1T en tencent:hy3 preview…
Ik heb tweehonderd free-accounts en één plus-account, aangesloten op cliproxyapi, en via reverse proxy gebruikt in verschillende cli’s. Deze accounts zijn voldoende voor zwaar persoonlijk gebruik. Als je 1M context, fast-modus, subagenten, en hd-beeldanalyse aanzet, dan reiken de tokens van deze honderden accounts nog steeds niet toe, en moet je ze gepland gebruiken. f…
GPT5.5 is dubbel zo duur als GPT5.4, GPT5.4 is ongeveer 40% duurder dan GPT5.3codex, beide prijsverhogingen hebben een basislogica, namelijk verbetering van de token-efficiëntie. GPT5.2 is een model dat verschrikkelijk traag is, maar de GPT5-serie modellen hebben een hoge nauwkeurigheid bij het lokaliseren van problemen, weinig bugs, en kunnen de mentale belasting van het reviewen aanzienlijk verlagen…
Sommige mensen delen dat het model van Xiaomi langdurige taken kan uitvoeren, honderden tool calls zonder fouten, ik weet niet wie deze testrichting is begonnen, het is alsof je zegt dat een student 100 minuten in de examenzaal kan blijven zonder naar de wc te gaan, het heeft geen zin. Wij normale mensen begrijpen dat voor een examengerichte test, het enige wat echt belangrijk is het cijfer, als we iets soepeler zijn, het cijfer meer dan 95% van het beoordelingssysteem weegt, meestal kijk je eerst naar het cijfer en dan naar andere prestaties, als het cijfer laag is hoef je niet verder te kijken…
En verkreeg de eerste responstijd en token-snelheid van een deel van de fabrikanten om 16:00 uur Beijing-tijd, heb het enkele maanden zelf gebruikt, iedereen is welkom om te bezoeken en waardevolle feedback te geven! Projectlink: #https://github.com/jqknono/coding-plans-for-copilot
Met mijn kleine project een Xiaomi pro plan bemachtigd, deze maand even proberen. Het project is een vscode-plugin die elke chat-completion/responses/anthropic-compatibele API aansluit op github copilot. Projectadres: #https://github.com/…
Ik ben nog steeds een beetje in de war. Als ik een strategie had die geld kon verdienen, zou ik zeker een lening afsluiten en alles erin gooien, en zou ik die strategie nooit zomaar delen. Wat willen die vele mensen online dan bereiken door strategieën te delen? #kwantitatieve handel[onderwerp]# #kwantitatief[onderwerp]# #financiële investering[onderwerp]#
Het is misschien een beetje laat om nu te zeggen dat ik vlucht uit cursor, maar eigenlijk ben ik in een half jaar geleidelijk minder cursor gaan gebruiken, omdat mijn codeergewoonten zijn veranderd en de sterke punten van cursor niet langer de reden zijn om het te kiezen. De eigenschap waarmee cursor tot op heden nog steeds op de eerste plaats staat, is zijn unieke aanvullingsmodel dat aanvulling over regels en bestanden heen ondersteunt, en op het gebied van…
Weer geld terug, ik geef de resources door aan de jongens. 40 euro per maand is goedkoop, maar overdag mag je het niet gebruiken en ’s nachts moet ik slapen, dit is geen lite-abonnement, dit is een night-abonnement! Terugbetalingsvragenlijst, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Dit is de derde keer dat ik in de val van Zhipu trap. Ze zeiden dat ze oude gebruikers wilden behouden en gaven een onbeperkte weeklimiet, dus kwam ik terug om het opnieuw te proberen, maar weer werd ik bedrogen. Er is geen weeklimiet, maar wanneer ik het nodig heb, werkt het gewoon niet. Als ik net op mijn werk aankom of net klaar ben met werken, komt het weer tot leven, alsof we op het hoogtepunt elkaar ontmoeten. In februari zei ik dat Zhipu lite single concurrency had, en Zhipu gebruikte het bedrijfscertificaat om bij xhs te rapporteren dat ze mijn account wilden blokkeren wegens laster.
Sinds de release van de GPT5-serie een half jaar geleden, loopt deze voorop in logische nauwkeurigheid, maar het meest bekritiseerde is de relatief trage snelheid, vooral GPT5.2, die verschrikkelijk traag is; veel gewone verzoeken beginnen met opus mogelijk al na 20 seconden contextverzameling met de wijzigingen, terwijl GPT5.2 waarschijnlijk 20 minuten analyseert voordat het begint met wijzigen. Het GPT5.2codex-model uit dezelfde periode is iets sneller, maar de logica is duidelijk verminderd. Daarna bracht het GPT5.3codex-model logica en snelheid in balans, en het codex-model werd bruikbaar. GPT5.4 integreerde codemogelijkheden in het hoofdmodel, zonder apart codex-model uit te brengen, en de snelheid nam duidelijk toe. Naar verluidt is de effectiviteit per token toegenomen, waardoor met minder denken een vergelijkbare nauwkeurigheid wordt bereikt.
#https://jqknono.github.io/coding-plans-for-copilot/ Verzamelde binnenlandse en buitenlandse open-source modelpakketten, evenals de latentie en token-snelheid van aanbieders
Zij die bekend zijn met LLM-evaluaties weten dat opus in diverse benchmarks vaak boven gpt staat, maar in de praktijk is het probleemoplossend vermogen van gpt ongeëvenaard. Op het moment van posten zijn de nieuwste hoofdmodellen van de gpt5-serie gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
Het terugbetalingsvenster opent binnen een week na het festival en sluit op 6 maart 2026. Ga dan naar de pagina Mijn abonnement en klik op Annuleren en terugbetalen om het met één klik te voltooien. Let op: dit terugbetalingsvenster sluit op 3.6. Programmeurs, denk terug aan uw ervaring met Zhipu in de afgelopen twee maanden, geloof uw eigen gevoel en neem een rationele beslissing.
Ten eerste was de taak slechts het vertalen van Chinees naar Engels voor een nodejs-applicatie die een mermaid omzet in een afbeelding. Dit is een puur hulpmiddel en de taak was alleen vertalen. Tot nu toe ben ik tijdens het gebruik van het Zhiwu-model de volgende problemen tegengekomen: 1. Zeer lage gelijktijdige limiet, hoe meer je het nodig hebt, hoe lager de gelijktijdigheid 2. Lage token-genereratiesnelheid 3….
Veel mensen zeggen dat het lite-abonnement een lage gelijktijdigheid heeft, maar zeggen misschien niet duidelijk hoe laag het precies is. Ik zal het iets duidelijker uitleggen. Slechts één gelijktijdige verbinding. Dit betekent dat in tools met een subagent-mechanisme lite helemaal niet kan draaien. Ik koop al vier of vijf jaar allerlei AI-producten en het Zhipu-abonnement is de grootste zwendel die ik heb meegemaakt; het kan bijna niet worden gebruikt voor coderen. Nu kan het alleen nog worden gebruikt voor eendraadse vertaling…
Open-source adres github:jqknono/reference-Harmony Belangrijkste functies zie figuur, toont sneltoetsen en veelgebruikte commando’s van diverse populaire ontwikkeltools, deze kunnen helpen de werkefficiëntie te verbeteren. “Ontwikkelsnelreferentie” heeft een heldere architectuur, eenvoudige en gefocuste functies, zal in de toekomst geen advertenties plaatsen, en voldoet volledig aan het app-beoordelingsbeleid van Huawei. In december…
De Qianwen-app werkt met vier-richtingen veegbewegingen, links de chatgeschiedenis en agents, rechts de agent-markt. Wanneer het veegspoor op het scherm niet recht omhoog of omlaag is, maar lijkt op een haal naar links (丿) of naar rechts, wordt de zijinhoud geopend. Om terug te keren naar het chatscherm moet je niet over het scherm vegen, maar een terug-actie uitvoeren en vanaf de schermrand naar binnen vegen om terug te keren. Als de richtingen verward raken, crasht de app. De Qianwen-app…
Het is onhandig om een nieuw gesprek te starten; na het starten van een nieuw gesprek verschijnt er slechts een pop-upmelding, terwijl de geschiedenis op de oorspronkelijke plek blijft staan. Wanneer je van onderwerp wisselt, zie je nog steeds het antwoord op de vorige vraag, wat het gevoel geeft dat de context nog niet is gewisseld. Dit is ongebruikelijk onder de vele AI-chatapps. Maar de drempel om Doubao te gebruiken is inderdaad lager, wat gunstig is voor het werven van gebruikers.
Sommige modelontwikkelaars bieden bij de lancering van een nieuwe versie een ideale responssnelheid en geen verminderde intelligentie; als er meer mensen gaan gebruiken, nemen snelheid en effect af. Dit is het gedrag van een marktleider: zodra de prestaties achterblijven, lopen gebruikers weg en staan de gehamsterde kaarten idle. Om dit te voorkomen kan men overwegen zwaar activa en intellectuele eigendomsactiva te ontkoppelen, het gebruiksrecht van het model te verkopen, of hardwarebronnen te huren.
Archief van een kort Xiaohongshu-bericht: Huawei dacht er om twee uur ’s nachts drie keer over na en zag uiteindelijk af van het bestellen van een late snack voor mij.