Waarom prijsverhoging mogelijk is door verbetering van token-efficiëntie van het model
Categories:
GPT5.5 is dubbel zo duur als GPT5.4, GPT5.4 is ongeveer 40% duurder dan GPT5.3codex, beide prijsverhogingen hebben een basislogica, namelijk verbetering van de token-efficiëntie. GPT5.2 is een model dat verschrikkelijk traag is, maar de GPT5-serie modellen hebben een hoge nauwkeurigheid bij het lokaliseren van problemen, weinig bugs, en kunnen de mentale belasting van het reviewen aanzienlijk verlagen, dus ik kon het niet over mijn hart verkrijgen om ze op te geven. Vanaf 5.3codex heeft elk nieuw GPT-model de snelheid duidelijk verhoogd. Volgens de officiële uitleg verlaagt het model, terwijl het de prestaties verbetert, de token-kosten van het denken. Dat wil zeggen, onder de voorwaarde dat de hardware hetzelfde blijft en de prestaties verbeteren, is het model meer “direct to the point” — ik begrijp dit als dat het model slimmer is, de logica helderder is, en het snel de juiste conclusie kan bedenken in plaats van meerdere keren te reflecteren. Wie een deel van de thought chains van open-source modellen heeft gezien, zal opmerken dat het denkproces grotendeels fout kan zijn, maar door meerdere keren te reflecteren en meerdere keren details toe te voegen, kan het uiteindelijk toch het juiste antwoord krijgen, alleen is de thought chain langdradig en slecht. De denkefficiëntie van GPT5.5 is nu wel uniek in de industrie. Het nadenken van opus was ooit vrijwel nutteloos, en vanaf 4.7 heeft het ook “Heb je … nodig?”. Op basis van mijn ervaring is de aanbevelingsnauwkeurigheid na GPT5.4 al zeer hoog. Ik kijk ernaar uit dat onze modellen snel eens “stomen” tegen GPT5 in plaats van weer opus te “stomen”.

