Pomysł na dalsze korzystanie z modelu A/
Ważny jest model, różnice w harnessie nie są tak duże. Ostatnio A/ odblokowało nieco możliwości dla odwrotnych proxy, warto wypróbować inne narzędzia harness, takie jak opencode, copilot cli itp.
Ważny jest model, różnice w harnessie nie są tak duże. Ostatnio A/ odblokowało nieco możliwości dla odwrotnych proxy, warto wypróbować inne narzędzia harness, takie jak opencode, copilot cli itp.
Modele Zhipu radzą sobie całkiem nieźle, ale możliwości inżynieryjne są ograniczone, co subskrybenci odczuwają w jakości usług. Zaletą glm5.2 jest rygorystyczne myślenie, kosztem jest jednak niska efektywność tokenów, co prowadzi do wyższej ceny całkowitej. Zakładając, że większość użytkowników rzeczywiście docenia dobrze działające modele, ale nogi głosują za modelami o dobrym stosunku ceny do jakości, wtedy producenci o dobrym stosunku ceny do jakości zdobędą użytkowników. Zakładając, że rzeczywista rentowność dostawców modeli AI przypomina fabrykę, kładąc nacisk na efekt skali i kontrolę kosztów, wtedy producenci o dobrym stosunku ceny do jakości łatwiej osiągają zysk…
AI nadciąga gwałtownie, przygotujmy się zawczasu
Wymaga skonfigurowania zaplanowanych zadań na komputerze, możesz to sam zbadać
W ciągu ostatnich półtora roku niektóre firmy przeceniły rolę AI i rozpoczęły zwolnienia. Wraz z upływem czasu przedsiębiorstwa powoli odkryły, że AI nie jest tak mądre i tanie, jak przewidywano, i zaczęły ograniczać zużycie tokenów AI oraz spowalniać zwolnienia. Bardzo ważnym powodem jest to, że AI nie jest tanie i nie może wziąć na siebie winy. W niektórych branżach dotychczas żartowano, że AI nie może pójść do więzienia, ale zgodnie z moim rzeczywistym doświadczeniem zawodowym, ma to pewną racjonalność…
Cechy skorumpowanej architektury to: wiele specjalnych obsług, obsług zgodności, silne sprzężenie, trudności z odwróceniem sytuacji. Architektury powoli ulegają korupcji. Skorumpowana architektura utrudnia tworzenie nowych funkcji, naprawę błędów, wszystko jest ze sobą powiązane, co utrudnia również testowanie i QA. Widziałem kiedyś post entuzjasty programowania z innej branży, który mówił, by ograniczyć zachowanie abstrakcji modelu podczas pisania kodu, aby kod był bardziej zrozumiały…
Seria GPT5 charakteryzuje się wysoką skutecznością odzyskiwania informacji i może realizować bardzo rygorystyczną logikę, co jest wyjątkowe w rozwiązywaniu błędów. Jednocześnie potrafi na bieżąco wykrywać sprzeczności w kontekście — doświadczenie to jest unikalne wśród wielu obecnych modeli. Ale niedawno w moim prywatnym projekcie inżynierii wstecznej odkryłem, że możliwości GPT5 w inżynierii wstecznej są ograniczone i wyraźnie gorsze niż modelu opus. W wielu przypadkach zwięźle odpowiada, że się nie da, podczas gdy opus szybko realizuje funkcjonalną inżynierię wsteczną…
Ktoś udostępnia bardzo długie i wymyślne prompty, rzekomo poprawiające działanie GPT5 — należy podchodzić do tego ostrożnie. GPT5 różni się od modeli sonnet lub opus4.6 i wcześniejszych w claudecode; negatywne skutki chaotycznego pisania własnych promptów są bardziej widoczne. Systemowe prompty GPT5 należy starannie przemyśleć, w przeciwnym razie łatwo pogorszyć jakość działania modelu.
Mój przypadek użycia to głównie pisanie kodu, a projekty to głównie narzędzia wiersza poleceń. Tencent HY3 Preview radzi sobie bardzo dobrze w moim przypadku użycia, dobrze przestrzega instrukcji i ma niezłą logikę dialektyczną. CoBuddy, model kodujący od Baidu niedawno dodany do openrouter, też przetestowałem, jest słaby, już po dwóch prostych użyciach widać gorsze możliwości, kontekst ma tylko 131…
Mam dwieście kont free i jedno konto plus, podłączone do cliproxyapi, odwrotnie proxy do różnych cli. Te konta wystarczą do intensywnego użytku osobistego, jeśli włączysz kontekst 1M, tryb fast, użyjesz subagentów, analizę obrazów HD, te kilkaset kont tokenów i tak będzie na wyczerpaniu, trzeba planować użycie. f…
Niektórzy dzielą się, że model Xiaomi może wykonywać długodystansowe zadania, setki wywołań tool call bez błędu, nie wiadomo kto zainicjował ten kierunek testów, to jak mówić, że uczeń może wytrzymać 100 minut w sali egzaminacyjnej bez pójścia do toalety, co nie ma sensu. My, normalni ludzie rozumiemy, że dla egzaminu sprawdzającego wiedzę, jedyną ważną rzeczą jest wynik, a jeśli nieco luźniej, wynik stanowi ponad 95% wagi systemu ocen…
I uzyskano czas odpowiedzi pierwszego znaku oraz szybkość tokenów niektórych dostawców o godzinie 16:00 czasu pekińskiego. Używam tego od kilku miesięcy, zapraszam do odwiedzin i przekazywania cennych uwag! Link do projektu: #https://github.com/jqknono/coding-plans-for-copilot
Mam jeszcze wątpliwości. Gdybym miał strategię, na której można zarabiać, zaciągnąłbym pożyczkę i postawił wszystko na jedną kartę, i nigdy nie udostępniłbym jej łatwo. Więc co zyskują ci, którzy udostępniają strategie w internecie? #handel_kwantytatywny[temat]# #kwantytatywny[temat]# #inwestycje_finansowe[temat]#
Powszechnie znanym atutem Anthropic jest zdrowy rozsądek, czyli common sense. Niektóre prace programistyczne opierają się na zdrowym rozsądku, inne na logice własnej. Styl wnioskowania opus to zgadywanie wielu możliwości, a następnie szybkie weryfikowanie. GPT5 ma tendencję wnioskować zgodnie z implementacją kodu, wielokrotnie porządkując logikę biznesową. Pod względem stylu przypomina to różnicę między przeszukiwaniem wszerz a w głąb. W miarę…
Narracja o kosztach nie pasuje do branży dużych modeli, wszyscy tracą pieniądze, nawet zwycięzcy tracą, przegrani uważają, że tak dalej być nie może, nie mają siły przekonać zwycięzców do podniesienia cen, więc postanawiają najpierw podnieść ceny własnych przestarzałych produktów, to bicie głową w mur i kopanie sobie grobu. Krajowi producenci otwartoźródłowych modeli zyskują rozgłos, a gdy ich modele zyskują pewną konkurencyjność, zamykają kod źródłowy, qwen3.6/minimax2.7/glm5.1turbo itp. nie zostały udostępnione, inne mniejsze firmy tylko trochę pozmieniają bazowe modele, zdestylują model zwycięzcy i chcą za to kasę, co jest zbyt naiwne.
Od pół roku od premiery serii GPT5, jej rygorystyczność logiczna jest wiodąca, ale najbardziej krytykowaną kwestią jest jej powolne tempo, zwłaszcza GPT5.2, które jest niewyobrażalnie wolne — wiele zwykłych żądań opus może po 20 sekundach zbierania kontekstu zacząć wprowadzać poprawki, podczas gdy GPT5.2 może potrzebować 20 minut analizy, zanim w ogóle zacznie zmieniać. Równoczesny model GPT5.2codex jest nieco szybszy, ale logika wyraźnie spada. Później model GPT5.3codex zrównoważył logikę i szybkość, dzięki czemu model codex stał się użyteczny. W GPT5.4 możliwości kodowania zostały włączone do głównego modelu, nie publikując już oddzielnego modelu codex, a jego szybkość wyraźnie wzrosła. Podobno wynika to ze zwiększonej efektywności na token, więc może myśleć mniej, by osiągnąć zbliżoną dokładność.
Kiedy zamawiałem najwięcej, jednocześnie wykupiłem kilka subskrypcji, a potem nie mogłem ich wykorzystać, co miesiąc przepadało co najmniej połowa z kilkuset yuanów. OpenAI niedawno udostępniło codex cli dla użytkowników darmowych, z pewnym darmowym tygodniowym limitem, a ci, którzy znają codex, wiedzą, że jego limit bardzo różni się od tego w claudecode i jest niezwykle trwały. Mam sam 6 kont podłączonych pod…
Po pierwsze, zadanie polegało jedynie na przetłumaczeniu aplikacji nodejs konwertującej mermaid na obraz z chińskiego na angielski, to czyste narzędzie, a zadanie to tylko tłumaczenie. Do tej pory podczas korzystania z modelu Zhipu napotkałem następujące problemy: 1. Bardzo niski limit współbieżności, im bardziej jest potrzebny, tym niższa współbieżność 2. Niska prędkość generowania tokenów 3….
Aplikacja Qianwen obsługuje cztery kierunki przesuwania: po lewej stronie znajdują się historia czatów i agenty, a po prawej rynek agentów. Gdy ślad przesunięcia na ekranie nie jest pionowy, lecz przypomina skos (丿) lub ukos, wywoływana jest zawartość boczna. Powrót do interfejsu czatu nie odbywa się przez przesuwanie ekranu, lecz przez operację powrotu — wsuwanie od krawędzi ekranu. Przy chaotycznych kierunkach aplikacja się zawiesza. Aplikacja Qianwen…
Archiwum krótkiego posta na Xiaohongshu pt. „Niebo wie, ziemia wie, ty wiesz, ja wiem, bogowie wiedzą, duchy wiedzą, co to niewiedza”.