博客
華為token plan挺貴
Tuesday, June 09, 2026 在 博客
不便宜,特別是這個額度消耗的統計方式,輸入輸出都算在 plan 內。 我經常單次請求就 2kw tokens,59 元檔只夠我用 3 次請求。編碼用的話大概 99% 的輸入都是輸入快取,輸入快取命中按正價來算比較離譜。 如果想有人用,就不要算輸入,只把輸出計入額度,這樣才值得納入考慮。 比如阿里雲的 token plan,好歹區分了輸入和輸入快取,快取命中價格是 1/10,也算有些優惠。不知道華為這邊是確實沒快取命中,還是文件忘了寫。
github copilot的路线选择
Thursday, June 04, 2026 在 博客
copilot去年二月到七月在vscode insider中是可以無限使用的,我在這期間見證了copilot的agent能力的逐步衰弱。很難想像,copilot的首月預覽版竟然是效果最好的,之後agent能力逐步下降。 具體是什麼變化? 那就是copilot的開發演進方向,在過去一年多裡是「省token」。早期大家的agent讀檔案就是一次性全讀,qwen cli/claudecode/gemini/copilot早期都是這樣,效果非常好,只是token消耗估計有點大,上下文也會迅速填滿,如果重 …
擔心被優化更應該用AI
Thursday, June 04, 2026 在 博客
過去一年半裡, 一些企業高估AI的作用開啟了裁員, 隨著時間推移, 企業慢慢發現AI並沒有預想的聰明和便宜, 開始減少AI token消費, 減緩裁員.有一個很重要的原因就是AI不便宜, 且沒法背鍋. 以往一些行業以AI無法坐牢作為調侃, 但根據我的實際工作體驗, 它確有一定合理性. 以程式設計師為例, 我們首先分析AI完成所有的工作需要哪些資訊, 它需要控制瀏覽器, 需要登入密碼, 需要MFA多因素認證, ssh private key, git private key, 資料庫連線URL, …
我理解是不能隨便批評企業了
Saturday, May 30, 2026 在 博客
雖然網友部分發文裡的確會有小馬過河的問題,但也不至於不讓松鼠說水很深吧。 對比型的發文裡常有輸家贏家,不知道以後是不是不讓有輸家。 有些廠家確實吹牛吹過頭,或者排行榜的定語找得偏門,容易給一般消費者帶來誤導。 之前批評產品都是自己用過的來分享避坑,之後可能不能再做這些分享了,我會做一些「值得一試」的分享。
小米API排在llm性價比前列
Thursday, May 28, 2026 在 博客
之前發文批評mimo-2.5-pro性能支撐不了它的定價, 它的性能真的沒法對標gpt5.x和opus4.x, 並非我要拿它們對標, 是小米要對標它們, 所以我才發文指出差距明顯. 但現在小米改為對標deepseek, 我就覺得可能尚有一戰之力. 賣llm本就不應該根據成本來定價, 你領先就可以賺超額利潤, 落後就必須虧本求用戶用你, 然後搞點高質量數據來訓練.何況OpenAI還在虧, 而小米還沒虧呢.
架構腐化的一個因素是向開發代價妥協
Wednesday, May 27, 2026 在 博客
腐化的架構特徵有:大量的特殊處理、相容處理、耦合嚴重、積重難返。 架構都會慢慢腐化。腐化後的架構難以開發新特性,bug 難修,牽一髮動全身,導致測試和 QA 也很難做。 我曾看到有跨行開發愛好者發帖說,限制模型寫程式碼時的抽象行為,這樣程式碼更容易看得懂。人更容易看得懂的程式碼,LLM 也會更容易看得懂,因此可以快速開發且減少錯誤。我想跨行開發者大概工程量較小,習慣流水線式邏輯,如果有規模擴大的預期,思維方式不能侷限於流水線,而是使用建築工思維。預期蓋30層樓房子,即要打10米地基,預期通水通電 …
deepseek永遠在我的AIgateway裡佔一席之位
Friday, May 22, 2026 在 博客
2.5折直接變1/4永久,不用搶購,不用套餐,不用刷5h額度週額度,不用算閒時忙時倍率,不用算token和credit的兌換匯率,直接零售即批發,沒有套路,全是真誠。
適度遺忘有利於模型表現
Thursday, May 21, 2026 在 博客
GPT5系列有著高召回率,可以實現非常嚴謹的邏輯,用於解bug一絕,同時它能及時發覺上下文的前後矛盾之處,體驗在目前眾多模型裡獨一份。 但最近我在個人的逆向專案發現GPT5做逆向能力有限,明顯不如opus模型。它很多時候明確回覆行不通,而換opus就能很快實現功能逆向。opus將自己的逆向過程都記錄成操作嘗試歷史,在我數天的高強度使用下,歷史文件存在較多前後矛盾之處。GPT可以做到不輕信一處過時的說明,但過時資訊較多時,GPT5會難以正確處理。 也就是說GPT5系列模型在一個漏洞百出的低品質工程 …
AI寫的程式碼bug更少還是更多
Wednesday, May 20, 2026 在 博客
AI太能寫了,bugs/lines肯定更少,可是耐不住lines暴增,以前不想寫的需求現在咔咔寫,bug也越來越多。 另外AI查別人的bug也是一絕,一些隱藏的bug都被翻出來了。 以往的大廠或流行庫沒有像現在這樣隔幾天就爆出重大bug。逆向和攻擊變得更簡單,慢慢大家會意識到AI不止創造,之後的攻防可能會更有意思。