ブログ

投稿カテゴリ 2026
  • AIが書いたコードのバグは少ないか多いか

    Wednesday, May 20, 2026 内 ブログ

    AIはめちゃくちゃ書けるので、bugs/linesは確実に少なくなるが、linesが爆増するのをどうにもできず、以前は書きたくなかった要件を今はガンガン書くので、バグもどんどん増えている。 また、AIが他人のバグを調べるのも一絶で、いくつかの隠れたバグまで掘り起こされている。 これまでの大企業や人気ライブラリは今のように数日おきに重大なバグが発覚することはなかった。リバースエンジニアリングや攻撃がより簡単になり、次第にAIは創造するだけでなく、その後の攻防がより面白くなることにみんな気づくだろう …

    続きを読む

  • claude codeに国産モデルを接続することを推奨

    Monday, May 18, 2026 内 ブログ

    私は実はanthropicという企業に少し嫌悪感を抱いているが、その勢いは盛んで、しかたなく使っている。claudecode proのサブスクリプションを契約したが、割り当て量は少なく、計画立案にしか使えない。国産モデルの性能はやや劣るものの、割り当て量はより多く、コストパフォーマンスの優位性が明らかである。 国産モデル事業者は現在いずれもresponse APIを提供していないため、codexでうまく接続することができず、これは私たちが旧版codexを考慮しないという前提である。 chat …

    続きを読む

  • GPT5シリーズモデルの使用コツは制限を減らすこと

    Friday, May 15, 2026 内 ブログ

    非常に長くて凝ったプロンプトを共有し、GPT5の性能向上を謳う人がいますが、慎重に見るべきです。 GPT5はclaudecodeのsonnetやopus4.6以前のモデルとは異なり、適当にカスタムプロンプトを書くと悪影響がより顕著です。GPT5のシステムプロンプトは慎重に検討すべきで、さもないとモデルの性能が低下しやすくなります。

    続きを読む

  • 騰訊のモデルは予想以上に良かった, 試してみることをお勧めします

    Friday, May 08, 2026 内 ブログ

    私のユースケースは主にコーディングで、プロジェクトは主にコマンドラインツールです。 騰訊HY3 Previewは私のユースケースで非常に良い性能を示し、指示の遵守と弁証的な論理も優れています。 openrouterで最近公開されたBaiduのCoBuddy コーディングモデルも試しましたが、非常に劣っており、簡単に2回使うだけで能力の低さが感じられ、コンテキストはわずか131kです。 匿名モデルOwl Alphaはまずまずの性能で、コンテキストは1Mまで対応しています。これはコーディング特化モデ …

    続きを読む

  • おすすめのコーディング向けモデル体験

    Tuesday, May 05, 2026 内 ブログ

    まずは古い友人のopenrouter、10ドルを入金すると、毎日1000回の無料呼び出しがあり、ほとんどの場合freeモデルの中にそこそこ性能の良いモデルがいくつかあります。公式ポリシーは入金額の有効期間を設定する権利を保留しており、一年の有効期間が設けられる可能性がありますが、私の過去一年以上の10ドルは依然として有効です。 最近期間限定で体験したinclusionAI:Ling-2.6-1Tとtencent:hy3 preview、このうち混元3プレビュー版は私が初めて使う騰訊(テンセント) …

    続きを読む

  • codex free auth自動取得フローの実現可能性

    Tuesday, May 05, 2026 内 ブログ

    freeアカウントを200個とplusアカウントを1つ持っており、cliproxyapiに接続し、各cliで使用するためにリバースプロキシ経由で利用しています。これらのアカウントは個人のヘビーユーザーに十分ですが、1Mコンテキスト、fastモードを有効にし、subagentを使い、高解像度画像解析を行うと、これら数百のアカウントのトークンも依然として足りなくなり、計画的に使う必要があります。 freeのcodex cliの体験枠は公式では期間限定とされており、いつ終了するかは明言されていませんが …

    続きを読む

  • なぜモデルのトークン効率を向上させるだけで値上げできるのか

    Sunday, May 03, 2026 内 ブログ

    GPT5.5はGPT5.4と比べて価格が2倍になり、GPT5.4はGPT5.3codexと比べて価格が約40%上昇しました。両方の値上げには共通の基本ロジックがあり、それはトークン効率の向上です。 GPT5.2は信じられないほど遅いモデルですが、GPT5シリーズのモデルは問題特定の精度が高く、バグが少なく、レビュー時の心理的負担を大幅に軽減できるため、ずっと手放せずにいました。5.3codex以降、GPTモデルは世代ごとに明らかに速度が向上しており、公式の説明によると、モデルは性能を向上させつつ …

    続きを読む

  • ごめんなさいmimo v2.5 proは本当にダメです

    Sunday, May 03, 2026 内 ブログ

    一部の人が小米のモデルは長期タスクを実行でき、数百回のtool callでもエラーが出ないと共有しているが、このテストの方向性を誰が提唱したのか分からない。まるである生徒が試験場で100分間トイレに行かずに耐えられると言うようなもので、意味がない。 私たち普通の人が理解するところでは、一つの受験試験に対して、重要なのは唯一点数だけであり、もう少し緩く言えば、点数が評価体系の重みの95%以上を占め、一般的にまず点数を見てからその他の表現を見、点数が低ければ他を見る必要がない。 mimoは確かに一つ …

    続きを読む

  • 34社のコーディングプランを提供するメーカーを調査

    Thursday, April 30, 2026 内 ブログ

    そして一部のベンダーの北京時間午後4時の最初の文字応答とトークン速度を取得し、数ヶ月間自分で使用しました。ぜひアクセスして、貴重なご意見をお寄せください! プロジェクトリンク: #https://github.com/jqknono/coding-plans-for-copilot

    続きを読む

  • 小米がtoken planの特典を配布

    Thursday, April 30, 2026 内 ブログ

    私の小さなプロジェクトで小米のpro planをゲットしました。今月試してみます プロジェクトはvscodeプラグインで、任意のchat-completion/responses/anthropic互換のAPIをgithub copilotに接続するものです プロジェクトアドレス: #https://github.com/jqknono/coding-plans-for-copilot

    続きを読む