Идея продолжить использование модели A/
Важна модель, разница в harness не так велика. Недавно A/ открыл несколько лазеек для обратного прокси, стоит попробовать другие harness-инструменты. opencode, copilot cli и другие вполне неплохи.
Важна модель, разница в harness не так велика. Недавно A/ открыл несколько лазеек для обратного прокси, стоит попробовать другие harness-инструменты. opencode, copilot cli и другие вполне неплохи.
Цена в рабочее время ×2
По умолчанию используется модель stepfun для оценки персональных данных, полученных через GitHub API, довольно забавно https://githubroast.dev/ #vibecoding大赏[话题]#
Раньше я больше всего рекомендовал chatgpt plus, но на днях chatgpt заблокировал мой codex, и при повторном входе в codex требуется SMS-двухфакторная аутентификация. Поскольку номер телефона был от платформы приёма кодов, openai не поддерживает самостоятельную смену привязки номера, основной аккаунт можно считать потерянным. Перешёл попробовать supergrok, и предоставляемая им модель compose…
Модели Zhipu показывают неплохие результаты, но инженерные возможности ограничены, что заметно подписчикам по качеству сервиса. Преимущество glm5.2 — строгая логика мышления, в ущерб эффективности токенов, что приводит к высокой совокупной цене. Предположим, большинство пользователей действительно оценят качественную модель, но ноги проголосуют за модель с лучшим соотношением цены и качества, тогда производители с лучшим соотношением цены и качества завоюют пользователей. Предположим, реальная прибыль поставщиков ИИ-моделей похожа на фабрику, где важны эффект масштаба и контроль затрат, тогда производителям с лучшим соотношением цены и качества легче получить прибыль…
Создайте несколько рабочих пространств, в каждом из которых можно подписаться на один go; рабочие пространства можно создавать свободно. Нет необходимости создавать несколько аккаунтов, если только не ради халявных 5 долларов.
Второе изображение достаточно доказывает, что это официальная версия, знакомый вкус 1302. 6.18 можно стабильно использовать, скорость тоже довольно неплохая, возможно поставщик больше не использует z.ai. На ощупь при работе с кодом превосходит deepseekv4pro, частота ошибок скриптов заметно снизилась. Конечно, цена тоже выросла во много раз. Из китайских моделей рекомендую только deepseek, жду, когда он быстрее…
ИИ наступает стремительно, мы готовимся заранее
Требуется настройка планировщика задач на компьютере, можно изучить самостоятельно
Недёшево, особенно способ учёта расхода лимита — и ввод, и вывод засчитываются в план. Часто одиночный запрос у меня съедает 20 млн токенов, тарифа за 59 юаней хватает всего на 3 запроса. При кодинге около 99% ввода — это кэш ввода, а попадание в кэш ввода считается по полной цене — довольно нелепо. Если хотите, чтобы им пользовались, не считайте ввод, а засчитывайте в лимит только вывод,…
copilot с февраля по июль прошлого года в vscode insider можно было использовать безлимитно, за это время я наблюдал постепенное ослабление agent-способностей copilot. Трудно представить, что первая предварительная версия copilot оказалась самой эффективной, после чего agent-способности постепенно снижались. Какие именно произошли изменения? Это то, что copi…
За последние полтора года некоторые компании переоценили роль ИИ и начали сокращения. Со временем компании постепенно обнаружили, что ИИ не так умён и дёшев, как ожидалось, и начали сокращать потребление AI token, замедляя увольнения. Одна из важных причин в том, что ИИ недёшев и не может взять вину на себя. Раньше в некоторых отраслях шутили, что ИИ не может сесть в тюрьму, но по моему реальному опыту работы…
Ранее я публиковал пост с критикой того, что производительность mimo-2.5-pro не оправдывает его цену, его производительность действительно не может сравниться с gpt5.x и opus4.x, я вовсе не сам хотел их сравнивать, это Xiaomi сравнивает их с ними, поэтому я и написал, что разрыв очевиден. Но теперь Xiaomi сменила ориентир на deepseek, и мне кажется, что у неё может быть шанс в этой борьбе. Продавать LLM изначально…
Признаки разложившейся архитектуры: множество специальных обработок, совместимых обработок, сильная связанность, неподъемное бремя. Любая архитектура со временем медленно разлагается. Разложившаяся архитектура затрудняет разработку новых функций, исправление багов затрагивает всё целиком, из-за чего тестирование и QA также трудно выполнять. Я видел, как энтузиасты разработки из смежных областей писали, что нужно ограничивать абстрактное поведение модели при написании кода, тогда код будет понятнее…
2,5-кратная скидка сразу становится 1/4 навсегда, не нужно гнаться за распродажами, не нужны пакеты, не нужно набирать 5-часовые или недельные лимиты, не нужно считать коэффициенты пикового и непикового времени, не нужно считать курс обмена между token и credit, розничная цена сразу как оптовая, никаких уловок, всё по-честному.
Серия GPT5 обладает высокой полнотой охвата, способна реализовать очень строгую логику, незаменима для решения багов, и в то же время может своевременно замечать противоречия в контексте — такой опыт уникален среди множества нынешних моделей. Но недавно в своём личном проекте по реверс-инжинирингу я обнаружил, что возможности GPT5 в реверс-инжиниринге ограничены, явно уступая модели opus. Во многих случаях она прямо отвечает, что это невозможно, тогда как opus…
ИИ пишет слишком много, bugs/lines определённо меньше, но не выдерживает взрывного роста lines, раньше не хотелось писать требования — теперь пишет со стуком, и багов становится всё больше. Кроме того, ИИ — мастер находить чужие баги, выкапывает даже скрытые. Раньше крупные компании или популярные библиотеки не выдавали так часто серьёзные баги. Реверс-инжиниринг и атаки…
Я на самом деле испытываю некоторую антипатию к компании anthropic, но она сейчас на пике популярности, поэтому приходится использовать её, скрепя сердце. Оформил подписку claudecode pro, лимит очень мал, можно использовать только для планирования. Отечественные модели хоть и немного уступают, но лимитов больше, явное преимущество по соотношению цена-качество. Поставщики отечественных моделей пока не предоставляют response API, поэтому…
Некоторые делятся очень длинными и замысловатыми промптами, якобы улучшающими работу GPT5, к этому стоит относиться с осторожностью. GPT5 отличается от моделей sonnet или opus4.6 и ранее в claudecode — негативный эффект от беспорядочного написания собственных промптов довольно заметен. Системный промпт GPT5 следует тщательно продумывать, иначе легко ухудшить показатели модели.
Моя сфера применения в основном написание кода, проекты в основном инструменты командной строки. Tencent HY3 Preview показывает отличные результаты в моей сфере применения, следование инструкциям и диалектическая логика на хорошем уровне. Я также попробовал кодирующую модель CoBuddy от Baidu, недавно появившуюся на openrouter, она очень слабая, уже после пары простых использований чувствуется низкая способность, контекст всего 131…
Прежде всего, старый знакомый openrouter: после пополнения на 10 долларов доступно 1000 бесплатных вызовов в день, и в большинстве случаев среди бесплатных моделей есть несколько вполне неплохих. Официальная политика оставляет за собой право устанавливать срок действия суммы, может быть год действия, но мои 10 долларов за последний год с лишним всё ещё действительны. Недавно в рамках ограниченного по времени тестирования inclusion…
У меня есть двести free-аккаунтов и один plus-аккаунт, подключённые к cliproxyapi, с обратным прокси в различные cli. Этих аккаунтов достаточно для личного интенсивного использования. Если включить контекст 1M, режим fast, использовать subagent, парсинг изображений высокого разрешения, то токенов этих сотен аккаунтов всё равно не хватит, придётся планировать использование. f…
GPT5.5 по сравнению с GPT5.4 вдвое дороже, GPT5.4 по сравнению с GPT5.3codex подорожал примерно на 40%, оба повышения цен основаны на одной базовой логике — повышении эффективности токенов. GPT5.2 — это модель, которая работает невероятно медленно, но модели серии GPT5 отличаются высокой точностью локализации проблем, малым числом багов и заметно снижают когнитивную нагрузку при проверке…
Некоторые делятся, что модель Xiaomi может выполнять длинные задачи, сотни вызовов tool call без ошибок. Не знаю, кто инициировал это направление тестирования — это всё равно что сказать, будто ученик может продержаться 100 минут на экзамене не сходя в туалет, что бессмысленно. Нормальные люди понимают, что для экзаменационной проверки единственное важное — это только баллы, и если быть снисходительнее, то баллы занимают более 95% веса в системе оценки…
И получил время отклика первого токена и скорость token у некоторых производителей в 16:00 по пекинскому времени, пользовался несколько месяцев, добро пожаловать посетить, высказывайте ценные замечания! Ссылка на проект: #https://github.com/jqknono/coding-plans-for-copilot
Благодаря моему небольшому проекту получил Xiaomi pro plan, в этом месяце попробую. Проект — это плагин для vscode, который подключает любой совместимый с chat-completion/responses/anthropic API к github copilot. Адрес проекта: #https://github.com/…
У меня всё ещё есть сомнения: если бы у меня была стратегия, на которой можно заработать, я бы точно взял кредит и вложил всё, и ни за что не стал бы легко делиться ею. Так зачем же многие в сети делятся стратегиями? #квантовая торговля[тема]# #квант[тема]# #финансовые инвестиции[тема]#
Говорить об уходе от cursor сейчас, возможно, немного поздно. На самом деле за полгода я постепенно стал реже использовать cursor, потому что мои привычки в кодировании изменились, и сильные стороны cursor больше не являются причиной выбирать его. По сей день характеристика cursor, которая по-прежнему уверенно занимает первое место, — это его уникальная модель автодополнения, поддерживающая дополнение выше, ниже, слева и справа, через строки и файлы. Ни по скорости отклика, ни по проценту принятия у неё нет равных соперников. Но я уже не пишу код вручную с помощью автодополнения, а перешёл на покупку различных пакетов для кодирования и активно использую agent для написания кода. Agent в cursor всё ещё очень мощный, но, к сожалению, он не имеет явного преимущества перед claudecode/codex, а официальные пакеты для кодирования от anthropic и OpenAI гораздо выгоднее пакетов cursor. Cursor не может конкурировать с поставщиками моделей по соотношению цена-качество моделей, поэтому cursor должен продвигать свою собственную модель composer, чтобы иметь право на участие в игре.
Широко известное преимущество Anthropic — это здравый смысл, то есть common sense. Некоторые разработческие задачи опираются на здравый смысл, некоторые — на специфическую логику. Стиль рассуждения opus — выдвигать множество гипотез, а затем быстро проверять их. GPT5 склонна рассуждать на основе реализации кода, многократно разбирая бизнес-логику. По стилю это похоже на разницу между поиском в ширину и поиском в глубину. По мере…
Снова можно вернуть деньги, освобождаю ресурсы для братьев. 40 юаней в месяц, конечно, дёшево, но днём пользоваться нельзя, а ночью мне надо спать — это не lite-тариф, это night-тариф! Анкета для возврата, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Это в третий раз, когда я попался на удочку Zhipu. Говорили, что хотят удержать старых пользователей и дадут лимит без недельного ограничения, и я снова решил попробовать, но опять попался. Без недельного ограничения — да, но когда он мне нужен, им вообще нельзя пользоваться. Он «оживает» только когда я только пришёл на работу и только что с неё ушёл, можно сказать, мы встречаемся на пике. В феврале я говорил, что Zhipu lite имеет одну конкурентную сессию, и Zhipu, используя сертификат коммерческой деятельности, пожаловался в xhs…
Нарратив о затратах не подходит для индустрии больших языковых моделей, все несут убытки, даже победители, проигравшие считают, что так больше нельзя, но не могут убедить победителей поднять цены, решают сначала повысить цены на свою отсталую продукцию — это разбивание горшка в отчаянии и рытье себе могилы. Отечественные производители открытых моделей завоевывают известность, и после того как их модели обретают конкурентоспособность, они закрывают исходный код, qwen3.6/minimax2.7/glm5.1turbo и др. не были открыты, другие мелкие компании просто что-то делают на базовых моделях, дистиллируют модели победителей и хотят брать деньги — не слишком ли легко они это себе представляют.
С момента выхода серии GPT5 полгода назад, её логическая строгость лидирует, но больше всего критики вызывает её низкая скорость, особенно GPT5.2, медленный до безумия, для многих обычных запросов opus может за 20 секунд собрать контекст и начать вносить правки, а GPT5.2, вероятно, будет анализировать 20 минут, прежде чем начнёт что-то менять. Модель GPT5.2codex того же периода немного быстрее, но логика заметно слабее. Позже модель GPT5.3codex сбалансировала логику и скорость, и модели codex стали пригодными для использования. В GPT5.4 кодовые возможности были интегрированы в основную модель, отдельные модели codex больше не выпускаются, а скорость заметно возросла. Утверждается, что эффективность на единицу token увеличилась, поэтому для достижения схожей точности требуется меньше размышлений.
У claude тариф max5x стоит в пять раз дороже pro, и объем тоже в пять раз больше; max20x стоит в десять раз дороже, объем — в 20 раз. У OpenAI pro в шесть раз дороже plus, review — в десять раз, соотношение цена/качество спорное.Конечно, там есть привилегия приоритетной обработки запросов, я не уверен, насколько это ускоряет. В повседневном использовании чата с включенным extend thinking на каждый вопрос в среднем уходит около пяти минут. Недельный лимит plus — 3000 диалогов, этого хватает с головой.
#https://jqknono.github.io/coding-plans-for-copilot/ Собранные отечественные и зарубежные пакеты открытых моделей, а также задержка поставщиков и скорость token
Собираются и систематизируются только отечественные производители с определённой репутацией, не реселлеры, безопасность имеет некоторую гарантию. В реальном использовании задержка первого токена, скорость token, количество одновременных запросов, квантование — важны, но производители редко об этом упоминают. В сравнении скорость важнее, правда. #jqknono.github.io/coding-plans-for-…
В период пиковых заказов одновременно оформлял несколько подписок, и все они оставались неиспользованными — минимум половина нескольких сотен в месяц уходила впустую. Недавно OpenAI открыла codex cli для бесплатных пользователей с определённой бесплатной недельной квотой; те, кто знаком с codex, знают, что её квота очень сильно отличается от claudecode и крайне долговечна. У меня есть 6 аккаунтов, подключённых через c…
Те, кто знаком с оценкой LLM, знают, что opus часто опережает gpt в различных рейтингах, но в реальном использовании способность gpt решать проблемы не имеет равных. На момент публикации последними основными моделями серии gpt5 являются gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
Окно возврата откроется в течение недели после праздников и продлится до 6 марта 2026 года. Тогда зайдите на страницу «Мои пакеты», нажмите «Отменить и вернуть средства» — и всё выполнится в один клик. Обратите внимание: период окна возврата заканчивается 3.6, братья-программисты, вспомните свой опыт использования Zhipu за последние два месяца, доверяйте своим ощущениям и принимайте взвешенные решения.
Сначала задача состояла лишь в переводе с китайского на английский Node.js-приложения, преобразующего mermaid в изображение; это чистый инструмент, и задача заключалась только в переводе. На данный момент в процессе использования модели Zhipu я уже столкнулся со следующими проблемами: 1. Крайне низкие ограничения параллелизма, чем больше нужно использовать, тем ниже параллелизм 2. Низкая скорость генерации токенов 3….
Многие говорят, что у lite-тарифа низкая конкурентность, но, возможно, не уточнили, насколько она низкая. Я объясню это понятнее. Всего одна конкурентная линия. Это означает, что в инструментах с механизмом subagent lite вообще не может работать. Я покупаю различные ИИ-продукты четыре-пять лет, и тариф Zhipu — самый большой обман, с которым я столкнулся. Он почти непригоден для программирования. Сейчас его можно использовать только для однопоточного перевода…
После пополнения openrouter на 10 долларов ежедневно доступна квота на 1000 запросов к бесплатным моделям, чего мне с избытком хватает для проверки. Но довольно долгое время многие модели постоянно возвращали ошибку 429, например openai/gpt-oss-120b:free и др. Сегодня я вручную протестировал различные способы и в итоге подтвердил…
Открытый исходный код github:jqknono/reference-Harmony Основные функции см. на изображении, отображаются горячие клавиши и часто используемые команды различных популярных инструментов разработки, что помогает повысить эффективность работы. Архитектура «Справочника разработчика» ясная, функции простые и сфокусированные, в будущем не будет рекламы, и полностью соответствует политике проверки приложений Huawei. В декабре п…
Когда увидел, замер на мгновение, только потом понял, что “plan” перевели как “тариф” GPT5.2high невыносимо медленный, GPT5.3 ещё не вышел, а 5.3-codex вышел первым, на практике скорость заметно выросла, снижение логических способностей не такое явное, как у GPT-5.2-Codex по сравнению с GPT5.2, это специализированная модель для кодинга, на которую стоит перейти…
Приложение Qwen использует четырёхсторонние жесты прокрутки: слева — история диалогов и агенты, справа — маркетплейс агентов. Когда траектория скольжения по экрану не строго вертикальна, а напоминает черту «пи» (丿) или «на», вызывается боковое содержимое, а чтобы вернуться в интерфейс диалога, нужно не скользить по экрану, а выполнить возврат — смахнуть от края экрана. При путанице с направлением приложение зависает. Приложение Qwen…
Неудобно создавать новый чат, после создания нового чата появляется только всплывающее уведомление, а история сообщений остается на месте. При смене темы всё ещё видны ответы на предыдущие вопросы, создавая ощущение, что контекст не переключился, что нехарактерно для большинства ИИ-приложений для диалогов. Но порог входа в Doubao действительно ниже, что способствует его развитию среди пользователей.
Когда некоторые разработчики моделей выпускают новую версию в начале, скорость отклика идеальна, интеллект не снижается, но если пользователей становится больше, скорость и качество падают. Это поведение лидера: как только производительность отстаёт, пользователи уходят, и запасённые карты простаивают. Чтобы избежать этого, можно рассмотреть разделение тяжёлых активов и активов интеллектуальной собственности, продажу прав на использование модели или аренду аппаратных ресурсов.
Архив короткого поста в Xiaohongshu: Рекомендую практичный комбо-набор для ИИ-программирования.
Архив короткого поста в Xiaohongshu: Рекомендую хорошие ИИ-инструменты для кодинга.