O que importa é o modelo, a diferença de harness não é tão grande, recentemente a A/ abriu algumas brechas de proxy reverso, vale a pena experimentar outras ferramentas de harness. opencode, copilot cli etc. são boas.
Antes eu sempre recomendava o chatgpt plus, mas outro dia o chatgpt bloqueou meu codex, e para entrar no codex novamente é preciso autenticação secundária por SMS. Como o número era de uma plataforma de recebimento de códigos, a openai não permite trocar o número de celular por conta própria, então a conta principal está arruinada. Fui experimentar o supergrok, e o composer que ele oferece…
O desempenho dos modelos da Zhipu é razoável, mas sua capacidade de engenharia é limitada, e os usuários de assinatura percebem a qualidade do serviço. O glm5.2 tem o mérito de um raciocínio rigoroso, à custa de baixa eficiência de tokens, resultando em um preço geral mais alto. Supondo que a maioria dos usuários realmente aprecie modelos com bom desempenho, mas os pés votem em modelos com bom custo-benefício, então os fabricantes com bom custo-benefício conquistarão os usuários. Supondo que a forma real de lucro dos fornecedores de modelos de IA seja semelhante à de uma fábrica, valorizando economia de escala e controle de custos, então os fabricantes com bom custo-benefício obtêm lucro mais facilmente.
Crie múltiplos espaços de trabalho, cada um pode assinar um go, os espaços podem ser criados livremente. Não é necessário criar múltiplas contas, a menos que seja para aproveitar os 5 dólares de gorjeta.
A segunda imagem é prova suficiente de que é original, o familiar sabor 1302. Já dá para usar com estabilidade no 6.18, a velocidade também é muito boa, talvez o fornecedor não esteja usando z.ai. Na experiência de uso, em código é superior ao deepseekv4pro, a taxa de erro de scripts diminuiu bastante. Claro, o preço também ficou muitas vezes mais caro. Entre os modelos nacionais, só recomendo o deepseek, espero que ele suporte multimodal em breve…
Não é barato, especialmente a forma como a consumo da cota é contabilizado, entradas e saídas são contadas no plano. Frequentemente faço uma única requisição de 20 milhões de tokens, a faixa de 59 yuan só me dura 3 requisições. Para codificação, cerca de 99% da entrada é cache de entrada, cobrar o preço cheio na ocorrência de cache de entrada é absurdo. Se quiserem que alguém use, não contem a entrada, contabilizem apenas a saída na cota…
o copilot pôde ser usado ilimitadamente no vscode insider de fevereiro a julho do ano passado, e nesse período testemunhei o declínio gradual da capacidade de agente do copilot. difícil imaginar, a versão de pré-visualização do primeiro mês do copilot acabou sendo a de melhor desempenho, e depois a capacidade de agente diminuiu gradualmente. qual foi a mudança exata? foi o copi…
No último ano e meio, algumas empresas superestimaram o papel da IA e iniciaram demissões. Com o passar do tempo, as empresas perceberam gradualmente que a IA não é tão inteligente e barata quanto esperado, e começaram a reduzir o consumo de tokens de IA e a desacelerar as demissões. Uma razão muito importante é que a IA não é barata e não pode assumir a culpa. Antigamente, alguns setores brincavam que a IA não pode ir para a prisão, mas com base na minha experiência de trabalho real…
Postei anteriormente criticando que o desempenho do mimo-2.5-pro não justificava seu preço, seu desempenho realmente não consegue rivalizar com gpt5.x e opus4.x, não fui eu quem quis compará-los, foi a Xiaomi que os usou como referência, então publiquei apontando a diferença evidente. Mas agora a Xiaomi mudou para usar a deepseek como referência, e acho que talvez ainda tenha força para competir. Vender LLM…
As características de uma arquitetura corrupta são: muitos tratamentos especiais, tratamentos de compatibilidade, acoplamento severo, peso acumulado difícil de reverter. Toda arquitetura apodrece lentamente. A arquitetura corrupta dificulta o desenvolvimento de novos recursos, bugs são difíceis de corrigir, mexer em uma parte afeta o todo, o que torna os testes e QA também muito difíceis de fazer. Já vi um entusiasta de desenvolvimento de outra área postar dizendo que restringir o comportamento de abstração do modelo ao escrever código faz o código ser mais…
2,5折 direto para 1/4 permanente, sem precisar comprar em promoção, sem pacotes, sem ficar acumulando cota de 5h semanal, sem calcular multiplicador de horário ocioso/ocupado, sem calcular taxa de câmbio entre token e credit, varejo direto é atacado, sem truques, tudo é sincero.
A série GPT5 tem alta taxa de recuperação, pode implementar lógica muito rigorosa, sendo excelente para depurar bugs, e ao mesmo tempo percebe prontamente contradições no contexto, uma experiência única entre os muitos modelos atuais. Mas recentemente, em meu projeto de engenharia reversa pessoal, descobri que a capacidade de engenharia reversa do GPT5 é limitada, claramente inferior ao modelo opus. Muitas vezes ele responde explicitamente que não funciona, enquanto trocar para o opu…
A IA escreve demais, bugs/linhas com certeza é menor, mas não dá pra aguentar o aumento explosivo de linhas, requisitos que antes não queríamos escrever agora são feitos rapidinho, e os bugs também aumentam. Além disso, a IA é excelente em encontrar bugs de outros, alguns bugs ocultos foram revelados. Grandes empresas ou bibliotecas populares de antes não explodiam com bugs graves a cada poucos dias como agora. Engenharia reversa e ataques…
Eu realmente sinto certa aversão à empresa anthropic, mas seu prestígio está em alta, então só posso usar com relutância. Assinei o claudecode pro, a cota é muito pequena, só serve para planejamento. Os modelos nacionais têm desempenho um pouco inferior, mas a cota é maior, com clara vantagem de custo-benefício. As empresas de modelos nacionais atualmente não oferecem response API, portanto não é possível integrar bem no codex, presumindo que não consideremos o codex antigo…
Alguém compartilha prompts muito longos e elaborados alegando melhorar o desempenho do GPT5, deve-se ver com cautela. O GPT5 é diferente dos modelos sonnet ou opus4.6 anteriores no claudecode, os efeitos negativos de escrever prompts personalizados aleatoriamente são mais evidentes. O prompt de sistema do GPT5 deve ser bem ponderado, caso contrário é fácil degradar o desempenho do modelo.
Meu cenário de uso é principalmente escrever código, e os projetos são principalmente ferramentas de linha de comando. O Tencent HY3 Preview tem um bom desempenho no meu cenário de uso, com bom seguimento de instruções e lógica dialética. O modelo de codificação CoBuddy da Baidu, que recentemente entrou no openrouter, eu também testei, é muito ruim, dá para sentir a capacidade fraca com apenas duas utilizações simples, o contexto tem apenas 131…
Primeiro, o velho conhecido openrouter, após depositar 10 dólares, há 1000 chamadas gratuitas diárias, na maioria das vezes nos modelos free haverá alguns modelos com desempenho razoável. A política oficial reserva o direito de definir validade do valor, pode haver validade de um ano, mas meus 10 dólares de mais de um ano ainda estão válidos. Recentemente experiência por tempo limitado inclusion…
Tenho duzentas contas free e uma conta plus, conectadas ao cliproxyapi, com proxy reverso para uso em vários cli. Essas contas são suficientes para uso pessoal intensivo. Se ativar contexto de 1M, modo fast, usar subagent, análise de imagens em alta definição, o token dessas centenas de contas ainda será insuficiente, sendo necessário planejar o uso. f…
O GPT5.5 tem o preço dobrado em relação ao GPT5.4, e o GPT5.4 teve um aumento de preço de cerca de 40% em relação ao GPT5.3codex. Os dois aumentos de preço têm uma lógica básica em comum, ou seja, a eficiência de token foi melhorada. O GPT5.2 é um modelo lento a ponto de deixar as pessoas furiosas, mas a série GPT5 tem alta precisão na localização de problemas, poucos bugs e pode reduzir significativamente a carga mental de revisão…
Algumas pessoas compartilham que o modelo da Xiaomi consegue executar tarefas de longa duração, com centenas de tool calls sem erro, não sei quem iniciou essa direção de teste, é como dizer que um aluno consegue ficar 100 minutos na prova sem ir ao banheiro, não faz sentido. Nós, pessoas normais, entendemos que, para um exame, a única coisa importante é a nota, e se formos mais flexíveis, a nota representa mais de 95% do sistema de avalia…
E obteve o tempo de resposta do primeiro token e a taxa de token de alguns fornecedores às quatro da tarde no horário de Pequim. Usei por alguns meses e convido todos a visitar e deixar seus comentários valiosos! Link do projeto: #https://github.com/jqknono/coding-plans-for-copilot
Consegui um plano pro da Xiaomi graças ao meu pequeno projeto, vou testar este mês. O projeto é um plugin do vscode que conecta qualquer API compatível com chat-completion/responses/anthropic ao github copilot. Endereço do projeto: #https://github.com/…
Ainda tenho uma dúvida: se eu tivesse uma estratégia que desse dinheiro, com certeza pegaria empréstimo e apostaria tudo, e jamais compartilharia essa estratégia facilmente. Então, o que ganham as muitas pessoas que compartilham estratégias na internet? #quanttrading[tópico]# #quant[tópico]# #investimentofinanceiro[tópico]#
Dizer para fugir do cursor agora pode ser um pouco tarde, na verdade, durante meio ano reduzi gradualmente o uso do cursor, porque meus hábitos de codificação mudaram, e os pontos fortes do cursor já não são mais a razão para eu escolhê-lo. A característica pela qual o cursor ainda mantém o primeiro lugar é seu modelo de autocompletar exclusivo, que suporta complemento cruzando linhas e arquivos em todas as direções, seja…
A vantagem amplamente conhecida da Anthropic é o senso comum, ou seja, common sense. Alguns trabalhos de desenvolvimento dependem de senso comum, outros dependem de lógica proprietária. O estilo de raciocínio do opus é conjecturar muitas possibilidades e então validá-las rapidamente. O GPT5 tende a raciocinar com base na implementação do código, revisando repetidamente os negócios. Em termos de estilo, é semelhante à diferença entre busca em largura e busca em profundidade. À medida que…
Consegui reembolso de novo, liberando recursos para os brothers. 40 reais por mês é barato, mas não dá pra usar de dia e à noite eu durmo, isso não é plano lite, é plano night! Questionário de reembolso, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Esta é a terceira vez que caio no golpe da Zhipu. Disseram que era para reter usuários antigos, dando cota sem limite semanal, então voltei para testar de novo, e acabei sendo enganado novamente. Não tem limite semanal, mas quando preciso dela simplesmente não funciona; só ‘revive’ quando acabo de chegar ao trabalho ou de sair, enfim, nos encontramos no auge. Em fevereiro, disse que o Zhipu lite tinha apenas uma concorrência, e a Zhipu usou o certificado de operação da empresa para denunciar meu perfil no xhs, alegando difamação…
A narrativa de custo não se adequa ao setor de grandes modelos, todos estão no prejuízo, até mesmo os vencedores, os perdedores acham que não pode continuar assim, sem capacidade de persuadir os vencedores a aumentar os preços, decidem primeiro aumentar o preço de seus produtos obsoletos, isso é quebrar a própria louça e cavar sua própria cova. As fabricantes domésticas de modelos open-source ganham notoriedade, depois que seus modelos têm certa competitividade fecham o código, qwen3.6/minimax2.7/glm5.1turbo etc. não foram open-source, outras pequenas fábricas mexem um pouco nos modelos base, destilam os modelos dos vencedores, e já querem cobrar, não imaginam as coisas fáceis demais.
Uso o vscode há dez anos e vi uma atualização de tema pela primeira vez. Em comparação com o tema padrão original, os blocos de cor diminuíram, o preto ficou mais preto e o branco ficou mais branco. #vscode[tópico]#
Nos seis meses desde o lançamento da série GPT5, seu rigor lógico está à frente, mas o que mais atrai críticas é sua velocidade relativamente lenta, especialmente o GPT5.2, lento de forma absurda, para muitas solicitações comuns o opus pode levar 20 segundos coletando contexto e já começar a modificar, enquanto o GPT5.2 provavelmente precisa analisar por 20 minutos antes de começar a alterar. O modelo GPT5.2codex do mesmo período é um pouco mais rápido, mas a lógica diminui claramente. Depois o modelo GPT5.3codex equilibrou lógica e velocidade, e o modelo codex começou a se tornar utilizável. O GPT5.4 fundiu a capacidade de código no modelo principal, não lançando mais separadamente o modelo codex, e sua velocidade aumentou significativamente. Dizem que a eficiência por token aumentou, então pode pensar menos para alcançar precisão aproximada.
Do lado do claude, o preço do max5x é cinco vezes o do pro, e a quantidade também é cinco vezes; o preço do max20x é dez vezes, e a quantidade é 20 vezes. Do lado da OpenAI, o pro é 6 vezes o plus, o review é 10 vezes, custo-benefício difícil de avaliar.É claro que ele também tem o privilégio de processamento prioritário de solicitações, não tenho certeza de quanto pode ser mais rápido. Uso diariamente o chat para conversas, ativando o extend thinking, a sensação é de cerca de cinco minutos em média por pergunta. O limite semanal de conversas do plus é de 3000, nem chega a usar tudo.
#https://jqknono.github.io/coding-plans-for-copilot/ Pacotes de modelos de código aberto nacionais e estrangeiros coletados, bem como a latência e a taxa de token dos fornecedores
Apenas coletamos e organizamos fabricantes nacionais com certa reputação, não revendedores, com garantia de segurança. Na prática, a latência do primeiro token, taxa de token, número de concorrência e se há quantização são muito importantes, mas pouco mencionados pelos fabricantes. Em comparação, a velocidade é mais importante, realmente. #jqknono.github.io/coding-plans-for-…
Na época em que assinei mais planos, assinei vários pacotes ao mesmo tempo e não consegui usar todos, desperdiçando pelo menos metade de centenas de reais por mês. A OpenAI recentemente abriu o codex cli para usuários gratuitos, com uma certa cota semanal gratuita, e quem conhece o codex sabe que sua cota é muito diferente da do claudecode, sendo extremamente durável. Eu mesmo tenho 6 contas, conectadas em um…
Quem conhece avaliações de LLM sabe que o opus frequentemente supera o gpt em diversos rankings, mas na prática o gpt é imbatível na resolução de problemas. Até a data da publicação, os principais modelos mais recentes da série gpt5 incluem gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
A janela de reembolso será aberta dentro de uma semana após o feriado, até 6 de março de 2026. Na época, acesse a página Meu Plano, clique em cancelar e reembolsar para concluir com um clique. Observe que o período da janela de reembolso vai até 3.6. Irmãos programadores, lembrem-se de sua experiência usando a Zhipu nos últimos dois meses, acreditem em seus sentimentos e tomem decisões racionais.
Primeiro, a tarefa era apenas traduzir de chinês para inglês um aplicativo nodejs que converte um mermaid em imagem; esta é uma ferramenta pura, e a tarefa era apenas traduzir. Até agora, ao usar o modelo Zhipu, encontrei os seguintes problemas: 1. limite de concorrência extremamente baixo, quanto mais se precisa usar, menor a concorrência 2. velocidade de geração de token baixa 3….
Muitas pessoas dizem que o limite de concorrência do pacote lite é baixo, mas talvez não tenham explicado o quão baixo é. Vou explicar com mais clareza. Apenas uma concorrência Isso significa que em ferramentas com mecanismo de subagent, o lite simplesmente não consegue rodar. Comprei diversos produtos de IA por quatro ou cinco anos, e o pacote da Zhipu foi o maior golpe que levei, ele quase não serve para codificação. Agora só serve para tradução de thread único…
Após recarregar 10 dólares na openrouter, há uma cota diária de 1000 usos de modelos gratuitos, o que é mais do que suficiente para mim fazer validações. Mas por um longo período, muitos de seus modelos sempre retornavam erro 429, como openai/gpt-oss-120b:free, etc. Hoje testei manualmente vários métodos e finalmente confirmei…
Endereço do código aberto github:jqknono/reference-Harmony As principais funções veja a figura, exibe atalhos e comandos comuns de várias ferramentas de desenvolvimento populares, que podem ajudar a melhorar a eficiência do trabalho. A arquitetura de “Referência Rápida de Desenvolvimento” é clara, a função é simples e focada, não haverá anúncios no futuro e está totalmente em conformidade com a política de revisão de aplicativos da Huawei. Enviado em dezembro…
Fiquei confuso por um instante ao ver, só então percebi que “plan” foi traduzido como “pacote” O GPT5.2high é lento de forma absurda, o GPT5.3 ainda não saiu, mas o 5.3-codex saiu primeiro, nos testes a velocidade melhorou bastante, a queda na capacidade lógica não é tão evidente quanto a do GPT-5.2-Codex em relação ao GPT5.2, é um modelo de codificação especializado que vale a pena migrar…
O app Qwen usa operação de deslizar em quatro direções, com histórico de conversas e agentes à esquerda, e mercado de agentes à direita. Quando o traço de deslizar na tela não é reto para cima ou para baixo, mas parece um traço à esquerda (丿) ou à direita, o conteúdo lateral é acionado, e para voltar à interface de conversa não se desliza a tela, mas é preciso fazer a operação de retorno, deslizando a partir da borda da tela para voltar. Se a direção ficar confusa, o app trava. O app Qwen…
É inconveniente criar uma nova conversa; após criar uma nova conversa, há apenas um pop-up de aviso, e o histórico de mensagens permanece no mesmo lugar. Ao trocar de assunto, ainda é possível ver a resposta da pergunta anterior, dando a sensação de que o contexto não foi trocado, o que é incomum entre os diversos apps de conversação com IA. Mas a barreira de entrada do app da Doubao é realmente menor, o que favorece seu desenvolvimento de usuários.
Alguns desenvolvedores de modelos, no início do lançamento de uma nova versão, têm velocidade de resposta ideal e sem degradação da inteligência; se muitos usuários passam a usar, a velocidade e o efeito caem. Essa é a característica de quem lidera: uma vez que o desempenho fica para trás, os usuários vão embora e as GPUs estocadas ficam ociosas. Para evitar essa situação, pode-se considerar desacoplar ativos pesados e ativos de propriedade intelectual, vender direitos de uso do modelo ou alugar recursos de hardware.
Arquivo do post curto do Xiaohongshu sobre ‘Minha esposa me perguntou por que não fui jogar bola com eles, e cinco segundos depois ela ficou surpresa’.