O que importa é o modelo, a diferença de harness não é tão grande, recentemente a A/ abriu algumas brechas de proxy reverso, vale a pena experimentar outras ferramentas de harness. opencode, copilot cli etc. são boas.
No último ano e meio, algumas empresas superestimaram o papel da IA e iniciaram demissões. Com o passar do tempo, as empresas perceberam gradualmente que a IA não é tão inteligente e barata quanto esperado, e começaram a reduzir o consumo de tokens de IA e a desacelerar as demissões. Uma razão muito importante é que a IA não é barata e não pode assumir a culpa. Antigamente, alguns setores brincavam que a IA não pode ir para a prisão, mas com base na minha experiência de trabalho real…
As características de uma arquitetura corrupta são: muitos tratamentos especiais, tratamentos de compatibilidade, acoplamento severo, peso acumulado difícil de reverter. Toda arquitetura apodrece lentamente. A arquitetura corrupta dificulta o desenvolvimento de novos recursos, bugs são difíceis de corrigir, mexer em uma parte afeta o todo, o que torna os testes e QA também muito difíceis de fazer. Já vi um entusiasta de desenvolvimento de outra área postar dizendo que restringir o comportamento de abstração do modelo ao escrever código faz o código ser mais…
A série GPT5 tem alta taxa de recuperação, pode implementar lógica muito rigorosa, sendo excelente para depurar bugs, e ao mesmo tempo percebe prontamente contradições no contexto, uma experiência única entre os muitos modelos atuais. Mas recentemente, em meu projeto de engenharia reversa pessoal, descobri que a capacidade de engenharia reversa do GPT5 é limitada, claramente inferior ao modelo opus. Muitas vezes ele responde explicitamente que não funciona, enquanto trocar para o opu…
A IA escreve demais, bugs/linhas com certeza é menor, mas não dá pra aguentar o aumento explosivo de linhas, requisitos que antes não queríamos escrever agora são feitos rapidinho, e os bugs também aumentam. Além disso, a IA é excelente em encontrar bugs de outros, alguns bugs ocultos foram revelados. Grandes empresas ou bibliotecas populares de antes não explodiam com bugs graves a cada poucos dias como agora. Engenharia reversa e ataques…
Alguém compartilha prompts muito longos e elaborados alegando melhorar o desempenho do GPT5, deve-se ver com cautela. O GPT5 é diferente dos modelos sonnet ou opus4.6 anteriores no claudecode, os efeitos negativos de escrever prompts personalizados aleatoriamente são mais evidentes. O prompt de sistema do GPT5 deve ser bem ponderado, caso contrário é fácil degradar o desempenho do modelo.
Tenho duzentas contas free e uma conta plus, conectadas ao cliproxyapi, com proxy reverso para uso em vários cli. Essas contas são suficientes para uso pessoal intensivo. Se ativar contexto de 1M, modo fast, usar subagent, análise de imagens em alta definição, o token dessas centenas de contas ainda será insuficiente, sendo necessário planejar o uso. f…
O GPT5.5 tem o preço dobrado em relação ao GPT5.4, e o GPT5.4 teve um aumento de preço de cerca de 40% em relação ao GPT5.3codex. Os dois aumentos de preço têm uma lógica básica em comum, ou seja, a eficiência de token foi melhorada. O GPT5.2 é um modelo lento a ponto de deixar as pessoas furiosas, mas a série GPT5 tem alta precisão na localização de problemas, poucos bugs e pode reduzir significativamente a carga mental de revisão…
Algumas pessoas compartilham que o modelo da Xiaomi consegue executar tarefas de longa duração, com centenas de tool calls sem erro, não sei quem iniciou essa direção de teste, é como dizer que um aluno consegue ficar 100 minutos na prova sem ir ao banheiro, não faz sentido. Nós, pessoas normais, entendemos que, para um exame, a única coisa importante é a nota, e se formos mais flexíveis, a nota representa mais de 95% do sistema de avalia…
Ainda tenho uma dúvida: se eu tivesse uma estratégia que desse dinheiro, com certeza pegaria empréstimo e apostaria tudo, e jamais compartilharia essa estratégia facilmente. Então, o que ganham as muitas pessoas que compartilham estratégias na internet? #quanttrading[tópico]# #quant[tópico]# #investimentofinanceiro[tópico]#
Dizer para fugir do cursor agora pode ser um pouco tarde, na verdade, durante meio ano reduzi gradualmente o uso do cursor, porque meus hábitos de codificação mudaram, e os pontos fortes do cursor já não são mais a razão para eu escolhê-lo. A característica pela qual o cursor ainda mantém o primeiro lugar é seu modelo de autocompletar exclusivo, que suporta complemento cruzando linhas e arquivos em todas as direções, seja…
A vantagem amplamente conhecida da Anthropic é o senso comum, ou seja, common sense. Alguns trabalhos de desenvolvimento dependem de senso comum, outros dependem de lógica proprietária. O estilo de raciocínio do opus é conjecturar muitas possibilidades e então validá-las rapidamente. O GPT5 tende a raciocinar com base na implementação do código, revisando repetidamente os negócios. Em termos de estilo, é semelhante à diferença entre busca em largura e busca em profundidade. À medida que…
A narrativa de custo não se adequa ao setor de grandes modelos, todos estão no prejuízo, até mesmo os vencedores, os perdedores acham que não pode continuar assim, sem capacidade de persuadir os vencedores a aumentar os preços, decidem primeiro aumentar o preço de seus produtos obsoletos, isso é quebrar a própria louça e cavar sua própria cova. As fabricantes domésticas de modelos open-source ganham notoriedade, depois que seus modelos têm certa competitividade fecham o código, qwen3.6/minimax2.7/glm5.1turbo etc. não foram open-source, outras pequenas fábricas mexem um pouco nos modelos base, destilam os modelos dos vencedores, e já querem cobrar, não imaginam as coisas fáceis demais.
Nos seis meses desde o lançamento da série GPT5, seu rigor lógico está à frente, mas o que mais atrai críticas é sua velocidade relativamente lenta, especialmente o GPT5.2, lento de forma absurda, para muitas solicitações comuns o opus pode levar 20 segundos coletando contexto e já começar a modificar, enquanto o GPT5.2 provavelmente precisa analisar por 20 minutos antes de começar a alterar. O modelo GPT5.2codex do mesmo período é um pouco mais rápido, mas a lógica diminui claramente. Depois o modelo GPT5.3codex equilibrou lógica e velocidade, e o modelo codex começou a se tornar utilizável. O GPT5.4 fundiu a capacidade de código no modelo principal, não lançando mais separadamente o modelo codex, e sua velocidade aumentou significativamente. Dizem que a eficiência por token aumentou, então pode pensar menos para alcançar precisão aproximada.
#https://jqknono.github.io/coding-plans-for-copilot/ Pacotes de modelos de código aberto nacionais e estrangeiros coletados, bem como a latência e a taxa de token dos fornecedores
Muitas pessoas dizem que o limite de concorrência do pacote lite é baixo, mas talvez não tenham explicado o quão baixo é. Vou explicar com mais clareza. Apenas uma concorrência Isso significa que em ferramentas com mecanismo de subagent, o lite simplesmente não consegue rodar. Comprei diversos produtos de IA por quatro ou cinco anos, e o pacote da Zhipu foi o maior golpe que levei, ele quase não serve para codificação. Agora só serve para tradução de thread único…