Lo importante es el modelo; la diferencia entre los harness no es tan grande. Recientemente A/ ha abierto algunos accesos para proxies inversos, así que vale la pena probar otras herramientas de harness como opencode, copilot cli, etc.
Por defecto usa el modelo stepfun para juzgar los datos personales que la API de github puede obtener, muy divertido https://githubroast.dev/ #vibecoding大赏[话题]#
Antes siempre recomendaba chatgpt plus, pero hace unos días chatgpt bloqueó mi codex. Para volver a iniciar sesión en codex se requiere autenticación de segundo factor por SMS. Como el número de teléfono era de una plataforma de recepción de códigos, openai no permite cambiar el número vinculado por cuenta propia, la cuenta principal quedó inutilizada. Me pasé a probar supergrok, el composer que ofrece…
El rendimiento del modelo de Zhipu es aceptable, pero su capacidad de ingeniería es limitada, y los usuarios de suscripción pueden percibir la calidad del servicio. La ventaja de glm5.2 es su razonamiento riguroso, a costa de una baja eficiencia de tokens, lo que resulta en un precio integral más alto. Suponiendo que la mayoría de los usuarios realmente aprecian los modelos con buen rendimiento, pero sus pies votan por los modelos de buena relación calidad-precio, entonces los fabricantes de buena relación calidad-precio ganarán a los usuarios. Suponiendo que la rentabilidad real de los proveedores de modelos de IA es similar a la de una fábrica, enfocada en economías de escala y control de costos, entonces los fabricantes de buena relación calidad-precio obtienen beneficios más fácilmente…
Crea múltiples espacios de trabajo, cada uno puede suscribir un go, los espacios se pueden crear libremente. No hace falta crear varias cuentas, a menos que sea para aprovechar los 5 dólares.
La segunda imagen basta para demostrar que es original sin duda, el familiar sabor 1302. El 6.18 ya se puede usar con estabilidad, la velocidad también es bastante buena, quizá el proveedor ya no usa z.ai. En la experiencia de uso, en código es superior a deepseekv4pro, la tasa de error en scripts ha bajado bastante. Por supuesto, el precio también es varias veces más caro. De los modelos nacionales solo recomiendo deepseek, espero que pronto…
No es barato, especialmente la forma en que se contabiliza el consumo de la cuota, tanto la entrada como la salida se cuentan en el plan. A menudo una sola solicitud me consume 20 millones de tokens, la tarifa de 59 yuanes solo me alcanza para 3 solicitudes. Si se usa para programar, aproximadamente el 99% de la entrada es caché de entrada, cobrar la caché de entrada al precio normal es bastante absurdo. Si quieren que la gente lo use, no cuenten la entrada, solo incluyan la salida en la cuota…
copilot desde febrero hasta julio del año pasado se podía usar ilimitadamente en vscode insider, durante ese periodo fui testigo del declive gradual de la capacidad agente de copilot. Difícil de imaginar, la versión preliminar del primer mes de copilot resultó ser la de mejor rendimiento, luego la capacidad agente fue disminuyendo poco a poco. ¿Qué cambio exactamente? Pues fue que co…
Anteriormente publiqué una crítica sobre que el rendimiento de mimo-2.5-pro no justificaba su precio, su rendimiento realmente no puede compararse con gpt5.x y opus4.x, no fui yo quien quiso compararlos, fue Xiaomi quien los comparó, por eso publiqué señalando la clara diferencia. Pero ahora Xiaomi ha cambiado a compararse con deepseek, y siento que podría tener cierta capacidad de competir. Vender LLM…
El 25% de descuento se convierte directamente en 1/4 permanente, sin comprar a la carrera, sin paquetes, sin acumular cuota de 5h semanal, sin calcular multiplicadores de horas libres u ocupadas, sin calcular el tipo de cambio entre token y credit, venta minorista igual que al por mayor, sin trucos, todo es sincero.
La IA escribe muchísimo, los errores/líneas seguro son menos, pero no aguanta el aumento explosivo de líneas, antes no querías escribir requisitos y ahora los escribes sin parar, y los errores también aumentan. Además, la IA es excelente buscando errores de otros, algunos errores ocultos fueron descubiertos. Las grandes empresas o bibliotecas populares de antes no tenían este tipo de errores graves estallando cada pocos días. La ingeniería inversa y los ataques…
En realidad siento cierta aversión por la empresa anthropic, pero está en auge, así que no queda más remedio que usarla a regañadientes. Contraté una suscripción claudecode pro, la cuota es muy escasa y solo sirve para planificar. Los modelos nacionales rinden algo peor, pero la cuota es mayor, con una clara ventaja de relación calidad-precio. Los proveedores de modelos nacionales aún no ofrecen response API, por lo que no…
Alguien comparte indicaciones muy largas y elaboradas que afirman mejorar el rendimiento de GPT5, hay que verlo con cautela. A diferencia de sonnet en claudecode o los modelos anteriores a opus4.6, los efectos negativos de escribir indicaciones personalizadas a la ligera son bastante evidentes. Las indicaciones del sistema de GPT5 deben considerarse con cuidado, de lo contrario es fácil degradar el rendimiento del modelo.
Primero está el viejo conocido openrouter. Tras depositar 10 dólares, hay 1000 llamadas gratuitas diarias, y la mayoría de las veces entre los modelos free hay varios con un rendimiento aceptable. La política oficial se reserva el derecho de establecer una validez del importe; podría haber un año de validez, pero mis 10 dólares de hace más de un año siguen vigentes. Recientemente probé por tiempo limitado inclusion…
Tengo doscientas cuentas free y una cuenta plus, conectadas a cliproxyapi, y las uso mediante proxy inverso en varios cli. Estas cuentas son suficientes para un uso personal intensivo; si se activa el contexto de 1M, el modo fast, se usan subagentes, análisis de imágenes en alta definición, los token de estas cientos de cuentas seguirán siendo insuficientes, y habrá que planificar su uso. f…
Y obtuve el tiempo de respuesta del primer token y la velocidad de token de algunos proveedores a las 4 de la tarde, hora de Pekín. Lo he usado durante varios meses, ¡les damos la bienvenida a visitar y dejarnos sus valiosos comentarios! Enlace del proyecto: #https://github.com/jqknono/coding-plans-for-copilot
Conseguí un plan pro de Xiaomi gracias a mi pequeño proyecto, voy a probarlo este mes. El proyecto es un plugin de vscode que conecta cualquier API compatible con chat-completion/responses/anthropic a github copilot. Dirección del proyecto: #https://github.com/…
La ventaja bien conocida de Anthropic es el sentido común, es decir, common sense. Algunos trabajos de desarrollo dependen del sentido común, otros de lógica propietaria. El estilo de razonamiento de opus es conjeturar muchas posibilidades y luego verificarlas rápidamente. GPT5 tiende a razonar según la implementación del código, repasando repetidamente el negocio. En cuanto al estilo, es similar a la diferencia entre búsqueda en amplitud y búsqueda en profundidad. A medida que…
Se puede pedir reembolso otra vez, dejo los recursos a los compañeros. 40 yuanes al mes es barato, pero no se puede usar de día y de noche tengo que dormir, ¡esto no es un plan lite, es un plan night! Cuestionario de reembolso, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Esta es la tercera vez que caigo en la trampa de Zhipu. Dijeron que para retener a los usuarios antiguos darían cuota sin límite semanal, así que volví a probarlo, y otra vez me engañaron. No tiene límite semanal, pero cuando lo necesito simplemente no funciona; justo cuando entro y salgo del trabajo, revive, lo que podría llamarse encontrarse en la cima. En febrero dije que Zhipu lite tenía concurrencia única, y Zhipu usó su certificado empresarial para denunciarme en xhs…
La narrativa de costos no es adecuada para la industria de los grandes modelos; todos están perdiendo dinero, incluso el ganador pierde. Los perdedores sienten que esto no puede continuar, no tienen capacidad para persuadir al ganador de subir precios, así que deciden primero subir el precio de sus propios productos obsoletos, lo cual es hacerlo por despecho y cavar su propia tumba. Los fabricantes nacionales de modelos de código abierto se hacen un nombre, y después de que sus modelos tienen cierta competitividad cierran el código, qwen3.6/minim…
Por parte de claude, el precio de max5x es cinco veces el de pro, y la cuota también es cinco veces; el precio de max20x es diez veces, y la cuota es 20 veces. Por parte de OpenAI, pro es 6 veces plus, review es 10 veces, la relación calidad-precio es difícil de evaluar. Por supuesto, también tiene el privilegio de procesamiento prioritario de solicitudes, no estoy seguro de cuánto más rápido puede ser. Uso diariamente el chat para conversar, activando extend thinking se siente en promedio unos cinco minutos por pregunta. El límite semanal de plus es de 3000 conversaciones, de sobra. El cli de codex con cuota semanal intensiva dura dos días (sin fast activado), así que solo necesitas preparar dos o tres cuentas plus para cubrir lo semanal, si eres impaciente y activas fast, con 4 cuentas también basta.
#https://jqknono.github.io/coding-plans-for-copilot/ Paquetes de modelos de código abierto nacionales y extranjeros recopilados, así como la latencia de los proveedores y la velocidad de tokens
Solo recopila y organiza fabricantes nacionales con cierta reputación, no estaciones de retransmisión, con cierta garantía de seguridad. En el uso real, la latencia del primer token, la velocidad de tokens, el número de concurrencias y si está cuantizado son muy importantes pero los fabricantes lo mencionan poco. En comparación, la velocidad es más importante, de verdad. #jqknono.github.io/coding-plans-for-…
En el momento de mayor suscripción contraté varios planes a la vez, y no pude usarlos todos, perdiendo al menos la mitad de varios cientos al mes. OpenAI recientemente abrió codex cli a usuarios gratuitos, con cierto cupo semanal gratuito, y quienes conocen codex saben que su cupo es muy diferente al de claudecode, y es muy duradero. Tengo 6 cuentas propias, conectadas a un…
Quienes conocen las evaluaciones de LLM saben que opus a menudo supera a gpt en varias listas de evaluación, pero en el uso real la capacidad de gpt para resolver problemas es insuperable. Hasta el momento de publicar, los modelos principales más recientes de la serie gpt5 son gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
La ventana de reembolso se abrirá dentro de una semana después del festival, hasta el 6 de marzo de 2026. Entonces entra en la página de Mi plan, haz clic en Cancelar y reembolsar para completarlo con un solo botón. Nota: esta ventana de reembolso termina el 3.6. Hermanos programadores, recordad vuestra experiencia usando Zhipu en los últimos dos meses, creed en vuestros sentimientos y decidid con racionalidad.
En primer lugar, la tarea consistía simplemente en traducir del chino al inglés una aplicación nodejs que convierte un mermaid en imagen; es una herramienta pura y la tarea era solo traducción. Hasta ahora, al usar el modelo de Zhipu he encontrado los siguientes problemas: 1. límites de concurrencia extremadamente bajos, cuanto más se necesita, menor es la concurrencia 2. velocidad de generación de tokens baja 3….
Mucha gente dice que el límite de concurrencia del plan lite es bajo, pero puede que no hayan explicado claramente qué tan bajo es. Lo explicaré con más claridad. Solo hay una concurrencia, lo que significa que en herramientas con mecanismo de subagentes, lite simplemente no puede funcionar. He comprado todo tipo de productos de IA durante cuatro o cinco años, y el plan de Zhipu es el mayor engaño en el que he caído; casi no sirve para programar. Ahora solo puede usarse para…
Después de recargar 10 dólares en openrouter, se dispone de 1000 usos diarios de modelos gratuitos; 1000 usos son más que suficientes para mis validaciones. Pero durante bastante tiempo, muchos de sus modelos devolvían constantemente errores 429, como openai/gpt-oss-120b:free, etc. Hoy probé manualmente varios métodos y finalmente confirmé…
Dirección de código abierto github:jqknono/reference-Harmony Las funciones principales se muestran en la imagen, presenta los atajos de teclado y comandos comunes de diversas herramientas de desarrollo populares, lo cual puede ayudar a mejorar la eficiencia laboral. La arquitectura de “referencia rápida de desarrollo” es clara, la función es sencilla y enfocada, no habrá anuncios en el futuro, y cumple totalmente con la política de revisión de aplicaciones de Huawei. En diciembre…
Me quedé un momento confundido al verlo, hasta que entendí que “plan” se había traducido como “paquete”. GPT5.2high es terriblemente lento, GPT5.3 aún no ha salido, pero 5.3-codex salió primero. En las pruebas reales la velocidad mejora notablemente, y la caída en capacidad lógica no es tan evidente como la de GPT-5.2-Codex frente a GPT5.2, es un modelo de codificación especializado que vale la pena adoptar…
Es incómodo crear una nueva conversación; tras crearla solo aparece un mensaje emergente, y los mensajes históricos siguen en su lugar. Al cambiar de tema todavía se ve la respuesta de la pregunta anterior, dando la sensación de que el contexto no se ha cambiado, lo cual es poco común entre las muchas apps de chat de IA. Pero el umbral de uso de Doubao es realmente más bajo, lo que favorece su desarrollo de usuarios.
Cuando algunos desarrolladores de modelos lanzan una nueva versión al principio, la velocidad de respuesta es ideal y no hay degradación de inteligencia; si hay muchos usuarios, tanto la velocidad como el rendimiento disminuyen. Esta es la actitud de los líderes: una vez que el rendimiento se queda atrás, los usuarios se van y las tarjetas acaparadas quedan ociosas. Para evitar esta situación, se puede considerar desacoplar los activos pesados de los activos de propiedad intelectual, vender derechos de uso del modelo o alquilar recursos de hardware.
Archivo de publicación corta en Xiaohongshu sobre que los libros que los miembros con tarjeta de experiencia de WeChat Reading pueden leer son cada vez menos.