Lo importante es el modelo; la diferencia entre los harness no es tan grande. Recientemente A/ ha abierto algunos accesos para proxies inversos, así que vale la pena probar otras herramientas de harness como opencode, copilot cli, etc.
Por defecto usa el modelo stepfun para juzgar los datos personales que la API de github puede obtener, muy divertido https://githubroast.dev/ #vibecoding大赏[话题]#
Antes siempre recomendaba chatgpt plus, pero hace unos días chatgpt bloqueó mi codex. Para volver a iniciar sesión en codex se requiere autenticación de segundo factor por SMS. Como el número de teléfono era de una plataforma de recepción de códigos, openai no permite cambiar el número vinculado por cuenta propia, la cuenta principal quedó inutilizada. Me pasé a probar supergrok, el composer que ofrece…
El rendimiento del modelo de Zhipu es aceptable, pero su capacidad de ingeniería es limitada, y los usuarios de suscripción pueden percibir la calidad del servicio. La ventaja de glm5.2 es su razonamiento riguroso, a costa de una baja eficiencia de tokens, lo que resulta en un precio integral más alto. Suponiendo que la mayoría de los usuarios realmente aprecian los modelos con buen rendimiento, pero sus pies votan por los modelos de buena relación calidad-precio, entonces los fabricantes de buena relación calidad-precio ganarán a los usuarios. Suponiendo que la rentabilidad real de los proveedores de modelos de IA es similar a la de una fábrica, enfocada en economías de escala y control de costos, entonces los fabricantes de buena relación calidad-precio obtienen beneficios más fácilmente…
Crea múltiples espacios de trabajo, cada uno puede suscribir un go, los espacios se pueden crear libremente. No hace falta crear varias cuentas, a menos que sea para aprovechar los 5 dólares.
La segunda imagen basta para demostrar que es original sin duda, el familiar sabor 1302. El 6.18 ya se puede usar con estabilidad, la velocidad también es bastante buena, quizá el proveedor ya no usa z.ai. En la experiencia de uso, en código es superior a deepseekv4pro, la tasa de error en scripts ha bajado bastante. Por supuesto, el precio también es varias veces más caro. De los modelos nacionales solo recomiendo deepseek, espero que pronto…
No es barato, especialmente la forma en que se contabiliza el consumo de la cuota, tanto la entrada como la salida se cuentan en el plan. A menudo una sola solicitud me consume 20 millones de tokens, la tarifa de 59 yuanes solo me alcanza para 3 solicitudes. Si se usa para programar, aproximadamente el 99% de la entrada es caché de entrada, cobrar la caché de entrada al precio normal es bastante absurdo. Si quieren que la gente lo use, no cuenten la entrada, solo incluyan la salida en la cuota…
copilot desde febrero hasta julio del año pasado se podía usar ilimitadamente en vscode insider, durante ese periodo fui testigo del declive gradual de la capacidad agente de copilot. Difícil de imaginar, la versión preliminar del primer mes de copilot resultó ser la de mejor rendimiento, luego la capacidad agente fue disminuyendo poco a poco. ¿Qué cambio exactamente? Pues fue que co…
En el último año y medio, algunas empresas sobreestimaron el papel de la IA y comenzaron a despedir personal. Con el paso del tiempo, las empresas descubrieron poco a poco que la IA no es tan inteligente ni tan barata como se esperaba, y empezaron a reducir el consumo de tokens de IA y a frenar los despidos. Una razón muy importante es que la IA no es barata y no puede asumir la culpa. Antes algunos sectores bromeaban diciendo que la IA no puede ir a la cárcel, pero según mi experiencia laboral real, hay cierta lógica en ello…
Anteriormente publiqué una crítica sobre que el rendimiento de mimo-2.5-pro no justificaba su precio, su rendimiento realmente no puede compararse con gpt5.x y opus4.x, no fui yo quien quiso compararlos, fue Xiaomi quien los comparó, por eso publiqué señalando la clara diferencia. Pero ahora Xiaomi ha cambiado a compararse con deepseek, y siento que podría tener cierta capacidad de competir. Vender LLM…
Las características de una arquitectura corrupta son: gran cantidad de manejo especial, manejo de compatibilidad, acoplamiento severo, carga acumulada difícil de revertir. Todas las arquitecturas se corrompen lentamente. La arquitectura corrupta dificulta el desarrollo de nuevas funciones, los bugs son difíciles de corregir, un cambio afecta a todo, lo que hace que las pruebas y QA también sean muy difíciles de realizar. Una vez vi a un aficionado al desarrollo de otro sector publicar que, al limitar el comportamiento de abstracción del modelo al escribir código, el código es más fácil de entender…
El 25% de descuento se convierte directamente en 1/4 permanente, sin comprar a la carrera, sin paquetes, sin acumular cuota de 5h semanal, sin calcular multiplicadores de horas libres u ocupadas, sin calcular el tipo de cambio entre token y credit, venta minorista igual que al por mayor, sin trucos, todo es sincero.
La serie GPT5 tiene una alta tasa de recuperación y puede lograr una lógica muy rigurosa, siendo excelente para depurar errores. Al mismo tiempo, puede detectar a tiempo contradicciones en el contexto, ofreciendo una experiencia única entre los muchos modelos actuales. Pero recientemente, en mi proyecto de ingeniería inversa personal, descubrí que la capacidad de GPT5 para la ingeniería inversa es limitada, claramente inferior al modelo opus. Muchas veces responde explícitamente que no es factible, mientras que cambiando a opu…
La IA escribe muchísimo, los errores/líneas seguro son menos, pero no aguanta el aumento explosivo de líneas, antes no querías escribir requisitos y ahora los escribes sin parar, y los errores también aumentan. Además, la IA es excelente buscando errores de otros, algunos errores ocultos fueron descubiertos. Las grandes empresas o bibliotecas populares de antes no tenían este tipo de errores graves estallando cada pocos días. La ingeniería inversa y los ataques…
En realidad siento cierta aversión por la empresa anthropic, pero está en auge, así que no queda más remedio que usarla a regañadientes. Contraté una suscripción claudecode pro, la cuota es muy escasa y solo sirve para planificar. Los modelos nacionales rinden algo peor, pero la cuota es mayor, con una clara ventaja de relación calidad-precio. Los proveedores de modelos nacionales aún no ofrecen response API, por lo que no…
Alguien comparte indicaciones muy largas y elaboradas que afirman mejorar el rendimiento de GPT5, hay que verlo con cautela. A diferencia de sonnet en claudecode o los modelos anteriores a opus4.6, los efectos negativos de escribir indicaciones personalizadas a la ligera son bastante evidentes. Las indicaciones del sistema de GPT5 deben considerarse con cuidado, de lo contrario es fácil degradar el rendimiento del modelo.
Mi caso de uso principal es escribir código, y mis proyectos son principalmente herramientas de línea de comandos. Tencent HY3 Preview funciona muy bien en mi caso de uso, con buen seguimiento de instrucciones y lógica dialéctica. También probé el modelo de codificación CoBuddy de Baidu que recientemente salió en openrouter, y es bastante malo, con solo usarlo dos veces se nota que su capacidad es menor, y el contexto es solo de 131…
Primero está el viejo conocido openrouter. Tras depositar 10 dólares, hay 1000 llamadas gratuitas diarias, y la mayoría de las veces entre los modelos free hay varios con un rendimiento aceptable. La política oficial se reserva el derecho de establecer una validez del importe; podría haber un año de validez, pero mis 10 dólares de hace más de un año siguen vigentes. Recientemente probé por tiempo limitado inclusion…
Tengo doscientas cuentas free y una cuenta plus, conectadas a cliproxyapi, y las uso mediante proxy inverso en varios cli. Estas cuentas son suficientes para un uso personal intensivo; si se activa el contexto de 1M, el modo fast, se usan subagentes, análisis de imágenes en alta definición, los token de estas cientos de cuentas seguirán siendo insuficientes, y habrá que planificar su uso. f…
GPT5.5 duplica el precio respecto a GPT5.4, GPT5.4 aumentó el precio aproximadamente un 40% respecto a GPT5.3codex, ambas subidas de precio comparten una lógica base: se ha mejorado la eficiencia de tokens. GPT5.2 es un modelo terriblemente lento, pero la serie GPT5 tiene alta precisión en la localización de problemas y pocos bugs, lo que reduce significativamente la carga mental de revisión…
Algunas personas comparten que el modelo de Xiaomi puede ejecutar tareas de larga duración, con cientos de tool call sin errores. No sé quién inició esta dirección de prueba, es como decir que un estudiante puede aguantar 100 minutos en el examen sin ir al baño, lo cual no tiene sentido. Nosotros, las personas normales, entendemos que para un examen competitivo, lo único importante es la puntuación. Si somos más flexibles, la puntuación representa más del 95% del sistema de evaluación…
Y obtuve el tiempo de respuesta del primer token y la velocidad de token de algunos proveedores a las 4 de la tarde, hora de Pekín. Lo he usado durante varios meses, ¡les damos la bienvenida a visitar y dejarnos sus valiosos comentarios! Enlace del proyecto: #https://github.com/jqknono/coding-plans-for-copilot
Conseguí un plan pro de Xiaomi gracias a mi pequeño proyecto, voy a probarlo este mes. El proyecto es un plugin de vscode que conecta cualquier API compatible con chat-completion/responses/anthropic a github copilot. Dirección del proyecto: #https://github.com/…
Tengo una duda: si tuviera una estrategia que pudiera generar dinero, sin duda pediría un préstamo y lo apostaría todo, y jamás compartiría esa estrategia a la ligera. Entonces, ¿qué buscan tantas personas que comparten estrategias en internet? #TradingCuantitativo[Tema]# #Cuantificación[Tema]# #InversiónFinanciera[Tema]#
Quizás sea un poco tarde para hablar de abandonar cursor, pero en realidad he ido reduciendo gradualmente su uso en el último medio año, porque mis hábitos de programación han cambiado y sus puntos fuertes ya no son la razón para elegirlo. La característica que aún mantiene a cursor firmemente en el primer lugar es su modelo de autocompletado exclusivo, que admite completado entre líneas y archivos en todas direcciones, y…
La ventaja bien conocida de Anthropic es el sentido común, es decir, common sense. Algunos trabajos de desarrollo dependen del sentido común, otros de lógica propietaria. El estilo de razonamiento de opus es conjeturar muchas posibilidades y luego verificarlas rápidamente. GPT5 tiende a razonar según la implementación del código, repasando repetidamente el negocio. En cuanto al estilo, es similar a la diferencia entre búsqueda en amplitud y búsqueda en profundidad. A medida que…
Se puede pedir reembolso otra vez, dejo los recursos a los compañeros. 40 yuanes al mes es barato, pero no se puede usar de día y de noche tengo que dormir, ¡esto no es un plan lite, es un plan night! Cuestionario de reembolso, zhipu-ai.feishu.cn/share/base/form/shrcn8hoW11cnI0PRd7H…
Esta es la tercera vez que caigo en la trampa de Zhipu. Dijeron que para retener a los usuarios antiguos darían cuota sin límite semanal, así que volví a probarlo, y otra vez me engañaron. No tiene límite semanal, pero cuando lo necesito simplemente no funciona; justo cuando entro y salgo del trabajo, revive, lo que podría llamarse encontrarse en la cima. En febrero dije que Zhipu lite tenía concurrencia única, y Zhipu usó su certificado empresarial para denunciarme en xhs…
La narrativa de costos no es adecuada para la industria de los grandes modelos; todos están perdiendo dinero, incluso el ganador pierde. Los perdedores sienten que esto no puede continuar, no tienen capacidad para persuadir al ganador de subir precios, así que deciden primero subir el precio de sus propios productos obsoletos, lo cual es hacerlo por despecho y cavar su propia tumba. Los fabricantes nacionales de modelos de código abierto se hacen un nombre, y después de que sus modelos tienen cierta competitividad cierran el código, qwen3.6/minim…
He usado vscode durante diez años y es la primera vez que veo una actualización de tema. En comparación con el tema predeterminado original, hay menos bloques de color, los negros son más negros y los blancos son más blancos. #vscode[tema]#
En los seis meses desde el lanzamiento de la serie GPT5, su rigor lógico ha sido líder, pero lo más criticado es su velocidad relativamente lenta, especialmente GPT5.2, lento de manera absurda; para muchas solicitudes comunes, opus podría tardar 20 segundos en recopilar el contexto y empezar a modificar, mientras que GPT5.2 probablemente tardaría 20 minutos en analizar antes de empezar a cambiar. El modelo GPT5.2codex de la misma época era algo más rápido, pero con lógica claramente reducida. Después, el modelo GPT5.3codex equilibró lógica y velocidad, y los modelos codex empezaron a ser utilizables. GPT5.4 integró la capacidad de código en el modelo principal, dejando de lanzar modelos codex por separado, y su velocidad mejoró notablemente. Se dice que la eficiencia por token aumentó, por lo que puede pensar menos para alcanzar una precisión similar.
Condenado por infracción aunque no tuviera servidor, por usar fuentes de libros pirateados para atraer tráfico y ganar dinero con la cuenta pública; aunque no creara piratería personalmente, compartir tampoco está permitido #desarrolladorindependiente[tema]# #cuidadoconlasestafas[tema]#
Muchas personas que no son programadores también han empezado a usar diversas herramientas de automatización, lo cual nos trae un rayo de esperanza a los que trabajamos en seguridad.
Por parte de claude, el precio de max5x es cinco veces el de pro, y la cuota también es cinco veces; el precio de max20x es diez veces, y la cuota es 20 veces. Por parte de OpenAI, pro es 6 veces plus, review es 10 veces, la relación calidad-precio es difícil de evaluar. Por supuesto, también tiene el privilegio de procesamiento prioritario de solicitudes, no estoy seguro de cuánto más rápido puede ser. Uso diariamente el chat para conversar, activando extend thinking se siente en promedio unos cinco minutos por pregunta. El límite semanal de plus es de 3000 conversaciones, de sobra. El cli de codex con cuota semanal intensiva dura dos días (sin fast activado), así que solo necesitas preparar dos o tres cuentas plus para cubrir lo semanal, si eres impaciente y activas fast, con 4 cuentas también basta.
#https://jqknono.github.io/coding-plans-for-copilot/ Paquetes de modelos de código abierto nacionales y extranjeros recopilados, así como la latencia de los proveedores y la velocidad de tokens
Solo recopila y organiza fabricantes nacionales con cierta reputación, no estaciones de retransmisión, con cierta garantía de seguridad. En el uso real, la latencia del primer token, la velocidad de tokens, el número de concurrencias y si está cuantizado son muy importantes pero los fabricantes lo mencionan poco. En comparación, la velocidad es más importante, de verdad. #jqknono.github.io/coding-plans-for-…
En el momento de mayor suscripción contraté varios planes a la vez, y no pude usarlos todos, perdiendo al menos la mitad de varios cientos al mes. OpenAI recientemente abrió codex cli a usuarios gratuitos, con cierto cupo semanal gratuito, y quienes conocen codex saben que su cupo es muy diferente al de claudecode, y es muy duradero. Tengo 6 cuentas propias, conectadas a un…
Quienes conocen las evaluaciones de LLM saben que opus a menudo supera a gpt en varias listas de evaluación, pero en el uso real la capacidad de gpt para resolver problemas es insuperable. Hasta el momento de publicar, los modelos principales más recientes de la serie gpt5 son gpt-5.2-mini, gpt-5.2, gpt-5.3-codex, gpt-5.3-codex-sp…
La ventana de reembolso se abrirá dentro de una semana después del festival, hasta el 6 de marzo de 2026. Entonces entra en la página de Mi plan, haz clic en Cancelar y reembolsar para completarlo con un solo botón. Nota: esta ventana de reembolso termina el 3.6. Hermanos programadores, recordad vuestra experiencia usando Zhipu en los últimos dos meses, creed en vuestros sentimientos y decidid con racionalidad.
En primer lugar, la tarea consistía simplemente en traducir del chino al inglés una aplicación nodejs que convierte un mermaid en imagen; es una herramienta pura y la tarea era solo traducción. Hasta ahora, al usar el modelo de Zhipu he encontrado los siguientes problemas: 1. límites de concurrencia extremadamente bajos, cuanto más se necesita, menor es la concurrencia 2. velocidad de generación de tokens baja 3….
Mucha gente dice que el límite de concurrencia del plan lite es bajo, pero puede que no hayan explicado claramente qué tan bajo es. Lo explicaré con más claridad. Solo hay una concurrencia, lo que significa que en herramientas con mecanismo de subagentes, lite simplemente no puede funcionar. He comprado todo tipo de productos de IA durante cuatro o cinco años, y el plan de Zhipu es el mayor engaño en el que he caído; casi no sirve para programar. Ahora solo puede usarse para…
Después de recargar 10 dólares en openrouter, se dispone de 1000 usos diarios de modelos gratuitos; 1000 usos son más que suficientes para mis validaciones. Pero durante bastante tiempo, muchos de sus modelos devolvían constantemente errores 429, como openai/gpt-oss-120b:free, etc. Hoy probé manualmente varios métodos y finalmente confirmé…
Dirección de código abierto github:jqknono/reference-Harmony Las funciones principales se muestran en la imagen, presenta los atajos de teclado y comandos comunes de diversas herramientas de desarrollo populares, lo cual puede ayudar a mejorar la eficiencia laboral. La arquitectura de “referencia rápida de desarrollo” es clara, la función es sencilla y enfocada, no habrá anuncios en el futuro, y cumple totalmente con la política de revisión de aplicaciones de Huawei. En diciembre…
Me quedé un momento confundido al verlo, hasta que entendí que “plan” se había traducido como “paquete”. GPT5.2high es terriblemente lento, GPT5.3 aún no ha salido, pero 5.3-codex salió primero. En las pruebas reales la velocidad mejora notablemente, y la caída en capacidad lógica no es tan evidente como la de GPT-5.2-Codex frente a GPT5.2, es un modelo de codificación especializado que vale la pena adoptar…
La app Qwen utiliza operación de deslizamiento en cuatro direcciones: a la izquierda están el historial de conversaciones y los agentes, a la derecha está el mercado de agentes. Cuando el trazo de deslizamiento en pantalla no es recto arriba-abajo, sino similar a un trazo diagonal (丿) o un trazo descendente, se invoca el contenido lateral, y para volver a la interfaz de conversación no se desliza la pantalla, sino que se requiere una acción de retorno, deslizando desde el borde de la pantalla para volver. Si la dirección se confunde, la app se bloquea. La app Qwen…
Es incómodo crear una nueva conversación; tras crearla solo aparece un mensaje emergente, y los mensajes históricos siguen en su lugar. Al cambiar de tema todavía se ve la respuesta de la pregunta anterior, dando la sensación de que el contexto no se ha cambiado, lo cual es poco común entre las muchas apps de chat de IA. Pero el umbral de uso de Doubao es realmente más bajo, lo que favorece su desarrollo de usuarios.
Cuando algunos desarrolladores de modelos lanzan una nueva versión al principio, la velocidad de respuesta es ideal y no hay degradación de inteligencia; si hay muchos usuarios, tanto la velocidad como el rendimiento disminuyen. Esta es la actitud de los líderes: una vez que el rendimiento se queda atrás, los usuarios se van y las tarjetas acaparadas quedan ociosas. Para evitar esta situación, se puede considerar desacoplar los activos pesados de los activos de propiedad intelectual, vender derechos de uso del modelo o alquilar recursos de hardware.
Archivo de publicación corta en Xiaohongshu sobre que los libros que los miembros con tarjeta de experiencia de WeChat Reading pueden leer son cada vez menos.