GLM-5.3 ya es open-weight: el modelo más potente de Z.ai para coding y ciberdefensa

GLM-5.3 is now open-weight

GLM-5.3 ya es open-weight: el modelo más potente de Z.ai para coding y ciberdefensa

Z.ai ha liberado los pesos de GLM-5.3, su modelo más avanzado para codificación agéntica y ciberdefensa. Ahora cualquiera puede descargarlo, ejecutarlo y personalizarlo desde Hugging Face. El anuncio incluye un enlace al blog técnico y ha generado reacciones de la comunidad: Unsloth ya prepara versiones GGUF para ejecución local, y Baseten lo integrará próximamente. Sin embargo, un usuario señala que la licencia ya no es MIT, sino semi-comercial, similar a la de Kimi, MiniMax o Qwen.

GLM-5.3 es ahora open-weight: nuestro modelo más capaz para codificación agéntica y ciberdefensa ya está disponible para descargar, ejecutar y personalizar.
  1. revolvingthrow

    GLM 5.3 es probablemente el modelo de pesos abiertos más equilibrado si quieres ir más allá de DeepSeek Flash o del nuevo GLM Flash. Lo usé con Pi y la experiencia fue bastante buena, sobre todo porque es menos quisquilloso con temas de ciberseguridad y demás que los modelos estadounidenses. Está un poco por detrás de Kimi en capacidad, pero es mucho más fácil de ejecutar; esperaría que los precios (¡y la velocidad!) de terceros sean notablemente mejores.

    Suponiendo que estés dispuesto a gastar un dineral en el próximo Mac M5 Ultra con 512 GB de memoria unificada, incluso puedes ejecutarlo localmente, cuantizado a 4 bits. Si es mínimamente razonable, bueno, mi esposa probablemente me desollaría vivo, pero quizás la tuya sea más comprensiva.

  2. nkmnz

    Me gustaría preguntarle a Sam Altman si todavía piensa que es demasiado peligroso publicar GPT-3. Quiero decir, nadie lo usaría, pero ¿cuál es su razonamiento para no publicarlo ahora, en 2026?

  3. mmastrac

    Anteriormente publiqué que DS4Flash era _bueno_ pero no _excelente_ en dos DGX Sparks, pero tengo que decir que GLM-5.3 es bastante impresionante. Ha podido abordar todos los problemas difíciles y aleatorios que le he lanzado y tiene la intuición que DS4Flash parece carecer.

    Estamos lejos de un modelo de clase Fable en mi opinión, pero las cosas se van a poner interesantes en este próximo año.

  4. armcat

    Lo que es muy prometedor aquí es la relación entre tokens y precisión. Supongo que sus "tokens de salida" significan tokens generados como parte del pensamiento y cualquier llamada a herramientas (lo que los proveedores de servicios denominan "tokens de entrada" desde el punto de vista de facturación). Los modelos chinos como Qwen3.8 y GLM 5.2 piensan en exceso en nuestras cargas de trabajo (que son tareas de análisis de datos altamente complejas). Es un factor de 3 a 4 veces mayor que Opus y los modelos GPT. Incluso con precios más baratos por millón de tokens, el costo termina siendo más alto, en algunos casos el doble. Así que esto es muy prometedor de GLM 5.3. Espero con ansias probarlo.

  5. scosman

    Lo he estado usando cada vez más. Se siente como Opus 4.8, en el mejor sentido posible.

  6. redox99

    Encuentro GLM 5.3 Flash más interesante que 5.3. El hecho de que 5.3 no tenga visión es un factor decisivo. Además, 5.3 Flash parece ser mejor para crear interfaces de usuario bonitas.

  7. fra

    h/t a DeepInfra por ser el primer proveedor externo en OpenRouter (https://openrouter.ai/z-ai/glm-5.3?endpoint=b711bea7-3994-49...).

  8. kixiQu

    ¿Esto significa que estará pronto en Bedrock? He oído cosas geniales sobre este modelo, pero quiero las prácticas de manejo de datos de AWS...

Más de este día

2026-08-28