Bonsai 2 27B comprime un modelo de IA a 5.9GB sin perder casi nada de capacidad

Bonsai 2 27B: Near-Lossless Compression in a 9x Smaller Footprint

Bonsai 2 27B comprime un modelo de IA a 5.9GB sin perder casi nada de capacidad

Prism ML lanza Ternary Bonsai 2 27B, basado en Qwen3.8 27B, que usa pesos ternarios y ocupa 5.9GB, más de 9 veces menos que el modelo completo. Conserva el 98.2% de su rendimiento en razonamiento, código, visión y agentes, con una ventana de contexto de 262K tokens. Alcanza 143 tokens/s en RTX 5090 y 46.8 tokens/s en M5 Max, bajo licencia Apache 2.0.

La pregunta ya no será solo cuán capaz es un modelo, sino cuánta inteligencia útil se puede entregar dentro de un presupuesto dado de memoria, cómputo y energía.

Más de este día

2026-09-17