ShapeLearn exprime Qwen 3.8 27B hasta el 99,63% de BF16 en una GPU de 13,1 GB
Shapelearn Qwen 3.8 27B (13.1 GB VRAM)
ByteShape publica los GGUFs completos de ShapeLearn para Qwen 3.8 27B tras una primera versión Lite con menos presupuesto de optimización. Los cinco modelos se sitúan en la frontera calidad-velocidad medida en seis GPUs: GPU-5 alcanza el 99,63% de la puntuación agregada de BF16 a 90,4 tok/s, mientras que GPU-4 llega al 98,72% en solo 11,0 GB. El decoding especulativo con MTP o DFlash2 acelera todos los modelos.
GPU-5 es nuestra recomendación por defecto allí donde quepa: alcanza 90,4 tok/s al 99,63% de la línea base BF16.