PrismML, fundada por investigadores de Caltech, ha publicado el modelo Bonsai 2 27B que reduce el modelo Qwen 27B de código abierto de Alibaba a 5,9 GB, requiriendo entre 9 y 10 veces menos memoria que el original.
El modelo iguala el 98 % de las puntuaciones combinadas de referencia de Qwen, una mejora respecto al 95 % del primer modelo Bonsai lanzado en marzo.
La compañía busca eliminar la necesidad de que los grandes modelos de lenguaje capaces y con capacidad de razonamiento tengan tamaños masivos mediante esta tecnología de compresión.
