PrismML, fundada por investigadores de Caltech, ha publicado el modelo Bonsai 2 27B que reduce el modelo Qwen 27B de código abierto de Alibaba a 5,9 GB, requiriendo entre 9 y 10 veces menos memoria que el original.

El modelo iguala el 98 % de las puntuaciones combinadas de referencia de Qwen, una mejora respecto al 95 % del primer modelo Bonsai lanzado en marzo.

La compañía busca eliminar la necesidad de que los grandes modelos de lenguaje capaces y con capacidad de razonamiento tengan tamaños masivos mediante esta tecnología de compresión.