Cerebras publica su catálogo de modelos de inferencia y aclara su política de compresión
Cerebras Inference detalla en su documentación oficial el catálogo de modelos disponibles en sus endpoints públicos, así como las técnicas de compresión que aplica —y las que no— a los modelos de código abierto que aloja. La compañía aclara que no ofrece modelos podados (pruned) en sus endpoints com
