This model is based on bigscience/bloom 1b7. We pruned its vocabulary from 250880 to 46145 with Chinese corpus to reduce GPU memory usage. So the total parameter is 1.4b now. How to use
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy