LittleLamb 0.3B Powered by CompactifAI Tiny Model · 50% Compressed · Thinking & Non Thinking Modes Table of Contents Highlights Model Overview Key Characteristics Quick Start What's New in LittleLamb 0.3B Dual Mode Inference (Thinking / Non Thinking) Training & Fine Tuning Architecture Evaluation & Benchmarks Languages Intended Use Safety & Limitations Model Information Citation Model Overview LittleLamb 0.3B is a general purpose bilingual model at 290M parameters , a similar size class to 270M models such as gemma3 270m it and functiongemma 270m it —developed based on Qwen3 0.6B, by Multiverse Computing . The original Qwen3 0.6B is an open weight, instruction tuned model with thinking and non thinking capabilities and multilingual coverage. LittleLamb 0.3B is compressed at a 50% compression rate using CompactifAI , Multiverse Computing's proprietary technology. The model supports English and Spanish and retains Qwen3's dual thinking/non thinking modes. Key Characteristics Characteristic Description Base model Qwen3 0.6B (0.6B params, 0.44B non embedding; open weight, Apache 2.0) Parameters 290M total parameters after CompactifAI compression (50% compression rate from base 0.6B) Ar…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy