Paper Link 👁️ Hf ver 🚀 RU Описание модели GGUF Ruadapt версия инструктивной модели Qwen/Qwen3 4B Instruct 2507 . В модели был заменен токенизатор, затем произведено дообучение (Continued pretraining) на русскоязычном корпусе, после чего была применена техника LEP (Learned Embedding Propagation) . Благодаря новому токенизатору (расширенный tiktoken cl100k с помощью униграм токенизатора на 48 т. токенов) скорость генерации русскоязычных текстов возрасла до 100% (в зависимости от длины контекста) по сравнению с исходной моделью. Под скоростью генерации подразумевается количество русскоязычных символов/слов в секунду на одинаковых текстовых последовательностях. Важно Веса модели могут обновляться по мере получения новых версий. Информацию о версиях будет в самом конце README, там же фиксируются даты и коммиты версий, чтобы всегда можно было использовать предыдущие варианты при необходимости. Ответы модели не отражают мнения авторов, а лишь повторяют знания полученные из данных на всех этапах обучения (предобучение, смена токенизатора, обучение на инструкциях, калибровка качества ответов). Модель была получена из сторонней предобученной модели, контроль за предобучением которой не явл…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy