Vikhr Llama3.1 8B Instruct R 21 09 24 Описание Vikhr Llama3.1 это унимодальная LLM (Large Language Model) на 8B параметров представляющая из себя улучшенную версию meta llama/Meta Llama 3.1 8B Instruct командой VikhrModels , адаптированную преимущественно для русского и английского языков. Для ее обучения мы использовали несколько этапов включающих в себя SFT и SMPO нашу собственную вариацию DPO, подробнее читайте в секции "Как эта модель создавалась" . Модель оптимизированна для различных вариантов использования, включая ризонинг, суммаризацию, код, roleplay, поддержание диалога. Vikhr Llama обладает возможностью многоязычной генерации, и высокопроизводительными возможностями RAG. Модель имеет лучшие оценки среди прочих на наших инструктивных и RAG бенчарках и, поэтому, мы верим, что во многих задачах может быть лучше чем gpt 3.5 turbo от OpenAI. Весь использованный код для обучения доступен в нашем репозитории effective llm alignment на GitHub, а основные датасеты доступны в нашем профиле на HF. Особенности 1. Высокое качество генераций на русском и английском языках, а также некоторых других языках, благодаря датасету Grandmaster PRO MAX и исходной модели 2. Поддержка системных…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy