Qwen3 Sex 简体中文 English 基于 Qwen3 4B Instruct 2507 进行 SFT 后得到的对话模型。 [!WARNING] 本模型面向 18 岁以上成年用户 ,可能输出包含成人内容、露骨描写等不适合所有受众的文本。请在使用前阅读下方免责声明。 模型简介 项目 内容 基础模型 Qwen/Qwen3 4B Instruct 2507 数据类型 bfloat16 上下文长度 原生支持 262,144(建议日常对话使用 4K–32K) 对话模板 ChatML( / ) 仓库内容 文件 说明 model .safetensors 完整权重(bfloat16) config.json / tokenizer / chat template.jinja 模型与分词器配置 generation config.json 推荐推理参数(请保持默认以获得最佳效果) infer.py 开箱即用的命令行多轮对话脚本 Modelfile Ollama 导入用的 Modelfile Qwen3 Sex BF16.gguf 未量化 GGUF(BF16,约 8 GB) Qwen3 Sex Q8 0.gguf Q8 0 量化 GGUF(约 4.3 GB) 推荐推理配置 [!IMPORTANT] generation config.json 中的参数是经过调优后推荐使用的配置, 强烈建议保持默认 。 快速使用 方式一:直接运行 infer.py (推荐) 仓库内已附带交互式命令行脚本,自动加载模型并按 generation config.json 中的参数推理,开箱即用: [!TIP] 输入 clear 清空多轮对话历史,输入 exit 或 quit 退出。 方式二:最小化推理代码 方式三:导入 Ollama 使用 GGUF 仓库中提供了 GGUF 格式模型文件( Qwen3 Sex BF16.gguf 和 Qwen3 Sex Q8 0.gguf ),可直接通过 Ollama 加载: [!CAUTION] GGUF 格式(尤其是 Q8 0 量化版)相比原始 safetensors 权重, 推理质量会有所下降 ,部分细节、长上下文连贯性以及生成的稳定性可能不如直接使用 infer.py 。如果对生成质量有较高要求,请优先使用方式一或方式二。 免责声明 [!CAUTION] 下载或使用本模型即表示您已阅读、理解并同意以下全部条款。 如不同意,请立即停止下载和使用。 点击折叠 / 展开完整声明 1. 成人内容警告 :本模型在含有成人导向内容的语料上进行了微调,可能生成包含露骨、敏感或不适合工作场所(NSFW)的文本。 严禁未满 18 周岁的用户访问、下载或使用本模型。 2. 使用范围 :本模型仅供学术研究、个人非商业用途及虚构创作参考。使用者必须遵守所在国家或地区的法律法…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy