
Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 选型与运行指南按显存挑量化三步跑起来【免费下载链接】Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive项目地址: https://ai.gitcode.com/hf_mirrors/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-AggressiveQwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 是一款完全解锁的无审查多模态模型基于 Qwen/Qwen3.6-35B-A3B 构建原生处理文本、图像与视频实测拒绝率 0/465。35B 总参数每次前向仅约 3B 活跃MoE 架构消费级硬件即可运行Aggressive 变体不会拒绝任何提示词始终产出完整内容。想把它当作本地全解锁的生成工具你只需要按下面的表选档、克隆仓库、用 llama.cpp 启动。 先选档按显存选量化版本这个模型的硬件画像35B 总参数 / 约 3B 活跃参数MoE256 个专家、每个 token 路由 8 个40 层线性注意力与全 softmax 注意力按 3:1 混合原生上下文长度 262K。下面所有量化版本都用重要性矩阵imatrix生成同档位下比常规量化的质量保留更好。量化类型BPW大小Q8_K_P10.0644 GBQ6_K_P7.0731 GBQ5_K_P6.4728 GBQ4_K_P5.4023 GBQ4_K_M4.8821 GBIQ4_NL4.5620 GBIQ4_XS4.3219 GBQ3_K_P4.3919 GBIQ3_M3.5615 GBQ2_K_P3.4615 GBIQ2_M2.6911 GBmmproj (f16)—899 MB选档逻辑很简单能装下多大就选多大。16GB 内存跑 IQ4_XS / IQ3_M 这一档15–20 GB显存 24GB 以上就上 Q4_K_P23 GB或 Q5_K_P28 GB内存宽裕再考虑 Q8_K_P44 GB。注意 128K 上下文还要额外吃内存务必留余量。mmproj 那一行是视觉投影文件跑图像/视频场景要随主模型一起拿。K_P 量化优先理由K_PPerfect是 HauhauCS 的自定义量化用模型专属分析挑出最关键的质量做保留每个模型都有自己独立的优化配置。等效于质量提升 1–2 个量化级别文件只比基础量化大 ~5–15%llama.cpp、LM Studio 及任何 GGUF 运行时直接可用无需特殊构建。⚙️ 三步跑起来装环境、拉模型、启动1. 准备运行时环境先确认内存至少 16GB较小的量化版本以此为准再装一个 GGUF 兼容运行时llama.cpp、LM Studio、Jan、koboldcpp 任选其一即可。2. 拉取模型文件克隆仓库一次拿齐全套量化文件和 mmproj 文件git clone https://gitcode.com/hf_mirrors/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive在里面挑出你选定的那档主 GGUF 文件。3. 用 llama.cpp 启动llama-cli -m Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_P.gguf \ --mmproj mmproj-Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-f16.gguf \ --jinja -c 131072 -ngl 99-ngl 99把所有层丢给 GPU-c 131072开 128K 上下文这是保留思考能力的门槛别省。示例用的是 Q4_K_P把你第 1 步选定的文件名换进去就行纯文本场景可去掉--mmproj那行。⚠️ 参数与避坑速查采样参数 3 条硬性要求采样参数直接沿用 Qwen 官方作者的建议按思考/非思考模式各取一组思考模式默认一般用途temperature1.0, top_p0.95, top_k20, min_p0, presence_penalty1.5编码/精确任务temperature0.6, top_p0.95, top_k20, min_p0, presence_penalty0非思考模式一般用途temperature0.7, top_p0.8, top_k20, min_p0, presence_penalty1.5推理任务temperature1.0, top_p1.0, top_k40, min_p0, presence_penalty2.0三条硬性要求一条都别省上下文保持 ≥128K否则思考能力会打折扣llama.cpp 必须加--jinja标志否则聊天模板处理不正确视觉图像/视频支持需要mmproj文件与主 GGUF 一起加载️ 故障速查表加载失败 / 量化显示? / 视觉不生效现象原因解决模型无法加载运行时不支持 GGUF 格式或文件下载不完整、已损坏确认运行时是 llama.cpp / LM Studio / Jan / koboldcpp 之一重新下载模型并校验文件完整性LM Studio 量化列把 K_P 量化显示为?LM Studio 的量化识别表没有收录 K_P 自定义命名纯显示问题模型加载和运行完全正常忽略即可图像/视频输入没有反应只启动了主 GGUF视觉能力没启用用--mmproj参数把 mmproj (f16) 文件与主模型一起加载另外记住一点输出末尾偶尔出现的简短免责声明是基础模型训练里自带的痕迹不是拒绝——内容始终完整生成。写在最后跑起来之后这就是你本地能拿到的最强无审查生成工具之一如果你希望保留一些安全护栏HauhauCS 未来可能推出保留部分防护措施的 Balanced 变体值得留意。【免费下载链接】Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive项目地址: https://ai.gitcode.com/hf_mirrors/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考