每日签到 地址发布 老王说明书 宣传中心 繁/简
所有非百度云的云盘统一只能发到这里!!!

此板块禁止发布游戏资源,禁止诱导回帖、点赞、收藏等
查看: 4.3K|回复: 10
收起左侧

[软件] [转载搬运] 你们要的本地酒馆模型来了Qwen3.6-35B-A3B 越狱版 [n+72g]

  [复制链接]
发表于 2026-6-9 11:02:47 | 显示全部楼层 |阅读模式
下载信息分类(其他网盘版)
下载方式(其他网盘版): 夸克网盘
来源: 转载搬运
文件数量: n
资源大小: 72g
解压密码:
解压软件: 360

马上注册,结交更多好友,享用更多功能,让你轻松玩转社区。

您需要 登录 才可以下载或查看,没有帐号?免费注册

x
本帖最后由 gzqkrl 于 2026-6-17 00:50 编辑

      老是看有人问有没有本地可以用在酒馆上的ai,不是配置要求太高就是太傻,这次终于找到个合适的。
Qwen3.6-35B-A3B 越狱版!目前最强“无审查”开源模型?6G 显存都能跑,本地 AI 彻底自由了
最近 AI 圈,真的越来越离谱了。如果你一直关注本地大模型,应该已经发现:现在的开源模型,不仅越来越聪明,甚至已经开始挑战很多闭源商业 AI。而今天要介绍的这个模型,更是直接把“本地 AI”推向了另一个阶段。
它就是:Qwen3.6-35B-A3B Uncensored HauhauCS Aggressive
20260524094928_092626-1536x864.jpg
一个目前热度极高的“越狱版”开源模型。而且重点是:它不仅无审查、无限制,还非常聪明。甚至可以说:这可能是目前最强的越狱版开源模型之一。

什么是“越狱版”模型?
简单来说:
官方模型通常会加入大量安全限制。
比如:
  • 敏感内容拒答
  • 某些问题无法回答
  • 强制政治正确
  • 输出被过滤
  • 系统提示词限制
所以很多时候:
你明明只是正常提问。
结果模型却:
“抱歉,我无法帮助你。”
而这类 Uncensored(无审查)版本:
则会尽可能移除这些限制。
尤其这个:
Aggressive 版本
可以说是:
目前最激进的版本之一。
官方模型 VS 越狱版模型
实测效果非常夸张。同样的问题:
官方模型:
  • 疯狂拒答
  • 强制安全策略
  • 输出保守
而越狱版:
不仅会回答。
甚至:
  • 什么都敢说
  • 什么都肯干
  • 几乎没有限制
  • 20260524103741_562767-scaled.jpg
  • 而且最关键的是:
    它并不是那种:
    “只会越狱,但智商很低”的模型。
    恰恰相反。
    这个模型:
    真的非常聪明。
    部署教程:
    1、模型
    模型来源:O站社区
    里面有多种不同大小的量化版,你可以根据自己的显存大小,来选择对应的版本,最小的11G模型可以在6G/8G显存上跑起来,但是建议最低使用8G显存2、 llama.cpp
  • 这款免费开源项目支持 N卡、A卡、I卡 还有纯CPU运行,同时也可以在Mac、Linux系统上运行!也就意味着,你几乎可以在任何电脑上进行运行。速度还非常快,远比ollama、LM Studio 快的多也稳定的多!!
  • 20260524095705_536710-940x529.jpg
  • 3、一键启动脚本(支持多版本切换)
    将下面的的脚本另存为BAT批处理,保存的时候选择utf-8格式,嫌麻烦直接下载打包版

  1. [url=home.php?mod=space&uid=103185]@echo[/url] off
  2. chcp 65001 >nul
  3. title Qwen3.6-35B-A3B 越狱版

  4. cd /d "%~dp0"

  5. :menu
  6. cls
  7. echo ==========================================
  8. echo      Qwen3.6-35B-A3B 越狱版+多模态模型
  9. echo               零度优化版
  10. echo ==========================================
  11. echo.
  12. echo 1. Q4_K_P(4090 推荐)
  13. echo 2. Q4_K_M(稳定版)
  14. echo 3. IQ4_NL(高压缩高质量)
  15. echo 4. IQ2_M(6G/8G 显卡)
  16. echo.
  17. echo ==========================================

  18. set /p choice=请输入数字:

  19. if "%choice%"=="1" (
  20.     llama-server.exe ^
  21.     -m "models\Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_P.gguf" ^
  22.     --mmproj "models\mmproj-Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-f16.gguf" ^
  23.     -ngl 999 ^
  24.     -c 131072 ^
  25.     -n 8192 ^
  26.     --host 127.0.0.1 ^
  27.     --port 8080
  28. )

  29. if "%choice%"=="2" (
  30.     llama-server.exe ^
  31.     -m "models\Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf" ^
  32.     --mmproj "models\mmproj-Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-f16.gguf" ^
  33.     -ngl 999 ^
  34.     -c 131072 ^
  35.     -n 8192 ^
  36.     --host 127.0.0.1 ^
  37.     --port 8080
  38. )

  39. if "%choice%"=="3" (
  40.     llama-server.exe ^
  41.     -m "models\Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-IQ4_NL.gguf" ^
  42.     --mmproj "models\mmproj-Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-f16.gguf" ^
  43.     -ngl 999 ^
  44.     -c 131072 ^
  45.     -n 8192 ^
  46.     --host 127.0.0.1 ^
  47.     --port 8080
  48. )

  49. if "%choice%"=="4" (
  50.     llama-server.exe ^
  51.     -m "models\Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-IQ2_M.gguf" ^
  52.     --mmproj "models\mmproj-Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-f16.gguf" ^
  53.     -ngl 999 ^
  54.     -c 8192 ^
  55.     -n 4096 ^
  56.     --host 127.0.0.1 ^
  57.     --port 8080
  58. )

  59. pause
复制代码



20260524100109_012895-940x503.jpg
打开后在上面选择对应的模型,输入对应的数字确认即可启动!
注意:如果启动后出现乱码,则:进入系统设置中心,在顶部搜索关键词:系统区域设置,打开选择用于非Unicode程序的语言,然后勾选 Beta版:使用 Unicode UTF-8 提供全球语言支持;重启电脑再打开就不会乱码! 如下图所示:
20260528025432_937912-940x515.jpg

当然需要真正实现tokens自由,本地不受限制,完全免费使用AI Agent,那么将其对接到Hermes或者OpenClaw 小龙虾上去,才能真正体现出它的价值所在。
AI Agent 对接步骤:
1、在选择模型提供商的时候,选择自定义
20260524100404_821676-940x529.jpg
2、API base 地址填写:
[size=1em][size=1.25em]http:[size=1.25em]//127.0.0.1:8080/v1





API key 密钥随便填写一个数字或留空都可以

3、其它设置可以根据自己的喜好进行自定义
20260524100746_174902-940x529.jpg

Qwen3.6-35B-A3B 为什么这么强?
很多人看到:
35B
第一反应是:
“这得服务器才能跑吧?”
但实际上:
Qwen3.6-35B-A3B 用的是:
MoE(专家混合架构)
简单理解:
虽然模型总参数是 35B。
但每次实际运行时:
只会激活大约 3B 参数。
这意味着:
它既拥有超大模型的能力。
又拥有小模型的速度。
6G 显存都能跑?
是的。
这也是它最夸张的地方之一。
通过 GGUF 量化后:
甚至:
  • 6G 显存
  • 8G 显存
  • 普通游戏显卡
都能运行。
并且支持:
  • NVIDIA 显卡
  • AMD 显卡
  • Intel Arc 显卡
真正实现:
本地 AI 自由在 Artificial Analysis 排行榜中表现极强
目前在全球权威 AI 榜单:
20260524101123_401057-940x615.jpg
Qwen3.6-35B-A3B 在 40B 以内开源模型中:
几乎属于第一梯队。
尤其:
  • 中文理解
  • 代码能力
  • 多模态视觉
  • 推理能力
  • 长上下文能力
表现都非常夸张。
尤其中文能力。
可以说:
这是目前中文体验最强的一批开源模型。
多模态支持也非常离谱
这次不仅支持文本。
还支持:
多模态视觉识图
也就是说:
它可以直接:
  • 看图片
  • 分析截图
  • OCR 识别
  • 理解画面内容
  • 分析复杂 UI
  • 阅读代码截图
配合 llama.cpp 最新版后:
甚至已经可以当:
本地版 ChatGPT Vision
来使用。
20260524101147_350126-940x527.jpg
本地部署非常简单
这次部署方案:
我使用的是:
llama.cpp 最新版
优点非常明显:
  • 免费
  • 开源
  • 支持 Windows
  • 支持 CUDA
  • 支持 Vulkan
  • 支持 AMD
  • 支持 Intel
而且:
现在 llama.cpp 已经越来越成熟。
不仅支持:
  • OpenAI API
  • 多模态
  • 超长上下文
  • Agent 调用
甚至还能直接:
本地替代 OpenAI APIHermes Agent 实测效果惊艳
这次我还把它:
接入了 Hermes Agent。
效果可以说:
非常炸裂。
因为现在:
你不仅仅是在“聊天”。
而是:
真正拥有了一个:
本地 AI Agent
它可以:
  • 自动写代码
  • 自动分析图片
  • 自动执行任务
  • 自动工具调用
  • 自动联网
  • 长上下文记忆
而且:
完全本地运行。
不用联网。
不用 API Key。
没有 Token 消耗。
真正实现:
  • Token 自由
  • Agent 自由
  • 本地 AI 自由
推荐量化版本
不同显卡。
推荐不同量化。
RTX 4090 / 24G 显存
推荐:
  • Q4_K_P
  • Q4_K_M
体验最好。
8G 显存用户
推荐:
  • IQ2_M
  • IQ3_M
也能正常运行。
推荐 llama.cpp 参数
[size=1em]



推荐启动参数:
  1. llama-server.exe ^
  2. -m "模型路径.gguf" ^
  3. --mmproj "mmproj.gguf" ^
  4. -ngl 999 ^
  5. -c 131072 ^
  6. -n 8192 ^
  7. --host 127.0.0.1 ^
  8. --port 8080 ^
  9. --jinja
复制代码
其中:

--mmproj
是多模态必须参数。

否则:

上传图片按钮会变灰。

--jinja
则是新版 Qwen 模型非常重要的参数。

不加的话:

可能出现:

回复异常
格式错乱
无限重复
中文异常
现在的本地 AI,已经完全变了
很多人对本地模型的印象:

还停留在:

很笨
很慢
只能聊天
无法实用
但现在。

真的不一样了。

尤其:

Qwen3.6-35B-A3B 这种模型出现后。

本地 AI 已经开始:

真正接近商业闭源模型。

而且:

完全属于你自己。

最后
如果你一直想体验:

无审查 AI
本地 AI
多模态 AI
本地 Agent
超长上下文
本地 OpenAI API
那么:

这个模型。真的非常值得尝试。因为现在这种资源:谁也不知道还能存在多久。建议尽快收藏、下载、备份!
另外,对于想要用它来写小说的兄弟,我另外附了一个开源的ai小说软件,把小说软件的api设置成本地即可
  1. http://127.0.0.1:8080/v1
复制代码






回复

使用道具 举报

发表于 2026-6-19 00:23:26 | 显示全部楼层
纯小白能用吗?下了之后完全不知道怎么用,哪里可以查教程
回复 支持 0 反对 0

使用道具 举报

发表于 2026-6-12 06:23:04 | 显示全部楼层
小说软件怎么进  配置倒是都好了 也能用 小说没研究明白
屏幕截图 2026-06-12 062225.png
回复 支持 反对

使用道具 举报

 楼主| 发表于 2026-6-12 18:18:39 手机版 | 显示全部楼层
lw1544475469 发表于 2026-6-12 06:23
小说软件怎么进  配置倒是都好了 也能用 小说没研究明白

回复 支持 反对

使用道具 举报

发表于 2026-6-12 19:57:04 | 显示全部楼层

回复了啥  看不到 哈哈哈
回复 支持 反对

使用道具 举报

 楼主| 发表于 2026-6-18 21:48:44 | 显示全部楼层
lw1544475469 发表于 2026-6-12 06:23
小说软件怎么进  配置倒是都好了 也能用 小说没研究明白

小说软件补发了
回复 支持 反对

使用道具 举报

发表于 2026-6-21 16:19:47 | 显示全部楼层
我下了也不知道怎么用了,点击越狱版按数字出来一堆字符也没用
回复 支持 反对

使用道具 举报

发表于 2026-6-28 23:09:24 手机版 | 显示全部楼层
llama文件解压后打不开
回复 支持 反对

使用道具 举报

发表于 2026-7-19 09:59:43 | 显示全部楼层
666666666666666666666666666
回复 支持 反对

使用道具 举报

发表于 2026-8-22 10:05:21 手机版 | 显示全部楼层
对接酒馆以后报错 [34m63.29.798.579 W srv    operator(): got exception: {"error":{"code":400,"message":"Unable to generate parser for this template. Automatic parser generation failed: \n------------\nWhile executing CallExpression at line 85, column 32 in source:\n...first %}↵            {{- raise_exception('System message must be at the beginnin...\n                                           ^\nError: Jinja Exception: System message must be at the beginning.","type":"invalid_request_error"}}


有没有和我一样遇到这种情况的?
回复 支持 反对

使用道具 举报

 楼主| 发表于 2026-8-22 10:49:36 手机版 | 显示全部楼层
小小云飞joker 发表于 2026-8-22 10:05
对接酒馆以后报错 [34m63.29.798.579 W srv    operator(): got exception: {"error":{"code":400," ...

问豆包吧,代码我贴不出来一点发送就报错
回复 支持 反对

使用道具 举报

您需要登录后才可以回帖 登录 | 免费注册
点击进行验证

本版积分规则

我们不生产资源,只做资源的搬运工。

广告合作-tags标签-app下载-Archiver-小黑屋-