← 返回首页
🧪 AI 内容小助手
实验性功能
加载本地大模型,用简单的对话窗口测试效果
⚠️ 使用前请注意:
这是实验性功能,依赖社区提供的浏览器版模型文件,可能不稳定或加载失败
检测到你正在用手机访问
:这个功能对内存要求较高,手机上很容易出现"加载到一半页面自动刷新/卡住"的情况(本质是系统内存不足),成功率不如电脑浏览器,请酌情尝试,条件允许的话更建议换用电脑
如果想清理占用的存储空间、或者遇到问题想重新下载,可以点击下方"🗑️ 清理模型缓存"
页面会
自动检测硬件并推荐最合适的模型档位
(标准版约 480MB / 兼容版约 780MB / MiniCPM5-1B 约 930MB / 加强版约 1.2GB),首次使用需下载对应的模型数据,仅下载一次,浏览器会自动缓存;请在网络良好时使用
这些模型均为 4bit 量化格式,
主要依赖 WebGPU 显卡加速
:完全没有可用显卡(或只有软件模拟适配器)时会
在加载前直接拒绝
,因为这种格式没有实用的 CPU 版本;显卡不支持 fp16 时会自动推荐兼容版。就算检测到了真实显卡,
集成显卡(核显)仍然会比独立显卡慢一些
,请耐心等待并降低速度预期
关于"回答质量"
:标准/兼容版是
0.5B 参数、再经过 4bit 量化的小模型
,能力上限本来就有限,回答简单、偶尔答非所问都属正常。
显卡只影响快慢、不影响聪明程度
——想要更好的回答质量,可以在内存充裕的电脑上手动选择加强版(1.5B,有内存不足崩溃的风险)
检测到你在用 Mac
:部分 Mac 的 Chrome/浏览器在加载这个模型时,可能因为 GPU 显存不足导致
浏览器(或标签页)直接崩溃/重载
——这类崩溃发生在很底层,页面无法完全拦截。建议加载前先关掉其它占显存的标签页/应用,并优先使用最新版 Chrome
这里只是一个用于测试模型效果的
对话调试窗口
;具体的"AI 辅助生成"功能(如听写词语生成)已经分别做进了对应的功能页面里,加载过一次模型后,那些页面会自动出现对应入口
可选模型来自通义千问
Qwen2.5
与面壁智能
MiniCPM5
系列,权重均遵循
Apache 2.0
开源许可,可自由用于学术与商业用途
正在检测设备加速能力...
🔍 检测硬件并查看详情
选择模型:
📥 加载模型
🗑️ 清理全部模型缓存
💾 本地已下载的模型
💬 对话调试窗口:随便聊聊,测试一下模型的回复效果(回复内容不保证准确,仅供调试参考)。
发送
🗑️ 清空对话