← 返回首页

🧪 AI 内容小助手实验性功能

加载本地大模型,用简单的对话窗口测试效果

⚠️ 使用前请注意:
  • 这是实验性功能,依赖社区提供的浏览器版模型文件,可能不稳定或加载失败
  • 如果想清理占用的存储空间、或者遇到问题想重新下载,可以点击下方"🗑️ 清理模型缓存"
  • 页面会自动检测硬件并推荐最合适的模型档位(标准版约 480MB / 兼容版约 780MB / MiniCPM5-1B 约 930MB / 加强版约 1.2GB),首次使用需下载对应的模型数据,仅下载一次,浏览器会自动缓存;请在网络良好时使用
  • 这些模型均为 4bit 量化格式,主要依赖 WebGPU 显卡加速:完全没有可用显卡(或只有软件模拟适配器)时会在加载前直接拒绝,因为这种格式没有实用的 CPU 版本;显卡不支持 fp16 时会自动推荐兼容版。就算检测到了真实显卡,集成显卡(核显)仍然会比独立显卡慢一些,请耐心等待并降低速度预期
  • 关于"回答质量":标准/兼容版是 0.5B 参数、再经过 4bit 量化的小模型,能力上限本来就有限,回答简单、偶尔答非所问都属正常。显卡只影响快慢、不影响聪明程度——想要更好的回答质量,可以在内存充裕的电脑上手动选择加强版(1.5B,有内存不足崩溃的风险)
  • 这里只是一个用于测试模型效果的对话调试窗口;具体的"AI 辅助生成"功能(如听写词语生成)已经分别做进了对应的功能页面里,加载过一次模型后,那些页面会自动出现对应入口
  • 可选模型来自通义千问 Qwen2.5 与面壁智能 MiniCPM5 系列,权重均遵循 Apache 2.0 开源许可,可自由用于学术与商业用途
正在检测设备加速能力...
💬 对话调试窗口:随便聊聊,测试一下模型的回复效果(回复内容不保证准确,仅供调试参考)。