对话 新对话
推理速度
--tok/s
首 Token
--ms
内存占用
--MB
KV 缓存
0tokens
引擎
WebLLM
FableFlow
基于 WebLLM + WebGPU 的零成本浏览器 AI 引擎
100% 本地推理,数据不出境,永久免费运行
WebGPU 加速
5-10x 融合优化
📦
AWQ INT4
8x 模型压缩
🔒
本地推理
数据不出境
💰
零成本
永久免费
AI 生成内容仅供参考 · 所有数据在本地处理 · 隐私政策