在你自己的浏览器里运行 AI 模型
这不是在演示别人的 API。模型本身会被下载到你的浏览器里,用 WebGPU 在你自己的硬件上执行,所以提示词、回复和生成的图像都不会离开这台机器。加载一个模型,切到飞行模式,照样能继续用。
- 完全在你的浏览器里运行
- 断网也能用
- 不上传
- 不用注册
- 没有水印
正在加载工具……
工作原理
- 选一个模型。每个模型在你下载之前,都会显示下载大小和需要的硬件条件。
- 等待下载完成 —— 只需一次,之后会保留在你浏览器的缓存里。
- 开始使用。如果想要证据,断开网络连接,再用一次看看。
为什么什么都不用上传
这个页面上的每一步操作,都由运行在你浏览器标签页里的代码完成,用的就是渲染网页的那套引擎。文件从磁盘读进标签页的内存,在那里被处理,再作为下载写回去。它不会被送到任何地方 —— 不会送给我们,也不会送给第三方。
自己动手验证
- 打开浏览器的开发者工具(F12),选择“网络”(Network)面板。
- 载入你的文件,运行这个工具。
- 你能看到的请求只有这些:工具自己的代码 —— 少数几个重型工具还会从公共 CDN 取它们的开源引擎 —— 外加一条发往 loreatec.jp 的小小访问记录(页面地址和标题,仅此而已)。没有一条带着你的文件。
常见问题
这真的是在本地运行,还是在调用某个 API?
在本地运行,这也是这个网站上最容易自己验证的一条说法:加载一个模型,切到飞行模式,照样能继续用 —— 换成 API 调用,这一步根本撑不过去。唯一的网络流量,是从 Hugging Face 一次性下载模型权重,这个过程可以在开发者工具的“网络”(Network)面板里看到。
为什么下载体积这么大?
因为这些就是真正的模型本体,不是一个瘦客户端。深度估计模型 30 MB,语音合成 175 MB,语音转写 282 MB,图像生成 1.9 GB,最大的对话模型 4.8 GB。每个模型只下载一次,之后会被缓存;开始之前,每个模型旁边都会标出大小,用完之后也有一个按钮可以把它们全部删除。
这八个模型具体能做什么?
两个 Gemma 4 模型能接收文本、图像和音频,并以文本作答。Gemma 3 1B 是一个更小、只处理文本的对话模型,给性能较弱的机器用。LCM Dreamshaper 根据提示词生成图像。Kokoro 把文字念出来。Whisper 转写音频。DETR 在照片里找出物体并标注类别。Depth Anything 从单张图像估计深度信息。
需要一台性能很强的电脑吗?
用小模型不需要:深度估计、物体检测和语音合成在普通笔记本上就能跑。图像生成和大一些的对话模型需要一块真正的 GPU 和足够的空闲内存 —— 每个模型旁边都标着一个大致的硬件门槛,下载几个 GB 之前就能先看到。没有 WebGPU 的话,所有模型仍然能在 CPU 上运行,只是会慢得多。
这些模型分别是什么许可?
六个是 Apache-2.0,一个是 MIT,Gemma 3 1B 则遵循 Gemma Terms(Gemma 使用条款)。都是开放模型,这里只是用来做免费演示;页面上写出了每个模型的名字,你可以到 Hugging Face 上查看对应的模型卡片。