Local AI Tools
免费的浏览器本地 AI 工具
每个工具只下载一次开源模型,之后所有计算都在你自己的设备上完成。免费使用,文件不会上传,不用注册,也没有每月额度。
本站工具的真实处理结果
每一张都是在浏览器标签页里、用该工具自带的示例图跑出来的。
照片与图片9
图片去背景:免费出原分辨率,全程在你的浏览器里完成
把照片拖进来。抠图这一步是在你这台机器上算的,图片不会传到任何服务器。
- 模型
- birefnet-lite-512
- 首次下载
- 94 MB–183 MB
- 运行于
- WebGPU / CPU
从照片里抹掉多余的东西
把不想要的东西涂掉,模型来补「本来该在那儿的东西」。整个过程在你自己的机器上跑完,照片一个字节都不会传出去。
- 模型
- lama
- 首次下载
- 59 MB–102 MB
- 运行于
- WebGPU / CPU
去除图片上的文字
把照片、截图或海报拖进来:检测模型先把字幕、配字、标签一段段圈出来,你取消想留的,修补模型把其余的字抹掉并补上背景——全程在你的浏览器里。
- 模型
- lama
- 首次下载
- 59 MB–102 MB
- 运行于
- WebGPU / CPU
图片放大 4 倍
把不够大的图丢进来,超分模型在你自己的设备上把它放大 4 倍。文件不会上传,结果上也不会被印上任何东西。
- 模型
- realesr-general-x4v3-onnx
- 首次下载
- 5 MB
- 运行于
- WebGPU / CPU
照片去模糊
把拍糊了的照片拖进来。去模糊模型只下载一次,之后全部计算都在你这台机器上完成,照片不会离开这个标签页。
- 模型
- image_restoration
- 首次下载
- 263 MB
- 运行于
- WebGPU / CPU
给黑白老照片上色
把扫描件拖进来。颜色是在你这台电脑上算出来的,照片不会离开这个页面;算好的颜色按原分辨率盖回原图。
- 模型
- ddcolor
- 首次下载
- 129 MB
- 运行于
- CPU
证件照制作(本地处理)
丢一张自拍进来,裁多大、换什么底色、六寸相纸排几张,都在这个标签页里算完——照片不会离开你的设备。
- 模型
- modnet
- 首次下载
- 13 MB–25 MB
- 运行于
- WebGPU / CPU
照片生成深度图
拖一张照片进来,几秒钟后拿到深度图。Depth Anything V2 就在这个标签页里跑,照片不离开你的电脑。
- 模型
- depth-anything-v2-small
- 首次下载
- 26 MB–94 MB
- 运行于
- WebGPU / CPU
让 AI 描述一张图片
把图拖进来。识图模型在你这台机器上写描述,文件不会离开这个标签页。
- 模型
- SmolVLM-256M-Instruct
- 首次下载
- 194 MB–251 MB
- 运行于
- WebGPU / CPU
音频与视频7
去人声、提伴奏——在浏览器里跑的人声分离
把音频拖进来,人声和伴奏在这台机器上分开。文件不出本机,也不用排队等服务器。
- 模型
- all_public_uvr_models
- 首次下载
- 64 MB
- 运行于
- WebGPU / CPU
录音转文字
把音频拖进来,出一份带时间戳、能点着跳播的文字稿。Whisper 模型就跑在这个标签页里——录音不出你的电脑,不用注册、不排队、不按分钟计量。
- 模型
- whisper-base
- 首次下载
- 197 MB–278 MB
- 运行于
- WebGPU / CPU
在浏览器里跑的文字转语音
贴上文字,挑一个英文声音,把音频下载走。Kokoro 模型在你自己的机器上运行,文字不上传,也没有账号这回事。
- 模型
- Kokoro-82M-v1.0-ONNX
- 首次下载
- 291 MB–310 MB
- 运行于
- WebGPU / CPU
AI 音乐检测:这首歌是不是 AI 做的?
把歌拖进来就行。频谱指纹在你自己的设备上算,音频一个字节都不出本机。
- 模型
- ai-music-detector
- 首次下载
- 0 MB
- 运行于
- CPU
视频去背景:免费、带声音,全程在你的浏览器里
把片段拖进来就行。每一帧都在你自己的电脑上抠,原来的声音也一起带走。
- 模型
- modnet
- 首次下载
- 12 MB–25 MB
- 运行于
- WebGPU / CPU
测出你的音域
唱两个音或拖入一段录音,本机运行的神经网络音高模型告诉你音域和大致声部。
- 模型
- crepe-onnx
- 首次下载
- 2 MB–87 MB
- 运行于
- WebGPU / CPU
测歌曲 BPM
拖一首歌进来,几秒钟告诉你它多快、拍子落在哪、几拍一小节——拍点模型就在你的浏览器里跑,歌不出本机。
- 模型
- beat-this-onnx
- 首次下载
- 115 MB
- 运行于
- WebGPU / CPU
文字与文档5
从图片里提取文字
粘贴一张截图,或把照片拖进来。识别在你自己的机器上跑完,图片不会离开这个标签页。
- 模型
- PP-OCRv5_mobile_rec_onnx
- 首次下载
- 16 MB
- 运行于
- WebGPU / CPU
文档照片展平:把拍弯的纸拉平
书页再弯、小票再皱,拍下来就能拉平。计算全在你自己的设备上,照片不会离开浏览器。
- 模型
- UVDoc_onnx
- 首次下载
- 30 MB
- 运行于
- WebGPU / CPU
图片表格转 Excel
表格截图 / 照片 → 可编辑的单元格,保留合并单元格,导出 Excel / CSV / Markdown。
- 模型
- table-transformer-structure-recognition-v1.1-all-onnx
- 首次下载
- 111 MB
- 运行于
- WebGPU / CPU
公式图片转 LaTeX
截图粘贴,出可编辑的 LaTeX 与 MathML;免费不限次,图片不出本机。
- 模型
- pix2text-mfr-1.5
- 首次下载
- 114 MB
- 运行于
- WebGPU / CPU
给文本脱敏:找出并遮盖里面的个人信息
粘一段工单、邮件或者会议纪要进来。人名、手机号、地址这些会在你这台设备上被识别出来并遮盖掉——文本不会离开浏览器。
- 模型
- gliner_multi_pii-v1
- 首次下载
- 568 MB
- 运行于
- WebGPU / CPU
为什么放在浏览器里
文件不出本机
页面里根本没有上传这一步。打开浏览器的网络面板就能自己确认:模型下载完之后,这个标签页不再往外发任何东西。
不注册、不排队、不限量
没有账号体系。算力用的是你自己的设备,服务器那边没有东西需要分配。
加载完就能断网用
模型权重由浏览器缓存,第二次打开一两秒就能用。模型加载完之后,断开网络也能在同一个标签页里继续处理。
怎么做到的
每个工具是一个页面加一个转成 ONNX 的开源模型。浏览器支持 WebGPU 就走 WebGPU,否则降级到多线程 WebAssembly。用的哪个模型、多大、什么许可证,每个工具页上都写着。



