补上次没回的问题:本地抠图用的什么模型,以及往视频和手机上搬时踩的坑

发布于

fgghyyfk:

上次那个尽量不上传图片的浏览器工具,有人问本地去背景用的哪个模型。三档:ISNet INT8 四十多兆,BEN2 两百出头,BiRefNet HR-Matting 四百多兆,用到了才下,下完缓存在浏览器里。

后来想把这套搬到视频上,直接拿图片模型逐帧跑。单看每一帧都挺对,连起来播就不行,边缘一帧一个样,头发和肩线一直在抖。换成带时序的模型才稳住,音频单独走一条最后再对上。现在能出片也能保住音轨,但只敢挂 Beta ,而且只做了桌面 Chrome 和 Edge 。

PDF 压缩那边,体积大多是内嵌图撑起来的,引擎按每页实算内嵌图的有效 DPI 决定要不要重采样,几种编码各压一遍取最小的。边界也硬:没做字体子集化,纯文字 PDF 一般只能压 5%-20%,指望大幅瘦身的可以不用试。

图片压缩在手机上也能用,坑比桌面多。iOS Safari 和微信里拿不到原生 WebP 编码,只能自己带个兼容编码器顶上。更麻烦的是内存,一次塞几十张大图,页面直接被系统干掉,后来改成处理完就释放源文件,又加了个手动清空队列。上次有个朋友提的平铺水印还没做,只做了单个。想问下有没有人在移动浏览器里跑过大批量图片处理,除了主动释放内存还有什么稳一点的做法?

还是上次那个 [https://imging.cn/](https://imging.cn/),视频抠像在 /video ,PDF 压缩在 /pdf ,免注册,导出不带水印。上次有位猜是 Deepseek 写的,不是,主要是 Claude 写的。说界面花的几位,配色改过一轮。

---

原文链接:[点击查看](https://www.v2ex.com/t/1236262)

评论

暂无评论。

0.055182s