工作原理
如何从 AI 放大工具获得好结果
放大不是简单地改尺寸。清楚模型能重建什么、不能重建什么,决定了你得到的是清晰的放大图还是一张塑料感的图。
传统放大——双三次、Lanczos,以及各种图像编辑器内置的重采样——靠对已有像素取平均来工作。要求它把宽度放大四倍,它就必须仅凭算术凭空造出四分之三的输出,结果自然发虚。那本质上只是对原图做了一次数学上合理的模糊。
超分辨率模型的做法不同。它在同一张图片的小尺寸与大尺寸版本组成的数百万对样本上训练过,因而学到了被缩小的一根睫毛、一道砖缝、一个字母的笔画在原始尺寸下通常是什么样子。它不是取平均,而是预测最可能丢失的那部分细节。这就是为什么放大后的照片能呈现出皮肤纹理或织物经纬,而普通重采样永远做不到。
这句话里真正关键的词是可信。模型重建的是与其训练相符的细节,而不是当时真实存在的细节。对照片、插画和截图来说,这几乎总是你想要的效果。但凡准确性本身才是重点的场景——车牌、医学影像、你打算当作证据的文件——放大后的图像都只是一种解读,不能当作被找回的事实来读。
可以放大哪些文件
Veedz AI 接受四种输入格式,源文件上限为 20MB。这个上限的存在是因为一切都在浏览器标签页里运行:整张图片必须与模型和输出缓冲区一起装进内存。
| 格式 | 最适合 | 注意 |
|---|---|---|
| PNG | 截图、界面、标志、线稿——大色块与硬边缘 | 文件偏大;会比 JPEG 更早触到 20MB 上限 |
| JPEG | 相机或手机拍摄的照片 | 已有的压缩瑕疵也会被一并放大——见下方关于原图的部分 |
| WebP | 从现代网页保存的图片 | 有损 WebP 的注意事项与 JPEG 相同 |
| AVIF | 较新、更高效的网页图片 | 在老机器上解码比其他格式慢 |
从你手上最好的原图开始
这是对画质影响最大的一环,而且不花一分钱。模型会把拿到的一切放大,包括缺陷。一张被截过屏、重新保存过、又在聊天软件里转发三次的照片,带着压缩色块、色带和被磨钝的边缘——放大会忠实地把这些统统放大。
动手之前,先看看有没有更好的版本:相册里的原图而不是从聊天里下载的副本,导出的 PNG 而不是它的 JPEG 截图,完整尺寸的文件而不是缩略图。900 像素的原图放大 4 倍,胜过 400 像素原图放大 4 倍的幅度,远比像素差距让人以为的要大。
选 2 倍还是 4 倍
两个倍数用的是同一个模型,4 倍只是要求它重建得更多。请按你实际需要的尺寸来选,而不是习惯性地直接拉满。
- 2 倍 — 对照片、人脸以及本身已经比较清晰的图片更稳妥。细节更贴近原图,被"编造"出来的纹理也不那么显眼。
- 4 倍 — 更适合真正很小的素材:旧头像、缩略图、低分辨率扫描件、像素画,以及需要经得起打印或投影的标志。
如果你需要某个确定的成品尺寸,请放大到紧邻其上的倍数,再用任意编辑器缩小。把 4 倍的结果缩到目标尺寸几乎无损,通常也比勉强接受一个略小的 2 倍结果更好看。
选择输出格式
输出选择器把格式和倍数合并在一个菜单里,默认是 PNG 4 倍。
- PNG(无损)— 完整保留模型输出的结果。如果图片还要再编辑、打印或长期保存,这是正确选择。文件会很大,4 倍 PNG 可能是源文件的好几倍。
- WebP(更小)— 肉眼几乎与 PNG 无异,体积却只有一小部分。凡是要放到网站或文档里的图片,这是最好的默认项。
- JPEG — 兼容性最好、体积最小,但会在重建结果之上重新引入有损压缩。用来分享没问题;如果文件还要反复编辑再保存,就不要选它。
下载前该检查什么
请以原始尺寸使用前后对比滑块,不要只看缩略图。任何图片缩小了都好看。有四个地方能看出重建是否真的成功:
- 人脸 — 眼睛、牙齿和发际线最能暴露一个过度自信的模型。皮肤发蜡、眼睛像画上去的,就该改用 2 倍。
- 文字 — 小字要么被令人信服地锐化,要么变成一本正经的乱码。请确认那些字母还是原来的字母。
- 细密重复图案 — 砖墙、织物纹理、树叶和格栅,在模型平铺猜测的地方可能出现规律的闪烁。
- 平坦区域 — 天空、墙面和影棚背景应当保持干净。这些地方出现斑块,通常说明源图的压缩比看上去更重。
速度、内存与隐私
每次会话的第一次处理需要下载 AI 模型,因此明显比后续的慢。之后浏览器会缓存模型,后面的图片立刻就能开始,而且在完全没有网络连接的情况下也能继续工作。
在支持 WebGPU 的环境中,模型跑在你的显卡上,一张普通照片几秒就能完成。没有 WebGPU 时还有 CPU 回退方案,任何现代浏览器都能运行,但速度慢得多。由于处理发生在标签页内,可用内存不足的机器处理大图 4 倍时可能变慢甚至直接失败;关掉其他占用大的标签页确实管用。
这一切都不经过服务器。页面读取你的图片,在你的设备上处理,再作为下载返回——根本不存在上传这一步,因此也不存在任何人可以保存、泄露或拿去训练的文件副本。