Labs · 图层重建工坊

一张压平的截图,
拆回能改的图层

拖进一张幻灯片截图或海报:OCR 找出文字,被字盖住的背景就地修补,下载到手的是真 PPTX——每一块都是能重打、能换色、能调字号的文本框,不是贴在幻灯片上的一张图。

免费 · 不限次数本地运行 · 不上传真文本框,不是贴图

拖一张图进来,或点击选择

PNG / JPG / WebP · 全程在你的浏览器里处理,不上传

识别语言

整个过程通常 10–30 秒,大图和首次加载会慢一些。

图片、识别结果、导出文件都只存在于你的浏览器里。这个页面没有上传接口。

这个工具怎么来的

管线四段,全在你的浏览器里:tesseract.js(Apache-2.0)把图读两遍——一遍自动版面分析,一遍稀疏扫描,专补第一遍漏掉的孤立小字;然后是手写的聚类层,把词聚成文本块,从实际笔画像素里估字号、颜色、对齐和粗细;背景修补层把每个块里的字擦掉——纯色和渐变底用边缘插值,轻纹理底用扩散填充;最后 PptxGenJS(MIT)把修补后的整图写成幻灯片背景,每个文本块写成一个原生文本框。

估算器是拿真值样张标定的——样张里每个字号、每个颜色都是已知的:这套样张上,字号误差落在 0.2%–11% 之间,干净底上的取色逐字节精确,粗体判定(按笔画宽度相对字号)16 个块全对。导出的 PPTX 还会用 python-pptx 读回来复核一遍:文字、坐标、样式都真实在文件里,不是「看起来像」。

它做不到什么

效果好的:幻灯片截图、网页截图、海报、AI 生成的图——标准字体加纯色或渐变底。会诚实退化的:照片复杂纹理上的字不硬擦(块上有「底图未清除」标注,文本框叠在原图上);低对比字幕——亮天空上的白字——可能整个识别不到;艺术字、手写体、旋转文字大多过不了 OCR;表格按图保留。原图的字体名从像素里查不出来,只能在衬线 / 非衬线里二选一,导出后在 PowerPoint 里换成你要的字体。另外 OCR 偶尔会认错字——所以每个块导出前都能改,这不是缺陷补丁,是这个工具存在的理由。

常见问题

为什么别的「图片转 PPT」转出来根本不能改字?

因为多数工具没有做转换——只是把你的图原样贴进一页空白幻灯片,页数对了,内容还是一张平面图。重建才是难的部分:要 OCR 找到文字、版面分析把词聚成块、背景修补把原来的字擦掉、再按 OOXML 格式写出真文本框。这条管线在这页里完整跑一遍,而且跑在你自己的浏览器里——这也是它可以免费不限量的原因。

什么样的图效果最好?

幻灯片截图、网页截图、海报、图文卡这类「设计稿」输入:标准字体、纯色或渐变底。在我们的标定样张上,平底上的文字擦得几乎看不出痕迹,字号估算误差大多在 10% 以内。照片是诚实的弱项:复杂纹理上的字不硬擦(文本框直接叠在原图上,块上有标注);低对比的字幕——比如亮天空上的白字——可能整个识别不到。

识别错了字怎么办?

点那个块,导出前直接改——这正是「重建」和「贴图」的区别。一张带错字的平面图只能重做,一个带错字的文本框改起来两秒钟。每个块的文字、字号、颜色、粗体都能在这页上编辑。

图片会被上传吗?

不会。识别引擎(tesseract.js,Apache-2.0 许可)第一次用时下载进你的浏览器(约 6–10 MB,之后有缓存),从识别到最终生成 PPTX 文件,每一步都在你的设备上完成。这个页面没有上传接口。也因为计算发生在你这边,我们才能免费、不限次数、不加水印。

能导出分层 PSD 吗?

还不能。PSD 出口(背景层 + 真文字图层,走 MIT 许可的 ag-psd 写入器)和这页共用同一套引擎,排在第二个出口做。先发 PPTX,是因为搜「图片转 PPT」的人要的就是一份能接着改的幻灯片。

相关工具与阅读

← 全部免费工具

图片转可编辑 PPT · 图层重建工坊 — 截图重建成真文本框,浏览器本地完成 · Foreverse · 新梦