文字提取
提交一张照片、扫描件或截图,锁定在像素中的文字就会变成你可以选择、搜索并粘贴到其他地方的字符。
那些图片上的文字最终会变成一个你可以搜索、编辑和转交的文件——无论图片有多少张。
从一张图片中提取文字是每个工具都能做到的部分。下面是:当有四十张图片时会怎样,以及文字提取出来后又会怎样。
提交一张照片、扫描件或截图,锁定在像素中的文字就会变成你可以选择、搜索并粘贴到其他地方的字符。
放入文件夹而不是单个文件。一份扫描文档的四十页或一个月的收据可以一次性处理完并汇总在一起,而无需四十次单独上传。
说出你真正想要的内容:页面上的所有内容,或者只列出你指定的字段并排列成列,或者用几行文字说明文档内容。
从一张包含文字图片到一个充满文字的文件,只需三步。
拖入一张照片或整个文件夹——扫描件、拍摄照片、截图——并说出你想从中获得什么。
它会处理每一张图片,提取文字,并让每段文字都可追溯到其源文件,然后按照你要求的布局和文件类型汇总结果。
在输出内容用于重要场合之前,先将输出与原始文件核对一遍。将本次运行保存为 Playbook,这样下个月的批处理就能以相同的列格式呈现。
这一类别中有一半承诺完美准确率,另一半则一次只处理一个文件。
这里最知名的两款工具在标题中写着“100% 准确率”。没有人能保证这一点:一张有折痕的收据、一个不佳的角度、一份模糊的复写副本,都会让任何读取工具开始猜测。AllyHub 的做法是坦率承认这一点,并提醒你核对重要数据。
.jpeg&w=1920&q=75)
把页面上所有内容一股脑倒进一个文本框往往不是你真正想要的。你想要的是那六个字段、总额,或者一句关于文档内容的话。直接提出这种需求,就跳过了你自己阅读导出内容并提取信息的环节。
.jpeg&w=1920&q=75)
任何有一堆拍摄下来的纸质文件、一本无法复制内容的书、需要数字化的表格,或一段无法选中的截图的人。
一鞋盒的收据在截止日期前不算什么问题,但一到截止日就成了唯一的问题。拍摄它们只需十分钟;而录入需要一整晚,而且错误数字往往就是在录入时产生的。
你拍下书页是因为图书馆的藏书不能带出房间,现在你有四十张无法搜索的文字图片。要引用其中的内容得先找到对应的照片,而这正是那些精彩句子从未进入你草稿的原因。
文件柜是出色的存档工具,却是糟糕的数据库。将内容整理成行是大家都认为应该做且没人安排的一步,因为这看起来需要某人花费数周的时间。
你需要的数字在别人发给你的截图里,或作为图片的一部分嵌在幻灯片中。它明明就在那里,你却无法选中,这是每周都会遇到的虽小但非常烦人的问题。
输入什么、输出什么,以及它不会承诺什么。
它能读取包含文字的图片,并将文字以字符形式返回——可选择、可搜索、可编辑。AllyHub 不仅处理单个文件,也能轻松处理整个文件夹,而且让你指定结果的呈现形式,而不是总把页面上的所有内容都输出。
是的。单张图片可以免费使用。大批量处理、按命名列进行结构化输出,以及保存运行以便相同任务可以重复执行,这些功能属于付费方案。
照片、扫描件以及常见图像格式的截图,另外还支持扫描版 PDF。输出可以是纯文本、文档或电子表格——按你的选择。手写内容也能识别,但如果实际难点在于字迹不清,可以查看专门解决该问题的“手写转文字”页面。
不能,而且请警惕任何声称能做到的工具。识别质量取决于图片:平整、光线充足、印刷清晰的页面能准确识别,而一张有折痕、角度偏斜的收据照片对任何工具来说都确实困难。请将输出视为初步结果,并核对你要依赖的数据。
大多数都是单次上传的小工具,把页面上所有内容返回给你,剩下的由你处理。而在 AllyHub,批量处理是常态,输出形式由你指定,而且这些设置会积累下来——列格式和文件类型会保存,所以下个月执行相同任务时只需一行操作,而无需重新设置。