space ocr
指南文章价格文档
documents

手机照片,一键变成表格数据

随手拍下收据、发票或表格等任意文档,即可获得结构化数据并存入电子表格。自动处理倾斜照片和多语言混合内容。

4 分钟阅读· 2026-08-31

你是否也有一堆需要处理的收据,或是一整个文件夹的扫描发票?目标很简单:把每张票据的关键信息录入电子表格。但现实却很繁琐:打开图片,费力地辨认细节,再逐个字段手动敲入。照片还常常是匆忙拍下的,有点歪斜,光线也不理想。整个过程不仅慢,还容易出错,没人愿意干这种活。

用手机拍摄的文档照片
一张随手拍的倾斜照片,照样能提取出一条干净的数据。

如果能跳过手动录入呢?使用space-ocr,你只需定义一次你需要的列,比如Vendor、Invoice Date和Total Amount。如果一时拿不准该定义哪些列,也可以先让系统从一张样张照片中自动识别,再修改这些建议(对应 API 中的autoFields)。然后,无论单据版式如何,你都可以直接上传图片。不同供应商的发票和收据,都能解析成你表格中统一、清晰的行结构。它直接支持扫描仪或手机相机生成的标准图片格式,如JPEG、PNG、GIF和WebP。

上传图片,指定所需字段,即可获得结构化数据。

即使是手机随手拍的照片,它也能轻松处理。如果你竖着拿手机拍照,图片文件通常会包含方向数据(EXIF),告诉软件在查看时如何旋转。space-ocr在上传时会读取这些数据,自动校正图片,让提取出的文本坐标与你在屏幕上看到的位置一致。较大的照片在识别前可能会由服务端缩小尺寸,因此返回的坐标以实际识别的页面为准,而不是你上传文件的像素尺寸。也无需手动选择语言。系统会自动检测并处理同一份文档中的多种语言,比如日语、英语和韩语。

每个提取出的数值都与其在原始文档中的确切位置相关联,提供清晰的溯源路径。
✓ Verified

space-ocr不只是读出一个值,还会记录这个值来自哪里。首先由模型给出文本值,系统再将它与OCR在页面上实际检测到的符号逐字符比对。每个值都会带回它在照片上的位置:box是不带倾斜的矩形,quad是随拍摄角度倾斜的四个点。所有坐标都归一化到0到1000的网格,并以实际识别的页面(data.image)为基准,因此可以直接画回图像上。当两次读取对不上,或者你要的值在页面上找不到时,这个值不会悄悄通过,而是进入待复核清单(data.review.flagged)。两次读取仍有可能在同一处误读上取得一致,所以这份清单是帮你缩小复核范围,而不是替你完成复核。

一份手写文档
即便是手写体和混合文字,也能解析为统一的结构。

定价模式简单明了:每张图片$0.05(含税)。每个账户每月都有100次免费扫描额度。如果因为技术原因扫描失败,我们不会收取任何费用。套餐详情见价格页面。这是一个简单、按量付费的工具,帮你从文档中提取数据,并转换成更有用的格式。

  1. 创建工作表
    定义你需要的列,如“供应商”、“日期”和“总计”。这就是你的列定义。如果拿不准,可以先让系统从一张样张照片中自动识别,再作修改。
  2. 拍摄照片
    用手机拍下收据、发票或任何文档。不用担心照片是否完全平整。
  3. 上传图片
    将JPEG或PNG文件拖放到space-ocr网页应用中的工作表里。
  4. 检查数据
    新的一行会自动出现,并填入提取的数据。每个数值都链接到它在照片上的位置,方便核对。
我需要先将照片摆正或裁剪吗?
不需要。space-ocr会根据你手机相机的数据(EXIF方向)自动处理图像旋转,并能从倾斜或歪斜的文档中提取数据。
我可以上传哪些文件类型?
你可以上传常见的图像格式,如JPEG、PNG、GIF和WebP。网页应用也支持PDF,它会自动将PDF逐页转换为图像进行处理。
它支持不同语言吗?
支持。语言检测是全自动的。引擎经过优化,无需任何手动设置即可处理包含日语、韩语、中文和英语等多种混合语言的文档。
它如何处理不同版式的发票或收据?
你只需定义一次你想要的结构(即你的列)。之后,AI会智能地从各种版式中查找相关数据,并将其映射到你定义的统一结构中。
费用是多少?
每处理一张图片收费$0.05(含税)。你每月还可以获得100次免费扫描额度,如果OCR处理失败,我们不会收费。套餐详情可查看价格页面。
提取的数据可靠吗?
提取出的值会与原始文档的OCR识别结果进行比对,并附带它在图像上的位置,你可以据此确认某个数字来自哪里。两次读取对不上或找不到的值不会悄悄通过,而是被列为待复核。这份清单帮你确定先看哪里,并不替代你的复核。

告别手动输入,开始上传吧。

每月可获100次免费扫描。注册无需信用卡。

相关文章