Invofox:AI 发票识别与文档数据提取工具

将发票、PDF 和扫描件里的信息整理成系统可用的结构化数据。

invofox.com
Invofox screenshot

通俗解释:Invofox 是干什么用的?

Invofox 是面向企业软件和业务系统的 AI 发票识别、文档数据提取服务。假设你每天收到一批供应商发票,需要把供应商名称、开票日期、税额、总金额和商品明细录入系统:Invofox 可以读取 PDF 或图片,找出这些信息,再整理成程序能直接读取的 JSON 数据,减少逐项抄录的工作。

可以把它理解成“把文件变成数据”的处理环节。普通文字识别主要解决“图片上写了什么”,Invofox 进一步处理“哪个数是金额、哪一行是商品、这些字段应该放在哪里”。它适合需要持续接收和处理文档的财务软件、物流平台、金融科技产品及企业运营团队。若只是偶尔复制图片上的几行文字,可能不需要如此完整的接入流程。

从发票抬头到商品明细,提取真正需要入库的字段

发票处理不能只识别总金额。Invofox 的官方发票页面列出了发票号码、日期、到期日、供应商与接收方信息、税基、税率、税额和应付总额,也支持把商品描述、数量、单价及行金额整理成明细数组。系统可以围绕配置的数据结构验证结果,帮助发现明细与汇总金额不一致的情况。

文档范围还包括收据、工资单、银行流水、水电账单、合同等。对于专有格式或额外字段,需要提供目标字段结构和代表性样本,与官方确认文档类型配置。官网列出的文档种类不等于每种地区票据都有现成适配;目前没有核实到中国税务发票查验、开票系统或本地税务平台的官方连接能力。

一份 PDF 装着多张单据时,怎样批量处理?

Splitter 用于把合并 PDF 中的多份逻辑文档拆开,再分别提取数据;Classifier 用于在提取前识别文档类型。这对供应商把多张发票合成一个附件、业务部门混合上传不同票据的场景很有帮助。

这两个功能也有接入细节:开启拆分后,上传响应先返回 importId,不能沿用单份文档“马上拿到 documentId”的假设。接收 import.processed 事件,才能确认整批文档处理完成。自动分类遇到未匹配类型时,可能丢弃文档或转到默认类型,取决于环境配置,不能理解为任何文件都会正确识别。

从一张样本开始,完成 API 接入与结果检查

  1. 注册账号并进入一个环境,在 API and Webhooks 中创建 API 密钥。
  2. 在 Document Types 查看要使用的文档类型 ID 或别名,准备一份具有代表性的 PDF 或图片。
  3. 向 POST https://api.invofox.com/v1/ingest/uploads 提交 multipart 请求,使用 x-api-key 请求头,附上 files 文件和包含 type 的 info JSON 字段。
  4. 保存返回的 documentId,通过 Webhook 接收 document.processed;测试时也可轮询 GET /documents/{documentId}。
  5. 对照原文件检查关键字段、商品行、金额、处理状态与置信度,再决定是否写入业务系统。需要纠正的字段可通过 PUT /documents/{id} 回传。

上传成功只说明文件进入流程,最终数据需要异步取得。受密码保护、损坏或格式不支持的文件可能触发 file.rejected,而不会产生可查询的文档,因此要处理失败事件。正式对接应参考官方 API 入门文档,不要把官网首页的简化演示当成完整接口规范。

免费试用能做什么,什么时候需要付费?

截至 2026 年 10 月 6 日,英文官网定价页列出 500 页免费额度,首页说明这是新账号的一次性评估额度,不是每月恢复的永久免费套餐。适合用真实业务中常见的清晰文件、复杂表格和异常样本,检查能否提取你真正需要的字段。

Starter 页面标价为 每月 $500 起、按年结算,包含每月最多 5,000 页;Scale 和 Enterprise 采用定制报价。官网同时说明这些金额属于估算,实际成本受文档复杂度、处理量和集成要求影响,不应把起价当作所有用户的最终费用。通常按页计费,部分复杂企业流程可按文档计费。

“识别错误返还费用”和准确率 SLA 也有适用条件:定价页把相关优惠限定在年处理量至少 100 万页的团队。采购前应核对当前套餐与报价条件,不要默认试用账号也享有相同承诺。

上传财务资料前,要分清默认保留与零数据保留

普通处理流程的数据保留可以用于审计、排错和模型改进;官方纠错文档也说明,回传的修正会进入模型训练。因此,不能笼统写成“上传内容绝不保留、绝不用于训练”。

零数据保留是 Scale 和 Enterprise 可申请启用的选项。 官方页面描述该模式在交付后删除文档和提取产物,匿名训练样本则需要另外明确选择加入。启用后也会失去历史回放、排错和基于原始生产资料优化的部分能力。涉及客户身份、银行流水或工资资料时,应先核实零数据保留条件,并确认自己的套餐、处理区域及合同设置。

常见问题

Invofox 与普通 OCR 有什么区别?

普通 OCR 重点是识别字符;Invofox 的文档流程进一步输出有字段含义的 JSON,并处理分类、拆分与数据验证。具体输出哪些字段,由环境中的文档类型决定。

500 页免费额度会每月重新发放吗?

官网将免费额度描述为一次性试用,而非循环发放的免费配额。持续用于生产业务,需要结合处理量选择付费方案。

不自己编写 API,也能接入业务工具吗?

官网提供 Zapier 集成,可用 API 密钥连接 Invofox,再设置文件来源、提取动作与目标应用字段映射。具体流程仍需要配置与测试,不能把“无需写代码”理解为无需检查结果。

官方资源与接入支持

LightPDF免费+付费
AI PDF 编辑器、转换器与文档对话,覆盖 Web、桌面与移动端
AI 效率与文档工具AI OCR 工具 · 人工智能演示生成器 · AI工作流程自动化工具 +1访问 ↗