文字识别 API
文字识别(OCR)API 可从图片中检测并提取文字(文字检测),也可处理扫描件、PDF 和 TIFF 等文字密集的文档(文档文字检测),返回文字内容及其版面结构和位置坐标。接口兼容 Google Cloud Vision 的 images:annotate 与 files:annotate REST 规范。
- 文字检测:适用于照片、截图与标牌
- 文档文字检测:适用于扫描件、票据与表单
- 支持 PDF、TIFF 与 GIF 文件,单次请求最多 5 页
- 兼容 Google Cloud Vision REST 接口
哪款 API 适合您?
许多团队会组合使用:用翻译 API 处理稳定、大批量的翻译,用文字识别 API 将图片与文档转为文字。
| 翻译 API | 文字识别 API | |
|---|---|---|
| 适用场景 | 大规模翻译文本与 HTML,质量稳定一致 | 从照片、扫描件、票据、表单和 PDF 文件中提取文字 |
| 接口 | Google Cloud Translation v2 与 v3 REST | Google Cloud Vision images:annotate 与 files:annotate |
| 鉴权方式 | X-Api-Key 请求头或 key 查询参数 |
X-Api-Key 请求头或 key 查询参数 |
| 计费单位 | 字符(Unicode 码位) | 图片(PDF、TIFF 或 GIF 每页计为一张) |
| 起步价格 | 每月免费 50 万字符(NMT) | 每项功能每月免费 1,000 张图片 |
统一平台
所有 API 共享的基础能力
账户、访问控制与结算方式在所有 Vionex API 中保持一致。
结算账号与账单
每个结算账号每月一份账单,涵盖所有关联项目。
项目与配额
用项目区分团队和环境,每个项目都有独立配额。
受限 API 密钥
将每个密钥限定在所需的 API 范围内,并可停用不再使用的密钥。
用量报告
按项目、服务和 SKU 查看用量与费用。