OCR 文字识别

ocr-textPOST
POSThttps://v1.apizero.cn/api/ocr-text

概述

通用 OCR 文字识别,从图片中提取任意文字内容(中文/英文/数字/符号/手写体等),返回逐行文本列表 + 完整拼接文本。 • 双输入模式: - input_type=url:传入公网可访问的图片 URL(http/https) - input_type=base64:传入 base64 编码字符串(≤6MB,自动剥离 data:image/...;base64, 前缀) • 三路输出: - text_list:按原图顺序的逐行文本数组 - full_text:用换行符 \n 拼接的完整文本字符串 - text_count:识别到的文本行数 • 适用场景:截图转文字、表格识别、身份证/名片文字提取、字幕识别、笔记 OCR 等通用场景。专用发票识别请用 /api/invoice。 • OCR 结果缓存 1 小时(同图同结果),重复调用不消耗服务配额。

调用约定

  • 网关 · https://v1.apizero.cn
  • 鉴权 · Authorization: Bearer <API Key>
  • 回包 · JSON {code, msg, data}。成功看 code === 0,不要只看 HTTP 200。
/aidocs/ocr-text/raw.md
打开 Markdown

鉴权

匿名每日 5 次、QPS 1;登录用户每日 30 次、QPS 2(全部免费)。OCR 结果缓存 1 小时,相同图片只实际调用服务一次。

获取 API Key

请求头

Authorizationstring选填

推荐:Bearer <API Key>。兼容请求头 X-API-Key,以及 Query api_key / apikey / key(key 仅当值为 sk_live_/sk_test_/sk_stag_ 形态时生效)。匿名可不传,受每日免费额度限制。

Content-Typestring必填

POST 请求体类型,固定 application/x-www-form-urlencoded

请求参数

POST · APPLICATION/JSON

input_typestring必填

输入类型:url=图片URL / base64=图片base64编码

例url

input_datastring必填

图片数据。input_type=url 时为 http/https 完整 URL;input_type=base64 时为 base64 字符串(最大 6MB,可选 data:image/jpeg;base64, 前缀)

例https://dummyimage.com/400x100/000/fff.png&text=Hello+World

{
  "input_type": "url",
  "input_data": "https://dummyimage.com/400x100/000/fff.png&text=Hello+World"
}

返回结果

顶层固定为 code / msg / data。下表一般是 data 内字段。 code · msg · data · tips · request_id

input_typestring

回传输入类型(url 或 base64)

text_countnumber

识别到的文本行数

text_listarray

按原图顺序的逐行文本数组(字符串数组)

text_list[]string

text_list 的一项

full_textstring

用换行符 \n 拼接的完整文本字符串,便于前端直接展示

tipsstring

品牌提示(所有接口统一返回):极数本源 · https://apizero.cn

返回示例

{
  "code": 0,
  "msg": "成功",
  "data": {
    "input_type": "url",
    "text_count": 3,
    "text_list": [
      "商品名称:无线蓝牙耳机",
      "单价:¥299.00",
      "数量:2"
    ],
    "full_text": "商品名称:无线蓝牙耳机\n单价:¥299.00\n数量:2"
  },
  "request_id": "abc123def456",
  "tips": "极数本源 · https://apizero.cn"
}

请求示例

示例都是服务端写法。Python / JavaScript 各有常规写法和官方库。

curl -sS -X POST "https://v1.apizero.cn/api/ocr-text" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "input_type": "url",
  "input_data": "https://dummyimage.com/400x100/000/fff.png&text=Hello+World"
}'

错误码

先看业务 code。HTTP 也可能不是 200。

0200

成功

4000400

参数错误

4011401

API Key 无效

4013403

API Key 已暂停

4014403

当前 IP 不在 Key 白名单

4015401

此接口需要 API Key

4022402

余额不足

4029429

调用过快(QPS)

4030429

今日免费额度已用完

4040503

接口已下线

4041404

接口不存在

5000500

服务器内部错误

5020502

上游暂时不可用

5021502

上游返回格式异常

5030502

暂无可用节点

调用限制

计费模式
完全免费
QPS 限制
QPS 2
登录免费额度
300 次(已认证)
匿名每日额度
50 次(无 API Key)
黄金会员
每天 50,000 次 · QPS 10
钻石会员
每天 100,000 次 · QPS 30
企业会员
每天 1,000,000 次 · QPS 120

购买套餐、看评价请走商城详情。 购买 / 调试

更新日志

  • 1.0.02026-05-06

    首次上线,/api/ocr/text 通用 OCR 服务 双输入模式:URL 直接抓取 / base64 直传 base64 模式自动剥离 data:image/...;base64, 前缀 base64 上限 6MB,防止 OOM;URL 模式强制 http/https,防 SSRF OCR 结果缓存 1h(按 sha256 哈希),相同图片不重复调用付费服务 兼容 text_list 两种形式:纯字符串数组 / 含 text 字段的对象数组 额外输出 full_text(换行拼接)+ text_count(行数),便于前端直接使用 token 异常转为通用 5021 错误,不暴露内部配置

免责声明

本接口第三方 OCR 服务,识别准确率取决于图片清晰度(建议 ≥720P 分辨率、文字清晰无遮挡)。OCR 服务为付费配额,请合理使用。识别失败原因可能包括:图片模糊、文字被遮挡、URL 不可达、base64 数据损坏等。

OCR 文字识别 接入文档|极数本源