PDF 分割拆分 API 接口
接口详情官网地址: https://www.gugudata.com/api/details/pdfsplitter

接口详情官网地址: https://www.gugudata.com/api/details/pdfsplitter
PDF 分割拆分 API PDF 拆分,支持公开或私有存储,文件处理、PDF等关键词场景常会用到,适合用于文档识别与格式转换、批量归档与自动化录入与PDF、图片与网页内容处理等业务场景,方便开发者直接在应用、脚本或数据流程中接入。

1. 产品功能
- 高效处理大文件;
- 支持多语言字符识别;
- 支持 formdata 格式 PDF 文件流传参;
- 支持设置每个 PDF 文件的页数;
- 支持公开存储和私有存储,私有模式通过短期下载链接访问;
- 接口服务多节点部署;
- 围绕“PDF 分割拆分”提供标准化能力,便于快速接入现有业务;
- 适合将“PDF 分割拆分”结果接入业务系统、后台工具和自动化流程;
2. API 文档
接口地址: https://api.gugudata.com/imagerecognition/pdf-splitter?appkey=REDACTED&pageSize=10&isZip=false
返回格式: application/json; charset=utf-8
请求方式: POST
请求协议: HTTPS
数据预览: https://www.gugudata.com/preview/pdfsplitter
接口测试: https://api.gugudata.com/imagerecognition/pdf-splitter/demo
3. 请求参数
| 参数名 | 参数类型 | 是否必须 | 默认值 | 备注 |
|---|---|---|---|---|
| file | file | 是 | YOUR_FILE | formdata 文件流 |
| storage | string | 否 | public | 文件存储方式,可选 public 或 private。默认 public 返回公开下载地址;private 存入私有存储,返回 file_id,需生成短期下载链接后下载。 |
4. 返回参数
| 参数名 | 参数类型 | 备注 |
|---|---|---|
| DataStatus.StatusCode | int | 接口返回状态码 |
| DataStatus.StatusDescription | string | 接口返回状态说明 |
| DataStatus.ResponseDateTime | string | 接口数据返回时间 |
| DataStatus.DataTotalCount | int | 此条件下的总数据量,一般用于分页计算 |
| Data.uuid | string | 唯一标识符 |
| Data.num_files | int | 生成的 PDF 文件数量 |
| Data.pdf_files | array | 公开存储时返回文件下载地址列表;私有存储时返回文件引用列表,可用于生成短期下载链接。 |
5. 错误码说明
| 状态码 | 错误说明 | 备注 |
|---|---|---|
| 100 | 正常返回 | - |
| 101 | 参数错误 | - |
| 102 | 请求频率受限 | 每秒请求不能超过 100 次 |
| 103 | 账号欠费 | - |
| 104 | APPKEY 错误 | 请检查传递的 APPKEY 是否为开发者中心获取到的值 |
| 110 | 接口响应错误 | - |
6. 适用场景
- 适合用于文档识别与格式转换,快速补齐产品侧需要的 PDF 分割拆分 数据能力。
- 适合用于批量归档与自动化录入,减少手工整理、清洗与重复开发成本。
- 适合用于PDF、图片与网页内容处理,将接口结果直接接入后台系统、数据任务或内容处理流程。
7. 相关接口
- 可搭配使用:HTML/URL 转 PDF,适合补充同类场景的接口能力。
- 可搭配使用:HTML 转 Word,适合补充同类场景的接口能力。
- 可搭配使用:通用图片文件流 OCR 到文本,适合补充同类场景的接口能力。