新用户注册即送 100 积分 · 1 页转换 = 1 积分

别再把乱码喂给
AI 应用了。

一条 HTTP 请求,把 PDF / Word / PPT / Excel 变成结构干净的 Markdown —— 标题、列表、表格原样保留,直接进 RAG、知识库与你的应用。

它解决什么问题
注册仅需手机号 · 100 积分约可转换 100 页 · 支持私有化部署
cURL Python Node.js Vue 3 Java Go Rust
convert.sh

YOUR_API_KEY 替换为你在控制台创建的 API-Key,选择语言即可复制运行。

Pain Points

做 AI 应用的人,
都在文档上翻过车

解析做得潦草,再好的应用也救不回来。文档处理是 AI 产品最容易失守的第一道工序。

— 01

应用读不懂二进制文档

PDF / Word / PPT 直接丢进上下文,拿到的是乱码、截断和整页噪声。Token 花在垃圾字符上,效果却上不去。

解法:上传即转换,返回结构干净的 Markdown,Token 只花在有效内容上。
— 02

表格一解析就散架

财报、参数表、报价单被拍平成断行文本,行列关系全部丢失,下游统计、引用、对账接连出错。

解法:表格智能还原为 Markdown 表格,行列结构原样保留。
— 03

自建解析链路,坑比代码多

文档、OCR 各拼一套:字体缺失、编码错乱、扫描件抽空;并发一上来进程数爆炸,调优以周计。

解法:免部署免运维,注册取 Key 当天上线,异常自动兜底。
— 04

中文文档是重灾区

常见解析按英文习惯切分,中文合同、说明书、红头文件解析出来段落粘连、表格乱序,面目全非。

解法:针对中文排版与字符专项优化,合同、说明书、产品表稳定解析。
Features

为 AI 应用与知识库
打磨的解析引擎

自研解析引擎算法,还原与中文优化三件难事。

— 02 / 格式

一份接口全覆盖

PDF、Word、PPT、Excel、HTML、CSV、JSON 与常见图片;旧版 Office(.doc / .ppt / .xls)自动兼容。

— 03 / 结构

表格智能还原

自动识别 PDF 中的表格并还原为 Markdown 表格,保留行列结构,直接可用于下游应用。

— 04 / 视觉识别

单据图片直接识别

发票、身份证、订单等单据截图直接识别为结构化 Markdown,1 张消耗 1 积分。

— 05 / 接入

一条 curl 跑通

标准 Bearer 鉴权(兼容 X-API-Key 请求头),支持 file 上传与 ?url= 远程地址,无 SDK 依赖。

— 06 / 计费

失败自动退分,计费透明

转换前按页数预估扣减,失败秒级退还;积分不足返回明确的 402 错误码。1 页 = 1 积分,没有隐藏消耗。

Benchmarks

快,是测出来的

同一服务的两代解析架构实测对比:把「每个请求新建进程池」换成「共享常驻进程池」后,短文档快了 4 倍以上。

其它的 常见自建架构 我们的 本服务
5 页 PDF
3.0 s
0.7 s
10 页 PDF
3.9 s
1.1 s
100 页 PDF
11.9 s
6.9 s

8 核 / 8G、8 并发压测环境下的平均转换耗时,两代架构均为本服务实测数据。

Compare

自建,还是直接用?

解析能力本身没有壁垒,壁垒在于把并行、还原、容错、中文优化这些细节全部做完的时间。

维度自建方案我们的
接入周期数周:拼装组件、踩坑调优当天:注册 → 取 Key → 一条 curl
解析内核上游默认效果,需自行优化定制内核:页级并行 + 表格还原 + 中文优化
并发吞吐进程池与内存过订阅自己扛自研解析引擎优化,长文档不爆内存
单据识别需另接 OCR / 识别服务发票、身份证、订单开箱即识别
运维与容错自己值班、自己重试免运维,转换失败自动退积分
数据合规全程自控支持私有化部署,数据不出内网
Formats

支持的文件类型

.pdf 扫描 / 电子版 .docx Word .pptx PowerPoint .xlsx Excel .jpg / .png / .webp 图片识别 .csv 表格 .html / .json 网页与数据
AI Recognition

图片智能识别场景

图片 OCR

截图、照片、扫描件中的文字一键提取,中英文均可。

发票识别

增值税 / 电子发票,金额、税号、商品明细结构化输出。

身份证识别

正反面信息提取,姓名、证件号、有效期字段识别。

订单识别

电商 / 物流订单截图,单号、商品、金额一目了然。

Usage

三步上手

1

注册

手机号 + 验证码注册,即送 100 积分。

2

取 Key

控制台创建 API-Key,Bearer 鉴权保存到服务端。

3

调用

POST /convert 上传文件(或 ?url=),拿到 Markdown。

Pricing

按页计费,简单透明

1 页转换消耗 1 积分:PDF 按真实页数、PPT 按幻灯片数、Word 约 1000 字 / 页、Excel 约 100 有数据行 / 页。图片识别 1 张 1 积分。

新客专享 · 限购一次
500 积分
¥9.9

约 0.02 元 / 页

注册即送 100 积分,可叠加使用

积分包
10000 积分
¥599

约 0.06 元 / 页

生产环境批量转换,不限次数

积分包
100000 积分
¥3900

约 0.04 元 / 页

平台级用量,折合每页最低价

转换前预估扣减、失败自动退还 · 积分后续可用于 AI 精华抵扣(1000 Token = 1 积分)· 用量大或需私有化部署可联系我们

FAQ

常见问题

「积分 / 页」怎么算?

1 页转换消耗 1 积分:PDF 按真实页数,PPT 按幻灯片数,Word 约 1000 字 / 页,Excel 约 100 有数据行 / 页。转换前先扣减、失败自动退还。新用户注册即送 100 积分;9.9 元 / 500 积分新客套餐每个用户限购一次;

和直接用开源有什么区别?

本服务基于自研解析内核,主要差异:页级并行共享进程池(吞吐实测见上方数据)、表格智能还原、中文排版专项优化、扫描件与单据的视觉识别,以及免运维和失败自动退分。你只需要一条 HTTP 请求,其余的坑我们踩完了。

转换的结果能直接给 AI 应用用吗?

可以。返回的是标准 Markdown 文本,保留标题、列表与表格结构,可直接作为应用上下文、RAG 切块或导入笔记软件。

文档数据安全吗?

上传的临时文件默认保留 24 小时内自动清理,也可配置为转换完成即删除;服务本身支持私有化部署到自有服务器,数据不出内网。

支持扫描件 / 图片 OCR 吗?

支持图片识别:上传发票、身份证、订单等截图或照片(jpg / png / webp),由视觉识别引擎识别并输出结构化 Markdown。纯扫描图片型 PDF 建议先转成图片再识别。

为什么收不到短信验证码?

请确认手机号无误;若 1 分钟内未收到,可稍后重试。如多次失败,说明服务商通道暂未覆盖,可联系我们人工开通。

支持私有化部署吗?

支持。本 API 可私有化部署于自有服务器,数据不出内网。商务合作请通过站内联系方式与我们联系。

先用 100 积分,
跑通第一条转换

从注册到拿到第一份 Markdown 输出,大约只要两分钟。别让文档解析,成为 AI 产品的瓶颈。