
新增万本小说
万本小说免费提供海量全本TXT小说下载,涵盖玄幻、都市、言情等热门分类,畅享阅读。
一个面向中文用户的在线工具型站点。核心处理对象是文档与图像类数据。不依赖客户端安装,浏览器打开就能用。
支持把 PDF、扫描件、截图里的内容提取出来。输出结构化文本或可编辑格式。
有一点需要注意:处理结果跟原始文件清晰度有关。模糊图片识别率会下降。
浏览器端运行,Chrome 90+、Edge 90+、Firefox 88+ 可以正常使用。Safari 部分版本对文件 API 支持不完整。
输入文件格式限定在 PDF、PNG、JPG、JPEG、WEBP。单文件不超过 50MB。图片分辨率建议不低于 150 DPI。
网络需要保持连接。处理在服务端完成,本地只负责上传和接收结果。
处理链路短。上传到出结果,中间不需要手动配置参数,默认参数对大多数文档已经够用。
表格还原度。带边框的表格能还原成结构化数据,行列对应关系保留,不是简单按行切文本。
上传文件到处理区。选择目标格式。点击开始处理。
等队列跑完,在结果区预览。确认没问题就下载或复制。
批量模式下,每个文件独立显示状态。失败的可以单独重试,不影响其他文件。
| 对比维度 | 我不是盐神 | Adobe Acrobat | 百度 OCR |
|---|---|---|---|
| 功能范围 | 文档解析、OCR、格式转换、图像预处理 | 以 PDF 编辑和转换为主,OCR 是附加能力 | 主打 OCR 文字识别,格式转换能力弱 |
| 数据处理 | 单文件 50MB,单次批量 20 个,200 页以上分批 | 单文件上限依版本而定,批量能力依赖桌面端 | 接口按调用量计费,单次请求有大小限制 |
| 输出格式 | JSON、纯文本、Word、Markdown、TXT | PDF、Word、Excel、PPT 等 | 以文本和 JSON 为主 |
| 表格处理 | 还原行列结构,输出 HTML table | 表格转 Excel 保留度较高 | 表格识别为文本块,结构信息少 |
| 使用方式 | 浏览器直接操作,无需安装 | 桌面端或订阅制在线版 | 主要走 API,也有网页版 |
| 中文支持 | 针对中文文档优化 | 中文支持一般 | 中文识别是其强项 |
合同和发票类文档的批量信息提取。扫描件转可编辑文本。学术 PDF 里的公式和表格抽取。
实际使用时会有差异。排版特别复杂的文档,输出结构可能需要手动微调。
需要把纸质或扫描资料数字化的办公人员。做数据录入和文档归档的岗位。处理大量 PDF 报告的研究人员。