内容 & AI 能力
合合信息 TextIn
智能文字识别与文档解析,扫描全能王背后的技术
访问 合合信息 TextInTextIn 是合合信息的智能文字识别平台,技术源自其扫描全能王等产品的长期积累。相比通用 OCR 只做文字提取,它的重点在文档结构的还原——版面分析、表格结构识别与阅读顺序判定。
核心能力
- 通用文字识别:印刷体、手写体、多语种
- 证卡票据识别:身份证、银行卡、发票、营业执照
- 表格识别:还原单元格结构与合并关系
- 文档解析:版面分析、标题层级、段落与阅读顺序还原
- 图像预处理:切边矫正、去阴影、增强
- 文档转 Markdown 等结构化格式
典型场景
除常规的证件识别与表单自动填充外,文档解析在大模型应用中的需求上升明显:做文档问答或知识库时,PDF 与扫描件必须先转成结构化文本,如果表格被打散、标题层级丢失、多栏排版的阅读顺序错乱,后续的检索与生成效果都会受影响。这类解析质量直接决定 RAG 应用的上限,是通用 OCR 覆盖不到的部分。
接入方式
在平台注册获取 App ID 与密钥,通过 HTTP 接口提交图片或文档,返回结构化的 JSON 结果。提供多语言示例代码与在线体验。部分能力支持私有化部署。
注意事项
个人开发者可注册使用,提供免费试用额度,商用按调用量计费,不同接口的单价差异较大。证件类识别涉及敏感个人信息,需取得用户同意,识别完成后不应长期留存原始图像。对数据敏感的场景可确认私有化部署方案。复杂版面的还原效果需用真实业务文档实测,不同类型文档的表现差异明显。
编目记录 · record
- 收录日期
- 2026.08.14
- 链接核对
- 2026.08.14 境内节点实测可达
- 刻意不收录
- 价格 免费额度 限流阈值
这类数值变动频繁,静态页面无法保证准确,写进来就会变成过期错误信息。 需要准确数值请以官方文档为准;本站的取舍依据见编辑原则。