← 返回平台目录 CNDEV · No.111
内容 & AI 能力

合合信息 TextIn

智能文字识别与文档解析,扫描全能王背后的技术

官网 · website
分类 · category
来源 · source
官方收录
OCR
访问 合合信息 TextIn

TextIn 是合合信息的智能文字识别平台,技术源自其扫描全能王等产品的长期积累。相比通用 OCR 只做文字提取,它的重点在文档结构的还原——版面分析、表格结构识别与阅读顺序判定。

核心能力

  • 通用文字识别:印刷体、手写体、多语种
  • 证卡票据识别:身份证、银行卡、发票、营业执照
  • 表格识别:还原单元格结构与合并关系
  • 文档解析:版面分析、标题层级、段落与阅读顺序还原
  • 图像预处理:切边矫正、去阴影、增强
  • 文档转 Markdown 等结构化格式

典型场景

除常规的证件识别与表单自动填充外,文档解析在大模型应用中的需求上升明显:做文档问答或知识库时,PDF 与扫描件必须先转成结构化文本,如果表格被打散、标题层级丢失、多栏排版的阅读顺序错乱,后续的检索与生成效果都会受影响。这类解析质量直接决定 RAG 应用的上限,是通用 OCR 覆盖不到的部分。

接入方式

在平台注册获取 App ID 与密钥,通过 HTTP 接口提交图片或文档,返回结构化的 JSON 结果。提供多语言示例代码与在线体验。部分能力支持私有化部署。

注意事项

个人开发者可注册使用,提供免费试用额度,商用按调用量计费,不同接口的单价差异较大。证件类识别涉及敏感个人信息,需取得用户同意,识别完成后不应长期留存原始图像。对数据敏感的场景可确认私有化部署方案。复杂版面的还原效果需用真实业务文档实测,不同类型文档的表现差异明显。

编目记录 · record

收录日期
2026.08.14
链接核对
2026.08.14 境内节点实测可达
刻意不收录
价格 免费额度 限流阈值

这类数值变动频繁,静态页面无法保证准确,写进来就会变成过期错误信息。 需要准确数值请以官方文档为准;本站的取舍依据见编辑原则