Parse icon

Parse

Parse 是 Cohere 面向企业文档、表格和图像的文档解析模型,可将非结构化内容转为可供搜索和 AI 工作流使用的结构化数据。

Parse

概述

Parse 是 Cohere 面向企业文档、表格和图像的文档解析模型。它可将非结构化内容转换为结构化数据,供 AI 系统搜索、索引或执行操作。

该产品面向需要用于搜索和智能体的文档摄取能力的组织,并支持 OCR、视觉推理、边界框、多语言文档,以及在云端、本地、私有和隔离环境中的部署。

核心能力

适用于扫描件和数字文件的 OCR

Parse 使用 OCR 从扫描件和数字文档中提取文本,因此适用于非原生可机器读取的文件。

多模态文档解析

该模型可检测复杂文档中嵌入的表格、图表和图像,从而让这些元素能带着更多上下文进入下游 AI 工作流。

带页面坐标的视觉定位

Parse 以页面坐标返回轴对齐边界框,并可高亮关键视觉区域,用于来源归因和空间推理。

多语言文档支持

该模型支持主要商业语言,并被描述为多语言模型,有助于团队处理混合语言的企业文档集合。

企业级部署选项

Parse 可部署在云端、本地,以及私有和隔离环境中,以满足不同的安全与基础设施需求。

实际用例

  • 文档处理工作流

    团队可以自动化高吞吐量文件的摄取与提取,例如理赔、合同和发票,从而减少所需的人工审核和数据录入量。

  • 语义搜索准备

    组织可以将复杂文档转化为可检索的表示,以支持企业搜索系统中的分块、索引、搜索和引用质量。

  • 多模态智能体工作流

    AI 智能体可以使用 Parse 的输出来推理完整的文档上下文,包括表格、图表和其他视觉元素,而不只是依赖纯文本。

  • 受控企业部署

    需要对数据和基础设施进行更严格控制的企业,可以在私有、本地或隔离环境中部署 Parse。

  • 多语言文档接入

    处理多语言文档集合的团队可以使用 Parse,以一致的输出处理主要商业语言中的内容。

Pros and Cons

Pros

  • 支持 OCR 和视觉推理,有助于 Parse 同时处理文档中的文本与视觉结构。
  • 为提取内容返回边界框,这对高亮和引用工作流很有用。
  • 支持跨九种商业语言的多语言文档处理。
  • 可部署在云端、本地、私有或隔离环境中。
  • 提供公开的基准测试框架 ParseBench,用于说明解析质量如何评估。

Cons

  • 页面未为每种受支持的输入类型、输出架构或验证规则提供完整的技术规范。
  • 部分集成细节只做了高层说明,因此读者可能仍需要查阅产品文档或联系销售以了解工作流细节。

FAQ

什么是 Parse?

Parse 是 Cohere 的文档视觉解析模型。它旨在将企业文档和图像中的非结构化内容转化为下游 AI 智能体和应用可使用的结构化数据。

Parse 支持 OCR 吗?

是的。页面说明 Parse 支持 OCR 和视觉推理,因此它既能提取文本,也能理解视觉元素和上下文。

Parse 可用于哪里?

Parse 可通过 Cohere API 和 Model Vault 使用,也可在 Amazon SageMaker 和 Microsoft Azure 上使用。页面还说明,它可以私有部署,以满足对数据和基础设施控制要求更高的企业用例。

什么是 ParseBench?

ParseBench 是 Cohere 的文档解析质量基准,覆盖表格、文本内容、文本格式、布局和图表。页面说明 Cohere 会报告表格、文本内容和文本格式的结果,而布局和图表分数被排除在外,因为它们覆盖了当前产品范围之外的能力。

Parse 支持多语言吗?

是的。Parse 被描述为一款多语言模型,训练于全球最常用的九种商业语言。

Quick Facts

类别
文档解析 / 文档视觉
产品线
Cohere Parse
访问方式
Cohere API、Model Vault、Amazon SageMaker、Microsoft Azure
部署方式
云端、本地、私有和隔离环境
语言
九种主要商业语言
相关产品
Compass 将 Parse 作为其文档处理流程中的一个组件