A ferramenta Mistral Parse oferece uma forma poderosa de extrair e processar conteúdo de documentos PDF usando a OCR API da Mistral. Esta ferramenta aproveita reconhecimento óptico de caracteres avançado para extrair texto e estrutura de arquivos PDF com precisão, facilitando a incorporação de dados de documentos nos fluxos de trabalho dos seus agentes.
Com a ferramenta Mistral Parse, você pode:
- Extrair texto de PDFs: Converter com precisão o conteúdo de PDF para formatos texto, markdown ou JSON
- Processar PDFs a partir de URLs: Extrair conteúdo diretamente de PDFs hospedados online fornecendo suas URLs
- Manter a estrutura do documento: Preservar formatação, tabelas e layout dos PDFs originais
- Extrair imagens: Incluir opcionalmente imagens embutidas dos PDFs
- Selecionar páginas específicas: Processar apenas as páginas de que você precisa em documentos multipágina
A ferramenta Mistral Parse é especialmente útil em cenários em que seus agentes precisam trabalhar com conteúdo de PDF, como analisar relatórios, extrair dados de formulários ou processar texto de documentos digitalizados. Ela simplifica o processo de disponibilizar conteúdo de PDF aos seus agentes, permitindo que trabalhem com informações armazenadas em PDFs com a mesma facilidade que com entrada de texto direta.
Usage Instructions
Integrate Mistral Parse into the workflow. Can extract text from uploaded PDF documents, or from a URL.
Actions
mistral_parser
Input
| Parameter | Type | Required | Description |
|---|---|---|---|
file | file | Yes | Normalized UserFile from file upload or file reference |
Output
| Parameter | Type | Description |
|---|---|---|
pages | array | Array of page objects from Mistral OCR |
↳ index | number | Page index (zero-based) |
↳ markdown | string | Extracted markdown content |
↳ images | array | Images extracted from this page with bounding boxes |
↳ id | string | Image identifier (e.g., img-0.jpeg) |
↳ top_left_x | number | Top-left X coordinate in pixels |
↳ top_left_y | number | Top-left Y coordinate in pixels |
↳ bottom_right_x | number | Bottom-right X coordinate in pixels |
↳ bottom_right_y | number | Bottom-right Y coordinate in pixels |
↳ image_base64 | string | Base64-encoded image data (when include_image_base64=true) |
↳ dimensions | object | Page dimensions |
↳ dpi | number | Dots per inch |
↳ height | number | Page height in pixels |
↳ width | number | Page width in pixels |
↳ tables | array | Extracted tables as HTML/markdown (when table_format is set). Referenced via placeholders like [tbl-0.html] |
↳ hyperlinks | array | Array of URL strings detected in the page (e.g., ["https://...", "mailto:..."]) |
↳ header | string | Page header content (when extract_header=true) |
↳ footer | string | Page footer content (when extract_footer=true) |
model | string | Mistral OCR model identifier (e.g., mistral-ocr-latest) |
usage_info | object | Usage and processing statistics |
↳ pages_processed | number | Total number of pages processed |
↳ doc_size_bytes | number | Document file size in bytes |
document_annotation | string | Structured annotation data as JSON string (when applicable) |