A ferramenta Reducto permite a extração rápida e precisa de texto e dados de documentos PDF via OCR (Optical Character Recognition). O Reducto foi projetado para fluxos de agentes, facilitando o processamento de PDFs enviados ou vinculados e a transformação do conteúdo em informações prontas para uso.
Com a ferramenta Reducto, você pode:
- Extrair texto e tabelas de PDFs: Converta rapidamente PDFs digitalizados ou digitais em texto, markdown ou JSON estruturado.
- Analisar PDFs a partir de uploads ou URLs: Processe documentos enviando um PDF ou especificando uma URL direta.
- Personalizar a formatação de saída: Escolha o formato de saída preferido — markdown, texto puro ou JSON — e especifique formatos de tabela como markdown ou HTML.
- Selecionar páginas específicas: Opcionalmente extraia conteúdo de páginas particulares para otimizar o processamento e focar no que importa.
- Receber metadados detalhados de processamento: Além do conteúdo extraído, obtenha detalhes do job, tempos de processamento, informações do arquivo de origem, contagens de páginas e estatísticas de uso de OCR para auditoria e automação.
Seja para automatizar etapas de fluxo, extrair informações críticas do negócio ou liberar documentos de arquivo para busca e análise, o parser OCR do Reducto entrega dados estruturados e acionáveis mesmo dos PDFs mais complexos.
Procurando parsing de PDF confiável e escalável? O Reducto é otimizado para uso por desenvolvedores e agentes — oferecendo precisão, velocidade e flexibilidade para compreensão moderna de documentos.
Usage Instructions
Integrate Reducto Parse into the workflow. Can extract text from uploaded PDF documents or file references.
Actions
reducto_parser
Input
| Parameter | Type | Required | Description |
|---|---|---|---|
file | file | Yes | PDF document to be processed |
Output
| Parameter | Type | Description |
|---|---|---|
job_id | string | Unique identifier for the processing job |
duration | number | Processing time in seconds |
usage | json | Resource consumption data |
result | json | Parsed document content with chunks and blocks |
pdf_url | string | Storage URL of converted PDF |
studio_link | string | Link to Reducto studio interface |