---
title: Entender Mídia
description: Leia PDFs, planilhas, apresentações e imagens e transforme o conteúdo em texto pronto para o fluxo.
---

# Entender Mídia  ·  `document_extractor`

<NoCard kind="document_extractor" categoria="Dados" />

<Secao icon="info">Para que serve</Secao>

Pensa numa assistente que recebe um contrato em PDF, lê tudo, e te entrega um resumo com as informações principais. O Entender Mídia faz isso: recebe um arquivo (PDF, Word, planilha, apresentação ou imagem), lê o conteúdo e devolve tudo como texto estruturado — pronto para passar para uma IA analisar, ou para usar em mensagens e integrações.

<Secao icon="clock">Quando usar</Secao>

- Processar contratos ou documentos enviados pelo cliente via WhatsApp
- Extrair informações de boletos, notas fiscais ou comprovantes em imagem
- Ler o conteúdo de uma planilha recebida e tomar decisões com base nos dados
- Preparar o conteúdo de um documento para análise por um nó Modelo de IA (LLM)
- Adicionar documentos enviados pelos usuários à base de conhecimento, para consulta futura

---

## Formatos suportados

| Tipo | Extensões |
|------|-----------|
| **Documentos de texto** | PDF, DOCX |
| **Apresentações** | PPTX |
| **Planilhas** | XLSX |
| **Imagens** | PNG, JPG, JPEG, WEBP, GIF, BMP |

A saída é sempre em **Markdown** — um jeito simples de organizar texto com títulos, listas e tabelas —, mantendo a estrutura do documento original.

---

<Secao icon="list-checks">Passo a passo</Secao>

<Passos>
  <Passo>Certifique-se de que o arquivo já está disponível no fluxo — via upload do cliente, resultado de um nó HTTP, ou uma URL pública.</Passo>
  <Passo>Arraste o nó **Entender Mídia** para o canvas e conecte ao nó que fornece o arquivo.</Passo>
  <Passo>No painel, configure a **Fonte do arquivo**: URL direta, variável com o caminho, ou upload.</Passo>
  <Passo>Salve. A saída <code v-pre>{{document_extractor.content}}</code> conterá o texto extraído em Markdown, e <code v-pre>{{document_extractor.fields}}</code> os campos estruturados detectados.</Passo>
</Passos>

---

<Secao icon="sliders-horizontal">Campos</Secao>

| Campo | O que faz |
|-------|-----------|
| **Fonte do arquivo** | URL ou referência ao arquivo a ser processado |
| **Tipo de arquivo** | Detecção automática ou especificação manual do formato |

## Saídas

| Variável | Conteúdo |
|----------|----------|
| `content` | Texto completo do documento em Markdown |
| `fields` | Campos estruturados extraídos (título, autor, data, tabelas, etc.) quando disponíveis |

---

<Secao icon="circle-check">Exemplo</Secao>

O cliente envia uma foto de um comprovante de pagamento pelo WhatsApp. O fluxo captura o arquivo, passa pelo Entender Mídia, e o modelo de IA seguinte lê o Markdown gerado para confirmar o valor e a data do pagamento.

<Dica>

Para documentos extensos (PDFs com muitas páginas), combine o Entender Mídia com o nó **Modelo de IA (LLM)** e peça para o modelo resumir as partes relevantes antes de usar o conteúdo numa mensagem.

</Dica>

<Cuidado>

Arquivos protegidos por senha ou com restrição de cópia podem não ser extraídos corretamente. Oriente os clientes a enviar documentos sem senha quando possível.

</Cuidado>
