Base de Conhecimento (Gestão)
Gerencie bases, itens de texto, arquivos e sites que alimentam seus agentes.
Visão geral
A página Base de Conhecimento é onde vive tudo que o agente sabe além das diretrizes. O workspace pode ter várias bases, cada uma com seus itens, e cada base é vinculada aos agentes que podem consultá-la.
Esta página cobre a operação da tela. Para estratégia de conteúdo — o que escrever, como estruturar, o que evita alucinação — veja o guia de base de conhecimento.
Lista de bases
Cada card mostra o nome, a descrição, a quantidade de itens e a data de criação. No topo há:
- Busca por fonte, agente ou conteúdo — ela também devolve trechos encontrados dentro do conteúdo indexado, com link para o item
- Filtro por tag
- Nova base
As abas separam Conteúdo e Arquivo (itens arquivados).
Modos de recuperação
Ao adicionar um item, o primeiro passo é escolher como o agente vai acessar aquele conhecimento:
| Modo | Como funciona | Quando usar |
|---|---|---|
| Injetar como prompt | O conteúdo inteiro entra no contexto em toda conversa | Textos curtos e sempre relevantes: políticas, regras de negócio, tabela pequena |
| Busca semântica (RAG) | O conteúdo é indexado e só os trechos relevantes entram na resposta | Documentos grandes, sites, catálogos, FAQ extensa |
Upload de arquivo só funciona no modo Busca semântica. Conteúdo injetado no prompt consome tokens em toda conversa — use com parcimônia.
Tipos de conteúdo
Texto
Cole ou escreva o conteúdo direto na plataforma. Aceita Markdown.
Arquivo
Arraste ou selecione arquivos — PDF, TXT, CSV, Markdown e imagens (JPG, PNG, GIF, WebP), até 50 MB por arquivo. O texto é extraído automaticamente; itens já enviados podem ter o conteúdo extraído depois, o que habilita a edição inline.
Website
Informe a URL e clique em Descobrir: a plataforma encontra as páginas por sitemap, rastreamento da home ou os dois combinados. Marque as páginas que quer incluir (há busca, "selecionar todas", "inverter" e um limite de seleção) e confirme.
Selecione só as páginas relevantes. Termos de uso, política de privacidade e páginas duplicadas só adicionam ruído à busca.
Gerenciando itens
Cada item traz o tipo (TEXTO, ARQUIVO, WEB) e as ações:
- Ver conteúdo — Abre o texto indexado
- Editar item — Altera o conteúdo; a reindexação (re-embedding) roda automaticamente
- Baixar arquivo / Visitar site
- Rastrear novamente — Refaz o crawl de um item de website
- Tentar rastrear novamente — Quando o rastreamento falhou
- Ativar / Desativar — Item inativo não é consultado pelo agente
- Excluir item
- Tags — Até 10 por item, usadas no filtro
Atualização automática (websites)
Itens de website podem se atualizar sozinhos: diário, semanal ou mensal (ou desligado). O card mostra o último rastreamento e a próxima execução.
Ative a atualização semanal em sites que mudam com frequência (blog, catálogo, preços) e deixe desligado no que é estável — cada recrawl consome processamento e tokens de indexação.
Publicação na central de ajuda
Um item pode ser publicado na central de ajuda pública do agente: qualquer visitante lê o conteúdo, sem login. O editor mostra um preview de como o visitante vai ler e pede confirmação antes de publicar.
Conteúdo publicado fica acessível sem autenticação. Revise antes: nada de dado pessoal, preço interno ou informação sensível.
Acesso por agente
Em Gerenciar acesso, escolha quais agentes consultam aquela base. É o que permite segmentar o conhecimento — o agente de vendas consulta o material comercial, o de suporte consulta a documentação técnica.
Um agente sem base vinculada responde apenas com as diretrizes. O Dashboard avisa quando isso acontece, no bloco "Precisa de você".
Como o conteúdo é processado
- Entrada — Texto colado, arquivo enviado ou página rastreada
- Extração — O texto é extraído do PDF, do arquivo ou do HTML
- Chunking — O conteúdo é dividido em trechos adequados à busca
- Embedding — Cada trecho vira um vetor (só no modo busca semântica)
- Indexação — Os vetores ficam disponíveis para a busca híbrida do agente
O card mostra o andamento (rastreando, pronto, falha). Textos ficam prontos em segundos; sites e PDFs longos levam alguns minutos.
Editar um item republica o conteúdo e refaz o embedding — o agente continua atendendo com a versão anterior até a nova ficar pronta, sem downtime.
Auditando o que o agente usou
Na conversa, a aba Logs mostra a Auditoria da RAG: a query original, a reescrita, as sub-queries e os chunks que entraram na resposta, com link para a fonte. É a forma mais direta de descobrir por que uma resposta saiu incompleta. Veja Histórico.

