Chat de IA
O Chat de IA do Docsbook é um widget de chat em seu site de documentação que responde com o conteúdo dessa documentação, não com a memória do modelo. Um leitor faz uma pergunta, o assistente pesquisa suas páginas, abre as relevantes e transmite de volta uma resposta que cita as páginas que usou.
Como o Docsbook AI Chat responde a uma pergunta?#
O Docsbook AI Chat responde com um fluxo de geração aumentada por recuperação (RAG) baseado em chamadas de ferramentas. O modelo decide quando chamar cada ferramenta, e o widget mostra o rastreamento ao vivo de cada etapa, para que o leitor possa ver de qual página uma resposta veio.
- Pesquisar — o assistente pesquisa sua documentação em busca de seções relevantes.
- Ler — ele abre páginas específicas e cita o texto que precisa.
- Responder — ele compõe a resposta e a transmite ao leitor através de
streamdown.
Cada chamada é registrada, para que você possa posteriormente inspecionar o que foi perguntado, o que foi recuperado e se o leitor achou a resposta útil. Como o assistente responde a partir de suas páginas indexadas, um leitor que de outra forma abriria um ticket de suporte recebe a resposta na página — e uma pergunta que o assistente não conseguiu responder aparece como uma lacuna documentada em vez de um e-mail.
Quanto custa executar o Docsbook AI Chat?#
Cada resposta que o Docsbook AI Chat transmite utiliza o saldo do projeto para o qual respondeu. Nada mais no chat é contabilizado: a hospedagem do widget, a exibição da página e a busca do leitor não são medidas.
Três coisas no chat consomem o saldo, e são as três que chamam um modelo:
- Uma resposta a um leitor.
- Construir ou reconstruir o índice semântico.
- Uma execução de agente iniciada a partir do chat.
Os preços atuais e o que um plano inclui estão na página de preços do Docsbook — ela é gerada a partir das constantes de cobrança ao vivo em cada solicitação, portanto, é o único valor que vale a pena citar. Quando o saldo de um projeto se esgota, o chat de IA pausa em vez de cobrar mais, e o widget informa isso.
Busca semântica#
A busca semântica substitui a correspondência de palavras-chave na etapa 1 por recuperação baseada em significado: cada seção da sua documentação é incorporada uma vez, e o Docsbook AI Chat encontra a passagem certa mesmo quando a redação do leitor não se sobrepõe à redação da página. Um leitor que pergunta "por que meu site está em branco após um push" chega à página de falha de construção que nunca usa a palavra "em branco".
Ative-o em Float Widget → AI Chat aba → Busca Semântica. O cartão é onde você opera:
- O interruptor — habilitar ou desabilitar a recuperação baseada em significado para o chat.
- Sincronização ao vivo — uma vez que o índice existe, ele se re-sincroniza a cada commit em seus docs, para que você não precise se lembrar de reconstruí-lo.
- Última atualização — se o índice reflete seu conteúdo atual.
- Construir / Reconstruir — mostra uma estimativa de custo antes de ser executado, progresso ao vivo que você pode cancelar, e os tokens e custo após uma execução.
Construir o índice chama um modelo de incorporação sobre todo o seu corpus, que é o motivo pelo qual a estimativa é mostrada antes da execução em vez de depois. Você pode limitar o gasto por fonte — veja o limite do Índice Semântico em Planos Premium.
Personalização#
Você controla como o chatbot se comporta sem escrever código de backend:
- Perguntas sugeridas — preencha o estado vazio com 3–5 prompts iniciais. Estes são os textos de maior impacto no widget: eles dizem ao leitor para que serve o assistente.
- Prompt do sistema — substitua o conjunto de instruções padrão pela sua própria voz e regras.
- Ganchos pré/pós-LLM — transforme o prompt antes que o modelo o veja e processe a resposta antes que o leitor a veja. Veja Ganchos de Chat.
Qual modelo executa o chat?#
Docsbook executa o chat através do OpenRouter por padrão, em openai/gpt-4o-mini, e você escolhe um modelo diferente nas configurações do espaço de trabalho. O provedor pode ser qualquer um dos:
providers:
- openrouter
- openai
- gemini
- anthropicExistem duas configurações de modelo em Configurações ▸ Chat, porque dois modelos diferentes estão em funcionamento:
- Modelo de Chat de Visitantes AI — o que responde aos seus leitores no chat de docs.
- Modelo de Admin & Agente AI — o que executa o assistente dentro do seu painel: aquele que lê suas análises, chama ferramentas e edita seus docs.
Cada configuração lista seus próprios modelos com o preço por 1M de tokens ao lado deles, então um chat de leitor mais barato e um assistente administrativo mais forte — ou o inverso — é uma escolha cada. Um modelo mais barato faz o mesmo saldo ir mais longe. As traduções têm uma configuração de modelo própria em Configurações ▸ Traduções.
Você também pode trazer sua própria chave de API do provedor das configurações do espaço de trabalho. O uso então vai para sua chave ao preço do próprio provedor e não é deduzido do seu saldo do Docsbook.
Chat multiplayer#
Pressione Convidar na barra de ferramentas do chat para trazer um colega de equipe para a mesma sessão ao vivo. Perguntas sobre a documentação raramente são trabalho solo: alguém pergunta, outra pessoa sabe metade da resposta, e o resultado acaba colado no Slack onde ninguém encontra novamente.
- Veja quem está aqui. O botão mostra quem da sua equipe está atualmente neste chat.
- Convide por e-mail. O convite funciona independentemente de o destinatário já ter uma conta no Docsbook — o link os leva ao login e diretamente para o projeto.
- Uma resposta compartilhada. Vocês dois perguntam, e vocês dois assistem a mesma resposta chegando, para que ela chegue a todos de uma vez em vez de ser retransmitida de forma indireta.
As sessões são apenas ao vivo. Nada sobre um chat compartilhado é armazenado após todos saírem.
O que um leitor vê quando nenhum chat está conectado#
Se um leitor abrir o widget de chat em um site de documentação que não tem Chat AI conectado, ele verá uma explicação simples em vez de um erro, pedindo que entre em contato com o proprietário do site para configurá-lo. O widget nunca falha silenciosamente e nunca mostra um rastreamento de pilha para um leitor.
Relacionado#
- Ganchos de Chat — interceptar o prompt e a resposta.
- Fontes — o que o assistente lê antes de responder.
- Servidor MCP — gerenciar configurações de chat a partir do Claude Code.
- Preços — do que uma resposta se baseia.