Indexar textos para busca
Esta tarefa transforma textos soltos — artigos, políticas, descrições, atas — num índice pesquisável por significado. Você envia o conteúdo, ele é fatiado em trechos e vetorizado, e a partir daí as tarefas de busca do KIT respondem consultas sobre ele. É a fundação de qualquer busca inteligente ou assistente de respostas.
Rode online
Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.
Do texto solto ao índice vivo
Indexar é mais que guardar: o conteúdo é dividido em trechos de tamanho digerível e cada trecho vira um vetor de significado. Quando alguém pesquisa, a consulta é comparada com esses vetores e os trechos mais próximos em sentido voltam primeiro. Por isso o índice acha “posso emendar o feriado?” dentro de uma política de ponto que nunca usa a palavra “emendar” — coisa que nenhum Ctrl+F faz.
O que dá para construir em cima
Com o índice montado, as outras tarefas da categoria entram em cena: busca semântica para achar trechos por significado, busca híbrida quando a palavra exata também importa, e respostas com IA quando você quer pergunta e resposta em vez de lista de resultados. O mesmo índice serve para todas — você indexa uma vez e escolhe a forma de consultar conforme o caso.
Limites que você precisa conhecer
Cada índice aceita até 10.000 trechos, e cada chamada de indexação processa até 20.000 tokens — bases maiores entram em várias chamadas. Se o seu acervo passa dos 10.000 trechos, divida por tema ou por período: um índice para a base de conhecimento, outro para os contratos, outro para o arquivo morto. Índices separados por assunto ainda deixam as buscas mais limpas, porque o universo de comparação fica coerente.
Preço: quase um arredondamento
A indexação custa US$ 0,002 por chamada mais US$ 0,0015 por 1.000 trechos. Um índice cheio, com 10.000 trechos, fica em US$ 0,015 de processamento — menos que um pastel na feira, e em dólar. O custo relevante da busca inteligente está nas consultas do dia a dia, não na montagem; então não faz sentido economizar deixando conteúdo importante de fora do índice.
Casos de uso
Base de conhecimento do suporte
A TecnoSul Soluções Digitais indexou 400 artigos de ajuda. Agora a busca do portal encontra “boleto não abre” dentro do artigo “problemas com faturas em PDF” — e o time atende menos chamado repetido.
Manual do colaborador
Juliana Nascimento, do RH de uma rede de farmácias de Recife, indexou o manual interno e as políticas de benefícios. As dúvidas de férias, plantão e reembolso agora são achadas por significado, não pelo título do capítulo.
Atas e regulamento do condomínio
Uma administradora de condomínios de Porto Alegre indexou regulamentos e atas de assembleia dos últimos cinco anos. Quando um condômino pergunta sobre obras no apartamento, a resposta certa aparece em segundos.
Perguntas frequentes
Qual a diferença entre indexar e só gerar embeddings?
A geração de embeddings devolve os vetores crus para você guardar e gerenciar por conta própria. A indexação guarda e organiza os trechos do lado do KIT, prontos para as tarefas de consulta — sem você montar banco vetorial nenhum.
Quantos trechos cabem num índice?
Até 10.000. Se a sua base é maior, divida em índices por tema ou por período — além de caber, a busca fica mais precisa com universos coerentes.
Depois de indexar, como eu pesquiso?
Com as tarefas de busca semântica, busca híbrida ou de resposta com IA, apontando para o seu índice. Indexar é o passo um; consultar é o dia a dia.
Quanto custa indexar 10.000 trechos?
US$ 0,015 de processamento (US$ 0,0015 por 1.000 trechos), mais US$ 0,002 por chamada. Sim, é isso mesmo: centavos de dólar.
Indexar documentos internos da empresa está de acordo com a LGPD?
O conteúdo é processado para montar um índice que só responde às suas chamadas de API. A prática recomendada é a mesma de qualquer sistema interno: envie o que precisa ser pesquisável e anonimize dados pessoais que não fazem falta para a busca.
Posso acrescentar conteúdo depois?
Pode: conteúdo novo entra com novas chamadas de indexação, pagando o mesmo preço por trecho. Não precisa refazer o índice do zero a cada documento que chega.
Para desenvolvedores — acesso via API
Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.
Endpoint
Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.
Chame do seu código
curl -X POST https://api.kit.forhosting.com/search/index-text \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/search/index-text", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/search/index-text",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/search/index-text", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/search/index-text", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemplo de requisição
{
"text": "…"
}Exemplo de resposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "search.index_text",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.
Preço
Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.
Limites
max_chunks | 10000 |
max_tokens | 20000 |
Erros
| HTTP | Código | O que significa |
|---|---|---|
401 | unauthorized | Token ausente ou inválido. Confira o header Authorization. |
402 | insufficient_balance | Saldo insuficiente para esta tarefa. Faça uma recarga e tente de novo. |
404 | unknown_type | Esse tipo de tarefa não existe. Confira o campo type no catálogo. |
429 | rate_limited | Muitas requisições em pouco tempo. Espere um instante e tente de novo. |