ForHosting KIT · Ler texto de imagem (OCR)

Que idioma é esse documento?

Essa ferramenta examina um documento — PDF, digitalização ou foto — e identifica em que idioma ele está escrito, inclusive quando há mais de um no mesmo arquivo. Parece trivial até chegar um manual em algo que pode ser chinês ou japonês, e a resposta definir para quem você manda o arquivo.

● Estávelpor documentoUS$ 0,003
Use pelo WebAPIE-mailApp em breveTelegram em breve

Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.

Quando ninguém no escritório reconhece a língua

Importadoras recebem manuais e certificados de fábricas asiáticas; escritórios recebem contratos de parceiros do Leste Europeu; RHs recebem currículos internacionais. O primeiro passo prático — saber que idioma é aquele — trava tudo quando ninguém reconhece o alfabeto. A identificação automática responde em segundos, distinguindo inclusive línguas visualmente parecidas para leigos: chinês de japonês, russo de ucraniano, espanhol de português.

Documento com idiomas misturados

Contrato bilíngue com colunas lado a lado, manual com seções por país, certificado com carimbos em outra língua: o mundo real mistura idiomas no mesmo papel. A análise reporta os idiomas presentes no documento, não apenas um rótulo único — o que evita a surpresa de mandar para o tradutor de inglês um arquivo que é metade alemão. Documentos escaneados entram normalmente: o reconhecimento do texto na imagem faz parte do fluxo.

O passo barato que evita o passo caro

Identificar o idioma custa US$ 0,003 de chamada mais US$ 0,0135 por documento — centavos. Errar o idioma na contratação de uma tradução juramentada custa dias e dinheiro de verdade. Por isso o uso típico é como triagem automática: todo documento que entra no fluxo é identificado primeiro, e o roteamento — para tradutor, para a filial certa, para o analista que fala a língua — acontece sem tentativa e erro. Limites por envio: 25 MB, 10 páginas.

Importadora triando documentos de fábrica

Uma importadora de Santos recebe certificados e manuais de fornecedores da Ásia. A identificação separa o que está em chinês, coreano e vietnamita antes de cotar tradução — cada documento vai para o tradutor juramentado do idioma certo, sem retrabalho.

Agência de tradução automatizando orçamentos

Clientes mandam arquivos pedindo orçamento sem dizer o idioma. A agência identifica automaticamente na chegada e responde a cotação com par de idiomas correto em minutos — antes, um coordenador abria arquivo por arquivo.

RH com currículos internacionais

Uma vaga remota atraiu candidatos do mundo inteiro. O sistema de RH identifica o idioma de cada currículo anexado e direciona os que não estão em português ou inglês para avaliadores adequados.

Suporte roteando anexos de clientes

O atendimento de um software com clientes na América Latina recebe prints e PDFs em várias línguas. Identificando o idioma do anexo, o chamado cai direto na fila do atendente que fala espanhol — ou português.

Distingue português do Brasil de português de Portugal?

A identificação primária é do idioma — português. Variantes regionais compartilham a quase totalidade do vocabulário, então trate a distinção fina entre variantes como tarefa de revisão humana, não de triagem automática.

Consegue diferenciar chinês, japonês e coreano?

Sim — é um dos casos em que a ferramenta mais ajuda, porque para quem não lê os alfabetos a confusão é natural, e mandar um manual japonês para tradutor de chinês custa caro.

E se o documento tiver dois idiomas ao mesmo tempo?

O resultado reporta os idiomas encontrados no arquivo. Contratos bilíngues e manuais multilíngues são justamente o cenário em que um rótulo único enganaria.

A ferramenta também traduz o documento?

Não — ela responde qual é o idioma, que é a informação de que você precisa para decidir o passo seguinte. Tradução é outra etapa, com outra ferramenta.

Qual o preço para triar um fluxo contínuo de documentos?

US$ 0,003 por chamada mais US$ 0,0135 por documento: identificar 1.000 arquivos custa cerca de US$ 16,50. Cobrança por uso, sem plano mínimo.

Os arquivos enviados ficam armazenados?

São usados apenas para executar a identificação e nada mais — sem reaproveitamento nem exposição. Se o documento é sigiloso e a dúvida é só o idioma, enviar uma página representativa já resolve.

Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.

POSThttps://api.kit.forhosting.com/ocr/language

Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.

curl -X POST https://api.kit.forhosting.com/ocr/language \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"…"}'
{
  "input": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "ocr.language",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.

por chamadaUS$ 0,003
por documentoUS$ 0,0135

Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.

max_mb25
max_pages10
HTTPCódigoO que significa
401unauthorizedToken ausente ou inválido. Confira o header Authorization.
402insufficient_balanceSaldo insuficiente para esta tarefa. Faça uma recarga e tente de novo.
404unknown_typeEsse tipo de tarefa não existe. Confira o campo type no catálogo.
429rate_limitedMuitas requisições em pouco tempo. Espere um instante e tente de novo.
422task_failedA tarefa falhou do nosso lado. Você não paga nada por ela.

Ver a documentação completa do KIT →