ForHosting KIT · Texto e IA

Remover pontuação de texto on-line

Retire a pontuação de textos com um filtro previsível e compatível com Unicode, que mantém letras, dígitos, espaços, tabulações e quebras de linha.

● BetaGrátis · no seu navegador
Use pelo WebAPIE-mailTelegramApp em breve

Cole uma frase, um parágrafo, uma lista ou um trecho multilíngue e receba um texto limpo, sem vírgulas, aspas, parênteses, travessões ou outras marcas. A operação é determinística, não acessa a rede e preserva os espaços originais em vez de compactá-los ou reformatá-los. Assim, o resultado pode ser usado em rotinas repetíveis de pré-processamento, indexação, comparação e análise textual simples.

Remova a pontuação sem alterar as palavras

A pontuação ajuda na leitura, mas pode atrapalhar quando um processo precisa de uma sequência simplificada de palavras e números. Esta ferramenta examina o texto fornecido caractere por caractere e mantém letras Unicode, números Unicode e espaços em branco. Vírgulas, pontos, apóstrofos, aspas, parênteses, travessões, barras e marcas semelhantes são removidos onde aparecerem. As letras e os dígitos restantes continuam na ordem original, sem alteração dos espaços. Isso preserva espaços, tabulações e quebras de linha para etapas posteriores, sem normalização silenciosa. O comportamento é propositalmente direto: não reescreve frases, não tenta adivinhar separadores, não muda maiúsculas, não translitera sistemas de escrita nem substitui sinais por novos espaços. Se duas palavras forem separadas apenas por pontuação, elas poderão ficar unidas após a remoção. Quando a separação for importante, prepare a origem ou use depois uma tokenização adequada aos seus dados. Como a regra é sempre a mesma, entradas idênticas geram saídas idênticas.

Filtragem Unicode para textos multilíngues

Texto é muito mais amplo que o alfabeto inglês, portanto uma expressão limitada a ASCII descartaria nomes válidos, caracteres acentuados e sistemas de escrita inteiros. O filtro usa propriedades de caracteres Unicode para reconhecer letras e números nas escritas compatíveis. Letras latinas com diacríticos, gregas, cirílicas e árabes, ideogramas CJK e caracteres numéricos Unicode podem permanecer, enquanto a pontuação ao redor é retirada. Os espaços em branco também são reconhecidos como categoria Unicode, preservando espaços comuns, tabulações e quebras de linha. Símbolos que não sejam letras, números ou espaços também são removidos, de acordo com o contrato que restringe o resultado a essas categorias. Isso inclui enfeites e emojis, em vez de tratá-los como letras. A ferramenta não normaliza Unicode, portanto sequências canonicamente equivalentes não são convertidas em uma representação comum. Ela também não converte para minúsculas, extrai radicais, ordena, elimina duplicatas nem interpreta o conteúdo. Essas limitações tornam o resultado transparente: a capacidade apenas filtra caracteres. Use outra ferramenta linguística ou de normalização se precisar de regras adicionais de equivalência.

Use o resultado em rotinas repetíveis

O texto sem pontuação funciona como representação intermediária para indexação de busca, contagens simples de palavras, preparação de identificadores, exercícios, limpeza de conjuntos de dados e comparações em que diferenças de pontuação não importam. Envie o conteúdo no campo de texto obrigatório e leia o valor filtrado no campo de texto retornado. A API custa US$ 0,002 por solicitação, enquanto a experiência no navegador executa localmente a mesma lógica determinística. Uma entrada vazia é rejeitada porque não oferece texto para processar; o erro claro torna omissões acidentais visíveis, em vez de apresentar um sucesso enganoso. Uma entrada composta apenas por espaços é aceita e preservada, pois eles fazem parte do conjunto permitido. Antes de usar a saída como identificador permanente ou forma canônica sensível, defina regras adicionais de caixa, normalização, escrita e colisões. A remoção pode fazer originais diferentes produzirem o mesmo resultado e unir trechos antes separados por sinais. Em rotinas comuns, mantenha o original junto com a versão filtrada para exibição, auditoria ou processamento futuro com outras regras.

Preparar texto para análise simples

Remova a pontuação antes de contar ou comparar palavras, mantendo os espaços e a estrutura de linhas da origem.

Limpar rótulos importados

Filtre sinais e símbolos decorativos de rótulos copiados sem perder letras e dígitos multilíngues.

Comparar trechos sem considerar a pontuação

Crie uma forma intermediária determinística quando a pontuação não deve afetar uma comparação posterior.

Quanto custa?

A API custa US$ 0,002 por solicitação. A versão do navegador executa localmente a mesma lógica determinística.

Quais caracteres são preservados?

Letras Unicode, números Unicode e espaços em branco são mantidos na ordem original.

As quebras de linha e tabulações são mantidas?

Sim. Os espaços em branco são preservados, inclusive espaços, tabulações e quebras de linha.

Há suporte para acentos e letras não latinas?

Sim. A ferramenta usa propriedades Unicode, sem limitar letras e números a ASCII.

A pontuação é substituída por espaços?

Não. Os caracteres não permitidos são removidos, então partes separadas apenas por sinais podem ficar unidas.

O que acontece se o texto estiver vazio?

Texto ausente, uma string vazia ou um valor que não seja string gera um erro de entrada inválida.

Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.

POSThttps://api.kit.forhosting.com/text/remove-punctuation

Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.

curl -X POST https://api.kit.forhosting.com/text/remove-punctuation \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"Hello, world! Room #42 is ready."}'
{
  "text": "Hello, world! Room #42 is ready."
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "text.remove_punctuation",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.

por chamadaUS$ 0,002

Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.

max_tokens20000
HTTPCódigoO que significa
401unauthorizedToken ausente ou inválido. Confira o header Authorization.
402insufficient_balanceSaldo insuficiente para esta tarefa. Faça uma recarga e tente de novo.
404unknown_typeEsse tipo de tarefa não existe. Confira o campo type no catálogo.
429rate_limitedMuitas requisições em pouco tempo. Espere um instante e tente de novo.

Ver a documentação completa do KIT →