Eliminar palabras vacías de un texto en línea
Las palabras vacías son términos estructurales frecuentes, como artículos, conjunciones, pronombres y preposiciones breves.
Ejecutar — gratis
Resultan necesarias en la escritura corriente, pero suelen añadir ruido al preparar búsquedas, revisar temas o crear un flujo sencillo de procesamiento textual. Esta herramienta selecciona una lista revisada según el código de idioma que usted indique, tokeniza el contenido de forma coherente, elimina las coincidencias sin alterar la grafía de las palabras conservadas y devuelve el texto depurado junto con recuentos útiles para comprobar el resultado.
Seleccione el idioma correspondiente al texto
Las palabras vacías dependen del idioma, por lo que el código lingüístico forma parte de la operación y no es un simple ajuste visual. El inglés repite con mucha frecuencia términos como «the», «is» y «and», mientras que el español, el francés, el alemán, el italiano y el portugués emplean artículos, pronombres, contracciones y preposiciones diferentes. Indique uno de los códigos de dos letras admitidos: en, es, fr, de, it o pt. La capacidad utilizará únicamente la lista revisada que corresponda. No intenta adivinar el idioma, ya que un texto breve puede ser ambiguo y una deducción incorrecta podría borrar términos relevantes sin avisar. Un código no admitido genera un error de entrada explícito, en vez de aplicar el inglés como alternativa. Si el material mezcla idiomas, separe primero los pasajes y procese cada uno con su código real. Así, el resultado será explicable, repetible y no descartará una palabra solo porque se parezca a una palabra vacía de otra lengua. Conserve el original siempre que la salida vaya a orientar decisiones editoriales o analíticas.
Comprenda cómo se seleccionan y devuelven las palabras
El algoritmo normaliza la entrada a una forma Unicode estable y extrae secuencias de letras o números, incluidas las palabras con apóstrofo recto o curvo en su interior. La comparación con la lista no distingue mayúsculas de minúsculas, pero los elementos conservados mantienen la grafía y el uso de mayúsculas del original. La puntuación no aparece en el texto depurado, porque la salida buscada es una secuencia de palabras relevantes y no una frase reescrita. La respuesta incluye una matriz ordenada de palabras, esas mismas palabras unidas en una cadena práctica y recuentos de términos de entrada, eliminados y restantes. Estos datos facilitan la comprobación de procesos por lotes y permiten medir cuánto afectó la lista a cada pasaje. El método es deliberadamente determinista: una entrada idéntica produce siempre la misma salida, sin modelos, detectores de idioma, solicitudes de red, azar ni contexto oculto. Una lista de palabras vacías es una convención útil, no una ley lingüística universal; revise por ello los términos cuando el vocabulario especializado sea importante.
Aplique las palabras depuradas a flujos de trabajo reales
Las secuencias depuradas sirven como transformación inicial cuando un paso posterior debe destacar el tema por encima de la estructura gramatical. Usted puede enviarlas a un contador de frecuencias, comparar el vocabulario de varios documentos, preparar etiquetas candidatas, revisar temas recurrentes en encuestas o reducir ruido en un índice de búsqueda sencillo. La salida no sustituye la obtención de raíces, la lematización, el reconocimiento de entidades, el análisis de sentimiento ni un sistema completo de lenguaje natural. Tampoco agrupa variantes de una palabra, decide su sentido por contexto ni reconstruye una prosa gramatical después del filtrado. Trate el resultado como un conjunto transparente de rasgos que conserva el orden de la fuente. En automatizaciones, valide los recuentos y guarde el código de idioma para poder reproducir la transformación. El procesamiento mediante API comienza en $0.002 por elemento y la opción del navegador usa la misma lógica pura. No presente el texto unido como cita: se han retirado deliberadamente la puntuación y los términos estructurales.
Qué puede hacer con ella
Preparar términos clave candidatos
Retire el relleno gramatical antes de revisar los términos que mejor describen un artículo, una nota o un producto.
Comparar vocabulario documental
Genere listas coherentes de palabras relevantes antes de contar vocabulario repetido en textos del mismo idioma.
Depurar respuestas de encuestas
Reduzca términos estructurales para que los temas recurrentes de las respuestas libres resulten más visibles.
Preguntas frecuentes
¿Qué idiomas se admiten?
Inglés (en), español (es), francés (fr), alemán (de), italiano (it) y portugués (pt). Cualquier otro código genera un error de entrada.
¿La herramienta detecta automáticamente el idioma?
No. Usted indica el código de forma explícita para mantener un comportamiento predecible y evitar una lista incorrecta.
¿Se conservan las mayúsculas?
Sí. La comparación ignora las mayúsculas, pero cada término retenido mantiene la grafía y capitalización originales.
¿Qué ocurre con la puntuación?
Se excluye durante la tokenización. El resultado contiene una lista ordenada de términos relevantes y un texto unido por espacios.
¿La herramienta obtiene raíces o lemas?
No. Solo elimina las palabras vacías enumeradas; no combina variantes, infiere raíces ni analiza funciones gramaticales.
¿Cuánto cuesta el procesamiento por API?
El procesamiento por API comienza en $0.002 por elemento. También puede ejecutarse en el navegador con la misma lógica determinista.
Para desarrolladores — acceso por API
Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.
Endpoint de API
¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, por email y desde Telegram — y pronto también desde nuestra app.
Llámela desde su stack
curl -X POST https://api.kit.forhosting.com/text/remove-stopwords \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"The quick brown fox jumps over the lazy dog and runs into the forest.","language":"en"}'const res = await fetch("https://api.kit.forhosting.com/text/remove-stopwords", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "The quick brown fox jumps over the lazy dog and runs into the forest.",
"language": "en"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/text/remove-stopwords",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "The quick brown fox jumps over the lazy dog and runs into the forest.",
"language": "en"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/text/remove-stopwords", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"The quick brown fox jumps over the lazy dog and runs into the forest.","language":"en"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"The quick brown fox jumps over the lazy dog and runs into the forest.","language":"en"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/text/remove-stopwords", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Ejemplo de solicitud
{
"text": "The quick brown fox jumps over the lazy dog and runs into the forest.",
"language": "en"
}Ejemplo de respuesta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "text.remove_stopwords",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.
Precio
Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.
Límites
max_tokens | 20000 |
Errores
| HTTP | Código | Significado |
|---|---|---|
401 | unauthorized | API key ausente o inválida. |
402 | insufficient_balance | El saldo no cubre el precio de la tarea. |
404 | unknown_type | El tipo de tarea no existe. |
429 | rate_limited | Demasiadas peticiones. Use el webhook en vez de sondear. |