ForHosting KIT · Texto e IA

Extraer palabras clave

La mayoría de las 'herramientas de palabras clave' solo cuentan cuántas veces se repite cada palabra. Esta API de extracción de palabras clave lee el texto como lo haría un editor, identificando las frases que llevan el significado en lugar de las que simplemente más se repiten. Envía un artículo, una ficha de producto o una transcripción a POST /text/extract-keywords y recibe una lista ordenada lista para insertar en un campo de su CMS, un índice de búsqueda o un pipeline de etiquetado.

● EstablePor solicitud + por 1000 palabras$0.003
Úselo desde WebAPIEmailApp prontoTelegram pronto

Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.

Pensada para quien etiqueta contenido a gran escala

Los equipos de contenido, los responsables de SEO y los catálogos de marketplace chocan con el mismo límite: una persona puede leer un artículo y elegir buenas palabras clave en treinta segundos, pero nadie tiene treinta segundos multiplicados por diez mil artículos. Este endpoint existe exactamente para ese vacío: etiquetado masivo y desatendido de publicaciones de blog, descripciones de producto, artículos de ayuda o páginas extraídas de la web, donde la consistencia entre miles de documentos importa más que una lista perfecta para un solo texto.

Qué devuelve el modelo en la práctica

La respuesta es un arreglo ordenado de palabras clave, cada una con un puntaje de relevancia, para que defina su propio corte: las cinco primeras para una etiqueta meta, las veinte primeras para un índice interno. La extracción favorece frases de varias palabras frente a sustantivos genéricos sueltos cuando la frase aporta un significado más específico, porque 'financiamiento de bienes raíces comerciales' es una etiqueta mucho más útil que la palabra 'financiamiento' aislada.

Por qué contar frecuencias nunca fue suficiente

Las primeras herramientas de palabras clave, desde la primera generación de software de SEO en los años noventa, funcionaban contando cuántas veces aparecía cada palabra y asumiendo que frecuencia era sinónimo de importancia. Ese método sacaba a relucir de forma sistemática palabras vacías, textos legales repetidos y menciones de marca como si fueran las 'palabras clave principales', lo cual explica por qué tantas nubes de etiquetas automáticas resultan inútiles. Leer buscando relevancia en vez de frecuencia es precisamente el propósito de este endpoint.

Qué ocurre después de enviar una solicitud

Como la extracción corre en una cola, la llamada devuelve de inmediato un task_id y la lista de palabras clave llega después, ya sea enviada a su webhook firmado apenas está lista, o disponible detrás de un enlace firmado válido por 24 horas si prefiere consultarlo usted mismo. Nada del contenido de su texto de origen se conserva más allá de la ventana de retención, y jamás se usa para entrenar ningún modelo.

Dónde encaja dentro de un pipeline

Como el endpoint es una llamada única y sin estado, se integra sin fricción en pipelines de ingesta: un webhook del CMS que se dispara al publicar, un proceso nocturno sobre un catálogo de productos o un worker de cola que etiqueta artículos extraídos antes de indexarlos. Se paga por solicitud más una tarifa reducida por palabra, de modo que una descripción breve de producto cuesta una fracción de lo que cuesta un informe de cinco mil palabras: no existe un cargo fijo por documento.

Etiquetar automáticamente un archivo de blog

Procesar cada publicación existente una sola vez para completar un campo de etiquetas que distintos autores nunca llenaron de forma consistente.

Enriquecer un índice de búsqueda

Extraer entre 10 y 15 palabras clave por ficha de producto y alimentarlas a los campos de sinónimos o boost del motor de búsqueda interno para mejorar la relevancia.

Control de calidad editorial antes de publicar

Verificar que las palabras clave extraídas de un borrador coincidan con el término objetivo indicado al redactor, detectando desvíos de tema antes de que salga en vivo.

Deduplicar un conjunto de datos extraído

Agrupar miles de artículos extraídos por su conjunto de palabras clave para detectar contenido casi duplicado antes de indexarlo.

¿Cómo se usa la API para extraer palabras clave?

Se envía una solicitud POST a /text/extract-keywords con el texto en el cuerpo; la llamada devuelve de inmediato un task_id y la lista ordenada de palabras clave llega por webhook o mediante un enlace firmado cuando termina el procesamiento.

¿Existe un plan gratuito?

No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.

¿Cuánto cuesta extraer palabras clave?

El precio es de 0.003 dólares por solicitud más 0.013 dólares por cada 1000 palabras del texto de entrada, y solo se cobra por las tareas que se completan; una tarea fallida nunca se cobra.

¿En qué idiomas funciona?

El endpoint procesa texto sin importar el idioma y devuelve las palabras clave en el mismo idioma del texto original, de modo que un artículo en español entrega palabras clave en español.

¿Se puede extraer palabras clave en lote?

Sí; cada llamada es una tarea independiente, así que puede encolar tantos documentos como necesite en paralelo y recoger cada resultado conforme llega su webhook.

¿Cuántas palabras clave devuelve?

La respuesta incluye una lista ordenada con puntaje de relevancia en lugar de un número fijo, así que usted decide el corte según necesite un conjunto ajustado para una etiqueta meta o uno más amplio para un índice.

¿En qué se diferencia de una herramienta basada en frecuencia?

Los contadores de frecuencia marcan la palabra que más se repite, incluyendo palabras vacías y texto repetido; este endpoint ordena las frases según cuánto significado aportan en contexto, por lo que el relleno genérico rara vez queda arriba.

¿Cuánto tiempo se conservan los resultados?

Los resultados quedan disponibles detrás de un enlace firmado durante 24 horas y se eliminan al vencer la ventana de retención; el texto nunca se guarda para entrenamiento.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/text/extract-keywords

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/text/extract-keywords \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "text.extract_keywords",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.003
Por 1000 palabras$0.0135

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_tokens20000
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.
422task_failedLa tarea falló tras 3 reintentos. No se cobra.

Ver la documentación completa del KIT →