ForHosting KIT · Audio y voz

Palabras clave del audio

Una grabación no viene con etiquetas, así que buscar en una biblioteca de audio suele depender de que alguien recuerde más o menos en qué episodio se trató un tema. Este endpoint escucha una sola vez y devuelve las palabras clave y temas realmente tratados, ordenados por relevancia, convirtiendo el contenido hablado en algo que se puede buscar, filtrar y ordenar como texto.

● EstablePor solicitud + por minuto$0.004
Úselo desde WebAPIEmailApp prontoTelegram pronto

Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.

El problema de usar audio como objetivo de búsqueda

El texto es buscable desde el momento en que existe; el audio no lo es, a menos que alguien lo etiquete a mano o lo transcriba y lo vuelva a leer. Ese vacío es la razón por la que archivos enteros de podcasts, bibliotecas de llamadas y grabaciones de clases quedan prácticamente inaccesibles a la búsqueda: el contenido está ahí, pero nada indica qué hay dentro de un archivo sin escucharlo primero. Este endpoint existe para ponerle una etiqueta a ese vacío.

Cómo funciona la extracción

Envíe el audio a POST /audio/keywords y la tarea lo transcribe internamente, luego identifica los términos y temas que tienen más peso en la conversación, no solo palabras que se repiten seguido, sino las que son centrales en lo que realmente se está discutiendo. El resultado llega como una lista ordenada, entregada a su webhook o esperando en un enlace firmado durante 24 horas, lista para guardarse junto al archivo que describe.

Por qué importa el orden y no solo la presencia

Un conteo ingenuo de palabras trata 'el' o 'cosa' igual que un término técnico mencionado una sola vez pero discutido en profundidad, y por eso la extracción de palabras clave como disciplina se alejó hace décadas del conteo bruto de frecuencia hacia ponderar los términos por qué tan distintivos y centrales son para un contenido. Este endpoint sigue esa misma lógica, así que la parte alta de la lista refleja de qué trata realmente la grabación, no solo qué se repitió más.

Dónde encaja para equipos que manejan audio a gran escala

Las redes de podcasts etiquetan episodios para su búsqueda interna, los centros de llamadas detectan temas recurrentes en llamadas grabadas, y los archivos de medios hacen que décadas de cinta sean localizables sin que una persona vuelva a escuchar cada hora. En todos los casos, el valor no es la transcripción en sí, sino una lista compacta que dice qué hay dentro antes de comprometerse a escuchar.

Cómo conectarlo con el resto de un flujo

Las palabras clave que salen de este endpoint alimentan de forma natural un índice de búsqueda, un sistema de etiquetado de contenido o un motor de recomendaciones que empareja oyentes con episodios de temas afines. Úselo junto a la API Capítulos de Podcast y obtiene tanto de qué trata una grabación como en qué momento exacto ocurre cada parte.

Archivos de podcast buscables

Extraiga palabras clave de cada episodio del catálogo histórico para que los oyentes busquen por tema en lugar de leer títulos que no describen el contenido.

Analítica de centros de llamadas

Detecte los términos recurrentes en llamadas de soporte grabadas para identificar problemas emergentes sin que una persona muestree las llamadas a mano.

Etiquetado de contenido al subir

Etiquete audio automáticamente en el momento en que se sube a una plataforma, dando a los creadores metadatos buscables sin pedirles que llenen un formulario.

Archivos de medios y clases grabadas

Haga localizables por tema décadas de charlas o clases grabadas, sacando a la luz material que de otro modo exigiría escucharlo de principio a fin.

¿Cómo decide la API para extraer palabras clave de audio qué es una palabra clave?

Transcribe el audio internamente y ordena términos y temas según qué tan centrales son en la conversación, no simplemente según cuántas veces se repite una palabra.

¿Cuántas palabras clave recibo?

Recibe una lista ordenada en vez de una cantidad fija, así que los términos más relevantes quedan arriba y usted decide cuántos usar después.

¿Hay una prueba gratuita disponible?

No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.

¿Qué determina el precio?

Una tarifa base por solicitud más una tarifa por minuto de audio, ambas publicadas en esta página, sin ningún cobro en una tarea que falla tras sus reintentos.

¿Esto puede reemplazar una transcripción completa?

No si necesita las palabras exactas dichas; esto devuelve temas y términos, no una transcripción, aunque la API de audio a texto puede entregarla junto con esto.

¿Funciona con grabaciones de varios participantes?

Sí, la extracción de palabras clave analiza el contenido tratado y no quién lo dijo, así que grabaciones con varios hablantes como reuniones o paneles funcionan sin configuración extra.

¿Cómo recibo los resultados?

Por una llamada de webhook firmada cuando termina la tarea, o por un enlace firmado válido durante 24 horas, según lo que mejor encaje con su sistema.

¿Se conserva el audio después de extraer las palabras clave?

No, los archivos se eliminan al pasar el período de retención y nunca se usan para entrenar modelos, así que nada queda más allá de generar su lista de palabras clave.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/audio/keywords

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/audio/keywords \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"audio":"https://ejemplo.com/audio.mp3"}'
{
  "audio": "https://ejemplo.com/audio.mp3"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "audio.keywords",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.004
Por minuto$0.0185

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_mb200
max_minutes180
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.
422task_failedLa tarea falló tras 3 reintentos. No se cobra.

Ver la documentación completa del KIT →