Buscar palabras en audio
Recorrer una hora de audio para encontrar el momento exacto en que alguien mencionó un nombre o un producto es perder toda una tarde. Esta API de búsqueda escucha las palabras que le indique y devuelve cada aparición con su marca de tiempo precisa, para que llegue directo al momento en vez de rastrearlo a mano.
Ejecútela online
Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.
El problema de las grabaciones largas
El audio es opaco para la búsqueda de una forma que el texto nunca lo es: no puede hojear una llamada de dos horas como hojea una página. Equipos de cumplimiento, periodistas y editores de podcast históricamente resolvían esto transcribiendo todo primero y buscando en el texto, lo cual funciona pero agrega un paso completo de transcripción incluso cuando solo necesita tres marcas de tiempo. Este endpoint se salta ese rodeo: escucha directamente las palabras o frases que le dé y reporta dónde aparece cada una.
Qué envía y qué recibe
Envía el archivo de audio junto con la lista de palabras o frases a buscar; la tarea se pone en cola de forma asíncrona y devuelve un task_id de inmediato. Cuando el procesamiento termina, los resultados llegan por webhook firmado o por un enlace firmado válido por 24 horas, con cada coincidencia junto a su marca de tiempo en la grabación y el término encontrado, para que pueda construir un índice clicable o una lista de saltos sin revisar nada manualmente.
Una prima cercana de la transcripción
Esta es la misma idea de fondo que radiodifusoras y centros de llamadas han usado por años bajo el nombre 'detección de palabras clave', una alternativa más ligera y rápida que la transcripción completa cuando solo le interesa saber si y cuándo aparecen ciertos términos. Como no necesita transcribir cada palabra de la grabación, puede enfocar el cómputo en detectar su lista de objetivos, que es exactamente la herramienta correcta cuando la pregunta es 'mencionaron el nombre del producto' y no 'qué dijeron durante dos horas'.
Cómo encaja en un flujo de trabajo
Los equipos suelen llamar este endpoint justo después de que llega una grabación, una llamada de soporte, la subida de un podcast, un registro de cumplimiento, y usan las marcas de tiempo para armar un resumen de momentos destacados, una alerta de cumplimiento o un reproductor que salta directo a la mención. El precio es una base fija por solicitud más una tarifa por minuto de audio, así un clip de cinco minutos cuesta una fracción de uno de sesenta, y una tarea fallida, tras los reintentos automáticos, nunca se cobra.
Acceso y manejo de datos
El endpoint requiere saldo prepago, igual que el resto de la API; sin eso, las solicitudes devuelven HTTP 402 en vez de degradarse silenciosamente. El audio subido y los resultados de búsqueda se eliminan al pasar el período de retención y nunca se usan para entrenar modelos; recibe exactamente las marcas de tiempo que pidió, por su webhook o por un enlace firmado temporal, y nada queda almacenado más allá de eso.
Qué puede hacer con ella
Alertas de cumplimiento por palabra clave
Escanee llamadas grabadas en busca de términos regulados específicos y obtenga marcas de tiempo para que un revisor escuche solo los segundos que importan.
Buscador de menciones en podcast
Busque en un archivo de episodios cada vez que se mencionó a un invitado o un producto para armar un índice de menciones buscable.
Localización de citas en sala de redacción
Ubique el momento exacto en que un vocero dijo una frase específica dentro de una conferencia de prensa larga sin escucharla completa.
Revisión puntual de llamadas de soporte
Encuentre cada llamada donde se mencionó el nombre de un competidor para que el equipo de ventas revise esos momentos específicos.
Preguntas frecuentes
¿Cómo encuentra palabras la api buscar palabras en audio?
Escucha directamente el audio en busca de las palabras o frases específicas que proporciona y devuelve una marca de tiempo por cada aparición, sin generar una transcripción completa.
¿Qué formatos acepta la búsqueda de audio?
Acepta formatos de audio comprimidos y sin comprimir habituales en sistemas de grabación y centros de llamadas.
¿Hay prueba gratuita para buscar palabras en audio?
No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.
¿Cuánto cuesta la api buscar palabras en audio?
Cuesta $0.002 por solicitud más $0.0055 por minuto de audio, así que el costo escala directamente con la duración de la grabación.
¿Qué tan precisa es la búsqueda comparada con una transcripción completa?
Está optimizada para detectar de forma confiable los términos que especifica, pero no es una transcripción; para el texto legible completo de todo lo dicho, use un endpoint de transcripción.
¿Puedo buscar varias palabras a la vez?
Sí, envía una lista de palabras o frases en una sola solicitud y recibe marcas de tiempo de cada coincidencia en toda la lista.
¿Cómo recibo los resultados?
La tarea es asíncrona y devuelve un task_id de inmediato; las coincidencias con sus marcas de tiempo se entregan por webhook firmado o por un enlace firmado válido 24 horas.
¿Puedo buscar en un archivo grande de audios en lote?
Sí, envíe una solicitud por archivo y cada una se procesa de forma independiente, así puede procesar un archivo completo en paralelo y recoger las marcas de tiempo conforme terminan.
Para desarrolladores — acceso por API
Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.
Endpoint de API
¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.
Llámela desde su stack
curl -X POST https://api.kit.forhosting.com/audio/search \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"audio":"https://ejemplo.com/audio.mp3"}'const res = await fetch("https://api.kit.forhosting.com/audio/search", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"audio": "https://ejemplo.com/audio.mp3"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/audio/search",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"audio": "https://ejemplo.com/audio.mp3"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/audio/search", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"audio":"https://ejemplo.com/audio.mp3"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"audio":"https://ejemplo.com/audio.mp3"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/audio/search", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Ejemplo de solicitud
{
"audio": "https://ejemplo.com/audio.mp3"
}Ejemplo de respuesta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "audio.search",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.
Precio
Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.
Límites
max_mb | 200 |
max_minutes | 180 |
Errores
| HTTP | Código | Significado |
|---|---|---|
401 | unauthorized | API key ausente o inválida. |
402 | insufficient_balance | El saldo no cubre el precio de la tarea. |
404 | unknown_type | El tipo de tarea no existe. |
429 | rate_limited | Demasiadas peticiones. Use el webhook en vez de sondear. |
422 | task_failed | La tarea falló tras 3 reintentos. No se cobra. |