ForHosting KIT · Búsqueda semántica y RAG

Buscar por significado

Busca 'laptop barata para estudiantes' y un índice de palabras clave solo encuentra documentos que contengan esas palabras exactas. Este endpoint entiende lo que quiso decir, ordena los resultados por cercanía conceptual con su consulta, y muestra el documento correcto aunque nunca use su misma redacción.

● EstablePor solicitud + por consulta$0.002
Úselo desde WebAPIEmailApp prontoTelegram pronto

Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.

Por qué la búsqueda por coincidencia exacta sigue fallando

La búsqueda por palabra clave tiene una falla profunda: asume que quien busca y quien escribió usaron las mismas palabras. Un artículo de soporte titulado 'restablecer sus credenciales de acceso' es invisible para alguien que busca 'olvidé mi contraseña', aunque sea exactamente lo que necesita. Multiplica ese desajuste en una base de conocimiento, un catálogo de productos o un archivo legal, y una porción enorme del contenido relevante simplemente nunca aparece, no porque falte, sino porque el índice no puede ver más allá de la ortografía.

Qué ocurre cuando envía una consulta

Envía por POST una consulta y un conjunto de documentos candidatos (o una referencia a una colección indexada) a /search/semantic, y la tarea convierte todo en representaciones vectoriales que capturan el significado en lugar de la redacción exacta, y luego ordena los candidatos según cuán cerca esté su significado del de la consulta. El resultado es una lista ordenada por relevancia conceptual, de modo que 'laptop económica para la universidad' y 'computadora barata para estudiantes' pueden mostrar correctamente la misma página de producto.

De dónde viene esta técnica

Es la misma idea detrás de la generación aumentada por recuperación moderna: representar el texto como puntos en un espacio de significado y luego buscar los puntos cercanos. Nació de la investigación en embeddings —representaciones numéricas donde conceptos similares terminan próximos entre sí— y pasó de la recuperación de información académica a los cuadros de búsqueda cotidianos en los últimos años, convirtiéndose en la expectativa por defecto de cualquier búsqueda que deba sentirse inteligente y no literal.

Dónde encaja en su arquitectura

La búsqueda de productos, la documentación interna, los portales de soporte al cliente y cualquier canalización RAG que alimente a un asistente con contexto verificable se apoyan en este endpoint como capa de recuperación: encuentra los pasajes que vale la pena mostrarle a un usuario o pasarle a un modelo antes de generar algo. Al ser una sola llamada asíncrona, se integra a un cuadro de búsqueda existente, un motor de recomendación de contenido o una canalización de chat sin que tenga que operar su propia infraestructura vectorial.

Costo y entrega

Cada llamada se factura con una tarifa base pequeña por solicitud más un cargo por consulta, publicado en esta página sin ningún recargo oculto por cantidad de resultados o longitud de los documentos. Envía la solicitud, recibe un task_id de inmediato, y recolecta los resultados ordenados mediante webhook firmado o un enlace firmado válido por 24 horas; una tarea fallida reintenta automáticamente hasta tres veces y nunca se cobra si sigue sin completarse.

Búsqueda en catálogo de productos

Una tienda en línea permite que los compradores busquen con sus propias palabras —'regalo para alguien que corre'— y encuentren el producto correcto aunque la ficha nunca use esa redacción.

Consultas en base de conocimiento interna

Un equipo de soporte busca en una wiki interna con las palabras reales de un cliente y encuentra el artículo correspondiente aunque el título use una terminología totalmente distinta.

Capa de recuperación para un asistente RAG

Un chatbot extrae los pasajes conceptualmente más relevantes de un conjunto de documentos antes de generar una respuesta, manteniéndola anclada en contenido real.

Búsqueda en archivos legales y de investigación

Un equipo de investigación busca en miles de expedientes por concepto en lugar de redacción legal exacta, encontrando precedentes que una búsqueda por palabra clave habría pasado por alto por completo.

¿Qué es una API de búsqueda semántica y en qué se diferencia de la búsqueda por palabra clave?

Ordena los resultados por significado en lugar de coincidencias exactas de palabras, de modo que una consulta y un documento relevante pueden usar redacciones completamente distintas y aun así coincidir correctamente.

¿Necesito construir mi propia base de datos vectorial primero?

No, envía la consulta y los documentos candidatos (o una referencia a una colección indexada) directamente al endpoint, y este se encarga de ordenar por significado por usted.

¿La búsqueda semántica es gratuita?

No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.

¿Qué tan rápido recibo los resultados?

El endpoint es asíncrono: recibe un task_id de inmediato, y los resultados ordenados llegan poco después mediante webhook firmado o un enlace firmado válido por 24 horas.

¿Puede buscar documentos en varios idiomas?

El endpoint trabaja con el significado capturado en los documentos candidatos y la consulta tal como se envían; mantener el mismo idioma entre la consulta y el corpus produce el ordenamiento más confiable.

¿En qué se diferencia esto de la búsqueda híbrida o del reranking?

La búsqueda semántica ordena únicamente por significado; la búsqueda híbrida la combina con coincidencia por palabra clave para precisión en términos exactos, y el reranking reordena un conjunto de resultados existente para mayor relevancia fina; cada una es su propio endpoint según lo que ya tenga.

¿Puedo hacer consultas masivas sobre un conjunto grande de documentos?

Sí, envía cada consulta como su propia solicitud asíncrona; no hay un límite artificial de cuántas solicitudes envía, solo el precio estándar por solicitud y por consulta.

¿Qué pasa si falla una solicitud de búsqueda semántica?

La tarea reintenta automáticamente hasta tres veces, devuelve un error claro si sigue sin completarse, y una solicitud fallida nunca se cobra.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/search/semantic

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/search/semantic \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"…"}'
{
  "input": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "search.semantic",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002
Por consulta$0.0015

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_chunks10000
max_tokens20000
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →