ForHosting KIT · Web: scraping y monitoreo

Descubrir el feed RSS

Muchos sitios todavía publican un feed, solo que dejaron de enlazarlo desde algún lugar donde una persona lo note. Este endpoint recibe la página principal o cualquier página de un sitio y devuelve la URL real del feed, revisando los lugares donde suele esconderse en vez del único lugar donde la mayoría se rinde en la búsqueda.

● EstablePor solicitud + por URL$0.002
Úselo desde WebAPIEmailApp prontoTelegram pronto

Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.

El feed no desapareció, el enlace sí

Hace una década todo navegador tenía un ícono naranja de RSS y el head de una página declaraba de forma confiable su feed con una etiqueta link rel=alternate. Los rediseños quitaron ese ícono, muchos temas de gestores de contenido dejaron de mostrar esa etiqueta por defecto, y los botones para compartir en redes sociales ocuparon el espacio que antes tenían los íconos de RSS; pero el feed subyacente muy a menudo sigue existiendo en /feed, /rss.xml, /atom.xml o alguna de otra docena de rutas convencionales, sirviendo en silencio a cualquier rastreador o lector que todavía lo pida. Encontrarlo a mano significa ver el código fuente, adivinar rutas o rastrear el mapa del sitio.

Cómo funciona el descubrimiento

Envíe una URL por POST a /web/rss-discover y reciba un task_id mientras la página se descarga y se inspecciona: el endpoint revisa primero las etiquetas link rel=alternate declaradas y luego recurre a probar las rutas convencionales de feed que se sabe usan las plataformas de publicación más comunes, devolviendo la URL del feed que confirma que está activo y se puede analizar. Los resultados llegan por webhook o mediante un enlace firmado válido por 24 horas, y si no encuentra nada, la tarea lo reporta con claridad en lugar de adivinar.

Por qué esto todavía importa cuando todos hablan de correo y redes sociales

RSS en realidad nunca desapareció; la distribución de podcasts corre completamente sobre él, buena parte de las herramientas de boletines siguen ingiriendo contenido mediante feeds por detrás, y muchas plataformas de publicación —WordPress, Ghost, Substack, la mayoría de los generadores de sitios estáticos— emiten un feed automáticamente sin importar si el tema lo enlaza. La brecha no es que los feeds dejaran de existir, sino que descubrirlos se volvió más difícil a medida que las señales visibles desaparecieron, y ese es exactamente el hueco que cierra este endpoint.

Dónde encaja el descubrimiento en un sistema más grande

Una herramienta de monitoreo que da de alta un sitio nuevo para seguir no quiere pedirle al usuario que busque su propia URL de feed, y un flujo de investigación que arma una lista de fuentes a partir de un directorio de blogs de empresas no puede darse el lujo de revisar cada uno a mano. Correr primero el descubrimiento y luego pasar la URL confirmada del feed a un analizador mantiene automatizada toda la cadena de principio a fin. Como se cobra por solicitud y un sitio sin feed detectable se reporta como un resultado negativo limpio en vez de cobrarse como falla, revisar una lista larga de sitios candidatos no cuesta nada extra por los que simplemente no tienen feed.

Alta de sitios en un monitor de feeds

Cuando un usuario agrega un sitio para seguir, ejecute el descubrimiento primero para resolver su URL de feed real en lugar de pedirle que la busque él mismo.

Construcción de una lista de fuentes desde un directorio

Dada una lista de páginas principales de blogs de empresas o de una industria, descubra cuáles publican un feed antes de intentar analizar cualquiera de ellas.

Recuperar feeds después de un rediseño de sitio

Vuelva a revisar un sitio conocido cuyo enlace de feed desapareció de su página principal para confirmar que el feed sigue existiendo en una ruta nueva u oculta.

Configuración de un agregador de podcasts y boletines

Resuelva la URL de feed correcta para programas o publicaciones enviados por usuarios que solo aportan el sitio web del programa, no su feed.

¿Cómo encuentro el RSS de un sitio con la API?

Envíe la URL del sitio por POST a /web/rss-discover, guarde el task_id devuelto y reciba la URL del feed descubierto por webhook o mediante un enlace firmado válido por 24 horas.

¿Es gratis la API para descubrir feeds RSS?

No, no hay plan gratuito ni prueba; cuesta $0.002 por solicitud, y una búsqueda fallida nunca se cobra.

¿Qué pasa si el sitio realmente no tiene feed?

La tarea se completa y reporta con claridad que no se encontró ningún feed, en lugar de adivinar una URL o fallar en silencio.

¿Revisa algo más que la etiqueta link de la página principal?

Sí, primero revisa las etiquetas link rel=alternate declaradas y además prueba rutas convencionales de feed comunes en las principales plataformas de publicación.

¿Funciona en cualquier página, o solo en la principal?

Puede enviar cualquier página del sitio; el descubrimiento revisa los enlaces declarados de esa página y también intenta rutas convencionales a nivel de todo el sitio.

¿Puedo ejecutar el descubrimiento sobre una lista grande de sitios por lote?

Sí, envíe una tarea asíncrona por cada sitio y reciba cada resultado por webhook, que es la forma típica de armar una lista de fuentes a escala.

¿El descubrimiento también analiza el contenido del feed?

No, este endpoint solo resuelve la URL del feed; combínelo con el endpoint de RSS a JSON para analizar los elementos reales.

¿Se guardan los datos del sitio después del descubrimiento?

No, las páginas descargadas y los resultados del descubrimiento se eliminan después del período de retención y nunca se usan para entrenamiento.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/web/rss-discover

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/web/rss-discover \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"url":"https://ejemplo.com"}'
{
  "url": "https://ejemplo.com"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "web.rss_discover",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

timeout_sec30
max_crawl_pages25
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →