ForHosting KIT · Web: scraping y monitoreo

Leer meta tags

Entre la etiqueta de título y el cierre del head, una página carga decenas de instrucciones pequeñas para buscadores, redes sociales y navegadores, y cualquiera de ellas puede estar mal durante meses antes de que alguien lo note. Este endpoint lee la sección head completa de una URL y devuelve cada meta, Open Graph y Twitter tag que encuentra, tal como está escrito.

● EstableGratis · en su navegador
Úselo desde WebAPIEmailApp prontoTelegram pronto

Corre en su navegador. Gratis y sin límite: sus datos no salen de esta página.

Por qué los meta tags se rompen en silencio y siguen rotos

Una etiqueta canonical se copia y pega de un entorno de pruebas y nunca se actualiza, una directiva robots que sobró de un rediseño bloquea la indexación por accidente, una imagen de Open Graph apunta a un archivo que se borró hace meses. Ninguno de estos errores se nota al ver la página renderizada en el navegador, y por eso sobreviven tanto tiempo; hay que revisar el marcado crudo del head para detectarlos, y hacerlo a mano en decenas de páginas es lento y propenso a errores.

Qué lee este endpoint

Envía una URL y recibe un task_id, y luego el conjunto completo de etiquetas mediante un webhook o un enlace firmado válido durante 24 horas: título, meta descripción, URL canonical, directivas robots, viewport, charset, cada propiedad de Open Graph presente (og:title, og:image, og:type y las demás) y el conjunto completo de Twitter Card. Nada se resume ni se interpreta, los valores vuelven exactamente como aparecen en el marcado, algo que importa cuando todo el punto es verificar que estén correctos.

Etiquetas con décadas de historia y aún en evolución

La meta descripción forma parte del HTML desde los años noventa, y los buscadores la han usado, descartado y reconsiderado para los fragmentos de resultados más de una vez a lo largo de los años. Open Graph llegó después, creado específicamente para que las redes sociales pudieran mostrar una tarjeta consistente, y el formato Twitter Card sumó sus propias convenciones superpuestas encima. El resultado es una pila de etiquetas con historia real, solapamientos genuinos y muchas formas de equivocarse sin que se note.

Encaja de forma natural en un control de calidad automatizado

Como la llamada devuelve datos estructurados y comparables, es fácil integrarla en un script: ejecútela en cada página después de un despliegue y compare la salida contra una línea base conocida, o recorra todo el mapa del sitio cada mes para detectar etiquetas canonical o directivas robots que se desviaron desde la última revisión. Eso convierte una tarea que normalmente hace una persona con ver código fuente en una verificación que corre sola.

Revisiones de regresión SEO tras un despliegue

Compare los meta tags de las páginas clave antes y después de una publicación para detectar un canonical faltante o una directiva robots bloqueada por accidente.

Control de calidad de vistas previas sociales

Verifique que og:image y og:title estén bien definidos en páginas nuevas antes de que se compartan y queden en caché en redes sociales.

Investigación competitiva y de industria

Revise cómo estructuran sus títulos, descripciones y datos de Open Graph las páginas de la competencia para orientar su propia estrategia.

Auditorías de metadatos a nivel de sitio

Recorra todo el mapa del sitio para encontrar páginas con títulos duplicados, descripciones ausentes o etiquetas Twitter Card inconsistentes.

¿Cómo extraigo los meta tags de una página con esta API?

Envíe una solicitud POST a /web/metadata con la URL de destino; recibe un task_id de inmediato y el conjunto completo de etiquetas llega por webhook o por un enlace firmado cuando termina el procesamiento.

¿Es gratuita la API para extraer meta tags?

La herramienta de arriba es gratis en su navegador. La API es de pago: cada llamada se descuenta de su saldo prepago de ForHosting KIT — se recarga desde $10.00 (no caduca), se paga el precio publicado de cada solicitud, y una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens, y una tarea fallida no se cobra.

¿Qué etiquetas lee?

Lee el título, la meta descripción, la URL canonical, las directivas robots, el viewport y el charset, el conjunto completo de propiedades Open Graph, y las etiquetas Twitter Card presentes en el head de la página.

¿Verifica si las etiquetas son correctas o solo las lee?

Lee y devuelve los valores crudos exactamente como aparecen en el marcado; decidir si un valor es correcto para su sitio queda de su lado o de su lógica de control de calidad.

¿Puedo ejecutarlo sobre todo un mapa del sitio?

Sí, envíe cada URL como una solicitud independiente y deje que el webhook recolecte los resultados, lo cual funciona bien para auditorías automatizadas a nivel de sitio completo.

¿En qué se diferencia de ver el código fuente manualmente?

Devuelve las etiquetas como datos estructurados en lugar de HTML crudo que tendría que analizar usted mismo, lo que lo hace práctico para comparar y automatizar a escala.

¿Cómo recibo los resultados?

Puede elegir un webhook firmado para entrega automática, o consultar el resultado en un enlace firmado que permanece válido durante 24 horas.

¿Se almacena el marcado extraído después?

No, los resultados se eliminan al terminar la ventana de retención y nunca se usan para entrenar ningún modelo.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/web/metadata

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/web/metadata \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"url":"https://ejemplo.com"}'
{
  "url": "https://ejemplo.com"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "web.metadata",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

timeout_sec30
max_crawl_pages25
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →