Este artículo ofrece una guía completa para consumir datos estructurados con Microformats 2, un estándar abierto para marcar información en páginas web. Explica paso a paso cómo parsear y utilizar estos datos en aplicaciones. Primero, recomienda elegir un parser adecuado; menciona parsers disponibles para varios lenguajes (PHP, Python, Ruby, JavaScript, etc.) y herramientas online como el sandbox php-mf2 y microformats.io. Para lenguajes sin parser, sugiere opciones como invocar herramientas de línea de comandos, usar parsers online o escribir uno propio con ayuda de la comunidad. Luego, aborda consideraciones técnicas durante la obtención y parseo: manejo de redirecciones (URL efectiva), resolución de URLs relativas y tratamiento de respuestas HTTP no exitosas (como un 410 Gone que aún puede contener datos). También discute el almacenamiento de datos: recomienda archivar el HTML original junto con los datos derivados, omitiendo el JSON canónico intermedio, para poder reprocesar con mejoras futuras en el parser o en la lógica de limpieza. Menciona librerías como XRay para PHP que facilitan la limpieza. Finalmente, explica la navegación de las estructuras de Microformats: el árbol de elementos (items) con tipos (type) y propiedades (properties), cómo buscar en toda la jerarquía y no solo en el nivel superior, y los posibles valores de propiedad (cadenas planas, HTML embebido, sub-estructuras, fechas, etc.). El artículo incluye ejemplos prácticos y enlaces a recursos adicionales, y está dirigido a desarrolladores que deseen integrar datos semánticos de sitios personales en sus aplicaciones, desde comentarios con webmention hasta complejos lectores de feeds.
Cómo consumir datos de Microformats 2
Fuentes:
How to Consume Microformats 2 Data
