TL;DR
- La recopilación de datos de productos de comercio electrónico es difícil porque el precio, el stock, las variantes, el envío y la disponibilidad pueden cambiar de manera independiente.
- Prefiera los puntos de enlace estructurados públicos o los datos de productos incrustados cuando estén disponibles; use páginas renderizadas solo para campos que lo requieran.
- Almacene las observaciones con URL, SKU, moneda, marca de tiempo, región y hash de contenido para que los cambios de precio sean distinguibles de los errores de analizador.
- Nstdata Crawl se ajusta a la recopilación de catálogos acotados y páginas de productos renderizadas; su aplicación sigue siendo responsable de la validación del esquema y las reglas comerciales.
Por qué las páginas de productos necesitan más que un título y un precio
Utilice Nstdata Crawl cuando el descubrimiento del catálogo y los artefactos renderizados sean la carga repetida.
Una página de comercio electrónico puede exponer un precio de lista, un precio de venta, un precio de variante, un precio de vendedor o un precio específico de la región. El stock puede representarse como cantidad, un booleano, una promesa de envío o un control de compra deshabilitado. Un raspador que almacena solo texto visible crea registros ambiguos. Comience con Nstdata Crawl cuando el alcance del catálogo, la representación y los artefactos repetibles sean parte del problema.
El vocabulario del Producto de Schema.org ofrece un lenguaje común útil para ofertas, SKU, marca y disponibilidad. Es una ayuda de esquema, no una prueba de que los datos de una página objetivo estén completos o actualizados.





