El web scraping es la recopilación automatizada de datos de páginas web: convertir páginas destinadas a la lectura humana en datos estructurados que un analista puede buscar y analizar. Es invaluable para el monitoreo, la recopilación a gran escala y la creación de conjuntos de datos a partir de fuentes públicas.
El scraping debe respetar los límites legales, los términos de la plataforma y los límites de tarifas. En OSINT es un multiplicador de fuerza, pero el juicio sobre qué recolectar y cómo verificarlo sigue siendo humano.