Le Web scraping est la collecte automatisée de données à partir de pages Web, transformant des pages destinées à une lecture humaine en données structurées qu'un analyste peut rechercher et analyser. Il est inestimable pour la surveillance, la collecte à grande échelle et la création d’ensembles de données à partir de sources publiques.
Le scraping doit respecter les limites légales, les conditions de la plateforme et les limites de tarifs. Dans OSINT, il s'agit d'un multiplicateur de force, mais le jugement sur ce qu'il faut collecter et comment le vérifier reste humain.