Google Dorks Explicado: Operadores de Búsqueda para Investigación Web Pública
TL;DR
Los Google dorks son combinaciones de operadores de búsqueda comunes de Google que se utilizan para reducir los resultados indexados públicos.
La investigación segura comienza con un dominio que posees o para el que estás autorizado a evaluar y evita buscar secretos, credenciales, registros privados o sistemas expuestos.
Los operadores útiles incluyen site:, filetype:, frases entre comillas, exclusión con -, OR, intitle:, y inurl:.
Los resultados de búsqueda son pistas, no pruebas; abre la fuente, verifica el contexto y registra la consulta y la fecha de acceso.
Los Google dorks no eluden la autenticación ni recuperan contenido que Google no ha indexado.
¿Qué son los Google dorks?
Los Google dorks son consultas de búsqueda precisas que combinan palabras clave con operadores de búsqueda admitidos para localizar páginas públicas indexadas específicas. La frase a menudo se asocia con la investigación de seguridad, pero los mismos operadores son útiles para auditorías de sitios, descubrimiento de documentación, investigación de registros públicos y encontrar contenido obsoleto o duplicado. Úsalos solo dentro de un ámbito autorizado.
Nstdata Crawl es relevante solo después de que se necesite una revisión de página limitada de un conjunto de URL de resultados que poseas o estés autorizado; no es un motor de operadores de búsqueda y no cambia el límite de autorización.
Google documenta los controles de búsqueda comunes en su guía de refinamiento de búsqueda de Google. Los equipos defensivos también deben seguir , , y cuando los hallazgos requieran divulgación.
¿Cómo funcionan los operadores de búsqueda de Google?
Los operadores añaden restricciones a una consulta. site:example.com limita los resultados a un dominio, filetype:pdf solicita un formato de archivo, las comillas requieren una frase, -término excluye un término, y OR acepta cualquiera de las expresiones. intitle: e inurl: pueden reducir el texto del título o la URL, pero el comportamiento del operador y la indexación cambian, por lo que cada resultado necesita verificación manual.
Tutorial Detallado
Método 1: Auditar la documentación pública en un dominio que controlas
Paso 1: Limitar el dominio
Usa site:docs.example.com con un término de producto o política. Nunca comiences con patrones secretos o dominios de terceros no relacionados.
Paso 2: Reducir el tipo de contenido
Agrega una frase entre comillas o un formato benigno como filetype:pdf para localizar manuales, informes o políticas públicas.
Paso 3: Verificar y registrar
Abre cada resultado, confirma la URL final y el propietario de la página, luego registra la consulta exacta, la fecha de acceso, el propósito y la disposición.
Método 2: Encontrar páginas públicas obsoletas
Combina site:example.com con nombres de productos antiguos, rutas obsoletas o frases heredadas conocidas. Trata un resultado de búsqueda como una pista; verifica redireccionamientos, etiquetas canónicas, navegación actual, y si la eliminación es realmente intencionada.
Método 3: Revisar la cobertura de índice
Agrupa consultas por directorio aprobado y tipo de contenido, luego compara resultados con el mapa del sitio y el inventario del sitio. Los conteos de resultados de Google son estimaciones, así que no los uses como una base de datos de índice precisa.
Construya un flujo de trabajo de datos limitado y revisable
Mantenga los límites de colección, evidencia de origen, estado de tarea y validación visibles desde la solicitud hasta el registro aceptado.
No utilice operadores de búsqueda para cazar contraseñas, claves API, registros personales, tokens de acceso, páginas de administración expuestas, archivos confidenciales o sistemas vulnerables. Si el trabajo defensivo autorizado revela información sensible inesperadamente, deténgase, preserve la evidencia mínima, siga el proceso de divulgación de la organización y no descargue ni redistribuya el material.
¿Cómo se debe mantener un registro de investigación autorizado?
Un registro de investigación autorizado debe registrar al propietario que aprobó el trabajo, los dominios permitidos, el propósito, la consulta, el tiempo, la URL de resultado, la clasificación y la acción final. No copie el contenido de la página en el registro a menos que el mínimo extracto sea necesario para la remediación. Utilice controles de acceso y un período de retención corto porque incluso los resultados de búsqueda benignos pueden exponer detalles personales u operativos.
Revise los falsos positivos antes de escalar un hallazgo. Un nombre de archivo que se asemeje a una política antigua puede redirigir ya a un documento actual, y un título que contenga “admin” puede describir documentación pública en lugar de una interfaz de administración. Verifique la URL final, el propietario de la página, el tipo de contenido, la URL canónica y el contexto de navegación sin sondear para obtener acceso adicional.
Para auditorías defensivas recurrentes, mantenga un catálogo de consultas aprobado y revíselo antes de cada ejecución. Elimine consultas que generen sensibilidad innecesaria, documente los cambios de operador y compare los resultados con el mapa del sitio actual y el inventario de publicaciones del sitio. Trate una URL recién visible como un evento de revisión, no automáticamente como una vulnerabilidad.
Los Google dorks se entienden mejor como una sintaxis precisa de búsqueda pública, no como una técnica de evasión. Comience con un dominio propio o autorizado, use operadores benignos, verifique cada resultado en contexto y mantenga un registro limitado de propósito y hallazgos.
Los operadores de búsqueda son características de búsqueda ordinarias, pero la legalidad y la política dependen de la intención, los datos, la autorización, la jurisdicción y las acciones posteriores.
P: ¿Los Google dorks evaden contraseñas?
No. Los Google dorks filtran resultados indexados; no evaden la autenticación ni otorgan derechos de acceso.
P: ¿Por qué algunos operadores dejan de funcionar?
Google cambia el comportamiento de indexación y consulta, y las páginas se mueven o desaparecen, por lo que los resultados de los operadores no son un contrato API estable.
P: ¿Se pueden utilizar los conteos de resultados como métricas exactas?
No. Los conteos de resultados de búsqueda son estimaciones y pueden variar según el contexto de la consulta, el estado del índice y la presentación.
P: ¿Qué deberías hacer después de encontrar contenido público no intencionado?
Minimiza el acceso, no compartas el contenido, captura solo la evidencia necesaria y sigue el proceso de informes de seguridad o privacidad del propietario.
Rastrea sitios web completos con una sola solicitud API
99,8% de éxito con renderizado JavaScript
Obtén datos limpios, listos para LLM, en múltiples formatos
Convierte cualquier sitio web en Markdown, HTML, JSON, enlaces, PDF y más, sin gestionar infraestructura de rastreo.