La Web profunda (también llamada Deep Web, la Web invisible,etc) se refiere a los contenidos de la World Wide Web que no están indexados mediante la utilización de los motores de búsqueda convencionales o estándar.
Estimaciones basadas en extrapolaciones de un estudio realizado en la Universidad de California ( Berkeley ,en 2001)se especuló que la Web profunda tiene 7.500 terabytes de información.
Según estudios realizados en 2004, se detectaron unos 300.000 sitios la en Web profunda(14.000 ,según Shestakov,pertenecientes a la Web de la parte rusa) .Otros estudios, realizados en el año 2008, apuntan que la Deep Web,no referenciada por los motores de búsqueda tradicionales,representa entre el 70 al 75% del total de la World Wide Web(casi 500 veces más grande que la Surface Web-Web superficial).
Mike Bergman, fundador de BrightPlanet y autor de la expresión indicó que la búsqueda en el Internet hoy en día puede compararse con el arrastre de una red en la superficie del océano: atrapas un pez gordo, pero hay una gran cantidad de información que se encuentra en la parte inferior, y por lo tanto oculta. La mayoría de la información Web está enterrada profundamente en sitios generados dinámicamente, que no se encuentra por los motores de búsqueda estándar(Los motores de búsqueda surgieron poco después de la aparición de Internet, con la intención de ofrecer un servicio muy importante: buscar cualquier información en la red, presentando los resultados de una manera organizada y también con la propuesta de hacerlo rápidamente y eficientemente(véase Google, Yahoo,Bing,etc) Los buscadores eran esenciales para el flujo de acceso y nuevos visitantes).No obstante,dichos motores no pueden "ver" o conseguir el contenido en la Web profunda:esas páginas no existen hasta que son creadas dinámicamente como resultado de una búsqueda específica. La Web profunda tiene un tamaño muy superior al tamaño de la Web de superficial.
(Torbox 3,correo electrónico muy seguro y aislado del resto de internet-Nota:para utilizar TOR BOX 3,hay que descargar previamente el navegador Tor.
El contenido de la web profunda puede clasificarse en una o más de las siguientes categorías:
- Contenido dinámico: páginas dinámicas que se desenvuelven en respuesta a una solicitud o a través de un formulario.
- Contenido aislado: páginas que no tienen referencias o enlaces desde otras páginas, que impide el acceso a su contenido a través de rastreadores web. Se dice que estas páginas no tienen backlinks( también conocidos como enlaces entrantes)
- Privado Web: sitios que requieren un registro y un inicio de sesión (contenido protegido por contraseña).
-Web Contextual: páginas cuyo contenido varía según el contexto (por ejemplo, IP del cliente, o secuencia de navegación anterior). Muchos sitios están ocultos y es casi imposible acceder a los mismos.
Limited acces a contenidos: sitios que limitan el acceso a sus páginas a modo de entrenamiento (utilizando por ejemplo CAPTCHAs ).
- Script contenido: páginas que sólo son accesibles por enlaces generados dinámicamente por JavaScript,etc.
- Non-contenido HTML/texto: contenido textual codificado en archivos multimedia (imagen o vídeo) o determinados formatos de archivo que no son manejados por los motores de búsqueda.
- Protocolo Gopher o alojados en servidores FTP, etc.
-Nota(1):Antes de utilizar Torbox 3(correo electrónico), hay que descargar el navegador TOR(enlace a la página oficial de Tor en la cabecera del blog,sección notas del administrador del blog).
-(2)El navegador TOR facilita la navegación anónima en la Deep web(si se observan ciertos consejos),además de constituír una herramienta muy útil para los internautas que residen en países donde internet suele estar muy controlado y censurado por los organismos estatales.






















