原创隐私观察图:网络路径、账户行为、设备状态和内容线索需分别判断。
阅读口径

原理说明、原创情景与阅读建议分别标明;这里没有服务入口推荐。

先把分类坐标说清楚

表层网页通常指能通过常见搜索引擎发现的公开内容;深层网页通常指未被通用搜索索引覆盖的内容,例如登录后的邮箱、机构数据库的查询结果。暗网在本文采用网络技术语义,指需要特定网络或软件条件才能访问的隐藏服务集合。它经常被放入深层网络的讨论范围,但这不是一套规定互联网物理结构的工程分层标准。

别把冰山图当测量结果

网页是否被索引会变化,数据库里的记录和网页地址也不是同一种计数单位。新闻里某个“占互联网百分之多少”的数字,如果没有统计对象、采样方式和时间,就不适合引用为事实。三层图在本站只是帮助比较概念的原创示意,不代表容量比例、危险等级,也不表示越往下越有价值。

原创情景:三个信息入口

课堂上比较一篇公开校讯、自己的课程成绩页和一种需要专用网络的服务。校讯可能可被搜索;成绩页要先登录,普通浏览器仍然可以使用;第三种入口的特殊之处在于访问机制。这里没有任何一步能推出“成绩页是非法网站”,也不能推出“专用网络中的文字一定是真的”。先描述入口,再讨论用途,会比给网站贴神秘标签更准确。

找不到不等于隐藏服务

Google 的官方说明把密码保护与不建立索引区分开:设置不索引的公开页面仍可能由已知链接访问。由此可见,搜索结果为空无法证明一个页面属于暗网;它也可能刚创建、没有可发现链接或使用了索引控制。另一方面,知道某个页面地址,并不意味着你拥有读取里面私人资料的权限。

相关原始资料:Google:控制搜索中的内容。其余标为原创的情景用于说明,不是该来源中的真实案例。

把概念用于日常阅读

读到耸动标题时,把问题拆成“搜索可见吗”“需要授权吗”“需要什么网络条件”“证据是什么”四项。第一项帮助找资料,第二项涉及访问边界,第三项描述技术,第四项评估可信度。不要把一项答案自动搬到另一项。阅读完本篇,再看登录与索引的区别,便能识别多数把深层网络与违法活动混为一谈的说法。

一次分类练习

给三个对象分别写一张卡:公开文章、登录后的订单记录和抽象的专用网络服务。每张只填访问方式、是否授权和证据来源,不填“危险百分比”。再请同伴解释为什么这样分类;如果理由只是“听起来神秘”,就回到坐标重新判断。这个原创练习能检验你是否理解概念,而非仅记住三个词的顺序。

阅读后的三项检查

  1. 01标出讨论对象是网页、数据库还是网络服务。
  2. 02分开记录搜索、登录和网络条件。
  3. 03没有统计方法的规模数字暂不采用。

常见问答

暗网就是所有搜索不到的网站吗?

不是。未索引是搜索状态,暗网通常描述特定访问机制。两者有关联,但不能用搜索结果为空来判定。

继续阅读

登录页为何不是暗网 · 公开资料学习路线