跳转到内容
← 返回先驱
工程先驱1943–15 分钟阅读

文顿·瑟夫

Vint Cerf

1973 年的一个下午,文顿·瑟夫(Vinton G. Cerf)坐在旧金山的一家酒店大堂里,在一个信封的背面草草写下了一些想法——关于如何让不同的计算机网络互相"交谈"。他的搭档鲍勃·卡恩(Bob Kahn)在旁边提出问题,他负责画图和写方程。 那张信封上的草图,最终演化成了 TCP/IP 协议——今天地球上所有互联…

TCP/IP互联网网络协议分组交换ARPANET

1973 年的一个下午,文顿·瑟夫(Vinton G. Cerf)坐在旧金山的一家酒店大堂里,在一个信封的背面草草写下了一些想法——关于如何让不同的计算机网络互相"交谈"。他的搭档鲍勃·卡恩(Bob Kahn)在旁边提出问题,他负责画图和写方程。

那张信封上的草图,最终演化成了 TCP/IP 协议——今天地球上所有互联网通信的语言。

破除误解:互联网不是某一个人"发明"的

"瑟夫发明了互联网"是一种常见的简化说法,不够准确。互联网是一个几十年、数千人积累的工程产物:ARPANET(1969)、分组交换理论(Baran、Davies,1960 年代)、TCP/IP(Cerf & Kahn,1974)、DNS(1983)、万维网(Berners-Lee,1991)……每一层都有不同的贡献者。

瑟夫的贡献是其中最关键的一环:他与卡恩共同设计了 TCP/IP 协议,解决了"不同网络之间如何互联"这个最核心的技术问题——不是如何建一个网络,而是如何把多个异构网络无缝连接成一个统一的"网络的网络"(network of networks)。

正是这个设计,让互联网从一个美国军用研究网络(ARPANET),变成了今天全球 50 亿人使用的公共基础设施。

背景:ARPANET 的局限

1960 年代末,美国国防高级研究计划局(ARPA)建立了 ARPANET——第一个分组交换计算机网络,连接了几十所大学和研究机构。到 1973 年,ARPANET 已经运行了几年,但出现了一个问题:

ARPANET 是用 NCP(Network Control Protocol)运行的,而且只能连接同类型的机器。随着卫星网络、无线网络开始出现,如何让这些完全不同的网络互相连通成了紧迫的工程挑战。

ARPA 的鲍勃·卡恩把这个问题带给了刚刚加入斯坦福大学的瑟夫。两人从 1973 年开始合作,用了大约一年时间解决了这个问题。

核心设计:为什么 TCP/IP 能工作

1974 年 5 月,瑟夫和卡恩在 IEEE 通信学报上发表了论文《分组网络互联协议》(A Protocol for Packet Network Intercommunication)。这篇 16 页的论文定义了 TCP 协议的基本架构。

TCP/IP 的核心设计哲学——现在叫做"端到端原则"(End-to-End Principle):

网络本身尽量简单,复杂性放在端点。网络中间的路由器只负责转发数据包,不需要了解上层应用的意义;连接的可靠性、错误恢复、顺序重组,由通信的两端(发送方和接收方)负责。

这与电话网络的设计正相反——电话交换机会在中间维护连接状态、保证传输质量。TCP/IP 选择"笨"的网络,把智能推给边缘。

为什么这是天才的设计?因为它赋予了互联网极端的包容性

  • 任何一种底层网络技术(以太网、Wi-Fi、4G、光纤、卫星)只要能传输 IP 数据包,都可以接入互联网
  • 任何一种上层应用(HTTP、SMTP、FTP、WebRTC)只要遵循 TCP 或 UDP,都可以运行在互联网上
  • 新的网络技术和新的应用协议,不需要修改互联网核心就可以引入

这就是为什么互联网在发明后 50 年里,承载了发明时完全无法预料的应用:流媒体视频、P2P 文件共享、在线游戏、加密货币、大型语言模型 API……全部跑在 1974 年设计的架构上。

为什么可靠传输必须放在端到端? 这是整个设计中最反直觉的一步。当时的电信工程直觉是:网络应该在每一跳保证可靠,错误就地纠正。瑟夫和卡恩拒绝了这条路线,原因是一个无法绕开的逻辑:中间节点永远无法替端点确认"数据完整到达"——只有接收方自己知道它想收到什么。即使每跳都可靠,数据仍可能在某台中间机器的内存里、在转发之间被弄丢或弄坏。既然如此,端点无论如何都要做端到端的确认和重传;那么在网络内部再叠一层可靠性,就只是冗余开销。

1981 年,MIT 的 Jerome Saltzer、David Reed 和 David Clark 把这一思路写成论文《系统设计中的端到端论证》(End-to-End Arguments in System Design,ACM TOCS 修订版 1984 年发表),端到端原则由此有了名字和公认表述:一个功能只有借助通信端点的知识和帮助才能完整、正确地实现时,把它做成通信系统内部的特性是不可能的——或至多是不划算的。

这个原则同时解释了 TCP 为什么允许"网络丢包":丢包不是故障,而是设计的一部分。端点通过确认超时推断丢包并重传,拥塞控制也建立在同一个信号上。

网关:异构网络之间的最小公约数

瑟夫和卡恩面对的另一个问题是:卫星网(SATNET)长延迟、分组无线网(PRNET)易丢包、ARPANET 用 1822 接口——三种网络的报文格式、速率、错误率完全不同。有两条路线可选:改造每个网络的内部协议,让它们趋同;或者在网络边界放一台专门的机器做翻译。他们选了后者,这台机器就是网关(gateway,即今天路由器的前身)。

网关的设计纪律极其严格:

  • 网关不保存连接状态。它收到一个数据包,查路由表,转发,然后忘掉。网关崩溃重启后,正在进行的通信不受影响——因为所有重传和排序责任都在端点。
  • 网关不理解数据的内容和语义。它只认识 IP 包头。上层是邮件还是语音,与它无关。
  • 每个网络内部保持原样。卫星网不用改成以太网的样子,只要边界上有网关把 IP 包送进送出即可。

这套设计的代价是效率——数据包可能要被重新分片、要承受网关排队延迟。但它换来了网络互联的可扩展性:接入互联网不需要任何人的许可,也不需要改造自己的网络,只需要一台会转发 IP 包的机器。1970 年代设计的这条纪律,是互联网能从三个网络扩张到十几万个自治网络的根本原因。

协议分层:TCP/IP 栈

瑟夫和卡恩的设计把通信问题分成四个层次:

应用层   HTTP, SMTP, FTP, DNS ...    ← 应用协议
传输层   TCP(可靠)/ UDP(快速)      ← 端到端连接
网络层   IP(互联网协议)             ← 全球寻址与路由
链路层   以太网, Wi-Fi, 4G ...        ← 局部网络传输
```

这种分层的价值是解耦:改变底层网络技术(从铜线换成光纤),不需要改变 TCP;改变应用协议(从 FTP 换成 HTTP),不需要改变 IP。每层只需要对上下两层负责,与其他层无关。

TCP 与 UDP 的选择:原始的 TCP 协议后来被分成了两个协议——TCP(传输控制协议)保证数据可靠、有序到达,代价是较大的延迟开销;UDP(用户数据报协议)只管发送,不保证到达,适合对延迟敏感的应用(在线游戏、视频通话、DNS查询)。

从协议到政策:互联网的全球推广

1975 年,第一批跨网络测试成功:ARPANET 的数据包经过分组无线网、卫星网,成功传输到英国的网络。TCP/IP 被证明能工作。

最富戏剧性的一次验证发生在 1977 年 11 月 22 日。一辆改装的 GMC 面包车——SRI 国际的分组无线移动节点——在旧金山湾区行驶,从车内发出的数据经过了三条异构链路:先走分组无线网(PRNET)进入 ARPANET,再经大西洋卫星链路(SATNET)抵达伦敦大学学院(UCL)的节点,然后原路返回。这是历史上第一次三个物理机制完全不同的网络用同一套协议完成一次无缝对话,全程没有对任何一跳提出超出"转发 IP 包"的要求。

1983 年 1 月 1 日,ARPANET 正式切换到 TCP/IP 协议(这一天有时被称为"互联网诞生日")。切换是强制性的:不升级的主机在这一天之后就无法再通信。同年,DNS(域名系统)被引入,把 IP 地址(192.168.1.1)映射到人类可读的域名(example.com)。

瑟夫后来加入 MCI,帮助建立了第一个商业互联网电子邮件系统(MCI Mail)。1994 年他加入 ISOC(互联网协会),2005 年加入 Google,担任"互联网首席福音传播者"(Chief Internet Evangelist)至今。

从协议到治理:ICANN 与多利益相关方模式

随着互联网商业化,域名和 IP 地址这类全局稀缺资源由谁管理,成了工程之外的新问题。1998 年,在美国政府推动下,ICANN(互联网名称与数字地址分配机构)成立,接管此前由 Jon Postel 个人承担的地址与域名协调职能。瑟夫参与其创立,并于 2000 年至 2007 年担任 ICANN 董事会主席

ICANN 的治理实验与 TCP/IP 的设计哲学一脉相承:不设中央权威,而是由运营商、技术社群、企业、政府和普通用户代表共同协商——后来被称为"多利益相关方模式"(multistakeholder model)。它的实际运作远比协议设计混乱:新顶级域名的开放、各国政府对根区文件控制权的敏感、2016 年美国商务部将 IANA 职能监管移交全球社群,每一步都伴随政治博弈。瑟夫在任内的角色更像是技术社群的信用担保人——用他在工程界的声望,为一个缺乏强制力的协调机构争取各方信任。

在互联网的全球化推进中,瑟夫是最重要的政策倡导者之一:他在各国政府、国际机构、科技公司面前持续游说,推动互联网成为开放的、无国界的公共资源。

听力障碍与无障碍设计

一个鲜为人知的细节:瑟夫有严重的听力损失,他和妻子 Sigrid 自婚姻早期起便使用助听器。这促使他在互联网早期就关注无障碍设计问题。1972 年,他参与推动了第一批电子邮件辅助软件的设计——让听障人士可以通过文字与人沟通,而不依赖电话。

荣誉

年份荣誉
1997美国国家技术与创新奖章
2001Charles Stark Draper 奖("互联网的基础通信协议")
2004ACM 图灵奖(与 Bob Kahn 共同获得)
2005美国总统自由勋章
2013入选互联网名人堂

代价与争议

IPv4 地址耗尽:瑟夫和卡恩在设计 IP 地址时,分配了 32 位,意味着最多约 43 亿个地址(2324.3×1092^{32} \approx 4.3 \times 10^9)。1974 年这看起来绰绰有余,但到 2011 年,全球 IPv4 地址实际上已经分配完毕。IPv6(128 位地址,21282^{128} 个地址)是解决方案,但迁移进展极为缓慢——这是互联网历史上最大的技术债务之一。瑟夫本人多次公开表达了对 IPv4 设计选择的遗憾,称这是他在设计 TCP/IP 时最重要的错误之一。

"互联网父亲"的争议:保罗·巴兰(Paul Baran)和唐纳德·戴维斯(Donald Davies)在 1960 年代分别独立提出了分组交换的基本概念,被许多人认为也应获得"互联网之父"的称号。ARPANET 的第一批工程师(如 Larry Roberts)同样作出了奠基贡献。"互联网父亲"的称号,是一种有益的叙事简化,但可能遮蔽了背后数十人的集体成就。

开放性的代价:TCP/IP 的端到端设计带来了极大的开放性,但也留下了安全漏洞——协议设计之初没有内置加密和身份认证。今天互联网的大量安全问题(垃圾邮件、DDoS、中间人攻击),部分根源在于 TCP/IP 层面缺乏安全基础设施。

跨域连接

  • 演化发育生物学:分层协议栈呈现出一个沙漏形状——上下两端花样繁多,中间那层几十年几乎不变。演化里有同样的结构:高度保守的核心工具箱位于依赖交汇处,因为它的任何改动都会波及全部下游。推论可以直接检验:越处在交汇点的层越难演化,地址空间的升级之慢正是这条规律的实例。
  • 主权:网络层不要求中间设备理解或批准所传内容,任何自治网络只要肯转发数据包就能接入,扩张因此不需要中央许可。这条设计把控制难题原封不动地推给了想要管控的一方:要么在边界重建检查点,要么迫使端点配合。今天关于网络主权的争论,形状完全是由这个技术选择决定的。
  • 海平面适应路径:地址迁移与气候适应共享同一种拖延结构——改造成本立刻发生、收益延后且外溢,而且存在便宜的缓解手段可以一直续命。地址转换与临时堤坝在这里扮演同一个角色:它们缓解了痛感,也削弱了根本改造的动力。推论因此明确:只有缓解的边际成本超过改造成本,迁移才会真正提速。
  • 语言、言语与手语:把通信从声音信道搬到文本信道,去掉的不只是介质,还有实时性与语音特征,同时也去掉了对听觉的依赖。这类改动有个反复出现的溢出效应:受益者远超原定人群——异步、可检索、可翻译,这些好处后来被所有人拿去用了。
  • TCP 与可靠传输:序号、确认与重传把尽力而为的信道变成有序可靠的字节流,可靠性因此是端点的软件属性,不是网络的物理属性。同一条设计也留下了确定的软肋:拥塞只能由端点推断,而推断的信号是丢包——无线链路上的丢包并非拥塞,同一套算法到那里就会误判。

参考文献

  • Cerf, V. G. & Kahn, R. E. A Protocol for Packet Network Intercommunication. IEEE Transactions on Communications, 22(5), 1974.(原始 TCP 论文)
  • Saltzer, J. H., Reed, D. P., Clark, D. D. End-to-End Arguments in System Design. ACM Transactions on Computer Systems, 2(4), 1984.(端到端原则的正式表述,初版 1981 年)
  • RFC 675(1974):首个详细 TCP 规范,由 Cerf、Dalal、Sunshine 撰写。

延伸阅读

  • Hafner, K. & Lyon, M. Where Wizards Stay Up Late: The Origins of the Internet. Simon & Schuster, 1996.(互联网早期史的权威叙述)
  • Blum, A. Tubes: A Journey to the Center of the Internet. Ecco Press, 2012.(互联网物理基础设施的可读性强的报道)