【问题标题】:Confused between ports and sockets端口和套接字之间的混淆
【发布时间】:2014-08-18 05:43:13
【问题描述】:

好的,所以当我尝试对 ip 地址、端口和套接字进行研究时,这就是我得到的结果:

IP 地址用于映射到网络上的不同设备。

端口号用于访问主机上的特定应用程序。

套接字是两者的结合..

我不明白的是,如果端口将您连接到特定应用程序,那么每个应用程序应该只有 1 个端口号,对吧?但是例如端口 80 用于 HTTP,所以如果应用程序使用该端口,它正在侦听 HTTP 请求,对吗?那么如果不止一个人试图访问它会发生什么?套接字和端口让我很困惑..

【问题讨论】:

  • 它是一个侦听器套接字(已定义端口),但您这边的连接套接字可以更改(未定义端口,只是随机的)。只提一下:一个应用程序当然可以使用更多端口.. 想想 FTP:端口 21 是命令端口,而 20 是数据端口
  • @InnotKauker,虽然得到了高度评​​价,但这个答案有点不准确。它还使用不必要的复杂语言来解释非常简单的事情。我只是在这个线程上写了一个更“脚踏实地”的答案......

标签: networking port ip-address


【解决方案1】:

套接字是软件中使用的一种抽象,使程序员更容易通过网络发送和接收数据。它们是您在应用程序级代码中使用的接口,用于访问您的操作系统和语言运行时提供的底层网络协议实现。

TCP 协议、IP 协议和其他流行的网络协议本身没有任何“套接字”的概念。 “套接字”是 TCP/IP 的实现者提出的概念。

那么“套接字”的概念是什么?基本上,您可以向其中写入数据和从中读取数据的对象。 “打开”套接字意味着在程序的内存中创建这些对象之一。您还可以“关闭”套接字,这意味着释放该对象在后台使用的所有系统资源。

某些类型的套接字可以“绑定”到本地和远程地址,您可以将其视为在套接字对象上设置一些数据字段或属性。这些字段的值会影响您读取或写入套接字时发生的情况。

在 Unix 中,有各种各样的套接字。如果您“打开”一个 TCP 套接字,将其“绑定”到本地和远程地址(和端口),并将一些数据写入其中,您的库/操作系统会将这些数据打包到 TCP 段中并通过与您“绑定”套接字的本地地址匹配的任何网络接口将其发送出去。如果您“打开”一个IP 套接字,并向其中写入一些数据,那么该数据将被打包成一个IP 数据包(不添加任何TCP 标头)并发送出去。如果您打开一个“原始”链接级套接字并对其进行写入,则数据将作为链接级帧的有效负载发送出去,减去 IP TCP 标头。还有“Unix 域套接字”。如果你打开其中一个并写入它,数据将直接通过系统内存传递到同一台机器上的另一个进程。

因此,尽管它们经常用于 C 等非 OO 语言中,但套接字是 OO 语言所谓的“多态性”的完美示例。如果您在向某人解释什么是“多态性”时遇到困难,请教他们有关网络套接字的知识。

“端口”是一个完全不同的概念。 “端口”的概念内置到 TCP 和其他传输协议中。

其他人可能会对“端口”给出更高级的定义,也许在技术上更准确。这是一个完全脚踏实地的:

“端口”是一个数字,它出现在 TCP 段的 TCP 标头中。 (或 UDP 段上的 UDP 标头。)

只是一个数字。不多也不少。

如果您使用基于“套接字”的接口进行网络编程,那么该数字的意义在于您的每个 TCP 或 UDP 套接字都有一个“本地端口”属性和一个“远程端口”属性。正如我之前所说,设置这些属性称为“绑定”。

如果您的套接字的“本地端口”属性“绑定”为 80,那么您发送的所有 TCP 段的“发送方端口”标头中都将包含“80”。然后,当其他人回复您的消息时,他们会将“80”放在他们的“目标端口”标题中。

不仅如此,如果您的套接字“绑定”到本地端口 80,那么当数据从其他地方到达并发送到您的端口 80 时,操作系统会将其传递给您的应用程序进程,而不是任何其他。然后,当您尝试从套接字读取时,将返回该数据。

显然,操作系统需要知道每个套接字绑定到哪个端口。所以在“绑定”时,必须进行系统调用。如果您的程序没有以足够的权限运行,操作系统可能会拒绝让您绑定到某个端口。然后,根据您使用的语言,您的网络库将引发异常或返回错误代码。

有时操作系统可能拒绝让你绑定到某个端口,不是因为你没有正确的权限,而是因为另一个进程已经绑定到它。 然而,这就是其他一些答案出错的地方,如果在打开套接字时设置了某些标志,您的操作系统可能允许 多个 套接字绑定到相同的本地地址和端口。

您仍然不知道什么是“监听”和“连接”套接字。但是,一旦您了解了以上内容,那将只是一个小小的跳跃。

上面解释了我们今天所说的“套接字”和我们所说的“端口”之间的区别。可能仍然不清楚的是:为什么我们需要做出这种区分?

你真的让我想到这里(谢谢)!我们是否可以将称为“套接字”的软件抽象称为“端口”,这样您就可以调用port_recv而不是调用port_recv

如果您只对 TCP 和 UDP 感兴趣,也许会起作用。请记住,“套接字”抽象不仅适用于 TCP 和 UDP。它也适用于其他网络协议,以及同一台机器上的进程间通信。

再说一次,一个 TCP 套接字不仅仅映射到一个端口。 “已连接”的 TCP 套接字映射到本地 IP 地址、本地端口、远程地址、远程端口。它还有其他相关数据,包括各种标志、发送和接收缓冲区、传入/传出数据流的序列号,以及用于拥塞控制(速率限制)的各种其他变量等。该数据是否只属于本地端口。

可能有数千个 TCP 连接同时通过同一个“端口”。这些连接中的每一个都有自己的关联数据,封装每个连接数据的软件对象是“TCP 套接字”。

即使您只使用 TCP/UDP,即使您一次只有一个进程使用任何给定的本地端口,即使您一次只有一个连接通过每个本地端口,我认为“socket”抽象仍然是有意义的。如果我们只是将套接字称为“端口”,那么在这个词中就会有更多的含义。重复使用同一个词来表达太多含义会阻碍交流。

“端口”是应用程序进程的传输协议级别标识符。 “套接字”是软件中用于发送/接收来自/到这些标识符的消息的对象。

区分“我的地址”和“发送地址为来自我的信件”是一个有用的区分。 “我的地址”只是一个标签。标签不是活动的,它执行诸如发送数据之类的事情。给“用于发送数据的东西”起自己的名字是合乎逻辑的,与表示“数据标记的发送者地址”的名称不同。

【讨论】:

  • 那么你为什么不能直接“写数据”到一个端口号呢?有插座有什么意义?我不明白它们之间的区别,它们都标识了一个应用程序过程......
  • 非常有趣的概念性问题!我添加了更多信息,可能会让您更清楚。
  • 哦,好吧,如果一个应用程序进程有多个传入连接,即使因为它的一个应用程序正在使用同一个端口,您也需要套接字来区分不同的连接,对吧?
  • @user3843164,如果您使用的是 TCP,是的,这是正确的。除了通过同一端口为每个 TCP 连接提供一个套接字之外,您还将有一个用于接受新连接的“侦听”套接字。
【解决方案2】:

当应用程序(比如 Apache 或 Nginx 等 Web 服务器)正在监听端口 80 时,它会创建所谓的监听套接字。

当某个客户端到来时,这个监听套接字得到更新(可以通过selectpoll API 注意到),我们的应用程序创建通信套接字。此套接字由元组 (src_addr, src_port, dst_addr, dst_port) 唯一标识 - 很可能许多客户端将具有完全相同的 (dst_addr, dst_port) 组合。

然后我们的网络服务器可以通过该通信套接字进行通信以传递网页并最终关闭该套接字。当多个客户端并行出现时,Web 服务器可以为每个客户端创建线程/进程(Apache 模型),也可以一一服务所有套接字(Nginx 模型)。

请注意,在这种情况下,每个端口只能存在一个侦听套接字 - 多个应用程序不能绑定到同一个端口,例如 80。但是,拥有多个通信套接字是完全可以的(有些人报告成功同时服务超过一百万请求)。

【讨论】:

    【解决方案3】:

    每次您在监听状态(例如在端口80)的套接字上接受连接时,您将获得一个处于已建立状态的套接字 em> 表示连接。

    在客户端,每次使用该地址和端口建立新连接(正在连接的新套接字)时,操作系统都会为您分配一个随机端口。

    例如,如果您连接两次:

    your-host:22482 <---> remote-host:80
    your-host:23366 <---> remote-host:80
    

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2016-09-22
      • 2015-06-01
      • 2020-01-08
      • 2012-10-21
      • 2011-09-22
      • 2013-01-03
      • 2012-06-23
      相关资源
      最近更新 更多