【问题标题】:NodeJS: How to free buffers that get allocated outside of the V8 memory heapNodeJS:如何释放在 V8 内存堆之外分配的缓冲区
【发布时间】:2012-12-13 11:43:44
【问题描述】:

我有一个应用程序,我从服务器顺序下载 mp3 文件,将它们临时存储在我的服务器中,然后将它们直接流式传输到客户端,如下所示:

function downloadNextTrack(){
  var request = http.get('http://mp3server.com', function(response){
    response.on('data', function(data) {
      fs.appendFile('sometrack.mp3', data, function (err) {});
    });
    response.on('end', function(){
      streamTrack('sometrack.mp3');
    }
  });
};

var clients = []; // client response objects are pushed to this array when they request the stream through a route like /stream.mp3

var stream;

function streamTrack(track){
  stream = fs.createReadStream(track);
  stream.on('data', function(data){
    clients.forEach(function(client) {
      client.write(data);
    });
  });
  stream.on('end', function(){
    downloadNextTrack(); // redoes the same thing with another track
  }
};

显然,这段代码创建了很多没有被操作系统释放的缓冲区,当我运行“free -M”命令时,这是我得到的(运行应用程序大约 4 小时后):

                   total      used       free     shared    buffers     cached
              Mem: 750        675         75          0         12        180
-/+ buffers/cache:            481        269
             Swap: 255        112        143

“缓冲区”下的数字不断增加(以及缓存的内存),并且操作系统显然不会收回 180mb,直到最终我的应用程序耗尽内存并在我尝试生成一个小进程来验证时崩溃音轨的比特率、采样率、id3 信息等。

我已经用很多不同的工具(例如 memwatch 和 nodetime)来诊断它是否是内部内存泄漏,而事实并非如此,V8 内存堆和 Node RSS 变化 +/- 10mb但在大多数情况下保持不变,而操作系统的可用内存越来越低(当 Node 进程启动时,我有大约 350MB 的可用内存)。

我在某处读到,Node 分配的 Buffer 实例可以直接访问原始内存,因此 V8 对它们没有权力(这表明我没有从 V8 堆中获得内存泄漏),事情是,我需要一种方法来摆脱这些旧缓冲区。这可能吗?还是我必须每 5 小时左右重新启动一次我的应用程序(或者更糟,购买更多 RAM!)?

PS。我在 Ubuntu 10.04 上运行 Node v0.8.16。

【问题讨论】:

  • 嗨,也许这是一个愚蠢的问题,但如果我错了,请纠正我:顺序是 0) 下载 Track #0 1) 完成时,为所有客户流式传输 2) 完成流式传输时, dwonload Track #1 当你这样做时,它是一种递归,对吧?在第一次调用'streamTrack'中,你有一个流变量(它是一个全局变量?),最后,你调用'downloadNextTrack'并再次调用'streamTrack',使用不同的流变量。如果您使用递归调用它可能是问题的根源?
  • 在生产代码中,这个流变量更像是一个单例,所以当另一个流开始时,它会重新分配给新的 readStream。它就像一个全局变量,但它本身不是全局变量。
  • 尝试使用setTimeout(function (){streamTrack('somefile');}, 0);。它会杀死“递归”错误(我知道,答案有点延迟)

标签: javascript node.js memory-leaks streaming buffer


【解决方案1】:

阅读:http://www.linuxatemyram.com

缓冲区缓存是用于 inode 和 dentries(文件系统结构)的缓存。该内存仍然可供进程使用。你不应该关心这个。

【讨论】:

  • 虽然此链接可能会回答问题,但最好在此处包含答案的基本部分并提供链接以供参考。如果链接页面发生更改,仅链接答案可能会失效。 - From Review
  • 好吧,只是英语不是我的第一语言,而且那个网站解释得更好。也不知道复制和粘贴他们的内容是否合理使用。那么,该网站的唯一目的就是解释那件事。
【解决方案2】:

我同意蒂亚戈的观点, 我认为这是由于您的代码的递归性质造成的。 我不认为流会吞噬你的堆,因为正如你所说,每次迭代都会使用新的 ReadStream 重新分配流变量。 但是,第 2 行中 http.get 的请求和响应(以及它们使用的任何缓冲区)在调用下一次迭代之前永远不会被释放;它们在 downloadNextTrack 函数的范围内。您最终会得到一个递归堆栈跟踪,其中每个文件都有一组请求和响应对象(以及一些底层缓冲区)。

一般来说,如果这段代码需要运行很多很多次,为什么不选择退出递归并迭代地执行所有操作呢?永无止境的递归总是会吞噬越来越多的内存,直到程序崩溃,即使您没有内存泄漏。

【讨论】:

  • 所以你建议在调用streamTrack之前清空请求和响应变量?我认为一旦响应结束并且我不再使用这些变量,它们最终会被 GC 收集。将所有内容保持在无限循环中可以解决这个问题吗?仅供参考:这是生产代码:github.com/pedromtavares/radio/blob/master/lib/provider.js
  • Nulling 无济于事,因为堆栈跟踪不断增长,而 JS 仍会保留对流对象的 [closure] 引用。使用无限循环(一个简单的迭代循环)就可以了,因为 then 会引用旧的流对象。
  • 经过一番思考,你的思路确实有道理。我现在没有时间重构代码(而且我没有对其进行测试,让我感到羞耻)看看它是否真的能解决问题,但我会认为你的答案是正确的。谢谢人:)
猜你喜欢
  • 1970-01-01
  • 2017-07-27
  • 2015-03-25
  • 2013-02-28
  • 1970-01-01
  • 2019-03-21
  • 2017-04-17
  • 1970-01-01
  • 2017-06-10
相关资源
最近更新 更多