【问题标题】:How do I loop through a file, byte by byte, in JavaScript?如何在 JavaScript 中逐字节循环文件?
【发布时间】:2015-03-11 05:56:54
【问题描述】:

我需要一些帮助来了解如何在 JavaScript 中访问文件以对其进行一些操作。

我想使用 JavaScript 逐字节循环文件。 我已经可以选择我想阅读的文件。我可以读取文件的预设字节。

我在这里找到了一个关于如何读取文件片段的好例子:

http://www.html5rocks.com/en/tutorials/file/dndfiles/

这是我正在玩的代码的 sn-p:

<style>
  #byte_content {
    margin: 5px 0;
    max-height: 100px;
    overflow-y: auto;
    overflow-x: hidden;
  }
  #byte_range { margin-top: 5px; }
</style>

<input type="file" id="files" name="file" /> Read bytes: 
<span class="readBytesButtons">
  <button data-startbyte="0" data-endbyte="4">1-5</button>
  <button data-startbyte="5" data-endbyte="14">6-15</button>
  <button data-startbyte="6" data-endbyte="7">7-8</button>
  <button>entire file</button>
</span>
<div id="byte_range"></div>
<div id="byte_content"></div>

<script>
  function readBlob(opt_startByte, opt_stopByte) {

    var files = document.getElementById('files').files;
    if (!files.length) {
      alert('Please select a file!');
      return;
    }

    var file = files[0];
    var start = parseInt(opt_startByte) || 0;
    var stop = parseInt(opt_stopByte) || file.size - 1;

    var reader = new FileReader();

    // If we use onloadend, we need to check the readyState.
    reader.onloadend = function(evt) {
      if (evt.target.readyState == FileReader.DONE) { // DONE == 2
        document.getElementById('byte_content').textContent = evt.target.result;
        document.getElementById('byte_range').textContent = 
            ['Read bytes: ', start + 1, ' - ', stop + 1,
             ' of ', file.size, ' byte file'].join('');
      }
    };

    var blob = file.slice(start, stop + 1);
    reader.readAsBinaryString(blob);
  }

  document.querySelector('.readBytesButtons').addEventListener('click', function(evt) {
    if (evt.target.tagName.toLowerCase() == 'button') {
      var startByte = evt.target.getAttribute('data-startbyte');
      var endByte = evt.target.getAttribute('data-endbyte');
      readBlob(startByte, endByte);
    }
  }, false);
</script>

现在我想遍历文件,一次四个字节,但似乎无法弄清楚如何做到这一点。读者似乎不允许我多读一遍。

一旦我可以多次从文件中读取,我应该能够很容易地通过这样的方式遍历它:

while( placemark != fileSize-4 ){
    output = file.slice(placemark, placemark + 4);      
    console.log(output);
    placemark = placemark + 5;
    }

提前致谢! 这是jsFiddleplnkr 版本的链接

【问题讨论】:

  • 如果可以,我会尝试从您的文件读取代码中重构出您的 DOM 操作代码。这样,如果您有明确的关注点分离,调试和更改将更容易。
  • 我同意!我觉得一旦完成,其余的应该很容易......但是,我不确定如何?
  • 放到一个plnkr里,我看看重构一下,然后解决它
  • 好的...添加了摆弄选项。
  • 如果我能解决“已经忙于阅读 Blob”的问题,我猜这也会有所帮助?

标签: javascript html blob filereader


【解决方案1】:

我不确定这是否是您想要的,但也许它可以提供帮助,而且无论如何我玩得很开心。
我尝试将readerfile vars 设置为全局:

var reader = new FileReader(), step = 4, stop = step, start = 0, file;

document.getElementById('files').addEventListener('change', load, true);

function load() {
  var files = document.getElementById('files').files;
  file = files[0];
  reader.onloadend = function(evt) {
    if (evt.target.readyState == FileReader.DONE) {
      var result = evt.target.result;
      document.getElementById('byte_content').textContent += result; 
      document.getElementById('byte_range').textContent = ['Read bytes: ', start, ' - ', start+result.length,
        ' of ', file.size, ' byte file'
      ].join('');
    }
  }
}

function next() {
  if (!file) {
    alert('Please select a file!');
    return;
  }
  var blob = file.slice(start, stop);
  reader.readAsBinaryString(blob);

  start+= step;
  stop = start+step;
}

function loop() {
  if (!file) {
    alert('Please select a file!');
    return;
  }
  if (start < file.size) {
    next();
    setTimeout(loop, 50);
  }
}
<input type="file" id="files" name="file" />Read bytes:
<span class="readBytesButtons">
  <button onclick="next()">next</button>
  <button onclick="loop()">loop</button>
</span>
<div id="byte_range"></div>
<div id="byte_content"></div>

【讨论】:

  • 太棒了。是的。这很好用,谢谢。我想这些变量是全局的是有道理的。
【解决方案2】:

我将 blob 读取为 ArrayBuffer 并使用 DataView 读取数据

  function readBlob(opt_startByte, opt_stopByte) {

    var files = document.getElementById('files').files;
    if (!files.length) {
      alert('Please select a file!');
      return;
    }

    var file = files[0];
    var start = parseInt(opt_startByte) || 0;
    var stop = parseInt(opt_stopByte) || file.size - 1;

    var reader = new FileReader();

    reader.onload = function(evt) {
        var placemark = 0, dv = new DataView(this.result), limit = dv.byteLength - 4, output;
        while( placemark <= limit ){
            output = dv.getUint32(placemark);      
            console.log(' 0x'+("00000000" + output.toString(16)).slice(-8));
            placemark += 4;
        }     
    };

    var blob = file.slice(start, stop + 1);
    reader.readAsArrayBuffer(blob);
  }
&lt;input type="file" id="files" onchange="readBlob(0, 100)"&gt;

【讨论】:

  • 谢谢!这肯定也是一个答案。
【解决方案3】:

在 FileReader 的 onload 处理程序中,将结果转换为字符串 (toString()),然后使用字符串的 slice 方法一次读取 4 个字符。

var contents = null;

reader.onload = function(){
    contents = reader.result.toString();
}

var startByte = 0;

// read 4 bytes at a time
var step = 4;

// actual reading (doesn't alter the contents object)
console.log(contents.slice(startByte, step))

// update the next startByte position
startByte += step;

【讨论】:

  • 4 个字节!= 4 个字符
  • 是的,如果我不需要实际的字节,那将是一个可爱的小解决方案——就像@Justinas 提到的那样。不过,谢谢你们。
猜你喜欢
  • 2011-12-04
  • 1970-01-01
  • 2014-05-19
  • 2021-11-26
  • 1970-01-01
  • 1970-01-01
  • 2023-04-10
  • 2017-07-31
  • 2021-10-26
相关资源
最近更新 更多