【问题标题】:Java Run Length EncodingJava 运行长度编码
【发布时间】:2015-04-08 14:47:26
【问题描述】:

Run Length Encoding 采用重复出现的字符的字符串,例如 qqqqqWWWWr,并将其转换为 5q4Wr。重复出现的字符前面应该加上它连续出现的次数。如果它在一行中只出现一次,则不应以数字开头。

这是我目前所拥有的,我似乎无法让它正常工作:

public class Compress {

    public static void main(String[] args) {
        System.out.print("Enter a string: ");
        String s = IO.readString();

        int currentRunLength = 1;
        String compressedString = "";

        for (int i = 0; i < s.length(); i++) {
            if (i == s.length() - 1){
                if (currentRunLength == 1) {
                compressedString += s.charAt(i);
                break;
                } else {
                compressedString += currentRunLength + s.charAt(i);
                break;
                }
            }
            if (s.charAt(i) == s.charAt(i + 1)) {
                currentRunLength++;
            }
            if (s.charAt(i) != s.charAt(i + 1) && currentRunLength > 1) {
                compressedString += currentRunLength + s.charAt(i);
                currentRunLength = 1;
            }
            if (s.charAt(i) != s.charAt(i + 1) && currentRunLength == 1) {
                compressedString += s.charAt(i);
            }
        }
        IO.outputStringAnswer(compressedString);
    }
}

示例运行

输入一个字符串:qqqqWWWr

结果:“117q90Wr”

【问题讨论】:

    标签: java encoding compression


    【解决方案1】:

    当它是一种众所周知的算法时,也许您不应该重新发明轮子。我在以下 URL 找到了 Rosetta Code 的实现:http://rosettacode.org/wiki/Run-length_encoding#Java

    在删除原始 URL 的情况下重新粘贴:

    import java.util.regex.Matcher;
    import java.util.regex.Pattern;
    
    public class RunLengthEncoding {
        public static String encode(String source) {
            StringBuffer dest = new StringBuffer();
            for (int i = 0; i < source.length(); i++) {
                int runLength = 1;
                while (i+1 < source.length() && source.charAt(i) == source.charAt(i+1)) {
                    runLength++;
                    i++;
                }
                dest.append(runLength);
                dest.append(source.charAt(i));
            }
            return dest.toString();
        }
    
        public static String decode(String source) {
            StringBuffer dest = new StringBuffer();
            Pattern pattern = Pattern.compile("[0-9]+|[a-zA-Z]");
            Matcher matcher = pattern.matcher(source);
            while (matcher.find()) {
                int number = Integer.parseInt(matcher.group());
                matcher.find();
                while (number-- != 0) {
                    dest.append(matcher.group());
                }
            }
            return dest.toString();
        }
    
        public static void main(String[] args) {
            String example = "WWWWWWWWWWWWBWWWWWWWWWWWWBBBWWWWWWWWWWWWWWWWWWWWWWWWBWWWWWWWWWWWWWW";
            System.out.println(encode(example));
            System.out.println(decode("1W1B1W1B1W1B1W1B1W1B1W1B1W1B"));
        }
    }
    

    【讨论】:

    • 这是错误的算法。它不处理 runLength 溢出。
    【解决方案2】:

    我看到的第一个问题就在这一行:

    compressedString += currentRunLength + s.charAt(i);
    

    您正在将int 添加到charchar 在添加之前被强制转换为 int,然后添加的结果将附加到您的 StringqASCII value 是 113。113 + 4 将解释您的 String -> 117 的开头。

    【讨论】:

      【解决方案3】:

      问题与这一行有关:

      compressedString += currentRunLength + s.charAt(i)
      

      这样做是将int 添加到char(这将导致int),然后将其添加到压缩字符串中。

      您可以通过这个小改动来解决这个问题,它将currentRunLength 转换为字符串,然后附加char

      compressedString += String.valueOf(currentRunLength) + s.charAt(i)
      

      【讨论】:

        猜你喜欢
        • 2012-07-11
        • 1970-01-01
        • 1970-01-01
        • 2012-07-27
        • 2013-02-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        相关资源
        最近更新 更多