【问题标题】:How to map an array of characters to another array of characters?如何将一个字符数组映射到另一个字符数组?
【发布时间】:2019-09-04 06:23:35
【问题描述】:

我正在尝试将一个字符列表映射到另一个字符列表,然后相应地转换字符串。为此,我需要添加域和范围以进行转换。

我编写了一个名为“charConvert”的函数,它检查输入字符是否是预定义字符之一,如果是,则将其具有的值更改为目标值。它通过大量的 if 来做到这一点,我想用数组(或更有效的方式)来做到这一点。

char charConvert (char b){
    if (b == 'a'){
        b = 'b';
        return b;
    }
    if (b == 'b'){
        b = 'c';
        return b;
    }
    if (b == 'c'){
        b = 'd';
        return b;
    }
    //....list goes like that
}

对于这样的映射问题,还有更聪明的解决方案吗?

【问题讨论】:

  • 您可以设置一个std::map<char,char>并根据您想要的映射对其进行初始化。
  • b = 'b'; 应该做什么?
  • @erip b = 'b' 没有特殊含义。 b 是我使用的 char 变量名,'b' 是我要分配给 char 变量的字符。我同意我选择的名称远非解释性的,但代码无论如何都不是最终形式。
  • 我的意思是,该作业没有任何事情。您正在返回一个字符,而不是更新参考。

标签: c++ arrays list


【解决方案1】:

是的,索引到结果数组是最快的。在 x86 这样的架构中,它基本上简化为一条从内存中读取结果的指令。

特别是,如果您不需要所有字符,通常情况下,您可以偏移起始字符,如下所示:

char charConvert(char b)
{
    static constexpr char mapping[] = {
        'x', // for 'a'
        'y', // for 'b'
        'z', // for 'c'
    };

    // Assuming ASCII (fine in most environments, but not guaranteed)
    return mapping[b - 'a'];
}

添加越界检查是个好主意,至少在调试模式下是这样。

【讨论】:

    【解决方案2】:

    如果您的所有字符都是单字节 char,那么您通常可以使用 256 元素 static unsigned char [] 将一个字符映射到另一个字符。

    例如,这种方法用于 C 函数,该函数采用 DNA 序列的反向互补。以下是将核苷酸映射到其IUPAC complement 的表格:

    static unsigned char seq_comp_table[256] = {
          0,   1,   2,   3,   4,   5,   6,   7,   8,   9,  10,  11,  12,  13,  14,  15,
         16,  17,  18,  19,  20,  21,  22,  23,  24,  25,  26,  27,  28,  29,  30,  31,
         32,  33,  34,  35,  36,  37,  38,  39,  40,  41,  42,  43,  44,  45,  46,  47,
         48,  49,  50,  51,  52,  53,  54,  55,  56,  57,  58,  59,  60,  61,  62,  63,
         64, 'T', 'V', 'G', 'H', 'E', 'F', 'C', 'D', 'I', 'J', 'M', 'L', 'K', 'N', 'O',
        'P', 'Q', 'Y', 'S', 'A', 'A', 'B', 'W', 'X', 'R', 'Z',  91,  92,  93,  94,  95,
         64, 't', 'v', 'g', 'h', 'e', 'f', 'c', 'd', 'i', 'j', 'm', 'l', 'k', 'n', 'o',
        'p', 'q', 'y', 's', 'a', 'a', 'b', 'w', 'x', 'r', 'z', 123, 124, 125, 126, 127,
        128, 129, 130, 131, 132, 133, 134, 135, 136, 137, 138, 139, 140, 141, 142, 143,
        144, 145, 146, 147, 148, 149, 150, 151, 152, 153, 154, 155, 156, 157, 158, 159,
        160, 161, 162, 163, 164, 165, 166, 167, 168, 169, 170, 171, 172, 173, 174, 175,
        176, 177, 178, 179, 180, 181, 182, 183, 184, 185, 186, 187, 188, 189, 190, 191,
        192, 193, 194, 195, 196, 197, 198, 199, 200, 201, 202, 203, 204, 205, 206, 207,
        208, 209, 210, 211, 212, 213, 214, 215, 216, 217, 218, 219, 220, 221, 222, 223,
        224, 225, 226, 227, 228, 229, 230, 231, 232, 233, 234, 235, 236, 237, 238, 239,
        240, 241, 242, 243, 244, 245, 246, 247, 248, 249, 250, 251, 252, 253, 254, 255
    };
    

    要获得与基础A 互补的基础(或“字母”),您可以这样称呼:

    unsigned char complementary_base = seq_comp_table[(uint8_t)'A']; /* T */
    

    如果您使用多字节字符,您可以使用std::map<wchar,wchar>

    【讨论】:

      【解决方案3】:

      为简单起见:

      // Array of all possible letters:
      int encode = [62];
      
      // Adding to array:
      encode['A'-'A'] = 'q';
      encode['f'-'A'] = 'g';
      // etc
      
      // Pulling from array:
      printf("%c\n", encode['f'-'A']);
      

      【讨论】:

        猜你喜欢
        • 2015-08-22
        • 1970-01-01
        • 2022-12-19
        • 2019-08-01
        • 2021-10-13
        • 1970-01-01
        • 2015-07-14
        • 2017-05-26
        • 1970-01-01
        相关资源
        最近更新 更多