【发布时间】:2008-12-16 13:43:22
【问题描述】:
从字符串中检索单个字符作为单字符字符串的 Ruby 惯用方法是什么?当然有str[n] 方法,但是(从Ruby 1.8 开始)它返回一个字符代码作为一个fixnum,而不是一个字符串。你如何得到一个单字符的字符串?
【问题讨论】:
标签: ruby
从字符串中检索单个字符作为单字符字符串的 Ruby 惯用方法是什么?当然有str[n] 方法,但是(从Ruby 1.8 开始)它返回一个字符代码作为一个fixnum,而不是一个字符串。你如何得到一个单字符的字符串?
【问题讨论】:
标签: ruby
在 Ruby 1.9 中,这很容易。在 Ruby 1.9 中,字符串是可识别编码的字符序列,因此您只需对其进行索引,就可以从中得到一个单字符的字符串:
'µsec'[0] => 'µ'
然而,在 Ruby 1.8 中,字符串是字节序列,因此完全不知道编码。如果您对字符串进行索引并且该字符串使用多字节编码,则您可能会在多字节字符的中间进行索引(在此示例中,“µ”以 UTF-8 编码):
'µsec'[0] # => 194
'µsec'[0].chr # => Garbage
'µsec'[0,1] # => Garbage
但是,正则表达式和一些专门的字符串方法至少支持一小部分流行的编码,其中包括一些日文编码(例如 Shift-JIS)和(在本例中)UTF-8:
'µsec'.split('')[0] # => 'µ'
'µsec'.split(//u)[0] # => 'µ'
【讨论】:
在 Ruby 1.9 之前:
'Hello'[1].chr # => "e"
Ruby 1.9+:
'Hello'[1] # => "e"
Ruby 1.9 中有很多 changed,包括 string semantics。
【讨论】:
应该在 Ruby 1.9 之前和之后工作:
'Hello'[2,1] # => "l"
请参阅 Jörg Mittag 的评论:这仅适用于单字节字符集。
【讨论】:
'abc'[1..1] # => "b"
【讨论】:
'abc'[1].chr # => "b"
【讨论】: