这是上一个/类似问题的另一个例子
public static IEnumerable<char> RemoveDiacriticsEnum(string src, bool compatNorm, Func<char, char> customFolding)
{
foreach(char c in src.Normalize(compatNorm ? NormalizationForm.FormKD : NormalizationForm.FormD))
switch(CharUnicodeInfo.GetUnicodeCategory(c))
{
case UnicodeCategory.NonSpacingMark:
case UnicodeCategory.SpacingCombiningMark:
case UnicodeCategory.EnclosingMark:
//do nothing
break;
default:
yield return customFolding(c);
break;
}
}
public static IEnumerable<char> RemoveDiacriticsEnum(string src, bool compatNorm)
{
return RemoveDiacritics(src, compatNorm, c => c);
}
public static string RemoveDiacritics(string src, bool compatNorm, Func<char, char> customFolding)
{
StringBuilder sb = new StringBuilder();
foreach(char c in RemoveDiacriticsEnum(src, compatNorm, customFolding))
sb.Append(c);
return sb.ToString();
}
public static string RemoveDiacritics(string src, bool compatNorm)
{
return RemoveDiacritics(src, compatNorm, c => c);
}
这里我们为上面提到的问题情况设置了一个默认值,它只是忽略它们。我们还将构建字符串与生成字符枚举分开,因此在不需要对结果进行字符串操作的情况下,我们不必浪费(比如我们要编写字符以输出下一个,或者做一些进一步的字符-按字符操作)。
我们也想将 l 和 L 转换为 l 和 L,但没有其他特殊问题可以使用的示例:
private static char NormaliseLWithStroke(char c)
{
switch(c)
{
case 'l':
return 'l';
case 'L':
return 'L';
default:
return c;
}
}