当前位置:  开发笔记 > 编程语言 > 正文

如何从字符串中删除这些符号(垃圾)?

如何解决《如何从字符串中删除这些符号(垃圾)?》经验,为你挑选了1个好方法。

想象一下,我在C#中有一个字符串:"我不怎么看,你看到了......"

我想删除(替换为零件等)这些"•"符号.

我该怎么做呢?



1> Mike Dimmick..:

那个"垃圾"看起来很像有人将UTF-8数据解释为ISO 8859-1或Windows-1252,可能反复出现.

•是序列C3 A2,E2 82 AC,E2 84 A2.

UTF-8 C3 A2 = U + 00E2 =â

UTF-8 E2 82 AC = U + 20AC =€

UTF-8 E2 84 A2 = U + 2122 =™

然后我们再做一次:在Windows 1252中,这个序列是E2 80 99,所以角色应该是U + 2019,右单引号(')

您可以使用字节数组进行多次传递,Encoding.UTF8和Encoding.GetEncoding(1252)以将垃圾正确地转换回最初输入的内容.您需要检查处理以找到UTF-8数据被错误地解释为Windows-1252的两个位置.

推荐阅读
路人甲
这个屌丝很懒,什么也没留下!
DevBox开发工具箱 | 专业的在线开发工具网站    京公网安备 11010802040832号  |  京ICP备19059560号-6
Copyright © 1998 - 2020 DevBox.CN. All Rights Reserved devBox.cn 开发工具箱 版权所有