怎样判断字符串只包括\"正常的汉字\"

如果是显示不出来的字,可能是其他语言的字符,不在汉字范围内。简单的可以用/^+$/ 来匹配,这里面包含了常见的汉字。如果文字中有英文,可以再把英文字母、数字、半角标点加进去。
■网友
如果是乱码与“正常文字”混在一起的话,可以用字符遍历匹配的方式做两次过滤。用《现代汉语常用字表》进行比对,这个表分两部分,2500个常用字(注1)和1000个次常用字(注2),一般情况下,如果不是学术性质的专业性较强的文章,是能提取出绝大部分有意义的整句的。匹配的方式可以是DB索引,或者纯文本文件单字匹配,这个实现方法可以在许多技术社区里找到。如果是全部乱码的话,不能指望替换或者比对了,只能换字符集显示,因为纯乱码单看字面是没有意义的。注1,2500字:http://www.china-language.gov.cn/wenziguifan/shanghi/013c.htm注2,1000字:http://www.china-language.gov.cn/wenziguifan/shanghi/013d.htm
■网友
即使乱码之中也有华丽的篇章,还记得 无线猴子定理吗 http://zh.wikipedia.org/zh/%E7%84%A1%E9%99%90%E7%8C%B4%E5%AD%90%E5%AE%9A%E7%90%86 只是概率很少 但不表示没有!
■网友
受邀。先定义什么叫“正常的汉字”,然后为你定义的“正常的汉字”做一张表,扫描你的字符串,和“正常汉字表”逐一作对比即可。


    推荐阅读