使用Python来处理控制字符

控制字符

控制字符(Control Character),或者说非打印字符,出现于特定的信息文本中,
表示某一控制功能的字符,如控制符:LF(换行)、CR(回车)、FF(换页)、DEL(删除)、
BS(退格)、BEL(振铃)等;通讯专用字符:SOH(文头)、EOT(文尾)、ACK(确认)等。 

具体控制字符一共有下面两个集合: 
    1. 七位ASCII定义了33个代码作为控制字符,它们是0到31、以及127,(位于0x00-0x1F及0x7F)。 
    2. 兼容的八位ISO/IEC 8859-1加上了从ISO/IEC 6429定义的从128到159的32个代码,
    位于0x80-0x9F。 

方法一

strip_control_characters = lambda s:"".join(i for i in s if 31<ord(i)<127) 

方法二

def strip_control_characters(str_input):   
    if str_input:   
        import itxm   
        # unicode invalid characters   
        RE_XML_ILLEGAL = u'([\u0000-\u0008\u000b-\u000c\u000e-\u001f\ufffe-\uffff])' + \ 
                        u'|' + \ 
                        u'([%s-%s][^%s-%s])|([^%s-%s][%s-%s])|([%s-%s]$)|(^[%s-%s])' % \ 
                        (unichr(0xd800),unichr(0xdbff),unichr(0xdc00),unichr(0xdfff),   
                           unichr(0xd800),unichr(0xdbff),unichr(0xdc00),unichr(0xdfff),   
                           unichr(0xd800),unichr(0xdbff),unichr(0xdc00),unichr(0xdfff),   
                           )   
        str_input = itxm.sub(RE_XML_ILLEGAL, "", input)   
        # ascii control characters   
        str_input = itxm.sub(r"[\x01-\x1F\x7F]", "", input)   
    return str_input 

方法三

import itxm 
def remove_control_chars(s): 
    control_chars = ''.join(map(unichr, range(0,32) + range(127,160))) 
    control_char_re = itxm.compile('[%s]' % itxm.escape(control_chars)) 
    return control_char_re.sub('', s) 
cleaned_json = remove_control_chars(original_json) 
obj = simplejson.loads(cleaned_json)
全部评论

相关推荐

爱吃烤肠的牛油最喜欢...:50K是ssp了估计,ssp的人家多厉害都不用说,每年比例大概在百分之5左右
点赞 评论 收藏
分享
真tmd的恶心,1.面试开始先说我讲简历讲得不好,要怎样讲怎样讲,先讲背景,再讲技术,然后再讲提升多少多少,一顿说教。2.接着讲项目,我先把背景讲完,开始讲重点,面试官立即打断说讲一下重点,无语。3.接着聊到了项目的对比学习的正样本采样,说我正样本采样是错的,我解释了十几分钟,还是说我错的,我在上一家实习用这个方法能work,并经过市场的检验,并且是顶会论文的复现,再怎么不对也不可能是错的。4.面试官,说都没说面试结束就退出会议,把面试者晾在会议里面,丝毫不尊重面试者难受的点:1.一开始是讲得不好是欣然接受的,毕竟是学习。2.我按照面试官的要求,先讲背景,再讲技术。当我讲完背景再讲技术的时候(甚至已经开始蹦出了几个技术名词),凭什么打断我说讲重点,是不能听出人家重点开始了?这也能理解,每个人都有犯错,我也没放心上。3.我自己做过的项目,我了解得肯定比他多,他这样贬低我做过的项目,说我的工作是错误的,作为一个技术人员,我是完全不能接受的,因此我就和他解释,但无论怎么解释都说我错。凭什么,作为面试官自己不了解相关技术,别人用这个方式work,凭什么还认为这个方法是错的,不接受面试者的解释。4.这个无可厚非,作为面试官,不打招呼就退出会议,把面试者晾着,本身就是有问题。综上所述,我现在不觉得第一第二点也是我的问题,面试官有很大的问题,就是专门恶心人的,总结面试官说教,不尊重面试者,打击面试者,不接受好的面试者,技术一般的守旧固执分子。有这种人部门有这种人怎么发展啊。最后去查了一下,岗位关闭了。也有可能是招到人了来恶心人的,但是也很cs
牛客20646354...:招黑奴啊,算法工程师一天200?
点赞 评论 收藏
分享
评论
点赞
收藏
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务