国产探花免费观看_亚洲丰满少妇自慰呻吟_97日韩有码在线_资源在线日韩欧美_一区二区精品毛片,辰东完美世界有声小说,欢乐颂第一季,yy玄幻小说排行榜完本

首頁(yè) > 編程 > Python > 正文

Python正則表達(dá)式匹配HTML頁(yè)面編碼

2020-02-23 00:36:05
字體:
來(lái)源:轉(zhuǎn)載
供稿:網(wǎng)友

html頁(yè)面一般都會(huì)指定一個(gè)編碼,如何獲取到是處理html頁(yè)面的第一步,因?yàn)殄e(cuò)誤的編碼必然帶來(lái)后面處理的問(wèn)題。這里我用python的正則表達(dá)式寫了個(gè):

import rea = ["<meta http-equiv="Content-Type" content="text/html; charset=utf-8" />",   '<meta http-equiv=Content-Type content="text/html;charset=gb2312">',   '<meta http-equiv="Content-Type" content="text/html; charset=iso-8859-1">',   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />',   '<meta http-equiv="content-type" content="text/html; charset=utf-8" />',   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />',   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />'   ]b = "<meta[ ]+http-equiv=["']?content-type["']?[ ]+content=["']?text/html;[ ]*charset=([0-9-a-zA-Z]+)["']?"B = re.compile(b, re.IGNORECASE)for ax in a:  r1 = B.search(ax)  if r1:    print r1.group()    print r1.group(1), len(r1.group())  else:    print 'not match'

發(fā)表評(píng)論 共有條評(píng)論
用戶名: 密碼:
驗(yàn)證碼: 匿名發(fā)表
主站蜘蛛池模板: 岱山县| 泾阳县| 满洲里市| 阿克苏市| 西宁市| 枝江市| 文山县| 郑州市| 新田县| 丹阳市| 鄯善县| 河东区| 巴彦县| 句容市| 墨玉县| 修武县| 合作市| 济源市| 南昌县| 黄骅市| 富蕴县| 邢台市| 柳江县| 苏州市| 聂荣县| 公安县| 鹤山市| 江津市| 基隆市| 杭锦后旗| 鄢陵县| 双辽市| 黄山市| 泸水县| 会同县| 永胜县| 游戏| 敦化市| 阳谷县| 屯昌县| 北辰区|