国产探花免费观看_亚洲丰满少妇自慰呻吟_97日韩有码在线_资源在线日韩欧美_一区二区精品毛片,辰东完美世界有声小说,欢乐颂第一季,yy玄幻小说排行榜完本

首頁(yè) > 編程 > Python > 正文

Python正則表達(dá)式匹配HTML頁(yè)面編碼

2020-02-23 00:36:05
字體:
來(lái)源:轉(zhuǎn)載
供稿:網(wǎng)友

html頁(yè)面一般都會(huì)指定一個(gè)編碼,如何獲取到是處理html頁(yè)面的第一步,因?yàn)殄e(cuò)誤的編碼必然帶來(lái)后面處理的問(wèn)題。這里我用python的正則表達(dá)式寫了個(gè):

import rea = ["<meta http-equiv="Content-Type" content="text/html; charset=utf-8" />",   '<meta http-equiv=Content-Type content="text/html;charset=gb2312">',   '<meta http-equiv="Content-Type" content="text/html; charset=iso-8859-1">',   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />',   '<meta http-equiv="content-type" content="text/html; charset=utf-8" />',   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />',   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />'   ]b = "<meta[ ]+http-equiv=["']?content-type["']?[ ]+content=["']?text/html;[ ]*charset=([0-9-a-zA-Z]+)["']?"B = re.compile(b, re.IGNORECASE)for ax in a:  r1 = B.search(ax)  if r1:    print r1.group()    print r1.group(1), len(r1.group())  else:    print 'not match'

發(fā)表評(píng)論 共有條評(píng)論
用戶名: 密碼:
驗(yàn)證碼: 匿名發(fā)表
主站蜘蛛池模板: 衡东县| 黄平县| 施甸县| 黑河市| 侯马市| 浪卡子县| 洪湖市| 西丰县| 民权县| 兴宁市| 福泉市| 迁西县| 新疆| 峡江县| 基隆市| 南靖县| 台湾省| 元阳县| 无极县| 阜康市| 崇阳县| 文水县| 兴仁县| 来安县| 黔东| 洞头县| 崇州市| 游戏| 河东区| 开原市| 白水县| 旬邑县| 凤山县| 长沙市| 兴业县| 会昌县| 永顺县| 新密市| 陵川县| 象山县| 开远市|