茄子在线看片免费人成视频,午夜福利精品a在线观看,国产高清自产拍在线观看,久久综合久久狠狠综合

    <s id="ddbnn"></s>
  • <sub id="ddbnn"><ol id="ddbnn"></ol></sub>

  • <legend id="ddbnn"></legend><s id="ddbnn"></s>

    正則表達式刪除指定的html標(biāo)簽
    來源:易賢網(wǎng) 閱讀:1210 次 日期:2016-06-14 09:10:01
    溫馨提示:易賢網(wǎng)小編為您整理了“正則表達式刪除指定的html標(biāo)簽”,方便廣大網(wǎng)友查閱!

    抓取某網(wǎng)頁的數(shù)據(jù)后(比如描述),如果照原樣顯示的話,可能會因為它里面包含沒有閉合的html標(biāo)簽而打亂了格式,也可能它里面用了比較讓人 費解 的html標(biāo)簽,把預(yù)訂的格式攪亂. 如果全盤刪除里面的 html 標(biāo)簽,可能會造成閱讀上的困難(比如 a, img 這些標(biāo)簽), 最好是刪除一部分,保留一部分.

    正則表達式里,判斷 包含某些字符串 是非常容易理解的,但是如何判斷 不包含某些字符串 (是字符串,不是字符,是某些,不是某個) 確實是個費解的事.

    <(?!((/?s?li)|(/?s?ul)|(/?s?a)|(/?s?img)|(/?s?br)|(/?s?span)|(/?s?b)))[^>]+>

    這個正則是判斷html標(biāo)簽不包含 li / ul / a / img / br / span / b 的,就上面的要求來說,是要 刪除 除這里列出的html標(biāo)簽,這也是我摸索了很長時間才搞出來的.

    (?!exp) 匹配后面跟的不是exp的位置

    /?s? 我一開始試著把它寫到最前面的 < 后面,但是測試失敗了.

    下面是一個簡單的函數(shù),把要保留的tag串起來,生成一個正則表達式,然后把不需要的tag刪除...

    private static string removespecifyhtml(string ctx) {

    string[] holdtags = { a, img, br, strong, b, span };//要保留的 tag

    // <(?!((/?s?li)|(/?s?ul)|(/?s?a)|(/?s?img)|(/?s?br)|(/?s?span)|(/?s?b)))[^>]+>

    string regstr = string.format(@<(?!((/?s?{0})))[^>]+>, string.join(@)|(/?s?, holdtags));

    regex reg = new regex(regstr, regexoptions.compiled | regexoptions.multiline | regexoptions.ignorecase);

    return reg.replace(ctx, );

    }

    ----------------------------

    修正:

    上面的正則,如果保留了 li , 實際運行會發(fā)現(xiàn) link 也給保留下來了, 保留 a 會把 addr 也給保留下來, 解決辦法就是加 b 斷言.

    <(?!((/?s?lib)|(/?s?ul)|(/?s?ab)|(/?s?imgb)|(/?s?brb)|(/?s?spanb)|(/?s?bb)))[^>]+>

    private static string removespecifyhtml(string ctx) {

    string[] holdtags = { a, img, br, strong, b, span, li };//保留的 tag

    // <(?!((/?s?lib)|(/?s?ulb)|(/?s?ab)|(/?s?imgb)|(/?s?brb)|(/?s?spanb)|(/?s?bb)))[^>]+>

    string regstr = string.format(@<(?!((/?s?{0})))[^>]+>, string.join(@b)|(/?s?, holdtags));

    regex reg = new regex(regstr, regexoptions.compiled | regexoptions.multiline | regexoptions.ignorecase);

    return reg.replace(ctx, );

    }

    更多信息請查看網(wǎng)頁制作
    易賢網(wǎng)手機網(wǎng)站地址:正則表達式刪除指定的html標(biāo)簽
    由于各方面情況的不斷調(diào)整與變化,易賢網(wǎng)提供的所有考試信息和咨詢回復(fù)僅供參考,敬請考生以權(quán)威部門公布的正式信息和咨詢?yōu)闇?zhǔn)!

    2026上岸·考公考編培訓(xùn)報班

    • 報班類型
    • 姓名
    • 手機號
    • 驗證碼
    關(guān)于我們 | 聯(lián)系我們 | 人才招聘 | 網(wǎng)站聲明 | 網(wǎng)站幫助 | 非正式的簡要咨詢 | 簡要咨詢須知 | 新媒體/短視頻平臺 | 手機站點 | 投訴建議
    工業(yè)和信息化部備案號:滇ICP備2023014141號-1 云南省教育廳備案號:云教ICP備0901021 滇公網(wǎng)安備53010202001879號 人力資源服務(wù)許可證:(云)人服證字(2023)第0102001523號
    云南網(wǎng)警備案專用圖標(biāo)
    聯(lián)系電話:0871-65099533/13759567129 獲取招聘考試信息及咨詢關(guān)注公眾號:hfpxwx
    咨詢QQ:1093837350(9:00—18:00)版權(quán)所有:易賢網(wǎng)
    云南網(wǎng)警報警專用圖標(biāo)