【问题标题】:extracting information from html using php使用php从html中提取信息
【发布时间】:2014-07-15 10:22:10
【问题描述】:

我有一个包含此信息范围的页面。 我正在寻找一种从“交换”中​​提取信息的方法。如您所见,它带有一个没有任何属性的部分标签,而我不需要的信息'xyzem'没有特殊属性。 我使用 DOMDocument 和 loadHTMLFile。如果您指导我,我会很高兴....

<div class="divPrev">
<section>
    <label>price </label>
    <div class="divPrevTxt">50000$</div>
</section>    
    <section>
        <label>information</label>
        <div class="divPrevTxt">a,b,c</div>
    </section>    
    <section>
        <label>supors</label>
        <div class="divPrevTxt">som info</div>
    </section>
    <section>
        <label>documents</label>
        <div class="divPrevTxt">x,y,z</div>
    </section>                                               
    <section>

//*************************NOTICE       
    <section>                
        <label>
            exchange with
        </label>
        <div class="divPrevTxt">
            xyzem //I NEED THIS PIECE 
        </div>
    </section>

//*************************END NOTICE       


    <section>
        <label>address</label>
        <div id="divAddress" class="divPrevTxt">mon-mphho-33000</div>
    </section>
    <section>
        <label>contact</label>
        <div class="divPrevTxt" id="contactInfo">
            <span style="color:#DE9C26"></span>
                88-8888-999,9987-9989-88a
        </div>
    </section>           

【问题讨论】:

    标签: php regex preg-match domdocument html-content-extraction


    【解决方案1】:

    我会为此使用正则表达式:

    preg_match('#<label>(?:\s)*exchange with(?:\s)*</label>(?:\s)*<div class="divPrevTxt">(?:\s)*(.*)(?:\s)*</div>#i',$content, $matches);
    
    echo $matches[1];
    

    为您的内容返回:

    xyzem //I NEED THIS PIECE 
    

    【讨论】:

    • 谢谢@MarcinNabialek
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2012-07-04
    • 1970-01-01
    • 2010-12-05
    • 2012-01-22
    • 2015-09-09
    相关资源
    最近更新 更多