Guten Tag,
ich bin dabei aus einem HTML Dokument einen Text herauszufiltern, stoße jedoch auf mehrere Problem. Zunächst der Ausschnitt aus dem Dokument:
Folgendes möchte ich herausfiltern:
Wie folgt habe ich meinen DOMXPath Query gestaltet:
Leider erhalte ich dadurch nur das folgende Ergebnis:
Wie kann ich die anderen Textabschnitte miteinbeziehen und <br> als tatsächliche Zeilenumbrüche beinhalten?
Grüße,
Chris.
ich bin dabei aus einem HTML Dokument einen Text herauszufiltern, stoße jedoch auf mehrere Problem. Zunächst der Ausschnitt aus dem Dokument:
HTML-Code:
<p id="content"> Erste Zeile <br> Zweite Zeile <br> E-Mail: <script>JavaScript #1</script> <a href="#"> <script>JavaScript #2</script> Ein Link </a> <br> Letzte Zeile </p>
Code:
Erste Zeile\r\nZweite Zeile\r\nEin Link\r\nLetzte Zeile
PHP-Code:
$xpath = DOMXPath($dom);
$result = $xpath->query("('//p[@id='content']/text()[not(parent::script)]");
Code:
Erste Zeile
Grüße,
Chris.

Kommentar