Lektion 6 von 7
Daten aus HTML extrahieren
Scraping heißt, strukturierte Daten aus einer HTML-Seite zu ziehen. Für einfache Muster genügt re.findall.
re.findall(r"<h2>(.*?)</h2>", html) liefert die Liste der von den Klammern erfassten Inhalte — das non-greedy .*? stoppt am ersten schließenden Tag.
import re names = re.findall(r"<h2>(.*?)</h2>", html)
🎯 Aufgabe
Extrahieren Sie aus HTML die Liste names der drei Produktnamen (Inhalte der h2-Tags) mit re.findall und geben Sie names aus.
PRO-Lektion
Dieses fortgeschrittene Kapitel gehört zu CodeAge PRO. Schalte es frei, um dein Abenteuer fortzusetzen.
PRO entdecken →