CodeAgeBy Sitezack
Angewandtes Python für ProfisDateien, CSV und APIs0 XP
Kapitel-Fortschritt0/6

Lektion 6 von 7

Daten aus HTML extrahieren

Scraping heißt, strukturierte Daten aus einer HTML-Seite zu ziehen. Für einfache Muster genügt re.findall.

re.findall(r"<h2>(.*?)</h2>", html) liefert die Liste der von den Klammern erfassten Inhalte — das non-greedy .*? stoppt am ersten schließenden Tag.

import re
names = re.findall(r"<h2>(.*?)</h2>", html)

🎯 Aufgabe

Extrahieren Sie aus HTML die Liste names der drei Produktnamen (Inhalte der h2-Tags) mit re.findall und geben Sie names aus.

PRO-Lektion

Dieses fortgeschrittene Kapitel gehört zu CodeAge PRO. Schalte es frei, um dein Abenteuer fortzusetzen.

PRO entdecken