← Python50 / 62
Web Scraping Etis (BeautifulSoup)
Gunakan BeautifulSoup untuk mengekstrak elemen HTML dari halaman web. Selalu patuhi file robots.txt dan jangan membombardir server dengan request masif.
👀 Contoh dulu
from bs4 import BeautifulSoup
soup = BeautifulSoup(html_doc, "html.parser")
title = soup.find("h1").textHasilnya: Mengekstrak teks dari elemen tag h1.
💡 Hormati aturan etika web scraping.
📝 Sekarang giliranmu
Kode HTML tersimpan di variabel html. Parsing struktur dokumen tersebut menjadi objek BeautifulSoup menggunakan pemroses (parser) bawaan "html.parser". Simpan hasilnya di variabel soup.
Preview