Ein einfaches Go-Tool, das Suchergebnisse über DuckDuckGo abruft, die verlinkten Seiten besucht und versucht, den Titel der jeweiligen Webseite auszulesen. Die Ergebnisse werden in einer JSON-Datei gespeichert.
Das Programm:
- sucht über DuckDuckGo nach einem Begriff (Text wird per URL-Query übergeben),
- extrahiert die tatsächlichen Ziel-URLs (die DuckDuckGo über Redirects maskiert),
- besucht jede Seite mit einem realistischen User-Agent,
- liest den
<title>-Tag der Seite (wenn möglich), - speichert URL + Titel als Liste in eine
results.json.
Die Ergebnisse erscheinen in der Reihenfolge, in der sie besucht wurden.
go run main.go "schuhe"Das Skript erstellt oder überschreibt eine Datei namens results.json im Projektverzeichnis.
[
{
"url": "https://www.otto.de/schuhe/",
"title": "Schuhe online kaufen | OTTO"
},
{
"url": "https://www.eschuhe.de/"
}
]Wenn kein Titel extrahiert werden konnte, bleibt das Feld leer oder fehlt.
- Sprache: Go
- HTTP/Scraping: Colly
- JSON-Encoding über Standardbibliothek
- Einfache Fehlerbehandlung und Logging per Konsole
Nicht alle Seiten erlauben Bot-Zugriffe. Manche blockieren Crawler oder liefern keine Inhalte ohne JavaScript. Das Tool ist nicht dafür gedacht, intensiv zu scrapen oder Daten großflächig zu sammeln – es dient eher als Lernprojekt oder für vereinfachte Recherchezwecke.
Keine besondere Lizenz. Nur zu Lernzwecken. Erstellt von Furkan.