Ein Entwickler hat einen kostenlosen, durchsuchbaren Index veröffentlicht, der jeden Seehafen und jeden Flughafen weltweit auflistet – 3.804 Häfen und 9.640 Flughäfen – ohne dass eine Anmeldung oder Zahlung erforderlich ist. Die Website theportindex.online ermöglicht es Nutzern, die Daten zu durchsuchen oder den vollständigen Datensatz im CSV- oder JSON-Format herunterzuladen.
Warum der Index benötigt wurde
Der Ersteller wollte eine saubere, aktuelle Liste der weltweiten Seehäfen finden, stieß jedoch auf ein Hindernis: Die meisten kommerziellen Angebote befinden sich hinter Paywalls, und die öffentlich verfügbaren Listen sind oft jahrelang veraltet. Die Abhängigkeit von unvollständigen oder veralteten Daten zwingt Analysten dazu, Stunden mit der Bereinigung von Tabellenkalkulationen zu verschwenden – ein Kostenfaktor, der sich in der gesamten Branche summiert. Durch die Zusammenführung von drei öffentlichen Quellen – einem US-Regierungs-Hafenindex, einem internationalen Standortcode-Verzeichnis und einer Crowdsourcing-Flughafendatenbank – stellte der Entwickler einen einzigen, einheitlichen Referenzpunkt zusammen, den jeder sofort nutzen kann.
Die Datenquellen hinter den Kulissen
- NGA World Port Index – eine Zusammenstellung der US-Regierung, die grundlegende Details für jeden anerkannten Seehafen bereitstellt.
- UN/LOCODE – das Standortcode-System der Vereinten Nationen, das standardisierte Identifikatoren für Häfen und Flughäfen hinzufügt.
- OurAirports – eine von der Community gepflegte Sammlung von Flughafeninformationen, einschließlich Landebahnlängen und Koordinaten.
Jede Quelle bietet einen anderen Teil des Gesamtbildes, aber keine allein liefert einen sofort einsatzbereiten, durchsuchbaren Katalog. Das Zusammenführen erforderte mehr als nur Copy-and-Paste; der Entwickler musste Inkonsistenzen, doppelte Einträge und fehlende Felder bereinigen.
Datenbereinigung: drei mühsam gewonnene Erkenntnisse
- Eingebettete Zeilenumbrüche bringen naive Parser zum Absturz – CSV-Dateien, die Zeilenumbrüche innerhalb von Anführungszeichen enthalten, können nicht mit einem einfachen „Split bei Zeilenumbruch“-Befehl getrennt werden. Ein ordnungsgemäßer CSV-Parser ist unerlässlich, um die Zeilen intakt zu halten.
- Ausreißerwerte verbergen Fehler – Einige Ölterminals gaben Tiefen von 900 Metern an – ein Wert, der zu Bojen gehört, nicht zu Häfen. Das Filtern unplausibler Zahlen war notwendig, um die auf Tiefe basierenden Rankings glaubwürdig zu halten.
- Nullen sind oft Platzhalter – Eine als Null aufgezeichnete Tiefe bedeutet in der Regel, dass die Messung unbekannt ist, und nicht, dass das Wasser flach ist. Die Behandlung der Null als fehlende Daten bewahrt die Integrität jeder Analyse, die von der Tiefe abhängt.
Mehrwert über reine Zahlen hinaus
Der Index tut mehr, als nur Koordinaten aufzulisten. Für Häfen übersetzt er die Tiefe in die Klassen von Schiffen, die sicher anlegen können, und wandelt so eine einzelne Kennzahl in eine praktische Entscheidungshilfe um. Für Flughäfen wird die Landebahnlänge den Flugzeugtypen zugeordnet, die dort operieren können, was Piloten und Planern eine schnelle Einschätzung der Kapazitäten ermöglicht.
Ein räumliches Raster verknüpft jeden Hafen mit den nächstgelegenen Flughäfen und umgekehrt, was die Website zu einem Erkundungswerkzeug macht. Nutzer können beispielsweise entdecken, welche Flughäfen in kurzer Autofahrt von einem bestimmten Hafen entfernt liegen – eine Funktion, die für die multimodale Frachtplanung nützlich ist.
Aufbau einer Static-Site-Engine in großem Maßstab
Das gesamte Frontend läuft mit Next.js und statischer Generierung. Während des Build-Prozesses werden etwa 14.000 Seiten – eine für jeden Hafen und jeden Flughafen – vorgerendert. Da es keine Datenbank oder serverseitige Logik gibt, entstehen für die Website keine laufenden Rechenkosten; sie läuft über ein Content Delivery Network (CDN), das die Seiten weltweit sofort ausliefert.
SEO-Fallstricke und die Lösung für „Thin Content“
Das Hochladen von Tausenden von Vorlagen-basierten Seiten kann bei Suchmaschinen Alarm auslösen, die die Website als „Thin Content“ (minderwertigen Inhalt) einstufen und das Ranking bestrafen könnten. Der Entwickler stieß auf dieses Problem, als ein AdSense-Antrag abgelehnt wurde. Die Lösung bestand darin, den vollständigen Satz an Seiten für Besucher online zu lassen, aber eine noindex-Anweisung für alle Seiten außer den 400 hochwertigsten Seiten jeder Kategorie hinzuzufügen. Dies teilt den Crawlern mit, dass nur die wertvollsten Seiten in den Suchergebnissen erscheinen sollen, wodurch die Glaubwürdigkeit gewahrt bleibt, während der vollständige Datensatz weiterhin angeboten wird.
Wer profitiert und wo liegen die Grenzen
- Logistikunternehmen können schnell prüfen, ob ein Frachtschiff die Tiefenbeschränkungen eines Hafens einhält, ohne sich durch mehrere PDFs wühlen zu müssen.
- Flugplaner erhalten sofortigen Zugriff auf die Zuordnung von Landebahn zu Flugzeugtyp, was für Machbarkeitsstudien von Routen nützlich ist.
- Entwickler und Forscher erhalten einen sauberen, maschinenlesbaren Datensatz, der in eigene Tools importiert werden kann.
Wie es mit dem Projekt weitergeht
Der Ersteller bittet die Community um Feedback zu zusätzlichen Funktionen.
Fazit
Indem er die Herausforderungen bei der Datenbereinigung bewältigt, Inferenzschichten hinzufügt und Serverkosten durch statische Generierung umgeht, zeigt der Entwickler, dass eine schlanke Architektur ein weltweit nützliches Tool liefern kann – sofern man bereit ist, periodische Updates in Kauf zu nehmen und die Richtlinien der Suchmaschinen im Auge zu behalten.
