ఒక డెవలపర్ ప్రపంచంలోని ప్రతి సముద్ర రేవు (seaport) మరియు విమానాశ్రయం (airport)—3,804 రేవులు మరియు 9,640 విమానాశ్రయాలు—అందుات ఒక ఉచిత, సెర్చేబుల్ ఇండెక్స్‌ను విడుదల చేశారు. దీని కోసం సైన్-అప్ లేదా చెల్లింపు అవసరం లేదు. theportindex.online అనే ఈ సైట్ ద్వారా వినియోగదారులు డేటాను బ్రౌజ్ చేయవచ్చు లేదా పూర్తి డేటాసెట్‌ను CSV లేదా JSON ఫార్మాట్‌లో డౌన్‌లోడ్ చేసుకోవచ్చు.

ఈ ఇండెక్స్ ఎందుకు అవసరమైంది

సృష్టికర్త ప్రపంచంలోని సముద్ర రేవుల యొక్క స్పష్టమైన, తాజా జాబితాను కనుగొనాలని ప్రయత్నించారు, కానీ కొన్ని ఇబ్బందులు ఎదురయ్యాయి: చాలా వాణిజ్య ఆఫర్‌లు పేవాల్స్ (paywalls) వెనుక ఉన్నాయి మరియు బహిరంగంగా అందుబాటులో ఉన్న జాబితాలు తరచుగా సంవత్సరాల క్రితం నాటివి అయిపోతున్నాయి. అసంపూర్తిగా లేదా పాత డేటాపై ఆధారపడటం వల్ల విశ్లేషకులు స్ప్రెడ్‌షీట్‌లను క్లీన్ చేయడానికి గంటల కొద్దీ సమయాన్ని వృధా చేయాల్సి వస్తుంది, ఇది పరిశ్రమ అంతటా ఒక పెద్ద ఖర్చుగా మారుతుంది. మూడు బహిరంగ మూలాలను—ఒక US ప్రభుత్వ రేవు ఇండెక్స్, ఒక అంతర్జాతీయ లొకేషన్ కోడ్ డైరెక్టరీ మరియు ఒక క్రౌడ్‌సోర్స్డ్ విమానాశ్రయ డేటాబేస్—కలిపి, డెవలపర్ ఎవరైనా తక్షణమే ఉపయోగించగల ఒకే ఒక సమగ్ర రిఫరెన్స్‌ను రూపొందించారు.

తెర వెనుక ఉన్న డేటా మూలాలు

  • NGA World Port Index – ప్రతి గుర్తింపు పొందిన సముద్ర రేవుకు ప్రాథమిక వివరాలను అందించే ఒక U.S. ప్రభుత్వ సంకలనం.
  • UN/LOCODE – ఐక్యరాజ్యసమితి యొక్క లొకేషన్ కోడ్ సిస్టమ్, ఇది రేవులు మరియు విమానాశ్రయాల కోసం ప్రామాణిక గుర్తింపులను (identifiers) జోడిస్తుంది.
  • OurAirports – రన్‌వే పొడవులు మరియు కోఆర్డినేట్‌లతో సహా విమానాశ్రయ సమాచారాన్ని కలిగి ఉన్న కమ్యూనిటీ నిర్వహించే సేకరణ.

ప్రతి మూలం ఒక విభిన్న కోణాన్ని అందిస్తుంది, కానీ ఏదీ ఒంటరిగా ఉపయోగించడానికి సిద్ధంగా ఉన్న, సెర్చేబుల్ క్యాటలాగ్‌ను అందించదు. వాటిని విలీనం చేయడానికి కేవలం కాపీ-పేస్ట్ సరిపోదు; డెవలపర్ అసమానతలు (inconsistencies), డూప్లికేట్ ఎంట్రీలు మరియు మిస్సింగ్ ఫీల్డ్‌లను పరిష్కరించాల్సి వచ్చింది.

డేటాను క్లీన్ చేయడం: మూడు కష్టపడి నేర్చుకున్న పాఠాలు

  1. Embedded newlines break naïve parsers – కోటెడ్ ఫీల్డ్‌ల (quoted fields) లోపల లైన్ బ్రేక్‌లు ఉన్న CSV ఫైల్‌లను సాధారణ “split on newline” కమాండ్‌తో విడదీయలేము. రోలను (rows) సరిగ్గా ఉంచడానికి సరైన CSV parser అవసరం.
  2. Outlier values hide mistakes – కొన్ని ఆయిల్ టెర్మినల్స్ 900 మీటర్ల లోతును జాబితా చేశాయి, ఇది రేవులకు (harbors) కాకుండా మౌరింగ్ బూయ్‌లకు (mooring buoys) సంబంధించిన సంఖ్య. లోతు ఆధారిత ర్యాంకింగ్‌లను విశ్వసనీయంగా ఉంచడానికి అసాధ్యమైన సంఖ్యలను ఫిల్టర్ చేయడం అవసరమైంది.
  3. Zeros are often placeholders – సున్నాగా నమోదైన లోతు సాధారణంగా ఆ కొలత తెలియదని అర్థం, నీరు చదునుగా ఉందని కాదు. లోతుపై ఆధారపడే ఏ విశ్లేషణ యొక్క సమగ్రతను కాపాడాలన్నా, సున్నాను మిస్సింగ్ డేటాగా పరిగణించాలి.

కేవలం సంఖ్యల కంటే ఎక్కువ విలువను జోడించడం

ఈ ఇండెక్స్ కేవలం కోఆర్డినేట్‌లను జాబితా చేయడమే కాకుండా మరిన్ని పనులు చేస్తుంది. రేవుల కోసం, ఇది లోతును ఆ రేవులో సురక్షితంగా లంగరు పడగల నౌకల తరగతుల (classes of vessels) రూపంలోకి మారుస్తుంది, తద్వారా ఒకే మెట్రిక్‌ను ఆచరణాత్మక నిర్ణయ సాధనంగా మారుస్తుంది. విమానాశ్రయాల కోసం, రన్‌వే పొడవును అక్కడ పనిచేయగల విమానాల రకాలతో అనుసంధానిస్తుంది, ఇది పైలట్‌లకు మరియు ప్లానర్‌లకు సామర్థ్యాన్ని ఒక చూపులో అంచనా వేయడానికి సహాయపడుతుంది.

ఒక స్పేషియల్ గ్రిడ్ ప్రతి రేవును దాని సమీపంలోని విమానాశ్రయాలతో మరియు విరుద్ధంగా అనుసంధానిస్తుంది, దీనివల్ల ఈ సైట్ ఒక అన్వేషణ సాధనంగా మారుతుంది. ఉదాహరణకు, ఒక నిర్దిష్ట రేవుకు తక్కువ డ్రైవింగ్ దూరంలో ఏ విమానాశ్రయాలు ఉన్నాయో వినియోగదారులు కనుగొనవచ్చు—ఇది మల్టీమోడల్ ఫ్రైట్ ప్లానింగ్‌కు ఉపయోగపడే ఫీచర్.

భారీ స్థాయిలో స్టాటిక్-సైట్ ఇంజిన్‌ను నిర్మించడం

మొత్తం ఫ్రంట్ ఎండ్ Next.js తో స్టాటిక్ జనరేషన్‌పై నడుస్తుంది. బిల్డ్ ప్రక్రియలో, సుమారు 14,000 పేజీలు—ప్రతి రేవు మరియు విమానాశ్రయానికి ఒకటి చొప్పున—ముందుగానే రెండర్ చేయబడతాయి. డేటాబేస్ లేదా సర్వర్-సైడ్ లాజిక్ లేకపోవడం వల్ల, ఈ సైట్‌కు ఎటువంటి నిరంతర కంప్యూట్ ఖర్చులు ఉండవు; ఇది ప్రపంచవ్యాప్తంగా పేజీలను తక్షణమే అందించే కంటెంట్-డెలివరీ నెట్‌వర్క్ (CDN) పై పనిచేస్తుంది.

SEO ఇబ్బందులు మరియు 'thin-content' పరిష్కారం

వేలాది టెంప్లేట్ పేజీలను అప్‌లోడ్ చేయడం వల్ల సెర్చ్ ఇంజన్‌లకు అనుమానం కలగవచ్చు, అవి సైట్‌ను “thin content”గా పరిగణించి ర్యాంకింగ్‌లను తగ్గించవచ్చు. AdSense దరఖాస్తు తిరస్కరించబడినప్పుడు డెవలపర్ ఈ సమస్యను ఎదుర్కొన్నారు. దీనికి పరిష్కారం ఏమిటంటే, సందర్శకుల కోసం పూర్తి పేజీలను అందుబాటులో ఉంచడం, కానీ ప్రతి కేటగిరీలోని టాప్ 400 నాణ్యమైన పేజీలు మినహా మిగిలిన అన్నింటికీ noindex డైరెక్టివ్‌ను జోడించడం. ఇది క్రాలర్‌లకు అత్యంత విలువైన పేజీలు మాత్రమే సెర్చ్ రిజల్ట్స్‌లో కనిపించాలని చెబుతుంది, తద్వారా పూర్తి డేటాసెట్‌ను అందిస్తూనే విశ్వసనీయతను కాపాడుతుంది.

ఎవరికి ప్రయోజనం, మరియు పరిమితులు ఏమిటి

  • Logistics firms బహుళ PDFల ద్వారా వెతకకుండానే, ఒక కార్గో షిప్ రేవు యొక్క లోతు పరిమితులకు సరిపోతుందో లేదో త్వరగా ధృవీకరించుకోవచ్చు.
  • Airline planners రూట్ ఫీజిబిలిటీ స్టడీస్ కోసం ఉపయోగపడే రన్‌వే-టు-ఎయిర్‌క్రాఫ్ట్ మ్యాపింగ్‌లను తక్షణమే పొందవచ్చు.
  • Developers and researchers కస్టమ్ టూల్స్‌లోకి ఇంపోర్ట్ చేయగల స్వచ్ఛమైన, మెషిన్-రీడబుల్ డేటాను పొందవచ్చు.

ప్రాజెక్ట్ యొక్క తదుపరి అడుగులు

అదనపు ఫీచర్ల గురించి ఫీడ్‌బ్యాక్ ఇవ్వవలసిందిగా సృష్టికర్త కమ్యూనిటీని కోరుతున్నారు.

ముగింపు

డేటా క్లీనింగ్ ఇబ్బందులను పరిష్కరించడం, ఇన్ఫరెన్స్ లేయర్‌లను జోడించడం మరియు స్టాటిక్ జనరేషన్ ద్వారా సర్వర్ ఖర్చులను నివారించడం ద్వారా, ఒక లీన్ ఆర్కిటెక్చర్ కూడా ప్రపంచవ్యాప్తంగా ఉపయోగపడే సాధనాన్ని అందించగలదని డెవలపర్ నిరూపించారు—మీరు ఎప్పటికప్పుడు వచ్చే అప్‌డేట్‌లను అంగీకరించడానికి మరియు సెర్చ్ ఇంజిన్ మార్గదర్శకాలను గమనిస్తూ ఉండటానికి సిద్ధంగా ఉంటే ఇది సాధ్యమవుతుంది.