你提交了代码,因为监控仪表盘看起来一切正常。HTTP 200。绿色对勾。然后你便去吃午饭了。

当你回来时,用户看到的却是空表格和陈旧的数据。你自己用 cURL 请求了该端点。状态码 200。但响应体呢?它可能包含一个礼貌的 JSON 对象,告诉你服务已宕机;或者返回了一个没有任何记录的空壳响应;又或者模式(schema)在夜间发生了变化,导致你的解析器在处理 null 值时崩溃了。这就是“200 陷阱”。服务器成功响应了 HTTP 请求,但它从未承诺其中的数据是有效的。

政府 API 是互联网上最丰富、最权威的数据流之一。更棒的是,令人惊讶的是,其中许多 API 无需注册、无需 API 密钥,也不需要 OAuth 握手。大门是敞开的。但问题在于,它们是由致力于优化透明度的公务员构建的,而不是为了你的可用性监控器而设计的。它们很诚实,有时甚至有些古怪,并且要求你必须读取实际的有效载荷(payload)。

以下是你可以立即调用的十个数据源,以及你能在其中发现的内容。

十个端点

USAspending
财政部运行着联邦资金流向的权威账本。包括合同、拨款、贷款和直接付款。如果你想追踪特定机构向特定邮政编码区域供应商的支出,这里就是你的起点。这些数据属于公共领域,其粒度细化到了单笔交易。

Treasury FiscalData
需要上一个工作日结束时的准确国债数据?或者是历史财政收入?FiscalData 是财政部的开放数据存储库。它包含精确到分位的债务数据、政府证券利率以及定期更新的联邦财务摘要。

Federal Register
这是美国政府的每日日志。每一项拟议规则、最终规则、公告和总统文件都会发布于此。如果你正在构建合规工具或追踪监管变化,该数据源是了解机构实际执行内容的“事实真相”。

openFDA
FDA 发布经过整理的数据集,涵盖药物不良事件、药品标签、食品执法报告和医疗器械召回。它不能替代临床建议,但它是药物安全讨论背后的原始信号。开发者利用它来交叉引用症状、追踪召回地理范围或监控标签变更。

PubMed
国家生物技术信息中心(NCBI)通过其 E-utilities 维护这个生物医学文献数据库。它拥有涵盖医学、护理学、牙科学和兽医学的数千万条引用,为文献综述和引用网络提供动力。可以将其视为同行评审发现领域的支柱。

ClinicalTrials.gov
由美国国立卫生研究院(NIH)管理,该注册库保存了由公共和私人资助的研究方案及结果信息。你可以追踪招募状态、地点、结果衡量指标,以及结果是否已实际发布。任何围绕医疗研究透明度构建工具的人都需要它。

CDC Public Health Data
美国疾病控制与预防中心(CDC)发布涵盖死亡率、出生率、疾病流行率和行为风险因素的监测数据。其粒度因数据集而异,但该数据源是美国公共卫生官方统计脉搏。

GBIF
全球生物多样性信息机构(GBIF)汇集了来自世界各地博物馆、公民科学家和研究机构的物种出现记录。无论你是需要地