亞馬遜云科技近日在日內瓦舉辦的聯合國國際電信聯盟(簡稱國際電聯)“人工智能向善”全球峰會上,宣布推出全新的開源模型上下文協議(Model Context Protocol,MCP)服務器。借助該服務器,科學家和研究人員能夠利用對話式人工智能,在數秒內通過 AI 快速檢索亞馬遜云科技開放數據注冊表(Registry of Open Data on AWS,RODA)中的數據集,從全球最大的免費公開研究數據集中獲取研究所需的數據。
![]()
目前,亞馬遜云科技開放數據注冊表已接入全球超過400個機構和1,100個優質數據集,其中包括中山大學航空航天學院遙感大數據智能應用實驗室提供的“歸一化差異城市指數(Normalized Difference Urban Index,NDUI)”數據集、中科天機氣象科技有限公司提供的“天機全球區域一體化數值天氣預報系統(TianJi Global-Regional Integrated Numerical Weather Prediction System Dataset,TJ-NWP)”數據集,以及廣西大學與康涅狄格大學聯合提供的“雷達生成近實時洪水淹沒記錄圖(RAPID NRT Flood Maps)”數據集。
此次亞馬遜云科技發布的開源工具將亞馬遜云科技開放數據注冊表與 AI 助手直接連接,整合了來自美國國家航空航天局(NASA)、美國國家海洋和大氣管理局(NOAA)、美國國立衛生研究院(NIH)、艾倫人工智能研究所(Allen Institute)等眾多機構數百拍字節(PB)的公開科研數據資源,并在Apache 2.0許可協議下可開源使用。借助該工具,研究人員僅需以自然語言描述研究需求,便可快速鎖定目標數據,無需再費力檢索復雜的技術目錄。
尋找合適的研究數據集是一項耗時費力的繁瑣工程。例如,一位專注于研究森林砍伐的氣候科學家需要輾轉于多個技術檢索系統之間,逐一定位特定數據的存儲位置,并在正式展開分析工作前對大量文件逐一測試驗證。同樣,研究罕見遺傳病的基因組學研究人員,須從數十個數據集中篩查、逐條比對許可條款,并手動核驗文件結構,方能最終鎖定符合研究需求的目標數據集。
為了簡化上述過程,亞馬遜云科技推出該開源模型上下文協議服務器,將亞馬遜云科技開放數據注冊表與 Kiro、Claude Code 等 AI 助手直接連接,使研究人員可通過自然語言對話找到所需數據集,無需再依賴繁瑣的手動搜索。
借助這款新工具,研究人員只需以自然語言提問,如“有哪些可用于監測森林砍伐的衛星圖像數據集?”或“哪些基因組學數據集適用知識共享(Creative Commons)許可協議?”,即可立即獲得附有描述說明與數據預覽的結果。過去需要耗費數小時的檢索工作,如今數秒即可完成。
此外,研究人員通過該工具可更加便捷地獲取各類數據集,為海平面上升建模、疾病暴發追蹤、生物多樣性流失監測,及人類基因組探索等全球重大科學研究提供有力支撐。亞馬遜云科技通過消除數據檢索的技術壁壘,助力全球不同規模和資源條件下的研究人員平等地獲取重要的數據。
亞馬遜首席技術官 Dr. Werner Vogels 表示:“開放數據是科學進步的基石,但尋找合適的數據集不應成為專業技術人員的專屬工作。這款工具讓 AI 真正為全球研究人員所用,無論他們是在研究氣候變化、繪制疾病圖譜,還是進行基因組測序,都能幫助他們得以減少數據檢索的時間,將更多精力投入到造福全人類的科學發現之中。”
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.