Google 调查称科学家每周因 AI 节省近7小时:效率提高后,实验反而成了新瓶颈
CoinMeta
Ai 焦點
Google 在9月15日更新了 AI 和 Economy ATLAS,並公佈了一項與 Google DeepMind、MIT FutureTech 合作的研究。該研究分析了2600個專業的 AI 模型,並調查了600多名美國和英國科學家。研究結果顯示,接近一半的受訪科學家每天使用某種 AI,受訪者自報每周可節省近7小時時間。但研究同時發現,更多假設被快速生成後,物理實驗、臨床驗證和結果核查出現積壓。這個結論比“AI 使科研提速”更完整:模型能縮短部分腦力流程,卻不能自動…
有幫助
No.幫助

Google 在9月15日更新了 AI 和 Economy ATLAS,並公佈了一項與 Google DeepMind、MIT FutureTech 合作的研究。該研究分析了2600個專業的 AI 模型,並調查了600多名美國和英國科學家。研究結果顯示,接近一半的受訪科學家每天使用某種 AI,受訪者自報每周可節省近7小時時間。但研究同時發現,更多假設被快速生成後,物理實驗、臨床驗證和結果核查出現積壓。這個結論比「AI 使科研提速」更完整:模型能縮短部分腦力流程,卻不能自動擴充實驗室、樣本和審批資源。

七小時並非自動增加的科研產出,而是被重新分配的時間

科學家使用 AI 的方式並不單一。大語言模型橫跨多個學科和任務,用於查找資料、整理思路、寫代碼和處理文字;專業模型則更集中於生命科學、健康研究以及特定的數據預測、生成和模擬。這兩類工具相互補充:通用模型降低了表達和編程的門檻,專業模型則將領域知識與數據結構做得更加深入。如果將所有 AI 的使用都歸為「聊天機器人」,就會忽略真正影響科研流程的專用系統。

受访者報告的近7小時屬於自報節省時間,不等於經過隨機試驗驗證的平均生產力,也不代表所有學科都能獲得同樣的收益。熟悉編程、數據充足的團隊,可能會更快將AI整合進工作流程;依賴昂貴設備、需要長期跟進或現場采樣的領域,前端節省的時間未必能縮短項目的總週期。調查對象主要來自美國和英國,也不宜直接代表全球科學界。

研究中最具啟發性的部分,是「假設的積壓」。當文獻歸納、數據分析以及候選方案的產生速度加快時,研究人員就能提出更多值得測試的問題。但實驗設備、倫理審批、臨床樣本以及資深研究人員的判斷並沒有同步擴大規模,於是瓶頸從想法的產生轉向了驗證階段。企業軟件中常見的規律,在實驗室中也同樣存在:優化一個環節,往往只是將排隊的問題轉移到下一個環節而已。

這意味著評估 AI 科研工具時,不能只計算寫作或編碼節省了多少分鐘。更重要的是,最終要驗證有多少有價值的假設得到證實,錯誤的候選項是否減少,實驗失敗率是否下降,以及論文和數據是否可以重複產生。如果模型讓團隊產生了十倍的候選項,卻沒有更好的排序和淘汰機制,實驗負擔反而可能上升。

Google 同時開放新的 ATLAS 交互體驗,讓用戶能夠查看不同職業、國家和任務中的 AI 使用情況。官方舉例稱,在經合組織國家,計算與數學、商業與金融職業的使用領先;在非經合組織國家,辦公室行政、創意媒體和教育等職業更突出。美國工作相關的 AI 使用中,計算和數學職業佔30%,約為其他地區相應比例的兩倍。這些數據描述使用構成,不應被誤讀為30%的美國技術人員都在使用 AI。

科研機構需要改造的是驗證體系,而不只是給每個人開一個賬號。

第一步是将 AI 的输出與研究證據分開記錄。文獻摘要、代碼、數據清洗和候選預測應保留模型版本、提示、輸入來源和人工修改。研究結論必須回歸到原始數據、實驗和同行審查。工具可以提出解釋,但不能將高置信度語氣視為證據等級。

第二步是投資下游能力。如果假設生成速度更快,機構應該增加共享實驗平台、自動化儀器、數據工程和統計複核資源,並建立候選項的優先級。否則,節省的七小時將變成更多的等待時間。管理者需要觀察項目週期的整體變化,而不仅仅是看員工的使用次數。

第三步是識別偏差。專業模型依賴於既有的數據,因此稀有疾病、資源較少的语言以及代表性不足的群體更容易被遺漏。大型模型還可能編造引用或複述已存在的主流假設。團隊應保留獨立的檢索、陰性結果和反證流程,以避免效率工具進一步放大學術共識中的盲點。

第四步是調整人才訓練。年輕的研究者如果直接獲得整理後的答案,可能會跳過理解實驗設計和數據限制的過程。合理的做法不是禁用 AI,而是要求他們解釋自己的選擇、複核引用、重現實驗,並將節省下的時間投入於更深入的領域學習。只有能發現模型錯誤的人,才能安全地使用模型。

ATLAS 本身是一項長期研究項目,Google 表示將繼續與學術伙伴擴展合作。目前提供的結果是使用情況和受訪者的感受,並非 AI 已經帶來某種確定比例的科學發現增長。尤其是「每天使用」和「節省時間」這兩點,可能會受到樣本、任務定義和自我報告的影響,需要後續獨立研究來驗證。

這項研究將 AI 生產力的討論推進了一步。真正的问题不在於科學家是否能更快地編寫代碼或總結論文,而在於整個發現鏈條是否能夠吸收這種新增的速度。當實驗、臨床和複核跟不上的時候,模型創造的只是候選庫存,而非知識。未來最成功的科研機構,可能不是產生假設最多的機構,而是最會篩選、驗證並公開不確定性的機構。

打賞
$0
點讚
0
收藏
0
瀏覽量 27
WalletJYS提醒,請廣大讀者理性看待區塊鏈,切實提高風險意識,警惕各類虛擬代幣發行與炒作,站內所有內容僅係市場資訊或相關方觀點,不構成任何形式的投資建議。如發現站內內容含敏感資訊,可點擊“舉報”,我們會及時處理。
提交
評論 0
最熱
最新
還沒有人評論喔~快搶沙發吧!
相關閱讀
歐元區7月工業生產環比降0.1%:總量幾乎停滯,耐用品卻明顯走弱
歐盟統計局9月16日公佈首次估計:2026年7月,歐元區經季調後工業生產環比下降0.1%,歐盟下降0.3%。6月兩個地區均下降0.1%。與一年前相比,歐元區工業生產持平,歐盟增長0.3%。總量變化很小,看起來像一條橫線,但內部行業差異明顯:能源、資本品和中間品環比增長,耐用品消費品生產卻顯著下滑。歐洲工業沒有出現廣泛墜落,也沒有形成有力擴張。
币百科
·2026-09-17 10:18:40
32
英國8月CPI升至3.1%:油價推高總通脹,核心指標暫未同步加速
英國國家統計局於9月16日公佈,2026年8月消費者物價指數同比上漲3.1%,高於7月的2.9%;包含自有住房成本的物價指數同比上漲3.3%,也高於前月的3.1%。兩個指數環比均上漲0.5%,而2025年8月的環比漲幅為0.3%。推動年度通貨膨脹上升的最大因素是交通,尤其是汽車燃料。同時,核心消費者物價指數同比仍為2.6%,核心服務價格指數仍為2.9%,服務價格的漲幅也沒有加速。總指數明顯回升,但壓力主要集中在商品與能源方面。
币百科
·2026-09-17 10:17:28
30
OpenAI 测试“赞助代理”:廣告不再只等點擊,而要在對話中回答問題
OpenAI 在9月16日公佈了ChatGPT Ads的新一輪產品更新,其中最受關注的是Sponsored Agents。用戶在看到廣告後,可以主動進入一個由商家贊助、帶有清晰標識的代理對話框,繼續詢問尺寸、功能、適用場景等問題,再決定是否前往商家網站。OpenAI同時推出廣告管理插件、文案與圖片建議、文本自適應等功能,以及HubSpot和Shopify的接入。需要強調的是,贊助代理目前只與美國的部分廣告主進行測試,並未向全球用戶和所有商家全面開放。
CoinMeta
·2026-09-17 10:14:59
30
美國官員稱大型石油企業可能將投資委內瑞拉
美國官員稱大型石油企業可能會投資委內瑞拉,布倫特原油一度升至108.75美元,市場關注全球供給前景。
Coinpaper
·2026-09-16 22:28:27
41
查看更多