跳至主要內容
OpenAI

2026年7月28日

研究發表研究

智慧體式 AI 時代的科學運算

一份實地報告說明科學家如何運用程式碼編寫智慧體,推動基因體學及其他資料密集領域的科學軟體現代化。

載入中…

科學運算是現代學術與產業研究的核心支柱。然而,分析科學資訊所需的軟體一直難以跟上資料快速產生的速度。許多廣泛使用的研究工具,起初只是隨研究論文一併發布的程式碼,由工程經驗有限的小型學術團隊開發,幾乎沒有時間進行封裝、測試、最佳化或長期支援。因此,科學基礎設施往往依賴緩慢、脆弱且需要持續維護的工作流程。這些限制拖慢了科學發現的步伐。

AI 智慧體正開始改變這種局面。它們能降低工程工作的成本,並承擔繁瑣的實作任務,協助研究人員更快建立原型、推動過去難以實現的專案,也更容易長期維護軟體。因此,科學軟體能更有效率地開發,也能獲得更完善的維護,讓研究人員把更多時間投入科學探索。

我們分享一份探索性實地報告,介紹八個主要來自生命科學領域、運用智慧體協助的科學運算專案,其中五個僅使用 Codex,另外三個則結合使用 Codex 與 Claude Code。報告彙整了各專案團隊撰寫的案例研究,並歸納出反覆出現的共通主題。這些專案涵蓋的工作範圍廣泛,從例行維護、特定功能的最佳化,到大規模程式語言遷移,以及針對 GPU 原生架構重新設計。參與團隊表示,智慧體大幅加快了軟體開發與維護的速度,有些案例甚至讓小型團隊得以承擔原本需要投入更多時間,或仰賴具備專業工程能力人員才能完成的工作。不過,他們也指出,如何為這些工具建立明確且長期的責任歸屬與維護機制,仍然是一項持續存在的挑戰。

貢獻者一致指出,研究人員的角色正從實作轉向驗證與協調:明確指定要建構什麼、定義如何衡量正確性,並判斷專案何時可以發布。在這種新興模式下,研究人員仍掌控科學方向與品質標準,並藉由智慧體式協助提升工作速度。

展示智慧體協助科學軟體專案分布的示意圖,呈現從維護到工作流程重新設計的不同面向。

案例研究

將廣泛使用的基因體資料剖析程式庫現代化

cyvcf2 是用於讀寫基因體變異檔案的 Python 程式庫。GPT‑5.5 以現代化的統一流程取代該程式庫的舊式建置與封裝系統,讓程式庫更容易安裝、測試與發布。

有了程式碼編寫智慧體,要快速推進並不難;但就目前而言,若想在科學上走得長遠,仍需要專家的指導、洞見、判斷力與細心。

—Brent Pedersen

共通主題

儘管專案規模差異很大,但都顯示程式碼編寫智慧體正讓工程人力與專業知識不再是科學運算的重大限制。如今,瓶頸轉為驗證 AI 智慧體的輸出,而這仍仰賴人類判斷。

綜觀各案例研究,智慧體能有效處理明確且定義清楚的任務,卻無法可靠判斷其成果在科學上是否有效或符合預期。事實上,即使成果存在明顯錯誤,智慧體往往仍表現得很有信心。因此,人工審查者必須找出可靠的方法來驗證結果。最有效的方法會採用外部參照或可衡量的驗收目標,例如輸出結果必須完全一致、與既有工具達到相同結果、符合預期的統計特性,或比對事先利用模擬資料建立的標準答案。

另一個共通主題是,這些專案通常採用依據回饋反覆迭代的分階段方式,而非一次完成。貢獻者將廣泛目標拆解成較小的變更,再利用中期基準與測試系統評估並改進智慧體的成果。智慧體通常能迅速產出初步實作,但處理邊界情況與細微的數值差異則耗時許多。完成實作的「最後一哩路」往往最費工。

整體而言,這些案例研究顯示,智慧體讓研究人員能減少實作時間,把更多心力放在引導科學工作上。人類負責定義目標、將複雜專案拆解成可管理的部分,並判斷結果在科學上是否有效。智慧體能緩解長期存在的工程限制,讓研究人員能完成更多原本做不到的工作,並將更多心力投入最重要的科學問題與決策。

長期維護管理仍不可或缺

研究軟體長期存在的維護缺口,拖慢了迭代速度,也限制了可重現性與可靠性。已發表的「研究程式碼(在新視窗中開啟)」與體學工具(在新視窗中開啟)研究發現,公開發布的軟體往往無法在全新的運算環境中正確安裝或依照文件執行,迫使研究人員花費大量時間進行設定與偵錯。即使是例行改進,也能節省研究人員的時間並降低運算需求;以效能為導向的重構與重寫則能帶來更大幅度的提升。

然而,實作成本降低也讓大量相似的重寫版本更容易出現,導致使用者分散,也分散了維持單一工具可靠性所需的專家投入。因此,長期維護管理與貢獻歸屬機制變得更加重要。成熟的科學軟體承載著未記錄的慣例、相容性要求與使用者信任,僅翻譯原始程式碼無法重現這些要素。

這些案例研究呈現了幾條可行的前進道路。MHCflurry 與 cyvcf2 的變更已納入原本的上游專案;由於原專案已遭棄置,rustar-aligner 則轉由新的社群負責維護。若能與既有維護者協調,就應儘早展開合作。若必須採用獨立實作,就需要明確的負責人與可信的維護計劃。若缺少這些條件,今日的現代化重寫版本可能成為明日遭棄置的程式碼,而非可靠的科學基礎設施。

邁向更持久可靠的科學軟體

這份實地報告兼具回顧性與探索性,但其中的案例研究顯示,科學軟體的開發方式正發生務實的轉變。Codex 等程式碼編寫智慧體能大幅降低維護、遷移、最佳化與全新實作的成本。它們的長期科學價值,仍取決於人類決定要建構什麼、如何驗證,以及由誰維護。更深層的改變不只是研究人員能產出更多軟體,而是他們能投入更多心力來定義、驗證及維護管理這些工具。

這些案例研究顯示,智慧體如今已能加快科學運算的迭代速度。隨著程式碼編寫智慧體持續進步,研究人員可減少花在維護分析流程上的時間,將更多心力用於推動領域發展。