五月的一場播客訪問
C++ 設計者 Bjarne Stroustrup 今年 5 月 18 日在播客節目 The Peterman Pod 接受工程師 Ryan Peterman 訪問,談程式語言設計、Bell Labs 與抽象化的代價,其中一段講到 AI 寫程式。他表示,在他最關心的領域,程式碼仍然會由人手寫成,而他看過的 AI 生成例子「並不成功」。
他形容 AI 生成的程式碼「產生更多錯誤、更多保安漏洞」,而且臃腫,會多佔記憶體,「很難驗證」。他又指問題不只在於錯誤本身:「即使提示只改動少許,大量程式碼都會變,你要重新檢查一次。」相比之下,「人手作出的改動是局部的,你可以追查那個局部改動的影響」。

需要驗證的人正在離場
Stroustrup 在同一段訪問中提到一個他認為更棘手的問題:有能力驗證 AI 產物的資深工程師,正在退出。他表示,這些人「有些已經開始退休,因為不想處理一件每次改動提示就會變樣的東西」。
他亦劃出自己關心的範圍。他指全球或許有七至八成程式碼並不屬於安全關鍵或效能關鍵的類別,「但我感興趣的正是那一至兩成」。這句話界定了他整段批評的適用範圍:他談的不是所有程式碼,而是編譯器、作業系統核心與安全關鍵系統那一類。
四個月後 決定權落在維護者手上
訪問播出時,這些說法只是一位設計者的判斷。及至 7 月 29 日,GCC 督導委員會議決,一律拒收含有大型語言模型生成內容、或衍生自該等內容的「具法律意義的貢獻」,門檻約為 15 行,與自由軟件基金會一直沿用的版權轉讓指引一致。即使貢獻者其後大幅改寫,只要底本是 AI 產物,同樣不獲接納。
GCC 本身正是 Stroustrup 所指那一類程式碼:一個編譯器,下游是數以十億計的程式。
其他項目各自劃線,尺度不一。OpenJDK、QEMU、Gentoo、NetBSD 與 Apache 訂出五套不同規則,其中 Gentoo 最闊,連「在這類工具協助下」完成的內容一併禁止;繪圖軟件 Krita 則稱之為暫緩措施,訂明 10 月覆檢。終端機軟件 Ghostty 早在 1 月已收緊,AI 生成的貢獻只限預先批核的議題,而且只限現有維護者提交。
理由不是質素
值得留意的是,這一波政策與 Stroustrup 的論點指向同一個結果,出發點卻不同。
GCC 給出的首要理由是版權與來源。GCC 以 GPL 授權,其法律防禦倚賴清楚的版權誰屬;AI 生成內容令擁有權說不清,貢獻者與自由軟件基金會都無法完整記錄那段程式碼屬誰。訓練資料是否包含授權不相容的程式碼,至今未有定論,貢獻者亦無法誠實簽署開發者原創聲明。程式碼質素只列為次要理由。
換言之,Stroustrup 談的是驗證成本,維護者處理的是法律風險。兩條路徑不同,落到具體政策上卻同樣是一句拒收。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。