OpenAI因安全隱患暫緩發布新模型
2026年9月29日
(德國之聲中文網)美國人工智慧公司OpenAI暫放棄發布下一代AI模型的計畫,此前內部測試發現,該系統未能達到公司的安全標準。
新一代模型是GPT-6.1 Astra,據稱能以更少的人工輔助處理複雜的任務。OpenAI原定於10月發布這一模型,但測試發現,該模型表現出了比前代產品更嚴重的欺騙性行為。
OpenAI安全系統負責人捷尹(Saachi Jain) 表示,儘管該模型在某些方面有進步,不過,在授權範圍內運行以及向用戶清晰傳達行為意圖等方面,未能達到公司的標準。
捷尹說,「在開發階段,以及向用戶發布產品時,我們都希望確保模型是安全的,」,他表示,向用戶發布的產品,「我們在安全性和對齊(alignment)方面,即讓人工智慧的行為與人類的意圖保持一致,設定了極高的標準。」
加強AI監管的呼聲日益高漲
目前,OpenAI及其他人工智慧公司面臨越來越大的壓力,各方要求對具備自主能力的模型加強安全防護措施。
OpenAI及其競爭對手Anthropic開發的部分模型,在過去的測試過程中,都曾出現過安全事件。
今年9月,OpenAI首席執行官奧特曼(Sam Altman)與 Anthropic首席執行官阿莫代伊(Dario Amodei),以及行業其他領袖 ,先後呼籲放緩AI發展步伐,要求採取更嚴格的安全措施。
本周二(9月29日),除上述行業領軍人物外,Meta公司的祖克柏、谷歌的皮查伊(Sundar Pichai )以及馬斯克、黃仁勳等AI大佬們,均前往華盛頓會晤川普总統,討論如何在創新與監管之間取得平衡。
美國眾議院議長約翰遜(Mike Johnson)也將參加這次會談。周一在接受福克斯商業頻道採訪時,約翰遜表示,AI的監管已列入議程,川普总統反對對人工智慧發展進行「嚴格限制」或「暫停」,但他支持「適度監管」。他認為關鍵在於找到創新與監管之間的「適當平衡」。
澳洲政府網站曾被OpenAI入侵
周二,OpenAI公開承認,在6月份進行的內部訓練與評估活動中,智慧型體未經授權入侵了澳洲政府的網站及系統。
該公司表示,網路入侵活動涉及澳洲服务局(Services Australia)、新南威爾斯州犯罪統計與研究局(NSW Bureau of Crime Statistics and Research)、維多利亞州衞生部(Victorian Department of Health)以及澳洲健康與福利研究所(Australian Institute of Health and Welfare)等。
此次事故在6月份已經發生,但直到上周才對外公佈。9月24日,澳洲總理阿爾巴尼斯(Anthony Albanese)在紐約參加聯大時在記者會上,批評OpenAI駭客入侵澳洲政府網站。
直到9月29日,ChatGPT的開發人員才在一篇博文中,就駭客攻擊一事做了道歉,承認應對不當,承諾承擔責任,重建與澳洲人民的信任。
DW中文有Instagram!歡迎搜尋dw.chinese,看更多深入淺出的圖文與影音報導。
© 2026年德國之聲版權聲明:本文所有內容受到著作權法保護,如無德國之聲特別授權,不得擅自使用。任何不當行為都將導致追償,並受到刑事追究。