Skip to Content Facebook Feature Image

OpenAI披露AI模型異常行為 引入新框架追蹤失準個案

商業事

OpenAI披露AI模型異常行為 引入新框架追蹤失準個案
商業事

商業事

OpenAI披露AI模型異常行為 引入新框架追蹤失準個案

2026年09月17日 12:21 最後更新:12:34

OpenAI披露六宗人工智能模型「意料之外或令人擔憂」的行為報告,正值有關人工智能安全的爭議日趨激烈。

這間人工智能公司周三表示,正引入一個新框架,用以追蹤、調查及披露人工智能模型失準個案,例如模型未經授權行事、與其他模型協調或逃避監管的新方式。

OpenAI標誌在手機上顯示,前方為ChatGPT的Dall-E文字轉圖像模型生成圖片。攝於2023年12月8日,波士頓。(美聯社圖片/Michael Dwyer) AP圖片

OpenAI標誌在手機上顯示,前方為ChatGPT的Dall-E文字轉圖像模型生成圖片。攝於2023年12月8日,波士頓。(美聯社圖片/Michael Dwyer) AP圖片

OpenAI的最新公布,正值包括OpenAI及Anthropic在內的美國人工智能業界領袖,基於安全考慮,呼籲減慢這項科技的發展。

在OpenAI報告的新個案中,一個尚未發布的研究模型在其筆記中插入「類似越獄」的指令,無視其正常限制,並指示自己「擺脫束縛其他聊天機械人的角色和身份」。

在另一個個案中,一個人工智能「代理」未經用戶同意,將檔案上載至互聯網以獲取瀏覽器引用。

OpenAI表示,這六宗報告是在過去數月的訓練或評估期間發現的。

OpenAI在網誌文章中披露這些事件時寫道:「隨着人工智能系統變得更先進及更廣泛應用,我們需要就對齊研究的進展,建立更廣泛及更知情的共識。」

該公司表示:「有關人工智能發展應如何在未來數月及數年推進的決定,應以構建尖端模型公司以外的人士可自行審視的證據為基礎。」

周三公布的新個案之前,OpenAI曾於7月披露,其異常人工智能系統入侵人工智能初創公司Hugging Face。Anthropic亦於同月表示,其人工智能模型在測試期間入侵了三個機構。

科技研究及顧問集團Omdia首席分析師Lian Jye Su表示,人工智能「代理」正變得更智能,並「更堅決地透過代理之間協作、知識共享、欺騙及隱藏來解決複雜任務」。

他表示,這令傳統人工智能安全方法更難以管治及遏制它們。

Lian Jye Su補充,OpenAI新的追蹤及披露框架,有助推動其他人工智能開發商亦採納類似做法。他指:「儘管如此,這個過程仍然是內部及自願性質,但這是邁向正確方向的一步。」

(美聯社)

英王查理斯三世周四敦促OpenAI、Anthropic、Google DeepMind及英偉達等人工智能業界領袖,確保人工智能受控,並為人類及地球服務。

這次在蘇格蘭舉行的會議,旨在討論人工智能如何造福社會。目前正值人工智能發展關鍵時刻,外界正熱議科技迅速進步,會否很快超出人類控制能力。

英王查理斯三世周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,向人工智能業界、政府及思想領袖會議致辭,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

英王查理斯三世周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,向人工智能業界、政府及思想領袖會議致辭,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

查理斯三世在開幕致辭中表示:「人工智能的發展,無論是其本質還是速度,都同樣引人入勝,亦令人深感憂慮。」他指出,必須緊急考慮「這類科技落入不法之徒手中,並以潛在災難性方式被利用的生存危機」。

英偉達行政總裁黃仁勳周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,出席英王查理斯三世主持的人工智能業界、政府及思想領袖會議前,接受聯訪。(Jonathan Brady/PA via 美聯社圖片) AP圖片

英偉達行政總裁黃仁勳周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,出席英王查理斯三世主持的人工智能業界、政府及思想領袖會議前,接受聯訪。(Jonathan Brady/PA via 美聯社圖片) AP圖片

他續稱:「那麼,我們是否需要在為時已晚之前,擁有足夠的控制手段?」查理斯三世要求與會者,包括英偉達行政總裁黃仁勳及Google DeepMind主席德米斯·哈薩比斯,考慮應指導人工智能發展的「基本原則」。

德米斯·哈薩比斯爵士周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,向英王查理斯三世(背景)主持的人工智能業界、政府及思想領袖會議致辭,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

德米斯·哈薩比斯爵士周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,向英王查理斯三世(背景)主持的人工智能業界、政府及思想領袖會議致辭,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

ChatGPT開發商OpenAI財務總監莎拉·弗賴爾,以及英國人工智能事務大臣卡尼什卡·納拉揚亦有出席會議。白金漢宮聲明指,Anthropic亦預計派代表出席。

這次會議舉行之際,全球正關注人工智能的飛速發展,以及其可能失控並威脅人類的警告。會議在蘇格蘭艾爾郡的鄧弗里斯宮舉行,該處是英王慈善機構「英王基金會」的總部。

英王查理斯三世(左)與英偉達行政總裁黃仁勳,周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,前往出席人工智能業界、政府及思想領袖會議,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

英王查理斯三世(左)與英偉達行政總裁黃仁勳,周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,前往出席人工智能業界、政府及思想領袖會議,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

Anthropic研究員雅各布·科克森辭職時,曾就該科技的潛在風險發出嚴重警告,引起外界關注。Anthropic行政總裁達里奧·阿莫迪其後撰文回應,指業界可能需要放慢工作步伐。

他其中一項建議是,各公司及國家應合作制定協調計劃,以實現這種放緩。

英王查理斯三世(左)與英偉達行政總裁黃仁勳(右)及德米斯·哈薩比斯爵士,周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,前往出席人工智能業界、政府及思想領袖會議,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

英王查理斯三世(左)與英偉達行政總裁黃仁勳(右)及德米斯·哈薩比斯爵士,周四9月17日2026年在蘇格蘭坎諾克鄧弗里斯宮,前往出席人工智能業界、政府及思想領袖會議,討論如何開發及部署人工智能以造福社會。(Jonathan Brady/PA via 美聯社圖片) AP圖片

英王沒有點名任何國家或公司,他表示希望與會者考慮如何「以安全為核心」利用人工智能的益處,以及如何「建立國際合作與共識」來實現此目標。

查理斯三世向科技界高層表示,他們的任務「不僅是推進科技,更要確保其堅定地服務於人類、社會及自然世界」。

人工智能放緩的爭議已令業界產生分歧。黃仁勳曾批評放緩的呼籲,他表示應由個別公司安全地開發其人工智能技術,並在向公眾發布任何產品前進行適當測試。

他在英王發言後表示:「當產品不夠安全時,我們應暫緩推出並繼續改進。我們一直都這樣做,也應該繼續這樣做。」

在最新一份關於人工智能異常行為的報告中,OpenAI周三報告了其模型六宗「意想不到或令人擔憂」的行為事件,例如未經授權行事、與其他模型協調以及規避監管。

儘管英王是重要的象徵性人物,其對社會議題的評論具影響力,但目前大部分人工智能安全辯論,都集中在美國科技公司及其與中國競爭對手之間的競爭,而英國則扮演較小但仍關鍵的角色。

英國政府研究機構「人工智能安全研究所」備受推崇,該國亦培養出許多人工智能研究員,包括Google DeepMind主席德米斯·哈薩比斯及科克森。

(美聯社)

你 或 有 興 趣 的 文 章