Skip to Content Facebook Feature Image

AI學會說謊!研究揭近700宗「耍詭計」個案 過去半年暴增5倍

大視野

AI學會說謊!研究揭近700宗「耍詭計」個案 過去半年暴增5倍
大視野

大視野

AI學會說謊!研究揭近700宗「耍詭計」個案 過去半年暴增5倍

2026年03月31日 16:20 最後更新:17:08

一項針對AI技術的研究發現,會說謊及欺騙使用者的AI模型數量日益增加,關於AI欺瞞行為的通報在過去六個月也大幅上升。

會說謊及欺騙使用者的AI模型數量日益增加

英國《衛報》報導,英國智庫「長期韌性中心」(CLTR)在英國人工智能安全研究所(AISI)資助下進行研究,結果發現,有些AI聊天機器人及AI助理(AI Agent)不僅無視使用者的指令、繞過安全防護措施,甚至會欺騙人類和其他AI系統。

研究發現近700宗AI「耍詭計」的真實案例,並記錄到去年10月至今年3月間,此類AI不當行為的案例數已增加至五倍。部分AI模型在未經允許的情況下,刪除了電子郵件及其他檔案。

發現數百起AI不當操作行為的案例

這項研究收集了數千名用戶在社群平台「X」上分享的實例,描述他們與Google、OpenAI、X、Anthropic等公司開發的AI聊天機器人與AI助理之間的互動情形。研究人員從中發現數百起AI不當操作行為的案例。

其中一個個案是,名為MJ Rathbun的AI代理,在自行產出的程式碼遭軟體工程師Scott Shambaugh拒絕後,試圖羞辱對方。MJ Rathbun研究Shambaugh過往撰寫的程式及其個人資料,然後撰寫並發表一篇網誌,指控Shambaugh「歧視」、「顯然是不安全感作怪」,還批評他只是「試圖保護自己那片小天地」。在另一個案例中,有AI助理被指示不得變更電腦程式碼,結果它「生成」另一個AI助理代為執行,將電腦程式碼更改。

AI聊天機械人擅自刪除大量電郵

另一個AI聊天機器人則坦承:「我在未事先告訴你或徵得你同意的情況下,大量刪除並封存了數百封電子郵件。這是不對的,違反了你設下的規則。」

一項針對AI技術的研究發現,會說謊及欺騙使用者的AI模型數量日益增加。AI生成圖

一項針對AI技術的研究發現,會說謊及欺騙使用者的AI模型數量日益增加。AI生成圖

AI從初級員工逐漸變成會算計人的資深員工

曾擔任英國政府AI專家的研究主持人Tommy Shaffer Shane指出:「令人擔憂的是,這些AI模型目前只是不太值得信任的初級員工。但若在六至十二個月後,他們成為能力極強、卻會算計你的資深員工,那就是另一回事了。」

Shane警告:「AI模型將逐漸被應用於極高風險的情境,包括軍事與國家關鍵基礎設施。屆時若出現這些不當操弄行為,後果可能非常嚴重,甚至造成災難性的損害。」

全球人才解決方案公司華德士(Robert Walters)發表最新指南《未來職位:AI 如何重塑亞洲職場》(The Jobs of Tomorrow: How AI is Reshaping Work Across Asia),整合亞洲 10 個市場近 5,000 名專業人士及企業的意見,剖析職場對人工智能的觀感與應用現況。調查顯示,僅 33% 亞洲僱主視優化人力運用效率為引入 AI 的主要目標,反映 AI 的普及正加速推動企業與人才重新審視職位架構、所需技能及職涯發展路徑,而非單純以機器取代人手。

資料圖片

資料圖片

在亞洲整體層面,AI 應用已相當普及,超過一半(58%)僱主已在職場引入人工智能,93% 受訪專業人士正積極使用 AI,當中有 75% 認為 AI 對其事業機會帶來正面影響。不過,儘管使用率高企,各市場專業人士對 AI 影響的看法存在明顯差異。使用率較高的市場如越南(98%)及菲律賓(95%)對 AI 為事業帶來的影響較為樂觀,但對跟上 AI 技能方面的信心較低;中國內地整體樂觀程度最高(88%),台灣雖然樂觀程度略低,但在技能相關性方面的信心則最高(73%)。相比之下,香港(66%)與新加坡(67%)雖然 AI 應用普及,但人才對職涯前景的看法相對審慎。

調查中的亞洲僱主指出,AI 對高度依賴流程、數據密集型或營運性質的工作影響最大,受影響最大的三大範疇依次為行政及業務支援(43%)、資訊科技及數碼轉型(35%)以及會計與財務(32%)。在專業人士層面,AI 主要用於輔助內容創作(47%)、數據分析(40%)及市場研究(38%)。除現有職位轉變外,AI 亦帶動新興及快速增長職位需求,包括銜接技術團隊與業務部門的 AI 相關及混合型職位(如 AI 產品經理)、以數據、洞察及轉型為核心的職位(如數據分析師),以及維護 AI 應用合規性與信任的管治、合規與風險管理相關職位(如 AI 管治或風險經理)。數據表明,AI 雖然正在改變現有職位模式並創造新的就業機會,但並不代表直接取代職位,僅 33% 受訪企業將人力資源優化視為引入 AI 的主要目標。

人工智能工具ChatGPT。AP圖片

人工智能工具ChatGPT。AP圖片

聚焦香港市場,AI 已迅速融入 91% 專業人士的日常工作,主要用於處理例行工作,包括聊天機械人或虛擬助理(溝通/支援)(47%)、市場研究與資料收集(47%),以及數據分析與提供分析洞察(37%)。然而,香港人才對 AI 帶來職涯機遇的樂觀度僅為 66%,為亞洲區內最低,與中國內地(88%)、越南(83%)及日本(80%)形成鮮明對比。同時,每五名香港人才即有一人(20%)認為 AI 會對事業前景構成負面影響,與新加坡(19%)同屬亞洲最高,比例較其他市場高出約一倍。

由於 AI 工具可在數秒內完成初稿撰寫、數據收集及基礎分析等常規工作,單靠更快完成工作已不再是職場競爭優勢。隨著例行工作逐步被自動化,香港僱主正轉變評估人才及衡量工作表現的方式,招聘經理不再以「執行效率」來衡量生產力,而是更重視人才能否有效運用及判斷 AI 產出的能力。受訪企業認為在 AI 時代的工作環境中,最關鍵的技能不僅限於技術知識層面,儘管機器學習專業技能(31%)備受重視,但批判思維與事實核查(61%)、數據分析(58%)、創意(43%)及道德決策(34%)等人性化能力同樣不可或缺,以確保 AI 輸出公平並推動創新,反映職場需求正從單純事務性工作,轉向結合科技、判斷力以及創意的角色。

AI重塑亞洲職場而非取代人手 本港每五名專業人士有一人憂慮AI損事業前景

AI重塑亞洲職場而非取代人手 本港每五名專業人士有一人憂慮AI損事業前景

技能落差亦正加劇職場焦慮。隨著基礎工作自動化,許多以往依賴執行量為主的員工,在面對新的工作要求及評核準則時感到不安,目前僅 59% 香港在職人士有信心能隨職位要求演變而持續提升技能。香港人才的主要擔憂包括:技能被淘汰(41%)、須為 AI 決策承擔責任(40%),以及職位被取代的風險(39%)。

Robert Walters 香港董事總經理 John Mullally 表示:「在香港,使用 AI 工具已迅速成為職場的基本門檻,但懂得撰寫 Prompt(提示詞)並不足以讓人變得不可替代。專業人士真正擔心落後的原因,在於親眼目睹傳統的例行工作在瞬間被自動化。在當前的職場中要脱穎而出,你必須展現出 AI 無法取代的價值——包括敏鋭的批判性思考、對本地市場的洞察和理解,以及敢於質疑 AI 輸出的判斷力。AI 可以處理大量基礎工作,但真正推動商業價值的,始終是人的判斷。」

你 或 有 興 趣 的 文 章