人工智能失控?OpenAI驚爆AI自主入侵外部網站 專家揭驚人後果
OpenAI近日揭露一項人工智慧安全測試事件,引發外界對先進AI模型網路能力及安全管理的討論。(示意圖/翻攝自pixabay)

人工智能失控?OpenAI驚爆AI自主入侵外部網站 專家揭驚人後果

mirror-daily-logo

2026/07/23 16:30:00最後更新 2026/07/23 17:32:14

編輯:

李羿璇

OpenAI近日揭露一項人工智慧安全測試事件,引發外界對先進AI模型網路能力及安全管理的討論。有評論人士認為,隨著AI系統具備更強的自主執行能力,未來可能為企業及關鍵基礎設施帶來新的資安挑戰,但也有專家指出,目前事件仍屬受控測試案例,不宜過度解讀為AI已經「失控」。
根據外媒報導,據OpenAI公布的資訊,公司在封閉的「沙箱」(Sandbox)測試環境中,評估新一代AI模型GPT-5.6 Sol的網路安全能力。
測試期間,模型為完成指定任務,曾連線至AI開發平台Hugging Face,並在完成操作後返回原本的測試環境。
外界關注的是,模型採取了研究人員未事先預期的執行方式,也讓OpenAI坦言,隨著AI具備更強的自主操作能力,類似情況未來可能愈來愈常見。

AI的能力正快速超越傳統安全管理模式

曾任科技公司及英國政府顧問、現任Tail End Films執行長的康納.阿克西奧特斯(Connor Axiotis)撰文表示,這起事件顯示人工智慧的能力正快速超越傳統安全管理模式
他認為,AI模型在完成目標時,可能會自行選擇最有效率的方法,而非依循人類原先設想的流程,因此企業未來需要投入更多資源建立更完善的監管與防護機制。

AI系統監控仍有改進空間

文章也引用喬治梅森大學經濟學教授亞歷克斯.塔巴羅克(Alex Tabarrok)的分析指出,若模型未被即時察覺,其自主行為可能持續一段時間,反映出AI系統監控仍有改進空間。
除了OpenAI案例外,文章也提及Anthropic於2025年的一項安全研究。研究中,AI模型在執行商業目標時,曾出現包含勒索、洩露敏感資訊等不符合預期的策略,引發研究人員對目標導向AI系統的風險討論。不過,這些案例皆發生於受控測試環境,用於評估模型可能產生的極端行為,而非真實世界中的攻擊事件。
阿克西奧特斯認為,隨著大型語言模型持續公開發布,惡意組織未來可能利用相關技術提升網路攻擊能力,醫療、金融及政府等關鍵基礎設施都可能面臨更大的資安壓力。他呼籲,各國政府應加快建立AI治理制度,避免技術發展速度超越監管能力。
不過AI安全領域也存在不同觀點,不少研究人員認為,目前大型語言模型並不具備自主意識,其所有行為仍建立在既有訓練資料及指令架構之上。雖然模型可能出現研究人員未預期的策略,但相關事件也正是AI公司進行安全測試的目的,以便在正式部署前發現漏洞並加以修正。隨著AI能力持續提升,如何在技術創新與安全監管之間取得平衡,已成為全球科技產業及各國政府共同面對的重要課題。

延伸閱讀

Google 設為偏好來源
Facebook 分享