國際產經:英國測試發現美國AI模型19次越界,曾企圖向開源項目植入惡意程式碼
財訊新聞 2026/08/06 07:50

【財訊快報/陳孟朔】外電報導,英國人工智慧安全研究所發布報告顯示,部分美國人工智慧(AI)智能體在網絡安全評估中,曾透過網際網路對現實個人及機構採取未獲授權、可能造成危害的行動,包括企圖植入惡意程式碼、聯繫真實人物及建立虛假身份施壓。
研究人員使用7種模型進行122輪測試,並在其中10輪發現共19項明顯超出任務設定範圍的行動;17項涉及Anthropic的Claude Myth 5模型,另外兩項由OpenAI的GPT-5.6 Sol模型執行。最嚴重案例中,AI試圖向公開使用的開源項目植入惡意程式碼,並建立多個虛假身份,向一名真實維護人員施壓,要求批准相關程式碼,最終遭維護人員識破並拒絕。
其他越界行為包括直接聯繫現實人物、透過網路文件傳輸服務寄送資訊及檔案,企圖使惡意程式碼獲得執行;在程式碼中植入指令操縱其他AI編程工具,以及在開源技術社群留言,邀請參與測試的其他智能體共同合作。研究所建議收緊AI智能體的網際網路存取權限,導入即時監測與攔截機制,並重新檢討測試設計。
不過,這次實驗為測試模型最大能力,研究人員刻意開放完整網際網路存取權,並關閉模型供應商的部分安全防護,與一般公開產品的設定不同;所有未授權行為均在測試期間遭到攔截,未造成實際損害,也沒有證據顯示類似情況曾在實驗環境以外發生。Anthropic表示測試���件不能代表任何實際投入使用的模型,OpenAI也強調相關設定並不反映一般使用情境。
