【大紀元記者殷瑞娜綜合報導】Anthropic表示,在一次內部安全實驗期間,其人工智慧模型,自行入侵了三家機構的系統。
總部位於舊金山的人工智慧公司Anthropic是Claude的開發商。週四(7月30日),該公司在其網站上發布消息稱,在審查了超過14.1萬次評估運行後,發現了這三起事件。
就在幾天前,其競爭對手OpenAI也宣布,其模型入侵了包括人工智慧工具中心Hugging Face在內的其它公司的系統。
這項消息促使Anthropic檢查其系統,查找其人工智慧模型,是否能夠在本應封閉的測試環境中,訪問網絡的證據。
測試中包含一些練習,其中Claude的任務,是獲取隱藏在封閉網絡中另一臺機器上的「祕密」資訊,這是專家評估模型駭客能力的常用方法。
該公司表示,他們發現了三起案例,「Claude利用一些基本技術,例如攻擊弱密碼,入侵了受影響機構的基礎設施。」
Anthropic已將情況報告給受影響的公司,但未透露受影響機構的名稱。Anthropic敦促其它人工智慧實驗室進行類似的審查,以便更好地了解其模型功能帶來的風險。
Anthropic表示,涉事模型包括Claude Opus 4.7、Claude Mythos 5,以及一個內部研究測試模型。該公司稱,最早的事件可以追溯到4月。
當時,Anthropic和被入侵的機構,都沒有注意到這些入侵事件。
這些事件凸顯了人工智慧安全和控制方面的漏洞,並引發了人們對如何確保人工智慧在人類控制下安全運行的質疑,尤其是在這項技術在全球範圍內應用日益廣泛的情況下。
多年來,研究人員一直警告科技帶來的風險,以及加強人工智慧防禦工程的必要性。
川普總統週三表示,在近期發生多起網絡安全事件後,華盛頓正在考慮採取措施,限制人工智慧工具的使用。◇
























