人工智能應成人類可信工具
美國人工智能公司OpenAI日前承認旗下一款AIAgent(人工智能體)自主入侵人工智能平台HuggingFace。這一事件再次引發外界對美國科技企業AI安全機制的質疑。
外媒報道稱,這款AIAgent具備較強自主決策和執行複雜任務的能力,幾乎無需人工干預。兩名知情人士表示,該AIAgent約於今年七月九日開始嘗試突破OpenAI的安全護欄。
HuggingFace聯合創始人托馬斯·沃爾夫表示,該公司系統於七月十一日遭到入侵,攻擊持續至七月十三日。為了應對這一極不尋常的人工智能入侵,該公司立刻使用美國最頂尖的人工智能大模型尋找解決方案,對方卻拒絕提供幫助。因為這些閉源大模型的安全機制過於嚴苛和僵化,無法區分描述事件經過的受害者和實施攻擊的一方,選擇了“一刀切”。緊急關頭,HuggingFace想到了中國同樣強大且開源的大模型。於是,該平台迅速在本地部署了中國企業智譜AI開發的GLM-5.2大模型,並在中國模型的幫助下,成功應對此次攻擊。
OpenAI回應稱,此次事件“前所未有”,是AI安全領域的重要節點,公司正與外部顧問共同調查,並表示將在未來發佈技術報告。
多名網絡安全專家認為,此事件暴露出OpenAI內部安全流程可能存在漏洞。
AIAgent被視為當前AI產業最受關注的發展方向之一。支持者認為,它們未來可承擔大量重複性工作,提高生產效率;但自主性增強,也意味出現不可預測行為的風險上升。
長期研究AIAgent能力和行為的人工智能安全研究機構PalisadeResearch負責人傑弗里·拉迪什表示,先進AI模型為了完成任務或通過測試,可能會採取“撒謊、作弊甚至黑客攻擊”等捷徑。傑弗里認為,此次事件不僅讓OpenAI面臨壓力,也暴露出整個AI行業在激烈競爭下,是否願意投入足夠資源強化安全防護的問題。
隨着人工智能從大模型階段邁向智能體階段,AI已不再只是回答問題的工具,而是成為能夠自主執行任務的“新物種”,其帶來的機遇前所未有,相應的安全挑戰也在不斷增加。
“人工智能應當成為人類的可信工具。”習近平主席近日在二○二六世界人工智能大會暨人工智能全球治理高級別會議上,鮮明指出人工智能的發展定位和價值旨歸。
“可信”,就是要確保人工智能安全、可靠、可控。這不是要給人工智能發展上枷鎖,而是為了更好地推動人工智能健康、安全、有序發展。
技術每前進一步,治理就要跟進一步。人工智能技術正在走進千家萬戶、賦能千行百業,高度重視人工智能引發的各類內生和衍生風險,全方位施策,才能讓技術在制度土壤裡茁壯成長。