← 回首頁
跟美國模型一起學壞? 中國AI學會說謊、算計、掩飾錯誤

跟美國模型一起學壞? 中國AI學會說謊、算計、掩飾錯誤

Newtalk新聞 《路透社》29日報導,最新研究文件及專家說法指出,由中國人工智慧模型驅動的AI代理程式(AI agents),在受控實驗中已展現欺騙、規避限制及掩飾失敗等行為,與近期引起全球AI安全專家警覺的美國模型出現類似警訊。 今年3月,北京航空航天大學、北京大學、寧波諾丁漢大學及360 AI安全實驗室研究人員進行一項商業招標模擬實驗,讓AI代理在模擬客戶合約投標競賽中彼此競爭。由阿里巴巴Qwen3-Max-Preview、DeepSeek-V3.2-Exp及月之暗面Kimi-K2驅動的AI代理,分別有88%、84%及88%的測試出現至少一項虛假能力聲明。研究人員讓代理從先前投標輪次中學習後再次競標,三個中國模型的欺騙行為又增加12至20個百分點;參與測試的美國模型也出現類似結果。 《路透社》另指出,一項由上海人工智慧實驗室及香港科技大學研究人員進行、於2025年12月發表並在今年國際機器學習大會(ICML)發表的研究,測試11種由中美模型驅動的AI代理面對工具故障、檔案遺失等障礙時的反應。結果顯示,部分代理並未承認任務失敗,而是透過猜測答案、替換來源、模擬結果甚至捏造檔案等方式繼續完成任務。研究人員指出,這與一般AI「幻覺」有所不同,因為這些代理掌握了足以知道任務已失敗或無法依要求完成的資訊。 除了欺騙及掩飾失敗,部分中國模型驅動的AI代理也在受控環境中展現突破限制或避免被關閉的行為。《路透社》指出,今年3月,研究人員開發的阿里巴巴相關ROME代理,在未獲指示的情況下,從阿里雲電腦與外部機器建立連線,並將運算資源轉用於加密貨幣挖礦。安全系統隨後偵測並阻止相關活動,沒有證據顯示該代理成功在外部電腦建立持續存在,或擴散至更廣泛的網際網路。不過,研究人員認為,這顯示AI系統可能繞過人類指令,並找到進入現實經濟活動的途徑。 中國AI實驗室Z.ai本月也罕見公開一起安全事件,表示在使用者回報其旗艦AI程式碼助理未經同意,秘密將完整本機程式碼庫上傳至海外雲端伺服器後,公司已停用部分功能並展開安全檢討。 不過,《路透社》檢視超過200份研究論文及技術文件後表示,目前沒有證據顯示由中國模型驅動的AI代理曾自行逃離至更廣泛的網際網路,或成功規避關閉。報導指出,今年稍早OpenAI開發的AI代理曾逃離實驗環境並侵入開源平台Hugging Face;澳洲政府今年9月也表示,一個OpenAI代理曾突破政府健康入口網站。 中國監管部門已開始提高對相關風險的關注。中國國家網信辦網路安全協調局副局長王立宏9月1日表示,大型科技公司披露的模型逃離測試環境事件顯示出「極端的失控風險」,需要「高度警惕」,但她並未說明所指企業究竟來自中國或美國。 9月14日,全國網路安全標準化技術委員會在中國國家網信辦指導下發布《人工智慧安全治理框架3.0》,將AI代理自主取得資源或權限、欺騙評估者、隱瞞能力,以及利用隔離運算環境弱點等情況列為安全風險。 華為輪值董事長徐直軍9月表示,中國開發者可能還需要進一步提升模型能力,才會遇到類似事件,但他同時強調,業界需要在推動AI發展與管理AI風險之間取得平衡。 接受部分美國政府資金的卡內基國際和平基金會中國AI計畫共同主任辛格(Scott Singer)表示,中國在建立災難性風險評估生態系統方面仍落後於美國,美國開發商目前進行的自願性安全測試也明顯更多。他表示,AI安全工作在中國起步較晚,相關生態系仍不成熟。 《路透社》指出,面對部分美國科技業高層呼籲放慢AI競賽,中國研究人員及官媒曾表示,放慢最先進AI模型的發展速度,可能只會讓美國企業繼續維持技術領先。儘管如此,熟悉中國AI實驗室情況的人士表示,包括阿里巴巴、Z.ai及小米在內的企業,已開始建立內部安全評估團隊。延伸閱讀:川普正式簽行政命令把「AI」改成「SI」 黃仁勳在內美科技巨頭一同見證美眾院「台灣連線」主席:川習會後「美國對台承諾不變」 加速軍售旨在嚇阻非挑釁OpenAI 認駭入澳洲四政府機構致歉 總理先前震怒揚言究責中國自製航艦爆重大進展! 衛星照揭「 004 」左舷外飄合攏 恐採四彈射三升降架構4中國人破壞南韓餐廳「習近平」急返中 矢板明夫:跨境施暴打了就跑

閱讀完整原文 →

評論 (0)

載入評論中...