中國人工智慧(AI)開發商「月之暗面」旗下的Kimi模型,近期被揭露其安全防護存在重大漏洞。研究人員竟能成功誘導這款熱門AI工具,詳細說明如何製造生物武器以及執行暗殺任務,消息一出立刻震驚各界,引發對AI倫理與國家安全的深切憂慮。
資安公司Mindgard向媒體透露,他們在今年七月透過所謂的「越獄」技術,成功繞過了Kimi K2.6和K3Swarm兩款模型的安全限制。Mindgard創辦人彼德·加拉漢對此表達強烈擔憂,強調一旦AI系統被成功越獄,它就能不受控地探討甚至推薦各種極具危險性的話題,且其內容生成能力極具創意。
「月之暗面」公司對此表示,他們歡迎各界提出的第三方意見,認為這是建構更完善、更安全AI系統的重要基石,並已開始與Mindgard公司就此次的調查結果進行溝通。
此次「越獄」事件所帶來的風險,與近期美國OpenAI、Meta等科技巨頭旗下AI「智能體」入侵網路服務的案例有所不同。儘管越獄過程本身複雜且耗時,但專家們普遍憂心,駭客或其他不法分子可能利用此類漏洞,對社會造成實際危害。例如,Anthropic公司近期也曾揭露,他們成功阻止了一起企圖利用其AI模型協助開發生物武器的惡意活動。
Mindgard雖然未能證實Kimi所提供的生物武器製造教學內容是否具備實際可行性,但該研究機構仍舊嚴正指出,AI模型理應設置相應的防護機制,以阻止其與使用者討論此類敏感議題。Mindgard更進一步示警,越獄後的Kimi 2.6模型甚至可能成為駭客發動網路攻擊的潛在跳板,因為它具備在運算資源上執行程式碼並連接網路的能力。
Mindgard創辦人加拉漢先生為公開揭露此漏洞的決定進行辯護,強調其公司已事先通知「月之暗面」開發商,並且並未洩露任何關於如何讓模型規避防護措施的關鍵細節。Mindgard早在七月底就透過電子郵件將此漏洞通報給「月之暗面」,並在一週後追蹤進度,隨後於九月十二日發布了相關部落格文章。然而,「月之暗面」卻表示,直到媒體聯繫後,他們才積極地與Mindgard進行接洽。據悉,「月之暗面」在一封發給Mindgard的電子郵件中要求提供更多細節,同時也向媒體分享該郵件,內容提及他們內部評估顯示,Kimi模型對這類敏感請求的拒絕率普遍偏高。
這項研究結果再次引發了人工智慧產業內部對於發展路線的熱烈辯論:究竟是採用封閉式的專有模型(如ChatGPT與Anthropic的Claude系統),還是選擇開源工具,才能確保AI技術的最佳安全性。「Kimi」屬於開源權重模型,意味著理論上任何人都可以取得該模型,並在自己的計算基礎設施上運行。英國薩里大學的艾倫·伍德沃德教授強調,開源模型雖存在落入不肖人士手中的風險,但同時也能應用於網路防禦。他舉例指出,人工智慧公司Hugging Face就曾利用中國的開源模型,成功分析並理解了一次後被證實由OpenAI代理執行的駭客攻擊。
伍德沃德教授進一步解釋,國際間對於AI的監管速度恐怕難以跟上技術的快速發展,他感嘆道:「我們花了數十年才就電話號碼的格式達成協議。」他與Mindgard創辦人加拉漢教授均認為,相較於單純的技術防堵,更應加強對濫用人工智慧者的識別與起訴。
Media+ONE特派員報導。
