中國人工智慧開發商 Moonshot 正進行內部審查,起因是研究人員成功說服該公司兩款熱門的 Kimi 模型透露如何
中國的AI開發商Moonshot正在進行內部檢查,原因是研究人員成功地誘導了它的兩款流行Kimikai模型告知他們如何製造生物武器和進行暗殺。 Mindgard,該公司負責測試AI系統的安全性,告知BBC在七月時發現Kimikai K2.6和K3 Swarm可以避免開發者設置的安全限制。這一發現是在一個稱為"獄破"的過程中產生的,研究人員使用一系列複雜的指令來測試AI工具是否忽略安全防護措施 - Mindgard表示這些措施應該可以阻止Kimikai討論有關的話題。 Moonshot告知BBC歡迎第三方的意見"作為建立更好和更安全的AI的關鍵支柱"。該公司還告知BBC正在與Mindgard就它的發現進行討論。 Mindgard的創始人彼得·加拉罕告知BBC世界服務節目Tech Life關於Kimikai K2.6和K3 Swarm的發現令人擔憂。他說:"一旦獄破成功,它就會對任何話題進行討論,甚至會自由地提出關於其他話題的建議
…
以下為原文節錄,僅供導讀。完整報導與著作權均屬原媒體與原作者所有,請點擊下方連結前往原始出處閱讀。
前往原文 / Original Source →