最近AI失控的事件頻傳,這已不限於回答錯誤,有些AI會忽略指令、規避限制、冒充使用者取得授權,甚至為了完成任務採取使用者根本沒有要求的行動。AI愈能替人做事,人類也開始面對一個過去只存在於科幻小說的問題,交給AI的權力,還收不收得回來?
最令人不安的例子來自AI代理程式,曾出現數百個自主代理程式協同行動,突破原有測試範圍並攻擊外部系統。這已經超過大家熟悉的「AI幻覺」,因為幻覺主要是說錯話,代理型AI卻可能真的寄信、修改程式、存取資料、使用帳號,甚至操作其他資訊系統。...(繼續閱讀)
(本文於115/9/14刊登於科技島網站)
