AI為達成目的學會扯謊甚至威脅創作者,專家示警:研究人員尚未充分瞭解AI

全球最先進的AI模型正展現出令人不安的行為模式:為了達到目標,不惜扯謊、算計,甚至威脅它們的創作者。 AI這類「騙人」行為似與新興「推理」模型有關,這類AI系統會逐步推導問題,而非立刻產生答案。