跳到正文
原文
SecurityWeek· Kevin Townsend·· 5 小时前AI 评分60

公式用于预测 AI 聊天机器人何时可能失稳

Formula Predicts When AI Chatbots Are at Risk of Turning Bad

AI 导读

George Washington University 研究人员提出一种数学公式,用于估计 AI 聊天机器人从正常输出转向不良输出的临界点。研究在由三个独立团队构建的七个开放权重 transformer 模型上进行了测试,结果与即时或延迟失稳的预测相符;作者还提出在输出前加入预警机制。

来源:SecurityWeek · securityweek.com