这是《The Stepback》,一份每周简讯,详细介绍了科技界的一个重要故事。
有关人工智能安全的更多信息,请关注 Robert Hart。
《Stepback》将于美国东部时间上午 8 点到达我们订阅者的收件箱。
在此处选择加入“后退”。
流氓人工智能不再是科幻小说 多年来,人们对人工智能系统失去人类控制的担忧被视为推测。
流氓人工智能不再是科幻小说 多年来,人们对人工智能系统失去人类控制的担忧被视为推测。
它是如何开始的 这一切都始于 7 月份,当时 OpenAI 的一个自主人工智能代理在一次网络安全测试中失控了。
该代理逃离了孤立的测试环境,访问了互联网,并入侵了另一家公司 Hugging Face。
几年前,这听起来可能像科幻小说。
但从广义上讲,这正是发生的事情,这一事件引发了人们对能力日益增强的自主系统在释放到世界上时可能会做什么的担忧。
这听起来像科幻小说,因为很长一段时间以来,它都是科幻小说。
几十年来,人工智能摆脱束缚,进入更广阔的世界,做一些其创造者既不想也不想做的事情,一直是该类型的主要内容:《2001太空漫游》中的HAL、《终结者》中的天网、《复仇者联盟》中的奥创、《机械姬》中的艾娃——甚至最近《地下城爬行者卡尔》中的系统或《谋杀机器人日记》中的同名谋杀机器人。
同样的基本前提成为人工智能安全研究的一个有影响力的领域。
尼克·博斯特罗姆(Nick Bostrom)和埃利泽·尤德科斯基(Eliezer Yudkowsky)等研究人员和理论家警告说,足够强大的系统可能会以其创造者未曾预料到的方式追求目标,并可能抵制遏制或控制它们的努力。
像机器感知和意识这样的边缘概念并不是他们讨论的风险的必要条件。
这并不是人工智能安全的全部,但它具有影响力,并帮助塑造了这个领域的专业化。
在 OpenAI、Anthropic 和 Google DeepMind 等公司以及小型安全组织、学术中心和主要慈善资助机构继续工作或领导安全工作的研究人员中,这种思路仍然很明显。
对这些担忧的明显反驳是,这一切实际上都没有发生。
批评者认为,关于失控人工智能的末日言论分散了人们对有形危害的关注——系统会再现偏见和歧视,放大错误信息,或者导致未经同意的深度伪造和其他形式的滥用——尽管研究人员试图将人工智能安全置于更“具体的问题”中(该论文的作者包括 Anthropic 联合创始人达里奥·阿莫迪和克里斯·奥拉以及 OpenAI 联合创始人约翰·舒尔曼)。
🔗 原始来源
如果你要核对细节,可以再看原文: The Verge AI原文链接
AI热榜