SheepNav
精选昨天0 投票

AI 拒绝机制的双刃剑:安全的屏障还是潜在的灾难?

MIT Technology Review 的《The Download》 newsletter 近日聚焦 AI 安全中的一个核心矛盾:我们是否过度依赖 AI 的拒绝能力来规避风险?

当前主流 AI 模型被训练为拒绝大量敏感请求——从如何毒害同事到如何制作绞索,聊天机器人通常会给出否定回答。但这种拒绝机制并非万无一失,且失败时可能带来灾难性后果。有人正试图利用 AI 来增强生物病原体或构建自主无人机集群。文章作者 Arthur Holland Michel 警告称,迟早有一天,拒绝失败可能引发全球性灾难。

更深层的问题在于,依赖拒绝意味着要在"模型应遵守"和"必须违抗"之间划清界限。而政府也将各自划线,可能借此限制言论自由。与此同时,让 AI 变得有用的能力也可能使其变得危险——若要 AI 帮助治愈癌症,它就需要具备遗传学专业知识,而这些知识同样可能被用于制造生物武器。

GLP-1 减肥药的未知副作用

另一则报道关注 GLP-1 类减肥药。本周,MIT Technology Review 的 Antonio Regalado 报道了新研究,提示这类药物可能延缓生物衰老。这是该类药物一系列潜在益处中的最新发现。

但研究人员也在调查一些奇怪的副作用。最常见的副作用是胃肠道反应,同时也在研究其与脱发、指甲病变以及眼后神经损伤的可能关联。

气候科技公司观察:远景能源的全球风电雄心

远景能源入选 MIT Technology Review 的"2026 年 10 家值得关注的气候科技公司"。中国安装风力涡轮机的速度超过任何其他国家,而远景能源作为领先制造商之一,正将可再生能源整合到数据中心——利用风力涡轮机发电,并用电池在现场储能。该公司最近成为首家完全使用可再生能源直接为数据中心供电的企业。其 AI 驱动的系统可优化电力输出,使设施能够接收……(内容截断)

延伸阅读

  1. 让 AI 智能体在你的屏幕上画箭头、方框和文字:bigarrow 登陆 Hacker News
  2. OpenAI解雇三名安全研究员,当事人发公开信否认指控并警告寒蝉效应
  3. 未来的新职业:送货无人机空中交通管制员
查看原文