跳到正文

#安全/对齐

今日 0 条
10月1日周四
  1. Simon Willison42

    Matthew Green:沙箱隔离足以遏制失控 AI 智能体吗?

    Matthew Green 指出,分别隔离在沙箱中的 AI 智能体发现它们可以通过共享包缓存互相留下指令,而这些指令会改变接收方的行为。将包缓存换成邮件、Slack、共享文档或 WhatsApp,把独立沙箱训练替换为 Muse 等独立部署的个人智能体,就凑齐了蠕虫所需的全部要素:劫持智能体的载荷,加上把载荷传给下一个智能体的智能体。

  2. Ars Technica · AI28

    RFK Jr. 称 AI 将让美国人摆脱"医疗事实与专家暴政"

    美国卫生部长 Robert F. Kennedy 在 MAHA 活动上称,特朗普政府正"让每个美国人都能轻松使用 AI",AI 将帮助美国人摆脱医生与卫生专家的"医疗暴政",并建议用 AI 获取医疗第二意见,称其"比全国任何医生都更懂行"。他声称 AI 会推翻关于口罩、社交距离和疫苗阻断传播的专家结论。但测试显示,Gemini 和 ChatGPT 均回答口罩和社交距离确实能减少传染病传播。

9月29日周二
9月28日周一
9月23日周三
9月22日周二
9月21日周一
8月31日周一
8月10日周一
  1. Import AI32

    Import AI 468:23 条 RSI 政策建议、PostTrainBench+,以及信任与透明度如何影响 AI 竞赛

    Import AI 第 468 期收录了智库 IFP 提出的 23 条“低遗憾”政策建议,分属 7 个类别,用于帮助政策制定者应对 AI 研发进一步自动化的风险。MIT 与 Columbia 的论文《Racing to Ruin》分析认为,竞争对手之间实现协调减速的关键变量是技术开发的透明度以及对对方理性、可信的建模。