跳到正文

#安全/对齐

今日 3 条
今天10月5日周一
  1. The Decoder31

    DeepMind 研究人员提出“人工共生智能”,作为奇点理论的替代方案

    DeepMind 研究人员提出“人工共生智能”概念,主张 AI 研究的核心挑战是协调由智能体、人和连接系统组成的复杂网络,而非构建孤立的机器智能。该观点基于对 DeepSeek-R1、QwQ-32B 等推理模型的分析,发现其推理轨迹会自发出现内部辩论、转换视角和调和冲突的多视角行为,且这种行为在训练中涌现而非显式编程。

10月4日周日
  1. The Decoder26

    Altman 反对将 AI 模型宗教化,称这是"真实的安全问题"

    OpenAI CEO Sam Altman 公开反对将 AI 模型与宗教类比,称人们"赋予 AI 模型宗教力量或放弃人类判断"让他"非常不安",并称这是"真实的安全问题"。此番表态紧随《纽约时报》关于 Anthropic 接触宗教领袖的报道,以及教皇 Leo XIV 称"算法缺乏人性的火花"。Altman 曾在 2023 和 2024 年称 OpenAI 的目标是构建"天空中的魔法智能"。

10月1日周四
9月29日周二
9月28日周一
9月23日周三
9月22日周二
9月21日周一
8月31日周一
8月10日周一
  1. Import AI32

    Import AI 468:23 条 RSI 政策建议、PostTrainBench+,以及信任与透明度如何影响 AI 竞赛

    Import AI 第 468 期收录了智库 IFP 提出的 23 条政策建议,分属 7 个类别,用于帮助政策制定者应对 AI 研发进一步自动化的风险。MIT 与 Columbia 的论文《Racing to Ruin》分析双寡头 R&D 竞争,认为信任与透明度是竞争对手实现协调减速的两个关键变量。本期还介绍了 PostTrainBench+ 以及一篇关于智能机器与机器人身体的虚构短篇故事。

4月21日周二
  1. Hugging Face Blog38

    AI 与网络安全的未来:为什么开放性至关重要

    Hugging Face 发文讨论 Mythos 与 Project Glasswing 发布后 AI 网络安全格局,指出 Mythos 的能力来自模型、算力、安全脚手架与自主性组成的系统而非单一模型。文章认为开源代码与工具能在检测、验证、协调、补丁传播四个阶段分散风险,避免闭源单点故障,并主张用半自主 AI 智能体在人类可控前提下防御漏洞。