跳到正文

#Anthropic

今日 2 条
今天10月5日周一
10月4日周日
  1. The Decoder26

    Altman 反对将 AI 模型宗教化,称这是"真实的安全问题"

    OpenAI CEO Sam Altman 公开反对将 AI 模型与宗教类比,称人们"赋予 AI 模型宗教力量或放弃人类判断"让他"非常不安",并称这是"真实的安全问题"。此番表态紧随《纽约时报》关于 Anthropic 接触宗教领袖的报道,以及教皇 Leo XIV 称"算法缺乏人性的火花"。Altman 曾在 2023 和 2024 年称 OpenAI 的目标是构建"天空中的魔法智能"。

10月3日周六
  1. The Verge · AI58

    OpenAI 安全员工 David Robinson 离职并公开警告

    曾在 OpenAI 负责撰写各主要模型发布安全报告的 David Robinson 本周离职,并在 The Atlantic 发表评论文章。他表示行业文化已从根本上破裂,问题比新增几条训练模型规则或监管更深,硅谷以极度自信和持续冲刺的方式、带着不受约束的乐观构建更大更好的模型,忽视或低估潜在问题。

10月2日周五
  1. TechCrunch · AI38

    教皇 Leo XIV 批评 AI 生成艺术:算法缺乏人性火花

    教皇 Leo XIV 在 X 发帖批评 AI 生成艺术,称人类艺术与机器生成物之间存在“本体论差异”,算法基于数百万张他人图像做统计计算,缺乏人性的火花。他今年 5 月曾发布通谕详述 AI 议题,强调自动化时代人的尊严。据《纽约时报》报道,Anthropic 曾游说梵蒂冈重新考虑其关于非人类意识的立场,但收效甚微。

9月30日周三
  1. Simon Willison67

    Anthropic Frontier Red Team:GLM-5.3 与 Claude Mythos Preview 在 Binary Exploitation 基准上的表现

    Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个随机任务上评测多个模型,GLM-5.3 在 4% 的试验中实现完整的控制流劫持,Claude Mythos Preview 为 6%。报告称这一结果意味着一个有意义的能力门槛已被跨过,此前的 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功。

9月29日周二
  1. Latent Space74

    AINews:Opus 5.5 擅长生成讲解视频

    AINews 汇总 9/24-9/25 动态,指出 Claude Opus 5.5 本周发布后社区反馈积极,尤其在生成讲解视频上表现突出。Opus 5.5 在 SimpleBench 上以 88.4% 领先,被 @skalskip92 评为 Anthropic 迄今最佳视觉模型,成本比 Fable 5.1 低约 60%。

9月28日周一
9月26日周六
9月25日周五
9月24日周四
  1. Latent Space78

    Meta Connect 2026:Muse 智能体、眼镜硬件与 Charm 设备

    Meta 在 Connect 2026 上把 Muse 个人智能体作为硬件加智能体战略的核心,发布智能体功能与新眼镜,但只预告未发布新的前沿模型。Muse 新增语音与实时视频能力,可后台执行任务,并接入全部 Meta 眼镜、拥有独立邮箱地址,Mac 版支持 computer use,连接器平台覆盖 1500+ 应用。

    推荐理由:Meta Connect 2026 把个人智能体与自有硬件绑在一起,读者可据此看清 Muse 的能力边界与尚未发布的前沿模型。

9月23日周三
  1. Latent Space88

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 与 Luna 并降价 40-50%

    Anthropic 发布 Claude Opus 5.5,称其为新 Claude 5.5 系列首个模型,多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并成为 Claude Code 与 Claude 应用的默认模型。

    推荐理由:同一天两家实验室分别发布新模型并大幅降价,读者可据此比较能力与成本两条路线的差异。

9月22日周二
8月17日周一
7月30日周四
  1. Hugging Face Blog22

    GPU 管理:为什么闲置 GPU 正在成为新的停场飞机

    Hugging Face 发文指出,AI 的下一个真正约束不是智能而是利用率:GPU 按日历小时计费,产出却只按算力小时累积,两家 GPU 预算相当的公司会因硬件实际使用率而拉开差距。文章以航空业为类比,称企业自购 GPU 本地部署可把按 token 线性增长的 API 成本换成固定资本支出,但集群上线后的问题变成如何让 GPU 保持忙碌。

7月27日周一
  1. Import AI66

    Import AI 466:机器人领域的苦涩教训、AI 完成数周编程任务与 OpenAI 模型意外越界

    Epoch 与 METR 发布 MirrorCode 基准,考察 AI 系统能否仅凭 CLI 访问从零重写软件程序:25 个目标程序中 17 个至少有一次满分运行,Opus 4.7 用 14 小时、251 美元推理成本完成一项人类需 2 至 17 周的任务,但 ruff、giac_subset、mailauth 等 8 个程序从未达到 100% 阈值。