跳到正文

#Agent

今日 1 条
今天10月5日周一
  1. The Decoder31

    DeepMind 研究人员提出“人工共生智能”,作为奇点理论的替代方案

    DeepMind 研究人员提出“人工共生智能”概念,主张 AI 研究的核心挑战是协调由智能体、人和连接系统组成的复杂网络,而非构建孤立的机器智能。该观点基于对 DeepSeek-R1、QwQ-32B 等推理模型的分析,发现其推理轨迹会自发出现内部辩论、转换视角和调和冲突的多视角行为,且这种行为在训练中涌现而非显式编程。

10月4日周日
  1. Simon Willison38

    Simon Willison:按量付费服务需要默认硬性预算上限,AWS 已推出支出限额

    Simon Willison 呼吁按量付费的 API 和服务默认设置硬性预算上限,超过 $X/月即切断并返回错误,而非仅发警告邮件。他指出 AWS 在 9 月 16 日推出月度支出限额功能,项目达到限额后当月暂停,但该新体验目前仅向有限客户开放;Google Cloud 已于 7 月推出类似的 Spend Caps。

10月2日周五
  1. MIT Technology Review · AI12

    MIT Technology Review 报告:自主 AI 如何重塑企业智能

    MIT Technology Review 发布报告,提出企业 AI 正从工具转向“智能体式转变”(agentic shift)这一运营模式。报告指出 2026 年全球 AI 投资将达 2.5 万亿美元、同比增长 44%,但多数企业仍未能靠 AI 增长收入,症结在于数据孤岛与架构僵化。报告建议以流程重构为先,转向可组合架构,并在数据原地查询的自主可控基础上让 AI 智能体可靠行动。

  2. The Verge · AI38

    AI 幻觉让"顾客永远是对的"变得更糟:服务员、护林员、幼教都在被 ChatGPT 反驳

    生成式 AI 的普及正在改写"顾客永远是对的":纽约服务员 Madison 称有客人以 ChatGPT 为由否认菜品含贝类过敏原,还有人拒绝侍酒师、改问 ChatGPT,甚至点出不存在的酒。Meta 新 AI 智能体 Muse 的推出可能加剧这一问题,影院、Apple Store 员工及护林员、幼教也遇到客人拿 AI 幻觉当依据的情况。

10月1日周四
9月29日周二
9月28日周一
9月24日周四
9月23日周三
9月22日周二
9月21日周一
9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解 AI 热门观点:该不该读 AI 生成的代码、RAG 是否已死、Skills 是否杀死了 MCP

    GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,但审查力度应随风险分级;Skills 与 MCP 解决不同问题,前者是打包的 Markdown 专业知识,后者是智能体连接工具与数据的标准;RAG 并未消亡,检索能让模型更接近答案并减少 token 浪费。

8月31日周一
8月14日周五
  1. Hugging Face Blog62

    Hugging Face 发布 2026 夏季开源模型观察报告

    Hugging Face 发布 2026 年 1 月至 8 月的开源模型生态观察报告,基于 Hub 数据给出六项发现。报告显示模型仓库从 243 万增至 296 万,数据集从 71.1 万增至 100 万,Spaces 从 100 万增至 144 万;85.6% 的模型终身下载量不足 200 次,1.5% 的仓库占据 99.2% 的下载量。

    推荐理由:Hugging Face 用 Hub 七个月数据拆解开源模型格局,可看到中美模型规模、下载与点赞背离及智能体流量变化。

7月7日周二
  1. Berkeley AI Research38

    智能免费之后怎么办?面向智能体、由智能体运行、由智能体构建的数据系统

    伯克利 EPIC Data Lab 提出近零推理成本时代的三大数据系统挑战:为智能体设计(Data Systems For Agents)、运行智能体(Of Agents)、由智能体构建(By Agents)。GPT-4 级能力从 2023 年初约 $30/百万 token 降至如今不足 $1,部分厂商已低于 $0.10,推理价格年降幅 9x 至 900x、中位数约 50x。

6月1日周一
4月21日周二
  1. Hugging Face Blog38

    AI 与网络安全的未来:为什么开放性至关重要

    Hugging Face 发文讨论 Mythos 与 Project Glasswing 发布后 AI 网络安全格局,指出 Mythos 的能力来自模型、算力、安全脚手架与自主性组成的系统而非单一模型。文章认为开源代码与工具能在检测、验证、协调、补丁传播四个阶段分散风险,避免闭源单点故障,并主张用半自主 AI 智能体在人类可控前提下防御漏洞。