OpenAI:先进 AI 或成突破性创意背后的日常执行关键
OpenAI 发文探讨先进 AI 对突破性创意背后日常工作的价值,认为执行环节可能决定下一阶段经济的形态与进步速度。文章未给出具体模型、参数或基准数据。
OpenAI 发文探讨先进 AI 对突破性创意背后日常工作的价值,认为执行环节可能决定下一阶段经济的形态与进步速度。文章未给出具体模型、参数或基准数据。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,但审查力度应随风险分级;Skills 与 MCP 解决不同问题,前者是打包的 Markdown 专业知识,后者是智能体连接工具与数据的标准;RAG 并未消亡,检索能让模型更接近答案并减少 token 浪费。
Hugging Face 发文指出,AI 的下一个真正约束不是智能而是利用率:GPU 按日历小时计费,产出却只按算力小时累积,两家 GPU 预算相当的公司会因硬件实际使用率而拉开差距。文章以航空业为类比,称企业自购 GPU 本地部署可把按 token 线性增长的 API 成本换成固定资本支出,但集群上线后的问题变成如何让 GPU 保持忙碌。
DharmaOCR 在巴西葡萄牙语 OCR 基准上以 0.925 分领先 Mistral OCR4 的 0.798 和 Unlimited-OCR 的 0.7587,尽管后两者发布更晚且资源雄厚。该模型经葡萄牙语监督微调与 DPO 两阶段训练,将全部参数集中于单一语言领域,从而在复杂文档提取质量和推理稳定性上保持结构性优势。
伯克利 EPIC Data Lab 提出近零推理成本时代的三大数据系统挑战:为智能体设计(Data Systems For Agents)、运行智能体(Of Agents)、由智能体构建(By Agents)。GPT-4 级能力从 2023 年初约 $30/百万 token 降至如今不足 $1,部分厂商已低于 $0.10,推理价格年降幅 9x 至 900x、中位数约 50x。
Dharma AI 撰文解读 Goldfeder、Wyder、LeCun 与 Shwartz-Ziv 的 2026 年论文《AI Must Embrace Specialization via Superhuman Adaptable Intelligence》,指出优化理论、演化生物学、竞争市场与机器学习都指向同一结论:在有限资源下,专业化而非通用化才是取得性能优势的路径。
Hugging Face 博客指出,企业级 AI 规模化落地的关键不在 LLM 本身,而在"agent logic"——即运行于 agent 层、可引导 LLM 聚焦企业工作流的软件原语,如知识图谱、算法与程序分析库。
Google DeepMind 与 Google Research 开发的 AI 天气模型 WeatherNext 帮助美国国家飓风中心提前五天预测飓风 Melissa 在牙买加以 Category 5 强度登陆,置信度达 80%,三天前升至接近 100%。
推荐理由:原文给出 WeatherNext 在飓风 Melissa 上的提前五天路径与强度预测细节,可了解 AI 天气模型在极端事件中的实际表现。
Hugging Face 发文讨论 Mythos 与 Project Glasswing 发布后 AI 网络安全格局,指出 Mythos 的能力来自模型、算力、安全脚手架与自主性组成的系统而非单一模型。文章认为开源代码与工具能在检测、验证、协调、补丁传播四个阶段分散风险,避免闭源单点故障,并主张用半自主 AI 智能体在人类可控前提下防御漏洞。
Google DeepMind 回顾 AlphaGo 击败围棋世界冠军十周年,称其“第 37 手”证明了 AI 能超越模仿人类、发现全新策略。
Google DeepMind 发布 2025 年度回顾,梳理 8 大研究突破领域。模型方面,Gemini 2.5 于 3 月发布,Gemini 3 于 11 月推出。
AlphaFold 2 自 2020 年在 CASP 14 上解决蛋白质结构预测难题以来,其免费开放的蛋白质数据库已服务 190 多个国家的超 300 万研究人员,相关工作于 2024 年获诺贝尔化学奖。该模型已被引用超 35,000 篇论文,另有超 200,000 篇论文在方法中融入 AlphaFold 2,独立分析显示使用者提交新型实验蛋白质结构的数量增加超 40%。