开源工具 BootLoops 支持 AI 模型完成精确科学计算
哈佛大学物理学家 Matthew Schwartz 在 Anthropic 客座文章中介绍开源工具 BootLoops,它让 Claude 完成精确科学计算,源码已在 GitHub 发布。
哈佛大学物理学家 Matthew Schwartz 在 Anthropic 客座文章中介绍开源工具 BootLoops,它让 Claude 完成精确科学计算,源码已在 GitHub 发布。
Meta 宣布开源项目 Muse Gadgets,提供 ESP32 开发板固件和 Linux SDK,让爱好者把自制设备接入其 AI 智能体 Muse,代码采用 Apache 2.0 许可,并设有 Discord 社区讨论。
一批 AI 智能体无需下载新 App,直接通过 iMessage、RCS、SMS、WhatsApp 等短信通道接收任务,可记忆上下文、连接已有应用并代为完成预约、订票、发邮件等操作。
Meta 推出开源项目 Muse Gadgets,提供开源固件和 Linux SDK,让开发者用 Raspberry Pi 或 ESP32 等低成本硬件搭建接入个人 AI 智能体 Muse 的设备,并给出彩色电子墨水屏、HDMI 电视棒等项目思路,还开设了 Discord 频道。
Meta 开源了相关代码,允许用户自制搭载其新 AI 智能体的 Muse 硬件,官方建议用 ESP32 开发板或 Raspberry Pi 配合其 SDK,连接屏幕、按钮和传感器等外设。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备端运行。
推荐理由:原文给出 64GB 新配置的定价、上市时间与双机集群方式,读者可据此判断本地跑大模型的硬件门槛。
Earendil 旗下的 Pi 发布 Pi 1.0 与 Pi Durable,两者同时登上 Hacker News 首页。Pi 1.0 带来 Codemode(原生支持 MCP、Jev 和图像模型)、虚拟模型扩展支持、延迟工具加载、Anthropic 模型缓存预热、对话中途系统消息、新 TUI 主题以及默认全屏模式。
Chatham Financial 使用 Codex 和 GPT-5.6 构建技术并重新设计工作流程,将交易验证时间从 30 分钟缩短到 4 分钟以内。
OpenAI 的 GPT-6 Astra Ultrafast 已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户中开放,运行在 NVIDIA Blackwell GPU 上,token 生成速度最高可达 Astra Standard 模式的 8 倍。
推荐理由:原文给出 Ultrafast 模式相对标准模式的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。
Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,不再依赖构建时的静态快照。该功能支持 SPICE 和 Direct Query 两种数据集模式,查询以查看者身份执行,自动沿用现有行级与列级安全规则,每位查看者首次使用需按数据集授权,且不支持匿名或公开访问。
OpenAI 宣布在全球范围上线两项 ChatGPT 购物功能:虚拟试穿和收藏。用户可上传自拍或全身照,在购物结果中通过新的 Try On 按钮查看衣服或配饰的上身效果,也可上传网页截图等商品图片让 ChatGPT 试穿;收藏功能则把用户发现的产品保存到应用内的 Library,与试穿图片存放在一起。
Amazon Quick Sight 发布层级筛选器,可将 Region、Country、City 等多个关联字段合并到一个紧凑控件中,支持最多五级层级,读者按逻辑路径逐级下钻,无需面对大量独立筛选器。该功能支持跨层级混选(如同时选中整个日本和纽约市),并可跨工作表作用于整个仪表板。
Albertsons 正使用 ChatGPT Enterprise 和 OpenAI API 帮助团队加快工作速度,并让数百万顾客的购物体验更轻松。
社交俱乐部 The Den 在新店开业之际,用 ChatGPT Work 将拨款申请的准备时间从 3 天缩短到 2 小时,酒牌材料从 4 天缩短到 3 小时,每周因此省出 10-15 小时用于业务增长。
Latent Space 在 OpenAI 开发者日直播后采访了负责 Computer Use 产品与工程的 Ari Weinstein 和 API 产品负责人 Nikunj Handa,两人介绍了 Dots、GPT-6.1 Sol、Agents API 与 Decisions API 等发布。
Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解其如何在不影响蛋白功能的前提下嵌入可验证信号。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,成为首批交付该平台的云厂商之一,Cognition 是首个在生产环境运行 Vera Rubin 的客户。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,读者可据此判断智能体推理的算力成本走向。
Amazon Bedrock 在印度上线 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让数据在印度境内处理。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5 进行区域内推理,请求与数据全程不出该 Region。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,是 GPT-6 Sol 的重大升级,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。
推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比。
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,全程在本地运行。
Condé Nast 联合 AWS 生成式 AI 创新中心,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,并选用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。该方案将单次内容检索耗时从 250 分钟降至 2 分钟以内,覆盖超 14 万条视频,支持自然语言意图搜索、以图搜视频和精确时间戳定位。
OpenAI 回顾 DevDay 2026 的 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。
GitHub Copilot 应用推出 canvases(画布扩展),一种用户与智能体共享的可定制界面,可做成看板、发布清单或仪表盘。在 agent 会话中输入 /create-canvas 并用自然语言描述工作流,无需编码即可生成界面,画布双向同步,智能体与用户可同时修改。画布保存为扩展,可随项目共享或作为个人扩展复用,Awesome Copilot 已提供现成模板。
Runway 推出 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并提出新的输入格式 WorldPrompt,可固定环境部分要素(含首帧)后生成带时间戳的事件与动作。
GitHub Copilot 提出用 canvas 替代 chat 作为与 AI 交互的主要界面。canvas 是运行在 GitHub Copilot 应用内的全栈小应用,可与 agent 双向通信,也能调用第三方 API 或在本地执行代码,例如管理 Winget 包、操作 SQLite 数据库。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可据此判断自动化安全测试的边界。
Remedy Entertainment 的 CONTROL Resonant 已在 GeForce NOW 首发上线,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
Google Private AI Compute 团队公布 Private AI Compute 架构更新,将为其平台带来私有化的服务端持久记忆,实现跨设备的长期上下文延续,同时保持端侧级别的隐私标准。
推荐理由:Google 给出云端持久记忆的加密与验证方案,读者可据此判断跨设备 AI 助手隐私架构的走向。
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持,现已免费开源。
推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出多家厂商的落地案例,可据此判断物理 AI 开发方式的变化。
Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化 checkpoint,通过 from_pretrained 传入 gguf_file 在本地生成,无需额外配置。
推荐理由:Hugging Face 官方给出在 transformers 中直接加载 GGUF 的用法与性能对比,可据此判断本地推理工作流是否值得迁移。
TypeSafe AI 发布首个大型可编程模型 Jev,定位为面向代码消费的 System 1 模型,按每美元智能优化,而非面向聊天的指令跟随模型。
Hugging Face 发布 tokenizers v1,输出与 v0.23 完全一致的 token ID,但速度最高提升数十倍。v1 将单个 crate 拆分为工作区,引入 bitcannon 用 SIMD 位流替代正则做预分词、无分配合并循环、线程本地词缓存和原生多线程并行。
Pawprint Studio 的开放世界捉宠 RPG《Aniimo》首发即登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck 和新增支持的 Firefox 浏览器等设备上串流游玩。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并接入 GPT-6 Astra,用于研究、建模和生成可直接交付客户的材料。
推荐理由:OpenAI 面向金融行业推出专用 ChatGPT,内置金融数据并接入 GPT-6 Astra,可据此判断其行业落地方向。
Google DeepMind 推出 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍,已通过免费网站门户向学术研究开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单碱基变异的预测结果做成可检索资源,读者可了解它对变异解读流程的改变。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,并更贴近用户原本的构想。
推荐理由:官方给出 ChatGPT Images 2.5 的输入类型与输出定位,可据此判断图像生成能力的变化方向。
GitHub 发布研究预览 Project HydraFusion,通过运行时多模型编排为每个任务选择执行方案,用户可在 GitHub Copilot CLI 中通过 /experimental 启用,按各模型标准费率计费。
推荐理由:GitHub 官方给出多模型编排的三种执行模式与三项基准的成本质量对比,可据此判断自动路由在编码任务中的取舍。
Hugging Face 发布 funes,一个为 Claude Code、Codex、pi、Hermes 等编码智能体提供持久记忆的本地记忆层,单条命令即可接入。
推荐理由:原文给出跨 Claude Code、Codex 等智能体的本地记忆层设计与 handoff-vs-recall 基准对比,可据此判断会话记忆的落地方式。
Google DeepMind 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender harness,用于自主发现、验证并修复漏洞。
推荐理由:原文给出受限访问计划的能力组合与准入条件,读者可据此判断前沿网络防御能力的开放节奏。