跳到正文
  1. 量子位78

    谷歌发布办公 Agent Gemini Agent,支持调用 Claude

    Google Cloud 发布长文介绍 Gemini 在企业 Agent 领域的更新,核心是全新发布的 Gemini Agent,可查资料、写邮件、做 PPT、分析数据、编写运行代码并跨应用调用工具。

    推荐理由:谷歌把办公 Agent 的模型选择、企业身份与四类记忆机制一并公开,可对照 Meta、OpenAI 的路线差异。

  2. 爱范儿78

    微软发布 Surface Laptop Ultra 与混合智能 Windows 更新

    微软在特别发布会上推出 Surface Laptop Ultra,搭载 NVIDIA RTX Spark Superchip,最高 128GB 统一内存,可在本地运行超过 1200 亿参数模型,起价 2599 美元,10 月 7 日开放预订、10 月 16 日发货。

    推荐理由:微软把 Windows 的 AI 能力从 Copilot 入口扩展到本地模型、Agent 容器与算力调度,读者可据此判断 AI PC 的硬件与系统路线变化。

  3. Google Developers Blog71

    Google 发布 AQuA 环境质量智能体,诊断生产环境智能体故障

    Google 发布 AQuA(Ambient Quality Agent),一个在 Google Cloud 项目内旁路运行的质量智能体,按计划、部署后或按需扫描 Cloud Trace、Cloud Logging 或 BigQuery 中的生产轨迹,经采样、评审、聚类、验证、跟踪五阶段流水线输出可验证的故障洞察。

    推荐理由:原文给出 AQuA 的五阶段流水线、成本数据和一次真实多智能体排查案例,可据此判断生产环境智能体质量监控的可行做法。

  4. NVIDIA Blog76

    NVIDIA 与 Microsoft 发布 RTX Spark 笔记本和 Windows 智能体基础设施

    在旧金山举行的 Windows AI and Surface 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,并公布 RTX Spark 笔记本即日开启预售、10 月 16 日开售,紧凑型台式机 11 月上市。

    推荐理由:英伟达与微软把智能体运行所需的系统级容器和本地算力硬件一起端出,读者可据此判断本地智能体落地的软硬件门槛。

  5. Microsoft Research71

    微软开源 Agent Lightning v1.0:3500 行代码的轻量智能体 RL 框架

    微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。

    推荐理由:微软开源 Agent Lightning v1.0,用约 3500 行代码把真实 harness 直接接入 RL 训练,并给出 6000 样本的编码智能体训练结果。

  1. GitHub Copilot Changelog67

    GitHub Copilot 本地沙箱正式可用

    GitHub Copilot 的本地沙箱功能正式可用,覆盖 GitHub Copilot CLI、GitHub Copilot 应用以及使用 Agent Host 的 VS Code 会话。

    推荐理由:官方说明本地沙箱在 CLI、应用与 VS Code 中正式可用,读者可据此了解智能体工作流的权限边界如何落地。

  2. Google AI Blog65

    Google 推出实验性游戏平台 Playground,用提示词即可创建和游玩自定义游戏

    Google 发布实验性游戏平台 Playground,用户通过对话式界面输入提示词即可创建、游玩和分享自定义游戏,无需编程经验。平台基于浏览器,支持手机和笔记本游玩,游戏可设为私密、生成分享链接或发布到 Explore 画廊,部分品类支持排行榜和多人对战。Playground 今日面向美国 18 岁以上用户开放,创建权限按 Google AI 订阅分级,后续将接入 Unity Spark。

    推荐理由:Google 官方发布实验性游戏平台 Playground,读者可了解其提示词生成游戏的能力边界与开放范围。

  3. Unsloth Releases60

    Unsloth 发布 v0.1.903-beta:内置浏览器、EmbeddingGemma 2 与语音克隆

    Unsloth 发布 v0.1.903-beta,在聊天旁加入内置浏览器面板,文件、网页和模型生成的 HTML 都以标签页打开,并支持对页面内容提问。该版本同时支持 Google DeepMind 的多模态嵌入模型 EmbeddingGemma 2,提供 740M 参数版本(纯文本 270M)、100+ 语言和 8K 上下文窗口,代码任务比上一代提升约 14%。

    推荐理由:Unsloth 一次更新同时加入内置浏览器、EmbeddingGemma 2 支持与语音克隆页面,可据此判断本地微调工具链的边界扩展。

  1. Cursor Changelog62

    Cursor 推出本地智能体远程控制功能

    Cursor 上线 Remote Control,用户可在 Cursor iOS app 中查看并回复运行在自己电脑上的本地智能体。该功能默认对除 Enterprise 组织外的所有用户开启,电脑需保持开机联网,可在桌面设置中开启 Keep this computer awake 防止休眠。

    推荐理由:官方说明远程控制本地智能体的开启方式与限制,可据此判断移动端接管本地编码流程的可行性。

  1. GitHub Copilot Changelog60

    GitHub Copilot 周报:新增 Claude Sonnet 5.5 与 GPT-6.1 Sol 等能力

    GitHub Copilot 本周为 Pro、Pro+、Max、Business 和 Enterprise 用户上线 Claude Sonnet 5.5,并为 Pro+、Max、Business 和 Enterprise 用户提供 GPT-6.1 Sol。

    推荐理由:汇总了 Copilot 本周新增模型、动态工作流与桌面自动化能力,可据此判断智能体工作流的可用边界。

  1. JetBrains AI Blog68

    JetBrains 在 IDE 中推出 Air 智能体开发体验 EAP

    JetBrains 在 IDE 中开放 Air 的 Early Access Program,可作为插件从 JetBrains Marketplace 安装,或直接使用 JetBrains IDE 2026.3 EAP 版本。

    推荐理由:JetBrains 官方给出 Air 在 IDE 中的并行会话、云端运行与数据流向说明,可据此判断现有编码工作流会如何变化。

  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试全流程

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃定级交给 LLM 智能体,读者可据此判断自动化安全测试的边界。

  1. Cursor Changelog62

    Cursor 发布 Rollouts 与 Security Review 两个代码上线机器人

    Cursor 发布 Rollouts 和 Security Review 两个机器人,面向代码交付的最后环节,今日起在 Teams 和 Enterprise 套餐提供。

    推荐理由:Cursor 把部署监控与安全审查做成两个 PR 机器人,读者可据此判断代码上线环节的自动化边界。

  1. Zed Blog74

    Zed 发布 Delta 公测版,用线程协作替代 Pull Request

    Zed 团队发布 Delta 公测版,这是一个与智能体协作编码并评审其产出的多人环境,支持 macOS、Linux、Windows 及网页端,移动浏览器也可跟进线程。

    推荐理由:Zed 团队公开了用 Delta 线程替代 PR 的协作方式与自用数据,可据此判断智能体时代代码评审的另一种组织形态。

  1. Sourcegraph Blog66

    Sourcegraph 推出 Agentic Batch Changes,跨仓库代码变更由智能体编排

    Sourcegraph 发布 Agentic Batch Changes,基于 Batch Changes 与 Deep Search 构建,用户用自然语言描述变更后,智能体在索引代码库中划定范围、制定计划、先在单个仓库试改再逐步铺开,仓库差异时自动适配,CI 失败时继续处理,直到 PR 可供人工审查合并。

    推荐理由:Sourcegraph 把批量代码变更交给智能体编排,并给出按合并结果计费的方式,可观察大规模迁移的落地路径。

  1. Cursor Changelog85

    Cursor 推出 Projects,用协调者智能体管理长期开发任务

    Cursor 发布 Projects 功能,用于承接功能开发、迁移或完整应用等更大规模的工作,可跨数月保持上下文、把任务分派给数千个子智能体,并在无需提示的情况下执行周期性工作。

    推荐理由:原文说明了协调者智能体如何拆分任务、共享上下文并常驻云端,可据此判断长周期开发工作流的组织方式。

  1. Cursor Changelog74

    Cursor 推出自托管机器,工具执行留在自有网络

    Cursor 上线 self-hosted machines,让工具执行完全留在用户自己的网络内,代码库、构建产物和密钥都保存在自有基础设施的机器上,由智能体在本地处理工具调用。

    推荐理由:Cursor 把智能体的工具执行放进企业自有网络,读者可据此判断代码与密钥不出内网的落地方式。

  1. Mistral AI71

    Mistral 发布 Agentic Search 检索层,FinanceBench 准确率提升至 86%

    Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、检查和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries。

    推荐理由:原文给出多步检索循环在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可据此判断传统 one-shot RAG 的边界。

  1. Cursor Changelog73

    Cursor 更新云智能体与 Harness,新增订阅、/goal 与独立子智能体环境

    Cursor 发布云智能体与 Cursor harness 更新,让常驻智能体可自动响应事件、保持目标并完成长会话任务。新增 Subscriptions 让云智能体监控 PR、Slack 线程或定时任务,并自动订阅自己创建的 PR 直至完成;子智能体可运行在各自独立的虚拟机环境中。此外还加入 Custom Modes、/goal 长周期目标指令,以及不打断智能体的 Steering 改进。

    推荐理由:官方更新列出云智能体的订阅、目标保持与子智能体独立环境等能力,可据此判断常驻智能体工作流的变化。

  1. Cursor Changelog71

    Cursor 推出 Origin 代码托管,进入早期 beta

    Cursor 上线 Origin 代码托管,今日起面向所有付费方案开放早期 beta,企业组织管理员可选择退出。首批功能包括仓库、Pull Request、代码浏览和 GitHub 同步,Origin 托管的仓库以 Origin 为唯一来源,同步的 GitHub 仓库仍以 GitHub 为准,PR 评论双向同步。

    推荐理由:Cursor 把代码托管、PR 与智能体放进同一入口,读者可据此判断它与 GitHub 的分工边界。