跳到正文
今天10月9日周五3 条
  1. AWS Machine Learning Blog38

    Cornerstone OnDemand 如何用 Amazon Bedrock 将数据库诊断时间缩短 78%

    Cornerstone OnDemand 基于 Amazon Bedrock 和 Strands Agents 构建多智能体系统 Orion AI,将数据库诊断时间从 45 分钟降至 10 分钟,减少 78%。该系统还把手动生命周期步骤从 10 步以上压缩为 1 次交互(减少 70%),并将冗余告警中位数削减 65%。三人团队用六个月完成交付。

  2. Claude Code Releases12

    Claude Code v2.1.295 发布

    Claude Code v2.1.295 为 command 和 HTTP hooks 新增 onFailure: "block",使无法启动、超时或异常退出的 hook 直接阻断操作;同时加入 Program Status Protocol(OSC 7501)支持,终端可显示 Claude Code 正在工作、等待用户还是已完成。

10月8日周四
10月7日周三
  1. Claude Code Releases17

    Claude Code v2.1.292 发布:新增插件市场安装与 Agent effort 参数

    Claude Code 发布 v2.1.292,为 claude plugin install 新增 --marketplace 参数,可在同一策略校验下自动添加市场并安装插件;Agent 工具新增 effort 参数,可指定子智能体的推理投入等级。本次还修复了沙箱读取、权限提示绕过、MCP 工具名超 128 字符导致请求失败等多项安全与稳定性问题。

10月4日周日
  1. Hugging Face Blog71

    微软与 Hugging Face 发布 ThinkingBox:按数据库终态给 AI 智能体打分

    微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,它让智能体在隔离的 MCP 工具会话中运行,只根据最终后端状态和副作用打分,而不是看模型生成的文字。

    推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用数据库终态而非模型自述来判定成败,并给出 20 次重复下的可靠性数据。

10月3日周六
  1. Claude Code Releases12

    Claude Code v2.1.288 发布

    Claude Code v2.1.288 新增 $.ui.selection() 接口,可返回全屏模式下最近选中的文本;/code-review 支持 --max-findings 参数调整报告数量,并新增 Ctrl+F 按名称查找会话、Alt+↑/↓ 在 agents 视图分组间跳转。

10月2日周五
  1. OpenAI Agents SDK Releases10

    OpenAI Agents SDK v0.23.0 发布

    OpenAI Agents SDK 发布 v0.23.0,新增 MCP 列表页限制配置、沙箱 Docker 删除保护和内存整合轮次配置,以及可选的加密历史扫描预算。该版本还修复了智能体工具流式回调积压、嵌套工具状态隔离、工具失败详情脱敏等问题,并升级多项依赖。

9月26日周六
9月25日周五
  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试全流程

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃定级交给 LLM 智能体,读者可据此判断自动化安全测试的边界。

9月24日周四
  1. Google Developers Blog66

    Google Cloud API Gateway 支持将 REST API 转为 MCP 工具

    Google Cloud API Gateway 进入 Public Preview,可作为远程 MCP 服务器,在已有 OpenAPI 3.0.x 或 3.1.x 规范上通过 x-google-api-management.mcp 注解,把现有 REST 操作暴露为智能体可调用的 MCP 工具,无需另建服务器。

    推荐理由:原文给出把现有 REST API 直接暴露为 MCP 工具的具体配置步骤与限制,可据此评估改造成本。

9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解五大 AI 热梗:该不该读 AI 生成的代码、RAG 已死、Skills 杀死 MCP?

    GitHub Podcast 最新一期拆解了五个 AI 热门论断:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的 Markdown 专家经验,后者是连接工具与数据的标准协议,二者可组合使用;RAG 并未消亡,检索能为模型提供训练数据之外的相关信息,减少 token 浪费并降低答案不完整的概率。

9月2日周三
8月19日周三
8月3日周一
  1. JetBrains AI Blog60

    JetBrains 开放 Central CLI 早期访问,用 AI credits 管控第三方 Agent 开销

    JetBrains 在 2026 上半年 AI 开发支出增长约 10 倍后,把内部调试用的 CLI 包装器做成 JetBrains Central CLI,并于 7 月 8 日开放早期访问,任何拥有 JetBrains AI credits 的个人或组织均可使用。

    推荐理由:JetBrains 公开了内部 AI 成本治理的完整路径,从失控到自研 CLI 再到开放早期访问,可对照自身团队的多工具开销问题。

7月31日周五
  1. Sourcegraph Blog28

    如何在自有代码库上评估 Sourcegraph

    Sourcegraph 给出了一套在自有代码库上评估其 MCP server 的方法:在 288 个任务中,结构化检索把文件级 F1 从 0.091 提升到 0.240、recall 从 0.120 提升到 0.272,但整体任务完成奖励基本不变。成本则因任务而异,基线智能体广泛搜索时节省 15% 至 51%,基线仅需七次以内搜索即可定位时平均多花 $0.15。

7月29日周三
  1. MCP 规范 Releases22

    MCP 规范 2026-07-28 RC 发布

    Model Context Protocol(MCP)发布 2026-07-28 候选版本(RC),规范以草案形式提供,详细变更见 2026-07-28 草案更新日志。该版本并非最终版,RC 与正式版之间可能仍有改动,各 SDK 将按自身节奏适配,旧版规范可能继续使用一段时间。客户端与服务器可通过版本协商文档确定所用协议版本。

7月23日周四
  1. Sourcegraph Blog40

    Sourcegraph 推出 Code Finder:为编程智能体提供快速高效的代码搜索

    Sourcegraph 在 MCP server 中上线智能体搜索工具 Code Finder,它自行运行搜索循环,直接返回匹配的文件路径、行范围和用途说明。基准测试显示,Code Finder 比使用本地搜索工具的编程智能体快 2 倍以上,比调用其 MCP 工具的智能体成本低最多 40%,结果质量相当。该工具已通过 MCP 正式可用,并为 Deep Search 提供文件发现能力。

7月22日周三
  1. JetBrains AI Blog62

    JetBrains Air 更新:接入更多智能体、本地模型与 Java/Kotlin 代码智能

    JetBrains Air 新版本通过 JetBrains 与 Zed 开发的 Agent Client Protocol(ACP)接入 GitHub Copilot、OpenCode、Pi、Cline 等兼容智能体,此前该工作流仅限 Air 自带的 Claude、Codex、Gemini CLI 和 Junie。

    推荐理由:Air 通过 ACP 接入多家编码智能体并支持本地模型,读者可据此判断企业既有工具能否纳入同一工作流。

7月5日周日
6月23日周二
6月9日周二
1月27日周二
12月4日周四