跳到正文
10月2日周五
  1. Hugging Face Blog36

    ServiceNow CoreAI 推出 AutoSynthData:为企业智能体生成训练数据

    ServiceNow CoreAI 构建了 AutoSynthData,利用目标模型的失败案例与更强教师的成功示范,自动生成并验证新的可执行训练任务,并随模型进步动态调整课程。该流程以 EnterpriseOps Gym 数据集为例演示,生成的任务需满足可行性、真实性与难度三项要求,验证器则需保证一致性、可靠性与完整性。

  2. NVIDIA Blog78

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI 在 API 以及符合条件的 ChatGPT Work 和 Codex 用户中上线 GPT-6 Astra Ultrafast,该模式运行在 NVIDIA Blackwell GPU 上,token 生成速度最高可达 Astra Standard 模式的 8 倍。

    推荐理由:原文给出 Ultrafast 模式相对标准模式的生成速度提升与开放入口,读者可据此判断它对编码智能体循环的实际影响。

10月1日周四
  1. Claude Agent SDK Releases8

    Claude Agent SDK v0.2.163 发布

    Claude Agent SDK 发布 v0.2.163,内置 Claude CLI 更新至 2.1.286。该版本将 issue 分诊所用模型固定,以修复 CLI 新默认模型导致的失败,并可通过 pip install claude-agent-sdk==0.2.163 从 PyPI 安装。

9月30日周三
9月29日周二
  1. TRL Releases12

    TRL v1.14.1 发布

    TRL 发布 v1.14.1,修复了 vLLM 0.20 至 0.25 上首次权重同步时的 server 模式崩溃问题。该版本还修复了 vLLM server 模式下工具调用后每个样本只生成一个 completion 的问题,并让 CLI 脚本保留显式的 model_init_kwargs、正确响应 resume_from_checkpoint。

  2. CrewAI Releases20

    CrewAI 1.15.23 发布:新增 Gemini 3.8 Flash 支持与 crewai eval 评估能力

    CrewAI 发布 1.15.23,新增对 Gemini 3.8 Flash 的原生支持,并让 crewai eval 通过 AMP 评估最近一次追踪运行、记录而非打印结果。该版本还优化了平台集成设置体验、优先展示热门集成,并修复了追踪面板可见性、TUI 评估按钮、Bedrock 同步调用回退及 SQLite 连接关闭等问题。

9月28日周一
  1. LMDeploy Releases22

    LMDeploy v0.18.0 发布

    LMDeploy 发布 v0.18.0,新增输出与输入 logprobs 支持,并扩展 SM90 量化 GEMM、统一 TurboMind 线性执行。该版本为昇腾支持 glm52、为 qwen3.5 支持 dflash,同时加入 PyTorch 版 TurboMind W4A16 AWQ 线性后端原型与分段 CUDA graph 预填充。

9月27日周日
9月26日周六
9月25日周五
9月24日周四
  1. Google Developers Blog66

    Google Cloud API Gateway 支持将 REST API 转为 MCP 工具

    Google Cloud API Gateway 进入 Public Preview,可作为远程 MCP 服务器,在已有 OpenAPI 3.0.x 或 3.1.x 规范上通过 x-google-api-management.mcp 注解,把现有 REST 操作暴露为智能体可调用的 MCP 工具,无需另建服务器。

    推荐理由:原文给出把现有 REST API 直接暴露为 MCP 工具的具体配置步骤与限制,可据此评估改造成本。

  2. GitHub Blog · AI & ML28

    GitHub Copilot 应用如何渲染超大 pull request

    GitHub Copilot 应用重建了 pull request 视图,以应对超大 diff 与评论带来的渲染压力,实测对象是一个包含 2,200 个文件、超 100 万行改动和 400 多条行内评论的开源 pull request。方案将文档高度拆成确定性的代码几何与动态块几何两部分:代码行高可提前精确计算,评论、草稿和回复框则按块惰性测量,并锚定到文件、行号和侧别而非像素坐标。

  3. Microsoft Research62

    微软研究院:把物理 AI 推理卸载到边缘或云端可提升机器人性能与续航

    微软研究院对移动操作机器人工作负载做了首次系统性测量,发现把物理 AI 推理从机器人端侧 GPU 卸载到边缘或云端 GPU 可提升任务成功率、支持更大模型并延长续航。

    推荐理由:微软研究院系统测量了机器人端侧 GPU 推理的瓶颈,并给出可复用的 Kubernetes 卸载工具链,读者可据此判断物理 AI 的部署取舍。

  4. Google DeepMind62

    Google DeepMind 为 Private AI Compute 引入安全服务端持久记忆

    Google Private AI Compute 团队公布为 Private AI Compute 平台引入私有服务端记忆的技术方案,让云端 AI 在跨设备场景下持久保留上下文,同时维持端侧级隐私标准。

    推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端 AI 如何在保留跨设备上下文的同时维持端侧级隐私。

9月23日周三
  1. Claude Agent SDK Releases20

    Claude Agent SDK v0.2.158 发布:新增 verbatim_prompts 选项

    Claude Agent SDK v0.2.158 新增 ClaudeAgentOptions.verbatim_prompts 选项(默认 False),开启后用户消息原样传给 CLI,不做 @path 文件展开和斜杠命令分发,可防止提示词中内联的不可信文本触发意外文件读取或命令执行。该选项需 CLI 2.1.248+,旧版本会记录警告,并已内置更新至 Claude CLI 2.1.280。

9月21日周一
  1. Sourcegraph Blog22

    Sourcegraph:自主代码库才是 AI 编程的下一步

    Sourcegraph 认为,AI 编程已把 prompt-to-PR 流程打磨到极致,但大型企业存量代码库的维护仍完全未解决。作者提出"自主代码库"构想:由触发器(定时任务、新 CVE、生产日志异常等)驱动可调用的智能体函数(全库 Deep Search、推送 PR、批量变更),组成确定性有向图工作流。未来企业将转向范围更窄、授权更小的智能体组合,而非继续泛化通用 harness。

9月19日周六
9月18日周五
9月17日周四
  1. JetBrains AI Blog40

    JetBrains 如何为语义代码搜索构建 RAG 流水线:解析、分块与向量化

    JetBrains 分享了其语义代码搜索平台 Air Context 的 RAG 流水线构建经验,首篇聚焦解析、分块与向量化。团队指出固定行数分块会把 import 语句和函数内容等无关代码混在一起导致检索错误,因此采用基于解析器的结构感知分块,利用 Java 等语言的类结构约定划分语义单元。该平台旨在让 LLM 智能体按语义而非关键词检索代码,获得可引用的仓库证据。

  2. CrewAI Releases15

    CrewAI 1.15.22 发布:支持连接别名与 OpenRouter 嵌入

    CrewAI 发布 1.15.22,新增连接标识符别名支持,并将 OpenRouter 纳入支持的嵌入向量提供商。该版本在 crew 搭建阶段校验平台集成,向 JSON crew 向导添加平台工具,并公开 CrewAI Platform 应用目录。此外还修复了 Azure 流式工具调用按 wire index 归类、Gemini 文件数据内容保留等问题。