LangGraph 1.2.13 发布
LangGraph 发布 1.2.13,集中修复 DeltaChannel 相关缺陷:不再为从未写入的 DeltaChannel 遍历历史,避免将废弃分支重放到 DeltaChannel fork,并在各 update_state 路径上保留 DeltaChannel 计数器。
LangGraph 发布 1.2.13,集中修复 DeltaChannel 相关缺陷:不再为从未写入的 DeltaChannel 遍历历史,避免将废弃分支重放到 DeltaChannel fork,并在各 update_state 路径上保留 DeltaChannel 计数器。
DeepSpeed 合并 PR #8497,为连续批处理 rollout 新增可选的 decode front 对齐路径:开启 align_decode_fronts 后按 attention mask 推导有效 prompt 长度、从长到短排序并右对齐 prefill,同时裁剪无效 cache 列,默认仍保持等宽填充布局。
Claude Code v2.1.289 修复了复合 shell 命令嵌套部分的 deny/ask 规则在托管机器上覆盖用户安装 mod 审批的问题,并解决了短代码块含大量未闭合标签或深层嵌套 ${} 替换时终端卡死。
vLLM 发布 v0.31.0rc5,在 requirements 中为 Transformers 版本添加了上限约束。该改动由 Isotr0py 提交、Harry Mellor 共同署名,并从主分支 cherry-pick 而来。
Claude Code v2.1.288 新增 $.ui.selection() 接口,可返回全屏模式下最近选中的文本;/code-review 支持 --max-findings 参数调整报告数量,并新增 Ctrl+F 按名称查找会话、Alt+↑/↓ 在 agents 视图分组间跳转。
SGLang 发布 v0.5.21,合并 227 位贡献者的 779 个 PR,新增 DeepSeek-V4.1 Flash、GigaChat 3.5、MiMo-V2.6、Qwen-Image 2.1、FLUX 3 Action 等模型支持。
GitHub Copilot 代码审查现已支持通过 REST 和 GraphQL API 发起请求,并可为每次请求单独设置审查强度。默认审查强度已改为 Balanced,于 2026 年 9 月 28 日生效,此前显式选择 Lite 的设置保持不变。该功能已面向 Copilot Pro、Pro+、Max、Business 和 Enterprise 计划全面开放。
GitHub Copilot 于 2026 年 10 月 2 日在所有体验中弃用 Gemini 3.5 Flash、Gemini 3.6 Flash、Kimi K2.7 Code 和 Claude Opus 4.7,建议分别改用 Gemini 3.8 Flash、Kimi K3 和 Claude Opus 5.5。
OpenAI Agents SDK 发布 v0.23.1 补丁版本,修复发布测试并刷新必需的 readiness 检查,SDK 运行时源码相对 v0.23.0 仅改动版本号字符串。
GitHub Copilot 本周为 Pro、Pro+、Max、Business 和 Enterprise 用户上线 Claude Sonnet 5.5,并为 Pro+、Max、Business 和 Enterprise 用户提供 GPT-6.1 Sol。
推荐理由:汇总了 Copilot 本周新增模型、动态工作流与桌面自动化能力,可据此判断智能体工作流的可用边界。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备端运行。
推荐理由:原文给出 64GB 新配置的定价、上市时间与双机集群方式,读者可据此判断本地跑大模型的硬件门槛。
vLLM 发布 v0.31.0rc4,修复了 HiSparse 在 FULL graphs 下 MTP 接受率崩溃的问题。该版本为候选发布版,主要针对上述 bug 进行修补。
Unsloth Desktop 新增 Cmd/Ctrl+P 命令面板,支持分享 GGUF 运行设置,并让 Laya 决策模型短请求提速最高 4.1 倍。
OpenAI Agents SDK 发布 v0.23.0,新增 MCP 列表页限制配置、沙箱 Docker 删除保护和内存整合轮次配置,以及可选的加密历史扫描预算。该版本还修复了智能体工具流式回调积压、嵌套工具状态隔离、工具失败详情脱敏等问题,并升级多项依赖。
OpenAI 在 API 以及符合条件的 ChatGPT Work 和 Codex 用户中上线 GPT-6 Astra Ultrafast,该模式运行在 NVIDIA Blackwell GPU 上,token 生成速度最高可达 Astra Standard 模式的 8 倍。
推荐理由:原文给出 Ultrafast 模式相对标准模式的生成速度提升与开放入口,读者可据此判断它对编码智能体循环的实际影响。
JetBrains 在 IDE 中开放 Air 的 Early Access Program,可作为插件从 JetBrains Marketplace 安装,或直接使用 JetBrains IDE 2026.3 EAP 版本。
推荐理由:JetBrains 官方给出 Air 在 IDE 中的并行会话、云端运行与数据流向说明,可据此判断现有编码工作流会如何变化。
Unsloth 发布 v0.1.901-beta,其 Studio 针对链接文件夹中的相同文件复用嵌入向量以提升性能。该版本提交已在 GitHub 上通过验证签名。
vLLM 发布 v0.31.0rc3,为 Model Runner V2 加入随机化 dummy inputs 支持(#58411)。该改动由 Robert Shaw 提交,并经 Claude Opus 5.5 等共同署名,属于候选版本更新。
Claude Agent SDK 发布 v0.2.163,内置 Claude CLI 更新至 2.1.286。该版本将 issue 分诊所用模型固定,以修复 CLI 新默认模型导致的失败,并可通过 pip install claude-agent-sdk==0.2.163 从 PyPI 安装。
Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解其在 DNA 合成筛查与数据库标注上的验证思路。
Axolotl v0.20.0 发布,自 v0.19.0 以来累计 67 个 commit,新增 GGUF 导出、Ringmaster 上下文并行、原生 NVFP4 LoRA 和无 DeepEP 的专家并行。
vLLM 发布 vllm-proto 0.4.0,对应标签 proto-v0.4.0(提交 f28a508),该标签已通过提交者签名验证。此次发布附带 2 个资源文件。
vLLM 发布 v0.31.0rc2,修复 Mamba 在稀疏场景下 prompt-end prefill checkpoint 的保留问题。该版本为候选发布版,主要针对 Mamba 相关 bug 进行修正。
TRL 发布 v1.14.1,修复了 vLLM 0.20 至 0.25 上首次权重同步时的 server 模式崩溃问题。该版本还修复了 vLLM server 模式下工具调用后每个样本只生成一个 completion 的问题,并让 CLI 脚本保留显式的 model_init_kwargs、正确响应 resume_from_checkpoint。
Unsloth 新增决策模型支持,可在本地运行 Laya(开源 Jev)回答是/否、多选和评分问题并输出概率,通过 Settings > API 启用 Decision API,支持 TypeSafe SDK 的 Jev 兼容 /v1/systemone 端点。
TensorRT-LLM 发布 v1.3.0rc29,新增对 Qwen3.5 全局 FP8 权重、Kimi K3 NVFP4 SiTU 的 CuTeDSL MoE 后端以及 DeepSeek V4 NVFP4 MLA 残差开关的支持。
PEFT 发布 v0.21.1,使 Tensor Parallel(TP)能够与 PEFT 正常配合工作,需搭配 Transformers ≥ 5.17.0 使用。该版本为小型更新,包含 #3614、#3790 两项改动。
CrewAI 发布 1.15.23,新增对 Gemini 3.8 Flash 的原生支持,并让 crewai eval 通过 AMP 评估最近一次追踪运行、记录而非打印结果。该版本还优化了平台集成设置体验、优先展示热门集成,并修复了追踪面板可见性、TUI 评估按钮、Bedrock 同步调用回退及 SQLite 连接关闭等问题。
LMDeploy 发布 v0.18.0,新增输出与输入 logprobs 支持,并扩展 SM90 量化 GEMM、统一 TurboMind 线性执行。该版本为昇腾支持 glm52、为 qwen3.5 支持 dflash,同时加入 PyTorch 版 TurboMind W4A16 AWQ 线性后端原型与分段 CUDA graph 预填充。
Unsloth 发布面向 Linux x86_64、CUDA 13 的预编译 wheel,涵盖 flash-attn 2.8.4、causal-conv1d 1.7.0 和 mamba-ssm 2.3.2.post1,基于 PyTorch 2.13 与 2.14、Python 3.13 构建。
Claude Agent SDK 发布 v0.2.160,修复后台子智能体在轮次结果到达前完成时 stdin 被过早关闭、导致后续轮次报 "Stream closed" 的问题。
TRL v1.14.0 移除了 v1.13 引入的 trl.losses 模块,DPO、KTO、GRPO 改为通过 _ChunkedLogProbFunction 流式计算所选 token 的 log-probs,各自复用原有损失代码,不再重复实现损失数学。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃定级交给 LLM 智能体,读者可据此判断自动化安全测试的边界。
Google Cloud API Gateway 进入 Public Preview,可作为远程 MCP 服务器,在已有 OpenAPI 3.0.x 或 3.1.x 规范上通过 x-google-api-management.mcp 注解,把现有 REST 操作暴露为智能体可调用的 MCP 工具,无需另建服务器。
推荐理由:原文给出把现有 REST API 直接暴露为 MCP 工具的具体配置步骤与限制,可据此评估改造成本。
LangGraph CLI 发布 0.4.32.dev0 开发版本,该版本由 GitHub Actions 于 9 月 23 日构建并签名发布。更新内容为 cli==0.4.32 以来的变更,附带 2 个资源文件。
Claude Agent SDK 发布 v0.2.159,内置 Claude CLI 更新至 2.1.281,并将 e2e 测试默认模型固定为 claude-opus-5,以规避 CLI 新默认模型导致的 CI 失败。该版本已在 PyPI 提供,可通过 pip install claude-agent-sdk==0.2.159 安装。
LangGraph CLI 发布 0.4.32,新增将自托管部署置于 listener 的能力,并为自托管部署加入 --image-uri 参数。该版本还更新 langgraph deploy 命令改用 agent_id 和 environment 参数,并澄清 agent flags、支持环境变量默认值。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国和日本六国,由 18 家渠道合作伙伴支持部署,旗舰硬件为 HP Dimension with Google Beam。
Unsloth 现已支持本地运行 Qwen-Image-2.1,该版本支持图像编辑与图像生成,并提供 Fast FP8 与 GGUF 修复。此次更新新增自定义 Agent Skills,可复用 Claude Code 和 .agents 文件夹中的技能,长推理块速度提升至 60 FPS(此前 30 FPS)。
TensorRT-LLM 发布 v1.3.0rc28,新增 DFlash 2 支持并为 Llama、Llama4 默认启用 KV-cache manager V2,同时扩展 Qwen3.8-Flash-Next 的 disaggregation、MegaMoE 与 GVR index reuse 支持。