GitHub 推出专用模型检测泄露密钥
GitHub 公布专用于密钥检测的微调模型,可读取上下文代码识别凭据,包括没有固定 token 格式的密码,且不生成代码或文本。该模型已自动升级现有 AI 检测密码告警,AI 推送保护进入私有预览,Copilot CLI 与 Copilot App 的 /security-review 命令也将加入密钥分类器检查。
推荐理由:GitHub 把微调后的密钥检测模型接入告警、推送保护和 Copilot 安全审查,可据此了解各功能的开放范围与计费方式。
GitHub 公布专用于密钥检测的微调模型,可读取上下文代码识别凭据,包括没有固定 token 格式的密码,且不生成代码或文本。该模型已自动升级现有 AI 检测密码告警,AI 推送保护进入私有预览,Copilot CLI 与 Copilot App 的 /security-review 命令也将加入密钥分类器检查。
推荐理由:GitHub 把微调后的密钥检测模型接入告警、推送保护和 Copilot 安全审查,可据此了解各功能的开放范围与计费方式。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软开源 Agent Lightning v1.0,用约 3500 行代码把真实 harness 直接接入 RL 训练,并给出 6000 样本的编码智能体训练结果。
GitHub Copilot 的本地沙箱功能正式可用,覆盖 GitHub Copilot CLI、GitHub Copilot 应用以及使用 Agent Host 的 VS Code 会话。
推荐理由:官方说明本地沙箱在 CLI、应用与 VS Code 中正式可用,读者可据此了解智能体工作流的权限边界如何落地。
GitHub Copilot CLI 1.0.94-0 起可用 /model 发现本地运行的 Ollama 实例中受支持的模型,与已配置模型和 GitHub Copilot 云端模型并列展示。
LangGraph CLI 发布 0.4.33 版本,新增 `--image-uri` 参数,支持直接部署已推送的镜像,并加入 `langgraph deploy listeners list` 命令。该版本还修复了带凭据的 Git 依赖被拒绝的问题,并升级了 virtualenv、urllib3、pyjwt 等依赖。
Google 发布实验性游戏平台 Playground,用户通过对话式界面输入提示词即可创建、游玩和分享自定义游戏,无需编程经验。平台基于浏览器,支持手机和笔记本游玩,游戏可设为私密、生成分享链接或发布到 Explore 画廊,部分品类支持排行榜和多人对战。Playground 今日面向美国 18 岁以上用户开放,创建权限按 Google AI 订阅分级,后续将接入 Unity Spark。
推荐理由:Google 官方发布实验性游戏平台 Playground,读者可了解其提示词生成游戏的能力边界与开放范围。
OpenAI 为 ChatGPT for Teens 推出 College Planner,帮助学生管理大学申请,同时上线闪卡和测验功能。OpenAI 还将组建青少年 AI 顾问委员会,让青少年参与塑造 AI 的未来。
Cline 发布 v4.1.23,模型目录更新后推荐列表新增 GPT-6.1 Sol,免费列表新增 Solar Mini 4 并移除 DeepSeek V4.1 Flash 和 space-bunny-alpha,同时调整了 302.AI、Mistral、Nvidia、Vultr 等多家供应商的默认模型。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造了一款 ChatGPT 插件,让旅客在规划行程时即可查找、比较和预订酒店。
OpenAI Codex 发布 0.162.0-alpha.18 预发布版本,自上一版本以来主分支新增 113 个提交。该版本由 github-actions 于 10 月 7 日发布,标签为 rust-v0.162.0-alpha.18。
Google 推出 Developer Knowledge API 生态,为 AI 智能体和开发工具提供 Google Cloud、Firebase、Android 等官方文档的结构化访问,取代网页抓取。
Claude Agent SDK 发布 v0.2.164,内置 Claude CLI 升级至 2.1.292,可通过 pip install claude-agent-sdk==0.2.164 安装。
GitHub 修复了 Copilot 使用指标中智能体活动被漏计的问题:部分 IDE 将 Copilot 智能体会话迁移到 Copilot SDK 后未标识来源 IDE,导致活动无法正确归属,部分还被计入 Copilot CLI。
TRL 发布 v1.14.2 补丁,修复两处静默训练错误和三处崩溃。其中 #7505 影响默认生成路径(use_vllm=False)下的 GRPO、RLOO 和 Distillation。
Claude Code 发布 v2.1.292,为 claude plugin install 新增 --marketplace 参数,可在同一策略校验下自动添加市场并安装插件;Agent 工具新增 effort 参数,可指定子智能体的推理投入等级。本次还修复了沙箱读取、权限提示绕过、MCP 工具名超 128 字符导致请求失败等多项安全与稳定性问题。
vLLM 发布 v0.31.1rc0,新增按缓存层级(cache tier)暴露缓存提示词 token 的指标(#56318)。该改动由 Cam Quilici 提交,Nick Hill 与 Yifan Qiao 共同参与。
Ollama 发布 v0.40.0,在 Apple Silicon 设备上,MLX 运行时支持的模型架构将自动改用 MLX 运行。此次支持的模型包括 qwen3.8、gemma4、qwen3.6 和 qwen3.5,决策模型 Nimble、tev1、clef、clef-flash 也已上线 MLX,嵌入模型 embeddinggemma-2 同样获得 MLX 支持。
推荐理由:Ollama 在 Apple Silicon 上默认切换到 MLX 运行时,读者可据此了解本地部署的默认行为变化与已支持模型范围。
Unsloth 发布 v0.1.903-beta,在聊天旁加入内置浏览器面板,文件、网页和模型生成的 HTML 都以标签页打开,并支持对页面内容提问。该版本同时支持 Google DeepMind 的多模态嵌入模型 EmbeddingGemma 2,提供 740M 参数版本(纯文本 270M)、100+ 语言和 8K 上下文窗口,代码任务比上一代提升约 14%。
推荐理由:Unsloth 一次更新同时加入内置浏览器、EmbeddingGemma 2 支持与语音克隆页面,可据此判断本地微调工具链的边界扩展。
Ollama 发布 v0.40.0-rc6,在 MLX 推理后端实现 EmbeddingGemma2Model 架构,包含 24 层双向文本编码器、PLE 以及共享的 gemma4 视觉/音频塔,输出采用 mean-pool + L2。该版本的 /api/embed 接口支持通过 input dicts 传入逐项媒体内容。
LangGraph SDK 发布 0.4.6 版本,修复了 sdk-py 中 thread stream 请求对 thread_id 和 assistant_id 的百分号编码问题。此次更新还包含 langgraph 1.2.13 版本发布,以及 sdk-py 依赖项的小版本与补丁更新,并将 urllib3 从 2.7.0 升级至 2.8.0。
vLLM 发布 v0.31.0,含 307 位贡献者的 717 个提交,重点优化 DeepSeek-V4.1-Flash:FlashMLA mega attention 搭配 NVFP4 压缩 KV cache 成为 SM100 默认配置。
Claude Code 发布 v2.1.291,修复了 2.1.290 中云会话可能丢失权限提示回答的回归问题,以及 2.1.288 中退出会话时最后几条消息可能丢失的回归问题。该版本自上一版以来包含 7 个提交。
Ollama 发布 v0.40.0-rc5,修复针对近期 MLX 更新的补丁(#18812)。该版本为候选发布版,提交已通过 GitHub 签名验证。
Ollama 发布 v0.40.0-rc4,本次更新包含 MLX 版本升级,并为单元测试添加 scopes 以降低内存占用。该版本为候选发布版(rc),提交已通过 GitHub 验证签名。
Cursor 上线 Remote Control,用户可在 Cursor iOS app 中查看并回复运行在自己电脑上的本地智能体。该功能默认对除 Enterprise 组织外的所有用户开启,电脑需保持开机联网,可在桌面设置中开启 Keep this computer awake 防止休眠。
推荐理由:官方说明远程控制本地智能体的开启方式与限制,可据此判断移动端接管本地编码流程的可行性。
Claude Code v2.1.290 发布,为 mod 的 turn.step hook 结果新增 serverToolUses 字段,记录 API 自身发起的工具调用及其 id、名称、输入和起止时间。
LangGraph 发布 1.2.13,集中修复 DeltaChannel 相关缺陷:不再为从未写入的 DeltaChannel 遍历历史,避免将废弃分支重放到 DeltaChannel fork,并在各 update_state 路径上保留 DeltaChannel 计数器。
DeepSpeed 合并 PR #8497,为连续批处理 rollout 新增可选的 decode front 对齐路径:开启 align_decode_fronts 后按 attention mask 推导有效 prompt 长度、从长到短排序并右对齐 prefill,同时裁剪无效 cache 列,默认仍保持等宽填充布局。
Claude Code v2.1.289 修复了复合 shell 命令嵌套部分的 deny/ask 规则在托管机器上覆盖用户安装 mod 审批的问题,并解决了短代码块含大量未闭合标签或深层嵌套 ${} 替换时终端卡死。
vLLM 发布 v0.31.0rc5,在 requirements 中为 Transformers 版本添加了上限约束。该改动由 Isotr0py 提交、Harry Mellor 共同署名,并从主分支 cherry-pick 而来。
Claude Code v2.1.288 新增 $.ui.selection() 接口,可返回全屏模式下最近选中的文本;/code-review 支持 --max-findings 参数调整报告数量,并新增 Ctrl+F 按名称查找会话、Alt+↑/↓ 在 agents 视图分组间跳转。
SGLang 发布 v0.5.21,合并 227 位贡献者的 779 个 PR,新增 DeepSeek-V4.1 Flash、GigaChat 3.5、MiMo-V2.6、Qwen-Image 2.1、FLUX 3 Action 等模型支持。
GitHub Copilot 代码审查现已支持通过 REST 和 GraphQL API 发起请求,并可为每次请求单独设置审查强度。默认审查强度已改为 Balanced,于 2026 年 9 月 28 日生效,此前显式选择 Lite 的设置保持不变。该功能已面向 Copilot Pro、Pro+、Max、Business 和 Enterprise 计划全面开放。
GitHub Copilot 于 2026 年 10 月 2 日在所有体验中弃用 Gemini 3.5 Flash、Gemini 3.6 Flash、Kimi K2.7 Code 和 Claude Opus 4.7,建议分别改用 Gemini 3.8 Flash、Kimi K3 和 Claude Opus 5.5。
OpenAI Agents SDK 发布 v0.23.1 补丁版本,修复发布测试并刷新必需的 readiness 检查,SDK 运行时源码相对 v0.23.0 仅改动版本号字符串。
GitHub Copilot 本周为 Pro、Pro+、Max、Business 和 Enterprise 用户上线 Claude Sonnet 5.5,并为 Pro+、Max、Business 和 Enterprise 用户提供 GPT-6.1 Sol。
推荐理由:汇总了 Copilot 本周新增模型、动态工作流与桌面自动化能力,可据此判断智能体工作流的可用边界。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备端运行。
推荐理由:原文给出 64GB 新配置的定价、上市时间与双机集群方式,读者可据此判断本地跑大模型的硬件门槛。
vLLM 发布 v0.31.0rc4,修复了 HiSparse 在 FULL graphs 下 MTP 接受率崩溃的问题。该版本为候选发布版,主要针对上述 bug 进行修补。
Unsloth Desktop 新增 Cmd/Ctrl+P 命令面板,支持分享 GGUF 运行设置,并让 Laya 决策模型短请求提速最高 4.1 倍。
OpenAI Agents SDK 发布 v0.23.0,新增 MCP 列表页限制配置、沙箱 Docker 删除保护和内存整合轮次配置,以及可选的加密历史扫描预算。该版本还修复了智能体工具流式回调积压、嵌套工具状态隔离、工具失败详情脱敏等问题,并升级多项依赖。