谷歌发布办公 Agent Gemini Agent,支持调用 Claude
Google Cloud 发布长文介绍 Gemini 在企业 Agent 领域的更新,核心是全新发布的 Gemini Agent,可查资料、写邮件、做 PPT、分析数据、编写运行代码并跨应用调用工具。
推荐理由:谷歌把办公 Agent 的模型选择、企业身份与四类记忆机制一并公开,可对照 Meta、OpenAI 的路线差异。
Google Cloud 发布长文介绍 Gemini 在企业 Agent 领域的更新,核心是全新发布的 Gemini Agent,可查资料、写邮件、做 PPT、分析数据、编写运行代码并跨应用调用工具。
推荐理由:谷歌把办公 Agent 的模型选择、企业身份与四类记忆机制一并公开,可对照 Meta、OpenAI 的路线差异。
Anthropic 推出名为 OSS Scanner 的免费服务,选择加入的开源项目可获得由其最强模型(包括 Claude Mythos)定期执行的安全扫描。该扫描报告完全由模型生成,不经人工复核或分诊,因此扫描更快更频繁,但报告也可能出错或无效。此前 AI 工具已帮助发现过影响几乎所有 Linux 发行版的开源漏洞,同时部分开源项目正疲于应对大量 AI 生成的漏洞报告。
CrewAI 发布 1.15.26,修复了 rwlock 获取被中断时的所有权保留问题、文档站点源 URL 未保留的问题,以及 log-tasks-outputs 中任务输出显示实际输出的问题。该版本还更新了 v1.15.25 的快照和更新日志。
NVIDIA 开发者正用 GPT-6 Astra、Claude Fable 5 等前沿 AI 模型配合 Omniverse 库,通过自然语言指令构建仿真应用。
Extend 工程师 Bo Lau 搭建了一个模拟 Elizabeth Holmes 办公桌的网站,还原 2016 年的 MacBook Air 与 iPhone 界面,用户可翻阅美国诉 Holmes 刑事庭审公开的邮件、短信、幻灯片和文档,还能运行 Theranos Edison 血液检测仪。
llama.cpp 发布 b11514 版本,修复了 Musa FWHT 问题(#30167)。该版本继续提供覆盖 macOS、Linux、Windows、Android 及 openEuler 的多平台构建,支持 CUDA 12/13、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端,其中 macOS Intel 与 openEuler 构建处于 DISABLED 状态。
Claude Code v2.1.295 为 command 和 HTTP hooks 新增 onFailure: "block",使无法启动、超时或异常退出的 hook 直接阻断操作;同时加入 Program Status Protocol(OSC 7501)支持,终端可显示 Claude Code 正在工作、等待用户还是已完成。
llama.cpp 发布 b11513,为 CUDA 后端改进 top-k 算法选择:按形状在 bitonic、radix select 与 DeviceTopK/CUB argsort 之间切换,阈值可在构建时覆盖。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
OpenAI Codex 发布 0.162.0,在启用 worktree 功能后,可从受信任的本地项目创建和列出托管 Git worktree,并支持在智能体 Command Center 中用 p 键置顶任务。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 付费购买模型推理,将接入 x402 支付支持的工作量从数月缩短到数天并投入生产。
Claude Agent SDK 发布 v0.2.165,内置 Claude CLI 升级至 2.1.294,可通过 pip install claude-agent-sdk==0.2.165 安装。该版本还新增 CI 告警,当发布被阻塞或失败时会通知 Slack。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可接受目标而非仅指令,自行规划任务、调用技能与工具并连接企业内部系统。该智能体默认自动选择模型,用户也可手动切换,首批支持 Anthropic 的 Claude 模型,未来将扩展至开源和私有模型。
llama.cpp 发布 b11512,修复 DFlash 输出头共享问题,改为从 GGUF metadata 读取绑定输出权重,并共享绑定词嵌入 metadata,同时移除 DFlash 嵌入头回退逻辑。相关改动由 Codex 协助完成。
llama.cpp 发布 b11511 版本,修复了 CUDA 后端中 MMQ 的越界读取(out-of-bounds reads)问题(#29953)。该版本继续提供覆盖 macOS、Linux、Windows、Android 及 openEuler 的多平台构建,包括 CUDA 12.8/13.4、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端。
llama.cpp 发布 b11510,CUDA 后端新增循环 PAD kernel,可处理超过 65535 行或切片的场景。该版本同步更新 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台构建,涵盖 CUDA 12.8/13.4、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端。
Oracle 在招聘、工程和运营中借助 ChatGPT Work 与 Codex,把专家知识转化为快速、可重复的工作流,将原本需要数天的工作缩短到几分钟。
Ollama v0.40.2-rc0 在列表输出中隐藏了重复与降级保护条目。加载需要 llama.cpp 补丁集的旧版 GGUF 时,Ollama 会在磁盘上做惰性转换,并临时保留新旧两份 GGUF、创建影子 v1 manifest 标签,以防降级后的服务器删除新 blob。这些旧副本将在未来版本中移除以回收磁盘空间。
llama.cpp 发布 b11509,修复 CUDA 后端 CCCL 版本守卫在 4.x 上误判的问题:旧逻辑分别比较主次版本号,导致 CCCL 4.x 下 STRIDED_ITERATOR_AVAILABLE 未定义,argsort 静默回退到 init_offsets 路径,仅损失性能而不报错。
llama.cpp 发布 b11507 版本,新增 MoE 缓存跨多 GPU 支持(#30112)。该版本继续提供 macOS、Linux、Windows、Android 及 openEuler 等多平台构建,覆盖 CUDA 12/13、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端。
Google 发布实验性笔记应用 Google AI Edge Foresight,可在完全离线状态下转写会议和音频文件。该应用免费,在 macOS 上运行,使用 Google 端侧 EmbeddingGemma 2 模型,可把会议中的速记要点整理成完整笔记,并内置助手回答关于录音内容的问题,还能接入本地文件作为参考。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,并集成在 Gemini Enterprise 应用中,用户能在单一界面里与它对话并分配任务。
生数科技开放新一代视频生成旗舰模型 Vidu Q4 预览版,主打传神表现力,最高支持 4K 直出,单次最多可用 15 张参考图和 3 段参考音频,单条最长 16 秒。
《Gears of War: E-Day》已于 10 月 6 日全球发售后上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能云端游玩,并支持 NVIDIA DLSS 和 NVIDIA Reflex。
正行创新在APRCE 2026发布面向零售开放场景的Physical AI解决方案,由双足人形机器人H1、搬运理货轮臂式机器人C1及机器人管理平台M1组成,支持“0改造”快速部署,机器人可实现99%任务自主完成。自研轻量级世界动作模型SLM-0.5在LIBERO基准测试中平均任务成功率98.6%,推理速度较主流方案提升24倍。方案计划2027年正式商业化,支持直接采购或RaaS订阅。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者将创意转化为精细图像和电影级视频广告。
Nvidia 正大力押注物理 AI,其全栈安全解决方案已被多家机器人公司采用,目标指向更安全的 Robotaxi 与人形机器人。
爱范儿提前拿到生数科技 Vidu Q4 Preview 预览版访问权限并实测,该版本定位高表现力旗舰模型,参考生视频支持最多 15 张参考图、3 段参考音频和可选 2K、4K 输出,试拍 0.09 元/秒起。
微软在特别发布会上推出 Surface Laptop Ultra,搭载 NVIDIA RTX Spark Superchip,最高 128GB 统一内存,可在本地运行超过 1200 亿参数模型,起价 2599 美元,10 月 7 日开放预订、10 月 16 日发货。
推荐理由:微软把 Windows 的 AI 能力从 Copilot 入口扩展到本地模型、Agent 容器与算力调度,读者可据此判断 AI PC 的硬件与系统路线变化。
OpenAI Codex 发布 0.162.0-alpha.17.2 预发布版本,自上一版本以来 main 分支新增 150 个提交。该版本由 github-actions 于 10 月 8 日发布,附带 178 个资源文件。
Cline Desktop v0.0.45 修复了自 0.0.38 起 SSH 环境连接报 SyntaxError 的问题,并新增 Claude Haiku 5.5 模型。Google Vertex AI、GitHub Copilot 等多个提供商的默认模型改为 Claude Haiku 5.5,同时修复了 GPT-6 Astra、Claude Opus 5.5 等模型关闭推理时的 400 错误。
Cline CLI v3.0.70 修复了在 GPT-6 Astra、GPT-6.1 Sol、Claude Fable 5 和 Claude Opus 5.5 上关闭推理时生成 commit message 和任务报 400 错误的问题,并解决了 MCP server 或 hook 退出后约 3 秒即退出的缺陷。
Cline SDK v0.0.92 将 AI SDK 统一到 ai 7.0.120 版本线,所有 @ai-sdk/* 包统一使用 @ai-sdk/provider-utils 5.0.50。
Claude Code 发布 v2.1.294,修复了以指令形式编写的 prompt 与 agent hooks(如"阻止某类命令")此前会放行本应拦截内容的问题。同时改进了 Stop 和 SubagentStop 上以指令形式编写的 prompt hooks(如"构建失败就继续")的判定方式,Claude 更不容易提前停止。
Unsloth 发布 v0.1.904-beta,支持用 QLoRA 将任意文本或视觉 LLM 训练成 Jev 风格决策模型,决策准确率从 30% 提升到 80%,并可在 Unsloth 内完成训练、测试、导出与部署。
OpenAI Codex 发布 0.162.0-alpha.18.1 预发布版本,自上一版本以来主分支新增 113 个提交。该版本由 github-actions 于 10 月 8 日发布,附带 178 项资源文件。
Ollama 发布 v0.40.1,新增代理云端用量与余额 API,并移除 CLI 引导中的账户步骤。该版本修复了 Windows 上 llama 读取超过 2GiB 的问题,同时避免 Windows 上的符号链接,并清理了 README 中的失效链接。
极客公园「造物 100」第 7 期推荐四款新品:MUZIM L1 桌面数据坞搭载 OpenSoul 文件系统与 Vibe Search,支持 24TB 存储、按语义搜到视频某一帧。
OpenAI 将 GPT-6 推向更广泛的 ChatGPT 用户,并推出 Intelligent UI 智能用户界面,可根据问题自动组合文字、图表、按钮、表单,生成可直接操作的计算器、账单分摊工具或小游戏,10 月 7 日起向 Plus、Pro、Business、Enterprise 用户逐步开放,Free 和 Go 用户 10 月 8 日起陆续获得支持。
微软在时隔两年的首场线下活动中发布新款 Surface Laptop Ultra,并公布 Windows 11 的一系列改动,同时展示本地 AI 与智能体工作流如何改变个人计算。