OpenAI Codex 发布 0.162.0-alpha.17.1 预发布版本
OpenAI Codex 发布 0.162.0-alpha.17.1 预发布版本,自上一版本以来主分支新增 151 个提交。该版本由 github-actions 于 10 月 7 日发布,附带 178 个资源文件。
OpenAI Codex 发布 0.162.0-alpha.17.1 预发布版本,自上一版本以来主分支新增 151 个提交。该版本由 github-actions 于 10 月 7 日发布,附带 178 个资源文件。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6。
Ollama v0.40.2 让旧版本下载的模型在首次运行时后台自动升级,以在 llama.cpp 上获得更好性能与兼容性,并保留原始副本作为备份以便安全降级。该版本还修复了 ollama list 对已升级模型重复显示的问题,ollama launch claude 现使用模型完整上下文长度。备份模型将在未来版本自动清除。
vLLM 发布 vllm-proto 0.5.0,该 tag 由提交者签名并通过验证。此次发布附带 2 个资源文件,版本号从 proto-v0.5.0 正式定为 vllm-proto 0.5.0。
llama.cpp 发布 b11515 版本,为 SYCL 后端加入 Q5_K 重排布局的 MMVQ 与融合 GLU 支持。该版本同步更新 macOS、Linux、Windows、Android 及 openEuler 等多平台构建产物,覆盖 CUDA 12/13、ROCm 10.0、Vulkan、OpenVINO、SYCL FP32/FP16 等后端。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 `cat file.txt | uvx ttok` 即可统计 token 数。
openJiuwen 发布并开源企业级 AgentOS,将多智能体协同、自演进、算力亲和与企业级安全可靠能力整合进统一底座,并通过插件化架构连接上层应用与底层模型、算力资源。
OpenAI Codex 发布 0.163.0-alpha.2 预发布版本,该版本自上一版本以来包含 6 个提交。这是 rust-v0.163.0-alpha.2 的预发布构建,具体功能变更未在发布说明中列出。
OpenAI 推出名为 Intelligent UI 的新界面,随新模型 GPT-6 于周三开始推送,把大量可视化内容整合进对话,其中不少是可交互的按钮、定制计算器、交互式图表和可编辑图形。
Meta 周三宣布其 Muse 助手推出独立 iPad 应用,距 9 月 8 日在 iOS 和 Android 上线仅一个月。据 Sensor Tower 估算,Muse 上线以来安装量已超过 660 万次。
微软在旧金山 Tech Week 活动上公布 Surface Laptop Ultra 的规格与价格,两个基础型号分别 2600 美元和 3700 美元起,最高配至 5900 美元。
Google 发布 Mac 应用 Google AI Edge Foresight,对标 AI 会议记录工具 Granola,可完全离线运行。该应用使用端侧 EmbeddingGemma 2 模型(740 million 参数)跨应用记录会议内容,包括线下会议,界面为分屏设计,一侧手写速记、一侧生成 AI 笔记,并支持查看转写文本或与 Gemma 4 驱动的助手对话。
Goodfire 发布一类监控工具,通过读取模型内部激活信号来发现 AI 智能体的风险行为,而非让另一个模型逐字审查输出,目前面向 Baseten 客户开放。
AI 与硬件初创公司 Natura 发布 99 美元智能戒指 Interface,按下手指即可让 AI 智能体完成任务、记录想法,无需掏出手机。戒指同时是健康追踪器,可监测心率、HRV、睡眠和活动,并连接 Meta 的 Muse、Instinct、Grok Bot、Claude、ChatGPT 等智能体与应用。
OpenAI 在 ChatGPT 中推出 Intelligent UI 功能,让回答可以结合图表、表单、可点击按钮等交互式视觉内容,该更新随 GPT-6 向所有用户推送。
Google Cloud 发布长文介绍 Gemini 在企业 Agent 领域的更新,核心是全新发布的 Gemini Agent,可查资料、写邮件、做 PPT、分析数据、编写运行代码并跨应用调用工具。
推荐理由:谷歌把办公 Agent 的模型选择、企业身份与四类记忆机制一并公开,可对照 Meta、OpenAI 的路线差异。
Anthropic 推出名为 OSS Scanner 的免费服务,选择加入的开源项目可获得由其最强模型(包括 Claude Mythos)定期执行的安全扫描。该扫描报告完全由模型生成,不经人工复核或分诊,因此扫描更快更频繁,但报告也可能出错或无效。此前 AI 工具已帮助发现过影响几乎所有 Linux 发行版的开源漏洞,同时部分开源项目正疲于应对大量 AI 生成的漏洞报告。
CrewAI 发布 1.15.26,修复了 rwlock 获取被中断时的所有权保留问题、文档站点源 URL 未保留的问题,以及 log-tasks-outputs 中任务输出显示实际输出的问题。该版本还更新了 v1.15.25 的快照和更新日志。
NVIDIA 开发者正用 GPT-6 Astra、Claude Fable 5 等前沿 AI 模型配合 Omniverse 库,通过自然语言指令构建仿真应用。
Extend 工程师 Bo Lau 搭建了一个模拟 Elizabeth Holmes 办公桌的网站,还原 2016 年的 MacBook Air 与 iPhone 界面,用户可翻阅美国诉 Holmes 刑事庭审公开的邮件、短信、幻灯片和文档,还能运行 Theranos Edison 血液检测仪。
llama.cpp 发布 b11514 版本,修复了 Musa FWHT 问题(#30167)。该版本继续提供覆盖 macOS、Linux、Windows、Android 及 openEuler 的多平台构建,支持 CUDA 12/13、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端,其中 macOS Intel 与 openEuler 构建处于 DISABLED 状态。
Claude Code v2.1.295 为 command 和 HTTP hooks 新增 onFailure: "block",使无法启动、超时或异常退出的 hook 直接阻断操作;同时加入 Program Status Protocol(OSC 7501)支持,终端可显示 Claude Code 正在工作、等待用户还是已完成。
llama.cpp 发布 b11513,为 CUDA 后端改进 top-k 算法选择:按形状在 bitonic、radix select 与 DeviceTopK/CUB argsort 之间切换,阈值可在构建时覆盖。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
OpenAI Codex 发布 0.162.0,在启用 worktree 功能后,可从受信任的本地项目创建和列出托管 Git worktree,并支持在智能体 Command Center 中用 p 键置顶任务。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 付费购买模型推理,将接入 x402 支付支持的工作量从数月缩短到数天并投入生产。
Claude Agent SDK 发布 v0.2.165,内置 Claude CLI 升级至 2.1.294,可通过 pip install claude-agent-sdk==0.2.165 安装。该版本还新增 CI 告警,当发布被阻塞或失败时会通知 Slack。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可接受目标而非仅指令,自行规划任务、调用技能与工具并连接企业内部系统。该智能体默认自动选择模型,用户也可手动切换,首批支持 Anthropic 的 Claude 模型,未来将扩展至开源和私有模型。
llama.cpp 发布 b11512,修复 DFlash 输出头共享问题,改为从 GGUF metadata 读取绑定输出权重,并共享绑定词嵌入 metadata,同时移除 DFlash 嵌入头回退逻辑。相关改动由 Codex 协助完成。
llama.cpp 发布 b11511 版本,修复了 CUDA 后端中 MMQ 的越界读取(out-of-bounds reads)问题(#29953)。该版本继续提供覆盖 macOS、Linux、Windows、Android 及 openEuler 的多平台构建,包括 CUDA 12.8/13.4、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端。
llama.cpp 发布 b11510,CUDA 后端新增循环 PAD kernel,可处理超过 65535 行或切片的场景。该版本同步更新 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台构建,涵盖 CUDA 12.8/13.4、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端。
Unsloth 发布 v0.1.905-beta,可用 QLoRA 把任意文本或视觉 LLM 训练成 Jev 风格决策模型,决策准确率从 30% 提升到 80%。
推荐理由:Unsloth 把决策模型训练、测试、导出到部署串成一条链路,并给出准确率从 30% 到 80% 的对照。
Oracle 在招聘、工程和运营中借助 ChatGPT Work 与 Codex,把专家知识转化为快速、可重复的工作流,将原本需要数天的工作缩短到几分钟。
Ollama v0.40.2-rc0 在列表输出中隐藏了重复与降级保护条目。加载需要 llama.cpp 补丁集的旧版 GGUF 时,Ollama 会在磁盘上做惰性转换,并临时保留新旧两份 GGUF、创建影子 v1 manifest 标签,以防降级后的服务器删除新 blob。这些旧副本将在未来版本中移除以回收磁盘空间。
llama.cpp 发布 b11509,修复 CUDA 后端 CCCL 版本守卫在 4.x 上误判的问题:旧逻辑分别比较主次版本号,导致 CCCL 4.x 下 STRIDED_ITERATOR_AVAILABLE 未定义,argsort 静默回退到 init_offsets 路径,仅损失性能而不报错。
llama.cpp 发布 b11507 版本,新增 MoE 缓存跨多 GPU 支持(#30112)。该版本继续提供 macOS、Linux、Windows、Android 及 openEuler 等多平台构建,覆盖 CUDA 12/13、ROCm 10.0、Vulkan、SYCL、OpenVINO 等后端。
Google 发布实验性笔记应用 Google AI Edge Foresight,可在完全离线状态下转写会议和音频文件。该应用免费,在 macOS 上运行,使用 Google 端侧 EmbeddingGemma 2 模型,可把会议中的速记要点整理成完整笔记,并内置助手回答关于录音内容的问题,还能接入本地文件作为参考。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,并集成在 Gemini Enterprise 应用中,用户能在单一界面里与它对话并分配任务。
生数科技开放新一代视频生成旗舰模型 Vidu Q4 预览版,主打传神表现力,最高支持 4K 直出,单次最多可用 15 张参考图和 3 段参考音频,单条最长 16 秒。
《Gears of War: E-Day》已于 10 月 6 日全球发售后上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能云端游玩,并支持 NVIDIA DLSS 和 NVIDIA Reflex。