ttok 0.4 发布:新增 --list-models 命令
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 `cat file.txt | uvx ttok` 即可统计 token 数。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 `cat file.txt | uvx ttok` 即可统计 token 数。
OpenAI 推出名为 Intelligent UI 的新界面,随新模型 GPT-6 于周三开始推送,把大量可视化内容整合进对话,其中不少是可交互的按钮、定制计算器、交互式图表和可编辑图形。
Meta 周三宣布其 Muse 助手推出独立 iPad 应用,距 9 月 8 日在 iOS 和 Android 上线仅一个月。据 Sensor Tower 估算,Muse 上线以来安装量已超过 660 万次。
微软在旧金山 Tech Week 活动上公布 Surface Laptop Ultra 的规格与价格,两个基础型号分别 2600 美元和 3700 美元起,最高配至 5900 美元。
Google 发布 Mac 应用 Google AI Edge Foresight,对标 AI 会议记录工具 Granola,可完全离线运行。该应用使用端侧 EmbeddingGemma 2 模型(740 million 参数)跨应用记录会议内容,包括线下会议,界面为分屏设计,一侧手写速记、一侧生成 AI 笔记,并支持查看转写文本或与 Gemma 4 驱动的助手对话。
Goodfire 发布一类监控工具,通过读取模型内部激活信号来发现 AI 智能体的风险行为,而非让另一个模型逐字审查输出,目前面向 Baseten 客户开放。
AI 与硬件初创公司 Natura 发布 99 美元智能戒指 Interface,按下手指即可让 AI 智能体完成任务、记录想法,无需掏出手机。戒指同时是健康追踪器,可监测心率、HRV、睡眠和活动,并连接 Meta 的 Muse、Instinct、Grok Bot、Claude、ChatGPT 等智能体与应用。
OpenAI 在 ChatGPT 中推出 Intelligent UI 功能,让回答可以结合图表、表单、可点击按钮等交互式视觉内容,该更新随 GPT-6 向所有用户推送。
Anthropic 推出名为 OSS Scanner 的免费服务,选择加入的开源项目可获得由其最强模型(包括 Claude Mythos)定期执行的安全扫描。该扫描报告完全由模型生成,不经人工复核或分诊,因此扫描更快更频繁,但报告也可能出错或无效。此前 AI 工具已帮助发现过影响几乎所有 Linux 发行版的开源漏洞,同时部分开源项目正疲于应对大量 AI 生成的漏洞报告。
NVIDIA 开发者正用 GPT-6 Astra、Claude Fable 5 等前沿 AI 模型配合 Omniverse 库,通过自然语言指令构建仿真应用。
Extend 工程师 Bo Lau 搭建了一个模拟 Elizabeth Holmes 办公桌的网站,还原 2016 年的 MacBook Air 与 iPhone 界面,用户可翻阅美国诉 Holmes 刑事庭审公开的邮件、短信、幻灯片和文档,还能运行 Theranos Edison 血液检测仪。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 付费购买模型推理,将接入 x402 支付支持的工作量从数月缩短到数天并投入生产。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可接受目标而非仅指令,自行规划任务、调用技能与工具并连接企业内部系统。该智能体默认自动选择模型,用户也可手动切换,首批支持 Anthropic 的 Claude 模型,未来将扩展至开源和私有模型。
Oracle 在招聘、工程和运营中借助 ChatGPT Work 与 Codex,把专家知识转化为快速、可重复的工作流,将原本需要数天的工作缩短到几分钟。
Google 发布实验性笔记应用 Google AI Edge Foresight,可在完全离线状态下转写会议和音频文件。该应用免费,在 macOS 上运行,使用 Google 端侧 EmbeddingGemma 2 模型,可把会议中的速记要点整理成完整笔记,并内置助手回答关于录音内容的问题,还能接入本地文件作为参考。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,并集成在 Gemini Enterprise 应用中,用户能在单一界面里与它对话并分配任务。
《Gears of War: E-Day》已于 10 月 6 日全球发售后上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能云端游玩,并支持 NVIDIA DLSS 和 NVIDIA Reflex。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者将创意转化为精细图像和电影级视频广告。
Nvidia 正大力押注物理 AI,其全栈安全解决方案已被多家机器人公司采用,目标指向更安全的 Robotaxi 与人形机器人。
微软在时隔两年的首场线下活动中发布新款 Surface Laptop Ultra,并公布 Windows 11 的一系列改动,同时展示本地 AI 与智能体工作流如何改变个人计算。
Artcraft 从可控 AI 图像视频编辑工具转向一套七款开源应用,复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
在旧金山举行的 Windows AI and Surface 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,并公布 RTX Spark 笔记本即日开启预售、10 月 16 日开售,紧凑型台式机 11 月上市。
推荐理由:英伟达与微软把智能体运行所需的系统级容器和本地算力硬件一起端出,读者可据此判断本地智能体落地的软硬件门槛。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,把 push protection 扩展到无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与人工修复的失衡,并给出把检测前移到 push 环节的模型方案。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软开源 Agent Lightning v1.0,用约 3500 行代码把真实 harness 直接接入 RL 训练,并给出 6000 样本的编码智能体训练结果。
Latent Space 采访 Kubernetes 联合创造者 Craig McLuckie 和 Joe Beda,介绍其公司 Stacklok 转向基于 Kubernetes 的智能体方案,核心产品是 6 月起在 GitHub 开源的云原生 harness Mecatl。
Google 宣布其 SynthID 检测器现已支持所有合作方嵌入的水印,并在新网站 SynthID.com 上向所有人开放使用。SynthID 是编码在 AI 生成图像、视频像素和音频波形中的隐形信号,Google 称仅 Gemini 就已为超过 1800 亿张图像和视频以及 24 万年时长的音频集成该水印。
OpenAI 为 ChatGPT for Teens 推出 College Planner,帮助学生管理大学申请,同时上线闪卡和测验功能。OpenAI 还将组建青少年 AI 顾问委员会,让青少年参与塑造 AI 的未来。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造了一款 ChatGPT 插件,让旅客在规划行程时即可查找、比较和预订酒店。
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,用于接入 OpenAI 在 DevDay 上宣布的 Decisions API。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备端运行。
推荐理由:原文给出 64GB 新配置的定价、上市时间与双机集群方式,读者可据此判断本地跑大模型的硬件门槛。
OpenAI 在 API 以及符合条件的 ChatGPT Work 和 Codex 用户中上线 GPT-6 Astra Ultrafast,该模式运行在 NVIDIA Blackwell GPU 上,token 生成速度最高可达 Astra Standard 模式的 8 倍。
推荐理由:原文给出 Ultrafast 模式相对标准模式的生成速度提升与开放入口,读者可据此判断它对编码智能体循环的实际影响。
Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解其在 DNA 合成筛查与数据库标注上的验证思路。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃定级交给 LLM 智能体,读者可据此判断自动化安全测试的边界。
Google Private AI Compute 团队公布为 Private AI Compute 平台引入私有服务端记忆的技术方案,让云端 AI 在跨设备场景下持久保留上下文,同时维持端侧级隐私标准。
推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端 AI 如何在保留跨设备上下文的同时维持端侧级隐私。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,超过 AlphaFold Database 的 30 倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单碱基变异的预测结果做成可检索资源,读者可了解基因组变异解读的规模化路径。
Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、检查和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries。
推荐理由:原文给出多步检索循环在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可据此判断传统 one-shot RAG 的边界。