Google 发布本地优先的会议记录应用 AI Edge Foresight
Google 发布 Mac 应用 Google AI Edge Foresight,对标 AI 会议记录工具 Granola,可完全离线运行。该应用使用端侧 EmbeddingGemma 2 模型(740 million 参数)跨应用记录会议内容,包括线下会议,界面为分屏设计,一侧手写速记、一侧生成 AI 笔记,并支持查看转写文本或与 Gemma 4 驱动的助手对话。
Google 发布 Mac 应用 Google AI Edge Foresight,对标 AI 会议记录工具 Granola,可完全离线运行。该应用使用端侧 EmbeddingGemma 2 模型(740 million 参数)跨应用记录会议内容,包括线下会议,界面为分屏设计,一侧手写速记、一侧生成 AI 笔记,并支持查看转写文本或与 Gemma 4 驱动的助手对话。
Google Cloud 发布长文介绍 Gemini 在企业 Agent 领域的更新,核心是全新发布的 Gemini Agent,可查资料、写邮件、做 PPT、分析数据、编写运行代码并跨应用调用工具。
推荐理由:谷歌把办公 Agent 的模型选择、企业身份与四类记忆机制一并公开,可对照 Meta、OpenAI 的路线差异。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可接受目标而非仅指令,自行规划任务、调用技能与工具并连接企业内部系统。该智能体默认自动选择模型,用户也可手动切换,首批支持 Anthropic 的 Claude 模型,未来将扩展至开源和私有模型。
Google 发布实验性笔记应用 Google AI Edge Foresight,可在完全离线状态下转写会议和音频文件。该应用免费,在 macOS 上运行,使用 Google 端侧 EmbeddingGemma 2 模型,可把会议中的速记要点整理成完整笔记,并内置助手回答关于录音内容的问题,还能接入本地文件作为参考。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,并集成在 Gemini Enterprise 应用中,用户能在单一界面里与它对话并分配任务。
OpenAI 将 GPT-6 推向更广泛的 ChatGPT 用户,并推出 Intelligent UI 智能用户界面,可根据问题自动组合文字、图表、按钮、表单,生成可直接操作的计算器、账单分摊工具或小游戏,10 月 7 日起向 Plus、Pro、Business、Enterprise 用户逐步开放,Free 和 Go 用户 10 月 8 日起陆续获得支持。
Google AI Edge 团队以 Apache 2.0 协议开源端侧 GPU 计算引擎 ML Drift,它抽象 OpenGL ES、OpenCL、Metal 和 WebGPU,作为 LiteRT 的核心 GPU 加速引擎,也可独立使用。
推荐理由:Google 开源端侧 GPU 推理引擎 ML Drift,并给出 Chrome、YouTube Shorts、Adobe 等迁移后的实测提速数据。
Google 发布 AQuA(Ambient Quality Agent),一个在 Google Cloud 项目内旁路运行的质量智能体,按计划、部署后或按需扫描 Cloud Trace、Cloud Logging 或 BigQuery 中的生产轨迹,经采样、评审、聚类、验证、跟踪五阶段流水线输出可验证的故障洞察。
推荐理由:原文给出 AQuA 的五阶段流水线、成本数据和一次真实多智能体排查案例,可据此判断生产环境智能体质量监控的可行做法。
Google 宣布其 SynthID 检测器现已支持所有合作方嵌入的水印,并在新网站 SynthID.com 上向所有人开放使用。SynthID 是编码在 AI 生成图像、视频像素和音频波形中的隐形信号,Google 称仅 Gemini 就已为超过 1800 亿张图像和视频以及 24 万年时长的音频集成该水印。
Google 发布实验性游戏平台 Playground,用户通过对话式界面输入提示词即可创建、游玩和分享自定义游戏,无需编程经验。平台基于浏览器,支持手机和笔记本游玩,游戏可设为私密、生成分享链接或发布到 Explore 画廊,部分品类支持排行榜和多人对战。Playground 今日面向美国 18 岁以上用户开放,创建权限按 Google AI 订阅分级,后续将接入 Unity Spark。
推荐理由:Google 官方发布实验性游戏平台 Playground,读者可了解其提示词生成游戏的能力边界与开放范围。
Google 推出 Developer Knowledge API 生态,为 AI 智能体和开发工具提供 Google Cloud、Firebase、Android 等官方文档的结构化访问,取代网页抓取。
Unsloth 发布 v0.1.903-beta,在聊天旁加入内置浏览器面板,文件、网页和模型生成的 HTML 都以标签页打开,并支持对页面内容提问。该版本同时支持 Google DeepMind 的多模态嵌入模型 EmbeddingGemma 2,提供 740M 参数版本(纯文本 270M)、100+ 语言和 8K 上下文窗口,代码任务比上一代提升约 14%。
推荐理由:Unsloth 一次更新同时加入内置浏览器、EmbeddingGemma 2 支持与语音克隆页面,可据此判断本地微调工具链的边界扩展。
Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解其在 DNA 合成筛查与数据库标注上的验证思路。
Google Cloud API Gateway 进入 Public Preview,可作为远程 MCP 服务器,在已有 OpenAPI 3.0.x 或 3.1.x 规范上通过 x-google-api-management.mcp 注解,把现有 REST 操作暴露为智能体可调用的 MCP 工具,无需另建服务器。
推荐理由:原文给出把现有 REST API 直接暴露为 MCP 工具的具体配置步骤与限制,可据此评估改造成本。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国和日本六国,由 18 家渠道合作伙伴支持部署,旗舰硬件为 HP Dimension with Google Beam。
Google 旗下 Envisioning Studio 联合 Google Labs,与设计师 Jane Wade、Sergio Hudson 在 Google Flow 中共同打造了两款定制工具,用于纽约时装周。
联合国系统发布 UN System Data Commons,这是一个基于 Google Data Commons 构建的开源平台,把分散的全球统计数据整合为可搜索的 AI-ready 知识图谱。
推荐理由:联合国系统与 Google 合作把分散的全球统计数据整合为可自然语言查询、可被 AI 智能体调用的知识图谱。
Google Developers Blog 发文介绍智能体编码系统的 harness engineering,主张用行为评估补充 Terminal-Bench、DeepSWE 等端到端基准,断言智能体的中间执行步骤而非最终输出。
推荐理由:Google 团队给出行为评估的写法与三步测试循环,可作为智能体编码系统迭代时的可迁移方法。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,超过 AlphaFold Database 的 30 倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单碱基变异的预测结果做成可检索资源,读者可了解基因组变异解读的规模化路径。