Gemini Enterprise Agent Platform 上线 Agent Anomaly Detection 私测
Google 在 Gemini Enterprise Agent Platform 上为 Agent Anomaly Detection 开启 Private Preview,用推理层审计智能体的推理轨迹、工具调用和执行流程,标记行为异常、可疑意图与策略违规。
推荐理由:原文给出分层检测流程与一个抓取型异常实例,可据此判断智能体行为审计在生产中的落地方式。
公司与项目
Google 与 DeepMind 的 AI 动态:Gemini 系列、Gemini CLI 与 Agent 工具链、研究成果与产品生态。
28 条精选近 30 天 23 条共收录 59 条
Google 在 Gemini Enterprise Agent Platform 上为 Agent Anomaly Detection 开启 Private Preview,用推理层审计智能体的推理轨迹、工具调用和执行流程,标记行为异常、可疑意图与策略违规。
推荐理由:原文给出分层检测流程与一个抓取型异常实例,可据此判断智能体行为审计在生产中的落地方式。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型,前者面向规模化与成本效率,后者面向高复杂度任务与多步推理。
推荐理由:官方给出两款语音模型在语音质量与智能体任务基准上的排名和分数,可据此判断实时语音智能体的能力水位。
Google 发布 autofinetune 项目,把自主研究循环用于 LLM 后训练,基于 Tunix、Gemma 和 Cloud TPU,由 Antigravity CLI 与 Gemini Flash 3.7 编排。
推荐理由:原文给出自主后训练循环的完整配置与两个真实案例,可据此迁移到自己的微调流程。
Google Developers Blog 发文介绍智能体编码系统的 harness engineering,主张用行为评估补充 Terminal-Bench、DeepSWE 等端到端基准,断言智能体的中间执行步骤而非最终输出。
推荐理由:Google 团队给出行为评估的写法与三步测试循环,可作为智能体编码系统迭代时的可迁移方法。
Google 发布 Agent Development Kit(ADK)for Kotlin 1.0 正式版,与 ADK 1.0 Core 功能对齐,并加入 Android 优先的端侧扩展。
推荐理由:官方给出 1.0 的功能清单与 Android 端侧扩展,可据此判断 Kotlin 智能体开发的可用边界。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,超过 AlphaFold Database 的 30 倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单碱基变异的预测结果做成可检索资源,读者可了解基因组变异解读的规模化路径。
Google for Startups AI Agents Challenge 评审发现,排名靠前的参赛作品反复出现四种工程模式:双向 MCP(智能体既是自身工具的客户端,也是其他智能体可调用的服务端)、事件驱动并发(智能体通过事件总线并行响应同一信号而非串行调用)、同标准回退(小模型顶替过载模型时仍走同一验证函数)、分层路由(先用正则和廉价模型分类,再交给完整推理模型)。
推荐理由:从真实参赛代码中提炼四种智能体工程模式,可迁移到自己的构建中。
Google Cloud 将原生 TPU 支持集成进 vLLM,并以 Qwen3-Embedding-8B 和 Qwen3-VL-Embedding-8B 为目标模型做了多项工程优化,支持 4K+ token 文本和 15K+ token 多模态输入。
推荐理由:原文给出 vLLM-TPU 上部署 Qwen3 嵌入模型的具体优化与开源配方,可了解长上下文多模态嵌入的工程路径。