跳到正文
今天10月9日周五6 条
  1. arXiv cs.SE30

    超越组件测试:Agentic AI 系统的验证研究综述

    一项系统映射研究综合 262 篇论文,指出 Agentic AI 系统的验证需从组件测试转向对多步轨迹的上下文验证。研究提出覆盖行为、安全、时序、监管与多智能体五个维度的分类体系,发现文献集中于行为评估(105 篇),时序有效性最薄弱(仅 14 篇)。论文结合医疗、工业运营与智能出行三个案例,提出以有限自主规范、对抗性轨迹生成、运行时监控和可审计证据结构为核心的研究议程。

  2. arXiv cs.SE26

    DITTO:面向 Pickle 格式预训练模型的安全审计上下文感知扫描器

    针对 Pickle 格式预训练模型的安全审计工具 DITTO 发布,它通过追踪 Pickle 虚拟机状态转移并进行上下文感知语义分析来推断模型意图。对超 1 万个 Hugging Face 仓库的分析显示 9.3% 仍依赖 Pickle;DITTO 实现 100% 扫描覆盖率、0% 漏报率和 0.7% 误报率,F1 达 0.966。

9月16日周三
  1. Google Developers Blog60

    Gemini Enterprise Agent Platform 上线 Agent Anomaly Detection 私测

    Google 在 Gemini Enterprise Agent Platform 上为 Agent Anomaly Detection 开启 Private Preview,用推理层审计智能体的推理轨迹、工具调用和执行流程,标记行为异常、可疑意图与策略违规。

    推荐理由:原文给出分层检测流程与一个抓取型异常实例,可据此判断智能体行为审计在生产中的落地方式。

9月15日周二
9月4日周五