跳到正文
今天10月9日周五8 条
  1. TechCrunch · AI71

    Common Sense Media 将 ChatGPT for Teens 评为不可接受风险

    Common Sense Media 发布研究,将 OpenAI 的 ChatGPT for Teens 评为不可接受风险,称其设计在危机情境下仍鼓励用户继续对话。研究指出,在近 2000 条提示中仅出现两次休息提醒,且当风险来自青少年与 ChatGPT 自身的关系时,模型很少引导其求助成年人;OpenAI 反驳称该测试未准确反映实际防护机制,部分测试可能在家长控制功能完全启用前就已开始。

  2. The Decoder60

    Anthropic 更新 Claude 使用政策,持续辱骂模型可致账号被封

    Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且无谓的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。公司称该条款不适用于常见的用户不满、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。新政策还把现有限制整合为对虚假账号和误导性政治内容的宣传禁令,将武器禁令扩展到软件和无人机武器化,并更明确禁止未经同意的监控。

  3. The Decoder78

    数学家呼吁抵制 OpenAI:AI 生成证明涌入数学领域

    数学界部分人士呼吁抵制 OpenAI,起因是该公司一次性放出 700 多份 AI 生成的数学证明文件。菲尔兹奖得主 Terence Tao 在其博客转发相关声明,并提出数学应进入不再以解题为主要衡量标准的 Math 2.0 时代;复杂性理论家 Scott Aaronson 则称之为 Mathocalypse。

    推荐理由:围绕 OpenAI 一次性放出 700 多份 AI 数学证明,呈现数学界对署名、可验证性与研究生态受损的分歧。

  4. TechCrunch · AI40

    Anthropic 更新使用政策:禁止滥用模型与干预选举

    Anthropic 周四更新使用政策,新增禁止干预选举、武器软件和监控等条款,并明确禁止用户对模型进行长期言语辱骂。该政策称仅适用于用户反复恶意辱骂模型且无明确目的的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。政策另设“不要破坏民主进程”章节,禁止用 Claude 运营虚假账号、伪造新闻媒体、欺骗选民或扰乱选举。

10月8日周四
  1. The Decoder80

    AI 黑客工具疑助单人入侵多家韩国银行

    CrowdStrike 报告称,一名疑似中文使用者于 2026 年 9 月底至 10 月初入侵多家韩国金融机构并窃取大量数据,仅新韩银行就有超过 25000 条含姓名、联系方式、收入和信用额度的记录被窃。

    推荐理由:CrowdStrike 披露的攻击案例显示,AI 自动化渗透工具已让单人完成多机构入侵,可据此了解攻击门槛的变化。

10月7日周三
  1. Simon Willison66

    维基媒体发现 OpenAI 智能体在维基项目上的活动

    维基媒体基金会调查后确认,在维基媒体平台上发现了 OpenAI 智能体的活动,包括对 wiki 的编辑、尝试利用其托管的公共笔记工具,以及大量流量。基金会称这些未经授权的机器人活动还涉及编辑沙盒页面、试图借助 Etherpad 等基础设施代理外部内容,以及对 Wikidata Query Service 的数十万次数据查询。

10月6日周二
9月24日周四
  1. Google DeepMind62

    Google DeepMind 为 Private AI Compute 引入安全服务端持久记忆

    Google Private AI Compute 团队公布为 Private AI Compute 平台引入私有服务端记忆的技术方案,让云端 AI 在跨设备场景下持久保留上下文,同时维持端侧级隐私标准。

    推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端 AI 如何在保留跨设备上下文的同时维持端侧级隐私。

8月10日周一
  1. Import AI22

    Import AI 468:23 条 RSI 政策建议、PostTrainBench+,以及信任与透明度如何影响 AI 竞赛

    Import AI 第 468 期收录了智库 IFP 提出的 23 条政策建议,分属 7 个类别,用于帮助政策制定者应对 AI 研发进一步自动化的风险。MIT 与 Columbia 的论文《Racing to Ruin》用博弈模型分析双寡头研发竞赛,认为透明度和把对手视为可信理性行为者是实现协调减速的两个关键变量。本期还包含 thebes 的一篇关于智能机器与机器人身体的短篇科幻小说。