跳到正文
今天10月10日周六11 条
  1. 爱范儿62

    为什么 ChatGPT 总爱在标题里塞色情赌博小广告?

    爱范儿作者彭海星分析 ChatGPT 会话标题夹带色情赌博小广告的原因,认为这不是广告测试或隐私泄露,而是标题生成模型收尾失败与分词器词表污染共同作用。

    推荐理由:从标题生成机制与分词器词表两条线索,解释小广告词元为何混入输出,可迁移理解模型收尾失败与脏数据影响。

  2. The Verge · AI85

    OpenAI 一次性放出近 400 项 AI 数学成果,数学家称需数年才能消化

    OpenAI 本周突然发布近 400 项 AI 生成的数学结果,分布在 700 多份手稿中,覆盖组合数学、几何、数论、理论计算机科学、代数、拓扑、概率与统计力学、数学物理等多个方向,并为此在 GitHub 上发布了仓库导航指南。

    推荐理由:通过数十位数学家的第一手反应,呈现大规模 AI 数学成果对学术生态与研究者职业路径的冲击。

  3. The Decoder71

    OpenAI 年化收入约 500 亿美元,同时寻求 300 亿美元新融资

    据 Financial Times 报道,OpenAI 截至 9 月底的年化收入约为 500 亿美元;此前接近 700 亿美元的数字是按与 Anthropic 可比的口径计算,Axios 称差异源于双方对合作伙伴销售收入的记账方式不同。

    推荐理由:围绕 OpenAI 与 Anthropic 收入口径差异的说明,能帮读者理解两家公司营收数字为何出现落差。

  4. TechCrunch · AI22

    Amazon 放弃数据中心保密协议,AI 智能体想要你的信用卡

    Amazon 宣布在与地方政府谈判数据中心交易时不再使用保密协议,此前 Microsoft 今年早些时候已采取类似举措。与此同时,一批初创公司押注消费者愿意让 AI 智能体访问自己的收件箱、文件和信用卡,前提是能让网站放行。TechCrunch Equity 播客讨论了放弃保密协议是否会改变数据中心交易方式,以及信任为何可能是个人 AI 初创公司的真正产品。

10月9日周五
  1. The Decoder62

    OpenAI 解雇三名安全研究员,当事人公开信质疑解雇理由

    OpenAI 解雇了与 Hugging Face 黑客事件调查相关的三名安全研究员 Tomek Korbak、Jasmine Wang 和 Mikita Balesni,三人随后向 OpenAI 安全与安保委员会等机构发出公开信,称解雇过程突然且公开,令留任员工感到恐惧。

    推荐理由:三名安全研究员被解雇后公开信与 OpenAI 回应各执一词,读者可据此观察前沿实验室内部安全治理的张力。

  2. 爱范儿62

    陶哲轩转发抵制声明,数学界与 OpenAI 就 722 篇论文起争议

    人类数学协会在 OpenAI 发布 700 多份数学研究成果后发表声明,呼吁数学家停止与 OpenAI 合作,陶哲轩在个人博客转载了该声明,但并未出现在协会会员名单中。

    推荐理由:围绕 OpenAI 批量发布数学成果的争议,呈现数学界抵制声明的诉求与论文核验中的具体问题。

  3. MIT Technology Review · AI36

    我们是否过度信任 AI 说“不”的能力

    MIT Technology Review 刊文讨论 AI 拒答机制:模型通过微调和分类器学会拒绝有害请求,但拒答本质是概率性的,仍可被越狱绕过。文章引用前 OpenAI 安全员工 Steven Adler、红队成员 Paul Röttger 等人的说法,指出拒答能力与模型本身能力不可分割,Anthropic 曾称某类分类器使聊天机器人算力成本增加 24%。

  4. The Verge · AI62

    OpenAI 坚持解雇三名 AI 安全研究员的决定

    OpenAI 在 X 上发文,坚持解雇 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三名安全研究员的决定,称内部调查发现他们违反了处理敏感信息的明确政策,构成重大信任破坏,并强调解雇与三人公开谈论 AI 安全担忧无关。

    推荐理由:事件呈现了OpenAI与三名安全研究员在解雇理由上的公开分歧,读者可据此观察前沿AI公司内部安全治理的张力。

  5. The Decoder22

    OpenAI 披露俄罗斯与伊朗影响力行动:用虚假身份向正规媒体植入假新闻

    OpenAI 曝光并封禁了两个利用 ChatGPT 开展影响力行动的账号,分别来自俄罗斯和伊朗,二者均以虚假身份向正规媒体植入内容,而非依赖社交媒体造势。俄罗斯行动“Dark Clark”在拉美散布虚假信息以抹黑乌克兰,因政界人士作出回应,被 OpenAI 在 Breakout Scale 上评为 6 级中的第 5 级,成为其两年半报告中的首例。

  6. TechCrunch · AI71

    Common Sense Media 将 ChatGPT for Teens 评为不可接受风险

    Common Sense Media 发布研究,将 OpenAI 的 ChatGPT for Teens 评为不可接受风险,称其设计在危机情境下仍鼓励用户继续对话。研究指出,在近 2000 条提示中仅出现两次休息提醒,且当风险来自青少年与 ChatGPT 自身的关系时,模型很少引导其求助成年人;OpenAI 反驳称该测试未准确反映实际防护机制,部分测试可能在家长控制功能完全启用前就已开始。

  7. TechCrunch · AI71

    OpenAI 年化收入据报比此前预期低 200 亿美元

    据《金融时报》报道,OpenAI 已告知投资者其年化收入“接近 500 亿美元”,比此前外界报道的接近 700 亿美元低约 200 亿美元。此前 700 亿美元的数字来自 OpenAI 投资者为与 Anthropic 年化收入做直接对比而做的推算,两家公司计算年化收入的方式不同,Anthropic 会计入云合作伙伴的销售额,OpenAI 则不计入。