跳到正文
10月7日周三
  1. Microsoft Research22

    Microsoft 研究员 Jennifer Neville 谈 AI 评测与「意外失败」的启示

    Microsoft 合伙人研究经理 Jennifer Neville 在 Microsoft Research Podcast 中讨论评测如何推动 AI 系统突破传统 benchmark 的性能边界,以及模型在超出常规测试时出现的「意外失败」。她结合自身从数学、物理、认知科学到计算机科学的经历,分享与当前 AI 系统协作的实用建议,并强调当结果偏离预期时应仔细审视数据。

9月25日周五
9月21日周一
  1. Sourcegraph Blog22

    Sourcegraph:自主代码库才是 AI 编程的下一步

    Sourcegraph 认为,AI 编程已把 prompt-to-PR 流程打磨到极致,但大型企业存量代码库的维护仍完全未解决。作者提出"自主代码库"构想:由触发器(定时任务、新 CVE、生产日志异常等)驱动可调用的智能体函数(全库 Deep Search、推送 PR、批量变更),组成确定性有向图工作流。未来企业将转向范围更窄、授权更小的智能体组合,而非继续泛化通用 harness。

9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解五大 AI 热梗:该不该读 AI 生成的代码、RAG 已死、Skills 杀死 MCP?

    GitHub Podcast 最新一期拆解了五个 AI 热门论断:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的 Markdown 专家经验,后者是连接工具与数据的标准协议,二者可组合使用;RAG 并未消亡,检索能为模型提供训练数据之外的相关信息,减少 token 浪费并降低答案不完整的概率。

9月1日周二
7月27日周一
  1. Sourcegraph Blog22

    Sourcegraph 谈合规优先 AI:如何为受监管工程团队证明智能体溯源

    Sourcegraph 提出以"限定范围检索"为智能体留下可审计的溯源记录,即明确列出智能体在改动代码前读过哪些文件及原因。其 Deep Search 会在每次回答中返回显式来源清单,MCP server 则把读文件、关键词搜索、跳转定义等操作拆成可单独观测的事件,并受仓库权限与 scoped token 约束,处理在用户自有实例内完成,仅模型调用对外。

7月13日周一
7月7日周二
6月9日周二
4月14日周二
3月7日周六
2月28日周六
  1. Continue Blog22

    AI Slop 是流程问题,不是人的问题

    Continue 提出,AI 生成代码引发的低质问题应归因于流程缺失而非开发者个人。采用 AI 辅助编码的团队 PR 提交量提升 2-5 倍,但代码从 agent 到合并缺乏标准强制检查,无人拦截缺失的限流、输入校验等问题。Continue 将团队标准写成仓库中的 markdown 检查文件,每个 PR 上以完整 agent 运行,通过则静默、失败则给出具体问题和修复建议。

2月16日周一
  1. Continue Blog22

    Continue:如何用“Chiseling”打磨 Vibe Code

    Continue 提出在 vibe coding 之后增加“Chiseling(凿刻)”环节,即人工重构和打磨 AI 生成的代码,把重复功能、1000 行方法和无用单测清理成清晰的逻辑核心。团队规模扩大后,凿刻会成为瓶颈,因此需要在 CI/CD 中引入云端智能体自动检查命名、抽象、测试与安全规范,把资深工程师的打磨标准编码为对每个 PR 的系统化审查。

12月4日周四