《大语言模型基础》一书发布,涵盖预训练、提示词与对齐等六大主题
一本名为《Foundations of Large Language Models》的大语言模型基础书籍发布,全书共六章,分别聚焦预训练、生成模型、提示词、对齐、推理与 reasoning。该书面向大学生、NLP 从业者及相关领域读者,可作为大语言模型的参考读物。
一本名为《Foundations of Large Language Models》的大语言模型基础书籍发布,全书共六章,分别聚焦预训练、生成模型、提示词、对齐、推理与 reasoning。该书面向大学生、NLP 从业者及相关领域读者,可作为大语言模型的参考读物。
针对四种语言、四个模型的指令级消融实验显示,同一语义的系统提示词在英语中协同、在西班牙语中竞争,这种拓扑反转由社会语域(祈使语气的强制力差异)介导。将单个指令块改写为陈述式可减少 81% 的跨语言差异(p = 0.029,置换检验);改写 11 个祈使块中的 3 个即可使西班牙语指令拓扑从竞争转为协同,并溢出影响未改写块。
研究对 D-POAF 决策实践中的五种定量算子进行不确定性压力测试,发现独立估计误差下逆 MSE 聚合达到 MAE 0.615,较最佳单一估计器降低 42.2%,但误差相关性 rho=0.6 时增益降至 4.4%,rho=0.8 时转为负值。
一篇被 SSR 2026 收录的 SoK 论文系统梳理了 Common Criteria(ISO/IEC 15408)产品评估中的反复出现的失效模式,基于标准、ISO/IEC 18045 评估方法、NIAP 保护轮廓及公开安全目标与认证报告,构建了覆盖安全目标范围界定、保护轮廓符合性、保障证据、密码要求、功能测试、漏洞分析、运维指南和认证后配置漂移的生命周期分类体系。
RAND 发布报告提出美国应以"自由行动"战略应对超级智能,通过构建人机生态、AI 安全架构、改造国家安全体系及提升公民应对能力来保留选项。报告还归纳了共存、拒止、加速三类共七种原型战略,并列出危险临近程度、共存可行性等五项关键不确定性。
Google 开发者博客介绍深度学习在天体粒子物理中的应用:Pierre Auger 天文台用 1500 多个探测器站覆盖 3000 km² 捕捉宇宙线空气簇射,IceCube 以约 1 km³ 南极冰探测中微子,这些观测站的空间分布式传感器以纳秒级读出记录波形,数据结构类似图像,适合用深度学习分析。文章指出这些方法有望提升仪器灵敏度、发现隐藏模式并搜索信号异常。