DeepSpeed v0.19.2 补丁版本发布
DeepSpeed 发布 v0.19.2 补丁版本,新增 engine.coalesce_grad_reduction() 支持 ZeRO 1/2/3 多次反向传播,并加入 AutoEP 与 Biren SUPA 加速器支持。
DeepSpeed 发布 v0.19.2 补丁版本,新增 engine.coalesce_grad_reduction() 支持 ZeRO 1/2/3 多次反向传播,并加入 AutoEP 与 Biren SUPA 加速器支持。
MCP Servers 发布 2026.6.16 版本,由 actions-user 于 6 月 16 日打上标签。该版本随附 2 个资源文件,仓库当前有 202 个 issue 和 293 个 pull request。
LMDeploy 发布 v0.14.0a2,新增 FP8 KV cache 量化、Qwen3 Omni 支持,并在 turbomind 后端支持 Qwen3.5(vit)推理。该版本还加入 OpenAI Responses 兼容端点,扩展 chat completions 与 v1/messages 的 token 输入输出并返回 routed experts。
MCP Servers 发布 2026.6.3 版本,标签为 0e5f158。该版本由 actions-user 于 6 月 4 日打标签,发布资源共 2 项。
Axolotl v0.17.0 发布,新增基于 DeepEP 的 MoE 专家并行(EP)训练、BitNet 1.58-bit 全量微调,以及通过 Tinker 兼容 API 的远程训练。
LMDeploy 发布 v0.14.0a1,新增 FP8 KV cache 量化,并加入 Qwen3.5 MoE lite AWQ 支持。该版本扩展 chat completions 接口,支持 token-in/out 与返回 routed experts,并按 OpenAI 规范新增 AllowedToolChoice、解析失败返回 400。
LLaMA-Factory 发布 v0.9.5,新增对 Qwen3.5/Qwen3.6、Gemma 4 模型的主要支持,并兼容 Transformers v5。
smolagents 发布 v1.26.0,WebSearchTool 新增 Exa 作为搜索引擎选项,同时移除了远程 WasmExecutor。该版本还回滚了 ToolSerializer.dumps 的 f-string 转义修复,并更新了 LocalPythonExecutor 的 docstring。
DeepSpeed 发布 v0.19.1,新增 bf16 优化器状态 CPU offload 支持,并优化单例 MoE 通信、ZeRO-3 通过 mori 实现 SDMA allgather。该版本修复了 FastFileWriter 文件描述符泄漏、ZeRO-3 前向崩溃及 gemma4 注意力头等问题,同时支持 flash-attn 2.7.0 与 PyTorch v2.11 兼容。
smolagents 发布 v1.25.0,修复远程执行器的高危漏洞,并将 WasmExecutor 通配符绑定改为仅回环端点、为 Docker 与 Wasm 执行器引入 token 认证。该版本还移除旧版无前缀 pickle 支持、将 allow_pickle 默认设为 False,并新增 MLflow 集成文档与 Python 执行器参考页。
LMDeploy 发布 v0.13.0,新增 Anthropic 兼容服务端点,并支持 TurboQuant(quant_policy=42)的 KV Cache 量化。
PEFT 发布 v0.19.1 补丁版本,包含 #3161 和 #3165 两项修复。该版本由 BenjaminBossan 于 4 月 16 日发布,自上一版本以来主分支已有 325 次提交。
PEFT 发布 v0.19.0,一次性新增 GraLoRA、BD-LoRA、Cartridges、PVeRA、PSOFT、Lily、PEANuT、TinyLoRA、AdaMSS 共 9 种 PEFT 方法。
Axolotl 发布 v0.16.1,新增对 Gemma 4 的支持,并附带示例 YAML 配置。该版本自 v0.16.0 以来共合并 356 个提交,完整变更可通过 v0.16.0...v0.16.1 对比查看。
Axolotl 发布 v0.16.0,新增异步 GRPO 强化学习训练,集成 vLLM 并支持 LoRA 权重同步与 FP8,在 Qwen2-0.5B 上步时从 3.79s 降至 1.59s,提速 58%。
Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,可在特征、数据与模型组件归因中大规模识别驱动 LLM 输出的关键交互。SPEX 利用稀疏性与低阶性将交互搜索转化为稀疏恢复问题,ProxySPEX 进一步借助层级结构,以约少 10 倍的消融次数达到 SPEX 的性能。
Axolotl 发布 v0.15.0,新增 GLM、Qwen3.5 及 Qwen3.5 MoE 模型支持,并引入 SonicMoE 内核与 ScatterMoE LoRA。
Axolotl 发布 v0.14.0,将底层 transformers 依赖从 v4 升级到 v5,并新增 MoE 内核选择(batched_mm、grouped_mm)及 scattermoe 自定义集成,显著提升 MoE 模型训练速度并降低显存占用。
MCP Servers 发布 v2026.1.26,更新了 @modelcontextprotocol/server-everything、@modelcontextprotocol/server-memory 和 mcp-server-time 三个包,版本号均为 2026.1.26。
smolagents 发布 v1.24.0,新增对 gpt-5.2* 系列模型的无停止序列支持,并为 Python 代码执行加入健壮的超时机制。该版本还兼容 Gradio 6,支持向 apply_chat_template 传递额外参数,并将 API 返回的工具调用统一转换为 smolagents 的 ChatMessageToolCall 格式。
MCP Servers 发布 v2026.1.14,更新了 @modelcontextprotocol/server-everything、@modelcontextprotocol/server-filesystem 和 mcp-server-git 三个服务包,版本号均为 2026.1.14。
伯克利 AI Research 提出一套基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,并在 NeurIPS 2025 论文中验证。该指标在彩色摄影、射电天文、无镜头成像和显微成像四个领域均能预测解码器性能,优化后设计可媲美端到端方法,且内存与算力需求更低、无需任务专用解码器。
PEFT 发布 0.18.1 补丁版本,为适配即将到来的 transformers v5 修复了若干特殊场景问题,并修复了此前无意要求 transformers >= 4.52 的回归问题。该版本还修复了在 AMD ROCm 上运行 PEFT 的问题。
LlamaFactory 发布 v0.9.4,仓库名从 LLaMA-Factory 改为 LlamaFactory,弃用 Python 3.9–3.10、要求 3.11–3.13,并从 pip 迁移到 uv 安装。
Model Context Protocol 发布 2025-11-25 修订版的稳定版本,规范已在 MCP 官网提供。该修订版的详细变更可查阅 2025-11-25 changelog。
推荐理由:MCP 2025-11-25 修订版转为稳定版,读者可据此确认协议版本状态并查阅变更清单。
smolagents 发布 v1.23.0,将默认 InferenceClient 模型切换为 Qwen/Qwen3-Next-80B-A3B-Thinking,并新增 gpt-5.1 支持。
Model Context Protocol 发布 2025-11-25 修订版候选(RC),规范以草案形式提供,详细变更见 2025-11-25 草案更新日志。该规范尚未最终定稿,RC 与正式版之间可能仍有改动,各 SDK 将按自身节奏采用,旧版本规范可能继续使用一段时间。客户端与服务端的版本确定流程参见 Version Negotiation 文档。
PEFT 发布 0.18.0,新增 RoAd、ALoRA、Arrow、WaveFT、DeLoRA、OSF 六种微调方法。RoAd 通过逐元素乘法学习 2D 旋转矩阵,是除 LoRA 外唯一支持混合 adapter 批次的 PEFT 方法;ALoRA 可按 token 序列选择性启用 LoRA 并复用 KV cache。