← 资讯列表
资讯

HuggingFace Transformers 5.16.0 发布 集成 Qwen4-Exp

📅 2026/9/11 23:04:17👁 1 阅读⏱ 约 3 分钟

一句话:HuggingFace Transformers 5.16.0 版本正式发布,新增 Qwen4-Exp 模型支持,引入 GatedResidual、Qwen Sparse Attention 与 Per-Layer Embedding 等架构组件。

背景

2026 年 8 月 26 日,HuggingFace 正式发布 Transformers 5.16.0 版本。距离上一版本 5.15.0 仅 16 天,发布频率稳定。自首次被 Freedom.Tech 追踪以来,已记录两个正式版本,平均迭代周期约 16 天,显示出项目处于活跃维护阶段。

核心要点

  • HuggingFace Transformers 5.16.0 于 2026 年 8 月 26 日发布
  • 新增 Qwen4-Exp 模型支持,采用 GatedResidual 架构组件
  • 引入 Qwen Sparse Attention 稀疏注意力机制
  • 新增 Per-Layer Embedding 分层嵌入模块
  • 上一版本 5.15.0 已支持 Meta Muse Glimmer 智能体多模态工作流
  • 项目保持约 16 天的稳定迭代节奏

为什么重要

Qwen4-Exp 的集成标志着 Transformers 库对国产前沿模型生态的支持加速,GatedResidual 与稀疏注意力等架构创新或将为开源社区提供更高效的推理路径。对开发者而言,这意味着可在统一框架内快速试验新一代模型架构,降低实验成本。

关键事实速记

  • 发布日期:2026 年 8 月 26 日
  • 版本号:5.16.0
  • 新增模型:Qwen4-Exp
  • 迭代周期:约 16 天
  • 已追踪版本数:2 个
  • 首次追踪时间:约 16 天前

📂 原文链接:查看原文 →

← 返回资讯列表 AI8899 · 内容仅供学习参考