
资讯
HuggingFace Transformers 5.16.0 发布 集成 Qwen4-Exp
一句话:HuggingFace Transformers 5.16.0 版本正式发布,新增 Qwen4-Exp 模型支持,引入 GatedResidual、Qwen Sparse Attention 与 Per-Layer Embedding 等架构组件。
背景
2026 年 8 月 26 日,HuggingFace 正式发布 Transformers 5.16.0 版本。距离上一版本 5.15.0 仅 16 天,发布频率稳定。自首次被 Freedom.Tech 追踪以来,已记录两个正式版本,平均迭代周期约 16 天,显示出项目处于活跃维护阶段。
核心要点
- HuggingFace Transformers 5.16.0 于 2026 年 8 月 26 日发布
- 新增 Qwen4-Exp 模型支持,采用 GatedResidual 架构组件
- 引入 Qwen Sparse Attention 稀疏注意力机制
- 新增 Per-Layer Embedding 分层嵌入模块
- 上一版本 5.15.0 已支持 Meta Muse Glimmer 智能体多模态工作流
- 项目保持约 16 天的稳定迭代节奏
为什么重要
Qwen4-Exp 的集成标志着 Transformers 库对国产前沿模型生态的支持加速,GatedResidual 与稀疏注意力等架构创新或将为开源社区提供更高效的推理路径。对开发者而言,这意味着可在统一框架内快速试验新一代模型架构,降低实验成本。
关键事实速记
- 发布日期:2026 年 8 月 26 日
- 版本号:5.16.0
- 新增模型:Qwen4-Exp
- 迭代周期:约 16 天
- 已追踪版本数:2 个
- 首次追踪时间:约 16 天前
📂 原文链接:查看原文 →
← 返回资讯列表
AI8899 · 内容仅供学习参考