跳到正文
原文
Hugging Face Blog·· 2026-02-26精选AI 评分70

Hugging Face 博客解读 MoE 在 transformers 中的工程实现

Mixture of Experts (MoEs) in Transformers

AI 导读

Hugging Face 官方博客介绍 Mixture of Experts (MoE) 的原理及其在 transformers 库中的工程支持。文章以 gpt-oss-20b 为例说明总参数与激活参数的区别(21B 总参数、每 token 激活约 3.6B),并给出 M3 Ultra 上约 115 tok/s 的实测速度。

推荐理由

文章把 MoE 原理与 transformers 库的加载、后端、并行改造串起来,读者可据此理解工程落地路径。

来源:Hugging Face Blog · huggingface.co