跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

180条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 101–120 条 · 共 180 条
6月3日周二
  1. Hugging Face Blog74

    Hugging Face 发布开源 450M 视觉语言动作模型 SmolVLA

    Hugging Face 发布 SmolVLA-450M,一款 450M 参数的开源视觉语言动作模型,可在消费级硬件上运行,仅用 lerobot 标签下的社区共享数据集预训练,在 LIBERO、Meta-World 仿真及 SO100、SO101 真实任务上超过更大的 VLA 和 ACT 基线。

    推荐理由:原文给出了训练数据规模、架构取舍和异步推理收益,读者可据此评估小模型 VLA 在消费级硬件上的可行性。

5月23日周五
5月21日周三
5月15日周四
  1. Hugging Face Blog60

    Hugging Face Transformers 将标准化模型定义,降低跨框架贡献门槛

    Hugging Face 宣布 Transformers 将成为跨框架的模型定义枢纽:只要模型架构被 transformers 支持,就预期在生态其他部分同样被支持。

    推荐理由:原文说明了 Transformers 作为模型定义标准如何打通训练、推理与本地部署链路,读者可据此理解生态碎片化的应对方式。

4月25日周五
4月14日周一
  1. Hugging Face Blog60

    Hugging Face 收购 Pollen Robotics,将开售开源人形机器人 Reachy 2

    Hugging Face 宣布收购成立 9 年的开源机器人公司 Pollen Robotics,这是继 Gradio、XetHub 之后其第五次收购,并将开售首款开源人形机器人 Reachy 2,售价 $70,000,已在 Cornell、Carnegie Mellon 等实验室使用。

    推荐理由:梳理了 Hugging Face 从 LeRobot 到收购 Pollen Robotics 的完整布局,便于理解其开源机器人路线。

4月5日周六
  1. Hugging Face Blog88

    Hugging Face 迎来 Meta Llama 4 Maverick 与 Scout 模型

    Hugging Face 官方博客宣布 Meta 新一代 Llama 4 模型上线 Hub:Maverick 约 400B 总参数、128 专家,Scout 约 109B 总参数、16 专家,均为 17B 激活参数的 MoE 架构,支持文本与图像输入,训练数据最多 40 万亿 token、覆盖 200 种语言。

    推荐理由:原文拆解了 NoPE、分块注意力等架构选择,读者可理解超长上下文如何实现。

3月18日周二
  1. Hugging Face Blog74

    NVIDIA 在 GTC 2025 发布 Cosmos Transfer、Physical AI Dataset 与 Isaac GR00T N1 三项开源成果

    NVIDIA 在 GTC 大会上发布三项面向物理 AI 开发者的开源成果:世界基础模型 Cosmos Transfer、开源数据集 Physical AI Dataset,以及首个通用人形机器人推理开源模型 Isaac GR00T N1。

    推荐理由:梳理了三项开源发布的具体规格与架构细节,便于开发者评估可直接复用的模型与数据资源。

3月17日周一
  1. Mistral AI74

    Mistral AI 发布 Mistral Small 3.1 模型

    Mistral AI 宣布发布 Mistral Small 3.1,基于 Mistral Small 3 升级,改进了文本性能与多模态理解,上下文窗口扩展至 128k tokens,推理速度达 150 tokens per second,以 Apache 2.0 许可开源。

    推荐理由:原文列出了上下文、速度与运行门槛,读者可据此判断它是否适合端侧与低延迟场景。

3月12日周三
  1. Hugging Face Blog84

    Google 发布 Gemma 3:多模态、多语言、128k 上下文的开源 LLM

    Google 发布 Gemma 3 系列开源模型,包含 1B、4B、12B、27B 四种参数规模,提供预训练与指令微调版本,上下文窗口最高达 128k tokens,支持 140+ 语言,4B/12B/27B 版本可处理图文输入。

    推荐理由:原文拆解了长上下文、多模态与多语言三项技术改进的具体做法,便于理解开源模型的能力来源。

3月11日周二
  1. Hugging Face Blog66

    Hugging Face 与 Yaak 推出最大开源自动驾驶数据集 L2D

    Hugging Face LeRobot 团队与 Yaak 联合发布 Learning to Drive(L2D)开源自动驾驶数据集,R4 版本包含 90+ TB 多模态数据、5000+ 小时驾驶、来自德国 30 个城市的 6 路环视摄像头与完整车辆状态。

    推荐理由:对比表和分阶段发布计划让读者能直接评估该数据集相对现有开源数据集的规模与可用性差异。

2月21日周五
  1. Hugging Face Blog65

    Google 发布多模态视觉语言编码器 SigLIP 2

    Google 发布多模态视觉语言编码器家族 SigLIP 2,在 sigmoid loss 基础上加入解码器、Global-Local Loss 和 Masked Prediction Loss 等辅助训练目标,以提升语义理解、定位与稠密特征能力。

    推荐理由:文章拆解了从 SigLIP 到 SigLIP 2 的训练目标演进,读者可据此理解辅助损失如何改进视觉编码器。

2月20日周四
  1. Hugging Face Blog62

    Hugging Face 发布 SmolVLM2 系列视频理解模型

    Hugging Face 发布 SmolVLM2 系列三个新模型,参数量分别为 2.2B、500M 和 256M,主打在手机到服务器等各类设备上运行视频理解。2.2B 版本在 Video-MME 上超过现有 2B 模型,500M 和 256M 版本被称为迄今发布的最小视频语言模型,其中 500M 版本以不到四分之一的参数量接近 2.2B 的视频理解能力。

    推荐理由:原文给出三档参数量、Video-MME 表现和 MLX/Swift 接入方式,读者可据此判断小模型视频理解能否落到自己的设备上。

2月14日周五
2月11日周二
  1. Hugging Face Blog61

    Hugging Face Open R1 发布 OpenR1-Math-220k 数学推理数据集

    Hugging Face 的 Open R1 项目发布首个大规模数学推理数据集 OpenR1-Math-220k,用 512 张 H100 本地跑 DeepSeek R1 生成 800k 条推理轨迹,经 Math Verify 与 Llama3.3-70B-Instruct 判分过滤后保留 220k 道题的正确轨迹。

    推荐理由:原文公开了数据生成与过滤的完整流水线和训练对照结果,读者可据此复现或迁移到其他领域。

2月4日周二
  1. Hugging Face Blog71

    Hugging Face 开源复现 OpenAI Deep Research,GAIA 验证集达 55.15%

    Hugging Face 在 24 小时冲刺中开源复现 OpenAI 的 Deep Research,基于 smolagents 构建的开源智能体在 GAIA 验证集上取得 55.15% 的成绩,超过此前开源框架 Magentic-One 约 46% 的水平。

    推荐理由:文中给出了代码动作相对 JSON 的具体优势和可复现的性能差距,读者可据此判断智能体框架选型的影响。

2月2日周日