跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

192条精选相关主题产品更新论文研究开源生态

最新精选

第 181–192 条 · 共 192 条
11月30日周三
9月21日周三
7月12日周二
  1. Hugging Face Blog78

    Hugging Face 发布 176B 参数开源多语言模型 BLOOM

    Hugging Face 发布 BLOOM,这是首个完全透明训练的多语言大语言模型,拥有 176B 参数,可生成 46 种自然语言和 13 种编程语言的文本。该项目由 70+ 国家、250+ 机构的 1000 多名研究人员协作完成,在法国巴黎南部的 Jean Zay 超算上训练 117 天(3 月 11 日至 7 月 6 日),算力资助价值约 €3M。

    推荐理由:原文交代了训练协作规模与开放许可细节,读者可据此理解大模型研究门槛如何被降低。

1月27日周四
1月5日周二
11月5日周二
  1. OpenAI News72

    OpenAI 发布 GPT-2 最大 1.5B 参数版本,完成分阶段发布

    OpenAI 发布 GPT-2 最大的 1.5B 参数版本,同时开放代码和模型权重以便利对 GPT-2 输出的检测,这是 GPT-2 分阶段发布的最终模型。作者表示自 8 月以来已有更大的语言模型发布,但仍按原计划推进,希望这一完整分阶段发布流程能为未来强大模型的开发者提供参考,并继续与 AI 社区讨论负责任的发布方式。

    推荐理由:原文交代了分阶段发布计划的收尾背景,读者可借此理解负责任发布这一做法的完整流程。

10月15日周二
  1. OpenAI News72

    OpenAI 用机器人手在模拟训练中学会解魔方

    OpenAI 训练了一对神经网络,让类人机器人手解开魔方。训练完全在模拟环境中进行,使用了与 OpenAI Five 相同的强化学习代码,并结合一种名为 Automatic Domain Randomization (ADR) 的新技术。系统能应对训练中未见过的情况,例如被毛绒长颈鹿戳碰,表明强化学习可解决物理世界中要求极高灵巧度的问题。

    推荐理由:原文点明训练完全在模拟中完成并迁移到物理世界,读者可据此理解强化学习在真实机器人上的可行性路径。

8月20日周二
  1. OpenAI News76

    OpenAI 发布 774M 参数 GPT-2 模型并开源法律协议

    OpenAI 在发布 124M 小模型、分阶段发布 355M 中模型及相关误用与社会效益研究后,正式发布 774M 参数的 GPT-2 语言模型。同时发布一份开源法律协议,方便组织之间发起模型共享合作,并公布技术报告介绍其与 AI 研究社区协调发布规范的经验。

    推荐理由:原文交代了分阶段发布路径与配套法律协议,读者可了解其模型共享合作的落地方式。

4月15日周一
  1. OpenAI News62

    OpenAI Five 连胜 Dota 2 世界冠军 OG

    OpenAI Five 在本周末的 Finals 中连胜两局,击败 Dota 2 世界冠军战队 OG,成为首个在电竞项目中战胜世界冠军的 AI。原文指出,OpenAI Five 与 DeepMind 的 AlphaStar 此前都曾在私下击败过顶尖职业选手但输掉了现场直播的比赛,因此这也是 AI 首次在直播中战胜电竞职业选手。

    推荐理由:原文点明这是 AI 首次在直播中战胜电竞职业选手,提供了与 AlphaStar 此前战绩的对照背景。

2月14日周四
8月11日周五