跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

179条精选相关主题产品更新论文研究开源生态

最新精选

第 81–100 条 · 共 179 条
1月14日周三
  1. Google Research74

    Google 发布 MedGemma 1.5 4B 医学多模态模型与 MedASR 医疗语音识别模型

    Google 发布 MedGemma 1.5 4B,支持 CT、MRI、全片病理等高维医学影像解读,以及胸片时序回顾、解剖定位和检验报告结构化抽取,并同步推出面向医疗听写的开源语音识别模型 MedASR。

    推荐理由:原文给出了各医学影像模态的具体基准提升数字,读者可据此判断该模型在实际医疗场景中的可用程度。

12月18日周四
12月17日周三
  1. Google DeepMind86

    Google DeepMind 发布 Gemini 3 Flash 模型

    Google DeepMind 发布 Gemini 3 Flash,主打前沿智能与速度兼得、成本更低,已在 Gemini API、Google AI Studio、Gemini CLI、Google Antigravity、Vertex AI、Gemini Enterprise 开放预览,并成为 Gemini app 与 Search AI Mode 的默认模型。

    推荐理由:原文给出多项基准分数、定价与速度对比,读者可据此判断它在成本与能力上的取舍位置。

12月16日周二
12月11日周四
  1. OpenAI News76

    OpenAI 发布 GPT-5.2,主打数学与科学能力

    OpenAI 发布 GPT-5.2,称其为迄今数学与科学能力最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上取得新的 state-of-the-art 结果。文章说明这些提升如何转化为实际研究进展,包括解决一个开放的理论问题和生成可靠的数学证明。

    推荐理由:原文点出该模型在数学与科学基准上的提升如何转化为解决开放理论问题的实际进展。

  2. OpenAI News78

    OpenAI 发布 GPT-5.2

    OpenAI 发布 GPT-5.2,称其是面向日常专业工作的最先进前沿模型,具备 state-of-the-art 的推理、长上下文理解、编码和视觉能力。该模型已在 ChatGPT 和 OpenAI API 中可用,用于驱动更快、更可靠的 agentic workflows。

    推荐理由:官方定位说明它面向日常专业工作,读者可据此判断与既有模型的取舍。

12月9日周二
12月3日周三
11月20日周四
11月19日周三
  1. OpenAI News65

    OpenAI 发布 GPT-5.1-Codex-Max 编码模型

    OpenAI 发布 GPT-5.1-Codex-Max,这是面向 Codex 的更快、更智能的 agentic 编码模型,面向长时运行的项目级任务设计,增强了推理能力和 token 效率。

    推荐理由:原文点明该模型面向项目级长任务并强调推理与 token 效率,读者可据此判断其与既有 Codex 模型的定位差异。

  2. Google DeepMind92

    Google DeepMind 发布 Gemini 3 系列模型

    Google DeepMind 发布 Gemini 3,先推出 Gemini 3 Pro preview,并同步上线 Gemini app、AI Studio、Vertex AI、Gemini CLI 及 Search 的 AI Mode,首次在 Search 第一天接入。

    推荐理由:官方给出了各基准的具体分数与开放入口,读者可据此评估其相对 2.5 Pro 的实际提升。

11月17日周一
  1. Google DeepMind73

    Google DeepMind 发布 WeatherNext 2 天气预报模型

    Google DeepMind 和 Google Research 发布 WeatherNext 2 天气预报模型,预报生成速度提升 8x、分辨率可达 1 小时,单次输入可生成数百种可能情景,每个预测在单个 TPU 上耗时不到一分钟。

    推荐理由:原文说明了新模型的建模思路和落地入口,读者可据此判断它如何进入现有天气查询与业务流程。

11月13日周四
  1. OpenAI News74

    OpenAI 推出面向开发者的 GPT-5.1 API

    GPT-5.1 现已在 API 中提供,带来更快的自适应推理、扩展的提示词缓存、改进的编码性能,以及新的 apply_patch 和 shell 工具。

    推荐理由:官方点明了面向开发者的具体接口变化,读者可据此评估对现有工作流的影响。

11月12日周三
  1. OpenAI News72

    OpenAI 发布 GPT-5.1,ChatGPT 更智能更自然

    OpenAI 宣布升级 GPT-5 系列,推出更温暖、更强能力的 GPT-5.1,并新增定制 ChatGPT 语气和风格的方式,今日开始向付费用户推出。

    推荐理由:官方说明了模型语气与可定制性的变化,读者可据此判断它对日常对话体验的影响。

9月30日周二
  1. OpenAI News67

    OpenAI 发布 Sora 2 系统卡

    OpenAI 发布 Sora 2 系统卡,介绍其新一代视频与音频生成模型。Sora 2 在 Sora 基础上引入更准确的物理表现、更强的真实感、同步音频、增强的可控性以及更广的风格范围等此前视频模型难以实现的能力。

9月9日周二
  1. Hugging Face Blog61

    Hugging Face 发布 mmBERT 多语言编码器模型

    Hugging Face 发布 mmBERT,一个基于 ModernBERT 构建的大规模多语言编码器模型,使用 3T+ tokens、覆盖 1800 多种语言训练,是首个在性能与速度上超越 XLM-R 的同类模型。

    推荐理由:原文给出三阶段训练与低资源语言在衰减阶段快速学习的细节,可迁移其渐进式多语言训练思路。