跳到正文

论文研究

值得读的 AI 论文与研究成果:架构创新、训练方法、能力测量与理论进展的精选解读。

最新精选

第 21–35 条 · 共 35 条
3月12日周四
2月13日周五
2月10日周二
2月4日周三
  1. Google Research60

    Google Research 将与 Included Health 开展全国随机对照研究评估对话式 AI

    Google Research 宣布将与 Included Health 合作,在 IRB 批准后启动一项前瞻性、经知情同意的全国随机对照研究,评估对话式 AI 在真实虚拟医疗场景中的表现,与标准临床实践进行对照。

    推荐理由:梳理了从模拟研究到真实临床的分阶段评估路径,可理解医疗 AI 证据生成的推进逻辑。

1月14日周三
11月25日周二
  1. Google DeepMind63

    AlphaFold 助力解析心脏病关键蛋白 apoB100 结构

    Google DeepMind 宣布借助 AlphaFold,密苏里大学研究者解析了赋予“坏胆固醇”形态的关键蛋白 apoB100 的结构。研究者先用冷冻电镜(cryo-EM)拍摄 LDL 颗粒图像,再用 AlphaFold 生成原子级分辨率预测并对照实验数据精修,得到包裹 LDL 颗粒的笼状外壳及维持颗粒完整的带状结构,为高胆固醇和动脉粥样硬化性心血管疾病的防治提供了新可能。

    推荐理由:原文说明了冷冻电镜与 AlphaFold 结合如何突破 50 年未解的结构难题,读者可了解这一方法的迁移价值。

9月10日周三
6月6日周四
5月31日周三
  1. OpenAI News66

    OpenAI 用过程监督提升数学推理并取得新 SOTA

    OpenAI 训练的模型通过奖励每一步正确的推理过程(过程监督)而非仅奖励最终答案(结果监督),在数学问题求解上取得新的 SOTA。原文指出过程监督除提升性能外,还能直接训练模型产出经人类认可的 chain-of-thought,带来对齐层面的收益。

    推荐理由:原文对比了过程监督与结果监督的差异,读者可据此理解奖励每一步推理对性能和对齐的双重作用。

5月28日周四
1月23日周四
9月17日周二
  1. OpenAI News61

    OpenAI:多智能体捉迷藏游戏中涌现出渐进复杂的工具使用

    OpenAI 报告在新的模拟捉迷藏环境中训练智能体,观察到它们在简单游戏中逐步发现愈发复杂的工具使用,累计形成六种不同的策略与反策略,其中部分策略是作者此前不知道环境所支持的。这种简单环境中的自监督涌现复杂性表明,多智能体协同适应有朝一日可能产生极其复杂和智能的行为。

    推荐理由:原文以捉迷藏游戏为例说明多智能体对抗如何催生出连作者都未预料的工具使用策略,可帮助理解涌现行为的研究路径。

6月11日周一
  1. OpenAI News66

    OpenAI 用无监督预训练在语言任务上取得 SOTA 结果

    OpenAI 宣布用一个可扩展、任务无关的系统在多种语言任务上取得 state-of-the-art 结果,并同步开源该系统。其方法结合了 transformer 与无监督预训练两个已有思路,结果表明监督学习方法搭配无监督预训练效果很好,作者希望这一结果能推动在更大、更多样数据集上开展相关研究。

    推荐理由:原文点明了方法组合与可迁移结论,读者可据此理解监督学习配无监督预训练这一思路的价值。

5月16日周三
  1. OpenAI News61

    OpenAI 分析:2012年以来最大AI训练算力呈指数增长

    OpenAI 发布分析显示,自2012年以来最大规模AI训练所用算力以3.4个月翻倍的速度指数增长,同期累计增长超过300,000倍,而摩尔定律的翻倍周期为2年、同样条件下仅对应7倍增长。文章指出算力提升是AI进步的关键组成部分,若这一趋势延续,需要为远超当前能力的系统做好准备。

    推荐理由:给出了算力增长的量化趋势和与摩尔定律的对比,读者可据此理解AI能力扩张的速度背景。

10月11日周三
  1. OpenAI News61

    OpenAI 发现自博弈让 AI 自主学会体育动作技能

    OpenAI 表示自博弈让模拟 AI 无需专门设计环境即可自行发现铲球、躲闪、假动作、踢球、接球和鱼跃扑球等身体技能,并确保环境难度始终适合 AI 提升。结合此前 Dota 2 的自博弈结果,OpenAI 表示对自博弈将成为未来强大 AI 系统核心部分的信心在增加。

    推荐理由:原文把 Dota 2 与足球自博弈结果并列,说明自博弈可迁移到不同环境并自动匹配难度。