跳到正文

全部动态

今日 4 条
7月10日周五
  1. Hugging Face Blog60

    PyTorch Profiling 系列第三篇:在 profiler 下对比六种注意力实现

    Hugging Face 发布 Profiling in PyTorch 系列第三篇,用 NVIDIA A100-SXM4-80GB 逐一 profile 注意力实现:手写朴素注意力、把 masked_fill 改成 masked_fill_ 的原地版本,以及 SDPA 的 math、efficient、flash、cudnn 四个后端。

    推荐理由:通过同一注意力实现在 profiler 下的六种形态对比,读者能学会先猜测再看 trace 的具体分析方法。

7月6日周一
5月16日周六
  1. Google DeepMind51

    Google DeepMind:剑桥大学用 Co-Scientist 缩短传染病研究周期

    Google DeepMind 介绍剑桥大学 Clare Bryant 教授使用 Co-Scientist 寻找病原体跨物种传播引发重症的分子开关。Bryant 先后输入课题摘要与完整基金申请书,工具生成并排序假设,最终锁定她此前未关注的蛋白并细化到具体氨基酸,团队正构建含相应突变的细胞系验证。她表示原本需两到三年的实验工作如今有望在六个月内完成。

  2. Google DeepMind47

    Google DeepMind Co-Scientist 加速肝病机制发现

    Google DeepMind 的 Co-Scientist 帮助爱丁堡大学生物工程师 Filippo Menolascina 团队缩小 MASH 联合疗法的搜索空间,并针对 resmetirom 只对少数合格患者起效的问题提出假设,将 NLRP3 inflammasome 指认为连接炎症与代谢的分子桥梁,该假设随后经实验验证,有望为靶向双联疗法铺路。

3月31日周二
3月11日周三
1月22日周四
  1. Mistral AI61

    Mistral AI 排查 vLLM 分离式部署内存泄漏:UCX mmap hook 是元凶

    Mistral AI 在 Engineering Deep Dive 系列首篇文章中复盘了排查 vLLM 内存泄漏的过程:在 Mistral Medium 3.1 配合 Prefill/Decode 分离式部署且启用 graph compilation 时,系统内存以 400 MB/分钟线性增长。

    推荐理由:逐层递进的排查路径和每种工具的失效原因,对定位同类底层内存问题有直接可迁移的方法价值。

11月1日周六
8月1日周五
4月9日周三
3月4日周二