跳到正文

全部动态

今日 9 条
9月21日周一
  1. Hugging Face Blog62

    Hugging Face 发布 tokenizers v1:编码提速 3 至 30 倍

    Hugging Face 发布 tokenizers v1 候选版本,在 Apple M4 Max 单线程下编码速度比 v0.23 快 3 至 30 倍,八线程扩展效率为线性的 76%,且输出 token ID 与 v0.23 完全一致。

    推荐理由:原文给出 v1 与 v0.23 的逐项基准对比和实现改动,可据此判断分词器在训练与推理管线中的实际提速空间。

  2. Simon Willison43

    Simon Willison 引述 voxium:大公司全员用 Claude Code 写代码,无人阅读

    voxium 在 Simon Willison 的博客中描述了入职大公司半个月的见闻:从 L1 到 L7 工程师的规格、代码、测试、PRD、工单和报告全部由 Claude Code 生成,团队成员被迫每天工作 12 到 13 小时只为按回车,且没有人阅读产出的内容。管理层多次表示推代码不是瓶颈,质疑团队为何仍然很慢。

  3. Simon Willison45

    MCP was always a bad idea?(MCP 一直是个坏主意?)

    Simon Willison 撰文反驳"MCP 已过时"的观点,认为对 Claude Code、Codex 等可自由访问互联网的终端 agent 而言确实可直接调用 API,但 MCP 仍为受限场景提供关键价值:精确控制 agent 可访问的外部服务、在不让 agent 接触 API key 的前提下处理认证、提供连接与认证服务的 UI,以及强审计日志。

9月20日周日
9月19日周六
9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解 AI 热门观点:该不该读 AI 生成的代码、RAG 是否已死、Skills 是否杀死了 MCP

    GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是智能体连接工具与数据的标准,可组合使用;RAG 并未消亡,它让模型基于训练数据外的文档、内部知识和代码库上下文作答,避免浪费 token 并减少不完整回答。

9月17日周四
  1. GitHub Blog · AI & ML75

    GitHub 用 Copilot 将 Copilot 运行时迁移到 Rust 的实践复盘

    GitHub 工程师 Stephen Toub 复盘用 GitHub Copilot 把 Copilot agent runtime 从 TypeScript 重写为超过 80 万行生产级 Rust 的过程,代码主要由 AI 智能体编写,横跨 128 个 PR 并增量上线,性能提升数个数量级。

    推荐理由:GitHub 工程师复盘用 Copilot 把运行时从 TypeScript 迁到 Rust 的全过程,含多智能体协作与提示缓存数据。

9月16日周三
  1. Mistral AI56

    Mistral 与 Mozilla 合作,为 Firefox Smart Window 提供模型支持

    Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。双方称对话默认不保存在 Mozilla 服务器上,Mistral 等合作方同意零数据留存,Mistral 还会针对地区语言和方言微调模型。

  2. NVIDIA Blog60

    NVIDIA DSX 通过 MaxLPS 与 Flex 提升 AI 工厂每兆瓦产出

    NVIDIA 介绍 DSX 平台如何在固定电力预算下提升 AI 工厂产出:Lambda 在 HGX B200 服务器上首次验证 DSX MaxLPS,用与 16 节点满功率相同的预算运行 19 节点,集群 token 吞吐从约 4 million tokens per second 提升到 5 million(+24%),性能功耗比提升 23%。

    推荐理由:原文给出了 Lambda 实测的吞吐与能效数字,以及电网信号自动降载的生产案例,可据此评估其对电力受限场景的实际价值。

9月15日周二
9月12日周六
9月11日周五
  1. GitHub Blog · AI & ML40

    GitHub Copilot 应用新手指南:使用 diff、终端和浏览器面板

    GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让用户无需切换编辑器、终端和浏览器即可完成审查、运行和预览 AI 生成代码的完整流程。diff 面板以绿红高亮展示代码增删改,支持接受更改、留言或让 Copilot 修改;终端面板可直接运行项目命令并支持多窗口;浏览器面板的 Pick & Polish 工具可选中页面元素并让智能体调整。

9月10日周四
  1. Mistral AI26

    Cloudera 与 Mistral 达成合作,将主权 AI 引入企业数据平台

    Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练定制模型,同时保有数据和由此产生的智能的所有权。Cloudera 平台上运行着 30 exabytes 的客户管理数据。

  2. Hugging Face Blog61

    Hugging Face 用 LoRA 适配器同步与 KV 前缀路由把 AsyncGRPO 跨 Job 训练提速 3.9 倍

    Hugging Face 博客展示了一个基于 TRL v1.14 AsyncGRPOTrainer 的跨 Hugging Face Jobs 异步 GRPO 训练方案:训练端只训练 LoRA 适配器,通过 Storage Bucket 挂载的共享文件系统把几 MB 的适配器传给 vLLM,无需 NCCL。

    推荐理由:原文给出五轮对照实验的完整指标变化,读者可据此学会用 AsyncGRPO 指标定位训练瓶颈并复现提速路径。

9月9日周三
  1. Mistral AI62

    Mistral 如何用 AI 智能体迁移 4 万行 Fortran 遗留代码

    Mistral 帮助一家欧洲能源运营商把 4 万行 Fortran 77 物理油藏模拟器迁移到 C++,该代码库没有测试套件和集中文档。团队先搭建数值一致性校验框架,用自定义解析器生成调用树并让上百个智能体补文档,再以规划、编码、测试、审查的智能体工作流逐模块迁移,由人工审查 PR 把关。

    推荐理由:Mistral 公开了用智能体迁移 4 万行 Fortran 的完整流程,含一致性校验与人工审查节点的取舍。

9月8日周二
  1. Google DeepMind78

    Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组全部 90 亿个单字母变异预测

    Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold 数据库的 30 多倍。

    推荐理由:读者可了解 9 亿单核苷酸变异预测数据集如何把基因组变异解读从单点分析扩展到全基因组视图。

  2. Mistral AI66

    Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 和 PSG Equity 联合领投。Mistral 称这是欧洲科技公司完成的最大一笔股权融资,资金将用于扩展前沿研究、算力、基础设施以及商业和国际业务。公司目前业务覆盖 20 个国家,服务 125 家以上全球企业,包括 Airbus、ASML 和 HSBC。

    推荐理由:欧洲 AI 公司迄今最大一笔股权融资,读者可了解主权 AI 与开放权重路线获得的资本背书。

9月7日周一
9月5日周六
9月4日周五
  1. Google Research66

    Google 与 HHMI Janelia 等发布完整雄性果蝇脑图谱

    Google 与 HHMI Janelia、剑桥大学等合作在 Cell 发表论文,发布完整雄性果蝇大脑与中枢神经系统连接组图谱,包含超过 166,000 个神经元和 1.25 亿个突触连接,是迄今按神经元数量计算最大的脑图谱。

    推荐理由:Google 与 HHMI Janelia 等合作发布迄今神经元数量最多的脑图谱,读者可了解 AI 在连接组学中的具体作用。

  2. GitHub Blog · AI & ML51

    GitHub Copilot app 教程:同时运行多个智能体会话

    GitHub 官方博客介绍如何在 GitHub Copilot app 中并行运行多个智能体会话:每个会话独立运行在自己的 Git worktree 上,互不干扰,各自保留上下文,可在 sessions view 中跟踪进度并随时切换。文中以 tailspin-toys 仓库为例,同时发起构建 funded sort 功能、无障碍审查和运行测试三个会话,并建议新手先从两个小任务开始尝试。

9月3日周四
  1. Hugging Face Blog61

    用 TRL 和 OpenEnv 开源复现训练代码模型画水彩的完整配方

    作者用 TRL 和 OpenEnv 开源复现了 Surya Narreddi 训练语言模型写 p5.brush 代码画水彩的配方,参考池数据集、RL 环境、训练脚本和模型全部公开,整条流水线可在 Hugging Face 上一条命令跑通。

    推荐理由:文章完整拆解了用 TRL 和 OpenEnv 复现审美奖励训练的全过程,含三组奖励配比对比与踩坑记录,可直接迁移。