跳到正文
9月30日 · 周三

最新精选

今天9月30日周三
  1. The Decoder88

    OpenAI 在 DevDay 发布一系列 ChatGPT 更新,向操作系统形态演进

    OpenAI 在 DevDay 宣布一系列 ChatGPT 更新,包括开放插件系统 Plugin Extensions、共享工作区 Space、协作文档 Pages 与 Collaborative Slides、自动化工作流以及新的定价层级。

    最新进展9月30日 01:58OpenAI 发布 GPT-6.1 Sol,性能接近 GPT-6 Astra 且价格更低

    推荐理由:梳理了 ChatGPT 从聊天工具向协作平台扩展的完整功能版图,便于判断它与协作类工具的竞争关系。

  2. The Verge · AI76

    OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol 与 $500/月 ChatGPT Pro

    OpenAI 在 9 月 29 日于旧金山举办的 DevDay 主题演讲中公布多项更新:推出对标 Meta Muse 的 AI agent 产品 Dots(初期仅向 ChatGPT Pro。

    推荐理由:原文梳理了 DevDay 多项发布并交代了 agent 安全风波背景,读者可据此理解发布时机的行业语境。

9月29日周二
  1. The Decoder78

    Manus 2.0 发布:可编辑视频、托管多人游戏并从手机远程运行智能体

    Manus 发布 2.0 版本,把 AI 智能体扩展为平台,支持视频编辑、托管多人游戏,以及用用户自己的手机号运行个人智能体。在一种测试配置中,新的 Cascade 智能体框架比上一代系统少用 23.2% 的 token,运行成本降低 32%。

    推荐理由:Manus 2.0 把智能体扩展成平台,并给出 Cascade 的 token 与成本对比,可据此判断智能体产品的形态变化。

9月25日周五
  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness、分诊崩溃并生成漏洞报告。

    推荐理由:GitHub Security Lab 开源了面向 C/C++ 的自主模糊测试流水线,读者可了解 LLM 智能体如何接管写 harness、追覆盖率与崩溃分诊。

  2. Google DeepMind71

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,将实时视频生成与语音对话结合,为 Gemini 的对话式 AI 带来近实时的视觉形象。

    推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解其多语言同步与异步工具调用如何用于企业对话场景。

9月22日周二
  1. NVIDIA Blog62

    NVIDIA 发布 Isaac ROS 5.0,为机器人开发引入智能体工作流

    NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,支持 ROS Lyrical 与 Ubuntu 24.04,并新增面向 AI 智能体的 Isaac 技能与 agent-ready 文档。

    推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出多家厂商的落地案例,可据此判断物理 AI 开发方式的变化。

  2. Hugging Face Blog62

    Transformers 新增 llama.cpp GGUF 量化模型支持

    Hugging Face 在 transformers 中加入 GGUF 支持,用户可通过 from_pretrained 传入 gguf_file 直接加载 Hub 上的量化检查点并在本地生成。

    推荐理由:Hugging Face 官方说明 transformers 如何直接加载 GGUF 量化权重,并给出与 llama.cpp 的对比数据与当前限制。

9月21日周一
  1. Hugging Face Blog62

    Hugging Face 发布 tokenizers v1:编码提速 3 至 30 倍

    Hugging Face 发布 tokenizers v1 候选版本,在 Apple M4 Max 单线程下编码速度比 v0.23 快 3 至 30 倍,八线程扩展效率为线性的 76%,且输出 token ID 与 v0.23 完全一致。

    推荐理由:原文给出 v1 与 v0.23 的逐项基准对比和实现改动,可据此判断分词器在训练与推理管线中的实际提速空间。

9月16日周三
  1. NVIDIA Blog60

    NVIDIA DSX 通过 MaxLPS 与 Flex 提升 AI 工厂每兆瓦产出

    NVIDIA 介绍 DSX 平台如何在固定电力预算下提升 AI 工厂产出:Lambda 在 HGX B200 服务器上首次验证 DSX MaxLPS,用与 16 节点满功率相同的预算运行 19 节点,集群 token 吞吐从约 4 million tokens per second 提升到 5 million(+24%),性能功耗比提升 23%。

    推荐理由:原文给出了 Lambda 实测的吞吐与能效数字,以及电网信号自动降载的生产案例,可据此评估其对电力受限场景的实际价值。

9月10日周四
  1. OpenAI News65

    OpenAI 在 API 中推出 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,带来自然的全双工语音对话能力,并具备更强的指令遵循、自定义声音和电话(telephony)支持。

    推荐理由:原文点明了全双工语音、自定义声音和电话接入三项能力,读者可据此判断它对语音应用形态的影响。

9月5日周六
  1. GitHub Blog · AI & ML61

    GitHub Copilot 推出 Project HydraFusion 研究预览:多模型编排实现前沿质量

    GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排在 Copilot 中自动选择执行工作流,用户可在 Copilot CLI 中通过 /experimental 启用。

    推荐理由:原文给出了三种执行模式与三个基准的成本质量数据,读者可据此判断多模型编排的实际取舍。

9月3日周四
  1. Hugging Face Blog62

    Hugging Face 发布 funes:为编码智能体提供可自有的持久记忆层

    Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供本地持久记忆层,一条命令即可安装并自动索引每轮对话。

    推荐理由:原文说明了本地索引与可迁移数据集的设计取舍,读者可据此判断它与托管记忆服务的差异。

  2. Google DeepMind62

    Google DeepMind 推出 Fairwind Program,向政府与企业开放 Gemini 3.8 Flash Cyber 网络防御能力

    Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 与 CodeMender 组合,用于自主发现、验证并修复漏洞。

    推荐理由:Google 把 Gemini 3.8 Flash Cyber 与 CodeMender 打包成受限访问计划,读者可了解前沿模型在漏洞修复上的落地方式与准入条件。

9月2日周三
  1. Google DeepMind73

    Gemini 推出 agentic video understanding 视频理解功能

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出 agentic video understanding,通过让模型主动调用原生视频工具按需检索画面、音频与字幕,替代固定帧率的静态处理。

    推荐理由:原文给出了成本、token 与准确率三项量化变化及启用方式,读者可据此评估它对长视频分析工作流的实际影响。

9月1日周二
  1. Hugging Face Blog69

    Hugging Face 发布 @huggingface/kernels:207 个 WebGPU kernel 与浏览器端基准工具 Fleet

    Hugging Face WebAI 团队发布 @huggingface/kernels,一个从 Hub 加载并运行优化 WebGPU kernel 的 JavaScript 库,首批包含 207 个 kernel,以独立仓库形式发布,Apache-2.0 许可,每个 kernel 附带 manifest、正确性测试、benchmark 用例和 WGSL shader 模板。

    推荐理由:原文给出了与 ORT WebGPU 的对比数据和单 kernel 仓库结构,读者可据此评估浏览器端推理优化的实际收益与复用方式。

8月28日周五
  1. Hugging Face Blog61

    Open ASR Leaderboard 新增 Hindi 与 Indian English 评测集 Monsoon

    Voice Arena 与 Hugging Face 合作向 Open ASR Leaderboard 新增 Monsoon en-IN 和 Monsoon hi-IN 两个评测集,Hindi 成为该多语言标签页上的首个 Indic 语言。

    推荐理由:原文用分区 WER 差异和 lattice 打分对比说明单一 WER 的盲区,读者可据此理解榜单评测的可迁移设计。

  2. Google Research61

    Google Earth AI 推出 planetary prediction engine 自动化地理空间建模

    Google Research 介绍 Google Earth AI 的实验性能力 planetary prediction engine(PPE),可从自然语言查询出发自主完成数据发现、特征工程、模型训练与评估,把复杂地理空间预测模型的构建时间从数周缩短到数分钟。

    推荐理由:原文给出了三阶段架构与四类任务的具体指标,读者可据此判断自动化地理空间建模相对人工流程的实际增益。

8月27日周四
  1. Google DeepMind74

    Google DeepMind 发布语音转写模型 Gemini 3.5 Transcribe

    Google DeepMind 发布语音转写模型 Gemini 3.5 Transcribe,可将原始音频直接转为准确、格式化的文本,已在 Gemini app 和 Android 的 Rambler 等功能中使用,现通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 向开发者开放。

    推荐理由:原文给出了 WER、延迟等量化指标和 Chirp 3 对比,读者可据此评估其在真实场景的可用性。

8月25日周二
  1. Hugging Face Blog61

    Gradio 推出 gr.Workflow:把 AI 流水线变成可拖拽画布与 REST API

    Hugging Face 官方博客介绍内置在 Gradio 中的 gr.Workflow,它把 AI 应用流水线描述成带类型节点的图,提供可拖拽画布,每个节点可运行、中间结果可见,同一张图同时是 REST API 并可一键部署到 Hugging Face Spaces。

    推荐理由:通过多个可直接复用的示例,展示了把流水线声明为图后自动获得 API 与部署的开发方式。

8月20日周四
  1. Mistral AI71

    Mistral 发布 Agentic Search 检索层,FinanceBench 准确率从 26.7% 升至 86%

    Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、检查和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。

    推荐理由:Mistral 公开了 Agentic Search 的检索循环设计与 FinanceBench、OfficeQA Pro 基准数据,可对比传统 RAG 的差距。

扫码用小程序

爱心宝 小程序码
爱心宝
副业 小程序码
副业