Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111:73 个节点、11 条媒体管线
Hugging Face 官方博客发布 Workflow1111,用 Gradio Workflow 单一画布重建了 AUTOMATIC1111 stable-diffusion-webui 的大部分功能。
Hugging Face 官方博客发布 Workflow1111,用 Gradio Workflow 单一画布重建了 AUTOMATIC1111 stable-diffusion-webui 的大部分功能。
一位 MIT 研究者使用 GPT-5.6 Sol 搭配 Codex 自主运行量子计算实验、分析结果并校准 qubit。文章展示了 GPT-5.6 Sol 与 Codex 结合在科研工作流中的实际用法。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold 数据库的 30 多倍。
推荐理由:读者可了解 9 亿单核苷酸变异预测数据集如何把基因组变异解读从单点分析扩展到全基因组视图。
OpenAI 官方发布 ChatGPT Images 2.5,官方介绍称它能把用户的想法、草图和参考照片转化为更个性化、更精致、更贴合原始想法的图像。
OpenAI 正在扩大对新闻业的支持,为学生、教育工作者、记者和新闻机构提供工具、培训与合作。这些举措覆盖从课堂到编辑部的多个环节。
1Password 工程团队使用 Codex 快速构建新功能和内部工具,工程效率提升 21%,在达到生产可用的同时仍遵守严格的安全策略。Codex 是 OpenAI 的编码智能体产品,1Password 将其用于日常开发流程。
GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排在 Copilot 中自动选择执行工作流,用户可在 Copilot CLI 中通过 /experimental 启用。
推荐理由:原文给出了三种执行模式与三个基准的成本质量数据,读者可据此判断多模型编排的实际取舍。
OpenAI 推出 Daybreak for Frontline Defenders,承诺投入 10 亿美元,扩大前沿网络 AI、培训和支持的获取渠道,以保护关键服务。
Playco 使用 GPT-6 Astra 从一个灰盒基础构建了三个主题游戏原型,手动修复比使用上一代模型减少 50%。
Legora 用 GPT-6 Astra 在几分钟内审查 41 份文档,找出全部 4 处植入错误,该金融审查工作流性能提升近 40%。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供本地持久记忆层,一条命令即可安装并自动索引每轮对话。
推荐理由:原文说明了本地索引与可迁移数据集的设计取舍,读者可据此判断它与托管记忆服务的差异。
Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 与 CodeMender 组合,用于自主发现、验证并修复漏洞。
推荐理由:Google 把 Gemini 3.8 Flash Cyber 与 CodeMender 打包成受限访问计划,读者可了解前沿模型在漏洞修复上的落地方式与准入条件。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出 agentic video understanding,通过让模型主动调用原生视频工具按需检索画面、音频与字幕,替代固定帧率的静态处理。
推荐理由:原文给出了成本、token 与准确率三项量化变化及启用方式,读者可据此评估它对长视频分析工作流的实际影响。
Hugging Face WebAI 团队发布 @huggingface/kernels,一个从 Hub 加载并运行优化 WebGPU kernel 的 JavaScript 库,首批包含 207 个 kernel,以独立仓库形式发布,Apache-2.0 许可,每个 kernel 附带 manifest、正确性测试、benchmark 用例和 WGSL shader 模板。
推荐理由:原文给出了与 ORT WebGPU 的对比数据和单 kernel 仓库结构,读者可据此评估浏览器端推理优化的实际收益与复用方式。
Voice Arena 与 Hugging Face 合作向 Open ASR Leaderboard 新增 Monsoon en-IN 和 Monsoon hi-IN 两个评测集,Hindi 成为该多语言标签页上的首个 Indic 语言。
推荐理由:原文用分区 WER 差异和 lattice 打分对比说明单一 WER 的盲区,读者可据此理解榜单评测的可迁移设计。
Google Research 介绍 Google Earth AI 的实验性能力 planetary prediction engine(PPE),可从自然语言查询出发自主完成数据发现、特征工程、模型训练与评估,把复杂地理空间预测模型的构建时间从数周缩短到数分钟。
推荐理由:原文给出了三阶段架构与四类任务的具体指标,读者可据此判断自动化地理空间建模相对人工流程的实际增益。
Google DeepMind 宣布推出全球首个针对专有前沿模型的双盲评测,将外部评测限制在密码学“盒子”中,防止模型事后利用考题优化成绩。该评测与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,在保护隐私的环境中用保密基准测试 Gemini Flash Lite 模型,以缓解基准污染问题、提升评测完整性。
Hugging Face 官方博客介绍内置在 Gradio 中的 gr.Workflow,它把 AI 应用流水线描述成带类型节点的图,提供可拖拽画布,每个节点可运行、中间结果可见,同一张图同时是 REST API 并可一键部署到 Hugging Face Spaces。
推荐理由:通过多个可直接复用的示例,展示了把流水线声明为图后自动获得 API 与部署的开发方式。
Google Research 推出 Biomarker Discovery Framework,一个在人类监督下把候选生物标志物优先级排序组织成迭代研究循环的多智能体系统,结合假设生成、并行统计分析、模型训练、对抗验证与文献推理,在三个队列共 9,279 参与者观测上识别出 41 个心理健康和 25 个代谢结局的候选数字生物标志物。
Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、检查和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。
推荐理由:Mistral 公开了 Agentic Search 的检索循环设计与 FinanceBench、OfficeQA Pro 基准数据,可对比传统 RAG 的差距。
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用同一套 API 加载 PyLate、Stanford-NLP ColBERT 和 colpali-engine 检查点,支持 ColBERT 式晚期交互检索。
推荐理由:原文给出索引体积代价的具体数据和四种向量库的实测耗时,读者可据此评估落地成本。
OlmoEarth Studio 新增嵌入向量计算与导出功能,用户可通过 UI 或 API 选择区域、时间范围、编码器变体、分辨率和影像源,导出 int8 量化的 Cloud-Optimized GeoTIFF。
Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和带 SLA 的可用性承诺。
推荐理由:Mistral 把区域推理端点、SLA 优先级层和第三方开源模型接入放在同一套基础设施上,可观察主权 AI 的落地方式。
NVIDIA Magpie Multilingual TTS 发布新版本,364M 参数开放权重模型支持 12 种语言,新增 Modern Standard Arabic、韩语和巴西葡萄牙语,并扩大印地语和日语的 code-switching 支持。
Baseten 正式成为 Hugging Face Hub 的 Inference Providers 服务商,首批支持对话与文本生成任务,可调用 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开源权重 LLM。
Microsoft Research 开源智能体框架 Orchard,核心是可复用的 Kubernetes 环境服务 Orchard Env,支持在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 内直接训练智能体,并同步发布训练数据与评测方法。
推荐理由:原文给出三个领域的训练配方与具体分数,读者可据此评估小参数开源模型在真实任务上的能力边界。
NVIDIA 发布 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式模拟器,将 Cosmos-H-Surgical-Simulator 蒸馏为因果少步学生模型,并通过 FlashDreams 加速推理库提供服务,在单张 NVIDIA RTX PRO 6000 GPU 上从约 10 fps 提升到约 160 fps 的交互运行。
Diffusers 现可通过 from_pretrained() 直接加载 Nunchaku 量化检查点,无需单独推理引擎或本地 CUDA 编译。
Hugging Face 与 Pollen Robotics 发布开源系统 Grabette,用手持夹爪录制人类演示并自动生成机器人可用数据集,无需机器人、实验室或遥操作设备。
Google DeepMind 与 Isomorphic Labs 发布联合的生物韧性(bioresilience)方案,将 AI 模型与智能体开放给可信伙伴,覆盖预防、检测、响应三个环节。
Google DeepMind 联合 Atal Innovation Mission 上线 ATL Saathi 实时试点,这是一款由 Gemini 驱动的 Web 应用,为印度 Atal Tinkering Labs 教师提供 24/7 备课与培训助手。
Mistral Studio 为 Prompts 和 Skills 提供集中式系统记录,支持版本控制、归属管理和可追溯性,让 AI 行为可治理、可发现。Studio 提供不可变版本、回滚、清晰归属、分类标签和审计日志,业务专家可直接编辑并经 CI/CD 流程发布生产版本,Skills 可作为 MCP servers 从 Studio 直接调用。该功能现已向 Mistral Studio 客户开放。
Hugging Face 宣布 transformers 的 vLLM 建模后端在多种 LLM 架构上已达到或超过 vLLM 手写原生实现的速度,模型作者只需加 --model-impl transformers 标志即可免费获得极速推理。
Hugging Face 与 Amazon SageMaker AI 推出深链集成,支持模型页上的 Customize on SageMaker AI 和 Deploy on SageMaker AI 按钮一键直达 SageMaker Studio,模型预加载、环境自动配置。
Microsoft 在 Build 2026 宣布 Foundry Managed Compute,并推出 Hugging Face models on Foundry,把 Hugging Face 生态的开源权重模型以每周更新的精选目录形式提供,可一键部署到 Foundry Managed Compute。
LeRobot v0.6.0 发布,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一的奖励模型 API(Robometer、TOPReward)。
推荐理由:原文系统梳理了机器人学习闭环各环节的新增能力,读者可据此了解开源机器人栈的当前边界。
Hugging Face 与 SkyPilot 联合发布 store: hf 存储后端,用一个 hf:// URL 和已有的 HF_TOKEN 就能把 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务。
Hugging Face 官方博客介绍 Kernels 项目近期的重大更新,Hub 上新增了 kernel 仓库类型,可展示 kernel 支持的加速器、操作系统和后端版本,并提升可发现性。
Hugging Face 与 Cerebras 合作推出基于 Gemma 4 的实时语音 AI 演示,将开放的级联语音管线与 Cerebras 的推理速度结合,实现更自然的对话响应。
Google Research 发布覆盖 50+ 全球城市、9 个国家的建筑级屋顶反照率数据集,并上线高分辨率 Heat Resilience Earth Engine App 供公众使用。