Google Research 用生成式 UI 让教师创建互动教学模拟
Google Research 发布研究实验,让教师借助生成式 UI(GenUI)创建贴合课程目标的互动教学模拟,并开放 30 多个面向中学 STEM 的英文学习互动示例库。
Google Research 发布研究实验,让教师借助生成式 UI(GenUI)创建贴合课程目标的互动教学模拟,并开放 30 多个面向中学 STEM 的英文学习互动示例库。
Pawprint Studio 的免费开放世界抓宠 RPG《Aniimo》本周登陆 GeForce NOW,玩家无需 45GB 下载即可在 Steam Deck、新支持的 Firefox 浏览器等设备上串流游玩。
Cooley 用 ChatGPT Work 构建了 GO Public,把智能引入 IPO 流程,帮助律师更早发现问题,把判断力集中在最关键的地方。
GitHub 工程师 Stephen Toub 复盘用 GitHub Copilot 把 Copilot agent runtime 从 TypeScript 重写为超过 80 万行生产级 Rust 的过程,代码主要由 AI 智能体编写,横跨 128 个 PR 并增量上线,性能提升数个数量级。
推荐理由:GitHub 工程师复盘用 Copilot 把运行时从 TypeScript 迁到 Rust 的全过程,含多智能体协作与提示缓存数据。
OpenAI 推出 Astra for Law,为法律行业提供前沿智能、定制律所工作流、连接法律数据源,并配备面向保密客户工作的法律级管控。该产品通过 OpenAI for Law 提供,整合了法律场景所需的智能能力与合规控制。
OpenAI 发布了一套用于追踪、调查和披露模型对齐问题的框架,并同时公布了六份关于模型意外或令人担忧行为的报告。该框架旨在系统化处理模型对齐(misalignment)事件的记录与公开流程,六份报告涵盖模型表现出的意外或令人担忧行为。
OpenAI 与 AARP 将在美国 10 座城市为 1,000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全地掌握实用 AI 技能。
NVIDIA 宣布 Vera Rubin NVL72 在 MLPerf Inference v6.1 首次提交中亮相,在 Qwen3-VL 上吞吐量较 GB300 NVL72 最高提升 3.7 倍,在 DeepSeek-R1 上最高提升 2.5 倍。
推荐理由:原文给出与上代系统的吞吐对比和扩展效率数据,读者可据此评估其推理经济性影响。
Emerald AI、Google 和 NVIDIA 宣布启动 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调整用电。
OpenAI 推出一系列 AI 驱动的广告新体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
Hex 的数据智能体借助 GPT-6 Astra,把分析结果转化为员工乐于分享的交互式可视化图表。GPT-6 Astra 帮助 Hex 的数据智能体将答案直接生成为交互式可视化内容。
ChatGPT Work 和 Codex 的分析功能帮助团队了解 AI 使用情况与支出、识别培训需求,并将 AI 采用与业务成果关联起来。
Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。双方称对话默认不保存在 Mozilla 服务器上,Mistral 等合作方同意零数据留存,Mistral 还会针对地区语言和方言微调模型。
OpenAI Economic Research 发布研究,展示劳动者如何在传统岗位之外使用 AI,以及哪些新活动成为其工作中反复出现的部分。
曼彻斯特大学与 NVIDIA Earth-2 团队合作,用生成式降尺度模型 Earth-2 CorrDiff 和支持时序预报的 Earth-2 StormCast 构建英国全境空气污染模型,分辨率达 2-3 平方公里。
Salesforce 在 Dreamforce 上发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 在近三十年企业 CRM 部署数据构成的专有合成数据集上后训练而成,采用监督微调与强化学习,使用 NVIDIA NeMo RL、NeMo Gym 和 NeMo AutoModel。
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的 fan-out 查询并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归生成完整结果集,无需 CoT 推理 token。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型,分别面向规模化低成本场景与高复杂度多步推理任务。
推荐理由:官方给出两款语音模型的基准成绩与开放渠道,可据此判断实时语音智能体的能力与成本取舍。
NVIDIA 介绍 DSX 平台如何在固定电力预算下提升 AI 工厂产出:Lambda 在 HGX B200 服务器上首次验证 DSX MaxLPS,用与 16 节点满功率相同的预算运行 19 节点,集群 token 吞吐从约 4 million tokens per second 提升到 5 million(+24%),性能功耗比提升 23%。
推荐理由:原文给出了 Lambda 实测的吞吐与能效数字,以及电网信号自动降载的生产案例,可据此评估其对电力受限场景的实际价值。
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 与 DSX 平台的多项进展,将 AI 基础设施指标从峰值性能转向经验证的 agentic tokens per megawatt。
推荐理由:原文给出多组能效与吞吐数字,读者可据此评估每兆瓦产出这一新指标如何影响 AI 工厂选型。
Hugging Face 博客介绍了 ALTK-Evolve 新增的 consistency guidelines 与 Consistency Analyzer:在 AppWorld test_normal(168 任务)上,GPT-4.1 驱动的 ReAct agent 平均 Mean@5 为 77.4%,但 Pass^5 仅 53.0%,存在 24.4pp 的一致性差距。
费城儿童医院(CHOP)基于 NVIDIA 共同创立的开源医学影像框架 MONAI,利用 CT、MRI 和 3D 超声影像在数秒内生成解剖精确的心脏模型,把过去需熟练研究员四小时完成的流程压缩到可常规临床使用的水平。
Fyxer 基于 OpenAI 模型、微调、记忆和真实用户反馈,为每位用户整理收件箱并以其个人语气起草邮件。
Perplexity 使用 GPT-6 Astra 撰写沟通内容、修改软件并监控生产系统,且检查频率远低于此前使用的模型。
GitHub 日本和韩国营销负责人用 GitHub Copilot 把活动运营流程自动化:以 GitHub Issue 为工作单元,用 Issue forms 收集活动信息、Labels 触发 GitHub Actions 工作流,活动从单个 Issue 自动搭建、每日筛选报名者并在结束后自动清理。
Cognition 用 GPT-6 Astra 提升 Devin 测试软件并证明其可用的能力,目标是让工程师少审代码、多交付产品。
OpenAI 将 Habitat 从一个 Python 库演进为全球分布式存储平台,服务 10 亿 ChatGPT 用户,峰值达 22M requests per second。文章介绍了这一在线存储系统快速扩展的演进过程。
Google Research 在 ACL 2026 提出 ToolGrad,用“先答案后问题”范式生成工具调用数据:先构造真实 API 工作流,再反向标注用户查询,替代 ToolBench、ToolACE 的 DFS 试错搜索。
GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让用户无需切换编辑器、终端和浏览器即可完成审查、运行和预览 AI 生成代码的完整流程。diff 面板以绿红高亮展示代码增删改,支持接受更改、留言或让 Copilot 修改;终端面板可直接运行项目命令并支持多窗口;浏览器面板的 Pick & Polish 工具可选中页面元素并让智能体调整。
César de la Fuente 的实验室使用 Codex 和 ChatGPT 在现存与灭绝基因组中搜索抗菌候选分子,以对抗耐药性感染。
OpenAI 在 ChatGPT Work 中推出 Data agent,用户可连接公司数据、挖掘洞察,并用自然语言借助 AI 构建交互式看板。
Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练定制模型,同时保有数据和由此产生的智能的所有权。Cloudera 平台上运行着 30 exabytes 的客户管理数据。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并结合 GPT-6 Astra,面向研究、建模和生成可交付客户的材料。
OpenAI 与 GSA 将向符合条件的联邦、州、地方和部落政府提供 $0 许可费、50% 使用折扣以及扩展的网络防御支持。
Hugging Face 博客展示了一个基于 TRL v1.14 AsyncGRPOTrainer 的跨 Hugging Face Jobs 异步 GRPO 训练方案:训练端只训练 LoRA 适配器,通过 Storage Bucket 挂载的共享文件系统把几 MB 的适配器传给 vLLM,无需 NCCL。
推荐理由:原文给出五轮对照实验的完整指标变化,读者可据此学会用 AsyncGRPO 指标定位训练瓶颈并复现提速路径。
OpenAI 发布 Agents API,这是一项由 Codex harness 驱动的托管服务,用于构建和上线云端智能体,支持编排、长时间运行的会话以及工具调用。
OpenAI 在 API 中推出 GPT-Live-1,带来自然的全双工语音对话能力,并具备更强的指令遵循、自定义声音和电话(telephony)支持。
推荐理由:原文点明了全双工语音、自定义声音和电话接入三项能力,读者可据此判断它对语音应用形态的影响。
Hugging Face 官方博客发布 Workflow1111,用 Gradio Workflow 单一画布重建了 AUTOMATIC1111 stable-diffusion-webui 的大部分功能。
Paul Christiano 加入 OpenAI Foundation 董事会及其安全与保障委员会(Safety and Security Committee),带来 AI 对齐、安全与标准方面的经验。
OpenAI 公共政策主管 Chris Lehane 撰文指出,更强的 AI 能力需要更强的安全证据、共享标准和持久的政策行动,而政策窗口仍然敞开。文章呼吁在窗口关闭前推动相关治理措施落地。