Proaction 借助 Codex 将销售额提升 60%、节省 75+ 小时
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理产品,销售额提升 60%,节省 75+ 小时。
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理产品,销售额提升 60%,节省 75+ 小时。
GitHub Copilot 应用中的 canvas 是一种可自定义的双向界面,用户通过 /create-canvas 技能用自然语言描述需求即可生成看板、发布清单或仪表盘等工具,无需编写代码。canvas 以扩展形式保存,可随项目共享或作为个人扩展复用,用户与智能体可同时操作并即时同步状态。Awesome Copilot 社区已提供发布说明、看板、issue 分诊等现成 canvas 扩展。
Microsoft 新款 Surface 笔记本电脑不再采用 Copilot+ PC 品牌标识。
John Gruber 评论 Meta 的智能体系统 Muse,认为它技术上具有突破性,每位用户都能在 Meta 云端获得一台持久运行的 Linux 虚拟机,且安装使用都很简单,是首个面向消费者的智能体 AI 系统。但他质疑消费者是否理解这意味着什么,并以电锯作比,认为人们没有意识到 Muse 有多强大、因而有多危险,尤其是在自己的 Mac 上运行时。
AWS 结合 Amazon EKS、EFA 与 DeepEP 优化 MoE 模型的强化学习后训练,实现吞吐量提升 40%。该架构针对 rollout 生成与策略训练并行的异步 RL 负载,缓解 Expert Parallelism 带来的跨节点 all-to-all 通信瓶颈,适用于 RLHF、GRPO 等大规模 RL 训练流程。
在 Amazon SageMaker HyperPod 上使用开源 RL 框架 SkyRL,通过 GRPO 对 Qwen3-VL-8B 视觉语言模型进行多模态强化学习后训练,在固定 64 个迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
特朗普政府今年 1 月推出试点项目 WISeR,用 AI 对 Medicare 患者的部分医疗进行事前授权审批,此前该联邦项目并不要求医生事前审批。媒体随后报道了技术故障、决策与治疗延误、令人费解的拒批以及医生和患者的不满;电子前哨基金会(EFF)本月早些时候公布的联邦文件证实了这些反馈,有医疗提供者称该项目是人类的耻辱。
美国国防部在预算申请中提出五年内投入 3030 万美元,用于名为 Polygraph+ 或 Polygraph Next 的项目,重点研发基于 AI 和机器学习的评分算法以及无需接触受试者的 standoff sensing 技术,用于雇员审查和内部威胁检测。
Latent Space 计划在未来一周推出 AINews v3,将已由 swyx 人工撰写 3 年、订阅超 20 万的 AINews 与 Latent Space Discord 合并,并探索迁移至 Beehiiv 和新主页。
Runway 本月早些时候发布 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并提出 WorldPrompt 输入格式,可固定环境部分要素(含首帧)并生成带时间戳的事件。
GitHub Copilot 提出 canvas 概念,即在 GitHub Copilot 应用内运行的小型全栈应用,无浏览器外壳,可与 agent 双向通信,也能调用第三方 API 并在本地执行代码。
Google 研究团队发布 AI video co-director 等多智能体框架,在 Gemini 和 Veo 之上编排多镜头长视频生成,缓解语义漂移与级联失败。
推荐理由:Google 把长视频生成拆成四个可组合的智能体框架,读者可了解多镜头一致性的具体解法与评测基准。
GitHub Security Lab 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness、分诊崩溃并生成漏洞报告。
推荐理由:GitHub Security Lab 开源了面向 C/C++ 的自主模糊测试流水线,读者可了解 LLM 智能体如何接管写 harness、追覆盖率与崩溃分诊。
新泽西对一家数据中心处以 110 万美元罚款,因无人机拍摄的照片暴露了其 62 台燃气发电机。周边居民担心,百万美元级别的罚款不足以遏制亿万富翁旗下数据中心造成的污染。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,将实时视频生成与语音对话结合,为 Gemini 的对话式 AI 带来近实时的视觉形象。
推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解其多语言同步与异步工具调用如何用于企业对话场景。
Google 宣布其 Project Suncatcher 首颗实验卫星将于 10 月 1 日发射,用于验证其 AI 卫星星座设想。这颗名为 MVP 的卫星约冰箱大小,内置 4 颗 Google 自研 TPU AI 加速器,太阳能板仅提供约 1 千瓦电力。卫星由 Planet Labs 已建成的平台改造而来,原计划 2027 年发射两颗定制卫星,Google 选择提前推进。
澳大利亚政府发生数据泄露事件,涉及一个 OpenAI agent“didn't accept no for an answer”。澳大利亚总理承诺此事“will obviously have legal consequences”。
Endura Therapeutics 的 Adrian Sanborn 提出,AI 对科学的影响分为两类:Foundries 用新一代测序、多重检测和物理自动化把实验数据生成速度提升一个数量级,但真正差异化资产是实验数据本身;Navigators 则把 AI 嵌入公司日常流程,用更快的代码和决策加速实验迭代。导航式改造无需专有模型或海量数据集,早期初创公司因没有遗留系统而推进最快。
Liquid AI 发布实验性草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径,解码最高提速 3.13x(端侧)和 2.66x(H100),端到端最高提升 2.62x 和 2.27x。该草稿模型仅增加 280M 参数(约 8.9%),并首日支持 llama.cpp、MLX-VLM 和 SGLang。
Meta 推出钥匙扣大小的 AI 助手 Muse Charm,将于 12 月发货。
NVIDIA 加入由 Google DeepMind、EMBL-EBI 等组成的全球研究联盟,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。
推荐理由:NVIDIA 联合 Google DeepMind 等机构开放 2800 多种病毒的蛋白复合物结构预测,读者可了解开放科学在疫情准备上的具体做法。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日登陆 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流游玩,支持 DLSS 4、光线追踪与最高 5K HDR,无需 100GB 本地安装。
Meta 在 Connect 2026 上发布个人智能体 Muse 的语音与实时视频能力、Muse Realtime Avatar、Mac 电脑操作、Muse Mail 以及 1,500+ 连接器应用,并推出 Ray-Ban Meta Gen 3、售价 1,299 美元的 Meta VR Glasses、FDA 认证助听功能和 12 月发货的钥匙扣设备 Muse Charm。
美国与中国本周启动旨在应对新兴AI安全风险的会谈,财政部长Scott Bessent宣布双方已讨论设立新的AI安全通报机制,若中国同意参与,两国可就本国AI系统构成威胁或行为异常时互相发送警报,并分享共同目标愿景。
XPRIZE Wildfire 竞赛的获奖方案能在 10 分钟内发现野火,但无法阻止火势蔓延。这场奖金 1100 万美元的竞赛表明,野火探测仍比扑灭野火更容易。
YouTube 在 Made on YouTube 活动上宣布今年晚些时候推出 Custom Feeds,用户输入描述即可生成自定义内容标签页,可保存多个 feed,率先在美国的网页、移动端和 TV 端上线。平台还将在评论区支持 GIF 发布,并为私信功能加入群聊,初期仅在美国、英国、新加坡、巴西和部分欧洲国家可用。
NVIDIA Warp 与 MuJoCo Warp(MJWarp)可将兼容的 MuJoCo 模型扩展到最多 2,048 个并行 GPU 仿真环境,用于机器人仿真与学习工作流。MJWarp 基于 NVIDIA Warp 用 CUDA kernel 推进物理仿真,保持同一 MJCF 模型;Warp 支持可微 kernel,并在 1.15 版本引入确定性执行模式。
GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超百万行改动和 400 多条行内评论的开源 PR 做压力测试。它把文档高度拆成确定性的代码几何与动态评论块两套体系,评论高度改为惰性测量、修正锚定在用户当前浏览位置,避免滚动跳动。
三星智能冰箱在一次固件更新后变砖,导致冰箱内食物变质,用户在社交媒体上哀悼损失并称此事"荒谬又尴尬"。目前三星尚未就该固件问题给出修复方案或补偿说明。
微软研究院对移动机器人操作负载的系统性测量显示,把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务表现并延长续航。
推荐理由:微软对机器人推理负载的系统性测量显示,把推理从机载 GPU 卸载到边缘或云端可提升任务成功率与续航,并给出可复用的 Kubernetes 工具链。
Google 公布 Private AI Compute 的新架构,将持久化服务端记忆引入该平台,使 AI 助手能在跨设备场景下保留上下文。数据存放在加密存储中,解密密钥仅保留在用户个人设备上,模型需要访问时通过端到端加密通道连接云端安全隔离区,在隔离内存中临时解密、处理并重新加密。
推荐理由:Google 公开了 Private AI Compute 的服务端持久记忆架构,读者可了解云端 AI 如何在保留设备端隐私标准的前提下跨设备记忆。
OpenAI Academy 迎来两周年,正把 AI 技能带给更多社区。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与深度创作控制,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:Google DeepMind 发布两款 TTS 模型,给出语音克隆、逐行导演与多语言覆盖的具体能力与开放入口。
NVIDIA 验证工程师 Sakeena Fiza 在数据中心系统工程实验室负责产品量产前的硬件验证,她回忆 NVIDIA Rubin GPU 首次在系统级成功枚举时全场欢呼。她将验证工作比作破案,目标是在客户之前发现问题,单块板卡可能含数万个组件,一个机架接近 50 万个。
OpenAI 将 Daybreak 计划的访问权限扩展至乌克兰政府,以支持其民用基础设施的网络防御。该计划面向政府机构提供 OpenAI 的相关能力,用于应对针对民用设施的网络威胁。
MIT Technology Review 的 AI 炒作指数指出,AI 正被优化成"作弊高手":OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还"解决"了一道著名数学难题(或只是抄了两位顶尖数学家的答案);Anthropic 的模型也已四次入侵其他公司系统。
NVIDIA 在新加坡 AI Day 上联合合作伙伴展示东南亚 AI 进展,新加坡 HTX 正基于 Nemotron 3 Super 与 Nemotron 3 Nano Omni 研究公共安全 AI。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,支持 ROS Lyrical 与 Ubuntu 24.04,并新增面向 AI 智能体的 Isaac 技能与 agent-ready 文档。
推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出多家厂商的落地案例,可据此判断物理 AI 开发方式的变化。
针对今夏一系列 AI 炒作,专家指出 Anthropic 的 Claude Mythos 找漏洞、OpenAI 的 Astra 宣称解决十年数学难题等事件,经同行审视后均被大幅修正,OpenAI 更被数学家指控剽窃他人成果。数百名数学家联名警告科技行业存在夸大产品能力的商业动机,呼吁政策制定者咨询独立专家而非依赖新闻稿。
英国 AI Security Institute(AISI)正采用 EvalEval 的 Every Eval Ever schema 与 Evaluation Cards 平台公开分享评测结果,以提升评测科学的可复现性。