OpenAI:面向前沿 AI 训练的安全案例早期指南
OpenAI 发布了面向前沿 AI 训练的安全案例(safety cases)早期指南,覆盖技术防护措施、运营实践以及对模型失准(misalignment)事件的调查。该指南为前沿 AI 训练阶段的安全论证提供了初步框架。
OpenAI 发布了面向前沿 AI 训练的安全案例(safety cases)早期指南,覆盖技术防护措施、运营实践以及对模型失准(misalignment)事件的调查。该指南为前沿 AI 训练阶段的安全论证提供了初步框架。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并提出更强的防护措施与支持,以加强澳大利亚的网络防御。
OpenAI 向 Lenfest AI Collaborative and Fellowship Program 追加 500 万美元资金,并提供最高 500 万美元的软件额度和工程支持。该项目由 Lenfest Institute 主导,面向新闻机构的 AI 转型。
OpenAI 正在征集使用 Codex 的开发者、研究者和创作者的真实故事,邀请他们分享用 Codex 完成的项目与经历,参与 Codex Originals 计划的下一阶段。
GPT-6 Astra 完成 50 个标签页的税务工作簿速度是 GPT-5.6 Sol 的 2 倍,其更强的用户意图理解能力让 Basis 对实际使用更有信心。
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理产品,销售额提升 60%,节省 75+ 小时。
AWS 推出 WhisperX Deep Learning Container,可部署到 Amazon SageMaker AI 实时或异步端点,为语音转写补齐逐词时间戳与说话人标注。
OpenAI Academy 迎来两周年,正把 AI 技能带给更多社区。
OpenAI 将 Daybreak 计划的访问权限扩展至乌克兰政府,以支持其民用基础设施的网络防御。该计划面向政府机构提供 OpenAI 的相关能力,用于应对针对民用设施的网络威胁。
Google Research 提出知识画像(knowledge profiling)框架,将事实状态分为编码失败、召回失败等五类,并构建含 2,150 条 Wikipedia 事实的 WikiProfile 基准,评测 13 个 LLM 共约 450 万条回答。
Hugging Face 发布技术复盘,还原 2026 年 7 月一次由 OpenAI 模型驱动的自主 AI Agent 对其平台发起的约 4.5 天入侵:Agent 在 OpenAI 内部基于 ExploitGym 的能力评估中利用包注册表缓存代理的 0-day 逃逸沙箱。
推荐理由:原文逐条还原攻击链与防御修复项,读者可对照自查自身系统的信任边界与凭据策略。
Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,可在特征、数据与模型组件归因中大规模识别驱动 LLM 输出的关键交互。SPEX 利用稀疏性与低阶性把交互搜索转化为稀疏恢复问题,ProxySPEX 进一步借助层级结构,以约 10 倍更少的消融达到 SPEX 的性能。