Hugging Face 开源复现 OpenAI Deep Research,GAIA 验证集达 55.15%
Hugging Face 在 24 小时冲刺中开源复现 OpenAI 的 Deep Research,基于 smolagents 构建的开源智能体在 GAIA 验证集上取得 55.15% 的成绩,超过此前开源框架 Magentic-One 约 46% 的水平。
推荐理由:文中给出了代码动作相对 JSON 的具体优势和可复现的性能差距,读者可据此判断智能体框架选型的影响。
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
Hugging Face 在 24 小时冲刺中开源复现 OpenAI 的 Deep Research,基于 smolagents 构建的开源智能体在 GAIA 验证集上取得 55.15% 的成绩,超过此前开源框架 Magentic-One 约 46% 的水平。
推荐理由:文中给出了代码动作相对 JSON 的具体优势和可复现的性能差距,读者可据此判断智能体框架选型的影响。
OpenAI 推出 deep research,一个使用推理综合大量在线信息、为你完成多步研究任务的智能体,今天起向 Pro 用户开放,Plus 和 Team 用户随后可用。
OpenAI 通过官方新闻页发布 o3-mini 模型,本次抓取失败,仅标题可用,正文内容缺失。
OpenAI 官方发布新产品 Operator,正文抓取失败,仅标题可用,具体功能与开放范围未在材料中给出。
OpenAI 官方发布公告,宣布推出 Stargate 项目。feed 仅提供标题,未包含项目细节。
OpenAI 发布新的对齐策略 deliberative alignment,用于 o1 模型,直接向模型教授安全规范并让模型围绕这些规范进行推理。
推荐理由:原文点明该策略直接教模型安全规范并对其推理,读者可据此理解对齐思路的变化。
OpenAI 官方宣布推出 OpenAI o1,同时带来面向开发者的 Realtime API 改进和一种新的微调方法等更新。
OpenAI 宣布其视频生成模型 Sora 现已在 sora.com 开放使用,用户可生成最高 1080p 分辨率、最长 20 秒、支持宽屏、竖屏或方形比例的视频。用户既可以纯文本生成全新内容,也可以上传自有素材进行扩展、混剪和融合。
OpenAI 发布 ChatGPT Pro,定位为拓展前沿 AI 使用范围的订阅方案,官方页面主题为 Broadening usage of frontier AI。
OpenAI 官方宣布推出 ChatGPT search,让用户在 ChatGPT 中获得快速、及时的答案,并附带相关网络来源的链接。
OpenAI 官方宣布为 ChatGPT 推出 canvas,一种新的写作与编程交互方式。当前 feed 仅提供标题,未包含更多功能细节。
OpenAI 推出 Realtime API,开发者现在可以在自己的应用中构建快速的语音到语音(speech-to-speech)体验。
OpenAI 宣布开发者现在可以使用图像和文本微调 GPT-4o,以提升模型的视觉能力。
推荐理由:官方宣布开放图像微调入口,读者可据此判断视觉能力定制是否进入可落地阶段。
OpenAI 在 API 中推出 Prompt Caching,对模型近期已处理过的输入自动提供折扣,降低重复输入的调用成本。
推荐理由:说明了缓存如何自动降低近期已见输入的成本,读者可据此判断调用开销的变化。
OpenAI 官方发布 o1 模型,原文链接为 https://openai.com/index/introducing-openai-o1-preview,抓取失败,仅标题可用,无正文细节。
OpenAI News 发布标题为 Learning to reason with LLMs 的内容,抓取失败,正文不可用,仅标题可用。
OpenAI 宣布 GPT-4o 现已支持微调(fine-tuning)。
OpenAI 在 API 中推出 Structured Outputs,模型输出现在能够可靠地遵循开发者提供的 JSON Schema。
OpenAI 宣布正在测试 SearchGPT,这是一个临时原型,提供快速及时的答案,并附带清晰、相关的来源。
OpenAI 官方发布 GPT-4o mini,定位为成本高效(cost-efficient)的模型。