跳到正文

#MCP/工具调用

今日 0 条
9月29日周二
  1. Hugging Face Blog36

    ProvenanceGuard:面向 MCP 智能体的来源感知事实性验证

    Hugging Face 发布论文 ProvenanceGuard,一种面向 MCP 智能体的生成后验证层,可区分"事实有据"与"来源归属正确",专门检测把某来源的事实错误归到另一来源的跨来源混淆。在 281 条医疗智能体真实 trace 上,专家判定应拦截的 139 条声明中它拦下 138 条,来源识别准确率约 86%,并在与四种支持性检查器的对比中取得最高分。

  2. The Decoder78

    Manus 2.0 发布:可编辑视频、托管多人游戏并从手机远程运行智能体

    Manus 发布 2.0 版本,把 AI 智能体扩展为平台,支持视频编辑、托管多人游戏,以及用用户自己的手机号运行个人智能体。在一种测试配置中,新的 Cascade 智能体框架比上一代系统少用 23.2% 的 token,运行成本降低 32%。

    推荐理由:Manus 2.0 把智能体扩展成平台,并给出 Cascade 的 token 与成本对比,可据此判断智能体产品的形态变化。

9月28日周一
9月26日周六
  1. GitHub Blog · AI & ML40

    GitHub Copilot 应用入门:如何用 canvases 构建自定义工作流

    GitHub Copilot 应用中的 canvas 是一种可自定义的双向界面,用户通过 /create-canvas 技能用自然语言描述需求即可生成看板、发布清单或仪表盘等工具,无需编写代码。canvas 以扩展形式保存,可随项目共享或作为个人扩展复用,用户与智能体可同时操作并即时同步状态。Awesome Copilot 社区已提供发布说明、看板、issue 分诊等现成 canvas 扩展。

9月25日周五
  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness、分诊崩溃并生成漏洞报告。

    推荐理由:GitHub Security Lab 开源了面向 C/C++ 的自主模糊测试流水线,读者可了解 LLM 智能体如何接管写 harness、追覆盖率与崩溃分诊。

9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解 AI 热门观点:该不该读 AI 生成的代码、RAG 是否已死、Skills 是否杀死了 MCP

    GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是智能体连接工具与数据的标准,可组合使用;RAG 并未消亡,它让模型基于训练数据外的文档、内部知识和代码库上下文作答,避免浪费 token 并减少不完整回答。

9月16日周三
  1. Mistral AI56

    Mistral 与 Mozilla 合作,为 Firefox Smart Window 提供模型支持

    Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。双方称对话默认不保存在 Mozilla 服务器上,Mistral 等合作方同意零数据留存,Mistral 还会针对地区语言和方言微调模型。

9月12日周六
9月11日周五
8月20日周四