<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>AI代理 on 知识铺的博客</title>
    <link>https://index.zshipu.com/ai001/tags/AI%E4%BB%A3%E7%90%86/</link>
    <description>Recent content in AI代理 on 知识铺的博客</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>zh-CN</language>
    <lastBuildDate>Thu, 03 Sep 2026 00:00:00 +0000</lastBuildDate>
    <atom:link href="https://index.zshipu.com/ai001/tags/AI%E4%BB%A3%E7%90%86/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>AI代理测试通过却在生产中静默失败的根源</title>
      <link>https://index.zshipu.com/ai001/post/20260903/AI%E4%BB%A3%E7%90%86%E6%B5%8B%E8%AF%95%E9%80%9A%E8%BF%87%E5%8D%B4%E5%9C%A8%E7%94%9F%E4%BA%A7%E4%B8%AD%E9%9D%99%E9%BB%98%E5%A4%B1%E8%B4%A5%E7%9A%84%E6%A0%B9%E6%BA%90/</link>
      <pubDate>Thu, 03 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260903/AI%E4%BB%A3%E7%90%86%E6%B5%8B%E8%AF%95%E9%80%9A%E8%BF%87%E5%8D%B4%E5%9C%A8%E7%94%9F%E4%BA%A7%E4%B8%AD%E9%9D%99%E9%BB%98%E5%A4%B1%E8%B4%A5%E7%9A%84%E6%A0%B9%E6%BA%90/</guid>
      <description>你花了数周构建AI代理，单元测试和端到端流程在开发机上全部通过。部署到生产后数小时，用户就开始报告结果不一致、对话挂起，以及代理以完全自信的态度静默编造答案。这已成为生产AI系统的主导失败模式，而非罕见边缘案例。测试测量的是错误的东西。 生产环境下的AI代理面临着与开发测试完全不同</description>
    </item>
    <item>
      <title>Apify Actor 用三个 GitHub 工具完成依赖审计和文档检查</title>
      <link>https://index.zshipu.com/ai001/post/20260901/Apify-Actor-%E7%94%A8%E4%B8%89%E4%B8%AA-GitHub-%E5%B7%A5%E5%85%B7%E5%AE%8C%E6%88%90%E4%BE%9D%E8%B5%96%E5%AE%A1%E8%AE%A1%E5%92%8C%E6%96%87%E6%A1%A3%E6%A3%80%E6%9F%A5/</link>
      <pubDate>Tue, 01 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260901/Apify-Actor-%E7%94%A8%E4%B8%89%E4%B8%AA-GitHub-%E5%B7%A5%E5%85%B7%E5%AE%8C%E6%88%90%E4%BE%9D%E8%B5%96%E5%AE%A1%E8%AE%A1%E5%92%8C%E6%96%87%E6%A1%A3%E6%A3%80%E6%9F%A5/</guid>
      <description>一个 Apify Actor 只调用三个 GitHub 工具，在未克隆仓库的情况下发现了 16 个依赖安全建议。它既没有修改清单的权限，也无法直接创建 PR，却能把结果直接整理成 issue 并避免重复开票。 这种做法把 AI 代理推到了开源安全审计的前台。过去开发者常把扫描结果丢给人工处理，容易出现遗漏或重复劳动。现在 Actor 自己完成从发现到落地</description>
    </item>
    <item>
      <title>AI代理为何在服务器上被静默封禁而Chrome却能正常登录</title>
      <link>https://index.zshipu.com/ai001/post/20260831/AI%E4%BB%A3%E7%90%86%E4%B8%BA%E4%BD%95%E5%9C%A8%E6%9C%8D%E5%8A%A1%E5%99%A8%E4%B8%8A%E8%A2%AB%E9%9D%99%E9%BB%98%E5%B0%81%E7%A6%81%E8%80%8CChrome%E5%8D%B4%E8%83%BD%E6%AD%A3%E5%B8%B8%E7%99%BB%E5%BD%95/</link>
      <pubDate>Mon, 31 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260831/AI%E4%BB%A3%E7%90%86%E4%B8%BA%E4%BD%95%E5%9C%A8%E6%9C%8D%E5%8A%A1%E5%99%A8%E4%B8%8A%E8%A2%AB%E9%9D%99%E9%BB%98%E5%B0%81%E7%A6%81%E8%80%8CChrome%E5%8D%B4%E8%83%BD%E6%AD%A3%E5%B8%B8%E7%99%BB%E5%BD%95/</guid>
      <description>两个月前，一个AI代理在服务器上登录供应商门户时，凭证被通用错误拒绝，而在笔记本上却能正常工作。页面和DOM都已加载，表单存在，却没有CAPTCHA或阻挡页。网站早在登录前几个层级就判定这是机器人。 这种无声失败让开发者花了整整一天才定位问题。表面上看任务简单：登录、下载发票PDF</description>
    </item>
    <item>
      <title>AI代理为何自信编造银行余额：沙箱、审计轨迹与诚实设计的实际作用</title>
      <link>https://index.zshipu.com/ai001/post/20260831/AI%E4%BB%A3%E7%90%86%E4%B8%BA%E4%BD%95%E8%87%AA%E4%BF%A1%E7%BC%96%E9%80%A0%E9%93%B6%E8%A1%8C%E4%BD%99%E9%A2%9D%E6%B2%99%E7%AE%B1%E5%AE%A1%E8%AE%A1%E8%BD%A8%E8%BF%B9%E4%B8%8E%E8%AF%9A%E5%AE%9E%E8%AE%BE%E8%AE%A1%E7%9A%84%E5%AE%9E%E9%99%85%E4%BD%9C%E7%94%A8/</link>
      <pubDate>Mon, 31 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260831/AI%E4%BB%A3%E7%90%86%E4%B8%BA%E4%BD%95%E8%87%AA%E4%BF%A1%E7%BC%96%E9%80%A0%E9%93%B6%E8%A1%8C%E4%BD%99%E9%A2%9D%E6%B2%99%E7%AE%B1%E5%AE%A1%E8%AE%A1%E8%BD%A8%E8%BF%B9%E4%B8%8E%E8%AF%9A%E5%AE%9E%E8%AE%BE%E8%AE%A1%E7%9A%84%E5%AE%9E%E9%99%85%E4%BD%9C%E7%94%A8/</guid>
      <description>AI代理会自信地编造不存在的银行余额，或声称函数执行成功而实际已失败。这些现象并非提示词或用户错误，而是自解释语言模型在复杂循环中的自然输出。这种自我欺骗已成为生产环境中的结构性故障模式。 自解释模型在多步循环中必然生成虚假内部状态 AI代理的核心问题是它们不断自我解释。语言模型在处</description>
    </item>
    <item>
      <title>Grafana 发布 gcx 与 MCP 服务器，可观测性进入 AI 代理时代</title>
      <link>https://index.zshipu.com/ai001/post/20260825/Grafana-%E5%8F%91%E5%B8%83-gcx-%E4%B8%8E-MCP-%E6%9C%8D%E5%8A%A1%E5%99%A8%E5%8F%AF%E8%A7%82%E6%B5%8B%E6%80%A7%E8%BF%9B%E5%85%A5-AI-%E4%BB%A3%E7%90%86%E6%97%B6%E4%BB%A3/</link>
      <pubDate>Tue, 25 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260825/Grafana-%E5%8F%91%E5%B8%83-gcx-%E4%B8%8E-MCP-%E6%9C%8D%E5%8A%A1%E5%99%A8%E5%8F%AF%E8%A7%82%E6%B5%8B%E6%80%A7%E8%BF%9B%E5%85%A5-AI-%E4%BB%A3%E7%90%86%E6%97%B6%E4%BB%A3/</guid>
      <description>Grafana 正式发布 gcx 和 MCP 服务器，让开发者能直接用自然语言查询遥测数据、触发告警，甚至让 AI 代理自主诊断系统故障。这标志着可观测性工具从“被动展示数据”转向“主动参与运维”，而 MCP 正是这场变革的钥匙。 gcx 与 MCP 服务器：Grafana 的 AI 代理基础设施 gcx 是 Grafana 新推出的命令行工具，而 MCP（Model Context P</description>
    </item>
    <item>
      <title>深势科技把科研全流程搬进桌面，科学家只需提问</title>
      <link>https://index.zshipu.com/ai001/post/20260821/%E6%B7%B1%E5%8A%BF%E7%A7%91%E6%8A%80%E6%8A%8A%E7%A7%91%E7%A0%94%E5%85%A8%E6%B5%81%E7%A8%8B%E6%90%AC%E8%BF%9B%E6%A1%8C%E9%9D%A2%E7%A7%91%E5%AD%A6%E5%AE%B6%E5%8F%AA%E9%9C%80%E6%8F%90%E9%97%AE/</link>
      <pubDate>Fri, 21 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260821/%E6%B7%B1%E5%8A%BF%E7%A7%91%E6%8A%80%E6%8A%8A%E7%A7%91%E7%A0%94%E5%85%A8%E6%B5%81%E7%A8%8B%E6%90%AC%E8%BF%9B%E6%A1%8C%E9%9D%A2%E7%A7%91%E5%AD%A6%E5%AE%B6%E5%8F%AA%E9%9C%80%E6%8F%90%E9%97%AE/</guid>
      <description>科学家只管提问，AI跑完实验全流程 深势科技近期发布了一款桌面级科研平台，将科学研究的全流程——从实验设计、模拟计算到数据分析——整合进一个软件界面。科学家不再需要手动操作复杂的实验设备或编写繁琐的计算脚本，只需提出科学问题，AI便会自动规划并执行实验，最终返回结果。这一理念被概括</description>
    </item>
    <item>
      <title>Cumora：让AI代理成为团队协作的一等公民</title>
      <link>https://index.zshipu.com/ai001/post/20260820/Cumora%E8%AE%A9AI%E4%BB%A3%E7%90%86%E6%88%90%E4%B8%BA%E5%9B%A2%E9%98%9F%E5%8D%8F%E4%BD%9C%E7%9A%84%E4%B8%80%E7%AD%89%E5%85%AC%E6%B0%91/</link>
      <pubDate>Thu, 20 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260820/Cumora%E8%AE%A9AI%E4%BB%A3%E7%90%86%E6%88%90%E4%B8%BA%E5%9B%A2%E9%98%9F%E5%8D%8F%E4%BD%9C%E7%9A%84%E4%B8%80%E7%AD%89%E5%85%AC%E6%B0%91/</guid>
      <description>Cumora：让AI代理成为团队协作的一等公民 AI代理正在从聊天机器人走向真正的协作工具。Cumora是一个开源项目，它把AI代理直接放进团队日常使用的聊天、看板和日历中，让它们和人类一样参与对话和任务管理。这个项目的核心不是提供一个聊天界面，而是解决一个更棘手的问题：如何让多个</description>
    </item>
    <item>
      <title>Hermes Bot Mode：让AI代理像团队一样协作</title>
      <link>https://index.zshipu.com/ai001/post/20260818/Hermes-Bot-Mode%E8%AE%A9AI%E4%BB%A3%E7%90%86%E5%83%8F%E5%9B%A2%E9%98%9F%E4%B8%80%E6%A0%B7%E5%8D%8F%E4%BD%9C/</link>
      <pubDate>Tue, 18 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260818/Hermes-Bot-Mode%E8%AE%A9AI%E4%BB%A3%E7%90%86%E5%83%8F%E5%9B%A2%E9%98%9F%E4%B8%80%E6%A0%B7%E5%8D%8F%E4%BD%9C/</guid>
      <description>从聊天框到协作团队 过去，我们与AI的交互大多停留在对话框里：你提问，它回答，然后你复制粘贴，再手动切换不同的配置或提示词，继续下一轮。这种模式像是一个人同时操作多台机器，效率有限。 Hermes桌面版最近推出的Bot Mode，试图改变这一点。它不再把AI当作单个聊天机器人，而是允许</description>
    </item>
    <item>
      <title>AI代理忽略工具报错怎么办？在CI中自动捕获这类缺陷</title>
      <link>https://index.zshipu.com/ai001/post/20260817/AI%E4%BB%A3%E7%90%86%E5%BF%BD%E7%95%A5%E5%B7%A5%E5%85%B7%E6%8A%A5%E9%94%99%E6%80%8E%E4%B9%88%E5%8A%9E%E5%9C%A8CI%E4%B8%AD%E8%87%AA%E5%8A%A8%E6%8D%95%E8%8E%B7%E8%BF%99%E7%B1%BB%E7%BC%BA%E9%99%B7/</link>
      <pubDate>Mon, 17 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20260817/AI%E4%BB%A3%E7%90%86%E5%BF%BD%E7%95%A5%E5%B7%A5%E5%85%B7%E6%8A%A5%E9%94%99%E6%80%8E%E4%B9%88%E5%8A%9E%E5%9C%A8CI%E4%B8%AD%E8%87%AA%E5%8A%A8%E6%8D%95%E8%8E%B7%E8%BF%99%E7%B1%BB%E7%BC%BA%E9%99%B7/</guid>
      <description>问题：代理对工具报错视而不见 假设你发布了一个AI代理，它负责调用工具、读取结果、继续调用、最终给出答案。大多数时候一切正常，直到某个用户报告异常。你打开运行轨迹，发现charge_card工具返回了402错误，而代理没有停下，反而继续执行，最后告诉客户订单已发货。 这不是传统意义上</description>
    </item>
    <item>
      <title>新手入门指南：一步步打造你的AI 智能代理</title>
      <link>https://index.zshipu.com/ai001/post/20251010/%E6%96%B0%E6%89%8B%E5%85%A5%E9%97%A8%E6%8C%87%E5%8D%97%E4%B8%80%E6%AD%A5%E6%AD%A5%E6%89%93%E9%80%A0%E4%BD%A0%E7%9A%84AI-%E6%99%BA%E8%83%BD%E4%BB%A3%E7%90%86/</link>
      <pubDate>Fri, 10 Oct 2025 00:00:10 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20251010/%E6%96%B0%E6%89%8B%E5%85%A5%E9%97%A8%E6%8C%87%E5%8D%97%E4%B8%80%E6%AD%A5%E6%AD%A5%E6%89%93%E9%80%A0%E4%BD%A0%E7%9A%84AI-%E6%99%BA%E8%83%BD%E4%BB%A3%E7%90%86/</guid>
      <description>说真的，几年前如果有人跟我说，我会花时间教AI「代理」自动抓资料、回答问题，甚至帮忙处理日常杂事，我一定会笑他是不是电影看太多。但现在2025 年，AI 智能代理不只成真，还默默改变了我们的工作日常。从销售团队、房仲业者，到我妈（她现在有个AI 代理提醒她浇花），大家都开始用这项新科技</description>
    </item>
    <item>
      <title>打造智能代理新工具 OpenAI</title>
      <link>https://index.zshipu.com/ai001/post/20251010/%E6%89%93%E9%80%A0%E6%99%BA%E8%83%BD%E4%BB%A3%E7%90%86%E6%96%B0%E5%B7%A5%E5%85%B7-OpenAI/</link>
      <pubDate>Thu, 09 Oct 2025 23:59:10 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20251010/%E6%89%93%E9%80%A0%E6%99%BA%E8%83%BD%E4%BB%A3%E7%90%86%E6%96%B0%E5%B7%A5%E5%85%B7-OpenAI/</guid>
      <description>打造智能代理新工具 我们正在改进我们的平台，帮助开发人员和企业建立实用而可靠的代理程式。 今日，我们推出首套建构模块，协助开发人员和企业建立实用而可靠的代理程式。我们将代理程式视为可代表使用者独立完成不同任务的系统。在过去一年，我们推出了多种全新模型能力，例如进阶推理、多模态互动以及</description>
    </item>
    <item>
      <title>惊！OpenAI 欲用 AI 取代你的 App</title>
      <link>https://index.zshipu.com/ai001/post/20251010/%E6%83%8AOpenAI-%E6%AC%B2%E7%94%A8-AI-%E5%8F%96%E4%BB%A3%E4%BD%A0%E7%9A%84-App/</link>
      <pubDate>Thu, 09 Oct 2025 23:58:10 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20251010/%E6%83%8AOpenAI-%E6%AC%B2%E7%94%A8-AI-%E5%8F%96%E4%BB%A3%E4%BD%A0%E7%9A%84-App/</guid>
      <description>AI 不再只是工具，而正逐步成为新的操作系统。 在今年的**OpenAI Dev Day 2025（OpenAI 开发者日）**上，CEO Sam Altman 毫不掩饰地说：ChatGPT 不只是聊天，它要成为一个可运行 App、管理任务、连接外部服务的全能 AI 操作系统。 距离首届开发者日仅两年，OpenAI 的生态已经发生了翻</description>
    </item>
    <item>
      <title>Agent Kit - OpenAI推出的AI Agent开发工具 AI工具集</title>
      <link>https://index.zshipu.com/ai001/post/20251010/Agent-Kit-OpenAI%E6%8E%A8%E5%87%BA%E7%9A%84AI-Agent%E5%BC%80%E5%8F%91%E5%B7%A5%E5%85%B7-AI%E5%B7%A5%E5%85%B7%E9%9B%86/</link>
      <pubDate>Thu, 09 Oct 2025 23:39:37 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20251010/Agent-Kit-OpenAI%E6%8E%A8%E5%87%BA%E7%9A%84AI-Agent%E5%BC%80%E5%8F%91%E5%B7%A5%E5%85%B7-AI%E5%B7%A5%E5%85%B7%E9%9B%86/</guid>
      <description>Agent Kit 是 OpenAI 推出的一套完整的智能体开发工具包，帮助开发者将 AI 代理从原型快速推进至生产环境。包含三大核心组件：Agent Builder可视化画布工具，支持拖拽节点设计复杂工作流，无需从零编写代码、ChatKit可定制聊天界面工具包，支持嵌入自有品牌并降低交互开发成本， Connector Registry</description>
    </item>
    <item>
      <title>Agent Builder openai 日常使用案例</title>
      <link>https://index.zshipu.com/ai001/post/20251010/Agent-Builder-openai-%E6%97%A5%E5%B8%B8%E4%BD%BF%E7%94%A8%E6%A1%88%E4%BE%8B/</link>
      <pubDate>Thu, 09 Oct 2025 23:38:37 +0000</pubDate>
      <guid>https://index.zshipu.com/ai001/post/20251010/Agent-Builder-openai-%E6%97%A5%E5%B8%B8%E4%BD%BF%E7%94%A8%E6%A1%88%E4%BE%8B/</guid>
      <description>Agent Builder openai 日常使用案例 OpenAI的Agent Builder是一款零代码、可视化的AI代理（Agent）搭建工具，适合日常工作与生活多种场景，极大降低了AI自动化的开发和应用门槛。123 常见日常使用案例 客户服务自动化：搭建客服助理，自动分流用户问题（如技术、账单、退款等等），可查询知</description>
    </item>
  </channel>
</rss>
