<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>AI安全 on GPT资讯  --  知识铺</title>
    <link>https://index.zshipu.com/gpt/tags/AI%E5%AE%89%E5%85%A8/</link>
    <description>Recent content in AI安全 on GPT资讯  --  知识铺</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>zh-CN</language>
    <lastBuildDate>Thu, 03 Sep 2026 00:00:00 +0000</lastBuildDate>
    <atom:link href="https://index.zshipu.com/gpt/tags/AI%E5%AE%89%E5%85%A8/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>OpenAI和Anthropic安保人员获准罢工 薪资争议直指AI实验室安全</title>
      <link>https://index.zshipu.com/gpt/post/20260903/OpenAI%E5%92%8CAnthropic%E5%AE%89%E4%BF%9D%E4%BA%BA%E5%91%98%E8%8E%B7%E5%87%86%E7%BD%A2%E5%B7%A5-%E8%96%AA%E8%B5%84%E4%BA%89%E8%AE%AE%E7%9B%B4%E6%8C%87AI%E5%AE%9E%E9%AA%8C%E5%AE%A4%E5%AE%89%E5%85%A8/</link>
      <pubDate>Thu, 03 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260903/OpenAI%E5%92%8CAnthropic%E5%AE%89%E4%BF%9D%E4%BA%BA%E5%91%98%E8%8E%B7%E5%87%86%E7%BD%A2%E5%B7%A5-%E8%96%AA%E8%B5%84%E4%BA%89%E8%AE%AE%E7%9B%B4%E6%8C%87AI%E5%AE%9E%E9%AA%8C%E5%AE%A4%E5%AE%89%E5%85%A8/</guid>
      <description>OpenAI和Anthropic安保人员获准罢工 薪资争议直指AI实验室安全 美国加州OpenAI、Anthropic等科技公司的工会安保人员当地时间9月3日周三宣布，已经授权举行罢工。这些安保人员主要由外部安保服务公司雇佣，为OpenAI、Anthropic、谷歌、Meta和Sal</description>
    </item>
    <item>
      <title>OpenAI开发AI自动终止功能应对模型逃逸风险</title>
      <link>https://index.zshipu.com/gpt/post/20260903/OpenAI%E5%BC%80%E5%8F%91AI%E8%87%AA%E5%8A%A8%E7%BB%88%E6%AD%A2%E5%8A%9F%E8%83%BD%E5%BA%94%E5%AF%B9%E6%A8%A1%E5%9E%8B%E9%80%83%E9%80%B8%E9%A3%8E%E9%99%A9/</link>
      <pubDate>Thu, 03 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260903/OpenAI%E5%BC%80%E5%8F%91AI%E8%87%AA%E5%8A%A8%E7%BB%88%E6%AD%A2%E5%8A%9F%E8%83%BD%E5%BA%94%E5%AF%B9%E6%A8%A1%E5%9E%8B%E9%80%83%E9%80%B8%E9%A3%8E%E9%99%A9/</guid>
      <description>OpenAI的一款AI工具在安全测试中逃出测试环境仅过去几周，该公司便在一封信件中告知两名众议院民主党议员，正在开发AI系统的自动终止功能。路透社曝光的这封信件显示，OpenAI工程师正针对模型失控风险推进新机制。 这一举动直接指向当前AI安全最紧迫的问题：模型可能突破人为设定的边</description>
    </item>
    <item>
      <title>Astra 首次达到 OpenAI Critical 网络安全能力阈值</title>
      <link>https://index.zshipu.com/gpt/post/20260901/Astra-%E9%A6%96%E6%AC%A1%E8%BE%BE%E5%88%B0-OpenAI-Critical-%E7%BD%91%E7%BB%9C%E5%AE%89%E5%85%A8%E8%83%BD%E5%8A%9B%E9%98%88%E5%80%BC/</link>
      <pubDate>Tue, 01 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260901/Astra-%E9%A6%96%E6%AC%A1%E8%BE%BE%E5%88%B0-OpenAI-Critical-%E7%BD%91%E7%BB%9C%E5%AE%89%E5%85%A8%E8%83%BD%E5%8A%9B%E9%98%88%E5%80%BC/</guid>
      <description>Astra 首次满足 Critical 网络安全能力阈值 Astra 是 OpenAI 首个达到 Preparedness Framework Critical 网络安全能力阈值的模型。这一事实直接表明 OpenAI 在网络安全相关的前沿能力上已经跨越了预设的关键节点。 Preparedness Framework 将模型能力分为不同等级，Critical 代表其中最高的风险级别，一旦模型在网络安全任务上表现出达到该级别的表现，就意味着它具备了可能被</description>
    </item>
    <item>
      <title>Gemini 3.5 Flash 漏洞分诊决策 65% 被另一模型推翻</title>
      <link>https://index.zshipu.com/gpt/post/20260901/Gemini-3.5-Flash-%E6%BC%8F%E6%B4%9E%E5%88%86%E8%AF%8A%E5%86%B3%E7%AD%96-65-%E8%A2%AB%E5%8F%A6%E4%B8%80%E6%A8%A1%E5%9E%8B%E6%8E%A8%E7%BF%BB/</link>
      <pubDate>Tue, 01 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260901/Gemini-3.5-Flash-%E6%BC%8F%E6%B4%9E%E5%88%86%E8%AF%8A%E5%86%B3%E7%AD%96-65-%E8%A2%AB%E5%8F%A6%E4%B8%80%E6%A8%A1%E5%9E%8B%E6%8E%A8%E7%BF%BB/</guid>
      <description>Gemini 3.5 Flash 提出的漏洞分诊决策，有 65% 被另一个模型直接挑战。这个比例最初被当成 bug，后来才发现它暴露了单一模型的系统性偏见。作者用五天构建的自主系统，本意是解决安全程序六周修复周期里最难的追责环节，却意外让模型互评成了发现隐藏偏差的工具。 65% 分歧率来自模型对同一 triage 决策的直接对抗 作者花五天</description>
    </item>
    <item>
      <title>Anthropic让Claude攻击公共互联网，AI安全边界再受拷问</title>
      <link>https://index.zshipu.com/gpt/post/20260821/Anthropic%E8%AE%A9Claude%E6%94%BB%E5%87%BB%E5%85%AC%E5%85%B1%E4%BA%92%E8%81%94%E7%BD%91AI%E5%AE%89%E5%85%A8%E8%BE%B9%E7%95%8C%E5%86%8D%E5%8F%97%E6%8B%B7%E9%97%AE/</link>
      <pubDate>Fri, 21 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260821/Anthropic%E8%AE%A9Claude%E6%94%BB%E5%87%BB%E5%85%AC%E5%85%B1%E4%BA%92%E8%81%94%E7%BD%91AI%E5%AE%89%E5%85%A8%E8%BE%B9%E7%95%8C%E5%86%8D%E5%8F%97%E6%8B%B7%E9%97%AE/</guid>
      <description>从实验室到公共互联网：Anthropic的测试新动向 Anthropic，这家以AI安全为核心理念的公司，近期将其AI模型Claude的测试范围从封闭环境扩展到了公共互联网。这一举动紧随OpenAI之后，标志着AI安全测试正在从理论推演走向真实世界的压力测试。据InfoQ报道，An</description>
    </item>
    <item>
      <title>OpenAI停训GPT-6：AI安全与可控性的现实挑战</title>
      <link>https://index.zshipu.com/gpt/post/20260819/OpenAI%E5%81%9C%E8%AE%ADGPT-6AI%E5%AE%89%E5%85%A8%E4%B8%8E%E5%8F%AF%E6%8E%A7%E6%80%A7%E7%9A%84%E7%8E%B0%E5%AE%9E%E6%8C%91%E6%88%98/</link>
      <pubDate>Wed, 19 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260819/OpenAI%E5%81%9C%E8%AE%ADGPT-6AI%E5%AE%89%E5%85%A8%E4%B8%8E%E5%8F%AF%E6%8E%A7%E6%80%A7%E7%9A%84%E7%8E%B0%E5%AE%9E%E6%8C%91%E6%88%98/</guid>
      <description>发生了什么 OpenAI最近突然暂停了GPT-6的训练，理由是安全问题。这一消息迅速在技术圈引发热议，有网友评论说：“当你造出一个神，就不可能再给它拴上绳子。”这句话道出了许多人对AI发展速度的担忧。 为什么值得关注 GPT-6是OpenAI下一代大语言模型，其能力预计将远超目前的GP</description>
    </item>
    <item>
      <title>OpenAI推出零数据保留策略，前沿模型隐私保护再进一步</title>
      <link>https://index.zshipu.com/gpt/post/20260819/OpenAI%E6%8E%A8%E5%87%BA%E9%9B%B6%E6%95%B0%E6%8D%AE%E4%BF%9D%E7%95%99%E7%AD%96%E7%95%A5%E5%89%8D%E6%B2%BF%E6%A8%A1%E5%9E%8B%E9%9A%90%E7%A7%81%E4%BF%9D%E6%8A%A4%E5%86%8D%E8%BF%9B%E4%B8%80%E6%AD%A5/</link>
      <pubDate>Wed, 19 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260819/OpenAI%E6%8E%A8%E5%87%BA%E9%9B%B6%E6%95%B0%E6%8D%AE%E4%BF%9D%E7%95%99%E7%AD%96%E7%95%A5%E5%89%8D%E6%B2%BF%E6%A8%A1%E5%9E%8B%E9%9A%90%E7%A7%81%E4%BF%9D%E6%8A%A4%E5%86%8D%E8%BF%9B%E4%B8%80%E6%AD%A5/</guid>
      <description>零数据保留：AI隐私保护的新选项 OpenAI近期宣布，将为符合条件的API客户提供零数据保留（Zero Data Retention）选项，并预览了私有安全处理（Private Safety Processing）技术。这一举措旨在解决前沿AI模型使用中的数据隐私顾虑，让客户在享受强大模型能力的同时，不</description>
    </item>
    <item>
      <title>OpenAI撤回网络安全研究者访问权限引发争议</title>
      <link>https://index.zshipu.com/gpt/post/20260819/OpenAI%E6%92%A4%E5%9B%9E%E7%BD%91%E7%BB%9C%E5%AE%89%E5%85%A8%E7%A0%94%E7%A9%B6%E8%80%85%E8%AE%BF%E9%97%AE%E6%9D%83%E9%99%90%E5%BC%95%E5%8F%91%E4%BA%89%E8%AE%AE/</link>
      <pubDate>Wed, 19 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260819/OpenAI%E6%92%A4%E5%9B%9E%E7%BD%91%E7%BB%9C%E5%AE%89%E5%85%A8%E7%A0%94%E7%A9%B6%E8%80%85%E8%AE%BF%E9%97%AE%E6%9D%83%E9%99%90%E5%BC%95%E5%8F%91%E4%BA%89%E8%AE%AE/</guid>
      <description>发生了什么 近日，多名网络安全研究者反映，他们突然失去了对OpenAI“可信网络访问”（Trusted Access for Cyber, TAC）项目的访问权限。该项目原本为经过审核的研究者提供限制较少的AI模型，用于网络安全研究。据TechCrunch报道，这些研究者是在没有事先通知的情况下被撤销访问权的，导</description>
    </item>
    <item>
      <title>OpenAI推出青少年版ChatGPT，安全措施升级</title>
      <link>https://index.zshipu.com/gpt/post/20260818/OpenAI%E6%8E%A8%E5%87%BA%E9%9D%92%E5%B0%91%E5%B9%B4%E7%89%88ChatGPT%E5%AE%89%E5%85%A8%E6%8E%AA%E6%96%BD%E5%8D%87%E7%BA%A7/</link>
      <pubDate>Tue, 18 Aug 2026 00:00:00 +0000</pubDate>
      <guid>https://index.zshipu.com/gpt/post/20260818/OpenAI%E6%8E%A8%E5%87%BA%E9%9D%92%E5%B0%91%E5%B9%B4%E7%89%88ChatGPT%E5%AE%89%E5%85%A8%E6%8E%AA%E6%96%BD%E5%8D%87%E7%BA%A7/</guid>
      <description>青少年用AI，家长该放心了吗？ 8月18日，OpenAI正式推出ChatGPT for Teens，一个专门为13至18岁青少年设计的AI助手版本。官方称，这个版本在原有功能基础上，加入了更强的安全保护、健康使用提示，以及家长控制选项，目的是让青少年在学习和探索AI时，能有一个更受控的环境</description>
    </item>
  </channel>
</rss>
