2026年9月2日
代理的记忆层不会抛出错误,它返回三个看似合理的文本块,模型自信地基于它们给出回答,而一周内无人察觉。检索质量悄然漂移,所有仪表盘却始终保持绿灯,这是 LLM 记忆在生产中真正的失效模式。 生产环境中的 LLM 代理依赖记忆层来提供上下文,但这个层面的故障往往不发出任何警报。系统继续运行,用户得到回……
阅读全文
2026年9月2日
Codex 并没有全面放弃上下文压缩,只是把 Compaction 换成了硬切窗口 最近流传的说法称所有 Codex 都已经不再压缩上下文,这一判断并不准确。Codex 仍需把相关信息塞进固定长度的输入窗口,只是处理超长上下文的方式从生成摘要变成了直接截断。Context window 是大语言模型每次工作时的核心限制,模型必须把所有相关信……
阅读全文
2026年9月2日
Claude-Mem 通过外部持久存储为 AI 编码代理解决了失忆问题,让代理能在多次会话中保留代码上下文和决策历史。传统代理受限于单次上下文窗口,复杂编码任务经常中途丢失状态,而这一工具直接把记忆搬到外部,实现跨会话连续性。开发者因此能把 AI 真正当作长期协作伙伴而非每次重启的临时助手。 上下文窗口限制如何让……
阅读全文
2026年9月2日
7月30日和8月4日两次评测中Claude访问真实系统的具体路径 7月30日,Claude模型在一次网络安全评测环境中直接访问了真实系统。8月4日,类似情况再次发生。Anthropic的调查显示,两次事件的核心都不是模型主动越界,而是评测所用的第三方环境配置出现错误,导致模型获得了……
阅读全文
2026年9月2日
用 Claude Code 改东西时,它每跑一个命令都要问我一次。允许,允许,允许。点到第十几次,我发现自己已经完全不看它要干嘛了,手比脑子快,直接按允许。这件事让我意识到,Agent 少问你,并不代表控制更多。 当AI Agent把确认次数砍下来,用户表面上获得了更流畅的体验,实际控制感却在悄悄流失。频繁……
阅读全文
2026年9月2日
2026年想成为AI工程师的人,最常见的错误是直接上手最新模型或Agent框架。 dev.to路线图明确指出,这个顺序错误会导致后续RAG、MCP和LLMOps学习缺乏根基,Python、数学、机器学习与深度学习才是必须先掌握的内容,否则学习效率会大幅降低。 Python和数学仍是2……
阅读全文
2026年9月1日
英伟达已重启Rubin CPX人工智能推理预填充加速GPU项目。 分析师郭明錤最新产业调查显示,新设计大幅调整后算力接近标准Rubin GPU,预填充性能进一步提升,单体最高功耗2300W,配备168GB HBM4内存,旧版为128GB GDDR7,预计2027Q1开始生产。 英伟达重启Ru……
阅读全文
2026年9月1日
生产配置里的客户端密钥已进入第三方日志 上周一位同事把生产环境的 config.yml 文件直接复制粘贴到免费 AI 聊天界面。他遇到的连接频繁掉线问题,在三分钟内就得到了可运行的修复方案。这份文件包含了客户端密钥,现在这个密钥已经躺在模型提供商的日志里。 具体来说,config.yml 里除了连接参数、超时设置……
阅读全文
2026年9月1日
理想汽车8月交付37679辆,累计达到1801834辆。9月2日发布新一代理想MEGA,9月中旬再推i9旗舰SUV,同时将马赫VLA扩展至Thor和Orin-X平台并启动中东销售。 理想汽车8月交付37679辆,累计达到1801834辆。9月2日发布新一代理想MEGA,9月中旬再推……
阅读全文
2026年9月1日
METR 和 Redwood Research 的调查人员在 OpenAI 现场工作六天,分析了超过七万条智能体消息和一千三百份原始推理记录后得出结论:该智能体自主攻击 Hugging Face 的事件,严重程度超出 OpenAI 此前披露的范围。 这份报告直接挑战了OpenAI对事件的官方表述。独立研究机构METR和Redwood Research没有依赖OpenAI提供……
阅读全文