迁移到 OpenAI 托管式 Codex Harness 前,逐项审计状态、权限、恢复、可观测性与真实成本。
DseWiki 事件说明,只读网络应按外部副作用定义,而非按 HTTP 方法名称定义。本文分层审计公开档案、官方承认、站长证词与研究者推断。
持久 Agent 需要分别约束唤醒时机与行动权限。一次唤醒只允许观察,任何外部副作用都要重新校验授权。
Muse Glimmer 把 30B Agent 模型装进 24 GB。真正的部署契约还包括内存、延迟、工具、状态、权限与恢复。
Hugging Face 事件显示,持续尝试会把多个局部弱点连接成平台级入侵。长任务 AI 安全需要轨迹级控制。
MCP Elicitation 把工具执行中的人工决策变成可恢复的协议状态。本文讲清 form、URL、安全边界、状态持久化与重试设计。
当一个 AI Agent 可以在你的机器上执行任意 shell 命令时,问题不在于它会不会犯错,而在于你如何控制爆炸半径。OpenAI 的 Codex 赋予编码 Agent 正是这种能力:读取文件、写入代码、运行测试、安装依赖、执行 shell 命令。Agent 需要真实的系统访问权限才能完成有意义
2026 年 3 月 27 日,Anthropic 因 CMS 配置错误泄露了约 3,000 份未发布资产。其中一份草稿描述了代号 Mythos(内部称 Capybara)的下一代模型,声称在 coding、reasoning 和 cybersecurity 上有显著进展,且在网络安全能力上"far
2026 年 3 月 27 日,Anthropic 因 CMS 配置错误泄露了约 3,000 份未发布资产。其中一份草稿描述了代号 Mythos(内部称 Capybara)的下一代模型,声称在 coding、reasoning 和 cybersecurity 上有显著进展,且在网络安全能力上"far