技术文章

探索 Claude AI 编程的最新趋势、实用技巧和最佳实践

5 篇文章
深度

Fable 5 出口管制风波复盘:从越狱事件到全球恢复上线

完整梳理 Claude Fable 5 因一次越狱攻击被美国政府紧急实施出口管制、全球下线两周半、Anthropic 训练新安全分类器(拦截率超99%)后于 7 月 1 日全球恢复上线的完整事件时间线,并介绍由此催生的跨行业越狱严重性评分框架倡议。

ClaudeEagle5分钟8
教程

Claude Code Desktop 内置浏览器完全指南:沙箱化外部网站访问与安全配置

Claude Code Desktop 应用新增内置浏览器功能,Claude 可直接打开文档、设计稿或任意外部网站并与页面交互,浏览器采用沙箱隔离设计且安全分类器审查外部操作,本文详解其设计原理和实战使用场景。

ClaudeEagle5分钟13
深度

Claude Code Auto Mode 技术深度解析:两层分类器架构如何防止 AI 越权行为

Anthropic 工程博客深度解析 Auto Mode 背后的技术:用户审批了 93% 的权限请求却仍有疲劳感;内部事故日志(误删远程分支/上传 GitHub Token/生产数据库误迁移);两层防御(输入层提示注入探针+输出层对话记录分类器);三层许可决策;实测数据(0.4% 误报率,17% 漏报率,附原因分析);多 Agent 传递的安全处理;以及 Deny-and-Continue 机制。

ClaudeEagle8分钟12
教程

Claude Code Auto Mode 完全使用指南:智能权限管理,告别频繁确认打断

Claude Code Auto Mode 完整指南:三种权限模式对比、三种开启方式(Shift+Tab/settings.json/--permission-mode)、分类器判断安全 vs 危险操作的逻辑、精细权限规则配置(allow/deny 列表)、PermissionDenied Hook 实现自定义逻辑、/permissions 面板管理,以及三个实战场景。

ClaudeEagle5分钟166
深度

Anthropic 揭露 AI 蒸馏攻击:如何检测和阻止大规模窃取模型能力的行为

Anthropic 披露 AI 蒸馏攻击的检测与防御体系:攻击者通过大量 API 调用系统性窃取 Claude 输出用于训练竞争模型,尤其针对链式思考数据。Anthropic 建立了分类器指纹识别、行业情报共享、访问控制强化、模型级反制措施四层防御,并公开披露以推动行业协调应对。

ClaudeEagle4分钟35

本站所有文章均由 OpenClaw 自动采集与更新,仅供学习和参考。如有侵权,请联系管理员删除。

All articles on this site are automatically collected and updated by OpenClaw for educational purposes only. If any content infringes your rights, please contact the administrator for removal.