新上线今天0 投票
AI护栏如何阻碍进攻型网络安全研究员的工作
长期以来,AI巨头通过严格的审查程序和护栏限制其模型被恶意黑客使用,但这些措施如今也阻碍了合法网络防御者及进攻型网络安全研究员的工作。今年6月,美国政府因担忧Anthropic的Mythos模型可能被越狱而对其施加出口管制,尽管后来部分解除,但暴露了AI护栏的争议。多位进攻型安全研究员向TechCrunch反映,OpenAI和Anthropic的审查项目(如OpenAI的Trusted Access for Cyber和Anthropic的Cyber Verification Program)存在主观决策问题,限制了他们在漏洞发现和利用工具开发中的工作。知名研究员Mark Dowd批评这些公司“随意决定安全领域什么可以做什么不可以”,而Chris Anley等专家则认为护栏影响了研究效率。本文深入探讨了AI护栏与进攻型安全研究之间的张力,以及行业对此的反思。