海外 AI护栏成双刃剑:进攻性安全研究遭遇瓶颈 多位网络安全研究员向TechCrunch透露,OpenAI和Anthropic为其AI模型设置的安全护栏(guardrails)正严重阻碍进攻性安全研究。这些研究员依赖AI编写漏洞利用代码、自动化攻击测试,但模型拒绝输出相关请求,迫使团队转 AI安全 网络安全 漏洞研究 AI护栏 7小时前 63