AI护栏成双刃剑:进攻性安全研究遭遇瓶颈
多位网络安全研究员向TechCrunch透露,OpenAI和Anthropic为其AI模型设置的安全护栏(guardrails)正严重阻碍进攻性安全研究。这些研究员依赖AI编写漏洞利用代码、自动化攻击测试,但模型拒绝输出相关请求,迫使团队转
多位网络安全研究员向TechCrunch透露,OpenAI和Anthropic为其AI模型设置的安全护栏(guardrails)正严重阻碍进攻性安全研究。这些研究员依赖AI编写漏洞利用代码、自动化攻击测试,但模型拒绝输出相关请求,迫使团队转
由前谷歌安全高管创立的AegisAI近日完成3600万美元融资,其AI代理能像人类一样快速分析每条消息,捕捉最精细检查清单也无法发现的微小异常。随着生成式AI被用于制造高度逼真的鱼叉式网络钓鱼邮件,传统防御手段已力不从心。AegisAI的解
网络安全初创公司Glow在沉寂中浮出水面,以12亿美元估值正式进入公众视野,旨在挑战AI时代端点安全领域。该公司瞄准企业内部快速采用AI代理和开发者工具所引发的新型端点风险,为日益复杂的企业环境提供针对性防护方案。这一高调亮相标志着网络安全
谷歌今日宣布推出Gemini 3.6 Flash轻量级模型及针对网络安全的AI工具,同时预告了即将到来的Gemini 3.5 Pro版本,并确认已经开始训练下一代旗舰模型Gemini 4。新模型在推理速度、代码生成和安全防护方面均有显著提升
最新研究发现,AI在招聘过程中比人类更容易形成偏见,尤其是在筛选简历时。同时,全球气象数据系统正面临人为破坏威胁,可能导致天气预报失效和气候研究倒退。本期《今日下载》深度剖析这两大科技热点。
本周科技安全新闻综述:经期追踪应用被曝大规模数据泄露,用户隐私岌岌可危;俄罗斯网络间谍转向关键基础设施攻击,威胁升级;美国国土安全部多次遭黑客入侵却浑然不知;AI音乐生成器被揭露擅自抓取数据训练模型。这些事件共同敲响数字时代隐私与安全的警钟
微软在7月的“补丁星期二”中修复了创纪录的570个安全漏洞,覆盖Windows、Azure、Office等全线产品。微软表示,大量漏洞的发现得益于AI技术的深度应用,包括AI辅助代码审计、自动化模糊测试和威胁模式识别。这一数字是此前最高纪录
互联网奠基人之一、TCP/IP协议联合发明者文特·瑟夫(Vint Cerf)正在牵头制定一套全新标准,旨在为开放互联网上的AI代理(AI Agent)建立统一的身份识别与验证机制。这一举措有望终结AI代理“匿名乱跑”的乱象,为自主智能体的可
OpenAI于2026年7月10日正式推出GPT-5.6模型家族,这是继GPT-4之后的最新一代大语言模型。新系列在推理能力、指令遵循和安全性方面实现重大突破,尤其在网络安全领域引入多层防护机制。据官方透露,GPT-5.6在对抗性测试和红队
针对日益猖獗的AI深度伪造诈骗,初创公司Savi推出了一款专用App,可实时检测来电中的AI合成声音,防止不法分子利用语音克隆技术冒充亲人索要赎金。该公司刚获得700万美元种子轮融资,App于本周二在iOS和Android平台同步上线。
一场由AI代理主导的勒索攻击首次在真实世界中完成技术执行,但最新细节显示,人类仍负责选择目标、搭建基础设施和提供被盗凭证。这并非上周新闻暗示的完全自主网络犯罪首秀,而是人机协作的升级版威胁。
五眼联盟(美国、英国、加拿大、澳大利亚、新西兰)的网络安全负责人于2026年6月22日发布罕见的联合情报简报,指出人工智能驱动的网络威胁将在未来数月内对个人和企业造成直接影响。简报警告,AI工具已大幅降低网络攻击门槛,从身份盗窃到勒索软件,
OpenAI发布改进版网络安全模型GPT-5.5-Cyber,并推出“Patch the Planet”倡议,旨在系统性修复全球开源软件漏洞。此举不仅是对AI安全能力的深度探索,更是对Anthropic所倡导的“安全至上”理念的直接回应。编
随着2026年世界杯的临近,AI技术正在被诈骗分子广泛利用,从伪造门票到克隆官方网站,诈骗手段愈发逼真且难以分辨。WIRED警告,球迷在购票、预订酒店时需加倍警惕,因为AI生成的虚假信息可能会让即使是经验丰富的消费者也上当受骗。本文将剖析A
过去30年的历史一再证明,试图阻止网络安全相关软件的跨境流动是徒劳的。从加密技术到间谍软件,出口管制从未真正奏效。如今,Anthropic推出的网络安全模型Mythos又站在了风口浪尖。本文将回顾历史教训,分析为何针对AI安全工具的管制同样
一群由数十名网络安全专家组成的团体致信白宫,强烈要求解除对Anthropic公司最强AI模型Fable和Mythos的出口管制。专家们认为,该禁令不仅无助于提升国家安全,反而严重限制了网络安全防御者保护软件和产品的能力,是一种“危险”的举措
科技巨头谷歌近日起诉一家名为“Outsider Enterprise”的中国网络犯罪组织,指控其利用人工智能技术实施大规模短信诈骗,在短短两周内发送了250万条欺诈短信,受害人数达数十万。此案揭示AI技术正在被犯罪集团用于高度自动化、精准化
Anthropic最新发布的Fable模型在网络安全领域引发争议。多名安全研究人员指出,该模型内置的安全护栏(guardrails)过于严格,导致无法执行基本的渗透测试、漏洞分析等任务。他们批评Anthropic过度谨慎,以安全之名牺牲了实
据WIRED报道,加密货币资金正大量涌入中国的肽实验室,推动这一领域迅速扩张。与此同时,黑客利用Meta的AI机器人窃取Instagram账户,Anthropic意外帮助NSA黑客,以及一个持续数十年的GPS卫星谜团可能已被解开。这些事件共
网络安全公司Cyera即将完成由Evolution Equity Partners领投的3亿美元融资,估值飙升至120亿美元,对应ARR倍数高达80倍。尽管公司仍处于运营亏损状态,但投资者对其高增长前景仍热情高涨。本文分析这一高估值背后的逻