给AI装上“神经滤镜”,让恶意特征提取免疫噪声。
下一个巨浪。
记忆中的每个部分都可能是良性的,但由它们共同构成的Agent,未必仍然安全。
Agent 不再只是安全规则的被动执行对象,也可能逐渐成为安全边界的主动探索者。
TCP/IP 协议栈部分处理路径存在校验强度不足。WAVED 以攻击者需要“猜中多少信息”为度量,自动分析 Linux 和 F...
Unit 42披露针对Google同步Passkey生态系统的三类新型攻击(Pass-ta-key、Silver Pass-ta-key、Golden Pass-t...
从输入输出护栏走向执行控制平面。
当 Agent 开始持续读取网页、邮件、MCP 返回结果和代码仓库,并能够执行真实动作时,信息本身就应该像权限一...
强制控制,而非绕行。
大多数 Agent 安全方案,都在试图解决一个问题:怎么让模型识别出恶意指令?
它把「失控」从一个只能在事后命名的结果,转化为一组可以提前检查的问题
只需要一百多次按键的录音,就能把英文文本还原出99%以上的准确率。哪怕是隔墙录音、线上会议的背景音,也能...
安全不能只看模型有没有说“不”
模型安全不一定只是约束一个已经具备全部能力的模型,也可以从训练阶段开始塑造模型的能力边界。
论文首次探索了知识增强LLM推理在虚假网络威胁情报检测中的应用,通过知识约束、双向解释生成和证据融合,实...
Agent 的错误行为发生在轨迹中,但风险往往更早地形成于上下文里。
加快RISC-V 安全内核在SIM卡等产品规模化应用,为网络强国和数字中国建设筑牢坚实的安全屏障。
GPT-5.6-Sol 的攻防能力超越了 Claude Mythos 5!
人类安全研究员何去何从?
Agent权限治理的核心,并不是回答"Agent能访问什么",而是回答"企业愿意将多大的决策权交给Agent"。权限的本...
微信公众号