《概要》直面智能体高自主性带来的新型安全风险,构建了全流程、系统化的管理体系,可以作为智能体研发、部署与监管的重要参考。
现有隐私评测大多关注 Agent 的最终回复或对外动作,却忽略了一个更早、更隐蔽的阶段——敏感数据第一次进入 Agent 上下文的阶段。
通过覆盖 setuid 二进制文件(如 /usr/bin/su)实现本地权限提升,从而获取系统最高控制权。
每一次人工纠正,都是最昂贵的训练信号,它必须自动进入评测集、判例库和智能体记忆,而不是消失在某条工单备注里。这不是人的价值下降,而是人的价值从重复劳动,迁移到设...
恶意 Skill 的恶意性通常不在某一个文件、某一段代码、某一句 prompt 里,而在各组成部分之间的关系里。
美国AI政策旨在强化国家能力,但相比于全面收紧监管,更可能表现为产业侧低负担、安全侧强介入的并行格局。
适用于消费类网联摄像头的网络安全标识的备案和使用。
从算力互联网三层架构出发,系统梳理各类安全痛点,总结归纳风险体系;结合可信计算、可靠运行、人工智能安全赋能等核心理念,构建算力互联网安全可信框架,并提出针对性治...
规范网络数据安全风险评估活动,保障网络数据安全,促进网络数据依法合理有效利用。
偷师、借道、换血、误删……折腾到最后,xAI成了给对手供电的人。
金融信息服务领域分类分级细则落地。
一个互联网社区给AI智能体上了一堂生动的公开课,深刻解释了为什么永远不要给AI信用卡权限和截止日期;一位用户给一个拥有AWS资源权限的智能体下达任务,要求限时接入某技...
这座占地 22,000 平方英尺的复刻城镇,专门用于培训执法人员模拟和调查真实世界中的网络攻击事件。
检测到风险,不等于阻止动作。
AI 写代码已经从一个新鲜功能,变成了很多开发者日常工作流的一部分。
个人信息处理无“小事”,筑牢安全保护“防火墙”。
把供应链攻击的扩散路径一层层堵住!
人提供意图,模型降低表达成本,系统执行约束。
论文定义的攻击向量都能够在现实场景中被有效执行,当前主流LLM缺乏针对恶意MCP服务器的稳健防御机制,常见MCP客户端/Host也难以有效缓解相关攻击。
加强Skills来源审查与行为监控,及时清除可疑组件,防范由此引发的安全风险。
微信公众号