严禁所有人对Claude持续、无谓地辱骂和虐待。
AI推门而入,变局已至,靶场建设的三件事该怎么记?
大模型时代,我们习惯用越狱、提示注入、数据泄露等类别描述安全风险。但到了 Agent 时代,这种分类方式开始...
从基础设施、模型和智能体三个层面,分析安全评估面临的挑战,并提出持续治理路径。
ANT构建智能体网络流量数据集,评测流量分析方法从智能体网络流量进行智能体任务风险识别、场景识别与行为原...
丹麦国家人口登记系统的某家私营合作方遭到攻击,攻击者利用其合法访问权限对该系统发起大规模自动化查询,导...
成功利用可导致配置文件、凭据(JDBC 连接串、密码、API Token、私钥等)泄露,进而实现权限提升、账户接管或...
美国智库警告称“灰色地带施压”或升级为“网络经济战”。
移动应用存在侵害用户权益问题的情况时有出现。
有种说法认为65%BOM属于贸易法范畴,和国家安全没关系,所以FCC没权力自己设这个门槛,真要这么限,需要国会...
AI安全争议揭示了技术能力、规则影响力与风险承担之间的不对称。
新规涉及智能手机、摄像头、计算机等电子设备,计划于2028年12月1日起实施。
官方将原因直指 自动化提交数量激增,绝大多数均为无效报告。
真正主导安全结果的是:你遭遇了什么攻击,其次才是用了什么模型。
textGrain: Entropy-Calibrated Watermarking for Language Model Text.
中美开放模型的竞争局。
网络靶场正在重演兰利式错误。
自主作战不再是一批分散的项目,而被提升为组织化、预算化、常设化的国家能力工程。
“允许失败”解决的是态度问题。
codex 下一步,网友说了算?
微信公众号