安全工程师的工作,正在从监控 Bug 转向监控 Agent Loop。
大多数 Agent 安全方案,都在试图解决一个问题:怎么让模型识别出恶意指令?
攻击者可构造恶意 HDF5 文件,利用其外部存储特性读取容器内敏感文件,提取 SECRET_KEY_BASE 密钥。随后使用该密钥签名绕过签名验证,触发反序列化执行任意系统命令。
近期动态的盘点。
过去只要写明作家名字,模型就能生成接近其文风的内容,不需要额外解释句长、节奏、视角。现在,这类提示用不了了。
它把「失控」从一个只能在事后命名的结果,转化为一组可以提前检查的问题
韩国主要移动运营商KT因数据泄露被罚2.52亿元,去年该公司1.66万余名用户通信敏感信息泄露,被用于交易盗刷,该公司直到用户投诉才发现此事件。
“对抗性蒸馏”、“蒸馏攻击”和普通蒸馏最大的区别,不在于训练方法,而在于教师模型并不属于训练学生模型的一方,模型提供商也没有同意这种用途。
AI 安全测试公司 Andon Labs 扔出一颗炸弹:在它经典的「Vending-Bench」模拟测试里,Claude Opus 5 以平均 11182 美元的最终余额刷新纪录,登顶历史第一。
报告为企业与社会组织构建了一个结构化行动框架,明确了非政府主体在人工智能风险治理中可以实际承担的三大角色:管理技术与运营风险、通过市场与网络机制塑造安全激励、在...
上半年,信息安全产品和服务收入1425亿元,同比增长6.3%。
Windows 默认的 NTFS 文件系统内置了至少三层相互独立的审计记录结构,只清理其中任意一层,都藏不住完整的操作痕迹。把三层证据交叉印证,就能还原出攻击者以为已经抹去的...
本文聚焦巴基斯坦军用人工智能的发展和运用情况,阐述其对本国、地区及全球带来的影响。
本文梳理特朗普第二任期对内、对外和对华三个层面的AI人才政策,审视其长期系统性投入人才储备、加速AI领域外交人才转型、强化对华AI人才竞争等措施的表征,探究其力图确保...
美国明州30多个社区供水系统日前遭网络破坏攻击,多个城市受到影响;其中布拉汉姆市水厂因此关停数小时,官方公告建议用户节约用水,梅普尔普莱恩市宣布进入紧急状态以快速...
报告从发展背景、市场现状、竞争格局、落地场景、发展趋势五大维度,系统剖析我国大模型专有云服务市场发展现状,梳理产业发展核心逻辑与演进规律,旨在为国家相关政策制定...
江西证监局发布行政处罚决定书〔2026〕3号,认定渔翁信息在科创板IPO申报期间存在财务造假、隐瞒股权代持等违法行为。公司及7名相关责任人合计被罚1790万元。
损失金额2000元上下,最高达8000元。
只需要一百多次按键的录音,就能把英文文本还原出99%以上的准确率。哪怕是隔墙录音、线上会议的背景音,也能实现九成左右的还原度。
位置不是被填进地图的,而是从连接中生长出来的。没有外部底图,关系本身就足以定义坐标。这一篇,重新追问:“空间”究竟从何而来。
微信公众号