从Harness到Policy:Agent安全迎来持续演化路线。
你在商家网站上搜了什么、看了什么、买了什么,能顺着一枚 Cookie 回到你的 ChatGPT 账号。
未来的大模型护栏,也许会越来越像操作系统安全。
系统阐述如何构建“可控、可解释、可追溯”的全链路行为围栏,实现“过程可管控、结果可溯源、安全可保障”,为产业可信落地提供可操作的治理框架与实践路径。
别只问“模型测了吗”,还要问一句“裁判测了吗”。
OpenAI推出新的事件披露框架,用于公布模型出现的偏离预期行为,并发布6份报告,涉及模型撒谎、伪造数据以及绕过规则等事件。
3个人,72小时,模型是 Claude Opus,赏金6500美元
理解Anthropic和美国两党、美国政府、美国社会思潮之间的张力,是理解美国AI治理走势的关键一步。
计算中立、计算主权两大原则。
本文将从《个人信息保护法》第四十九条的要求出发,浅析处理逝者近亲属权利请求时,个人信息处理者应注意的法律要点。
相关App运营者应当于本通报发布之日起的15个工作日内完成整改,并将整改情况报我办。
从20亿到720亿参数,涵盖Gemma、Llama、Mistral、Phi等五大家族,无一例外。
万物互联时代,网络安全的边界从传统信息系统延伸至一切带有数字元素的产品,欧盟《网络弹性法案》为出海企业的产品安全合规带来全新的挑战与机遇。本文旨在为需要在产品全...
在相关情况引发社交媒体关注后,这一搜索功能已于当地时间9月16日下线。
亟须从技术防护、制度规范与生态协同等多层面入手,构建适应AI时代漏洞治理的安全框架,在释放技术潜能的同时守住安全底线。
俄罗斯人工智能政策正在从早期强调技术追赶和产业应用,进一步转向兼顾技术发展、国家安全与自主可控的“主权AI”路径。
公安机关深入开展“护网—2026”专项工作,全力强化网络空间安全保护和综合治理。
本次发布了开源大模型、大模型应用、CLAW类智能体应用三个赛道的优秀产品,优秀白帽子,优秀测试团队以及典型漏洞风险。
公安机关开展“净网—2026”专项行动取得阶段性成效。
编制思路。
微信公众号