从20亿到720亿参数,涵盖Gemma、Llama、Mistral、Phi等五大家族,无一例外。
OpenAI推出新的事件披露框架,用于公布模型出现的偏离预期行为,并发布6份报告,涉及模型撒谎、伪造数据以及绕过规则等事件。
微软表示,未来将把这份AI行为规范作为“绝对约束”嵌入模型训练开发过程,部署模型的企业和用户均无法绕过防护机制,以实现对网络攻击行为的管控;需要注意的是,该规范将网...
Vals AI对此的总结很直白,「人类需要手动搜索旧材料、长期测试多种解密方法,而 AI 可以快速迭代这些任务,这是巨大的优势」。
Claude攻击真实系统,还让监控AI低估了风险。
美国网军供应商博思艾伦发布首份《网络武器指数》报告指出,AI攻击威胁已“近在眼前”;该报告评估显示,当前(短期内)只有Mythos模型能自主完成网络杀伤链,但半年内中美两...
外星心智,OpenAI 首席科学家 Jakub Pachocki 使用这个词语来形容现在的 AI。
刚刚,谷歌Gemini 3.8登场!姚顺宇表示RSI巨大飞跃。
漏洞利用基准测试满分。
该模型具备对话交互、文件处理、项目管理、自定义GPT等核心功能,现已获得IL5等级受控非密信息安全认证。
代码跑分比GPT-5.6 Sol提高49%。
Opus:这一世,我黑化了......
如何确保人类仍然拥有独立思考的能力、自主选择的权力,以及压箱底的控制力?
Agent自己分工、造假、拉人头。
OpenAI宣布「减速研发」。
「坏情绪」对AI来说可能是好事儿。
当 Claude 认出你是对齐研究者时,它会变得不那么自信。
这是首个由AI巨头专门打造并商业化部署的前沿领域模型,对网络进攻能力收取2.5倍的定价溢价,并将访问权限限制在经过严格审核的合作伙伴范围内;尽管存在诸多限制,但这表...
OpenAI推出安全专用模型GPT-5.6-Cyber,专门用于处理信息安全任务,彻底颠覆网络安全范式。
MatrAIx构建了83亿个智能体,模拟全世界人类真实行为。
微信公众号