#ai-safety
共 3 篇相关内容 · 安全漏洞、AI动态、技术文章
技术文章 2
LLM真的懂安全漏洞吗?CWE-Trace框架揭示大模型的“照猫画虎”困境
## TL;DR 研究人员发现,大语言模型(LLM)在安全漏洞检测基准测试中的高分表现,可能并非源于真正的安全推理能力,而更像是“照猫画虎”式的模式匹配。团队构建了CWE-Trace框架,用834个经人工标注的Linux内核代码样本覆盖7
DiffusionGemma推理透明度研究:扩散语言模型的黑箱到底有多黑
# DiffusionGemma的推理透明度:扩散语言模型的"黑箱"到底有多黑? ## TL;DR 扩散语言模型DiffusionGemma在连续潜空间中执行大量计算,其推理过程的透明度一直令人担忧。这项研究将透明度分解为"变量透明度"
情报动态 1
GitHub 🟢
agent-governance-toolkit — 微软AI Agent治理工具包,4.2K⭐
微软出品AI Agent治理工具包,零信任身份、执行沙箱、可靠性工程,覆盖OWASP Agentic Top 10全部10项。