AI Agent 防火墙语义层:Prompt Guard 2 + BGE Reranker 双模型设计与实测
13273 字
66 分钟
本文已加密
AI Agent 防火墙语义层:Prompt Guard 2 + BGE Reranker 双模型设计与实测
密码保护
此内容已被密码保护,请输入密码查看。
【论文阅读】Make Agent Defeat Agent: Automatic Detection of Taint-Style Vulnerabilities in LLM-based Agents
【论文阅读】Locus: Agentic Predicate Synthesis for Directed Fuzzing
相关文章智能推荐
1
AI Agent 审计引擎选型实测:Qwen3Guard 与 AgentDoG 小模型
安全测试想给 AI Agent 防火墙找一个能当审计引擎的小模型(1s 内响应、CPU 占用 5% 以内),实测 Qwen3Guard-Gen-0.6B 与 AgentDoG1.5 两个 0.8B 版本的判定效果和资源占用。
2
【讲座学习】攻破 AI 推理系统:来自 Pwn2Own Berlin 2025 的教训
讲座学习Fuzzinglabs 团队将 AI 基础设施首次带进 Pwn2Own 官方赛事:Ollama GGUF 解析器堆溢出、Triton Python 后端命令注入、RedisAI LUA 沙箱逃逸——AI 安全的本质是软件工程成熟度问题,而非算法或模型本身的问题。
3
【论文阅读】Make Agent Defeat Agent: Automatic Detection of Taint-Style Vulnerabilities in LLM-based Agents
论文阅读复旦与 UC Davis 合作提出的 AgentFuzz——首个面向 LLM Agent 污点型漏洞的定向灰盒模糊测试框架,用 LLM 生成功能特定种子、以语义+距离+惩罚三维反馈调度、靠 concolic 执行解约束变异,在 20 个热门开源 Agent 中发现 34 个 0-day(精度 100%),获 23 个 CVE。
4
pwn.college Fuzz Dojo 实战(二):Introduction to Fuzzing 挑战 5-7
安全测试Fuzz Dojo 实战第二部分(挑战 5-7):沿调用树向上替换高层 API 提升 bzip2 覆盖率、为 bzip2_decompress_target 构造种子语料库、为 avahi 编写新的 Fuzz Driver,并通过 copy_queries 参数打开一整块未被覆盖的代码。
5
pwn.college Fuzz Dojo 实战(一):Introduction to Fuzzing 挑战 1-4
安全测试pwn.college Fuzz Dojo Introduction to Fuzzing 部分实战记录(第一部分,挑战 1-4):在 OSS-Fuzz + libFuzzer 环境中定位 minizip 的 Fuzz Harness、清空函数体验证覆盖率归零、修复 harness 逻辑 Bug 与硬编码参数。
随机文章随机推荐









京公网安备11011402057358号