CyberGym 的论文结果与榜单高分能直接比较吗?从真实漏洞复现案例、修复前后差分验证和 CTF 基准的区别,重新审视这些数字。
主题:AI
与「AI」相关的文章。
“误报最常见的原因是模型对信任边界的理解不足——The most common cause of false positives is that the model lacks a good understanding of your trust boundaries” 这是近期我对 AI 审计漏洞实践的最深刻感悟。
记录 oh-my-vul 从两个安全研究 Skill 演进为证据优先漏洞研究工作台的过程,以及 Evidence、CLI、TUI、Codex 和 Claude Code 适配背后的设计考虑。
用 Claude Code Agent Teams 做代码安全审计:多智能体协作流程、适用边界与 Go 项目初体验。
Claude Code / 同类 CLI Agent 使用随笔:交互模式、常用工作流与安全审计场景下的实践记录。
MCP(Model Context Protocol)是由 Anthropic 于 2024 年 11 月推出的开源协议,旨在为大型语言模型(LLM)与外部工具、数据源之间建立统一、安全、标准化的通信接口。
