-
Claude Mythos와 사이버 보안 LLM: 자율 취약점 발견의 변곡점
Anthropic Claude Mythos가 보여준 자율 zero-day 발견·익스플로잇 능력과, 이를 측정하는 사이버 보안 LLM 벤치마크(Cybench, CyberSecEval, CVE-Bench 등) 정리
-
Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models
Cybench 논문 리뷰 — 프로 CTF 40과제와 subtask로 LLM 에이전트의 자율 사이버 공격 역량을 평가하는 사실상의 표준 벤치마크
-
CVE-Bench: A Benchmark for AI Agents' Ability to Exploit Real-World Web Application Vulnerabilities
CVE-Bench 논문 리뷰 — 실제 critical-severity CVE를 컨테이너 샌드박스에서 자율 익스플로잇하는 LLM 에이전트의 능력을 측정하는 벤치마크
-
AutoAdvExBench: Benchmarking Autonomous Exploitation of Adversarial Example Defenses
AutoAdvExBench 논문 리뷰 — LLM이 ML 보안 연구자처럼 적대적 예제 방어를 자율적으로 깨뜨릴 수 있는지 측정하는 벤치마크
-
CAIBench: A Meta-Benchmark for Evaluating Cybersecurity AI Agents
CAIBench 논문 리뷰 — CTF·공방전·사이버레인지·지식·프라이버시를 통합한 사이버 보안 AI 에이전트 메타 벤치마크. 지식과 실전 능력의 간극을 정량화