-
CAIBench: A Meta-Benchmark for Evaluating Cybersecurity AI Agents
CAIBench 논문 리뷰 — CTF·공방전·사이버레인지·지식·프라이버시를 통합한 사이버 보안 AI 에이전트 메타 벤치마크. 지식과 실전 능력의 간극을 정량화
-
CyberSecEval (1–3): Meta Purple Llama의 사이버 보안 위험·역량 평가
CyberSecEval 시리즈 리뷰 — Meta Purple Llama의 사이버 보안 벤치마크. insecure coding부터 prompt injection, 공격 역량, false refusal rate(FRR)까지 dual-use를 정면으로 다룬다
-
CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence
CTIBench 논문 리뷰 — 위협 인텔리전스(CVE→CWE 매핑, CVSS 예측, 행위자 귀속, ATT&CK 추출)에서 LLM의 지식과 추론을 평가하는 벤치마크
-
SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity
SecBench 논문 리뷰 — 4.4만+ 객관식과 3천+ 주관식으로 구성된, 중·영 이중언어 대규모 사이버 보안 지식·추론 평가 데이터셋
-
ALMA: 9,000개 주석만으로 LLM을 정렬하기
Red-Teaming 시리즈 #22 — 9K 라벨(전체의 1% 미만)로 합성 데이터를 만들어 정렬하는 데이터 효율 기법 (Yasunaga et al., Meta, 2024)