SecureAgentBench: Benchmarking Secure Code Generation under Realistic Vulnerability Scenarios Paper • 2509.22097 • Published Sep 26, 2025 • 3
Gotcha! This Model Uses My Code! Evaluating Membership Leakage Risks in Code Models Paper • 2310.01166 • Published Oct 15, 2024
What Do Users Ask in Open-Source AI Repositories? An Empirical Study of GitHub Issues Paper • 2303.09795 • Published Mar 17, 2023
PenForge: On-the-Fly Expert Agent Construction for Automated Penetration Testing Paper • 2601.06910 • Published Jan 11
Beyond Function-Level Analysis: Context-Aware Reasoning for Inter-Procedural Vulnerability Detection Paper • 2602.06751 • Published Feb 6
ESG Reporting Lifecycle Management with Large Language Models and AI Agents Paper • 2603.10646 • Published Mar 11
Finding Memory Leaks in C/C++ Programs via Neuro-Symbolic Augmented Static Analysis Paper • 2603.27224 • Published May 31
AgentSZZ: Teaching the LLM Agent to Play Detective with Bug-Inducing Commits Paper • 2604.02665 • Published Apr 3
Can LLMs Deobfuscate Binary Code? A Systematic Analysis of Large Language Models into Pseudocode Deobfuscation Paper • 2604.08083 • Published Apr 9
Automated Repair of TEE Partitioning Issues via DSL-Guided and LLM-Assisted Patching Paper • 2605.22087 • Published May 21
Finding Missing Input Validation in TEEs via LLM-Assisted Symbolic Execution Paper • 2605.22058 • Published May 21
Think Like Human Developers: Harnessing Community Knowledge for Structured Code Reasoning Paper • 2503.14838 • Published Mar 19, 2025
Back to the Basics: Rethinking Issue-Commit Linking with LLM-Assisted Retrieval Paper • 2507.09199 • Published Oct 6, 2025
SLICEMATE: Accurate and Scalable Static Program Slicing via LLM-Powered Agents Paper • 2507.18957 • Published Jul 25, 2025