Construct repository-level vulnerability data at training scale
Construct repository-level software-vulnerability training data at scale while retaining build configuration, cross-function information flow, and labels that remain valid at repository granularity.
References
The open problem is repository-level data at training scale: mining that retains build configuration and cross-function flow, and a label that survives the transition.
— The Data Problem in Software Vulnerability Analysis: Artifacts, Quality, and Consumption
(2609.01503 - Nong et al., 1 Sep 2026) in Section 6, “Future Directions,” subsection “Preserve context: move mining up the granularity ladder”