Training data attribution is plausibly scalable to frontier LLMs using compressed-gradient influence functions, but public access will likely remain limited because AI labs have strong incentives to keep training data private.
double-check
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CY 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Training Data Attribution (TDA): Examining Its Adoption & Use Cases
Training data attribution is plausibly scalable to frontier LLMs using compressed-gradient influence functions, but public access will likely remain limited because AI labs have strong incentives to keep training data private.