{"as_of":"2026-08-15T04:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0354f90eb92feb1f95d63da476774b48f603aac18618ee73dde976cbe9934703","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:20:28.737198Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13515/citation-record","integrity":"/paper/2608.13515/integrity","json":"/paper/2608.13515/citation-record.json","paper":"/paper/2608.13515"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.142995Z","title":"Towards tracing knowledge in language models back to the training data","venue":null,"work_id":"051a25d1-daac-4984-9a6d-e346e09b4a0b","year":2022},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.657844Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:a686f441190432a10008d5219b629f4d7229bfc5c2694dfef0960d4ea9e5c109","observation_id":"cb8a18f1-432a-409a-b1a4-6f3869eafcdd","resolution":{"observed_at":"2026-08-14T05:20:29.147563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16235","last_updated":"2024-09-24T16:51:36Z","snapshot_observed_at":"2026-08-12T22:38:28.195671Z","submitted_at":"2024-09-24T16:51:36Z","title":"EuroLLM: Multilingual Language Models for Europe","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16235","snapshot_observed_at":"2026-08-14T05:20:28.694299Z","title":"org/abs/2409.16235","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.694299Z"},"links":{"cited_paper":"/paper/2409.16235","citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:311487029e3466ad5183e8a4c87549f235eca1c18022a845bda89210e7acce3f","observation_id":"6d0b2c6f-a56e-4984-9758-300680aca8e1","resolution":{"observed_at":"2026-08-14T05:20:28.694299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.698559Z","title":"URLhttps://arxiv.org/abs/2502.11411","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.698559Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:84381beb7ca9c522f89c4b541661025baf583bd7b1079fe9af80edbad258cfaf","observation_id":"d218f962-31f0-4602-871d-c2376e182341","resolution":{"observed_at":"2026-08-14T05:20:28.698559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.091090Z","title":"Oskar van der Wal, Pietro Lesci, Max M¨uller-Eberstein, Naomi Saphra, Hailey Schoelkopf, Willem Zuidema, and Stella Biderman","venue":null,"work_id":"7ba8eb0f-fe4a-4047-adb1-e7d57ee55a2c","year":2020},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.703300Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:97f704466ec0eff7a2c1d971c12fbb1291c64d0d37ff25ccdc4e5bc417ab9e14","observation_id":"fa9d9395-6e8c-494e-b3e4-4986ced792a9","resolution":{"observed_at":"2026-08-14T05:20:29.095785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.707297Z","title":"doi: 10.1109/TPAMI.2021.3069908","venue":null,"work_id":null,"year":1939},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.707297Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:fa9d09818fb61f0e8359b36ceecc2502a3e18b99a0b3cf0e1eb28b18b50196be","observation_id":"8d856abe-b6e7-47be-8115-05c62a9ea4ef","resolution":{"observed_at":"2026-08-14T05:20:28.707297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.078074Z","title":"\" href=\"../../../demos/logger-strategy/","venue":null,"work_id":"14902fac-fd81-4ee9-9d5e-83c0bacffd6a","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.711666Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:06165d02524171a081af72eb36fa337b9ea154087e67af2e7fbdd252e532515a","observation_id":"c578e055-de09-4170-9685-ec8240171b38","resolution":{"observed_at":"2026-08-14T05:20:29.082250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.063773Z","title":null,"venue":null,"work_id":"e512a2bc-b075-4181-8418-c26e7e6b147a","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.716145Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:c26bfe7eb8e81a26b1f5230ce8045924a418f044a6ed79942dc163eede3742c1","observation_id":"258acba8-215b-4d4f-93d0-5d35a484308e","resolution":{"observed_at":"2026-08-14T05:20:29.068566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.049506Z","title":null,"venue":null,"work_id":"ee293b53-1ead-4235-9f46-e9dfd37e7133","year":2025},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.720172Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:716baa2962a14247e26f80e2b5b3b8fa0e34e46dfa69bacb26d73303ccdff159","observation_id":"ca37c418-b7f5-420c-b82d-ddd73a4782a4","resolution":{"observed_at":"2026-08-14T05:20:29.053692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.035677Z","title":"This suggests that the observed domain-level contribution dynamics may be somewhat more sensitive to data ordering than to weight initialization","venue":null,"work_id":"775b26f4-65b7-4f8d-922b-e077b20a3378","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.723934Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:344aa9dbbffd283a03a0a87f13aa1147e9e63c46806f36081d0985f73ca19ad3","observation_id":"fc5bf851-4661-47a5-8239-40495b457c12","resolution":{"observed_at":"2026-08-14T05:20:29.040395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.020585Z","title":"Because our analysis uses only within-interval rankings, we omit this common factor","venue":null,"work_id":"3609f736-45e5-4469-9495-345c50118d27","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.727543Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:783269afff06f8b85dd17128e85c8ec9d6f35042d0b0afab696624133233af19","observation_id":"c31447d2-8a5a-43f5-a03c-1826a049fccf","resolution":{"observed_at":"2026-08-14T05:20:29.025487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.006169Z","title":"Each model size includes three runs with different weight initializations and data orderings","venue":null,"work_id":"4545982a-b223-4e3c-aa8b-9bcfbaeedbb1","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.732402Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:818e5a5f96fed3bb0ddb76bd59b229a73fcea121164d62d35cd21a488a754fb1","observation_id":"3c01101b-9942-402e-a428-7f692fa76874","resolution":{"observed_at":"2026-08-14T05:20:29.011482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.991079Z","title":null,"venue":null,"work_id":"c6677069-fc3c-4146-a446-74194dca59dc","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.737198Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:54d8e4ebac8e82baac7e585ed66c4e4aedfc7ee20ce925f9d6e9fe4c36c2def1","observation_id":"b4bc89d8-ab11-4a53-98b1-07397bfbcf95","resolution":{"observed_at":"2026-08-14T05:20:28.996538Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.667170Z","title":"ISBN 9781605585161","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.667170Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:a44484163b3eb04df798cff1e65d89b8c661af72d6a06886907c71c52339e032","observation_id":"aaeafa3f-d093-4f83-9d69-6ba705f130f2","resolution":{"observed_at":"2026-08-14T05:20:28.667170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.104964Z","title":"Dai Liu, Jindong Gu, Hu Cao, Carsten Trinitis, and Martin Schulz","venue":null,"work_id":"caf61230-d43b-4a7a-9164-b2ecc845f6a9","year":2024},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.689431Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:46f9d22ec0a44cf17273f969281067de5cce511af97c4e4909db506df9b90832","observation_id":"dc305538-20ed-446f-a9d7-e1c4f9facbb6","resolution":{"observed_at":"2026-08-14T05:20:29.109241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-14T05:20:28.680296Z","title":"Amirata Ghorbani and James Zou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.680296Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:61bad9b1b65cf6c04bd5d5a38574bd2df7e910a4a3b2de7ed3e76472caa65fc6","observation_id":"e5a72114-3e1b-4d26-b72d-af051fad4dcc","resolution":{"observed_at":"2026-08-14T05:20:28.680296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.662687Z","title":"doi: 10.18653/v1/ 2022.findings-emnlp.180","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.662687Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:ba02e2d8b4d60b4db66bd77562892f412e803fbfc463c488efd5f88e7c2be8c8","observation_id":"f8c20293-97c8-4e21-b1c4-02832031fd02","resolution":{"observed_at":"2026-08-14T05:20:28.662687Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.129801Z","title":null,"venue":null,"work_id":"76103adf-1198-4787-a2d2-29cadc57ed61","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.671423Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:b2236ca61f164d96fd7ea1607be0f0f231fcf0f1f6524393811bb85656989071","observation_id":"78da8903-2e55-4ef1-9706-b55926bf4754","resolution":{"observed_at":"2026-08-14T05:20:29.134154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.684958Z","title":"doi: 10.1007/ s10994-023-06495-7","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.684958Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:4760bdd179401831cc0b1d110998710308518cc3a26b64f45881b23fd40eece6","observation_id":"57d97440-b48c-4802-a743-40fc3e5f0ed0","resolution":{"observed_at":"2026-08-14T05:20:28.684958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.117813Z","title":"ISBN 978-9908-53-109-0","venue":null,"work_id":"64e07d16-6760-42ca-be5f-34d39908cac5","year":2025},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.676035Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:3b6d4c81dd50f848977f9febbb3c1319484d5723699ff0a5b3d6ca4effc0defd","observation_id":"f0d73867-dcbd-47d0-94bd-c41741f543b0","resolution":{"observed_at":"2026-08-14T05:20:29.121569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T03:18:39.435794Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2608.13515."}