{"as_of":"2026-08-12T21:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e177bb647166467b0f8a313c572b57902f728feb784b2d5e1b13625447d44713","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:42:11.348291Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13037/citation-record","integrity":"/paper/2607.13037/integrity","json":"/paper/2607.13037/citation-record.json","paper":"/paper/2607.13037"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:10.595674Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.595674Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:e67aefa2ab94a1efa30ae1e5c7bcd4ed61a1064ebddd7cc213562f80ce446f77","observation_id":"a8b7547e-938f-4a50-96b2-af6681f2b508","resolution":{"observed_at":"2026-08-02T13:42:10.595674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:10.671035Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.671035Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:63449244d65c8568880872e834bb8bed786965676c6f63b3a1f742901a5957c6","observation_id":"aea07d0e-57d1-4af0-83bd-06aeb4c2d755","resolution":{"observed_at":"2026-08-02T13:42:10.671035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:10.801207Z","title":"purge–author –index follows the same three- hop path but returns only (line_hash, file) pairs without expanding section and author details","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.801207Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:8b54eb825d24e66253038a406034be8fa442755013f7e098e0975b0138510a80","observation_id":"7d0d5193-dfb2-416c-a3c8-5ee7e23fd848","resolution":{"observed_at":"2026-08-02T13:42:10.801207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-08-02T13:42:10.443324Z","title":"id\": \"<hash>","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.443324Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:4de2a2ae474669f8ec7c58240d8aa11a3d686fa8937756f5adc9f2abcbbaf4d5","observation_id":"6aac9c5d-2634-44d1-af85-a5cc2cbf2b1b","resolution":{"observed_at":"2026-08-02T13:42:10.443324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:10.910913Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.910913Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:77ebca04d43122bacced389b3d490643a6889afb4d3509baedf62737894b3650","observation_id":"225bfc11-1596-4b8b-a8c9-6fc828292ff9","resolution":{"observed_at":"2026-08-02T13:42:10.910913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:11.031035Z","title":"Unified binary index.The binary index (OBIDXF02) uses type-tagged references to serve both the document-index and token-index layers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:11.031035Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:7483b8414342ae8803b2a22cfcd3be07830482ad243a599801f845348f0d52a9","observation_id":"2bbe88cf-7a57-4cac-b8f5-2d92555a88d1","resolution":{"observed_at":"2026-08-02T13:42:11.031035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:11.106542Z","title":"Lines with r <0.10 are edited by replacing 10% of their alphabetic characters with random lowercase letters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:11.106542Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:184c49bfd944ecc91abaf6cab3bfc52ccdd9808fb442392e7537c3303a40c281","observation_id":"65eaca66-26b4-4887-a0da-ea2270e78e1d","resolution":{"observed_at":"2026-08-02T13:42:11.106542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:11.237502Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:11.237502Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:ddef048eeb1fd23f71ed0c2f0844703462ab42b9187886f18f1337928a472199","observation_id":"ab75d491-1312-4b90-a617-14b5236ecd70","resolution":{"observed_at":"2026-08-02T13:42:11.237502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:11.348291Z","title":"Insertions are placed at random positions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:11.348291Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:e50f83c37bc8e0a36b50c022fd6120ce545c89604fa2ee236f9978aa2d353f65","observation_id":"fb7ab743-78dd-41d2-a69c-458e971ec1ce","resolution":{"observed_at":"2026-08-02T13:42:11.348291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01078","last_updated":"2025-07-01T14:59:52Z","snapshot_observed_at":"2026-08-11T13:18:09.099712Z","submitted_at":"2025-07-01T14:59:52Z","title":"yProv4ML: Effortless Provenance Tracking for Machine Learning Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01078","snapshot_observed_at":"2026-08-02T13:42:10.331409Z","title":"Nathaniel Li, Alexander Pan, Anjali Gopal, Sum- mer Yue, Daniel Berrios, Alice Gatti, Justin D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.331409Z"},"links":{"cited_paper":"/paper/2507.01078","citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:9f47b0f148d1ee329703b8bc1d16b811cbc03da7705c88a5b4a75440e2d27a8a","observation_id":"e37d2062-63e1-4df8-bff4-75e840325ed0","resolution":{"observed_at":"2026-08-02T13:42:10.331409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23232","last_updated":"2024-11-11T20:02:41Z","snapshot_observed_at":"2026-07-06T19:42:25.742756Z","submitted_at":"2024-10-30T17:20:10Z","title":"Attribute-to-Delete: Machine Unlearning via Datamodel Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23232","snapshot_observed_at":"2026-08-02T13:42:10.163234Z","title":"Databricks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.163234Z"},"links":{"cited_paper":"/paper/2410.23232","citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:9c78ad7b0e7c6ec0601ddbfb486914108f1ebc1fa2e81e0dc62463936183d59d","observation_id":"2f69c239-662a-491b-8cbd-68dcdaf360b4","resolution":{"observed_at":"2026-08-02T13:42:10.163234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:42:10.013869Z","title":"InProceedings of The Web Conference 2026 (WWW ’26), New York, NY , USA","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:10.013869Z"},"links":{"citing_paper":"/paper/2607.13037"},"observation_digest":"sha256:567b895f906bae7510779f12c4e40ba6a80750a47dc49071486ed909d79123a9","observation_id":"ea5970f7-b87f-47fc-82e0-ee90391a37c8","resolution":{"observed_at":"2026-08-02T13:42:10.013869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13037","last_updated":"2026-05-19T10:18:33Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T14:35:14.663627Z","submitted_at":"2026-05-19T10:18:33Z","title":"OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.13037."}