{"as_of":"2026-08-20T00:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ddc2ffe773858a6f035fb9780ae2e97d048706b02551dc6821f9b332228f512a","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:54:36.744382Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.14777/citation-record","integrity":"/paper/2507.14777/integrity","json":"/paper/2507.14777/citation-record.json","paper":"/paper/2507.14777"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:29.868443Z","title":"On the dangers of stochastic parrots: Can language models be too big? In Proceedings of the 2021 ACM conference on fairness, accountability, and transparency, pages 610–623, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:29.868443Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:006b691c99a821e7abd7066557959df586a38f0ac447e192103c160219b72352","observation_id":"4e847438-46c7-4ec9-b561-c9d0a9f332fa","resolution":{"observed_at":"2026-08-06T15:54:29.868443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-18T22:17:47.865607Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-06T15:54:29.950605Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:29.950605Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:d4d5d8b8fc2fc12287ea7124c50121a75de941b984985aadd4a92e2264068a04","observation_id":"10243b96-78c1-46f2-b8c4-112f06a23218","resolution":{"observed_at":"2026-08-06T15:54:29.950605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15146","last_updated":"2024-11-11T19:47:16Z","snapshot_observed_at":"2026-08-19T07:48:23.074454Z","submitted_at":"2024-04-23T15:49:37Z","title":"Rethinking LLM Memorization through the Lens of Adversarial Compression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15146","snapshot_observed_at":"2026-08-06T15:54:30.048277Z","title":"Rethinking llm memorization through the lens of adversarial compression.arXiv preprint arXiv:2404.15146, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.048277Z"},"links":{"cited_paper":"/paper/2404.15146","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:0aeafae984762bfdf50bb4a9df0edbffc186617beee39e24f81733e0fb1c41f4","observation_id":"81a74fa8-00f0-4709-8da7-0f67c5704d13","resolution":{"observed_at":"2026-08-06T15:54:30.048277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.491353Z","title":"Emergent and predictable memorization in large language models","venue":null,"work_id":"823028eb-7a07-44d5-a3f5-35bc4a66abaa","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.162709Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:fa6edcfdbb98dae565070d33e6fce3cd5a046ab788e46e962d39d3e43f1bda92","observation_id":"5456ca5e-b454-429c-958a-5147a3c56c84","resolution":{"observed_at":"2026-08-06T15:54:38.496777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.474636Z","title":"Deduplicating training data mitigates privacy risks in language models","venue":null,"work_id":"8b947627-f64a-442b-9519-f8b1fd1197ea","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.240434Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:4b54303844f70e68696117678c22738a58d456c2d8a3a3f3a9d5d53a32d7dd22","observation_id":"fe800e97-3f51-4140-b8bb-4f18b53d222c","resolution":{"observed_at":"2026-08-06T15:54:38.479388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:30.318127Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.318127Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:aa91601fc916958b11f3b6abb1db74c8ee0c579f4c96f99257bfa94501627a8a","observation_id":"647b9d7d-7770-4f58-9aef-0d71318d8997","resolution":{"observed_at":"2026-08-06T15:54:30.318127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.447192Z","title":"The secret sharer: Evaluating and testing unintended memorization in neural networks","venue":null,"work_id":"9ba470ae-96fd-4c87-94bf-b65256c54c6a","year":2019},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.432387Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:25d19d07778e639691ba700e4ef9139182de9129aedbb7e710374c4ac5463729","observation_id":"c42f2838-495d-4ac6-b947-c5cdc13c5de7","resolution":{"observed_at":"2026-08-06T15:54:38.453047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.431172Z","title":"Memorization without overfitting: Analyzing the training dynamics of large language models","venue":null,"work_id":"9aa57630-bf2f-4465-bd6c-29ce48f79a6e","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.549998Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:681fcbb699f9d8607d8c8bb7302563e3ba3375f2a6d4d2108a200203fc8f4cfd","observation_id":"3e800049-4c5e-4569-9ed7-9452abd987da","resolution":{"observed_at":"2026-08-06T15:54:38.436190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.414659Z","title":"An empirical analysis of memorization in fine-tuned autoregressive language models","venue":null,"work_id":"582f4d68-7d85-44ef-bc5c-a9515508eff7","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.629170Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:54c373d1385c72df746cb5657ca3faf9855ee8177c60de076ae81296d86480d1","observation_id":"f2b82d42-a3f3-4285-b1e5-b3b8f2625d49","resolution":{"observed_at":"2026-08-06T15:54:38.419749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17546","last_updated":"2023-09-11T16:58:48Z","snapshot_observed_at":"2026-08-18T20:40:56.886855Z","submitted_at":"2022-10-31T17:57:55Z","title":"Preventing Verbatim Memorization in Language Models Gives a False Sense of Privacy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17546","snapshot_observed_at":"2026-08-06T15:54:30.675295Z","title":"Preventing verbatim memorization in language models gives a false sense of privacy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.675295Z"},"links":{"cited_paper":"/paper/2210.17546","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:a5e3b13c249bc42b6487cc39d03ccec5ab2f02d06d40391ca35ea73ada9a4b13","observation_id":"53d68b14-1b20-4665-878c-e98da5c22880","resolution":{"observed_at":"2026-08-06T15:54:30.675295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.394993Z","title":"Near-duplicate sequence search at scale for large language model memorization evaluation","venue":null,"work_id":"acc24366-1b21-4cf3-8385-6ca923839969","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.681438Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e8e30eac45e856c337e6b86da5524af5490a14762f15777a367e2e6c835e7fb8","observation_id":"a196b3dd-61dd-48e2-b376-0b93f1741b64","resolution":{"observed_at":"2026-08-06T15:54:38.401276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.379190Z","title":"Uncovering latent memories: Assessing data leakage and memorization patterns in large language models","venue":null,"work_id":"9d41addf-c19e-463a-8b2b-1fa80450f12c","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.746169Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:d5364b7698eafe94e09e8967fe5a04052569ace4120e38c820a5d3f318aa96a2","observation_id":"b22ae51b-c1b1-4919-8f4a-a540e501330e","resolution":{"observed_at":"2026-08-06T15:54:38.384012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.363108Z","title":"Quantifying and analyzing entity-level memorization in large language models","venue":null,"work_id":"2327e5c1-e94d-449f-97f8-7d6f01c28346","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.833461Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:1e11c692229059cc596e88b2f3294f86f71b982102a0eec5f4766e767b24aa6a","observation_id":"39e45161-ffa6-47f0-bd98-2bc6062bf507","resolution":{"observed_at":"2026-08-06T15:54:38.368188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.12938","last_updated":"2023-10-13T22:16:41Z","snapshot_observed_at":"2026-08-19T05:26:21.836382Z","submitted_at":"2021-12-24T04:20:57Z","title":"Counterfactual Memorization in Neural Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.12938","snapshot_observed_at":"2026-08-06T15:54:30.920640Z","title":"Counterfactual memorization in neural language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.920640Z"},"links":{"cited_paper":"/paper/2112.12938","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:86caf6f9ce5e777cc0e54b3afdd5ba0d237e6808ed0322b66cd31deda88310fc","observation_id":"d1e79c42-62da-413e-b5b3-759e0e1d3272","resolution":{"observed_at":"2026-08-06T15:54:30.920640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.343735Z","title":"On memorization in probabilistic deep generative models","venue":null,"work_id":"5d85c6ec-6662-4715-a181-9f8978e8542a","year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.989824Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:ef9b04fb17db540dbf07d079e938fe19f4d91d14ac8b416e4e3c2d29449e7d68","observation_id":"6174912d-47d5-4e35-a835-28e563d3894a","resolution":{"observed_at":"2026-08-06T15:54:38.350123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06499","last_updated":"2022-03-24T19:29:45Z","snapshot_observed_at":"2026-08-14T07:55:03.346803Z","submitted_at":"2021-07-14T06:06:52Z","title":"Deduplicating Training Data Makes Language Models Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06499","snapshot_observed_at":"2026-08-06T15:54:31.117800Z","title":"Deduplicating training data makes language models better","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.117800Z"},"links":{"cited_paper":"/paper/2107.06499","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:1569055943d69794859f3abc26a9f1ac91e370d72995cac4395207c446c5e9b9","observation_id":"11513c1e-3f72-419a-840e-84e621194ec0","resolution":{"observed_at":"2026-08-06T15:54:31.117800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:31.212886Z","title":"‘improving ratings’: audit in the british university system","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.212886Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:fa85260d1f0e87d77375054392121febc1abe00d696d5a4430df0aa336d4ec24","observation_id":"d3555407-feca-46e4-b7b7-73d3f2eaf761","resolution":{"observed_at":"2026-08-06T15:54:31.212886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-15T14:36:26.439846Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-06T15:54:31.324658Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.324658Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:1ce35d94deec8ed40c6f0ccd4aea9f14ea917abe52210478fbc66a794a42a4b0","observation_id":"4408f1bf-837b-4ea9-9b9f-696b4f9a79fd","resolution":{"observed_at":"2026-08-06T15:54:31.324658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04289","last_updated":"2025-01-12T15:43:54Z","snapshot_observed_at":"2026-08-16T13:45:25.885980Z","submitted_at":"2024-06-06T17:34:24Z","title":"What Languages are Easy to Language-Model? A Perspective from Learning Probabilistic Regular Languages","version":5},"cited_work":{"arxiv_id":"2406.04289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04289","snapshot_observed_at":"2026-08-06T15:54:37.958204Z","title":"What Languages are Easy to Language-Model? A Perspective from Learning Probabilistic Regular Languages","venue":"cs.CL","work_id":"1b092d9c-4abe-425e-8e3f-648f52c0e98e","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.457040Z"},"links":{"cited_paper":"/paper/2406.04289","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:9ecc6a2829f1777bf576de223aa2da4f6a0d574e35f881cde66735bddbd0c958","observation_id":"4263cebb-4060-4b65-896b-2de9b439bc5a","resolution":{"observed_at":"2026-08-06T15:54:37.963182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12973","last_updated":"2024-01-30T18:59:34Z","snapshot_observed_at":"2026-08-18T18:41:48.541535Z","submitted_at":"2024-01-23T18:59:21Z","title":"In-Context Language Learning: Architectures and Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12973","snapshot_observed_at":"2026-08-06T15:54:31.579512Z","title":"In-context language learning: Arhitectures and algorithms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.579512Z"},"links":{"cited_paper":"/paper/2401.12973","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:9edb7e770d74d7118c20023481c1a6f01965f02ff815efb8a6931151066ccb6d","observation_id":"a94ead0e-82a4-49da-9c2c-6319821ec3fb","resolution":{"observed_at":"2026-08-06T15:54:31.579512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14840","last_updated":"2023-10-23T12:03:01Z","snapshot_observed_at":"2026-08-16T14:49:46.940061Z","submitted_at":"2023-10-23T12:03:01Z","title":"Transparency at the Source: Evaluating and Interpreting Language Models With Access to the True Distribution","version":1},"cited_work":{"arxiv_id":"2310.14840","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.14840","snapshot_observed_at":"2026-08-06T15:54:37.919994Z","title":"Transparency at the Source: Evaluating and Interpreting Language Models With Access to the True Distribution","venue":"cs.CL","work_id":"af4bef28-9782-4815-8a5e-0407737da851","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.696400Z"},"links":{"cited_paper":"/paper/2310.14840","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:3d4519e597a7e55ac6b9bffe605ada65a3d4ebca1b98eddfbb7f5b6a238bd550","observation_id":"17974dc2-0ddd-4234-8d37-f89ed29fc3e0","resolution":{"observed_at":"2026-08-06T15:54:37.925415Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13060","last_updated":"2023-10-29T17:14:06Z","snapshot_observed_at":"2026-08-16T15:37:45.611434Z","submitted_at":"2023-04-25T18:00:08Z","title":"Injecting structural hints: Using language models to study inductive biases in language learning","version":2},"cited_work":{"arxiv_id":"2304.13060","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.13060","snapshot_observed_at":"2026-08-06T15:54:37.899246Z","title":"Injecting structural hints: Using language models to study inductive biases in language learning","venue":"cs.CL","work_id":"4e83e133-6277-4e8a-83ab-cb4c5822c997","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.855458Z"},"links":{"cited_paper":"/paper/2304.13060","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e7adaee090d2526617eba00a8cd3f7c43790300d763c713e4e49f0dc20f18a6d","observation_id":"07d6192d-096c-4969-b7e7-f8594e0c1f01","resolution":{"observed_at":"2026-08-06T15:54:37.904123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01044","last_updated":"2021-06-02T09:34:32Z","snapshot_observed_at":"2026-08-18T08:41:21.308265Z","submitted_at":"2021-06-02T09:34:32Z","title":"Examining the Inductive Bias of Neural Language Models with Artificial Languages","version":1},"cited_work":{"arxiv_id":"2106.01044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.01044","snapshot_observed_at":"2026-08-06T15:54:37.876666Z","title":"Examining the Inductive Bias of Neural Language Models with Artificial Languages","venue":"cs.CL","work_id":"d171f949-44ae-4b9f-927d-27e6e8b6ee0e","year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.025451Z"},"links":{"cited_paper":"/paper/2106.01044","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c2ac4f5020ff8a2ed19adbe50d28abbc95cc47eda98467a490ff2de4d0f1b649","observation_id":"f0087c7c-2edd-41c6-a011-ae34753e25e8","resolution":{"observed_at":"2026-08-06T15:54:37.881979Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.327986Z","title":"Towards more natural artificial languages","venue":null,"work_id":"75f35aa6-d253-4c44-8c38-b41b875cf87b","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.170446Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:a1983c6132795c183914eef0a2eceeeccb90065151aa9e50f3be7b572f261770","observation_id":"86210bac-8088-4515-a4b9-4768ee3d6db2","resolution":{"observed_at":"2026-08-06T15:54:38.332904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13673","last_updated":"2025-05-19T11:12:27Z","snapshot_observed_at":"2026-08-18T16:00:47.608550Z","submitted_at":"2023-05-23T04:28:16Z","title":"Physics of Language Models: Part 1, Learning Hierarchical Language Structures","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13673","snapshot_observed_at":"2026-08-06T15:54:32.373894Z","title":"Physics of language models: Part 1, learning hierarchical language structures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.373894Z"},"links":{"cited_paper":"/paper/2305.13673","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:29e1941f0e9026ea7135684166b6c6b0151a1fd19f566db85c1a6cec0ba09040","observation_id":"d368c22f-7575-4753-99eb-25ca9ba6cef6","resolution":{"observed_at":"2026-08-06T15:54:32.373894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03796","last_updated":"2023-05-05T18:54:40Z","snapshot_observed_at":"2026-08-18T00:51:06.212103Z","submitted_at":"2023-05-05T18:54:40Z","title":"Transformer Working Memory Enables Regular Language Reasoning and Natural Language Length Extrapolation","version":1},"cited_work":{"arxiv_id":"2305.03796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.03796","snapshot_observed_at":"2026-08-06T15:54:37.833815Z","title":"Transformer Working Memory Enables Regular Language Reasoning and Natural Language Length Extrapolation","venue":"cs.CL","work_id":"7b830679-68fd-4050-967d-45831e90c642","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.521304Z"},"links":{"cited_paper":"/paper/2305.03796","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:4d60a56fe71ba08b82723d1cb426c96a3887cdd82c2a7c1ce4c706dcd50bf7c1","observation_id":"99d76e3b-b84c-4262-b639-909255249b6a","resolution":{"observed_at":"2026-08-06T15:54:37.839608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01288","last_updated":"2022-11-03T22:44:21Z","snapshot_observed_at":"2026-08-16T16:19:05.583334Z","submitted_at":"2022-11-02T17:10:07Z","title":"Characterizing Intrinsic Compositionality in Transformers with Tree Projections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01288","snapshot_observed_at":"2026-08-06T15:54:32.722899Z","title":"Char- acterizing intrinsic compositionality in transformers with tree projections","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.722899Z"},"links":{"cited_paper":"/paper/2211.01288","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:1d4338b3f4a21a511bf11f1557c6816fefda86dc680b8c20fda5fe2a7498cf2f","observation_id":"79339cde-805c-424f-b061-74c468863a24","resolution":{"observed_at":"2026-08-06T15:54:32.722899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10749","last_updated":"2023-05-02T14:16:15Z","snapshot_observed_at":"2026-08-19T19:51:31.689851Z","submitted_at":"2022-10-19T17:45:48Z","title":"Transformers Learn Shortcuts to Automata","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10749","snapshot_observed_at":"2026-08-06T15:54:32.921274Z","title":"Transformers learn shortcuts to automata","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.921274Z"},"links":{"cited_paper":"/paper/2210.10749","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:5c92fe015ed82246c0b7de71ec210483baf2afcbff508617a3f35e3f38eccac7","observation_id":"3f495db6-6e73-4c31-8b3b-5c85d0f97a6c","resolution":{"observed_at":"2026-08-06T15:54:32.921274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.311580Z","title":"Learning bounded context- free-grammar via lstm and the transformer: difference and the explanations","venue":null,"work_id":"136de89b-2edc-48a0-9f10-a6bd53b3d7c3","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.105814Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:f3dce8e5d21587d8fe46a844afec0f90c1fa388ba13e1afa32c675c98eed3a93","observation_id":"9f00af93-6c21-416c-a0da-afb227a6f1cc","resolution":{"observed_at":"2026-08-06T15:54:38.316903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11264","last_updated":"2020-10-08T12:55:37Z","snapshot_observed_at":"2026-08-08T13:16:05.781323Z","submitted_at":"2020-09-23T17:21:33Z","title":"On the Ability and Limitations of Transformers to Recognize Formal Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11264","snapshot_observed_at":"2026-08-06T15:54:33.333452Z","title":"On the ability and limitations of trans- formers to recognize formal languages","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.333452Z"},"links":{"cited_paper":"/paper/2009.11264","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:d37f61cb20fe5356d8396c55142c1967e3b09b2ca112a41d638600fc2125a8cf","observation_id":"0ab13602-b305-4969-a10b-b80fbd4cc797","resolution":{"observed_at":"2026-08-06T15:54:33.333452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.295511Z","title":"Formal languages and the nlp black box","venue":null,"work_id":"48946270-1fef-4abb-b137-d20258589550","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.541358Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:3e17110eb134caef4b19620af6f86f65a00d81ef36a555bd815417a29a7575f9","observation_id":"c43bed4f-b29c-4fae-acb5-5f3a0a9b8193","resolution":{"observed_at":"2026-08-06T15:54:38.300374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00208","last_updated":"2024-09-04T11:48:04Z","snapshot_observed_at":"2026-08-19T04:14:52.740946Z","submitted_at":"2023-11-01T00:38:26Z","title":"What Formal Languages Can Transformers Express? A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00208","snapshot_observed_at":"2026-08-06T15:54:33.692930Z","title":"Transformers as recognizers of formal languages: A survey on expressivity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.692930Z"},"links":{"cited_paper":"/paper/2311.00208","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:703a9b567cb631c4e4251dbaa64610abaf4329eb13e3bdaece3e3569913bec6b","observation_id":"870460b6-eafa-40f6-bb2e-45df5a873f85","resolution":{"observed_at":"2026-08-06T15:54:33.692930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.277331Z","title":"Theoretical limitations of self-attention in neural sequence models","venue":null,"work_id":"738352e8-49ab-4e59-a577-318bb35026de","year":2020},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.803922Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:f4986f3af60442eb9d91823db8534aba0ddd8c0ba0083291dd38d1f4edd3cd3e","observation_id":"e8a4df78-5dcd-45a6-b35d-7990b3e7e3f0","resolution":{"observed_at":"2026-08-06T15:54:38.282902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-16T16:48:12.209708Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T15:54:33.911739Z","title":"Neural networks and the chomsky hierarchy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.911739Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:2e4a557469fa8b47826ff178ba588b47ed8735e855e3ca0e875f00f5b1472f50","observation_id":"329e5830-fad8-4f8b-95a5-1353a9b0c8d9","resolution":{"observed_at":"2026-08-06T15:54:33.911739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09963","last_updated":"2024-05-27T17:01:29Z","snapshot_observed_at":"2026-08-16T14:18:18.310631Z","submitted_at":"2024-02-15T14:17:51Z","title":"Why are Sensitive Functions Hard for Transformers?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09963","snapshot_observed_at":"2026-08-06T15:54:33.958427Z","title":"Why are sensitive functions hard for transformers? arXiv preprint arXiv:2402.09963, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.958427Z"},"links":{"cited_paper":"/paper/2402.09963","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:553da17492ed2e05c3b1ca88401615914f51dd0a25bbd011427d7b6f48540cc3","observation_id":"9213f9c7-cd0f-4d46-b13c-3943507de087","resolution":{"observed_at":"2026-08-06T15:54:33.958427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03743","last_updated":"2020-02-25T18:30:29Z","snapshot_observed_at":"2026-08-14T19:05:29.638715Z","submitted_at":"2018-06-10T23:24:33Z","title":"Are All Languages Equally Hard to Language-Model?","version":2},"cited_work":{"arxiv_id":"1806.03743","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.03743","snapshot_observed_at":"2026-08-06T15:54:37.673219Z","title":"Are All Languages Equally Hard to Language-Model?","venue":"cs.CL","work_id":"29538ff9-126a-4228-aad7-e98532a7302a","year":2018},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.015203Z"},"links":{"cited_paper":"/paper/1806.03743","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:9270041959716fcf8c744032d1c0b496b57d5bf5f9c9401ec0e5856ddf1aa59a","observation_id":"bc5a3e7d-ed8b-4ef9-86ec-917c159be891","resolution":{"observed_at":"2026-08-06T15:54:37.693810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04726","last_updated":"2020-02-25T18:38:57Z","snapshot_observed_at":"2026-08-18T05:14:05.717965Z","submitted_at":"2019-06-11T17:56:08Z","title":"What Kind of Language Is Hard to Language-Model?","version":2},"cited_work":{"arxiv_id":"1906.04726","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04726","snapshot_observed_at":"2026-08-06T15:54:37.578425Z","title":"What Kind of Language Is Hard to Language-Model?","venue":"cs.CL","work_id":"414bcdbf-ea06-408d-8950-383688e9ecd5","year":2019},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.058378Z"},"links":{"cited_paper":"/paper/1906.04726","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:d1c12255f35dcb4b35d4993bba1687682834ccf5e194016293832b211fef67a9","observation_id":"7fdd7e02-d358-4864-836e-3a2b841d7c58","resolution":{"observed_at":"2026-08-06T15:54:37.649165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:34.171170Z","title":"Elements of information theory","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.171170Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:13d754cb4981507883de0d227c9c619beb9ab09c2e2a41d5bb5d827f175fc678","observation_id":"41ffa587-0f56-4161-a127-a8b0f4d75f6f","resolution":{"observed_at":"2026-08-06T15:54:34.171170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.250160Z","title":"Carrasco","venue":null,"work_id":"597e7a62-2209-4f9a-a71d-13ede20ec823","year":1997},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.223047Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:8e4e96f2a12b06460b5a0d35c2c32357547c1ebcd1d958143442764decf53b0a","observation_id":"5dfaad75-b384-4dc6-be3d-d8418ffc8870","resolution":{"observed_at":"2026-08-06T15:54:38.254760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T15:54:34.297362Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.297362Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:84e376e60b7e5afd017c1ac526d83c47fe10abd92623f96c51bcc0f8d023a295","observation_id":"cbd6df96-5182-4123-aabb-901eb2c3b721","resolution":{"observed_at":"2026-08-06T15:54:34.297362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T15:54:34.345999Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.345999Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:a51bcc4f13973a8582af8ce38e443a444927518f595b2273a98916331b86cfb7","observation_id":"f8cce4bb-71c2-4cb8-b840-785d03471654","resolution":{"observed_at":"2026-08-06T15:54:34.345999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T15:54:34.446211Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.446211Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:601dd4590a5ddacac58da946ca0dbc3d9a538ef5f05470261214c334096f1105","observation_id":"346f76fc-3499-4750-b9e2-9ab0bc7acdcf","resolution":{"observed_at":"2026-08-06T15:54:34.446211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T15:54:34.504173Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.504173Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:fab2511130b6c706ebd6f81e131fc31e5aca3e28d0b1025f22ef0011eaa3f419","observation_id":"daa972fd-78db-41f7-8bcc-dadc69d22098","resolution":{"observed_at":"2026-08-06T15:54:34.504173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:34.601309Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.601309Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:08c334c8e8035272cf092fc43a0c6d085af62c40fd441bd4a9197c874df6dfb0","observation_id":"c4262e12-d378-4476-8e61-94abfe5631ae","resolution":{"observed_at":"2026-08-06T15:54:34.601309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T15:54:34.665366Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.665366Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:b239d61af8e1512d03103adf08fab7ddede9bee6cbe526cea9e5f4eaf88b94cf","observation_id":"9c0ba11a-aa4a-4c67-bc06-8e68c860c08a","resolution":{"observed_at":"2026-08-06T15:54:34.665366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.223161Z","title":"Cross-entropy loss functions: Theoretical analysis and applications","venue":null,"work_id":"3cbeae59-9af7-41de-898d-498a55f6314a","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.750218Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e7bc795c30b6d9bc65ba5e7e459c722ce9b6d3ee2a76091c181c5b2d1b94c107","observation_id":"0a28b1d8-9c80-492b-bb59-515a99b38e6a","resolution":{"observed_at":"2026-08-06T15:54:38.227935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12628","last_updated":"2022-10-20T05:30:43Z","snapshot_observed_at":"2026-08-17T14:09:03.289442Z","submitted_at":"2022-05-25T10:08:45Z","title":"Are Large Pre-Trained Language Models Leaking Your Personal Information?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12628","snapshot_observed_at":"2026-08-06T15:54:34.827067Z","title":"Are large pre-trained language models leaking your personal information? arXiv preprint arXiv:2205.12628, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.827067Z"},"links":{"cited_paper":"/paper/2205.12628","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:912ab4257bb06f8ca8ffba55a0bc6791021a2104734ac6c82cbd4595d636dd1f","observation_id":"62724fd1-90b0-468a-a306-45fb21bddb27","resolution":{"observed_at":"2026-08-06T15:54:34.827067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.206741Z","title":"Propile: Probing privacy leakage in large language models","venue":null,"work_id":"267d33c8-81fe-42c1-a8f0-f3d8ef95f326","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.930061Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:94ee399b832151a929d0fa38a3d27fa7323d4507fdd1e0624eaac060970bcb69","observation_id":"30b7b062-b258-45a1-b23a-d1b272136903","resolution":{"observed_at":"2026-08-06T15:54:38.211572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00099","last_updated":"2023-05-09T14:08:17Z","snapshot_observed_at":"2026-08-16T16:49:06.318226Z","submitted_at":"2022-06-30T20:48:26Z","title":"Measuring Forgetting of Memorized Training Examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00099","snapshot_observed_at":"2026-08-06T15:54:34.984512Z","title":"Measuring forgetting of memorized training examples","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.984512Z"},"links":{"cited_paper":"/paper/2207.00099","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:b1ab3981f87e98d016c9c1e59ddaa310f31d29b8d1fa61968dc9473554442b98","observation_id":"f0f6c9ba-01fa-4a9c-a6bc-d728ebb78d84","resolution":{"observed_at":"2026-08-06T15:54:34.984512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-06T15:54:35.095617Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.095617Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:ac4cf72147ca8a17361f0d4c33209d4ec36ee637c4069d6170f71daa364e0cf4","observation_id":"b416c6cb-322e-404b-9aae-9898d5f34fcc","resolution":{"observed_at":"2026-08-06T15:54:35.095617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-08-17T12:46:02.488423Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-06T15:54:35.178701Z","title":"Olmo: Accelerating the science of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.178701Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:6d507c44d1fd3e7aa1e498bd06088a6805390945af00d7479838b0a706cae076","observation_id":"861368a3-81a4-4d2c-a9a5-d0f57aaeaa1f","resolution":{"observed_at":"2026-08-06T15:54:35.178701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:35.258472Z","title":"Revisiting privacy, utility, and efficiency trade-offs when fine-tuning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.258472Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:4c9bc4acce14693cc2234da8361ee644802d1cffdb58c551f1f5d7fe9cb8d8cc","observation_id":"d91affa0-d007-4b44-8e4a-4394694fd270","resolution":{"observed_at":"2026-08-06T15:54:35.258472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.190365Z","title":"Foundation models and fair use","venue":null,"work_id":"b61f4602-b19f-4546-86b5-1eb9a736863e","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.374698Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:989a875f0adb3e986f871e782115fa310ce08b3901caee1ae7656b8ad7aff2ce","observation_id":"4117af86-efc2-4d5f-a641-246f6e8e037f","resolution":{"observed_at":"2026-08-06T15:54:38.196150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.172502Z","title":"Llms and memorization: On quality and specificity of copyright compliance","venue":null,"work_id":"e771aec8-c2eb-4aa7-b78b-e2611dc6e75c","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.453875Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:46748bbf2491c6f3879d1372df526962dac7e9304772e262e706c6beac52aac3","observation_id":"2116a35d-121e-439c-8bc7-75b00babaaef","resolution":{"observed_at":"2026-08-06T15:54:38.178090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06370","last_updated":"2024-12-09T10:44:47Z","snapshot_observed_at":"2026-08-15T19:22:16.130483Z","submitted_at":"2024-12-09T10:44:47Z","title":"Exploring Memorization and Copyright Violation in Frontier LLMs: A Study of the New York Times v. OpenAI 2023 Lawsuit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06370","snapshot_observed_at":"2026-08-06T15:54:35.545591Z","title":"Exploring memorization and copyright violation in frontier llms: A study of the new york times v","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.545591Z"},"links":{"cited_paper":"/paper/2412.06370","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:bd82cb753fc810c722162f43e618085d72f67c5b915bd51a0302d2abdcba7294","observation_id":"a9f22345-5b8b-491a-8d38-152e2a9084e0","resolution":{"observed_at":"2026-08-06T15:54:35.545591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:35.602191Z","title":"Undesirable memorization in large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.602191Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e5e15c8d0f399aac022410ae6e36116ae41f3b87a0c2cec670ae9dfa2e2fc79e","observation_id":"33b4e3da-f702-44a1-9179-8442b4769fa6","resolution":{"observed_at":"2026-08-06T15:54:35.602191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11715","last_updated":"2024-10-25T10:40:25Z","snapshot_observed_at":"2026-08-18T05:22:21.257873Z","submitted_at":"2024-06-17T16:33:35Z","title":"Measuring memorization in RLHF for code completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11715","snapshot_observed_at":"2026-08-06T15:54:35.707199Z","title":"Measuring memorization in rlhf for code completion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.707199Z"},"links":{"cited_paper":"/paper/2406.11715","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:f8acdc25fd9edb791b193dfdd81ca433bb5601fff2be342cce8ef3bc2984bbe8","observation_id":"b2f237b6-4786-4fcf-88f1-7f812050fe23","resolution":{"observed_at":"2026-08-06T15:54:35.707199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.155941Z","title":"What neural networks memorize and why: Discovering the long tail via influence estimation","venue":null,"work_id":"82fd0177-8127-4fb3-aaca-33a7fd35ecbe","year":2020},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.776038Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e1648f1963bbf3ad22be28c5b8f531922689ab48cf3c932e86ef9e782fa71da2","observation_id":"e9363736-34a8-4604-a218-127feab40bb3","resolution":{"observed_at":"2026-08-06T15:54:38.161158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03588","last_updated":"2023-02-13T12:26:13Z","snapshot_observed_at":"2026-08-16T16:26:06.207749Z","submitted_at":"2022-10-07T14:45:31Z","title":"Understanding Transformer Memorization Recall Through Idioms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03588","snapshot_observed_at":"2026-08-06T15:54:35.853655Z","title":"Under- standing transformer memorization recall through idioms","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.853655Z"},"links":{"cited_paper":"/paper/2210.03588","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:72f1cb719fa8dc41d7625d2490aa0a70e74e1aa7a6ccbc7f34e26a3d06f19b2b","observation_id":"6885741a-8c18-4186-bead-c65f7f6f44a1","resolution":{"observed_at":"2026-08-06T15:54:35.853655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-16T13:32:26.549245Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-06T15:54:35.942487Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.942487Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:5de46a0cbf5937a2a273e2143d44e60dd341173358404b2d2b817abe6d14612a","observation_id":"32107197-b353-4d20-97d1-32a1e1ba110a","resolution":{"observed_at":"2026-08-06T15:54:35.942487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18497","last_updated":"2025-07-09T15:14:46Z","snapshot_observed_at":"2026-08-18T12:16:38.711300Z","submitted_at":"2024-12-24T15:28:56Z","title":"Neuron-Level Differentiation of Memorization and Generalization in Large Language Models","version":2},"cited_work":{"arxiv_id":"2412.18497","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18497","snapshot_observed_at":"2026-08-06T15:54:37.025421Z","title":"Neuron-Level Differentiation of Memorization and Generalization in Large Language Models","venue":"cs.CL","work_id":"aaa48314-682b-4000-91cb-dd63fcdf63ea","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.978341Z"},"links":{"cited_paper":"/paper/2412.18497","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:2efb36c96b388e70c34cbdaa85ffac1c975e2abb1b0f6a5981f6cc6296ff6722","observation_id":"1fc6a6d9-70d9-4f89-b81f-79d9629410bb","resolution":{"observed_at":"2026-08-06T15:54:37.096373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:36.050260Z","title":"Mem- orize or generalize? evaluating llm code generation with evolved questions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.050260Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c865452cfc821e53637bbca0db70cfd4c70c4f91174643a950bff292084fe4eb","observation_id":"084e2ae6-1562-473d-a9f9-7fd738f0bfc4","resolution":{"observed_at":"2026-08-06T15:54:36.050260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.137804Z","title":"Rethinking memorization in llms: On learning by rote vs","venue":null,"work_id":"ac2d802c-d94d-467e-ae46-5baf6649b30f","year":null},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.175005Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:35e33ba3df480725e4119cf73358ab373eda2df2077d923a7b83af6cd87e84f1","observation_id":"dbabadd5-3e65-4cd6-9838-41c6169aa49d","resolution":{"observed_at":"2026-08-06T15:54:38.142821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15938","last_updated":"2024-05-31T17:49:03Z","snapshot_observed_at":"2026-08-19T05:48:20.574766Z","submitted_at":"2024-02-24T23:54:41Z","title":"Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15938","snapshot_observed_at":"2026-08-06T15:54:36.269021Z","title":"Generalization or memorization: Data contamination and trustworthy evaluation for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.269021Z"},"links":{"cited_paper":"/paper/2402.15938","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:a3a8093bfd98d2e73f92c7d4dac088f074c550f8b7e5962052d4066e24b8d3de","observation_id":"9b23b898-db20-48ec-b167-74c318f44a07","resolution":{"observed_at":"2026-08-06T15:54:36.269021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.120677Z","title":"How much do language models copy from their training data? evaluating linguistic novelty in text generation using raven","venue":null,"work_id":"2430d72c-11d9-4b9d-b849-abc195f1d414","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.427188Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e2866f94e2db1d1788327a984e18b138e744e08a63fa0dd89b37de9decf89f33","observation_id":"ca744455-129d-400e-a611-bc8905256784","resolution":{"observed_at":"2026-08-06T15:54:38.126751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.106108Z","title":"Probabilistic context-free grammars (pcfgs)","venue":null,"work_id":"19eb7bf9-6c12-4caf-84df-3bee78f84a52","year":2013},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.513639Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:61f90ab7b9c5c8d07f869f5423bc1faea3b46489ea16befcdb750ec0ee7701e5","observation_id":"7f1046a2-ca4f-4b21-bf5c-0da81377d50a","resolution":{"observed_at":"2026-08-06T15:54:38.110569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.090194Z","title":"Three models for the description of language.IRE Transactions on information theory, 2(3):113–124, 1956","venue":null,"work_id":"76776c0d-a32c-4517-a500-b16e3c931c68","year":1956},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.647912Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:aa626193c3b5be27c65cbbe95843208aa043d32793c3d6f2de92e9c49d5fb53e","observation_id":"3a810597-8292-4537-8cb0-b2c58caeb65a","resolution":{"observed_at":"2026-08-06T15:54:38.094870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.075266Z","title":"start\" or","venue":null,"work_id":"c5ac99dd-c4c4-48db-b677-d8ed08b02a50","year":2014},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.744382Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:6f6755be57c39cd42682aa3ff0e46b3fdbbc7ae10716ea30e81fd4633555ef9c","observation_id":"57a0bd6c-e27e-4b69-bcd7-040a214e93b2","resolution":{"observed_at":"2026-08-06T15:54:38.079569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T08:28:54.534044Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":8,"verified_fuzzy":24},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2507.14777."}