{"as_of":"2026-08-10T08:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b1bf6d618c8288d9cd3452c52a13e22dfa76c4fa3e52738ff0aea21649d6155","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T22:05:02.705232Z","state":"measured"},{"denominator":86,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":86,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T02:50:09.196457Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T02:50:58.332378Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"cited_work":{"arxiv_id":"2501.18914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Choquette-Choo, Badih Ghazi, George Kaissis, Ravi Kumar, Ruibo Liu, Da Yu, and Chiyuan Zhang","venue":null,"work_id":"048d2023-9d6a-4075-916a-df606314df31","year":2025},"citing_paper":{"arxiv_id":"2505.16329","last_updated":"2026-04-26T14:33:57Z","snapshot_observed_at":"2026-08-02T23:19:18.105404Z","submitted_at":"2025-05-22T07:34:27Z","title":"High-Dimensional Private Linear Regression with Optimal Rates","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T02:50:09.196457Z"},"links":{"cited_paper":"/paper/2501.18914","citing_paper":"/paper/2505.16329"},"observation_digest":"sha256:b2b523e06f1ebb6dc74628753f0fe5afdf952d9f315400df69e16c1e09e59a84","observation_id":"629c9eb3-66de-4892-a8d2-0135ea09d741","resolution":{"observed_at":"2026-05-22T02:50:58.335502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"cited_work":{"arxiv_id":"2501.18914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Choquette-Choo, Badih Ghazi, George Kaissis, Ravi Kumar, Ruibo Liu, Da Yu, and Chiyuan Zhang","venue":null,"work_id":"048d2023-9d6a-4075-916a-df606314df31","year":2025},"citing_paper":{"arxiv_id":"2601.10237","last_updated":"2026-04-16T13:16:57Z","snapshot_observed_at":"2026-07-30T08:45:45.642515Z","submitted_at":"2026-01-15T09:50:36Z","title":"Fundamental Limitations of Favorable Privacy-Utility Guarantees for DP-SGD","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T13:37:50.765735Z"},"links":{"cited_paper":"/paper/2501.18914","citing_paper":"/paper/2601.10237"},"observation_digest":"sha256:11a586f9f83aedc4a7a753419137bb3015dc69113602316f2c0e65f7d48ab4bb","observation_id":"3524c178-261c-4dfc-8770-f30d501c0f19","resolution":{"observed_at":"2026-05-16T13:37:56.495543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"cited_work":{"arxiv_id":"2501.18914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Choquette-Choo, Badih Ghazi, George Kaissis, Ravi Kumar, Ruibo Liu, Da Yu, and Chiyuan Zhang","venue":null,"work_id":"048d2023-9d6a-4075-916a-df606314df31","year":2025},"citing_paper":{"arxiv_id":"2605.07072","last_updated":"2026-05-08T00:47:11Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T00:47:11Z","title":"Less Random, More Private: What is the Optimal Subsampling Scheme for DP-SGD?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-11T01:06:21.633242Z"},"links":{"cited_paper":"/paper/2501.18914","citing_paper":"/paper/2605.07072"},"observation_digest":"sha256:65713a578c836dc075d5cc7a458a4e9cf25ee3aaa3081d6a4e1493b9352e8ece","observation_id":"d3926d10-a519-42cb-a817-f435214fa1e7","resolution":{"observed_at":"2026-05-11T04:45:58.064210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.18914/citation-record","integrity":"/paper/2501.18914/integrity","json":"/paper/2501.18914/citation-record.json","paper":"/paper/2501.18914"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.460455Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.460455Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:2d80ee9c3b6c48ca9eba6697de84c290b9ff4882be641ba4335800dac18b16a3","observation_id":"f0373ff8-9971-4279-a031-a6ba44d8f316","resolution":{"observed_at":"2026-08-09T22:05:02.460455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.464676Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.464676Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:e82d00fc153a0a7716ae30a2f96f8a929a7da9b0916a6137cb108f360bed39ba","observation_id":"61f594a2-8dd0-4d6c-bd0e-35f56ae47906","resolution":{"observed_at":"2026-08-09T22:05:02.464676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.468415Z","title":"B., Mironov, I., Talwar, K., and Zhang, L","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.468415Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:d4040c58568c2e233c9c6b49222bc646acfcebd5032c83d5e3765e25b6ba4f95","observation_id":"a02fce59-7c6a-4391-8ce3-37579efdf4a8","resolution":{"observed_at":"2026-08-09T22:05:02.468415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T22:05:02.471763Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.471763Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:e0c9a9bca5086e1ab50dc167ddff69e247657dd36486dad25725c1c4962e63bf","observation_id":"875a1ea7-8e41-42da-89ba-f79f146975aa","resolution":{"observed_at":"2026-08-09T22:05:02.471763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.761225Z","title":"The crossroads of innovation and privacy: Private synthetic data for generative AI","venue":null,"work_id":"891c84b2-b9c0-4368-a599-e9d9ba50e3c4","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.475509Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1a572510cb0ad94e772835ea84d6b8c92e21469f1c660a9ed5ea86edbd8c526e","observation_id":"a46ef737-e423-4636-84f9-8516cfe717dd","resolution":{"observed_at":"2026-08-09T22:05:15.764022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12108","last_updated":"2024-10-09T17:45:07Z","snapshot_observed_at":"2026-08-04T09:52:16.576629Z","submitted_at":"2024-07-16T18:28:40Z","title":"Private prediction for large-scale synthetic text generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12108","snapshot_observed_at":"2026-08-09T22:05:02.478985Z","title":"Private prediction for large-scale synthetic text generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.478985Z"},"links":{"cited_paper":"/paper/2407.12108","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:be9bba91347afd10ff213cf18bb37ee3963e804baf9a2482ca8fc5884798e222","observation_id":"d15e446e-47b6-442b-9e5e-0fbcaab2412c","resolution":{"observed_at":"2026-08-09T22:05:02.478985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.754059Z","title":"Large-scale differentially private BERT","venue":null,"work_id":"a820ac97-7be8-4523-9684-ee1fb2137ffe","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.482745Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:b6f71cc776616ea16eb964fee465c8031c21c5fc183d21b1576413733c7504a3","observation_id":"5ac5903d-fda1-4a9c-a007-0b513de417f4","resolution":{"observed_at":"2026-08-09T22:05:15.756627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-09T22:05:02.485922Z","title":"M., Firat, O., Johnson, M., Lepikhin, D., Passos, A., Shakeri, S., Taropa, E., Bailey, P., Chen, Z., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.485922Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:53c082c9f8851540368d500a1a4442236f361041c656241ef29b38c6ff8eaf7f","observation_id":"7a2c9af1-4763-4bb4-88c1-68c25e77beba","resolution":{"observed_at":"2026-08-09T22:05:02.485922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.746796Z","title":"Privacy amplification by subsampling: Tight analyses via couplings and divergences, 2018","venue":null,"work_id":"983ecb80-e0fd-42e4-bd0e-88669f0a5a5b","year":2018},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.489773Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1ee8bf6d11bf100f942beaf95be7cd15ab1985b64da7f1d921d284b66ace62c3","observation_id":"4bdb8029-de59-4c2b-b0a2-d7f9d1169c81","resolution":{"observed_at":"2026-08-09T22:05:15.749559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.738986Z","title":"Reconstructing training data with informed adversaries","venue":null,"work_id":"c3bc8f02-714f-4092-af92-81b2a736a7aa","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.492996Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:3ebdfb9f8e76aa31ee0fd3b11b1b6806392e57cd97d708a8a7a05b5968fbf82a","observation_id":"c4ea427c-54a1-4fb6-8335-d8a221d33be2","resolution":{"observed_at":"2026-08-09T22:05:15.742146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.730874Z","title":"Private empirical risk minimization: Efficient algorithms and tight error bounds","venue":null,"work_id":"322baa9a-4b0c-4fab-9ed7-7b6159673dc5","year":2014},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.495991Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:e5808889391a13593e6394473c55a735ea6ddaf5afe5902df08d4a260603d3f8","observation_id":"5bab3390-66b1-4e27-90c5-f98b05735290","resolution":{"observed_at":"2026-08-09T22:05:15.733951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10888","last_updated":"2023-08-21T17:42:33Z","snapshot_observed_at":"2026-08-07T20:51:50.220870Z","submitted_at":"2023-08-21T17:42:33Z","title":"Unlocking Accuracy and Fairness in Differentially Private Image Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10888","snapshot_observed_at":"2026-08-09T22:05:02.499144Z","title":"H., Hayes, J., Stanforth, R., Stutz, D., Kohli, P., Smith, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.499144Z"},"links":{"cited_paper":"/paper/2308.10888","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:28489a727ba56ec2f581cf6493069e84791402a5d858d057242d381c501cb3af","observation_id":"eea3ad11-cfac-4603-b784-4bf4cd836ef2","resolution":{"observed_at":"2026-08-09T22:05:02.499144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.722572Z","title":"S., Sutawika, L., Schoelkopf, H., Anthony, Q., Purohit, S., and Raff, E","venue":null,"work_id":"93d82531-6095-43e5-bd50-1816778d7e88","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.502400Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:cee8e8e3999830ddf222e267489a7eafb5def1b24bb8c1b1659f1666e92ec02c","observation_id":"e3d5a317-e77e-4395-ae95-ce8fff419810","resolution":{"observed_at":"2026-08-09T22:05:15.725626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.714429Z","title":"Scalable and efficient training of large convolutional neural networks with differential privacy","venue":null,"work_id":"46517355-d6d7-4057-9aaf-96a1a1eef896","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.505391Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:0a8bdc018de5b26806dcce7113a19752ed84ab3738f7d843cce24eff14197afa","observation_id":"49a556cf-ce3c-42f5-a39f-07d14ef2ded5","resolution":{"observed_at":"2026-08-09T22:05:15.717505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.706366Z","title":"Differentially private optimization on large model at small cost","venue":null,"work_id":"e9645118-2f8a-4549-885f-2f147c4f8310","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.508420Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:c97d31f6438cdd869e7ec127d97318642b06d183ebbbf7f04792d09c9e67d02b","observation_id":"3f005122-75f0-4d23-a70a-c9456393397c","resolution":{"observed_at":"2026-08-09T22:05:15.709378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.698123Z","title":"Extracting training data from large language models","venue":null,"work_id":"cd8d2fb1-6818-4bfa-bb4a-f5fbf8fdd527","year":2021},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.511347Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:c459be69bb4de9d615afeb1b94030b9acdb2ca91cf1d069ef610f1dd7673037e","observation_id":"3deb14b3-6036-4044-abd7-fa063ceba6ec","resolution":{"observed_at":"2026-08-09T22:05:15.701156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.689893Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":"97921ede-e550-4cc8-916d-41f5209c75bf","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.514388Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:4ba2077a127c003609fd794405af4dba8119bfba4426942d988d15f2267878ea","observation_id":"895368f2-7799-4861-9444-ce22f1b1ffa0","resolution":{"observed_at":"2026-08-09T22:05:15.692999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.681675Z","title":"A., Paleka, D., Pearce, W., Anderson, H., Terzis, A., Thomas, K., and Tram \\`e r, F","venue":null,"work_id":"0d8a7bbc-4e9a-42e0-aa3c-c8b1d43d7dd6","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.517425Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:5e87697cffbc67018bce2aa6697b0fca8f6bf71db5c31ca735b8ad37641e61a5","observation_id":"2a206b09-f01a-4bc1-8e81-19b919aa87bb","resolution":{"observed_at":"2026-08-09T22:05:15.684835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07737","last_updated":"2024-07-10T15:07:58Z","snapshot_observed_at":"2026-07-06T18:44:16.139499Z","submitted_at":"2024-07-10T15:07:58Z","title":"Fine-Tuning Large Language Models with User-Level Differential Privacy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07737","snapshot_observed_at":"2026-08-09T22:05:02.520377Z","title":"B., Mitchell, N., Pillutla, K., and Rush, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.520377Z"},"links":{"cited_paper":"/paper/2407.07737","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:709ffae1c1c52652684e45238f36724cd6052166488ffcb2df844bd814f652bb","observation_id":"f4006fd1-d80f-413e-a2dd-f0258cdd653a","resolution":{"observed_at":"2026-08-09T22:05:02.520377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06675","last_updated":"2023-05-08T21:49:57Z","snapshot_observed_at":"2026-08-02T01:29:22.350700Z","submitted_at":"2023-02-13T20:27:30Z","title":"Symbolic Discovery of Optimization Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06675","snapshot_observed_at":"2026-08-09T22:05:02.523732Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.523732Z"},"links":{"cited_paper":"/paper/2302.06675","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1c5adaa689288177dd9f3470ff74d1fd2ebff195186eff741b73727dd939f8ff","observation_id":"ca211374-f08d-44f9-80fb-7c41187d1ccf","resolution":{"observed_at":"2026-08-09T22:05:02.523732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.673858Z","title":null,"venue":null,"work_id":"055ee324-3608-4268-a4d8-ea013dc12f2b","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.526910Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:78089fa0d4f956c682f1da427b191b4c82b050d0d3ed3032c4e42404803bf0ac","observation_id":"e21b2d25-e02d-4472-9a69-ad509a81ea54","resolution":{"observed_at":"2026-08-09T22:05:15.676664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.665405Z","title":"Mind the privacy unit! user-level differential privacy for language model fine-tuning","venue":null,"work_id":"28e2b217-3e62-4e22-861b-e0a07a7cd11c","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.529416Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:676bf142672004100e53d7896a4c6322a1fc19949cc419326bc2603dc942b284","observation_id":"dedc7793-05d4-437a-87d8-d0d3afbcad11","resolution":{"observed_at":"2026-08-09T22:05:15.668663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.656728Z","title":"Scalable DP-SGD : Shuffling vs","venue":null,"work_id":"740d22af-15d9-4bb8-9203-eee62606ac93","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.531816Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:059ee3fc155066e1d03e707f4c857905372407adc70e00746d9eee3d5f7e935f","observation_id":"b28f6f38-5cbb-4a31-8648-59dafbe8671b","resolution":{"observed_at":"2026-08-09T22:05:15.659847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13650","last_updated":"2022-06-16T17:47:42Z","snapshot_observed_at":"2026-08-09T01:53:18.372890Z","submitted_at":"2022-04-28T17:10:56Z","title":"Unlocking High-Accuracy Differentially Private Image Classification through Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.13650","snapshot_observed_at":"2026-08-09T22:05:02.534080Z","title":"L., and Balle, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.534080Z"},"links":{"cited_paper":"/paper/2204.13650","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:dcb20be0eaaed850b04c0f0c87db7bb4d9222165bb7d958ed750396e97619859","observation_id":"304dea68-846e-4f8a-a2b4-55a2597a44d4","resolution":{"observed_at":"2026-08-09T22:05:02.534080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.648174Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"4cdf30d3-c5a8-4075-9925-21877d1ef570","year":2019},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.536687Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:f4040662f911c068a9e0225eff5f511efdafec7913345f3735a0051522ea354d","observation_id":"799558ed-aab7-495f-856f-0828e7cf1d72","resolution":{"observed_at":"2026-08-09T22:05:15.651406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.640385Z","title":"S., Wang, T., Huang, C., and Sun, H","venue":null,"work_id":"cba2a927-05a6-483b-a9a9-6a9fcbafa4c8","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.539119Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:0c84bf2ad62ecd9166a33b9bd871462df1d8d365ab01ff6d76999172ce4d6149","observation_id":"dd298b68-236c-4c98-9fde-c471a95bdfa4","resolution":{"observed_at":"2026-08-09T22:05:15.642934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.632543Z","title":"Flocks of stochastic parrots: Differentially private prompt learning for large language models","venue":null,"work_id":"d5752dbe-b1ec-4891-87cc-0de96ccc04bc","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.541494Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:83bc901f9f25316edc2d58ba56a45cf17e540f24596258c365143b9c3ebfbd00","observation_id":"247ce4aa-b7e9-4cbd-abe2-95d59c2926dd","resolution":{"observed_at":"2026-08-09T22:05:15.635318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.624493Z","title":"On the privacy risk of in-context learning","venue":null,"work_id":"ebd27529-96a6-4c95-a900-7f6005a98b3e","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.543817Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:ea00125569e438d981813d4f67cacf7bd9b8023b761adf88bc0c5d9f11aeae95","observation_id":"7b89da64-14c3-45b9-b4f5-e59a42c54203","resolution":{"observed_at":"2026-08-09T22:05:15.627467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T22:05:02.546186Z","title":"The Llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.546186Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:9719c1408f15f93fc2599bff8c354082fd62eae0e18beb39f41f5ea2def83948","observation_id":"0550f31a-a31d-4492-afb0-6c9bc3dd29d3","resolution":{"observed_at":"2026-08-09T22:05:02.546186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.616160Z","title":"Calibrating noise to sensitivity in private data analysis","venue":null,"work_id":"8453b5e3-6ea9-42f2-adfe-c00c27d1e042","year":2006},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.548692Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:5dfeb79ec96f184dc0c9718bd576cbac1a477ccc344a2851393cbdf75cdc61d5","observation_id":"78dda07b-586a-4f8a-9f13-8d2da79155ef","resolution":{"observed_at":"2026-08-09T22:05:15.619209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08540","last_updated":"2024-06-14T20:21:05Z","snapshot_observed_at":"2026-07-06T17:43:56.860733Z","submitted_at":"2024-03-13T13:54:00Z","title":"Language models scale reliably with over-training and on downstream tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08540","snapshot_observed_at":"2026-08-09T22:05:02.550944Z","title":"Y., Smyrnis, G., Shankar, V., Gururangan, S., Wortsman, M., Shao, R., Mercat, J., Fang, A., Li, J., Keh, S., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.550944Z"},"links":{"cited_paper":"/paper/2403.08540","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:5fb73a61c0f6beb944949be62f926865db59d7eb299627376b7e854e4d48045e","observation_id":"822192f8-2cf8-41a8-a43b-7ef6ea8c6068","resolution":{"observed_at":"2026-08-09T22:05:02.550944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.607378Z","title":"Predictability and surprise in large generative models","venue":null,"work_id":"5b1856df-b543-44fd-bef7-ca13ac9a20bf","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.554175Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1bbb0f39f6f34ff2e79415faf6e220ef0e600f605e8d63e2bf4cf0bc147fcf08","observation_id":"c493a56c-3e1d-4b3e-be08-4fb18e958e3d","resolution":{"observed_at":"2026-08-09T22:05:15.610626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-09T22:05:02.557123Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.557123Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:97e2dc7c48e1afd3d32df2c084a81b745c060ae2bf777ef3bed97ced3ae773a5","observation_id":"5f30aae0-6cd9-4171-91ea-2497b41e13cc","resolution":{"observed_at":"2026-08-09T22:05:02.557123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-09T22:05:02.560629Z","title":"S., Love, J., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.560629Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:cf5001b7b4d499555cd2ba5d8c31acf62876c9b49f54861759ff7bda3bca87ee","observation_id":"8cdadba0-1e12-4b4e-a025-6c47bd7578cc","resolution":{"observed_at":"2026-08-09T22:05:02.560629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T22:05:02.563895Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.563895Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:4bb3c1a06b1c2034fe1592a322edb36a5ad1d0350e0da6da0f79dd033b496b2a","observation_id":"4cb2ca6f-924e-4292-a411-ce10f8cc8f47","resolution":{"observed_at":"2026-08-09T22:05:02.563895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13861","last_updated":"2023-02-27T15:02:04Z","snapshot_observed_at":"2026-08-08T18:55:37.205842Z","submitted_at":"2023-02-27T15:02:04Z","title":"Differentially Private Diffusion Models Generate Useful Synthetic Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13861","snapshot_observed_at":"2026-08-09T22:05:02.566936Z","title":"L., Wiles, O., and Balle, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.566936Z"},"links":{"cited_paper":"/paper/2302.13861","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:160ed0832ff24f1a16c5726f4abe3935b4e129062b3e85f38defa665f3d294f6","observation_id":"bc758505-3f81-4876-a21b-66ee7e1a0cb8","resolution":{"observed_at":"2026-08-09T22:05:02.566936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.598773Z","title":"and Latonero, M","venue":null,"work_id":"d83132c1-b8d0-4d48-a07e-c2462cb741fc","year":2017},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.570165Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:6748b856e9b4c947f09b3d8771bb92b0ea1448b3dedb98a859396f14becb8a4a","observation_id":"51b4e952-24b9-47a9-92a5-e08d6f6b7bc2","resolution":{"observed_at":"2026-08-09T22:05:15.601864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.589861Z","title":"Google's differential privacy libraries., 2022","venue":null,"work_id":"053b0490-e377-4e97-a3da-d0d3df889243","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.573081Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:65f4c41219fd7a735cc9f45d88fdf83e00ac98e275a28b88b630993de191cd92","observation_id":"531f4b89-b57e-4725-9399-fafa7517f89f","resolution":{"observed_at":"2026-08-09T22:05:15.593009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-09T22:05:02.576030Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.576030Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:ff29f2e437587d648b4ba3f96c21d627416cf8ada2dc768225b8d01342d85367","observation_id":"204ccb5c-3c55-4daa-bada-596d6f559990","resolution":{"observed_at":"2026-08-09T22:05:02.576030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.581088Z","title":"T., Zhang, C., Li, Z., Li, B., and Wang, Z","venue":null,"work_id":"07336aab-0357-42f2-8190-65c6c53dd8c1","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.579167Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:81d987775ba27aebc033d0e89b156581a53b125fe0b1ab68615845ed6d8d26c8","observation_id":"9ab250db-00ac-4786-9ab7-0eb61115ac32","resolution":{"observed_at":"2026-08-09T22:05:15.584233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.582136Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.582136Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:4a889cd9b3161d3ad65d8b46e63256f884e251d18c6378dc055a6c1260c40e5e","observation_id":"efcf04e7-7395-4d3f-a199-0eff39f8a78b","resolution":{"observed_at":"2026-08-09T22:05:02.582136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17546","last_updated":"2023-09-11T16:58:48Z","snapshot_observed_at":"2026-08-04T04:34:05.607113Z","submitted_at":"2022-10-31T17:57:55Z","title":"Preventing Verbatim Memorization in Language Models Gives a False Sense of Privacy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17546","snapshot_observed_at":"2026-08-09T22:05:02.585035Z","title":"A., and Carlini, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.585035Z"},"links":{"cited_paper":"/paper/2210.17546","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:f27365b96a47c8aaf5daa1939c87c4813ad6285847c310d2403136a8aa95236a","observation_id":"e246c354-c05c-45b2-8cd9-db0c8346a679","resolution":{"observed_at":"2026-08-09T22:05:02.585035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03928","last_updated":"2023-07-08T08:02:47Z","snapshot_observed_at":"2026-07-06T15:51:43.130122Z","submitted_at":"2023-07-08T08:02:47Z","title":"Bounding data reconstruction attacks with the hypothesis testing interpretation of differential privacy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03928","snapshot_observed_at":"2026-08-09T22:05:02.588331Z","title":"Bounding data reconstruction attacks with the hypothesis testing interpretation of differential privacy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.588331Z"},"links":{"cited_paper":"/paper/2307.03928","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:5fe075e7cba78d8153b5ea5042222558788fb05c94eaa758f8fa5e5df047e9d4","observation_id":"610698f1-82a2-4550-b270-86ea014c0dba","resolution":{"observed_at":"2026-08-09T22:05:02.588331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.567379Z","title":"Beyond the calibration point: Mechanism comparison in differential privacy","venue":null,"work_id":"79d8f7dc-28bc-4bce-9541-2b32e17346fb","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.591575Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:51da8eb6cf434f8013cdb5ea9aadf64fcb1d4531a11fb04ec907d5e9ad640da3","observation_id":"3b8f90fa-1f90-4755-8bcc-6ff6a9fb6b59","resolution":{"observed_at":"2026-08-09T22:05:15.570636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-09T22:05:02.594525Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.594525Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:3e2791a6dd12d49019e305119101e114a54ca20d17e8f2ad0efb70f6a645c2ab","observation_id":"9010c1b9-ea61-4ba5-9d2d-a4474def2505","resolution":{"observed_at":"2026-08-09T22:05:02.594525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.597755Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.597755Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:11933d01e0fd2241a08394a6d2ac35d3a7de39c2c4fa9d8f6379543040a18095","observation_id":"c916c46d-e4b3-4813-aa2d-8e886573fe4e","resolution":{"observed_at":"2026-08-09T22:05:02.597755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.553092Z","title":"and Ponomareva, N","venue":null,"work_id":"ba6a1a11-0ea9-46ff-b04c-41bc41949a3a","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.600675Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:6d7e0df6a58b858fb3c9f38fb1c77a05e7f5824b66959a60e84f3a69168e7fbb","observation_id":"e04b89ba-cf82-455d-8e87-1fbc40ecf757","resolution":{"observed_at":"2026-08-09T22:05:15.556608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12328","last_updated":"2022-02-09T04:55:14Z","snapshot_observed_at":"2026-08-04T13:45:26.163424Z","submitted_at":"2022-01-28T18:48:18Z","title":"Toward Training at ImageNet Scale with Differential Privacy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12328","snapshot_observed_at":"2026-08-09T22:05:02.603557Z","title":"Toward training at ImageNet scale with differential privacy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.603557Z"},"links":{"cited_paper":"/paper/2201.12328","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:224a658d9cedaea3fe5959d46106dabd4ef00caf0310c0028b18c22830a3ab5f","observation_id":"1494b815-bea2-4346-a848-0da50d6038ac","resolution":{"observed_at":"2026-08-09T22:05:02.603557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.544099Z","title":"Large language models can be strong differentially private learners","venue":null,"work_id":"df99af2e-46c7-4a12-b39a-39404e3be36e","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.606708Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:c976d279f8fc1898aee84a2f45ae1ff9e86788cbd035ffdd710738a0807a6d8a","observation_id":"3ea0bf12-00c5-4c98-99fc-9ba54567ef65","resolution":{"observed_at":"2026-08-09T22:05:15.547312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.535216Z","title":"J., Novak, R., Lee, J., Wortsman, M., Xiao, L., Everett, K., Alemi, A","venue":null,"work_id":"88349b94-b7e8-4b1a-a17b-8e95a7376af4","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.609764Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:796eeddfc8b0e7adaeecb1a1c25e181a1e10f36e61bfa582a5139422067c78ae","observation_id":"1b9ec1d5-c3ae-46f4-ad65-f9684a0ff5d0","resolution":{"observed_at":"2026-08-09T22:05:15.538451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-09T22:05:02.612675Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.612675Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:d3e45802ba220e44c095b152bc300b9e804ed1ad858fa6053e53fc4e7950c1e7","observation_id":"d814cd33-f1f7-40e9-a583-81e4d4b5e092","resolution":{"observed_at":"2026-08-09T22:05:02.612675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.526228Z","title":"Analyzing leakage of personally identifiable information in language models","venue":null,"work_id":"eccee2cb-327f-4523-b5cc-2bcaf1a97ae7","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.615787Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1dbce61cd886e04fc74af0e87323303f937e03b706f3a509db40d9fdf61b238b","observation_id":"3c33765d-4565-45cf-b9da-55ed2a7fbd24","resolution":{"observed_at":"2026-08-09T22:05:15.529460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.06162","last_updated":"2018-12-14T20:49:09Z","snapshot_observed_at":"2026-07-06T07:21:19.842962Z","submitted_at":"2018-12-14T20:49:09Z","title":"An Empirical Model of Large-Batch Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.06162","snapshot_observed_at":"2026-08-09T22:05:02.618642Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.618642Z"},"links":{"cited_paper":"/paper/1812.06162","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:fc5f9cb3d16f493728f0fd3fa33c26788b2dfdd5dfe54df53bf4613e048aa523","observation_id":"e409d138-deec-47c0-ab74-44f5c6817c87","resolution":{"observed_at":"2026-08-09T22:05:02.618642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.517555Z","title":"Updating quasi- N ewton matrices with limited storage","venue":null,"work_id":"7a1f94cc-091f-4b57-836c-d16fbc76a648","year":1980},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.621389Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1a04d2f9a5b135609b1450eb1c5d29d4f1274282dae9e477a247d0cc89c73438","observation_id":"0d005d45-91d4-4feb-8b38-a8ecedfa403b","resolution":{"observed_at":"2026-08-09T22:05:15.520704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.623885Z","title":"and Wright, S","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.623885Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:f8ea1a92d9c95c5c5f7993297176e3ba93b8e68c480a6c662a46e9c90e80a4f4","observation_id":"23fd9076-2f1c-4476-a358-4c62dc875249","resolution":{"observed_at":"2026-08-09T22:05:02.623885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.504407Z","title":"B., Vassilvitskii, S., Chien, S., and Thakurta, A","venue":null,"work_id":"d922c431-2059-42b6-ac47-f86dd683ee59","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.626275Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:6714f6033c66df5151028767349783650a9e166afc83e9abac9224486169c0ff","observation_id":"1267a439-115e-465a-82ed-fb596b3bfa8a","resolution":{"observed_at":"2026-08-09T22:05:15.507387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17746","last_updated":"2025-05-07T18:36:12Z","snapshot_observed_at":"2026-07-06T18:36:51.761148Z","submitted_at":"2024-06-25T17:32:16Z","title":"Recite, Reconstruct, Recollect: Memorization in LMs as a Multifaceted Phenomenon","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17746","snapshot_observed_at":"2026-08-09T22:05:02.628551Z","title":"S., Deng, A., O'Brien, K., SV, J., Khan, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.628551Z"},"links":{"cited_paper":"/paper/2406.17746","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:3c1a2f9e30fef549caa5368205018cfde5f54bcce804b0420b05d17bce883327","observation_id":"3a068439-a5ae-4f84-beb5-c6c501f4d11d","resolution":{"observed_at":"2026-08-09T22:05:02.628551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.496748Z","title":"K., Charles, Z., Garrett, Z., Augenstein, S., and Mitchell, N","venue":null,"work_id":"6710414e-ec24-4fe8-8117-b3aeb93ceef1","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.631380Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:7bfeddfe6d6855df0c71a318d51a835eab16960f3bca699c1b597afedb85924a","observation_id":"328571d9-525e-4b7b-9ea7-457250121db5","resolution":{"observed_at":"2026-08-09T22:05:15.499398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.489513Z","title":"TAN without a burn: Scaling laws of DP-SGD","venue":null,"work_id":"68206d91-73c2-4991-b12c-1b84947acc6f","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.633800Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:b80936be5d4fb596c529c94152ccb25d17ae7959d37b7b862962f60de16f6c42","observation_id":"6464e725-0401-46ea-8f17-25a1de3c0133","resolution":{"observed_at":"2026-08-09T22:05:15.492205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.482142Z","title":"Differentially private representation learning via image captioning","venue":null,"work_id":"a2ab899f-4bb0-4f49-80cf-982f2396bab5","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.636162Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:ce660e3e0e3379cd1d1d7527412b02a26a9a23ccadb4dd7227270eaaaa67ac45","observation_id":"d0cfe463-e430-4f28-90a4-893e72b6e568","resolution":{"observed_at":"2026-08-09T22:05:15.484688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.474455Z","title":"J., Lee, J., Antognini, J., Sohl-Dickstein, J., Frostig, R., and Dahl, G","venue":null,"work_id":"64ec02d5-4028-4f76-a222-dcfdd6a0ecc6","year":2019},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.639070Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1ab68a89d86bac4f19cb0b0b0ed30d966be300080d87690021156ee148975719","observation_id":"3008b1f9-25be-4af8-bd40-f9250f46eccd","resolution":{"observed_at":"2026-08-09T22:05:15.477492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.466184Z","title":"M., Lowe, R., Voss, C., Radford, A., Amodei, D., and Christiano, P","venue":null,"work_id":"4d1d00de-4daf-4818-82e0-bb6700a5d160","year":2020},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.642090Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:8354d950556e53c63985599b859f4c5cfc3b935d03db7568645571c162fb6c48","observation_id":"1384ed1c-bed2-48aa-9f17-5136093606e1","resolution":{"observed_at":"2026-08-09T22:05:15.469264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.456644Z","title":"Enabling fast differentially private SGD via just-in-time compilation and vectorization","venue":null,"work_id":"b1db21d5-d6b1-4ecb-92a1-dae34df281a9","year":2021},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.644878Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:825f7d741a4a23189350e81a8f92ee0aafb5723e3a975ec18a81b33a300443e8","observation_id":"3ce99226-749d-4e4b-b4d1-a8f26831a0ce","resolution":{"observed_at":"2026-08-09T22:05:15.459922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.448350Z","title":"A., Manoel, A., Mireshghallah, F., Lin, Z., Gopi, S., Kulkarni, J., and Sim, R","venue":null,"work_id":"51a530fc-5221-49e2-9ea2-3a88ac42f725","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.647860Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:b71e2191f2f067cf465cffbfd610ca620cd01be6f6e13a02570bb4aa896045a2","observation_id":"adb3c8f8-4dc9-48b7-a369-33646690c82d","resolution":{"observed_at":"2026-08-09T22:05:15.451500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15551","last_updated":"2025-09-08T18:47:35Z","snapshot_observed_at":"2026-08-06T08:12:28.242579Z","submitted_at":"2023-12-24T21:46:14Z","title":"On the Benefits of Public Representations for Private Transfer Learning under Distribution Shift","version":5},"cited_work":{"arxiv_id":"2312.15551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.15551","snapshot_observed_at":"2026-08-09T22:05:15.186049Z","title":"On the Benefits of Public Representations for Private Transfer Learning under Distribution Shift","venue":"cs.LG","work_id":"46b28c39-5883-4384-bd2f-3abfed331a58","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.650727Z"},"links":{"cited_paper":"/paper/2312.15551","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:336e4dacdb63c42fc0272ab087f6e68c9ec977b8c02758847b569fc5d69c8715","observation_id":"f48ce78d-8dc2-4d2d-b154-1fe5bc47d4c0","resolution":{"observed_at":"2026-08-09T22:05:15.190444Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.439758Z","title":"E., and Honkela, A","venue":null,"work_id":"9f70c6ab-11ee-4d65-a48d-0eb354a8c8be","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.653994Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:e39c1a210218397e21ec834e0fcb52624ee086e881740b286e005348d5c12ed4","observation_id":"8d59107f-16a4-483d-a043-de32d8e405f4","resolution":{"observed_at":"2026-08-09T22:05:15.442738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06470","last_updated":"2024-07-17T06:53:58Z","snapshot_observed_at":"2026-07-06T14:29:57.303212Z","submitted_at":"2022-12-13T10:41:12Z","title":"Position: Considerations for Differentially Private Learning with Large-Scale Public Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06470","snapshot_observed_at":"2026-08-09T22:05:02.656929Z","title":"Considerations for differentially private learning with large-scale public pretraining","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.656929Z"},"links":{"cited_paper":"/paper/2212.06470","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:91a3004de8dbbeaee9189e925ff66f51f45c92a676df5c73dec97ea998df8f5c","observation_id":"3e6b039f-e0e9-4307-8682-b74301c7a1d4","resolution":{"observed_at":"2026-08-09T22:05:02.656929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.431057Z","title":"Can public large language models help private cross-device federated learning? In NAACL (Findings), pp.\\ 934--949, 2024","venue":null,"work_id":"e6f7eddb-adc4-4f00-8e0f-28315e97efd0","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.660157Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:f7174ffbbf4ee365a6dbcf993c9199d1cdb7bcd0069186b9501dac390d7c6924","observation_id":"4de23078-6895-4f6e-8bdd-7e7ede5bdd97","resolution":{"observed_at":"2026-08-09T22:05:15.434369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.422460Z","title":"A., Backurs, A., Chandrasekaran, V., Kulkarni, J., and Sim, R","venue":null,"work_id":"89f2044e-4c4b-46f3-a4ce-75afb1bd7004","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.662921Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:3ede422cf24d7ac80ba68cf728bd22e81810a0e84fae5b74cbf4c24e1503ffb0","observation_id":"fcc6f820-d944-42ff-8df4-a20d53e86eeb","resolution":{"observed_at":"2026-08-09T22:05:15.425696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.414013Z","title":"T., and Mittal, P","venue":null,"work_id":"b0ceed5e-b782-4d99-9d60-0b171866cb4e","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.665791Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:946961b6c97e62b67a0bca90a6356932e0d33ef07df5dd562f911bf680212c54","observation_id":"1456e916-fcb1-4490-8c84-c2353aaf0761","resolution":{"observed_at":"2026-08-09T22:05:15.417064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04663","last_updated":"2021-12-23T21:29:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-10T20:54:58Z","title":"GSPMD: General and Scalable Parallelization for ML Computation Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04663","snapshot_observed_at":"2026-08-09T22:05:02.668521Z","title":"GSPMD : general and scalable parallelization for ML computation graphs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.668521Z"},"links":{"cited_paper":"/paper/2105.04663","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:9f4a780e91ce438f2a353d408a9b76b25e193612cf9be15f8196f259cee52364","observation_id":"785a2d0d-66e1-4d3c-9ee6-5d663f5d3811","resolution":{"observed_at":"2026-08-09T22:05:02.668521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.405091Z","title":"Privacy risk in machine learning: Analyzing the connection to overfitting","venue":null,"work_id":"67b85b4e-8caa-46a6-8ab1-72b5af3847c7","year":2018},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.671533Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:3d05010cbc0b2a2da051cd4c4d5bb3b293cc65d1bd72ce9e4fb6e62cb7b01d10","observation_id":"acad16a9-4871-4dad-ae95-9e512b23cf0e","resolution":{"observed_at":"2026-08-09T22:05:15.408488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.00962","last_updated":"2020-01-03T06:53:00Z","snapshot_observed_at":"2026-07-06T07:43:06.427641Z","submitted_at":"2019-04-01T16:53:35Z","title":"Large Batch Optimization for Deep Learning: Training BERT in 76 minutes","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.00962","snapshot_observed_at":"2026-08-09T22:05:02.674730Z","title":"Large batch optimization for deep learning: Training bert in 76 minutes, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.674730Z"},"links":{"cited_paper":"/paper/1904.00962","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:10e1eb86c7e2ddbcc6905e538930d3639556adc14aaf58595e55bf68ff582cbf","observation_id":"ae6a4999-2331-4545-b12d-2f53c6e34b32","resolution":{"observed_at":"2026-08-09T22:05:02.674730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.395763Z","title":"Large scale private learning via low-rank reparametrization","venue":null,"work_id":"770dcb9b-169e-4284-9544-20138f016171","year":2021},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.678274Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:346672f2f6e694cb6a5a0ca87549055dc48d34f431995575ef9bbe1bff7cee7a","observation_id":"9bda54f3-4a31-461f-9aab-46c8fabe2c16","resolution":{"observed_at":"2026-08-09T22:05:15.399002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.386946Z","title":"A., Kamath, G., Kulkarni, J., Lee, Y","venue":null,"work_id":"01c146cc-7047-467c-973b-b67116b51534","year":2022},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.681016Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:c17dad61d6e41ac54a32ed97957f5df2b5cae70c695ca7c742147fc0aaeb8c53","observation_id":"e1567c43-320b-452b-afee-0783d63cbdaa","resolution":{"observed_at":"2026-08-09T22:05:15.390083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21676","last_updated":"2025-04-21T04:19:56Z","snapshot_observed_at":"2026-07-06T19:41:15.267950Z","submitted_at":"2024-10-29T02:54:06Z","title":"How Does Critical Batch Size Scale in Pre-training?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21676","snapshot_observed_at":"2026-08-09T22:05:02.683938Z","title":"How does critical batch size scale in pre-training? arXiv:2410.21676, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.683938Z"},"links":{"cited_paper":"/paper/2410.21676","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:1d2f2e0c7e08de55927cedb6f09b22ce3bce5e49415f7ecf39912e1ac44a6ef7","observation_id":"57bdad84-9478-4da6-a432-c3db2ea83848","resolution":{"observed_at":"2026-08-09T22:05:02.683938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.378061Z","title":"K., Oh, S., and He, N","venue":null,"work_id":"bc1b529b-a99e-41d8-9d5b-9e9768b9ac28","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.687014Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:bec46e1c6c2f4865e35029ac1dce55687a43506dbda07d96b28b53e5975ab970","observation_id":"5b729103-da47-480e-b2cd-3dd4e3d335e0","resolution":{"observed_at":"2026-08-09T22:05:15.381145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14632","last_updated":"2024-04-17T04:16:15Z","snapshot_observed_at":"2026-07-06T16:52:00.070739Z","submitted_at":"2023-11-24T17:56:44Z","title":"Differentially Private SGD Without Clipping Bias: An Error-Feedback Approach","version":2},"cited_work":{"arxiv_id":"2311.14632","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.14632","snapshot_observed_at":"2026-08-09T22:05:15.141428Z","title":"Differentially Private SGD Without Clipping Bias: An Error-Feedback Approach","venue":"cs.LG","work_id":"25453eea-a3d9-4860-9c37-4eb9e4cb24c7","year":2023},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.689970Z"},"links":{"cited_paper":"/paper/2311.14632","citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:637fe25291df75517e0acba61f5b4f2824e92e6000cfb07fd6c54059d03f60b2","observation_id":"abae21ff-797f-45b8-98fd-2434ea18dcb5","resolution":{"observed_at":"2026-08-09T22:05:15.146944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.369862Z","title":"S., Salakhutdinov, R., Urtasun, R., Torralba, A., and Fidler, S","venue":null,"work_id":"7d92e224-a7ff-45b7-9cc3-f7bc2731c179","year":2015},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.693008Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:fb4683587f845742af2504b42a4efaaa762942901376f2d928ebec05540d632f","observation_id":"44fbaa5d-8587-44e2-bccd-921f83b75673","resolution":{"observed_at":"2026-08-09T22:05:15.372689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:15.361949Z","title":"T., Stieger, S., Feiner, L","venue":null,"work_id":"6ac70c19-a0cb-49c1-ba02-70d78aafce89","year":2024},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.695877Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:428fa19a8d49160c23b53c2a2e90abef2216fca5b4682e445fb05c73dd764107","observation_id":"c0cf2b95-fa0a-4822-aff9-116a852b705b","resolution":{"observed_at":"2026-08-09T22:05:15.364570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.698766Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.698766Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:a2a1ed8d2a09edc6e449897fc996b3a9de100875fa2d8fa0a6ee968aca0186a7","observation_id":"b3df63b0-23a1-4706-8995-da539e38e24a","resolution":{"observed_at":"2026-08-09T22:05:02.698766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.702159Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.702159Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:d43b3ad3b087981c559e452956a246d58377b8fdf06fd4f335453346d4a3508d","observation_id":"e0080499-9f74-4ca0-b91a-d6e54c28abda","resolution":{"observed_at":"2026-08-09T22:05:02.702159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:05:02.705232Z","title":"bG g6b嗍 3kQI @k /h m?hlKJڅ:| 4 j 2M^ ; Z ݄ hT2 !; & ȯ ɾD :] q u ` bcߩ -@n- e5 h v Vb?SHP r! 5 ШEw7wlQ # `K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-09T22:05:02.705232Z"},"links":{"citing_paper":"/paper/2501.18914"},"observation_digest":"sha256:8c09f94ca16f33d5a66075d400d893a0c8b06b0b6c3f99dfe27c91ba0be1d7ab","observation_id":"dd26519d-dd4f-4072-a1eb-9650c2524066","resolution":{"observed_at":"2026-08-09T22:05:02.705232Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.18914","last_updated":"2025-01-31T06:32:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T21:55:30.723303Z","submitted_at":"2025-01-31T06:32:46Z","title":"Scaling Laws for Differentially Private Language Models"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":2,"verified_fuzzy":46},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 3 inbound Pith citation observations for arXiv:2501.18914."}