{"as_of":"2026-08-11T01:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77a9dea75394c30c00a8b18423c6c2117e729f6ea83d9ff35ee98113890a1b97","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:36:50.562805Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:34:48.903774Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T16:34:48.928876Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.18182","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.18182","snapshot_observed_at":"2026-08-05T16:34:48.928876Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","venue":"cs.LG","work_id":"afd54600-c7a0-422c-b76e-84666e19f61d","year":2025},"citing_paper":{"arxiv_id":"2508.18181","last_updated":"2025-08-25T16:35:07Z","snapshot_observed_at":"2026-08-05T16:34:36.377149Z","submitted_at":"2025-08-25T16:35:07Z","title":"What is digital about abstraction?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T16:34:48.903774Z"},"links":{"cited_paper":"/paper/2508.18182","citing_paper":"/paper/2508.18181"},"observation_digest":"sha256:1e1a7f724e052140472e788025d23942a7d06b03d8e3ed8b4ed4f76c10bc15d1","observation_id":"b6c6a4f1-e616-49e0-8f72-f3d0dca0b319","resolution":{"observed_at":"2026-08-05T16:34:48.933802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.18182/citation-record","integrity":"/paper/2508.18182/integrity","json":"/paper/2508.18182/citation-record.json","paper":"/paper/2508.18182"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1710.11258","last_updated":"2017-10-30T22:01:56Z","snapshot_observed_at":"2026-08-10T17:28:24.758029Z","submitted_at":"2017-10-30T22:01:56Z","title":"Adaptive Sampling Strategies for Stochastic Optimization","version":1},"cited_work":{"arxiv_id":"1710.11258","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.11258","snapshot_observed_at":"2026-08-05T16:36:50.824857Z","title":"Adaptive Sampling Strategies for Stochastic Optimization","venue":"math.OC","work_id":"372f31bf-4f45-446c-bb7b-29720b6e7944","year":2017},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.489347Z"},"links":{"cited_paper":"/paper/1710.11258","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:0cf8637c935619e22c1829f4548c8610d7251d95b757a9e11a96f3827e4eea0f","observation_id":"9a9cfdc2-1215-45c2-89a2-0b9529789fc4","resolution":{"observed_at":"2026-08-05T16:36:50.830712Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.940026Z","title":"Byrd, Gillian M","venue":null,"work_id":"85eaca41-64fa-4da9-b589-914a400b51ac","year":2012},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.496519Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:aba6df88bdd271f5aaf1aedb648b92f1b0cd3711d0ec0f05ddedf39868f44dab","observation_id":"0dedbaec-4bce-41b4-bc00-a316b222f390","resolution":{"observed_at":"2026-08-05T16:36:50.949350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08105","last_updated":"2024-09-23T10:41:27Z","snapshot_observed_at":"2026-08-04T10:53:01.395272Z","submitted_at":"2023-11-14T12:05:45Z","title":"DiLoCo: Distributed Low-Communication Training of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08105","snapshot_observed_at":"2026-08-05T16:36:50.502069Z","title":"Rusu, Rachita Chhaparia, Yani Donchev, Adhiguna Kuncoro, Marc'Aurelio Ranzato, Arthur Szlam, and Jiajun Shen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.502069Z"},"links":{"cited_paper":"/paper/2311.08105","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:dbb89748efdbb181915a6b5ee8a8fa1007a9429315fd5a79cc32683960384e25","observation_id":"d20fa830-0265-4a0b-8cef-3700bff4f7c1","resolution":{"observed_at":"2026-08-05T16:36:50.502069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.910657Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":"fe1962a4-1940-4f27-9438-5e2c4cd784b3","year":2011},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.510950Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:4a7112f9313a1baf8d9ab28237020db63e03302b6116de8f40de609b8810b431","observation_id":"c2240402-f84f-4bff-bf6b-e03ee30bc0a8","resolution":{"observed_at":"2026-08-05T16:36:50.919427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13936","last_updated":"2024-11-06T04:53:36Z","snapshot_observed_at":"2026-08-10T17:28:19.334956Z","submitted_at":"2024-06-20T02:08:50Z","title":"Communication-Efficient Adaptive Batch Size Strategies for Distributed Local Gradient Methods","version":2},"cited_work":{"arxiv_id":"2406.13936","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13936","snapshot_observed_at":"2026-08-05T16:36:50.766291Z","title":"Communication-Efficient Adaptive Batch Size Strategies for Distributed Local Gradient Methods","venue":"stat.ML","work_id":"0b4c497e-a631-497b-aba4-06bc6b0e1e78","year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.517083Z"},"links":{"cited_paper":"/paper/2406.13936","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:262fb271b6b7b6734a5273e96420e6672c18dde126560527d6e19b81e349b8bf","observation_id":"f3fb0a2d-5752-45f3-9c02-a9c011bdbc33","resolution":{"observed_at":"2026-08-05T16:36:50.775729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11215","last_updated":"2024-05-28T05:40:38Z","snapshot_observed_at":"2026-08-04T06:40:34.301575Z","submitted_at":"2024-02-17T07:49:50Z","title":"AdAdaGrad: Adaptive Batch Size Schemes for Adaptive Gradient Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11215","snapshot_observed_at":"2026-08-05T16:36:50.522929Z","title":"Adadagrad: Adaptive batch size schemes for adaptive gradient methods, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.522929Z"},"links":{"cited_paper":"/paper/2402.11215","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:e4eb11c0749898f56d499295b8e2415f51b8a550e62e9d077aa281a9215c420d","observation_id":"d73c9710-d506-4114-b18f-8aad88581f0c","resolution":{"observed_at":"2026-08-05T16:36:50.522929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09767","last_updated":"2019-05-03T12:58:04Z","snapshot_observed_at":"2026-07-06T06:41:03.009337Z","submitted_at":"2018-05-24T16:38:51Z","title":"Local SGD Converges Fast and Communicates Little","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09767","snapshot_observed_at":"2026-08-05T16:36:50.529584Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.529584Z"},"links":{"cited_paper":"/paper/1805.09767","citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:e730b92ab57cc799b063ad2119be0294a0974d75c29d38cae72d025c6b41680f","observation_id":"d83783d3-33d3-4d47-a3f5-abf2197918f1","resolution":{"observed_at":"2026-08-05T16:36:50.529584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.888954Z","title":"Microllama: A 300m-parameter language model trained from scratch","venue":null,"work_id":"4c118e9f-8122-4962-a09e-1b07e81369c9","year":2024},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.535734Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:9ca5fad17bacb367e5422f648e31b30a7154e02141170fdc9f7ade6a22e0ea43","observation_id":"34121115-5456-4696-b72b-d4227cc888ed","resolution":{"observed_at":"2026-08-05T16:36:50.895404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.540026Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.540026Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:4581fa604f3fde9f4ab7dbc6da5b360ad22674f9fc0e877bd9d70200bc74d76a","observation_id":"adfcd00d-5c64-48d2-aabc-d841230d7e95","resolution":{"observed_at":"2026-08-05T16:36:50.540026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.548224Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.548224Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:b9f2a5eb43ff8dc751d63fd16446a8187863b403b185c7c8b30ddac22c52f1c2","observation_id":"e49ff0ef-618d-4131-afdd-51cb07683ae7","resolution":{"observed_at":"2026-08-05T16:36:50.548224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.556449Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.556449Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:d29d81bee8f3f3ed7ad651d1246e54978e525c0046638eb6e346e9b8af287355","observation_id":"b8ab24f6-bb8d-4714-b057-87857e9d4efd","resolution":{"observed_at":"2026-08-05T16:36:50.556449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:36:50.562805Z","title":"7 x4f [ @w떆d bQ̪̺;Y̬7","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:36:50.562805Z"},"links":{"citing_paper":"/paper/2508.18182"},"observation_digest":"sha256:452a811e9ca96c5b74eb9ddd30186e08c5707ae41496622d34b2a96cdd51ff04","observation_id":"8c0c3f3f-decd-42c1-9808-1e904f37d80c","resolution":{"observed_at":"2026-08-05T16:36:50.562805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.18182","last_updated":"2025-08-25T16:35:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T16:36:35.157558Z","submitted_at":"2025-08-25T16:35:57Z","title":"AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2508.18182."}