{"as_of":"2026-08-17T08:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7742a33477989efba6de238feb5baceee13110f0687b23885f00845920f5d319","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:06:07.508201Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:48:39.942516Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":"2406.14833","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-07-03T16:48:39.942516Z","title":null,"venue":null,"work_id":"a442239c-47d3-43a5-8580-eda90156ddae","year":2024},"citing_paper":{"arxiv_id":"2409.04777","last_updated":"2026-05-20T09:55:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-07T09:37:19Z","title":"Optimization Hyper-parameter Laws for Large Language Models","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T20:45:31.427677Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2409.04777"},"observation_digest":"sha256:92cf6be73793683096a5d99981692053ee29aa8f416b8fadef264a7266857e1f","observation_id":"dec96b09-c71c-48d9-a0f1-9a0f712cd44f","resolution":{"observed_at":"2026-05-23T20:45:48.778583Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-08-07T11:10:15.091522Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03320","last_updated":"2025-06-03T19:06:41Z","snapshot_observed_at":"2026-08-17T00:30:22.493711Z","submitted_at":"2025-06-03T19:06:41Z","title":"The Future of Continual Learning in the Era of Foundation Models: Three Key Directions","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:10:15.091522Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2506.03320"},"observation_digest":"sha256:10dbebb7ea5bca2ea80737ab7879fe92e1ac08cf4a9ca9933b49149b5164e4bf","observation_id":"a42defd7-f98c-40cd-839d-3fa84c799b59","resolution":{"observed_at":"2026-08-07T11:10:15.091522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-08-07T10:50:51.076830Z","title":"Efficient continual pre-training by mitigating the stability gap, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04344","last_updated":"2025-06-04T18:02:07Z","snapshot_observed_at":"2026-08-15T22:24:29.920738Z","submitted_at":"2025-06-04T18:02:07Z","title":"GEM: Empowering LLM for both Embedding Generation and Language Understanding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:51.076830Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2506.04344"},"observation_digest":"sha256:9ddb0e7aa0152eef557413139c69b1281f896932687281d82240610675ee9808","observation_id":"340dc06a-e7c4-4e88-9387-69b785d2b744","resolution":{"observed_at":"2026-08-07T10:50:51.076830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-08-07T00:40:21.272531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13045","last_updated":"2025-08-24T10:01:04Z","snapshot_observed_at":"2026-08-17T00:43:34.316284Z","submitted_at":"2025-06-16T02:27:25Z","title":"Continual Learning for Generative AI: From LLMs to MLLMs and Beyond","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:21.272531Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2506.13045"},"observation_digest":"sha256:f25d108b0ef1c89896480d9e9a031c3546bb951c1430093f9c33744873427a73","observation_id":"4867052f-09b6-4810-be3d-e025bb1f628c","resolution":{"observed_at":"2026-08-07T00:40:21.272531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-08-15T19:06:07.508201Z","title":"Effi- cient continual pre-training by mitigating the stability gap,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17818","last_updated":"2025-06-21T21:16:39Z","snapshot_observed_at":"2026-08-16T18:35:15.088798Z","submitted_at":"2025-06-21T21:16:39Z","title":"CultureMERT: Continual Pre-Training for Cross-Cultural Music Representation Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T19:06:07.508201Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2506.17818"},"observation_digest":"sha256:41cacc98b91e43368e8e435f3d244401dac17a44ac26f3ea0a53c1f5c4625369","observation_id":"0387c68a-b223-46fb-92cf-3ceee8d9a9d6","resolution":{"observed_at":"2026-08-15T19:06:07.508201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-08-06T21:36:31.547787Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23762","last_updated":"2025-06-30T12:09:29Z","snapshot_observed_at":"2026-08-13T08:27:18.830708Z","submitted_at":"2025-06-30T12:09:29Z","title":"Software Engineering for Large Language Models: Research Status, Challenges and the Road Ahead","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-06T21:36:31.547787Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2506.23762"},"observation_digest":"sha256:2cd2ce3bab8925716a3a92956704db8b784283ad827128a84a6d88af945b0c01","observation_id":"b8f9e692-7090-4f16-bf3d-56e60fc6b099","resolution":{"observed_at":"2026-08-06T21:36:31.547787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":"2406.14833","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-07-03T16:48:39.942516Z","title":null,"venue":null,"work_id":"a442239c-47d3-43a5-8580-eda90156ddae","year":2024},"citing_paper":{"arxiv_id":"2606.24901","last_updated":"2026-06-12T13:44:48Z","snapshot_observed_at":"2026-08-03T03:21:51.293576Z","submitted_at":"2026-06-12T13:44:48Z","title":"LLM Evolution as an Industry-Scale Ecosystem: A Lifecycle Perspective on Continual Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T05:02:18.347642Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2606.24901"},"observation_digest":"sha256:4074141ee35736d1a52397d243abdd0e9a8b58d73f1808ee8f124074c793d75d","observation_id":"e37e0564-2e73-4d13-ad28-1408eaa64f4b","resolution":{"observed_at":"2026-07-03T16:48:39.943850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-07-14T08:04:06.432613Z","title":"arXiv preprint arXiv:2406.14833 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10959","last_updated":"2026-07-12T23:24:42Z","snapshot_observed_at":"2026-08-03T13:16:14.672928Z","submitted_at":"2026-07-12T23:24:42Z","title":"WSqD: A Horizon-Free Learning Rate Schedule for Large Model Training","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-14T08:04:06.432613Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2607.10959"},"observation_digest":"sha256:250ef7ff0018b1e6d367d910deec2e88beba9a38cfb1b0eb7f7e03df52e74667","observation_id":"208cfa66-0cc2-4c6d-925f-0c2d559ff9b5","resolution":{"observed_at":"2026-07-14T08:04:06.432613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14833","snapshot_observed_at":"2026-08-01T10:18:18.914771Z","title":"32 The Blessing of Dimensionality Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20301","last_updated":"2026-07-22T15:48:39Z","snapshot_observed_at":"2026-08-14T21:59:39.658009Z","submitted_at":"2026-07-22T15:48:39Z","title":"The Blessing of Dimensionality: How Near-Orthogonality in High-Dimensional Spaces Explains Temporal Portability","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T10:18:18.914771Z"},"links":{"cited_paper":"/paper/2406.14833","citing_paper":"/paper/2607.20301"},"observation_digest":"sha256:f09754767d48a83ca54387bc32ad22991019bc3230227df56011d51dd7669926","observation_id":"d9f21a8e-6e5e-4158-acd6-8b11db393d89","resolution":{"observed_at":"2026-08-01T10:18:18.914771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.14833/citation-record","integrity":"/paper/2406.14833/integrity","json":"/paper/2406.14833/citation-record.json","paper":"/paper/2406.14833"},"outbound":[],"paper":{"arxiv_id":"2406.14833","last_updated":"2024-06-27T08:11:01Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:40:53.239170Z","submitted_at":"2024-06-21T02:28:37Z","title":"Efficient Continual Pre-training by Mitigating the Stability Gap"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2406.14833."}