{"as_of":"2026-08-08T22:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca86632e18b8f5499c93eff1118f66ece21ebbf4b93d53bb0f5994cf05bf8392","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:07:31.713925Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T23:24:01.963863Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2409.04777","last_updated":"2026-05-20T09:55:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-07T09:37:19Z","title":"Optimization Hyper-parameter Laws for Large Language Models","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-23T20:45:31.427677Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2409.04777"},"observation_digest":"sha256:fb262e5656d008d90ae048ee0124745a835da078c3a8a3f522efe8d73c96af93","observation_id":"921063f1-6e6e-4ce5-8f3d-19c5d5d8f569","resolution":{"observed_at":"2026-05-23T20:45:48.948200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-07T15:07:31.713925Z","title":"Preprint, arXiv:2302.03241","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17140","last_updated":"2025-05-22T06:48:33Z","snapshot_observed_at":"2026-08-07T15:01:48.603757Z","submitted_at":"2025-05-22T06:48:33Z","title":"Data Doping or True Intelligence? Evaluating the Transferability of Injected Knowledge in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:07:31.713925Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2505.17140"},"observation_digest":"sha256:d4176422451b4469b5f1c112db49c96db83d1e339722db30aee6fc13cb440bf2","observation_id":"ad19ebae-2d5a-4a6e-bb41-d08380558b00","resolution":{"observed_at":"2026-08-07T15:07:31.713925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-07T14:41:37.342138Z","title":"Continual pre-training of language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.342138Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:a0e06293dc523e7f9d22024268433747f90bcce2b03b0aa2fc912a62b4b95126","observation_id":"73ddad87-78bb-4a09-a9e0-731211447055","resolution":{"observed_at":"2026-08-07T14:41:37.342138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-07T11:56:54.880750Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06347","last_updated":"2025-06-01T20:50:43Z","snapshot_observed_at":"2026-08-07T23:14:32.486974Z","submitted_at":"2025-06-01T20:50:43Z","title":"Unified Game Moderation: Soft-Prompting and LLM-Assisted Label Transfer for Resource-Efficient Toxicity Detection","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:54.880750Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2506.06347"},"observation_digest":"sha256:4f58e78c5ad6082e2df43c4326af904749c1d9a885a4ba9e95ddcaabc1ee1181","observation_id":"5474a7be-41a2-4b96-b427-2c51bf97229d","resolution":{"observed_at":"2026-08-07T11:56:54.880750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-07T00:40:23.861194Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13045","last_updated":"2025-08-24T10:01:04Z","snapshot_observed_at":"2026-08-08T06:33:39.031465Z","submitted_at":"2025-06-16T02:27:25Z","title":"Continual Learning for Generative AI: From LLMs to MLLMs and Beyond","version":4},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:23.861194Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2506.13045"},"observation_digest":"sha256:faeeeacc4aab67a0606acb209764d1320ebd5699ea4ea73af33bd32a88d9c211","observation_id":"9249228c-1fdd-4188-b2ac-11b50a54c596","resolution":{"observed_at":"2026-08-07T00:40:23.861194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-06T21:20:09.647212Z","title":"Continual pre-training of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00469","last_updated":"2025-07-01T06:28:57Z","snapshot_observed_at":"2026-08-07T08:41:36.700355Z","submitted_at":"2025-07-01T06:28:57Z","title":"Bisecle: Binding and Separation in Continual Learning for Video Language Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:20:09.647212Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2507.00469"},"observation_digest":"sha256:087214288e53ca8185ffb8cbe91758ca47b0c8f16cb3c0e9124c667e14584139","observation_id":"c3a28d15-4050-4a44-a6d8-1de3b97291e5","resolution":{"observed_at":"2026-08-06T21:20:09.647212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-06T16:29:47.708700Z","title":"Continual pre-training of language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13499","last_updated":"2025-07-17T19:11:00Z","snapshot_observed_at":"2026-08-07T12:37:34.668398Z","submitted_at":"2025-07-17T19:11:00Z","title":"AI-Assisted Fixes to Code Review Comments at Scale","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:29:47.708700Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2507.13499"},"observation_digest":"sha256:471f1611c8ffc9193c09baacc5a2e717bcaa03aea7be4232a4d32783d2c420ba","observation_id":"e439bcc1-23b8-4871-a4ca-dbc8711b2e83","resolution":{"observed_at":"2026-08-06T16:29:47.708700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2509.07177","last_updated":"2026-04-14T15:07:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-08T19:48:52Z","title":"Towards EnergyGPT: A Large Language Model Specialized for the Energy Sector","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T17:39:17.456350Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2509.07177"},"observation_digest":"sha256:746e38ddce4323f692c0387b7713d81f2a209f91b25794ca69def557569bd1c9","observation_id":"72de1ada-a28b-4c56-aa12-d5c0e60c7a24","resolution":{"observed_at":"2026-05-18T17:42:47.455682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2509.17183","last_updated":"2026-04-08T01:32:04Z","snapshot_observed_at":"2026-08-02T13:27:11.357272Z","submitted_at":"2025-09-21T18:06:05Z","title":"LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-18T14:46:45.598080Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2509.17183"},"observation_digest":"sha256:51b2cc1d512b9df689005324b51c565bcdac769e139295cf6182471a535f1bcb","observation_id":"911fdbd9-5e8c-43f8-aa34-e0a881a701ff","resolution":{"observed_at":"2026-05-18T14:51:30.401187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2601.16175","last_updated":"2026-02-05T18:03:03Z","snapshot_observed_at":"2026-08-01T10:41:29.420510Z","submitted_at":"2026-01-22T18:24:00Z","title":"Learning to Discover at Test Time","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T05:16:04.001700Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2601.16175"},"observation_digest":"sha256:58763a64af9e0bb1230d5c5fdf022e49cf75821c1b4f074801f1b5475bdbe905","observation_id":"e65f9345-c86b-4de6-9f95-d43377b06f5c","resolution":{"observed_at":"2026-05-16T05:16:04.138617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2601.21577","last_updated":"2026-05-13T07:33:05Z","snapshot_observed_at":"2026-08-02T00:23:43.845967Z","submitted_at":"2026-01-29T11:42:30Z","title":"Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T09:34:23.475942Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2601.21577"},"observation_digest":"sha256:7f07321d78ca4dd96de8f3b4cb85021c58c6598b3c13fc54c37cda79ef7a9567","observation_id":"ae411208-6855-4ce0-93bb-4518282acf59","resolution":{"observed_at":"2026-05-16T09:37:41.664096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-02T18:36:58.134724Z","title":"Continual pre-training of language models.arXiv preprint arXiv:2302.03241,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.00004","last_updated":"2026-07-23T07:35:13Z","snapshot_observed_at":"2026-08-03T08:52:32.473253Z","submitted_at":"2026-03-09T10:51:01Z","title":"LinearARD: Linear-Memory Attention Distillation for RoPE Restoration","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T18:36:58.134724Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2604.00004"},"observation_digest":"sha256:15a8499723d8f3650b7c4d054bc0238414c4c3016d210f66f9ad93f122aeb66f","observation_id":"24e3ec75-1195-4eac-84a1-ad6c5708bdbb","resolution":{"observed_at":"2026-08-02T18:36:58.134724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2605.05776","last_updated":"2026-05-07T07:09:03Z","snapshot_observed_at":"2026-07-06T23:18:22.301347Z","submitted_at":"2026-05-07T07:09:03Z","title":"HEDP: A Hybrid Energy-Distance Prompt-based Framework for Domain Incremental Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-08T11:25:01.780099Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2605.05776"},"observation_digest":"sha256:42a41bc1049946c20a4d98683166e2fe5a48b639d57285b13d17899c688fa65b","observation_id":"1a5d88d4-be8b-4722-9808-66c2265a11b0","resolution":{"observed_at":"2026-05-11T19:36:15.049738Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2605.10640","last_updated":"2026-05-11T14:28:02Z","snapshot_observed_at":"2026-07-06T23:22:32.858399Z","submitted_at":"2026-05-11T14:28:02Z","title":"Towards Understanding Continual Factual Knowledge Acquisition of Language Models: From Theory to Algorithm","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-12T04:47:54.466097Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2605.10640"},"observation_digest":"sha256:43dc93479cddc905c4064dbcac146ea7689fde23a6a742e8e5a335899a3460c7","observation_id":"55306f03-a062-40a7-b64f-62c43e096524","resolution":{"observed_at":"2026-05-12T05:56:25.597688Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2605.15156","last_updated":"2026-05-20T17:53:38Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:51:34Z","title":"MeMo: Memory as a Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T03:17:23.202604Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2605.15156"},"observation_digest":"sha256:de6b2901d360c876b5d5f4efbe32cc233b2a9507eee78eb956b710db109cb131","observation_id":"f42279f7-5a37-4751-8db8-b59e099fcdc3","resolution":{"observed_at":"2026-05-15T03:19:43.393031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2605.15156","last_updated":"2026-05-20T17:53:38Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:51:34Z","title":"MeMo: Memory as a Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T08:36:31.022046Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2605.15156"},"observation_digest":"sha256:9c787dc85c0fe4593f589ea71eefc2e00a5c083fe72f24d72e93521f97361954","observation_id":"e5d8e25b-7f4b-4b5a-84c9-9a33b867ef17","resolution":{"observed_at":"2026-05-21T08:39:53.612682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2605.20296","last_updated":"2026-05-19T11:01:39Z","snapshot_observed_at":"2026-08-03T21:35:51.861909Z","submitted_at":"2026-05-19T11:01:39Z","title":"Spectral Unforgetting: Post-Hoc Recovery of Damaged Capabilities Without Retraining","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T07:49:13.043266Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2605.20296"},"observation_digest":"sha256:fb0e9ef0331bb9ffdb77bc539cd1fd05884f57fcd38d67505f0ddceb02ad32c7","observation_id":"74830d9e-524c-4ee6-909d-e17a937d0c3b","resolution":{"observed_at":"2026-05-21T07:49:49.898714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":"2302.03241","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-06-29T23:24:01.963863Z","title":"Continual pre-training of language models","venue":null,"work_id":"85c35e72-3c51-4386-adfd-a807084c08df","year":2023},"citing_paper":{"arxiv_id":"2605.26097","last_updated":"2026-05-25T17:54:34Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:54:34Z","title":"Forgetting in Language Models: Capacity, Optimization, and Self-Generated Replay","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T23:15:45.174086Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2605.26097"},"observation_digest":"sha256:d72a10e563915349a58f33f5415f1f7a0b690cdb6dda44df964810d2f2194401","observation_id":"a63f0fc3-a9dc-4d0f-8893-f6a0ea715761","resolution":{"observed_at":"2026-06-29T23:24:01.965352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-02T15:39:37.977391Z","title":"Continual pre-training of language models.arXiv:2302.03241,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11889","last_updated":"2026-07-17T09:32:58Z","snapshot_observed_at":"2026-08-08T09:40:05.908022Z","submitted_at":"2026-04-24T17:00:53Z","title":"Scaling Point-in-Time Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T15:39:37.977391Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2607.11889"},"observation_digest":"sha256:53dcd5c5fa00dda4bbd3b76539e01ca2eb2621d637014dac7119d5c31178c473","observation_id":"a6e68a9f-f59c-4174-9689-4b9adf2fb501","resolution":{"observed_at":"2026-08-02T15:39:37.977391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-01T04:45:23.593279Z","title":"https://arxiv.org/abs/2302.03241","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22468","last_updated":"2026-07-24T16:32:40Z","snapshot_observed_at":"2026-08-01T04:45:12.108475Z","submitted_at":"2026-07-24T16:32:40Z","title":"Learning to Prepare Molecular Ground States with Transformer Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T04:45:23.593279Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2607.22468"},"observation_digest":"sha256:aa92b19df4cb9227708b1da3121023e1d0da33d02423fd9dbd862712b578a0df","observation_id":"89c1bf4c-5c67-45d0-a258-d09e19262ba6","resolution":{"observed_at":"2026-08-01T04:45:23.593279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.03241/citation-record","integrity":"/paper/2302.03241/integrity","json":"/paper/2302.03241/citation-record.json","paper":"/paper/2302.03241"},"outbound":[],"paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2302.03241."}