{"as_of":"2026-08-20T13:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4886884f9131c32bf2b076fb3020bc61eeae21c0d002d4d4360690dc6c951b9b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:19:58.308118Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":"2406.03476","doi":"10.48550/arxiv.2406.03476","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., Owen, S., and Fran- kle, J","venue":"arXiv (Cornell University)","work_id":"efc95c99-f81f-450a-8792-bbcb7bfdd5c7","year":2024},"citing_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T14:16:23.842092Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2408.03314"},"observation_digest":"sha256:e267771cfd4376fd5e81c21ef823cd29e560c9fe366e2b95874d0555cb892646","observation_id":"4b726d53-b9a7-4127-8c27-be1661a25895","resolution":{"observed_at":"2026-05-10T14:16:23.871304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-12T21:22:21.968196Z","title":"Larsen, Sean Owen, and Jonathan Frankle","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08968","last_updated":"2024-11-13T19:02:36Z","snapshot_observed_at":"2026-08-16T16:38:20.297580Z","submitted_at":"2024-11-13T19:02:36Z","title":"Sparse Upcycling: Inference Inefficient Finetuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T21:22:21.968196Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2411.08968"},"observation_digest":"sha256:77e417271743799460aacd7fec5a16e2af23340396446fd047e02e62193157d9","observation_id":"467abb9f-7e07-48f1-9caa-70d1911afc01","resolution":{"observed_at":"2026-08-12T21:22:21.968196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-12T15:04:38.090863Z","title":"Does your data spark joy? performance gains from domain upsampling at the end of training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15242","last_updated":"2024-11-22T02:55:20Z","snapshot_observed_at":"2026-08-14T05:08:15.609977Z","submitted_at":"2024-11-22T02:55:20Z","title":"The Zamba2 Suite: Technical Report","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T15:04:38.090863Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2411.15242"},"observation_digest":"sha256:895bba74958984dd4554088659dc846fda6c1c3486bbf96899dd052d0ede1d65","observation_id":"659a3b3d-41c5-458b-888d-a765d68b6739","resolution":{"observed_at":"2026-08-12T15:04:38.090863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-12T13:41:46.008379Z","title":"Larsen, Sean Owen, and Jonathan Frankle","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16035","last_updated":"2024-11-25T01:48:09Z","snapshot_observed_at":"2026-08-18T21:43:07.540889Z","submitted_at":"2024-11-25T01:48:09Z","title":"Predicting Emergent Capabilities by Finetuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T13:41:46.008379Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2411.16035"},"observation_digest":"sha256:4d6970759d1ca0b38b0e9a6b5238506fc58a998fcdbfd596428f931de5608283","observation_id":"f125af7e-c2cb-4f1d-a55a-23303004c79e","resolution":{"observed_at":"2026-08-12T13:41:46.008379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-11T12:34:16.582789Z","title":"Larsen, Sean Owen, and Jonathan Frankle","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15285","last_updated":"2024-12-18T18:41:18Z","snapshot_observed_at":"2026-08-18T23:32:05.050971Z","submitted_at":"2024-12-18T18:41:18Z","title":"Maximize Your Data's Potential: Enhancing LLM Accuracy with Two-Phase Pretraining","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T12:34:16.582789Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2412.15285"},"observation_digest":"sha256:22e88ca68fea137ecf774d6ca98850c154fe656c2d309b4f208c2a72c85899f4","observation_id":"21b24c9f-bd47-4fc1-94be-9f92fd042679","resolution":{"observed_at":"2026-08-11T12:34:16.582789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":"2406.03476","doi":"10.48550/arxiv.2406.03476","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., Owen, S., and Fran- kle, J","venue":"arXiv (Cornell University)","work_id":"efc95c99-f81f-450a-8792-bbcb7bfdd5c7","year":2024},"citing_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-14T05:03:05.661970Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"reference_index":153,"source":"arxiv_source","source_observed_at":"2026-05-13T17:30:02.803757Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2502.02737"},"observation_digest":"sha256:baf310eb2cb261fbab7859e83d0ae4279c012c6fe818b6803ee29d453cbd2b0f","observation_id":"9908adf4-4096-4377-88ab-dfefffa41465","resolution":{"observed_at":"2026-05-13T17:30:02.919309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-16T12:19:58.308118Z","title":"Does your data spark joy? performance gains from domain upsampling at the end of training.arXiv preprint arXiv:2406.03476, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13161","last_updated":"2025-11-30T07:03:40Z","snapshot_observed_at":"2026-08-16T12:11:22.940380Z","submitted_at":"2025-04-17T17:58:13Z","title":"Nemotron-CLIMB: CLustering-based Iterative Data Mixture Bootstrapping for Language Model Pre-training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:58.308118Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2504.13161"},"observation_digest":"sha256:b1636b1957e4013307d3fc80742d6c618c1f2da952e5c42e180e0b035a58838a","observation_id":"d7f67488-3497-43c0-ac96-5969e1a0362f","resolution":{"observed_at":"2026-08-16T12:19:58.308118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-16T11:32:05.839964Z","title":"Blakeney, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15431","last_updated":"2025-04-21T20:54:44Z","snapshot_observed_at":"2026-08-16T11:24:41.443927Z","submitted_at":"2025-04-21T20:54:44Z","title":"Trillion 7B Technical Report","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T11:32:05.839964Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2504.15431"},"observation_digest":"sha256:e9ff21d26e302ce66f8e49151459d68b619f68f892e287731913b61f4c2e7ac6","observation_id":"3e7ade0a-6bfe-48a3-9f91-44de13f1efe8","resolution":{"observed_at":"2026-08-16T11:32:05.839964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-16T05:53:58.298711Z","title":"Does your data spark joy? performance gains from domain upsampling at the end of training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21039","last_updated":"2025-04-28T08:41:12Z","snapshot_observed_at":"2026-08-17T19:11:29.399446Z","submitted_at":"2025-04-28T08:41:12Z","title":"Llama-3.1-FoundationAI-SecurityLLM-Base-8B Technical Report","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:53:58.298711Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2504.21039"},"observation_digest":"sha256:54c4e371d6b9c21da148a571d09b3ceb094fc57d54b32532a229bb6dbacd3a15","observation_id":"49e8d926-f6a0-448f-9652-59849d6ca6eb","resolution":{"observed_at":"2026-08-16T05:53:58.298711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-06T16:53:08.641036Z","title":"Does your data spark joy? performance gains from domain upsampling at the end of training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12466","last_updated":"2025-07-16T17:59:45Z","snapshot_observed_at":"2026-08-19T19:30:29.233194Z","submitted_at":"2025-07-16T17:59:45Z","title":"Language Models Improve When Pretraining Data Matches Target Tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:53:08.641036Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2507.12466"},"observation_digest":"sha256:9ac5cb63e366addb2b917fea2988afe67c46cb01ddee5e6f2c7f6967ed7fc3dd","observation_id":"85b25a7e-3f1d-495e-8096-3eae7485d039","resolution":{"observed_at":"2026-08-06T16:53:08.641036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-06T14:20:37.130182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19586","last_updated":"2025-07-25T18:00:21Z","snapshot_observed_at":"2026-08-18T19:38:49.643527Z","submitted_at":"2025-07-25T18:00:21Z","title":"Mitigating Geospatial Knowledge Hallucination in Large Language Models: Benchmarking and Dynamic Factuality Aligning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T14:20:37.130182Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2507.19586"},"observation_digest":"sha256:825b10385bd915b703a67fd4d299b976ca230c5da09e8b90d0c63c2ffd5e1bb4","observation_id":"74aa8a65-a88f-4f57-9561-59f90caca0d5","resolution":{"observed_at":"2026-08-06T14:20:37.130182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-06T11:59:52.159243Z","title":"Does your data spark joy? performance gains from domain upsampling at the end of training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22250","last_updated":"2025-07-29T21:56:45Z","snapshot_observed_at":"2026-08-06T11:59:51.689888Z","submitted_at":"2025-07-29T21:56:45Z","title":"Using Scaling Laws for Data Source Utility Estimation in Domain-Specific Pre-Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:59:52.159243Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2507.22250"},"observation_digest":"sha256:cde2c135ca1652cec400dfe77924841f330ece5b4438851104c24d3b815989e5","observation_id":"7f6c5223-f9ce-42a6-b4ba-59cf61fbcb53","resolution":{"observed_at":"2026-08-06T11:59:52.159243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-15T17:21:06.619163Z","title":"Larsen, Sean Owen, and Jonathan Frankle","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13144","last_updated":"2025-08-18T17:56:04Z","snapshot_observed_at":"2026-08-18T03:59:35.024516Z","submitted_at":"2025-08-18T17:56:04Z","title":"Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:21:06.619163Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2508.13144"},"observation_digest":"sha256:462f610958a4d8e99f1e949004df5afa089b307b2255426154dd92e807c26ac2","observation_id":"b1035626-9902-496a-8b1b-58858639b199","resolution":{"observed_at":"2026-08-15T17:21:06.619163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":"2406.03476","doi":"10.48550/arxiv.2406.03476","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., Owen, S., and Fran- kle, J","venue":"arXiv (Cornell University)","work_id":"efc95c99-f81f-450a-8792-bbcb7bfdd5c7","year":2024},"citing_paper":{"arxiv_id":"2603.08022","last_updated":"2026-05-06T03:36:45Z","snapshot_observed_at":"2026-08-12T13:46:02.406167Z","submitted_at":"2026-03-09T06:58:00Z","title":"Capacity-Aware Mixture Law Enables Efficient LLM Data Optimization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T14:23:30.849350Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2603.08022"},"observation_digest":"sha256:dbe6b0a8f1420a4e178b788f5ca54b25a5e706b898b389d8f9631bd6bc5736c8","observation_id":"10471077-be80-4b32-8815-0f9a3c91879a","resolution":{"observed_at":"2026-05-15T14:25:55.364976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":"2406.03476","doi":"10.48550/arxiv.2406.03476","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., Owen, S., and Fran- kle, J","venue":"arXiv (Cornell University)","work_id":"efc95c99-f81f-450a-8792-bbcb7bfdd5c7","year":2024},"citing_paper":{"arxiv_id":"2605.00072","last_updated":"2026-04-30T11:50:32Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T11:50:32Z","title":"XekRung Technical Report","version":1},"reference_index":131,"source":"arxiv_source","source_observed_at":"2026-05-09T20:55:10.400291Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2605.00072"},"observation_digest":"sha256:e245088ff5205e005e662cc7551b04f30558edd4391deb609e329350e6b8ae7b","observation_id":"204710eb-0e69-413c-a64c-10445399cc8d","resolution":{"observed_at":"2026-05-09T20:58:06.753264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":"2406.03476","doi":"10.48550/arxiv.2406.03476","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., Owen, S., and Fran- kle, J","venue":"arXiv (Cornell University)","work_id":"efc95c99-f81f-450a-8792-bbcb7bfdd5c7","year":2024},"citing_paper":{"arxiv_id":"2605.05365","last_updated":"2026-05-06T18:44:08Z","snapshot_observed_at":"2026-08-16T18:16:47.637991Z","submitted_at":"2026-05-06T18:44:08Z","title":"ZAYA1-8B Technical Report","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-08T17:36:37.182196Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2605.05365"},"observation_digest":"sha256:75871b19096e83680517b299a58116233206e586bcaa01dce1777bdd02ed4938","observation_id":"99f9b5a6-5603-49a0-a6b5-dad88d268d48","resolution":{"observed_at":"2026-05-11T17:26:05.244182Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":"2406.03476","doi":"10.48550/arxiv.2406.03476","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., Owen, S., and Fran- kle, J","venue":"arXiv (Cornell University)","work_id":"efc95c99-f81f-450a-8792-bbcb7bfdd5c7","year":2024},"citing_paper":{"arxiv_id":"2606.24320","last_updated":"2026-06-25T20:48:22Z","snapshot_observed_at":"2026-07-06T23:58:54.018557Z","submitted_at":"2026-06-23T08:57:34Z","title":"ZONOS2 Technical Report","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-25T22:37:15.072758Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2606.24320"},"observation_digest":"sha256:29f503c3aa3c8e3907178942e613f94b5fd6ea87fd6a5b0c8056a5b7dfc94ee6","observation_id":"09f8cd8d-2ed9-45bc-add9-9ad360d989f0","resolution":{"observed_at":"2026-07-04T18:40:03.309291Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":"2406.03476","doi":"10.48550/arxiv.2406.03476","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W., Owen, S., and Fran- kle, J","venue":"arXiv (Cornell University)","work_id":"efc95c99-f81f-450a-8792-bbcb7bfdd5c7","year":2024},"citing_paper":{"arxiv_id":"2606.24320","last_updated":"2026-06-25T20:48:22Z","snapshot_observed_at":"2026-07-06T23:58:54.018557Z","submitted_at":"2026-06-23T08:57:34Z","title":"ZONOS2 Technical Report","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-29T02:07:31.791835Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2606.24320"},"observation_digest":"sha256:179afc35188b3e130a8e985a226ef29d65943c4d6075cad7dba7a01b8a77c2de","observation_id":"2c859aab-7803-4f7e-9145-6dbf68aa80d6","resolution":{"observed_at":"2026-07-01T18:15:59.001887Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03476","snapshot_observed_at":"2026-08-01T09:51:50.318054Z","title":"arXiv preprint arXiv:2406.03476 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27308","last_updated":"2026-07-29T17:49:04Z","snapshot_observed_at":"2026-08-05T10:53:49.344314Z","submitted_at":"2026-07-29T17:49:04Z","title":"ZUNA1.1: A more flexible EEG foundation model for Denoising and Super-resolution","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T09:51:50.318054Z"},"links":{"cited_paper":"/paper/2406.03476","citing_paper":"/paper/2607.27308"},"observation_digest":"sha256:a11496702e03d021eb7dec6b2d2b5686b734d95b2ed904ac2b1ab878f1462708","observation_id":"87328ef2-e8f0-430c-a537-27814a2311e2","resolution":{"observed_at":"2026-08-01T09:51:50.318054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.03476/citation-record","integrity":"/paper/2406.03476/integrity","json":"/paper/2406.03476/citation-record.json","paper":"/paper/2406.03476"},"outbound":[],"paper":{"arxiv_id":"2406.03476","last_updated":"2024-06-05T17:29:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T20:50:06.838406Z","submitted_at":"2024-06-05T17:29:15Z","title":"Does your data spark joy? Performance gains from domain upsampling at the end of training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2406.03476."}