{"as_of":"2026-08-08T19:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a6227e94f4de5276c8ac99ea7f7c744cacf81c8d0cb10fd55079041b5ae0fa8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":34,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:43:02.614781Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":7,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"reference_index":236,"source":"pdf_text","source_observed_at":"2026-05-10T22:46:39.268353Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2303.18223"},"observation_digest":"sha256:66529abddd46a2fae8b1d9695b59a06a1b4161caa53f0968aa59907411187e1d","observation_id":"c894b174-2f1a-4007-92fb-7003f519a3fe","resolution":{"observed_at":"2026-05-10T22:46:40.287347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T10:07:53.748795Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2309.12284"},"observation_digest":"sha256:2bbd6f944eceda17199e2532efbd91f53af1ce5753061693f723b81b30354c19","observation_id":"2cabdda0-928c-42f8-8775-028b8a8be8ec","resolution":{"observed_at":"2026-05-13T10:07:53.863501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2411.05527","last_updated":"2026-05-04T11:38:18Z","snapshot_observed_at":"2026-07-06T19:47:25.840369Z","submitted_at":"2024-11-08T12:35:58Z","title":"How Good is Your Wikipedia? Auditing Data Quality for Low-resource and Multilingual NLP","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-23T17:36:18.451771Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2411.05527"},"observation_digest":"sha256:887d0025ba2c6391f888e0bd61d196e385ba53071c401d5751264fda40cc3c7e","observation_id":"80cb290a-d72a-4454-980d-5e17b1e77046","resolution":{"observed_at":"2026-05-23T17:38:15.898675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2504.21850","last_updated":"2026-05-14T18:32:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T17:57:22Z","title":"Visual Compositional Tuning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T17:39:09.890605Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2504.21850"},"observation_digest":"sha256:3ce0b838ed6777ec56c350288e7329146e132e7547beb4e6c02392185a3e92ca","observation_id":"9fa03547-68b8-47b7-b02f-0e39ab57bd3c","resolution":{"observed_at":"2026-05-22T17:41:53.142850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T15:43:02.614781Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14070","last_updated":"2025-05-31T03:47:36Z","snapshot_observed_at":"2026-08-07T23:55:16.149811Z","submitted_at":"2025-05-20T08:21:37Z","title":"Enhancing LLMs via High-Knowledge Data Selection","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:43:02.614781Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.14070"},"observation_digest":"sha256:d43caa8f6334b8d6e3e63735ee52b81b28a3bb55f9c18c3fe25ff94d56d64bd9","observation_id":"58768ad4-65f5-4480-8f5d-e1fd7c9863c9","resolution":{"observed_at":"2026-08-07T15:43:02.614781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T15:08:26.725536Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16260","last_updated":"2025-05-22T05:50:19Z","snapshot_observed_at":"2026-08-07T15:02:27.864215Z","submitted_at":"2025-05-22T05:50:19Z","title":"Small-to-Large Generalization: Data Influences Models Consistently Across Scale","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T15:08:26.725536Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.16260"},"observation_digest":"sha256:4a826a56b47fd897711b9f3590f9b2c020c2ee4fb704f551af71c53540b983ec","observation_id":"d1e39d41-ff38-45d0-ba22-d7320806b40d","resolution":{"observed_at":"2026-08-07T15:08:26.725536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T15:06:45.356862Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16340","last_updated":"2025-05-22T07:54:39Z","snapshot_observed_at":"2026-08-08T14:37:48.265187Z","submitted_at":"2025-05-22T07:54:39Z","title":"Improving Chemical Understanding of LLMs via SMILES Parsing","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:06:45.356862Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.16340"},"observation_digest":"sha256:458a4ce313dae2f3552e5c67fcfee1ceb0ef2ed194d92db49181ec6e4f400f18","observation_id":"9d0b6135-a217-482e-9dbc-88e0d434b1f0","resolution":{"observed_at":"2026-08-07T15:06:45.356862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T14:33:13.502620Z","title":"Marion, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18458","last_updated":"2025-06-01T16:00:34Z","snapshot_observed_at":"2026-08-07T20:59:19.597449Z","submitted_at":"2025-05-24T01:57:12Z","title":"A Survey of LLM $\\times$ DATA","version":3},"reference_index":285,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:13.502620Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.18458"},"observation_digest":"sha256:2e875fff907d7d810ca7452f39c3814461f3808b1b27657c3160ac98a165fa66","observation_id":"7de29b8e-dede-49df-828d-71792f8cc102","resolution":{"observed_at":"2026-08-07T14:33:13.502620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T14:25:18.051571Z","title":"When less is more: Investigating data pruning for pretraining llms at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19051","last_updated":"2025-05-25T09:08:00Z","snapshot_observed_at":"2026-08-07T22:50:03.044224Z","submitted_at":"2025-05-25T09:08:00Z","title":"Efficient Data Selection at Scale via Influence Distillation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:25:18.051571Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.19051"},"observation_digest":"sha256:06688a3c8f15b6b7c1c2d43b0b58e57d3b67f8d4c1da5960b8a804981f0187ee","observation_id":"d619e2ab-6886-44f8-9a45-7f500f198bcc","resolution":{"observed_at":"2026-08-07T14:25:18.051571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T14:09:48.284205Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19893","last_updated":"2025-05-26T12:23:26Z","snapshot_observed_at":"2026-08-07T14:01:57.359586Z","submitted_at":"2025-05-26T12:23:26Z","title":"ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:09:48.284205Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.19893"},"observation_digest":"sha256:5a1a3bd6fc6c434d4cc26462f7f5f7183e7a85977be78cf04850be998214bcb2","observation_id":"ea4f463e-8f5a-43cf-a59f-4cf597277efc","resolution":{"observed_at":"2026-08-07T14:09:48.284205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T10:56:21.826147Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04015","last_updated":"2025-06-04T14:46:18Z","snapshot_observed_at":"2026-08-07T10:46:59.839970Z","submitted_at":"2025-06-04T14:46:18Z","title":"GORACS: Group-level Optimal Transport-guided Coreset Selection for LLM-based Recommender Systems","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:21.826147Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2506.04015"},"observation_digest":"sha256:a3d05dedc7eacd37fd4e9a0d741ea06eb20443688ed8a48870beeb8e29632cf6","observation_id":"b36ccb73-9dcf-40a7-b18e-44f33a2c34eb","resolution":{"observed_at":"2026-08-07T10:56:21.826147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T10:31:20.455874Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05447","last_updated":"2025-07-14T23:29:38Z","snapshot_observed_at":"2026-08-07T10:21:15.691562Z","submitted_at":"2025-06-05T15:18:35Z","title":"Training Dynamics Underlying Language Model Scaling Laws: Loss Deceleration and Zero-Sum Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:20.455874Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2506.05447"},"observation_digest":"sha256:1ec6576dab64def7609f60d388538af6e57114887fbba5dbb106568f6fd163ff","observation_id":"64bb2aec-abbc-4d16-aafe-645de5f60d18","resolution":{"observed_at":"2026-08-07T10:31:20.455874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-07T10:19:07.465093Z","title":"Marion, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05777","last_updated":"2025-06-06T06:14:55Z","snapshot_observed_at":"2026-08-08T13:34:22.949058Z","submitted_at":"2025-06-06T06:14:55Z","title":"Efficient dataset generation for machine learning perovskite alloys","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:07.465093Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2506.05777"},"observation_digest":"sha256:267aed68bd5d3088daa6fefc5ccc008f12efc02de2fee87ebd760a3adfccbe29","observation_id":"59f6abf4-afe3-47c3-a6ba-d8b95481c1ed","resolution":{"observed_at":"2026-08-07T10:19:07.465093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-06T20:15:24.011287Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03648","last_updated":"2025-07-04T15:25:04Z","snapshot_observed_at":"2026-08-06T20:02:40.466269Z","submitted_at":"2025-07-04T15:25:04Z","title":"Disentangling the Roles of Representation and Selection in Data Pruning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T20:15:24.011287Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2507.03648"},"observation_digest":"sha256:77b58cf48e01701121c5ed936eb73d98853ba97b3cabb2521deeed3d1f9d42f3","observation_id":"ca62f42a-f897-4865-96b0-edae64c870fa","resolution":{"observed_at":"2026-08-06T20:15:24.011287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-06T16:53:11.656872Z","title":"When less is more: Investigating data pruning for pretraining llms at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12466","last_updated":"2025-07-16T17:59:45Z","snapshot_observed_at":"2026-08-07T10:43:47.278118Z","submitted_at":"2025-07-16T17:59:45Z","title":"Language Models Improve When Pretraining Data Matches Target Tasks","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T16:53:11.656872Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2507.12466"},"observation_digest":"sha256:f74357ea6e2a680727fbdbccb246ca14d4481d3fa5e10be5be98973718c9737a","observation_id":"6d07eb10-06d0-43e4-8429-1cb456aa0180","resolution":{"observed_at":"2026-08-06T16:53:11.656872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T20:00:05.194995Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11551","last_updated":"2025-08-18T06:38:38Z","snapshot_observed_at":"2026-08-05T19:58:29.896587Z","submitted_at":"2025-08-15T15:53:09Z","title":"ADMIRE-BayesOpt: Accelerated Data MIxture RE-weighting for Language Models with Bayesian Optimization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:00:05.194995Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2508.11551"},"observation_digest":"sha256:3aac04e3015e5be49e862cbc386471f7699e742bb293871883a3ba6bbf57a64e","observation_id":"f1ed7484-fbb0-434d-9557-1e0cf813a131","resolution":{"observed_at":"2026-08-05T20:00:05.194995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2602.18584","last_updated":"2026-05-16T01:08:46Z","snapshot_observed_at":"2026-08-02T09:38:59.455163Z","submitted_at":"2026-02-20T19:44:24Z","title":"GIST: Targeted Data Selection for Instruction Tuning via Coupled Optimization Geometry","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T12:26:14.261351Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2602.18584"},"observation_digest":"sha256:619969d68bafd51024765f88eebcea45c16ca63b0fbfe1324e53b52da1ee2664","observation_id":"2e348e6e-7e5a-4f43-9d9d-a883ad6a9fef","resolution":{"observed_at":"2026-05-21T12:30:07.825970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-03T02:34:19.737306Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.17205","last_updated":"2026-07-30T22:57:15Z","snapshot_observed_at":"2026-08-07T16:20:57.572055Z","submitted_at":"2026-03-17T23:11:45Z","title":"OPERA: Online Data Pruning for Efficient Retrieval Model Adaptation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T02:34:19.737306Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2603.17205"},"observation_digest":"sha256:f34b06bd9e354754c291565e9f832abf47983d5c7e657df385816b7d95308d6a","observation_id":"02f8e2ee-dc95-42cb-a6ab-97b1549804ad","resolution":{"observed_at":"2026-08-03T02:34:19.737306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2604.02345","last_updated":"2026-02-11T17:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-11T17:02:38Z","title":"UI-Oceanus: Scaling GUI Agents with Synthetic Environmental Dynamics","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-16T02:59:27.807789Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2604.02345"},"observation_digest":"sha256:fc931358feed1201c11492d10fd1cc14d911751fc9686829b8251dee32f172cc","observation_id":"f79798d1-047b-49c3-a62f-082c3e17873d","resolution":{"observed_at":"2026-05-16T03:00:31.597557Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2604.07940","last_updated":"2026-04-09T08:00:22Z","snapshot_observed_at":"2026-07-06T22:57:09.435331Z","submitted_at":"2026-04-09T08:00:22Z","title":"A Systematic Framework for Tabular Data Disentanglement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:27:39.046005Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2604.07940"},"observation_digest":"sha256:ad11c5389a8a8d5f475bd0031e0c240b342ec1c940058dbee3b10df65c36c6d8","observation_id":"bec684eb-a500-4351-a15f-776c0af3754b","resolution":{"observed_at":"2026-05-11T00:30:55.343421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2604.11810","last_updated":"2026-04-09T14:08:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T14:08:01Z","title":"GRACE: A Dynamic Coreset Selection Framework for Large Language Model Optimization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T18:06:46.131725Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2604.11810"},"observation_digest":"sha256:24adc637909bdbaca2751c866eaf6dfe55f1f7fb3a98ae9f9dd594c1917419be","observation_id":"a3ddf1a1-2cb4-416e-b88d-752280d835eb","resolution":{"observed_at":"2026-05-10T20:30:49.021001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2604.17396","last_updated":"2026-04-19T11:59:58Z","snapshot_observed_at":"2026-08-01T18:23:32.699442Z","submitted_at":"2026-04-19T11:59:58Z","title":"Representation-Guided Parameter-Efficient LLM Unlearning","version":1},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-10T06:01:46.885030Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2604.17396"},"observation_digest":"sha256:bb9fcb3a19a307cf2b57fba901bd3f249cbd5c57576ca14e6f1f396c7da14abe","observation_id":"3a677dd1-e712-45c9-805e-2f19681436fb","resolution":{"observed_at":"2026-05-10T06:06:19.197284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2605.00369","last_updated":"2026-06-05T01:05:58Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T03:12:16Z","title":"InvEvolve: Evolving White-Box Inventory Policies via Large Language Models with Performance Guarantees","version":2},"reference_index":159,"source":"arxiv_source","source_observed_at":"2026-05-09T19:50:39.734124Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2605.00369"},"observation_digest":"sha256:aa174b61f7ebfa5f55cce6406b8593a1e0becb3ef62f50a39aab7c7d57297ad2","observation_id":"42d6e4f0-05f0-4d7e-b871-71d586e13301","resolution":{"observed_at":"2026-05-11T15:31:07.878353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2605.00369","last_updated":"2026-06-05T01:05:58Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T03:12:16Z","title":"InvEvolve: Evolving White-Box Inventory Policies via Large Language Models with Performance Guarantees","version":3},"reference_index":159,"source":"arxiv_source","source_observed_at":"2026-05-12T02:38:45.322351Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2605.00369"},"observation_digest":"sha256:15a90238f30c49a26ec6c9d180b3210eb579eb94c9e37fd7370a5af1546c7432","observation_id":"06f0d75f-3540-4396-bc2f-322592cb7c9d","resolution":{"observed_at":"2026-05-12T02:41:17.710831Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2605.05227","last_updated":"2026-04-19T14:23:23Z","snapshot_observed_at":"2026-08-02T14:54:36.818075Z","submitted_at":"2026-04-19T14:23:23Z","title":"Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T07:09:21.652035Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2605.05227"},"observation_digest":"sha256:452d0633f12c85cacea885407a11707882a3717772aec3e1be428c8b321f3033","observation_id":"9b194a4b-747d-408c-854b-b7680421d8ca","resolution":{"observed_at":"2026-05-10T07:11:53.392676Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2605.12906","last_updated":"2026-05-25T14:11:40Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T02:33:04Z","title":"Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-14T20:02:58.318276Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2605.12906"},"observation_digest":"sha256:5b6b77030c75d6ccb0d3ea3442228bda8bcf9005bc71f5f5fb39d90fb33fa8f7","observation_id":"b00f21c8-e6b6-4814-ac7b-59860a533759","resolution":{"observed_at":"2026-05-14T20:07:54.465343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2605.19762","last_updated":"2026-05-19T12:37:01Z","snapshot_observed_at":"2026-08-02T21:57:08.320932Z","submitted_at":"2026-05-19T12:37:01Z","title":"What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-20T05:06:46.360174Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2605.19762"},"observation_digest":"sha256:1c1c6b00184cdd84160c62da7c8d543c58ad98a4cbfc838393c9c54762edce1d","observation_id":"d5555e70-5a61-4bd6-98b2-0169e925a5cf","resolution":{"observed_at":"2026-05-20T05:08:05.057764Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2605.22389","last_updated":"2026-05-21T12:21:41Z","snapshot_observed_at":"2026-07-06T23:32:44.699825Z","submitted_at":"2026-05-21T12:21:41Z","title":"Unified Data Selection for LLM Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-22T05:33:20.930156Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2605.22389"},"observation_digest":"sha256:095ae09d10fa9a1f5291f4bf6fcdee013a68ecb1376383aeaf9ebc168edd16f3","observation_id":"db30ffd2-cf6e-4225-839f-d856a63944c6","resolution":{"observed_at":"2026-05-22T05:34:40.137379Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2605.28631","last_updated":"2026-05-27T15:38:09Z","snapshot_observed_at":"2026-07-06T23:38:09.179597Z","submitted_at":"2026-05-27T15:38:09Z","title":"Single-Rollout Hidden-State Dynamics for Training-Free RLVR Data Selection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T14:08:40.968105Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2605.28631"},"observation_digest":"sha256:dcfcd4b2e0d8b91a9a92be399eb1b6a2c09cba0896b74cacab8459aa51d5682b","observation_id":"ab1d612f-3fa9-44d0-923c-f018258698cf","resolution":{"observed_at":"2026-06-29T14:13:30.110956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2606.08574","last_updated":"2026-06-07T11:11:51Z","snapshot_observed_at":"2026-08-03T13:39:16.935988Z","submitted_at":"2026-06-07T11:11:51Z","title":"OrderDP: A Theoretically Guaranteed Lossless Dynamic Data Pruning Framework","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-06-27T18:26:32.883834Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2606.08574"},"observation_digest":"sha256:b2275664e02498cdfb7a58b49860d2b3cada16b6517409f143580dc852aa5d7d","observation_id":"9977346f-1710-4a74-a843-032e2e0f72e6","resolution":{"observed_at":"2026-07-02T23:07:27.218492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2606.23611","last_updated":"2026-06-22T17:11:15Z","snapshot_observed_at":"2026-07-06T23:58:20.975630Z","submitted_at":"2026-06-22T17:11:15Z","title":"Data Selection Through Iterative Self-Filtering for Vision-Language Settings","version":1},"reference_index":195,"source":"arxiv_source","source_observed_at":"2026-06-26T09:22:47.537137Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2606.23611"},"observation_digest":"sha256:d4b62a5605ad43b3416e25132ec7a34ad5611973177bf50a1bac19a1c241e78d","observation_id":"8b75c3a5-0934-4ce1-a63d-ccd01945265c","resolution":{"observed_at":"2026-07-04T09:49:44.946514Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2606.24998","last_updated":"2026-06-23T16:02:40Z","snapshot_observed_at":"2026-07-31T12:51:11.444875Z","submitted_at":"2026-06-23T16:02:40Z","title":"Internal Data Repetition Destroys Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-26T00:12:56.745617Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2606.24998"},"observation_digest":"sha256:e7b90f96fff198da95ac9b85ee4ff2566eef39148233693bc0e0ca114471a36e","observation_id":"ddfb4caa-9c82-4503-86fc-8301fe8837a6","resolution":{"observed_at":"2026-07-04T16:49:57.884375Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":"2309.04564","doi":"10.48550/arxiv.2309.04564","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When less is more: Investigating data pruning for pretraining llms at scale.arXiv preprint arXiv:2309.04564","venue":"arXiv (Cornell University)","work_id":"cc2c01ad-f12f-43a3-ac00-8df29526cffd","year":2023},"citing_paper":{"arxiv_id":"2606.26091","last_updated":"2026-06-24T17:59:02Z","snapshot_observed_at":"2026-08-02T03:35:37.854415Z","submitted_at":"2026-06-24T17:59:02Z","title":"On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity","version":1},"reference_index":216,"source":"arxiv_source","source_observed_at":"2026-06-25T19:23:56.452083Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2606.26091"},"observation_digest":"sha256:8601d33a0e33a6a8bf99f8d28fd45779b0aa77e027f6a4d11311c16bd6c0ce29","observation_id":"870d7ae7-8728-4ea3-8419-a661c6fd1a08","resolution":{"observed_at":"2026-07-04T20:50:12.707543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-07-31T11:19:34.319148Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24585","last_updated":"2026-07-27T15:51:41Z","snapshot_observed_at":"2026-08-07T13:03:57.696225Z","submitted_at":"2026-07-27T15:51:41Z","title":"From Data to Device: ELMOD An Efficient German-First 2.7B Language Model for Mobile Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T11:19:34.319148Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2607.24585"},"observation_digest":"sha256:abbfa877e99e5416d9f35d7718566a0e5fb16bbcc18764965a49ea977025a4cd","observation_id":"94a9d6c8-a587-4be7-8fed-9f93f61025bc","resolution":{"observed_at":"2026-07-31T11:19:34.319148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2309.04564/citation-record","integrity":"/paper/2309.04564/integrity","json":"/paper/2309.04564/citation-record.json","paper":"/paper/2309.04564"},"outbound":[],"paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T03:50:04.516601Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 34 inbound Pith citation observations for arXiv:2309.04564."}