{"as_of":"2026-08-09T19:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f444ade04767659fda51dfed010ee440836de5fdcf51c8491cf4eac3d7bde1e8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:27:57.460128Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T06:15:58.988295Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-09T14:27:57.460128Z","title":"Task-adaptive pretrained language models via clustered-importance sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01804","last_updated":"2025-02-03T20:33:20Z","snapshot_observed_at":"2026-08-09T14:21:38.248358Z","submitted_at":"2025-02-03T20:33:20Z","title":"Soup-of-Experts: Pretraining Specialist Models via Parameters Averaging","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T14:27:57.460128Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2502.01804"},"observation_digest":"sha256:4d0ea9a4228b4ec09cae5dcd670913400aff9fad560ecacfb86decc381f5aa38","observation_id":"b08e76ba-e5e0-4789-ae2f-033f557d9885","resolution":{"observed_at":"2026-08-09T14:27:57.460128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-07T14:04:22.901349Z","title":"Task-adaptive pretrained language models via clustered-importance sampling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20380","last_updated":"2025-05-26T17:32:14Z","snapshot_observed_at":"2026-08-09T06:26:18.435852Z","submitted_at":"2025-05-26T17:32:14Z","title":"GRAPE: Optimize Data Mixture for Group Robust Multi-target Adaptive Pretraining","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:04:22.901349Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2505.20380"},"observation_digest":"sha256:4e1be459b25c2b92bd9835a8344ec41b7ac4cd51f8b7fb82844b6717745ca2ae","observation_id":"4514bdcb-4843-496a-b304-2ba5fc63bd0c","resolution":{"observed_at":"2026-08-07T14:04:22.901349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-07T00:42:57.732570Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12966","last_updated":"2025-06-15T21:08:51Z","snapshot_observed_at":"2026-08-08T21:39:58.375574Z","submitted_at":"2025-06-15T21:08:51Z","title":"Assessing the Role of Data Quality in Training Bilingual Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:57.732570Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2506.12966"},"observation_digest":"sha256:0628ec2384f85ccd1cb5e868a542212de98c2db891e508690341f5c0face84a9","observation_id":"74951000-d1e7-44b6-bd03-72c9a584ee1f","resolution":{"observed_at":"2026-08-07T00:42:57.732570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-06T16:53:10.133518Z","title":"Task-adaptive pretrained language models via clustered-importance sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12466","last_updated":"2025-07-16T17:59:45Z","snapshot_observed_at":"2026-08-09T12:12:41.025897Z","submitted_at":"2025-07-16T17:59:45Z","title":"Language Models Improve When Pretraining Data Matches Target Tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:53:10.133518Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2507.12466"},"observation_digest":"sha256:d4681972c6a117525a2021755c404160b40c8f709ce7cae3c16021ef4f8ba946","observation_id":"14fd87ce-5af6-49d7-b84b-84a018c74bc3","resolution":{"observed_at":"2026-08-06T16:53:10.133518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-04T13:24:14.800183Z","title":"Task-adaptive pretrained language models via clustered- importance sampling.arXiv preprint arXiv:2410.03735,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.00866","last_updated":"2026-06-24T09:23:10Z","snapshot_observed_at":"2026-08-08T07:37:11.965093Z","submitted_at":"2025-10-01T13:15:15Z","title":"Removing Noise, not Finding Gold: Quality Filtering for Large-Scale Pretraining","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:24:14.800183Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2510.00866"},"observation_digest":"sha256:be3dfce2ce532b8c017cbfbd0a897a9203aa8b1051ace25f08d7d94b4ce15e7a","observation_id":"c1f66cfd-4456-4ec6-a630-ddb72b9ecda1","resolution":{"observed_at":"2026-08-04T13:24:14.800183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-03T04:17:27.132962Z","title":"Task-adaptive pretrained language models via clustered-importance sampling.arXiv preprint arXiv:2410.03735, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05547","last_updated":"2026-08-05T16:57:37Z","snapshot_observed_at":"2026-08-08T23:12:50.234380Z","submitted_at":"2026-02-05T11:06:37Z","title":"Multi-Task GRPO: Reliable LLM Reasoning Across Tasks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:17:27.132962Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2602.05547"},"observation_digest":"sha256:15e48a456bb62e86f709ef5d56cc8a1225c58671e7350240b6f44f853f077452","observation_id":"7feaa412-33a7-44f7-a1d9-a6d5bbc3e356","resolution":{"observed_at":"2026-08-03T04:17:27.132962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":"2410.03735","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task-adaptive pretrained language models via clustered-importance sampling","venue":null,"work_id":"7dad0764-e693-4d01-adf8-d839d2128171","year":2024},"citing_paper":{"arxiv_id":"2604.08519","last_updated":"2026-04-09T17:55:50Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:55:50Z","title":"Cram Less to Fit More: Training Data Pruning Improves Memorization of Facts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-10T17:42:31.465077Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2604.08519"},"observation_digest":"sha256:3129a63949fdb14857879687ad5ffac2966ed13323bd79fccb24146392e216df","observation_id":"c2274be3-db88-4413-88b3-69a1ca1e5520","resolution":{"observed_at":"2026-05-11T06:15:58.990203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.03735/citation-record","integrity":"/paper/2410.03735/integrity","json":"/paper/2410.03735/citation-record.json","paper":"/paper/2410.03735"},"outbound":[],"paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T06:27:43.634379Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2410.03735."}