{"as_of":"2026-08-09T10:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fbba0c138ab4b546d884dbbfd194e829c400e43bb6138118db2508b4149bdb53","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T06:19:33.724551Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22769/citation-record","integrity":"/paper/2607.22769/integrity","json":"/paper/2607.22769/citation-record.json","paper":"/paper/2607.22769"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:19:32.099580Z","title":"Nemotron-climb: Clustering-based iterative data mixture optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:32.099580Z"},"links":{"citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:c84345451412732956e42e197d6c94aacc43fd405bac1fd3b3bd9464f25d1275","observation_id":"3652de58-bbaa-4d06-8d5d-c3d3c0f48d4c","resolution":{"observed_at":"2026-08-01T06:19:32.099580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-01T06:19:32.223883Z","title":"Training compute-optimal large language models.arXiv preprint arXiv:2203.15556, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:32.223883Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:d5b86e16a4a3e949560b355ae023bd105946d7d6efc1929ed624ae91c331d3a7","observation_id":"ac5b3502-6737-4d99-b71a-6e35bc680979","resolution":{"observed_at":"2026-08-01T06:19:32.223883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-01T06:19:32.464859Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:32.464859Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:4613056e4d558ec1cd31d0d8889839f1f17171de61cc13448c108a748005a421","observation_id":"70f937f4-19c3-4b23-9a72-22cd41637be1","resolution":{"observed_at":"2026-08-01T06:19:32.464859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07965","last_updated":"2025-01-08T09:07:54Z","snapshot_observed_at":"2026-08-07T08:00:00.868748Z","submitted_at":"2024-04-11T17:52:01Z","title":"Rho-1: Not All Tokens Are What You Need","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07965","snapshot_observed_at":"2026-08-01T06:19:32.644746Z","title":"Rho-1: Not all tokens are what you need.arXiv preprint arXiv:2404.07965, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:32.644746Z"},"links":{"cited_paper":"/paper/2404.07965","citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:231db3ad10bd4cabfd21b54d1c872ad6fd4c9e917616a620c5a0425cd019eb94","observation_id":"eef586f3-1521-4934-b262-7cb4f560ebc5","resolution":{"observed_at":"2026-08-01T06:19:32.644746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:19:32.754745Z","title":"Scalebio: Scalable bilevel optimization for llm data reweighting.Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:32.754745Z"},"links":{"citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:5a138d5b8f4449599e43fe6d70824afdd231cf072c876ab74316d039e445d55a","observation_id":"f7098e97-af5e-4fc8-a46f-93f300adc2d8","resolution":{"observed_at":"2026-08-01T06:19:32.754745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-01T06:19:32.909831Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism.arXiv preprint arXiv:1909.08053, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:32.909831Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:d30f96e8681b0152887841f0c1226fb1a064e7a456f1792d8e76a3d1442f006a","observation_id":"c45f3513-2912-4ade-820f-f20ce1a27d97","resolution":{"observed_at":"2026-08-01T06:19:32.909831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:19:33.024740Z","title":"Qurating: Select- ing high-quality data for training language models.International Conference on Machine Learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.024740Z"},"links":{"citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:87b217c7e26515a362704221f5f15fbe9e4adb4b8b046ca16a5040341316985d","observation_id":"875e4b27-41d0-41de-a15c-9e8403d60a23","resolution":{"observed_at":"2026-08-01T06:19:33.024740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-07T17:47:02.067367Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-01T06:19:33.174874Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.174874Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:e1cbdd4b7e8a0fa37dc6a9e1744a7d8cf5fd977bdc650da0d2ccc2603db3bfe9","observation_id":"c2c8288b-7575-47fa-8bed-2d1642d7603f","resolution":{"observed_at":"2026-08-01T06:19:33.174874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:19:33.305650Z","title":"Data selection for language models via importance resampled mcmc.Advances in Neural Information Processing Systems, 36, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.305650Z"},"links":{"citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:173666aa246b97674a69b7905ccd8ba99de680e3a83bf37a46a2ef114f8a4d7a","observation_id":"24290403-1671-403d-af9b-c749768a8733","resolution":{"observed_at":"2026-08-01T06:19:33.305650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:19:33.392135Z","title":"Doremi: Optimizing data mixtures speeds up language model pretraining.Advances in Neural Information Processing Systems, 36, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.392135Z"},"links":{"citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:1148a5240d6fdb53eb85f071825d9b55ca3ff7e8f2a03f24d1c6fd2e79c7cbc2","observation_id":"5915e398-61dc-40ce-88ee-7d05e39ceffd","resolution":{"observed_at":"2026-08-01T06:19:33.392135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:19:33.624844Z","title":"Dataflex: A unified framework for data-centric dynamic training of large language models.arXiv preprint arXiv:2603.26164, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.624844Z"},"links":{"citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:d4a2df2453e38e46c48f4a54a4024f45efa04691cf56b5bd142f54896aa9d017","observation_id":"cffd2bca-5698-486b-95d8-a2832d153890","resolution":{"observed_at":"2026-08-01T06:19:33.624844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-01T06:19:33.724551Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models.arXiv preprint arXiv:2403.13372, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.724551Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:dcfddef17fae89f338115e8f8c5350d7ca45a87251d6a3add9217331bbd43e5d","observation_id":"3478ff6d-deba-4dae-bcd6-0b7517a56165","resolution":{"observed_at":"2026-08-01T06:19:33.724551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T05:05:03.937121Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.22769."}