{"as_of":"2026-08-09T23:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:90e43f23573889e3eee4f1ea2680ab2a50f01fb81ff439efb29acfc3a500de08","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T23:02:23.296216Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:49:17.695166Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2308.12067","last_updated":"2026-04-12T14:13:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-23T11:27:30Z","title":"MM-LIMA: Less Is More for Alignment in Multi-Modal Datasets","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T08:13:18.191233Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2308.12067"},"observation_digest":"sha256:ded5ff8ed79e6034ebdac7d41a551d9807e0fa2105fc3127af566e13641160fa","observation_id":"42bb65dc-b14d-4987-9e6b-99e210376ade","resolution":{"observed_at":"2026-05-24T08:14:10.175046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T14:21:16.453610Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2309.01219"},"observation_digest":"sha256:7be477bbec618dd2e49e7bc2b1cecde14bf1fbef8fb02431aeccce612036bfe1","observation_id":"d84fe3e4-cad7-4bb8-9fc6-41793cf5e71c","resolution":{"observed_at":"2026-05-12T14:21:16.542943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-09T23:02:23.296216Z","title":"Instruction mining: Instruction data selection for tuning large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18578","last_updated":"2025-02-26T18:58:53Z","snapshot_observed_at":"2026-08-09T22:54:35.062212Z","submitted_at":"2025-01-30T18:50:25Z","title":"R.I.P.: Better Models by Survival of the Fittest Prompts","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T23:02:23.296216Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2501.18578"},"observation_digest":"sha256:7ae5f1483cd4396f0fbcc99493a3f31f9a39b7aa1b7a961ad399f8308315e7f3","observation_id":"65176a91-5dcc-4722-b4a0-f3a9ef0a97c1","resolution":{"observed_at":"2026-08-09T23:02:23.296216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-08T13:07:08.294764Z","title":"Preprint, arXiv:2307.06290","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07340","last_updated":"2025-05-26T03:01:06Z","snapshot_observed_at":"2026-08-09T02:52:12.629952Z","submitted_at":"2025-02-11T08:05:56Z","title":"Aligning Large Language Models to Follow Instructions and Hallucinate Less via Effective Data Filtering","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T13:07:08.294764Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2502.07340"},"observation_digest":"sha256:bbb9ed88e6be1fa4567fa0e8da904bc1442769f5f0efdfd8e370e1f41e1f81bb","observation_id":"9b416675-eaf6-433e-b784-3d726aaf998a","resolution":{"observed_at":"2026-08-08T13:07:08.294764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-08T04:54:50.582249Z","title":"Instruction mining: Instruction data selection for tuning large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08512","last_updated":"2025-08-14T07:15:48Z","snapshot_observed_at":"2026-08-09T13:56:26.887562Z","submitted_at":"2025-02-12T15:46:34Z","title":"Measuring Diversity in Synthetic Datasets","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T04:54:50.582249Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2502.08512"},"observation_digest":"sha256:4b1aefe5cd68ef8334df9cb49602ec7dc8aceaedcbe3b1cd9462d0dacdb40ff7","observation_id":"ee8b96bc-0712-46a4-a494-6b2c784d719b","resolution":{"observed_at":"2026-08-08T04:54:50.582249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-08T11:57:11.728183Z","title":"Instruction mining: When data mining meets large language model finetuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.728183Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:1a2be15e62802604107814344e4c3922b9011c6114aeec087f7bd27debbd98c9","observation_id":"4fe5805a-6445-47aa-b221-09d44d6ab5f2","resolution":{"observed_at":"2026-08-08T11:57:11.728183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2503.07557","last_updated":"2026-05-02T15:43:17Z","snapshot_observed_at":"2026-08-03T10:34:14.204884Z","submitted_at":"2025-03-10T17:27:17Z","title":"AutoSpatial: Visual-Language Reasoning for Social Robot Navigation through Efficient Spatial Reasoning Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-23T00:26:58.273861Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2503.07557"},"observation_digest":"sha256:3dae5dbd40264b436b495196e8d2dd3a5bb0d21adca5069131a1ad6a34bd23bc","observation_id":"663ff74e-816e-4d2d-b2e6-29d3f9ee6239","resolution":{"observed_at":"2026-05-23T00:27:17.816053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T15:09:33.588670Z","title":"Instruction mining: Instruction data selection for tuning large language models.arXiv preprint arXiv:2307.06290, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16066","last_updated":"2025-05-21T22:34:13Z","snapshot_observed_at":"2026-08-09T02:51:38.941026Z","submitted_at":"2025-05-21T22:34:13Z","title":"Merge to Mix: Mixing Datasets via Model Merging","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:33.588670Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.16066"},"observation_digest":"sha256:3af999f3a92274abfbf4a3e0673c1e066929fb04a4a7c197f6328b591e7a30b1","observation_id":"19e4d153-5cdb-476e-96c9-1d8cd985172b","resolution":{"observed_at":"2026-08-07T15:09:33.588670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:58:32.633147Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16849","last_updated":"2025-05-28T07:44:23Z","snapshot_observed_at":"2026-08-07T14:51:51.125807Z","submitted_at":"2025-05-22T16:11:35Z","title":"Walk&Retrieve: Simple Yet Effective Zero-shot Retrieval-Augmented Generation via Knowledge Graph Walks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:32.633147Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.16849"},"observation_digest":"sha256:2cc16124e7d5e0e1e1bde16bce6dd94baeb6954c320888c360a332352ed60e91","observation_id":"11863cfa-4401-49d1-bde0-355e87d328c5","resolution":{"observed_at":"2026-08-07T14:58:32.633147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:33:12.899936Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18458","last_updated":"2025-06-01T16:00:34Z","snapshot_observed_at":"2026-08-07T20:59:19.597449Z","submitted_at":"2025-05-24T01:57:12Z","title":"A Survey of LLM $\\times$ DATA","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:12.899936Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.18458"},"observation_digest":"sha256:4d187ca74dc22e3a9401f8315f492b397ea289afdbd09fbe709c6a08ee4a8d36","observation_id":"16e7db2c-f332-4fa9-bbe5-5e83e1d9133f","resolution":{"observed_at":"2026-08-07T14:33:12.899936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:32:13.530356Z","title":"Hyung Won Chung, Le Hou, Shayne Longpre, Bar- ret Zoph, Yi Tay, William Fedus, Yunxuan Li, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18557","last_updated":"2025-06-02T11:00:28Z","snapshot_observed_at":"2026-08-09T02:50:31.207477Z","submitted_at":"2025-05-24T06:51:03Z","title":"TAG-INSTRUCT: Controlled Instruction Complexity Enhancement through Structure-based Augmentation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:13.530356Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.18557"},"observation_digest":"sha256:03f4c8fb89d93fcc2e60c74e30ff4a5fb235cec04aee43efb7ac78741eb6d6e0","observation_id":"99126653-6042-4339-a9fe-071207acb0c2","resolution":{"observed_at":"2026-08-07T14:32:13.530356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:25:21.464252Z","title":"Instruction mining: Instruction data selection for tuning large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19051","last_updated":"2025-05-25T09:08:00Z","snapshot_observed_at":"2026-08-09T05:25:51.050878Z","submitted_at":"2025-05-25T09:08:00Z","title":"Efficient Data Selection at Scale via Influence Distillation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:25:21.464252Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.19051"},"observation_digest":"sha256:0dd6cbf5c3cf9106966d4b8c324c82574e81d3b6b82b6bfc0ea727d55e26217b","observation_id":"4553c525-29a0-4827-8eaf-0364a95e7b86","resolution":{"observed_at":"2026-08-07T14:25:21.464252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:00:29.600015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20416","last_updated":"2025-05-26T18:06:50Z","snapshot_observed_at":"2026-08-09T17:46:50.873415Z","submitted_at":"2025-05-26T18:06:50Z","title":"GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:00:29.600015Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.20416"},"observation_digest":"sha256:eb0386923950b5310eb8f7f4b741c96f27eb2bedee170c0a2b3ee819c6fbc7dc","observation_id":"c2e9f62e-708f-4c21-84bc-ea1c79d19ced","resolution":{"observed_at":"2026-08-07T14:00:29.600015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:55:35.093796Z","title":"Instruction mining: High-quality instruc- tion data selection for large language models.arXiv preprint arXiv:2307.06290, 1(3):6, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-09T02:50:04.519855Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.093796Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ca57dac962690daa1703cb7816fd175791bda229b737e8e67330344e20183279","observation_id":"dcf1a6d7-877f-4d33-8226-a98385e3554e","resolution":{"observed_at":"2026-08-07T04:55:35.093796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:37:06.226403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.226403Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:3fb70fc0f35b6018eb6ed049dd362e3cdb465919bb277f976cec368c0e521922","observation_id":"08b7ce6f-70e8-4e2e-a172-63c699e58f94","resolution":{"observed_at":"2026-08-07T04:37:06.226403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2605.05227","last_updated":"2026-04-19T14:23:23Z","snapshot_observed_at":"2026-08-09T11:52:43.386505Z","submitted_at":"2026-04-19T14:23:23Z","title":"Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T07:09:21.652035Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2605.05227"},"observation_digest":"sha256:9dd755ae34f95bd6d83f4fcdab0174bdcd9ff200e9008b9c43ae94e76dc5ce35","observation_id":"6f4c6a3d-937d-4a27-aa13-7b627447d7d4","resolution":{"observed_at":"2026-05-10T07:11:53.337299Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2605.07063","last_updated":"2026-05-08T00:16:11Z","snapshot_observed_at":"2026-07-31T19:38:37.065573Z","submitted_at":"2026-05-08T00:16:11Z","title":"Dr. Post-Training: A Data Regularization Perspective on LLM Post-Training","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-11T01:57:40.347786Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2605.07063"},"observation_digest":"sha256:80161b0b783beca8e39bcea54f8abadc5c03e0156051f24f4a4bf04a3c154651","observation_id":"c5140b54-8b76-4bc2-b6de-0770784267e3","resolution":{"observed_at":"2026-05-11T04:05:56.776981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2606.07690","last_updated":"2026-06-05T06:31:43Z","snapshot_observed_at":"2026-08-05T05:05:33.849870Z","submitted_at":"2026-06-05T06:31:43Z","title":"HARP: Efficient Data Selection for Finetuning Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T22:49:48.330530Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2606.07690"},"observation_digest":"sha256:119124aa8577b89d1bc26f6fa622c0e5206e1ae09de6dae676acc6db8bc89bbd","observation_id":"8fb8b7cc-7eab-476a-8ced-be9e00067922","resolution":{"observed_at":"2026-07-02T16:17:09.376334Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2606.08574","last_updated":"2026-06-07T11:11:51Z","snapshot_observed_at":"2026-08-03T13:39:16.935988Z","submitted_at":"2026-06-07T11:11:51Z","title":"OrderDP: A Theoretically Guaranteed Lossless Dynamic Data Pruning Framework","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-06-27T18:26:32.883834Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2606.08574"},"observation_digest":"sha256:24092027091e9580488b0f082ba89e5fa9100aecd7d92bedcd4f40192f2ecb2e","observation_id":"23a3e80d-cb90-470b-b2e4-916a38cdbe6e","resolution":{"observed_at":"2026-07-02T23:07:27.187260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2606.19549","last_updated":"2026-06-17T19:40:51Z","snapshot_observed_at":"2026-08-02T14:09:04.600861Z","submitted_at":"2026-06-17T19:40:51Z","title":"Predicting Mergeability of Parameter-Efficient Fine-Tuning Updates","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-26T21:01:04.043286Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2606.19549"},"observation_digest":"sha256:b862bc4c6907ae0f7d464da71f2bf42c0e2c2ffbd334a90133759500dd45cd87","observation_id":"c43ee3e2-8d64-4b29-9e90-8c920ad234a8","resolution":{"observed_at":"2026-07-04T00:49:17.697551Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-01T13:54:03.003356Z","title":"Instruction mining: High-quality instruction data selection for large language models.arXiv preprint arXiv:2307.06290, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18960","last_updated":"2026-07-21T10:52:04Z","snapshot_observed_at":"2026-08-06T12:53:41.666185Z","submitted_at":"2026-07-21T10:52:04Z","title":"SFGA: A Statistics-First Gating Architecture with Adjudicative Escalation for Trustworthy SFT Data Procurement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:54:03.003356Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2607.18960"},"observation_digest":"sha256:75952b6ad344789a8f2f14d08827e3849c754d8e9d0e0f0a469122bbe37295a8","observation_id":"fbf07f84-e4e4-41be-85f1-9f0fef4c3c2c","resolution":{"observed_at":"2026-08-01T13:54:03.003356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2307.06290/citation-record","integrity":"/paper/2307.06290/integrity","json":"/paper/2307.06290/citation-record.json","paper":"/paper/2307.06290"},"outbound":[],"paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2307.06290."}