{"as_of":"2026-08-21T17:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4bedfd5f637cb7f3f38a8d9d14622c476573fa805bb75d561800d4f81669d359","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:59:05.807268Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.03004/citation-record","integrity":"/paper/2507.03004/integrity","json":"/paper/2507.03004/citation-record.json","paper":"/paper/2507.03004"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.10832","last_updated":"2022-10-10T20:20:12Z","snapshot_observed_at":"2026-08-18T00:14:11.444362Z","submitted_at":"2021-10-21T00:08:17Z","title":"Ensemble of Averages: Improving Model Selection and Boosting Performance in Domain Generalization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.10832","snapshot_observed_at":"2026-08-06T20:59:03.016155Z","title":"Ensemble of averages: Im- proving model selection and boosting performance in domain generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.016155Z"},"links":{"cited_paper":"/paper/2110.10832","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:7721a04f977de63605171fcfeac7ed35db04e09452f7b3be03d2dccc78fc7d1b","observation_id":"aaec66fd-bc79-4ffc-8a35-33da17352c3a","resolution":{"observed_at":"2026-08-06T20:59:03.016155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:09.308222Z","title":"Swad: Domain generalization by seeking flat minima","venue":null,"work_id":"886e2702-11ca-4fc2-9abc-57759243786f","year":2021},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.086726Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:67e3b78d789351562e13f2c38dcaa7e94ce4ee83e1c5751c1f7c33a26577f060","observation_id":"572e5edd-f68a-48ee-b94d-02ff5eb4b76d","resolution":{"observed_at":"2026-08-06T20:59:09.363367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:09.026093Z","title":"Redpajama: an open dataset for training large language models, 2023","venue":null,"work_id":"fbbec371-d2c4-43fa-abbd-3c118e187049","year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.150293Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:63bc610a7282fb1f05148a75d8914003a0c55f6ef83faae27037f9a9a61fd61d","observation_id":"38ce1e0c-ebb4-4d27-a93e-97999bd3ed73","resolution":{"observed_at":"2026-08-06T20:59:09.169369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.01378","last_updated":"2023-09-13T15:07:01Z","snapshot_observed_at":"2026-08-16T16:11:22.966527Z","submitted_at":"2022-12-02T18:59:04Z","title":"ColD Fusion: Collaborative Descent for Distributed Multitask Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.01378","snapshot_observed_at":"2026-08-06T20:59:03.238055Z","title":"Cold fusion: Collaborative descent for distributed multitask finetuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.238055Z"},"links":{"cited_paper":"/paper/2212.01378","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:d5215af6f40871647b0fdb6ae77cfe99fb50119acbcffaaa3aaa7e5011c6c1b5","observation_id":"edd93686-42b9-412c-afe2-eff4b3ec2884","resolution":{"observed_at":"2026-08-06T20:59:03.238055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:08.823777Z","title":"fingpt-fiqa_qa","venue":null,"work_id":"d0a59bdd-5669-4895-a4fa-7a7fe37249db","year":null},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.271090Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:5fbfbc611d09a6874b868ea59fbe5fe81a7cb979af5c99cb7a72fdcdbf9112d6","observation_id":"47657797-cbe2-4693-8e1c-828c9bc605e7","resolution":{"observed_at":"2026-08-06T20:59:08.950675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-20T07:57:48.645407Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-06T20:59:03.405349Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.405349Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:c5820b3fc58d34bd6da9d541d0e91417eb4af59bb5464aa246ef5dec110ed8b6","observation_id":"233ec159-5fac-4c5a-bda5-1ed459a0591a","resolution":{"observed_at":"2026-08-06T20:59:03.405349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.02312","last_updated":"2020-01-07T23:13:35Z","snapshot_observed_at":"2026-08-14T00:44:14.500200Z","submitted_at":"2020-01-07T23:13:35Z","title":"Stochastic Weight Averaging in Parallel: Large-Batch Training that Generalizes Well","version":1},"cited_work":{"arxiv_id":"2001.02312","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.02312","snapshot_observed_at":"2026-08-06T20:59:06.334022Z","title":"Stochastic Weight Averaging in Parallel: Large-Batch Training that Generalizes Well","venue":"cs.LG","work_id":"81a1db05-a657-4c6b-9480-1d889f2926b6","year":2020},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.457350Z"},"links":{"cited_paper":"/paper/2001.02312","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:aba667b5cf0f88a6cb7e96cc2e3d277588f84e4155f2b480e6e873c0ae74a435","observation_id":"06f926cf-8a87-4a15-b003-00af713ae37e","resolution":{"observed_at":"2026-08-06T20:59:06.406840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-18T08:20:50.087566Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-08-06T20:59:03.537575Z","title":"Medalpaca–an open-source collection of medical conversational ai models and training data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.537575Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:792d9628737ea98944323a39010a3216ff917c168bf858909ff035522ac9a3dc","observation_id":"f384dfab-44f5-43ee-bdaf-54de593205b1","resolution":{"observed_at":"2026-08-06T20:59:03.537575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:08.380394Z","title":"Aligning ai with shared human values","venue":null,"work_id":"f162664a-9040-430f-b3d4-7d39195d5f97","year":2021},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.614700Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:9e458cffa97291c50947738542559ef5481e678a1c2241d1574955fc6e77b8c9","observation_id":"5c03d426-077e-46c1-87c6-5f6ae6c65225","resolution":{"observed_at":"2026-08-06T20:59:08.462363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:03.688113Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.688113Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:1a2bf4d7ed0c09e355b31af0e026ea71940bfd4cfbc74b9f93c053d316c2cee2","observation_id":"3e8fa007-e055-4d06-b35d-9410b90bd1fe","resolution":{"observed_at":"2026-08-06T20:59:03.688113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T20:59:03.750654Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.750654Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:8c51bc66cdc19503f4d3ec0a61d7eab15cf9f12e445151006a34780faeee7d45","observation_id":"dea18d27-d4d6-4c69-8d0c-b4eddf2784f8","resolution":{"observed_at":"2026-08-06T20:59:03.750654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04089","last_updated":"2023-03-31T15:27:01Z","snapshot_observed_at":"2026-08-13T03:27:01.609831Z","submitted_at":"2022-12-08T05:50:53Z","title":"Editing Models with Task Arithmetic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04089","snapshot_observed_at":"2026-08-06T20:59:03.793097Z","title":"Editing models with task arithmetic","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.793097Z"},"links":{"cited_paper":"/paper/2212.04089","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:ab72aae53c9628ec7c48f003837f0411a6d8e850bbd66032bd814388b6f17f50","observation_id":"adef72ab-8162-40df-bd11-f5bdd8788cf8","resolution":{"observed_at":"2026-08-06T20:59:03.793097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:08.176024Z","title":"Editing models with task arithmetic","venue":null,"work_id":"c5f80c1c-c9be-42b0-a066-c4497bacdb12","year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.882507Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:663576ff6de1ee9a0dbad4d4d1bf38786caea019d47e1353b8b5a77c7cdcf784","observation_id":"29e40bf6-489f-46b2-aba5-bfaa11642f77","resolution":{"observed_at":"2026-08-06T20:59:08.264099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05407","last_updated":"2019-02-25T14:18:11Z","snapshot_observed_at":"2026-08-14T19:36:09.254749Z","submitted_at":"2018-03-14T17:09:27Z","title":"Averaging Weights Leads to Wider Optima and Better Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05407","snapshot_observed_at":"2026-08-06T20:59:03.979947Z","title":"Averaging weights leads to wider optima and better generalization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.979947Z"},"links":{"cited_paper":"/paper/1803.05407","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:dc5cc871cf1b15278f93cd445b35b91de88bf9b2dffe840e78c27a3a79fba593","observation_id":"44e194b9-90c5-4e62-84b6-13799926e0df","resolution":{"observed_at":"2026-08-06T20:59:03.979947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T20:59:04.054223Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.054223Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:cff03b6a183da9d531a4917a4fef1122083b84430fb42ae20f7b6133e850f5aa","observation_id":"23e8ea93-bcdb-457e-9987-41bcc420b476","resolution":{"observed_at":"2026-08-06T20:59:04.054223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:04.112753Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.112753Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:3412e881aadc04d678dda85ce75d80313055d588d5a40d3b43aa35af89db5fee","observation_id":"d1d4183e-6672-4d6f-b8fb-04e3c61b6317","resolution":{"observed_at":"2026-08-06T20:59:04.112753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-08-17T06:10:48.003173Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-06T20:59:04.195793Z","title":"Pubmedqa: A dataset for biomedical research question answering","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.195793Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:08cc000f9008ed77462ac503208dbf25db30b2f5fc0fd96ccc5abfaf6ee50e36","observation_id":"7cd79f5e-271d-47ac-9905-102d29b8a2ed","resolution":{"observed_at":"2026-08-06T20:59:04.195793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09849","last_updated":"2025-05-21T23:53:00Z","snapshot_observed_at":"2026-08-16T16:07:30.940052Z","submitted_at":"2022-12-19T20:46:43Z","title":"Dataless Knowledge Fusion by Merging Weights of Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09849","snapshot_observed_at":"2026-08-06T20:59:04.284153Z","title":"Dataless knowledge fusion by merging weights of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.284153Z"},"links":{"cited_paper":"/paper/2212.09849","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:d40c2d31402578ccbe59fc71ae389a72792522e497f6846132e7f485d5882164","observation_id":"73b9f224-2889-49f1-9818-9853e3743ba2","resolution":{"observed_at":"2026-08-06T20:59:04.284153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:04.344075Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.344075Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:9f8d67ac32dccd418b9d456e85f214343ba1e255be9bfd609e37d983f862cc9e","observation_id":"c14d7b81-4133-40c1-8ea1-78ef07c2bf85","resolution":{"observed_at":"2026-08-06T20:59:04.344075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:04.413299Z","title":"Understanding black-box predictions via influence functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.413299Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:4059d42018e9cce8bdbd5bbe172b332295c49c82aa552c2f982052fb9fdb75a7","observation_id":"b72e4507-2984-49d4-992e-2f1c6e57a487","resolution":{"observed_at":"2026-08-06T20:59:04.413299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.05492","last_updated":"2017-10-30T20:52:14Z","snapshot_observed_at":"2026-08-13T17:19:46.488095Z","submitted_at":"2016-10-18T09:11:51Z","title":"Federated Learning: Strategies for Improving Communication Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.05492","snapshot_observed_at":"2026-08-06T20:59:04.487530Z","title":"Federated learning: Strategies for improving communication efficiency","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.487530Z"},"links":{"cited_paper":"/paper/1610.05492","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:375127bb3a8ac7e875c940802413900aeb7811f34f81d0cf01f740de76c9bdf9","observation_id":"7d20b216-b0f3-4f58-942f-a5c4f2c97ed0","resolution":{"observed_at":"2026-08-06T20:59:04.487530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00902","last_updated":"2024-03-13T14:27:46Z","snapshot_observed_at":"2026-08-19T23:31:11.622376Z","submitted_at":"2023-10-02T04:59:19Z","title":"DataInf: Efficiently Estimating Data Influence in LoRA-tuned LLMs and Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00902","snapshot_observed_at":"2026-08-06T20:59:04.543992Z","title":"Datainf: Efficiently estimating data influence in lora-tuned llms and diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.543992Z"},"links":{"cited_paper":"/paper/2310.00902","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:54b7fc6405fd760687039d85189cf310f73d834bd8b70c7b94cf1ccea1bb15ed","observation_id":"e2ae71c0-b837-4dbb-9ef4-62d50e9e3ee5","resolution":{"observed_at":"2026-08-06T20:59:04.543992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06499","last_updated":"2022-03-24T19:29:45Z","snapshot_observed_at":"2026-08-14T07:55:03.346803Z","submitted_at":"2021-07-14T06:06:52Z","title":"Deduplicating Training Data Makes Language Models Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06499","snapshot_observed_at":"2026-08-06T20:59:04.607253Z","title":"Deduplicating training data makes language models better","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.607253Z"},"links":{"cited_paper":"/paper/2107.06499","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:1b3cf79564c85237e135292142a715ac7315e32f0a5a5af0821f47d9cf9d721e","observation_id":"d76afe2c-0be6-4305-8abe-91a0e68ffbdc","resolution":{"observed_at":"2026-08-06T20:59:04.607253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.03306","last_updated":"2022-08-05T17:46:38Z","snapshot_observed_at":"2026-08-18T13:05:31.068739Z","submitted_at":"2022-08-05T17:46:38Z","title":"Branch-Train-Merge: Embarrassingly Parallel Training of Expert Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.03306","snapshot_observed_at":"2026-08-06T20:59:04.662169Z","title":"Branch-train-merge: Embarrassingly parallel training of expert language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.662169Z"},"links":{"cited_paper":"/paper/2208.03306","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:b6d7b813aa80a0fc2299211c147f8ae16dc52c1a80983356543ee3a088490989","observation_id":"24e3a7d0-fe10-400a-8c73-3d34e3d9eb7e","resolution":{"observed_at":"2026-08-06T20:59:04.662169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12032","last_updated":"2024-04-06T03:52:04Z","snapshot_observed_at":"2026-08-20T03:29:57.884097Z","submitted_at":"2023-08-23T09:45:29Z","title":"From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12032","snapshot_observed_at":"2026-08-06T20:59:04.732253Z","title":"From quantity to quality: Boosting llm performance with self- guided data selection for instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.732253Z"},"links":{"cited_paper":"/paper/2308.12032","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:d861323f398ae24f4bc97ecead23a44609ef5df50abdf08555dd8032e1afd06a","observation_id":"2ca8c4a2-3841-4b2c-9632-0b03d8b467b3","resolution":{"observed_at":"2026-08-06T20:59:04.732253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:07.951640Z","title":"Convergence analysis of two-layer neural networks with relu activation","venue":null,"work_id":"edcbb3ff-ca54-4ba1-a9cf-c6a76b17c85e","year":2017},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.810874Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:c6807e8334eeb5f41b885d93a8a6888f433952a793f872ce9c5570647c4ee0f6","observation_id":"9edf96f8-4fdc-4348-9b18-af5b230dce42","resolution":{"observed_at":"2026-08-06T20:59:08.050971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:07.781815Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"d064ea3e-19f7-425a-87bd-768649cf4cf0","year":2019},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.859470Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:e56476378162da5a0a858cbcdeaf2e1c515516e9c556c298b03acba2cba8b7fc","observation_id":"b5f36549-3092-4a43-b488-8c3fef8ff3f0","resolution":{"observed_at":"2026-08-06T20:59:07.895186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:07.572323Z","title":"Peft: State-of-the-art parameter-efficient fine-tuning methods, 2022","venue":null,"work_id":"019cb49f-842b-441c-84b1-1d47ea87841c","year":2022},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.898979Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:1e1beaa6f6bcaa697293bef2f6a5a5b32e274321214e5e933d3d4ed74aeca64a","observation_id":"a22bc54d-1f72-4a4d-b984-30404b02b74c","resolution":{"observed_at":"2026-08-06T20:59:07.661908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-99713-1_5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Mondschein and Cosimo Monda","venue":null,"work_id":"40b72080-3179-492e-95f6-5a127dc55cec","year":2019},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:04.956644Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:c4772f1eb2493a05f4571c7d91ba163e714f2adb26724ddf80417321daf75aba","observation_id":"da38bd29-33fd-4215-a67d-096ed2cb5e62","resolution":{"observed_at":"2026-08-06T20:59:06.009321Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16264","last_updated":"2025-06-28T00:00:06Z","snapshot_observed_at":"2026-08-08T06:18:27.640980Z","submitted_at":"2023-05-25T17:18:55Z","title":"Scaling Data-Constrained Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16264","snapshot_observed_at":"2026-08-06T20:59:05.011183Z","title":"Scaling data-constrained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.011183Z"},"links":{"cited_paper":"/paper/2305.16264","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:8d47f3fff298c3da2af02b04d72b0b154bd325a07c5035e62d6f714af1f45a1e","observation_id":"2f931eb1-dc06-4d8c-ba9b-afe80ae66a1e","resolution":{"observed_at":"2026-08-06T20:59:05.011183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:07.384166Z","title":"Gpt-4 technical report, 2023","venue":null,"work_id":"d5267d40-ad11-4519-8540-511b70879562","year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.049128Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:6b91785559bbd1fa5828443102f8f3b89209bb9fa1f684a384f085554277b30e","observation_id":"44ae9e10-007c-4325-b5be-4a6d15ed37d9","resolution":{"observed_at":"2026-08-06T20:59:07.471972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:07.188234Z","title":"Medmcqa: A large-scale multi-subject multi-choice dataset for medical domain question answering","venue":null,"work_id":"a2f45ef4-4cae-4048-9e75-284141c814bf","year":2022},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.120120Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:a0a3370dc347183c2d9844d73595ecd1aaad07fdf515648f45b082516715dbed","observation_id":"58927896-5d8a-4e21-b1ba-ebde90c9ca09","resolution":{"observed_at":"2026-08-06T20:59:07.264666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:06.978177Z","title":"Pytorch: An imperative style, high- performance deep learning library","venue":null,"work_id":"6ba77f48-ec53-4ecf-bb8b-dca6909a4e93","year":2019},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.167550Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:f2b469a4efa39b04a39094fe6516eb2b02b2536da9cb3e6aa508967ea9d1f532","observation_id":"cc517d00-a1ab-4f66-9bd0-eb11672d3170","resolution":{"observed_at":"2026-08-06T20:59:07.069483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:05.214502Z","title":"Towards building multilingual language model for medicine, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.214502Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:e5103059f3bea7980722fb5aa83147f7ef49acec72ac6c159becf5d1ffe4031a","observation_id":"d8a339a3-ce17-44bd-8d4d-bc94437fe42b","resolution":{"observed_at":"2026-08-06T20:59:05.214502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:05.278207Z","title":"Smith, and Yejin Choi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.278207Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:67c4b323ecf819a548a2cc12cbc09a65dfb42a8bc02411870859628c551deeb5","observation_id":"1a4ebf0b-0241-4156-a348-ae44be7fefca","resolution":{"observed_at":"2026-08-06T20:59:05.278207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13405","last_updated":"2019-06-28T16:44:04Z","snapshot_observed_at":"2026-08-14T16:23:18.622903Z","submitted_at":"2019-05-31T04:07:58Z","title":"Luck Matters: Understanding Training Dynamics of Deep ReLU Networks","version":4},"cited_work":{"arxiv_id":"1905.13405","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.13405","snapshot_observed_at":"2026-08-06T20:59:06.175066Z","title":"Luck Matters: Understanding Training Dynamics of Deep ReLU Networks","venue":"cs.LG","work_id":"3859b56e-d43a-4f6c-8c8d-5d67bb155b7a","year":2019},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.333594Z"},"links":{"cited_paper":"/paper/1905.13405","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:d91343a4ace0886d578e7e5b7f478d7768981ad0f3e4e961fe5459ac19e91520","observation_id":"d85f393b-0f7e-4acb-ad6b-b691dc3c5779","resolution":{"observed_at":"2026-08-06T20:59:06.219462Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:05.393072Z","title":"Llama: Open and efficient foundation language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.393072Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:e680160597171681836a8caa41fe9b1af0351a73c9b49bc10002c85597060b45","observation_id":"03cd30a0-72e3-4df6-a945-3b401adc160d","resolution":{"observed_at":"2026-08-06T20:59:05.393072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:05.458271Z","title":"Llama 2: Open foundation and fine-tuned chat models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.458271Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:8c5a49a76386837271969113e316e80d494ae049d85bc00b0018bf49d7bfa29e","observation_id":"4cb854e7-f732-4c3a-a0da-7d8cf00fcdae","resolution":{"observed_at":"2026-08-06T20:59:05.458271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0893-6080(96)00119-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Wilson, James L","venue":"Neural Networks","work_id":"6a66da44-cad0-48b9-8bbd-32b796ac49d5","year":1997},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.524371Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:e409f53b28434dde0cdd1fffd20fa56d7763d95a62e31a0c6094db0a512d5333","observation_id":"80e75d6c-c521-41fd-bf54-d7bd2567e041","resolution":{"observed_at":"2026-08-06T20:59:05.908802Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:05.584862Z","title":"Transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.584862Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:dbb5bd20aa3507b27070ef0b7efa4322e6b2f32a152f174db9bc23ad72a5b56c","observation_id":"5bd36964-1ed4-4161-bd38-27c029102767","resolution":{"observed_at":"2026-08-06T20:59:05.584862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:06.697484Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","venue":null,"work_id":"a0a5f004-df3b-411a-992d-4b1a9b663a20","year":2022},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.649932Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:bc8e095d3594990819561ee0009bf5719ec4c0f53bb59eb9eb0575a49c4fe64c","observation_id":"50609034-247e-4c41-bbc3-8f3ca6128a6a","resolution":{"observed_at":"2026-08-06T20:59:06.854254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14454","last_updated":"2023-08-25T14:08:38Z","snapshot_observed_at":"2026-08-20T03:33:07.385359Z","submitted_at":"2023-04-27T18:29:05Z","title":"PMC-LLaMA: Towards Building Open-source Language Models for Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14454","snapshot_observed_at":"2026-08-06T20:59:05.693572Z","title":"Pmc-llama: Further finetuning llama on medical papers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.693572Z"},"links":{"cited_paper":"/paper/2304.14454","citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:e784bf8bdebbf02412ec03cbdf5b5d8e89a2625841934a8a30015f49ff405bfe","observation_id":"7b749274-5670-49c3-81f0-cc4450a47a81","resolution":{"observed_at":"2026-08-06T20:59:05.693572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:06.496929Z","title":"TIES-merging: Resolving interference when merging models","venue":null,"work_id":"58ce3c05-f0d3-4e6f-8fa8-4b17e0d9c08b","year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.750506Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:3b6f62c8614fd45c316236129d7836ef8409b7c35f3333f71e2ef224f93b655c","observation_id":"3fe58433-ced4-4581-9302-70435df37255","resolution":{"observed_at":"2026-08-06T20:59:06.600515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:05.807268Z","title":"surprised","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:05.807268Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:ad54959d5328a5b9611a67d4b926b1172ca8e952264a1833451d8b2411ef45af","observation_id":"3f06e261-7424-493d-9280-ef4695199cc2","resolution":{"observed_at":"2026-08-06T20:59:05.807268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:59:08.600098Z","title":null,"venue":null,"work_id":"b9a4eb54-81d2-439e-8c3d-683a33ad3295","year":null},"citing_paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T20:59:03.350941Z"},"links":{"citing_paper":"/paper/2507.03004"},"observation_digest":"sha256:c2e786bf04deb47980defb923ed91db51ed9e3574351a956a6b2900be8ffc002","observation_id":"3baf143b-81a2-464f-9ca5-9e4e3ba88dbb","resolution":{"observed_at":"2026-08-06T20:59:08.676193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.03004","last_updated":"2025-07-02T06:19:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T15:06:27.200939Z","submitted_at":"2025-07-02T06:19:40Z","title":"CLUES: Collaborative High-Quality Data Selection for LLMs via Training Dynamics"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":4,"verified_fuzzy":13},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2507.03004."}