{"as_of":"2026-08-14T19:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9a38d2363a560a8710747f886d6efbd94d4e9538b95cbd81fec3c13dcfbf527","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:59:28.515144Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.14809/citation-record","integrity":"/paper/2412.14809/integrity","json":"/paper/2412.14809/citation-record.json","paper":"/paper/2412.14809"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.17461","last_updated":"2024-01-30T21:49:30Z","snapshot_observed_at":"2026-08-13T04:30:43.111624Z","submitted_at":"2024-01-30T21:49:30Z","title":"Synthetic Dialogue Dataset Generation using LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17461","snapshot_observed_at":"2026-08-11T11:59:28.182130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.182130Z"},"links":{"cited_paper":"/paper/2401.17461","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:f9209fccb086f9103825e76a18eabe45e751a6e406b3ca35956aae536293a03a","observation_id":"21d32cc4-2c8e-4ef4-bda0-96754a00f592","resolution":{"observed_at":"2026-08-11T11:59:28.182130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-11T11:59:28.189133Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.189133Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:280a45de984e3851f121f4bb9d126a5b78826f8b2724d24a674f1e453ad182b4","observation_id":"99091862-68c8-4aac-920a-a58fd9a155e2","resolution":{"observed_at":"2026-08-11T11:59:28.189133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-13T10:57:21.545059Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-11T11:59:28.194116Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.194116Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:e54b22dc078c76742350bbcb07cb3e7943a53da7debb731f97ceba4f90e0ed4a","observation_id":"87d551f8-e1c3-4e3a-95b2-15dce4f78a0e","resolution":{"observed_at":"2026-08-11T11:59:28.194116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-08-14T00:16:39.034955Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07597","snapshot_observed_at":"2026-08-11T11:59:28.199170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.199170Z"},"links":{"cited_paper":"/paper/2309.07597","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:0d4bc968d47d09a0c86022979da02d23533202cee8d26ba315586b2858966d28","observation_id":"5ff60c48-0659-40f0-8b42-5b4f14a823f9","resolution":{"observed_at":"2026-08-11T11:59:28.199170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-13T10:54:00.274565Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-11T11:59:28.204154Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.204154Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:a24fac1c92c6590280abd1b16058ad1179c4cc91263620e0b32772e8961f2ddf","observation_id":"e2e1f105-9487-423f-98c9-d989bc6e906e","resolution":{"observed_at":"2026-08-11T11:59:28.204154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-11T11:59:28.209337Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.209337Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:7d05f45ca03f1302603fed3eb9661903049efd8ef28eff3818906165c046d356","observation_id":"942f52d7-6b51-4599-80e7-d205f7204d63","resolution":{"observed_at":"2026-08-11T11:59:28.209337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03883","last_updated":"2024-03-11T02:01:09Z","snapshot_observed_at":"2026-08-06T11:43:44.726916Z","submitted_at":"2023-09-07T17:45:31Z","title":"DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03883","snapshot_observed_at":"2026-08-11T11:59:28.215886Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.215886Z"},"links":{"cited_paper":"/paper/2309.03883","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:b2b8a57c4d70d7bf2f7bacd0a0faad4158d1496847746679e6230b91d45e39a8","observation_id":"a3557b30-c6a9-45b7-ad9c-e8a75961dcdc","resolution":{"observed_at":"2026-08-11T11:59:28.215886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T11:59:28.220900Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.220900Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:6fd5ddfc7cef2197c562f3b3fddb00e6f5f8a59b4fe44037a7ca78612871a00c","observation_id":"035a2ea7-ce94-47aa-b29d-54c412ee074c","resolution":{"observed_at":"2026-08-11T11:59:28.220900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.225626Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.225626Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:9ceefc1032b0193a29784c9f42374c24f24e64075bc5718042ab0ee3c0d05e85","observation_id":"256ee3d8-19ec-4a6e-b925-5b2ecb4dc1b0","resolution":{"observed_at":"2026-08-11T11:59:28.225626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.230538Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.230538Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:da49e22a3d3f4c362946732b0b26669cd4c9092f8701dc84c7c8252891c3e1ac","observation_id":"8552721d-2047-46c1-b21a-bd46d9d8e478","resolution":{"observed_at":"2026-08-11T11:59:28.230538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.235500Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.235500Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:43a46598f502dc9a351eb6f4f16d20e8b3b15741193881ad1b8c9fba342239c5","observation_id":"194dc1cb-a3de-45e9-bddc-b452a2dad7e9","resolution":{"observed_at":"2026-08-11T11:59:28.235500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13007","last_updated":"2023-03-20T11:39:47Z","snapshot_observed_at":"2026-08-13T12:37:42.544416Z","submitted_at":"2023-02-25T06:58:16Z","title":"AugGPT: Leveraging ChatGPT for Text Data Augmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13007","snapshot_observed_at":"2026-08-11T11:59:28.240686Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.240686Z"},"links":{"cited_paper":"/paper/2302.13007","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:5371af731de725dc5912615dbc0132536b829346ad8a01949cba1e524a1c739d","observation_id":"f79de2d1-ffc8-4114-bda8-25b88504f4f8","resolution":{"observed_at":"2026-08-11T11:59:28.240686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.245508Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.245508Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:8ec5ef1c273a5bc5210ea31ec76ea972ae7a608a3580775466ff956cca8288f5","observation_id":"d50ace70-93f7-4fec-93e1-f73965ec14d1","resolution":{"observed_at":"2026-08-11T11:59:28.245508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-11T11:59:28.250095Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.250095Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:91eaa3af95fac1e3da1cc0dd90bd2927d199132221d5c425413ffc7a6cff0502","observation_id":"b3fbdaf6-96a6-461d-aab0-9bdc0134f28a","resolution":{"observed_at":"2026-08-11T11:59:28.250095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00586","last_updated":"2023-11-02T10:55:18Z","snapshot_observed_at":"2026-08-14T07:59:25.068582Z","submitted_at":"2023-04-30T21:44:21Z","title":"How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00586","snapshot_observed_at":"2026-08-11T11:59:28.255149Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.255149Z"},"links":{"cited_paper":"/paper/2305.00586","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:3e24ba5c3fec2fd1af86d99d77cf649f69008a1857ce78c4cb9759b7fe3e5733","observation_id":"de1ec050-3833-4a52-83be-52248d473277","resolution":{"observed_at":"2026-08-11T11:59:28.255149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T11:59:28.260873Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.260873Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:4388b010c0aa0cea8622c53d8bd7a81413affddcfd2ce9bc9620f82bdf9084cd","observation_id":"aa382943-83a1-420d-b40f-2b2b38a4b33a","resolution":{"observed_at":"2026-08-11T11:59:28.260873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.266975Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.266975Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:bb9654b14cbaf7fe41f977d661db7c0928e07a4fd393808ed3482606d6e10bc9","observation_id":"e5227492-6fcd-4a95-b9fc-5e5b1275e2d5","resolution":{"observed_at":"2026-08-11T11:59:28.266975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:29.449102Z","title":null,"venue":null,"work_id":"cf414de5-840b-4826-80c9-589c91ca84dc","year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.273654Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:4f2c517f5356f098de98e28b149a142c83a8639deb62a3d961ba76f64630243e","observation_id":"31f979fb-47d3-45b8-9919-cefad0c8c045","resolution":{"observed_at":"2026-08-11T11:59:29.453850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.278802Z","title":"o pf, Yannic Kilcher, Dimitri von R \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.278802Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:04ffc419efdc1378a352d7331d191cc524a053d7ffe692c238e4ab541f404487","observation_id":"cdf1dc56-74fb-4cee-ab52-68e6d3c922e0","resolution":{"observed_at":"2026-08-11T11:59:28.278802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00288","last_updated":"2023-11-01T04:40:05Z","snapshot_observed_at":"2026-08-14T17:06:25.685964Z","submitted_at":"2023-11-01T04:40:05Z","title":"Active Instruction Tuning: Improving Cross-Task Generalization by Training on Prompt Sensitive Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00288","snapshot_observed_at":"2026-08-11T11:59:28.283639Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.283639Z"},"links":{"cited_paper":"/paper/2311.00288","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:a60678ba2e0f2aa1451953eb27a6eba6f60be30db893aac511a0b356f831844b","observation_id":"b49f16de-036e-491f-aeae-85901070894b","resolution":{"observed_at":"2026-08-11T11:59:28.283639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.289196Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.289196Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:2139a02d65de0f0831f346c776849273af1a129a6875b50d4e9127c3d26c4478","observation_id":"9308dba0-155a-4d25-b610-c44da3d9987e","resolution":{"observed_at":"2026-08-11T11:59:28.289196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.294019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.294019Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:1b6f6f5493d72241cc0543b116b1a83ccca4d207272c095f53e4e369a58be5a4","observation_id":"c2c82599-c064-4d8c-9988-8218f4312106","resolution":{"observed_at":"2026-08-11T11:59:28.294019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00530","last_updated":"2024-06-07T20:28:36Z","snapshot_observed_at":"2026-08-13T04:29:20.236436Z","submitted_at":"2024-02-01T11:57:53Z","title":"Superfiltering: Weak-to-Strong Data Filtering for Fast Instruction-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00530","snapshot_observed_at":"2026-08-11T11:59:28.298773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.298773Z"},"links":{"cited_paper":"/paper/2402.00530","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:6ef0f2e584e9532b2958349cf682c8c2eb9e0cf085e91f7345d1b7da0ab53c75","observation_id":"3bcef62e-a6d8-46b4-a134-123b4cff8295","resolution":{"observed_at":"2026-08-11T11:59:28.298773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12032","last_updated":"2024-04-06T03:52:04Z","snapshot_observed_at":"2026-08-13T22:13:22.197575Z","submitted_at":"2023-08-23T09:45:29Z","title":"From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12032","snapshot_observed_at":"2026-08-11T11:59:28.303988Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.303988Z"},"links":{"cited_paper":"/paper/2308.12032","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:56abab38e6909d19b09da30e5963cb035672c6fa53d4b612315b84764a392174","observation_id":"d2bf98cd-5eae-40bb-ad2b-4f92178147ca","resolution":{"observed_at":"2026-08-11T11:59:28.303988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10302","last_updated":"2024-06-03T13:46:16Z","snapshot_observed_at":"2026-08-13T05:00:32.013916Z","submitted_at":"2023-12-16T03:33:12Z","title":"One-Shot Learning as Instruction Data Prospector for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10302","snapshot_observed_at":"2026-08-11T11:59:28.309046Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.309046Z"},"links":{"cited_paper":"/paper/2312.10302","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:f7672f1a255be57f9b3c618e6dc4ad5c54c484219e017fcd69fce7e4fc71bce0","observation_id":"593fe71e-cc3e-4034-aee0-bbc55cd9b9de","resolution":{"observed_at":"2026-08-11T11:59:28.309046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15685","last_updated":"2024-04-16T02:46:58Z","snapshot_observed_at":"2026-08-13T04:54:16.874411Z","submitted_at":"2023-12-25T10:29:28Z","title":"What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15685","snapshot_observed_at":"2026-08-11T11:59:28.314418Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.314418Z"},"links":{"cited_paper":"/paper/2312.15685","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:d9e6e1f35af4e0d853b8d260559d79bd251008902430241a2072d5ae0fbc0ce8","observation_id":"456565d1-ca2e-4715-89f8-46c9bb889f47","resolution":{"observed_at":"2026-08-11T11:59:28.314418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14115","last_updated":"2025-02-24T07:59:00Z","snapshot_observed_at":"2026-08-12T23:38:35.854809Z","submitted_at":"2024-06-20T08:58:58Z","title":"Take the essence and discard the dross: A Rethinking on Data Selection for Fine-Tuning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14115","snapshot_observed_at":"2026-08-11T11:59:28.320209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.320209Z"},"links":{"cited_paper":"/paper/2406.14115","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:80ad52566440e9b9328a5ad0057a09476711c9a05b178d2169630bdaeca92bc6","observation_id":"d140143b-253f-43bc-87f5-4b668401bf34","resolution":{"observed_at":"2026-08-11T11:59:28.320209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-11T11:59:28.325662Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.325662Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:d227b6c377a637c83a2862a3cdc79907d10e6693d56a4032fac780e5645f7849","observation_id":"28670dcd-1a98-4585-a12b-1a6b3d64a724","resolution":{"observed_at":"2026-08-11T11:59:28.325662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.330862Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.330862Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:b82921262dee528415a49fcc9e119ac382ddbe9265d9d033fb490f52a8c3fd7f","observation_id":"b615bd06-6bf5-4e19-ab44-dcc84e4fcd0e","resolution":{"observed_at":"2026-08-11T11:59:28.330862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08568","last_updated":"2025-05-27T07:40:36Z","snapshot_observed_at":"2026-08-13T11:17:21.801042Z","submitted_at":"2023-06-14T15:18:48Z","title":"WizardCoder: Empowering Code Large Language Models with Evol-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08568","snapshot_observed_at":"2026-08-11T11:59:28.336469Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.336469Z"},"links":{"cited_paper":"/paper/2306.08568","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:da860c0c05e8d4fcc52f652086210b450f708c63328547d834ddd73fea8a6360","observation_id":"0b080c1e-fa6e-45c6-8c24-932a7578d2fb","resolution":{"observed_at":"2026-08-11T11:59:28.336469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.342409Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.342409Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:e5f0dc20ed3e304a008c3c2abe41a3134f720d82a7b792bc4bfb3273f146f379","observation_id":"51ce56c8-e59b-40f2-a341-fde15c380a44","resolution":{"observed_at":"2026-08-11T11:59:28.342409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:29.392599Z","title":null,"venue":null,"work_id":"68aef4f7-da14-496b-a44f-3aea730069be","year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.348406Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:0510aaa0cbfb6a332d52121ed3e96ea88d898029e650623c75af35c3c4b3b68b","observation_id":"d379f97f-57c9-4e1b-80be-3906f5617916","resolution":{"observed_at":"2026-08-11T11:59:29.397690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08773","last_updated":"2022-03-14T09:15:08Z","snapshot_observed_at":"2026-08-05T18:13:22.401467Z","submitted_at":"2021-04-18T08:44:56Z","title":"Cross-Task Generalization via Natural Language Crowdsourcing Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08773","snapshot_observed_at":"2026-08-11T11:59:28.352979Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.352979Z"},"links":{"cited_paper":"/paper/2104.08773","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:d7420f802270cbd02803f7e36e73f8a6abc72d2f161e86d35d12294d9c0d0e00","observation_id":"2e5cfb4f-7ef6-4b88-acfd-404941e6a9b5","resolution":{"observed_at":"2026-08-11T11:59:28.352979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09906","last_updated":"2025-03-03T04:28:49Z","snapshot_observed_at":"2026-08-13T04:18:23.781512Z","submitted_at":"2024-02-15T12:12:19Z","title":"Generative Representational Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09906","snapshot_observed_at":"2026-08-11T11:59:28.358201Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.358201Z"},"links":{"cited_paper":"/paper/2402.09906","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:2f3efef922190f239d1aaccb829e6b3d84de62ef857c68ff3d4b8501542cdda0","observation_id":"8ea45315-a79c-4177-94f4-c05dad51f949","resolution":{"observed_at":"2026-08-11T11:59:28.358201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T11:59:28.363830Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.363830Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:a36e1125dd9e401f4ee3447ca10c4a1d4651b42f5a1ce36a36d5b57eac471979","observation_id":"c382692a-5a66-4df0-a4ae-93eb6f73fc70","resolution":{"observed_at":"2026-08-11T11:59:28.363830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-11T11:59:28.368828Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.368828Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:ce8d8067eb39fa5c40f4a6e8fa6312eac43ee6b07a9cfed5004acd9b65411d2e","observation_id":"549a4ef6-c933-4055-9cd9-011dd71dc030","resolution":{"observed_at":"2026-08-11T11:59:28.368828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.373500Z","title":"Peters, Mark Neumann, Mohit Iyyer, Matt Gardner, Christopher Clark, Kenton Lee, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.373500Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:f5680bc9e186b454ee8f39cd0d59d18fe147536dc88b6d89075245278af1f3a4","observation_id":"ede04695-d5f4-48c2-8bb0-b3056ffe0331","resolution":{"observed_at":"2026-08-11T11:59:28.373500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.378215Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.378215Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:bd45cf6eccbc5371d38619c8ba265e062fccc6704d860324797622a64e42c9d1","observation_id":"4e856a65-84c1-42a4-9094-1bce72ee9f99","resolution":{"observed_at":"2026-08-11T11:59:28.378215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-11T11:59:28.383006Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.383006Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:075dd678ee12560de02adabfdd2dc0f46674c3d251e0a656d56468faa50a58c5","observation_id":"e784d01e-1dd9-4b30-ac29-073841f93375","resolution":{"observed_at":"2026-08-11T11:59:28.383006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-11T11:59:28.388006Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.388006Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:273c51043fff0517746aca508d5ede44c65c00808c0bd83cec8cc90241bb2e68","observation_id":"56df30dd-be30-4062-9ff6-3b741407e80b","resolution":{"observed_at":"2026-08-11T11:59:28.388006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:29.355657Z","title":null,"venue":null,"work_id":"68f39cb8-ba16-4447-8904-916ec164751e","year":2020},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.392817Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:ba3b45b2c7eb676dceb134fbe7cf5beda77a12c03441a5fc9a6cbf91ee3b5a4c","observation_id":"f6230cc7-f168-41be-a7de-fd58a3ac38a0","resolution":{"observed_at":"2026-08-11T11:59:29.360446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:29.339938Z","title":null,"venue":null,"work_id":"ec38a231-356a-48d5-8411-6101f8da758f","year":2022},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.398694Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:ad21ca32b7e595eb12e0021811ecd0da4c50df1eae1256a6efb65ec1dc0f9334","observation_id":"f61cfe8f-0c83-4daa-b14a-174b2b1086af","resolution":{"observed_at":"2026-08-11T11:59:29.344671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08277","last_updated":"2024-06-03T16:48:59Z","snapshot_observed_at":"2026-08-13T04:20:01.822302Z","submitted_at":"2024-02-13T08:12:48Z","title":"Towards Faithful and Robust LLM Specialists for Evidence-Based Question-Answering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08277","snapshot_observed_at":"2026-08-11T11:59:28.404144Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.404144Z"},"links":{"cited_paper":"/paper/2402.08277","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:89259fd1a12a3d5a63e98860c85eccbc567a963c72cc27bf051c9f969df3ac0f","observation_id":"0b974c4b-d072-4d86-92b9-9d2fd34eaa67","resolution":{"observed_at":"2026-08-11T11:59:28.404144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06663","last_updated":"2025-03-18T16:21:04Z","snapshot_observed_at":"2026-08-12T23:04:30.419810Z","submitted_at":"2024-08-13T06:28:43Z","title":"Amuro and Char: Analyzing the Relationship between Pre-Training and Fine-Tuning of Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06663","snapshot_observed_at":"2026-08-11T11:59:28.410178Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.410178Z"},"links":{"cited_paper":"/paper/2408.06663","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:77e580f1448c1feb7a5ece01b169d037ffa53c3608a9428551293329f7c43c67","observation_id":"afb5ebce-f963-4bbf-9e30-d6dea14e9a52","resolution":{"observed_at":"2026-08-11T11:59:28.410178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-11T11:59:28.415460Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.415460Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:653ae34eb087d45184c162cd3f3fa40b6f10ccbad7c1694a2f9ed8b13a8b8946","observation_id":"99eb43db-ffe6-4276-9c02-268a8ee5af72","resolution":{"observed_at":"2026-08-11T11:59:28.415460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T11:59:28.421861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.421861Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:93b39e846bf9ea0656302f4448a8e336651a2b10fae9f7986b49bd701122193a","observation_id":"132aaa8b-b7d8-4158-9428-e1514c450d42","resolution":{"observed_at":"2026-08-11T11:59:28.421861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:29.323190Z","title":null,"venue":null,"work_id":"8b13d579-6681-41b9-a42e-1932510925be","year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.427599Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:4b6ed790fbcceb0951f8a9b116b2f0d98de87ee542e91ac127b50fc68357e136","observation_id":"727e7471-65e5-4eef-ad13-f5b301dfd929","resolution":{"observed_at":"2026-08-11T11:59:29.328877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.05950","last_updated":"2019-08-09T15:51:47Z","snapshot_observed_at":"2026-08-14T16:32:08.594751Z","submitted_at":"2019-05-15T05:47:23Z","title":"BERT Rediscovers the Classical NLP Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.05950","snapshot_observed_at":"2026-08-11T11:59:28.432483Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.432483Z"},"links":{"cited_paper":"/paper/1905.05950","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:1b4b87761545c0b9d12a50b44e51b75cd309c05c28ecf614284a56df9f7c0fb5","observation_id":"594edbad-0ef3-46d0-be69-fae638416b13","resolution":{"observed_at":"2026-08-11T11:59:28.432483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T11:59:28.437275Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.437275Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:c285fe7adeecc493d2bf79fca0b18b8e9043500b1aa732c77c4804dec5ef0179","observation_id":"fc9e787b-bd73-4ce7-a016-50faf417a047","resolution":{"observed_at":"2026-08-11T11:59:28.437275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.443879Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.443879Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:8da33aa9b6ca24eac4a7bccdf318e1dbbb0a8e29e2494c4363694911984ae229","observation_id":"886c86b6-10d3-481e-b5fb-6782ddcbc29f","resolution":{"observed_at":"2026-08-11T11:59:28.443879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.449398Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.449398Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:c87d116baf46c4829c5549da45f6c20c6d3810fa76863cbd2a2f886be40e6e51","observation_id":"a5d894e0-74f0-4ff9-b95a-c9f3d46415c0","resolution":{"observed_at":"2026-08-11T11:59:28.449398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12067","last_updated":"2026-04-12T14:13:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-23T11:27:30Z","title":"MM-LIMA: Less Is More for Alignment in Multi-Modal Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12067","snapshot_observed_at":"2026-08-11T11:59:28.456254Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.456254Z"},"links":{"cited_paper":"/paper/2308.12067","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:f4105c9a1ace663939716f7703b62755b321fd29c7185a164787dc6e74691810","observation_id":"9f42a011-5853-4b9b-a381-a6a2986b0cc0","resolution":{"observed_at":"2026-08-11T11:59:28.456254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.462856Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.462856Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:3f2309fa9956b35e1925c8798eacaa5f3a65c0f4a21175a529f047440a9ad909","observation_id":"00d502a3-5d59-4721-a9dc-65e51f608396","resolution":{"observed_at":"2026-08-11T11:59:28.462856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-13T04:24:51.821062Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T11:59:28.468647Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.468647Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:a0e31e6d1c9e1a4b535db2845e2a3fd54a5664670911ef2e1efb01692e09ea05","observation_id":"6f5105b7-fb81-4494-bec3-1497ff23ea11","resolution":{"observed_at":"2026-08-11T11:59:28.468647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-11T11:59:28.474396Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.474396Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:754a03a866439cdb132953b3bda3bd77d8386934c30a16be605319956462b32e","observation_id":"6dd6e227-9b6d-49ff-9f12-1a4baa236965","resolution":{"observed_at":"2026-08-11T11:59:28.474396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02699","last_updated":"2024-08-08T13:10:50Z","snapshot_observed_at":"2026-08-13T00:38:30.379028Z","submitted_at":"2024-04-03T12:57:19Z","title":"Scalable Model Editing via Customized Expert Networks","version":2},"cited_work":{"arxiv_id":"2404.02699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02699","snapshot_observed_at":"2026-08-11T11:59:28.653737Z","title":"Scalable Model Editing via Customized Expert Networks","venue":"cs.CL","work_id":"134ea489-8815-4008-9cf2-cf9c0a85013e","year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.481130Z"},"links":{"cited_paper":"/paper/2404.02699","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:fe98fc23bb8b4a67da66c4b913f8c01d87d3608e2aee81ea64b74ad31bb4730b","observation_id":"47b730dc-0b0d-4b99-b25e-e6e0bc31254c","resolution":{"observed_at":"2026-08-11T11:59:28.661965Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-11T11:59:28.488541Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.488541Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:4875715bb35a244278dd0d2f20c26f9d33564d43411aa54947852f9568ec5152","observation_id":"260e54e9-25e4-4b2d-b0c1-4109eced02d5","resolution":{"observed_at":"2026-08-11T11:59:28.488541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.495992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.495992Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:c464f0981ab5cb44a023973fef4bf40ab9df52fea2b2e3706dbc51a218fcfd65","observation_id":"0c8c20f5-f711-4ca0-a22e-059bd305ddcb","resolution":{"observed_at":"2026-08-11T11:59:28.495992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-11T04:34:07.318549Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-11T11:59:28.501572Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.501572Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:0f615d64072e2b03d11d8e4b12f6de033291af57c5c0bae4e091afb7156e2766","observation_id":"5c4bf374-0328-4852-904a-a0d564296ad9","resolution":{"observed_at":"2026-08-11T11:59:28.501572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.509250Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.509250Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:bcdfc818280aa176126190796cffde2719360f3dbd4bc5d9aea811748922ab4b","observation_id":"d54aee7b-8a86-428c-a2d4-32be57cd832f","resolution":{"observed_at":"2026-08-11T11:59:28.509250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:59:28.515144Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.515144Z"},"links":{"citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:99ef553fe572a04c6b11560dfe2c0874652ff80f909045facea8bb2fa23ec6ac","observation_id":"35505769-5e99-471d-bd51-93728022b690","resolution":{"observed_at":"2026-08-11T11:59:28.515144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T02:03:47.833458Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":60,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2412.14809."}