{"as_of":"2026-08-09T07:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01c0040a724db23f0d3b39ba0c00c6a3f14d761e0eb9bb67948c41ef01c4e2b5","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:57:12.088561Z","state":"measured"},{"denominator":99,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":99,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:55:17.631077Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:37:30.066482Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09650","snapshot_observed_at":"2026-08-06T18:55:17.631077Z","title":"https://api.semanticscholar.org/CorpusID: 276394867","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06959","last_updated":"2025-07-09T15:40:18Z","snapshot_observed_at":"2026-08-07T10:43:27.957447Z","submitted_at":"2025-07-09T15:40:18Z","title":"CheXPO: Preference Optimization for Chest X-ray VLMs with Counterfactual Rationale","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T18:55:17.631077Z"},"links":{"cited_paper":"/paper/2502.09650","citing_paper":"/paper/2507.06959"},"observation_digest":"sha256:5836937e9972a46d0cdcdd7add69bc6e9400883235d237066cf5c06e77e37c05","observation_id":"52494504-8160-465d-9634-fae864efedaa","resolution":{"observed_at":"2026-08-06T18:55:17.631077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"cited_work":{"arxiv_id":"2502.09650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09650","snapshot_observed_at":"2026-07-03T00:37:30.066482Z","title":"Prin- cipled data selection for alignment: The hidden risks of difficult examples.arXiv preprint arXiv:2502.09650","venue":null,"work_id":"ef7d2765-5489-4ee7-a33a-69eaf8fae1f2","year":2025},"citing_paper":{"arxiv_id":"2508.04149","last_updated":"2026-05-16T09:55:19Z","snapshot_observed_at":"2026-07-06T22:08:36.543090Z","submitted_at":"2025-08-06T07:24:14Z","title":"Difficulty-Based Preference Data Selection by DPO Implicit Reward Gap","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T23:46:24.208438Z"},"links":{"cited_paper":"/paper/2502.09650","citing_paper":"/paper/2508.04149"},"observation_digest":"sha256:d52be0170a406e1d022fe9ed1ac3138a136d8a1f996303cbda2eb98919913322","observation_id":"587ec8ef-4609-4aaa-b72b-9c19191f614d","resolution":{"observed_at":"2026-05-21T23:50:47.602048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"cited_work":{"arxiv_id":"2502.09650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09650","snapshot_observed_at":"2026-07-03T00:37:30.066482Z","title":"Prin- cipled data selection for alignment: The hidden risks of difficult examples.arXiv preprint arXiv:2502.09650","venue":null,"work_id":"ef7d2765-5489-4ee7-a33a-69eaf8fae1f2","year":2025},"citing_paper":{"arxiv_id":"2602.07340","last_updated":"2026-05-21T07:39:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-07T03:46:33Z","title":"Revisiting Robustness for LLM Safety Alignment via Selective Geometry Control","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T11:17:03.104902Z"},"links":{"cited_paper":"/paper/2502.09650","citing_paper":"/paper/2602.07340"},"observation_digest":"sha256:39a27469400102d1a9c77665aa77763d7c3ea83ab517a6b74857d5e3bf481d41","observation_id":"2116b96e-ee3c-472a-ad86-24fcc94936e6","resolution":{"observed_at":"2026-05-22T11:21:28.957156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"cited_work":{"arxiv_id":"2502.09650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09650","snapshot_observed_at":"2026-07-03T00:37:30.066482Z","title":"Prin- cipled data selection for alignment: The hidden risks of difficult examples.arXiv preprint arXiv:2502.09650","venue":null,"work_id":"ef7d2765-5489-4ee7-a33a-69eaf8fae1f2","year":2025},"citing_paper":{"arxiv_id":"2604.14314","last_updated":"2026-04-15T18:17:11Z","snapshot_observed_at":"2026-07-06T23:02:09.426599Z","submitted_at":"2026-04-15T18:17:11Z","title":"DharmaOCR: Specialized Small Language Models for Structured OCR that outperform Open-Source and Commercial Baselines","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T13:19:07.809807Z"},"links":{"cited_paper":"/paper/2502.09650","citing_paper":"/paper/2604.14314"},"observation_digest":"sha256:1b23f2e4fa186cd9b4f4df4e8cc4dd4e9d0d8051e737a1f5530de04c01c5021d","observation_id":"920f037d-8d99-4794-8d44-df315aa8d5cd","resolution":{"observed_at":"2026-05-10T13:20:25.566649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"cited_work":{"arxiv_id":"2502.09650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09650","snapshot_observed_at":"2026-07-03T00:37:30.066482Z","title":"Prin- cipled data selection for alignment: The hidden risks of difficult examples.arXiv preprint arXiv:2502.09650","venue":null,"work_id":"ef7d2765-5489-4ee7-a33a-69eaf8fae1f2","year":2025},"citing_paper":{"arxiv_id":"2606.09078","last_updated":"2026-06-08T06:22:33Z","snapshot_observed_at":"2026-08-02T22:19:23.885533Z","submitted_at":"2026-06-08T06:22:33Z","title":"The Hidden Bias of Process Reward Models:PRISM for Rewarding the Right Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T17:07:06.227106Z"},"links":{"cited_paper":"/paper/2502.09650","citing_paper":"/paper/2606.09078"},"observation_digest":"sha256:66c6f520bd32df21b5fa7b321c3bb2407777d1a539ddc542662ac67fba9e8eac","observation_id":"71147718-e90a-4306-bc05-e8a15b8b11cb","resolution":{"observed_at":"2026-07-03T00:37:30.067973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09650/citation-record","integrity":"/paper/2502.09650/integrity","json":"/paper/2502.09650/citation-record.json","paper":"/paper/2502.09650"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.661466Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.661466Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:d0ac0a225367d18971f9d2183e7b872c8cd17f5f73c75d15dd68278a46baa8a4","observation_id":"0a933d5a-ad80-4ede-bab5-ed53bf83892e","resolution":{"observed_at":"2026-08-08T11:57:11.661466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.667419Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.667419Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:f12b5bef385152d2a17e54a898072df654405d59897e934c6da689ae9d4ef3ac","observation_id":"655266a0-cd06-4946-add8-dca8dff3a089","resolution":{"observed_at":"2026-08-08T11:57:11.667419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.671948Z","title":"M., Longpre, S., Lambert, N., Wang, X., Muennighoff, N., Hou, B., Pan, L., Jeong, H., Raffel, C., Chang, S., Hashimoto, T., and Wang, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.671948Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:1a01c9f8d739ced6845a422b6e1b1bd5810194f261e78b5bd6150703f2d55e46","observation_id":"57bbada3-4c13-49f8-afac-91e6e5a6ed21","resolution":{"observed_at":"2026-08-08T11:57:11.671948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20541","last_updated":"2024-05-30T23:50:20Z","snapshot_observed_at":"2026-07-06T18:23:05.893052Z","submitted_at":"2024-05-30T23:50:20Z","title":"Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20541","snapshot_observed_at":"2026-08-08T11:57:11.676305Z","title":"L., and Paul, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.676305Z"},"links":{"cited_paper":"/paper/2405.20541","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:db9bb87011f3a1e1b1638c5fcdb26b8a390c847ae3c7751220c3995a00c178fb","observation_id":"6e6e59b9-9d2e-404c-ac45-9fdc6889f447","resolution":{"observed_at":"2026-08-08T11:57:11.676305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.681101Z","title":"Ultrafeedback binarized preferences-cleaned","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.681101Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:563a9b0cf75b48b6e65ae2a8c526f2a4934ed5a9b7e5bdd00b9b57a45183e381","observation_id":"605a9ffb-e7c1-4037-9535-20a6c4ab1b3f","resolution":{"observed_at":"2026-08-08T11:57:11.681101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-08T11:57:11.685443Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.685443Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:9bc7ca5e3ac571a475c33e85f1ad9576bd666735c820e1f1ff848d499751c89d","observation_id":"4dcbc8d6-dd6e-4c34-8d7a-76acbff3d966","resolution":{"observed_at":"2026-08-08T11:57:11.685443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.690190Z","title":"Teaching by examples: Implications for the process of category acquisition","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.690190Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b847c09961201bf21864efbae64c548ff2589effb3c4976207d37516da73df68","observation_id":"f0859dfe-08ef-4b56-ad86-17e0e915f779","resolution":{"observed_at":"2026-08-08T11:57:11.690190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.694676Z","title":"G., Guo, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.694676Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b5c29e26c77d610b61380586c7dddd2377efe0827ad403681df2f5efd7b1c751","observation_id":"9da6ea09-c173-49e0-8e8d-8d975e47b590","resolution":{"observed_at":"2026-08-08T11:57:11.694676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-08T11:57:11.698975Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.698975Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:0d83695731cb6140a8a4a8a23f87a549f6e3c14a3819e489c4db649a12f09d38","observation_id":"b71b82f7-5985-4a1c-afcd-07679dda7d93","resolution":{"observed_at":"2026-08-08T11:57:11.698975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.706330Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.706330Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:7a3363018db5da35f0d9f39c5436b541c9ae9ecb148637624f162545c4b0cf7c","observation_id":"e261bedc-56bf-4bcc-9069-07ce8a9f60ab","resolution":{"observed_at":"2026-08-08T11:57:11.706330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.710699Z","title":"Open LLM leaderboard","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.710699Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:2455d8b06cc5a679cd83c40b1cc907f080bd3c3d1a9762401a480a391cd05d63","observation_id":"32f02130-c072-4f41-ad63-87d146a7684f","resolution":{"observed_at":"2026-08-08T11:57:11.710699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.714968Z","title":"Curriculum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.714968Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:3105d69b3156845096633e8cf1d5d7ad9aed96b508d053bb0827900854996829","observation_id":"07777237-1d3c-4473-aa2d-ea91f2173d2d","resolution":{"observed_at":"2026-08-08T11:57:11.714968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.719298Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.719298Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:45b0ba234e7ac17813f78244ff01a172e7e8b5a2247df0d84d652a8edd7ebcf1","observation_id":"cc0cf199-6327-40dd-b7f4-a3b1c1db935c","resolution":{"observed_at":"2026-08-08T11:57:11.719298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02170","last_updated":"2021-08-04T16:53:43Z","snapshot_observed_at":"2026-07-06T11:35:35.934125Z","submitted_at":"2021-08-04T16:53:43Z","title":"Curriculum learning for language modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02170","snapshot_observed_at":"2026-08-08T11:57:11.723302Z","title":"Curriculum learning for language modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.723302Z"},"links":{"cited_paper":"/paper/2108.02170","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:66cf0eb9f846aea6a4cc179c042ea27691405ae2ccbcaf046111e010df9005e5","observation_id":"5bb97408-e321-487e-9c3b-d58ac09da152","resolution":{"observed_at":"2026-08-08T11:57:11.723302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-09T02:49:30.442127Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-08T11:57:11.728183Z","title":"Instruction mining: When data mining meets large language model finetuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.728183Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:1a2be15e62802604107814344e4c3922b9011c6114aeec087f7bd27debbd98c9","observation_id":"4fe5805a-6445-47aa-b221-09d44d6ab5f2","resolution":{"observed_at":"2026-08-08T11:57:11.728183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.733077Z","title":"Does the order of training samples matter? improving neural data-to-text generation with curriculum learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.733077Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:a8d4c16f6a87f1afd0c3c54a5f628e11b0d242ccd6936133f3d1656319167b95","observation_id":"62fe3a44-be84-43aa-a070-2c43626dc536","resolution":{"observed_at":"2026-08-08T11:57:11.733077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.737460Z","title":"Alpagasus: Training a better alpaca with fewer data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.737460Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:517645b6200c4cc97a84a54ca31803e9dfb538c0468ff80bd6cb6328048960bb","observation_id":"ee77afaa-5587-488d-9163-7eb5f02abd9e","resolution":{"observed_at":"2026-08-08T11:57:11.737460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.742169Z","title":"Skill-it! a data-driven skills framework for understanding and training language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.742169Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:846d0a596dcef944ec8d6f1cfa6cddc20413f492522e674e69f10329c27a8bd6","observation_id":"031b1471-498f-4f13-afa7-740b6b25be23","resolution":{"observed_at":"2026-08-08T11:57:11.742169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.746264Z","title":"Sdformer: Similarity-driven discrete transformer for time series generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.746264Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:77e33fa12984a3cf2561d8573daae28413156ac6c6efed2432bbfdf85bdf2f16","observation_id":"5a9e2a0a-dfd6-4f37-ba10-92c534bb9e07","resolution":{"observed_at":"2026-08-08T11:57:11.746264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.304905Z","title":"R., Kini, A., and Natarajan, N","venue":null,"work_id":"0cb22192-7665-492b-9f6d-0a965820817c","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.751157Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:d74ef2101b4d86a6491d529679ff3d61a91658166d735a49e2ccf83c8c919abd","observation_id":"73615786-de88-418e-a2d8-f9e4bfe2ee1f","resolution":{"observed_at":"2026-08-08T11:57:13.309048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.759750Z","title":"F., Leike, J., Brown, T., Martic, M., Legg, S., and Amodei, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.759750Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b9b635ba32729bbe5f3a59b3597e7d05c1e98dbe6a077b235e4d81499191e161","observation_id":"d01213d0-5a6f-4594-a656-f9104ba1c249","resolution":{"observed_at":"2026-08-08T11:57:11.759750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T11:57:11.764207Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.764207Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:a3da1d9127d9cf0611a4ae2e84175cfadf9c6666e596df15b85256ff88f38e2c","observation_id":"a5c8f22b-a6b8-4bf2-afed-ea171b7136f6","resolution":{"observed_at":"2026-08-08T11:57:11.764207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01472","last_updated":"2024-10-19T14:57:50Z","snapshot_observed_at":"2026-08-08T04:38:36.310621Z","submitted_at":"2023-08-02T23:39:29Z","title":"Reverse Stable Diffusion: What prompt was used to generate this image?","version":3},"cited_work":{"arxiv_id":"2308.01472","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.01472","snapshot_observed_at":"2026-08-08T11:57:12.462848Z","title":"Reverse Stable Diffusion: What prompt was used to generate this image?","venue":"cs.CV","work_id":"e873e5aa-6183-4ab3-814d-e43fcefd7b53","year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.770758Z"},"links":{"cited_paper":"/paper/2308.01472","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:44e54c592f08c0659b032a3b3cedd0fd1b3ac6118118a346894f686662a0eea1","observation_id":"04942a48-e175-4873-892f-abc86e3a6375","resolution":{"observed_at":"2026-08-08T11:57:12.470267Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13637","last_updated":"2025-05-09T08:38:29Z","snapshot_observed_at":"2026-08-06T04:15:24.770982Z","submitted_at":"2024-05-22T13:36:48Z","title":"Curriculum Direct Preference Optimization for Diffusion and Consistency Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13637","snapshot_observed_at":"2026-08-08T11:57:11.775726Z","title":"T., Sebe, N., and Shah, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.775726Z"},"links":{"cited_paper":"/paper/2405.13637","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:8e6d1e5474357ca0df075cfdb224b554e5ba778b7d149416bb1e713f74079819","observation_id":"dd1ed5de-a3ed-4067-a9a1-abb6b5d77eed","resolution":{"observed_at":"2026-08-08T11:57:11.775726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15653","last_updated":"2023-11-27T09:33:13Z","snapshot_observed_at":"2026-07-06T16:52:57.823137Z","submitted_at":"2023-11-27T09:33:13Z","title":"MoDS: Model-oriented Data Selection for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15653","snapshot_observed_at":"2026-08-08T11:57:11.781005Z","title":"Mods: Model-oriented data selection for instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.781005Z"},"links":{"cited_paper":"/paper/2311.15653","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:8c797c523510287d2d60fc472be703845cca4a200ba5490c581db32ca4074c1f","observation_id":"2ef54133-80ae-4ec1-a897-b8bae6146a04","resolution":{"observed_at":"2026-08-08T11:57:11.781005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T11:57:11.785598Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.785598Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:a434ca3a8926d9b62ca6fb1884ffce398af904b8d925dff3ab4e756b71f51c67","observation_id":"995355fc-80ec-40fa-8905-d823662788d0","resolution":{"observed_at":"2026-08-08T11:57:11.785598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.283594Z","title":"Length-controlled alpacaeval: A simple debiasing of automatic evaluators","venue":null,"work_id":"181f9deb-0d47-4b1a-8814-000ae5df18d5","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.790283Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b733303643c7e7243f9350a2942a2e24847d4eb91642f5a475ade1bc3d8a2215","observation_id":"175afe08-8912-4b17-96bd-099c513ca4ee","resolution":{"observed_at":"2026-08-08T11:57:13.288253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.270298Z","title":"Dsdm: Model-aware dataset selection with datamodels","venue":null,"work_id":"ddc5dd4a-b3b5-4f79-b9af-e2c92b11e1ab","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.794357Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:6dff2398bcb24abd4ec01501816c0f2c49066e5e88d8686b98d832f7848d07b1","observation_id":"75bfca09-7ec5-4c8a-9aeb-da243389824f","resolution":{"observed_at":"2026-08-08T11:57:13.274675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.257337Z","title":"Understanding dataset difficulty with \\ V \\ -usable information","venue":null,"work_id":"a7f73945-1215-4e61-acbe-3f9d911fefd4","year":2022},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.798601Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:721ce87b966ca288f6a4e215fe3f23055d056b96d9fa229f2384af2bce4c2ced","observation_id":"5c6ec3db-1c06-45e6-a387-f3711f9458b9","resolution":{"observed_at":"2026-08-08T11:57:13.261627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.244080Z","title":"Model alignment as prospect theoretic optimization","venue":null,"work_id":"4fe2ce8b-7b9d-4151-b78e-681b72b8df29","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.802491Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:44e64db04a2e200fcd9515d54b6adb61c5c8d539208c10189dd237cbcf9eebcb","observation_id":"2eebdb39-6605-40ea-b02c-2819b49dbc07","resolution":{"observed_at":"2026-08-08T11:57:13.248336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.230750Z","title":"Impact of preference noise on the alignment performance of generative language models","venue":null,"work_id":"bb58b64f-f14b-4282-9dbd-fde8ee6d4c6e","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.806525Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:4e58fce9c49a73f1ca5f152da700d521c74c4adcb5880d297c72deaf4f2359d3","observation_id":"a14c0fb6-3e55-43db-afe2-d1243e18a279","resolution":{"observed_at":"2026-08-08T11:57:13.234931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.217904Z","title":"Understanding finetuning for factual knowledge extraction","venue":null,"work_id":"84fdca9c-da78-400d-a138-a990a058bb05","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.810491Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:19edf07a5590c818163bd4cdfe31f4a3f6a8a1774a7b7e59c0b9094837375ea6","observation_id":"f3e08ea9-aae9-4812-9fae-d47368c74181","resolution":{"observed_at":"2026-08-08T11:57:13.222187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07691","snapshot_observed_at":"2026-08-08T11:57:11.814773Z","title":"ORPO : Monolithic preference optimization without reference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.814773Z"},"links":{"cited_paper":"/paper/2403.07691","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:db49fac260d24a159817eddbd5e3a40b0ac957e6bf777054be4cae2281af718b","observation_id":"00099db9-8739-4b1c-813b-d2136ec4efc6","resolution":{"observed_at":"2026-08-08T11:57:11.814773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.819203Z","title":"J., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., Chen, W., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.819203Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:868125ccaa8ecd112b394aa4682550d1a8d958ce5264dd39b39afaa80e4a1cb0","observation_id":"1ddbfca8-8e12-4ce2-ab49-3c98d34eabd9","resolution":{"observed_at":"2026-08-08T11:57:11.819203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.196570Z","title":"R., and Kwon, D","venue":null,"work_id":"c74cc1ea-d44f-458b-8028-b12b0d49393e","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.823176Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:a77ca4c2a0b80f2cf0bc39fb5fd92139ef87ce3236e65173c37a5f007afaf4ad","observation_id":"6793c83e-ec25-47ae-86ab-202543295f95","resolution":{"observed_at":"2026-08-08T11:57:13.200527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T11:57:11.826904Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.826904Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:ac8f79f47606281b6ed2ff654101275c785327908baccbb1a5897c90f1c85666","observation_id":"95d7a382-e5e9-4146-b24d-fda38f6883ba","resolution":{"observed_at":"2026-08-08T11:57:11.826904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.183451Z","title":null,"venue":null,"work_id":"24130ae8-63ae-4561-9f50-ffa316783473","year":2014},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.830975Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:f36893f9cc8f12962f0ed1d3781d4ea74c410460057989979640bad8d61ddfcb","observation_id":"922a2571-2e4d-46d1-8fa7-ff119a734921","resolution":{"observed_at":"2026-08-08T11:57:13.187780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03651","last_updated":"2016-12-12T12:51:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-12-12T12:51:03Z","title":"FastText.zip: Compressing text classification models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.03651","snapshot_observed_at":"2026-08-08T11:57:11.834633Z","title":"Fasttext","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.834633Z"},"links":{"cited_paper":"/paper/1612.03651","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:54f49b08c7170d5b56ca3330a60d1a100d1d2b6436e0454db5b1bd88efccdede","observation_id":"c2e50a66-9019-4125-8d4a-f49120d02f91","resolution":{"observed_at":"2026-08-08T11:57:11.834633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07490","last_updated":"2024-05-13T06:09:10Z","snapshot_observed_at":"2026-07-06T18:13:20.536375Z","submitted_at":"2024-05-13T06:09:10Z","title":"Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07490","snapshot_observed_at":"2026-08-08T11:57:11.838854Z","title":"and Lee, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.838854Z"},"links":{"cited_paper":"/paper/2405.07490","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:70c008dbde5daf951e482dd27263f6e4943081eef99c0d8eb7867c466d42d3f6","observation_id":"22f798a6-2699-4fbd-a2c0-01765da5c2ad","resolution":{"observed_at":"2026-08-08T11:57:11.838854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.170182Z","title":null,"venue":null,"work_id":"7279bcba-a586-4977-969a-5f5b86f253bb","year":2025},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.842709Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:81cc1ef0e6cb9724e53127fa406908aa427d9294249398a07b45ef688f3e9654","observation_id":"407c4005-7e06-40a9-ad05-bd90e5f34dfc","resolution":{"observed_at":"2026-08-08T11:57:13.174778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.154028Z","title":"The bigscience roots corpus: A 1.6 tb composite multilingual dataset","venue":null,"work_id":"0607f8c8-6911-4c88-8211-4fcc7819a23b","year":2022},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.846440Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:15d5b694891a90b0d8e793ebf03d8c6e88ff22034ac5ca8321723db8e3f3f42d","observation_id":"6c5f8b8d-a28b-42e0-a1f5-5f11f87b7054","resolution":{"observed_at":"2026-08-08T11:57:13.160470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06499","last_updated":"2022-03-24T19:29:45Z","snapshot_observed_at":"2026-08-05T18:30:13.997811Z","submitted_at":"2021-07-14T06:06:52Z","title":"Deduplicating Training Data Makes Language Models Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06499","snapshot_observed_at":"2026-08-08T11:57:11.850578Z","title":"Deduplicating training data makes language models better","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.850578Z"},"links":{"cited_paper":"/paper/2107.06499","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:9ee89d0c4e6693780e1f42b3cd3018ac2aa2bbeddf79aa2d0e06af6906e9777a","observation_id":"a73ca80c-d3fb-4b66-b229-20d104962919","resolution":{"observed_at":"2026-08-08T11:57:11.850578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.854392Z","title":"From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.854392Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b866c4787052ceee348dd9113fdecd09f8fb5b28da845817497d2b5280cff1a8","observation_id":"3fd1f474-239e-468d-8eca-f904ba2e90a2","resolution":{"observed_at":"2026-08-08T11:57:11.854392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-08T11:57:11.858507Z","title":"E., and Stoica, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.858507Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:d425d334a7dd4a62f7e3b26e11cc477bb75d42b3136234105e2ba2515d8eecf9","observation_id":"6bdd99c2-b198-4483-a296-4380124dc056","resolution":{"observed_at":"2026-08-08T11:57:11.858507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.862678Z","title":"Not all tokens are what you need for pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.862678Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:0da16f3952a11e98272b0efe10d65bd7162701a8f874ff6eabfc998fa58c4bf8","observation_id":"f3ac5268-774e-4fca-8653-f613abf7228d","resolution":{"observed_at":"2026-08-08T11:57:11.862678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.124353Z","title":"High dimensional robust m-estimation: Arbitrary corruption and heavy tails","venue":null,"work_id":"c2a37109-d92e-4b97-b3e8-b95bcc8a1224","year":2021},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.867488Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:781526ce1d6f1d9bb1bf7658f22f6011db581835a98f403cd703db72b25059fb","observation_id":"9c87cbab-1c7c-45b6-82ff-9fc427a1c648","resolution":{"observed_at":"2026-08-08T11:57:13.128916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.110176Z","title":"What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning","venue":null,"work_id":"b1c49d6e-0940-4581-a19d-b328ba56777e","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.872243Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:f33876d99bfc6ecc4d8a4f96272543aa6329856c594a5b2fdfe2706ddf260af1","observation_id":"a70c0d2d-c428-4ac4-987a-b2fe3b1531d2","resolution":{"observed_at":"2026-08-08T11:57:13.114562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.095675Z","title":"Simpo: Simple preference optimization with a reference-free reward","venue":null,"work_id":"ceea58d4-fb57-4164-8477-86c4ac1d70bf","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.876535Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:7776520d6f3eba0564216ca7f38c65b80232a8176a136fd36b21754e0b4791fa","observation_id":"08b2976a-b413-4734-9fab-b0c9f6b01ff6","resolution":{"observed_at":"2026-08-08T11:57:13.100378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.082985Z","title":"and Sachdeva, B","venue":null,"work_id":"743e50c2-4190-4fa9-bf8e-8478ff4fca9d","year":2020},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.881887Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:214a2248f5426fb1e583b5379db8c5437478631fa305c8ef2420a86ae075ba86","observation_id":"c85bd4a2-e299-4a9c-8397-10f4a19d2911","resolution":{"observed_at":"2026-08-08T11:57:13.086970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.067912Z","title":"A note on dpo with noisy preferences and relationship to ipo, 2023","venue":null,"work_id":"0038539e-051e-4ee3-8fa5-4a59eedc65df","year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.887035Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:6200003e880f2b7dbab548d3816e9dd5c318c79102f603a399021c28c9eed20c","observation_id":"e7d6aa9d-decf-4b25-9720-4277ed638ab2","resolution":{"observed_at":"2026-08-08T11:57:13.073007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-08T11:57:11.891521Z","title":"Orca: Progressive learning from complex explanation traces of gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.891521Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:6a3d490abf1d3b04ebb18725efdf88045c871b23110699798e44b13d3844cb1c","observation_id":"7b6659a8-b42c-4ddf-9082-713bce8805ee","resolution":{"observed_at":"2026-08-08T11:57:11.891521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.054247Z","title":"Length-based curriculum learning for efficient pre-training of language models","venue":null,"work_id":"b2f69741-d4cd-4da9-bdd4-d945784ad035","year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.896084Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:e6eace0497a4c050c72fa3022329c3b7367460e3088251d885e07077fbe19040","observation_id":"392909e0-5bac-496e-aa51-7cebca0482c2","resolution":{"observed_at":"2026-08-08T11:57:13.058550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.900352Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.900352Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:ba13f1e0067f2e21cb5dd25129f1d1b178497e02262a831ca5536400e8a83d62","observation_id":"ec70e3df-60ad-476f-b01a-f56379d30e89","resolution":{"observed_at":"2026-08-08T11:57:11.900352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.030089Z","title":"Disentangling length from quality in direct preference optimization","venue":null,"work_id":"1b9f0a69-0879-4a6e-a7ba-0f4da4d867c5","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.905008Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:2aa35be6a6ef17de67cbcd1ebd8dbe02861a3217efe5b0d09c6d60047e0d36e3","observation_id":"69a027fa-09de-4856-a636-9c3d356ad18b","resolution":{"observed_at":"2026-08-08T11:57:13.035108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07230","last_updated":"2024-11-08T08:55:00Z","snapshot_observed_at":"2026-08-05T03:29:24.626607Z","submitted_at":"2024-03-12T00:58:19Z","title":"Curry-DPO: Enhancing Alignment using Curriculum Learning & Ranked Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07230","snapshot_observed_at":"2026-08-08T11:57:11.908968Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.908968Z"},"links":{"cited_paper":"/paper/2403.07230","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:d82e0f85f05ce705f7f19c8056fffd02c82cea1ae6271b18ac134538d2216e35","observation_id":"011012fb-a26c-4fd3-b3be-7af78c817c61","resolution":{"observed_at":"2026-08-08T11:57:11.908968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:13.015319Z","title":"The refinedweb dataset for falcon llm: Outperforming curated corpora with web data only","venue":null,"work_id":"fb92a3d8-a537-442a-8b3c-1d887ba866eb","year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.913742Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:8093f77ee3580f86cead79df79e8169e700b5daaeb70d6a5011b83b4cfde8ad2","observation_id":"9182f382-07a8-48d3-8ec8-8b6dee8cdf33","resolution":{"observed_at":"2026-08-08T11:57:13.020270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.09848","last_updated":"2019-03-26T12:39:04Z","snapshot_observed_at":"2026-08-06T17:53:06.711251Z","submitted_at":"2019-03-23T17:33:38Z","title":"Competence-based Curriculum Learning for Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.09848","snapshot_observed_at":"2026-08-08T11:57:11.918643Z","title":"A., Stretcu, O., Neubig, G., Poczos, B., and Mitchell, T","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.918643Z"},"links":{"cited_paper":"/paper/1903.09848","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:27ceb5fb8c8dcf39f389d7e616ad0b3bf67c9477858183e7b1aa054d4e57323b","observation_id":"ae81375a-4ac7-491b-aacf-0eac71313965","resolution":{"observed_at":"2026-08-08T11:57:11.918643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.996804Z","title":"Unleashing the power of data tsunami: A comprehensive survey on data assessment and selection for instruction tuning of language models","venue":null,"work_id":"a8790240-372a-4470-b04d-1a7494d00470","year":2025},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.926741Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:297bb58bcc85b51cbef9c035de01caf35d260ac27310d66defd9ca4e951edf22","observation_id":"9a191d7d-59e8-4d31-80bb-c97fca1aaa28","resolution":{"observed_at":"2026-08-08T11:57:13.005599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.931086Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.931086Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b04ccd453770e773a99a98e4c96c36ea6083b7fb5c6e96cc14d8bd4d4d9a107c","observation_id":"083b9713-f2ce-498c-8666-2674a89f69b8","resolution":{"observed_at":"2026-08-08T11:57:11.931086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00973","last_updated":"2024-11-01T18:55:31Z","snapshot_observed_at":"2026-07-06T19:43:50.724897Z","submitted_at":"2024-11-01T18:55:31Z","title":"Does the Definition of Difficulty Matter? Scoring Functions and their Role for Curriculum Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00973","snapshot_observed_at":"2026-08-08T11:57:11.934793Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.934793Z"},"links":{"cited_paper":"/paper/2411.00973","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:8bdd37610428fc5ea4c90ddebd8d5d82802042207430d106a18c5cb26014593a","observation_id":"08e846eb-3a94-4287-ad2b-72e4dabb1f8e","resolution":{"observed_at":"2026-08-08T11:57:11.934793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.972375Z","title":"Unintentional unalignment: Likelihood displacement in direct preference optimization","venue":null,"work_id":"62a03ed6-5f0e-4050-a8ab-dd237c0b8b77","year":2025},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.939156Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:38db3ac5be14f5e9fc217607ec1e9f8a9090863ebd87163c3b820d990f87e2f7","observation_id":"a7960c65-ab17-4a1c-9859-e573a68aaf78","resolution":{"observed_at":"2026-08-08T11:57:12.978007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.958454Z","title":"and Xing, E","venue":null,"work_id":"b2ba9c45-3b02-474d-906c-a86029c825f9","year":2016},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.943641Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b4ba488aceb1f2878c09449256b969d5c52ba035fd774edca5b38ff6b3ed3e0d","observation_id":"d11b659b-cd51-414d-a25b-32c931f16615","resolution":{"observed_at":"2026-08-08T11:57:12.962510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.945748Z","title":"and Sanghavi, S","venue":null,"work_id":"07f41b13-b2c5-4d14-bca5-5f776a64e80b","year":2019},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.947522Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:2c045d502648120f37da3b4efa8c1bea7937de46138ffad96e9f0fbc0e669c30","observation_id":"a8a25d3b-ed1a-4554-b97f-be09715256ae","resolution":{"observed_at":"2026-08-08T11:57:12.949944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.932424Z","title":"less is more","venue":null,"work_id":"386b3f2f-5604-494c-9f65-6c01654ad493","year":2010},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.951236Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:c925f9b74d5a78795b37f25596c261209ecfeaff8793309966ca6fbdfb647fa6","observation_id":"979a4161-c013-4ee9-ac56-681e8739204d","resolution":{"observed_at":"2026-08-08T11:57:12.936911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10795","last_updated":"2020-10-15T05:53:46Z","snapshot_observed_at":"2026-07-06T09:57:57.267506Z","submitted_at":"2020-09-22T20:19:41Z","title":"Dataset Cartography: Mapping and Diagnosing Datasets with Training Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10795","snapshot_observed_at":"2026-08-08T11:57:11.955008Z","title":"A., and Choi, Y","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.955008Z"},"links":{"cited_paper":"/paper/2009.10795","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:5ef4d23534b4d07d70a75cb48f3cfee4f46566b06970b8834b44c2d3461d4137","observation_id":"5531633e-afad-4aa1-bec4-d018de30fe39","resolution":{"observed_at":"2026-08-08T11:57:11.955008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.918847Z","title":"Txt360: A top-quality llm pre-training dataset requires the perfect blend, 2024","venue":null,"work_id":"187c6a4a-4cc1-4a4f-ab86-977092ce9217","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.959566Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:d80ee34099393043dbbc392053fed92cb50e13252574c3f6e3ad70ab91e58058","observation_id":"ae8a458b-9b4b-4162-8f9a-37e872afea67","resolution":{"observed_at":"2026-08-08T11:57:12.923219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.905622Z","title":"T., Fu, J., Phan, M","venue":null,"work_id":"428f8dff-148b-4e78-8f90-fafbf637162e","year":2019},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.963423Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:c05f478a2254e550afb372d9d77a11500771cb878cf1e69dfab96eb671e08800","observation_id":"f490e476-e0d8-4040-9af3-5d3f01dde2e3","resolution":{"observed_at":"2026-08-08T11:57:12.910127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-08T11:57:11.967745Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.967745Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:fa1dbdb86157fd657d7eb550e998c995c98a198cfb2728f2a51d1d672c03bb83","observation_id":"80644951-0cad-452e-a7d7-e00693aa1dc1","resolution":{"observed_at":"2026-08-08T11:57:11.967745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.973198Z","title":"P., and Ferrari, V","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.973198Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:3b5a5319ee59b34fbafad65de93ba25d286f19168a896d0dcdb88c9068e31544","observation_id":"cb5c15be-f400-401a-b886-f8b25640dbec","resolution":{"observed_at":"2026-08-08T11:57:11.973198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-08T11:57:11.978495Z","title":"Zephyr: Direct distillation of lm alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.978495Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:55c6a69a298b19c43def36f9b00504a3bfc1c65960181638c094d654c1d36778","observation_id":"870ea2fd-4993-429b-b46a-daf4079775d1","resolution":{"observed_at":"2026-08-08T11:57:11.978495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06080","last_updated":"2024-01-12T09:46:10Z","snapshot_observed_at":"2026-07-06T17:14:24.413664Z","submitted_at":"2024-01-11T17:56:59Z","title":"Secrets of RLHF in Large Language Models Part II: Reward Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06080","snapshot_observed_at":"2026-08-08T11:57:11.983807Z","title":"Secrets of rlhf in large language models part ii: Reward modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.983807Z"},"links":{"cited_paper":"/paper/2401.06080","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:17feea099fe8ce472eb8acf32534785264a1a9688f0720f1b5e2f7a05c6297f5","observation_id":"b94a2143-d519-4a37-9fa7-fbb3ac0946b1","resolution":{"observed_at":"2026-08-08T11:57:11.983807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.883908Z","title":"Step-on-feet tuning: Scaling self-alignment of LLM s via bootstrapping","venue":null,"work_id":"c01ce542-f0c0-4592-9817-0eb3e368b299","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.988483Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:d20231d2d44955e7c723594fe38d1056dbeb9fe333710bbdaae600cff36cd4f2","observation_id":"90a7941f-47b3-48c6-a163-0442e9a72dc6","resolution":{"observed_at":"2026-08-08T11:57:12.888359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.871487Z","title":"Interpretable preferences via multi-objective reward modeling and mixture-of-experts","venue":null,"work_id":"91a0c6b2-bb94-42fc-ac4a-deedd503e5b1","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.992709Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:e65365d7839fb28eb86d7347202cedcd5ae142b9cfb3bb1afa73eeaf2dcfcda9","observation_id":"2bf987ba-2635-4a5b-b5df-1583e60a6e02","resolution":{"observed_at":"2026-08-08T11:57:12.875678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:11.997368Z","title":"A., Beltagy, I., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:11.997368Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:e841174854c7f46661d34a3253d4eeaff8f634b34ebaa9cb7f136c9613af9939","observation_id":"49a71b7f-cfeb-401b-9744-2c979fcd276a","resolution":{"observed_at":"2026-08-08T11:57:11.997368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-08T11:57:12.001804Z","title":"Ethical and social risks of harm from language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.001804Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:383770d0ce378724f2d8f1d231e013d2dca282125c59f27f6e196b9f50c00d09","observation_id":"940ba6b1-8a36-4822-86f9-46e1db1009d1","resolution":{"observed_at":"2026-08-08T11:57:12.001804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00359","last_updated":"2019-11-15T00:03:54Z","snapshot_observed_at":"2026-07-06T08:34:04.911718Z","submitted_at":"2019-11-01T13:09:28Z","title":"CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00359","snapshot_observed_at":"2026-08-08T11:57:12.006202Z","title":"Ccnet: Extracting high quality monolingual datasets from web crawl data","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.006202Z"},"links":{"cited_paper":"/paper/1911.00359","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:98382d1c5ddb4e34f73b12e2d7948faa9666414e02accda4195fd5f827c597ae","observation_id":"0b6dea10-5fa3-4ed9-8f74-42e7b1419e38","resolution":{"observed_at":"2026-08-08T11:57:12.006202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.848708Z","title":"QuRating : Selecting high-quality data for training language models","venue":null,"work_id":"c866a52a-05e9-41d2-afe3-da588e8358b4","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.010894Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:729f396fe111c9ecb33063d77df058b028cdd2704cb2d4fc90aacf1cfe009bbb","observation_id":"f6c989b5-6636-4f75-a4db-1dd8a05d1b25","resolution":{"observed_at":"2026-08-08T11:57:12.853177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00102","last_updated":"2025-06-02T15:14:22Z","snapshot_observed_at":"2026-08-03T20:00:36.895740Z","submitted_at":"2024-06-27T07:20:36Z","title":"Curriculum Learning with Quality-Driven Data Selection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00102","snapshot_observed_at":"2026-08-08T11:57:12.015145Z","title":"Curriculum learning with quality-driven data selection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.015145Z"},"links":{"cited_paper":"/paper/2407.00102","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:553503954a75c494b152e0e758bd20de7761390a69b305357f5955f37ae4e805","observation_id":"ca3dbf38-26b2-4c2f-8cf0-69da62b1bb1e","resolution":{"observed_at":"2026-08-08T11:57:12.015145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08182","last_updated":"2023-11-14T14:10:40Z","snapshot_observed_at":"2026-08-06T20:29:14.286463Z","submitted_at":"2023-11-14T14:10:40Z","title":"Self-Evolved Diverse Data Sampling for Efficient Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08182","snapshot_observed_at":"2026-08-08T11:57:12.021189Z","title":"Self-evolved diverse data sampling for efficient instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.021189Z"},"links":{"cited_paper":"/paper/2311.08182","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:61ecc492ae17b4048ac1ef1a877851ff90678b7494ea3989e6b0c0d6c3dc6ad3","observation_id":"f622c6a1-b7c3-4f5a-8aca-07d4679662ef","resolution":{"observed_at":"2026-08-08T11:57:12.021189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.835005Z","title":"When do curricula work? In ICLR, 2021","venue":null,"work_id":"b91be88d-a82a-4866-a433-eace0ff8fe4e","year":2021},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.026003Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:c698eaa230ce560b66659f9a1bd14b927a781d25352ec40086f89db6b81746c5","observation_id":"8f2607de-027a-4b4c-b720-0a72b82dd6ed","resolution":{"observed_at":"2026-08-08T11:57:12.839294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09335","last_updated":"2024-12-09T09:31:39Z","snapshot_observed_at":"2026-08-07T17:08:17.369067Z","submitted_at":"2024-10-12T02:48:34Z","title":"Rethinking Data Selection at Scale: Random Selection is Almost All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09335","snapshot_observed_at":"2026-08-08T11:57:12.030030Z","title":"Rethinking data selection at scale: Random selection is almost all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.030030Z"},"links":{"cited_paper":"/paper/2410.09335","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:6471b0a29799cd97953d81397a42fc782414734c92820aadfaf8793112ffd4a4","observation_id":"6df0da23-b153-4c5a-8ac2-fa80700025b4","resolution":{"observed_at":"2026-08-08T11:57:12.030030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.821627Z","title":null,"venue":null,"work_id":"b3dd6429-6a15-48b4-b58f-d5875f7c4887","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.034822Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:ca4ad407e86928559e2ed86144c16bba0f75d85e107b86a7e828ee5d9f78eca9","observation_id":"7e51ab70-6814-4151-b81d-0f1e62d84023","resolution":{"observed_at":"2026-08-08T11:57:12.825816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.807892Z","title":"Rethinking the instruction quality: Lift is what you need","venue":null,"work_id":"fd8f1051-f6a1-4289-8603-12d4b3d25d4d","year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.041371Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:df238291207e7ed9d1de54b287ca1d839f0cccc42d97db1b0c65e90cb66e4495","observation_id":"b95b6ad0-937c-46af-9755-55ed9ae87e2f","resolution":{"observed_at":"2026-08-08T11:57:12.812254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-08T11:57:12.046156Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.046156Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:50482d4ec371427c94053840e7d3795863d31d6f242c1274a04356b9ba560451","observation_id":"eadf9e32-3fdb-4a20-a638-ca514234b2e6","resolution":{"observed_at":"2026-08-08T11:57:12.046156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.794970Z","title":"Mates: Model-aware data selection for efficient pretraining with data influence models","venue":null,"work_id":"28ff74eb-7013-4bd7-a5dc-ad028f490886","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.050566Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:901289b23d8cd6c4f921cf43335d1ecd79f5ddd2d87b30c57af494b61c64e0d3","observation_id":"7f9bfb16-3836-4a50-9d59-965f0af0bbab","resolution":{"observed_at":"2026-08-08T11:57:12.799510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.779968Z","title":"Rrhf: Rank responses to align language models with human feedback","venue":null,"work_id":"32353ab4-3ffe-4f27-a8b7-d5ccfd62863c","year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.054366Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:dbdc2941962c354312a918be9a841ee519e99c983007bb828d311e667c2d1ec3","observation_id":"6b82e389-4073-4ce6-9548-9f16ee90c6c5","resolution":{"observed_at":"2026-08-08T11:57:12.785266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1410.4615","last_updated":"2015-02-19T15:33:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-10-17T01:35:12Z","title":"Learning to Execute","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1410.4615","snapshot_observed_at":"2026-08-08T11:57:12.058622Z","title":"and Sutskever, I","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.058622Z"},"links":{"cited_paper":"/paper/1410.4615","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:ec02656558b09d70ac1585078fe983b58b4dbd42c17d838380cc7543909e6855","observation_id":"1545fe36-70d1-4250-8e09-1041f3ed5f4b","resolution":{"observed_at":"2026-08-08T11:57:12.058622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-08T11:57:12.062800Z","title":"X., Zhou, K., Li, J., Tang, T., Wang, X., Hou, Y., Min, Y., Zhang, B., Zhang, J., Dong, Z., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.062800Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:7eb4049a531eec846230fab0bb1d09658005bf403f14995c5a501719e0caef26","observation_id":"af7312c9-8c9e-4264-a862-3898fe373720","resolution":{"observed_at":"2026-08-08T11:57:12.062800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10425","last_updated":"2023-05-17T17:57:10Z","snapshot_observed_at":"2026-08-02T06:11:08.013358Z","submitted_at":"2023-05-17T17:57:10Z","title":"SLiC-HF: Sequence Likelihood Calibration with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10425","snapshot_observed_at":"2026-08-08T11:57:12.067249Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.067249Z"},"links":{"cited_paper":"/paper/2305.10425","citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:21625e9b8369ed6e9009b7198aeb9a6890615a46f5f5509fe47e051e18bd1f9a","observation_id":"f423684f-2bfc-493e-9f0c-f0ec5536991d","resolution":{"observed_at":"2026-08-08T11:57:12.067249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.071918Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.071918Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:a5d2c6c14223118faad3ff5da9b556f6c934d7674910545a56dc4ac45445397a","observation_id":"c5300fb5-7f8d-4383-a4df-7bea9bcb9b16","resolution":{"observed_at":"2026-08-08T11:57:12.071918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.757560Z","title":"Lima: Less is more for alignment","venue":null,"work_id":"dc07a1a8-18fa-40a0-814a-40b38aead213","year":2023},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.076132Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b88279fd3af25b49a0da0142dcf24be9813576d1ff49093a12e3b895b85b7abe","observation_id":"9bf9302b-dd28-4f2a-83a4-507ded88943e","resolution":{"observed_at":"2026-08-08T11:57:12.762329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.741643Z","title":"R., Zhao, S., Song, K., Xu, S., and Zhu, C","venue":null,"work_id":"2bf20f84-45c7-4167-b508-405c15327b51","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.080391Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:e51a1f1d4a1106e402ac310265bb041bc05fa426e68116f4cb18ffe55c026575","observation_id":"e610697b-1579-4e58-9e90-d7d9984f5ffc","resolution":{"observed_at":"2026-08-08T11:57:12.746027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.728135Z","title":"Iterative data smoothing: Mitigating reward overfitting and overoptimization in rlhf","venue":null,"work_id":"eb4f571f-83d1-46e1-acf1-9cf3a1a78877","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.084310Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:b365882b2a6bc6eb198b7c06f0cadf954d73891c7adb5de32067bda66eee0b42","observation_id":"92d66173-e377-4369-bd29-6c1e14643f46","resolution":{"observed_at":"2026-08-08T11:57:12.732586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:57:12.709102Z","title":"Exploring the learning difficulty of data: Theory and measure","venue":null,"work_id":"c4e842da-2cb6-4095-bdcb-e6660dc87841","year":2024},"citing_paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-08T11:57:12.088561Z"},"links":{"citing_paper":"/paper/2502.09650"},"observation_digest":"sha256:2ee020c3ac9790ba60c7e41a51dd5514f9dc1ba38bf18b4c82f953954b46c751","observation_id":"076af431-e5b3-4735-b8ec-b743b489b3f0","resolution":{"observed_at":"2026-08-08T11:57:12.713528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.09650","last_updated":"2025-05-13T18:54:09Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T02:50:07.586622Z","submitted_at":"2025-02-11T17:01:11Z","title":"Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 5 inbound Pith citation observations for arXiv:2502.09650."}