{"as_of":"2026-08-15T07:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dcff395343f21cba7869f68f98cfa934635db376d08d18d1005a5181ec7f696f","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:43:29.483303Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20465/citation-record","integrity":"/paper/2607.20465/integrity","json":"/paper/2607.20465/citation-record.json","paper":"/paper/2607.20465"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.268938Z","title":"Fowlkes, Stefano Soatto, and Pietro Perona","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.268938Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:bbbdef256b6863b7a70ff26cc333cbcf5ff44872d4215d929ec5aa2ea490b808","observation_id":"bd4b03ec-4b6f-40c5-8b3e-b5487fe65a13","resolution":{"observed_at":"2026-08-02T13:43:29.268938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16640","last_updated":"2024-07-18T09:01:52Z","snapshot_observed_at":"2026-08-12T23:57:42.090430Z","submitted_at":"2024-05-26T17:31:21Z","title":"A Survey of Multimodal Large Language Model from A Data-centric Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16640","snapshot_observed_at":"2026-08-02T13:43:29.274883Z","title":"A survey of multimodal large language model from a data-centric perspective.arXiv preprint arXiv:2405.16640, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.274883Z"},"links":{"cited_paper":"/paper/2405.16640","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:3d98ec2233d4bf554a10c67e251a16658555bc2fd4803997debe7686475160d1","observation_id":"cdffe553-588b-46b7-888b-cadc8844152d","resolution":{"observed_at":"2026-08-02T13:43:29.274883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.281395Z","title":"Text2sql-flow: A robust sql-aware data augmentation framework for text-to-sql.arXiv preprint arXiv:2511.10192, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.281395Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:9575e6f35b9fe2174951718e7a23d87d602bd8ac0ffe312929c7f0643552f88b","observation_id":"fd684c46-25f3-4722-bfef-fec878732057","resolution":{"observed_at":"2026-08-02T13:43:29.281395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.286818Z","title":"Data-juicer: A one-stop data processing system for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.286818Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:77e1be7dc7c10b74759d739d1199fb8ec13b61d9d6a2427c2b9f323b48c16404","observation_id":"a93b4c45-4b63-45cb-be31-147ea1e05d4b","resolution":{"observed_at":"2026-08-02T13:43:29.286818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.292145Z","title":"Dc-bench: Dataset condensation benchmark.Advances in Neural Information Processing Systems, 35:810–822, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.292145Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:9ca09b08c5159f2422e4e55e9d0a77fe38e09a65aead5247096569455950051e","observation_id":"dcbe75e0-c1c3-41c6-a1a3-81dff4e03df5","resolution":{"observed_at":"2026-08-02T13:43:29.292145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.296952Z","title":"Enhancing chat language models by scaling high-quality instructional conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.296952Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:553e02fc33ef397030da05262ae6e556ccc232211c3b31be131ce611abed42a8","observation_id":"7c4aa522-9ce7-4455-859b-e95d8a464882","resolution":{"observed_at":"2026-08-02T13:43:29.296952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18693","last_updated":"2025-05-27T11:56:56Z","snapshot_observed_at":"2026-08-12T22:15:56.081296Z","submitted_at":"2024-10-24T12:42:04Z","title":"Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18693","snapshot_observed_at":"2026-08-02T13:43:29.303491Z","title":"Unleashing reasoning capability of llms via scalable question synthesis from scratch.arXiv preprint arXiv:2410.18693, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.303491Z"},"links":{"cited_paper":"/paper/2410.18693","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:73929f1844ec0e8d3f5f88d3996df34ab1cb4ba3729d13ef025eebb932e9ee64","observation_id":"603995aa-e9eb-4334-a2a1-06b30605e8f0","resolution":{"observed_at":"2026-08-02T13:43:29.303491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16812","last_updated":"2025-08-27T03:10:49Z","snapshot_observed_at":"2026-08-13T07:31:38.516844Z","submitted_at":"2025-07-22T17:59:03Z","title":"MegaScience: Pushing the Frontiers of Post-Training Datasets for Science Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16812","snapshot_observed_at":"2026-08-02T13:43:29.308285Z","title":"Megascience: Pushing the frontiers of post-training datasets for science reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.308285Z"},"links":{"cited_paper":"/paper/2507.16812","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:adfa476d94bff4730bac3e48384bcdc3d5ca6a0541523795bc6b884f2f6b3fed","observation_id":"a22e3b31-e2d7-4070-a10c-45ae2789e857","resolution":{"observed_at":"2026-08-02T13:43:29.308285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02410","last_updated":"2023-07-02T22:58:51Z","snapshot_observed_at":"2026-08-13T14:12:29.107649Z","submitted_at":"2022-10-05T17:32:16Z","title":"The Vendi Score: A Diversity Evaluation Metric for Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02410","snapshot_observed_at":"2026-08-02T13:43:29.312742Z","title":"The vendi score: A diversity evaluation metric for machine learning.arXiv preprint arXiv:2210.02410, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.312742Z"},"links":{"cited_paper":"/paper/2210.02410","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:1d49890bf87c31548b7ee84f5b90fdda8ecab56b8c6e6a0b9a59f0ec677278a3","observation_id":"941e3dc9-bf3c-4716-a14f-fbaec6ad7448","resolution":{"observed_at":"2026-08-02T13:43:29.312742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.317738Z","title":"Datacomp: In search of the next generation of multimodal datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.317738Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:8c240bc63c8ead65234815be6b9eb56993c23ec6fcdcc08e41343f7c34635d46","observation_id":"858d25fd-5f67-4e8b-aa18-786e218ef8c7","resolution":{"observed_at":"2026-08-02T13:43:29.317738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.321741Z","title":"Closing the data loop: Using opendataarena to engineer superior training datasets.arXiv preprint arXiv:2601.09733, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.321741Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:44d1ef098a630804a94e6ec6067969ee2df7bd6c10fb24c8bd76b395de9c07c0","observation_id":"96272a94-f334-4826-be5b-c904b8f16b8c","resolution":{"observed_at":"2026-08-02T13:43:29.321741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T13:43:29.326449Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.326449Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:eee0a4ed5af7acf1e995caadfa04137e5c464d05f955e288ad597725bc9ba6fc","observation_id":"edec8fc0-5fe7-4784-8327-c3dd57a4efee","resolution":{"observed_at":"2026-08-02T13:43:29.326449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-13T11:19:55.436754Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-02T13:43:29.331049Z","title":"Textbooks are all you need.arXiv preprint arXiv:2306.11644, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.331049Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:9db58d67857dd8fb53d29e9a53e8ceb8240fec0ba0ba33a6790e3e5ef727bcbc","observation_id":"8260ba64-d930-43a0-9770-7534233be136","resolution":{"observed_at":"2026-08-02T13:43:29.331049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.335854Z","title":"Lawyer llama technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.335854Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:0ab14534d460d1ae6301ab468b312e24c9036af1e74c35ded2dadcc749a3c26f","observation_id":"fd6371c9-9507-4444-b855-2c9090b67b95","resolution":{"observed_at":"2026-08-02T13:43:29.335854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-02T13:43:29.340436Z","title":"Mistral 7b.arXiv preprint arXiv:2310.06825, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.340436Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:be2c180d8d0f375f8e0dfea71d7feb24c1e93419d8a8e2be0c9281c50e63ca5c","observation_id":"9c181c15-a749-47ab-9e2a-19cf6cb0d272","resolution":{"observed_at":"2026-08-02T13:43:29.340436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-02T13:43:29.344746Z","title":"Scaling laws for neural language models.arXiv preprintarXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.344746Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:659c6b77202f8b216d4605c98e4f0c8af6367272d5f5bdcfa99e924d68997a15","observation_id":"56135507-05ce-4684-a697-169e33636bf7","resolution":{"observed_at":"2026-08-02T13:43:29.344746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.349168Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.349168Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:c4af85355e26bdf0764d661c83177716427fc00d5940cc3c2a9a9ed5078f95d5","observation_id":"cc07498d-6c21-4743-bacd-6e6d90f45803","resolution":{"observed_at":"2026-08-02T13:43:29.349168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.353546Z","title":"Datacomp-lm: In search of the next generation of training sets for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.353546Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:b5b56866b187b94c244a684ff66b65190b42d51368464ec235936cb16059d5fc","observation_id":"798812e9-500e-42ac-beab-8982f38a73f6","resolution":{"observed_at":"2026-08-02T13:43:29.353546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11116","last_updated":"2025-06-09T06:37:15Z","snapshot_observed_at":"2026-08-14T02:32:24.189918Z","submitted_at":"2025-06-09T06:37:15Z","title":"Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11116","snapshot_observed_at":"2026-08-02T13:43:29.358479Z","title":"Infinity instruct: Scaling instruction selection and synthesis to enhance language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.358479Z"},"links":{"cited_paper":"/paper/2506.11116","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:4f6031a11a18c26e6ad7d54cdebf88db4d0484ed871cd936c839e91cd78d4442","observation_id":"29130112-8ba6-494e-9325-3879df750380","resolution":{"observed_at":"2026-08-02T13:43:29.358479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.363120Z","title":"Superfiltering: Weak-to-strong data filtering for fast instruction-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.363120Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:131405aba9c5fee895c01ae4bc3a06304224c92ea30ee0cc1917cbc6895f3f34","observation_id":"32307cbf-ed4d-4525-ba4b-b64736018cbd","resolution":{"observed_at":"2026-08-02T13:43:29.363120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.368048Z","title":"Dataflow: An llm-driven framework for unified data preparation and workflow automation in the era of data-centric ai.arXiv preprint arXiv:2512.16676, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.368048Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:25b3101e08f47e2326d6d16978bbfb752faa9e3603140d611885e3ace519b17c","observation_id":"951c07c5-babc-41dd-9ebd-a3df9f7e8723","resolution":{"observed_at":"2026-08-02T13:43:29.368048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.372838Z","title":"Data preparation for large language models.Journal of Computer Science and Technology, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.372838Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:46b5973e3be2bccf65508176f0d2f007272355655859e81ee6fa13265649a38f","observation_id":"0018cca2-de3d-4cf0-89a8-2fcedc1c0926","resolution":{"observed_at":"2026-08-02T13:43:29.372838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.377408Z","title":"What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.377408Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:4a84754f053945274b5466d5b7167522f188786f80e9b5e87d39e162a629b44e","observation_id":"b170a5ed-a4c8-4819-8681-4183ffe4a4bf","resolution":{"observed_at":"2026-08-02T13:43:29.377408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.382203Z","title":"Dataperf: Benchmarks for data-centric ai development","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.382203Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:50626df542e9b34ce4e83ebd5756a2ad2878fad309989f41a97b19bf3d0419e8","observation_id":"8e194211-7910-45fc-ab33-883e69dbf12e","resolution":{"observed_at":"2026-08-02T13:43:29.382203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.386982Z","title":"GPT-4 technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.386982Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:fa0da1bd04981ce27762fd84d021281e4830b2458d649c210dab4608c69b556b","observation_id":"e5fcee22-949f-4808-97ea-f56f89739ed4","resolution":{"observed_at":"2026-08-02T13:43:29.386982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.391092Z","title":"Towards tailored recovery of lexical diversity in literary machine translation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.391092Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:530b8a7a0e88c3d39dc3cca867eb85b23fd16fa7875826bab1b72dbfd3dae3fe","observation_id":"d1908213-b27b-41dd-8382-606338e87975","resolution":{"observed_at":"2026-08-02T13:43:29.391092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08127","last_updated":"2025-06-14T03:19:54Z","snapshot_observed_at":"2026-08-10T22:13:51.553203Z","submitted_at":"2025-02-12T05:13:04Z","title":"Fino1: On the Transferability of Reasoning-Enhanced LLMs and Reinforcement Learning to Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08127","snapshot_observed_at":"2026-08-02T13:43:29.395146Z","title":"Fino1: On the transferability of reasoning-enhanced llms and reinforcement learning to finance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.395146Z"},"links":{"cited_paper":"/paper/2502.08127","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:f4c4878e6cfecc2533d1cbbc3f095e518813ce35f10c28b0462c6997f4ca7066","observation_id":"0428d130-e587-457f-8628-4a16b3509635","resolution":{"observed_at":"2026-08-02T13:43:29.395146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.11829","last_updated":"2022-07-13T20:21:42Z","snapshot_observed_at":"2026-08-14T19:12:50.025987Z","submitted_at":"2020-04-24T16:11:03Z","title":"A survey on domain adaptation theory: learning bounds and theoretical guarantees","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.11829","snapshot_observed_at":"2026-08-02T13:43:29.400467Z","title":"A survey on domain adaptation theory: learning bounds and theoretical guarantees.arXiv preprint arXiv:2004.11829, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.400467Z"},"links":{"cited_paper":"/paper/2004.11829","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:6618cb983960293ff97c0c2092ea79a8ca78e4a243539ec0b0acae1a499f3fd7","observation_id":"3ccdba98-9f92-4550-a0c8-458feef7a0ab","resolution":{"observed_at":"2026-08-02T13:43:29.400467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.404990Z","title":"Let’s verify math questions step by step.arXiv preprint arXiv:2505.13903, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.404990Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:f900c5f02baf5b443dbaf8741d81dabeaf20fc6dacf4e0189647a2d25b5b2d66","observation_id":"ae485336-5f26-4516-87d6-4d769b4338dc","resolution":{"observed_at":"2026-08-02T13:43:29.404990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.409080Z","title":"Reasonmed: A 370k multi-agent generated dataset for advancing medical reasoning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.409080Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:c6168a8072e3cea3da4633172568f60f7f356867353ef79a5cbdd6701ac40b9b","observation_id":"5b144c66-67dc-4ca7-8326-4f5ae8b151e7","resolution":{"observed_at":"2026-08-02T13:43:29.409080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-02T13:43:29.418322Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.418322Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:a3da9652271a5c09514a5c93a4f49c7f64b9e86d6bd410b8e720d4ed2773c48b","observation_id":"7f9efaef-e9bc-4663-b11d-f628591b0d7d","resolution":{"observed_at":"2026-08-02T13:43:29.418322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.422758Z","title":"Self-instruct: Aligning language models with self-generated instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.422758Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:ac4772ff576299ae7cdc433d28d0e132c1d0cca38139c872c0813eb1a28ae930","observation_id":"e9eb37d7-e4c7-44c3-8ed3-777f9175fe87","resolution":{"observed_at":"2026-08-02T13:43:29.422758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09739","last_updated":"2024-07-17T20:50:11Z","snapshot_observed_at":"2026-08-13T04:18:34.728169Z","submitted_at":"2024-02-15T06:36:07Z","title":"QuRating: Selecting High-Quality Data for Training Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09739","snapshot_observed_at":"2026-08-02T13:43:29.427294Z","title":"Qurating: Selecting high-quality data for training language models.arXiv preprint arXiv:2402.09739, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.427294Z"},"links":{"cited_paper":"/paper/2402.09739","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:2e608b7097da1aa955c013bb50c88a7d9cb6a6b5d7e91471ba68698e132a924d","observation_id":"8a4bba88-7a4f-4b5c-b9e0-987ea6a9ec2b","resolution":{"observed_at":"2026-08-02T13:43:29.427294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-13T04:24:51.821062Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-02T13:43:29.432403Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.432403Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:63a8d6dca44d0502b36a0a3a1620398263b333dabb6cb06792c2e8757b396428","observation_id":"d3d50ac5-3475-4a71-a7fc-109dec7d815d","resolution":{"observed_at":"2026-08-02T13:43:29.432403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.438152Z","title":"Wizardlm: Empowering large pre-trained language models to follow complex instructions, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.438152Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:3d49693c33b70f44b140e26dad54446e17462b3a427e2298512890fa16ec1423","observation_id":"31dd247f-db92-44bf-b5b7-d0f7224e1082","resolution":{"observed_at":"2026-08-02T13:43:29.438152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.443264Z","title":"Logics-stem: Empowering llm reasoning via failure-driven post-training and document knowledge enhancement, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.443264Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:b3fcfa5f167bbab75124f806805c4fd1538ce9509cff852be2fb87f5cd5f181c","observation_id":"cd37b376-0ddf-4eb3-9bed-1cd38b27c9e0","resolution":{"observed_at":"2026-08-02T13:43:29.443264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-02T13:43:29.447430Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.447430Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:0b8fba7b8139a3d2266c73807bca99abcb74a74d834542bfa44c6f6f3ed2741c","observation_id":"ab7bbbe0-d135-48ed-9c48-1b67fee50a50","resolution":{"observed_at":"2026-08-02T13:43:29.447430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-02T13:43:29.452083Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.452083Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:bf86c7ebdfa60fec54928be7de2037f81994f8751219030696b1be6d107a2431","observation_id":"2c5787fa-93fb-43fc-811f-d053fa1ca382","resolution":{"observed_at":"2026-08-02T13:43:29.452083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08197","last_updated":"2025-01-14T15:22:47Z","snapshot_observed_at":"2026-08-13T06:16:32.798188Z","submitted_at":"2025-01-14T15:22:47Z","title":"OpenCSG Chinese Corpus: A Series of High-quality Chinese Datasets for LLM Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08197","snapshot_observed_at":"2026-08-02T13:43:29.456364Z","title":"Opencsg chinese corpus: A series of high-quality chinese datasets for llm training, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.456364Z"},"links":{"cited_paper":"/paper/2501.08197","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:3a684f709ddb7ab019a19380a7ade27b82a9008ec632e5cfd6c519a280adab59","observation_id":"a1be480d-9b52-4913-8e55-650ef7ec0d5b","resolution":{"observed_at":"2026-08-02T13:43:29.456364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.460718Z","title":"Disc-lawllm: Fine-tuning large language models for intelligent legal services, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.460718Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:9f06f409d974dde2b47f81a065364365c75f996a557ad75f6ca9f2bf6c84f1b9","observation_id":"2a79cf5e-56d5-45fa-b806-dfec79adf9fb","resolution":{"observed_at":"2026-08-02T13:43:29.460718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.464976Z","title":"Ultramedical: Building specialized generalists in biomedicine, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.464976Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:b95f2f3428513380ba2ba934146fe878b27c01f14871752ea424feec01a655fd","observation_id":"ca1f35df-7d2d-4df3-852a-e25dd474a82b","resolution":{"observed_at":"2026-08-02T13:43:29.464976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-02T13:43:29.469176Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.469176Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:c03804054d37834a8610842c096c24b382b47cc82dba5fa37bf50b83de0cb103","observation_id":"8f808fa4-a4bc-489c-80c0-886038268843","resolution":{"observed_at":"2026-08-02T13:43:29.469176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.473875Z","title":"Google-proof","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.473875Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:762064c8527fc02781ef4fac100b9f49805acf3c7174b3737fc01669a5c7acba","observation_id":"4720352e-9d9c-4b37-ac62-f800bdecbbd1","resolution":{"observed_at":"2026-08-02T13:43:29.473875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.478789Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.478789Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:a3296148195aee95c956451927ac5db7f485b9f380160a7bbbb2aa1a0eea8913","observation_id":"27cc783e-2d4e-47a6-837b-b1d93658916a","resolution":{"observed_at":"2026-08-02T13:43:29.478789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.483303Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.483303Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:5d2e304908b53cecefdd0d0e302315e7690533f25fb1eeadf1526c4635aa6d7b","observation_id":"a483e706-d926-47cf-b11a-b27d902d965a","resolution":{"observed_at":"2026-08-02T13:43:29.483303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T13:43:29.413829Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.413829Z"},"links":{"citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:1ebed9df9928ef9a9f5c4ce23890f8c16ac2bf1e27894355184017e07c24575b","observation_id":"17223647-62dc-4e87-b1fc-eedfb60ea8fc","resolution":{"observed_at":"2026-08-02T13:43:29.413829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T01:36:19.591301Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2607.20465."}