{"as_of":"2026-08-24T02:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38e43d1857e8a2f94424b5606c1e34c0b73b459b5c04d5a39e7bf43151662b63","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:04:54.442231Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":51,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":"2207.10062","doi":"10.48550/arxiv.2207.10062","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/ARXIV.2207.10062 , url =","venue":"arXiv (Cornell University)","work_id":"2641b494-fe62-4b5b-89c5-d8aed4fcbf06","year":2022},"citing_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-08-19T17:37:52.818614Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"reference_index":123,"source":"pdf_text","source_observed_at":"2026-05-17T22:58:16.523267Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2406.11794"},"observation_digest":"sha256:c7d2bc46cdbcdeaad471e3f95308f0983e5e9d6ad778ad9b17d45d4368bb580c","observation_id":"fd03fc3f-88bc-426b-a194-117739b54440","resolution":{"observed_at":"2026-05-17T22:58:17.115559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":"2207.10062","doi":"10.48550/arxiv.2207.10062","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/ARXIV.2207.10062 , url =","venue":"arXiv (Cornell University)","work_id":"2641b494-fe62-4b5b-89c5-d8aed4fcbf06","year":2022},"citing_paper":{"arxiv_id":"2505.06621","last_updated":"2025-05-10T12:10:55Z","snapshot_observed_at":"2026-08-12T23:17:54.812651Z","submitted_at":"2025-05-10T12:10:55Z","title":"Minimizing Risk Through Minimizing Model-Data Interaction: A Protocol For Relying on Proxy Tasks When Designing Child Sexual Abuse Imagery Detection Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T16:29:56.727145Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2505.06621"},"observation_digest":"sha256:ea8a87b8c4eacf09524d6f12b64b8b27bf5c2a48a905ce04a0d5825133b60dc9","observation_id":"b37853d1-5a91-4cab-8abc-2c492b47c2c9","resolution":{"observed_at":"2026-05-22T16:31:47.162595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-15T21:04:54.442231Z","title":"Dataperf: Benchmarks for data-centric ai development.URL https://arxiv","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11034","last_updated":"2026-06-09T06:59:42Z","snapshot_observed_at":"2026-08-20T03:23:20.152206Z","submitted_at":"2025-05-16T09:29:41Z","title":"CleanPatrick: A Benchmark for Image Data Cleaning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:54.442231Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2505.11034"},"observation_digest":"sha256:26e30b5ada2300e5d783d1cc2d07c5a62d4bd2841deb69497d2e6b35ac0b0210","observation_id":"f8903f92-0cb4-4772-ba30-5c3b91a06f03","resolution":{"observed_at":"2026-08-15T21:04:54.442231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-07T00:55:17.142692Z","title":"Mazumder, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12312","last_updated":"2025-06-14T02:22:28Z","snapshot_observed_at":"2026-08-13T14:33:19.317608Z","submitted_at":"2025-06-14T02:22:28Z","title":"Perspective on Utilizing Foundation Models for Laboratory Automation in Materials Research","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-07T00:55:17.142692Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2506.12312"},"observation_digest":"sha256:dd9a307559ada5f56cd94f5258ed7f61ba6863c1aac34bc94f1cea00dc450d56","observation_id":"fa740b1c-991d-402a-9fed-cd8fff952d83","resolution":{"observed_at":"2026-08-07T00:55:17.142692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-07T15:03:44.360465Z","title":"G.; Diamos, S.; Diamos, G.; He, L.; Parrish, A.; Kirk, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18770","last_updated":"2025-05-22T09:36:17Z","snapshot_observed_at":"2026-08-14T02:31:16.728536Z","submitted_at":"2025-05-22T09:36:17Z","title":"Importance of User Control in Data-Centric Steering for Healthcare Experts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:03:44.360465Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2506.18770"},"observation_digest":"sha256:2a8be8386939b31f6784b874271596dff20575fc7dfa87fc0341e1250f9844d0","observation_id":"2816a4c5-0974-4b90-ba69-f1f93a633ea7","resolution":{"observed_at":"2026-08-07T15:03:44.360465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-05T17:59:30.181137Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16678","last_updated":"2025-08-21T09:19:08Z","snapshot_observed_at":"2026-08-19T20:11:11.403230Z","submitted_at":"2025-08-21T09:19:08Z","title":"Cognitive Agents Powered by Large Language Models for Agile Software Project Management","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T17:59:30.181137Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2508.16678"},"observation_digest":"sha256:9c7ef87f4dfa56ca2c060bad4e94330665aa84c209b7c4c348ca3b6d0e12e386","observation_id":"bf90073f-fd15-494a-bd4c-486039363c87","resolution":{"observed_at":"2026-08-05T17:59:30.181137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":"2207.10062","doi":"10.48550/arxiv.2207.10062","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/ARXIV.2207.10062 , url =","venue":"arXiv (Cornell University)","work_id":"2641b494-fe62-4b5b-89c5-d8aed4fcbf06","year":2022},"citing_paper":{"arxiv_id":"2605.09716","last_updated":"2026-05-10T19:30:16Z","snapshot_observed_at":"2026-08-16T22:27:06.673968Z","submitted_at":"2026-05-10T19:30:16Z","title":"Medical Model Synthesis Architectures: A Case Study","version":1},"reference_index":273,"source":"arxiv_source","source_observed_at":"2026-05-12T03:27:59.466519Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2605.09716"},"observation_digest":"sha256:583d36c879dcdbd7fedd4aa6c124a043733c19e83e0cb5096cad40d16b62f056","observation_id":"9386d03d-33a0-4ec9-8ef2-4d40ad84a819","resolution":{"observed_at":"2026-05-12T03:31:18.907189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10062","snapshot_observed_at":"2026-08-01T02:42:55.512734Z","title":"In: Advances in Neural Information Processing Systems 36 (NeurIPS), Datasets and Benchmarks Track (2023).https://doi.org/10.48550/ arXiv.2207.10062","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25356","last_updated":"2026-07-28T07:03:50Z","snapshot_observed_at":"2026-08-20T04:31:54.555926Z","submitted_at":"2026-07-28T07:03:50Z","title":"Data Quality Profiling at Scale with Progressive Sampling: A Benchmark for Data-Centric AI Pipelines","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T02:42:55.512734Z"},"links":{"cited_paper":"/paper/2207.10062","citing_paper":"/paper/2607.25356"},"observation_digest":"sha256:48beabd89a2e00f6b9af3177c277b22c0a3a37af788198125dd7d2c18df29249","observation_id":"6be7504d-fa09-4b81-9a2f-b2d725cef06f","resolution":{"observed_at":"2026-08-01T02:42:55.512734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2207.10062/citation-record","integrity":"/paper/2207.10062/integrity","json":"/paper/2207.10062/citation-record.json","paper":"/paper/2207.10062"},"outbound":[],"paper":{"arxiv_id":"2207.10062","last_updated":"2023-10-13T15:24:24Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T16:44:29.383674Z","submitted_at":"2022-07-20T17:47:54Z","title":"DataPerf: Benchmarks for Data-Centric AI Development"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2207.10062."}