{"as_of":"2026-08-19T01:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9201a6a15b407f41768860a9ae63ff97284e3134d8312318df653f5a807decbf","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:37:19.094296Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2503.13463/citation-record","integrity":"/paper/2503.13463/integrity","json":"/paper/2503.13463/citation-record.json","paper":"/paper/2503.13463"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.015171Z","title":"In: 2021 IEEE International Conference on Smart Data Services (SMDS)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.015171Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:b5bdc199be48aa282bf086d8a3daad17b476eaae8cb5ad7bd410abe61f617199","observation_id":"da26ed95-af26-4401-b606-b3fe98759130","resolution":{"observed_at":"2026-08-08T15:37:19.015171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.07261","last_updated":"2019-02-07T13:34:04Z","snapshot_observed_at":"2026-08-14T18:38:28.653951Z","submitted_at":"2018-08-22T07:55:56Z","title":"FactSheets: Increasing Trust in AI Services through Supplier's Declarations of Conformity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.07261","snapshot_observed_at":"2026-08-08T15:37:19.019283Z","title":"arXiv:1808.07261 [cs] p","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.019283Z"},"links":{"cited_paper":"/paper/1808.07261","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:32f6251d9bdc47946f5a9e76f6fb586f2d2726eb9500a1c674bf79a840298e6d","observation_id":"444f4c2a-d316-4ae4-bb66-6c73a280b75b","resolution":{"observed_at":"2026-08-08T15:37:19.019283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.777158Z","title":"Transactions of the Association for Computational Linguistics 6, 587–604 (2018)","venue":null,"work_id":"aedc2b0b-7bfc-4b47-82bb-ba9c2ecc7c2b","year":2018},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.022945Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:b13fae6e78231da81fc4b2a4bab4231bfa93080b0da1a4bd65cc386d81068554","observation_id":"3305dd30-c3d1-4c1d-87a7-15a1b8ea5794","resolution":{"observed_at":"2026-08-08T15:37:19.780102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.768905Z","title":null,"venue":null,"work_id":"85119da3-023a-4c3b-bcb3-3c7983f9010a","year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.026178Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:fe3fe5937c5bbd9731afd30ccd4a14ceef0396dd7942a66263adc4c3b15172ea","observation_id":"cdb6a5a4-0d1d-4f52-a147-a0eef932ee20","resolution":{"observed_at":"2026-08-08T15:37:19.771791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.032297Z","title":"Proceedings of the ACM on Human-Computer Interaction 5(CSCW2), 438:1–438:27 (Oct 2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.032297Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:ff676a667113ba85dc3a882f2981e4db968be8e342bb2d212b21cf99cac26a50","observation_id":"de3583ed-9bdb-4fab-9624-77bb09f5619b","resolution":{"observed_at":"2026-08-08T15:37:19.032297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.04424","last_updated":"2022-05-09T21:52:10Z","snapshot_observed_at":"2026-08-16T17:48:19.968016Z","submitted_at":"2021-10-18T20:13:51Z","title":"A Framework for Deprecating Datasets: Standardizing Documentation, Identification, and Communication","version":2},"cited_work":{"arxiv_id":"2111.04424","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.04424","snapshot_observed_at":"2026-08-08T15:37:19.540199Z","title":"A Framework for Deprecating Datasets: Standardizing Documentation, Identification, and Communication","venue":"cs.CY","work_id":"ff8ba1d6-09bf-40ac-be60-72b26f102ef5","year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.035370Z"},"links":{"cited_paper":"/paper/2111.04424","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:3be438700d2a085a2bdf8331ced01fc05860ace935bf7d0ba3b6170df10ab3f3","observation_id":"8bcb1f8d-8b63-4910-a8ed-fe926f6c194c","resolution":{"observed_at":"2026-08-08T15:37:19.543688Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.760591Z","title":null,"venue":null,"work_id":"3be08b58-a95e-4c07-bcf1-0bb96a2a550c","year":2022},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.039357Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:1f76907083e1773ed2a06ce6af4cf7a1032caf93eb83b6f93f34b7451becca52","observation_id":"b2d32d24-fafa-4aed-9cc0-b4a2871ffbdf","resolution":{"observed_at":"2026-08-08T15:37:19.763529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09010","last_updated":"2021-12-01T20:29:42Z","snapshot_observed_at":"2026-08-15T04:24:26.471843Z","submitted_at":"2018-03-23T23:22:18Z","title":"Datasheets for Datasets","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.09010","snapshot_observed_at":"2026-08-08T15:37:19.042281Z","title":"arXiv:1803.09010 [cs] p","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.042281Z"},"links":{"cited_paper":"/paper/1803.09010","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:b699f9edafcdcf662e0b2627195e719f20b7b55f5ee64fca2f76f0e598d0dd08","observation_id":"f381163f-8d83-484c-97fe-bf4a56ba9c2e","resolution":{"observed_at":"2026-08-08T15:37:19.042281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.03677","last_updated":"2018-05-09T18:10:02Z","snapshot_observed_at":"2026-08-16T07:47:06.765222Z","submitted_at":"2018-05-09T18:10:02Z","title":"The Dataset Nutrition Label: A Framework To Drive Higher Data Quality Standards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.03677","snapshot_observed_at":"2026-08-08T15:37:19.048110Z","title":"arXiv:1805.03677 [cs] p","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.048110Z"},"links":{"cited_paper":"/paper/1805.03677","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:4be787b45fcdf0521ab827eea886f8f7f3c58c741530ec85deb25c9505cf87d6","observation_id":"576009b4-e1f9-4c18-ac16-8d3ed74d7cb2","resolution":{"observed_at":"2026-08-08T15:37:19.048110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.749187Z","title":"In: Proceedings of the 2021 ACM Conference on Fairness, Accountability, and Transparency","venue":null,"work_id":"6aed3113-2551-4c7f-8e08-3248f931e7ab","year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.051142Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:ecb071dc02cc019607a4c38ff2795a8df1d6c81303cf5bffd04591ae3d584852","observation_id":"2bf06ab7-e34c-4c4f-a582-c0b17ae978aa","resolution":{"observed_at":"2026-08-08T15:37:19.753499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.056589Z","title":"Proceedings of the 2020 Conference on Fairness, Ac- countability, and Transparency pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.056589Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:7f663d9abbff793c9aa0efe6354897d0f326d6b40067f0646f46e91b039fc073","observation_id":"771eec66-099a-4b86-bc8a-fcec71430dfa","resolution":{"observed_at":"2026-08-08T15:37:19.056589Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01716","last_updated":"2021-12-03T05:01:47Z","snapshot_observed_at":"2026-08-16T17:37:21.471427Z","submitted_at":"2021-12-03T05:01:47Z","title":"Reduced, Reused and Recycled: The Life of a Dataset in Machine Learning Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01716","snapshot_observed_at":"2026-08-08T15:37:19.059004Z","title":"https://doi.org/ 10.48550/arXiv.2112.01716","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.059004Z"},"links":{"cited_paper":"/paper/2112.01716","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:ab09bbf2dbf43ea76c4694c087739ae8d713b584a1be9552b8ad258f99db3786","observation_id":"a8d5b7b8-ff29-408c-b7c8-10ce0d4fb827","resolution":{"observed_at":"2026-08-08T15:37:19.059004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1108/dprg-03-2021-0047","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Digital Policy, Regulation and Governance 23(5), 475–488 (Jan 2021)","venue":"Digital Policy Regulation and Governance","work_id":"da312f07-af43-432e-9931-0f5a96dd3b6b","year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.062451Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:ee2ac08b960dbaaa0426e82f3f22d9a65b7cfeba5231b1e2645bf0f1f548e667","observation_id":"4fc4d55a-1640-4161-9273-90be90e05c1a","resolution":{"observed_at":"2026-08-08T15:37:19.153562Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.065072Z","title":"Proceedings of the Conference on Fairness, Accountability, and Transparency pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.065072Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:541da025e039e181745b36774c133a2ba42d1dce3689f3aff2e9cba604dfe98f","observation_id":"846090d5-c28c-427e-a9e2-5849ec462994","resolution":{"observed_at":"2026-08-08T15:37:19.065072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02922","last_updated":"2021-11-21T17:58:58Z","snapshot_observed_at":"2026-08-18T02:09:12.289841Z","submitted_at":"2021-08-06T02:52:36Z","title":"Mitigating Dataset Harms Requires Stewardship: Lessons from 1000 Papers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02922","snapshot_observed_at":"2026-08-08T15:37:19.067723Z","title":"arXiv:2108.02922 [cs] p","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.067723Z"},"links":{"cited_paper":"/paper/2108.02922","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:35cd9b4d76e898121e647eacf002eeff0612dbe965eb386dc869c82cfa03414d","observation_id":"da2f533f-a151-4a8d-a0e3-554fe5a542c9","resolution":{"observed_at":"2026-08-08T15:37:19.067723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18637/jss.v090.i06","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Journal of Statistical Software 90, 1–38 (Jul 2019)","venue":"Journal of Statistical Software","work_id":"4901e170-4342-4ac0-9348-b2b65112b94f","year":2019},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.070876Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:634c42a05b350da0d69b7dd24e226c4a3ffe09fb52b28e4143589adbc8f42b2a","observation_id":"0f5a4603-333c-4861-89cb-4260c95ad7fd","resolution":{"observed_at":"2026-08-08T15:37:19.142321Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13796","last_updated":"2020-06-28T01:47:46Z","snapshot_observed_at":"2026-08-06T17:48:10.687152Z","submitted_at":"2020-06-24T15:08:59Z","title":"A Methodology for Creating AI FactSheets","version":2},"cited_work":{"arxiv_id":"2006.13796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.13796","snapshot_observed_at":"2026-08-08T15:37:19.345843Z","title":"A Methodology for Creating AI FactSheets","venue":"cs.HC","work_id":"d022fc1a-b666-42e3-a669-cd786b362f9b","year":2020},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.074139Z"},"links":{"cited_paper":"/paper/2006.13796","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:760e294e07e9f80789ade4f47994d16bd0cc73f449e8e6bf253725cb7aab6923","observation_id":"877b8091-b56f-4846-b035-9c3eaf01f9b6","resolution":{"observed_at":"2026-08-08T15:37:19.349723Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.077206Z","title":"Everyone wants to do the model work, not the data work","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.077206Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:d019112890324567113e4fe5b00fb30b8759989047cde47f81b3325ef2782d9a","observation_id":"9ba32b69-65a9-47d2-a340-4b3001b6bf88","resolution":{"observed_at":"2026-08-08T15:37:19.077206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.737963Z","title":"Proceedings of the ACM on Human-Computer Interaction 5(CSCW2), 1–37 (Oct 2021)","venue":null,"work_id":"75394053-50b0-4daf-8cd1-e9cc9ed4e866","year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.079832Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:aebaeec9fdf902289e65664e7c8fd81c2b5ec7c1d12e92b3f66a616e5e40294c","observation_id":"98e99221-d636-4ec1-b1a9-4c883ed19973","resolution":{"observed_at":"2026-08-08T15:37:19.741994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06675","last_updated":"2022-07-14T09:31:22Z","snapshot_observed_at":"2026-08-16T17:21:30.295917Z","submitted_at":"2022-02-14T13:00:31Z","title":"Can Machines Help Us Answering Question 16 in Datasheets, and In Turn Reflecting on Inappropriate Content?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.06675","snapshot_observed_at":"2026-08-08T15:37:19.082506Z","title":"https://doi.org/10.48550/arXiv.2202.06675","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.082506Z"},"links":{"cited_paper":"/paper/2202.06675","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:77f6203fd4e3689cc44ebe7f9240a5ae45aa372ccb8ae042083dcc034ba9b21e","observation_id":"f4db3860-b61c-4d57-b254-f8f0f90f28ea","resolution":{"observed_at":"2026-08-08T15:37:19.082506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.086135Z","title":"In: Proceedings of the 28th ACM International Conference on Information and Knowledge Manage- ment","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.086135Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:99968351cad574ea5ae33b1a7ffdd3d10aff9999090413780e68fe9706d74150","observation_id":"043a6c78-15ed-4062-8764-0df04e9c7e70","resolution":{"observed_at":"2026-08-08T15:37:19.086135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.088831Z","title":"Media, Culture & Society p","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.088831Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:9bf1357cbb45f3dfc99263cb363fe4ad91686ac04c62d29f776c5bee901fc535","observation_id":"65912f49-2f89-4762-ad8a-ee4fa11d5387","resolution":{"observed_at":"2026-08-08T15:37:19.088831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.091520Z","title":"Proceedings of the 2018 International Conference on Management of Data pp","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.091520Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:55b244333f1c46f350b0e70f6e9a99c4c34d93be860c839a8f9a4dc33ba9f00d","observation_id":"5bcec523-b667-457a-870c-520f383ba898","resolution":{"observed_at":"2026-08-08T15:37:19.091520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14000","last_updated":"2022-08-12T12:58:44Z","snapshot_observed_at":"2026-08-18T22:54:00.208664Z","submitted_at":"2021-03-25T17:38:20Z","title":"Fairness in Ranking: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14000","snapshot_observed_at":"2026-08-08T15:37:19.094296Z","title":"https://doi.org/10.48550/arXiv.2103.14000","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.094296Z"},"links":{"cited_paper":"/paper/2103.14000","citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:8afe5b3032dcdcda3deaa8949155d07e111389386b9f188cc16ee03cfecac713","observation_id":"6f7e6946-d8b5-4d46-851c-6e13fb6bbceb","resolution":{"observed_at":"2026-08-08T15:37:19.094296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:19.053970Z","title":"https://doi.org/10.1145/3442188.3445918","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","version":1},"reference_index":575,"source":"pdf_text","source_observed_at":"2026-08-08T15:37:19.053970Z"},"links":{"citing_paper":"/paper/2503.13463"},"observation_digest":"sha256:03de8f0f25d966ddb7398bddbb1017d30ced0b9020f0981796b72a21d746e17d","observation_id":"3070b6c1-278c-4adc-8465-640bf32df06e","resolution":{"observed_at":"2026-08-08T15:37:19.053970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2503.13463","last_updated":"2025-02-10T12:31:42Z","latest_version":1,"primary_category":"cs.DL","snapshot_observed_at":"2026-08-15T05:19:19.393067Z","submitted_at":"2025-02-10T12:31:42Z","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":17,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2503.13463."}