{"as_of":"2026-08-09T21:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0eb8cfe5d9e18630efafb7a30ee64221ae42f8bbe4e9f97f778f5cb4409f73e6","coverage":[{"denominator":187,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:23:27.862331Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.14741/citation-record","integrity":"/paper/2508.14741/integrity","json":"/paper/2508.14741/citation-record.json","paper":"/paper/2508.14741"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:18.506062Z","title":"URL: https://c2pa.org/specifications/ specifications/1.3/guidance/Guidance.html#1.4@specs:C2PA_Specification.adoc","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:18.506062Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:d38510fa00dc1b275794be96a24ec32efd42152457629892119341583acf7b5c","observation_id":"45ce15fc-2ec1-44ea-9bf1-afbebdf08d55","resolution":{"observed_at":"2026-08-05T18:23:18.506062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:18.557144Z","title":"URL: https://dataandtrustalliance.org/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:18.557144Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:fd510d842578ed11318fa3247104640dbd8ffa2737bc37d24a51ad97770ebaad","observation_id":"6274142f-0872-4b34-b4e2-705da5afee7f","resolution":{"observed_at":"2026-08-05T18:23:18.557144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:18.729829Z","title":"URL: https://developers.google.com/ looker-studio/connector/semantics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:18.729829Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:4539e82be6ba936d645d9ebc3d0190bb38b1f4b0727c15a82700bd3b82b8a5d9","observation_id":"b0eb316a-f7e1-4b40-844f-cc5b978f46fc","resolution":{"observed_at":"2026-08-05T18:23:18.729829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06368","last_updated":"2018-07-02T12:58:10Z","snapshot_observed_at":"2026-07-06T05:47:34.555344Z","submitted_at":"2017-06-20T11:20:12Z","title":"FA*IR: A Fair Top-k Ranking Algorithm","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06368","snapshot_observed_at":"2026-08-05T18:23:18.833235Z","title":"URL: http://arxiv.org/abs/1706.06368 , doi:10.1145/31 32847.3132938","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:18.833235Z"},"links":{"cited_paper":"/paper/1706.06368","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:4b4fc42f4bf4247d02b86a6b5c3ffcded8d0953a8b6fb9766e23b5b7eeb1e993","observation_id":"b6801a9e-5614-4d58-8098-33f6474fc593","resolution":{"observed_at":"2026-08-05T18:23:18.833235Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:18.891038Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:18.891038Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:47927c65f381452e49485687b86c68924778376f27d3fda418164fb219e838e9","observation_id":"1756ee83-99b7-440a-816d-b3b0b8edb716","resolution":{"observed_at":"2026-08-05T18:23:18.891038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:19.046306Z","title":"URL: https://www.media.mit.edu/projects/data-p rovenance-for-ai/overview/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.046306Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:f7ace0b8f96b4312a5f1db100e184dd0ddfec75bc35f047839eb20066736b25f","observation_id":"71fc464c-d211-44bf-98be-c4ca948f1f9d","resolution":{"observed_at":"2026-08-05T18:23:19.046306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:19.137604Z","title":"URL: https://www.w3.org/TR/prov-o/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.137604Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:cbc7338280d995b8704df967fcb87709849bdec5014464b6d93210b77fb6f471","observation_id":"0a0ab108-fa76-4acc-828d-94f23879b748","resolution":{"observed_at":"2026-08-05T18:23:19.137604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:19.289546Z","title":"URL: https://rdflib.readthedocs.io/en/stable/#","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.289546Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:b4c7f6ecdd884bc6a6b35569c8adb6f75998c09d1c35c3944c42dcc7b620781c","observation_id":"0844c684-22d8-4d75-ba49-e58158f6db58","resolution":{"observed_at":"2026-08-05T18:23:19.289546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:19.424234Z","title":"metrics and scoring","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.424234Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:8e8b9e964f43dbc81c6bf900ab8f22cbdda6c108c021e47cba00a74cb4ddd185","observation_id":"00019043-fb18-418a-b505-411db2aea8fd","resolution":{"observed_at":"2026-08-05T18:23:19.424234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:19.548422Z","title":"The Academy of Management Review , 20(3):709–734, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.548422Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:f0aeea8beb3639ef5a1da1293cad649d2b585e40b639983bf08f758b8080aa96","observation_id":"423f537c-cdac-4bb6-83f2-023484ade796","resolution":{"observed_at":"2026-08-05T18:23:19.548422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:19.682361Z","title":"Technical report, United States Department of Defense, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.682361Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:d7761bb73611d041c2446f407613de3d938ac5ef066ffbf7886fcf44e0f1d387","observation_id":"8c4d3900-45f2-4380-9fe6-db1583e64c06","resolution":{"observed_at":"2026-08-05T18:23:19.682361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:19.833708Z","title":"Auxiliary information: the raking-ratio empirical process","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.833708Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:66aeae518e66b6fccdb8633d789c17e00978b55ad3ba83afb3cee1cc49a9461c","observation_id":"fd70994f-5fb3-4124-a8bb-98ba374a51d1","resolution":{"observed_at":"2026-08-05T18:23:19.833708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13447","last_updated":"2021-08-27T16:28:01Z","snapshot_observed_at":"2026-07-06T09:59:29.017085Z","submitted_at":"2020-09-28T16:12:38Z","title":"Why resampling outperforms reweighting for correcting sampling bias with stochastic gradients","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13447","snapshot_observed_at":"2026-08-05T18:23:19.980854Z","title":"Why resampling outperforms reweighting for correcting sam- pling bias with stochastic gradients","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:19.980854Z"},"links":{"cited_paper":"/paper/2009.13447","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:52088befab71c1248c23c5391640ea10a7d43f8eacfc6ce62dac92b1d4adabc1","observation_id":"b8d0406d-1fb3-46c2-ac2e-4ff9948f5fef","resolution":{"observed_at":"2026-08-05T18:23:19.980854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:20.111270Z","title":"An approach for classification of highly imbalanced data using weighting and undersampling","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.111270Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:7ffd2591a3aba51c805a6f4f1b57ca0592f3ae443fdba72d9ed18b8da4d253c7","observation_id":"505a24f2-2f97-44b8-8e78-f972e5fc8a65","resolution":{"observed_at":"2026-08-05T18:23:20.111270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03198","last_updated":"2025-06-05T14:35:42Z","snapshot_observed_at":"2026-07-06T18:25:48.914502Z","submitted_at":"2024-05-28T04:36:15Z","title":"The Impossibility of Fair LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03198","snapshot_observed_at":"2026-08-05T18:23:20.160773Z","title":"The impossibility of fair llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.160773Z"},"links":{"cited_paper":"/paper/2406.03198","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:345013f74dafff4b0c3d70d1a3a830862563af5492f48ce2b671422ed86b3245","observation_id":"b430e6ee-cd17-4157-809a-da510a6d2e79","resolution":{"observed_at":"2026-08-05T18:23:20.160773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:20.214169Z","title":"O’Connor, and Kevin McGuinness","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.214169Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:26ccf820a98d007c1f7815820426ee23a92df40bae872df6e17b7b780b7c9330","observation_id":"e4374172-7c98-403a-91dc-d87a4d0bb73c","resolution":{"observed_at":"2026-08-05T18:23:20.214169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:20.291916Z","title":"Data catalog vocabulary (dcat) (w3c recommendation)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.291916Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:f14cb3c53110aae5cc429faf2be7b0a868638ddc02dae2eaa2ee86d4f3526343","observation_id":"d9d777e0-ef15-4292-af56-7e70a6630639","resolution":{"observed_at":"2026-08-05T18:23:20.291916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:20.334274Z","title":"Wefe: The word embeddings fairness eval- uation framework","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.334274Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2d6a6e33aa68630c765f391a5143ee41bd5f6eb9bd9f44dfb6b9dab8a1346151","observation_id":"9653afb9-3597-4650-97f6-ef8e4ecd2226","resolution":{"observed_at":"2026-08-05T18:23:20.334274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11222-021-10001-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:28.546210Z","title":"Optimal representative sample weighting","venue":null,"work_id":"315320f4-a50e-44c0-b300-e4531f772f24","year":2021},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.394863Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2f4b8575f41d15231f4e2c3d0aada9ba1fb0fa7dc916511df856c232ecec9721","observation_id":"f598eec4-92d3-4d38-b84a-640886830165","resolution":{"observed_at":"2026-08-05T18:23:28.614209Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:20.425682Z","title":"Practical considerations in raking survey data","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.425682Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:e750378319e84328d05d3a60c0920d558485117c62eaf96879c6e554c6199c8d","observation_id":"51bb76da-c463-4600-9889-b9cc0c4bccab","resolution":{"observed_at":"2026-08-05T18:23:20.425682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:20.511614Z","title":"Semantic data types","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.511614Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:f06d58f83a0166b1cfa99ad9029cb221dfee4d0ef37dfc29e1530e8c8d1e705b","observation_id":"b4295810-0d59-483f-bea3-e8f9abdb2a22","resolution":{"observed_at":"2026-08-05T18:23:20.511614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.01943","last_updated":"2018-10-03T20:18:35Z","snapshot_observed_at":"2026-07-06T07:05:57.302799Z","submitted_at":"2018-10-03T20:18:35Z","title":"AI Fairness 360: An Extensible Toolkit for Detecting, Understanding, and Mitigating Unwanted Algorithmic Bias","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.01943","snapshot_observed_at":"2026-08-05T18:23:20.597315Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.597315Z"},"links":{"cited_paper":"/paper/1810.01943","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:561214f8952290e57b0a3eb94db54a8aba70fe500bbcf8fb0229a171daa9d9dd","observation_id":"ef7542e2-9e0c-4d7a-ba1b-971aebdd1d7b","resolution":{"observed_at":"2026-08-05T18:23:20.597315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01094","last_updated":"2024-08-22T02:33:28Z","snapshot_observed_at":"2026-08-07T20:18:17.887139Z","submitted_at":"2019-12-02T22:00:14Z","title":"Recovering from Biased Data: Can Fairness Constraints Improve Accuracy?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01094","snapshot_observed_at":"2026-08-05T18:23:20.656241Z","title":"Recovering from biased data: Can fairness constraints improve accu- racy? (arXiv:1912.01094), December 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.656241Z"},"links":{"cited_paper":"/paper/1912.01094","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:98c8c644a0461e45eeefc9c663bc1303e93141b0b38aafce69631cc48dab249c","observation_id":"97fd1de2-209e-4c09-a5fb-489dcc576c4c","resolution":{"observed_at":"2026-08-05T18:23:20.656241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06520","last_updated":"2016-07-21T22:26:20Z","snapshot_observed_at":"2026-08-09T19:48:57.620569Z","submitted_at":"2016-07-21T22:26:20Z","title":"Man is to Computer Programmer as Woman is to Homemaker? Debiasing Word Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06520","snapshot_observed_at":"2026-08-05T18:23:20.736631Z","title":"Man is to computer programmer as woman is to homemaker? debiasing word embeddings","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.736631Z"},"links":{"cited_paper":"/paper/1607.06520","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:96aeabfddf42f7cf960cc2087663a98c87fa1e6bc3dfbd573716ffa30f9573a5","observation_id":"d8f25c33-c00d-4965-84f0-426dd11a9749","resolution":{"observed_at":"2026-08-05T18:23:20.736631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:20.855595Z","title":"Identifying problems with raking estimators","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:20.855595Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:f64f8878c69814a8546478c627bfc2366ab5bcc7a61462c9cdb5427b55ed6049","observation_id":"a4d1dd9f-70ae-407e-bda1-c2c9007b98f2","resolution":{"observed_at":"2026-08-05T18:23:20.855595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:21.013715Z","title":"What is the effect of importance weighting in deep learning? In International Conference on Machine Learning , 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:21.013715Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:769ec0e2eea5bd25e03cbeeefe36a49e592bb5fcc61ecd6e84a24f2bb11acbfc","observation_id":"69ea2f19-86ab-4b76-9230-06d4bb0a1c30","resolution":{"observed_at":"2026-08-05T18:23:21.013715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:21.156275Z","title":"Bryson, and Arvind Narayanan","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:21.156275Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:a5c9e704accea38d1292999f959635ee93281b9a7d61389a371d7270002584c3","observation_id":"732812ac-ff1e-40f0-9a14-7973d55de71c","resolution":{"observed_at":"2026-08-05T18:23:21.156275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01301","last_updated":"2024-08-02T14:43:45Z","snapshot_observed_at":"2026-07-06T18:56:05.823411Z","submitted_at":"2024-08-02T14:43:45Z","title":"A Decision-driven Methodology for Designing Uncertainty-aware AI Self-Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01301","snapshot_observed_at":"2026-08-05T18:23:21.297514Z","title":"A decision-driven methodology for designing uncertainty-aware ai self-assessment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:21.297514Z"},"links":{"cited_paper":"/paper/2408.01301","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:8811181d119048c2990b1e22113781b9fd609b688b934c5ee1860491d0875c99","observation_id":"f6bf0e84-df19-452b-aa1b-17fe44918bc0","resolution":{"observed_at":"2026-08-05T18:23:21.297514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:21.397608Z","title":"Fairness with adaptive weights","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:21.397608Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:53aec90667282cfa536649bb3b0056b9ff0ce17cc208549e15b322a30c1f5cc5","observation_id":"e4112075-7907-485a-b0fc-c57b8173ecb5","resolution":{"observed_at":"2026-08-05T18:23:21.397608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:21.570028Z","title":"Yu, Qiang Yang, and Xing Xie","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:21.570028Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:e37453eefeb6853d76f77c832b1799c2aa925be4ad8d0e49baf5affdc5536a71","observation_id":"54cc5e47-06cc-4379-b55e-cc904ef8650b","resolution":{"observed_at":"2026-08-05T18:23:21.570028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:21.675059Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:21.675059Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:fcbd78602edaf2beaa2132ea628473018337a128b2a94fadc9b02ef18bbae847","observation_id":"0a32cb86-bfb6-422f-8cad-7117d165ac6c","resolution":{"observed_at":"2026-08-05T18:23:21.675059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14735","last_updated":"2025-05-11T09:23:41Z","snapshot_observed_at":"2026-08-09T16:54:58.064408Z","submitted_at":"2023-10-23T09:15:18Z","title":"Unleashing the potential of prompt engineering for large language models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14735","snapshot_observed_at":"2026-08-05T18:23:21.760543Z","title":"Unleashing the potential of prompt engineering in large language models: a comprehensive review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:21.760543Z"},"links":{"cited_paper":"/paper/2310.14735","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2244171017037107201fc631996d36b41db335554ba9617e2f0f37741c52584d","observation_id":"068e527a-ee63-4e67-a3ba-ceccb67c9894","resolution":{"observed_at":"2026-08-05T18:23:21.760543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03103","last_updated":"2020-02-08T06:58:33Z","snapshot_observed_at":"2026-07-06T08:55:46.483905Z","submitted_at":"2020-02-08T06:58:33Z","title":"OoDAnalyzer: Interactive Analysis of Out-of-Distribution Samples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03103","snapshot_observed_at":"2026-08-05T18:23:22.029404Z","title":"OoD- Analyzer: Interactive Analysis of Out-of-Distribution Samples, February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.029404Z"},"links":{"cited_paper":"/paper/2002.03103","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2e5a96f1f6a5f7cf5e99538b2dfaf0e8c5ccdbe0c1afa16337add17846cb2c41","observation_id":"0f492a62-1904-4d24-9e0d-0f7650c03145","resolution":{"observed_at":"2026-08-05T18:23:22.029404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.129866Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.129866Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:bd9d3a47e826f49dc73d68bd2e9efd20643762d2533b642a309f90c1c15b7d07","observation_id":"d6571907-bbee-4404-a6a7-14bdc488426c","resolution":{"observed_at":"2026-08-05T18:23:22.129866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.240040Z","title":"Semantic Type Detection in Tabular Data via Machine Learning Using Semi-synthetic Data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.240040Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:1cf05589964586c464d9b2f5d0e89742c48b1098ea4ed4467ea2b1031a88e056","observation_id":"cac557b6-efc2-404c-90ef-2d0f52fe55b4","resolution":{"observed_at":"2026-08-05T18:23:22.240040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.363488Z","title":"Jordan, Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.363488Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:b2e2aa51b96d8d517d7022fb7e2ef30018f3c2a5f3f33c6d355d1089d4061c41","observation_id":"dc20a8ab-fcbc-4b23-b9f4-b3e49b2852cb","resolution":{"observed_at":"2026-08-05T18:23:22.363488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.519505Z","title":"Eleven quick tips for data cleaning and feature engineering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.519505Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:5a39149aa23a3b8246038f281a316549b50368c6d2ae57d957165611d4287d52","observation_id":"46fdeb90-a737-42c8-854d-e9e05cddebd5","resolution":{"observed_at":"2026-08-05T18:23:22.519505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.593317Z","title":"Statistical functions (scipy.stats) — scipy v1.13.0 manual","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.593317Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:77b2f7b4b03c4ccb563598323ac78527677ffeadc41fe1e7699afeec8ceca0fc","observation_id":"b0984a40-4e9f-42ab-8b4f-d6c870675ca5","resolution":{"observed_at":"2026-08-05T18:23:22.593317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.664001Z","title":"On a least squares adjustment of a sampled frequency table when the expected marginal totals are known","venue":null,"work_id":null,"year":1940},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.664001Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:cbb6642e6082a2b9cf574fa09556d8fc2ee42034e651b70a1b9f64be924dd35e","observation_id":"fc903820-604d-4560-860f-c1e87ff0ed6d","resolution":{"observed_at":"2026-08-05T18:23:22.664001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.755069Z","title":"Calibration estimators in survey sampling","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.755069Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:ccb361eae4fc4d74fccdff4b5863edc391e82b3f9f6c8aa722f8487b569caa05","observation_id":"62fee76e-8a13-4eca-a000-3045f5bea23e","resolution":{"observed_at":"2026-08-05T18:23:22.755069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.826156Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.826156Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:87432623fa4fa2d508f70dd99f8151a857df4773ef33665756ad241883c330b0","observation_id":"5a5c6de4-4a70-436e-a1fc-fc1ad75a897c","resolution":{"observed_at":"2026-08-05T18:23:22.826156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.884391Z","title":"Multi- dimensional gender bias classification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.884391Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:dfd0b113356445eb3c69327ad428bdc3f5d74cad6dbd2a48f63a6c8997f692b6","observation_id":"7a420aee-739a-450d-9a9c-f4a718989aec","resolution":{"observed_at":"2026-08-05T18:23:22.884391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:22.974662Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:22.974662Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:237f8b94abb6af8bc6d8e73d8708cdab37e32b790b7ae66ed0ef3b48cf75865e","observation_id":"70446882-aa03-403c-8652-65ce78eac620","resolution":{"observed_at":"2026-08-05T18:23:22.974662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21659/rupkath","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:37.933984Z","title":"Breaking the bias: Gender fairness in llms using prompt engineering and in-context learning","venue":null,"work_id":"40ff5a89-8984-411e-bc1c-a24d9b14b2ed","year":2023},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.033228Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:0c62e125219756535d23896ef11e89de9cff7fd553e77d791f18487940743347","observation_id":"063cc3af-2e33-4816-84a8-8624f96dec31","resolution":{"observed_at":"2026-08-05T18:23:38.007085Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08528","last_updated":"2022-05-11T16:22:21Z","snapshot_observed_at":"2026-08-08T23:10:07.605447Z","submitted_at":"2022-01-21T03:37:39Z","title":"To SMOTE, or not to SMOTE?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08528","snapshot_observed_at":"2026-08-05T18:23:23.074400Z","title":"To smote, or not to smote? arXiv preprint arXiv:2201.08528 , 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.074400Z"},"links":{"cited_paper":"/paper/2201.08528","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:37f3283b62a4491c6ae368ca8e8f5ce694af893c5e369e17cfec3cb16dd55715","observation_id":"27e756ec-089f-451c-b253-42a5f44f64d5","resolution":{"observed_at":"2026-08-05T18:23:23.074400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-71704-9_65","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:37.709008Z","title":null,"venue":null,"work_id":"2a250300-02e0-4bcf-b437-3086afb4bb79","year":2021},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.209904Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:3d6f2861bf5b98e00019d22d31b0054fd53813315fd828e3ad1b5e3508a94264","observation_id":"eddd4ccf-bfd2-4410-9867-8ed5c9a6fa91","resolution":{"observed_at":"2026-08-05T18:23:37.812650Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:23.281142Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.281142Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:e04f4e369cc53230f26f4b12d9f433cc73743837b88e44cce8ed5cde30947c21","observation_id":"efbd5664-832d-4d3f-a186-816597bc709d","resolution":{"observed_at":"2026-08-05T18:23:23.281142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:23.327238Z","title":"Classification in the presence of label noise: a survey","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.327238Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:9011398b388afcb71522bb78cd21c8720afc5b700e673d02430b7f2cf606ef81","observation_id":"3a386044-0914-44df-93b8-d9b9bee8d1eb","resolution":{"observed_at":"2026-08-05T18:23:23.327238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.06598","last_updated":"2021-03-11T10:55:00Z","snapshot_observed_at":"2026-08-09T13:13:58.253532Z","submitted_at":"2021-03-11T10:55:00Z","title":"DebIE: A Platform for Implicit and Explicit Debiasing of Word Embedding Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.06598","snapshot_observed_at":"2026-08-05T18:23:23.417166Z","title":"Debie: A platform for implicit and explicit debiasing of word embedding spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.417166Z"},"links":{"cited_paper":"/paper/2103.06598","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:11816246f527d1b22fec6b3cf8d3b33083d147cc7ccd4426bc230094ef3e5c64","observation_id":"282e6076-9ef6-42f1-b4b9-5e20777aa7a5","resolution":{"observed_at":"2026-08-05T18:23:23.417166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:23.483277Z","title":"Explainable disparity compensation for efficient fair ranking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.483277Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:0a7ebf1525c0bc843ee6ab6bc640ffa0492da6efb8ce6fe6c81f609eb2eae3e0","observation_id":"d7eb3767-3177-4a39-b347-a87ea8adffe8","resolution":{"observed_at":"2026-08-05T18:23:23.483277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-05T18:23:23.540270Z","title":"Retrieval-augmented generation for large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.540270Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:f87a3e927d04d4dfffc2cbe25c95667d9cca743403e40d17a928f10d8a19d077","observation_id":"62f38d3b-f191-4b6a-8cc4-380a81fe3689","resolution":{"observed_at":"2026-08-05T18:23:23.540270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:23.589098Z","title":"New Oversampling Approaches Based on Polynomial Fitting for Imbalanced Data Sets","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.589098Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:9c1d5710c8651511ca325e36ba14f82ccaa635911bc9b7b51b070ba76cf9d8c2","observation_id":"215f7f84-44ff-4c6f-9464-49b7af3dc58a","resolution":{"observed_at":"2026-08-05T18:23:23.589098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:23.652507Z","title":"Grammar-constrained decoding for structured NLP tasks without finetuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.652507Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:a4e492170d9cc281763cd2781528187060cd4839156426843e718524d574c2c2","observation_id":"6b701e2b-71b8-4d2f-b5ad-4e6403d2ec1e","resolution":{"observed_at":"2026-08-05T18:23:23.652507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:23.746328Z","title":"A Distributional Framework For Data Valuation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.746328Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:ad686c6a7aea83529b637286901bab09493ba32f9f61e23d731ebadbc0b58949","observation_id":"b44e19de-10c6-45c6-b1b4-035f36b40f50","resolution":{"observed_at":"2026-08-05T18:23:23.746328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02868","last_updated":"2019-06-10T08:10:40Z","snapshot_observed_at":"2026-07-06T07:44:03.990575Z","submitted_at":"2019-04-05T04:54:10Z","title":"Data Shapley: Equitable Valuation of Data for Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02868","snapshot_observed_at":"2026-08-05T18:23:23.841780Z","title":"Data Shapley: Equitable Valuation of Data for Machine Learning, June 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.841780Z"},"links":{"cited_paper":"/paper/1904.02868","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:13a6434b37338764ba9a0684698784e489bc34a503e0e541c24e228a16750a04","observation_id":"1f63ace1-d121-45f0-9478-4269191ccddc","resolution":{"observed_at":"2026-08-05T18:23:23.841780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:23.947653Z","title":"A primer on neural network models for natural language processing","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:23.947653Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:ad88b23b730872a7a50fa6c56427a75b9192c8726c9b41a3b3353d625c1cba5e","observation_id":"c22ffb78-76c0-45b3-960a-ed2b49438e65","resolution":{"observed_at":"2026-08-05T18:23:23.947653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.022829Z","title":"Neural network methods for natural language processing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.022829Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:f469d5cff2e36c5c7bb4eddf46b336bbb684919386e48cd814d95f508658ff5c","observation_id":"a058792f-9723-4557-a1cf-c9dd8796a693","resolution":{"observed_at":"2026-08-05T18:23:24.022829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.100788Z","title":"Lipstick on a pig: Debiasing methods cover up systematic gender biases in word embeddings but do not remove them","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.100788Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:4f5e7a0c46874653762db84d312a48e58a32c9bd8de485f789953ed8b9e70e19","observation_id":"84030d37-1ea4-4313-ace8-91d8abe07d2b","resolution":{"observed_at":"2026-08-05T18:23:24.100788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.216977Z","title":"Automated data cleaning can hurt fairness in machine learning-based decision making","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.216977Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:64f784db3d4377b664dc595808f88fcbbcb77d40f12b52c51c439c078387e195","observation_id":"a64f7aca-af6e-4aec-8c9c-060e8da7d307","resolution":{"observed_at":"2026-08-05T18:23:24.216977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.332223Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.332223Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:a785e4d964895bc944b1c439d73b62fc1a784697784dd5c389ce32b4880d0bce","observation_id":"956d791a-9b6c-46fd-ab1b-4be5f52020b9","resolution":{"observed_at":"2026-08-05T18:23:24.332223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-33374-3_5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:37.486083Z","title":"Achieving Counterfactual Fairness for Anomaly Detection, volume 13935, page 55–66","venue":null,"work_id":"95b2b6ce-b878-4fbc-a901-942bbb0bf17c","year":2023},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.494298Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2ae56c3ce8b20f40014f4342f092f312415ae691a94db9349c648bd59ad4a556","observation_id":"b0ed24a0-7536-49fc-8d96-fc2305eee244","resolution":{"observed_at":"2026-08-05T18:23:37.563560Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.596119Z","title":"Distributional structure","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.596119Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:3f36f1a7a20a6f8ab095179adaf7e761d78a1e7a17b2b4e7a7198f3253d61c0c","observation_id":"0e60b11f-c953-4d3c-9a18-cb85304abe92","resolution":{"observed_at":"2026-08-05T18:23:24.596119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.651090Z","title":"Discriminative machine learning for maximal representative subsampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.651090Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:99cef77e2067c66a27cb36ccd02f07df698da6f49d5bea3dc4d0684825200d5d","observation_id":"30a7f076-457a-477b-90f3-dc7d2692c058","resolution":{"observed_at":"2026-08-05T18:23:24.651090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.864227Z","title":"Identification of outliers , volume 11","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.864227Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:de73da55cf7dbfa10ba9ef870168f34dbcb40df5dea2c96609f392e171ae624a","observation_id":"e91e8bde-d557-4e73-aeb3-7c3544f511cb","resolution":{"observed_at":"2026-08-05T18:23:24.864227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:24.986528Z","title":"Garcia, and Shutao Li","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:24.986528Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:921143fb5f19efae44f373bf35f48581ccd05df22181fe25c4b08ccd53ef67a1","observation_id":"83512a9d-90e4-4f4f-8467-f120980d6c70","resolution":{"observed_at":"2026-08-05T18:23:24.986528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.050943Z","title":"Deep residual learning for image recogni- tion","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.050943Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:275f4aa468189bd3024e123a2a77d1ce6317df1a15316fbd4dbc621b47f150da","observation_id":"395161e0-7482-4424-8c43-cf2f2a781af7","resolution":{"observed_at":"2026-08-05T18:23:25.050943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.194383Z","title":"Understanding machine learning practitioners’ data documentation perceptions, needs, challenges, and desiderata","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.194383Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:a24db961d54467aa31e69b39b4debf7e5ddf508796830bdbc5545d96bf0a0085","observation_id":"dd8f0f0f-1247-4b36-9f09-ccf2b064366a","resolution":{"observed_at":"2026-08-05T18:23:25.194383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.285811Z","title":"Some reflections on innovation and invention","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.285811Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:3fa5ad9f234a70213eb9907563bdd6be9f1a9b3c33d053f8110fc519851cadcd","observation_id":"12d8446c-0e9b-460f-b789-539998b13223","resolution":{"observed_at":"2026-08-05T18:23:25.285811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.381821Z","title":"Machine Learning Algorithms, pages 117–259","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.381821Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:a1c5c0def22be41ac7b7d89630158687ba0f8055f912810b5a16959deae4d370","observation_id":"0e9a4bfd-0645-4436-9f55-9f5fd5ae7476","resolution":{"observed_at":"2026-08-05T18:23:25.381821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.475237Z","title":"Hacking with npos: collaborative analytics and broker roles in civic data hackathons","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.475237Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2740f126c92e6d0b164c997b55b8f10fded48d842674256abbf05132c253d5b2","observation_id":"d524c41a-3c78-4b49-89b7-28eed6556367","resolution":{"observed_at":"2026-08-05T18:23:25.475237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.599052Z","title":"Parameter-efficient transfer learning for NLP","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.599052Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:4c923aa2056bc22b3f0c9a1920260d98c60410d0a7e7339f7e06c6a011e2d126","observation_id":"217925aa-2077-4dc4-a8f8-b0ef010fd3d7","resolution":{"observed_at":"2026-08-05T18:23:25.599052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2024-1158","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:37.041190Z","title":"As biased as you measure: Methodological pitfalls of bias evaluations in speaker verification research","venue":null,"work_id":"3c618f2b-7742-4f7e-af4e-8c4c8d402661","year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.707236Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:9b4803dadcaf1b56730c7885b5e2a1e45397f3bbea3209d20dc1bd8de0d5956f","observation_id":"b4bc4e83-3135-45c0-a16c-f6ac987d8347","resolution":{"observed_at":"2026-08-05T18:23:37.153216Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-46990-9_3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:37.236942Z","title":null,"venue":null,"work_id":"5554849b-088a-49f1-8854-13ddc7165934","year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.429603Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:b3b40101dc129a5fa9715af491f0823171d283efd5f217f989c165361756e54c","observation_id":"7f2d4765-924d-4878-9cfd-1c0b623f7fbf","resolution":{"observed_at":"2026-08-05T18:23:37.352385Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.924654Z","title":"Identifying and Correcting Label Bias in Machine Learning, January","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.924654Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:a9fdebaa17d048ef32906eb9acf5ba78eb747947436b111b16fd696fe96a7a6b","observation_id":"35f9c1da-f9e8-4fd2-8e6f-0994f094efda","resolution":{"observed_at":"2026-08-05T18:23:25.924654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.086443Z","title":"Johnson and Taghi M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.086443Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:934fe08fe478f323f001d90288814c20c34ea35c22426bfe645a06f6bd6658e3","observation_id":"8170c9c4-f40b-4d9b-9e4b-4a4767a6ee19","resolution":{"observed_at":"2026-08-05T18:23:26.086443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.10945","last_updated":"2021-03-19T18:15:49Z","snapshot_observed_at":"2026-08-08T16:57:37.072014Z","submitted_at":"2020-12-20T14:54:29Z","title":"SPlit: An Optimal Method for Data Splitting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.10945","snapshot_observed_at":"2026-08-05T18:23:26.202315Z","title":"Roshan Joseph and Akhil Vakayil","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.202315Z"},"links":{"cited_paper":"/paper/2012.10945","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:d548cea5dd83c7ea8512ed78e3a09a3070ae303e6eba205d4bce39b8c75c2c13","observation_id":"72fb385f-06c5-43c7-97c8-c61f86270183","resolution":{"observed_at":"2026-08-05T18:23:26.202315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:25.788487Z","title":"Date and time format—iso 8601","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:25.788487Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:7a279853830bade3cb4e1120db3b92eefb529080e1f8686849df82eee8ce875b","observation_id":"10a192b4-065a-4427-8961-f70934d720a8","resolution":{"observed_at":"2026-08-05T18:23:25.788487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.339971Z","title":"Debiasing pre-trained contextualised embeddings","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.339971Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:369d134534a9137370b1dcb1337cdfb5288cf51f15ac65a95cf5ab7339108de4","observation_id":"644ef597-70e0-4242-a37c-456a063f142c","resolution":{"observed_at":"2026-08-05T18:23:26.339971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.390505Z","title":"Hauptmann","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.390505Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:b037365ee2db8b3a55cd2b189a8c025b6e8147b6e81b1b4f60d93ad8565ae931","observation_id":"bf638683-c4dd-47b1-8714-58a7e82eeab7","resolution":{"observed_at":"2026-08-05T18:23:26.390505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.458856Z","title":"Prompting large language models with audio for general-purpose speech summarization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.458856Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:b9dfa1305cc0c7767b805ec8edc925f52b87abed2bda589c54e79bb7dbc8c845","observation_id":"4f284388-1f53-453a-840e-ff15d880f94f","resolution":{"observed_at":"2026-08-05T18:23:26.458856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.489590Z","title":"Preventing catastrophic forgetting in continual learning of new natural language tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.489590Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:31b34d2a6d90f0e6760cfd3f4c4ac237e396fc4d22c7164eb1a352b9fd2ae6da","observation_id":"ef6401fa-46e4-4d20-b874-f21c0210e7f1","resolution":{"observed_at":"2026-08-05T18:23:26.489590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.275534Z","title":"Learning fair classifiers with partially annotated group labels","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.275534Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:7be5dc7b00ee491cb5fbf1dd31713a1acb7a09e089875a63e36395765eb866be","observation_id":"ee373c79-f3fc-4762-b84d-3ecc187bf7d4","resolution":{"observed_at":"2026-08-05T18:23:26.275534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/mti5120073","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:36.519545Z","title":"A Survey of Domain Knowledge Elicitation in Applied Machine Learning","venue":null,"work_id":"36f2873b-4858-4fa2-b0e9-57b901f6d7a4","year":2021},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.631030Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:c0c240516068f1783f37d12d359076c6af7c8e7eea29361db5aa61436c87b66f","observation_id":"fc758bdc-3a3f-4e60-aec6-fb11579a30b9","resolution":{"observed_at":"2026-08-05T18:23:36.619002Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11598","last_updated":"2025-07-04T20:56:35Z","snapshot_observed_at":"2026-07-06T19:17:19.354772Z","submitted_at":"2024-09-17T23:10:04Z","title":"Towards Fair RAG: On the Impact of Fair Ranking in Retrieval-Augmented Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11598","snapshot_observed_at":"2026-08-05T18:23:26.670272Z","title":"Towards fair rag: On the impact of fair ranking in retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.670272Z"},"links":{"cited_paper":"/paper/2409.11598","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:bbd1f29aa8fc6ced9d99beca361e0bfe135324fb12f0d8a475973afbcabefa27","observation_id":"c4e5703f-5129-48f5-b5a8-facec53bf6a1","resolution":{"observed_at":"2026-08-05T18:23:26.670272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.729612Z","title":"A short survey on importance weighting for machine learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.729612Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:b7feeaa8a1057e213940d45f7f7ade9df27cdc0b11558429a1d26352063c3027","observation_id":"a92373d8-f6c5-4e6e-a6c4-340b91f0b181","resolution":{"observed_at":"2026-08-05T18:23:26.729612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07421","last_updated":"2021-07-16T17:58:22Z","snapshot_observed_at":"2026-07-06T10:24:09.094124Z","submitted_at":"2020-12-14T11:14:56Z","title":"WILDS: A Benchmark of in-the-Wild Distribution Shifts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07421","snapshot_observed_at":"2026-08-05T18:23:26.758958Z","title":"Earnshaw, Imran S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.758958Z"},"links":{"cited_paper":"/paper/2012.07421","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:eed04e6b7cc973ad68b47bc0359cc1a12cadcd2c9adefba6561e606f55a1da4b","observation_id":"0de17d44-01a3-4544-9cf5-51045a15a54f","resolution":{"observed_at":"2026-08-05T18:23:26.758958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/asi.20722","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:36.740752Z","title":"Fleischmann, and William A","venue":null,"work_id":"2690ba42-9b26-4132-9f87-2cbda4dc1962","year":2008},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.547639Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:9a5dbd67ff6cdaa770875a0f006e985efe58ba80f40b813806578f7dc09ef2c5","observation_id":"3a69cd1b-fc2c-4df9-bdae-785aeb09fb9b","resolution":{"observed_at":"2026-08-05T18:23:36.855689Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.846242Z","title":"Aggregating human domain knowledge for feature ranking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.846242Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:b071eae428e4ecc1650655eac88e65cb229f037823ee88c941ccd11288d4512d","observation_id":"d0e14673-4cd9-477a-ab5a-91ca735665a4","resolution":{"observed_at":"2026-08-05T18:23:26.846242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:26.925136Z","title":"Adaptive Sensitive Reweighting to Mitigate Bias in Fairness-aware Classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.925136Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:a67b060cf7621a02f5a874a95ac3d958d75be0ae00b19016eb4c158a3e05cdb6","observation_id":"5232ebc5-b963-49cd-9b8e-c7480e07be17","resolution":{"observed_at":"2026-08-05T18:23:26.925136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:27.005828Z","title":"Kub´ at and S","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.005828Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2e7419ca3bf43553b4f85576b3d1a06b4af51a7cb1b03b4b50f90ecd3ef89140","observation_id":"40a9baa0-b083-402d-8add-291407a74619","resolution":{"observed_at":"2026-08-05T18:23:27.005828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/8731591","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:44.525719Z","title":"Gummadi, and Gerhard Weikum","venue":null,"work_id":"336312ea-a329-4f29-bf80-e2b7789b0c4d","year":2019},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.078296Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:7c988e377d3c99e5a6479ce9a3178c6f5804f34d35fa6660b44fe927ecfdb798","observation_id":"6bbc18c3-3522-4086-b309-e244d33623d6","resolution":{"observed_at":"2026-08-05T18:23:44.595257Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00745","last_updated":"2023-07-30T12:07:34Z","snapshot_observed_at":"2026-08-08T16:48:05.914287Z","submitted_at":"2023-06-01T14:40:52Z","title":"Column Type Annotation using ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00745","snapshot_observed_at":"2026-08-05T18:23:26.797058Z","title":"Column Type Annotation using ChatGPT, July 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:26.797058Z"},"links":{"cited_paper":"/paper/2306.00745","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:2aeaaedb4e613d907c273f37c5e424d30d849fc9c8c2f18b8f25896728e07b78","observation_id":"72ffedaa-7f8f-4c6b-90d8-4b543790ff23","resolution":{"observed_at":"2026-08-05T18:23:26.797058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:27.264533Z","title":"Biocreative v cdr task corpus: a resource for chemical disease relation extraction","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.264533Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:34bb5eb2e989e6e5370dba0d20f8ace5ec0152115c5f0263882c36b4ec8cc65b","observation_id":"15c95491-ff38-4041-b129-13e51a72d719","resolution":{"observed_at":"2026-08-05T18:23:27.264533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:27.375678Z","title":"Table-GPT: Table Fine-tuned GPT for Diverse Table Tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.375678Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:8402f6efedb3395afc3e7fa53bf96ee6f75be10658b0f46b65719c1aafff1b69","observation_id":"0f14c1f3-fa58-4fc5-81dc-a01eb47c636c","resolution":{"observed_at":"2026-08-05T18:23:27.375678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:27.457928Z","title":"Ecg noise sources and various noise removal techniques: A survey","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.457928Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:704dcd8d91758a08cc5b03a3748cffcc67fe0c813335ae134cfcaac11a7d694a","observation_id":"b186e2a8-1234-4244-8fed-64b75e80c084","resolution":{"observed_at":"2026-08-05T18:23:27.457928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/8668459","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:44.281338Z","title":"Model-based synthetic sampling for imbalanced data","venue":null,"work_id":"97918047-ddad-4815-9dfb-4b377ecd3950","year":2020},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.534105Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:438038d0212e35c3fbad7c67874e1c2c0295daa62a3609bb8ab5dc1f458611d1","observation_id":"32d980eb-7626-45ad-bc66-df959f567000","resolution":{"observed_at":"2026-08-05T18:23:44.358333Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.emn","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:36.275281Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":"4c9542fa-8237-4ea8-9400-4e2a2072049e","year":2021},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.140286Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:3b176993c956db9225948a4ae32c428ab237323a6e8d6f30fc71b67d151fb426","observation_id":"7f13f7fd-348b-48e3-bce7-3c3971acf2f5","resolution":{"observed_at":"2026-08-05T18:23:36.355798Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10473","last_updated":"2023-07-27T02:53:41Z","snapshot_observed_at":"2026-07-06T15:43:54.377120Z","submitted_at":"2023-06-18T04:30:12Z","title":"2D-Shapley: A Framework for Fragmented Data Valuation","version":2},"cited_work":{"arxiv_id":"2306.10473","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10473","snapshot_observed_at":"2026-08-05T18:23:44.062867Z","title":"2D-Shapley: A Framework for Fragmented Data Valuation","venue":"cs.LG","work_id":"763facb4-1f7b-49e9-9270-00223af33e21","year":2023},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.746821Z"},"links":{"cited_paper":"/paper/2306.10473","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:538d679d132f5e5457fdcd44de4b684b2255b901a2b97397aee50ad2f849bd96","observation_id":"2f238297-f8dd-4424-81ea-92a063105623","resolution":{"observed_at":"2026-08-05T18:23:44.114309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12691","last_updated":"2024-08-30T21:20:12Z","snapshot_observed_at":"2026-08-04T22:11:34.369542Z","submitted_at":"2024-04-19T07:42:35Z","title":"Data Authenticity, Consent, & Provenance for AI are all broken: what will it take to fix them?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12691","snapshot_observed_at":"2026-08-05T18:23:27.833125Z","title":"Data authenticity, consent, & provenance for ai are all broken: what will it take to fix them?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.833125Z"},"links":{"cited_paper":"/paper/2404.12691","citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:56c36f88651ad49fcdd9cc08568dc74e1293ff044451507dd07779c9de93a41e","observation_id":"74a4db54-0770-4da9-a2a3-806c27dff065","resolution":{"observed_at":"2026-08-05T18:23:27.833125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:23:27.862331Z","title":"De-biasing “bias” measurement","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T18:23:27.862331Z"},"links":{"citing_paper":"/paper/2508.14741"},"observation_digest":"sha256:3c278debeda28ef3a87af3287246c1997e77762f2b11e1b14a58d44351cae34c","observation_id":"92be47d7-80fb-47fa-ac86-71ab9684adf7","resolution":{"observed_at":"2026-08-05T18:23:27.862331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.14741","last_updated":"2025-08-20T14:40:21Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T19:32:20.709954Z","submitted_at":"2025-08-20T14:40:21Z","title":"CaTE Data Curation for Trustworthy AI"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":87,"verified_exact":11,"verified_fuzzy":0},"total_outbound_references":187},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 187 outbound references and 0 inbound Pith citation observations for arXiv:2508.14741."}