{"as_of":"2026-08-10T08:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:240a4f4e17669f6d57849d319d4c8afe062e395f13d5f9a195564569f48da357","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:43:53.953535Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10088/citation-record","integrity":"/paper/2507.10088/integrity","json":"/paper/2507.10088/citation-record.json","paper":"/paper/2507.10088"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.606270Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.606270Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:05660a172b22cb7c056b1bf08d2ed98bfc521fd59d3b34848c06d1a6509013c5","observation_id":"b0783815-7040-43ce-84d0-98a2630c1f38","resolution":{"observed_at":"2026-08-06T17:43:53.606270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:59.203603Z","title":null,"venue":null,"work_id":"3c3abf1b-045a-4b46-b705-f0d379dd9b00","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.610871Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:cac2175cfcde60ed9409839b0a831259ff58603b07a975ec1d2549856a96b32a","observation_id":"168dac2b-2fa5-4449-be73-4ff9058ebd40","resolution":{"observed_at":"2026-08-06T17:43:59.271855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:59.013237Z","title":null,"venue":null,"work_id":"a7e68afc-d357-40be-97be-83cd3351269f","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.615279Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b60a897be7a7c266eed6ab689456cebae07a6d46713b1532acf57b7e0e3a5e86","observation_id":"b53cc0bd-a50e-49e7-80ae-129c34617ae4","resolution":{"observed_at":"2026-08-06T17:43:59.103440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.619500Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.619500Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:0109d3eab8d33c6ddb6257973d5063a0a8cdeb03eaac59aa079def02df0b18c0","observation_id":"cec813aa-1da5-431f-9667-c983e9118e19","resolution":{"observed_at":"2026-08-06T17:43:53.619500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.802413Z","title":null,"venue":null,"work_id":"879dc863-4539-44d6-8b45-d145fe3f549c","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.623978Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:5d900d2d60ad870272b73d20e7ee5c7de8f9a4577ba125bd65e2c791d0413ead","observation_id":"05d9d306-f318-4e95-96d0-44a9eb8ae090","resolution":{"observed_at":"2026-08-06T17:43:58.900335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03672","last_updated":"2024-07-04T06:37:09Z","snapshot_observed_at":"2026-08-07T04:02:17.654537Z","submitted_at":"2024-07-04T06:37:09Z","title":"A Survey of Data Synthesis Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03672","snapshot_observed_at":"2026-08-06T17:43:53.628734Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.628734Z"},"links":{"cited_paper":"/paper/2407.03672","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a21070401df23c387dc1e9c9e6a9f26c3ce9b4992ceab0fa02fff8202d2b7a67","observation_id":"886f478c-0d1b-48a0-bd7e-ce8efe4a749e","resolution":{"observed_at":"2026-08-06T17:43:53.628734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.633557Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.633557Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:9a105b1e4d86903925191a378f90218939b679cce357f269f118fc9e0ce02ce2","observation_id":"b88bdf6c-d187-4653-87b8-671cf63cd02b","resolution":{"observed_at":"2026-08-06T17:43:53.633557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.637534Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.637534Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:9ca8010a33f4d98bf3a22ca3a3abace5192752f200dab2754c99da1a508e75f4","observation_id":"79a0c5f6-5563-4a56-bbd8-0a95636bf747","resolution":{"observed_at":"2026-08-06T17:43:53.637534Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08939","last_updated":"2024-05-28T04:32:09Z","snapshot_observed_at":"2026-08-06T03:42:39.770101Z","submitted_at":"2024-02-14T04:50:18Z","title":"Premise Order Matters in Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08939","snapshot_observed_at":"2026-08-06T17:43:53.641538Z","title":"Chi, Xuezhi Wang, and Denny Zhou","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.641538Z"},"links":{"cited_paper":"/paper/2402.08939","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:0b0adc2dffb3c382fff6117e7e195826b8fca50cfce9e045904101c4e0459a83","observation_id":"e01b675f-e5df-4299-a665-2789d87dab78","resolution":{"observed_at":"2026-08-06T17:43:53.641538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8496.2019","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.335849Z","title":null,"venue":null,"work_id":"8e115140-cecb-4e9c-9766-29c0d1393a53","year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.645569Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:c3cca2481ce40912063dfa7cc064629879bd0434365082808031d8f35bb1233f","observation_id":"ded3651d-20a1-422d-b24d-6d27894bee78","resolution":{"observed_at":"2026-08-06T17:43:55.388061Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.660015Z","title":null,"venue":null,"work_id":"d232f656-a343-45e1-a57f-89cc36913c96","year":1988},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.649666Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:165cd15ab96a7da36f64ad1c302f9978a100a0e840d011229892b748049c8035","observation_id":"5fee9f79-f6ce-4e19-b179-984e39fd003c","resolution":{"observed_at":"2026-08-06T17:43:58.733718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.494512Z","title":null,"venue":null,"work_id":"89336ce4-e79b-44ec-9927-9241036bd397","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.653485Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:3343abf9596f0325945e6739cac5bbceb799b17d9042ad0a2f43ad6281a122d4","observation_id":"e50d687d-0282-49c6-b739-df56023b57f2","resolution":{"observed_at":"2026-08-06T17:43:58.550332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T17:43:53.657338Z","title":"Zhang, Han Bao, Hanwei Xu, Haocheng Wang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.657338Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:53e61b2ccf1b6ee995c80f7b8d6adb83dc52df1a4d826e17665bc7bc0dfc6edb","observation_id":"0152c6d9-dfab-4a31-a244-4a064924b5ad","resolution":{"observed_at":"2026-08-06T17:43:53.657338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.286917Z","title":null,"venue":null,"work_id":"3b1a51ed-39e7-4136-a941-1e8d3cf46ebd","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.661572Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:7cc144736cae62a0d317d5ad6134140166d034e0e2edfa7e55d47222bdb4ff3a","observation_id":"cda3bd22-10b3-4e5f-a242-d76bb89d2d50","resolution":{"observed_at":"2026-08-06T17:43:58.383761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.123117Z","title":"Duda, Peter E","venue":null,"work_id":"2efe9b27-6ee9-45cb-a21d-588a34ebb639","year":2000},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.665537Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:abfb5f8870c855424098aad6ccc2ffad96c5caaa86fa5359aae409deb5af216a","observation_id":"645f64a9-07ee-4bf2-a440-bc63ff82a877","resolution":{"observed_at":"2026-08-06T17:43:58.212649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08528","last_updated":"2022-05-11T16:22:21Z","snapshot_observed_at":"2026-08-08T23:10:07.605447Z","submitted_at":"2022-01-21T03:37:39Z","title":"To SMOTE, or not to SMOTE?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08528","snapshot_observed_at":"2026-08-06T17:43:53.669542Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.669542Z"},"links":{"cited_paper":"/paper/2201.08528","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:178d4e2d13a5a7016d1b5cc6b262ea22756d352d635bf7e1094d53790ca25b0e","observation_id":"085c05c8-4c51-411f-bca4-5b39bbc4ae2d","resolution":{"observed_at":"2026-08-06T17:43:53.669542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.673605Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.673605Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:6cbed2dabe01a9e4e1fe01071b54a3d11177edd83b516b46d10551daa9ea45f8","observation_id":"c6088632-2d38-4e5b-9f20-384c1e120ba2","resolution":{"observed_at":"2026-08-06T17:43:53.673605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.959498Z","title":null,"venue":null,"work_id":"357f2c09-777a-4283-aa54-b94d07605cf7","year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.682598Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:c7e778820494831d7d773f4ceb67f553dcd54d6571879a4926f05e4eed01646b","observation_id":"74a9857c-4781-489c-929f-010cebf8f2b2","resolution":{"observed_at":"2026-08-06T17:43:58.041526Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.805765Z","title":"Friedman","venue":null,"work_id":"2b276849-7ca8-4c57-b1bf-aeefb64f7254","year":2001},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.686915Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:85c0582284788c1f628b6c389e58f2b0767c0d24c9cfe3edabe7d8b0317cbd71","observation_id":"421ffdff-fa52-4ce2-9908-44d08743cd90","resolution":{"observed_at":"2026-08-06T17:43:57.885731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00770","last_updated":"2024-07-12T20:29:57Z","snapshot_observed_at":"2026-08-09T13:21:58.456670Z","submitted_at":"2023-09-02T00:32:55Z","title":"Bias and Fairness in Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00770","snapshot_observed_at":"2026-08-06T17:43:53.690982Z","title":"Gallegos, Ryan A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.690982Z"},"links":{"cited_paper":"/paper/2309.00770","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:5be3717f6ac00a18d0b0097ff0e8831e89ab88de558311b25bc6dc5be75971de","observation_id":"4ecffbf0-0783-475e-a7c3-b963a9146042","resolution":{"observed_at":"2026-08-06T17:43:53.690982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-06T17:43:53.695473Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.695473Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b849329769c9284696e4fe5fdf247d5dbfce12213d64d25ea1efad454387a5ce","observation_id":"05509347-9b8e-4835-a7e2-838dc3c8be80","resolution":{"observed_at":"2026-08-06T17:43:53.695473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-04112-9_25","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":null,"venue":"Communications in computer and information science","work_id":"0dce2a5e-6d97-4585-b93f-8215236a9fd5","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.699732Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:454ebdb8a8cb0b4d1cfd220d619cc022779765f467ccf9a296fc56254f2514f9","observation_id":"cf34e9bb-9fe8-49e7-9cff-532e8970f5a7","resolution":{"observed_at":"2026-08-06T17:43:54.086324Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04247","last_updated":"2017-03-13T04:55:19Z","snapshot_observed_at":"2026-07-06T05:33:25.278531Z","submitted_at":"2017-03-13T04:55:19Z","title":"DeepFM: A Factorization-Machine based Neural Network for CTR Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04247","snapshot_observed_at":"2026-08-06T17:43:53.703634Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.703634Z"},"links":{"cited_paper":"/paper/1703.04247","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:103845766efd6544254a0de9ad976f00f59fe82ed789eee03fc4f9403e6a0ed9","observation_id":"43f8cee4-0ffd-417c-803b-897c165fb643","resolution":{"observed_at":"2026-08-06T17:43:53.703634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01172","last_updated":"2024-07-01T10:50:16Z","snapshot_observed_at":"2026-08-05T12:17:23.204989Z","submitted_at":"2024-07-01T10:50:16Z","title":"Enlarging of the sample to address multicollinearity","version":1},"cited_work":{"arxiv_id":"2407.01172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.01172","snapshot_observed_at":"2026-08-06T17:43:55.121899Z","title":"Enlarging of the sample to address multicollinearity","venue":"stat.AP","work_id":"dc9d79a2-e64d-4245-91bf-0c90f6c93fc5","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.707741Z"},"links":{"cited_paper":"/paper/2407.01172","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:ade8869103e0fffe79a389fed4b4d6fa8b91a440d113be11654b5b8a4936fedb","observation_id":"c128d2fe-4b7c-45cc-b3de-04393f50bb08","resolution":{"observed_at":"2026-08-06T17:43:55.137466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iri.2018","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.065981Z","title":null,"venue":null,"work_id":"77282649-0d94-43d5-8695-ad4efd1b3a3a","year":2018},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.711947Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:fa95ca97c0d370274c8ffa5c3cbb3b8f86d920ec0db245cbd01db6d7015df7ca","observation_id":"e1a29a07-aba8-4228-8f55-2cb9f93424cd","resolution":{"observed_at":"2026-08-06T17:43:54.070348Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03579","last_updated":"2022-06-08T14:01:43Z","snapshot_observed_at":"2026-08-07T05:10:41.239420Z","submitted_at":"2022-02-04T15:11:11Z","title":"Stop Oversampling for Class Imbalance Learning: A Critical Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03579","snapshot_observed_at":"2026-08-06T17:43:53.716115Z","title":"Hassanat, Ahmad S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.716115Z"},"links":{"cited_paper":"/paper/2202.03579","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:fa9ed2e3dd6f661a697ce8f38d3cb19d569ddb37d0fb3f4d5c73f5ec58c660aa","observation_id":"e4874d73-8834-4651-9fba-e1d760d4457e","resolution":{"observed_at":"2026-08-06T17:43:53.716115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.728372Z","title":"Tech Lab","venue":null,"work_id":"2ae1057d-5b77-469a-a854-11189a2d319e","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.720634Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:645769088cf6cc90109a52a14a1ecb60b6ecb6d4a7b19efe2ec1e4083618aa21","observation_id":"613a9f5d-6aec-4919-a29d-88ff3b1f8ae0","resolution":{"observed_at":"2026-08-06T17:43:57.747783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17216","last_updated":"2023-10-13T15:35:42Z","snapshot_observed_at":"2026-07-06T15:34:09.163519Z","submitted_at":"2023-05-26T19:22:03Z","title":"Generating Images with Multimodal Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17216","snapshot_observed_at":"2026-08-06T17:43:53.724609Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.724609Z"},"links":{"cited_paper":"/paper/2305.17216","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b60ccdc43e5012deb50d1be9f0a5339b7f1f6a27d8df03ef09175ac828446909","observation_id":"bd6d1203-8287-4d1b-9e07-c236e12c21c2","resolution":{"observed_at":"2026-08-06T17:43:53.724609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15421","last_updated":"2024-10-07T12:38:57Z","snapshot_observed_at":"2026-07-06T13:58:14.551432Z","submitted_at":"2022-09-30T12:26:14Z","title":"TabDDPM: Modelling Tabular Data with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15421","snapshot_observed_at":"2026-08-06T17:43:53.729012Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.729012Z"},"links":{"cited_paper":"/paper/2209.15421","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:dd7933692c8f0539978031d8f79ff87bb01d5159efd25b3f02f22d4fa0ae85d9","observation_id":"a21e7800-5d77-4875-b749-55040d54b546","resolution":{"observed_at":"2026-08-06T17:43:53.729012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.591234Z","title":null,"venue":null,"work_id":"e523713a-55d5-472e-bca4-4047d5476726","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.733730Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:930466eba97da738785c5b6432c518ce9ebdb15d504afbfaf455accb8779ca5f","observation_id":"28b2fda6-7eab-41e1-824c-f46faa389dcc","resolution":{"observed_at":"2026-08-06T17:43:57.647486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00879","last_updated":"2024-10-31T13:02:55Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-31T13:02:55Z","title":"DEREC-SIMPRO: unlock Language Model benefits to advance Synthesis in Data Clean Room","version":1},"cited_work":{"arxiv_id":"2411.00879","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.00879","snapshot_observed_at":"2026-08-06T17:43:55.025974Z","title":"DEREC-SIMPRO: unlock Language Model benefits to advance Synthesis in Data Clean Room","venue":"cs.DB","work_id":"158d9822-ae71-4671-b8ce-544f1b7cc014","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.737643Z"},"links":{"cited_paper":"/paper/2411.00879","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:91f468e0cf02af58e4787fe7950c7b2e762f12eb52834e089cdc56a85ff3aad3","observation_id":"6f7d4a20-ff18-4a58-a247-caaea1aaf045","resolution":{"observed_at":"2026-08-06T17:43:55.040825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.520478Z","title":null,"venue":null,"work_id":"333198d6-7db8-4b13-a17a-4a45ce2eca7f","year":2015},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.742392Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:72da2c2fd748ac95492d58abf300ec8a6a5cfd404fb1833a3662a60886fa3d40","observation_id":"3dc0f1e4-c225-4ed9-96ff-177784c51d07","resolution":{"observed_at":"2026-08-06T17:43:57.553852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02143","last_updated":"2024-01-04T08:49:10Z","snapshot_observed_at":"2026-08-09T04:24:33.752010Z","submitted_at":"2024-01-04T08:49:10Z","title":"Graph Neural Networks for Tabular Data Learning: A Survey with Taxonomy and Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02143","snapshot_observed_at":"2026-08-06T17:43:53.746389Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.746389Z"},"links":{"cited_paper":"/paper/2401.02143","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:9a9737862b72ac629d95d5119582df4044879bd04d25d00b4b5293d6bb81801b","observation_id":"f65df38c-2eb7-4157-b69c-04ef09460760","resolution":{"observed_at":"2026-08-06T17:43:53.746389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01432","last_updated":"2024-12-09T09:39:12Z","snapshot_observed_at":"2026-08-07T03:50:42.341073Z","submitted_at":"2023-09-29T14:38:58Z","title":"Split and Merge: Aligning Position Biases in LLM-based Evaluators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01432","snapshot_observed_at":"2026-08-06T17:43:53.750706Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.750706Z"},"links":{"cited_paper":"/paper/2310.01432","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:77549404cdafaf44fa15ff83a368eec1012011c54d4db4deb2ace7849db79665","observation_id":"ca2eab54-2c32-44bf-8009-df4890752fe7","resolution":{"observed_at":"2026-08-06T17:43:53.750706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.425183Z","title":"McCallum and K","venue":null,"work_id":"b0f9682e-a35b-4ba5-bb4f-d4a6e72b0342","year":1998},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.754958Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:c9cfd6bf7efc8c151998f9713e12999bcd3eba65d45875ac3564d27ac68270dd","observation_id":"9ee7e4b8-7745-4c55-87be-dba90199ae87","resolution":{"observed_at":"2026-08-06T17:43:57.461141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.298767Z","title":null,"venue":null,"work_id":"aa434649-c312-4203-b4d0-4807ac3377e7","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.759096Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:69d0cfe532da3da4af3adb9263dd752759924415bf125be16bb417f5c700dd58","observation_id":"3cb394c7-f3ce-4fb8-bbfc-94a27a87c96a","resolution":{"observed_at":"2026-08-06T17:43:57.383359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.047316Z","title":null,"venue":null,"work_id":"4b763b4e-719b-40f7-b8ec-17e424e5437e","year":2005},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.763110Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:848ff03760c3fdbcd6cf9c8edbf68161fc5098ce6f161e4d9e99ec6fd27c0608","observation_id":"18d9950e-8767-4e1b-8655-f616c932aa99","resolution":{"observed_at":"2026-08-06T17:43:57.126646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.766886Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.766886Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:6f4b10611cbe30141313b396ab802178c7595d8feef33210b0539ae4b2feb7cf","observation_id":"ab6a7e5e-d199-4021-a39c-088abe62ab77","resolution":{"observed_at":"2026-08-06T17:43:53.766886Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.879949Z","title":null,"venue":null,"work_id":"7fe3e9c7-7ed1-4596-9796-58750213cd19","year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.771570Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:d0da112a4bd6a4e2bd4c2db0ef2263a1beb4b8da024e31de1202459db3c0f0db","observation_id":"e3c47cb8-ecc2-453c-9d23-02fdceec63e3","resolution":{"observed_at":"2026-08-06T17:43:56.954294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.654558Z","title":null,"venue":null,"work_id":"a434b939-ac3e-4cfc-8f23-30fa1010039c","year":2010},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.781350Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:fd45f3fa45492895a12447f76ef221225dc93f9a71271007cc6a59e532a46e19","observation_id":"014a77b0-e9d2-433b-9b65-1f21b59c8c09","resolution":{"observed_at":"2026-08-06T17:43:56.758679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21717","last_updated":"2024-10-29T04:14:32Z","snapshot_observed_at":"2026-08-08T05:36:00.731159Z","submitted_at":"2024-10-29T04:14:32Z","title":"Generating Realistic Tabular Data with Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.21717","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.21717","snapshot_observed_at":"2026-08-06T17:43:54.900862Z","title":"Generating Realistic Tabular Data with Large Language Models","venue":"cs.LG","work_id":"e0e6e106-ebe4-40fa-9d7e-043a37ae19dd","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.776191Z"},"links":{"cited_paper":"/paper/2410.21717","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:73c49e67dbce00b4233a711b6dbe75eb98ff9585906cb5bac50faa7b5a5e690a","observation_id":"411cf88c-91f2-4b78-bae0-ea74c6dfa550","resolution":{"observed_at":"2026-08-06T17:43:54.905399Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09196","last_updated":"2025-06-12T07:17:19Z","snapshot_observed_at":"2026-08-09T07:11:16.083871Z","submitted_at":"2023-12-14T18:18:34Z","title":"Improved Algorithm for Deep Active Learning under Imbalance via Optimal Separation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09196","snapshot_observed_at":"2026-08-06T17:43:53.790544Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.790544Z"},"links":{"cited_paper":"/paper/2312.09196","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:426886039fa04594b3f843581ec8ae815e2f2e3bc6110155b72db90a679effe3","observation_id":"dbf7bf68-6215-43ff-958a-3430cb4ec809","resolution":{"observed_at":"2026-08-06T17:43:53.790544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00068","last_updated":"2022-08-22T00:58:03Z","snapshot_observed_at":"2026-07-06T08:33:56.199723Z","submitted_at":"2019-10-31T19:26:33Z","title":"Confident Learning: Estimating Uncertainty in Dataset Labels","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00068","snapshot_observed_at":"2026-08-06T17:43:53.786241Z","title":"Northcutt, Lu Jiang, and Isaac L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.786241Z"},"links":{"cited_paper":"/paper/1911.00068","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:2e006474d4f733b9b6535d8e654bc727307ca1e6f82e9b1e31b5c185d8bb71c0","observation_id":"e008506c-986c-45fe-95a1-b9a1fe5fa804","resolution":{"observed_at":"2026-08-06T17:43:53.786241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-06T17:43:53.799537Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.799537Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:41e4bfce21835881c904b03941a82fd7684254bdfb884cf46a3f783548f76874","observation_id":"d6fc0c38-8670-45b4-90a3-b283df5ff2c1","resolution":{"observed_at":"2026-08-06T17:43:53.799537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.453856Z","title":null,"venue":null,"work_id":"15677d3d-1eb4-4a36-a69c-03643e09adaa","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.795073Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:134bf57e1cd6b34f33ad4baf7d4fdc9d96d70479e77fd7f41260c0e2f522d3f8","observation_id":"07568641-6e2f-4ac2-b2ca-9676d338dc2f","resolution":{"observed_at":"2026-08-06T17:43:56.556448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.808261Z","title":"Pedregosa, G","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.808261Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:87f2af1ac92254a9a82c5f167b93367b524fe033864cd96bf2b5f3400be8993a","observation_id":"c32aa3ed-6ca1-43ca-9554-14e3903c7673","resolution":{"observed_at":"2026-08-06T17:43:53.808261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.803815Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.803815Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:95462f7c869aadde5b4a9fa1505db55c9926d988ad5cb498dc906cc01fc907f9","observation_id":"3bb33d70-226d-4c7d-9a66-c83e164914ee","resolution":{"observed_at":"2026-08-06T17:43:53.803815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/00220670209598786","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"The Journal of Educational Research","work_id":"7ddab018-abf9-4ec3-883f-4207d67d2356","year":2002},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.816144Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:848f27f1a03130330971317121acb156476a411be7edf7ef85ce959042f73ac5","observation_id":"8794fcdd-2312-4195-83ab-668c9e630df2","resolution":{"observed_at":"2026-08-06T17:43:54.044649Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00422","last_updated":"2025-03-20T10:08:31Z","snapshot_observed_at":"2026-08-10T01:00:57.698548Z","submitted_at":"2023-12-31T08:22:51Z","title":"Interpreting the Curse of Dimensionality from Distance Concentration and Manifold Effect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00422","snapshot_observed_at":"2026-08-06T17:43:53.812126Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.812126Z"},"links":{"cited_paper":"/paper/2401.00422","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:8108734166bebc74c6d57d44d97e024d88272d9e420446529658d22c4f7d35ae","observation_id":"0c2313cc-4f78-47ae-8242-033606cfcdae","resolution":{"observed_at":"2026-08-06T17:43:53.812126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.67993","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.815478Z","title":null,"venue":null,"work_id":"eafd835a-14a2-4613-a19e-7c3f9ce240a6","year":2021},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.824532Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:aa02bb03f16cfe004e7fe55090ecec9645fc70e8da5c8d25373c93fd2e1df35d","observation_id":"9c60274a-ecb6-4778-8a97-da33673a260e","resolution":{"observed_at":"2026-08-06T17:43:54.822234Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.820503Z","title":"Pezoulas, Dimitrios I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.820503Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:c9da36fc9b3889b405fbf6fcf918524adb14f2c57b6d3d1dc304658921b93145","observation_id":"8b3997fa-4740-4c6a-b175-abeb1e9a5cfb","resolution":{"observed_at":"2026-08-06T17:43:53.820503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-024-72894-y","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Janes, Neal Navani, and Mihaela van der Schaar","venue":"Scientific Reports","work_id":"a86725eb-fbbd-4bbb-a071-46213933ac5c","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.834502Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:cd1f93eb8e2dcf72ffde66f5cb7e3e76ce3b038c94fba651755efdb7030acffd","observation_id":"1c59db17-9c7a-439a-b5d2-190d8a59c887","resolution":{"observed_at":"2026-08-06T17:43:54.020040Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.11991","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.729601Z","title":null,"venue":null,"work_id":"0de7e3dc-ac25-43e9-982d-bce43d58376d","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.829369Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:752f95ab20ab806acb155b0249b2d74766da3cb9f38213aa48c02161c281c98e","observation_id":"b18410dc-6d7d-4aad-8905-b5015a7c8bd9","resolution":{"observed_at":"2026-08-06T17:43:54.736218Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.100018Z","title":null,"venue":null,"work_id":"c8153167-857b-48b7-b597-4bbdf5bda387","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.845618Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:3fdfc04d4648b2abed1f1fa786c24eb3b99ddd8865e50742950a6572bc1a2aa5","observation_id":"2e169a37-301c-4565-b344-06c126440048","resolution":{"observed_at":"2026-08-06T17:43:56.152803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.273071Z","title":null,"venue":null,"work_id":"96ff9b9b-d0eb-4061-9b30-493b1efea222","year":1986},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.839921Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:c1d729ec0ff2cb6110db8686fb9421f194e1ce35113354c560c1408350e38d0e","observation_id":"76f7be25-6ac7-4da3-8a78-ee1e70c2b2b5","resolution":{"observed_at":"2026-08-06T17:43:56.351969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.854928Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.854928Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a46038037159ce72868c913ec41d137a99b2c57769002aed359e178c3ab4ee94","observation_id":"0242dc05-d6f6-45e7-a79d-1a5593684e44","resolution":{"observed_at":"2026-08-06T17:43:53.854928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.850809Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.850809Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:713adec40e172bf2e0cfda215c41775e645cbe4885658e6cfa1f4bc840d7e439","observation_id":"b134a428-7c58-4881-9413-7b2efed154a1","resolution":{"observed_at":"2026-08-06T17:43:53.850809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.868168Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.868168Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:80a1e36b3e3dad29010bb2c16933ea6e4778cde98a6d4b545791e4a389d2def1","observation_id":"83e19de0-5620-4ac2-b558-8606e194b77e","resolution":{"observed_at":"2026-08-06T17:43:53.868168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11029","last_updated":"2024-05-17T18:03:59Z","snapshot_observed_at":"2026-07-06T18:15:58.951309Z","submitted_at":"2024-05-17T18:03:59Z","title":"Generative Artificial Intelligence: A Systematic Review and Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11029","snapshot_observed_at":"2026-08-06T17:43:53.859410Z","title":"arXiv:2405.11029 [cs.LG] https://arxiv.org/abs/2405.11029","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.859410Z"},"links":{"cited_paper":"/paper/2405.11029","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:2076cedc1d16a3b0d7e98ce8f4f2489bd5feb61b54d94d818fc6fc75eb8198b4","observation_id":"a486d356-0992-46c6-97de-f8dc77c10bbe","resolution":{"observed_at":"2026-08-06T17:43:53.859410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1404.1100","last_updated":"2014-04-03T21:16:49Z","snapshot_observed_at":"2026-07-06T03:40:19.607628Z","submitted_at":"2014-04-03T21:16:49Z","title":"A Tutorial on Principal Component Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1404.1100","snapshot_observed_at":"2026-08-06T17:43:53.864011Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.864011Z"},"links":{"cited_paper":"/paper/1404.1100","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:1a25fcdf08e58b1b7c9d3e666e38a7e5af3e54d5841c34c76895bc0f7556d888","observation_id":"1bdbe017-a8bb-44e9-a194-e657cad487c5","resolution":{"observed_at":"2026-08-06T17:43:53.864011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02966","last_updated":"2023-08-05T23:08:08Z","snapshot_observed_at":"2026-07-06T16:02:58.725804Z","submitted_at":"2023-08-05T23:08:08Z","title":"Generalized Oversampling for Learning from Imbalanced datasets and Associated Theory","version":1},"cited_work":{"arxiv_id":"2308.02966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.02966","snapshot_observed_at":"2026-08-06T17:43:54.504316Z","title":"Generalized Oversampling for Learning from Imbalanced datasets and Associated Theory","venue":"stat.ML","work_id":"fc3b4681-b185-46ef-ac78-b725777f73e2","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.880251Z"},"links":{"cited_paper":"/paper/2308.02966","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:e462138d0ac48c64db733b39250a830f6a46874e7b13899d860f3519fbb69037","observation_id":"dcbfb885-ac9d-4ad4-9b46-234c98066168","resolution":{"observed_at":"2026-08-06T17:43:54.509696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.82298","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.592321Z","title":null,"venue":null,"work_id":"e2cbc27a-b9ce-47b1-9aa8-109f12890afd","year":2017},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.872136Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:1b01711e3ec5812b656f7e9e1f4f029f1233532dbe244cea547b81c49adc56d0","observation_id":"3e22f2d5-d5ce-450d-bfca-bd0b13f0cbff","resolution":{"observed_at":"2026-08-06T17:43:54.600360Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02041","last_updated":"2023-02-04T00:32:50Z","snapshot_observed_at":"2026-08-07T18:09:41.641300Z","submitted_at":"2023-02-04T00:32:50Z","title":"REaLTabFormer: Generating Realistic Relational and Tabular Data using Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02041","snapshot_observed_at":"2026-08-06T17:43:53.876143Z","title":"Solatorio and Olivier Dupriez","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.876143Z"},"links":{"cited_paper":"/paper/2302.02041","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:e42646ac3ffedea804322197cf1d40a61218795765ee5907b3cf48c34e2bc180","observation_id":"aaa13ae3-bc3f-48d4-8204-25c1169af31c","resolution":{"observed_at":"2026-08-06T17:43:53.876143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02184","last_updated":"2024-10-03T03:58:03Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T03:58:03Z","title":"CodeJudge: Evaluating Code Generation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02184","snapshot_observed_at":"2026-08-06T17:43:53.893783Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.893783Z"},"links":{"cited_paper":"/paper/2410.02184","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:6aaa52d1c0e30578d0bba7a520ce32d58cc892cbd6dc5826284177a80b1f5801","observation_id":"a5684bfc-50b1-436c-bc04-6f42c4ab0d8b","resolution":{"observed_at":"2026-08-06T17:43:53.893783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02059","last_updated":"2024-11-07T03:32:44Z","snapshot_observed_at":"2026-08-07T15:32:17.369903Z","submitted_at":"2024-11-04T13:03:13Z","title":"TableGPT2: A Large Multimodal Model with Tabular Data Integration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02059","snapshot_observed_at":"2026-08-06T17:43:53.884678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.884678Z"},"links":{"cited_paper":"/paper/2411.02059","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:77d1f00f8b8405a45c2c6585cae5aab5bd5dbcdee31704a9e76553f1bb1ee398","observation_id":"139d1d4c-88a9-4e1f-a35b-d09d3e809837","resolution":{"observed_at":"2026-08-06T17:43:53.884678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6176.48641","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.462354Z","title":null,"venue":null,"work_id":"2b5cfa60-6e26-4a63-bb8f-f7d8491afc84","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.889095Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:dbc6a4b65e86c6d3b0c423cceb2005d47552d48dbe9bb09474178c644209c1ce","observation_id":"e5909a11-93ef-46e2-97eb-d57122d8de7b","resolution":{"observed_at":"2026-08-06T17:43:54.469270Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.739545Z","title":"Wei and Y","venue":null,"work_id":"fbe40ffe-6167-4c36-b1b5-2abb761d2094","year":2005},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.906516Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:240400a586837af9c442aaa74c23ebdd9cec9097af91b716d7762f6eef85d923","observation_id":"4fb87af6-3362-469a-8ca6-d33328f43267","resolution":{"observed_at":"2026-08-06T17:43:55.802661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.870306Z","title":null,"venue":null,"work_id":"4d8e57aa-d5ad-44de-8717-1333be6729a5","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.898594Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:04fced07231e57179dc8979b7a90453be2cf050d00cc0cd462d397d901ed3edd","observation_id":"e277fcb9-8892-4e24-9da5-47cb2ef61897","resolution":{"observed_at":"2026-08-06T17:43:55.995568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05579","last_updated":"2025-02-09T19:31:31Z","snapshot_observed_at":"2026-07-06T17:57:14.899058Z","submitted_at":"2024-04-08T14:55:35Z","title":"DRoP: Distributionally Robust Data Pruning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05579","snapshot_observed_at":"2026-08-06T17:43:53.902621Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.902621Z"},"links":{"cited_paper":"/paper/2404.05579","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:195158ca1f70949e6e70cc080f9d17b06951d9194a2bd78a67a7dd2cd23542da","observation_id":"a1cc5830-96e8-4fa8-aff5-235904dd7ad0","resolution":{"observed_at":"2026-08-06T17:43:53.902621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18144","last_updated":"2024-04-28T11:27:30Z","snapshot_observed_at":"2026-07-06T18:06:40.922189Z","submitted_at":"2024-04-28T11:27:30Z","title":"Generative AI for Visualization: State of the Art and Future Directions","version":1},"cited_work":{"arxiv_id":"2404.18144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.18144","snapshot_observed_at":"2026-08-06T17:43:54.337204Z","title":"Generative AI for Visualization: State of the Art and Future Directions","venue":"cs.LG","work_id":"37cd48e1-ac9f-4375-bd1e-e1fa5ce3e410","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.923081Z"},"links":{"cited_paper":"/paper/2404.18144","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:595a2971c59d5919be76982455aa4fd307a3fbad3a161f4e0f19aeff199521eb","observation_id":"76ca7cf0-edb7-463f-a934-fe273e9af2cb","resolution":{"observed_at":"2026-08-06T17:43:54.342597Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.910285Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.910285Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:ab16d5ba01aef3d14a5db2dc0f602d862bd1f11185ae4cee73534db1e2a58d18","observation_id":"6d43bf99-76a4-40b0-b52a-bae9dce2ec4b","resolution":{"observed_at":"2026-08-06T17:43:53.910285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02536","last_updated":"2025-05-23T10:01:57Z","snapshot_observed_at":"2026-08-06T08:12:55.523935Z","submitted_at":"2024-06-04T17:55:38Z","title":"Mitigate Position Bias in Large Language Models via Scaling a Single Dimension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02536","snapshot_observed_at":"2026-08-06T17:43:53.931934Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.931934Z"},"links":{"cited_paper":"/paper/2406.02536","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:1a1771fd01f5868e0c400c18411264792a449b958957d802cddfc9269a04a7ca","observation_id":"4373a058-2648-4b5f-bd9a-a15bda9c8587","resolution":{"observed_at":"2026-08-06T17:43:53.931934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10015","last_updated":"2025-04-03T00:24:10Z","snapshot_observed_at":"2026-08-04T01:38:31.634090Z","submitted_at":"2023-05-17T07:49:16Z","title":"Utility Theory of Synthetic Data Generation","version":4},"cited_work":{"arxiv_id":"2305.10015","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10015","snapshot_observed_at":"2026-08-06T17:43:54.358545Z","title":"Utility Theory of Synthetic Data Generation","venue":"stat.ML","work_id":"53f96505-68da-411e-9c91-37145ace8779","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.918674Z"},"links":{"cited_paper":"/paper/2305.10015","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:39806f8712eee936b837daa56f150ef24264d02d665db3aaaf804de7e53c82c2","observation_id":"ed000c46-ba34-4686-a0c0-5f63b2ebd20d","resolution":{"observed_at":"2026-08-06T17:43:54.363201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.563776Z","title":null,"venue":null,"work_id":"ad791fba-b7c7-4c07-a3dc-5d4051410da1","year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.940669Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:7456c4d5afe30fd811a070a7b5833bc135f6dab1919b2a20825fbbee86f01e74","observation_id":"bde681a4-b5be-44f0-9dbd-bfadf10e6054","resolution":{"observed_at":"2026-08-06T17:43:55.622737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00994","last_updated":"2024-04-25T09:53:33Z","snapshot_observed_at":"2026-07-06T16:01:34.200801Z","submitted_at":"2023-08-02T07:59:25Z","title":"SYNAuG: Exploiting Synthetic Data for Data Imbalance Problems","version":3},"cited_work":{"arxiv_id":"2308.00994","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.00994","snapshot_observed_at":"2026-08-06T17:43:54.316314Z","title":"SYNAuG: Exploiting Synthetic Data for Data Imbalance Problems","venue":"cs.CV","work_id":"f4b864d1-b9a2-4c5d-80dd-3633e59cb226","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.927522Z"},"links":{"cited_paper":"/paper/2308.00994","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:2223a3e77c5f614f1ad9ca821d38c5ee3d0ee93b12a71541f9af84e4062e69bd","observation_id":"f59b6978-a3fd-492d-b398-44301ed4d42d","resolution":{"observed_at":"2026-08-06T17:43:54.321500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2010.56093","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.215214Z","title":null,"venue":null,"work_id":"48cce14a-09b1-449a-8ea1-26e0ff6ca13e","year":2010},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.953535Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:fdcd4034225efc6b6ded00e7dd8c07e3e37f0d8a4a6b6646524bec8b7fa9ed11","observation_id":"452cfb36-1343-4e87-8c4c-b417cad5023b","resolution":{"observed_at":"2026-08-06T17:43:54.222225Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10402","last_updated":"2024-03-20T12:52:10Z","snapshot_observed_at":"2026-08-08T16:43:34.694268Z","submitted_at":"2023-10-16T13:45:26Z","title":"Real-Fake: Effective Training Data Synthesis Through Distribution Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10402","snapshot_observed_at":"2026-08-06T17:43:53.936245Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.936245Z"},"links":{"cited_paper":"/paper/2310.10402","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:76d2b7001e647b5f3d6bcda856995204f74f0530b4583bb2dbf9c4bee074478f","observation_id":"738c7bb7-e772-4878-92cf-dc45196505f2","resolution":{"observed_at":"2026-08-06T17:43:53.936245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02616","last_updated":"2019-04-04T15:42:58Z","snapshot_observed_at":"2026-08-10T07:07:45.680193Z","submitted_at":"2019-04-04T15:42:58Z","title":"Signal-to-Noise Ratio: A Robust Distance Metric for Deep Metric Learning","version":1},"cited_work":{"arxiv_id":"1904.02616","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.02616","snapshot_observed_at":"2026-08-06T17:43:54.262011Z","title":"Signal-to-Noise Ratio: A Robust Distance Metric for Deep Metric Learning","venue":"cs.CV","work_id":"8a80f87d-c7da-480e-91c7-0a6c027894db","year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.945202Z"},"links":{"cited_paper":"/paper/1904.02616","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:ecd1791cfdc804608dac9863a6898b0c145697b5890d5937482135652638cd9a","observation_id":"510a3c05-37d0-49dc-b0cf-0cdcf6a33239","resolution":{"observed_at":"2026-08-06T17:43:54.266799Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08855","last_updated":"2020-01-24T01:06:25Z","snapshot_observed_at":"2026-07-06T08:52:29.410955Z","submitted_at":"2020-01-24T01:06:25Z","title":"Privacy for All: Demystify Vulnerability Disparity of Differential Privacy against Membership Inference Attack","version":1},"cited_work":{"arxiv_id":"2001.08855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.08855","snapshot_observed_at":"2026-08-06T17:43:54.238807Z","title":"Privacy for All: Demystify Vulnerability Disparity of Differential Privacy against Membership Inference Attack","venue":"cs.CR","work_id":"630402ba-b716-4ef7-b1a1-28082f15abb5","year":2020},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.949279Z"},"links":{"cited_paper":"/paper/2001.08855","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a2815076f0129043fdc77195016809295590a976ea36b386de1d0441bb64af47","observation_id":"106a55de-89fe-49b0-b58c-4b1155a9faad","resolution":{"observed_at":"2026-08-06T17:43:54.243952Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.687892Z","title":"In Advances in Neural Information Processing Systems","venue":null,"work_id":"91d6cf12-0f69-43e8-80bb-303244fe0940","year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.914562Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:92a8bbeb0f25da504380fe96bd889e8209d0d19dacde732cc19818f0ace61642","observation_id":"405cb323-0713-407b-a698-ea8ba4556136","resolution":{"observed_at":"2026-08-06T17:43:55.702546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17944","last_updated":"2024-06-21T19:59:54Z","snapshot_observed_at":"2026-07-06T17:36:32.068270Z","submitted_at":"2024-02-27T23:59:01Z","title":"Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17944","snapshot_observed_at":"2026-08-06T17:43:53.677611Z","title":"arXiv:2402.17944 [cs.CL] https://arxiv.org/abs/ 2402.17944","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.677611Z"},"links":{"cited_paper":"/paper/2402.17944","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:f6eb6fa73c743c55edd8db9a0ac42c324e3006a15fef78eb6f3d037f84a2a15c","observation_id":"5c63c5e1-b91e-4884-9344-0835111c1527","resolution":{"observed_at":"2026-08-06T17:43:53.677611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T23:10:24.065143Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":5,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":53,"verified_exact":12,"verified_fuzzy":6},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 0 inbound Pith citation observations for arXiv:2507.10088."}