{"as_of":"2026-08-11T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:32c02dfc55d955040172d00c52bbc9e1f7a6ee2ce0f8e416164ab064c8b519d1","coverage":[{"denominator":188,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:26:13.655468Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T01:36:25.057478Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T01:37:22.329033Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"cited_work":{"arxiv_id":"2501.01631","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01631","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"463310d7-ea92-42c8-9a19-163d7cc0c208","year":2025},"citing_paper":{"arxiv_id":"2503.04338","last_updated":"2026-04-27T08:04:44Z","snapshot_observed_at":"2026-08-03T03:43:27.981758Z","submitted_at":"2025-03-06T11:34:49Z","title":"In-depth Analysis of Graph-based RAG in a Unified Framework","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-23T01:36:25.057478Z"},"links":{"cited_paper":"/paper/2501.01631","citing_paper":"/paper/2503.04338"},"observation_digest":"sha256:f18ff6b41640c9ad8d710b02b4f65d478e4547ab37d0a79d004e864f810fbc40","observation_id":"6ad1e85f-45b0-4ab2-bd74-d7082d22efc5","resolution":{"observed_at":"2026-05-23T01:37:22.332795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"cited_work":{"arxiv_id":"2501.01631","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01631","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"463310d7-ea92-42c8-9a19-163d7cc0c208","year":2025},"citing_paper":{"arxiv_id":"2604.01707","last_updated":"2026-08-06T02:59:56Z","snapshot_observed_at":"2026-08-11T00:41:36.339021Z","submitted_at":"2026-04-02T07:19:20Z","title":"Memory in the LLM Era: Modular Architectures and Strategies in a Unified Framework","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T22:03:55.582645Z"},"links":{"cited_paper":"/paper/2501.01631","citing_paper":"/paper/2604.01707"},"observation_digest":"sha256:4f9f1c5f89d1526a71b3e662adc7e9c512853aabdc6b2ac2a12e18b2f3347d7e","observation_id":"84950392-5555-4e35-a84d-beaa8aa5b8bf","resolution":{"observed_at":"2026-05-13T22:08:20.892916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.01631/citation-record","integrity":"/paper/2501.01631/integrity","json":"/paper/2501.01631/citation-record.json","paper":"/paper/2501.01631"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.576938Z","title":"Generalization on the unseen, logic reasoning and degree curriculum","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.576938Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:f14c341a734142803d59719a585d5071993c2ce9e9dd13f6a3567cfee895c5ce","observation_id":"eaf00d48-458d-4818-92db-4fb9ddb33229","resolution":{"observed_at":"2026-08-10T22:26:12.576938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.585323Z","title":"Interventional causal repre- sentation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.585323Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:9661ccc61c28ee6e9401cf12da4d4b2fe74dfb43b92043c42c78c6094215043d","observation_id":"ba7a078c-a0bd-4722-ab63-5537053e2727","resolution":{"observed_at":"2026-08-10T22:26:12.585323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13673","last_updated":"2025-05-19T11:12:27Z","snapshot_observed_at":"2026-08-10T12:48:03.439090Z","submitted_at":"2023-05-23T04:28:16Z","title":"Physics of Language Models: Part 1, Learning Hierarchical Language Structures","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13673","snapshot_observed_at":"2026-08-10T22:26:12.592125Z","title":"Physics of Language Models: Part 1, Context-Free Gram- mar","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.592125Z"},"links":{"cited_paper":"/paper/2305.13673","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:b92e6ef3de71c5289971ce9ac9cc5ffe9ab99812b8f47e832625d654d69b2b4e","observation_id":"458914df-e7da-4384-ba71-a1ab4a28b32f","resolution":{"observed_at":"2026-08-10T22:26:12.592125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.598919Z","title":"Automated unit test improvement using large language models at meta","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.598919Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:ef4f268c4f86ad2894aafd3923872be4e3f4a8afac0cf72bf6a1efcf34fcc0a0","observation_id":"e8123d92-2eb0-4aea-9ce8-686d2ef68b61","resolution":{"observed_at":"2026-08-10T22:26:12.598919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.609530Z","title":"A survey of cross-validation procedures for model selection","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.609530Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:a1761c4507a4ab0ad4f40499e670cfb9429ba3a9f78cb37172f1fbe78d651a53","observation_id":"6ba7ce5b-45b7-4c97-8aff-918e7248d7af","resolution":{"observed_at":"2026-08-10T22:26:12.609530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.618211Z","title":"Infusing Lattice Symmetry Priors in Attention Mechanisms for Sample-Efficient Ab- stract Geometric Reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.618211Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:06476089e6a739bacd2053a22ec286b15f9b0c7cf1a23e0e25c378144c7a9e4f","observation_id":"80dc89b6-a026-4802-96dc-77bd98a71c02","resolution":{"observed_at":"2026-08-10T22:26:12.618211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.630198Z","title":"Transformers as statisticians: Prov- able in-context learning with in-context algorithm selection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.630198Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:db7127ee92be06bd6b62b7497d3b20615a38fed7cfc8ee3c66d06902b1b8a8e4","observation_id":"3418c6be-c35a-4eb5-af9e-bc34761e1fc0","resolution":{"observed_at":"2026-08-10T22:26:12.630198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.636562Z","title":"Grounded Copilot: How Program- mers Interact with Code-Generating Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.636562Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:32902165d42fa02596cb779c58251f6ed42321ddc753fb7f03c471d007a089a7","observation_id":"4b9893a1-9a56-4c16-9f87-1a55e5269bd4","resolution":{"observed_at":"2026-08-10T22:26:12.636562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.646037Z","title":"Methodologies for data qual- ity assessment and improvement","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.646037Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:156aca5acc5ae066d85408ae698c8fdea16fd7ab24cce0550ede78c3295cc922","observation_id":"69c546e7-52e3-416c-9b3d-2960269dc995","resolution":{"observed_at":"2026-08-10T22:26:12.646037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.657431Z","title":"Neurosymbolic repair for low-code formula languages","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.657431Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:456b5957b6080285bfd6c155ac4db47e729e72da2b306e634ec8763a2a6f3691","observation_id":"7d5475e7-49b9-4c62-98a9-dcc0b2eff77d","resolution":{"observed_at":"2026-08-10T22:26:12.657431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.666886Z","title":"On the dangers of stochas- tic parrots: Can language models be too big?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.666886Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:8975ca3d3fc9e6eeefc1286d62e00ea9ea9752c89b4e1d76df92bbf0ed908555","observation_id":"d197c0e7-899c-4eea-aaa4-dc5a75948b3e","resolution":{"observed_at":"2026-08-10T22:26:12.666886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.681388Z","title":"Graph2Tac: Online Representation Learning of Formal Math Con- cepts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.681388Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:daa2562d2a0522cbd12ec1ba507d0626316b5c4f2c30da71539d1cb2551f4d9b","observation_id":"b5dbaffb-a5e9-4fd6-994d-d21355e6b3a7","resolution":{"observed_at":"2026-08-10T22:26:12.681388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.691029Z","title":"A parameterized theory of PAC learn- Revisiting Data Analysis with Pre-trained Foundation Models 23 ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.691029Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:6ddfac1d94a44e17c29645b8dcd25a1d05bcd313a8f7b2747c6046c26edf7aee","observation_id":"eee55fb0-d7ba-4515-b108-3f1f0a707eb1","resolution":{"observed_at":"2026-08-10T22:26:12.691029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.700762Z","title":"Statistical and computa- tional methods in data analysis","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.700762Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:34605c5ecda5b73a38118730b723617cb8ce99d131310edf63b7674cbd71015b","observation_id":"c727ce24-201f-453b-863c-69d2318aafbe","resolution":{"observed_at":"2026-08-10T22:26:12.700762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.709306Z","title":"Practical Reliability Data Analy- sis for Non-Reliability Engineers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.709306Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:998d13e51faddaf49f89557afe3d89fbcf8ebcf3b654240764121787b5753162","observation_id":"0cc42525-4ed6-454d-a447-ff54c45e716e","resolution":{"observed_at":"2026-08-10T22:26:12.709306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.719697Z","title":"Language models are few- shot learners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.719697Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:187e915efbd07a421c9764bf936107fd98bbb1ea3ab1d953055b7cc80983ff2f","observation_id":"00f6e6e7-059a-4766-a2f5-0dc44f8f178c","resolution":{"observed_at":"2026-08-10T22:26:12.719697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.728545Z","title":"Practical statistics for data scientists: 50+ es- sential concepts using R and Python","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.728545Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:4c3fa8890716dccbb4f034bd78763b034a6272e5c118aaa2cc0f9982c7718a8b","observation_id":"cc0cf1cf-624b-4866-9210-4b1f83e5330a","resolution":{"observed_at":"2026-08-10T22:26:12.728545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.736366Z","title":"Ro- bustness of Nonlinear Representation Learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.736366Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:9b5564d2ac92901b2a90e63d2130e2a675ec5ef0a92f2f7b42e64a7a96ccf3c9","observation_id":"a41d211d-faeb-4625-a49c-80c3c7355bc9","resolution":{"observed_at":"2026-08-10T22:26:12.736366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.747635Z","title":"CoqPyt: Proof Navigation in Python in the Era of LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.747635Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:fbf274ba6c226ceac9f8188c94401f049ade9e79507cc652d398e3f3a65385d9","observation_id":"719a356b-e4c4-4c2f-b7e3-55291d4dd615","resolution":{"observed_at":"2026-08-10T22:26:12.747635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.760198Z","title":"Why data sci- entists prefer glassbox machine learning: Algo- rithms, differential privacy, editing and bias mit- igation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.760198Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:67cfff2773f474d38bf570de49f98bef44af410a2e6705e38b252ed2a54f881f","observation_id":"77080056-cc12-4c90-8fa5-2e6b036281b5","resolution":{"observed_at":"2026-08-10T22:26:12.760198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.767780Z","title":"SPIREX: Improving LLM-based relation extraction from RNA-focused scientific literature using graph machine learn- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.767780Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:c1b5ceba958ad92649d0657951ed24a75b2ec27dd2744ca64b4eb34ec318f373","observation_id":"390d2526-440d-4755-9505-a6c37a1331fa","resolution":{"observed_at":"2026-08-10T22:26:12.767780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.773433Z","title":"Binding Language Mod- els in Symbolic Languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.773433Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:3203bfe423af34cc07638efe853ae74b4e1a777caf3cf81ccf9f0bfa18e3ea9b","observation_id":"4f12a427-ce96-455b-999a-b32f398b81bb","resolution":{"observed_at":"2026-08-10T22:26:12.773433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.796539Z","title":"Performance Optimiza- tion in the LLM World 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.796539Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:756393411030506b2bd16894d8ebb2bbe89cf8255d6031f2b39c4ad6b5c8976c","observation_id":"820d60cf-c439-4e28-abd7-d5b2b3af416e","resolution":{"observed_at":"2026-08-10T22:26:12.796539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.804661Z","title":"Relational database: A practi- cal foundation for productivity","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.804661Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:fcccb512b5a1614bde6eaff51f8ecbb3aa9bfc3e5ea309e4d0e4a713d4d70c03","observation_id":"d9a82eb4-8d47-451b-9729-688b54ae1236","resolution":{"observed_at":"2026-08-10T22:26:12.804661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07062","last_updated":"2023-09-11T22:11:46Z","snapshot_observed_at":"2026-08-08T22:17:08.501147Z","submitted_at":"2023-09-11T22:11:46Z","title":"Large Language Models for Compiler Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07062","snapshot_observed_at":"2026-08-10T22:26:12.811694Z","title":"Large language models for compiler optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.811694Z"},"links":{"cited_paper":"/paper/2309.07062","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:54c085658f8f50c0d40119776b477915def890ec5c4f7385b75faa7f6fca4da4","observation_id":"12a85de0-9d81-466a-8018-298971d47085","resolution":{"observed_at":"2026-08-10T22:26:12.811694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02524","last_updated":"2024-06-27T21:47:48Z","snapshot_observed_at":"2026-08-09T20:24:49.700759Z","submitted_at":"2024-06-27T21:47:48Z","title":"Meta Large Language Model Compiler: Foundation Models of Compiler Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02524","snapshot_observed_at":"2026-08-10T22:26:12.820402Z","title":"Meta Large Language Model Compiler: Foundation Models of Com- piler Optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.820402Z"},"links":{"cited_paper":"/paper/2407.02524","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:8a51b50c57507f3edaf05537cd3dad4ef2d8b10956e8c104f6b00942baa90268","observation_id":"b96feb83-c16a-4bb2-80b8-64f7203077de","resolution":{"observed_at":"2026-08-10T22:26:12.820402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.826614Z","title":"Good semi-supervised learn- ing that requires a bad gan","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.826614Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:240e85baaae0bf16924327b8c88c26aa9ec3af01b02b42c17b7375b98610e708","observation_id":"263f2136-4ddc-4ce1-af96-cb506f6c4bc7","resolution":{"observed_at":"2026-08-10T22:26:12.826614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.840870Z","title":"Compet- ing on analytics: Updated, with a new introduc- tion: The new science of winning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.840870Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:6d01a34f3de75816a3a9d39639d9d11be2e8d9d2bd530955d5f2ddb4ef8d7726","observation_id":"d5e89d60-ed22-4d31-a444-8e2cb9ac4d14","resolution":{"observed_at":"2026-08-10T22:26:12.840870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.849586Z","title":"Language Modeling Is Compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.849586Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:eca89c96d53f6dce065be1fd74b83a19a4f524b130c5ec52e7718adc47b13b19","observation_id":"0d190524-f4b8-4a4c-ae27-f557b0e22b9e","resolution":{"observed_at":"2026-08-10T22:26:12.849586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.860964Z","title":"TURL: Table Understand- ing through Representation Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.860964Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:64a64a16d7b35fb2bf95a1faad32809b087ea8beefe115920db990949e82c879","observation_id":"c5a2916b-b56c-43ad-8997-a5513b77b659","resolution":{"observed_at":"2026-08-10T22:26:12.860964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.873684Z","title":"LIDA: A Tool for Automatic Gen- eration of Grammar-Agnostic Visualizations and Infographics using Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.873684Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:5cda17ddde6697856e91989e3fce79f18c24c458be9654edaa109ad0b3d1b4da","observation_id":"023e56f9-e8d6-4a9a-868a-72c496fabd82","resolution":{"observed_at":"2026-08-10T22:26:12.873684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.894315Z","title":"Overfitting and undercomput- ing in machine learning","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.894315Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:ab7eaa5f6efcacb999d48bad252fd36cffd818f51f55f0fa49b18dbdba19db83","observation_id":"6a0a6020-ab95-49eb-97ba-6ea57b032faf","resolution":{"observed_at":"2026-08-10T22:26:12.894315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.908593Z","title":"Large language models of code fail at completing code with potential bugs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.908593Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:da04cb0db28aef24bc15879c6e9cd87509f164bdd0ac015606c5a4a7601c2fc1","observation_id":"32213f4d-0da9-46ef-a3fb-2288eb252d4e","resolution":{"observed_at":"2026-08-10T22:26:12.908593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.914084Z","title":"DeepJoin: Joinable Table Discovery with Pre-trained Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.914084Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:28096cf453a51a9472cd1c3208716c5e9fca4b77423270c6e556f5252be6d1bd","observation_id":"b0495682-39ba-4edf-baac-8416690cf945","resolution":{"observed_at":"2026-08-10T22:26:12.914084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.928500Z","title":"Position: Compositional Generative Modeling: A Single Model is Not All You Need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.928500Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:fb41bd827fc449bd7781c60ece76def9f84785cf1b52076cf19a540301c56a6c","observation_id":"a4c57b6f-80ea-4828-9170-3f7a53b1d40a","resolution":{"observed_at":"2026-08-10T22:26:12.928500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.936236Z","title":"Enhancing job recommen- dation through llm-based generative adversarial networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.936236Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:f60f3ddb92319807366ae2859114d0971203d38538ab8a1b0f410fdc9a552ad8","observation_id":"92c30e37-e3be-4e52-a46f-d53d9b00e1a7","resolution":{"observed_at":"2026-08-10T22:26:12.936236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.945577Z","title":"On-device query intent prediction with lightweight LLMs to support ubiq- uitous conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.945577Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:b5ab1fdeec3fc6f3705d81c6cfe3e1c6ea1e368bf64b4db3263669a00f275a11","observation_id":"e8700a57-1455-4b1e-a0aa-280c6d2b962b","resolution":{"observed_at":"2026-08-10T22:26:12.945577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.955772Z","title":"DreamCoder: growing gener- alizable, interpretable knowledge with wake–sleep Bayesian program learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.955772Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:e5d5a7ab80740818314d94567fd35b3a656c67aabaaf4146a809148ecaa0852c","observation_id":"465fa8b9-bf3b-40f3-a742-b22ade36113f","resolution":{"observed_at":"2026-08-10T22:26:12.955772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.965174Z","title":"Semantics-aware Dataset Dis- covery from Data Lakes with Contextualized Column- based Representation Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.965174Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:4f98355e2866bb2707c7f25a2394da66bdc488e30f1040eb652314269613dc8c","observation_id":"ba49abf3-79d6-4ad7-bfd0-ee43ec7305d0","resolution":{"observed_at":"2026-08-10T22:26:12.965174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.976163Z","title":"Combining Small Language Mod- els and Large Language Models for Zero-Shot NL2SQL","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.976163Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:0d0c688ec15995a2017675a69a61d86e7c4b21f85df84b04a9d0bfb8862cfe65","observation_id":"5c881272-1754-4476-b83f-b2591f41eaac","resolution":{"observed_at":"2026-08-10T22:26:12.976163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:12.990953Z","title":"How large lan- guage models will disrupt data management","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:12.990953Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:7378e20ae5f7c4eb6403fdd3cc690f94598a3afac149c5c1e3d98efa56130e84","observation_id":"16bc943f-d733-4abf-b24d-b4ac8fedace8","resolution":{"observed_at":"2026-08-10T22:26:12.990953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.003383Z","title":"Position: Relational Deep Learning-Graph Representation Learning on Re- lational Databases","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.003383Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:48ab46723352bf9ac8eb7bf2784ceb707ed8e0d140c1dd17c2baddec884df9a2","observation_id":"3f76a5d7-a168-48e4-83bb-91f52791f4a1","resolution":{"observed_at":"2026-08-10T22:26:13.003383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.015280Z","title":"CatSQL: Towards Real World Natural Language to SQL Applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.015280Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:d0d6b83a5c2794f69db9e5cf0fdd1a4885e7a87db59c41bb684ad6bec194ef58","observation_id":"5cdecbdd-d50d-4964-9e4f-7f8446712ddc","resolution":{"observed_at":"2026-08-10T22:26:13.015280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.045569Z","title":"Text-to-SQL Empowered by Large Language Models: A Benchmark Evalua- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.045569Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:eb791fa45d472c5b9aeccada023fa1779903e3bd9b7722583f7c1809bdc14771","observation_id":"e6cafa45-1c4c-4eef-9f25-801042d80d01","resolution":{"observed_at":"2026-08-10T22:26:13.045569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-10T22:26:13.058056Z","title":"Retrieval-augmented gener- ation for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.058056Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:06e32460266470bd29f069f99b4c79cb36279ac400ab989cc94c56431749ce45","observation_id":"318bde32-0d3a-479e-be1e-f2c497a85266","resolution":{"observed_at":"2026-08-10T22:26:13.058056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.070252Z","title":"Using experts to develop a supply chain matu- rity model in Mexico","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.070252Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:e9e394fd5d1613f6263f5a5b5eac013ae2bf2d27ff82c2a5e4d255bbe4ffc6d7","observation_id":"7af40a30-3dcf-4c29-a095-dda3883f4d2c","resolution":{"observed_at":"2026-08-10T22:26:13.070252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.078932Z","title":"LLM-PBC: Logic Learn- ing Machine-based explainable rules accurately stratify the genetic risk of Primary Biliary Cholan- gitis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.078932Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:fa64089b8f3401e336a782dbeb49947d4be8ac9ec2f2ab7fe99b6c93a5d01c01","observation_id":"d47015c5-364e-41bf-9c1b-6bbce62c761a","resolution":{"observed_at":"2026-08-10T22:26:13.078932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.086165Z","title":"LILO: Learning Interpretable Libraries by Compressing and Documenting Code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.086165Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:078d74038796e6d9394f2c7cc85854ffebe94a7f5cf2f20ac1caf97c69e7801a","observation_id":"c348749e-9815-4731-9a3f-a2d551e856cb","resolution":{"observed_at":"2026-08-10T22:26:13.086165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.093887Z","title":"Why do tree-based models still outper- form deep learning on typical tabular data?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.093887Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:ea7ad089cc35dfdf104bc2e0444e29ce725f801fb0ecb0feb27bafc9b08eda36","observation_id":"03234c48-7f2a-4c81-9b04-b56f76003cca","resolution":{"observed_at":"2026-08-10T22:26:13.093887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.103106Z","title":"Few-shot text-to-sql translation using structure and content prompt learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.103106Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:9f87e6b93f9194b8b6a011197054fde38656a0769077d4df4850c57cf7471a44","observation_id":"30f859d4-bd34-43b3-ae62-4ef779bcd3ba","resolution":{"observed_at":"2026-08-10T22:26:13.103106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.121681Z","title":"An intro- duction to variable and feature selection","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.121681Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:65e72c7249901480b342965bac6c051c6cc5d77ad2e80a79db3fbd2ff51d28ac","observation_id":"cb38ed99-3df6-46b8-a293-8a18559fee6e","resolution":{"observed_at":"2026-08-10T22:26:13.121681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.132153Z","title":"Interpreting Equivariant Repre- sentations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.132153Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:7cd437668f879394a947426958a1c862604d08677f747c229c007c8ceea1dd80","observation_id":"06b3a155-5f3a-4b5b-a0ec-40ac0b72d0b6","resolution":{"observed_at":"2026-08-10T22:26:13.132153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.138118Z","title":"The elements of statistical learning: data mining, inference, and prediction","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.138118Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:56067cf7ead00a4f1c6545c3b59bdaaac36a49baba7da9e06f300e93a7fa49d9","observation_id":"dc7f0573-558d-4fe0-8319-1d1e8f59ff5e","resolution":{"observed_at":"2026-08-10T22:26:13.138118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.148913Z","title":"Optimizing Video Selection LIMIT Queries With Commonsense Knowledge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.148913Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:95a1a74bfedfcfa37a302d63b84dc8b68d2b94d6fda0563e47b166116e64653f","observation_id":"e6500433-2e8c-4384-a434-6abd018e6391","resolution":{"observed_at":"2026-08-10T22:26:13.148913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.165652Z","title":"Declarative language design for interactive visualization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.165652Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:cc8418600f062cdf81c0bd58a45816ae1b26a013ce08874d36922910e489cf24","observation_id":"a8d84b9c-0df9-4b73-a556-34fb5a794cce","resolution":{"observed_at":"2026-08-10T22:26:13.165652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.170465Z","title":"Large Language Models for Automated Data Science: Introducing CAAFE for Context- Aware Automated Feature Engineering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.170465Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:0fab219bc6065429fcdedfb34b0c63ce883f0ef206549b97814b804cdef2b8dc","observation_id":"4943ca69-5dd2-4cb5-941f-7ea769248e34","resolution":{"observed_at":"2026-08-10T22:26:13.170465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.175347Z","title":"What’s Left? Concept Ground- ing with Logic-Enhanced Foundation Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.175347Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:c80d7fbd7a206eeaa6c8e5a8850a9376ed9717a6b1ad9fe0ddd3550dfeac90f0","observation_id":"d110118e-64ef-44a6-af12-3e180f678d9a","resolution":{"observed_at":"2026-08-10T22:26:13.175347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.180417Z","title":"Amortizing intractable in- ference in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.180417Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:42b05bd902d813d7f921b388f9fc3d36f06a33a3b53e973da43dc91a143da256","observation_id":"9cd0fa77-7fdf-4303-af8a-18591d7c92bc","resolution":{"observed_at":"2026-08-10T22:26:13.180417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.187974Z","title":"A survey of knowledge en- hanced pre-trained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.187974Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:69d3d86e4ab6da12621c68e128954ea9842e6b03272dd40b219a206cff417e89","observation_id":"e61d3249-ecba-4a9e-aba3-1c12db4ceef6","resolution":{"observed_at":"2026-08-10T22:26:13.187974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.196544Z","title":"InfiAgent-DABench: Evaluat- ing Agents on Data Analysis Tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.196544Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:c9abe31a44a95b400ad86917de3146936c8306681b8f4ac540305978626d3d1b","observation_id":"e75a6fdf-0acf-4b49-9675-f5a76a5aed0d","resolution":{"observed_at":"2026-08-10T22:26:13.196544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.219368Z","title":"KOSA: KO enhanced salary analytics based on knowledge graph and LLM capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.219368Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:3725029ca5f910ff2da0f9375f075cf802c393577355f179eacfe161e5560942","observation_id":"dacef6be-a650-4732-b88c-d34e69d8ab2a","resolution":{"observed_at":"2026-08-10T22:26:13.219368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.229250Z","title":"DAMA-DMBOK: Data man- agement body of knowledge","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.229250Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:88ac414dc303487c5f191fc1c340c54f66b92a4c0f8157d2f135e71ae6cf0493","observation_id":"067ff5a4-dfef-4025-bf39-b1f6160e1983","resolution":{"observed_at":"2026-08-10T22:26:13.229250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.240221Z","title":"Deep Indexed Active Learning for Matching Het- erogeneous Entity Representations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.240221Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:33e1142fa34601fad2ed4555d2c3d139fd7a91ed180d6b3e6be3bce163b21639","observation_id":"64a62fef-1db7-4df6-af1b-721f2dd848ba","resolution":{"observed_at":"2026-08-10T22:26:13.240221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.250776Z","title":"Jigsaw: Large language mod- els meet program synthesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.250776Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:7e5a0eb4d31c745d3c6103c764521f8fe81a2180d37c4f2d9f139f98334bc8c6","observation_id":"47ffbeb8-81a8-46fa-bbae-7d0cd71a2d4c","resolution":{"observed_at":"2026-08-10T22:26:13.250776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.258916Z","title":"R2E: Turning any Github Repository into a Programming Agent Environ- ment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.258916Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:510936e99e11a1626940f2dc44c1de1a449892ea45254783eeed9d41ebc4a91d","observation_id":"1cba3a29-7435-4725-883e-2d800d1369dc","resolution":{"observed_at":"2026-08-10T22:26:13.258916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.277882Z","title":"Counterexample guided inductive synthesis using large language models and satisfiability solving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.277882Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:79ba44b311899ff88154d34c4ebe487cb4be4cf26629681917c0c6cc6482cd49","observation_id":"932ba79f-3bb2-4988-9a03-0d53447f6135","resolution":{"observed_at":"2026-08-10T22:26:13.277882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.285804Z","title":"Survey of Hallucination in Natu- ral Language Generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.285804Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:a2f219951e3c99260da5e966519a35c73d5bb3665f1bbf20ec553fdd7a665592","observation_id":"01c16483-c156-4f66-8165-ea7ac44bf238","resolution":{"observed_at":"2026-08-10T22:26:13.285804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.290778Z","title":"The 3W Model and Alge- bra for Unified Data Mining","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.290778Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:4e18d42ad1ebdc4afdf17899e4c76f019d9d6f51902cff852b28c70fbf85a62f","observation_id":"4b53abce-13d4-44d8-b629-954eb6a2bac7","resolution":{"observed_at":"2026-08-10T22:26:13.290778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.306406Z","title":"Reinforcement learning: A survey","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.306406Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:599bac69f7f9b266cb2568e75afb263957eec6ba98acaddb63bce1ce89089ec9","observation_id":"d74f1400-431c-4989-b243-f41ed7417c24","resolution":{"observed_at":"2026-08-10T22:26:13.306406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.313614Z","title":"A Survey of Reinforce- ment Learning from Human Feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.313614Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:d4eea1ca611d4b7b0a49bf50f5061632662068b9dac218a5f0165c79700df6b3","observation_id":"58cb76ff-5e01-4867-8655-10127d2850a2","resolution":{"observed_at":"2026-08-10T22:26:13.313614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.324928Z","title":"CHORUS: Foundation Mod- els for Unified Data Discovery and Exploration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.324928Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:4d0b1cc075d83abf02b2cf0208800e2b3271a69aa478d665741d48805c82e2a4","observation_id":"16ad41a4-655e-47cd-a3e1-3bfc2c65f60c","resolution":{"observed_at":"2026-08-10T22:26:13.324928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.339540Z","title":"Information quality: The potential of data and analytics to generate knowledge","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.339540Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:075030409fbbe3c2630c2ee981a780df64c773ebb0fffdf194f631c3c31e67bc","observation_id":"4aa7b869-8ff3-40b4-ba0f-497f3e156451","resolution":{"observed_at":"2026-08-10T22:26:13.339540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.351459Z","title":"PAC Prediction Sets for Large Language Models of Code","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.351459Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:edf15c5104c4b17312cab29f17716c4b0cd900504b33c54355d3939e9d75a2e9","observation_id":"5a331c79-475f-4e5e-bc1e-72678e0815fa","resolution":{"observed_at":"2026-08-10T22:26:13.351459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.361035Z","title":"PAC prediction sets for large language models of code","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.361035Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:439c1d1dade5756f97cd4bd8ebf16edf3843de9885d0d0e7b805ce6792d5a3a8","observation_id":"39d58959-506d-43bc-82cd-57616ab97b9f","resolution":{"observed_at":"2026-08-10T22:26:13.361035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.386880Z","title":"Object identity","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.386880Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:3c74b6fc6b2a08ca40a72441b285cbda4dd60e9293e818a41bb58d232cc8c6f8","observation_id":"3b686da8-bed7-415e-9a46-b50ad401eaa6","resolution":{"observed_at":"2026-08-10T22:26:13.386880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.391668Z","title":"Cicero: A declarative gram- mar for responsive visualization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.391668Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:f51d05a5633df2eb2e2c53c1b5539ee6977b4d62bc5edc423fc2aed269b0f730","observation_id":"a24ae1b3-0c7d-4874-83eb-d1162a14bcb7","resolution":{"observed_at":"2026-08-10T22:26:13.391668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.396403Z","title":"Filling in the Gaps: LLM- Based Structured Data Generation from Semi- Structured Scientific Data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.396403Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:8844cd7e3aa057870c17c3a18b3205814b7936f97184b1e27bea9a7dc1c254c9","observation_id":"d84977bf-4c96-4171-9f70-663898745a19","resolution":{"observed_at":"2026-08-10T22:26:13.396403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.411381Z","title":"LLM-based and Retrieval- Augmented Control Code Generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.411381Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:2d309e1aae73074f0446482407e6e909dc80498466331efde70f00871f904958","observation_id":"d48fac03-ae5d-4ce7-a0c0-7e1f10339a73","resolution":{"observed_at":"2026-08-10T22:26:13.411381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.416645Z","title":"DS-1000: A natural and re- liable benchmark for data science code genera- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.416645Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:4e48936f235befd927d958a69c4d280cdbc25cd58558cb4e597e90eb308d113c","observation_id":"79c8243a-ae63-4b87-b6d7-612dd8da334c","resolution":{"observed_at":"2026-08-10T22:26:13.416645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.440864Z","title":"Modern data analysis","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.440864Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:79823053ccf894e183abe8643ffc8ba3538d22866efc006b1f3d44c61a8608ba","observation_id":"f57b921f-718d-4693-a742-62c6d3cae4ff","resolution":{"observed_at":"2026-08-10T22:26:13.440864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.449951Z","title":"Language Models as Controlled Natural Language Semantic Parsers for Knowledge Graph Question Answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.449951Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:1d48785031fd2c2030e1ead44ce8e6af3bb834a6516658e3ff1bfcfa4e5d3bc7","observation_id":"1d59d455-8a91-4b5c-affb-304b106758bd","resolution":{"observed_at":"2026-08-10T22:26:13.449951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.461304Z","title":"The Dawn of Natural Language to SQL: Are We Fully Ready? [Experiment, Anal- ysis & Benchmark ]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.461304Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:1a02625172ab1b45ada0626e06989534cfd042db843690919bc200edfa13c43a","observation_id":"9994b3d6-c7bc-4c0d-a445-ecd710155594","resolution":{"observed_at":"2026-08-10T22:26:13.461304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.478401Z","title":"Resdsql: Decoupling schema linking and skeleton parsing for text-to-sql","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.478401Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:6572c79fccfcdb9a4a255eb5db51325c4fc5885048d9c2fa753900396ab415dc","observation_id":"47b750d3-0f93-4cc0-acb3-d3a779dec78a","resolution":{"observed_at":"2026-08-10T22:26:13.478401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.490705Z","title":"Can llm already serve as a database interface? a big bench for large-scale database grounded text-to-sqls","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.490705Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:7a6eed10241e2b43078dfe72798cd411a0d477f822a0b3cf10a351791374525e","observation_id":"e80a5459-3ec5-4cd3-9ef2-7cb5f50c5527","resolution":{"observed_at":"2026-08-10T22:26:13.490705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08316","last_updated":"2024-11-19T17:49:27Z","snapshot_observed_at":"2026-07-06T18:29:39.539339Z","submitted_at":"2024-06-12T15:16:40Z","title":"Is Programming by Example solved by LLMs?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08316","snapshot_observed_at":"2026-08-10T22:26:13.508896Z","title":"Is Programming by Example solved by LLMs?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.508896Z"},"links":{"cited_paper":"/paper/2406.08316","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:f737989c5f81ec9cc85b6dd1f9b13d6023842bedb3141ec7e5c6f7e9176b4634","observation_id":"95e5df02-6300-46d5-abec-65b96cec9ec2","resolution":{"observed_at":"2026-08-10T22:26:13.508896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3650203","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:14.837812Z","title":"Towards Efficient Data Wrangling with LLMs using Code Generation","venue":null,"work_id":"58d5cbed-8680-4858-a44b-6998d3314351","year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.517350Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:6073d114b1088f57e700669c329d0edca9f0226283827586ecc0b14dcf091d62","observation_id":"75549a3f-e5fa-4eb4-997c-73572562950e","resolution":{"observed_at":"2026-08-10T22:26:14.849780Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.528656Z","title":"Towards Efficient Data Wrangling with LLMs using Code Generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.528656Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:6489294f000d19029d50e7cf1ff24ae65e51ec4bce2101c2bbfb991e2a583ad2","observation_id":"6f2bdfa1-93b0-4195-8876-78b2ef932d3d","resolution":{"observed_at":"2026-08-10T22:26:13.528656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.539136Z","title":"Deep Entity Matching with Pre-Trained Language Models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.539136Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:9286f00ecd214a1b35179f715e8eec3a6ffff9d936666a2ec2a686bc5cd068af","observation_id":"3a1804b9-c553-413d-9716-8dc265d8631e","resolution":{"observed_at":"2026-08-10T22:26:13.539136Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.544878Z","title":"Flexkbqa: A flexible llm-powered framework for few-shot knowledge base question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.544878Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:7288238c29d917c34ab03f3879a8acbd8b30d160ac9b26b9fe6a67314f5b64ec","observation_id":"27e63f74-2c15-4d04-8a76-8abf2c656d6f","resolution":{"observed_at":"2026-08-10T22:26:13.544878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.551561Z","title":"Foundation Models for Time Series Analysis: A Tutorial and Survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.551561Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:971b28bb95253378121b20c154d15ecaf53b8b8862ba27cb1e38ef6414b80a23","observation_id":"40bfaa53-1eec-464d-b13e-8bcf0417e611","resolution":{"observed_at":"2026-08-10T22:26:13.551561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.560773Z","title":"Statis- tical analysis with missing data","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.560773Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:b5a58b65e6d8d513633f4ebea59c2cef3ce0d672d78a655d1729a462ccecb08f","observation_id":"7839c153-cac5-439b-ab0b-39612ea654e8","resolution":{"observed_at":"2026-08-10T22:26:13.560773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.571917Z","title":"JarviX: A LLM no code platform for tabular data analysis and optimiza- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.571917Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:b30d0a1904ab66f8587f7e75331952f4b8ab9d08fe9f45f19dca72c452ff1b47","observation_id":"e59516a5-1626-449c-8012-2b9907bd96a3","resolution":{"observed_at":"2026-08-10T22:26:13.571917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.584077Z","title":"Enhancing Large Language Mod- els with Multimodality and Knowledge Graphs for Hallucination-free Open-set Object Recogni- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.584077Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:a4ac79ce10a03ed0c3cceb72084f44b34b3afbcbd33efbeec11bd47e6f3384cf","observation_id":"91e4ec75-93d0-42e5-90c7-1e3ff510245c","resolution":{"observed_at":"2026-08-10T22:26:13.584077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.589067Z","title":"SAIE Framework: Support Alone Isn’t Enough - Advancing LLM Training with Ad- versarial Remarks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.589067Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:e50ddd78fdda979bd9673608330d9618d585bbd28f6d85904e6cfff8a31b435d","observation_id":"c8c0a24b-c093-4cdb-8801-d9aa438cfc74","resolution":{"observed_at":"2026-08-10T22:26:13.589067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14274","last_updated":"2024-09-22T00:19:27Z","snapshot_observed_at":"2026-08-10T15:48:06.298391Z","submitted_at":"2024-09-22T00:19:27Z","title":"Proof Automation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14274","snapshot_observed_at":"2026-08-10T22:26:13.597347Z","title":"Proof Automation with Large Language Mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.597347Z"},"links":{"cited_paper":"/paper/2409.14274","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:319d9a878b314072102e5ff1a836ce685af83ab47130b4a8410ef721dac61303","observation_id":"4e6e1f39-d875-4536-94e3-5b5c885e65aa","resolution":{"observed_at":"2026-08-10T22:26:13.597347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08786","last_updated":"2022-03-03T12:10:58Z","snapshot_observed_at":"2026-07-06T11:01:05.577957Z","submitted_at":"2021-04-18T09:29:16Z","title":"Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08786","snapshot_observed_at":"2026-08-10T22:26:13.602943Z","title":"Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.602943Z"},"links":{"cited_paper":"/paper/2104.08786","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:5aba8ac186012536e957c3b633f51b37ea99936fb2eb2a7c1954920f93663c5e","observation_id":"4926cec2-fc61-4a2e-a578-c3f236ce0153","resolution":{"observed_at":"2026-08-10T22:26:13.602943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.619684Z","title":"Automatic programming: Large language models and beyond","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.619684Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:52b1ef84a41ca6bfa7200a2717a87c53e804f2c7d5f37f4ae9888678f9e678c5","observation_id":"947f2945-29ad-41c6-984d-7b8238ed09fe","resolution":{"observed_at":"2026-08-10T22:26:13.619684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.628010Z","title":"InsightPilot: An LLM- empowered automated data exploration system","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.628010Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:6a722109234f9e7ac9f32ac225ad8189142888e145dce4d63b8c3359da52997a","observation_id":"ec3b5794-cffc-445f-bc39-3ef0390a1470","resolution":{"observed_at":"2026-08-10T22:26:13.628010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03770","last_updated":"2024-05-06T18:09:48Z","snapshot_observed_at":"2026-08-08T03:33:14.622766Z","submitted_at":"2024-05-06T18:09:48Z","title":"Foundation Models for Video Understanding: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03770","snapshot_observed_at":"2026-08-10T22:26:13.643929Z","title":"Foundation Models for Video Understanding: A Survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.643929Z"},"links":{"cited_paper":"/paper/2405.03770","citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:a934cd020984e81957ac18656e345cc22c5db9e50adc323b8a32715afcc39087","observation_id":"9361f7d4-b4c3-4a9b-8e9c-f281606d9808","resolution":{"observed_at":"2026-08-10T22:26:13.643929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:26:13.655468Z","title":"Learning Instance-Specific Aug- mentations by Capturing Local Invariances","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-10T22:26:13.655468Z"},"links":{"citing_paper":"/paper/2501.01631"},"observation_digest":"sha256:cae8c758880cd8a19c031043b7bb8f5cbd9608755ea0aafdef591200bc53c8d6","observation_id":"f88f1c30-fcec-4197-82ab-e77e1ada4891","resolution":{"observed_at":"2026-08-10T22:26:13.655468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.01631","last_updated":"2025-01-03T04:38:51Z","latest_version":1,"primary_category":"cs.DB","snapshot_observed_at":"2026-08-10T23:57:05.570777Z","submitted_at":"2025-01-03T04:38:51Z","title":"Revisiting Data Analysis with Pre-trained Foundation Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":98,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":188},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 188 outbound references and 2 inbound Pith citation observations for arXiv:2501.01631."}