{"as_of":"2026-08-10T14:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4937d84b7c3c47e591d147fc397ab9eec9c9de60b38fadf9a3a9a813221a5672","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:47.958225Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:34:47.760875Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T08:04:29.090042Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"cited_work":{"arxiv_id":"2507.07829","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07829","snapshot_observed_at":"2026-06-30T08:04:29.090042Z","title":"Towards benchmarking foundation models for tabular data with text","venue":null,"work_id":"e217149e-75f7-4054-b53f-5e33f8febd66","year":2025},"citing_paper":{"arxiv_id":"2605.12292","last_updated":"2026-05-12T15:47:50Z","snapshot_observed_at":"2026-07-30T09:22:37.068920Z","submitted_at":"2026-05-12T15:47:50Z","title":"STRABLE: Benchmarking Tabular Machine Learning with Strings","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T05:13:15.039160Z"},"links":{"cited_paper":"/paper/2507.07829","citing_paper":"/paper/2605.12292"},"observation_digest":"sha256:43ccd7dfe4724f7731969b3ffaabcfeba488dfe34d17cba12d62e5022f712c45","observation_id":"036e564d-2896-4d9d-a8c4-e74202eb4aa7","resolution":{"observed_at":"2026-05-13T05:17:18.441754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"cited_work":{"arxiv_id":"2507.07829","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07829","snapshot_observed_at":"2026-06-30T08:04:29.090042Z","title":"Towards benchmarking foundation models for tabular data with text","venue":null,"work_id":"e217149e-75f7-4054-b53f-5e33f8febd66","year":2025},"citing_paper":{"arxiv_id":"2606.30410","last_updated":"2026-06-29T14:55:52Z","snapshot_observed_at":"2026-08-03T09:53:02.738738Z","submitted_at":"2026-06-29T14:55:52Z","title":"Beyond IID: How General Are Tabular Foundation Models, Really?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T06:59:14.626274Z"},"links":{"cited_paper":"/paper/2507.07829","citing_paper":"/paper/2606.30410"},"observation_digest":"sha256:d64f9d138ba3093b2e08ebc115a4b06e2f5dc5429f7e4d802e386c7e30965d4b","observation_id":"378dff40-5ec7-4857-906e-3d4ce8efecff","resolution":{"observed_at":"2026-06-30T07:04:21.420092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"cited_work":{"arxiv_id":"2507.07829","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07829","snapshot_observed_at":"2026-06-30T08:04:29.090042Z","title":"Towards benchmarking foundation models for tabular data with text","venue":null,"work_id":"e217149e-75f7-4054-b53f-5e33f8febd66","year":2025},"citing_paper":{"arxiv_id":"2606.30452","last_updated":"2026-06-29T15:21:17Z","snapshot_observed_at":"2026-08-02T15:48:26.354478Z","submitted_at":"2026-06-29T15:21:17Z","title":"Exploring Differences Between Tabular Enterprise Data and Public Benchmarks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-30T07:34:47.760875Z"},"links":{"cited_paper":"/paper/2507.07829","citing_paper":"/paper/2606.30452"},"observation_digest":"sha256:11a9fc7c62c42e255891dbba24e048518f18ffedbbe5c161e44aa30e6765c902","observation_id":"4a372cec-af06-47c5-9513-4821a51dd7f5","resolution":{"observed_at":"2026-06-30T08:04:29.091444Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07829/citation-record","integrity":"/paper/2507.07829/integrity","json":"/paper/2507.07829/citation-record.json","paper":"/paper/2507.07829"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:46.629336Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:46.629336Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:61f42ed96ce025e645fa2f673985e74ede4f24e8379d81eeab2ffb3dc5dc00f0","observation_id":"1c7d4019-78e6-4a09-b12b-428e12e41c91","resolution":{"observed_at":"2026-08-06T18:36:46.629336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.03731","last_updated":"2021-11-22T13:58:04Z","snapshot_observed_at":"2026-08-10T01:03:56.491176Z","submitted_at":"2017-08-11T23:28:48Z","title":"OpenML Benchmarking Suites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.03731","snapshot_observed_at":"2026-08-06T18:36:46.741921Z","title":"G., van Rijn, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:46.741921Z"},"links":{"cited_paper":"/paper/1708.03731","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:22fa8abeb094322d426b4588fbd8bffa350f3902a4c94c22425bcc75b447341c","observation_id":"baf2414d-065f-4a50-a179-fcdb89fd3b6b","resolution":{"observed_at":"2026-08-06T18:36:46.741921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.04606","last_updated":"2017-06-19T17:41:07Z","snapshot_observed_at":"2026-07-06T05:03:45.255477Z","submitted_at":"2016-07-15T18:27:55Z","title":"Enriching Word Vectors with Subword Information","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.04606","snapshot_observed_at":"2026-08-06T18:36:46.868838Z","title":"Enriching word vectors with subword information, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:46.868838Z"},"links":{"cited_paper":"/paper/1607.04606","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:180de63e6078f6a432aa414ce16914a9f7a388f167e4bc20edcb18716e207eae","observation_id":"377f81f8-07a2-4e19-8c55-b165bf9a981d","resolution":{"observed_at":"2026-08-06T18:36:46.868838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.052197Z","title":"V., Na, L., Ma, Y., Boussioux, L., Zeng, C., Soenksen, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.052197Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:45ff275bfdd7ad5a6292ebbf542b0423eec0dc6f50367755bc47a9e1ca019567","observation_id":"483d32a2-ff1e-4cbd-a28b-b3533f925e72","resolution":{"observed_at":"2026-08-06T18:36:47.052197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:48.584641Z","title":"and Guestrin, C","venue":null,"work_id":"10cd5dbd-d7ff-4e2d-83df-1d944c3b6983","year":2016},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.160510Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:682af774e20cbb1d31ae95991034343ac2ef404acf7c3326a035615c1a64a96e","observation_id":"877e9463-acaa-49d1-abe0-80df7238f766","resolution":{"observed_at":"2026-08-06T18:36:48.592767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.06505","last_updated":"2020-03-13T23:10:39Z","snapshot_observed_at":"2026-07-06T09:04:37.917150Z","submitted_at":"2020-03-13T23:10:39Z","title":"AutoGluon-Tabular: Robust and Accurate AutoML for Structured Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.06505","snapshot_observed_at":"2026-08-06T18:36:47.379543Z","title":"Autogluon-tabular: Robust and accurate automl for structured data, 2020 b","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.379543Z"},"links":{"cited_paper":"/paper/2003.06505","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:4b61f5a73dad5b95caa2def95f64aafff45f5ecf2df0e2b1eedc3d036aba83d6","observation_id":"da1cfbfd-2367-4aa7-b9d3-abe8e32e0193","resolution":{"observed_at":"2026-08-06T18:36:47.379543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12560","last_updated":"2023-11-16T14:12:10Z","snapshot_observed_at":"2026-08-05T19:50:36.254635Z","submitted_at":"2022-07-25T22:34:08Z","title":"AMLB: an AutoML Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12560","snapshot_observed_at":"2026-08-06T18:36:47.491670Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.491670Z"},"links":{"cited_paper":"/paper/2207.12560","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:472db7abf3d80881e18629c9a0bef2cc4e02df80ba5db59fb36479853925459c","observation_id":"fd806105-fa00-42c0-8498-182df74f00b6","resolution":{"observed_at":"2026-08-06T18:36:47.491670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:48.566662Z","title":"L., Amaral, L","venue":null,"work_id":"fca4572b-c810-4c6e-bb79-a9996880eea5","year":2000},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.546239Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:d742f5b71fef1d0964b3ffe166c65ce6e05817bfd0459e68ccdd001ed6743403","observation_id":"bacee3e0-ffd2-49d5-a053-b5645203fb63","resolution":{"observed_at":"2026-08-06T18:36:48.572115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09634","last_updated":"2023-12-15T09:23:56Z","snapshot_observed_at":"2026-07-06T17:02:33.830269Z","submitted_at":"2023-12-15T09:23:56Z","title":"Vectorizing string entries for data processing on tables: when are larger language models better?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09634","snapshot_observed_at":"2026-08-06T18:36:47.624023Z","title":"J., and Varoquaux, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.624023Z"},"links":{"cited_paper":"/paper/2312.09634","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:23692945016ee9b9890cf51a64627a30258653949e87b8ac08ec0a7e14789fe5","observation_id":"397e6b2c-c2bc-48c7-9a81-fad9763d348b","resolution":{"observed_at":"2026-08-06T18:36:47.624023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10723","last_updated":"2023-03-17T16:36:53Z","snapshot_observed_at":"2026-08-09T05:32:21.756555Z","submitted_at":"2022-10-19T17:08:13Z","title":"TabLLM: Few-shot Classification of Tabular Data with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10723","snapshot_observed_at":"2026-08-06T18:36:47.741196Z","title":"Tabllm: Few-shot classification of tabular data with large language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.741196Z"},"links":{"cited_paper":"/paper/2210.10723","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:9b156c39122b755d5daae0c29300319005e078e5fedc30b4d56082c3f9f36d4e","observation_id":"553da31f-b73a-417e-bc29-3f3a0fffff2d","resolution":{"observed_at":"2026-08-06T18:36:47.741196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00655","last_updated":"2023-12-15T17:10:35Z","snapshot_observed_at":"2026-07-06T16:55:41.420301Z","submitted_at":"2023-12-01T15:30:43Z","title":"Machine Learning for Health symposium 2023 -- Findings track","version":3},"cited_work":{"arxiv_id":"2312.00655","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.00655","snapshot_observed_at":"2026-08-06T18:36:48.335964Z","title":"Machine Learning for Health symposium 2023 -- Findings track","venue":"cs.LG","work_id":"86a32318-a32c-4840-b9f8-accfe9804ac6","year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.771782Z"},"links":{"cited_paper":"/paper/2312.00655","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:6c9f5cfd994d421b1a300edf3bd623c2add4aea7af251966923d99aa34580a99","observation_id":"2a0e2f26-28a3-4db7-99dd-1e2047a4d95b","resolution":{"observed_at":"2026-08-06T18:36:48.343264Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.776363Z","title":"u ller, S., Purucker, L., Krishnakumar, A., K \\","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.776363Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:aeb3d655775e3e408daf0f108ef629666b87dfc07522811d18a620ec689416a4","observation_id":"3d999283-7563-4363-a603-ddc2a8712cc4","resolution":{"observed_at":"2026-08-06T18:36:47.776363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16785","last_updated":"2024-05-31T15:03:11Z","snapshot_observed_at":"2026-07-06T17:35:41.168780Z","submitted_at":"2024-02-26T18:00:29Z","title":"CARTE: Pretraining and Transfer for Tabular Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16785","snapshot_observed_at":"2026-08-06T18:36:47.781086Z","title":"J., Grinsztajn, L., and Varoquaux, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.781086Z"},"links":{"cited_paper":"/paper/2402.16785","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:33bc9ededd92dc2aebc5366cc6d9a2e6d41fcc23aff6094615a98daea5844be1","observation_id":"2f229c0d-7b38-45e0-871a-c7df06729364","resolution":{"observed_at":"2026-08-06T18:36:47.781086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11596","last_updated":"2025-02-17T09:28:51Z","snapshot_observed_at":"2026-08-10T06:20:24.412183Z","submitted_at":"2025-02-17T09:28:51Z","title":"LLM Embeddings for Deep Learning on Tabular Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11596","snapshot_observed_at":"2026-08-06T18:36:47.785860Z","title":"Llm embeddings for deep learning on tabular data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.785860Z"},"links":{"cited_paper":"/paper/2502.11596","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:170635699522dc803288b0fcbb7ed2eef2ad679ad82cbe3aa4dbf24e09d11249","observation_id":"4cfe51fd-5639-4fb0-b60c-704ef2f0020a","resolution":{"observed_at":"2026-08-06T18:36:47.785860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04057","last_updated":"2024-07-04T16:57:14Z","snapshot_observed_at":"2026-08-06T10:04:51.925193Z","submitted_at":"2024-07-04T16:57:14Z","title":"TALENT: A Tabular Analytics and Learning Toolbox","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04057","snapshot_observed_at":"2026-08-06T18:36:47.790726Z","title":"Talent: A tabular analytics and learning toolbox","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.790726Z"},"links":{"cited_paper":"/paper/2407.04057","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:d8cf582ba90a9796960a468c8286e040aab464d89c3c65b6d2edea947cce1ab1","observation_id":"f2b6bb55-8deb-414c-8e46-6085c0fd301d","resolution":{"observed_at":"2026-08-06T18:36:47.790726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.796759Z","title":"Mug: A multimodal classification benchmark on game data with tabular, textual, and visual fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.796759Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:871cede61f88ed6069fd29d0d2728fe545871e8e004c482484f8604c5466def0","observation_id":"d212f918-239c-42a2-a6cb-30ab6f33bb59","resolution":{"observed_at":"2026-08-06T18:36:47.796759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.801181Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.801181Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:85b9fafe2b17bc2908038e19310b592d0bd625e69fba8fcd1b1f4f6037c549e7","observation_id":"0e193bd7-f170-4e32-afac-bd6d0fee7595","resolution":{"observed_at":"2026-08-06T18:36:47.801181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.805612Z","title":"C., Golestan, K., Yu, G., Volkovs, M., and Caterini, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.805612Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:08e5bd24707d90e831935defc26f0bf4dcd0e2289461e7bd24b7d7b521bb3748","observation_id":"dd1bc50d-5e66-4035-9d14-95163b290aee","resolution":{"observed_at":"2026-08-06T18:36:47.805612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.923586Z","title":"and Ratajczak, W","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.923586Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:e2d58b1c7baaf05645c29f691a63e81ace3cd85f7a2d63477e5fe8b6f528fc80","observation_id":"de99a1bf-5ee9-4548-b326-cb14bf0be713","resolution":{"observed_at":"2026-08-06T18:36:47.923586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:48.538176Z","title":null,"venue":null,"work_id":"b7d568dc-6846-44a9-9108-b984b2e3e456","year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.928885Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:2f04907f08013ee6e18fc456230fc9353c9ed8e8a4268290a11915a154bbcab1","observation_id":"b77ceb41-ea15-4e30-a9a0-62a0e3e34b3d","resolution":{"observed_at":"2026-08-06T18:36:48.542595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02997","last_updated":"2024-07-15T19:00:47Z","snapshot_observed_at":"2026-07-06T15:23:21.708631Z","submitted_at":"2023-05-04T17:04:41Z","title":"When Do Neural Nets Outperform Boosted Trees on Tabular Data?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02997","snapshot_observed_at":"2026-08-06T18:36:47.933777Z","title":"P., Feuer, B., Hegde, C., Ramakrishnan, G., Goldblum, M., and White, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.933777Z"},"links":{"cited_paper":"/paper/2305.02997","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:169c33bddc99b46f933181a15c7bf259d6c63adac2c3c01c04376f794ba7b5ba","observation_id":"3c40f97a-7d09-4260-87f3-95a17bc30202","resolution":{"observed_at":"2026-08-06T18:36:47.933777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02705","last_updated":"2021-11-04T09:29:16Z","snapshot_observed_at":"2026-08-05T03:09:36.676057Z","submitted_at":"2021-11-04T09:29:16Z","title":"Benchmarking Multimodal AutoML for Tabular Data with Text Fields","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02705","snapshot_observed_at":"2026-08-06T18:36:47.938962Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.938962Z"},"links":{"cited_paper":"/paper/2111.02705","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:86abbe5ba2c74514740892f79f485145a1e5a7d81089bd347e2b9a38722eb837","observation_id":"20f4a16d-b51d-445d-b8e4-85069cf05237","resolution":{"observed_at":"2026-08-06T18:36:47.938962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11877","last_updated":"2025-02-17T15:03:54Z","snapshot_observed_at":"2026-08-07T18:12:12.106664Z","submitted_at":"2025-02-17T15:03:54Z","title":"JoLT: Joint Probabilistic Predictions on Tabular Data Using LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11877","snapshot_observed_at":"2026-08-06T18:36:47.943525Z","title":"A., Gonzalez, J., Duvenaud, D., and Turner, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.943525Z"},"links":{"cited_paper":"/paper/2502.11877","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:f58ebfb801f15f532cb2732c5ebaf7f75d66392033ccb718571db3c6c70b4b8b","observation_id":"68150fff-f389-4666-be6f-8c868c976331","resolution":{"observed_at":"2026-08-06T18:36:47.943525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16233","last_updated":"2024-04-30T21:09:27Z","snapshot_observed_at":"2026-08-09T12:08:52.225929Z","submitted_at":"2024-04-24T22:28:12Z","title":"AutoGluon-Multimodal (AutoMM): Supercharging Multimodal AutoML with Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16233","snapshot_observed_at":"2026-08-06T18:36:47.948093Z","title":"Autogluon-multimodal (automm): Supercharging multimodal automl with foundation models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.948093Z"},"links":{"cited_paper":"/paper/2404.16233","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:fc9b31e441425f947ce4897e02312688e357d6673be3c624c35a9bdafa7c4a66","observation_id":"b7cd1408-79a6-4cfc-98cf-5c62396afbdd","resolution":{"observed_at":"2026-08-06T18:36:47.948093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10957","last_updated":"2020-04-06T02:53:18Z","snapshot_observed_at":"2026-08-10T12:28:10.970434Z","submitted_at":"2020-02-25T15:21:10Z","title":"MiniLM: Deep Self-Attention Distillation for Task-Agnostic Compression of Pre-Trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10957","snapshot_observed_at":"2026-08-06T18:36:47.952726Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.952726Z"},"links":{"cited_paper":"/paper/2002.10957","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:140551237e0102a6d61bdd5b937e28b268907b677fad8b8ca0c6dab9f9619f14","observation_id":"39807671-9e31-42b6-b726-dd81eba8cd87","resolution":{"observed_at":"2026-08-06T18:36:47.952726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19318","last_updated":"2025-02-17T13:45:00Z","snapshot_observed_at":"2026-07-06T17:52:30.328601Z","submitted_at":"2024-03-28T11:21:12Z","title":"TableLLM: Enabling Tabular Data Manipulation by LLMs in Real Office Usage Scenarios","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19318","snapshot_observed_at":"2026-08-06T18:36:47.958225Z","title":"Tablellm: Enabling tabular data manipulation by llms in real office usage scenarios, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.958225Z"},"links":{"cited_paper":"/paper/2403.19318","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:6b2ecb6043a6aad2f2d709d352b0892b063d6006afbda7574e9c55c63d3d9a25","observation_id":"df858277-3b94-4495-b64a-1bbc205d457e","resolution":{"observed_at":"2026-08-06T18:36:47.958225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T05:32:07.496844Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 3 inbound Pith citation observations for arXiv:2507.07829."}