{"as_of":"2026-08-17T19:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6960fab8a4cca1ecac9ffffe119f56167ad55077fe0ab8bf934b0a64d0135ec1","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:23:06.727778Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T13:45:07.339338Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:50:11.133540Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2605.19662","last_updated":"2026-06-06T14:55:14Z","snapshot_observed_at":"2026-08-17T11:49:43.006373Z","submitted_at":"2026-05-19T10:55:35Z","title":"When Tabular Foundation Models Meet Strategic Tabular Data: A Prior Alignment Approach","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-20T05:42:00.584949Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2605.19662"},"observation_digest":"sha256:74f57255d5536230b02e17e2cba79f39e39c3750e2fe881305e8181f361eb0b2","observation_id":"34393b24-82ea-43c3-b4be-f9f5cc24ab05","resolution":{"observed_at":"2026-05-20T05:43:05.602844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2606.11473","last_updated":"2026-06-09T22:07:04Z","snapshot_observed_at":"2026-08-16T12:13:21.204197Z","submitted_at":"2026-06-09T22:07:04Z","title":"CRUMB: Efficient Prior Fitted Network Inference via Distributionally Matched Context Batching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T13:45:07.339338Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2606.11473"},"observation_digest":"sha256:ac51fee7f7242e3444985d84bb98b603f8e9ac1bef5f800703433c21462c7aa9","observation_id":"60aab242-93a3-43d6-857b-e35848b61a19","resolution":{"observed_at":"2026-07-03T04:37:37.352182Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2606.24995","last_updated":"2026-06-23T15:52:35Z","snapshot_observed_at":"2026-08-03T10:05:54.978464Z","submitted_at":"2026-06-23T15:52:35Z","title":"Are Tabular Foundation Models Robust to Realistic Query Distribution Shifts in Microbiome Data?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T00:20:45.845889Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2606.24995"},"observation_digest":"sha256:8de9547c80784f121aacbf07806ce0f6ae1b2d9cac83ad8d6324b409bccd13d3","observation_id":"e66aabdf-dcf3-414c-86a0-bb567e76f823","resolution":{"observed_at":"2026-07-04T16:39:57.987181Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2606.26021","last_updated":"2026-06-24T16:42:21Z","snapshot_observed_at":"2026-08-10T18:30:05.673725Z","submitted_at":"2026-06-24T16:42:21Z","title":"Privacy Vulnerabilities of Attention Layers in Tabular Foundation Models and Protection of High-Risk Queries","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:48.784638Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2606.26021"},"observation_digest":"sha256:fe1e11b56bdf6a21a8103610f690f1804dea079d349d1948862f8ce1706e6537","observation_id":"6828f47b-8727-4487-a6c9-c15f765c202a","resolution":{"observed_at":"2026-07-04T20:50:11.135822Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05584/citation-record","integrity":"/paper/2506.05584/integrity","json":"/paper/2506.05584/citation-record.json","paper":"/paper/2506.05584"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.065322Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.065322Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:23e408a91cf027a2ee72dcbfea40ea35d57eb282332043e199fbe3fc979a7207","observation_id":"b817498e-ed5b-4230-b8d1-5c9292dd378e","resolution":{"observed_at":"2026-08-07T10:23:06.065322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T10:23:06.072004Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.072004Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9ff6166260d765e71bbc95c449ab7fdac9b5e08ccf772627e4828dd0fdf5b8f1","observation_id":"93a05e08-61dd-42b9-94ca-697b20e0802e","resolution":{"observed_at":"2026-08-07T10:23:06.072004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.252708Z","title":null,"venue":null,"work_id":"1545b9e1-c6b8-405a-b160-459c88a69d1a","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.077789Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d77134681ba1d0361b8aa39e3cf892eb1d86de775775865905810ec897f3eef0","observation_id":"1e4aa804-8985-4516-892d-a5e1a8b7e3a7","resolution":{"observed_at":"2026-08-07T10:23:08.257739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08867","last_updated":"2024-06-24T19:58:06Z","snapshot_observed_at":"2026-08-16T14:26:57.916814Z","submitted_at":"2024-01-16T22:44:12Z","title":"MambaTab: A Plug-and-Play Model for Learning Tabular Data","version":2},"cited_work":{"arxiv_id":"2401.08867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.08867","snapshot_observed_at":"2026-08-07T10:23:07.187900Z","title":"MambaTab: A Plug-and-Play Model for Learning Tabular Data","venue":"cs.LG","work_id":"6bc736bc-5081-4b18-b070-38c831d1e2e4","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.082568Z"},"links":{"cited_paper":"/paper/2401.08867","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:cacb4deb977736fe71277b82cdbefe7443e116fa5ff2df91cfbfcb189827e6aa","observation_id":"f68e4c6b-1de3-43c8-a48d-70ed842240ef","resolution":{"observed_at":"2026-08-07T10:23:07.195570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.232845Z","title":"Transformers learn to implement preconditioned gradient descent for in-context learning","venue":null,"work_id":"fbf1728f-57ce-4207-88be-e86b35e46a3b","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.087619Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:bffe0ee7f830005b9d33161316f78b53c08b41a431243858590a507909e87968","observation_id":"041d3fc8-7e9e-4ea7-9497-c9723b7607dd","resolution":{"observed_at":"2026-08-07T10:23:08.238148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.210978Z","title":null,"venue":null,"work_id":"41a37326-7cde-4117-a0fd-11fed35c5a8b","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.095535Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:c208f33acac60be205ba7343144ce643192e7b5968dd84811f24087bb591a908","observation_id":"4a449f67-c86a-4573-a991-8ade9b985dda","resolution":{"observed_at":"2026-08-07T10:23:08.216689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.184068Z","title":"Loan approval prediction based on machine learning approach","venue":null,"work_id":"ed676425-df3f-4da4-a8de-1d84804bd6c3","year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.100926Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:956c414b4c4bdabeb3e3852f3a62ccad55cccf3bcaa1020bd115a3c3784cb090","observation_id":"8a0c7c64-b24e-4ee6-9274-d7260ba49a49","resolution":{"observed_at":"2026-08-07T10:23:08.190370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T10:23:06.107328Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.107328Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:91ce4dcfe0054aea24b81ef747f503c067343f6aae9e5be4eb6300bd45a89efd","observation_id":"433aeaf1-88fa-44c7-9911-48d489504671","resolution":{"observed_at":"2026-08-07T10:23:06.107328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T10:23:06.112340Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.112340Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:a8786e5a9df9962131b03e8f50e7eccc16e058177f6e4951b6cc1e888895ca2d","observation_id":"1fdd5875-b8e2-421c-833c-1ff9aa89b60f","resolution":{"observed_at":"2026-08-07T10:23:06.112340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.158743Z","title":"Transformers as statisticians: Provable in-context learning with in-context algorithm selection","venue":null,"work_id":"becf1318-8876-49be-a82e-6e34e2c8ee18","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.117080Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:f573ab6d90b13a22daab9035a3f4e2492ca17f604f00356fe9648d6f664f7fb2","observation_id":"1a2cb109-d55e-4a1e-b53b-1775439a0057","resolution":{"observed_at":"2026-08-07T10:23:08.165284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T10:23:06.122150Z","title":"E., and Cohan, A","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.122150Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:5441805c34b195755fdbf30fba616553241b79a13469ebadc42de14713eb7f80","observation_id":"ab51883f-04e6-499a-831c-4be4e517617a","resolution":{"observed_at":"2026-08-07T10:23:06.122150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.03731","last_updated":"2021-11-22T13:58:04Z","snapshot_observed_at":"2026-08-15T16:15:34.381928Z","submitted_at":"2017-08-11T23:28:48Z","title":"OpenML Benchmarking Suites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.03731","snapshot_observed_at":"2026-08-07T10:23:06.127733Z","title":"G., van Rijn, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.127733Z"},"links":{"cited_paper":"/paper/1708.03731","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2e6dce3c07ec832a593c4490a428b464eb15f83e6de8926449a54fd28fdf5191","observation_id":"a493816b-54b2-4d86-9808-6e3121e67d7c","resolution":{"observed_at":"2026-08-07T10:23:06.127733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.134855Z","title":"M., Gir \\'o -i Nieto, X., and Ioannidis, A","venue":null,"work_id":"f131c948-2e62-4564-9910-b6f311e4e3e3","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.133303Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:1437a7a18c114c8c48ce448f14edff5fef244c5030147318991b3b568a938c1b","observation_id":"ae5d8beb-3267-4318-b79e-c85702ca208b","resolution":{"observed_at":"2026-08-07T10:23:08.141288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.116902Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":"1db40920-43dd-4ad4-92e9-556893c5ad4e","year":1901},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.137694Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:49c971f98ab4b2ee0792d8fe21b1bd0136f2b81cc2db2668995a5c65e45bcef3","observation_id":"fcd03941-5e71-49f1-b641-f5ce6e636746","resolution":{"observed_at":"2026-08-07T10:23:08.121938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.098262Z","title":"Z., and Wu, J","venue":null,"work_id":"83fc8c37-b22f-4a2b-9978-11b06af67d03","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.142477Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:102f24b9453c67256bf68059405b800d6534c4211cc911f5972c46d387916101","observation_id":"573f1dfe-0055-476a-b5e2-e20ebb091fc4","resolution":{"observed_at":"2026-08-07T10:23:08.103775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.148357Z","title":"and Guestrin, C","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.148357Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:1f80c0aa56e375e7f805d7ce7e40355021a262d55a0aea35560fb1023b2500d5","observation_id":"aef7be51-d6fb-46d8-9600-6ce377f78233","resolution":{"observed_at":"2026-08-07T10:23:06.148357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T10:23:06.153832Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.153832Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:c3ac4afa6762b35afa2e39a510eae36757ca6002d00b05ecd70c5e98a26176dd","observation_id":"30b8fd06-a223-4ac6-9356-e0072305eadc","resolution":{"observed_at":"2026-08-07T10:23:06.153832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T10:23:06.159190Z","title":"Qwen2-audio technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.159190Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:5d9d335dc2074a5ec020e7e2db4105e3b2cad5728e6d3e4a8d15974c7424ecea","observation_id":"63bda6d5-3641-48e6-959d-ff85f01e386c","resolution":{"observed_at":"2026-08-07T10:23:06.159190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.066621Z","title":"Support-vector networks","venue":null,"work_id":"86ea5684-6e09-4fea-b6fe-387ea0151d61","year":1995},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.165037Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:01be891c30f944b45934a550eeae49079f73f1de4ad93da105ad2ef82c99d43d","observation_id":"5d724641-74ca-4238-bb5d-156e31e2e8d0","resolution":{"observed_at":"2026-08-07T10:23:08.071545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.170745Z","title":"and Hart, P","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.170745Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9768738f2c8ecfd0b4b94583a5798b60ac51d40fd128e0b31618ef39a1af404b","observation_id":"6faca99f-281f-4e34-bd49-43135fcf1318","resolution":{"observed_at":"2026-08-07T10:23:06.170745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.035167Z","title":null,"venue":null,"work_id":"373ecee4-0d07-4957-ad84-671add068f12","year":1958},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.177392Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9408b5d2dcf69c984eb1ade45a5f40134bc71993a806bd4ca4d860267680af95","observation_id":"9d6b89d4-0766-4767-9090-a8b0e8ea6410","resolution":{"observed_at":"2026-08-07T10:23:08.040098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.017677Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"edca073d-7055-4594-a131-4c136ef219c0","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.182377Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2dff8f214bedd662795903d5cb33aea6227a3a01d526c84c1e80c49a826a235e","observation_id":"8e377e70-ca0d-4d95-aee9-6aa10c4f124b","resolution":{"observed_at":"2026-08-07T10:23:08.024159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.997481Z","title":"and Gu, A","venue":null,"work_id":"03d61442-7b4a-4aac-a2c4-73b478b1cc16","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.187431Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:0170e9b54a204f5adb0d3460020eb653a153f60553cdbbd208d7e019933f2bc1","observation_id":"4c865d6d-a105-411e-a84e-e7e54ab9973e","resolution":{"observed_at":"2026-08-07T10:23:08.003932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.977303Z","title":"Y., Ermon, S., Rudra, A., and Re, C","venue":null,"work_id":"19426d54-6283-4e39-a652-2e12a2de93c6","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.193246Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:73a331b18faaed39659f60f31c0c4d05317c418ca537e2ee42284ebd2faf0850","observation_id":"2e4838aa-ce49-4277-840a-a2ffba4ce608","resolution":{"observed_at":"2026-08-07T10:23:07.982718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.957277Z","title":"CausalLM is not optimal for in-context learning","venue":null,"work_id":"fa2560da-ea87-4306-80cd-e80e4f40e94b","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.198978Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:3bf5f1112a55d358d55152e799a663815d044665acd3c1247d30867a628a1b48","observation_id":"a52cff8b-3911-47bd-b4bc-935e47a66946","resolution":{"observed_at":"2026-08-07T10:23:07.962940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.938291Z","title":"LIFT : Language-interfaced fine-tuning for non-language machine learning tasks","venue":null,"work_id":"ddcb2b73-9d4d-4789-9934-9048446fb522","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.203917Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:8b50cf1a590eabc351ab28e325b159492fa5dbe4c1b5b4ada390b87515b12cbb","observation_id":"d9efcc46-14b8-4aef-a98c-80730f00f605","resolution":{"observed_at":"2026-08-07T10:23:07.943462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T10:23:06.209784Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.209784Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:5a4d8ac7238567490556ebd44eb5d9a41f6fc2ccb676b22bd9c327c248828c6e","observation_id":"01e7eb41-3150-42b5-a12c-068602dcd713","resolution":{"observed_at":"2026-08-07T10:23:06.209784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11137","last_updated":"2024-10-21T16:48:06Z","snapshot_observed_at":"2026-08-16T14:17:49.318934Z","submitted_at":"2024-02-17T00:02:23Z","title":"TuneTables: Context Optimization for Scalable Prior-Data Fitted Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11137","snapshot_observed_at":"2026-08-07T10:23:06.215110Z","title":"T., Cherepanova, V., Hegde, C., Hutter, F., Goldblum, M., Cohen, N., and White, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.215110Z"},"links":{"cited_paper":"/paper/2402.11137","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:40b1b1ee25427ffd3541eb09d8b2c1bbafe898bf9ea318f570c29b4e294c753d","observation_id":"481dbd0d-7620-47ff-b17d-08a0e1e323ba","resolution":{"observed_at":"2026-08-07T10:23:06.215110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.04074","last_updated":"2022-10-04T12:18:34Z","snapshot_observed_at":"2026-08-15T13:54:00.581511Z","submitted_at":"2020-07-08T12:41:03Z","title":"Auto-Sklearn 2.0: Hands-free AutoML via Meta-Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.04074","snapshot_observed_at":"2026-08-07T10:23:06.221142Z","title":"Auto-sklearn 2.0: Hands-free automl via meta-learning","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.221142Z"},"links":{"cited_paper":"/paper/2007.04074","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:81a90b2af1929c106821b640f95a44aa60e7ee655a389fef390224e944d1522e","observation_id":"8693a9bf-9664-41d0-a789-7eab717df857","resolution":{"observed_at":"2026-08-07T10:23:06.221142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.920027Z","title":null,"venue":null,"work_id":"f0e8e789-5d8f-413e-b002-1ef2c806223e","year":2001},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.228132Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:aba9d6846834cbcef32bdcd94053f4922b24b665122679b0188c64af074edbd6","observation_id":"e1dbfe7f-8fe7-4618-b242-e79ff5c00e32","resolution":{"observed_at":"2026-08-07T10:23:07.926864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T10:23:06.234238Z","title":"M., Hauth, A., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.234238Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:af05858fdffade576acfa03d0528aa90aab3284e243146c55ce705119c69604c","observation_id":"e54fbd43-4e49-4442-be52-11539beb207c","resolution":{"observed_at":"2026-08-07T10:23:06.234238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19572","last_updated":"2023-10-30T14:29:41Z","snapshot_observed_at":"2026-08-16T14:47:37.779848Z","submitted_at":"2023-10-30T14:29:41Z","title":"Improving Input-label Mapping with Demonstration Replay for In-context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19572","snapshot_observed_at":"2026-08-07T10:23:06.239553Z","title":"Improving input-label mapping with demonstration replay for in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.239553Z"},"links":{"cited_paper":"/paper/2310.19572","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:89e56620e86487208f1e59c31a8e290a82052495bf3756755d14d8838197365e","observation_id":"51a8d04a-da06-4925-a6d1-77bc7f94aec8","resolution":{"observed_at":"2026-08-07T10:23:06.239553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.901247Z","title":"Revisiting deep learning models for tabular data","venue":null,"work_id":"3d7896d4-6ab6-4a80-a389-c8c0e45880e8","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.244445Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:51df2678eca7f61c0ad34c968a4b5f8dc6d4c9a6fbdd7baa0a1fde0934899760","observation_id":"4591fffa-7787-46dd-a501-9e754b3f0a60","resolution":{"observed_at":"2026-08-07T10:23:07.906082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.881368Z","title":"TabR : Tabular deep learning meets nearest neighbors","venue":null,"work_id":"3c57f30f-cd25-4de0-83b7-aea97299ff5d","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.249101Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d73e6aaa4c9911cb4edff286f8f4e60ad071713b3a12c16b228e6f30ffbcf729","observation_id":"7c66920f-8104-4eb9-9e9a-6c80e6d241d9","resolution":{"observed_at":"2026-08-07T10:23:07.888655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.860721Z","title":"Why do tree-based models still outperform deep learning on typical tabular data? Advances in neural information processing systems, 35: 0 507--520, 2022","venue":null,"work_id":"ff6c2ce4-fec6-49c4-97f9-5cecceba5cf0","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.256485Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9c59218dcf6ed981d42b806b4491cad5c50664468e5c00000187fd816bbaa8ef","observation_id":"e3a52d4d-5962-424b-981b-eccd87aa0abb","resolution":{"observed_at":"2026-08-07T10:23:07.868025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.261731Z","title":"and Dao, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.261731Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2018e3a56be8d9e4d73b956bf46dda9c3c9c0cd7cb7f57910a3f901ad4d2af47","observation_id":"9a095128-6dd6-423a-a88b-58e0c279ca7a","resolution":{"observed_at":"2026-08-07T10:23:06.261731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.818266Z","title":"K., Dao, T., Rudra, A., and Re, C","venue":null,"work_id":"c1c1fe84-3140-44bf-b510-0b03a5777666","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.268460Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:3c3a60f5bacdf4a3c4daa35ec9655a9694b376b17b0302937fed33046d1eff96","observation_id":"13ae815f-7b58-48dd-becf-8e41f09e42bf","resolution":{"observed_at":"2026-08-07T10:23:07.823972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.797433Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":"dd2545d8-36e4-4f8f-b3b5-722d2a7188ea","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.273506Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:1b77de1fb5413bcd35a9bc2791b99381ddea7f1f74f15a2b72899cb65b091a63","observation_id":"59a1cbd2-8ca7-4121-b7a6-76ebbc5d8c87","resolution":{"observed_at":"2026-08-07T10:23:07.805233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04247","last_updated":"2017-03-13T04:55:19Z","snapshot_observed_at":"2026-08-14T23:30:22.779192Z","submitted_at":"2017-03-13T04:55:19Z","title":"DeepFM: A Factorization-Machine based Neural Network for CTR Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04247","snapshot_observed_at":"2026-08-07T10:23:06.279107Z","title":"Deepfm: a factorization-machine based neural network for ctr prediction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.279107Z"},"links":{"cited_paper":"/paper/1703.04247","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:0d1fca7071f0398f25bb66f371a91de65ba5810badba874e172b4e6de91fa061","observation_id":"6e5bfa1c-ff3e-4358-9876-30ece75396a3","resolution":{"observed_at":"2026-08-07T10:23:06.279107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1101/2024.07.01.600583","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"J., Oktay, D., Lin, Z., Verkuil, R., Tran, V","venue":"bioRxiv (Cold Spring Harbor Laboratory)","work_id":"6cb45a10-06fb-4621-879a-f819ec45e0a5","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.286156Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:25edce2908a90eec98020d6571b7aa5a277fecc6e9ba14041547d624854c47d6","observation_id":"6d1d62b0-7a8b-463f-be04-b71f9b1cc222","resolution":{"observed_at":"2026-08-07T10:23:06.789446Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.291394Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.291394Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:196c8fff3149b34d073d5671748daaf41d6ae2456e18e82964ef8c6fcc8d3ea0","observation_id":"73aabe10-6bcb-4450-902d-a5942e550aab","resolution":{"observed_at":"2026-08-07T10:23:06.291394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.754039Z","title":"Tab PFN : A transformer that solves small tabular classification problems in a second","venue":null,"work_id":"71ee20ba-1184-4172-89f8-eaa377dfc06b","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.296570Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:68262d5c9d4aafc7f56c08e21d31c186bf047299fc5a5faaff56feeee8cce20f","observation_id":"3834e135-0a79-479a-ac87-6559466e6ae2","resolution":{"observed_at":"2026-08-07T10:23:07.759799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.301650Z","title":"u ller, S., Purucker, L., Krishnakumar, A., K \\","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.301650Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:82fe604bf1d4e1f28e2b2de2e504a62a1dfbe7a965d2de3c67132d580ba46f77","observation_id":"fbb51f5b-5186-4c38-b7ad-f799a42d73af","resolution":{"observed_at":"2026-08-07T10:23:06.301650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06678","last_updated":"2020-12-11T23:31:23Z","snapshot_observed_at":"2026-08-14T12:45:55.154777Z","submitted_at":"2020-12-11T23:31:23Z","title":"TabTransformer: Tabular Data Modeling Using Contextual Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.06678","snapshot_observed_at":"2026-08-07T10:23:06.307742Z","title":"Tabtransformer: Tabular data modeling using contextual embeddings","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.307742Z"},"links":{"cited_paper":"/paper/2012.06678","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:05271e54f1bc415938f4f8d3696116208375d96d1a9c9f1ad9b141b73b492456","observation_id":"3626d02e-e574-4811-9a6f-aba428c28004","resolution":{"observed_at":"2026-08-07T10:23:06.307742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.712104Z","title":"E., Pollard, T","venue":null,"work_id":"e39e9d11-672f-4bec-8600-8fef48946366","year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.313021Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:05cd86e34f18c1920255406c873a1e31dcc3892b58f3deb3a3508e6a61b16610","observation_id":"c317637a-e02f-4351-a171-ea8f38611ef2","resolution":{"observed_at":"2026-08-07T10:23:07.717638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.317742Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.317742Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:647bab92a9c2b8f75091336b18b079c5d37c7302a9606118227a65034389264b","observation_id":"71da2975-5741-445d-b1ec-594e65bfc18f","resolution":{"observed_at":"2026-08-07T10:23:06.317742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.323253Z","title":"Lightgbm: A highly efficient gradient boosting decision tree","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.323253Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:dcd5e5f8c46e477167086d2529bafd8c5a806d4ef0d3812472c63f52b1a0f010","observation_id":"23c3617f-2e99-4782-807b-bd53d01b16e9","resolution":{"observed_at":"2026-08-07T10:23:06.323253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.328834Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.328834Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:4ef0499087e62ff302e74cb037d51fc7ac18e215258e42640162c5542692f1bb","observation_id":"cad481ce-5fda-475d-85f7-fba4d6e71426","resolution":{"observed_at":"2026-08-07T10:23:06.328834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.646811Z","title":"MNIST handwritten digit database","venue":null,"work_id":"085a2057-ffee-468c-a408-daa861a9b81a","year":2010},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.333557Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:03b31586be6381eb5c2ad770fe95f10d0247d9cc0d5361a1b7d616dad0ebeb13","observation_id":"cb288fe6-622b-42b2-a4ef-d4393c09d118","resolution":{"observed_at":"2026-08-07T10:23:07.652484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.627732Z","title":"Classification and regression by randomforest","venue":null,"work_id":"6eef5bcf-f03e-4dd9-9e7f-b662f2b45e45","year":2002},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.338673Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:55d25f4218f320897077830032fb230d2d1541095a5de01953d765efdf6fd68e","observation_id":"16053309-22c6-4f14-b5b8-418e80100c11","resolution":{"observed_at":"2026-08-07T10:23:07.633523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06971","last_updated":"2024-02-10T15:23:45Z","snapshot_observed_at":"2026-08-16T14:19:40.209226Z","submitted_at":"2024-02-10T15:23:45Z","title":"In-Context Data Distillation with TabPFN","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06971","snapshot_observed_at":"2026-08-07T10:23:06.343773Z","title":"In-context data distillation with TabPFN","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.343773Z"},"links":{"cited_paper":"/paper/2402.06971","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:372f9a7b59403335834424aa9e4d16d22e858366292ae72dbb6cdabfcf57e8ec","observation_id":"b16341c9-dd12-4ad8-a4e1-5005572042db","resolution":{"observed_at":"2026-08-07T10:23:06.343773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.609471Z","title":"and Ratajczak, W","venue":null,"work_id":"15033cf0-9bcb-48f1-be9f-900eff45a3ee","year":1993},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.348860Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:6c21571d87564d38dbd1db7eb3badef67a0963acdb559b3e337a2a8749b32598","observation_id":"c5c54713-870f-46cc-9f9c-0bb1dd3a1f1f","resolution":{"observed_at":"2026-08-07T10:23:07.615090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.578692Z","title":"C., Khandagale, S., Valverde, J., C, V","venue":null,"work_id":"161e529b-ac7e-4f7b-974a-ae671c6ca5e6","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.353544Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:86eba3192b217635147d87398c3757731877cbe4a7107ac51e4ed6e6eba1efbf","observation_id":"eb6b8719-75fa-4fa9-917f-adabdc5a6e6b","resolution":{"observed_at":"2026-08-07T10:23:07.586683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.559805Z","title":"L., Gu, A., Fernando, A., Gulcehre, C., Pascanu, R., and De, S","venue":null,"work_id":"8f928f59-75be-4ee0-90aa-7d76908f10ed","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.358784Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9e53f570b1e974ffae771a1ba7f9bebfe7fa4afff3e5652b07e7221285408e60","observation_id":"3fba9fa4-bd7a-4fb7-b7d4-feb4bb05d28c","resolution":{"observed_at":"2026-08-07T10:23:07.565353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.539962Z","title":"G., Albalak, A., Arcadinho, S., Biderman, S., Cao, H., Cheng, X., Chung, M","venue":null,"work_id":"3eff027e-cf39-4a6e-a86b-4218a5c8e77d","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.363887Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9d07748e6fc74a5119f58d13dc34addf0a7c9324fb7100b576b476e601254a78","observation_id":"6da4a17e-4df7-4f17-b988-e057036203bc","resolution":{"observed_at":"2026-08-07T10:23:07.545810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06312","last_updated":"2019-09-19T13:30:23Z","snapshot_observed_at":"2026-08-13T16:00:28.614744Z","submitted_at":"2019-09-13T16:11:28Z","title":"Neural Oblivious Decision Ensembles for Deep Learning on Tabular Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06312","snapshot_observed_at":"2026-08-07T10:23:06.369435Z","title":"Neural oblivious decision ensembles for deep learning on tabular data","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.369435Z"},"links":{"cited_paper":"/paper/1909.06312","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:bf5431acdb5eeb9ee34e58bab201bb47202d087893dc7bc8e5e3fda34a87f7fd","observation_id":"75f94ff4-29fc-4434-9c04-7870b162e21d","resolution":{"observed_at":"2026-08-07T10:23:06.369435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.522850Z","title":"V., and Gulin, A","venue":null,"work_id":"028edc6c-b914-4c8d-b342-7744295557b9","year":2018},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.374629Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d30039146fd508f135268e066329f280850516c2e3b281836258736c930e8d3d","observation_id":"bf15c6c0-3e7d-412c-89d7-af7c192e0bea","resolution":{"observed_at":"2026-08-07T10:23:07.528435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.506732Z","title":"The devil in linear transformer","venue":null,"work_id":"353387ca-aa8b-4330-b84b-5dc5ccf0da11","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.379524Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2c5b36b63999060c6af87786793c28323dba324d5c64d3b8f9a01ce44d8c6f8a","observation_id":"ee9494b4-b132-41c6-9d83-3a0018722efc","resolution":{"observed_at":"2026-08-07T10:23:07.511941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.490042Z","title":null,"venue":null,"work_id":"f655cca2-66a1-48cd-8e09-5f13cf39dfc9","year":1986},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.385248Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:f10480b12da314218599e760e40d6cf44c33cf292cb4bab11e89b9e6c18920d6","observation_id":"2ce90432-6bb4-4522-854e-fa0edcc7db1c","resolution":{"observed_at":"2026-08-07T10:23:07.495025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.390203Z","title":"L., Ma, J., and Fergus, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.390203Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:ed787336b578e23e643ac74cd61c801290675391ff3639a91dfaec20a45d7e1b","observation_id":"451a2a0a-a8b2-4054-bf72-9f58786f088a","resolution":{"observed_at":"2026-08-07T10:23:06.390203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.395312Z","title":"E., Hinton, G","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.395312Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:cd37d3048805b48378694d147ae846202584d96c60e20d54a10c225c2eb3a516","observation_id":"40fdd05b-516d-4edc-a06d-332ca6f5d0a5","resolution":{"observed_at":"2026-08-07T10:23:06.395312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-08-16T11:15:38.109255Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-07T10:23:06.400087Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.400087Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:b886d1e6d2e4256e9f73c538bc450908636b310d16f080cc346c74378b802cdc","observation_id":"43b0cab2-2df8-4ae5-b648-d5c474b9be60","resolution":{"observed_at":"2026-08-07T10:23:06.400087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01342","last_updated":"2021-06-02T17:51:05Z","snapshot_observed_at":"2026-08-16T18:20:11.383711Z","submitted_at":"2021-06-02T17:51:05Z","title":"SAINT: Improved Neural Networks for Tabular Data via Row Attention and Contrastive Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01342","snapshot_observed_at":"2026-08-07T10:23:06.405863Z","title":"B., and Goldstein, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.405863Z"},"links":{"cited_paper":"/paper/2106.01342","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:c21c4a0139015e7e6de2e4fdd9b6e25a5bf5fdd74e6d9bc8c1a563319c5ce7a2","observation_id":"8258b155-2756-43ea-882c-914cdcad3fa8","resolution":{"observed_at":"2026-08-07T10:23:06.405863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-02T13:21:32.251959Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-07T10:23:06.410758Z","title":"Retentive network: A successor to transformer for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.410758Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:a153ad64d20daabd911570fd95c4d9cdd59afe72e9502a7e29cbd9f1c93ee5d6","observation_id":"abc6012f-7f4f-46b4-bcf4-74a9abdde51a","resolution":{"observed_at":"2026-08-07T10:23:06.410758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06291","last_updated":"2025-03-25T17:27:53Z","snapshot_observed_at":"2026-08-17T08:43:57.903737Z","submitted_at":"2024-08-12T16:57:57Z","title":"Mambular: A Sequential Model for Tabular Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06291","snapshot_observed_at":"2026-08-07T10:23:06.415765Z","title":"F., Kumar, M., Weisser, C., Reuter, A., S \\\"a fken, B., and Samiee, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.415765Z"},"links":{"cited_paper":"/paper/2408.06291","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:e5d1035d8982d7e1b25a5502ebdd7b79f98a27e5f14ab239510ebbb74165dd15","observation_id":"92a994ef-569a-40aa-8bfd-6d27c2e28a0c","resolution":{"observed_at":"2026-08-07T10:23:06.415765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.459532Z","title":null,"venue":null,"work_id":"08e4b4dd-0a55-4c15-b92f-083cb1594cad","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.421217Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:511b4d6ac376013bdf9d16e52ac9318a3db72d4e1dbbf15d61053a6ab0939cbd","observation_id":"112d6863-f566-4844-9f6b-ae5b7f216029","resolution":{"observed_at":"2026-08-07T10:23:07.465497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.439378Z","title":"N., Bischl, B., and Torgo, L","venue":null,"work_id":"7c6c3c3f-22a6-48c8-b324-b4bbce5df34b","year":2013},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.426182Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:dc4b0e3750daa68632266d5dccb30501a3fddc5ba83a6a037913ef26f4a008ef","observation_id":"e2affd65-1df2-4f9a-b157-cf39c9268ed7","resolution":{"observed_at":"2026-08-07T10:23:07.445740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.432802Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.432802Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:e84cbc11f8afc71ca2bb3872c773b7938dc07d5fe186bcbe058dc7ed0e125200","observation_id":"14db07af-519a-40e5-8bb5-99ce5109c05b","resolution":{"observed_at":"2026-08-07T10:23:06.432802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.410608Z","title":null,"venue":null,"work_id":"17539acf-950c-4cb3-a76d-8ba6de355402","year":2005},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.441329Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:969aff1f1d9267bb3d6295d98913935421900a3a31127b4664a6f98d714cf0ad","observation_id":"d75804d2-7baf-4656-8433-59e25f645e1f","resolution":{"observed_at":"2026-08-07T10:23:07.415238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.394408Z","title":"Eegformer: A transformer--based brain activity classification method using eeg signal","venue":null,"work_id":"885b9b56-db61-455e-a404-0bf700803cc0","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.451454Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:ca8d60dc7161a289529683a1429498e0ca254313d571b6f083107ff740c93b84","observation_id":"625d2afb-eb06-4c81-a4f5-14a1ff045cb6","resolution":{"observed_at":"2026-08-07T10:23:07.399415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.377336Z","title":"Fashion-MNIST : a novel image dataset for benchmarking machine learning algorithms","venue":null,"work_id":"088fddeb-b5bb-4a5d-bdcc-84a3cd8ffe42","year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.464061Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:96dd8109ec5442a9f31097e84ba6246daa1f377545220d8785f372553842797a","observation_id":"79e79d2e-ed20-414b-b1c9-fa718283599e","resolution":{"observed_at":"2026-08-07T10:23:07.381834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.362239Z","title":"Y.-C., Li, W., Gilani, A., Goan, H.-S., and Liu, H","venue":null,"work_id":"a572c023-4e62-4392-b0e8-fa95da6bdb3f","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.475996Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2cff913d4149e49e870cf347c39fa07a3932270902e62bd67fc88c787f060b2e","observation_id":"0f25105e-9902-4133-bb44-3535ad9565f1","resolution":{"observed_at":"2026-08-07T10:23:07.366521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.344276Z","title":"Q., Cirik, F","venue":null,"work_id":"0b9244e2-3436-472f-bb28-cd1d74676887","year":2025},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.489740Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:f7a072ab545461eb9e3a46c001a4ae6914019438a4b452edac04d6e53b2ddeac","observation_id":"c7cddad3-3e38-40ac-88fc-29525964ec0d","resolution":{"observed_at":"2026-08-07T10:23:07.349787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.325596Z","title":"Feature selection using stochastic gates","venue":null,"work_id":"a14f38c6-9b10-4d10-b55a-3381ed934bfb","year":2020},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.506911Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:25ab341233c99c219df966b357e94a68504f92b324112f025e71acd548f5688f","observation_id":"a92b5bf7-a65b-4f12-b9ca-b4fb6aa0751d","resolution":{"observed_at":"2026-08-07T10:23:07.330645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.308723Z","title":"Gated linear attention transformers with hardware-efficient training","venue":null,"work_id":"017282e1-f00f-4f8f-a1de-e50ab9d679ac","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.518832Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:49cb9b60024e3066519f93f42a3ed7ae7d289ea220464141ce0c77f6201e967c","observation_id":"73eec504-33ec-4a0b-bee6-cd1dec16467a","resolution":{"observed_at":"2026-08-07T10:23:07.313966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.293389Z","title":"Vime: Extending the success of self-and semi-supervised learning to tabular domain","venue":null,"work_id":"f52ed577-9086-4481-a21c-0e4d9b8406e7","year":2020},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.530629Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:4ccb85d11e775a379c46ef923f39dc0f6f294274b8383af80a479965694a20ba","observation_id":"8df86a36-8313-4643-bf26-2f9619731622","resolution":{"observed_at":"2026-08-07T10:23:07.297874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.277361Z","title":null,"venue":null,"work_id":"1a1dcf8e-0c00-458e-be01-4dd784b3a7a8","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.543485Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:39a155b3db332677734f513ddce1b62f2f0b273f489f3b2c0f1d452c2768855a","observation_id":"b4bd4ff5-8722-439a-b694-2d4805ecb7c0","resolution":{"observed_at":"2026-08-07T10:23:07.282228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.262248Z","title":"The hedgehog & the porcupine: Expressive linear attentions with softmax mimicry","venue":null,"work_id":"7e641ce9-dae2-401f-89d1-fefb2584c49d","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.556565Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:53a420d6c51fbe636ab56bcd8ab393760d2cf31708fb24dcc825cce83191f07f","observation_id":"4259621e-f1c1-4681-95da-02c55bf42fd3","resolution":{"observed_at":"2026-08-07T10:23:07.266971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.651633Z","title":"Deep learning based recommender system: A survey and new perspectives","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.651633Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:19fe0e6c58ff53da8d2533fae3ed2f4ec8a62b744dbe99999c665ac2d6141c54","observation_id":"851882f0-af1c-41ae-baef-e3a12d939cf7","resolution":{"observed_at":"2026-08-07T10:23:06.651633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.234870Z","title":"XTab : Cross-table pretraining for tabular transformers","venue":null,"work_id":"347d09ad-4945-471c-983f-10c532325447","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.727778Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:615254913f7990e0212ca1b3abed8a4923e7cba9b1f9adf841192872b97e1f3f","observation_id":"fad94aba-f9ae-4341-8b24-58d3251da413","resolution":{"observed_at":"2026-08-07T10:23:07.239628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T11:18:24.564102Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":2,"verified_fuzzy":37},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 4 inbound Pith citation observations for arXiv:2506.05584."}