{"as_of":"2026-08-17T01:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b56de155cd485e46a74f5f776c163891d3ed789fbb419ad516f994120d1892bd","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:50:18.897807Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06926/citation-record","integrity":"/paper/2506.06926/integrity","json":"/paper/2506.06926/citation-record.json","paper":"/paper/2506.06926"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.234261Z","title":"Tabnet: Attentive interpretable tabular learning","venue":null,"work_id":"3d944245-052c-4449-a55e-710c13e7d313","year":2021},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.756483Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:7324cc89af7c3e1011751b1147fd9ef2de938b85904a701e90dcc4c0f03cdd85","observation_id":"7f75b3d3-7802-4555-ae60-590359047d20","resolution":{"observed_at":"2026-08-07T05:50:19.237918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.225912Z","title":"Task clustering and gating for bayesian multitask learning","venue":null,"work_id":"93da74d5-43d6-487b-a18c-c23bdad490df","year":2003},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.760185Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:07e1878e85ab30712f42d2159d64578004fdb2c03c8dd3e47495a5c1e10e4361","observation_id":"d6759820-e339-4320-bd3b-df640947fc44","resolution":{"observed_at":"2026-08-07T05:50:19.229491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.216731Z","title":"Applying natural language processing and hierarchical machine learning approaches to text difficulty classification","venue":null,"work_id":"f1260f39-62b5-4d68-a19d-34d319b8224b","year":2020},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.763745Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:cc3fd01b348fecfa2e47887a7f4c3aa20c0d534fae15a426a2e66e14fb6b897a","observation_id":"4d3320d8-fafc-485c-8af5-5154ef2c1ce6","resolution":{"observed_at":"2026-08-07T05:50:19.220520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.767845Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.767845Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:7d7d17cbdd2c6e63979b533414f4e576f1ece91c6f86855974f95b44fec8e19a","observation_id":"4ac66474-4e89-493d-982c-0089eb14b2d8","resolution":{"observed_at":"2026-08-07T05:50:18.767845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.2447","last_updated":"2012-10-19T15:03:51Z","snapshot_observed_at":"2026-08-16T17:03:14.551396Z","submitted_at":"2012-10-19T15:03:51Z","title":"Bayesian Hierarchical Mixtures of Experts","version":1},"cited_work":{"arxiv_id":"1212.2447","doi":null,"metadata_source":"pith","pith_arxiv_id":"1212.2447","snapshot_observed_at":"2026-08-07T05:50:19.032738Z","title":"Bayesian Hierarchical Mixtures of Experts","venue":"cs.LG","work_id":"4de6c87f-6c18-48de-8678-3c1d58eff6c5","year":2012},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.771065Z"},"links":{"cited_paper":"/paper/1212.2447","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:6e0994e8de2b3b29792745c6f2033644690ebd3362cb5e2d93dcdbb2f168ee1f","observation_id":"c831ace1-c5f2-479f-a7c4-4c91ff61e3a2","resolution":{"observed_at":"2026-08-07T05:50:19.035813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.205557Z","title":"Revisiting multimodal transformers for tabular data with text fields","venue":null,"work_id":"ce6d7de0-323d-4881-b6ed-f6bcd72b6c09","year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.775100Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:5be5144b17830ea55aa1821324a93812141cc8535574bc8cb6e5f52221dde6b2","observation_id":"2b3bee5d-3955-4a61-bbcf-176ebbdb3312","resolution":{"observed_at":"2026-08-07T05:50:19.208481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.777936Z","title":"Deep neural networks and tabular data: A survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.777936Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:b58465df87d1d26fce5886206f12c87599b7925a89855a8e3b60854f0b1e4539","observation_id":"cbe81b6b-866f-4611-bf8e-d9bcb675f5a6","resolution":{"observed_at":"2026-08-07T05:50:18.777936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.194011Z","title":"A comprehensive review on data preprocessing techniques in data analysis","venue":null,"work_id":"9630e6bf-ebe4-44fa-b0d7-ecc152de6730","year":2022},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.780509Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:4af364556a5e7cb0860a74dd165ce92d58deb9dd940316db297f7f3bc2859c19","observation_id":"8b19ce41-df85-4f44-8068-6c1c1277ec47","resolution":{"observed_at":"2026-08-07T05:50:19.196857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.782886Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.782886Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:db5fa78c324a0bfb947acb6c74a7c2605a7e45d0c1d53decc690b15ea534f39c","observation_id":"34bc99ba-4dd5-4ab7-9c8a-af99740f837d","resolution":{"observed_at":"2026-08-07T05:50:18.782886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.785542Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.785542Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:bf00256511268f611a867e7d0a50d0d6886ffd6adc4dc564491fca08667bcc75","observation_id":"6b98f1c0-54a4-433f-a264-ff056db75e85","resolution":{"observed_at":"2026-08-07T05:50:18.785542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0907.0783","last_updated":"2009-07-04T18:35:52Z","snapshot_observed_at":"2026-08-15T05:44:25.452248Z","submitted_at":"2009-07-04T18:35:52Z","title":"Bayesian Multitask Learning with Latent Hierarchies","version":1},"cited_work":{"arxiv_id":"0907.0783","doi":null,"metadata_source":"pith","pith_arxiv_id":"0907.0783","snapshot_observed_at":"2026-08-07T05:50:19.021763Z","title":"Bayesian Multitask Learning with Latent Hierarchies","venue":"cs.LG","work_id":"4be91597-2fc9-43f1-9e1e-5e6a8eee9811","year":2009},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.788317Z"},"links":{"cited_paper":"/paper/0907.0783","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:fefd7f34b25f52ea5e34b3d1a51d8dc40192219f0133c66c1d7fdb80ac07e7d8","observation_id":"60fbd060-ce22-40ea-b4ae-371f76c15814","resolution":{"observed_at":"2026-08-07T05:50:19.024531Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T05:50:18.791657Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.791657Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:e124abf76a49b5bd5de3135e3a138b0f9c0e8f9ad2497152f7c5937aeac1b05d","observation_id":"26b26f4c-b9cb-41e1-8c1c-9b03d0ba945b","resolution":{"observed_at":"2026-08-07T05:50:18.791657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03208","last_updated":"2023-04-06T16:43:16Z","snapshot_observed_at":"2026-08-16T15:42:13.397788Z","submitted_at":"2023-04-06T16:43:16Z","title":"Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03208","snapshot_observed_at":"2026-08-07T05:50:18.794719Z","title":"Cerebras-gpt: Open compute-optimal language models trained on the cerebras wafer-scale cluster","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.794719Z"},"links":{"cited_paper":"/paper/2304.03208","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:d20adc2545f5321b904c3d4aa606c8f7c526b13dfd7d95c5b5c033eee08c3b91","observation_id":"7b19a67a-b969-4e9b-bd05-f3e374efaaa7","resolution":{"observed_at":"2026-08-07T05:50:18.794719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13857","last_updated":"2025-06-21T09:18:16Z","snapshot_observed_at":"2026-08-16T13:08:17.334759Z","submitted_at":"2024-10-17T17:59:35Z","title":"How Numerical Precision Affects Arithmetical Reasoning Capabilities of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13857","snapshot_observed_at":"2026-08-07T05:50:18.797479Z","title":"How numerical precision affects mathematical reasoning capabilities of llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.797479Z"},"links":{"cited_paper":"/paper/2410.13857","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:09e91af640a0d50ba2be99302c798866ab8a93eb61da2f738b355fb6cbb071a3","observation_id":"51b3ca11-b280-4285-be86-b4c122573aaf","resolution":{"observed_at":"2026-08-07T05:50:18.797479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.176663Z","title":"Openml-ctr23–a curated tabular regression benchmarking suite","venue":null,"work_id":"89ceb756-bbb0-4906-ba65-af8e92312a34","year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.800849Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:48685b09910638710d0a16b0e0b95fffc43375f9fb9a835d2f33371b04ff502c","observation_id":"457bb6fd-331c-410b-8f98-d8f84794f077","resolution":{"observed_at":"2026-08-07T05:50:19.180150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08806","last_updated":"2024-10-02T06:22:48Z","snapshot_observed_at":"2026-08-16T13:18:48.660919Z","submitted_at":"2024-09-13T13:14:54Z","title":"TabKANet: Tabular Data Modeling with Kolmogorov-Arnold Network and Transformer","version":2},"cited_work":{"arxiv_id":"2409.08806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.08806","snapshot_observed_at":"2026-08-07T05:50:18.989934Z","title":"TabKANet: Tabular Data Modeling with Kolmogorov-Arnold Network and Transformer","venue":"cs.LG","work_id":"4748e9d6-6c49-4e27-a7bd-255fa63302de","year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.804109Z"},"links":{"cited_paper":"/paper/2409.08806","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:51b3f134ec3153c542299d12b5747fb9f263ba38d1c91fc59e0ce3cc4c9bd74b","observation_id":"c914291c-6b5d-4338-bf8a-b556f118e4c3","resolution":{"observed_at":"2026-08-07T05:50:18.994892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12031","last_updated":"2024-11-20T21:20:08Z","snapshot_observed_at":"2026-08-16T13:42:05.553563Z","submitted_at":"2024-06-17T18:58:20Z","title":"Large Scale Transfer Learning for Tabular Data via Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12031","snapshot_observed_at":"2026-08-07T05:50:18.808518Z","title":"Large scale transfer learning for tabular data via language modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.808518Z"},"links":{"cited_paper":"/paper/2406.12031","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:d2362237042474d72f9aa9b7d17795aa470c38fc5ee3f08f5e2ef800d7fc8a26","observation_id":"b954d388-e421-4442-94ac-36bd8407dbe4","resolution":{"observed_at":"2026-08-07T05:50:18.808518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.168968Z","title":"What every computer scientist should know about floating-point arithmetic","venue":null,"work_id":"505eccff-ead7-467e-bc62-0ae954fb1668","year":1991},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.812224Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:6877aa1367f6d394e42b5aff70b848cab2f977065afeb50d53b57adee7cb4edf","observation_id":"3b79f7a0-78fe-4933-bb39-d8da236612b9","resolution":{"observed_at":"2026-08-07T05:50:19.171697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.161011Z","title":"Revisiting deep learning models for tabular data","venue":null,"work_id":"2f7d7f6b-fb9e-4863-8918-b0d48393f4e1","year":2021},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.815589Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:b6a6a2fbe79bc5eb57f2c080314f1fecfdeaeb9e94d461673143262829329e3d","observation_id":"a119ae0f-82e4-4761-91d0-6e20a9bbb62b","resolution":{"observed_at":"2026-08-07T05:50:19.164558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:50:18.818387Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.818387Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:8f1826ed0d0a7382ff39842ba273c7acc3e684af76125d641e9957eec4493eee","observation_id":"d28e05d7-973c-4eab-ac54-aa77c6784b5d","resolution":{"observed_at":"2026-08-07T05:50:18.818387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.151645Z","title":"On typical range, sensitivity, and normalization of mean squared error and nash-sutcliffe efficiency type metrics","venue":null,"work_id":"fc2b6ec1-c72a-4ac9-96cb-1c3272b442b7","year":2011},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.821217Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:d6e0537fedfe1e03bea7095343b891f8edcacddf582d169e53a22900deebd91c","observation_id":"80dbb32e-52dc-4db6-859e-267cc46457c7","resolution":{"observed_at":"2026-08-07T05:50:19.155556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.144617Z","title":"The coefficient of determination exposed","venue":null,"work_id":"d1266cfe-b31a-4e4c-991f-1c6d2fd67c91","year":1973},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.824068Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:48111e5148196f6b4c87cf07c219a14c8b965fa3af8a6659537b80076496fffa","observation_id":"8f592924-04d8-4e60-99dc-824fecd963c2","resolution":{"observed_at":"2026-08-07T05:50:19.147224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.826344Z","title":"Tabllm: Few-shot classification of tabular data with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.826344Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:a744f23bf19fb0f8e9d64dde19a075613562a52c7cee15f95efc62984ef811c8","observation_id":"d5882811-d113-4e70-9e2d-124fd905648f","resolution":{"observed_at":"2026-08-07T05:50:18.826344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.132290Z","title":"Tabpfn: A transformer that solves small tabular classification problems in a second","venue":null,"work_id":"fe75e0ee-16e4-4250-854e-964497410e1a","year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.828736Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:f095d5cff40fa7a23526e06625995c96f05563ee06d301f611ff1a51fbf293fa","observation_id":"116aa3f1-113a-465d-b29b-14ba0c128bd7","resolution":{"observed_at":"2026-08-07T05:50:19.135204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06678","last_updated":"2020-12-11T23:31:23Z","snapshot_observed_at":"2026-08-14T12:45:55.154777Z","submitted_at":"2020-12-11T23:31:23Z","title":"TabTransformer: Tabular Data Modeling Using Contextual Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.06678","snapshot_observed_at":"2026-08-07T05:50:18.831722Z","title":"Tabtransformer: Tabular data modeling using contextual embeddings","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.831722Z"},"links":{"cited_paper":"/paper/2012.06678","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:12a9049eee93f5053343f2756fe370af4ce9a21d00e14d4fb07495c548c1293c","observation_id":"79853408-5823-43b0-ae2b-497335cced11","resolution":{"observed_at":"2026-08-07T05:50:18.831722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.125043Z","title":"Carte: pretraining and transfer for tabular learning","venue":null,"work_id":"d0e23f1c-fdfb-41af-8da8-58c631dd84b9","year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.834960Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:dc90b3efe8960eb451d413432335d40fa027a1d7740ddd5343d83da79aeee89b","observation_id":"fbd35fbf-840d-45eb-94d5-4ac0608194dd","resolution":{"observed_at":"2026-08-07T05:50:19.127828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15533","last_updated":"2022-11-20T18:15:30Z","snapshot_observed_at":"2026-08-16T16:14:44.169279Z","submitted_at":"2022-11-20T18:15:30Z","title":"The Stack: 3 TB of permissively licensed source code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15533","snapshot_observed_at":"2026-08-07T05:50:18.837929Z","title":"The stack: 3 tb of permissively licensed source code","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.837929Z"},"links":{"cited_paper":"/paper/2211.15533","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:4dbafd39c391c4f926e10ebd52b3dae4a80fb14c7f77a112b502c881426c3b7c","observation_id":"a15b52ed-d8e0-4e35-980a-32c8a74221fc","resolution":{"observed_at":"2026-08-07T05:50:18.837929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.115891Z","title":"A comprehen- sive analysis of deep regression.IEEE transactions on pattern analysis and machine intelligence, 42(9):2065–2081, 2019","venue":null,"work_id":"435d76e3-169b-44ff-9a84-826cc5acef66","year":2019},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.841075Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:5e751e3dc249acc29905088a914d71d625c899a90fbc5ebffae996bd0b67c60c","observation_id":"e44819ae-5970-4724-a42c-ac7684d227ae","resolution":{"observed_at":"2026-08-07T05:50:19.118688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.843626Z","title":"Set transformer: A framework for attention-based permutation-invariant neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.843626Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:130c419ba2c43d66819c53368735a53e5f52526331166af612e0b30e3c1cefb0","observation_id":"585d7bca-070c-4433-8e90-ad11d238eefd","resolution":{"observed_at":"2026-08-07T05:50:18.843626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.104102Z","title":"Bart: Denoising sequence-to-sequence pre- training for natural language generation, translation, and comprehension","venue":null,"work_id":"9f2ef248-f24d-45dd-bcda-a68101e3e3ee","year":2020},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.846455Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:89d9e91d012104f8ddede69780edfaccd84c3dc8a054a59d4aa5065de7067bcf","observation_id":"f5aca38f-2696-4e16-86c6-174b7e01bf88","resolution":{"observed_at":"2026-08-07T05:50:19.107028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06375","last_updated":"2025-05-05T09:20:58Z","snapshot_observed_at":"2026-08-16T15:55:45.024034Z","submitted_at":"2023-02-13T14:08:40Z","title":"One Transformer for All Time Series: Representing and Training with Time-Dependent Heterogeneous Tabular Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06375","snapshot_observed_at":"2026-08-07T05:50:18.849241Z","title":"One transformer for all time series: Representing and training with time-dependent heterogeneous tabular data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.849241Z"},"links":{"cited_paper":"/paper/2302.06375","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:1809c3192701f85fb807175312290e8d01d201b3a97cdb21beaa580d792c12c2","observation_id":"97a6a168-f96a-41a4-9757-8fa28cd57283","resolution":{"observed_at":"2026-08-07T05:50:18.849241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.094294Z","title":"A bounded version of the nash-sutcliffe criterion for better model assessment on large sets of basins","venue":null,"work_id":"290b63da-b571-47f6-a885-fe49e84b9eaa","year":2006},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.852785Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:b4c9672c8009ab05adbb3be35a187bcf872fb47ba3fe84aa0e7d631517993733","observation_id":"90a11b4b-602f-473e-be14-af5c4e78084c","resolution":{"observed_at":"2026-08-07T05:50:19.097990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.086960Z","title":"A survey of sensor fusion methods in wearable robotics","venue":null,"work_id":"598914e2-3696-497b-9950-72c6c13fb518","year":2015},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.855937Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:d661b2e3acc9f4c5fc7e06194ed058bcf6bc5135f4faba98926ac5c5bd98c220","observation_id":"9565d871-2027-4c08-9556-55ed35b50f52","resolution":{"observed_at":"2026-08-07T05:50:19.090093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.858333Z","title":"Tabular transformers for modeling multivariate time series","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.858333Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:d72035cd79a2edab789f36b47a836bd7a391cad1af7dc1683844e86811b4ce8e","observation_id":"b519f37f-6cb1-4bd2-a891-d20416c36a95","resolution":{"observed_at":"2026-08-07T05:50:18.858333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06312","last_updated":"2019-09-19T13:30:23Z","snapshot_observed_at":"2026-08-13T16:00:28.614744Z","submitted_at":"2019-09-13T16:11:28Z","title":"Neural Oblivious Decision Ensembles for Deep Learning on Tabular Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06312","snapshot_observed_at":"2026-08-07T05:50:18.861243Z","title":"Neural oblivious decision ensembles for deep learning on tabular data","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.861243Z"},"links":{"cited_paper":"/paper/1909.06312","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:75e867f85bdc958f01f9c88967c1d15afb5fb02f10458e0f43cf79791b46d512","observation_id":"e266b9b7-a82d-45ec-8a1c-80eefc7e6f4c","resolution":{"observed_at":"2026-08-07T05:50:18.861243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.075522Z","title":"The statistical measurement of agreement","venue":null,"work_id":"614726a6-26dd-4b24-a311-e8d79a7eaca2","year":1957},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.864304Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:0db011d669e5ead283c4e1a3eea856819320cdebd39c40bab352c8744a40c154","observation_id":"76a0ecf0-0053-4d43-9e36-6452af9bc13f","resolution":{"observed_at":"2026-08-07T05:50:19.078737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.067314Z","title":"Saint: Improved neural networks for tabular data via row attention and contrastive pre-training","venue":null,"work_id":"1d2f66d1-e29d-424c-abc3-d00ac39e8e42","year":2022},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.866654Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:ebbd45229ed55f07740f33d7209c94a2079d0149877c57cfa9f78b2279d41eaa","observation_id":"ae30319f-e2aa-4f29-bd0d-e4bff9964b0e","resolution":{"observed_at":"2026-08-07T05:50:19.070931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.060083Z","title":"Multi-task bayesian optimization","venue":null,"work_id":"b8c3bc89-4e2f-41be-a75d-2b5283e5fef2","year":2013},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.869125Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:8290870e0e6aca6e420ae589a3117ec7b948176f6403a2b152ff25c8779b066d","observation_id":"63dece68-caf3-43cb-8b7e-d6ccff5f6fb1","resolution":{"observed_at":"2026-08-07T05:50:19.062841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08962","last_updated":"2019-09-25T22:55:20Z","snapshot_observed_at":"2026-08-14T21:38:13.014467Z","submitted_at":"2019-08-23T18:02:05Z","title":"Well-Read Students Learn Better: On the Importance of Pre-training Compact Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08962","snapshot_observed_at":"2026-08-07T05:50:18.871863Z","title":"Well-read students learn better: On the importance of pre-training compact models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.871863Z"},"links":{"cited_paper":"/paper/1908.08962","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:84ac2d538eb41e7d96170bfb6388037b998a8e3bc5f23cea04e98c4e862d5dd4","observation_id":"45c3ebdf-44e2-4bb3-8b52-ab475807b07d","resolution":{"observed_at":"2026-08-07T05:50:18.871863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01147","last_updated":"2024-06-02T14:50:49Z","snapshot_observed_at":"2026-08-16T13:56:02.141569Z","submitted_at":"2024-05-02T10:05:16Z","title":"Why Tabular Foundation Models Should Be a Research Priority","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01147","snapshot_observed_at":"2026-08-07T05:50:18.875236Z","title":"Why tabular foundation models should be a research priority","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.875236Z"},"links":{"cited_paper":"/paper/2405.01147","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:7465553195d59310c1dda09f655800e32703b6b7781b8ac7f36aa3967bee4752","observation_id":"291a9551-a4cc-4ddd-9e91-5fdb68027ec1","resolution":{"observed_at":"2026-08-07T05:50:18.875236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:18.877933Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.877933Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:cf5453fb9eae484638fb3182b3becb194cad053bfa902784dc914a4717b50824","observation_id":"a372c969-0b0c-44de-982f-8c69129f7098","resolution":{"observed_at":"2026-08-07T05:50:18.877933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03266","last_updated":"2024-01-16T20:15:18Z","snapshot_observed_at":"2026-08-17T01:11:39.737505Z","submitted_at":"2023-10-05T02:37:09Z","title":"UniPredict: Large Language Models are Universal Tabular Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03266","snapshot_observed_at":"2026-08-07T05:50:18.880993Z","title":"Unipredict: Large language models are universal tabular classifiers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.880993Z"},"links":{"cited_paper":"/paper/2310.03266","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:f0ac4837a2642475ff70ba1918b80922d58c90d7a61e1270def46668bb0b1160","observation_id":"e03b4885-eb5b-4950-b22b-5d05354b0024","resolution":{"observed_at":"2026-08-07T05:50:18.880993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.048253Z","title":"Multi-task reinforcement learning: a hierarchical bayesian approach","venue":null,"work_id":"1cd7c8f8-79b3-4d8a-8d75-fbc4a1d7059c","year":2007},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.883791Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:6b4a4cb3c08930c273192876a930ad14aae41408ed1871d11e4b43c41b3d35d0","observation_id":"7e038fde-84bc-423e-a7e7-10199cc0dd7f","resolution":{"observed_at":"2026-08-07T05:50:19.051804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-07T05:50:18.886505Z","title":"Huggingface’s transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.886505Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:e86bdc82d9f0d71371aa1e233cf56cb94581ac23ac5508c983f9c3844cf580a0","observation_id":"faac0600-a9e4-4156-b45d-881ba3a37134","resolution":{"observed_at":"2026-08-07T05:50:18.886505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14402","last_updated":"2024-01-29T02:58:23Z","snapshot_observed_at":"2026-08-16T15:37:10.033412Z","submitted_at":"2023-04-27T17:58:49Z","title":"LaMini-LM: A Diverse Herd of Distilled Models from Large-Scale Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14402","snapshot_observed_at":"2026-08-07T05:50:18.889313Z","title":"Lamini-lm: A diverse herd of distilled models from large-scale instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.889313Z"},"links":{"cited_paper":"/paper/2304.14402","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:360c123e27d8a544fea1665e19b3688cd7d5d68a50c9c9b1b361d9f071faa22e","observation_id":"e9d2cba1-a216-46d9-a2fd-a686e0d738a0","resolution":{"observed_at":"2026-08-07T05:50:18.889313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:19.040667Z","title":"On layer normalization in the transformer architecture","venue":null,"work_id":"d59897ed-cd3b-414b-8e53-a1109dc36d49","year":2020},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.892410Z"},"links":{"citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:65ea8866fb2c98ab552e049918a6a516299774cbba8f00ac3a5a61af20e9a4b2","observation_id":"32907dcb-d867-4348-a5cd-0853b88c5486","resolution":{"observed_at":"2026-08-07T05:50:19.043510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T05:50:18.894775Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.894775Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:dad152ad0bfd27a3b89e02c3f7080138123f04c205e6c2ba35d323131fbb2d9f","observation_id":"cef2ec7e-cbdf-46a1-b90d-11c842925633","resolution":{"observed_at":"2026-08-07T05:50:18.894775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-07T05:50:18.897807Z","title":"Tinyllama: An open-source small language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:18.897807Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2506.06926"},"observation_digest":"sha256:c3e4e3c007cc5d8b71478f600fe915df59758fd37964d2733507368045d36d5c","observation_id":"5cbe5483-540a-4405-bae5-0c9a6eeeb744","resolution":{"observed_at":"2026-08-07T05:50:18.897807Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06926","last_updated":"2025-06-07T21:29:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T09:20:10.538583Z","submitted_at":"2025-06-07T21:29:25Z","title":"Basis Transformers for Multi-Task Tabular Regression"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":3,"verified_fuzzy":21},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2506.06926."}