{"as_of":"2026-08-09T21:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:151b160fe006f8d8ddf243f2a3b6f9e79673762df1824e0a2fa1454335826e81","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T18:39:41.316604Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T15:41:51.078898Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T15:44:48.313235Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"cited_work":{"arxiv_id":"2603.07841","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.07841","snapshot_observed_at":"2026-07-28T02:22:28.563646Z","title":null,"venue":null,"work_id":"f69073c2-4d76-4fa6-a836-1fe1db0f9827","year":2026},"citing_paper":{"arxiv_id":"2605.23595","last_updated":"2026-06-06T04:29:28Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:05:34Z","title":"Learning to Evaluate: Cost-Effective Model Evaluation on Unlabeled Data with Meta-Learning","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T15:41:51.078898Z"},"links":{"cited_paper":"/paper/2603.07841","citing_paper":"/paper/2605.23595"},"observation_digest":"sha256:bbfe56cc3bf6bc506d84a691210b0c44bd1e71d3ccd92b4e02e6956c726a61d5","observation_id":"0ea25dba-179d-4405-a524-fadfde9fb543","resolution":{"observed_at":"2026-07-28T02:22:28.563646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.07841/citation-record","integrity":"/paper/2603.07841/integrity","json":"/paper/2603.07841/citation-record.json","paper":"/paper/2603.07841"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:32.772734Z","title":"The dawn of natural language to sql: Are we fully ready?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:32.772734Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:69eb2e9ab71de5216a4824a52a116b801e11e724eb05c00511a97190ddfe2acf","observation_id":"07c09ce4-982b-4bef-a060-fc8b724cc2a4","resolution":{"observed_at":"2026-08-02T18:39:32.772734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00103","last_updated":"2017-11-09T23:06:14Z","snapshot_observed_at":"2026-08-03T05:45:09.122112Z","submitted_at":"2017-08-31T23:12:15Z","title":"Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00103","snapshot_observed_at":"2026-08-02T18:39:32.867967Z","title":"Seq2sql: Generating structured queries from natural language using reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:32.867967Z"},"links":{"cited_paper":"/paper/1709.00103","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:ebe864372979090eb3daf36996856e12b776dfacff05b6b3a1b970498bc2fcdd","observation_id":"1202f5a5-b513-4441-a755-f4b735421548","resolution":{"observed_at":"2026-08-02T18:39:32.867967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.04436","last_updated":"2017-11-13T06:41:29Z","snapshot_observed_at":"2026-07-06T06:09:05.613678Z","submitted_at":"2017-11-13T06:41:29Z","title":"SQLNet: Generating Structured Queries From Natural Language Without Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.04436","snapshot_observed_at":"2026-08-02T18:39:32.944351Z","title":"Sqlnet: Generating structured queries from natural language without reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:32.944351Z"},"links":{"cited_paper":"/paper/1711.04436","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:3e8939cb8cb55af28849ca2a1dc4ee472a749835b3e41acb654e7a7eef6bbd1c","observation_id":"5868c4c3-be93-41ea-8a32-1a41a3d0fc21","resolution":{"observed_at":"2026-08-02T18:39:32.944351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:32.998864Z","title":"TypeSQL: Knowledge- based type-aware neural text-to-SQL generation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:32.998864Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b0c84f78b10c1421cd082b7d389de8afc3ff0c6789e13546f1ba29be884e0490","observation_id":"053f0928-804c-4789-afdd-86f19977e093","resolution":{"observed_at":"2026-08-02T18:39:32.998864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.050050Z","title":"SyntaxSQLNet: Syntax tree networks for complex and cross-domain text-to-SQL task,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.050050Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b173f75002a48940cc93165a6abc8416b6b04e9ac13c48457e4a198f09713894","observation_id":"6a3ed6f2-cf9a-4681-9b5a-3ca9455762b1","resolution":{"observed_at":"2026-08-02T18:39:33.050050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.098760Z","title":"Editing-based SQL query generation for cross-domain context-dependent questions,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.098760Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:7b193116427c43cb34768211ecab77704aed87ef57ccf21dcbb3784fa55706d2","observation_id":"603d7bf0-b8c3-4215-82c9-c72515a00750","resolution":{"observed_at":"2026-08-02T18:39:33.098760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.160243Z","title":"To- wards complex text-to-SQL in cross-domain database with intermediate representation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.160243Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:7b742f29228cb50640051655f50865910c9bfed55568c02e28997200fb7ee250","observation_id":"a8c5afc0-577b-472f-be76-1583aaddac24","resolution":{"observed_at":"2026-08-02T18:39:33.160243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.217219Z","title":"RAT-SQL: Relation-aware schema encoding and linking for text-to-SQL parsers,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.217219Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:737807fa5d941b85a1a83c3136a2d94d877f08f3f16c7d587e862c1d5253fa92","observation_id":"63d33d8a-c4ce-4c8f-b355-408dfb6fa8c0","resolution":{"observed_at":"2026-08-02T18:39:33.217219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.294166Z","title":"Bridging textual and tabular data for cross-domain text-to-SQL semantic parsing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.294166Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:d0a6902ad62ce260e29247a41b86c31744dbb0ffae73783791ca164ce600ac79","observation_id":"5483ae2d-d2b0-48f9-a847-fba1c26e7770","resolution":{"observed_at":"2026-08-02T18:39:33.294166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.374273Z","title":"SmBoP: Semi-autoregressive bottom-up se- mantic parsing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.374273Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:68e9dbd6aac2f8e7194927789f42865b45b7cda9e230ef646b921457664481a4","observation_id":"e67b3f0d-9987-47c1-a053-2d15ffc4a1ed","resolution":{"observed_at":"2026-08-02T18:39:33.374273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.456786Z","title":"LGESQL: Line graph enhanced text-to-SQL model with mixed local and non-local relations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.456786Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:10432ba4bdb881848517a4ccde44d5bb7c461f948e226ae81b7f921ecdddeef6","observation_id":"6c6eecc1-1442-4979-9b45-8fc1f2b605c6","resolution":{"observed_at":"2026-08-02T18:39:33.456786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.523021Z","title":"Gra{pp}a: Grammar-augmented pre-training for table semantic parsing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.523021Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:e94b36555d1c55a81af99ca9371511ba4def86b1ba28bc44c66d54573aca4436","observation_id":"6e64e266-c7ae-488e-a5ad-67ef8b772684","resolution":{"observed_at":"2026-08-02T18:39:33.523021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.651687Z","title":"PICARD: Parsing in- crementally for constrained auto-regressive decoding from language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.651687Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:ef6d82ecc412c9e9688c1cd614fe2ed062d6d5fd113c80e60d43138bbb3cfada","observation_id":"bc6acdb3-3436-4304-b581-5eb6263cbacc","resolution":{"observed_at":"2026-08-02T18:39:33.651687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.710665Z","title":"DIN-SQL: Decomposed in-context learning of text-to-SQL with self-correction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.710665Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:c060e755a2bac992011fdbd769113c1500b51542689bca89531a9554451ab299","observation_id":"fa427ed9-e335-4ba0-8296-596c755c7911","resolution":{"observed_at":"2026-08-02T18:39:33.710665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:33.823343Z","title":"Text- to-sql empowered by large language models: A benchmark evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.823343Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:751e9521c8cf76e420d3908e926557ee6518c8da53f4c172a358f180214b8439","observation_id":"cb156028-2860-48d3-953a-beace5097580","resolution":{"observed_at":"2026-08-02T18:39:33.823343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16755","last_updated":"2024-11-25T19:43:07Z","snapshot_observed_at":"2026-08-02T16:46:24.597803Z","submitted_at":"2024-05-27T01:54:16Z","title":"CHESS: Contextual Harnessing for Efficient SQL Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16755","snapshot_observed_at":"2026-08-02T18:39:33.980750Z","title":"Chess: Contextual harnessing for efficient sql synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:33.980750Z"},"links":{"cited_paper":"/paper/2405.16755","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:4eaecefe414d48d725434639bc98cb5b3019007bde959ea93d6d8e4d608b4ddc","observation_id":"33605d56-34c6-43cd-84a7-722623f526fc","resolution":{"observed_at":"2026-08-02T18:39:33.980750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:34.206703Z","title":"How to answer secure and private SQL queries?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:34.206703Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:947dd961a27bb2b4853874b03896a119bf5b7f4a65b1b1528f946f2fdafc41a6","observation_id":"3be4cde5-3af2-4071-bbdc-8c5abf2fa770","resolution":{"observed_at":"2026-08-02T18:39:34.206703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:34.377665Z","title":"Lampat: Low-rank adaption for multilingual paraphrasing using adversarial training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:34.377665Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:e257d9b01300973411c9962c61133d4e22922611d98e1d5b47053762b27dcc6e","observation_id":"0c961342-6ffc-43c2-a003-773978bf40c3","resolution":{"observed_at":"2026-08-02T18:39:34.377665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:34.573043Z","title":"UniBridge: A unified approach to cross- lingual transfer learning for low-resource languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:34.573043Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:6858fb5d8b57327efe3d27913bad2c521ed44811b2e17ab7f2549fbbac77c2d6","observation_id":"174c535a-b878-43a1-9f29-bd1510addd95","resolution":{"observed_at":"2026-08-02T18:39:34.573043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:34.794936Z","title":"Resdsql: Decoupling schema linking and skeleton parsing for text-to-sql,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:34.794936Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b05292f363d24203ba3de7ff8ace0b108aa2014274240f744383117f16fe2ef8","observation_id":"bbb7d609-e10b-4877-9baf-585e8e99cb3b","resolution":{"observed_at":"2026-08-02T18:39:34.794936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:34.990884Z","title":"CHASE-SQL: Multi-path reasoning and preference optimized candidate selection in text-to-SQL,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:34.990884Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:30807ac14d8257bf9de8f07bf3dd0613974060357602fd34c2eb5bf57108cbc9","observation_id":"c7ddca6f-2705-4779-92d9-6f98f52a4be5","resolution":{"observed_at":"2026-08-02T18:39:34.990884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.157669Z","title":"Csc-sql: Corrective self-consistency in text-to- sql via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.157669Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:d7a6591ea23987b321e792714471f1b1424e756fd1716bf434c94c3e2efa75b0","observation_id":"eb796730-4322-4aad-abb3-de06b9921841","resolution":{"observed_at":"2026-08-02T18:39:35.157669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.279769Z","title":"Alpha- SQL: Zero-shot text-to-SQL using monte carlo tree search,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.279769Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:9c9e929aadb8f535dcfdbb6cc4bf4fb88e087621a177e4932aea99e104771518","observation_id":"b747c33f-c27d-494a-bfbe-9a6a1ac39cde","resolution":{"observed_at":"2026-08-02T18:39:35.279769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.456560Z","title":"Grounding natural language to SQL translation with data-based self-explanations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.456560Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:aa1414f608f32fbd1fe1e781824ee439f4436e42457c78dc7973ffecca824f80","observation_id":"26f9f3c9-47b2-41bd-83fc-a96ab2849cb9","resolution":{"observed_at":"2026-08-02T18:39:35.456560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.514386Z","title":"Machine learning inference pipeline execution using pure SQL based on operator fusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.514386Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b7339b4dc580e723639afd85a48477150e75f86b8d726de0d135866063168839","observation_id":"54f25c97-e497-4180-b84a-32e10eda3419","resolution":{"observed_at":"2026-08-02T18:39:35.514386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.559081Z","title":"AID-SQL: adaptive in-context learning of text-to-sql with difficulty-aware instruction and retrieval-augmented generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.559081Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:7c60170aa71a35d3cb28551ca43c37577972b570b13f2d9919aedb558b04d03f","observation_id":"31c1b549-2555-4703-b109-0040f18527e9","resolution":{"observed_at":"2026-08-02T18:39:35.559081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05002","last_updated":"2026-07-16T09:43:14Z","snapshot_observed_at":"2026-08-05T23:40:57.401096Z","submitted_at":"2025-08-07T03:33:59Z","title":"AgenticData: An Agentic Data Analytics System for Heterogeneous Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05002","snapshot_observed_at":"2026-08-02T18:39:35.581469Z","title":"Agenticdata: An agentic data analytics system for heterogeneous data,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.581469Z"},"links":{"cited_paper":"/paper/2508.05002","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:f5741b6ee6f199d844de1c135346a49ea30ea08fe5b46d41aa4aeae2259386b8","observation_id":"67524ef4-8b66-41d1-84ca-7194472ad2cc","resolution":{"observed_at":"2026-08-02T18:39:35.581469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.633695Z","title":"RefoRCE: A text-to-SQL agent with self-refinement, format restriction, and column exploration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.633695Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:d282dbe79af055bdbd969ef57b9383705cc00810a0df7e6eb2b959f59c3ee442","observation_id":"e2f9b57f-24c7-4909-a810-69c1b2f139aa","resolution":{"observed_at":"2026-08-02T18:39:35.633695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.676004Z","title":"Omnisql: Synthesizing high-quality text-to-sql data at scale,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.676004Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:125c1a309868d0db4e9eb79e7a1aaecc76af4321e7297fd7f80cfc9e5460379d","observation_id":"121774b4-3f79-4479-89a3-f5f26cef49e7","resolution":{"observed_at":"2026-08-02T18:39:35.676004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.712320Z","title":"Multilingual text-to-sql: Benchmarking the limits of language models with collaborative language agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.712320Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:010f6c33906b42c97261f14fc05fd31a0a008c67ddbe6c98121512c36771582a","observation_id":"1352d12a-e360-4bb3-a6eb-aec384ef2a3a","resolution":{"observed_at":"2026-08-02T18:39:35.712320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.750068Z","title":"Jacobsson","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.750068Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:cb6aac2f43513adcf5305978409e67fd23012a5d6825856c6ff7631c36768aef","observation_id":"b4a0172f-67e7-4559-8a45-b19469c740c5","resolution":{"observed_at":"2026-08-02T18:39:35.750068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:35.942932Z","title":"Spider: A large-scale human-labeled dataset for complex and cross-domain semantic parsing and text-to-SQL task,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:35.942932Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:eebe5e2c42b8d6fd73eb579c97cc63cd5376b5e33581d1be76f661ce496f3c93","observation_id":"defd7372-2655-4e1d-a045-10838ce77d52","resolution":{"observed_at":"2026-08-02T18:39:35.942932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.034626Z","title":"Sparc: Cross-domain semantic parsing in context,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.034626Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:4297c3126671ed2955a5f560fd8ccd208298d263bbc112a899b20a7a2bbdbe7a","observation_id":"56d2c5a2-cff8-4bef-92ef-976d4ddb288a","resolution":{"observed_at":"2026-08-02T18:39:36.034626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.150832Z","title":"Cosql: A conversational text- to-sql challenge towards cross-domain natural language interfaces to databases,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.150832Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:7072e708e2c5536718a0f79cdba3ccb253d864d7b4eecbcd5c477d95184d445b","observation_id":"c346af49-7ab6-41ae-a6cd-138a4f66d945","resolution":{"observed_at":"2026-08-02T18:39:36.150832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.251162Z","title":"Can llm already serve as a database interface? a big bench for large-scale database grounded text-to-sqls,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.251162Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:0f4b7f4f75f2a669e340bed9d65ba397c481d366296e01ce7c34977d347b6923","observation_id":"57507061-049e-4f4e-a349-fb1d2965d2b5","resolution":{"observed_at":"2026-08-02T18:39:36.251162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.394214Z","title":"Spider 2.0: Evaluating language models on real-world enterprise text-to-SQL workflows,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.394214Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:69d68e739a1e98795a75e0613d2113050968441dd4a62ec5479eb2912f744124","observation_id":"21cd6d72-90d3-4283-be8c-57e1e4a4e407","resolution":{"observed_at":"2026-08-02T18:39:36.394214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.515693Z","title":"Estimating large language model capabilities without labeled test data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.515693Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:54cfee187798f86cd550d17e0e9d120a2f79cee9c86ca01679b5963b54bc9d5e","observation_id":"86ef3cd9-2a91-4573-bcef-c3b50c424c36","resolution":{"observed_at":"2026-08-02T18:39:36.515693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.627540Z","title":"SelfCheckGPT: Zero-resource black-box hallucination detection for generative large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.627540Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:f7ac6882e74ffef33a1faf403300f5eb664639c6a086ab5ba738c9a3028d915c","observation_id":"29e1475a-ee9e-433c-a47d-abcb34e28861","resolution":{"observed_at":"2026-08-02T18:39:36.627540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.764186Z","title":"Detecting hallucinations in large language models using semantic entropy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.764186Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:4ef802aabe70f759996d1a26c596f1592ec58ddc3b51afcc1f32b5343c7e8b5b","observation_id":"21fe3fb7-7e63-419c-9f5a-faf40d2e45cf","resolution":{"observed_at":"2026-08-02T18:39:36.764186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.841370Z","title":"Autoeval done right: Using synthetic data for model evaluation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.841370Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:e3c60ae35a285d6b28150765a24e5dfed262fbde9aead348efd57c3485fe99f8","observation_id":"88eaec25-07a0-4c4f-bd39-50cc85d7f8f2","resolution":{"observed_at":"2026-08-02T18:39:36.841370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:36.974271Z","title":"Prediction-powered inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:36.974271Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:e8ae90a7e07034551d75742249f15bf6f197359d1b0385d7bfb482f1d1fcdd57","observation_id":"7ed38252-97df-4c6e-88e4-fc3d69d03288","resolution":{"observed_at":"2026-08-02T18:39:36.974271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:37.134328Z","title":"Leveraging unlabeled data to predict out-of-distribution performance,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:37.134328Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:27710c77ae860b414089208a661ddf27904e4a783dbc180ecb6f42e450d5ed31","observation_id":"eedf78a3-1d9a-46ff-927c-1f5617f21569","resolution":{"observed_at":"2026-08-02T18:39:37.134328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:37.298968Z","title":"Predicting with confidence on unseen distributions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:37.298968Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b47be46aea1589fcd05759edf5df6986564249f619927665347b232787d2f478","observation_id":"51a253a6-f856-4dd0-9500-d3c3d80af3fc","resolution":{"observed_at":"2026-08-02T18:39:37.298968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:37.464847Z","title":"Nl2sql-bugs: A benchmark for detecting semantic errors in nl2sql translation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:37.464847Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b4c87e4e12e602c5060675feb518510456623184c62f3153fe787742e31bc3d8","observation_id":"c4c13444-028a-4b66-ac6d-9dd182b92cf0","resolution":{"observed_at":"2026-08-02T18:39:37.464847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:37.578381Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:37.578381Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:39c5f0ce99b27eebcae4fcc1fbcc20ea73f051eee0928e378ea4111609c69e45","observation_id":"3cc1b5db-bc06-4510-98af-a94614e765a3","resolution":{"observed_at":"2026-08-02T18:39:37.578381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07875","last_updated":"2023-10-11T20:34:42Z","snapshot_observed_at":"2026-08-09T04:38:54.714512Z","submitted_at":"2023-10-11T20:34:42Z","title":"TabLib: A Dataset of 627M Tables with Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07875","snapshot_observed_at":"2026-08-02T18:39:37.752511Z","title":"Tablib: A dataset of 627m tables with context,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:37.752511Z"},"links":{"cited_paper":"/paper/2310.07875","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:414d618236b1fd34384bc4a384de5eb3f5d51485174fb560f88db01c4166cfc6","observation_id":"d2514b1a-2d95-4555-bbb1-334724510e0d","resolution":{"observed_at":"2026-08-02T18:39:37.752511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:37.866666Z","title":"KaggleDBQA: Realistic evaluation of text-to-SQL parsers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:37.866666Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:04289ce88311cf2b79d4df98e23bc457571e93f6fb8071e279e22b3ffa174b51","observation_id":"1ae63f45-aa34-40b3-8499-48e3e4cc0dff","resolution":{"observed_at":"2026-08-02T18:39:37.866666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:38.074736Z","title":"SQLForge: Synthesizing reliable and diverse data to enhance text-to-SQL reasoning in LLMs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.074736Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:8b6c828176f45c8f71044d7ebadb3f63224f0d75322cd4dbf54e6b270a181910","observation_id":"f368c44a-56e0-4681-af13-233cbc86859a","resolution":{"observed_at":"2026-08-02T18:39:38.074736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:38.197809Z","title":"Parsql: Enhancing text-to-sql through sql parsing and reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.197809Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:e8181da36386562200d65a4b460811c9911ef5577b9549aaab5771dbb52fda7d","observation_id":"5e44003d-2fc6-4ada-80da-af2393913983","resolution":{"observed_at":"2026-08-02T18:39:38.197809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:38.265359Z","title":"Llm-based data synthesis and distillation for high-quality text-to-sql training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.265359Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:bcc024069c15db90b788f65d085dadfed32775f7c7d54f4440364c3304536d26","observation_id":"e3d32f0a-1096-46af-bd20-229b998d3fb6","resolution":{"observed_at":"2026-08-02T18:39:38.265359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:38.389062Z","title":"On efficient multilevel clustering via wasserstein distances,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.389062Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:c5b422ca524d4af6bb6207b7624f66b2728acbe88e773fb5c1c9ed46a7aafdfc","observation_id":"edb8f102-cb51-4a0e-a707-fdf10814e889","resolution":{"observed_at":"2026-08-02T18:39:38.389062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:38.500617Z","title":"Probabilistic multilevel clustering via composite transportation distance","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.500617Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:d3ebe44a190ab84efb836b3194c1184cd4d05d7ddfdd89d3fbf0c4f048e8c50e","observation_id":"a40b8eae-a486-4fa1-87e9-68715e6489b5","resolution":{"observed_at":"2026-08-02T18:39:38.500617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:38.628808Z","title":"Multilevel clustering via Wasserstein means,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.628808Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:240d03638e890fda375e4e481ad9f28c132b59ed3e5e7369a5629ed7817ba770","observation_id":"ca32dfa6-9f6c-4137-a3a7-19a6a5003156","resolution":{"observed_at":"2026-08-02T18:39:38.628808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02999","last_updated":"2018-10-22T16:11:14Z","snapshot_observed_at":"2026-08-05T12:53:31.632675Z","submitted_at":"2018-03-08T08:29:38Z","title":"On First-Order Meta-Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.02999","snapshot_observed_at":"2026-08-02T18:39:38.741630Z","title":"On first-order meta-learning algorithms,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.741630Z"},"links":{"cited_paper":"/paper/1803.02999","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:dc17795a0b9efb4ff8bf491ace6778e86579d8481f89da1e046caf57827a3bf1","observation_id":"be4814e1-2d51-4d2e-bb90-42456b69fcf6","resolution":{"observed_at":"2026-08-02T18:39:38.741630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:38.866263Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:38.866263Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:ff510ddd7c2f452ed1997f27e2bb378b92b435e77bec522ca71ec9dc9c96dafe","observation_id":"8b97b553-fb54-4c32-99f7-df8ff924d86c","resolution":{"observed_at":"2026-08-02T18:39:38.866263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:39.041515Z","title":"Sciencebenchmark: A complex real-world bench- mark for evaluating natural language to sql systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:39.041515Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:4d04e148a61e054feb85d442be3f8847bdf95f0d512e0a6b308e63650e284109","observation_id":"c7970e95-45bc-4d88-9193-2d11e28351c6","resolution":{"observed_at":"2026-08-02T18:39:39.041515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:39.212724Z","title":"Ehrsql: A practical text-to-sql benchmark for electronic health records,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:39.212724Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:549edabe48363674766c9a433c5b57554393164f4b8839f4d02f62d750335298","observation_id":"dd7e1ca1-746a-40e7-9706-067f814ff1f0","resolution":{"observed_at":"2026-08-02T18:39:39.212724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:39.351031Z","title":"Gnnevaluator: Evaluating gnn performance on unseen graphs without labels,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:39.351031Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:be14bed1f561fa2849cd67c2b82dec05064678754824f7abdfd7968c38551d97","observation_id":"2f4076ad-b182-4b36-9aec-fabba04ff503","resolution":{"observed_at":"2026-08-02T18:39:39.351031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T18:39:39.486993Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:39.486993Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b5751aafd282e464b88262c28d82f7814a86ff4ecca00b60c44a8f3e7e98d59f","observation_id":"e7e41c0b-c141-4d9b-8ba1-f7d0dd35c866","resolution":{"observed_at":"2026-08-02T18:39:39.486993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T18:39:39.629407Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:39.629407Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:4af1eb0a5e5eb23f05ef0b269a9041124898357fbb1feeb41ca54f5857c80b67","observation_id":"c4b2a521-22dd-41e9-acbb-5c789ccf1fdf","resolution":{"observed_at":"2026-08-02T18:39:39.629407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-02T18:39:39.779694Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:39.779694Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:ee40e2042e6f74f4cf7f3cdfb3dc45b66d0f478b7418c1e6c11d2f3a4d208c7a","observation_id":"9cd006b4-5232-4fdf-8309-b19ca0c5761c","resolution":{"observed_at":"2026-08-02T18:39:39.779694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04701","last_updated":"2026-04-06T11:21:35Z","snapshot_observed_at":"2026-08-03T23:10:23.802142Z","submitted_at":"2025-07-07T06:50:46Z","title":"XiYan-SQL: A Novel Multi-Generator Framework For Text-to-SQL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04701","snapshot_observed_at":"2026-08-02T18:39:39.910501Z","title":"Xiyan-sql: A novel multi-generator framework for text- to-sql,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:39.910501Z"},"links":{"cited_paper":"/paper/2507.04701","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:183217118c0faab36162cac71fa676453e0a002b1a18d1123ba28210b2e6d75a","observation_id":"c7ec1c35-9416-417b-b4f0-8e3989709c86","resolution":{"observed_at":"2026-08-02T18:39:39.910501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-02T18:39:40.015940Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.015940Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:26cf008eac23283c77923a82f1899e13c3eb5c8130d400bfa22fba13001ba0b4","observation_id":"080feb71-0879-4012-8ea0-e2554a78c33c","resolution":{"observed_at":"2026-08-02T18:39:40.015940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-02T18:39:40.135720Z","title":"Starcoder 2 and the stack v2: The next generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.135720Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:506beb975b59ca3098fa6a3504aa5d76c402bd17abaa4f69a70a03b20cc302a0","observation_id":"e38cf667-42c9-4733-b827-d74440dfdf21","resolution":{"observed_at":"2026-08-02T18:39:40.135720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-02T18:39:40.301809Z","title":"Code llama: Open foundation models for code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.301809Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:ea75d45152e74fbecbb3605edff5aecef2f2a3ad2172f5f7fdaf9f5ee11f4daa","observation_id":"bae73236-909d-4514-9723-c1ac006363fe","resolution":{"observed_at":"2026-08-02T18:39:40.301809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-02T18:39:40.396982Z","title":"Phi- 4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.396982Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b4654b456a42abfd9e69ff895729ce457d49169fbd059e70211985c3f699d590","observation_id":"3dc6bec4-1961-4b05-a68c-95ab1a27c922","resolution":{"observed_at":"2026-08-02T18:39:40.396982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-02T18:39:40.460834Z","title":"Yi: Open foundation models by 01. ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.460834Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:725b2a36fc2ef7433bd4e4f6d959e81d31dc1c7108f5473eef28ce21611df159","observation_id":"ec65b310-3481-4cda-9105-86f82b30e10e","resolution":{"observed_at":"2026-08-02T18:39:40.460834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-02T18:39:40.550882Z","title":"Gemma: Open models based on gemini research and technology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.550882Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:4d8856e50c31228d54cec75edae58f0e655b3b906e61a0beeec3fe230ed745af","observation_id":"d8a5dafb-ffb8-4204-8603-683f5278236a","resolution":{"observed_at":"2026-08-02T18:39:40.550882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-02T18:39:40.626602Z","title":"Internlm2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.626602Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:b482ae90120a49d4238407ab71cfa3a41485b4c5839acb5fbd90197493b0731e","observation_id":"8a1ffac9-03c3-4bcb-a9ef-a128db973ed6","resolution":{"observed_at":"2026-08-02T18:39:40.626602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:40.743753Z","title":"Athena: An ontology-driven system for natural language querying over relational data stores,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.743753Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:0c85a70aac71a48ee21103a1e62f4e6954fe52ba6717e886fdd204b5666fa75a","observation_id":"d8badaba-c093-444d-9291-198d138c5417","resolution":{"observed_at":"2026-08-02T18:39:40.743753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:40.829518Z","title":"Athena++: Natural language querying for complex nested SQL queries,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.829518Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:92803fa81845405c2b21d6765eb438cf7b98715d479f169c70fdac8c414b5a24","observation_id":"918ba1f7-c3c9-4242-85c7-3578a0f9d692","resolution":{"observed_at":"2026-08-02T18:39:40.829518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:40.986312Z","title":"Sqlizer: Query synthesis from natural language,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:40.986312Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:e55e6f0064f4ee4e3143f630284b4db4014c701c53b2f5b41ece7437a3ebc93d","observation_id":"8818f91e-d9f4-4ce9-a2a7-2dc1db62b9b0","resolution":{"observed_at":"2026-08-02T18:39:40.986312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:41.181757Z","title":"Don’t judge a language model by its last layer: Contrastive learning with layer-wise attention pooling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:41.181757Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:d649f71a29042dd3cbbdbcd09e3de1eee79bedce4aa8fec860774fe207df30c3","observation_id":"bc813c4b-c735-4c9f-8ec4-b0729db6adcb","resolution":{"observed_at":"2026-08-02T18:39:41.181757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:41.250363Z","title":"SimCSE: Simple contrastive learning of sentence embeddings,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:41.250363Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:305120935b24d262b93539b2f7f3d54272df4e8c512577fffec8dc906583e69c","observation_id":"ad370d68-563f-4864-8248-cc0de690fa17","resolution":{"observed_at":"2026-08-02T18:39:41.250363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:39:41.316604Z","title":"PromptBERT: Improving BERT sentence embeddings with prompts,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T18:39:41.316604Z"},"links":{"citing_paper":"/paper/2603.07841"},"observation_digest":"sha256:61d11e73cc77f36def76240ff40f1aecfdc22a35a4e1c207fc27a0a38023a82e","observation_id":"70f0140f-6c74-49d6-b7df-ab574caa9630","resolution":{"observed_at":"2026-08-02T18:39:41.316604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.07841","last_updated":"2026-07-26T07:51:27Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T00:17:49.852559Z","submitted_at":"2026-03-08T23:14:18Z","title":"An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2603.07841."}