{"as_of":"2026-08-11T21:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ce168802859d4604ebfca6a00bbfcfcac225021db311c8981e5bda37a1cac0dc","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:32:11.229466Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T21:12:50.656479Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T21:13:59.761947Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"cited_work":{"arxiv_id":"2412.17867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.17867","snapshot_observed_at":"2026-06-29T21:13:59.761947Z","title":"arXiv:2412.17867","venue":null,"work_id":"032b466d-7391-4a8d-96f4-05e6497d2672","year":2025},"citing_paper":{"arxiv_id":"2605.26394","last_updated":"2026-05-25T23:52:15Z","snapshot_observed_at":"2026-07-31T14:56:11.737752Z","submitted_at":"2026-05-25T23:52:15Z","title":"Memory Architectures for Multi-Turn Text-to-SQL: A Benchmark and Empirical Study","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T21:12:50.656479Z"},"links":{"cited_paper":"/paper/2412.17867","citing_paper":"/paper/2605.26394"},"observation_digest":"sha256:d0262ae539a3b297cd92fb1cca9b6382285c76093b6ec90790fcac581b83bfc9","observation_id":"72372bde-4f4e-4948-9db2-07daf01f285b","resolution":{"observed_at":"2026-06-29T21:13:59.763229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.17867/citation-record","integrity":"/paper/2412.17867/integrity","json":"/paper/2412.17867/citation-record.json","paper":"/paper/2412.17867"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.884025Z","title":"Interactive-t2s: Multi-turn interactions for text-to-sql with large language models,","venue":null,"work_id":"95d4e39a-0e10-47f4-a745-ced07b5aad25","year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:10.929888Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:cbecbc4a39a31279bac7563ab09337431e4ccb1eb8fc5c154f7d31dd98f85784","observation_id":"6edd36b5-49fa-4238-bf2d-d67725cef1fd","resolution":{"observed_at":"2026-08-11T10:32:11.889038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00527","last_updated":"2024-05-01T14:01:22Z","snapshot_observed_at":"2026-08-06T08:24:31.803595Z","submitted_at":"2024-05-01T14:01:22Z","title":"ChatBI: Towards Natural Language to Complex Business Intelligence SQL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00527","snapshot_observed_at":"2026-08-11T10:32:10.938089Z","title":"Chatbi: Towards natural language to complex business intelligence sql,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:10.938089Z"},"links":{"cited_paper":"/paper/2405.00527","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:9efafa4c66b0dc7c2c3c6dc47c06c840a124d5a382d39a5cb5325ca7d217ec09","observation_id":"dafff2ac-0050-4229-b6fc-964a2f5775de","resolution":{"observed_at":"2026-08-11T10:32:10.938089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.870355Z","title":"Can llm already serve as a database interface? a big bench for large-scale database grounded text-to-sqls,","venue":null,"work_id":"c8fd1ab9-aed7-4441-b290-b67701f2f52b","year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:10.942722Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:6a6d3c001a87064972c0943dfea1e7c9e058febb8a24044a02bdc51d40ddaf3a","observation_id":"be83377e-ee26-45d8-aade-31e845c1a808","resolution":{"observed_at":"2026-08-11T10:32:11.874920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.858015Z","title":"Conda: state-based data augmentation for context-dependent text-to-sql,","venue":null,"work_id":"97428e4b-b6dc-4d42-9cea-354dbd0cee6c","year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.059530Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:ed15e8e3fbb719550e65ab4bf2d186d64cac187d730bc6df30888eec1fed5e17","observation_id":"ffacd9a9-a55f-4fa9-8e6f-342dafe75358","resolution":{"observed_at":"2026-08-11T10:32:11.862398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.063229Z","title":"Chase-sql: Multi-path reasoning and preference optimized candidate selection in text-to-sql,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.063229Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:73c6bfe056055ef5606f16c4acb9ac3dfed464fbc8765df4d0fc904d9b2f805c","observation_id":"5715aa5e-5626-4614-a331-936ef78b385f","resolution":{"observed_at":"2026-08-11T10:32:11.063229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11242","last_updated":"2025-03-18T02:12:21Z","snapshot_observed_at":"2026-08-10T12:55:55.805968Z","submitted_at":"2023-12-18T14:40:20Z","title":"MAC-SQL: A Multi-Agent Collaborative Framework for Text-to-SQL","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11242","snapshot_observed_at":"2026-08-11T10:32:11.071443Z","title":"Mac-sql: A multi-agent collaborative framework for text-to-sql,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.071443Z"},"links":{"cited_paper":"/paper/2312.11242","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:0789dd721dde7ab2b0ca1a0aec2c7ceda1d61be6f9f27db6072851a2cbd00af8","observation_id":"c6006cc3-ff4c-4f62-8f63-c878bb655e4b","resolution":{"observed_at":"2026-08-11T10:32:11.071443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01943","last_updated":"2024-10-02T18:41:35Z","snapshot_observed_at":"2026-07-06T19:26:33.330434Z","submitted_at":"2024-10-02T18:41:35Z","title":"CHASE-SQL: Multi-Path Reasoning and Preference Optimized Candidate Selection in Text-to-SQL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01943","snapshot_observed_at":"2026-08-11T10:32:11.067181Z","title":"Available: https://arxiv.org/abs/2410.01943","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.067181Z"},"links":{"cited_paper":"/paper/2410.01943","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:79a19d00a4693f61ba8972c4051b6691056c7d79cadfd1e01ccd350b4ae0d9ef","observation_id":"09a48938-2603-4daf-a503-f217c564108c","resolution":{"observed_at":"2026-08-11T10:32:11.067181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05922","last_updated":"2023-09-12T02:34:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-12T02:34:06Z","title":"A Survey of Hallucination in Large Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05922","snapshot_observed_at":"2026-08-11T10:32:11.079401Z","title":"A survey of hallucination in large foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.079401Z"},"links":{"cited_paper":"/paper/2309.05922","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:ae00d4f65e79edb2e5a6aa84fa9e365a6fcb047bead89c88397a3badb1f53fa6","observation_id":"1ee88942-7752-47a9-85e7-bd849e899f61","resolution":{"observed_at":"2026-08-11T10:32:11.079401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.836243Z","title":"Know what i don’t know: Handling ambiguous and unknown questions for text-to-sql,","venue":null,"work_id":"56c844b8-a916-441f-a522-d046f48b7ce1","year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.075619Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:d19a61a717e859e8927b3f26e781e9c5d1dfec1e0a401076e074d01066830c45","observation_id":"c9ba131b-6f8f-4fe1-a311-ae2357f961e8","resolution":{"observed_at":"2026-08-11T10:32:11.840844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15879","last_updated":"2024-07-02T10:32:22Z","snapshot_observed_at":"2026-08-11T05:47:08.993595Z","submitted_at":"2024-03-23T16:12:52Z","title":"TrustSQL: Benchmarking Text-to-SQL Reliability with Penalty-Based Scoring","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15879","snapshot_observed_at":"2026-08-11T10:32:11.088269Z","title":"Trustsql: A reliability benchmark for text-to-sql models with diverse unanswerable questions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.088269Z"},"links":{"cited_paper":"/paper/2403.15879","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:23d8a53880e8c9200f8ed994b820bebfb4662469eb3f86fc0c2e5810ea290a90","observation_id":"153408e1-673a-4b8f-861f-539a3bbe89db","resolution":{"observed_at":"2026-08-11T10:32:11.088269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19073","last_updated":"2024-10-31T13:59:05Z","snapshot_observed_at":"2026-08-05T18:35:32.064339Z","submitted_at":"2024-06-27T10:43:04Z","title":"AMBROSIA: A Benchmark for Parsing Ambiguous Questions into Database Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19073","snapshot_observed_at":"2026-08-11T10:32:11.083905Z","title":"Ambrosia: A benchmark for parsing ambiguous questions into database queries,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.083905Z"},"links":{"cited_paper":"/paper/2406.19073","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:85ebe82d04ce48c9d360374fcb861a1630f298f437dffe2f2591b9f2939a2c28","observation_id":"b701b11c-6821-4ac6-8a89-c84bdcd219b7","resolution":{"observed_at":"2026-08-11T10:32:11.083905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02285","last_updated":"2019-06-05T20:05:18Z","snapshot_observed_at":"2026-08-07T02:46:35.519827Z","submitted_at":"2019-06-05T20:05:18Z","title":"SParC: Cross-Domain Semantic Parsing in Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02285","snapshot_observed_at":"2026-08-11T10:32:11.096643Z","title":"Sparc: Cross-domain semantic parsing in context,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.096643Z"},"links":{"cited_paper":"/paper/1906.02285","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:27eb794a8294bb19d299186733bf0263c71a745b13cb4271391933c8b9c8f381","observation_id":"e4b24acc-e072-4fba-af75-f6a436105fe2","resolution":{"observed_at":"2026-08-11T10:32:11.096643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13671","last_updated":"2023-12-21T08:50:41Z","snapshot_observed_at":"2026-08-02T23:39:03.302164Z","submitted_at":"2023-12-21T08:50:41Z","title":"Text2Analysis: A Benchmark of Table Question Answering with Advanced Data Analysis and Unclear Queries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13671","snapshot_observed_at":"2026-08-11T10:32:11.092666Z","title":"Text2analysis: A benchmark of table question answering with advanced data analysis and unclear queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.092666Z"},"links":{"cited_paper":"/paper/2312.13671","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:3e90133b665833455cb1a5529fd3f6efa89805e6de4cbbac664a318367d4d2cb","observation_id":"19a463f9-1b65-4da7-9903-0ba82f6d9fbe","resolution":{"observed_at":"2026-08-11T10:32:11.092666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.12634","last_updated":"2020-10-23T19:36:57Z","snapshot_observed_at":"2026-08-11T11:11:27.465703Z","submitted_at":"2020-10-23T19:36:57Z","title":"Did You Ask a Good Question? A Cross-Domain Question Intention Classification Benchmark for Text-to-SQL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.12634","snapshot_observed_at":"2026-08-11T10:32:11.104805Z","title":"Did you ask a good question? a cross-domain question intention classification benchmark for text-to-sql,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.104805Z"},"links":{"cited_paper":"/paper/2010.12634","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:0993eb1c63b8667fda5bddf23a8fe96681a6624f5dd1c5b27989643b4ea4bf19","observation_id":"65c64fcb-5c9f-4b58-9f17-8e93f0370238","resolution":{"observed_at":"2026-08-11T10:32:11.104805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.822399Z","title":"Chase: A large-scale and pragmatic chinese dataset for cross-database context-dependent text-to-sql,","venue":null,"work_id":"3e5db33a-332b-46d6-8c4d-fc773557bec2","year":2021},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.100843Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:8b4caf824864bd30f29890d1e2331deb39ee86c15e126db4ec84c26087f2d18b","observation_id":"3cd0f214-99d2-4bad-ac3a-2539f6185002","resolution":{"observed_at":"2026-08-11T10:32:11.826520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00103","last_updated":"2017-11-09T23:06:14Z","snapshot_observed_at":"2026-08-03T05:45:09.122112Z","submitted_at":"2017-08-31T23:12:15Z","title":"Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00103","snapshot_observed_at":"2026-08-11T10:32:11.112652Z","title":"Seq2sql: Generating structured queries from natural language using reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.112652Z"},"links":{"cited_paper":"/paper/1709.00103","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:57325e782d0ea2600b7ced9272f02be18c22684e8e154960c89283fa85a3a804","observation_id":"2e27203f-ec7b-4af4-a556-cb67e9847d42","resolution":{"observed_at":"2026-08-11T10:32:11.112652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10593","last_updated":"2026-07-16T08:12:30Z","snapshot_observed_at":"2026-07-19T23:18:13.566751Z","submitted_at":"2024-06-15T10:54:54Z","title":"QDA-SQL: Questions Enhanced Dialogue Augmentation for Multi-Turn Text-to-SQL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10593","snapshot_observed_at":"2026-08-11T10:32:11.108989Z","title":"Qda-sql: Questions enhanced dialogue augmentation for multi-turn text- to-sql,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.108989Z"},"links":{"cited_paper":"/paper/2406.10593","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:095021c208d4269d0a745d7678b7e558b2051e3342da576e059dd6ae2da46e48","observation_id":"5f5e7013-bf78-4f74-af5d-57673a73cda5","resolution":{"observed_at":"2026-08-11T10:32:11.108989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.810503Z","title":"CoSQL: A conversational text-to-SQL challenge towards cross-domain natural language interfaces to databases,","venue":null,"work_id":"a754654c-7f5f-486b-bd92-c4407c5bde2a","year":2019},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.119985Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:861a17442f030a8a0770e2c9b5bd71f4499311a6ae1a559a6b85902140d7bfc6","observation_id":"da21000b-4d12-4c1c-be3a-089e4aceaf2b","resolution":{"observed_at":"2026-08-11T10:32:11.814339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.08887","last_updated":"2019-02-02T23:53:18Z","snapshot_observed_at":"2026-07-06T07:03:52.901427Z","submitted_at":"2018-09-24T13:03:13Z","title":"Spider: A Large-Scale Human-Labeled Dataset for Complex and Cross-Domain Semantic Parsing and Text-to-SQL Task","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.08887","snapshot_observed_at":"2026-08-11T10:32:11.116179Z","title":"Spider: A large-scale human-labeled dataset for complex and cross-domain semantic parsing and text-to-sql task,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.116179Z"},"links":{"cited_paper":"/paper/1809.08887","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:d14dac4a478998373c2a1a3c3e6518ea0b09b438f8c4bd690683a4d8552193e2","observation_id":"fd0c3d7a-40db-4dbe-ba9b-530692741328","resolution":{"observed_at":"2026-08-11T10:32:11.116179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05093","last_updated":"2021-09-10T20:14:08Z","snapshot_observed_at":"2026-08-04T13:48:07.557990Z","submitted_at":"2021-09-10T20:14:08Z","title":"PICARD: Parsing Incrementally for Constrained Auto-Regressive Decoding from Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05093","snapshot_observed_at":"2026-08-11T10:32:11.127906Z","title":"Picard: Parsing incremen- tally for constrained auto-regressive decoding from language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.127906Z"},"links":{"cited_paper":"/paper/2109.05093","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:2bbf2fdc8c5093b6c04fdb846cc6b0d60d8dd053d6ac2e62ce0fedc53b6c6087","observation_id":"649bba4b-abb1-4552-9ffd-cf22ab08edb1","resolution":{"observed_at":"2026-08-11T10:32:11.127906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.01069","last_updated":"2019-11-11T04:48:46Z","snapshot_observed_at":"2026-08-05T16:02:27.279711Z","submitted_at":"2019-02-04T07:55:47Z","title":"A Comprehensive Exploration on WikiSQL with Table-Aware Word Contextualization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.01069","snapshot_observed_at":"2026-08-11T10:32:11.123619Z","title":"A comprehensive exploration on wikisql with table-aware word contextualization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.123619Z"},"links":{"cited_paper":"/paper/1902.01069","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:1647636b3291699f97e7be98f2bcf37c017f5a8ec279433c1a876093c94336cc","observation_id":"65ea5e78-64bf-4caa-a35d-7c9dfc5c0f19","resolution":{"observed_at":"2026-08-11T10:32:11.123619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.785741Z","title":"Text-to-sql with large language models: Exploring the promise and pitfalls,","venue":null,"work_id":"b3e8c53f-8ed4-474e-8f09-ee459e1de152","year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.135664Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:f3f7577264dc08bcd83a63d160c3e531d535e9faacb3e0b72332c8af69286ae8","observation_id":"19096444-5489-476c-8dc1-0e13c4b57e86","resolution":{"observed_at":"2026-08-11T10:32:11.790440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.798492Z","title":"RAT-SQL: Relation-aware schema encoding and linking for text- to-SQL parsers,","venue":null,"work_id":"5df3e378-08ef-4272-8c49-48447b8f248f","year":2020},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.131828Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:519da1ebbeb2471e42b9f068e8b521f62d310b69c954b75f9f8395339a02b7cc","observation_id":"54ecb1a4-a7e5-43e9-9b9c-cb53fb135d38","resolution":{"observed_at":"2026-08-11T10:32:11.802849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11015","last_updated":"2023-11-02T20:30:12Z","snapshot_observed_at":"2026-08-09T10:43:29.864285Z","submitted_at":"2023-04-21T15:02:18Z","title":"DIN-SQL: Decomposed In-Context Learning of Text-to-SQL with Self-Correction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11015","snapshot_observed_at":"2026-08-11T10:32:11.143103Z","title":"Din-sql: Decomposed in-context learning of text-to-sql with self-correction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.143103Z"},"links":{"cited_paper":"/paper/2304.11015","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:12f3a849db02a3d90132641d216f66d960385aaa4cd1ce453760b89add11ab35","observation_id":"681b221e-6765-40da-b800-e2699e49619c","resolution":{"observed_at":"2026-08-11T10:32:11.143103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.772051Z","title":"Optimization modeling and verification from problem specifications using a multi-agent multi-stage llm framework,","venue":null,"work_id":"d281ab60-0476-478f-a827-52b9973c1304","year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.139455Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:6d94d57b51434a701c302f65853ea4bec8cf4df15774b70aa1cc13a66fb1b543","observation_id":"79c00550-b824-4b2d-8eb8-861326522718","resolution":{"observed_at":"2026-08-11T10:32:11.776694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.749766Z","title":"Evaluating text-to-sql model failures on real-world data,","venue":null,"work_id":"792018ba-5a4c-48ba-a53f-29892287782f","year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.151392Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:b23d09f1921e8146e36d8c4a2b319b1108a5d07540ecf8d806d57ad3c6071759","observation_id":"10210bca-fe37-4779-844d-0232a45c228f","resolution":{"observed_at":"2026-08-11T10:32:11.754532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.147284Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.147284Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:1710d9011d0f95cd3429f9ff2eb85ab717214aaa77b87112351a098754777091","observation_id":"1cfba163-291b-4e24-942c-702b7b15c302","resolution":{"observed_at":"2026-08-11T10:32:11.147284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-11T10:32:11.158928Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.158928Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:24bd22ee3add4789cc365cd0885aceccda4a65679113d392513b4fb420eda55a","observation_id":"492b6229-35be-4b58-bcf6-46d38ca73a02","resolution":{"observed_at":"2026-08-11T10:32:11.158928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.737317Z","title":"Benchmarking and improving text-to-SQL generation under ambiguity,","venue":null,"work_id":"f2f0a3a4-ab9b-4221-9e1b-b3e245688a20","year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.155280Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:2e76813cfafd148630c69836a1014a999844d632bb4a187fb23ceb81f045aa65","observation_id":"42dea213-9517-4b60-80c6-3bc90f8f0481","resolution":{"observed_at":"2026-08-11T10:32:11.741677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.166941Z","title":"A survey on large language model based autonomous agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.166941Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:a6ff9021bac955a6388ec7069e2485dc4c754f800d906dd2181c5a797208bb79","observation_id":"664b2fca-5e4c-4559-9380-e64c57645539","resolution":{"observed_at":"2026-08-11T10:32:11.166941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06794","last_updated":"2023-09-13T08:33:09Z","snapshot_observed_at":"2026-07-06T16:17:50.837748Z","submitted_at":"2023-09-13T08:33:09Z","title":"Cognitive Mirage: A Review of Hallucinations in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06794","snapshot_observed_at":"2026-08-11T10:32:11.162911Z","title":"Cognitive mirage: A review of hallucinations in large language models. corr abs/2309.06794 (2023),","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.162911Z"},"links":{"cited_paper":"/paper/2309.06794","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:cb85743ff848dc1bf4a90d99e0c6af09fad79c762ce96321832e44dbbac82843","observation_id":"a57c21eb-c883-4279-8326-624b6feec07b","resolution":{"observed_at":"2026-08-11T10:32:11.162911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-11T10:32:11.174316Z","title":"Metagpt: Meta programming for a multi-agent collaborative framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.174316Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:4a5f8b164b71b29fbaccf431d5073768de623907600c9edb10fcaef13e539e7b","observation_id":"ea030616-c0ea-4ce1-957b-51c491a40daf","resolution":{"observed_at":"2026-08-11T10:32:11.174316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.717026Z","title":"AutoGPT,","venue":null,"work_id":"32bbd7ba-476a-43ac-ab78-caf14407d880","year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.170683Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:cc4d029e777375e3fc993267f6fecf3b160c105f5e7d9d5b51b307418ab86844","observation_id":"b076ca3a-c648-4010-b755-399d465b91a3","resolution":{"observed_at":"2026-08-11T10:32:11.721295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.182101Z","title":"Instruction-following evaluation for large language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.182101Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:8622afc813576d25495f9ee30d797f4d3b7b71b90031544cbe90bde4465864ac","observation_id":"5debf461-8c6a-4866-a27d-6d8c35b4ef3f","resolution":{"observed_at":"2026-08-11T10:32:11.182101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07930","last_updated":"2024-11-07T03:37:51Z","snapshot_observed_at":"2026-08-11T06:10:54.573237Z","submitted_at":"2024-08-15T04:57:55Z","title":"MAG-SQL: Multi-Agent Generative Approach with Soft Schema Linking and Iterative Sub-SQL Refinement for Text-to-SQL","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07930","snapshot_observed_at":"2026-08-11T10:32:11.178070Z","title":"Mag-sql: Multi-agent generative approach with soft schema linking and iterative sub-sql refinement for text-to-sql,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.178070Z"},"links":{"cited_paper":"/paper/2408.07930","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:07f32961fe7865852cc42f3b4fd1230be25100edd67fe1e96e97693bf5527504","observation_id":"2bbaa214-2503-46c2-8f15-e2790912c335","resolution":{"observed_at":"2026-08-11T10:32:11.178070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16745","last_updated":"2024-01-30T04:50:28Z","snapshot_observed_at":"2026-08-10T02:30:40.835322Z","submitted_at":"2024-01-30T04:50:28Z","title":"MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16745","snapshot_observed_at":"2026-08-11T10:32:11.193825Z","title":"Mt-eval: A multi-turn capabili- ties evaluation benchmark for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.193825Z"},"links":{"cited_paper":"/paper/2401.16745","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:c0b5e231650b43d8cd73820be3e5dfd2032b1f6300091897b32ee256e95c3f3c","observation_id":"dd26b6f7-8aad-4975-9346-9dd74318f6ac","resolution":{"observed_at":"2026-08-11T10:32:11.193825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.197816Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.197816Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:0f4bb083195156037eb65bf11b503afd9d82ba12968ff0d08cade7f7b0865a20","observation_id":"4fdd8091-b7c0-436a-b5e5-18852752b6c5","resolution":{"observed_at":"2026-08-11T10:32:11.197816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.696631Z","title":"G-eval: NLG evaluation using gpt-4 with better human alignment,","venue":null,"work_id":"66b76a32-7856-4013-b22a-9de17700e5ad","year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.189883Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:fb26f7771a6c84200813b1afe92b07cc984f03b4258c13c4bb57226375315352","observation_id":"c819827b-fcce-4637-a429-99a051c0e625","resolution":{"observed_at":"2026-08-11T10:32:11.701474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-11T10:32:11.209508Z","title":"Chatdev: Communicative agents for software development,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.209508Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:9305b56e8a27db08c2aeeba94e203b943058d983049c975f4118aecb923abd7c","observation_id":"5dbcaf13-11b2-4ff4-bcad-df69789b6f5b","resolution":{"observed_at":"2026-08-11T10:32:11.209508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00322","last_updated":"2024-06-29T05:40:17Z","snapshot_observed_at":"2026-08-09T19:48:11.780233Z","submitted_at":"2024-06-29T05:40:17Z","title":"LLM-Generated Natural Language Meets Scaling Laws: New Explorations and Data Augmentation Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00322","snapshot_observed_at":"2026-08-11T10:32:11.213935Z","title":"Llm-generated natural language meets scaling laws: New explorations and data augmentation methods,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.213935Z"},"links":{"cited_paper":"/paper/2407.00322","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:76311ac3e4f371215d08baa45830192d8720ba5c8663900fc361df22242f8d97","observation_id":"5decd463-58d4-4470-ac97-41a68c996cae","resolution":{"observed_at":"2026-08-11T10:32:11.213935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.675902Z","title":"Large language models are not fair evaluators,","venue":null,"work_id":"58ee7a03-8865-4369-8912-ddcfcd1cf771","year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.201396Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:0dde406cb73ed25a69444750bb82ea1769837e7938fc134815cf8498823441cb","observation_id":"a1b817a8-9e1f-4e7f-803a-32a7a5d68702","resolution":{"observed_at":"2026-08-11T10:32:11.680534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-08T03:32:23.667881Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-08-11T10:32:11.205236Z","title":"Available: https://arxiv.org/abs/2305.17926","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.205236Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:6a9833b95fce6848b2f7cf430b8182227a0695b51a1b2d9b1b22a5a384ba96be","observation_id":"466c1153-1c28-4f5b-b24d-61bed5d0b83c","resolution":{"observed_at":"2026-08-11T10:32:11.205236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-11T20:57:48.098709Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-11T10:32:11.225711Z","title":"Wizardlm: Empowering large language models to follow complex instructions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.225711Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:66e9fd91ec3265c7b82ab62f08d16b95b53b75588dfc6e876211bfeca7ec2675","observation_id":"106b235f-74cb-4f35-b2a5-35c689ba378a","resolution":{"observed_at":"2026-08-11T10:32:11.225711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12043","last_updated":"2024-06-20T21:58:07Z","snapshot_observed_at":"2026-07-06T18:32:32.228906Z","submitted_at":"2024-06-17T19:29:39Z","title":"Grade Score: Quantifying LLM Performance in Option Selection","version":2},"cited_work":{"arxiv_id":"2406.12043","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.12043","snapshot_observed_at":"2026-08-11T10:32:11.261280Z","title":"Grade Score: Quantifying LLM Performance in Option Selection","venue":"cs.AI","work_id":"903312c1-7f0a-4dbf-adb5-edad1410093b","year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.229466Z"},"links":{"cited_paper":"/paper/2406.12043","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:7107c1137270b28f5a5a0779e6e79605b7e9ebe99ba5369a1e7eff70d96ee30e","observation_id":"0eac8988-03ba-4edf-856a-2ed1030db9b7","resolution":{"observed_at":"2026-08-11T10:32:11.267686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03444","last_updated":"2024-09-05T11:49:53Z","snapshot_observed_at":"2026-08-11T03:34:31.440155Z","submitted_at":"2024-09-05T11:49:53Z","title":"Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03444","snapshot_observed_at":"2026-08-11T10:32:11.218017Z","title":"Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.218017Z"},"links":{"cited_paper":"/paper/2409.03444","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:a60e0b40efaa85daa4c35206a5b31f37ebe76420ab2e1d62aa7b71bdceec9c1f","observation_id":"804144bd-94f1-42aa-8046-2718c12745ba","resolution":{"observed_at":"2026-08-11T10:32:11.218017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.662999Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena,","venue":null,"work_id":"7ab853a8-1a8e-49db-a737-a8ee440e0f61","year":2023},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.222057Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:dccb1aab0b2be63a4f01a1976bcc8f046e567be1fea49ca05ce2dcf29623b280","observation_id":"ecee97c7-898b-47c1-97a7-457dc5c72a6f","resolution":{"observed_at":"2026-08-11T10:32:11.666994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-11T10:32:11.185581Z","title":"Available: https://arxiv.org/abs/2311.07911","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:11.185581Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:b113508159677c9f4755498b5512f80b487a50765ed9f62d3c16e05313779f46","observation_id":"8a0f0e64-a8f2-4df2-a03b-27c121b2c22c","resolution":{"observed_at":"2026-08-11T10:32:11.185581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.11062","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:32:11.649043Z","title":"Available: https://arxiv.org/abs/2408.11062","venue":null,"work_id":"fe9411be-9ea3-4561-81c6-608fdefdfb9a","year":null},"citing_paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T10:32:10.934218Z"},"links":{"citing_paper":"/paper/2412.17867"},"observation_digest":"sha256:3500016079ab9bfdff758a1881126f361c8a0b510c6f4f94ffe9c9a8ae53240b","observation_id":"5057d25f-1cbc-4519-9dbe-1c43e355e201","resolution":{"observed_at":"2026-08-11T10:32:11.655422Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.17867","last_updated":"2025-04-08T02:23:17Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T10:25:57.034965Z","submitted_at":"2024-12-21T10:13:45Z","title":"Evaluating and Enhancing LLMs for Multi-turn Text-to-SQL with Multiple Question Types"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2412.17867."}