Pith. sign in

Paper Citation Record · LEDGER

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models

As of 8 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2505.21409.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.21409 v1

Coverage vector

measured 61 of 61 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:32:50.913865Z

measured 61 of 61 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

61 of 61 outbound references displayed

  • verified exact7
  • verified fuzzy16
  • unresolved34
  • parse uncertain0
  • malformed identifier3
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 07e3c137-1528-4fef-8fd3-8ee46e10ba6c · outbound

This paper cites Ai hallucination report 2025, 2025.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Ai hallucination report 2025, 2025

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:59.261936Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.361753Z digest=sha256:32a2114385380d358d3136b0369490c4bd0276288e358c273d6bda5413856cf1

Observation db2fe7a2-deb1-4651-8dfb-b2face751cf2 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:59.051641Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.403729Z digest=sha256:a1724d7961f4f203c93e37c260330b970afb285cf0129de7ddd66c2880058c2e

Observation f386ed11-ef70-4e89-b24e-978300c46ede · outbound

This paper cites Balsiger, H.-R.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Balsiger, H.-R

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:58.749755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.441750Z digest=sha256:57e94e3350087435a1526c4f62228cf0272c9cc8819c6b3cddcfe2ef19ee7124

Observation 09c7ceea-687d-4aab-841f-bb57859f6cac · outbound

This paper cites Interpretable Medical Diagnostics with Structured Data Extraction by Large Language Models.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Interpretable Medical Diagnostics with Structured Data Extraction by Large Language Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.520937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.520937Z digest=sha256:67c7fc011306ff47e5652f22751ab2ea49704916d5e7aaece11a1fc5b0521e92

Observation 83d20bd7-532e-4110-9a9a-e04daa29a71b · outbound

This paper cites Borisov, K.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Borisov, K

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:58.517294Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.573788Z digest=sha256:a62cc7b1dffb643c363845f51170e3593d2accb2118604decef8247d5a3fcf78

Observation 5a333f0c-374c-44d2-8ba9-77c3db137e51 · outbound

This paper cites Buoncristiano, G.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Buoncristiano, G

Reference 6

Resolution
verified exact
doi, observed 2026-08-07T13:32:52.299853Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.625119Z digest=sha256:1653197c2bfc6f57158bd22c84c363f0c43fab3ebf420ce954c52ea8034edf82

Observation 21db787f-3b63-472b-a4e7-8305a2cc2a45 · outbound

This paper cites Retrieve, Merge, Predict: Augmenting Tables with Data Lakes.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Retrieve, Merge, Predict: Augmenting Tables with Data Lakes

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.676074Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.676074Z digest=sha256:79f207525453ec391c431cfc06546c3b685c84dc7f1fdb0cf51d19961eb0f97c

Observation c3536f04-1b0a-4238-b799-71090ed6f0d8 · outbound

This paper cites Chang, X.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Chang, X

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.713259Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.713259Z digest=sha256:1b3b4c105e118a7c23487359e439603e4c147480aa5d4f76e5e538076816a8d3

Observation 3de3a363-6858-4b22-bd6b-b316ecd28949 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:58.348469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.750093Z digest=sha256:5a6ab3ea845c6404dc4a92ea91e2775dd255696155e804f66905a02d1f84eba1

Observation 539ed863-a7ca-4ace-bee0-2aa5697e9122 · outbound

This paper cites Chowdhury, D.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Chowdhury, D

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:58.162748Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.790043Z digest=sha256:be5ccf204b63cae5384364fcfe26b2d64361ab38357da7b041288cbfeac55d3d

Observation 6ebb0201-619e-4392-9502-01af1f438bcc · outbound

This paper cites Christophides, V.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Christophides, V

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.979386Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.827253Z digest=sha256:eec698bcdd095e817f10ef4e5dfe626cd50ba414f538d30dea2f32ce6d0f4615

Observation 9b9c87c3-d87c-4b35-8027-caa2498e6fc6 · outbound

This paper cites DeepSeek LLM: Scaling Open-Source Language Models with Longtermism.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models DeepSeek LLM: Scaling Open-Source Language Models with Longtermism

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.863793Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.863793Z digest=sha256:996bb6789ea0d4589661a0688d4658894280e3abc04e3a248b731c3a6372c894

Observation ccc29672-a4f9-4b2f-8a84-b3a2504f780e · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:57.759832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.949789Z digest=sha256:8c2f0f74d6fcc20b866daa5d4073ae9274d323081e3e335b589cebef42b44e58

Observation df98fbb8-4333-4889-92e7-52e433d66a7b · outbound

This paper cites Elnashar, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Elnashar, J

Reference 14

Resolution
metadata mismatch
raw_fallback, observed 2026-08-07T13:32:53.373000Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:47.101631Z digest=sha256:c76f98c972782c859e4dd163b8203fb97140dd1bbbbe19bde00f945c98d6e073

Observation 08c5554f-d8b2-4bf7-9373-0fa7ba694972 · outbound

This paper cites doi: https://doi.org/10.1016/j.accinf.2024.100715.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models doi: https://doi.org/10.1016/j.accinf.2024.100715

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.021461Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.021461Z digest=sha256:959565261fd0c5f9ec4ba67705d16b2fa30fba06973b62b1c7d7e5ba1ae71cc1

Observation 04667e40-d325-417c-be23-747a66d0cc9d · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Gemma: Open Models Based on Gemini Research and Technology

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.265524Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.265524Z digest=sha256:7d9792104034b984cf5fd0a7acfc04911603e9ae466b6059acd59dd4ef6afff0

Observation 9f9808ce-865c-42ec-99b6-36da7c895896 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 17

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:32:47.190773Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.190773Z digest=sha256:1b9ca8eef012f364b76d9d7936478c2de9aa4d6849b0dd093d1e0a02caf766c8

Observation c55372c2-1aaa-46f7-83f6-e76287c276b7 · outbound

This paper cites Holtzman, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Holtzman, J

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.520675Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:47.392521Z digest=sha256:7c446b9e7da72311c90848994998c68c6f521fc50417023dffe8956a05dc98f9

Observation 5d98f628-b3f6-4e59-9b1d-f2e583163ebb · outbound

This paper cites Glavic, G.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Glavic, G

Reference 19

Resolution
verified exact
doi, observed 2026-08-07T13:32:52.010553Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:47.329050Z digest=sha256:6774df8c70aaa87f664ed67597f638dcc9b8a1061806c16677fd7731806536b9

Observation 1f775385-3eef-40b5-8c87-0d5b04d31c49 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.559143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.559143Z digest=sha256:26dfff6dcd017dbbc9487e49ab60b4c6758ac0664a41d95f15c30f56c4dcbda2

Observation 7648c6b5-6d7b-4221-a791-bd58a2912d55 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.478077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.478077Z digest=sha256:3f188d2e12929519bbccb78eb2e5771b56ba375d228dd5ae90b9c1edc538166d

Observation 8f6d8c24-3092-4da0-9839-90c9010a4939 · outbound

This paper cites Joshi, E.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Joshi, E

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.315874Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:47.778376Z digest=sha256:8ff16b94f6b736d62a0330b249cd8339eb012f6961aeabdbadb597db2a0719c3

Observation f9bc9594-3b18-4636-a527-fdaf7ec9b2e3 · outbound

This paper cites Mistral 7B.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Mistral 7B

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.623703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.623703Z digest=sha256:23dfa590081cbf14fef41168a3d08e134d36af633046e68d26bca64e3e5f942d

Observation 07134d5f-adf9-4e76-b9f3-13bc1c1d65d0 · outbound

This paper cites Open-WikiTable: Dataset for Open Domain Question Answering with Complex Reasoning over Table.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Open-WikiTable: Dataset for Open Domain Question Answering with Complex Reasoning over Table

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.935799Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.935799Z digest=sha256:7537c321a36337011f1b2292be9a4d467e44ea20ca01230fded146b13b7d3465

Observation 75b5265f-a770-4f4b-a55e-786304332ccc · outbound

This paper cites Kwiatkowski, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Kwiatkowski, J

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:56.853352Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:48.009190Z digest=sha256:048756d303b94b50db122749be621297b64f6279a1f76b8076065c3760fc9c5f

Observation d849b4bf-17e1-4e8a-a17c-0de972ad3745 · outbound

This paper cites Kasneci, K.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Kasneci, K

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.073960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:47.860715Z digest=sha256:b37f0b30b3f04c13c304977113f43606f0b840500dfe0ba076c5e3eacc3f08fb

Observation 03ba16d3-e65d-4c38-9153-14c06ef62a34 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:56.626350Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:48.148989Z digest=sha256:d2957b9ef53f751827ad4e3958e9ec930d1e51b958c0d5dfa833cd79e5c010f4

Observation ef23b778-e2ee-4279-ad2b-b2f3286ff541 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:56.448911Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:48.227184Z digest=sha256:9f475b46d943e1a478fc3ede1ed93ec41b400a7f1adb1cdf90013a3aa6dc2dd1

Observation 8047c490-164c-4fb7-b9dd-bd8b8615ba34 · outbound

This paper cites Lee, M.-W.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Lee, M.-W

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.066912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.066912Z digest=sha256:0ebabe1b1825d4a1b38e54adffee1385035cf83c315f83929a84ee23e2c38d5d

Observation d711835e-1280-4b37-bf07-db934020e050 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 30

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:32:48.433952Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.433952Z digest=sha256:cf9fa1dded8a4f2ca4f93be12de65a00d56eff2cede96e4237d2f1663fa00b6b

Observation 72d61015-d0fe-4da7-b5f8-f561bddc1362 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.521291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.521291Z digest=sha256:36ed66a2ac999a3142687d646b8be1d3a42c286512e6168c115ee2abd4a6f0fd

Observation 2b4bc770-9318-4679-b948-ecb4b16afbbc · outbound

This paper cites The Llama 3 Herd of Models.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models The Llama 3 Herd of Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.609492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.609492Z digest=sha256:2322585701904848c16b9f90b07ac5d35083c9f54f3dc01d335679cc755c33d8

Observation 48022fea-0bfc-464d-a74c-451b1da09a50 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:56.258592Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:48.357266Z digest=sha256:680f5c10c95e37fb1d5f627d408e535e7b72460475f079b62b1210e0a141dea7

Observation 203906d0-b638-40db-9095-63eb26094c58 · outbound

This paper cites Papicchio, P.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Papicchio, P

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:56.093936Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:48.801222Z digest=sha256:4e6bb65cf8e96236d2d1530bb379ade8a524027fc69856207539d97696f0328d

Observation 3ee3bf0f-0a9c-4f6c-b505-6038d0c9fac2 · outbound

This paper cites Pasupat and P.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Pasupat and P

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:55.903693Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:48.872971Z digest=sha256:892db4cd8fdf987bd647a7ea6ed93482bfc61a8e2656c10fa365561e96c77498

Observation 53540648-f8a8-493c-8e1f-b972c4829785 · outbound

This paper cites Semantic Operators: A Declarative Model for Rich, AI-based Data Processing.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Semantic Operators: A Declarative Model for Rich, AI-based Data Processing

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.953399Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.953399Z digest=sha256:d88fe542ef3d72466787bcac5d61641bf0efafce4865ec8921176a470e2cc37e

Observation 4bb87158-d39f-489e-8709-8416759587c1 · outbound

This paper cites GPT-4 Technical Report.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models GPT-4 Technical Report

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.702771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.702771Z digest=sha256:9a7d9979d32ebe33d665bf5a6ef383e9d36ebd4e5bb50652b149a4a4d84053e1

Observation 7e8e62e6-53d7-420c-93e4-800ae8fd1de9 · outbound

This paper cites Petroni, P.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Petroni, P

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:55.477197Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.165647Z digest=sha256:f6eac1e05c10648ceb7a5d77cf0af0c665280b4fb1a91047c750e0260c506103

Observation 346a7052-f8cf-4ad8-902a-20fa0f0b3bd2 · outbound

This paper cites Qwen2.5 Technical Report.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Qwen2.5 Technical Report

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:49.327226Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:49.327226Z digest=sha256:603e8d6713450ceb5feb54d00a8f484a2c214d46c7d362be5f27d5487f02be7f

Observation f39c3868-ee30-4293-9d2e-30ac78f08a52 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:55.007684Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.414543Z digest=sha256:eb0ba990e6ec5654f05309da46a07e28fc433d90d24177e6b2e8b99f629f9925

Observation 5617f6dd-a755-4803-bf1c-fa10dbccc684 · outbound

This paper cites Petroni, T.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Petroni, T

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:55.666087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.017964Z digest=sha256:b03d223d262824809e6273f15cb43ca25d9531c45706c1c8f973c79c0796159b

Observation 214e4505-e483-4ee3-a224-aaef144eca94 · outbound

This paper cites Saparina and M.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Saparina and M

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:54.724969Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.681402Z digest=sha256:aed509b51917718f4da2acc9d33666deb83cf80b0cab6edc5ec129f7b7d5969a

Observation f2628c97-c9c0-4033-b7cd-b815f8e49dd5 · outbound

This paper cites DocETL: Agentic Query Rewriting and Evaluation for Complex Document Processing.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models DocETL: Agentic Query Rewriting and Evaluation for Complex Document Processing

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:49.753681Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:49.753681Z digest=sha256:3b236368bdf6e7912c12d1945fc1dacf3ee8e35361ee13973ef2e313093c63be

Observation 5393e0aa-2a2f-4186-b6ab-b3c38c2baa2f · outbound

This paper cites Singhal, S.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Singhal, S

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:54.457394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.844507Z digest=sha256:c0d7d82fc5be38e063fa41f0f9b6ee19f5822220863c1bb57fd39f656ff2c426

Observation 56c35b50-fe33-4bc5-ace0-e2f4d064e867 · outbound

This paper cites Stuhler, C.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Stuhler, C

Reference 45

Resolution
verified exact
doi, observed 2026-08-07T13:32:51.146841Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.922990Z digest=sha256:8e1508b0c2506cea3ac473f3a94f9101ec1cb7066514464269efd8d799fac789

Observation 31cc0abf-f788-4a7e-8436-331998aaef12 · outbound

This paper cites Saeed, N.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Saeed, N

Reference 46

Resolution
verified exact
doi, observed 2026-08-07T13:32:51.625148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.511762Z digest=sha256:00baf133d12bc84faf72720d4d90ffc1716d55d2f737e9f10066b6dab2ad3c0f

Observation 462e6e3c-9e7f-4112-be47-7ce49f70b95c · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 47

Resolution
verified exact
doi, observed 2026-08-07T13:32:51.376941Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.580285Z digest=sha256:517befdc3288d092c44c8cdf776f3f21f93ae3b21a40f773b413d9074d4a9b0e

Observation f584738f-6c6d-449e-bf4f-c33a73286a87 · outbound

This paper cites Truhn, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Truhn, J

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:54.214399Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:50.181882Z digest=sha256:d09ced4c19b4550f579f588f9343b5458585a6c3bc5dfb6a31a02652957e2b35

Observation acbd60b6-dba9-4d11-8652-d52550417321 · outbound

This paper cites Measuring short-form factuality in large language models.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Measuring short-form factuality in large language models

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.289751Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.289751Z digest=sha256:be428d2674c0444296c2f6445c9fc3a58370ea5dbd1378c1d8f9c010d053704e

Observation ffa750af-20cd-4e63-9098-d18d57002d8a · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 50

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:53.944357Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:50.376486Z digest=sha256:a9a959b7755dcd5c5abf0671884abb2944eba95a40674bd49b07a6825e85a351

Observation 80ac46d7-739e-4dfd-a43a-8510c0dbccc0 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.438462Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.438462Z digest=sha256:7390c6ec73894f744ce1950dd36548b1d31690e78c1cead8e3ca7c37260217eb

Observation fa26c866-5deb-493d-8ea9-74b2814f7e04 · outbound

This paper cites YAGO 4.5: A Large and Clean Knowledge Base with a Rich Taxonomy.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models YAGO 4.5: A Large and Clean Knowledge Base with a Rich Taxonomy

Reference 52

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:32:52.885759Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:50.036801Z digest=sha256:505594243fc98458988de6fd8c25b6f91084e4f7759f62f03c842bca66cd7d0e

Observation 51a3bf34-1a99-41c8-be65-de9f2fc3be9c · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 53

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:32:50.108142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.108142Z digest=sha256:30fee851fe1960c3a76ead0b325c49164d07e5084273156a811f40b1f662e955

Observation 1f7e146c-038d-4741-8944-43da98534dda · outbound

This paper cites Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.822133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.822133Z digest=sha256:67a48a0f506cb533eed5dede4314f2dd0efc0ff4c677e1c17e473beb9278b36c

Observation 85c57c1d-5f7a-4778-b8c9-00cb62d2b7bc · outbound

This paper cites bird”, “galois.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models bird”, “galois

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.913865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.913865Z digest=sha256:bb72c89c7ae3914fb19175d6f1cb7ad9aa269e2f64a25b2297c83c670a80f8c9

Observation c30f6445-753b-4c35-bd49-80e5b3e8ccc1 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 58

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:53.698539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:50.566418Z digest=sha256:c929a95ea10579df99ab3dac5e1b63c74bb03e17d5be371eb65c050e794d3e9f

Observation 6bff2db9-7609-4480-b209-367f9cc1daba · outbound

This paper cites TableLLM: Enabling Tabular Data Manipulation by LLMs in Real Office Usage Scenarios.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models TableLLM: Enabling Tabular Data Manipulation by LLMs in Real Office Usage Scenarios

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.689286Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.689286Z digest=sha256:a1b6134155d54837b42e2b8244cb32f0a9c9ed202556925754b95daca947130f

Observation 88eec023-3341-49c6-969a-3536460f28ae · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 2020

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:55.258363Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:49.254197Z digest=sha256:45b924f90fb583ab8c93e200b1b91df9a455fe81ce34adb38a9ca17b67aa07c6

Observation c5c90338-bdf0-448d-867b-c46c29e78773 · outbound

This paper cites TruthfulQA: Measuring How Models Mimic Human Falsehoods.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models TruthfulQA: Measuring How Models Mimic Human Falsehoods

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.282123Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.282123Z digest=sha256:8c28e4b3ccff7c2a09e8af35ca9d3f353e640ce119e82681bf386719c3546bc9

Observation 23a283f7-c1e8-4d6f-9126-2fc6563a52d4 · outbound

This paper cites Mistral 7B.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Mistral 7B

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.702623Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.702623Z digest=sha256:7b8c6007b08838d003f6880343b41e20a2aafcc81273ab11e8bf1c42cb3a7a48

Observation 29306f15-a00a-40f5-8bf4-dd5123b49722 · outbound

This paper cites doi: 10.3390/computers13100257.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models doi: 10.3390/computers13100257

Reference 2024

Resolution
verified exact
doi, observed 2026-08-07T13:32:52.618710Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:32:46.481258Z digest=sha256:395289fb77bdab4ad85ffda11d0a366dfa9423a9334088ae8d47f9920ee0bb80

Pith citing papers

No inbound Pith citation observations are available.