{"as_of":"2026-08-22T18:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65f8d622089f9655652fcca1dc68507f0cdf4493512214fe53c5726ad07f1d38","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:12:02.650276Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:37:04.850180Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T18:37:08.724321Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2505.23843","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23843","snapshot_observed_at":"2026-08-05T18:37:08.724321Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","venue":"cs.CL","work_id":"f5b95033-cff0-44b1-8315-64fa88076958","year":2025},"citing_paper":{"arxiv_id":"2508.14377","last_updated":"2025-08-23T05:27:00Z","snapshot_observed_at":"2026-08-14T14:16:57.459220Z","submitted_at":"2025-08-20T03:08:47Z","title":"ZPD-SCA: Unveiling the Blind Spots of LLMs in Assessing Students' Cognitive Abilities","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T18:37:04.850180Z"},"links":{"cited_paper":"/paper/2505.23843","citing_paper":"/paper/2508.14377"},"observation_digest":"sha256:cf414a451d5c52890e13b67d80c57e49a564473743d535ce0ad290cd54ff1738","observation_id":"8a7c73f9-61d8-458a-8ab4-05cc9d164f87","resolution":{"observed_at":"2026-08-05T18:37:08.729773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23843/citation-record","integrity":"/paper/2505.23843/integrity","json":"/paper/2505.23843/citation-record.json","paper":"/paper/2505.23843"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:06.440763Z","title":"Lateral thinking in man- agerial decision making through six thinking hats tech- nique","venue":null,"work_id":"ad3de456-1548-4ced-beaa-d60742810895","year":2017},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.147668Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:569e6b36dfd06198b9539c4d58f600b845c3a2b12e10ac870d6adcaf9c6de3f9","observation_id":"39e48223-16b8-4653-b254-14302dbd113b","resolution":{"observed_at":"2026-08-07T13:12:06.535068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-12T12:34:50.226758Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-07T13:11:59.210516Z","title":"Longbench v2: Towards deeper understanding and reasoning on realistic long- context multitasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.210516Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:acbf72fdac946c0546ee36e9f3aca1000ea65bfad1af099b824378c85b7d7d3d","observation_id":"78da5e74-dd07-45fe-b625-222bd5d1e5bd","resolution":{"observed_at":"2026-08-07T13:11:59.210516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10079","last_updated":"2024-12-13T12:13:19Z","snapshot_observed_at":"2026-08-13T02:38:46.486111Z","submitted_at":"2024-12-13T12:13:19Z","title":"Lost in the Middle, and In-Between: Enhancing Language Models' Ability to Reason Over Long Contexts in Multi-Hop QA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10079","snapshot_observed_at":"2026-08-07T13:11:59.323522Z","title":"Lost in the middle, and in-between: Enhancing language models’ ability to reason over long contexts in multi- hop qa","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.323522Z"},"links":{"cited_paper":"/paper/2412.10079","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:d69274ac521ab01877e38e369d0f479b60924785229201895f33deb2bb2f5812","observation_id":"b6ce57f9-5217-4c7d-8d4c-e76200710aa4","resolution":{"observed_at":"2026-08-07T13:11:59.323522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:06.206193Z","title":"Olson, Yoshua Bengio, and Karim Jerbi","venue":null,"work_id":"150a67a6-88ce-4e4f-bcae-42487f56755f","year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.438377Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:903f46f22d0d3a4cc4bd83385b362819606743cee099fdc7fe0b6b6949f53be3","observation_id":"d12f33db-3a56-4904-bd2a-e7c8deede7fa","resolution":{"observed_at":"2026-08-07T13:12:06.307084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20222","last_updated":"2024-10-11T11:32:16Z","snapshot_observed_at":"2026-08-16T13:14:09.678042Z","submitted_at":"2024-09-30T12:01:29Z","title":"Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20222","snapshot_observed_at":"2026-08-07T13:11:59.521353Z","title":"Beyond prompts: Dynamic conversa- tional benchmarking of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.521353Z"},"links":{"cited_paper":"/paper/2409.20222","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:03f86673a52843bdad3bcb151535b74bfb3dd29f5c9f40e5c4f6ed0b28282936","observation_id":"c242c12a-f0bd-4619-b361-83705df86c86","resolution":{"observed_at":"2026-08-07T13:11:59.521353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:06.024775Z","title":"Art or arti- fice? large language models and the false promise of creativity, 2024","venue":null,"work_id":"80bda4c2-36c9-4537-846b-af98fbc8bbe3","year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.615970Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:af854c887855682936e36cc8a2e3cc0de25c49eeb0457d91c56bb3e226f54980","observation_id":"bc279b02-bde6-4d3c-a9c3-5d2cd266f412","resolution":{"observed_at":"2026-08-07T13:12:06.139911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11158","last_updated":"2023-10-17T11:23:32Z","snapshot_observed_at":"2026-08-16T14:51:25.713188Z","submitted_at":"2023-10-17T11:23:32Z","title":"Probing the Creativity of Large Language Models: Can models produce divergent semantic association?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11158","snapshot_observed_at":"2026-08-07T13:11:59.715954Z","title":"Probing the cre- ativity of large language models: Can models pro- duce divergent semantic association? arXiv preprint arXiv:2310.11158, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.715954Z"},"links":{"cited_paper":"/paper/2310.11158","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:f4df72d87fb9b93f816c8e444bc296cc1c10ccfa03415bbd5adb073878194abb","observation_id":"0d669c96-2386-4594-b141-df439ca2b95f","resolution":{"observed_at":"2026-08-07T13:11:59.715954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06733","last_updated":"2024-10-09T10:09:11Z","snapshot_observed_at":"2026-08-20T21:39:58.693482Z","submitted_at":"2024-10-09T10:09:11Z","title":"Weak-eval-Strong: Evaluating and Eliciting Lateral Thinking of LLMs with Situation Puzzles","version":1},"cited_work":{"arxiv_id":"2410.06733","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.06733","snapshot_observed_at":"2026-08-07T13:12:03.729829Z","title":"Weak-eval-Strong: Evaluating and Eliciting Lateral Thinking of LLMs with Situation Puzzles","venue":"cs.CL","work_id":"50064abe-9b93-4e1c-9223-529c42c38be0","year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.831608Z"},"links":{"cited_paper":"/paper/2410.06733","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:bd2307b05622722134b56c7bd4ba94f4a37cf9a2f9c2edd46f4cafa8db0e69fe","observation_id":"68fa4b75-a2dd-4d6e-a001-61930c94d339","resolution":{"observed_at":"2026-08-07T13:12:03.845872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T13:11:59.948164Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:59.948164Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:932a44691473ee660041d6213e02e5768ace0692100e4785e1a988c9cc8ff9c2","observation_id":"5664193e-f8f1-49cb-986d-94b5fb4f751f","resolution":{"observed_at":"2026-08-07T13:11:59.948164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:05.802297Z","title":"Humanizing llms: A survey of psycho- logical measurements with tools, datasets, and human- agent applications, 2025","venue":null,"work_id":"e802d577-a221-4c09-84bb-e64f4f6d7eb7","year":2025},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.029918Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:c944fc64ac4e53025bba193c2e8496c4624e4973c90b3a2a6374c4aeeccff930","observation_id":"aa32cfa6-99e5-4d34-8861-b876c3cff40e","resolution":{"observed_at":"2026-08-07T13:12:05.893152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-20T12:52:29.141935Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T13:12:00.159723Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.159723Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:53eab2b063556ed49fdc5df59e369274990d3f9774fb5199342b0c6419acca88","observation_id":"0615c6ca-04c4-4e53-9050-e05970e34e91","resolution":{"observed_at":"2026-08-07T13:12:00.159723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02429","last_updated":"2024-10-31T17:04:59Z","snapshot_observed_at":"2026-08-16T13:04:03.685681Z","submitted_at":"2024-10-31T17:04:59Z","title":"IdeaBench: Benchmarking Large Language Models for Research Idea Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02429","snapshot_observed_at":"2026-08-07T13:12:00.231479Z","title":"Ideabench: Benchmarking large lan- guage models for research idea generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.231479Z"},"links":{"cited_paper":"/paper/2411.02429","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:93712f16bb042197700a031be9574743570ba051597acb018236bd1dc064ec0e","observation_id":"b36b8472-84b4-4d8b-a34f-c5894b39d8c4","resolution":{"observed_at":"2026-08-07T13:12:00.231479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-08-21T04:25:41.592030Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T13:12:00.307954Z","title":"Measuring mathematical prob- lem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.307954Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:b7e74a20d919ca52ba0ad0ffc5c0142d0bcefc6e693c6a8374f25d08021834f4","observation_id":"6d23357f-acce-4eaf-97c4-de89ef0b6482","resolution":{"observed_at":"2026-08-07T13:12:00.307954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10855","last_updated":"2024-03-17T13:11:08Z","snapshot_observed_at":"2026-08-16T15:06:55.950653Z","submitted_at":"2023-08-21T16:49:40Z","title":"LatEval: An Interactive LLMs Evaluation Benchmark with Incomplete Information from Lateral Thinking Puzzles","version":3},"cited_work":{"arxiv_id":"2308.10855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.10855","snapshot_observed_at":"2026-08-07T13:12:03.439846Z","title":"LatEval: An Interactive LLMs Evaluation Benchmark with Incomplete Information from Lateral Thinking Puzzles","venue":"cs.CL","work_id":"15bc5b87-b131-43de-a1e2-ae83820490c0","year":2023},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.384570Z"},"links":{"cited_paper":"/paper/2308.10855","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:8e3121c8398275d812ed569aae14fab98567e1de76cbff8c669bd0e4406708c1","observation_id":"98dbc834-6a6b-4da6-8ebf-a862a7f2580c","resolution":{"observed_at":"2026-08-07T13:12:03.480767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18431","last_updated":"2025-02-25T18:26:48Z","snapshot_observed_at":"2026-08-16T12:55:16.273130Z","submitted_at":"2025-02-25T18:26:48Z","title":"TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18431","snapshot_observed_at":"2026-08-07T13:12:00.478659Z","title":"Textgames: Learning to self-play text-based puzzle games via language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.478659Z"},"links":{"cited_paper":"/paper/2502.18431","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:bee3e26bda55054ef28366eccc6082fd69a8c9e3570e4415ab6d1bdc9729a3c6","observation_id":"d5a717b9-a3e4-43db-a5d2-c9cbfdb64175","resolution":{"observed_at":"2026-08-07T13:12:00.478659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05057","last_updated":"2023-11-09T19:45:13Z","snapshot_observed_at":"2026-08-16T14:54:07.889852Z","submitted_at":"2023-10-08T07:46:01Z","title":"BRAINTEASER: Lateral Thinking Puzzles for Large Language Models","version":3},"cited_work":{"arxiv_id":"2310.05057","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05057","snapshot_observed_at":"2026-08-07T13:12:03.133417Z","title":"BRAINTEASER: Lateral Thinking Puzzles for Large Language Models","venue":"cs.CL","work_id":"639de339-29e6-426b-af1d-22f871a33e54","year":2023},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.608571Z"},"links":{"cited_paper":"/paper/2310.05057","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:b1c0a684813227b5e9b60ebcebf43227bed6a544ceaf5efd8952bb2f6ce27a26","observation_id":"58d1734a-f3ff-4693-94a6-1a7a10e182a8","resolution":{"observed_at":"2026-08-07T13:12:03.309213Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:05.621314Z","title":"Babilong: Testing the limits of llms with long context reasoning-in-a-haystack","venue":null,"work_id":"312623ac-cb80-431a-9c12-74b88fa22424","year":null},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.704484Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:f232d5b9d0ff51e61f58cfc1abb8cbd94c96629d795306e74c7461232a307e54","observation_id":"9f01b3f2-6c9c-422b-b409-14056e2e8916","resolution":{"observed_at":"2026-08-07T13:12:05.677491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18394","last_updated":"2025-03-24T07:05:55Z","snapshot_observed_at":"2026-08-19T11:42:36.793360Z","submitted_at":"2025-03-24T07:05:55Z","title":"Solving Situation Puzzles with Large Language Model and External Reformulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18394","snapshot_observed_at":"2026-08-07T13:12:00.780628Z","title":"Solving situation puzzles with large language model and external reformulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.780628Z"},"links":{"cited_paper":"/paper/2503.18394","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:937f924f8345a76db8e67d75a35d4b0047945357297c829cd4c48bf13fd3acdd","observation_id":"b12f8ad0-2991-4966-893a-0a0824a94730","resolution":{"observed_at":"2026-08-07T13:12:00.780628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19444","last_updated":"2024-05-29T18:45:55Z","snapshot_observed_at":"2026-08-20T04:30:15.051554Z","submitted_at":"2024-05-29T18:45:55Z","title":"MathChat: Benchmarking Mathematical Reasoning and Instruction Following in Multi-Turn Interactions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19444","snapshot_observed_at":"2026-08-07T13:12:00.875755Z","title":"Math- chat: Benchmarking mathematical reasoning and in- struction following in multi-turn interactions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:00.875755Z"},"links":{"cited_paper":"/paper/2405.19444","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:3835c0995a45e12837cdf483d93f3c27e26992382ffb3238bf3bfacba4bd6547","observation_id":"c5d36ea8-4f5b-4a66-94d5-c3045366cde5","resolution":{"observed_at":"2026-08-07T13:12:00.875755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06373","last_updated":"2024-08-08T04:47:20Z","snapshot_observed_at":"2026-08-20T06:04:32.459700Z","submitted_at":"2024-05-10T10:19:14Z","title":"LLM Discussion: Enhancing the Creativity of Large Language Models via Discussion Framework and Role-Play","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06373","snapshot_observed_at":"2026-08-07T13:12:01.017120Z","title":"Llm discus- sion: Enhancing the creativity of large language models via discussion framework and role-play","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.017120Z"},"links":{"cited_paper":"/paper/2405.06373","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:7b5795e030096277b51bcace8ad7c7d40deeb41ebea07b3c5a68803a0412ff70","observation_id":"c247c504-32f6-41c3-86e5-da75598adf00","resolution":{"observed_at":"2026-08-07T13:12:01.017120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:05.392266Z","title":"Enhancing creativity as innovation via asynchronous crowdwork","venue":null,"work_id":"452132e1-36d6-40f8-b974-c0d887489ae3","year":2022},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.093647Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:bd70a05f5f89848499571a22df4b11b3c4ac9f033402e967b5e2740e8b900d95","observation_id":"77ff21cd-7c3d-4232-b9b2-a5e31b6cd296","resolution":{"observed_at":"2026-08-07T13:12:05.495014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:05.149849Z","title":"The effect of problem-based learning on lateral thinking skills","venue":null,"work_id":"a7bed497-b4d3-474b-9c8d-ce4d3af4236e","year":2020},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.203027Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:c48a2aa56df59d3c6cdb915234bc28ca542e5cb5911a0c4f55e68077d6860475","observation_id":"cfb10e48-2821-48de-a93b-6af70c49af76","resolution":{"observed_at":"2026-08-07T13:12:05.263027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:04.922855Z","title":"Naming un- related words predicts creativity","venue":null,"work_id":"a051b298-a662-4cf2-995f-2eb6873e062c","year":null},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.353907Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:50ed595bfb7aebe329e5da484b1a678f4ebba0aafbaaa4e94fc5690159660b7e","observation_id":"3141eafc-f406-4588-9f49-8ff4fc75f3cb","resolution":{"observed_at":"2026-08-07T13:12:05.039922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:04.709175Z","title":"Brainstorm, then select: a generative language model improves its creativity score","venue":null,"work_id":"84669168-3d46-4704-a355-d52fe5f9234b","year":2023},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.471893Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:e6e1b333c8ced31d42bcdbc48b204ced5e9b6a3de50f674e4d6edd8c1601f10b","observation_id":"596e6bb4-a689-4c43-a78f-e8ea7febba60","resolution":{"observed_at":"2026-08-07T13:12:04.821874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:04.477176Z","title":"Play, imagination, and creativity: A brief literature review","venue":null,"work_id":"d32e6429-6bda-4807-b07b-7a9749d81755","year":2012},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.603213Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:94e2d32d0ca2205899c6dca24caf2bd1bfcf10894790708041ae4851c1a1edda","observation_id":"ae61bb6a-58f7-4001-ae37-19875a676e5a","resolution":{"observed_at":"2026-08-07T13:12:04.528712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13940","last_updated":"2025-07-09T18:39:59Z","snapshot_observed_at":"2026-08-18T14:44:02.175834Z","submitted_at":"2024-08-25T21:20:17Z","title":"Derailer-Rerailer: Adaptive Verification for Efficient and Reliable Language Model Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13940","snapshot_observed_at":"2026-08-07T13:12:01.733623Z","title":"Cot rerailer: Enhancing the reliability of large language models in complex reasoning tasks through error detec- tion and correction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.733623Z"},"links":{"cited_paper":"/paper/2408.13940","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:a4b487c6efc74d5145eea923dc7232d8a72b64d40676ae1aca00fa80d6ad80ee","observation_id":"cd83c047-5efb-4f64-9feb-2049a1e3ac7c","resolution":{"observed_at":"2026-08-07T13:12:01.733623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-08-22T03:52:53.469568Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T13:12:01.877235Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.877235Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:0f851538ce15dbc14edfbf3e967314110390329e3b72384351760bfff49ff471","observation_id":"dc3f209f-b240-4f45-a084-5369add9c2b6","resolution":{"observed_at":"2026-08-07T13:12:01.877235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02964","last_updated":"2024-07-03T10:01:01Z","snapshot_observed_at":"2026-08-19T22:04:39.602347Z","submitted_at":"2024-07-03T10:01:01Z","title":"FSM: A Finite State Machine Based Zero-Shot Prompting Paradigm for Multi-Hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02964","snapshot_observed_at":"2026-08-07T13:12:01.987797Z","title":"Fsm: A fi- nite state machine based zero-shot prompting paradigm for multi-hop question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:01.987797Z"},"links":{"cited_paper":"/paper/2407.02964","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:e9da9e8213747b2b93279bc5ebc55acf01aa06df2f082967b001230711d2444e","observation_id":"989576b4-c66a-4dea-88b7-536fc9196c01","resolution":{"observed_at":"2026-08-07T13:12:01.987797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:04.304360Z","title":"The creative class- room: The role of space and place toward facilitat- ing creativity","venue":null,"work_id":"d6be69eb-b16a-4b1c-b314-b9b9ed73ce62","year":2009},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:02.060962Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:841dd06a23c736b5831e7be47d84e6f108168f1182c4312905384946be74e4df","observation_id":"eb889efe-2fdd-47ed-b018-f3a8178582a2","resolution":{"observed_at":"2026-08-07T13:12:04.361508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02465","last_updated":"2025-03-14T08:44:06Z","snapshot_observed_at":"2026-08-18T06:28:10.059227Z","submitted_at":"2024-09-04T06:28:22Z","title":"DetectiveQA: Evaluating Long-Context Reasoning on Detective Novels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02465","snapshot_observed_at":"2026-08-07T13:12:02.223795Z","title":"Detectiveqa: Evaluat- ing long-context reasoning on detective novels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:02.223795Z"},"links":{"cited_paper":"/paper/2409.02465","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:ecd83dcfdde056a16318a3797d32724d88005314181ead2a6cdbf4e9a18e6834","observation_id":"c40bc220-26df-493e-8410-ab00d3cad7ae","resolution":{"observed_at":"2026-08-07T13:12:02.223795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05262","last_updated":"2024-10-07T17:58:47Z","snapshot_observed_at":"2026-08-16T13:11:48.588353Z","submitted_at":"2024-10-07T17:58:47Z","title":"TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05262","snapshot_observed_at":"2026-08-07T13:12:02.370686Z","title":"Turtlebench: Evaluating top language mod- els via real-world yes/no puzzles","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:02.370686Z"},"links":{"cited_paper":"/paper/2410.05262","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:21f46f0d24b469f40d6c40a4e51c97ed586b6d52934c42474dcdf31a774fca31","observation_id":"22bfd3c3-2c84-49b3-9424-d5b647d95954","resolution":{"observed_at":"2026-08-07T13:12:02.370686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07103","last_updated":"2025-04-29T01:44:03Z","snapshot_observed_at":"2026-08-16T13:11:00.135235Z","submitted_at":"2024-10-09T17:41:53Z","title":"Unleashing Multi-Hop Reasoning Potential in Large Language Models through Repetition of Misordered Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07103","snapshot_observed_at":"2026-08-07T13:12:02.530820Z","title":"Unleashing multi-hop reasoning potential in large language mod- els through repetition of misordered context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:02.530820Z"},"links":{"cited_paper":"/paper/2410.07103","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:75a94d7cf0da8199218004d7e230e339494d32ff80b81f9af65f7b858cf24985","observation_id":"74449efc-3658-43dd-bfb3-d6393896a789","resolution":{"observed_at":"2026-08-07T13:12:02.530820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:12:04.094847Z","title":"As- sessing and understanding creativity in large language models","venue":null,"work_id":"4b482507-cda6-4eff-8a6c-55437b4c7187","year":null},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:02.650276Z"},"links":{"citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:952286b43ba67a01027635f86a6ecbfbed3e7b14f4af9c38d4e503d130570170","observation_id":"7e582bdf-bd2c-456b-9ebe-515631c5c8c2","resolution":{"observed_at":"2026-08-07T13:12:04.177440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":3,"verified_fuzzy":12},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2505.23843."}