{"as_of":"2026-08-20T02:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e71733b2841e50cf55b4e45345a6f272ef795204ec6b66ba51ccb3351e16839a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:12:02.370686Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T20:29:47.359139Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.05262","last_updated":"2024-10-07T17:58:47Z","snapshot_observed_at":"2026-08-16T13:11:48.588353Z","submitted_at":"2024-10-07T17:58:47Z","title":"TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05262","snapshot_observed_at":"2026-08-07T13:12:02.370686Z","title":"Turtlebench: Evaluating top language mod- els via real-world yes/no puzzles","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23843","last_updated":"2025-05-28T15:17:34Z","snapshot_observed_at":"2026-08-19T08:19:01.098320Z","submitted_at":"2025-05-28T15:17:34Z","title":"Evaluation Hallucination in Multi-Round Incomplete Information Lateral-Driven Reasoning Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:02.370686Z"},"links":{"cited_paper":"/paper/2410.05262","citing_paper":"/paper/2505.23843"},"observation_digest":"sha256:21f46f0d24b469f40d6c40a4e51c97ed586b6d52934c42474dcdf31a774fca31","observation_id":"22bfd3c3-2c84-49b3-9424-d5b647d95954","resolution":{"observed_at":"2026-08-07T13:12:02.370686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05262","last_updated":"2024-10-07T17:58:47Z","snapshot_observed_at":"2026-08-16T13:11:48.588353Z","submitted_at":"2024-10-07T17:58:47Z","title":"TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles","version":1},"cited_work":{"arxiv_id":"2410.05262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05262","snapshot_observed_at":"2026-08-05T20:29:47.359139Z","title":"TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles","venue":"cs.CL","work_id":"efad576d-75fd-4fb2-8a58-69ef368eafd8","year":2024},"citing_paper":{"arxiv_id":"2508.10358","last_updated":"2025-08-14T05:55:42Z","snapshot_observed_at":"2026-08-14T21:19:15.435784Z","submitted_at":"2025-08-14T05:55:42Z","title":"What to Ask Next? Probing the Imaginative Reasoning of LLMs with TurtleSoup Puzzles","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:47.026109Z"},"links":{"cited_paper":"/paper/2410.05262","citing_paper":"/paper/2508.10358"},"observation_digest":"sha256:34c0c83eb070e5244f3f86dc62baf598da811001d46773a6d1817558b942ab36","observation_id":"4f92a1b4-7afd-4bfe-8df3-d2590d80bd47","resolution":{"observed_at":"2026-08-05T20:29:47.451401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05262","last_updated":"2024-10-07T17:58:47Z","snapshot_observed_at":"2026-08-16T13:11:48.588353Z","submitted_at":"2024-10-07T17:58:47Z","title":"TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05262","snapshot_observed_at":"2026-08-03T10:55:09.650537Z","title":"Huichi Zhou, Yihang Chen, Siyuan Guo, Xue Yan, Kin Hei Lee, Zihan Wang, Ka Yiu Lee, Guchun Zhang, Kun Shao, Linyi Yang, and 1 others","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.08173","last_updated":"2026-06-02T11:13:10Z","snapshot_observed_at":"2026-08-13T09:02:36.940762Z","submitted_at":"2026-01-13T03:09:18Z","title":"The Agent's First Day: Benchmarking Learning, Exploration, and Scheduling in the Workplace Scenarios","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T10:55:09.650537Z"},"links":{"cited_paper":"/paper/2410.05262","citing_paper":"/paper/2601.08173"},"observation_digest":"sha256:65c6766751c0432c61b975c4975ba586afe7cb92219ba488f72c85761c8c8ebf","observation_id":"fb5d1bcb-4173-4634-bb5a-abacbe308aaf","resolution":{"observed_at":"2026-08-03T10:55:09.650537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05262","last_updated":"2024-10-07T17:58:47Z","snapshot_observed_at":"2026-08-16T13:11:48.588353Z","submitted_at":"2024-10-07T17:58:47Z","title":"TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05262","snapshot_observed_at":"2026-07-15T15:03:20.637041Z","title":"Turtlebench: Evaluating top language models via real-world yes/no puzzles.arXiv preprint arXiv:2410.05262,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.04734","last_updated":"2026-05-26T09:00:10Z","snapshot_observed_at":"2026-08-18T00:45:55.838149Z","submitted_at":"2026-03-05T02:13:09Z","title":"Multistage Stochastic Programming for Rare Event Risk Mitigation in Power Systems Management","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-15T15:03:20.637041Z"},"links":{"cited_paper":"/paper/2410.05262","citing_paper":"/paper/2603.04734"},"observation_digest":"sha256:d9d717f56eb483647ce8da119f1329a6cf61a0e309e03c4bbd7082b9b209b65d","observation_id":"25655dc3-e0cd-459b-9c9a-a7ddde2a5740","resolution":{"observed_at":"2026-07-15T15:03:20.637041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.05262/citation-record","integrity":"/paper/2410.05262/integrity","json":"/paper/2410.05262/citation-record.json","paper":"/paper/2410.05262"},"outbound":[],"paper":{"arxiv_id":"2410.05262","last_updated":"2024-10-07T17:58:47Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:11:48.588353Z","submitted_at":"2024-10-07T17:58:47Z","title":"TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:2410.05262."}