{"as_of":"2026-08-17T16:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cd8a16f2239b13820459b5a76839f4644dc1b339bc45927b5488b04c1a6520ab","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:28:47.872578Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10527/citation-record","integrity":"/paper/2506.10527/integrity","json":"/paper/2506.10527/citation-record.json","paper":"/paper/2506.10527"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:51.772804Z","title":"How far can transformers reason? the globality barrier and inductive scratchpad","venue":null,"work_id":"3470b629-0ad2-4536-8962-cb7c799293de","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:37.631385Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:8708d80b926538aa1538791faf8a343cec62cd6b566fdee78fdc60a301d0eb85","observation_id":"13daddeb-bf98-4bd7-9a13-2efcb2f7d51f","resolution":{"observed_at":"2026-08-07T04:28:51.870479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:51.519955Z","title":"Graph of logic: Enhancing llm reasoning with graphs and symbolic logic","venue":null,"work_id":"801644d1-e814-493f-baa7-51afab23f405","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:39.992525Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:e9f1f4e900e632d088947e66d3086909244115a0d385456b1a13b34516bdc103","observation_id":"4a180558-2c7b-4523-96ac-45160c5a1113","resolution":{"observed_at":"2026-08-07T04:28:51.648962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:51.210860Z","title":"Claude 3.7 sonnet","venue":null,"work_id":"9206ce41-5410-4123-809a-2d48e86da977","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.109199Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:a56bf98fe97f09d623e1957c95ad0ef6f77c46d1306d982bed27a97a53590efb","observation_id":"5d0623af-db05-4bc4-9540-25aa8c057937","resolution":{"observed_at":"2026-08-07T04:28:51.345069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10566","last_updated":"2024-09-13T18:01:49Z","snapshot_observed_at":"2026-08-16T13:18:42.338486Z","submitted_at":"2024-09-13T18:01:49Z","title":"Eureka: Evaluating and Understanding Large Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10566","snapshot_observed_at":"2026-08-07T04:28:40.218979Z","title":"Eureka: Evaluating and understanding large foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.218979Z"},"links":{"cited_paper":"/paper/2409.10566","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:9de335d019b4066d38f0b5c26728e859ee6e2134b28c0d27e967be0d58501f94","observation_id":"333256f3-6047-47a1-ae20-4dd8f38e1ec4","resolution":{"observed_at":"2026-08-07T04:28:40.218979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:28:40.339630Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.339630Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:2059c05335179335a25467ce0b27fa853ad61f7fef67244592f6674fc10a762d","observation_id":"cffd9cab-db11-42e7-ada0-fde6f9ff23c5","resolution":{"observed_at":"2026-08-07T04:28:40.339630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14890","last_updated":"2024-02-12T17:30:25Z","snapshot_observed_at":"2026-08-16T14:32:07.817753Z","submitted_at":"2023-12-22T18:07:44Z","title":"NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14890","snapshot_observed_at":"2026-08-07T04:28:40.881171Z","title":"Nphardeval: Dynamic benchmark on reasoning ability of large language models via complexity classes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.881171Z"},"links":{"cited_paper":"/paper/2312.14890","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:b67911f7e49dab76049cba8a51f72c84f1db50bcf4614a08f536c70f0a3d0c90","observation_id":"ab83d070-3c04-44dc-b9e6-6c70cba195da","resolution":{"observed_at":"2026-08-07T04:28:40.881171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04468","last_updated":"2024-11-07T06:36:19Z","snapshot_observed_at":"2026-08-13T07:44:55.410720Z","submitted_at":"2024-11-07T06:36:19Z","title":"Magentic-One: A Generalist Multi-Agent System for Solving Complex Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04468","snapshot_observed_at":"2026-08-07T04:28:43.800298Z","title":"Magentic-one: A generalist multi-agent system for solving complex tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:43.800298Z"},"links":{"cited_paper":"/paper/2411.04468","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:e3c2f96d52e5f4028e8765c906f2c166cde566a50cd37961a18dc35feb2c817c","observation_id":"52e18b69-3525-43f3-9d0c-641f6da8c5a4","resolution":{"observed_at":"2026-08-07T04:28:43.800298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.938913Z","title":"Gemini 2.0 pro experimental","venue":null,"work_id":"2e3b5f88-a566-44d1-b931-668d407e67f4","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:43.913151Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:d9c5af006e7b01de8d78b2b4f1c61d8e6604146e8e3c18c32e1a2d2412b2b8ee","observation_id":"e381ab0e-bd16-476e-afba-2cea2d894a18","resolution":{"observed_at":"2026-08-07T04:28:51.060732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.684305Z","title":"Gemini 2.0 flash thinking","venue":null,"work_id":"141a3521-d6f4-42b1-8ec5-22bf183e4208","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.022394Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:dbddb9c82f475c9e6c910e45c7d294603e730ef7e21db87967e822a3968cd768","observation_id":"6a919f3c-4495-4f5c-a3f8-3db8f25737dd","resolution":{"observed_at":"2026-08-07T04:28:50.806928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-08-13T14:38:32.919809Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08998","snapshot_observed_at":"2026-08-07T04:28:44.141478Z","title":"Reinforced self-training (rest) for language modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.141478Z"},"links":{"cited_paper":"/paper/2308.08998","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:1dae57639da2e344ab6d6e81a8b11767ba32591bf7eb2ef09c06a5847f4c5a52","observation_id":"cdfb6979-b996-405f-b957-0f4421b6c7fe","resolution":{"observed_at":"2026-08-07T04:28:44.141478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:28:44.268329Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.268329Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:ad4fba445aa284dfcbd5a6e70b27fad05325adcb0f14bea3db0212574124ed9a","observation_id":"1d341136-a6eb-4881-b45a-183389793d9e","resolution":{"observed_at":"2026-08-07T04:28:44.268329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T04:28:44.369152Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.369152Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:5a9f15adcb883f26efd230ad261e52f01348378bab0aeb92c41fa7e8c89cc78d","observation_id":"34041c10-3514-41ee-8637-d2c7787ecfc9","resolution":{"observed_at":"2026-08-07T04:28:44.369152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T04:28:44.472582Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.472582Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:c568ea5f688f1fb9322831d9db0787d16d99a0d2c76fb44f7c7d834eddc2b489","observation_id":"e0e8ec66-628e-48b0-ab30-204a7afcd6f8","resolution":{"observed_at":"2026-08-07T04:28:44.472582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.437621Z","title":"Finding all the elementary circuits of a directed graph","venue":null,"work_id":"56e22482-c525-4142-ac05-540363ed0507","year":1975},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.662847Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:0e0a6a9adcd0a20c035c59ae3de637d78ce720957fb64f292f72b25aea34f6f5","observation_id":"e6c594e3-5fc4-4736-a8c4-6c679e502ebf","resolution":{"observed_at":"2026-08-07T04:28:50.551608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.189497Z","title":"Same task, more tokens: the impact of input length on the reasoning performance of large language models","venue":null,"work_id":"a978f8ab-73d1-48ec-9409-9e796095de41","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.779665Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:0d156f37cf60156d6418fa1fccf86d774699eccaa031cf76aab8815c5ba4a897","observation_id":"ee54dd7e-7624-49af-8097-9be19ed5a087","resolution":{"observed_at":"2026-08-07T04:28:50.304512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03875","last_updated":"2023-07-13T17:29:48Z","snapshot_observed_at":"2026-08-16T15:17:49.475529Z","submitted_at":"2023-07-08T01:42:22Z","title":"Large Language Models for Supply Chain Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03875","snapshot_observed_at":"2026-08-07T04:28:44.907012Z","title":"Large language models for supply chain optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.907012Z"},"links":{"cited_paper":"/paper/2307.03875","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:22efa5bf4da0da74645ea4f38c304cd59cb986946276c7c74c735991e379c547","observation_id":"40a4ecee-aee7-46c8-9ade-57a6469fbfae","resolution":{"observed_at":"2026-08-07T04:28:44.907012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.909177Z","title":"Llms for relational reasoning: How far are we? In Proceedings of the 1st International Workshop on Large Language Models for Code, pp.\\ 119--126, 2024","venue":null,"work_id":"90d9a66e-7041-47b0-9911-d0b19d343130","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.061476Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:18e0daf58a61e1ee8f805b7bc7033c5bc4627ff985a9e9414d4430108a8ed9b2","observation_id":"859e10bb-1161-4366-bb42-3df6f0a3b072","resolution":{"observed_at":"2026-08-07T04:28:50.020611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:45.169542Z","title":"Let's verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.169542Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:b171bebd5f762e9a21603480e6b9eefb310addc2b62932cba2be6b39233ff0cc","observation_id":"75549691-995f-42ec-85b7-bf025908a967","resolution":{"observed_at":"2026-08-07T04:28:45.169542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01100","last_updated":"2025-07-15T01:14:25Z","snapshot_observed_at":"2026-08-15T18:38:02.815401Z","submitted_at":"2025-02-03T06:44:49Z","title":"ZebraLogic: On the Scaling Limits of LLMs for Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01100","snapshot_observed_at":"2026-08-07T04:28:45.311682Z","title":"Zebralogic: On the scaling limits of llms for logical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.311682Z"},"links":{"cited_paper":"/paper/2502.01100","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:dd67b120f94f01f13a89c8e5dca0ff94332d3e1849e5b940ae72364a90aabb63","observation_id":"0585ec8d-bfb5-4b8b-8c30-03a8a3682e69","resolution":{"observed_at":"2026-08-07T04:28:45.311682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.640300Z","title":"Evaluating cognitive maps and planning in large language models with cogeval","venue":null,"work_id":"7805fd2b-94c4-48ae-a755-9dc85962bc5f","year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.438885Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:3df2c71cb275d6142892c155afd14f85bd19ffabbe7a3eb46e152f9610c34648","observation_id":"1198c1e5-a59f-4cd8-a408-54ed93a49fad","resolution":{"observed_at":"2026-08-07T04:28:49.777154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.451381Z","title":"Foster, and Michael W","venue":null,"work_id":"5ad9d272-a119-4b60-844d-752190711a3d","year":2005},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.587781Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:237b74d23a6f56faf6622940b86a78758403155539b27c62c543b63a444f2229","observation_id":"71007d16-5174-49f2-af57-cf863ebb13bb","resolution":{"observed_at":"2026-08-07T04:28:49.524885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:45.681138Z","title":"Openai o3-mini system card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.681138Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:14992e308b8aed6f85562c6c72873ae9cc662721a4cbdc49d1369291e7be6f9d","observation_id":"8d9ed02d-68bb-4d41-9b87-63c757460c4f","resolution":{"observed_at":"2026-08-07T04:28:45.681138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.175865Z","title":"Logicbench: Towards systematic evaluation of logical reasoning ability of large language models","venue":null,"work_id":"e17ebe07-633a-4708-ba2c-c816696e2d2f","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.808086Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:2cd3b3f4f2e5460489fe87efb31b4e24c2b5150b08c12948f4b38deed9061134","observation_id":"e493e0fb-5ddf-4608-b0c2-eb598dbf49d3","resolution":{"observed_at":"2026-08-07T04:28:49.303330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17169","last_updated":"2024-10-07T03:48:18Z","snapshot_observed_at":"2026-08-16T13:39:56.946061Z","submitted_at":"2024-06-24T23:02:56Z","title":"Multi-LogiEval: Towards Evaluating Multi-Step Logical Reasoning Ability of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17169","snapshot_observed_at":"2026-08-07T04:28:45.947400Z","title":"Multi-logieval: Towards evaluating multi-step logical reasoning ability of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.947400Z"},"links":{"cited_paper":"/paper/2406.17169","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:056030c45d5884b47d20a472bdaad1dd4550076d9f82fe78b77a68faee9b6965","observation_id":"eec52d23-b3ff-4bc4-a8f0-e17870037a28","resolution":{"observed_at":"2026-08-07T04:28:45.947400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:48.923062Z","title":"Divide and translate: Compositional first-order logic translation and verification for complex logical reasoning","venue":null,"work_id":"4287d83e-501b-4772-a97a-739a77b02cbf","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.143857Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:3326ac8f05f3cc0632e4edd8daafce437e982baf6438552a2c2a8fb84ec1bb73","observation_id":"9571dae9-3f7e-403e-a0e1-e884514fadfb","resolution":{"observed_at":"2026-08-07T04:28:49.020000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13397","last_updated":"2024-06-19T09:38:59Z","snapshot_observed_at":"2026-08-16T13:41:31.732039Z","submitted_at":"2024-06-19T09:38:59Z","title":"MoreHopQA: More Than Multi-hop Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13397","snapshot_observed_at":"2026-08-07T04:28:46.289978Z","title":"Morehopqa: More than multi-hop reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.289978Z"},"links":{"cited_paper":"/paper/2406.13397","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:47ee9e664ca44f49dfdc600f799fb798696624eae1b436d637a929d893caee74","observation_id":"da054956-7561-4149-95b1-ce862f3536ca","resolution":{"observed_at":"2026-08-07T04:28:46.289978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10502","last_updated":"2024-09-16T17:42:15Z","snapshot_observed_at":"2026-08-16T13:18:05.144759Z","submitted_at":"2024-09-16T17:42:15Z","title":"Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10502","snapshot_observed_at":"2026-08-07T04:28:46.408842Z","title":"Causal language modeling can elicit search and reasoning capabilities on logic puzzles","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.408842Z"},"links":{"cited_paper":"/paper/2409.10502","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:8c1475ccd54a46c2771253a5bfd9249339493fb6cfd515679bf20c55a3576492","observation_id":"7cfadf7a-1629-496a-aadb-5c31cfd83f56","resolution":{"observed_at":"2026-08-07T04:28:46.408842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:46.557922Z","title":"Musique: Multihop questions via single-hop question composition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.557922Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:97c3b7a52b083c48c5309214dc51b31a4f576d74d62b96118d2d31f74b6cf821","observation_id":"d708a61d-0097-4c7d-8de8-c0b73add71d0","resolution":{"observed_at":"2026-08-07T04:28:46.557922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01589","last_updated":"2023-08-03T07:48:02Z","snapshot_observed_at":"2026-08-16T15:11:08.174548Z","submitted_at":"2023-08-03T07:48:02Z","title":"Holy Grail 2.0: From Natural Language to Constraint Models","version":1},"cited_work":{"arxiv_id":"2308.01589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.01589","snapshot_observed_at":"2026-08-07T04:28:48.169991Z","title":"Holy Grail 2.0: From Natural Language to Constraint Models","venue":"cs.AI","work_id":"0aec1ec9-ba3a-4461-b4f2-a85e6ff1a9b9","year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.653749Z"},"links":{"cited_paper":"/paper/2308.01589","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:ea8cb816ea2f2792ff4a819a0d12bceb6afbac3cb3019532b48b0401141bced6","observation_id":"b8a51838-5ab7-44b6-bc01-16188e1fbe78","resolution":{"observed_at":"2026-08-07T04:28:48.259984Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:46.787264Z","title":"On the planning abilities of large language models-a critical investigation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.787264Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:2b7a0b9ebdfe990eace37fe013c213e922447286f268e85f424179fc8f3acc30","observation_id":"21847219-af4a-477b-958a-87aa8001bb95","resolution":{"observed_at":"2026-08-07T04:28:46.787264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-16T13:16:55.432324Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-07T04:28:46.939636Z","title":"Llms still can't plan; can lrms? a preliminary evaluation of openai's o1 on planbench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.939636Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:a5a8724082803330307d474f8ea19a5d23d47249620b620f66ab7efae34cf236","observation_id":"16a779d1-6d61-4191-9907-fea88806053e","resolution":{"observed_at":"2026-08-07T04:28:46.939636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14852","last_updated":"2024-11-04T21:51:07Z","snapshot_observed_at":"2026-08-16T13:40:52.689637Z","submitted_at":"2024-06-21T03:53:37Z","title":"Is A Picture Worth A Thousand Words? Delving Into Spatial Reasoning for Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14852","snapshot_observed_at":"2026-08-07T04:28:47.081061Z","title":"Is a picture worth a thousand words? delving into spatial reasoning for vision language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.081061Z"},"links":{"cited_paper":"/paper/2406.14852","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:d6bc4c38738e1ad840fa9eb3fb745e5544b04342376f85a9548d88d5362f6349","observation_id":"0a527187-c70f-4ec1-b20d-88839e383437","resolution":{"observed_at":"2026-08-07T04:28:47.081061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19924","last_updated":"2024-10-14T03:41:09Z","snapshot_observed_at":"2026-08-16T13:14:17.240436Z","submitted_at":"2024-09-30T03:58:43Z","title":"On The Planning Abilities of OpenAI's o1 Models: Feasibility, Optimality, and Generalizability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19924","snapshot_observed_at":"2026-08-07T04:28:47.210808Z","title":"On the planning abilities of openai's o1 models: Feasibility, optimality, and generalizability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.210808Z"},"links":{"cited_paper":"/paper/2409.19924","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:92a749dee5979078cfc82154f71bb9a3cb3639ee4fd46748593ff7f57dadd00a","observation_id":"eba4517b-6b66-496a-b150-5b5060f6f192","resolution":{"observed_at":"2026-08-07T04:28:47.210808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:48.680854Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":"d1d8e49e-6226-4592-ae1a-71171eb3c876","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.330230Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:a21641946949ef4d58802529b08f9ea5b733203cbe141bae3224f518f26228ee","observation_id":"d6923359-51ac-47db-a56c-e6e919cba353","resolution":{"observed_at":"2026-08-07T04:28:48.740642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-07T04:28:47.511050Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.511050Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:8ba4648c24a09b73cd3e4abdb8cbf57a552c7932eb28d2e1a053f2ab7e1b9b93","observation_id":"2f3f4aa8-d39d-4e1d-832d-41bd705e4542","resolution":{"observed_at":"2026-08-07T04:28:47.511050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18357","last_updated":"2024-06-11T07:41:03Z","snapshot_observed_at":"2026-08-16T13:48:32.044219Z","submitted_at":"2024-05-28T16:55:33Z","title":"Faithful Logical Reasoning via Symbolic Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18357","snapshot_observed_at":"2026-08-07T04:28:47.609701Z","title":"Faithful logical reasoning via symbolic chain-of-thought","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.609701Z"},"links":{"cited_paper":"/paper/2405.18357","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:0db16d733389642f5a6257eb2fcf7b340c4010ddc1e14376066ced9ae9fcd77e","observation_id":"4979fd67-1488-487f-acdc-b9661780569c","resolution":{"observed_at":"2026-08-07T04:28:47.609701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-17T01:54:11.006899Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-07T04:28:47.750383Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.750383Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:3f9ed934d3443da4e03c80e3191f7da90f72dcd7124c7bba8219d10b8fd68496","observation_id":"5bae4fd2-961f-4349-bb38-18dbad1a73e3","resolution":{"observed_at":"2026-08-07T04:28:47.750383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-16T13:45:21.167651Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-07T04:28:47.872578Z","title":"Natural plan: Benchmarking llms on natural language planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.872578Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:de9830a50c391adebf38a4608b4efbcf72a34c8a3195e6b361dbac0118199b46","observation_id":"3f1b9139-7109-4809-907e-8bb7be6e5fb6","resolution":{"observed_at":"2026-08-07T04:28:47.872578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T09:34:23.528331Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2506.10527."}