{"as_of":"2026-08-10T07:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8b4163c017ac02ebb70e4350a46327745da5da3ecde329626b983ae9d433412","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:44:31.930407Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T08:36:48.288216Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":"2501.14851","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-02T08:36:48.288216Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models","venue":null,"work_id":"97c02745-8fd0-492d-bac0-125a8acdfb44","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:4bc6e0d8f8f32e10de73f06189e43ba0016bb63c9710d72a54169ce1ae2d907d","observation_id":"72b29544-c055-4143-ac7c-1ea19c030df1","resolution":{"observed_at":"2026-05-12T08:40:41.838340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-07T05:28:23.828084Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models // arXiv preprint arXiv:2501.14851","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07833","last_updated":"2025-06-13T17:24:38Z","snapshot_observed_at":"2026-08-10T07:16:20.475506Z","submitted_at":"2025-06-09T14:55:00Z","title":"Improving Large Language Models with Concept-Aware Fine-Tuning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:28:23.828084Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2506.07833"},"observation_digest":"sha256:ac75af5ccd151f325700fbbb814980b4ecf642453687e6a32cfb1e03cede7f36","observation_id":"9d8e7afd-0c1b-42ec-ad31-7d2a76d554fc","resolution":{"observed_at":"2026-08-07T05:28:23.828084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T18:08:39.208031Z","title":"K.; Zhang, X.; and Tao, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15180","last_updated":"2026-05-28T16:12:56Z","snapshot_observed_at":"2026-08-05T18:08:30.380618Z","submitted_at":"2025-08-21T02:36:16Z","title":"PuzzleClone: A DSL-Powered Framework for Synthesizing Verifiable Data","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T18:08:39.208031Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2508.15180"},"observation_digest":"sha256:fdc6feb21f9b3d7a4d3adbce5acd716913f54acefd8372b27318e21a5a9db0a9","observation_id":"f1e03c3c-9570-4a0d-85d8-caa872750e2a","resolution":{"observed_at":"2026-08-05T18:08:39.208031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T15:26:52.732798Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-08T08:17:40.776630Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.732798Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:b5a4015d43a582d838e4d394e2343ad70a611496a4eb3b2cb60dd9f166d87a87","observation_id":"c3056f3b-8e04-49fa-acf3-cd2deee7a1bb","resolution":{"observed_at":"2026-08-05T15:26:52.732798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T04:42:05.339231Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models.arXiv preprint arXiv:2501.14851, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06024","last_updated":"2025-09-07T11:52:18Z","snapshot_observed_at":"2026-08-06T03:19:32.912528Z","submitted_at":"2025-09-07T11:52:18Z","title":"Rethinking Reasoning Quality in Large Language Models through Enhanced Chain-of-Thought via RL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T04:42:05.339231Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2509.06024"},"observation_digest":"sha256:2c86f654fd7aa7fe210513a5dbf3a0cd457e938410aa855d402294ad94e53406","observation_id":"69fdc157-bbdc-465c-b495-18e1571d5675","resolution":{"observed_at":"2026-08-05T04:42:05.339231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-04T10:40:26.129286Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09340","last_updated":"2026-06-30T16:53:02Z","snapshot_observed_at":"2026-08-08T13:15:45.460913Z","submitted_at":"2025-10-10T12:49:00Z","title":"Deductive Logic in Language Models: Horizontal vs Vertical Reasoning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T10:40:26.129286Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2510.09340"},"observation_digest":"sha256:5a94a61114d2ac02b923aae28ed0cecd6ef78236ffadda5f24b2d54c0d4f5f79","observation_id":"6cc57450-3bb8-4c04-b73b-577b89f2e726","resolution":{"observed_at":"2026-08-04T10:40:26.129286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-03T07:39:36.528740Z","title":"Finale Doshi-Velez and Been Kim","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.18446","last_updated":"2026-06-25T03:52:17Z","snapshot_observed_at":"2026-08-09T07:55:44.433053Z","submitted_at":"2026-01-27T14:06:33Z","title":"ReportLogic: Evaluating Logical Quality in Deep Research Reports","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T07:39:36.528740Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2602.18446"},"observation_digest":"sha256:e28fe7c62de157cf6ba4cffc13a81b2806c03c294125c472d475668709782f13","observation_id":"7362ad27-72dd-4ec8-85fb-8925dfdd4e3e","resolution":{"observed_at":"2026-08-03T07:39:36.528740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":"2501.14851","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-02T08:36:48.288216Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models","venue":null,"work_id":"97c02745-8fd0-492d-bac0-125a8acdfb44","year":2025},"citing_paper":{"arxiv_id":"2604.04443","last_updated":"2026-04-06T05:41:02Z","snapshot_observed_at":"2026-08-09T08:53:47.973168Z","submitted_at":"2026-04-06T05:41:02Z","title":"DeonticBench: A Benchmark for Reasoning over Rules","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T20:22:03.956227Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2604.04443"},"observation_digest":"sha256:7e066a89b1876fd352d0d398e8ed8c3a18c114a19affecaad1091a21fc1fd8a7","observation_id":"84285226-067d-4eb5-a01d-f02e4098194e","resolution":{"observed_at":"2026-05-10T22:00:48.119873Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":"2501.14851","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-02T08:36:48.288216Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models","venue":null,"work_id":"97c02745-8fd0-492d-bac0-125a8acdfb44","year":2025},"citing_paper":{"arxiv_id":"2606.05009","last_updated":"2026-06-03T15:29:38Z","snapshot_observed_at":"2026-08-02T06:44:36.989749Z","submitted_at":"2026-06-03T15:29:38Z","title":"DAR: Deontic Reasoning with Agentic Harnesses","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T05:55:19.924704Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2606.05009"},"observation_digest":"sha256:322cc2c3a34c0e9aff95fa4c18dc8caf8af42fd67f1904e91a884a7bd0fdd55a","observation_id":"87594534-a9fd-4b10-aec1-ec25d04af57c","resolution":{"observed_at":"2026-07-02T08:36:48.289884Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-12T03:54:48.803944Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models.arXiv preprint arXiv:2501.14851, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05434","last_updated":"2026-07-03T11:54:32Z","snapshot_observed_at":"2026-08-09T18:12:42.276494Z","submitted_at":"2026-07-03T11:54:32Z","title":"Abductive Corroboration of Probabilistic AI Models for Forensic Synthetic Media Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T03:54:48.803944Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2607.05434"},"observation_digest":"sha256:f9376dd975ffe35739abaf4c250d14ab7149dbd76ce18fdf970107312b1d6cdf","observation_id":"50bfcbe8-7b85-4fea-a663-fddc2a596235","resolution":{"observed_at":"2026-07-12T03:54:48.803944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-07T12:44:31.930407Z","title":"arXiv preprint arXiv:2501.14851 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06202","last_updated":"2026-08-06T15:58:32Z","snapshot_observed_at":"2026-08-09T23:13:06.133585Z","submitted_at":"2026-08-06T15:58:32Z","title":"What Current AI Benchmarks Leave Unmeasured: Modality, Search, Citations, and Implications (for Safety Evaluations)","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:31.930407Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2608.06202"},"observation_digest":"sha256:cb32b8b1feb6275554e4d80a3fac83afb684ba80d580d5660bd886ad9141b8c7","observation_id":"1d6aa5bc-2a07-47f9-8374-28c6e9e277b0","resolution":{"observed_at":"2026-08-07T12:44:31.930407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14851/citation-record","integrity":"/paper/2501.14851/integrity","json":"/paper/2501.14851/citation-record.json","paper":"/paper/2501.14851"},"outbound":[],"paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2501.14851."}