{"as_of":"2026-08-14T17:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3091fbbafa3974cbbb936a5f9984a9058432c0eacce82e2f68c50d91566313ae","coverage":[{"denominator":9,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:42:39.596354Z","state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24069/citation-record","integrity":"/paper/2505.24069/integrity","json":"/paper/2505.24069/citation-record.json","paper":"/paper/2505.24069"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T12:42:38.862158Z","title":"Jiang, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:38.862158Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:48d366de08384789746468798e119092e0d12f69641160038fb8feff29eeba8a","observation_id":"c931fb64-0f01-4a99-a450-5eff50ef3507","resolution":{"observed_at":"2026-08-07T12:42:38.862158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09074","last_updated":"2024-06-12T08:55:13Z","snapshot_observed_at":"2026-08-13T04:40:46.886305Z","submitted_at":"2024-01-17T09:23:59Z","title":"Code Simulation Challenges for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09074","snapshot_observed_at":"2026-08-07T12:42:39.128432Z","title":"Malfa, E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.128432Z"},"links":{"cited_paper":"/paper/2401.09074","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:c2fefacdf3f0744331de8d1dee19cd252bdca55955da5dbfc7fa17b9baec07e9","observation_id":"f9b46fef-c915-48e2-8cf3-c2d7b4a95500","resolution":{"observed_at":"2026-08-07T12:42:39.128432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:39.368290Z","title":"acl-long.560/","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":560,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.368290Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:2b35d1d1a23eaca75590f3a1b0cc8d795c7e5452ebf09f5e083abf11be798e65","observation_id":"520f27ae-e1ca-41b4-9077-2fdfa797cab9","resolution":{"observed_at":"2026-08-07T12:42:39.368290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:40.050115Z","title":"$” to ensure a unique structure. The final state is a pre-order traversal collecting edge labels, with child edges visited in lexicographical order and “$","venue":null,"work_id":"4465e508-aad7-4074-b70f-e845b619b5d9","year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":765,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.596354Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:9e4cb2ead8435c9b9e372ba29e91762a460f3fde43d07c1541df1d11df5150d5","observation_id":"017e5cc6-e29c-4578-8d33-a18a77c18dd1","resolution":{"observed_at":"2026-08-07T12:42:40.136462Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:40.247259Z","title":"Jain, N., Han, K., Gu, A., Li, W.-D., Yan, F., Zhang, T., Wang, S., Solar-Lezama, A., Sen, K., and Stoica, I","venue":null,"work_id":"502a2d88-4db3-4a51-bf93-e36fd767a545","year":null},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:38.831254Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:4814623c9c5ddc3848c7a8673ea9c192206342923fbbad154f4023e8d5524e80","observation_id":"22b4c08b-010c-4700-bf8e-3231496757eb","resolution":{"observed_at":"2026-08-07T12:42:40.332011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04244","last_updated":"2024-06-06T16:41:39Z","snapshot_observed_at":"2026-07-30T15:43:06.151242Z","submitted_at":"2024-06-06T16:41:39Z","title":"Benchmark Data Contamination of Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04244","snapshot_observed_at":"2026-08-07T12:42:39.495637Z","title":"Wang, B., Yue, X., Su, Y ., and Sun, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.495637Z"},"links":{"cited_paper":"/paper/2406.04244","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:f458d768cc7b0d05349f598e3c207f0f8dda1ce160af96c4cb759f98bdc99f67","observation_id":"42df52bc-c515-45b3-9f28-9356b6f805a8","resolution":{"observed_at":"2026-08-07T12:42:39.495637Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:39.260078Z","title":"doi: 10.1145/3564240","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.260078Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:b5ddad5d054cdfce4b5ad13653445a6197cdf4fe75087323f1fb5bd4bd0356de","observation_id":"762da522-2267-4dee-9448-65391b593145","resolution":{"observed_at":"2026-08-07T12:42:39.260078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07314","last_updated":"2026-07-28T17:58:21Z","snapshot_observed_at":"2026-08-12T22:46:57.588845Z","submitted_at":"2024-09-11T14:44:51Z","title":"MEDIC: Comprehensive Evaluation of Leading Indicators for LLM Safety and Utility in Clinical Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07314","snapshot_observed_at":"2026-08-07T12:42:39.012433Z","title":"Kanithi, P., Christophe, C., Pimentel, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.012433Z"},"links":{"cited_paper":"/paper/2409.07314","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:d8015d5f5545fb142b979ac5ffa69c6f422d6c1d2b08297569bde1a3be34396f","observation_id":"46b88ea4-36b7-4e71-a9ad-d96715b6329a","resolution":{"observed_at":"2026-08-07T12:42:39.012433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15268","last_updated":"2025-01-27T11:35:04Z","snapshot_observed_at":"2026-08-12T22:39:20.893220Z","submitted_at":"2024-09-23T17:58:07Z","title":"Style Outweighs Substance: Failure Modes of LLM Judges in Alignment Benchmarking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15268","snapshot_observed_at":"2026-08-07T12:42:38.753358Z","title":"Fatemi, B., Halcrow, J., and Perozzi, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:38.753358Z"},"links":{"cited_paper":"/paper/2409.15268","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:c1b73cb4f8ad8da23b67fe5aa72ffd208dcbe27f82781984f9c928bce1e06869","observation_id":"bc074de8-e6eb-408b-bfe5-ccef2fb27b58","resolution":{"observed_at":"2026-08-07T12:42:38.753358Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T17:06:40.479295Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures"},"reference_resolution":{"displayed":9,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":9},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 9 of 9 outbound references and 0 inbound Pith citation observations for arXiv:2505.24069."}