{"as_of":"2026-08-10T04:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5785967158b8d8dc4501b4b4e9040aff01194b19431c8f0fcfef783ee1618db6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:37:02.501468Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T20:57:23.984225Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":"1908.06177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-07-02T20:57:23.984225Z","title":"Clutrr: A diagnostic benchmark for inductive reasoning from text","venue":null,"work_id":"68256d87-be6d-4efa-9bcc-daf3b840de6e","year":1908},"citing_paper":{"arxiv_id":"2302.04023","last_updated":"2023-11-28T09:01:12Z","snapshot_observed_at":"2026-08-07T14:17:12.140094Z","submitted_at":"2023-02-08T12:35:34Z","title":"A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T19:58:48.066562Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2302.04023"},"observation_digest":"sha256:c48f258733ac05203a2e4d0e7ef03e054f00c81bc45730333eacbb420e5c69fd","observation_id":"67de0736-678d-41c7-b20d-abf295c31a6c","resolution":{"observed_at":"2026-05-17T19:58:48.132125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-08-07T05:37:02.501468Z","title":"Sinha, S","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.07501","last_updated":"2025-06-09T07:26:47Z","snapshot_observed_at":"2026-08-09T07:37:37.211419Z","submitted_at":"2025-06-09T07:26:47Z","title":"Graph-of-Causal Evolution: Challenging Chain-of-Model for Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:37:02.501468Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2506.07501"},"observation_digest":"sha256:51a5f5c5f3c119ddd702071171c90401b6944264b88fd9042c860b59305218f9","observation_id":"29a4fef6-7651-49b6-a773-479980ce5c6b","resolution":{"observed_at":"2026-08-07T05:37:02.501468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-08-06T04:33:36.559851Z","title":"Clutrr: A diagnostic benchmark for inductive reasoning from text","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2508.03366","last_updated":"2025-08-05T12:14:32Z","snapshot_observed_at":"2026-08-09T12:19:44.746526Z","submitted_at":"2025-08-05T12:14:32Z","title":"A Comparative Study of Neurosymbolic AI Approaches to Interpretable Logical Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T04:33:36.559851Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2508.03366"},"observation_digest":"sha256:95885589930ac36747c6459e86ccd895a9605e24260a09ed8b6512a66f1fd055","observation_id":"3f9015cc-7a64-4831-b3b2-83f33f1acdc6","resolution":{"observed_at":"2026-08-06T04:33:36.559851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-08-05T20:19:26.281676Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.10777","last_updated":"2025-08-14T16:01:10Z","snapshot_observed_at":"2026-08-07T17:34:53.037498Z","submitted_at":"2025-08-14T16:01:10Z","title":"The Knowledge-Reasoning Dissociation: Fundamental Limitations of LLMs in Clinical Natural Language Inference","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T20:19:26.281676Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2508.10777"},"observation_digest":"sha256:064a21f1b115641248878ce9f900af77e767d3d215a480c4c2e259872719f22c","observation_id":"166b57ea-7d5a-4df8-9b45-0f307d17155a","resolution":{"observed_at":"2026-08-05T20:19:26.281676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":"1908.06177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-07-02T20:57:23.984225Z","title":"Clutrr: A diagnostic benchmark for inductive reasoning from text","venue":null,"work_id":"68256d87-be6d-4efa-9bcc-daf3b840de6e","year":1908},"citing_paper":{"arxiv_id":"2511.02627","last_updated":"2026-06-11T15:36:40Z","snapshot_observed_at":"2026-08-08T22:40:29.987506Z","submitted_at":"2025-11-04T14:57:11Z","title":"DecompSR: A dataset for decomposed analyses of compositional multihop spatial reasoning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T01:18:44.523602Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2511.02627"},"observation_digest":"sha256:c7672a6804c1cd405b7d44ffec872d59fa4f6ccf800ef7e56fc348160ddfeb34","observation_id":"cf2c98ca-9ec7-44e2-9cfb-802b4e33a740","resolution":{"observed_at":"2026-05-18T01:20:34.428264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-08-04T00:11:52.045761Z","title":"Clutrr: A diagnostic benchmark for inductive reasoning from text","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2511.02627","last_updated":"2026-06-11T15:36:40Z","snapshot_observed_at":"2026-08-08T22:40:29.987506Z","submitted_at":"2025-11-04T14:57:11Z","title":"DecompSR: A dataset for decomposed analyses of compositional multihop spatial reasoning","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T00:11:52.045761Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2511.02627"},"observation_digest":"sha256:6e8f798b8e8cead4de3ffd03f8697bc07cd122e67846762276d29e05783e2a68","observation_id":"f1262741-742d-46bd-9a07-e678af826b99","resolution":{"observed_at":"2026-08-04T00:11:52.045761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":"1908.06177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-07-02T20:57:23.984225Z","title":"Clutrr: A diagnostic benchmark for inductive reasoning from text","venue":null,"work_id":"68256d87-be6d-4efa-9bcc-daf3b840de6e","year":1908},"citing_paper":{"arxiv_id":"2604.12426","last_updated":"2026-04-14T08:16:49Z","snapshot_observed_at":"2026-07-06T23:00:37.144068Z","submitted_at":"2026-04-14T08:16:49Z","title":"Do Transformers Use their Depth Adaptively? Evidence from a Relational Reasoning Task","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:02.796850Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2604.12426"},"observation_digest":"sha256:6b137223048baf5d549930e074f8269b421f357ff7f8afcdf598d41fd938f14b","observation_id":"265b363a-d799-4ec7-a651-a82870d5be20","resolution":{"observed_at":"2026-05-11T10:16:07.545195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":"1908.06177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-07-02T20:57:23.984225Z","title":"Clutrr: A diagnostic benchmark for inductive reasoning from text","venue":null,"work_id":"68256d87-be6d-4efa-9bcc-daf3b840de6e","year":1908},"citing_paper":{"arxiv_id":"2606.08068","last_updated":"2026-07-08T15:21:39Z","snapshot_observed_at":"2026-07-12T14:47:31.355938Z","submitted_at":"2026-06-06T09:33:32Z","title":"DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-27T19:58:32.016341Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2606.08068"},"observation_digest":"sha256:de069f71af7fa7df9510ad311ae9b4d303dfbe36251481685326146a03f9c557","observation_id":"3da4fc31-ca78-4f37-9e84-4a7f609f8bcd","resolution":{"observed_at":"2026-07-02T20:57:23.985716Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text","version":2},"cited_work":{"arxiv_id":"1908.06177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06177","snapshot_observed_at":"2026-07-02T20:57:23.984225Z","title":"Clutrr: A diagnostic benchmark for inductive reasoning from text","venue":null,"work_id":"68256d87-be6d-4efa-9bcc-daf3b840de6e","year":1908},"citing_paper":{"arxiv_id":"2606.29278","last_updated":"2026-06-28T08:56:34Z","snapshot_observed_at":"2026-08-09T23:39:02.701504Z","submitted_at":"2026-06-28T08:56:34Z","title":"The Complexity Ceiling Benchmark: A Multi-Domain Evaluation of Sequential Reasoning Under Depth Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T07:37:38.371341Z"},"links":{"cited_paper":"/paper/1908.06177","citing_paper":"/paper/2606.29278"},"observation_digest":"sha256:71277958ce15cec8d626d2b8431fd4577d4d614305d699a4b31166e8928926d1","observation_id":"6aa2899d-1f28-4e4a-9ac1-4207623cdaf4","resolution":{"observed_at":"2026-06-30T07:44:22.080918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.06177/citation-record","integrity":"/paper/1908.06177/integrity","json":"/paper/1908.06177/citation-record.json","paper":"/paper/1908.06177"},"outbound":[],"paper":{"arxiv_id":"1908.06177","last_updated":"2019-09-04T00:14:56Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T06:01:21.997422Z","submitted_at":"2019-08-16T21:12:15Z","title":"CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:1908.06177."}