{"as_of":"2026-08-10T12:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef5f2924e552a9c977e2a6ceb3ee2f80e6a33bcd0ed71a7db635fc5d6e36f859","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:25:16.820859Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":45,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-16T07:02:53.740597Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2402.17762"},"observation_digest":"sha256:f47ec30ebdf2a6a0741d624d93bc6c5928a1910c081fbfc797a92b8b675c8b08","observation_id":"9587bdfb-4457-41ac-a217-9877c405cf5a","resolution":{"observed_at":"2026-05-16T07:02:53.839680Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-08T20:25:16.820859Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.820859Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:c9ed7151eda425c137f65bf28d1d751ff51a72e4c6b59ea800131219670c3a9c","observation_id":"cc7a17b9-e075-4884-95d5-0a71615f0d35","resolution":{"observed_at":"2026-08-08T20:25:16.820859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-07T18:32:14.589213Z","title":"K., Catt, E., Cundy, C., Hutter, M., Legg, S., Veness, J., and Ortega, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10390","last_updated":"2025-07-08T18:20:16Z","snapshot_observed_at":"2026-08-08T23:23:47.910559Z","submitted_at":"2025-02-14T18:59:40Z","title":"(How) Can Transformers Predict Pseudo-Random Numbers?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T18:32:14.589213Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2502.10390"},"observation_digest":"sha256:7d2ee8376160af74f82b3cab73ec9f9284fdb96b052eb53e2d919f3895a70418","observation_id":"9a754838-2723-4bb3-ba5a-0c787cd333e3","resolution":{"observed_at":"2026-08-07T18:32:14.589213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-07T15:42:28.200668Z","title":"arXiv preprint arXiv:2207.02098","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14178","last_updated":"2025-05-20T10:32:30Z","snapshot_observed_at":"2026-08-08T23:25:27.533968Z","submitted_at":"2025-05-20T10:32:30Z","title":"Tokenization Constraints in LLMs: A Study of Symbolic and Arithmetic Reasoning Limits","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:28.200668Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2505.14178"},"observation_digest":"sha256:5c254184177ae758bf25482656c2ddab9674f0930d846d1412ec3b88bcf1c749","observation_id":"2ae0fda0-8c58-48b0-9b04-203c46098115","resolution":{"observed_at":"2026-08-07T15:42:28.200668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-07T13:52:57.660079Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21024","last_updated":"2025-05-27T10:59:27Z","snapshot_observed_at":"2026-08-08T23:24:40.031957Z","submitted_at":"2025-05-27T10:59:27Z","title":"Pause Tokens Strictly Increase the Expressivity of Constant-Depth Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:52:57.660079Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2505.21024"},"observation_digest":"sha256:887b257b40e1bb6b390454a5d9dd21d6b907cf17618c40f1117ac0c303ff1445","observation_id":"fba3e2d5-644a-4db5-ae8a-b74125ce4d24","resolution":{"observed_at":"2026-08-07T13:52:57.660079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T15:54:33.911739Z","title":"Neural networks and the chomsky hierarchy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.911739Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:27f32137551a275533b8f9911c51d5749af92f6cee05232f1fef174ab7975d41","observation_id":"329e5830-fad8-4f8b-95a5-1353a9b0c8d9","resolution":{"observed_at":"2026-08-06T15:54:33.911739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2602.01651","last_updated":"2026-04-21T07:48:12Z","snapshot_observed_at":"2026-07-06T22:44:04.951815Z","submitted_at":"2026-02-02T05:11:48Z","title":"On the Spatiotemporal Dynamics of Generalization in Neural Networks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T08:59:44.016444Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.01651"},"observation_digest":"sha256:701b097b6fff82643f09ee1dae514f95dba5cc2b875c084ca2f3c0184104fce5","observation_id":"06718ac3-ac32-4447-8052-ddd5fcdbb80d","resolution":{"observed_at":"2026-05-16T09:00:46.926324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2602.01651","last_updated":"2026-04-21T07:48:12Z","snapshot_observed_at":"2026-07-06T22:44:04.951815Z","submitted_at":"2026-02-02T05:11:48Z","title":"On the Spatiotemporal Dynamics of Generalization in Neural Networks","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T08:59:44.016444Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.01651"},"observation_digest":"sha256:aa1b2c1ac5c514ccc03cf1511c5641737729ac0fcf3936c63dab11f046577298","observation_id":"d8c92058-80df-4b09-89fa-f9243a9b5e3c","resolution":{"observed_at":"2026-05-16T09:00:46.842573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2602.14814","last_updated":"2026-06-25T13:57:14Z","snapshot_observed_at":"2026-08-03T04:41:03.080168Z","submitted_at":"2026-02-16T15:07:51Z","title":"Learning State-Tracking from Code Using Linear RNNs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T21:46:14.287966Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.14814"},"observation_digest":"sha256:78fc902f4eb30ee0fbab88a6117535acd117c53f7901a4b6b2b30a6c2d401a7b","observation_id":"1f4b19a2-3595-4ff4-8700-8485d6bd1af2","resolution":{"observed_at":"2026-05-15T21:46:42.396411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-02T23:07:48.383042Z","title":"Neural networks and the chomsky hierarchy.arXiv preprint arXiv:2207.02098,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14814","last_updated":"2026-06-25T13:57:14Z","snapshot_observed_at":"2026-08-03T04:41:03.080168Z","submitted_at":"2026-02-16T15:07:51Z","title":"Learning State-Tracking from Code Using Linear RNNs","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T23:07:48.383042Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.14814"},"observation_digest":"sha256:abb8fb01dcc7d92015066397af0ffddf91610cad13c1b0fe5eadf42f50f47509","observation_id":"55b3aac6-e2e2-484a-82a6-302fff22421c","resolution":{"observed_at":"2026-08-02T23:07:48.383042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2603.29069","last_updated":"2026-04-05T18:40:06Z","snapshot_observed_at":"2026-08-07T17:56:32.986328Z","submitted_at":"2026-03-30T23:15:21Z","title":"On the Mirage of Long-Range Dependency, with an Application to Integer Multiplication","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:07:37.032208Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2603.29069"},"observation_digest":"sha256:6735490c2c576b007be2e629ffc8a3c7750474a7ee4e6680d2715db7bf0f4160","observation_id":"20396610-611d-4af0-a19f-af52bf915311","resolution":{"observed_at":"2026-05-14T21:09:28.840810Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2603.29069","last_updated":"2026-04-05T18:40:06Z","snapshot_observed_at":"2026-08-07T17:56:32.986328Z","submitted_at":"2026-03-30T23:15:21Z","title":"On the Mirage of Long-Range Dependency, with an Application to Integer Multiplication","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T21:07:37.032208Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2603.29069"},"observation_digest":"sha256:eca51f97228fc6e2a4f1047bed47bc41ed942b2ee8a9b7123aa044d992da689b","observation_id":"10ba4387-91fc-4f01-bb13-f929f5e69e90","resolution":{"observed_at":"2026-05-14T21:07:57.561296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.02709","last_updated":"2026-04-15T09:12:39Z","snapshot_observed_at":"2026-07-06T22:52:02.162758Z","submitted_at":"2026-04-03T04:06:39Z","title":"Evaluating the Formal Reasoning Capabilities of Large Language Models through Chomsky Hierarchy","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T19:51:08.304741Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.02709"},"observation_digest":"sha256:596759613f23de48803e87403920f3a941b589853e089030c69db385c16e2ff6","observation_id":"77495dcc-7142-4e6f-8538-26e47c84272e","resolution":{"observed_at":"2026-05-13T19:53:11.720559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.05923","last_updated":"2026-04-07T14:23:40Z","snapshot_observed_at":"2026-08-04T01:48:44.289003Z","submitted_at":"2026-04-07T14:23:40Z","title":"The UNDO Flip-Flop: A Controlled Probe for Reversible Semantic State Management in State Space Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:45:35.405345Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.05923"},"observation_digest":"sha256:cecf4744c22fd4260c4fafa7e670399ae774d7bbd41e8d9ad82661c7960853de","observation_id":"d6b88308-941f-4524-ba35-e3d20bc1e7a3","resolution":{"observed_at":"2026-05-11T00:00:52.685816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.17857","last_updated":"2026-04-21T13:11:34Z","snapshot_observed_at":"2026-07-06T23:04:50.935335Z","submitted_at":"2026-04-20T06:10:50Z","title":"On the Emergence of Syntax by Means of Local Interaction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T04:16:41.473079Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.17857"},"observation_digest":"sha256:974a265b4cb0014f9dc3fdcad9c972bc3b023b7b41fa4c6de5eb909e7632a4d6","observation_id":"72b419aa-a2d4-4bb5-88a1-35e9e472be13","resolution":{"observed_at":"2026-05-11T12:06:01.188483Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.17857","last_updated":"2026-04-21T13:11:34Z","snapshot_observed_at":"2026-07-06T23:04:50.935335Z","submitted_at":"2026-04-20T06:10:50Z","title":"On the Emergence of Syntax by Means of Local Interaction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T04:16:41.473079Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.17857"},"observation_digest":"sha256:76599d5fa64f8dcfa3189466ea05058784d0a78c092736ed7b6c5b1ab33103b8","observation_id":"67cbd6e7-d1cd-4808-8b23-38c9eb27eb6d","resolution":{"observed_at":"2026-05-10T04:20:03.855745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2605.05209","last_updated":"2026-07-26T22:32:59Z","snapshot_observed_at":"2026-08-02T17:39:23.922835Z","submitted_at":"2026-03-24T06:14:05Z","title":"Are Flat Minima an Illusion?","version":1},"reference_index":158,"source":"arxiv_source","source_observed_at":"2026-05-15T01:13:22.708879Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2605.05209"},"observation_digest":"sha256:7f755a486d732c23b2aaf17e783543b6a244c1f4eec23d366b7c8febbb14ce10","observation_id":"3d641c26-44ee-461d-ace5-56ec90d59821","resolution":{"observed_at":"2026-05-15T01:13:25.571490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2605.21070","last_updated":"2026-05-20T11:56:15Z","snapshot_observed_at":"2026-07-06T23:31:32.577242Z","submitted_at":"2026-05-20T11:56:15Z","title":"Towards Understanding Self-Pretraining for Sequence Classification","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-21T05:29:58.809024Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2605.21070"},"observation_digest":"sha256:fa5b3f0f1e788ff30e893a2d30fcc29cf26fbdb8a3351ee38ecdff0a2c1e08c1","observation_id":"03d7fee1-fb6d-4723-9779-457208bf9df0","resolution":{"observed_at":"2026-05-21T05:33:58.277977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2606.21884","last_updated":"2026-06-20T04:52:14Z","snapshot_observed_at":"2026-08-03T01:34:19.883808Z","submitted_at":"2026-06-20T04:52:14Z","title":"A Verifiable Search Is Not a Learnable Chain-of-Thought","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T12:35:20.698118Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2606.21884"},"observation_digest":"sha256:6717940b47998303fb977bf7180d3cc34adc0d83550bf590bded2ae463873e22","observation_id":"aa4c173d-c551-495f-b31a-cd5e858cc075","resolution":{"observed_at":"2026-07-04T07:49:39.740648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-02T07:20:41.199053Z","title":"Del\\'etang, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11953","last_updated":"2026-08-06T23:25:08Z","snapshot_observed_at":"2026-08-10T11:09:46.799766Z","submitted_at":"2026-07-11T21:33:32Z","title":"When Does Reward Teach State? A Hidden-Automaton Instrument and a Group-Language Warning Signal","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T07:20:41.199053Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2607.11953"},"observation_digest":"sha256:12a5a8073194eb3e2b84a82941cc07fc4125be10524f1e47558924772cb3b3f7","observation_id":"3ec6d875-a65b-4b1b-ab40-7243740a6c55","resolution":{"observed_at":"2026-08-02T07:20:41.199053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T00:43:14.297280Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00981","last_updated":"2026-08-02T04:15:12Z","snapshot_observed_at":"2026-08-08T23:24:38.455242Z","submitted_at":"2026-08-02T04:15:12Z","title":"Auditing Discovery Claims: A Two-Sided Criterion for Agentic Science, with the Negative Side Decidable","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:43:14.297280Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2608.00981"},"observation_digest":"sha256:ccc6639f7d822119cb66348eefb224dc124f9b540ad7e5d621adffb8341bcd2b","observation_id":"b0bd34aa-0379-4d8c-b17f-884719b758cf","resolution":{"observed_at":"2026-08-06T00:43:14.297280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T00:53:43.296195Z","title":"arXiv , arxivId =:2207.02098 , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01005","last_updated":"2026-08-02T05:22:30Z","snapshot_observed_at":"2026-08-09T21:40:34.223681Z","submitted_at":"2026-08-02T05:22:30Z","title":"Hierarchical Solomonoff Induction: An Unbounded Machine Learning Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:53:43.296195Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2608.01005"},"observation_digest":"sha256:17f411683cbdbd7e9a06c4e1e67da860baa79818393bd0b0e6f458055c86dd23","observation_id":"5c23beb0-9782-4913-90ed-9b1e19e59119","resolution":{"observed_at":"2026-08-06T00:53:43.296195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2207.02098/citation-record","integrity":"/paper/2207.02098/integrity","json":"/paper/2207.02098/citation-record.json","paper":"/paper/2207.02098"},"outbound":[],"paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2207.02098."}