{"as_of":"2026-08-10T09:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3642b7065d5d718e39abfb576df13f471e07809d304d889f9e163e77d24659a","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:04.580971Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:14:30.601345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:14:36.059388Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"cited_work":{"arxiv_id":"2505.14467","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14467","snapshot_observed_at":"2026-08-06T19:14:36.059388Z","title":"Void in Language Models","venue":"cs.CL","work_id":"786753f2-1be4-478a-a39c-6e2b3081a15b","year":2025},"citing_paper":{"arxiv_id":"2507.06203","last_updated":"2025-07-10T16:43:36Z","snapshot_observed_at":"2026-08-07T04:57:37.201438Z","submitted_at":"2025-07-08T17:29:07Z","title":"A Survey on Latent Reasoning","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:30.601345Z"},"links":{"cited_paper":"/paper/2505.14467","citing_paper":"/paper/2507.06203"},"observation_digest":"sha256:8185cee1d9acc723b790a076116ac428ffec8dcee4a373a8c6968707c50c4608","observation_id":"69447c7f-8dad-4d53-bf91-c317bd6ff894","resolution":{"observed_at":"2026-08-06T19:14:36.150323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14467/citation-record","integrity":"/paper/2505.14467/integrity","json":"/paper/2505.14467/citation-record.json","paper":"/paper/2505.14467"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-07T15:36:58.593864Z","title":"Alain and Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:58.593864Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:9a14c1b11201956638a590cdd448cb5cbb82c69095d7048012993f0a410c9369","observation_id":"fa4bd15f-d49d-4209-8da2-9ded7e238591","resolution":{"observed_at":"2026-08-07T15:36:58.593864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-08-10T06:51:08.792800Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-07T15:36:58.718951Z","title":"Banino, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:58.718951Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:80da20ff834ae23cecc09d6bf75c5517ac257ef3e4412f14c4a75ba980182432","observation_id":"873463b9-15c2-4b66-95bc-6faf0e095f12","resolution":{"observed_at":"2026-08-07T15:36:58.718951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06297","last_updated":"2016-01-07T22:41:10Z","snapshot_observed_at":"2026-08-04T23:18:10.428920Z","submitted_at":"2015-11-19T18:40:22Z","title":"Conditional Computation in Neural Networks for faster models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06297","snapshot_observed_at":"2026-08-07T15:36:58.892257Z","title":"Bengio, P.-L","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:58.892257Z"},"links":{"cited_paper":"/paper/1511.06297","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:df620eab47759ea6655a6b3991f36982466e7e762039600514f79d7f18c61d22","observation_id":"a2c6184e-205c-4cf4-beac-e7d7ec37ba99","resolution":{"observed_at":"2026-08-07T15:36:58.892257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.07811","last_updated":"2017-09-18T18:14:49Z","snapshot_observed_at":"2026-08-07T05:33:13.101914Z","submitted_at":"2017-02-25T00:22:51Z","title":"Adaptive Neural Networks for Efficient Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.07811","snapshot_observed_at":"2026-08-07T15:36:59.079696Z","title":"Bolukbasi, J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.079696Z"},"links":{"cited_paper":"/paper/1702.07811","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:c78a4e34fc92cfb7f80133eee7f2a5ec81050cfd56ad07aabad7a7c1b8a6d8c9","observation_id":"ed75a120-24b3-4c15-b6e8-305eae4c7ad2","resolution":{"observed_at":"2026-08-07T15:36:59.079696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:59.256134Z","title":"Bricken, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.256134Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:67a8ca33f4a7f1dc88792f263d1e7f7fa9e9180f117c89f6f5aeb5ff80580026","observation_id":"f352b557-6218-4bb7-a1c8-0510b25aee15","resolution":{"observed_at":"2026-08-07T15:36:59.256134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-07T15:36:59.383392Z","title":"Burns, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.383392Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:767e91c0700e3b0f52d3c57ff9e7d5a215ac874e4e81e4c8284a6f9a862f1554","observation_id":"4988c437-5448-4fe1-9cc8-c204ebbebaf3","resolution":{"observed_at":"2026-08-07T15:36:59.383392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:59.550543Z","title":"Clark, K","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.550543Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:815d0661c947324cbaa97b7d029cdf31738453c6b92aaa3f18f050e86d95ea64","observation_id":"a4d64958-c875-4326-b58f-ccf4c90a500e","resolution":{"observed_at":"2026-08-07T15:36:59.550543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:36:59.676912Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.676912Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:c2cf9f69458a026b1b93ec2bb783e841a4c6741d9082cf5ed2b2944f8f083c70","observation_id":"7b673a29-efd3-42cc-84c9-18a63d6fb633","resolution":{"observed_at":"2026-08-07T15:36:59.676912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03819","last_updated":"2019-03-05T16:46:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-07-10T18:39:15Z","title":"Universal Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03819","snapshot_observed_at":"2026-08-07T15:36:59.848221Z","title":"Dehghani, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.848221Z"},"links":{"cited_paper":"/paper/1807.03819","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:9d46d5fd7073f0838b1d8f26fb6c4ac52a71948e9955c7a0ae1ec1e568556542","observation_id":"99f24031-3ea8-46cd-99aa-9d3d58ceff61","resolution":{"observed_at":"2026-08-07T15:36:59.848221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.12894","last_updated":"2022-03-16T13:27:44Z","snapshot_observed_at":"2026-08-05T04:07:00.934919Z","submitted_at":"2021-10-25T12:48:07Z","title":"The Efficiency Misnomer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.12894","snapshot_observed_at":"2026-08-07T15:36:59.994585Z","title":"Dehghani, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.994585Z"},"links":{"cited_paper":"/paper/2110.12894","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:2543c45a1fe59dbb20e3cdd3c871637bc1690eda065d05354878b9d1eae4213c","observation_id":"7e545c32-27ef-4436-acf9-f6d6a3c7699c","resolution":{"observed_at":"2026-08-07T15:36:59.994585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:06.488399Z","title":"Elhage, N","venue":null,"work_id":"ab7283d5-33b9-4bfb-8115-d87230742d2b","year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.147782Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:3fafdffd53ce2267607d4acc0e9bddcbecb62ed02c40458a551f277848d67b53","observation_id":"e53f27bf-7c6a-4825-8c69-014cfcdcb76a","resolution":{"observed_at":"2026-08-07T15:37:06.623108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:00.287721Z","title":"Elhage, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.287721Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:560869f882ece32268eff3cd175c8b818bcdd562966afad421fd8c9c0a9a0dfd","observation_id":"5cf928c6-d24b-4434-a01a-a8af82747cac","resolution":{"observed_at":"2026-08-07T15:37:00.287721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-07T23:50:29.977330Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-07T15:37:00.457635Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.457635Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:21c5aadcc9afc03445cb0ab8d0c4c9b18a3731463927b6351e58b1afc42d4b03","observation_id":"699d5a3d-af2d-4962-a4ec-c0584f4b90c3","resolution":{"observed_at":"2026-08-07T15:37:00.457635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:37:00.573191Z","title":"Grattafiori, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.573191Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:e8de1ad33bfc1ae2bf2669b85cad2dc7ace86f495251057c20851c45022f8462","observation_id":"0fb6e4f7-512b-41aa-b566-e3e45f482c9e","resolution":{"observed_at":"2026-08-07T15:37:00.573191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.08983","last_updated":"2017-02-21T16:21:21Z","snapshot_observed_at":"2026-08-04T14:24:45.814840Z","submitted_at":"2016-03-29T22:09:00Z","title":"Adaptive Computation Time for Recurrent Neural Networks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.08983","snapshot_observed_at":"2026-08-07T15:37:00.706705Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.706705Z"},"links":{"cited_paper":"/paper/1603.08983","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:a2e96d64e538c053c9d288f34ffd355c15b87fe901d353b365517a43fa529bd6","observation_id":"99e85293-965a-4eb8-8aa9-dc16056883d8","resolution":{"observed_at":"2026-08-07T15:37:00.706705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17887","last_updated":"2025-03-03T17:02:05Z","snapshot_observed_at":"2026-08-03T06:33:46.668360Z","submitted_at":"2024-03-26T17:20:04Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17887","snapshot_observed_at":"2026-08-07T15:37:00.813610Z","title":"Gromov, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.813610Z"},"links":{"cited_paper":"/paper/2403.17887","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:200e824569c409be3f9ca6075b897f5acfe5ef1a463748c5f42c74570d1b98f7","observation_id":"16d7c48b-a93a-4468-b8f5-be1252e80b84","resolution":{"observed_at":"2026-08-07T15:37:00.813610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01610","last_updated":"2023-06-02T21:52:17Z","snapshot_observed_at":"2026-08-09T07:24:01.957644Z","submitted_at":"2023-05-02T17:13:55Z","title":"Finding Neurons in a Haystack: Case Studies with Sparse Probing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01610","snapshot_observed_at":"2026-08-07T15:37:00.997871Z","title":"Gurnee, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.997871Z"},"links":{"cited_paper":"/paper/2305.01610","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:1c87b89e73dc4bc5daa35b350381f31de355483f44aed58b3402d684c4e3a760","observation_id":"e2b6e765-9c95-40d3-b93b-fc305eb639bd","resolution":{"observed_at":"2026-08-07T15:37:00.997871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:01.138851Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.138851Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:56b24c0281072fe9b88137ecf49567b885a6b38aa25da35dc384f99cd9477713","observation_id":"73fd28a1-4874-4559-9c0f-a983582ad277","resolution":{"observed_at":"2026-08-07T15:37:01.138851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:06.219936Z","title":"Hassibi and D","venue":null,"work_id":"67fbb9a0-ea51-45a1-bade-faf0df2ef9cf","year":1992},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.247365Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:f8ff80075f1744c76c7440651243e63c52d406da728f688007e38ede8845b7f1","observation_id":"d4da5a8c-3571-4919-962c-a5864b03eec8","resolution":{"observed_at":"2026-08-07T15:37:06.358221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:37:01.373996Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.373996Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:c8fcb2df293d14d9517df543eede95597223c30d00b36297da828768e84a2eb3","observation_id":"cac6ffb8-b734-499c-b8c2-24184107b073","resolution":{"observed_at":"2026-08-07T15:37:01.373996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T15:37:01.524522Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.524522Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:eb40dd7d62e51302798268f1b365757edc2c351e7c19929ba329bd1a3073ca0b","observation_id":"76cb7536-47c9-4911-a77d-6366df234cae","resolution":{"observed_at":"2026-08-07T15:37:01.524522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T15:37:01.642796Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.642796Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:987d58d0c2c6200088267ffac4d60f81b806e5a38e9361b80c13ca67b941d787","observation_id":"6a774c97-4270-4b0d-984e-faca2dc620cd","resolution":{"observed_at":"2026-08-07T15:37:01.642796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07066","last_updated":"2025-02-04T23:34:30Z","snapshot_observed_at":"2026-07-06T17:58:21.138881Z","submitted_at":"2024-04-10T14:56:40Z","title":"Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07066","snapshot_observed_at":"2026-08-07T15:37:01.788971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.788971Z"},"links":{"cited_paper":"/paper/2404.07066","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:3c3b28232d9d4c9396534f7ce5cab85e4190c103c99fb9a1b6f576ec1430475b","observation_id":"c5f99ce4-bf40-445a-88f4-8be739c36be6","resolution":{"observed_at":"2026-08-07T15:37:01.788971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16061","last_updated":"2024-03-04T13:37:48Z","snapshot_observed_at":"2026-07-06T17:35:06.195492Z","submitted_at":"2024-02-25T11:15:42Z","title":"How Large Language Models Encode Context Knowledge? A Layer-Wise Probing Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16061","snapshot_observed_at":"2026-08-07T15:37:01.925027Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.925027Z"},"links":{"cited_paper":"/paper/2402.16061","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:c8b5c0374a38bcc1fffc3db519eac013fc57d18131e210effc839b1f0a942aff","observation_id":"3b0338e5-80cd-44b8-ad9b-cfc5141bdac2","resolution":{"observed_at":"2026-08-07T15:37:01.925027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:02.080694Z","title":"LeCun, J","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.080694Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:3898bccc708f6f3f056e2b8f838c458b95922108bb668474c695b5020a70e024","observation_id":"51613cad-122e-4d84-bd57-e6c7448a835f","resolution":{"observed_at":"2026-08-07T15:37:02.080694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-08-09T05:37:48.140401Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-07T15:37:02.184716Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.184716Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:d7bae5e8dbd7a455a332b816b61fa99927d48259e5e361be4588b8ad73a235d7","observation_id":"954a902c-d72d-4bf2-812d-dc96f9ab562c","resolution":{"observed_at":"2026-08-07T15:37:02.184716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.974669Z","title":null,"venue":null,"work_id":"df305e92-af12-4771-b89e-03076f3b5a85","year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.304092Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:9ed0a081e4930ccc87b04040f586f22cacd546c2d50c24450849b71a1376b6cf","observation_id":"033825a1-161c-4ec3-982f-71526440366c","resolution":{"observed_at":"2026-08-07T15:37:06.062736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-07T15:37:02.405282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.405282Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:93876e513a9f85be537d1306bb1249b11bb7a7ec9136cb314098200148ac4e88","observation_id":"e6068d21-b904-4db1-9306-5cf52e15ecf8","resolution":{"observed_at":"2026-08-07T15:37:02.405282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T15:37:02.531472Z","title":"Jaech, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.531472Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:bdecaafd2d08ac960ae643fbbe502436aeb2cb93fef3cc0db9ff15eed02d3ea6","observation_id":"70260c7e-1ff2-4b86-824b-445cf1d788cc","resolution":{"observed_at":"2026-08-07T15:37:02.531472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02707","last_updated":"2025-05-18T11:18:56Z","snapshot_observed_at":"2026-08-04T21:25:41.967552Z","submitted_at":"2024-10-03T17:31:31Z","title":"LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02707","snapshot_observed_at":"2026-08-07T15:37:02.661844Z","title":"Orgad, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.661844Z"},"links":{"cited_paper":"/paper/2410.02707","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:7953082517c24cde87e2c739fcfcb559ce6dbfcd5156bc2a8ded84c89ce586b2","observation_id":"cbed722c-36f6-499c-813b-3ad124f2d2c1","resolution":{"observed_at":"2026-08-07T15:37:02.661844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:37:02.773561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.773561Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:33999760c96003f970f71ca97fcd27325684ff3d9de1ecd07d05a8c77171b199","observation_id":"5a508e4b-50c5-47bd-8fae-0ffd065e86f6","resolution":{"observed_at":"2026-08-07T15:37:02.773561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T15:37:02.889990Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.889990Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:937bead4555fb8e804ea1ba04d76165a85c5e92aa7eab1bfd661ef441e6b3f4c","observation_id":"378ba57e-98b1-4dfc-be1b-6ae9a82c9ff7","resolution":{"observed_at":"2026-08-07T15:37:02.889990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.07061","last_updated":"2022-10-25T17:44:17Z","snapshot_observed_at":"2026-08-09T09:00:50.082830Z","submitted_at":"2022-07-14T17:00:19Z","title":"Confident Adaptive Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.07061","snapshot_observed_at":"2026-08-07T15:37:03.036731Z","title":"Schuster, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.036731Z"},"links":{"cited_paper":"/paper/2207.07061","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:7a39357964a0ad5f14729a916d697aabacb802146d323fa3e66a97220eb0a8de","observation_id":"22378bbd-5427-4fc9-afa4-e41b9c43a8ed","resolution":{"observed_at":"2026-08-07T15:37:03.036731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.692272Z","title":"Shemiranifar and M","venue":null,"work_id":"5586e636-8859-40b2-97d5-4aa16b701f9b","year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.146130Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:e7287da38bc5d18eaf44ebfa99176b4c01b945a2584dd89a9305521879feaa29","observation_id":"88d18ae0-28a9-42ec-9219-74f5fab10ff8","resolution":{"observed_at":"2026-08-07T15:37:05.825349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:03.244485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.244485Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:5d218a036df5126058b8a55f44f37005cddfe46d20b44de3177b718963e21a5f","observation_id":"53f15bcb-6371-489e-8537-0aee4671e112","resolution":{"observed_at":"2026-08-07T15:37:03.244485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:03.387903Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.387903Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:6d900928c690ba3b1828f34235313b84549c01d1dc0c90ecdb6e1f8e66e8a9c7","observation_id":"2845dc95-6ca7-4b1c-a3aa-8649f4756add","resolution":{"observed_at":"2026-08-07T15:37:03.387903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-07T15:37:03.554660Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.554660Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:4531ab990a0f0bcb138681c363b0fc42a40304bfd0b78c6c7420a91d2db82601","observation_id":"498a66e8-0e85-4739-925d-87adffcf6165","resolution":{"observed_at":"2026-08-07T15:37:03.554660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09485","last_updated":"2018-07-25T06:13:24Z","snapshot_observed_at":"2026-08-10T06:44:38.358608Z","submitted_at":"2017-11-26T23:03:37Z","title":"SkipNet: Learning Dynamic Routing in Convolutional Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09485","snapshot_observed_at":"2026-08-07T15:37:03.691040Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.691040Z"},"links":{"cited_paper":"/paper/1711.09485","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:89839e2aaa1917acd6de996efac0c2ac1a8e0b95bb4290d77423940896e5d967","observation_id":"66c14716-2a6d-45fc-ba5d-5960b08d53b8","resolution":{"observed_at":"2026-08-07T15:37:03.691040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13195","last_updated":"2023-06-03T06:19:23Z","snapshot_observed_at":"2026-07-06T14:46:15.598295Z","submitted_at":"2023-01-30T18:57:24Z","title":"Adaptive Computation with Elastic Input Sequence","version":2},"cited_work":{"arxiv_id":"2301.13195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.13195","snapshot_observed_at":"2026-08-07T15:37:04.689538Z","title":"Adaptive Computation with Elastic Input Sequence","venue":"cs.LG","work_id":"3905184c-fa8a-4c0b-aa08-9daa272e75fb","year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.823949Z"},"links":{"cited_paper":"/paper/2301.13195","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:4820686318d95b915d1dc7b2b5176a1161c4822c5e83209509c5dfaca3c200b6","observation_id":"ba5a40a2-37ca-4cb3-b7c7-8d259ea5026a","resolution":{"observed_at":"2026-08-07T15:37:04.833566Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.390590Z","title":null,"venue":null,"work_id":"deb58c38-8134-4ca9-ba16-4109ae707c40","year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.936524Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:1dbb640968e941ec3e0d38bd304f203b696b76276f4c615e646ff0746a51ac5b","observation_id":"2d1085b8-4882-4933-9799-861253e4bc1e","resolution":{"observed_at":"2026-08-07T15:37:05.545002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18218","last_updated":"2024-10-20T09:10:25Z","snapshot_observed_at":"2026-08-06T18:43:32.229808Z","submitted_at":"2024-05-28T14:21:15Z","title":"FinerCut: Finer-grained Interpretable Layer Pruning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18218","snapshot_observed_at":"2026-08-07T15:37:04.051595Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.051595Z"},"links":{"cited_paper":"/paper/2405.18218","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:fba2c03055a18e94f2347c8f4bd364e50289cda88fd0b15f29f96cdd3e4106de","observation_id":"e0b856c5-8c56-4c34-b0c6-ca25d76a25b2","resolution":{"observed_at":"2026-08-07T15:37:04.051595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:04.187227Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.187227Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:604571fa62d2c35c2d0273d05d4097eabb7ee4fe0d5136e6ce765b422382f182","observation_id":"82be5ab9-4f8d-406e-8614-4458437a510a","resolution":{"observed_at":"2026-08-07T15:37:04.187227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:04.322961Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.322961Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:bba0b814ca79a8914f5807daa0159dbe9d7cf1818af5e0a8bdeb054936306af1","observation_id":"45edec69-fcdb-433c-bc2a-06c07cd192d8","resolution":{"observed_at":"2026-08-07T15:37:04.322961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:04.453416Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.453416Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:aad82a22f3e0df293c44f8f953e880b51cff49a772b1dfae6a2986dc08379649","observation_id":"4d88a3ae-cf5a-4200-89eb-a7d277597e5e","resolution":{"observed_at":"2026-08-07T15:37:04.453416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.149615Z","title":null,"venue":null,"work_id":"084e8a62-760c-41e1-ab58-fb946aae4449","year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.580971Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:f559551e8660e7f63f0a0e0cb5c1eab455d01db95fe3e837df2797464a90bfcd","observation_id":"7b5ddd7d-59ed-4262-908c-c997da406cb2","resolution":{"observed_at":"2026-08-07T15:37:05.209798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T08:50:01.183608Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2505.14467."}