{"as_of":"2026-08-11T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e72e6fd4a19e59158e9ce7d22b9322bec7e556ae95b97bab8fc7b409d4fef09","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:03:43.345768Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.15754/citation-record","integrity":"/paper/2501.15754/integrity","json":"/paper/2501.15754/citation-record.json","paper":"/paper/2501.15754"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:42.542763Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.542763Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:5eb8dfbde7b60085dad557e94d4cafb514cd7849ae7e75963c9bf739260ad94c","observation_id":"24dc94cc-d760-4637-92ea-c1f7e84fb235","resolution":{"observed_at":"2026-08-10T14:03:42.542763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:42.579708Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.579708Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:e7bbdf15cbe282df857f972c779616a86423c9d98599ec10f8e0f4deb3a1f2af","observation_id":"bb695136-734b-4f65-b61c-53523e75f538","resolution":{"observed_at":"2026-08-10T14:03:42.579708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-10T14:03:42.586331Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.586331Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:41474ea9ecee5a2547bcc3e96b55d7cb9ea59269dfd68e3de69a5832621f4d7c","observation_id":"cea35db0-79c9-460a-85f2-c868113cdb48","resolution":{"observed_at":"2026-08-10T14:03:42.586331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:44.003903Z","title":null,"venue":null,"work_id":"23d8bf0f-c669-49d5-80e5-8e594e1c8985","year":2020},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.592830Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:a3d6a52fa91c6a05f650bff455668b158066226818f0e61ddf38aa9ea364b7b0","observation_id":"a535cdda-ac1d-45a5-ad46-240fcda2c8f1","resolution":{"observed_at":"2026-08-10T14:03:44.009928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.982279Z","title":null,"venue":null,"work_id":"1f66ab54-b6be-424a-ba58-3181c7e4dc1b","year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.637789Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:4b71231876e064a08bdfa5addf009e7d7f2c0a72c8cfb2763f3b44dc1d41e0ff","observation_id":"c6299581-1b8d-47d2-97e0-5911664cbff4","resolution":{"observed_at":"2026-08-10T14:03:43.987774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:42.703983Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.703983Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:b7ffb9fb117581418c0e89af66ee3a11776f578ad654d13c78adf884c837c827","observation_id":"bf4c88f0-0c71-4070-a618-b6d4a2a0899f","resolution":{"observed_at":"2026-08-10T14:03:42.703983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:42.793852Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.793852Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:fcc18f175f5e7918bfba031e6c42e3ab4e4f96383d775f6cf1f5e96f11fe8f46","observation_id":"c1ea1772-d7b6-436e-97b7-40359d63bd30","resolution":{"observed_at":"2026-08-10T14:03:42.793852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T14:03:42.862567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.862567Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:3f186b89c5407c7658f7f48f8e4742f664c889fa4e3dee63516ebd493e2fd9d5","observation_id":"d98177b5-939d-4842-a70a-10a2496440c9","resolution":{"observed_at":"2026-08-10T14:03:42.862567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.967168Z","title":null,"venue":null,"work_id":"395049d8-6177-459c-9c9a-149b7f6a7198","year":2022},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:42.903067Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:16b2ee27db54c330939f7f4b70b5085a0410ef80a1cf797a7dd5f3645f46d7f5","observation_id":"d4d3545a-a627-4347-b579-558a527630fa","resolution":{"observed_at":"2026-08-10T14:03:43.971719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.952090Z","title":null,"venue":null,"work_id":"9d2e4798-612f-40a4-8561-109f7de22d1c","year":2021},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.022392Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:a86f4acebdafc93250f2bac87a4ab83130e959f7e627ac570295ccb4d8e3ae2f","observation_id":"7454dee0-b161-4979-bf9b-6448a8587dbc","resolution":{"observed_at":"2026-08-10T14:03:43.956739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T14:03:43.030057Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.030057Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:d8862a4adf7450c26bf02e8316d3bc130a808b25e572fa36ce520232d12346cf","observation_id":"abf0b690-ded1-4422-8822-52cef9d7953a","resolution":{"observed_at":"2026-08-10T14:03:43.030057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.036917Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.036917Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:4f3ddfb8e7765c19049c9192ab8a6c2281e5be215ba0ad7d47388a6e07cc8b0d","observation_id":"e825cefc-e02f-426a-acbd-2d1f8dc6d267","resolution":{"observed_at":"2026-08-10T14:03:43.036917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06102","last_updated":"2024-06-06T22:59:58Z","snapshot_observed_at":"2026-08-10T02:14:16.642058Z","submitted_at":"2024-01-11T18:33:48Z","title":"Patchscopes: A Unifying Framework for Inspecting Hidden Representations of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06102","snapshot_observed_at":"2026-08-10T14:03:43.046416Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.046416Z"},"links":{"cited_paper":"/paper/2401.06102","citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:80b3155441859c8f0869572a9fdfe1433820f798f85942231506948481aef986","observation_id":"fd8505d2-d600-43d6-80c1-aa7f0833d724","resolution":{"observed_at":"2026-08-10T14:03:43.046416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.936344Z","title":null,"venue":null,"work_id":"1ea6175f-fe82-485c-b832-a7b302bd4aaa","year":2019},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.053182Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:5f7bdd4ed33bacb9bfd64d7a4f2f1b8ab468921ac9a1826f983a6e3ebf96995d","observation_id":"e88232e9-21be-45f5-b16a-7b61163be9c6","resolution":{"observed_at":"2026-08-10T14:03:43.941399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.920348Z","title":null,"venue":null,"work_id":"96e129d1-6600-4035-936f-746bacd21f28","year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.060538Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:b63c5bdf7ecf980017ad659ca13717339d0df2d292aba6fed2e190ac593c8c8f","observation_id":"5ec628e5-3ac1-45c4-a455-c6f210ccf6a2","resolution":{"observed_at":"2026-08-10T14:03:43.925099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.065648Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.065648Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:d7850415dec17021c1658062c7baaae2464ddc26a90436f78ce18cd74bdbb25f","observation_id":"ab6a4c8f-a92d-4775-a3d9-2bc05707a4fe","resolution":{"observed_at":"2026-08-10T14:03:43.065648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.891134Z","title":null,"venue":null,"work_id":"e7a1d567-bbfe-47ce-a0dd-fa8fcd3a653d","year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.070835Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:20c004d009fc6ed3c124e069735784027ab2434508c6b114dd477c44bdec961d","observation_id":"25bfe736-040e-4c9e-875c-fb491126513b","resolution":{"observed_at":"2026-08-10T14:03:43.896837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13710","last_updated":"2024-11-17T22:32:53Z","snapshot_observed_at":"2026-07-06T19:18:53.582890Z","submitted_at":"2024-09-06T16:17:06Z","title":"You can remove GPT2's LayerNorm by fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13710","snapshot_observed_at":"2026-08-10T14:03:43.075377Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.075377Z"},"links":{"cited_paper":"/paper/2409.13710","citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:1f8427762d026102a8ca51bc8597f5b94b07bf03791cfcb42bcd1b3cb93b9461","observation_id":"8bee0277-3c9b-4745-a9f6-044593e18eb2","resolution":{"observed_at":"2026-08-10T14:03:43.075377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.873841Z","title":null,"venue":null,"work_id":"31768830-1890-47df-91b4-b68b8d6807c7","year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.141764Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:936c35803c50917a6a58aefe3c0297dc03adf9925f36ee5f13c74a82410a1e0e","observation_id":"725517e3-2464-44a5-932e-b9a43d54dcad","resolution":{"observed_at":"2026-08-10T14:03:43.879013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.206415Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.206415Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:6801cc468b7cf925cec8be9e8248fc7a77ee74943c489f57c9d0cf5a26721927","observation_id":"a0aa9455-3dda-4a36-8cb8-6997a91150a4","resolution":{"observed_at":"2026-08-10T14:03:43.206415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.855608Z","title":null,"venue":null,"work_id":"5caa55e6-b043-486c-9679-ed1cdc482d35","year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.247655Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:c47176c4460611401d25b99391d98413f0ddd8f404b64acaf6e858637d89bb11","observation_id":"995bd200-8e51-4c04-8098-d59f405ade2d","resolution":{"observed_at":"2026-08-10T14:03:43.861645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-10T14:03:43.253168Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.253168Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:ae49edbce7ac283b4286f88114422f07505f1854c010fc57d03e042317e521a5","observation_id":"614edb11-e571-489d-8dff-88862c3557b2","resolution":{"observed_at":"2026-08-10T14:03:43.253168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.837435Z","title":null,"venue":null,"work_id":"63a8c0b3-158a-4a8c-a0ff-35579226db80","year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.257910Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:5e933b7e0d8193729972569e26bc892b0d17eca82c742fed84f27129318e6b1f","observation_id":"c9056c65-6134-4480-b34c-c250539a548f","resolution":{"observed_at":"2026-08-10T14:03:43.842590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.262833Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.262833Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:a133f28eed45f979bb6cfe876ec15714bd40b3de0b93c67e5f8399c08db65d8b","observation_id":"d27a82d7-4292-4af5-bc05-b973781f6b4e","resolution":{"observed_at":"2026-08-10T14:03:43.262833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.820511Z","title":null,"venue":null,"work_id":"7f810b08-ba60-438c-bfa7-d959cb733e9b","year":2022},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.267690Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:45ae9fc7c9f2087d1411900014aa7e0077db05a1213136f06988f7edd05a42c5","observation_id":"a058c55c-e928-4fa9-b7d2-1498e2d1cf27","resolution":{"observed_at":"2026-08-10T14:03:43.825566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.803117Z","title":null,"venue":null,"work_id":"0dc83bfa-bef5-4d73-92f7-a4df64089ffc","year":2019},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.272223Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:979ad15ab810dc74d180ab1574b05fe6998775538c4a437da456f50202d7be9d","observation_id":"ab03f2bb-41a9-48b4-ad7a-a34a29e99761","resolution":{"observed_at":"2026-08-10T14:03:43.808287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.277378Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.277378Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:c3a249b36145df37fdd872bcebed91dbdda6fbe6457618449f1f2d63214c4715","observation_id":"0f5f85c9-ebde-47e1-bdd7-c1cb95512780","resolution":{"observed_at":"2026-08-10T14:03:43.277378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.282321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.282321Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:08732184b2729598bd1b78bb3455e9566dbdd100566eedbcc1649999b3150766","observation_id":"d5f4982c-4ea2-4a1a-8b01-28655bb54359","resolution":{"observed_at":"2026-08-10T14:03:43.282321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.786056Z","title":null,"venue":null,"work_id":"bcc5f3a7-fb02-463d-919f-2b18d84e08ff","year":2017},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.286903Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:116d394d255d9d8fef44fbfad5e0acb7e1f1785052e2be8923fbc155e996090b","observation_id":"a12332fa-4ab5-4116-87b7-1321386a2806","resolution":{"observed_at":"2026-08-10T14:03:43.791550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.769048Z","title":null,"venue":null,"work_id":"d89c6694-c5d2-459d-97a9-45d5de45df63","year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.291757Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:358049fef9b900609e32e4ac92feeb89b8c481002746afbe6177d872a21a274b","observation_id":"020c7263-4e82-4895-9fb3-36c73a476120","resolution":{"observed_at":"2026-08-10T14:03:43.773896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:03:43.426579Z","title":null,"venue":null,"work_id":"7798cfca-ca15-4bcf-a2c8-2ee2b8a29013","year":2023},"citing_paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T14:03:43.345768Z"},"links":{"citing_paper":"/paper/2501.15754"},"observation_digest":"sha256:136d6b0a2d47dd0c6b0d28d2b055816dc276e774009b5474eb2bb5a8fae34316","observation_id":"1898301a-4ab2-48c1-bd8b-5f39e2521264","resolution":{"observed_at":"2026-08-10T14:03:43.433260Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.15754","last_updated":"2025-02-10T06:26:57Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T02:56:59.950586Z","submitted_at":"2025-01-27T03:45:29Z","title":"Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2501.15754."}