{"as_of":"2026-08-14T01:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f43655a395894174a057102a821f94e1526e37b2044221b1c358d61c9686e90","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:43:14.801525Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:59:30.298880Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T18:59:33.160545Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"cited_work":{"arxiv_id":"2501.15054","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15054","snapshot_observed_at":"2026-08-06T18:59:33.160545Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","venue":"cs.CL","work_id":"f77d2d5d-b8c8-4e2d-bc29-7b8a788230a5","year":2025},"citing_paper":{"arxiv_id":"2507.06722","last_updated":"2026-06-26T07:52:11Z","snapshot_observed_at":"2026-08-13T21:17:04.723362Z","submitted_at":"2025-07-09T10:30:09Z","title":"On the Effect of Uncertainty on Layer-wise Inference Dynamics","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:59:30.298880Z"},"links":{"cited_paper":"/paper/2501.15054","citing_paper":"/paper/2507.06722"},"observation_digest":"sha256:c4ce0f717a5fee73adecb58a15230ab79dbdb29c1fd254d6800c1f693d4c585a","observation_id":"43b03796-5d94-4077-addf-bed3abaabb52","resolution":{"observed_at":"2026-08-06T18:59:33.273968Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15054/citation-record","integrity":"/paper/2501.15054/integrity","json":"/paper/2501.15054/citation-record.json","paper":"/paper/2501.15054"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.082409Z","title":"Neel Nanda","venue":null,"work_id":"19c52e33-3cdc-4b4f-b074-091a954e9ad7","year":2022},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.715218Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:78173d8fa6f6a511a21ad075b93b3f28ddbff97b4cfc383a148c2c5f9e9bca20","observation_id":"c1f030de-aa82-4686-8c78-12fe3ae90242","resolution":{"observed_at":"2026-08-10T14:43:15.086106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.049500Z","title":"A review of taxonomies of explainable artificial intelligence (xai) methods","venue":null,"work_id":"c5f4f3eb-4df4-4a13-9e95-0e5670fb51fb","year":2022},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.726295Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:3660c73b65a7beec672c9eafa94d7fc8f343716c07cf4e911adda6974f33de93","observation_id":"268e257b-7345-4887-b610-8562bc4a4508","resolution":{"observed_at":"2026-08-10T14:43:15.053253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-10T14:43:14.729779Z","title":"Mechanistic interpretability for ai safety–a review.arXiv preprint arXiv:2404.14082,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.729779Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:a3c9445e6f25b9d4d9ab234a294acc0fc2269fd297f0a33bbf2ec59620557dd3","observation_id":"6729c272-5017-4a3e-9ebd-bec9fcd2f384","resolution":{"observed_at":"2026-08-10T14:43:14.729779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-10T14:43:14.741505Z","title":"Sparse autoen- coders find highly interpretable features in language models.arXiv preprint arXiv:2309.08600,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.741505Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:8ee8875c384ad86eb264c080696e98fbdef649ee680935d18c83925ea2b7d5ee","observation_id":"5d45590e-84b4-42de-b444-628aa8166c6b","resolution":{"observed_at":"2026-08-10T14:43:14.741505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-10T14:43:14.745081Z","title":"Inter- pretability in the wild: a circuit for indirect object identification in gpt-2 small.arXiv preprint arXiv:2211.00593,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.745081Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:c4d5cd860fbd41a6d47a3bd30e0ade51e06a0bb5947198b9a7a21cf2f4274c67","observation_id":"2ac73ebc-e5f0-4645-b3e4-e0a97897b17c","resolution":{"observed_at":"2026-08-10T14:43:14.745081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05969","last_updated":"2023-05-16T16:24:55Z","snapshot_observed_at":"2026-08-06T15:07:58.170997Z","submitted_at":"2023-04-12T16:46:43Z","title":"Localizing Model Behavior with Path Patching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05969","snapshot_observed_at":"2026-08-10T14:43:14.748803Z","title":"Localizing model behavior with path patching.arXiv preprint arXiv:2304.05969,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.748803Z"},"links":{"cited_paper":"/paper/2304.05969","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:b820f3506f4e91c043cdd261381e73d5dd75ab5b71d24b3d5934c783e6ce8c15","observation_id":"810515a5-3cf0-4547-ab2a-799b453335be","resolution":{"observed_at":"2026-08-10T14:43:14.748803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.036261Z","title":"com/posts/AcKRB8wDpdaN6v6ru/interpreting-gpt-the-logit-lens","venue":null,"work_id":"e4726f6b-9872-4c51-b57e-2a63bea05e9c","year":2019},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.752451Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:f3a8cfbe18878c0f8e63ca709d3516fd745bd5d2502f2bf1e221be631762e619","observation_id":"81f2b69b-d54c-4439-b631-24a4305e28c3","resolution":{"observed_at":"2026-08-10T14:43:15.041894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00175","last_updated":"2023-06-30T23:44:51Z","snapshot_observed_at":"2026-08-13T11:04:47.246888Z","submitted_at":"2023-06-30T23:44:51Z","title":"Still No Lie Detector for Language Models: Probing Empirical and Conceptual Roadblocks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00175","snapshot_observed_at":"2026-08-10T14:43:14.759786Z","title":"URL http://arxiv.org/abs/2307.00175","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.759786Z"},"links":{"cited_paper":"/paper/2307.00175","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:5701f0e92cefa25850ef4a0fc1fe5c2a58e775f7fd14546645930bfa4f6d7da3","observation_id":"fc23120f-5abd-491a-84ea-8dcc3276034f","resolution":{"observed_at":"2026-08-10T14:43:14.759786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13382","last_updated":"2024-06-26T14:27:49Z","snapshot_observed_at":"2026-08-13T13:58:07.766526Z","submitted_at":"2022-10-24T16:29:55Z","title":"Emergent World Representations: Exploring a Sequence Model Trained on a Synthetic Task","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13382","snapshot_observed_at":"2026-08-10T14:43:14.763946Z","title":"Emergent world representations: Exploring a sequence model trained on a synthetic task","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.763946Z"},"links":{"cited_paper":"/paper/2210.13382","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:de43cd4ebbb3f64bae4c2d92523fad8df11bdf32ab54cf16c9bb88054c82de06","observation_id":"c8ba1d4b-b0f9-4cae-a9da-d4d1ec3d2dab","resolution":{"observed_at":"2026-08-10T14:43:14.763946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-10T14:43:14.768096Z","title":"URLhttp://arxiv.org/abs/2206.07682","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.768096Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:8d61fe2a240aef769b69bb32b7c58e95fdb6fde7749c01d9f7c9a5e53cab0065","observation_id":"c7759ce2-4653-44f3-960e-f793910915cc","resolution":{"observed_at":"2026-08-10T14:43:14.768096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05217","last_updated":"2023-10-19T21:25:32Z","snapshot_observed_at":"2026-08-02T10:20:00.635719Z","submitted_at":"2023-01-12T18:56:49Z","title":"Progress measures for grokking via mechanistic interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05217","snapshot_observed_at":"2026-08-10T14:43:14.771573Z","title":"URLhttp://arxiv.org/abs/2301.05217","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.771573Z"},"links":{"cited_paper":"/paper/2301.05217","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:c3ce4283f222404f909e7d8fd17053841fd032b8900c075949d99cac0c597fb1","observation_id":"708a0b8d-41c3-4d26-896f-e0fd0c4471ad","resolution":{"observed_at":"2026-08-10T14:43:14.771573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.08799","last_updated":"2023-01-15T21:53:00Z","snapshot_observed_at":"2026-08-13T15:02:00.634499Z","submitted_at":"2022-07-18T17:55:05Z","title":"Hidden Progress in Deep Learning: SGD Learns Parities Near the Computational Limit","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.08799","snapshot_observed_at":"2026-08-10T14:43:14.775196Z","title":"URLhttp://arxiv.org/abs/2207.08799","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.775196Z"},"links":{"cited_paper":"/paper/2207.08799","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:9d0729c53d74f05252a80c36b1fb26a2621e0779b48040c6f22f3ada9f700d8e","observation_id":"4382c841-0db5-4bfa-9031-dfca2a9091ca","resolution":{"observed_at":"2026-08-10T14:43:14.775196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05262","last_updated":"2023-01-13T15:16:16Z","snapshot_observed_at":"2026-08-13T01:40:21.606634Z","submitted_at":"2022-02-10T18:59:54Z","title":"Locating and Editing Factual Associations in GPT","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05262","snapshot_observed_at":"2026-08-10T14:43:14.779216Z","title":"URL http://arxiv.org/ abs/2202.05262","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.779216Z"},"links":{"cited_paper":"/paper/2202.05262","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:eb42b2f8f3269542f8dd32c4778c28589b55ea7fad377610a5fe748c32cd791d","observation_id":"e8a802a3-b2a4-4638-a89a-146c3af9cfb7","resolution":{"observed_at":"2026-08-10T14:43:14.779216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.02299","last_updated":"2024-09-17T11:55:58Z","snapshot_observed_at":"2026-08-13T14:32:32.333600Z","submitted_at":"2022-09-06T08:51:53Z","title":"A Survey of Machine Unlearning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.02299","snapshot_observed_at":"2026-08-10T14:43:14.782996Z","title":"URLhttp://arxiv.org/abs/2209.02299","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.782996Z"},"links":{"cited_paper":"/paper/2209.02299","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:45f93e0887744a8dbd4fe91ffed7983d87e88fe8a59ef482de514681d539f8b7","observation_id":"860676fe-f804-4626-9fbf-632dacd16e3a","resolution":{"observed_at":"2026-08-10T14:43:14.782996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11415","last_updated":"2022-12-21T23:52:42Z","snapshot_observed_at":"2026-08-14T01:16:12.466370Z","submitted_at":"2022-12-21T23:52:42Z","title":"Circumventing interpretability: How to defeat mind-readers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11415","snapshot_observed_at":"2026-08-10T14:43:14.786443Z","title":"URLhttps://arxiv.org/abs/2212.11415","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.786443Z"},"links":{"cited_paper":"/paper/2212.11415","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:a5512bf559c37225931b90729e810dc858d34e8371c31bd8c134ab8a6a5e67a1","observation_id":"80f97076-180f-4218-8226-8aef73db19aa","resolution":{"observed_at":"2026-08-10T14:43:14.786443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-10T11:37:23.229129Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-10T14:43:14.789971Z","title":"Andy Zou, Long Phan, Sarah Chen, James Campbell, Phillip Guo, Richard Ren, Alexander Pan, Xuwang Yin, Mantas Mazeika, Ann-Kathrin Dombrowski, Shashwat Goel, Nathaniel Li, Michael J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.789971Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:270dd63faa1a8ebe847c35d288463106e4f61e87387ea32f80d66b2fd68e9463","observation_id":"8fee2dd8-deeb-431c-ac2d-e6ecb3d8d85e","resolution":{"observed_at":"2026-08-10T14:43:14.789971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-10T14:43:14.793410Z","title":"URL http://arxiv.org/ abs/2310.01405","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.793410Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:c996002a93390a97cdab613a0d819658f5c0f574b115eeceb507c29b671a4503","observation_id":"599be8c9-332f-4cc9-b99f-d2ca329015c0","resolution":{"observed_at":"2026-08-10T14:43:14.793410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-13T10:25:32.383656Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-10T14:43:14.797897Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.797897Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:939f6002ed43718d7df0e3301fc86c8e48629e485879a8387af3ca5df4665bc2","observation_id":"85c92d42-2d8c-43e8-9bf8-053b56e0a0dc","resolution":{"observed_at":"2026-08-10T14:43:14.797897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07532","last_updated":"2020-12-04T22:53:18Z","snapshot_observed_at":"2026-08-11T17:39:55.451343Z","submitted_at":"2020-12-04T22:53:18Z","title":"An overview of 11 proposals for building safe advanced AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07532","snapshot_observed_at":"2026-08-10T14:43:14.801525Z","title":"URLhttp://arxiv.org/abs/2012.07532","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.801525Z"},"links":{"cited_paper":"/paper/2012.07532","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:c254446fe47c0898637670e9c6d1df04b41d152933391e3acf8af8f1ff41c15c","observation_id":"d41b6da4-6911-4cac-9ea4-44a829bda27e","resolution":{"observed_at":"2026-08-10T14:43:14.801525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.060476Z","title":"Neel Nanda","venue":null,"work_id":"8459184c-aa90-45e6-9a28-2b0d985eba84","year":2018},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.722546Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:dd9f5eccb339b144e53c2616c446f0c628cd5d32c046bd0e43a5637829a0a831","observation_id":"cefe1f41-dc8d-4d9e-adfa-8be2419a5485","resolution":{"observed_at":"2026-08-10T14:43:15.064000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16367","last_updated":"2025-03-16T05:23:12Z","snapshot_observed_at":"2026-08-13T00:22:33.658871Z","submitted_at":"2024-04-25T07:10:29Z","title":"Learning Syntax Without Planting Trees: Understanding Hierarchical Generalization in Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16367","snapshot_observed_at":"2026-08-10T14:43:14.756025Z","title":"Learning syntax without planting trees: Understanding when and why transformers generalize hierarchically.arXiv preprint arXiv:2404.16367,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.756025Z"},"links":{"cited_paper":"/paper/2404.16367","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:00d529f5c323006592311f34a647290bf8be09de819ec69be05f086d06acfaad","observation_id":"6f5ceadc-785c-4c56-9ca3-dcfbfba038f4","resolution":{"observed_at":"2026-08-10T14:43:14.756025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.071280Z","title":"Lee Sharkey, Sid Black, and beren","venue":null,"work_id":"5797a51a-5d33-48f8-b604-c28165d1e3c9","year":2020},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.718935Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:04d3c12261bdf7019a293d06b5fab9f2a1f4d1879f103c6e3d652f688ca57007","observation_id":"a2552a8a-796f-4dd6-bef8-6f489b7c0018","resolution":{"observed_at":"2026-08-10T14:43:15.074738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-10T14:43:14.733628Z","title":"Understanding intermediate layers using linear classifier probes.arXiv preprint arXiv:1610.01644,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.733628Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:344ed9263de2b834e93bb922db41bf7e2179a16e0bace60bc8473c7db3822e90","observation_id":"9015422d-b7ad-4ce4-8101-07aa05a192a1","resolution":{"observed_at":"2026-08-10T14:43:14.733628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05862","last_updated":"2022-09-20T16:49:56Z","snapshot_observed_at":"2026-08-13T15:25:13.091837Z","submitted_at":"2022-06-13T00:22:50Z","title":"X-Risk Analysis for AI Research","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05862","snapshot_observed_at":"2026-08-10T14:43:14.702248Z","title":"Dan Hendrycks, Mantas Mazeika, and Thomas Woodside","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.702248Z"},"links":{"cited_paper":"/paper/2206.05862","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:56637fadc62f923d1fe499752c3906f844e0825bbe6fe711c5e6dcdc8b0a857d","observation_id":"d45d8511-7f54-48d9-be16-a96a4dc080de","resolution":{"observed_at":"2026-08-10T14:43:14.702248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12001","last_updated":"2023-10-09T22:57:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-21T03:35:06Z","title":"An Overview of Catastrophic AI Risks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12001","snapshot_observed_at":"2026-08-10T14:43:14.706872Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.706872Z"},"links":{"cited_paper":"/paper/2306.12001","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:0e865cbeefcdafce3943732b787560b35e4f1ac11dcb724e9d35d0d450e5b173","observation_id":"fa06af59-535d-40a7-a8f9-58b83639b142","resolution":{"observed_at":"2026-08-10T14:43:14.706872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19852","last_updated":"2025-04-04T11:14:49Z","snapshot_observed_at":"2026-08-05T20:02:35.087707Z","submitted_at":"2023-10-30T15:52:15Z","title":"AI Alignment: A Comprehensive Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19852","snapshot_observed_at":"2026-08-10T14:43:14.711050Z","title":"URLhttp://arxiv.org/abs/2310.19852","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.711050Z"},"links":{"cited_paper":"/paper/2310.19852","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:a6e4d712aa72a1cad489f86e3731e185b4be6748317478499219025d88749023","observation_id":"d51a07f8-32d9-4b56-a357-a4e17aba6e6f","resolution":{"observed_at":"2026-08-10T14:43:14.711050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T02:54:27.889130Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2501.15054."}