{"as_of":"2026-08-18T01:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:36c3f1e842a917f9b01aad4d52a5fe47398f684ca0dd2c55d574474737146ae6","coverage":[{"denominator":151,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:16:17.075444Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10260/citation-record","integrity":"/paper/2608.10260/integrity","json":"/paper/2608.10260/citation-record.json","paper":"/paper/2608.10260"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.383636Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.383636Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:962bbde817699aef904b1f4ca8d15b7f9a0abd0e734001cf6d19f49a04528100","observation_id":"25045826-422e-46a4-b099-4459a25e2442","resolution":{"observed_at":"2026-08-14T04:16:16.383636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.390977Z","title":"PLOS ONE , publisher =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.390977Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:97f2cb3e135a2799bcfc324adc22cdff6050545addfadc0d08d30cbffd1f4377","observation_id":"21e89d6f-450b-495b-a753-90dda5c371f4","resolution":{"observed_at":"2026-08-14T04:16:16.390977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.05950","last_updated":"2019-08-09T15:51:47Z","snapshot_observed_at":"2026-08-14T16:32:08.594751Z","submitted_at":"2019-05-15T05:47:23Z","title":"BERT Rediscovers the Classical NLP Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.05950","snapshot_observed_at":"2026-08-14T04:16:16.409090Z","title":"1905.05950 , archivePrefix=","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.409090Z"},"links":{"cited_paper":"/paper/1905.05950","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:11986927dfc91733e9482ac08abb7e8df7d870a3399b6fb71622d61cc8802bc3","observation_id":"38e22406-ad5c-44e3-ac1d-8db53842d43c","resolution":{"observed_at":"2026-08-14T04:16:16.409090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.418115Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.418115Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3033e04347febb62943ed5649b30e2c0c3c0bb72452a0275b6a721ad4b29b704","observation_id":"cefc9979-6be3-4626-b5e8-c207de1ac71e","resolution":{"observed_at":"2026-08-14T04:16:16.418115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.448118Z","title":"Interpreting","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.448118Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bcf45b6a90838b8811840dba8138b98f446bb1e10ca1e8d9512960ed32585b89","observation_id":"79d82990-ece9-444f-bbb1-674783c18c43","resolution":{"observed_at":"2026-08-14T04:16:16.448118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.452666Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.452666Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a3e2f93f260bd23393c53fb19c37ad8bafc7028112c461165de20bc1e469ac76","observation_id":"f104aafc-0331-469f-8c2f-3fb0f7dfddae","resolution":{"observed_at":"2026-08-14T04:16:16.452666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.456564Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.456564Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bc8e521e7a3a71f68f74bf8027fd5ea1a3268a95babd1f582f2c705d023bee3d","observation_id":"6e6ed633-44ec-4339-9e5d-a3e80a7549db","resolution":{"observed_at":"2026-08-14T04:16:16.456564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.461698Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.461698Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0fe7d15be927325011e0b004231d232225cff5e53974e87a81838360a4972893","observation_id":"14a17403-fa07-4d83-b0b6-15b21ada7ed1","resolution":{"observed_at":"2026-08-14T04:16:16.461698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.472590Z","title":"and Ducharme, R and Vincent, Pascal and Mathematiques, Centre , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.472590Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:14a9f7e889dc5b0485a48a9bf52c91470c0cd4d43c50be3fa2eb650cd1f0f16c","observation_id":"2b6c85c7-04a5-4e78-8e52-fdb42a19970a","resolution":{"observed_at":"2026-08-14T04:16:16.472590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.478458Z","title":"2013 , eprint=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.478458Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bdab879b6b6ad53bbc8915d79c0b85c90d909a4297c21e9acf387ae956664862","observation_id":"dbf42622-2c31-474d-aa7e-01371f0abc2f","resolution":{"observed_at":"2026-08-14T04:16:16.478458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.483996Z","title":"G lo V e: Global Vectors for Word Representation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.483996Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3608918e6a6788fa87fa891b06ae491e351f0cbe9f18447518ecc10352fce034","observation_id":"6e702ae6-1a7e-4bca-9db9-c40830fb3ffb","resolution":{"observed_at":"2026-08-14T04:16:16.483996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.490619Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.490619Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:753fcd21911d36f9f45ee015f150d58071e370d12d5556de09b91d8bf474b83a","observation_id":"e8fd2ed5-7b25-474f-8d0e-dcbe9447cd34","resolution":{"observed_at":"2026-08-14T04:16:16.490619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.509294Z","title":"C Users J","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.509294Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:c8cfd5f9418198fceb56286d03cee837a613cb77cb7523742db0260559bcdeb0","observation_id":"4ec5043e-cf1d-4fd4-b868-92de3d30cac9","resolution":{"observed_at":"2026-08-14T04:16:16.509294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.516480Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.516480Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:5d5c74c7f44956966ecdc0bbd3fb346eeaaf5a87f67c9963afb6f8e200f3919b","observation_id":"4e5456aa-2f43-4ddc-a98f-91c4f58ee72c","resolution":{"observed_at":"2026-08-14T04:16:16.516480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.527512Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.527512Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:de1698f6b173f099e7ab81ee773211c722cf9f318c729cbb844ccc7e06e696b8","observation_id":"823ef9c7-ad5d-483b-894e-9cd4ee181b22","resolution":{"observed_at":"2026-08-14T04:16:16.527512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-17T06:56:20.644738Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-14T04:16:16.533862Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.533862Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0fee75fdbcbb36c5975a70c5eaa219c30370c9f8a0a359a51799028bbe80d0dc","observation_id":"3ba81c5c-137f-4466-8219-f5ee945963d6","resolution":{"observed_at":"2026-08-14T04:16:16.533862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-14T04:16:16.538208Z","title":"Fu and Stefano Ermon and Atri Rudra and Christopher Ré , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.538208Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:77b0002d4c0956f96a1539179d6f9c0e612a5a6104ae5654043b47e58aeb88b3","observation_id":"3cda7172-8cb6-47bb-a8a5-1db38604ba11","resolution":{"observed_at":"2026-08-14T04:16:16.538208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-14T04:16:16.543145Z","title":"1810.04805 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.543145Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1e257cd92444fdac98e099795e51be1820f9ec00c05c931c4ba5782523ac44d4","observation_id":"6e48e81c-2e66-48b7-b5e1-90ba92a9fb33","resolution":{"observed_at":"2026-08-14T04:16:16.543145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.552037Z","title":"and Zipser, David , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.552037Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3646b710da69a0b36f861da471e39f74070d9c03b287a4336224a8b491046787","observation_id":"15cf7347-44af-4c0b-8dfc-c5a624c15324","resolution":{"observed_at":"2026-08-14T04:16:16.552037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.556800Z","title":"2001 , eprint=","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.556800Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:d8a7c47294a1e27a3820abdd07ab886f6da43c8c9649329d30103c9c10e03148","observation_id":"cf6a7188-cc13-46b9-892d-c68ce48a81de","resolution":{"observed_at":"2026-08-14T04:16:16.556800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.563326Z","title":"OpenAI Blog , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.563326Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:b6b1292e60d2013f77366a6244696c9f36d01eedb309ae758cd730b906bd259a","observation_id":"92844c8f-be9b-499a-8758-7997a7986032","resolution":{"observed_at":"2026-08-14T04:16:16.563326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.568337Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.568337Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:d2d23450dab336ae2fe5b59f1348447d21e7c8f7f4538eb4e7e7b6b482bfd471","observation_id":"02822102-463b-4d45-a225-351e04e9b0a0","resolution":{"observed_at":"2026-08-14T04:16:16.568337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.572978Z","title":"1954 , url=","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.572978Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:928d9d7cbedafa590f84588e5f3283fbc89e4110f045e8e3d307b8b7c0b8a34e","observation_id":"80d8ba48-d42c-4bec-be08-aea5ef5a785f","resolution":{"observed_at":"2026-08-14T04:16:16.572978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.577887Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.577887Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3f443c06c7af35c1805d24b716eb4714b32fc52f0203923f6124a379f35e2bb5","observation_id":"48ee2d37-59a7-4d77-87a0-0417770166a8","resolution":{"observed_at":"2026-08-14T04:16:16.577887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.581813Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.581813Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:27ed688ba1ad29c0da7876b15a450a9c3dfdfe3c84ba65b44e1818823cd7f74b","observation_id":"dea0743c-3e27-41a8-8942-8ac779fa45fb","resolution":{"observed_at":"2026-08-14T04:16:16.581813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.588109Z","title":"Why Should I Trust You?","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.588109Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:5477bc610f1c262f1f59d8cd82b86dc944de142d033c337ea7e0467ad317e5e7","observation_id":"19ae1910-164e-4393-b31c-3d07c564eaca","resolution":{"observed_at":"2026-08-14T04:16:16.588109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-14T04:16:16.592517Z","title":"Hu and Yelong Shen and Phillip Wallis and Zeyuan Allen-Zhu and Yuanzhi Li and Shean Wang and Lu Wang and Weizhu Chen , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.592517Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:33dea31b4f2d7647c817a6bdca38c5f8a298b25c2aedb7cdca9a69a1201bb3a8","observation_id":"b872518d-c041-4f73-99e0-586e86f480ae","resolution":{"observed_at":"2026-08-14T04:16:16.592517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.601319Z","title":"R eal T oxicity P rompts: Evaluating Neural Toxic Degeneration in Language Models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.601319Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:f60ac71efc105b88c49e4a1afb83a2b8b025443f3ea684215cdab44d5e853e6b","observation_id":"0bb244f0-270b-4d44-93f2-b68ef386888a","resolution":{"observed_at":"2026-08-14T04:16:16.601319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.607347Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.607347Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:9557de845be6efc1536e9e629d72380bfb989d2aa6530387d41fe926140c3d9c","observation_id":"3466e1ea-d7dd-4ba7-a515-de771fbb673b","resolution":{"observed_at":"2026-08-14T04:16:16.607347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.612787Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.612787Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:92f54913f7fb557cd71ee3bed5b193244d875bb102c2ea1f46e10b5057013cb5","observation_id":"dac58048-2643-4b7f-a748-b91f679bb87f","resolution":{"observed_at":"2026-08-14T04:16:16.612787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.618785Z","title":"and Gebru, Timnit and McMillan-Major, Angelina and Shmitchell, Shmargaret , title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.618785Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6ae2920b0e90858786b0c2174f6641bfb28195e6daae9d6ef7cae0a569014fec","observation_id":"cc92aa37-c254-49e7-8b5f-1759761f462d","resolution":{"observed_at":"2026-08-14T04:16:16.618785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.643851Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.643851Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:9b85c036cea0ad46dd7d7eaeb12e76b105c5756bf2a4d6697581abc821fb832a","observation_id":"41818f71-3eb5-4edb-ba18-46521d414fa9","resolution":{"observed_at":"2026-08-14T04:16:16.643851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.650899Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.650899Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0c02d63bc6eedb259260f5740ce6967591778d8448f2b133bf7507db7dc8db97","observation_id":"43ec8eab-9daf-4b25-9e48-4b11e1adb39f","resolution":{"observed_at":"2026-08-14T04:16:16.650899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05602","last_updated":"2024-06-10T09:58:55Z","snapshot_observed_at":"2026-08-17T01:11:29.065448Z","submitted_at":"2024-02-08T12:01:24Z","title":"AttnLRP: Attention-Aware Layer-Wise Relevance Propagation for Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05602","snapshot_observed_at":"2026-08-14T04:16:16.656408Z","title":"2402.05602 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.656408Z"},"links":{"cited_paper":"/paper/2402.05602","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0cac937a5c5dc3c08e47add211bf1f2beff7c2ea560d627f63eedfee47245193","observation_id":"a1b0f625-788f-45fd-bdae-d3b32d8a8084","resolution":{"observed_at":"2026-08-14T04:16:16.656408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.661346Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.661346Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:9fed81d8c5b8bc8d0f0ee88c82596c9bbfb271a6aeab6b0071d6295bdd683fce","observation_id":"559d53dd-5c3f-4278-ba70-ba47a2ad583f","resolution":{"observed_at":"2026-08-14T04:16:16.661346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.667449Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.667449Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:52d751dbaf7dbfa8aa650a627ae1daa6743aa0ad3fcef69d2c3821cabdaa5126","observation_id":"33838d78-22fb-498a-acee-da9ff83c2dd5","resolution":{"observed_at":"2026-08-14T04:16:16.667449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.672490Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.672490Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:14dbfdd2801d2a4578120bbdd54f5450a1b7052967d0d94f82b40e680af25799","observation_id":"89a17ae6-6069-45a0-aab4-9e164503a2dd","resolution":{"observed_at":"2026-08-14T04:16:16.672490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.677658Z","title":"2021 , journal=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.677658Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:14775216b88978316c42182c7785c947503f3e6327837157f4198ff22bbf6ea7","observation_id":"fd860d6d-a4c7-4421-868a-9c597c3aeab6","resolution":{"observed_at":"2026-08-14T04:16:16.677658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00586","last_updated":"2023-11-02T10:55:18Z","snapshot_observed_at":"2026-08-16T20:48:12.664112Z","submitted_at":"2023-04-30T21:44:21Z","title":"How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00586","snapshot_observed_at":"2026-08-14T04:16:16.681575Z","title":"How does","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.681575Z"},"links":{"cited_paper":"/paper/2305.00586","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2079e5e77040e009c6f421a46c8d8ede9b2ab06a55f769810ef0edcd9cd1a156","observation_id":"23d0846f-0e7c-4727-b854-851bfcde96e6","resolution":{"observed_at":"2026-08-14T04:16:16.681575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-14T04:16:16.686097Z","title":"Interpretability in the Wild: A Circuit for Indirect Object Identification in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.686097Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:aa12efb01c3fb2b1b607710b3eb481e5eb1a3ce0dfafce17f5df1a64f7195074","observation_id":"647a7e18-b281-4e58-ad4b-0b1d6bfd0c84","resolution":{"observed_at":"2026-08-14T04:16:16.686097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.692822Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.692822Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:7f3961c6285e687881adda8c8b3904df068fae7176179d1efa261cac4399c315","observation_id":"bc7f7fa8-d1db-472c-aee5-3d731e3ef4fb","resolution":{"observed_at":"2026-08-14T04:16:16.692822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.702756Z","title":"GitHub repository , howpublished =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.702756Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:fffd6a463d608a5b212bcbf7c6d3f3b7792296f56fdae320120d568e1bb8d0b0","observation_id":"df272c73-68e5-4e7f-8cbd-2f9f8d719201","resolution":{"observed_at":"2026-08-14T04:16:16.702756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.707557Z","title":"Orthrus Toxic Dictionary implementation , howpublished =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.707557Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3c0f5bb62bc51825c940e08d1a881332f84301364c9885e64cb97e40a27c43a1","observation_id":"bac6df61-4996-4c16-9109-1fb0a5332348","resolution":{"observed_at":"2026-08-14T04:16:16.707557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.719036Z","title":"The IEEE International Conference on Computer Vision (ICCV) , month =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.719036Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:8c68f99010f906bf66d62c673981b4c01f3785d9579d6338b0b20eaa554681d9","observation_id":"2f494b6c-60dd-4f56-8bd4-86576918292f","resolution":{"observed_at":"2026-08-14T04:16:16.719036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.727125Z","title":"2017 , howpublished =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.727125Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:48db727d66dce3cc4ca141a9b4e797c1b2e70bb26501e6acfd4c21bc2490cbbc","observation_id":"fa3e5950-4330-4616-a4c3-4f570c5e5232","resolution":{"observed_at":"2026-08-14T04:16:16.727125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.733701Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.733701Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:8746f3c1e769e7fef1050c8930bac14895b845ecf1a2d91db0639a7dcd972512","observation_id":"0a3f0a79-4fae-4a92-9b65-2f4aec6a4523","resolution":{"observed_at":"2026-08-14T04:16:16.733701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-14T04:16:16.738531Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.738531Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:05efa57829aecac27af63b4be6f426bbe20e521960153e6e74b6a3b69d8d922b","observation_id":"5b1a56b3-2852-4cc8-8708-163f4884074e","resolution":{"observed_at":"2026-08-14T04:16:16.738531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.747230Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.747230Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1eea7d4d1583b06e13ef03f9142f0d16f0ca484f946e6b7ec9310fcb166a4906","observation_id":"9e2800c1-f4ac-49ad-aa2d-d18ae0e8f88c","resolution":{"observed_at":"2026-08-14T04:16:16.747230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.751173Z","title":"AAAI Conference on Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.751173Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:f5c0313d0e510511bf5c62eafebe064cf51181b05d51eb38336bc26e377d0297","observation_id":"f19ac581-d6ff-4ef5-b1a3-db911c1cf567","resolution":{"observed_at":"2026-08-14T04:16:16.751173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.756189Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.756189Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:993324570e30ef43c9249d2c1bff4205ca760a318b4ea6cf44bd3535c5ecf5e7","observation_id":"ac304d72-aac1-48d9-93c6-32fcebb9594a","resolution":{"observed_at":"2026-08-14T04:16:16.756189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02860","last_updated":"2019-06-02T21:21:48Z","snapshot_observed_at":"2026-08-16T17:45:52.864524Z","submitted_at":"2019-01-09T18:28:19Z","title":"Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.02860","snapshot_observed_at":"2026-08-14T04:16:16.761405Z","title":"Le and Ruslan Salakhutdinov , year=","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.761405Z"},"links":{"cited_paper":"/paper/1901.02860","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1dbed1e2e1b2009e269f781f282100c9cec0e808b29023225fcc79e241777bef","observation_id":"0f56a8c2-2dfa-44c4-9676-b3147bf20955","resolution":{"observed_at":"2026-08-14T04:16:16.761405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.766529Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.766529Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a6f4ad906b12d36e41add646d9a8034e29c61440105da514f86d8f70fe396db1","observation_id":"57b496dd-2d36-4323-9442-27d4bb7a1207","resolution":{"observed_at":"2026-08-14T04:16:16.766529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.770619Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.770619Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:4e8a9fb08760a7f09e1fd338a8b1e393663c1ac75d800f97b83a7c4456455567","observation_id":"b350379e-a823-4067-9bfe-aff34449b58a","resolution":{"observed_at":"2026-08-14T04:16:16.770619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.776226Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.776226Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:24b32d7b2726e1960c77d91c6b9d6c7a1bd8aa84b258da15029a06c66aec0c48","observation_id":"ffe542e7-42a6-4a43-9046-75336969bad4","resolution":{"observed_at":"2026-08-14T04:16:16.776226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14875","last_updated":"2025-01-24T01:15:16Z","snapshot_observed_at":"2026-08-16T14:16:30.276287Z","submitted_at":"2024-02-21T18:25:25Z","title":"What's in a Name? Auditing Large Language Models for Race and Gender Bias","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14875","snapshot_observed_at":"2026-08-14T04:16:16.779811Z","title":"What's in a Name?","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.779811Z"},"links":{"cited_paper":"/paper/2402.14875","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bd6cb16e88d97e6af5d700e5d2b63c3c95ef215725840637e503495589118b3b","observation_id":"04c7bafe-2e99-4c5f-b85f-537916f2520b","resolution":{"observed_at":"2026-08-14T04:16:16.779811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.784211Z","title":"2020 , isbn =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.784211Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:c35670e2d794a86d96948c7a85f55181c6ef0a5e99747efa1b036d05a165e9bd","observation_id":"15f0677e-62d7-4d41-836f-90591b5a6c03","resolution":{"observed_at":"2026-08-14T04:16:16.784211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04897","last_updated":"2023-11-08T18:56:35Z","snapshot_observed_at":"2026-08-17T01:11:01.209723Z","submitted_at":"2023-11-08T18:56:35Z","title":"Future Lens: Anticipating Subsequent Tokens from a Single Hidden State","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04897","snapshot_observed_at":"2026-08-14T04:16:16.789598Z","title":"arXiv preprint arXiv:2311.04897 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.789598Z"},"links":{"cited_paper":"/paper/2311.04897","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1839fe197f17461cace05c75761516044e474b230a3498db2896934a08d97582","observation_id":"f1ad7109-6e78-4e7b-b84a-d6460f5ca069","resolution":{"observed_at":"2026-08-14T04:16:16.789598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-08-14T04:16:16.794208Z","title":"arXiv preprint arXiv:2403.05846 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.794208Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0ec4ac1e3fd4dff033eed2f1e60dfcb15de103632ca3d1adf7619a469630f627","observation_id":"693ede22-eeb3-411d-9489-7fe5acd03426","resolution":{"observed_at":"2026-08-14T04:16:16.794208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.798758Z","title":"arXiv preprint arXiv:2502.16570 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.798758Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:b760d1907634d79a70da59bdc31d74b727c027d453259c7c3c4f7c4b38ce182a","observation_id":"0d554eb8-7612-4903-a904-a1dc6be7639d","resolution":{"observed_at":"2026-08-14T04:16:16.798758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.813063Z","title":"Joint International Conference on Computational Linguistics, Language Resources and Evaluation , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.813063Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:637a71c702f5adcf414fdc9ca8a278248c9831f75663b04c52fce443081cb5ac","observation_id":"d955fe39-080a-4525-bd04-00ee4a0bad80","resolution":{"observed_at":"2026-08-14T04:16:16.813063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.835745Z","title":"59th Annual Meeting of the Association for Computational Linguistics and the 11th International Joint Conference on Natural Language Processing , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.835745Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:701798d516a7ffb312e1a7c209313a7d4c5b1f025ea9d878b1747264e57bc4d1","observation_id":"39315078-046c-455d-adb4-ab76ac40381a","resolution":{"observed_at":"2026-08-14T04:16:16.835745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.860014Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.860014Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:dfb8631b20f5d94a63f4916ceeac32283a97e25861813395f7d4c673b77b6644","observation_id":"a64b9ce2-fe16-44d6-9a56-908798de98b0","resolution":{"observed_at":"2026-08-14T04:16:16.860014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.864968Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.864968Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0b49178ece8aca7bd1c398cb2415c28dd3494fed5220941dca6bb761f14d7ddb","observation_id":"7bb2f87b-0f44-40dd-85c9-216dd92b338f","resolution":{"observed_at":"2026-08-14T04:16:16.864968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.869478Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.869478Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6e3681e21446291f2ea717d4e4a491dbee3e5646401ac436cb57f8928a7b1b8c","observation_id":"9d337b47-efb5-42e0-97f1-d42832593864","resolution":{"observed_at":"2026-08-14T04:16:16.869478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0907.3740","last_updated":"2009-07-21T20:21:38Z","snapshot_observed_at":"2026-08-15T05:43:10.523620Z","submitted_at":"2009-07-21T20:21:38Z","title":"Empirical Bernstein Bounds and Sample Variance Penalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0907.3740","snapshot_observed_at":"2026-08-14T04:16:16.873924Z","title":"Empirical","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.873924Z"},"links":{"cited_paper":"/paper/0907.3740","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:506576a4d444065553e16057940a10f8441ed5cc77333f59091c31313f491702","observation_id":"25954fe2-249a-4291-ac7f-5698a507ad82","resolution":{"observed_at":"2026-08-14T04:16:16.873924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.01060","last_updated":"2020-11-12T07:47:48Z","snapshot_observed_at":"2026-08-14T05:50:17.249446Z","submitted_at":"2020-11-02T15:42:40Z","title":"Constructing A Multi-hop QA Dataset for Comprehensive Evaluation of Reasoning Steps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.01060","snapshot_observed_at":"2026-08-14T04:16:16.879794Z","title":"Constructing A Multi-hop","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.879794Z"},"links":{"cited_paper":"/paper/2011.01060","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:61080a97c5209aa69a7ba4efa2afd141b811b3bc01c32d1bddd91770c1bab9bb","observation_id":"bf81d290-3523-4c20-b077-1c4ee61a10b0","resolution":{"observed_at":"2026-08-14T04:16:16.879794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.884337Z","title":"2020 , howpublished =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.884337Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:41c4aa8bc4e56f62f99806427964f64fd9a29b8e5f91e0eed22aad9337711ecd","observation_id":"4c9e03c5-a99a-4e30-b69f-a6936db63c03","resolution":{"observed_at":"2026-08-14T04:16:16.884337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.889458Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.889458Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:fe95d6e34cc0bc128787220d50197b86f2109d7dfe09dbdef72fdd153362e15a","observation_id":"874cfa9a-f9fe-4640-83c3-84afea313625","resolution":{"observed_at":"2026-08-14T04:16:16.889458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.895226Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.895226Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:55e2ec96b999d08be1f6b1167f779e1d37da5107cc947c67739079be4bc9b13f","observation_id":"37620d81-14f6-4950-ba03-a0fbea668137","resolution":{"observed_at":"2026-08-14T04:16:16.895226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.903671Z","title":"Better Estimation of the","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.903671Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:60505a5632e2c5389c223d1806861ad623e49dfa6976cc2978ad68616ce5a6a0","observation_id":"94c943a3-7f3f-46e2-88cf-d5bdf51abe1d","resolution":{"observed_at":"2026-08-14T04:16:16.903671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.910530Z","title":"A Comedy of Estimators: On","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.910530Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:66d4c557c7214e3fbdacf8a1548017b274e407a35a6cc2a288390e5be9c7847e","observation_id":"390f99e4-8ce7-4e50-a47d-05c18ea6f590","resolution":{"observed_at":"2026-08-14T04:16:16.910530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.923687Z","title":"arXiv preprint arXiv:2408.01416 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.923687Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:28cef65d8f677d7567185c456ce6aadb2eec5320276ec2402e9cd7d823b6add2","observation_id":"7bf221e7-a34b-41db-8152-55fb22fe6a35","resolution":{"observed_at":"2026-08-14T04:16:16.923687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.936844Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.936844Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:08d9dc819be09c8e53d1536ab86a1389045fe6aea8ea00c885e9fc29ba1cbd83","observation_id":"1f924db0-8279-4e39-91e9-b0d5d8e6e0f5","resolution":{"observed_at":"2026-08-14T04:16:16.936844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.942402Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.942402Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:473e2439ac93689b5892ff2ab5627938e20a93cd8e1fb5d6da1d724fa9c625ca","observation_id":"957cd34f-f486-4176-9176-7a9f0e4bff51","resolution":{"observed_at":"2026-08-14T04:16:16.942402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.946497Z","title":"Feature Visualization , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.946497Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:4d27489ad6f6872d1779a83eaf23d4089079d290c75e52ed83d5cf30e6fb81c9","observation_id":"8317f3b9-6f90-4ad0-9374-cbd2d6dd9d55","resolution":{"observed_at":"2026-08-14T04:16:16.946497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.950537Z","title":"Distill , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.950537Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bf8299c1aca9ff04b16c0f9bf197fb8193eb39ea498a4b103ff5a689dfbe8981","observation_id":"abea76c9-a3ca-41ce-bb31-4564e8eba643","resolution":{"observed_at":"2026-08-14T04:16:16.950537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.954148Z","title":"What Does BERT Look at? A n Analysis of BERT ' s Attention","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.954148Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:b084863c6237012546bc926c98649dfba5004597756de0ee8f3c82d3d8b7d4d8","observation_id":"65c62c95-fd73-4a6a-bc3f-e80a4cddd657","resolution":{"observed_at":"2026-08-14T04:16:16.954148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.959921Z","title":"Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.959921Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:05131e344a3c0f0e31c6e334e8d9c5d75dd14764932fb04eaacaa96fe686064c","observation_id":"dd457df7-085e-4ee7-bb2b-4853866afda5","resolution":{"observed_at":"2026-08-14T04:16:16.959921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.964424Z","title":"Analyzing the Structure of Attention in a Transformer Language Model","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.964424Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a25724ec3e854359b971347c42bdbbe4317d1bab93885a946edb90c0a4d28809","observation_id":"178080f5-c8c6-4667-ad23-c46d6da9e96e","resolution":{"observed_at":"2026-08-14T04:16:16.964424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.970596Z","title":"36th International Conference on Neural Information Processing Systems , articleno =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.970596Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:b2f4be38d7fa41221d505c29bad801e0c897f9e999d4d9887218eaaa9b43d3ed","observation_id":"122c2c2c-44b6-43dc-9947-91cbd240b842","resolution":{"observed_at":"2026-08-14T04:16:16.970596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.977977Z","title":"What do Neural Machine Translation Models Learn about Morphology?","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.977977Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:52826932e2a4d0b8afb96eb4717d376beeaa12e774b6d2d76f592d77a660a6a7","observation_id":"2b5fa53e-3635-4a23-b78b-9694c0337832","resolution":{"observed_at":"2026-08-14T04:16:16.977977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.982795Z","title":"A Structural Probe for Finding Syntax in Word Representations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.982795Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:9beac225c2bcdbd9bc09bcc4a56d7e8aab0d77086518611e482e7067b9dab534","observation_id":"8ec2b9ff-7672-4566-b89a-3d68d3788da1","resolution":{"observed_at":"2026-08-14T04:16:16.982795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.987616Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.987616Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:c1c4f4face73b8a4b64ec095e28dcc10289129e465ba199c46e33a9c15f88d82","observation_id":"b9e36f81-3f05-4363-870b-77f5cc2bf798","resolution":{"observed_at":"2026-08-14T04:16:16.987616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.994025Z","title":"Emergent Linear Representations in World Models of Self-Supervised Sequence Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.994025Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bd4092cf1a470cc1e4b9e907f9f35bd7b3fc1c764d6f3cc661400fe650c37c8e","observation_id":"8de10617-827c-4163-a21e-f2bfe582ca91","resolution":{"observed_at":"2026-08-14T04:16:16.994025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.004172Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.004172Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:45e79512e9f07662275391b6dd86b8fef317fe840b33e81cfba5b118e9656e4d","observation_id":"cf528e9f-7ca8-43e0-875d-110c378369a2","resolution":{"observed_at":"2026-08-14T04:16:17.004172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.010863Z","title":"Daniel and Sumers, Theodore R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.010863Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2b972f2e9eb51062779e94a32df9ecee91323b595ac4ec3a7c2a8d853b2060f7","observation_id":"eaa88cc8-801a-401f-9b37-291f8059e56c","resolution":{"observed_at":"2026-08-14T04:16:17.010863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.017203Z","title":"AI Alignment Forum , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.017203Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a9417104272bec59f2cc479c388878a0e7d6c88ae6e9b035f2d4ac733214045f","observation_id":"eb2cce3f-e41d-48c9-8b00-857cd854d529","resolution":{"observed_at":"2026-08-14T04:16:17.017203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.021670Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.021670Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:66a45bc89a754987ef975e197ba59602576d4e96eeb6261d321f178d49f86435","observation_id":"905707db-39e2-4fbc-ad75-6c5ad0395969","resolution":{"observed_at":"2026-08-14T04:16:17.021670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ins.2023.03.050","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.417373Z","title":"Adaptive learning rate optimization algorithms with dynamic bound based on","venue":null,"work_id":"f3c9ad68-d89b-4a5d-bafc-84568b89f0ef","year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.026233Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:34f508e6c96b8c7e8ce7d4c66df1b90aae8393fff04aeab00c2fedb09956395b","observation_id":"21a98f45-54f5-48a1-95c5-a4a7847fc1ce","resolution":{"observed_at":"2026-08-14T04:16:17.425195Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.033006Z","title":"2015 , eprint=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.033006Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1724dc77058bccb9ce576ccd2d66cd4e1b02de7d951d335b082f6e179dfd62dc","observation_id":"49574f5d-3997-45b9-bb2f-1ff910a7ac4c","resolution":{"observed_at":"2026-08-14T04:16:17.033006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-14T04:16:17.037782Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.037782Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2705792c6ab9778302e95ba76314a7ccac5f8baa785a77284080c55191d408d3","observation_id":"d75d977b-e07f-47ca-9620-450a8042d106","resolution":{"observed_at":"2026-08-14T04:16:17.037782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.042510Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.042510Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2521f47f31638600a3c5a5fa86c259f6739aae653ed874d5b11bf87af9527f69","observation_id":"acb6d2ef-6822-455c-a41a-40a687f1013f","resolution":{"observed_at":"2026-08-14T04:16:17.042510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.046462Z","title":"35th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.046462Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:01ffaa9511164f0c398edf1109f963a9afa63883486981b85ddea57cc99a431d","observation_id":"9c5dd915-5ba9-4602-adaa-a368aa0a2752","resolution":{"observed_at":"2026-08-14T04:16:17.046462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.051457Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.051457Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bbe6007e32d8822a12ea662a8bb55949e48aae13d9a05f9bfcf6675e05a18042","observation_id":"cc58e91f-06d9-49c5-87ae-01e326a0f80e","resolution":{"observed_at":"2026-08-14T04:16:17.051457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.055071Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.055071Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6c9b275798cb39a53251cfcc98fc1fa7ab64454a9fd4a0f0db58d594efe99022","observation_id":"76a5008c-89b6-48d7-9e75-fe000d6cebb2","resolution":{"observed_at":"2026-08-14T04:16:17.055071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.058965Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.058965Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:cc291e96a14ca3f1b5a5a6c4a997b5e128c097fe53b7fb16c0b75bbbf9aaec24","observation_id":"4eec9b34-799d-4208-a154-ec70bad00d99","resolution":{"observed_at":"2026-08-14T04:16:17.058965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.063177Z","title":"International Conference for High Performance Computing, Networking, Storage and Analysis , articleno =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.063177Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:765e44d1d4d09047c5dba6310aea2e5e6b481e9a81b03fe90704b1382d10e9ed","observation_id":"28bbd611-188b-490f-a6df-3c38379dac2f","resolution":{"observed_at":"2026-08-14T04:16:17.063177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.06840","last_updated":"2021-01-18T02:11:25Z","snapshot_observed_at":"2026-08-16T18:51:46.129753Z","submitted_at":"2021-01-18T02:11:25Z","title":"ZeRO-Offload: Democratizing Billion-Scale Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.06840","snapshot_observed_at":"2026-08-14T04:16:17.067120Z","title":"2101.06840 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.067120Z"},"links":{"cited_paper":"/paper/2101.06840","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:62910fcc8bcf673ea7bbf0b9b662ca862016cbef6f35fb2642824a58500e909d","observation_id":"e7e33618-595a-4f2c-8e6d-b48460f01c7a","resolution":{"observed_at":"2026-08-14T04:16:17.067120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.071305Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.071305Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:213874cf4abc5df755a29103607db80ae679917c8551036a4b111ce4e271e997","observation_id":"dcaad60d-8680-44a8-a783-2d8e31635c4e","resolution":{"observed_at":"2026-08-14T04:16:17.071305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.075444Z","title":"Building Production-Ready Probes For","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.075444Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:385bbfd1ea6c58250528b340bb8d5b14a00fbf9b069da751ebbce24b1d002451","observation_id":"e3e1787c-4204-476c-acbf-c575d64b83de","resolution":{"observed_at":"2026-08-14T04:16:17.075444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":151},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 151 outbound references and 0 inbound Pith citation observations for arXiv:2608.10260."}