{"as_of":"2026-08-12T04:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ce3e1f97261f7ba76e3e832f32cc7d711ffef2c3e312bf3ffe4aabf89a2e7bd5","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:07:12.195614Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:17:13.117220Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T08:16:47.723815Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":"2506.00653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-07-02T08:16:47.723815Z","title":"Bello, A","venue":null,"work_id":"f3a0c2cd-a15d-41c2-a12a-3969d7662c54","year":2025},"citing_paper":{"arxiv_id":"2604.06377","last_updated":"2026-05-05T18:37:43Z","snapshot_observed_at":"2026-08-11T13:29:25.505319Z","submitted_at":"2026-04-07T19:02:10Z","title":"The Master Key Hypothesis: Unlocking Cross-Model Capability Transfer via Linear Subspace Alignment","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:44.401045Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2604.06377"},"observation_digest":"sha256:60f23f340f3bf16e06867b9265b01b90784e5ae67aa63b78271872a108129f37","observation_id":"0fc98fd8-5782-41cf-a7c4-f2945f1edad8","resolution":{"observed_at":"2026-05-11T00:15:56.149206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":"2506.00653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-07-02T08:16:47.723815Z","title":"Bello, A","venue":null,"work_id":"f3a0c2cd-a15d-41c2-a12a-3969d7662c54","year":2025},"citing_paper":{"arxiv_id":"2605.08254","last_updated":"2026-05-07T19:38:12Z","snapshot_observed_at":"2026-07-06T23:20:28.875586Z","submitted_at":"2026-05-07T19:38:12Z","title":"HyperTransport: Amortized Conditioning of T2I Generative Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T01:56:34.395472Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2605.08254"},"observation_digest":"sha256:609786037c3dc8274e3fbef6f27188b2148641463dbae9bd92d6be0644bbecc6","observation_id":"4162988a-02e1-4a80-8dd0-8f0f308515bf","resolution":{"observed_at":"2026-05-12T07:46:38.048741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":"2506.00653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-07-02T08:16:47.723815Z","title":"Bello, A","venue":null,"work_id":"f3a0c2cd-a15d-41c2-a12a-3969d7662c54","year":2025},"citing_paper":{"arxiv_id":"2606.05290","last_updated":"2026-06-03T18:00:04Z","snapshot_observed_at":"2026-07-06T23:45:19.055840Z","submitted_at":"2026-06-03T18:00:04Z","title":"Do Models Share Safety Representations? Cross-Model Steering for Safe Visual Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T06:16:53.305354Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2606.05290"},"observation_digest":"sha256:443d881d2eb187615e472151be75c7d41d8a5da45d2b1c78d996aa963ccbacc6","observation_id":"c513d267-dd03-40cc-ba38-b2d9c5ca2870","resolution":{"observed_at":"2026-07-02T08:16:47.725232Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-08-05T10:17:13.117220Z","title":"Linear representation transferability hypothesis: Leveraging small models to steer large models.arXiv preprint arXiv:2506.00653,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03893","last_updated":"2026-08-04T16:26:47Z","snapshot_observed_at":"2026-08-08T19:02:49.662782Z","submitted_at":"2026-08-04T16:26:47Z","title":"Cross-Model KV Cache Transfer in LLM Families: A Closed-Form Linear Mapping for Prefill Reuse","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:13.117220Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2608.03893"},"observation_digest":"sha256:9a04eb2dd1b85faee4455df6c5279555f70bd50fba611e19bed640e4e508c12c","observation_id":"04dfa064-c0a2-43b8-9fc6-10db9eb3cc33","resolution":{"observed_at":"2026-08-05T10:17:13.117220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00653/citation-record","integrity":"/paper/2506.00653/integrity","json":"/paper/2506.00653/citation-record.json","paper":"/paper/2506.00653"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11717","snapshot_observed_at":"2026-08-07T12:07:09.147565Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.147565Z"},"links":{"cited_paper":"/paper/2406.11717","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:06c005a4629e55f4c7c2fc93785ffac690ffc20e9d4c23b02682b4592d254b20","observation_id":"71a66a4d-1d65-4ef3-8742-eaab81d6aca7","resolution":{"observed_at":"2026-08-07T12:07:09.147565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:16.019624Z","title":"Revisiting model stitching to compare neural representations","venue":null,"work_id":"87b4599a-301c-44cb-8686-ffd4406e88f4","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.220366Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:75934a8d9a45dfb578f97de6621c310d62601cb1402109d6ef64f23b50d2bc1a","observation_id":"1853f68c-b9e1-447d-b13f-92231db45124","resolution":{"observed_at":"2026-08-07T12:07:16.061940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12030","last_updated":"2025-01-27T10:02:44Z","snapshot_observed_at":"2026-08-09T14:52:05.192857Z","submitted_at":"2024-02-19T10:37:29Z","title":"Towards Cross-Tokenizer Distillation: the Universal Logit Distillation Loss for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12030","snapshot_observed_at":"2026-08-07T12:07:09.286384Z","title":"Towards cross-tokenizer distillation: the universal logit distillation loss for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.286384Z"},"links":{"cited_paper":"/paper/2402.12030","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:2a46ae9deb696e4fbfcd7896ccec0a21537cb62c5aa95f2f130cccc3c03322b0","observation_id":"4e11166d-3e79-44f6-b5b2-65be13bc0482","resolution":{"observed_at":"2026-08-07T12:07:09.286384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:09.386595Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.386595Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:4cb6d4a94db9a686831734d2bf11ddf615f19159874289253c54603fbe121ea0","observation_id":"068618f1-6652-41dc-9e8b-c4d05f3b8642","resolution":{"observed_at":"2026-08-07T12:07:09.386595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.871240Z","title":"Curve circuits","venue":null,"work_id":"127ea512-3e91-4e47-8a88-24ef77997602","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.482358Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:7e6a8597eb210c22e10c0540e264500b72c6d7642ed28ff224681189f63d8773","observation_id":"23488e73-c4a0-4368-bb38-b4274ce3b555","resolution":{"observed_at":"2026-08-07T12:07:15.910916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.711912Z","title":"Similarity and matching of neural network representations","venue":null,"work_id":"d3238007-99b7-4255-837e-dd4ca1f77bec","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.568445Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:fc774b224433afad2a76dabd033f6e90c358bdf4db331d29d13e081e4a1a1050","observation_id":"fdd7fd8f-625c-44fe-a744-18425836d52b","resolution":{"observed_at":"2026-08-07T12:07:15.758563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:09.661210Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.661210Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:0f623753ec3c032afe01e78c3c3bcd8b848a4c427865abd52ef4a1c7ce085e87","observation_id":"54bd986e-1009-46cc-a431-39829c0c8e44","resolution":{"observed_at":"2026-08-07T12:07:09.661210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.547656Z","title":"Toy models of superposition","venue":null,"work_id":"5f36432c-c4dd-4024-90c8-36a47058255e","year":2022},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.753535Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:daa69c920dd022d35a1ce95a039e55b10a01a8432895abf12cc044be655f5c86","observation_id":"542c91c9-630b-4f7f-8dc1-3b870637948d","resolution":{"observed_at":"2026-08-07T12:07:15.599874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T12:07:09.798719Z","title":"The P ile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.798719Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:1934ad06f804bc1214937df2f033406d5d984cf68ce1f7f6831fe75be6ce98c5","observation_id":"181f0547-4cf8-4b1f-828b-6b90458c181d","resolution":{"observed_at":"2026-08-07T12:07:09.798719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.359025Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":"d022d63d-7c65-4c56-81e1-dd1848fbf6b8","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.907199Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:5863735332e2ec29ea73f497d915ff3e309d980629534972744388a4ca8a8445","observation_id":"a889b737-5291-43d4-b07a-806665e48ffb","resolution":{"observed_at":"2026-08-07T12:07:15.444373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.176158Z","title":"Saes are highly dataset dependent: A case study on the refusal direction","venue":null,"work_id":"f0ac5850-bba1-4fc7-8afe-a48f6b9d9e7b","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.968105Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:a30aac48b8f3467db71130e8b250422b90e6eba14be04f8c2f2a2a62a24f8f34","observation_id":"d6e9f57c-9577-4bfe-b046-bb0c33310f70","resolution":{"observed_at":"2026-08-07T12:07:15.255568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02730","last_updated":"2023-12-05T12:48:04Z","snapshot_observed_at":"2026-07-06T16:57:09.664139Z","submitted_at":"2023-12-05T12:48:04Z","title":"Towards Measuring Representational Similarity of Large Language Models","version":1},"cited_work":{"arxiv_id":"2312.02730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.02730","snapshot_observed_at":"2026-08-07T12:07:13.386978Z","title":"Towards Measuring Representational Similarity of Large Language Models","venue":"cs.LG","work_id":"ed6d72a0-d347-4e70-8035-e0267c460eaf","year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.018944Z"},"links":{"cited_paper":"/paper/2312.02730","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:0b28df8baf128eb22067e65fb4b6f6a265ddb79adddd7ce1846f40c0d605d9f8","observation_id":"ad37495f-aa31-4b3c-b907-660b392b9047","resolution":{"observed_at":"2026-08-07T12:07:13.440934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.990400Z","title":"Similarity of neural network models: A survey of functional and representational measures","venue":null,"work_id":"f43855b2-ebd6-4e86-b125-1cb5ee6db664","year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.104251Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:1dd0a1ef500a5e342bbdda40f5e174c752dffef4626e7b94a45eeefce2bdff82","observation_id":"30372933-9dce-4e6e-a68f-9fec3583b8aa","resolution":{"observed_at":"2026-08-07T12:07:15.115350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00531","last_updated":"2025-03-11T20:01:30Z","snapshot_observed_at":"2026-08-09T01:39:58.264669Z","submitted_at":"2024-08-01T13:08:02Z","title":"ReSi: A Comprehensive Benchmark for Representational Similarity Measures","version":2},"cited_work":{"arxiv_id":"2408.00531","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.00531","snapshot_observed_at":"2026-08-07T12:07:13.212115Z","title":"ReSi: A Comprehensive Benchmark for Representational Similarity Measures","venue":"cs.LG","work_id":"bde77515-a04f-4098-8d8e-34c7296bf595","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.191437Z"},"links":{"cited_paper":"/paper/2408.00531","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:5c506fb55d4c8536063b6e70a05a8773f5fd7e105219bcdf0fb59c1ef3d73e3a","observation_id":"78737e0f-a994-4e71-b8c7-4da7f55010ad","resolution":{"observed_at":"2026-08-07T12:07:13.279213Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00414","last_updated":"2019-07-19T14:59:45Z","snapshot_observed_at":"2026-07-06T07:49:47.294073Z","submitted_at":"2019-05-01T17:57:26Z","title":"Similarity of Neural Network Representations Revisited","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00414","snapshot_observed_at":"2026-08-07T12:07:10.243871Z","title":null,"venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.243871Z"},"links":{"cited_paper":"/paper/1905.00414","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:56b520d41416ee34e320f08797d344bed2804770adec10a2ecf855f493edb8c0","observation_id":"3dca8ab0-46ef-4f01-a261-4dfd211b2333","resolution":{"observed_at":"2026-08-07T12:07:10.243871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19384","last_updated":"2025-06-16T10:21:00Z","snapshot_observed_at":"2026-07-06T18:38:05.229292Z","submitted_at":"2024-06-27T17:57:03Z","title":"The Remarkable Robustness of LLMs: Stages of Inference?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19384","snapshot_observed_at":"2026-08-07T12:07:10.354834Z","title":"The remarkable robustness of llms: Stages of inference? arXiv preprint arXiv:2406.19384, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.354834Z"},"links":{"cited_paper":"/paper/2406.19384","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:1f09ffec80c037fe6bc5a6ab2878ca5eb0b7295e49a02f973ee52bc36aa32af7","observation_id":"812f38d5-6cd1-4929-875a-da40cf98fb9d","resolution":{"observed_at":"2026-08-07T12:07:10.354834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06981","last_updated":"2025-05-21T00:01:46Z","snapshot_observed_at":"2026-08-07T14:16:41.337428Z","submitted_at":"2024-10-09T15:18:57Z","title":"Quantifying Feature Space Universality Across Large Language Models via Sparse Autoencoders","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06981","snapshot_observed_at":"2026-08-07T12:07:10.417992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.417992Z"},"links":{"cited_paper":"/paper/2410.06981","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:c8eace59a48dba212d30c256cbcffa9d5a513532f3f7cc73b5681ba5fb07e350","observation_id":"5976de11-95bb-44e3-859e-f70e38f5db6c","resolution":{"observed_at":"2026-08-07T12:07:10.417992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-11T23:41:02.350987Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-07T12:07:10.502533Z","title":"Gemma scope: Open sparse autoencoders everywhere all at once on gemma 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.502533Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:5f5afb479c909a553cb7af6c7238cde615f4e875f53e1c64f58f7751536b7b77","observation_id":"804b3db4-8e99-435d-a6c0-0ffb280dc208","resolution":{"observed_at":"2026-08-07T12:07:10.502533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.826884Z","title":"URL https://transformer-circuits.pub/2024/crosscoders/index.html","venue":null,"work_id":"34a3ed30-006c-4211-80ce-84ee3be7495a","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.585162Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:e219823d1efa9567c52907204c31d2a1989962fb4c347da76a87b7cd106e1e52","observation_id":"7d2338b6-bcfe-475d-9da8-5810a2ba536f","resolution":{"observed_at":"2026-08-07T12:07:14.902151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T12:07:10.667466Z","title":"In-context vectors: Making in context learning more effective and controllable through latent space steering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.667466Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:08e3adbcb4d4f0c95a0aec3e097746925c70a0c9b9f4c1729bf9c37f0c1cd6e6","observation_id":"4a9a8fef-6870-4662-95a8-d5bcde2bd181","resolution":{"observed_at":"2026-08-07T12:07:10.667466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15162","last_updated":"2023-03-09T15:02:07Z","snapshot_observed_at":"2026-08-08T12:10:35.397433Z","submitted_at":"2022-09-30T01:17:18Z","title":"Linearly Mapping from Image to Text Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15162","snapshot_observed_at":"2026-08-07T12:07:10.760990Z","title":"Linearly mapping from image to text space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.760990Z"},"links":{"cited_paper":"/paper/2209.15162","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:288bb3627c0cff700a4d35f63da9be55f16095a09d15268c89581e6ce1a03eba","observation_id":"ed5e59d7-52f9-433a-b7ff-b5ed70cd1a96","resolution":{"observed_at":"2026-08-07T12:07:10.760990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:10.807782Z","title":"Cross-tokenizer distillation via approximate likelihood matching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.807782Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:649ef94987c4e499c7cfdd63eabc1d37b63d63ec04f4cb27327f2271cdbbd794","observation_id":"27ff1048-9e8f-4700-9b80-446a185067cf","resolution":{"observed_at":"2026-08-07T12:07:10.807782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.636301Z","title":"Neuronpedia, 2025","venue":null,"work_id":"d03d655d-82c5-469e-b457-5bf29f91e1e9","year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.908705Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:08527824686e761cd9cff01610927315b038a81e7f99ae41912b93da5bd09cc3","observation_id":"4ab05bc6-bfe5-4cfd-bc63-ae374bf2e0f2","resolution":{"observed_at":"2026-08-07T12:07:14.719020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:10.953188Z","title":"Activation space interventions can be transferred between large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.953188Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:df04044a6d89df2a13a6c66889d9dc674b212c49b04eac8f09b42a60a5cc582c","observation_id":"731a14c1-d67b-46ff-be42-d98e11d29951","resolution":{"observed_at":"2026-08-07T12:07:10.953188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T12:07:11.081727Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.081727Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:f4710afc07b79d5a82f34c0bdc6241743b30fcc6a9b6d85fe9432744f70e6c07","observation_id":"243b6ac9-53e5-4a7a-92ee-4615b3a3f462","resolution":{"observed_at":"2026-08-07T12:07:11.081727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-07T12:07:11.137675Z","title":"The linear representation hypothesis and the geometry of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.137675Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:eddb65c50ca7ac9a8bf47e403182413e2a68d69a1855a109e20b0295b6c73614","observation_id":"f0e4ff69-eb6b-45ca-8c01-3f0ae753a251","resolution":{"observed_at":"2026-08-07T12:07:11.137675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.444388Z","title":"Svcca: Singular vector canonical correlation analysis for deep learning dynamics and interpretability","venue":null,"work_id":"65b3ec27-5f72-4379-af38-7fcf5eb87b4b","year":2017},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.276428Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:14f9a2e5970ad3e6912149de7a7a81913d077e914e414b67300eed49827b5e9c","observation_id":"5e965a90-148b-4552-a43c-0fb40882799b","resolution":{"observed_at":"2026-08-07T12:07:14.562404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.317050Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":"b1e1ef53-71c1-4cc8-9eec-981b11816851","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.331013Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:b447289c6f3c46b96ac72d15c6a98944d75660a2fb509ada305c46df032f4a2a","observation_id":"6277cc14-4c32-40b8-8d28-c0c1025b0305","resolution":{"observed_at":"2026-08-07T12:07:14.371582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.157174Z","title":"High-low frequency detectors","venue":null,"work_id":"4e8665b9-e88b-4a88-b156-80c4bb03a903","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.420529Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:b7c86932bbba61cc56a480950915c4daf9b06dbb32888883ecc2abdbfff37847","observation_id":"bac696bb-bc2b-4a50-bb1d-756bd26114c8","resolution":{"observed_at":"2026-08-07T12:07:14.201282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12877","last_updated":"2025-04-14T09:04:45Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-15T08:38:20Z","title":"Improving Instruction-Following in Language Models through Activation Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12877","snapshot_observed_at":"2026-08-07T12:07:11.509790Z","title":"Improving instruction-following in language models through activation steering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.509790Z"},"links":{"cited_paper":"/paper/2410.12877","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:eb03c6a3e4e93f92917535f225453c27c96d1a164b830763c174c55542521299","observation_id":"bf416959-719e-4dd2-8b26-d21fcb152e1c","resolution":{"observed_at":"2026-08-07T12:07:11.509790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.033148Z","title":"Analysing the generalisation and reliability of steering vectors","venue":null,"work_id":"f3e7b1bc-7b5c-444d-b442-88c4ba99c68e","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.544069Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:bd5f219933eac1684228b9af54e3b2460cddfac583eef39c6301f63c8e2c4fd0","observation_id":"092ae948-46ad-449a-85c3-f1f98c2b5b38","resolution":{"observed_at":"2026-08-07T12:07:14.088723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:11.660484Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.660484Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:a6b553818929fd84bb59e9c79f633ffee151505dc7893473fbd172918f2dd7b1","observation_id":"dfcabeb0-d753-4d5a-9560-76b03b72702f","resolution":{"observed_at":"2026-08-07T12:07:11.660484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-07T12:07:11.742179Z","title":"Steering language models with activation engineering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.742179Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:93cbad4be36210494a03bc7d3dcfb2aa9099aa3fa9d438a7b4625938adb60f06","observation_id":"3dd77334-8c0e-4bd9-8186-cddb362d7f7c","resolution":{"observed_at":"2026-08-07T12:07:11.742179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10491","last_updated":"2024-01-22T17:16:37Z","snapshot_observed_at":"2026-08-04T23:37:08.155969Z","submitted_at":"2024-01-19T05:02:46Z","title":"Knowledge Fusion of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10491","snapshot_observed_at":"2026-08-07T12:07:11.805248Z","title":"Knowledge fusion of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.805248Z"},"links":{"cited_paper":"/paper/2401.10491","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:a96a12572c0f15f7af249f31656cc46cfe4e51efb1e3ae92ace95e9b878e5db9","observation_id":"d09cd282-1a87-4730-8dfb-114bb3378dab","resolution":{"observed_at":"2026-08-07T12:07:11.805248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:13.828326Z","title":"Hopcroft","venue":null,"work_id":"21556733-6cc3-4262-b599-156fd34c135c","year":2018},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.894618Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:517782833cfbf590570e8ca64bfab7472b19e9cd58246b11b057ef997b96fa79","observation_id":"9264869d-b344-4858-9f8f-8a172d8fd44b","resolution":{"observed_at":"2026-08-07T12:07:13.916585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-10T14:49:08.398705Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-07T12:07:11.939328Z","title":"Axbench: Steering llms? even simple baselines outperform sparse autoencoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.939328Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:50a14d5f21e0b7269a68020611de8b537ee30ea21aa5a390c895d96b77aa71ed","observation_id":"a44a648d-3daf-4ca6-80dc-25d7bcf6f345","resolution":{"observed_at":"2026-08-07T12:07:11.939328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17409","last_updated":"2022-11-02T16:16:28Z","snapshot_observed_at":"2026-08-03T15:28:27.871509Z","submitted_at":"2022-10-24T10:16:13Z","title":"Deep Model Reassembly","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17409","snapshot_observed_at":"2026-08-07T12:07:11.998231Z","title":"Deep model reassembly","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.998231Z"},"links":{"cited_paper":"/paper/2210.17409","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:a1358f9aefc661b2580a806284a55664df7d7e12a6693226e53e136361e8fb4a","observation_id":"5dbf071c-3e88-4dcc-9fa6-e6ef100916d9","resolution":{"observed_at":"2026-08-07T12:07:11.998231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:12.071091Z","title":"P Xing, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:12.071091Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:fdf29aa5442d5a9dec1e4ecfb8efb881e83c0d4891bd6f6621069f0caf167afa","observation_id":"61d6c3d7-4da1-4053-bda2-f7419232eed3","resolution":{"observed_at":"2026-08-07T12:07:12.071091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T12:07:12.114429Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:12.114429Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:312bfff5031e65995070b216a413590ffe98f46181ea4718a2f8afa566dce9d0","observation_id":"308d5208-37dc-4c4b-bcac-2b83e1a16e8b","resolution":{"observed_at":"2026-08-07T12:07:12.114429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:13.613205Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":"22731d2c-ff1e-4f90-824b-bbb82b4d9382","year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:12.195614Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:c837d9855111a6ee842d7fb2bf1e7b589ecc8db0a070d55d672ea55760364744","observation_id":"4d05920c-ae7d-4d9a-b25a-1477954613bd","resolution":{"observed_at":"2026-08-07T12:07:13.691534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T10:11:59.833732Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 4 inbound Pith citation observations for arXiv:2506.00653."}