{"as_of":"2026-08-09T20:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf618843045cf522bbc433397b06b3af35ad02a9071b27a3673ea47431f7a8a8","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:40:17.766202Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T06:04:46.132037Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04774","snapshot_observed_at":"2026-08-01T06:04:46.132037Z","title":"arXiv preprint arXiv:2506.04774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22024","last_updated":"2026-07-24T06:43:09Z","snapshot_observed_at":"2026-08-08T12:54:01.031419Z","submitted_at":"2026-07-24T06:43:09Z","title":"Agent Security Needs Redefinition through a Holistic Framework","version":1},"reference_index":169,"source":"arxiv_source","source_observed_at":"2026-08-01T06:04:46.132037Z"},"links":{"cited_paper":"/paper/2506.04774","citing_paper":"/paper/2607.22024"},"observation_digest":"sha256:2fc6173da598c3f4fcc39234397da4de126a97ffe4d52b33b755c2eb7aaa48dc","observation_id":"8fde43a3-2aed-4689-b425-0635613a9c73","resolution":{"observed_at":"2026-08-01T06:04:46.132037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04774/citation-record","integrity":"/paper/2506.04774/integrity","json":"/paper/2506.04774/citation-record.json","paper":"/paper/2506.04774"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.897346Z","title":null,"venue":null,"work_id":"1062607a-e3ff-40c1-8068-4ef42134bba7","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:11.815239Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:ab9f986c6b7f94cdea3ede37f0576400789702b4a6406cb873687598d6e308c6","observation_id":"94ad6ea2-554f-42e1-ab19-04acb1203e09","resolution":{"observed_at":"2026-08-07T10:40:18.900727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09289","last_updated":"2024-10-05T19:56:20Z","snapshot_observed_at":"2026-08-09T11:10:33.004661Z","submitted_at":"2024-06-13T16:26:47Z","title":"Understanding Jailbreak Success: A Study of Latent Space Dynamics in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09289","snapshot_observed_at":"2026-08-07T10:40:11.902723Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:11.902723Z"},"links":{"cited_paper":"/paper/2406.09289","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:5910d9c64d42c7f5191e7aee67d78f0587c168713f18f582158c4bcaa4f4a90b","observation_id":"c9e68394-6eef-4cf3-a4b0-e7d8d5b7f83a","resolution":{"observed_at":"2026-08-07T10:40:11.902723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:12.048721Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.048721Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:67656e94c215b3401f587769e24cf8581254700dced81c832ec84e220a79300d","observation_id":"47f9b4a8-e997-4fd1-8530-56578e50b46a","resolution":{"observed_at":"2026-08-07T10:40:12.048721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.879176Z","title":"M.; Gebru, T.; McMillan-Major, A.; and Shmitchell, S","venue":null,"work_id":"6ee837cd-1742-49c3-ab90-5477e14bd4f9","year":2021},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.138931Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:038e7eeea6f2a63c745bece57087f302239efdbb3ee4e447698908f03d80130d","observation_id":"da2c91fc-be27-4121-968e-9506f3213a2d","resolution":{"observed_at":"2026-08-07T10:40:18.882752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04430","last_updated":"2025-02-10T19:55:17Z","snapshot_observed_at":"2026-08-06T22:57:40.145460Z","submitted_at":"2024-11-07T04:52:18Z","title":"Towards Unifying Interpretability and Control: Evaluation via Intervention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04430","snapshot_observed_at":"2026-08-07T10:40:12.266900Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.266900Z"},"links":{"cited_paper":"/paper/2411.04430","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:12f9b9d04bab6325c44fc4c24ed6c967ed2f796ee1e84f256fddb484fa905837","observation_id":"72f9e6b0-5781-4e0d-a4de-4a2be5e897e7","resolution":{"observed_at":"2026-08-07T10:40:12.266900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17027","last_updated":"2025-03-24T19:05:17Z","snapshot_observed_at":"2026-08-06T12:58:36.579099Z","submitted_at":"2024-09-25T15:30:24Z","title":"Counterfactual Token Generation in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17027","snapshot_observed_at":"2026-08-07T10:40:12.349798Z","title":"C.; Straitouri, E.; Tsirtsis, S.; and Gomez-Rodriguez, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.349798Z"},"links":{"cited_paper":"/paper/2409.17027","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:4aa57c2c300c0906f6176c5034eb8d36952538fb88fd51531a9cd4a265381027","observation_id":"77a8d546-c9e6-436e-a5c6-3503ba20ae16","resolution":{"observed_at":"2026-08-07T10:40:12.349798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07882","last_updated":"2024-10-14T17:46:28Z","snapshot_observed_at":"2026-07-06T18:29:21.709395Z","submitted_at":"2024-06-12T05:20:16Z","title":"Designing a Dashboard for Transparency and Control of Conversational AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07882","snapshot_observed_at":"2026-08-07T10:40:12.431538Z","title":"C.; Patel, O.; Riecke, J.; Raval, S.; Seow, O.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.431538Z"},"links":{"cited_paper":"/paper/2406.07882","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:78b7f71594402c5c9b709311df7a166a5026b88f1ca2811641852ecfd9489850","observation_id":"1882d3a5-a3cb-48dd-8294-f3b59f8a8415","resolution":{"observed_at":"2026-08-07T10:40:12.431538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.868784Z","title":null,"venue":null,"work_id":"641f9b92-a774-4917-bc75-8647d366a47f","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.531477Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:dbc5c42d151239dc17dd067b5cf26df2718662047215cce4a68838c01821a12d","observation_id":"b6c2add7-5eb9-4ba2-8044-6d1c55b7f653","resolution":{"observed_at":"2026-08-07T10:40:18.872041Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02164","last_updated":"2020-03-03T05:33:49Z","snapshot_observed_at":"2026-08-09T12:15:11.395844Z","submitted_at":"2019-12-04T18:32:15Z","title":"Plug and Play Language Models: A Simple Approach to Controlled Text Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02164","snapshot_observed_at":"2026-08-07T10:40:12.611935Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.611935Z"},"links":{"cited_paper":"/paper/1912.02164","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:3efe398f71449286217134bfb1de6ce91637ecf3619d6b60282f87b6bc73deea","observation_id":"77282ff0-8995-45d1-bd74-e13880b584dc","resolution":{"observed_at":"2026-08-07T10:40:12.611935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.858255Z","title":null,"venue":null,"work_id":"1535e829-88c2-4c39-8f9c-906cc46f371b","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.687937Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:81c30d6c61e7d3f221307d9e8469c6643cf3f687d776aab16d82d6ae7aa3f3c4","observation_id":"6881ef5d-2fe1-488f-8b7f-5e937104b2dd","resolution":{"observed_at":"2026-08-07T10:40:18.862105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-07T10:40:12.770267Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.770267Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:e6398f244112104ca1f6bd281bef75071f2dd98840dfd9f689d169d58bfec340","observation_id":"f2e26a96-310f-4b30-9321-10844ac4f91c","resolution":{"observed_at":"2026-08-07T10:40:12.770267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03407","last_updated":"2025-02-05T17:49:40Z","snapshot_observed_at":"2026-08-09T04:48:10.379856Z","submitted_at":"2025-02-05T17:49:40Z","title":"Detecting Strategic Deception Using Linear Probes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03407","snapshot_observed_at":"2026-08-07T10:40:12.847346Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.847346Z"},"links":{"cited_paper":"/paper/2502.03407","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:bfcc0ece7811eaaa6f4a07d1aec8bf19511009c6f20bbdb6a257fd9d878a124d","observation_id":"e3f6b74e-ae22-427d-9c24-c40fa118f0a0","resolution":{"observed_at":"2026-08-07T10:40:12.847346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T10:40:12.924665Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:12.924665Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:bd0a7f274f65254f1ab499c7a48af39ca36bbd3ef30bcd5741c2f718b1afc207","observation_id":"64cc8a35-8753-4c2f-b366-3a6dc1e96ae1","resolution":{"observed_at":"2026-08-07T10:40:12.924665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02207","last_updated":"2024-03-04T18:25:29Z","snapshot_observed_at":"2026-08-06T19:42:39.893943Z","submitted_at":"2023-10-03T17:06:52Z","title":"Language Models Represent Space and Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02207","snapshot_observed_at":"2026-08-07T10:40:13.002434Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.002434Z"},"links":{"cited_paper":"/paper/2310.02207","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:a5b8cd37839fc84faeb746f9c7af9d1d6579c59ee7a9012783e7d77f6a30a086","observation_id":"8bfeb9b5-2f5e-461b-b929-fba02fbcbc8f","resolution":{"observed_at":"2026-08-07T10:40:13.002434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.848278Z","title":null,"venue":null,"work_id":"7df639b5-edb3-4d10-be53-e19321041a2d","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.107395Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:7cac7b1218a7ee5b262847fb163d4a5daaf33712739290f77d7d0be737bf3aa5","observation_id":"b8444e9e-ce7e-4d44-a1de-815892b8bf85","resolution":{"observed_at":"2026-08-07T10:40:18.851988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.838486Z","title":null,"venue":null,"work_id":"e2dc6727-61b0-488f-b672-c22f0700b8ab","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.253157Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:4486357c1610982c473d2c04f7293079a3c69c2f85934a9861904ec1137df694","observation_id":"d50689de-925a-49e0-8e7c-ccdb40b21d92","resolution":{"observed_at":"2026-08-07T10:40:18.841912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.827878Z","title":null,"venue":null,"work_id":"c4a130e0-ee9d-4d19-afba-58c7494b82ae","year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.361926Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:7672b8a2053c5a43b1a865636ba39be48a41f58430a10061afddd7f7e2682b6a","observation_id":"33d6b09e-1433-4ebb-ab68-619ed8a1e908","resolution":{"observed_at":"2026-08-07T10:40:18.831925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:13.472104Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.472104Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:2cc9bcbcd26dc566909648392bf79ee38354b07461bef0bdb4352ade1447cf3f","observation_id":"119a767e-c9ed-4308-9bd7-8ba1b88330db","resolution":{"observed_at":"2026-08-07T10:40:13.472104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03282","last_updated":"2024-09-29T13:05:16Z","snapshot_observed_at":"2026-08-06T11:30:09.308345Z","submitted_at":"2024-07-03T17:08:52Z","title":"LLM Internal States Reveal Hallucination Risk Faced With a Query","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03282","snapshot_observed_at":"2026-08-07T10:40:13.595993Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.595993Z"},"links":{"cited_paper":"/paper/2407.03282","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:a254cbbf4bc7164ccc9fa37196ad5a674373bd2e08f1e4354d151749898c1f4b","observation_id":"0ac4247e-ab27-4e43-bf7d-4ecba1fdda1b","resolution":{"observed_at":"2026-08-07T10:40:13.595993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T10:40:13.785934Z","title":"Q.; Sablayrolles, A.; Mensch, A.; Bamford, C.; Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.785934Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:e226ec74764474511c136d251aacfa417253acdce2256251fffeab871c1f2fac","observation_id":"141e02df-241b-4a32-9d7b-cc0abad9b370","resolution":{"observed_at":"2026-08-07T10:40:13.785934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.817657Z","title":null,"venue":null,"work_id":"670b77d4-6828-4955-b729-370915e975ee","year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:13.957953Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:40bc84e5b92cb403bee057502af0be465dcdb36c5a84647555f715c8426bd5e6","observation_id":"2602e9a4-ddda-4f3e-8de5-c5d11a70ae96","resolution":{"observed_at":"2026-08-07T10:40:18.820866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12911","last_updated":"2025-04-19T04:07:54Z","snapshot_observed_at":"2026-08-07T16:01:28.483651Z","submitted_at":"2025-04-17T13:01:38Z","title":"Benchmarking Multi-National Value Alignment for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12911","snapshot_observed_at":"2026-08-07T10:40:14.097900Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.097900Z"},"links":{"cited_paper":"/paper/2504.12911","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:94e3f5894ce76a26c6b22d53c3d40418c0c2bc4fff4f80fb99ed91c495295845","observation_id":"026bdd06-ff39-456e-a758-4902ea2e3af8","resolution":{"observed_at":"2026-08-07T10:40:14.097900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16681","last_updated":"2025-02-23T18:54:15Z","snapshot_observed_at":"2026-08-07T17:54:50.710564Z","submitted_at":"2025-02-23T18:54:15Z","title":"Are Sparse Autoencoders Useful? A Case Study in Sparse Probing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16681","snapshot_observed_at":"2026-08-07T10:40:14.248537Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.248537Z"},"links":{"cited_paper":"/paper/2502.16681","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:dbe0159e92cf473dac4de88fce1234beb3f700a69614539e3e2d3395cce2afdd","observation_id":"cdd31f6d-49f1-4d16-9774-5f9653068ac4","resolution":{"observed_at":"2026-08-07T10:40:14.248537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02080","last_updated":"2025-04-02T08:53:23Z","snapshot_observed_at":"2026-08-07T17:32:14.086206Z","submitted_at":"2025-03-03T21:59:01Z","title":"Linear Representations of Political Perspective Emerge in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02080","snapshot_observed_at":"2026-08-07T10:40:14.374310Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.374310Z"},"links":{"cited_paper":"/paper/2503.02080","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:474708fa1c87e42f5334c0732cc3f189659aab65cbe4fd7bad7d0ad3d3f553a5","observation_id":"45257b3d-b96f-442f-b6d0-8a152a559c65","resolution":{"observed_at":"2026-08-07T10:40:14.374310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.805943Z","title":null,"venue":null,"work_id":"9c87e706-5537-4708-8419-e16df808a665","year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.517410Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:e1c7b589c38d02ac393f038f4353da65abe064bc090e734288862de123da086a","observation_id":"d61e7f14-1464-4f9b-a59d-29a9cdf2b49e","resolution":{"observed_at":"2026-08-07T10:40:18.810101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-07T10:40:14.643181Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.643181Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:dc1cc0db65596a3aff12535b2256ce16f6d2f54f71ab68cfb45d5fc0c27611d3","observation_id":"16f20382-c307-4930-873a-f4d579f23c8a","resolution":{"observed_at":"2026-08-07T10:40:14.643181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10965","last_updated":"2025-03-28T01:48:40Z","snapshot_observed_at":"2026-08-08T08:53:29.457485Z","submitted_at":"2025-03-14T00:21:15Z","title":"Auditing language models for hidden objectives","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10965","snapshot_observed_at":"2026-08-07T10:40:14.758765Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.758765Z"},"links":{"cited_paper":"/paper/2503.10965","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:f3601245b79a42f139f3ec6ccb5705a59be99626a84f5bb940baa5da38c2f0d9","observation_id":"3a3bdf26-6371-4dc1-9092-d0dff245fa82","resolution":{"observed_at":"2026-08-07T10:40:14.758765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.794345Z","title":null,"venue":null,"work_id":"6a6412ef-d2ad-447d-9cce-ccccd9d03a77","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.830466Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:607b610da3aee493c534da6f98b363b77fcfdc7ddf7137790f221ab02cd7d934","observation_id":"5778a28e-0e3a-4f3f-9aaa-7bc6c456806e","resolution":{"observed_at":"2026-08-07T10:40:18.798152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.783117Z","title":null,"venue":null,"work_id":"0f71a0ad-e72e-499c-9123-d60a4057b76e","year":2020},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.899684Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:cc0db222cef0455c20bdde2efbdcd83606d7259f4808467d23af08101bb2f2c2","observation_id":"b4ff2cd8-e959-4103-aaa2-566c0541250a","resolution":{"observed_at":"2026-08-07T10:40:18.786120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.772328Z","title":null,"venue":null,"work_id":"b6842187-f6ae-4a2c-b78c-716101982c91","year":2021},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:14.987655Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:c37fc4a7cdec217701d2f4e24867956bcc8375e85348994b69c453a32d033ccf","observation_id":"95a9bef5-dad0-49c9-9e51-f4b0b413bd55","resolution":{"observed_at":"2026-08-07T10:40:18.775593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T10:40:15.057352Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.057352Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:4e492364489e53cd8ce27dc8f5e3398d71d41883871f1b53de861b7771c79c0c","observation_id":"34e9a21d-5e58-4ba0-8b4a-e1b7c673a30b","resolution":{"observed_at":"2026-08-07T10:40:15.057352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-07T10:40:15.137589Z","title":"J.; and Veitch, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.137589Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:6f0aab7b85c79eea574e6178b9c537bd8838e164e32f10c94c4cea35c77f62a6","observation_id":"0b143f62-120e-4d6e-bdd1-4f6ce9cd9295","resolution":{"observed_at":"2026-08-07T10:40:15.137589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14287","last_updated":"2025-04-19T13:11:50Z","snapshot_observed_at":"2026-08-09T13:01:06.305227Z","submitted_at":"2025-04-19T13:11:50Z","title":"Probing the Subtle Ideological Manipulation of Large Language Models","version":1},"cited_work":{"arxiv_id":"2504.14287","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.14287","snapshot_observed_at":"2026-08-07T10:40:18.254853Z","title":"Probing the Subtle Ideological Manipulation of Large Language Models","venue":"cs.CL","work_id":"99d2abae-e482-4d14-a8eb-fb1dc6d7fe3f","year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.237966Z"},"links":{"cited_paper":"/paper/2504.14287","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:5ecc3b781d737f562d3bf86335a288339c4af644407ee27163498d935f3b4b06","observation_id":"10c7a550-7d23-418b-a7c1-5949aea71146","resolution":{"observed_at":"2026-08-07T10:40:18.363729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05171","last_updated":"2025-05-21T03:51:09Z","snapshot_observed_at":"2026-08-06T01:06:51.271569Z","submitted_at":"2025-01-09T11:45:05Z","title":"Emergence of human-like polarization among large language model agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05171","snapshot_observed_at":"2026-08-07T10:40:15.307646Z","title":"P.; Li, Y.; and Evans, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.307646Z"},"links":{"cited_paper":"/paper/2501.05171","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:07567822356388b94b4d5a9f81089a205831f88e468b1f5c7ed3d02473b5a7f0","observation_id":"e6e459ec-e583-4256-a318-909f7ce5ed10","resolution":{"observed_at":"2026-08-07T10:40:15.307646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24190","last_updated":"2024-11-11T04:35:11Z","snapshot_observed_at":"2026-07-06T19:43:05.453551Z","submitted_at":"2024-10-31T17:51:00Z","title":"Hidden Persuaders: LLMs' Political Leaning and Their Influence on Voters","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24190","snapshot_observed_at":"2026-08-07T10:40:15.399543Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.399543Z"},"links":{"cited_paper":"/paper/2410.24190","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:e3a34491422a337aece198403ad8dbbdb288491da20a83628da475abfc89bf41","observation_id":"c19090bd-f769-4cbd-8051-eb2c8d809adc","resolution":{"observed_at":"2026-08-07T10:40:15.399543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17245","last_updated":"2024-10-22T17:59:39Z","snapshot_observed_at":"2026-07-06T19:38:00.663759Z","submitted_at":"2024-10-22T17:59:39Z","title":"Towards Reliable Evaluation of Behavior Steering Interventions in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17245","snapshot_observed_at":"2026-08-07T10:40:15.472335Z","title":"S.; and Krueger, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.472335Z"},"links":{"cited_paper":"/paper/2410.17245","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:a75893e84603e66b8dcd979f450cc17e06ad99f5a6e0351e62decf90f27a4e27","observation_id":"d59786dc-ea37-47a1-8b6e-c6ee208fe136","resolution":{"observed_at":"2026-08-07T10:40:15.472335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16786","last_updated":"2024-06-05T10:17:53Z","snapshot_observed_at":"2026-08-09T12:16:23.866278Z","submitted_at":"2024-02-26T18:00:49Z","title":"Political Compass or Spinning Arrow? Towards More Meaningful Evaluations for Values and Opinions in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16786","snapshot_observed_at":"2026-08-07T10:40:15.582034Z","title":"o ttger, P.; Hofmann, V.; Pyatkin, V.; Hinck, M.; Kirk, H. R.; Sch \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.582034Z"},"links":{"cited_paper":"/paper/2402.16786","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:8ef78db810ad84bd5c43f5e4033c3950c0fafa5b3bd7d36487686955572c51cf","observation_id":"a76be71c-2681-4501-b4f8-ee2b4f620f18","resolution":{"observed_at":"2026-08-07T10:40:15.582034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.761931Z","title":null,"venue":null,"work_id":"db56cbb5-9924-4905-99fc-38e6aef1a6d7","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.687217Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:a981531475586e92a80b42a6bcd272f9e85a97a9fd246750c7294db98759f90e","observation_id":"fd056076-8b4d-426a-9626-772a64ede88b","resolution":{"observed_at":"2026-08-07T10:40:18.765388Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05124","last_updated":"2022-05-10T19:04:37Z","snapshot_observed_at":"2026-08-08T01:27:21.861290Z","submitted_at":"2022-05-10T19:04:37Z","title":"Extracting Latent Steering Vectors from Pretrained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05124","snapshot_observed_at":"2026-08-07T10:40:15.757086Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.757086Z"},"links":{"cited_paper":"/paper/2205.05124","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:bd53993187d46fe3aaa269058342fa6b5cf5ad30ac5d472dd057a402363cd5f0","observation_id":"7696cd5b-55a8-4088-b0f2-1a8750d958c1","resolution":{"observed_at":"2026-08-07T10:40:15.757086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05489","last_updated":"2025-06-30T00:37:41Z","snapshot_observed_at":"2026-08-09T13:30:36.885482Z","submitted_at":"2025-02-08T08:11:37Z","title":"Mechanistic Interpretability of Emotion Inference in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05489","snapshot_observed_at":"2026-08-07T10:40:15.865170Z","title":"N.; Banayeeanzade, A.; Bolourani, A.; Kian, M.; Jia, R.; and Gratch, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.865170Z"},"links":{"cited_paper":"/paper/2502.05489","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:cb08ec6c6582e35a716aa00d65c6852790f79e09c51f88c8af178bdfbe8dd7c4","observation_id":"0ddf8229-8a15-4824-be59-d32edc7d630b","resolution":{"observed_at":"2026-08-07T10:40:15.865170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01532","last_updated":"2025-04-22T07:22:45Z","snapshot_observed_at":"2026-08-07T17:33:42.340430Z","submitted_at":"2025-03-03T13:44:03Z","title":"Unmasking Implicit Bias: Evaluating Persona-Prompted LLM Responses in Power-Disparate Social Scenarios","version":2},"cited_work":{"arxiv_id":"2503.01532","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01532","snapshot_observed_at":"2026-08-07T10:40:17.965416Z","title":"Unmasking Implicit Bias: Evaluating Persona-Prompted LLM Responses in Power-Disparate Social Scenarios","venue":"cs.CY","work_id":"4171c82d-f0c0-40db-a411-5db396a3fc3b","year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:15.983958Z"},"links":{"cited_paper":"/paper/2503.01532","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:e431b40dad8097f4cc55a7cced4aac237c57bee605bc611c5d77f832684d9627","observation_id":"944e53b3-2b16-40aa-91a4-33f575d509ee","resolution":{"observed_at":"2026-08-07T10:40:18.103642Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-07T10:40:16.093515Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.093515Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:6c27ba80f4403813537c6c835b9084ded9c954816f44a9f31cb967167452cb7f","observation_id":"a02a8b38-77f9-4cce-906d-774e013f5b71","resolution":{"observed_at":"2026-08-07T10:40:16.093515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.751361Z","title":"M.; Thiergart, L.; Leech, G.; Udell, D.; Vazquez, J","venue":null,"work_id":"5f63acd6-00c7-4f75-8a62-d7a6414dc3d6","year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.182415Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:d3a786d2459eea432ae95c7ba6ce6d8ce3949188d91927333db219e30880e85e","observation_id":"4102e299-e09a-453f-96e6-1b377304da8a","resolution":{"observed_at":"2026-08-07T10:40:18.754892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-07T10:40:16.276183Z","title":"M.; Thiergart, L.; Leech, G.; Udell, D.; Vazquez, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.276183Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:66b9a1827076a4e3ae64bdcca9dffd937fd19ddba4f9646d7aa647b403d5b6e6","observation_id":"42f5e57b-87e7-4b21-8626-8562d130f76d","resolution":{"observed_at":"2026-08-07T10:40:16.276183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.740606Z","title":null,"venue":null,"work_id":"713cde17-08e8-4ffd-b92b-b589df750344","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.334370Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:295874ee94a64d56fc00994749d877f96f43208de8512b23bff55ad024b4cc49","observation_id":"d1d584af-ae64-4d2a-85f4-cd4ca69d26e4","resolution":{"observed_at":"2026-08-07T10:40:18.744082Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.730101Z","title":null,"venue":null,"work_id":"5210e555-fd98-4e5e-a53e-9217d603e791","year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.349447Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:1a1916b2a4c18fcf2ba7e6e2c041c40ec3c12ec2f4dde8c151f9b431fd0ef23d","observation_id":"edf7c0fc-022a-426d-99bd-5b655e2a404b","resolution":{"observed_at":"2026-08-07T10:40:18.733582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.720106Z","title":"D.; Cislak, A.; and Schmidt, P","venue":null,"work_id":"6a542bad-1973-4430-a11f-ead735ac33df","year":2021},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.465544Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:373372cbcbd38e3cf575839214c6fa6c1a2bbf51bdfd9f0f855b3bab24fce123","observation_id":"2c268ab6-ea56-4952-bc88-60c517d68520","resolution":{"observed_at":"2026-08-07T10:40:18.723417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-07T21:53:39.823463Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-07T10:40:16.702496Z","title":"D.; and Potts, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.702496Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:6821a29f8ea2da010ef28c5ff681f1a150cb2847bf8d1e866c20d129b6469cdd","observation_id":"8f410453-9292-436c-a201-524a7700f897","resolution":{"observed_at":"2026-08-07T10:40:16.702496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07809","last_updated":"2024-03-12T16:46:54Z","snapshot_observed_at":"2026-07-06T17:43:27.034067Z","submitted_at":"2024-03-12T16:46:54Z","title":"pyvene: A Library for Understanding and Improving PyTorch Models via Interventions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07809","snapshot_observed_at":"2026-08-07T10:40:16.892693Z","title":"D.; Manning, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.892693Z"},"links":{"cited_paper":"/paper/2403.07809","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:6e99184b08d67e6e87988e5a347c3c2a9bec355855cc48b67989e01aac558730","observation_id":"979e272c-86d7-4a6a-a427-b389965464dd","resolution":{"observed_at":"2026-08-07T10:40:16.892693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:18.709673Z","title":null,"venue":null,"work_id":"e43084d8-559a-470e-8a41-b4be127c7123","year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:16.999313Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:49838d0152ed7855d860995958899822dc9d1b248b8b70fe846a27b5f031d922","observation_id":"b7695adf-2e9b-44a0-891f-3f5a967f1bc2","resolution":{"observed_at":"2026-08-07T10:40:18.713280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T10:40:17.163625Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:17.163625Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:30ba782a3abea6988be90057077fafffb10e7dbdf83e4a00f4b9a5f7a8b6e955","observation_id":"a9827d7b-aa56-4b04-8caa-010647adb60f","resolution":{"observed_at":"2026-08-07T10:40:17.163625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00153","last_updated":"2025-05-05T19:17:46Z","snapshot_observed_at":"2026-07-06T19:24:52.534713Z","submitted_at":"2024-09-30T18:52:53Z","title":"Beyond Single Concept Vector: Modeling Concept Subspace in LLMs with Gaussian Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00153","snapshot_observed_at":"2026-08-07T10:40:17.280087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:17.280087Z"},"links":{"cited_paper":"/paper/2410.00153","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:cf0ff2e8291d9b18361babb90ae1c754965b5b56937226de04d4115c4a7e3bf0","observation_id":"c6ac4c51-036c-4cb8-8075-546b9bf895ed","resolution":{"observed_at":"2026-08-07T10:40:17.280087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T10:40:17.434936Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:17.434936Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:5ac911d2a8ff72ba123fb8f9ac6a67a5250dea90172dd4f66c5b548ac2596074","observation_id":"6c6d15f0-4053-4d04-9f87-16c03468093e","resolution":{"observed_at":"2026-08-07T10:40:17.434936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:17.654516Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:17.654516Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:666acbe5f7d39acf87bac0e4a889b8b801c2043fcb72305d8f71ab3ddbe40acc","observation_id":"674a7d5f-763d-4219-b94c-65c36c54a6e6","resolution":{"observed_at":"2026-08-07T10:40:17.654516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:17.766202Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:40:17.766202Z"},"links":{"citing_paper":"/paper/2506.04774"},"observation_digest":"sha256:1777f18adac0c9f9f20b095dcb3170f5b4691743610862061c39aac3dae7cc93","observation_id":"cb46cfd5-e600-4e78-941b-61727eaa585d","resolution":{"observed_at":"2026-08-07T10:40:17.766202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04774","last_updated":"2025-06-05T09:06:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T13:42:49.606307Z","submitted_at":"2025-06-05T09:06:59Z","title":"Fine-Grained Interpretation of Political Opinions in Large Language Models"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":49,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2506.04774."}