{"as_of":"2026-08-20T16:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73b81e7414d5c2bd1088c074c1d2298714f15affe553953f4352790dba839909","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T01:06:13.991987Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14791/citation-record","integrity":"/paper/2607.14791/integrity","json":"/paper/2607.14791/citation-record.json","paper":"/paper/2607.14791"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:11.999680Z","title":"Transformer Circuits , author =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:11.999680Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:585e8d763b049a802b95609fe9747928f7cfea1f09b1c604e26d94e8dc8c8da5","observation_id":"cf2d0450-8704-4b00-803d-6d31570301ba","resolution":{"observed_at":"2026-08-02T01:06:11.999680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:12.130859Z","title":"doi:10.48550/arXiv.2504.13707 , abstract =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.130859Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:8103362903cb6ae77b5119ff76dfa25e7cbb9cd2f5a4136113da5fe0408328f5","observation_id":"c81e630b-c054-4f38-bc68-193ab329a681","resolution":{"observed_at":"2026-08-02T01:06:12.130859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:12.236565Z","title":"and Mindermann, Soren and Hubinger, Evan and Perez, Ethan and Troy, Kevin , month = oct, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.236565Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:91edfde0b290d740ee52bb6a01c4d380e4d1e56237dfc75eb8a8cde8fa4ab5ec","observation_id":"131fa426-6fa4-40b9-a7f3-a8ba77bf3d05","resolution":{"observed_at":"2026-08-02T01:06:12.236565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:12.336525Z","title":"doi:10.48550/arXiv.2511.22619 , abstract =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.336525Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:4dbe72cdac4e719c00646f5c1cabdb66c0aaae562b8e0b7ac7b8c7c44018aa95","observation_id":"59557c60-c845-4101-b498-396405a2989c","resolution":{"observed_at":"2026-08-02T01:06:12.336525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21203/rs.3.rs-8316582/v1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating","venue":"Research Square","work_id":"0726ffee-5291-4357-9892-bb9222cb8f03","year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.439495Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:874c78ae6b04941d11428fde77cbc5bd4777401d0f821f9edd196de84cd5c8df","observation_id":"793feb99-2119-46ee-aee3-1470afa9dc48","resolution":{"observed_at":"2026-08-02T01:08:31.813229Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03450","last_updated":"2025-07-04T10:07:26Z","snapshot_observed_at":"2026-08-20T11:23:58.462996Z","submitted_at":"2025-07-04T10:07:26Z","title":"Evaluating the Evaluators: Trust in Adversarial Robustness Tests","version":1},"cited_work":{"arxiv_id":"2507.03450","doi":"10.48550/arxiv.2507.03450","metadata_source":"pith","pith_arxiv_id":"2507.03450","snapshot_observed_at":"2026-08-02T06:16:14.238844Z","title":"Evaluating the Evaluators: Trust in Adversarial Robustness Tests","venue":"cs.CR","work_id":"78fc98b5-dd06-495f-ab05-82ae675c6190","year":2025},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.581104Z"},"links":{"cited_paper":"/paper/2507.03450","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:a70efd4073462ea40602d4974c3a75718f1a09181d5e1175e4122642eb00e8f0","observation_id":"95ec2e15-544b-4143-9c09-630e9aa730fc","resolution":{"observed_at":"2026-08-02T01:08:31.579606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10462-025-11147-4","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Artificial Intelligence Review , author =","venue":"Artificial Intelligence Review","work_id":"22f9388a-943d-4c96-b9eb-318d877c8739","year":2025},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.737782Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:5d33f43cd0160437c7e6e8c6116c7a25e869684f22b46accded6c6076d44a790","observation_id":"2cc9fbdc-cb7e-4c13-827a-7b9965933696","resolution":{"observed_at":"2026-08-02T01:08:31.341020Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:12.827384Z","title":"Detecting and","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.827384Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:6a24ebaa0b3af0370d80ca69513203c2fdc749ab53bc03a4c147a05d267346b4","observation_id":"9cff7bed-fec0-4413-b6f6-336336e5cedd","resolution":{"observed_at":"2026-08-02T01:06:12.827384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:12.959076Z","title":"Adversarial machine learning : a taxonomy and terminology of attacks and mitigations , shorttitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:12.959076Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:6806e7d49e48551215447c308802ec9a0ffaaadcccec74ca95674853f993989c","observation_id":"1187fb18-be6f-4352-9182-1ac95e19a2c1","resolution":{"observed_at":"2026-08-02T01:06:12.959076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-02T01:06:13.095565Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.095565Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:f3a84651b9c5c028329ebe13c058bd36a315933135dbd075bec52b80cb04a3d6","observation_id":"ee3ec94b-199b-4f7c-a0b6-bcca9e17dfd2","resolution":{"observed_at":"2026-08-02T01:06:13.095565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:13.257843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.257843Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:0f6d233f66622af5471eba0ac0b98691b1a163f0218eedf27721e1e4d5665a19","observation_id":"f4755616-2108-47eb-a3e8-d4390353390a","resolution":{"observed_at":"2026-08-02T01:06:13.257843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:13.482885Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.482885Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:0d866101b26496002e793a795bc936e7fbdaee7294054dbc2cb9c0b5e21085c7","observation_id":"51c3763d-4c4a-44b8-a231-cb8d3184ea80","resolution":{"observed_at":"2026-08-02T01:06:13.482885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-15T04:03:05.895919Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-02T01:06:13.525747Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.525747Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:c1cdbd81afb7d5f128580c30cc82ff1f4919e0ed3cc43004079964fa3786f8e1","observation_id":"54f538bb-6061-47d0-a0c1-f4f38945e484","resolution":{"observed_at":"2026-08-02T01:06:13.525747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03407","last_updated":"2025-02-05T17:49:40Z","snapshot_observed_at":"2026-08-20T16:01:04.444205Z","submitted_at":"2025-02-05T17:49:40Z","title":"Detecting Strategic Deception Using Linear Probes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03407","snapshot_observed_at":"2026-08-02T01:06:13.565524Z","title":"Detecting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.565524Z"},"links":{"cited_paper":"/paper/2502.03407","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:52111aa4f6841e43d0c64ebdb97e656a5eb042546545b965b92798f8e8a4fe21","observation_id":"d6ae3a19-988d-4f6c-b784-3660557b3f5d","resolution":{"observed_at":"2026-08-02T01:06:13.565524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-02T01:06:13.602698Z","title":"Transcoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.602698Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:f65e66cdd3366ea7c80c706c2997807ce9fe79bea1a5863b10dc56c9db591484","observation_id":"9b9bd103-8203-42ef-adc8-eda0accbfd16","resolution":{"observed_at":"2026-08-02T01:06:13.602698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-02T01:06:13.642977Z","title":"Transcoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.642977Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:f4f72a4c36959f12836b988fc224daf627c1e5190fa8b370905ec061de628892","observation_id":"1f9592c2-90e0-4c90-8058-7b157fe71aae","resolution":{"observed_at":"2026-08-02T01:06:13.642977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25596","doi":"10.48550/arxiv.2509.25596","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"arXiv (Cornell University)","work_id":"2262eacf-0710-44d2-92f4-4c25d8ff341b","year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.678242Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:7ed4f9e00eae8b0e2e2dde9901e08317e6ccc98ca9af3b0291a7809b8fe43015","observation_id":"d181d130-3656-4ada-8f98-4892d79034f8","resolution":{"observed_at":"2026-08-02T01:08:29.793563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17272","last_updated":"2025-03-29T17:42:21Z","snapshot_observed_at":"2026-08-16T12:47:54.254043Z","submitted_at":"2025-03-21T16:15:49Z","title":"Revisiting End-To-End Sparse Autoencoder Training: A Short Finetune Is All You Need","version":2},"cited_work":{"arxiv_id":"2503.17272","doi":"10.48550/arxiv.2503.17272","metadata_source":"pith","pith_arxiv_id":"2503.17272","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Revisiting End-To-End Sparse Autoencoder Training: A Short Finetune Is All You Need","venue":"cs.LG","work_id":"d0719a9c-fdc1-4e68-b706-3011e8458ffc","year":2025},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.712325Z"},"links":{"cited_paper":"/paper/2503.17272","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:bb27cf3fa46b618cbdae3360a4cabba0d9170fa2e745950360143e78f2e0ca1c","observation_id":"ffa32250-660f-4cd1-a60a-3c921211c9da","resolution":{"observed_at":"2026-08-02T01:08:29.344749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:13.747348Z","title":"2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.747348Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:4dfbf0018fc76a376eb6421e0018ec085f6a267eebda22407c59a6f1c54ca747","observation_id":"d9e2bdf7-8ea0-40b4-83d1-0b2887f22c28","resolution":{"observed_at":"2026-08-02T01:06:13.747348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14876","last_updated":"2023-11-24T23:57:44Z","snapshot_observed_at":"2026-08-19T08:33:13.517140Z","submitted_at":"2023-11-24T23:57:44Z","title":"Exploiting Large Language Models (LLMs) through Deception Techniques and Persuasion Principles","version":1},"cited_work":{"arxiv_id":"2311.14876","doi":"10.48550/arxiv.2311.14876","metadata_source":"pith","pith_arxiv_id":"2311.14876","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Exploiting Large Language Models (LLMs) through Deception Techniques and Persuasion Principles","venue":"cs.HC","work_id":"2e4bd02d-99fd-400f-b95a-6092008663bb","year":2023},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.784531Z"},"links":{"cited_paper":"/paper/2311.14876","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:7d2af0a7ca7ba6b3f6e809a430b6f9fa55d72d351c34898f5f858cd32dcfcd4d","observation_id":"cf2c6d5c-4cc0-46fa-9731-281d86af64ef","resolution":{"observed_at":"2026-08-02T01:08:29.034753Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16513","last_updated":"2025-01-30T08:00:14Z","snapshot_observed_at":"2026-08-18T12:44:47.684179Z","submitted_at":"2025-01-27T21:26:37Z","title":"Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16513","snapshot_observed_at":"2026-08-02T01:06:13.817475Z","title":"Deception in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.817475Z"},"links":{"cited_paper":"/paper/2501.16513","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:76a0682bb5c80e4cda37c3ed1434e86b82f4c916a43e47236ff844179c3d2822","observation_id":"2c4b6ae3-14a9-4b38-87df-147106ec41a2","resolution":{"observed_at":"2026-08-02T01:06:13.817475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12831","last_updated":"2024-10-21T08:55:49Z","snapshot_observed_at":"2026-08-19T11:10:03.884371Z","submitted_at":"2024-07-03T13:01:54Z","title":"Truth is Universal: Robust Detection of Lies in LLMs","version":2},"cited_work":{"arxiv_id":"2407.12831","doi":"10.48550/arxiv.2407.12831","metadata_source":"pith","pith_arxiv_id":"2407.12831","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Truth is Universal: Robust Detection of Lies in LLMs","venue":"cs.CL","work_id":"46511d7e-fc31-432b-bc59-1c39ba5866f7","year":2024},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.856484Z"},"links":{"cited_paper":"/paper/2407.12831","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:0b78b20198ba276ca713ef803dab07d920870e0461b5e89c1aeec9fd05bb6c8f","observation_id":"2f079e38-d469-4c6a-9cf1-6f944064735b","resolution":{"observed_at":"2026-08-02T01:08:28.783851Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:13.890754Z","title":"Journal of Artificial Intelligence Research , author =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.890754Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:1dbc91e424c1460eee080fa28e37cd2b698544745d2f2530f80d4f9a73f125dd","observation_id":"08bddded-26ae-4fd2-b106-5642751447fc","resolution":{"observed_at":"2026-08-02T01:06:13.890754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:13.925985Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.925985Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:69fd37a39466d11de081b2f7ce843357a5dfa48ccad66e2e1b3cc3769843143a","observation_id":"cd6be88e-b9a7-4005-bcdf-13274036013b","resolution":{"observed_at":"2026-08-02T01:06:13.925985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T01:06:13.958761Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.958761Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:25cb7bf5d0a92178d21638fe4afcb722970c258a8246233a6ca8cb7e0a671ff9","observation_id":"edb0c837-faf4-4fe8-af70-020da0909e77","resolution":{"observed_at":"2026-08-02T01:06:13.958761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T01:06:13.991987Z","title":"2026 , note =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.991987Z"},"links":{"citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:10de3a03617dcf2653fdc6af2e5f6e8eb8d96d475ce19cea6d83ab3e04e175fa","observation_id":"cf5b1a26-b76c-491a-abc8-3b0a607682fc","resolution":{"observed_at":"2026-08-02T01:06:13.991987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":19,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.14791."}