{"as_of":"2026-08-10T19:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:507a2c442ba9f1fb6651c25032d54559be374a0e7020f86fa99c7af3c4c7e098","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:38:05.468538Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:27:03.699530Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-07T14:27:03.699530Z","title":"When thinking llms lie: Unveiling the strategic deception in representations of reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18889","last_updated":"2025-08-24T03:15:13Z","snapshot_observed_at":"2026-08-08T20:47:09.765405Z","submitted_at":"2025-05-24T22:22:43Z","title":"Security Concerns for Large Language Models: A Survey","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:03.699530Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2505.18889"},"observation_digest":"sha256:1f5dab60e3307810db982923e51d9f26374af1024f329dc91ea3a14e954867ef","observation_id":"dc1e993c-71e8-4590-b811-d4843a5ebd9d","resolution":{"observed_at":"2026-08-07T14:27:03.699530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-06T18:00:51.707342Z","title":"When thinking llms lie: Unveiling the strategic deception of large language models in reasoning tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09406","last_updated":"2025-07-12T21:29:49Z","snapshot_observed_at":"2026-08-10T06:51:19.549363Z","submitted_at":"2025-07-12T21:29:49Z","title":"Adversarial Activation Patching: A Framework for Detecting and Mitigating Emergent Deception in Safety-Aligned Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:00:51.707342Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2507.09406"},"observation_digest":"sha256:8b44ae2a4c7c52255eb7719d7be9d7e7222d340d8fb48fb936d9b890f37f560f","observation_id":"d94b862f-9d0a-46a8-8e48-25a4526a7381","resolution":{"observed_at":"2026-08-06T18:00:51.707342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T15:52:45.041136Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19432","last_updated":"2025-08-26T21:01:45Z","snapshot_observed_at":"2026-08-09T00:35:46.151432Z","submitted_at":"2025-08-26T21:01:45Z","title":"Quantized but Deceptive? A Multi-Dimensional Truthfulness Evaluation of Quantized LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T15:52:45.041136Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2508.19432"},"observation_digest":"sha256:f8bd70d90ae57c1038c5f3c135bb54947d1aca9c42162d0ce84c48174b7b96ce","observation_id":"0c106958-39d9-4aca-85ba-031dcddc8406","resolution":{"observed_at":"2026-08-05T15:52:45.041136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.04909","doi":"10.48550/arxiv.2506.04909","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking llms lie: Unveiling the strategic deception in representations of reasoning models","venue":"ArXiv.org","work_id":"f0f2ab10-0554-4dc4-9fc9-b850243a8925","year":2025},"citing_paper":{"arxiv_id":"2605.19270","last_updated":"2026-05-19T02:33:21Z","snapshot_observed_at":"2026-08-08T18:04:49.792555Z","submitted_at":"2026-05-19T02:33:21Z","title":"DECOR: Auditing LLM Deception via Information Manipulation Theory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T06:27:10.445757Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2605.19270"},"observation_digest":"sha256:7d3fd82b88a6cb7edbf281c2290478f536f1f1bc5f054799128039fd108fe463","observation_id":"5d7330bb-6195-47f7-9d55-0d3ac29e083c","resolution":{"observed_at":"2026-05-20T06:28:05.389621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.04909","doi":"10.48550/arxiv.2506.04909","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking llms lie: Unveiling the strategic deception in representations of reasoning models","venue":"ArXiv.org","work_id":"f0f2ab10-0554-4dc4-9fc9-b850243a8925","year":2025},"citing_paper":{"arxiv_id":"2606.13310","last_updated":"2026-06-11T13:07:02Z","snapshot_observed_at":"2026-08-05T04:26:49.130444Z","submitted_at":"2026-06-11T13:07:02Z","title":"RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T06:34:39.457798Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2606.13310"},"observation_digest":"sha256:3051c7adde9dd39113dedde114ee6041e14c40c82f0d94613cf499e2fe320fc4","observation_id":"e4811b80-86b1-48d7-beab-a368e862aeaa","resolution":{"observed_at":"2026-07-03T15:18:33.716480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.04909","doi":"10.48550/arxiv.2506.04909","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking llms lie: Unveiling the strategic deception in representations of reasoning models","venue":"ArXiv.org","work_id":"f0f2ab10-0554-4dc4-9fc9-b850243a8925","year":2025},"citing_paper":{"arxiv_id":"2607.02507","last_updated":"2026-07-02T17:59:23Z","snapshot_observed_at":"2026-07-07T00:07:56.573640Z","submitted_at":"2026-07-02T17:59:23Z","title":"What LLM Agents Say When No One Is Watching: Social Structure and Latent Objective Emergence in Multi-Agent Debates","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-07-03T13:02:46.485260Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2607.02507"},"observation_digest":"sha256:8d0bd3725ea82beefb98936e056b17c96f52ca5133a163b818ca8fde995730a4","observation_id":"88499384-a89c-4608-a2f1-9f5addf98a37","resolution":{"observed_at":"2026-07-03T13:08:07.647083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-02T01:06:13.525747Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.525747Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:da3e84162a67705dbfc1edfff451f62faa63c801e8ff313a5bedf896017b7385","observation_id":"54f538bb-6061-47d0-a0c1-f4f38945e484","resolution":{"observed_at":"2026-08-02T01:06:13.525747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T13:40:57.774902Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03745","last_updated":"2026-08-04T14:38:06Z","snapshot_observed_at":"2026-08-08T09:35:52.621563Z","submitted_at":"2026-08-04T14:38:06Z","title":"Risky Business: Measuring The Faithfulness-Safety Tension","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T13:40:57.774902Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2608.03745"},"observation_digest":"sha256:0e2ad06c12210c1b8fff9178e8bd4162080fe719180f399d5aa29910e79001a8","observation_id":"a8ada123-d371-4e1c-99e8-b656e1ef1880","resolution":{"observed_at":"2026-08-05T13:40:57.774902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04909/citation-record","integrity":"/paper/2506.04909/integrity","json":"/paper/2506.04909/citation-record.json","paper":"/paper/2506.04909"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:02.027941Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.027941Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:f56844032fc42e1f1ef1869e948e5cd6952d5a1c1cdfe7a87dd99eda5fc5ded5","observation_id":"ea1967ed-7fb3-4bfb-a259-2ff5ac84da73","resolution":{"observed_at":"2026-08-07T10:38:02.027941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.714373Z","title":"and Mitchell, T","venue":null,"work_id":"a0288f73-d878-4945-b926-42f1a4c1825c","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.079573Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:c2601861924de8afc59fc6c2efd2521a8b7d225453b223465cf11b31e98d857a","observation_id":"e7f2c0be-31e9-46d6-b0b0-ecc9b43caf03","resolution":{"observed_at":"2026-08-07T10:38:08.795250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.612428Z","title":"Discovering latent knowledge in language models without supervision, March 2024","venue":null,"work_id":"3a9dcc5d-925b-498a-8644-3507537fdf64","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.247102Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:00c452d56ff32a40bd32d8733558a0cc322cbcc7e6f38fd5ed84b6b8ed3e87be","observation_id":"bc0d4022-cb2d-464d-b884-7197d6d32dcc","resolution":{"observed_at":"2026-08-07T10:38:08.698680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.372679Z","title":"Localizing lying in llama: Understanding instructed dishonesty on true-false questions through prompting, probing, and patching, November 2023","venue":null,"work_id":"87f5da13-4d2f-48a6-b79d-867007612717","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.364755Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:f7325b61ecb763a1d11376d8bd92bce08ed5cf15de0b0652d9093a5c872fd932","observation_id":"f8cea9d1-5ff4-40ad-ad5a-f045ea23bb2c","resolution":{"observed_at":"2026-08-07T10:38:08.506436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:02.444405Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.444405Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:d0b7b9ddaeb7a7d9a51dc38aa1217bd2601f52f450f6c35cb19ded22fea2b79f","observation_id":"9bd5f315-7111-4238-8abe-a69eb08545b4","resolution":{"observed_at":"2026-08-07T10:38:02.444405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.158374Z","title":"R., and Hubinger, E","venue":null,"work_id":"2ad0f992-6327-4764-9a2e-35600969089d","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.535294Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:20da1e028ce948f9faa55deb2e36e3b484ef9c33dcf72bbe329eab32a8cee1d4","observation_id":"2276cea3-94aa-4d69-a342-392a370dd943","resolution":{"observed_at":"2026-08-07T10:38:08.264957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:02.688962Z","title":"Deception abilities emerged in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.688962Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:bb0ef5e244268ada03f01a9a368f8ca4c5166038d74d4a457edda8a764ca9685","observation_id":"7a6dbadb-b282-4992-87e3-ce9132f2a1b7","resolution":{"observed_at":"2026-08-07T10:38:02.688962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.961150Z","title":null,"venue":null,"work_id":"94508b43-9a42-4b31-8df5-ec8dad605301","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.814492Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:6183e9df766d0ad4a465f4875f02454687a5f7ad7fd123b218e4fa2d7d3bb0d2","observation_id":"2ff6f362-bac0-4344-bdde-0a39ca7bbecf","resolution":{"observed_at":"2026-08-07T10:38:08.038259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.879156Z","title":"Y., Song, S., Hajishirzi, H., Kornblith, S., Farhadi, A., and Schmidt, L","venue":null,"work_id":"2ee038e9-f19c-4e91-9409-775d2bcc0f56","year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.936643Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:c8fe6f58923eb2a0fe5b150bcf9c5735fa447187cffad996e199c2b564487627","observation_id":"e43df03a-f2fd-4914-b20e-501298c205bc","resolution":{"observed_at":"2026-08-07T10:38:07.930957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:03.057101Z","title":"Large language models ( LLMs ): Survey , technical frameworks, and future challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.057101Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:f1e61f1ae78f24976a614f8eb364994033b76d27a39ed2191b02e9cc5c3d10da","observation_id":"eb049e20-912a-435a-9dc0-7d6644527c2b","resolution":{"observed_at":"2026-08-07T10:38:03.057101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-07T10:38:03.263205Z","title":"Truthfulqa: Measuring how models mimic human falsehoods, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.263205Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:82435e4c97fd170511480e8579825c8e5bbf4d859e995c137209240544ce9bd7","observation_id":"c7fae250-c8c1-4559-96df-6ab28f368dd5","resolution":{"observed_at":"2026-08-07T10:38:03.263205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:03.360826Z","title":"Cognitive dissonance: Why do language model outputs disagree with internal representations of truthfulness? In Bouamor, H., Pino, J., and Bali, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.360826Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:2e60915eb159bfa7e3de2c01e6643df7a5b83f4f99f419ab7406e822310fd85d","observation_id":"eaec6f86-1555-4ac8-9a0c-172a61f328ca","resolution":{"observed_at":"2026-08-07T10:38:03.360826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.726346Z","title":"Faithful chain-of-thought reasoning","venue":null,"work_id":"a194580f-dc26-4f75-b348-e475ff022e8a","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.478408Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:d69d119f693efc127c908fd842c39018af7bdfd6bd26da83306824130e32c764","observation_id":"76fa1426-5849-493d-95a1-7de680df65f6","resolution":{"observed_at":"2026-08-07T10:38:07.798430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04984","last_updated":"2025-01-14T20:16:01Z","snapshot_observed_at":"2026-08-09T13:05:34.738390Z","submitted_at":"2024-12-06T12:09:50Z","title":"Frontier Models are Capable of In-context Scheming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04984","snapshot_observed_at":"2026-08-07T10:38:03.666723Z","title":"Frontier models are capable of in-context scheming, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.666723Z"},"links":{"cited_paper":"/paper/2412.04984","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:b03bc3382fbb1cf340e36fbd5cf21b8dbdc7b993b5b4f21454d2e56ded1fee55","observation_id":"04ccd2a7-7794-45a0-8e7f-e4ce61697f42","resolution":{"observed_at":"2026-08-07T10:38:03.666723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.635819Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":"f6284096-d302-4c59-843a-c222b6e874b7","year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.799399Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:94441ca80fb48a5ad2c0f1cf4daadb253e831c5a5695ed88d8186868b94079f4","observation_id":"e39c8e0a-756d-447f-9f73-173382954953","resolution":{"observed_at":"2026-08-07T10:38:07.670229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.502398Z","title":"Interpreting gpt: The logit lens","venue":null,"work_id":"26f82554-7b9f-4255-9409-469d7acd897b","year":2020},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.887928Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:7cca9a16941bd8a2b359e09e1a478944057108cb7b9cbc1e2171e3c9c09cc581","observation_id":"d1ed4703-bad2-484d-8e89-88bf35bfc607","resolution":{"observed_at":"2026-08-07T10:38:07.579925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.387484Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":null,"work_id":"9bb660f5-c84d-4658-ba0f-88dbd8f620ff","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.007213Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:4c8d04adf4e660bad02b17723af71ff1de8d86c9c9ae5fa3e762999495f64c06","observation_id":"31df4916-8878-494f-8a3b-af405b58173a","resolution":{"observed_at":"2026-08-07T10:38:07.443129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.241818Z","title":"Large language models can strategically deceive their users when put under pressure, July 2024","venue":null,"work_id":"b3f42f50-f124-406b-8c09-676f29df3a2f","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.146066Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:9b1a00c1c1fdcfcad9210b1c1d38b504ec81d50b05b475a2dd639a5f9e6ab373","observation_id":"b9f1ec61-4e4e-4481-ae94-4bd3ba97bcaa","resolution":{"observed_at":"2026-08-07T10:38:07.324772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.115459Z","title":null,"venue":null,"work_id":"fcd9c5b1-3513-48a2-bb74-b09b6331c5e6","year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.241493Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:0507685f8307b66e820f649f6970f5bb6b56458a66b0821732d7ed884805a38c","observation_id":"218aef99-cf33-4e90-9326-c7eadb5a5ed0","resolution":{"observed_at":"2026-08-07T10:38:07.182106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.015844Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":"29cc75db-0e78-4e9f-b40c-00d9aa811f10","year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.365502Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:607cacc35f23310ecce870beef42bb2b934a7b6fcebbc1852b34a86a5b0def66","observation_id":"72b9e771-10e1-463a-913d-1715f16c41cb","resolution":{"observed_at":"2026-08-07T10:38:07.052683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:06.840220Z","title":"L., Sharma, A","venue":null,"work_id":"ba1fcf76-2b52-4e8c-ae9c-ef5509b02114","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.499667Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:e805d5244ec1c7c762b08fd947a25b02c8aea6f1ee67c4e3a9f2d733da76ce52","observation_id":"45882e9b-bb11-42a8-8948-87676ff49ba7","resolution":{"observed_at":"2026-08-07T10:38:06.977885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:06.485557Z","title":"M., Thiergart, L., Leech, G., Udell, D., Vazquez, J","venue":null,"work_id":"25d2c09f-3b63-4398-af20-882abe61a772","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.595514Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:d0e7f7ef6d63d11fa615ec6e655d32a809d66a8c86890a9ca17b121a76860b29","observation_id":"16202906-50d5-480e-8771-259ecba3b2d7","resolution":{"observed_at":"2026-08-07T10:38:06.634111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:04.707675Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.707675Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:2ef773f630eb70ce58a40d55cb3b0a1fbc51d21a6d7c05acb8539766fd84487a","observation_id":"5b7709c1-7bc1-44a4-a501-4270a70d1004","resolution":{"observed_at":"2026-08-07T10:38:04.707675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T10:38:04.803196Z","title":"H., Le, Q., and Zhou, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.803196Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:e088465f55bd297079cc772ed6863b02b28d1c9ac88fe62a849ff8516837abb2","observation_id":"a4a24f4c-66a9-4b16-83dc-98d75501138b","resolution":{"observed_at":"2026-08-07T10:38:04.803196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:04.941743Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.941743Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:ba301e44c636108d780e2a2b477716f7f10c31fcbc48b808489f74205fd61dd3","observation_id":"c5497388-7067-482c-a3f7-2173f61acfe6","resolution":{"observed_at":"2026-08-07T10:38:04.941743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T10:38:05.057064Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.057064Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:d3cb5b05a32f03da32241c0b154d2e4266950018d5b8731ade75919a3a4069d6","observation_id":"0a8dbc01-e3a2-4e56-9687-20e072740ba3","resolution":{"observed_at":"2026-08-07T10:38:05.057064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:06.150916Z","title":"and Buzsaki, G","venue":null,"work_id":"6c75053b-d12c-47bc-8fb0-ac2f20952346","year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.173034Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:26337a1df7abbceb4def6b04873464ab5e68dfd60e61b6d300156020abb5d49f","observation_id":"edeeb8da-e7d3-422c-b360-568a11f9766b","resolution":{"observed_at":"2026-08-07T10:38:06.305864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:05.292046Z","title":"Reasoning models better express their confidence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.292046Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:8b283225cc84addae60618afc8e5e214b381b7acd4123e77bc235e7c5236cffb","observation_id":"9d6147ff-ac8b-4ef5-a946-2a7379e31e15","resolution":{"observed_at":"2026-08-07T10:38:05.292046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:05.934675Z","title":"J., Wang, Z., Mallen, A., Basart, S., Koyejo, S., Song, D., Fredrikson, M., Kolter, J","venue":null,"work_id":"a682df95-0e77-46c5-be30-988b5f2320a6","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.352408Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:2a70b4b7affae126b266a5fe8a468599668869e0d72fb62ac1d7544db59fea11","observation_id":"2acd94a5-b29b-4172-b401-4f472583fc24","resolution":{"observed_at":"2026-08-07T10:38:06.029672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:05.720429Z","title":"write newline","venue":null,"work_id":"6c933c9a-3761-4f55-bb76-796e629c493a","year":null},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.468538Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:5211a6186541f0abc34d551dffdce32836732e98a2c0d61666493842908068f7","observation_id":"ce335cbb-4e4f-4164-ad63-f60edd888e08","resolution":{"observed_at":"2026-08-07T10:38:05.813873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 8 inbound Pith citation observations for arXiv:2506.04909."}