{"as_of":"2026-08-20T05:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f172360442d044e845c696c8785ce11b665902c611fc49254983343871d0fcf0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:41:22.141140Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-08-13T11:12:58.507759Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T22:50:11.846863Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2412.14093"},"observation_digest":"sha256:a2cc18023cbeb744b0d370a2bda1a69f0fd2c5ac011afd030536471561ed07f0","observation_id":"06a3266a-2cee-4b34-8223-3dcf28092312","resolution":{"observed_at":"2026-05-12T22:50:11.946185Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-10T16:41:22.141140Z","title":"different","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13011","last_updated":"2025-04-10T16:25:31Z","snapshot_observed_at":"2026-08-17T02:54:37.934775Z","submitted_at":"2025-01-22T16:53:08Z","title":"MONA: Myopic Optimization with Non-myopic Approval Can Mitigate Multi-step Reward Hacking","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T16:41:22.141140Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2501.13011"},"observation_digest":"sha256:42aee33bd0cd5f16fd7980f54ca927583c2a90d6a96092f575cd58c0aea3204a","observation_id":"42aceb86-a0bb-481f-b238-dfaa9b454102","resolution":{"observed_at":"2026-08-10T16:41:22.141140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-06T22:03:54.383501Z","title":"and Greenblatt, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22777","last_updated":"2025-07-13T15:36:35Z","snapshot_observed_at":"2026-08-17T01:23:04.052232Z","submitted_at":"2025-06-28T06:37:10Z","title":"Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:03:54.383501Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2506.22777"},"observation_digest":"sha256:9c8115a96dcde8e3143cc8cc08e737ace80e659cd7deec0c6433465d0f6f6179","observation_id":"67be5f1f-89f9-49de-b9de-97969602ee1a","resolution":{"observed_at":"2026-08-06T22:03:54.383501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-06T19:34:55.843136Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05246","last_updated":"2025-07-07T17:54:52Z","snapshot_observed_at":"2026-08-14T01:04:51.496033Z","submitted_at":"2025-07-07T17:54:52Z","title":"When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T19:34:55.843136Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2507.05246"},"observation_digest":"sha256:d86fefcb922104c618d9d399c6ade6f82ef0edf1377c4513fda768ae70f38d23","observation_id":"31c74176-d014-4c06-b0de-dc539a7e1980","resolution":{"observed_at":"2026-08-06T19:34:55.843136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-17T02:01:42.843839Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:c392209af67a5a95f0f469be1c913d86b895aa79474bdc5d49b3ca810cbcbccd","observation_id":"1bf448f2-6dcd-4830-905a-704b7d8ece0f","resolution":{"observed_at":"2026-05-20T14:19:44.761298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-02T23:26:30.628642Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13904","last_updated":"2026-07-23T02:27:49Z","snapshot_observed_at":"2026-08-17T18:44:03.100895Z","submitted_at":"2026-02-14T21:53:47Z","title":"Diagnosing Pathological Chain-of-Thought in Reasoning Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T23:26:30.628642Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2602.13904"},"observation_digest":"sha256:50ac0b279c73c7a6d644d265b0bdf4bc30da9ef9de8ed92963d50a716cf7f85c","observation_id":"1f21787f-b906-4a30-bddd-cd0a03fb9630","resolution":{"observed_at":"2026-08-02T23:26:30.628642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2604.16242","last_updated":"2026-04-17T17:01:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-17T17:01:24Z","title":"Detecting and Suppressing Reward Hacking with Gradient Fingerprints","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T08:18:37.665350Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2604.16242"},"observation_digest":"sha256:87d6671b1fbc43adf4436b4ed4c05b97b971efae1a9350828ab9266a01de3f4a","observation_id":"3d71b3f4-33e8-4484-be57-83039ffb90f6","resolution":{"observed_at":"2026-05-10T08:22:37.572076Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2605.11746","last_updated":"2026-05-12T08:24:47Z","snapshot_observed_at":"2026-08-12T16:22:59.917674Z","submitted_at":"2026-05-12T08:24:47Z","title":"When Reasoning Traces Become Performative: Step-Level Evidence that Chain-of-Thought Is an Imperfect Oversight Channel","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T06:30:12.558660Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2605.11746"},"observation_digest":"sha256:fe47c6ce01b7d2379963406bda4144f00ec66190c85c9a981e5718b4ebf6925a","observation_id":"bc293fa8-4e7f-4c12-b12d-7002267f0c87","resolution":{"observed_at":"2026-05-13T06:32:24.393171Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2605.24396","last_updated":"2026-08-10T01:19:49Z","snapshot_observed_at":"2026-08-15T00:53:40.275358Z","submitted_at":"2026-05-23T04:42:45Z","title":"Understanding and Mitigating Premature Confidence for Better LLM Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-30T14:03:25.913615Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2605.24396"},"observation_digest":"sha256:1a21712abcf22f429f9de9c3fda1a16e62d1e7911f50e6ebd9724530a669ed69","observation_id":"03f5e166-a971-4774-ad45-9f8e85f5c4a0","resolution":{"observed_at":"2026-06-30T14:04:44.385114Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2605.26537","last_updated":"2026-05-26T04:38:56Z","snapshot_observed_at":"2026-08-17T03:40:36.896002Z","submitted_at":"2026-05-26T04:38:56Z","title":"Conceptual Steganography","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-29T18:46:39.761975Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2605.26537"},"observation_digest":"sha256:874e571dc0080104cc83ed33665debbc52603a006462464d500e70bfdd13bc3b","observation_id":"f752b928-caa1-4e30-a480-7f9f7a324065","resolution":{"observed_at":"2026-06-29T18:53:51.621461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2606.09931","last_updated":"2026-06-07T16:36:58Z","snapshot_observed_at":"2026-08-08T10:57:53.795341Z","submitted_at":"2026-06-07T16:36:58Z","title":"A Note on the Strategic Confinement Problem","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T17:30:12.165074Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2606.09931"},"observation_digest":"sha256:777d66a163dc2f7040a9fbc850a65bce41aa4c49da1149d22e6d854f4819b2ca","observation_id":"4ad341bd-0be5-4de4-80fe-cc441e544fac","resolution":{"observed_at":"2026-06-27T17:31:06.842944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2606.11063","last_updated":"2026-06-09T16:24:16Z","snapshot_observed_at":"2026-08-09T22:11:04.022394Z","submitted_at":"2026-06-09T16:24:16Z","title":"CIAware-Bench: Benchmarking Control Intervention Awareness Across Frontier LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T13:23:28.061924Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2606.11063"},"observation_digest":"sha256:93ccefbeef22fc89183c4a4c846007f3b98c528906baded1657bc85305d57318","observation_id":"122c54e7-21d8-478a-b498-880e09ae5697","resolution":{"observed_at":"2026-07-03T05:07:39.423665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2606.19603","last_updated":"2026-06-17T21:15:19Z","snapshot_observed_at":"2026-08-15T06:00:30.911318Z","submitted_at":"2026-06-17T21:15:19Z","title":"Comparing Linear Probes with Mahalanobis Cosine Similarity","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-26T20:40:03.169825Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2606.19603"},"observation_digest":"sha256:eea40648627baa28f8de299d1319df99e82f5c3ecee9cb88b51b4322b0917793","observation_id":"e8a0d71d-82ff-46f5-ac74-7566df5fb004","resolution":{"observed_at":"2026-07-04T01:09:18.923298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2606.28615","last_updated":"2026-06-26T21:14:56Z","snapshot_observed_at":"2026-08-04T19:40:32.344244Z","submitted_at":"2026-06-26T21:14:56Z","title":"What LLMs explain is not what they believe: Evaluating explanation sufficiency under models' own input beliefs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-30T00:38:21.949283Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2606.28615"},"observation_digest":"sha256:25885fa82cf10e8878363c0cbc89b8e34535ae85456ec29afd133a0c3f5ca970","observation_id":"0b3af246-dbce-44ae-b803-3e0a0600999d","resolution":{"observed_at":"2026-07-01T16:25:50.102094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-01T23:29:50.791477Z","title":"Preventing language models from hiding their reasoning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15434","last_updated":"2026-08-09T21:27:54Z","snapshot_observed_at":"2026-08-15T03:34:25.378426Z","submitted_at":"2026-07-16T20:07:47Z","title":"Coercion and Deception in AI-to-AI Management: An Agentic Benchmark of Unprompted Escalation","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T23:29:50.791477Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2607.15434"},"observation_digest":"sha256:23bde9c6d8c533e67dae26c66b101bfb664e9072fa5245e4770c8413286380f0","observation_id":"3fd1c6e4-9836-428f-8115-7be3bbfda935","resolution":{"observed_at":"2026-08-01T23:29:50.791477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-01T10:02:59.970123Z","title":"arXiv preprint arXiv:2310.18512 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20379","last_updated":"2026-08-19T13:32:38Z","snapshot_observed_at":"2026-08-20T05:26:18.797039Z","submitted_at":"2026-07-22T17:10:23Z","title":"Train the Model, Not the Reader: Decodability Supervision for Verifiable Activation Explanations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T10:02:59.970123Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2607.20379"},"observation_digest":"sha256:12d202d6380c2281ffc4cea58ca4296004cef8940cd445f82ac4e2e25ad66860","observation_id":"9df42a77-34b4-467c-8d69-28d57c845de5","resolution":{"observed_at":"2026-08-01T10:02:59.970123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-01T04:14:45.406064Z","title":"Preventing language models from hiding their reasoning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22925","last_updated":"2026-07-24T21:32:48Z","snapshot_observed_at":"2026-08-18T21:19:07.523984Z","submitted_at":"2026-07-24T21:32:48Z","title":"Not All LLM Reasoning is Visible in the Chain-of-Thought","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T04:14:45.406064Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2607.22925"},"observation_digest":"sha256:bf4c495051b35e9d1bc6baf82d5905c0313987a0036b6c168bb818bd4f494d99","observation_id":"c7dbb06f-cfdd-481b-a3dc-6ebe56957df8","resolution":{"observed_at":"2026-08-01T04:14:45.406064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.18512/citation-record","integrity":"/paper/2310.18512/integrity","json":"/paper/2310.18512/citation-record.json","paper":"/paper/2310.18512"},"outbound":[],"paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T14:48:07.623436Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2310.18512."}