{"as_of":"2026-08-19T18:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7925cb00aaa95eb65e2e5e6a826eb6ad9c9d968471e8422cb298c1611eb94512","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:04:48.423450Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02820/citation-record","integrity":"/paper/2608.02820/integrity","json":"/paper/2608.02820/citation-record.json","paper":"/paper/2608.02820"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.05159","last_updated":"2026-08-03T18:11:09Z","snapshot_observed_at":"2026-08-07T23:09:07.293633Z","submitted_at":"2025-10-03T12:47:21Z","title":"Malice in Agentland: Down the Rabbit Hole of Backdoors in the AI Supply Chain","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.05159","snapshot_observed_at":"2026-08-15T15:04:48.232695Z","title":"Malice in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.232695Z"},"links":{"cited_paper":"/paper/2510.05159","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:99519e4e60eb1a6de39cdc628ef78ec0fefaa924f9dccb539dda52ddad3693e8","observation_id":"5dde80d2-dd14-4c5d-882a-2d6581182117","resolution":{"observed_at":"2026-08-15T15:04:48.232695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.236530Z","title":"Backdoor","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.236530Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:00fcc7214b13263e8b08f27b0fc3b263a310d8c2a96432b930b5e7580cc37f7c","observation_id":"b3e2c16d-25f3-4c2b-9fe4-0c6ada04797b","resolution":{"observed_at":"2026-08-15T15:04:48.236530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00374","last_updated":"2024-09-11T12:48:42Z","snapshot_observed_at":"2026-08-18T18:57:32.884383Z","submitted_at":"2023-12-01T06:36:17Z","title":"The Philosopher's Stone: Trojaning Plugins of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00374","snapshot_observed_at":"2026-08-15T15:04:48.239576Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.239576Z"},"links":{"cited_paper":"/paper/2312.00374","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:e0dc5eb1f23618b3c7faed6a1a15ef565eafd9b10c3162374e266009220caa51","observation_id":"f54c95ca-b88b-4a54-a3a4-f852578b6f59","resolution":{"observed_at":"2026-08-15T15:04:48.239576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-08-15T14:10:05.296241Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-08-15T15:04:48.243855Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.243855Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:570239f3bc91f999676cc4deb3f6e75f91a14617423f7d2fdc7d22287af31b30","observation_id":"e31fb105-e100-4dbc-91b2-a5e246d92646","resolution":{"observed_at":"2026-08-15T15:04:48.243855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00348","last_updated":"2025-04-23T01:35:19Z","snapshot_observed_at":"2026-08-17T16:58:11.267710Z","submitted_at":"2024-11-01T04:05:59Z","title":"Attention Tracker: Detecting Prompt Injection Attacks in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00348","snapshot_observed_at":"2026-08-15T15:04:48.247703Z","title":"and Chen, Pin-Yu , year = 2024, month = nov, number =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.247703Z"},"links":{"cited_paper":"/paper/2411.00348","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:c0b6bb5061e556a79655d476ac4e5648880a80defc135ba2048c47cefbf441a1","observation_id":"6f7bc421-0700-4629-ba20-aeec116d225d","resolution":{"observed_at":"2026-08-15T15:04:48.247703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.251926Z","title":"Proceedings of the 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.251926Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:42db61cad151f6567f5d8b083857bfe8a9b52acada6050de075dc0314a4f6d18","observation_id":"97fcfd7e-4d00-4e47-bc2b-4ece0a0196a0","resolution":{"observed_at":"2026-08-15T15:04:48.251926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.561","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.842489Z","title":"Defending against","venue":null,"work_id":"e64d5507-beb4-4ebb-80ef-28a63ad05e9b","year":2023},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.255401Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:daf3514cb291503b657a4928ddfa0f1f640b4ad85d2185313b7682c2c0624c87","observation_id":"25f2deb5-6347-4d44-b103-7db996353cc2","resolution":{"observed_at":"2026-08-15T15:04:48.846321Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.naacl-main.348","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.832494Z","title":null,"venue":null,"work_id":"f60005f8-1294-4aa5-bc16-d509874e5dac","year":2022},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.258894Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:12490596f6d56096945dc9e0d00f3d7d6d660b15a9362ce275c2ad0ebb7595ba","observation_id":"ee8af44b-5157-4bda-a14d-2c5fcd17626a","resolution":{"observed_at":"2026-08-15T15:04:48.835984Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.263071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.263071Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:f9af68cebdbb9feac7d76361784a006e657decf445dee4dbcb2f1688c9b4825a","observation_id":"4ac373dc-0f29-44f6-bf07-dcf2c2405de3","resolution":{"observed_at":"2026-08-15T15:04:48.263071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18823","snapshot_observed_at":"2026-08-15T15:04:48.266417Z","title":"Transcoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.266417Z"},"links":{"cited_paper":"/paper/2501.18823","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:85b52d7b92239e0511984a1999d2c4345512cf69ca78d53c729ea8ba75c91510","observation_id":"543bdd20-a41a-4afd-a618-ce2f082335bd","resolution":{"observed_at":"2026-08-15T15:04:48.266417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14461","last_updated":"2024-06-06T12:45:52Z","snapshot_observed_at":"2026-08-16T13:59:01.995103Z","submitted_at":"2024-04-22T05:08:53Z","title":"Competition Report: Finding Universal Jailbreak Backdoors in Aligned LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14461","snapshot_observed_at":"2026-08-15T15:04:48.270182Z","title":"Competition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.270182Z"},"links":{"cited_paper":"/paper/2404.14461","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:70bc41903d19253476a9d68e835d0a5083f97cbd80721c5bedbe18ab328e7198","observation_id":"5c6fe47f-40e8-4892-840c-c137ce3d6792","resolution":{"observed_at":"2026-08-15T15:04:48.270182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.357654Z","title":", year = 2022, pages =","venue":null,"work_id":"1346867f-7900-4276-baa8-25ca5839b8d0","year":2022},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.274111Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:2b0e974940bcd28e55090f76d463b5b85b819d16947effa48f6a78a737ca9e8d","observation_id":"d53af019-dd81-4fee-8e3d-085b9898d635","resolution":{"observed_at":"2026-08-15T15:04:49.360952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.277670Z","title":"doi:10.48550/arXiv.2410.21228 , urldate =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.277670Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:3569635d023d8848201fd208a698fc0ad089cdeaa8e8d8750337bd9d79e93a73","observation_id":"ef9cfecc-e2f6-4aed-91a7-0a8f49327dd3","resolution":{"observed_at":"2026-08-15T15:04:48.277670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03007","last_updated":"2024-06-05T07:14:28Z","snapshot_observed_at":"2026-08-18T18:56:43.968763Z","submitted_at":"2024-06-05T07:14:28Z","title":"BadAgent: Inserting and Activating Backdoor Attacks in LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03007","snapshot_observed_at":"2026-08-15T15:04:48.280907Z","title":"doi:10.48550/arXiv.2406.03007 , urldate =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.280907Z"},"links":{"cited_paper":"/paper/2406.03007","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:948517026875050e28dc8bc4e7637f637b6e6e40deb5c106dc5bb44527759087","observation_id":"f8496927-c4ce-4417-a376-416c0f90b06b","resolution":{"observed_at":"2026-08-15T15:04:48.280907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09433","last_updated":"2024-08-15T19:51:07Z","snapshot_observed_at":"2026-08-18T18:57:02.935657Z","submitted_at":"2023-11-15T23:07:40Z","title":"Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09433","snapshot_observed_at":"2026-08-15T15:04:48.284542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.284542Z"},"links":{"cited_paper":"/paper/2311.09433","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:f18f04e7501946ee2786195522a5654c631386bf8c2d28ba91b5e534145ce31e","observation_id":"ad231733-d94c-49a6-a5d4-45e21278f74c","resolution":{"observed_at":"2026-08-15T15:04:48.284542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12242","last_updated":"2024-01-20T04:53:35Z","snapshot_observed_at":"2026-08-18T10:22:57.249193Z","submitted_at":"2024-01-20T04:53:35Z","title":"BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12242","snapshot_observed_at":"2026-08-15T15:04:48.288236Z","title":"doi:10.48550/arXiv.2401.12242 , urldate =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.288236Z"},"links":{"cited_paper":"/paper/2401.12242","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:c3599e2f054a6f184c4f1e45785df3bbdb290b92956bae8f8cbe3b2dbb35a8bc","observation_id":"e6796a91-54bb-4b31-81f4-c63e77d77eb7","resolution":{"observed_at":"2026-08-15T15:04:48.288236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.347539Z","title":null,"venue":null,"work_id":"935ff3a1-1f13-43d2-9c3e-581a85f383fa","year":2023},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.291889Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:9f333815b19eeb886f338aad8e4a68b52d65ea16567d4f851e72fec645a32cf2","observation_id":"ddfe0afc-7ac9-4d3d-9306-eafeed6da4e8","resolution":{"observed_at":"2026-08-15T15:04:49.351018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.337001Z","title":"Defending","venue":null,"work_id":"b1ce75d9-6d6e-4a98-ae0d-16e1558ff6cd","year":2023},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.294842Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:9b737a0ea65af31a6cabf4d4a2d16db5ba14a528c71a08e5cacc4589a7d90f7e","observation_id":"22a70c17-0c4f-4e56-9f5e-27578c371f22","resolution":{"observed_at":"2026-08-15T15:04:49.340495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2409.00399","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.719928Z","title":"Rethinking","venue":null,"work_id":"eec0e7b6-e640-4213-9b79-4a84e9a50ca8","year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.297944Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:0ef50c9ee4c4a0495c0a4e0102f4bb232719f8a4b6e30b81f17a649ee16ccc7d","observation_id":"2c295535-a7ad-4c59-a3cc-a39be4b345ba","resolution":{"observed_at":"2026-08-15T15:04:48.723563Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.301130Z","title":"Backdoor","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.301130Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:e270cb0455012973c07a5205d8e04e004f16dee597a6179460d3768ec257748e","observation_id":"2fd1e39a-599a-4de5-97fc-addb24bafab1","resolution":{"observed_at":"2026-08-15T15:04:48.301130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17092","last_updated":"2024-06-24T19:29:47Z","snapshot_observed_at":"2026-08-18T18:56:36.965879Z","submitted_at":"2024-06-24T19:29:47Z","title":"BEEAR: Embedding-based Adversarial Removal of Safety Backdoors in Instruction-tuned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17092","snapshot_observed_at":"2026-08-15T15:04:48.304364Z","title":"doi:10.48550/arXiv.2406.17092 , urldate =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.304364Z"},"links":{"cited_paper":"/paper/2406.17092","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:8dab53857df3cce45b6efd77537e2af005ff9329aed0b5450aadb833ed502349","observation_id":"202a5d51-338f-4f8e-ae06-62fb39adeac4","resolution":{"observed_at":"2026-08-15T15:04:48.304364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06852","last_updated":"2025-01-04T13:39:47Z","snapshot_observed_at":"2026-08-16T23:08:17.751684Z","submitted_at":"2024-06-10T23:54:21Z","title":"A Survey of Recent Backdoor Attacks and Defenses in Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06852","snapshot_observed_at":"2026-08-15T15:04:48.307996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.307996Z"},"links":{"cited_paper":"/paper/2406.06852","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:50835f781ebdeeb1204e3ad87a4fe57753469c8680793f303e013b07058b49ff","observation_id":"5f4fa6b2-b83c-4999-9d50-19449a2e20c9","resolution":{"observed_at":"2026-08-15T15:04:48.307996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.326563Z","title":null,"venue":null,"work_id":"032094f6-81b1-4ece-96a9-b2dd528795e8","year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.311116Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:6090c2a0c15d6d47b09284db759e4923f014023cf530d134f7dd49ad248b6e4d","observation_id":"d34ebd55-61a2-4255-8016-547a380a36fe","resolution":{"observed_at":"2026-08-15T15:04:49.330548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.316118Z","title":"Transformer Circuits Thread , year=","venue":null,"work_id":"f3bba8d2-703a-4437-9bba-57cdead40db4","year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.313785Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:ebb2eb538975fe9d62d6455c0b17ec08a8dce3535c7d2d1b62154fde0ab2155f","observation_id":"69fe2ac1-c835-4b0b-9405-66f5fd240871","resolution":{"observed_at":"2026-08-15T15:04:49.319509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T15:04:48.317322Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.317322Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:9c45e5acf676ba4901cba8ce594daf2f0894f11a57a7ee3f744e3ec85379a2a7","observation_id":"7f5131f1-b223-46cd-8f6c-3e54e2cd7ba6","resolution":{"observed_at":"2026-08-15T15:04:48.317322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.320585Z","title":"arXiv preprint arXiv:2307.04657 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.320585Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:0baf64b44cd8e26c38dcff30113df8a1582678093323e5b40dce83c370cf160f","observation_id":"6f8686f4-ab10-4c7c-bf0a-77a8a6a9207f","resolution":{"observed_at":"2026-08-15T15:04:48.320585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.323235Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.323235Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:2765aa811bade71a34c09f85772d017eb0951e8419bcf7d5d6f18d557bb83417","observation_id":"95963358-d0cd-4694-bf95-3007aaea55d8","resolution":{"observed_at":"2026-08-15T15:04:48.323235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.325959Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.325959Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:8dcf7c0d3cdb7cd0a6541088051cd827b127c808cc55947454125c1351b38351","observation_id":"53ef62c9-3aca-41d5-b5ba-68e7ed4e7334","resolution":{"observed_at":"2026-08-15T15:04:48.325959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.289615Z","title":"2026 , eprint=","venue":null,"work_id":"e9ebf338-741f-42f6-8d97-b3b046b54351","year":2026},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.329232Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:1190a1e1eac3539ed000cef30192344c684519deb83b90a831a92b1460ad1aa3","observation_id":"fefe6440-9c28-4308-9178-630ee47821cc","resolution":{"observed_at":"2026-08-15T15:04:49.292819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.278267Z","title":"2026 , eprint=","venue":null,"work_id":"995461b4-4efe-42a9-9e0a-73853669d533","year":2026},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.332628Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:70ae587c13899ed8b0c4265a65913ef9e88f21edb0fb2d86cdb60f0cafa99225","observation_id":"3507fbee-a623-4bc4-badd-ede6728c1741","resolution":{"observed_at":"2026-08-15T15:04:49.281969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.266222Z","title":"2025 , eprint=","venue":null,"work_id":"2fe8ae83-44c5-47b2-b1f5-9a3ff866b4ec","year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.336055Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:1454d2c91899e3002c8d757fea1b96b21cca8577d270d53dcd2b91c97afc8787","observation_id":"503ada3e-2279-4a88-9f70-31ac4a84efca","resolution":{"observed_at":"2026-08-15T15:04:49.270050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.339122Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.339122Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:d662d63724c0ab14cdd3a3ac51e41b7627a4d9f589a96cbe11ab07ffccd53f34","observation_id":"87953aa7-1d2c-4a45-93de-f4f3c50fc745","resolution":{"observed_at":"2026-08-15T15:04:48.339122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.342705Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.342705Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:275056960da57e5aeacb551ed19c1a103fe3b1c63eda1bb4a95d5ed1dc463e95","observation_id":"29368ed1-bc26-43bb-a701-ecbfe7cd07d0","resolution":{"observed_at":"2026-08-15T15:04:48.342705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.345974Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.345974Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:3081bf6c439fe1d9457172541189e34d315989b14a2bf350f5c68dfd6b201310","observation_id":"cd5bbdad-3064-44d2-b5e1-16a4e0c7137c","resolution":{"observed_at":"2026-08-15T15:04:48.345974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.231507Z","title":"2026 , eprint=","venue":null,"work_id":"05cbafd8-c46f-4772-9c25-9d026fb03ba3","year":2026},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.349002Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:544baab1b0aa470d9343c62a056ca6f859a4db91625fe75f46f51d9a81541b12","observation_id":"0cf87d2b-fdb1-44f2-9ba4-3caca481f84b","resolution":{"observed_at":"2026-08-15T15:04:49.235149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.351972Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.351972Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:ba5d5e427cf19a415cedf2dfccaaf5f4a8073f227b59cd8dad1c13a1a32770f9","observation_id":"32978d2e-7cba-4c0e-9b79-6e98ccbebe66","resolution":{"observed_at":"2026-08-15T15:04:48.351972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-15T15:04:48.355049Z","title":"Constitutional","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.355049Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:0adf2262273ef07e4fb111408b65263a615590dc9d454eee26a371edd90fbbb8","observation_id":"07782cec-8561-43bb-8a81-28941ed315d4","resolution":{"observed_at":"2026-08-15T15:04:48.355049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-15T15:04:48.358248Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.358248Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:7242cb4810914f85f5f23222b15d38e3abdba0a44a53222a1cc16cbf6028ea67","observation_id":"063f8fc2-3a79-4932-8806-973f3be03311","resolution":{"observed_at":"2026-08-15T15:04:48.358248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17114","last_updated":"2025-01-11T16:14:10Z","snapshot_observed_at":"2026-08-15T11:50:40.409656Z","submitted_at":"2024-12-22T18:01:49Z","title":"Decentralized Governance of Autonomous AI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17114","snapshot_observed_at":"2026-08-15T15:04:48.361525Z","title":"Decentralized","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.361525Z"},"links":{"cited_paper":"/paper/2412.17114","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:a287269457de0dbf50fd7a7dc45a6658f782419657245b80adeae44e52f3ba93","observation_id":"a1b27b6d-b0c9-46d6-b1f1-d528c7dfb28f","resolution":{"observed_at":"2026-08-15T15:04:48.361525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2601.19061","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.559479Z","title":"Thought-","venue":null,"work_id":"215752f8-913c-4106-bd1d-6f0523b59211","year":2026},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.364970Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:0938b46df00d7db2350ff8bd0d8372f191eb043a9eae32745018c213f08a0221","observation_id":"70f50b2f-5603-43e3-9e16-b8d88b0ccdc9","resolution":{"observed_at":"2026-08-15T15:04:48.563938Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T15:04:48.368482Z","title":"Evaluating","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.368482Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:32667551eec66fd79c8c26b2e367277f72973448a019b9088b37c5d591e2a324","observation_id":"ccd2dea1-c24f-4ba6-91ae-8bfa581829aa","resolution":{"observed_at":"2026-08-15T15:04:48.368482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13206","last_updated":"2025-07-10T08:27:27Z","snapshot_observed_at":"2026-08-19T14:06:05.728317Z","submitted_at":"2025-06-16T08:10:04Z","title":"Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13206","snapshot_observed_at":"2026-08-15T15:04:48.372099Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.372099Z"},"links":{"cited_paper":"/paper/2506.13206","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:6cafdd354dbd5bb1ab4954df4158550201cd8eb00a1bbd0e0c44e1bb4ba1ef93","observation_id":"a5c8b220-3866-414d-b1c8-7667a6b428b7","resolution":{"observed_at":"2026-08-15T15:04:48.372099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00720","last_updated":"2023-01-30T09:15:49Z","snapshot_observed_at":"2026-08-16T16:27:25.222553Z","submitted_at":"2022-10-03T05:33:27Z","title":"Complexity-Based Prompting for Multi-Step Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00720","snapshot_observed_at":"2026-08-15T15:04:48.375458Z","title":"Complexity-","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.375458Z"},"links":{"cited_paper":"/paper/2210.00720","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:3ab0484677af2472fe564306c67e0e839592f4d4db1fc1178f71af282c35fd6d","observation_id":"080054dd-baad-4955-a0d1-40473d3b2d8d","resolution":{"observed_at":"2026-08-15T15:04:48.375458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-17T08:35:42.452149Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-15T15:04:48.378825Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.378825Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:aa5440dd020964c1e7f9b18420ee25bdad8727d3d9e24f25687c7bd405ef1f9f","observation_id":"cba25d09-b27e-4eff-be84-29c1bc7ba927","resolution":{"observed_at":"2026-08-15T15:04:48.378825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14511","last_updated":"2024-08-28T14:13:41Z","snapshot_observed_at":"2026-08-18T18:57:09.862028Z","submitted_at":"2024-08-25T04:07:18Z","title":"Unveiling the Statistical Foundations of Chain-of-Thought Prompting Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14511","snapshot_observed_at":"2026-08-15T15:04:48.382214Z","title":"Unveiling the","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.382214Z"},"links":{"cited_paper":"/paper/2408.14511","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:eb417d0d8d9ad31baff1b53de6b9b920e72e69a32ca1a21f1094d4c098949ec2","observation_id":"a77da57d-5253-4bc8-a7bc-9c45c3245c12","resolution":{"observed_at":"2026-08-15T15:04:48.382214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04057","last_updated":"2025-02-11T04:12:21Z","snapshot_observed_at":"2026-08-18T18:57:06.645316Z","submitted_at":"2024-09-06T06:57:04Z","title":"Self-Harmonized Chain of Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04057","snapshot_observed_at":"2026-08-15T15:04:48.385709Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.385709Z"},"links":{"cited_paper":"/paper/2409.04057","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:30397688a427112d51619580dc032bbc73801b1a3cb45eda82afafbad39d8b3c","observation_id":"2f4284ea-f512-456a-90c0-a32da0e039a3","resolution":{"observed_at":"2026-08-15T15:04:48.385709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.211095Z","title":"Large Language Models Are Zero-Shot Reasoners , booktitle =","venue":null,"work_id":"7ef29543-4b2a-48f6-87c9-64d65ee8cdff","year":2022},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.389082Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:8230a5df473358a62307770d678534434569d7b25593535baf78e07efb190540","observation_id":"00a93c79-a4b1-491a-8ff7-12e78715fc0c","resolution":{"observed_at":"2026-08-15T15:04:49.215181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-17T02:01:42.843839Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-15T15:04:48.392413Z","title":"Chain of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.392413Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:670779970a29434d7ee1043513a429d8497e84037847230847e5d9f612556a6a","observation_id":"8a66fef0-a546-4292-bcca-8bbdeb8e31a9","resolution":{"observed_at":"2026-08-15T15:04:48.392413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03279","last_updated":"2023-06-13T01:01:42Z","snapshot_observed_at":"2026-08-18T12:38:50.695332Z","submitted_at":"2023-04-06T17:59:03Z","title":"Do the Rewards Justify the Means? Measuring Trade-Offs Between Rewards and Ethical Behavior in the MACHIAVELLI Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03279","snapshot_observed_at":"2026-08-15T15:04:48.396330Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.396330Z"},"links":{"cited_paper":"/paper/2304.03279","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:0484a5ae46715d2836e3e89725802bc7390933246b8158ed6a3178f376e459dc","observation_id":"38f16d94-efee-44c5-a855-e2b4289887c3","resolution":{"observed_at":"2026-08-15T15:04:48.396330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-15T15:04:48.399633Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.399633Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:35be3c6e50ecf8b4f37c5ae14dd8fe9e2df709659538f991983bc4a6afae75e7","observation_id":"38d58b6f-a98b-4312-8b90-82f00a215da5","resolution":{"observed_at":"2026-08-15T15:04:48.399633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:48.402668Z","title":"Adaptive","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.402668Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:f465f298f0742eee278e779e71b93fbdb1fb2a1d843c93ebc2af546bed5c362c","observation_id":"9c0e0f4f-0c69-4c56-a97f-cc8ec8b69272","resolution":{"observed_at":"2026-08-15T15:04:48.402668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15211","last_updated":"2024-12-16T01:20:42Z","snapshot_observed_at":"2026-08-18T18:57:30.844195Z","submitted_at":"2024-07-21T16:27:24Z","title":"Failures to Find Transferable Image Jailbreaks Between Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15211","snapshot_observed_at":"2026-08-15T15:04:48.405471Z","title":"Failures to","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.405471Z"},"links":{"cited_paper":"/paper/2407.15211","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:110fc7fa6790caa4424abba7a5a354118d6a2bcea08ede71c79692cdb8c2a9e6","observation_id":"b870bf8a-04e6-4ebc-94c6-c9298303712f","resolution":{"observed_at":"2026-08-15T15:04:48.405471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.01031","last_updated":"2021-01-11T00:14:51Z","snapshot_observed_at":"2026-08-18T18:56:46.986994Z","submitted_at":"2020-03-02T17:04:38Z","title":"Explanation-Guided Backdoor Poisoning Attacks Against Malware Classifiers","version":3},"cited_work":{"arxiv_id":"2003.01031","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.01031","snapshot_observed_at":"2026-08-15T15:04:48.914927Z","title":"Explanation-Guided Backdoor Poisoning Attacks Against Malware Classifiers","venue":"cs.CR","work_id":"3bc6654a-661d-49bc-8336-c965603d0bdf","year":2020},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.409073Z"},"links":{"cited_paper":"/paper/2003.01031","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:b121d985785caf93041efcb5481322043846f5d877f97b09f37b79513c99b253","observation_id":"6e25602d-6a5c-4abc-9d17-9e8bbaaae1ef","resolution":{"observed_at":"2026-08-15T15:04:48.919842Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-15T15:04:48.412647Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.412647Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:71d1bb4ff656889c9741ae3fc4b00973a17bd3edf0e5977678eadcfe82783b87","observation_id":"18a80d26-1232-4aee-8190-8f723bf5d2bc","resolution":{"observed_at":"2026-08-15T15:04:48.412647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10200","last_updated":"2024-05-23T20:53:59Z","snapshot_observed_at":"2026-08-18T18:57:10.378740Z","submitted_at":"2024-02-15T18:55:41Z","title":"Chain-of-Thought Reasoning Without Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10200","snapshot_observed_at":"2026-08-15T15:04:48.416108Z","title":"Chain-of-","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.416108Z"},"links":{"cited_paper":"/paper/2402.10200","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:050e38b69c3265455c316aef1f95825ac4fc7a0112ef2702f629e7e1a0d7fba3","observation_id":"e205baf1-fc87-4f44-a8eb-c7b6ca9a6fbf","resolution":{"observed_at":"2026-08-15T15:04:48.416108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:04:49.198397Z","title":"and Le, Quoc V","venue":null,"work_id":"d406d15e-dfab-448f-8f9f-9f77feadb77a","year":2022},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.419794Z"},"links":{"citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:6e312d6f8b2553d722d8f56ac77c328f69e1ea518a3cd643a09dc237b64ea6e0","observation_id":"eeb7089d-acf8-4a4d-b342-8b5a24c2138c","resolution":{"observed_at":"2026-08-15T15:04:49.202211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05605","last_updated":"2025-04-08T01:36:16Z","snapshot_observed_at":"2026-08-16T09:10:12.752541Z","submitted_at":"2025-04-08T01:36:16Z","title":"ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05605","snapshot_observed_at":"2026-08-15T15:04:48.423450Z","title":", year = 2025, month = apr, number =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T15:04:48.423450Z"},"links":{"cited_paper":"/paper/2504.05605","citing_paper":"/paper/2608.02820"},"observation_digest":"sha256:60f8c26c7745144076f76e277f539540df5c33481389cd00611226ca43589cfc","observation_id":"4d706a03-ea6f-45f1-987f-ad80d7e9f2de","resolution":{"observed_at":"2026-08-15T15:04:48.423450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02820","last_updated":"2026-08-03T19:32:13Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-19T08:36:38.187414Z","submitted_at":"2026-08-03T19:32:13Z","title":"Evading Chain-of-Thought Monitoring Through Model Poisoning"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":5,"verified_fuzzy":9},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2608.02820."}