{"as_of":"2026-08-13T12:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0334e2e05f55bd963a208577ca39314359be4602cdbd98bc85ab81179fbba3a2","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:20:47.964154Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.12701/citation-record","integrity":"/paper/2411.12701/integrity","json":"/paper/2411.12701/citation-record.json","paper":"/paper/2411.12701"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-12T17:20:47.789293Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.789293Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:79f4fb16db86c1c1932c65812225db69f51f917236d7bc8467ae50942a7adfaf","observation_id":"f1eb6100-59c3-4b36-98b8-2cc0e7f6c2af","resolution":{"observed_at":"2026-08-12T17:20:47.789293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-12T19:18:05.160367Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-12T17:20:47.793842Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.793842Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:793b865427cb055f8734e670a5dd8f7bcc05f6870406876bf0ec32659bc05c76","observation_id":"f178567c-0611-4702-a76d-4077d70ba11e","resolution":{"observed_at":"2026-08-12T17:20:47.793842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.798094Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.798094Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:a9765a06cb0530f1797c0c5d09d52b09de180199d55df3667ab3752d3d625a11","observation_id":"27c905c8-6ad6-47fb-bc92-6c226359ecde","resolution":{"observed_at":"2026-08-12T17:20:47.798094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.802316Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.802316Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:c4ee26a5c1359b83d03c13716c138197cddc6a3243aa1d674eb992077c77d676","observation_id":"637fa55d-1d2e-45ba-8087-bb5981de2d11","resolution":{"observed_at":"2026-08-12T17:20:47.802316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.427448Z","title":null,"venue":null,"work_id":"f99df17f-b2b4-46f2-82b5-5e0f5018c78c","year":2021},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.805946Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:bad303fc0f0b637b40953fea4d74bba57aadf8a37ed4c6e140fec273fc7b9382","observation_id":"53106c5f-ed7d-47c4-8f45-8f0b456594a3","resolution":{"observed_at":"2026-08-12T17:20:48.431158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07071","last_updated":"2024-10-03T17:26:48Z","snapshot_observed_at":"2026-08-12T23:25:36.776248Z","submitted_at":"2024-07-09T17:44:34Z","title":"Lookback Lens: Detecting and Mitigating Contextual Hallucinations in Large Language Models Using Only Attention Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07071","snapshot_observed_at":"2026-08-12T17:20:47.809937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.809937Z"},"links":{"cited_paper":"/paper/2407.07071","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:cd3e86a3b77567dd182ab1195c2f884cfe7d866247867827ce17dbed1449c13f","observation_id":"7e84de85-9ca3-4042-b9c6-24a429937849","resolution":{"observed_at":"2026-08-12T17:20:47.809937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.415262Z","title":null,"venue":null,"work_id":"61491309-f9d0-42b0-9691-7c99c302fdfe","year":2019},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.814235Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:b87213c948386b10e15631af844618baa82b85ef2e488f18dc08a5fd96b74be1","observation_id":"d3d0e54c-e0b5-4894-b46f-9b10b8d31218","resolution":{"observed_at":"2026-08-12T17:20:48.419496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-12T17:20:47.817894Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.817894Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:f3b48d5e2ba3096867b1b372c2dfaf00c935f56ec6e332980d0f58892c939f02","observation_id":"c36ca47f-55d3-468f-98c9-1f6a47776e4f","resolution":{"observed_at":"2026-08-12T17:20:47.817894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07970","last_updated":"2022-04-27T14:39:03Z","snapshot_observed_at":"2026-08-04T12:44:40.814745Z","submitted_at":"2021-11-15T18:36:25Z","title":"Triggerless Backdoor Attack for NLP Tasks with Clean Labels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07970","snapshot_observed_at":"2026-08-12T17:20:47.821833Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.821833Z"},"links":{"cited_paper":"/paper/2111.07970","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:815e2b48381eec70e21b8cc102ce4bf0bad59111cf21a16c2d6123d363265b36","observation_id":"aca82476-07ea-4f10-bc94-08849207c958","resolution":{"observed_at":"2026-08-12T17:20:47.821833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.826004Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.826004Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:0adf43698bb4f7253b1e742cfd3937df389e5f24c3f41137a87f3e9a430211ad","observation_id":"fadf73e0-49b4-453e-8f93-68d04a6cc602","resolution":{"observed_at":"2026-08-12T17:20:47.826004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.396196Z","title":null,"venue":null,"work_id":"82f131c5-1001-4af1-a060-bcfdfd243da8","year":2019},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.829829Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:cced51dcaf07dceb8f9029a28e1814cc4590eaee10b288133349a2bd4629331c","observation_id":"3d89cbbe-6302-4101-b536-5a4952ea89be","resolution":{"observed_at":"2026-08-12T17:20:48.400936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.385051Z","title":null,"venue":null,"work_id":"5e70f146-acc4-40bb-8d60-d8bda6a091d4","year":2021},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.833786Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:def02a26218bfd68ee47c6030e470fb3f6b65c01fec8b137ae08932e70765b1d","observation_id":"186b9804-67c8-4b61-ac49-354c8b15a793","resolution":{"observed_at":"2026-08-12T17:20:48.388665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.06660","last_updated":"2020-04-14T16:51:42Z","snapshot_observed_at":"2026-08-09T15:24:12.006566Z","submitted_at":"2020-04-14T16:51:42Z","title":"Weight Poisoning Attacks on Pre-trained Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.06660","snapshot_observed_at":"2026-08-12T17:20:47.837338Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.837338Z"},"links":{"cited_paper":"/paper/2004.06660","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:72fca08467d849003e600a61dc044b067445d0ac63dd866cd8b826b5e53b7e4d","observation_id":"325ab4dd-55eb-461d-9f05-2c73828076b5","resolution":{"observed_at":"2026-08-12T17:20:47.837338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12798","last_updated":"2025-05-19T04:34:50Z","snapshot_observed_at":"2026-08-12T22:58:55.229964Z","submitted_at":"2024-08-23T02:21:21Z","title":"BackdoorLLM: A Comprehensive Benchmark for Backdoor Attacks and Defenses on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12798","snapshot_observed_at":"2026-08-12T17:20:47.841557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.841557Z"},"links":{"cited_paper":"/paper/2408.12798","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:c589d62be9a3d0fe9e1b00e84e8425891c56a8de674921e99e84a83c2c35195b","observation_id":"102dd777-73dd-40ee-abd7-3faa44deb3e8","resolution":{"observed_at":"2026-08-12T17:20:47.841557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.373120Z","title":null,"venue":null,"work_id":"e8700bd6-32a7-4052-bc80-596c9bc58e1c","year":2022},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.845489Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:ddda78161edc29ef757a14fb855cad3d6135355c18e4a4fbbe0c4b8d212ef898","observation_id":"8a6dc7e3-981d-44e7-8413-5d21954d5860","resolution":{"observed_at":"2026-08-12T17:20:48.377489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.360286Z","title":null,"venue":null,"work_id":"3cb79115-6e6e-422e-ac9c-18be9c4e08ba","year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.849280Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:2fbe6763e24b4192c7ee87120c768273a0d9417a67852ae78903af3aef402f97","observation_id":"1d46b3f7-bf71-44a1-8d75-00b08198cff8","resolution":{"observed_at":"2026-08-12T17:20:48.364962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.853081Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.853081Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:87c3ad66bcac90a73bd6ad4e4f2ab312afb18f19942bb5d135ab3c8e74f39c81","observation_id":"581408bd-5971-44b6-9da1-418806bb18b6","resolution":{"observed_at":"2026-08-12T17:20:47.853081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.342130Z","title":null,"venue":null,"work_id":"cdea71f9-2603-4a71-ae1d-cb95fd44db73","year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.856909Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:a81520af254b3ea43df0a7f8b26956fa21063f13ba06e9dad5f2f03d88b30350","observation_id":"267bf8d8-1047-4a5f-89be-98078480cae2","resolution":{"observed_at":"2026-08-12T17:20:48.345482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.329758Z","title":null,"venue":null,"work_id":"15d02eaa-de65-4aa5-9bd0-3a5d050246b2","year":2018},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.861122Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:54077666b56af649c69aa6f3ec0943fab95d1524a9889b426c28ff3463d93111","observation_id":"dd48b56c-81b7-4730-a59f-60255ab08680","resolution":{"observed_at":"2026-08-12T17:20:48.334735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.317354Z","title":null,"venue":null,"work_id":"39f34e2c-939f-413e-9a32-f7daecb4454e","year":2022},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.864881Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:167c7b280cd1bd0a63abb109f6924e702150468a823687fbaf2f1bef0619f206","observation_id":"32301e36-bc1c-41bd-89f0-00daf1912226","resolution":{"observed_at":"2026-08-12T17:20:48.321842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14546","last_updated":"2020-04-30T02:20:14Z","snapshot_observed_at":"2026-08-10T07:37:00.806384Z","submitted_at":"2020-04-30T02:20:14Z","title":"WT5?! Training Text-to-Text Models to Explain their Predictions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14546","snapshot_observed_at":"2026-08-12T17:20:47.868417Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.868417Z"},"links":{"cited_paper":"/paper/2004.14546","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:2db0a5a1fb98e8da26af1b706ed870a5e8b11e356801784c0199c3d1c11af897","observation_id":"b347b450-3b4f-4704-a495-d75e18890df3","resolution":{"observed_at":"2026-08-12T17:20:47.868417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.306259Z","title":null,"venue":null,"work_id":"0c699ba7-36c9-49cc-952e-50e176bf9035","year":2020},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.872280Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:889615018f003e46f0939f5e920dd15fe45a306f091addd38c41f07a9df1a174","observation_id":"48aaefce-1dec-4c5c-a9bc-06121786601c","resolution":{"observed_at":"2026-08-12T17:20:48.309952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-12T17:20:47.876450Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.876450Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:964e9ea4de013196f9dc3beb3f7518290b8e25e9c320d9ee7e6b0c4065b80e80","observation_id":"9ccc6ebd-8851-44d4-a026-ced087df5e60","resolution":{"observed_at":"2026-08-12T17:20:47.876450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.294176Z","title":null,"venue":null,"work_id":"20234560-8918-43fd-a935-4177d0b4d80c","year":2019},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.880247Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:d4058ae8291d141fffacc830c0b204c23fdcb3d10964e89af468a4013ed9167e","observation_id":"d5ce55ae-c121-4750-91e1-6592de525067","resolution":{"observed_at":"2026-08-12T17:20:48.298126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07139","last_updated":"2021-10-14T03:54:16Z","snapshot_observed_at":"2026-08-11T11:12:33.970334Z","submitted_at":"2021-10-14T03:54:16Z","title":"Mind the Style of Text! Adversarial and Backdoor Attacks Based on Text Style Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07139","snapshot_observed_at":"2026-08-12T17:20:47.883792Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.883792Z"},"links":{"cited_paper":"/paper/2110.07139","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:004a82c14d025b39c70588fc0e4d81007543db442e6975ae1665ea66c09677ac","observation_id":"fc59da8b-0f4d-4237-95c6-d73502ddc931","resolution":{"observed_at":"2026-08-12T17:20:47.883792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.282344Z","title":null,"venue":null,"work_id":"83152a4b-2476-4e60-a8e0-c0eae49330aa","year":2021},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.887895Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:b046db332280449425dd09539116d227738dbd6b6640f05dae8d01df126b6154","observation_id":"84750a0f-f502-48d2-995a-8129036479c5","resolution":{"observed_at":"2026-08-12T17:20:48.286530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02361","last_updated":"2019-06-06T00:02:37Z","snapshot_observed_at":"2026-08-07T09:27:07.685326Z","submitted_at":"2019-06-06T00:02:37Z","title":"Explain Yourself! Leveraging Language Models for Commonsense Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02361","snapshot_observed_at":"2026-08-12T17:20:47.891761Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.891761Z"},"links":{"cited_paper":"/paper/1906.02361","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:a7a86810afaafa4e719c4ccebb3fed4c4b4d28d94a017bd736d626613be2cc16","observation_id":"bfe9e137-fcb2-4fae-9a75-dd4f03e51e0d","resolution":{"observed_at":"2026-08-12T17:20:47.891761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.271259Z","title":null,"venue":null,"work_id":"20b2065e-64a9-4327-9c18-fcc91c2088ed","year":2022},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.896208Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:0de958658593e705bdfd7daec329d8f9d48cad51560106dfb0f650b056808bd4","observation_id":"cabb687a-784b-4f96-b0a6-53419eabc550","resolution":{"observed_at":"2026-08-12T17:20:48.274947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.900803Z","title":"Manning, Andrew Ng, and Christopher Potts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.900803Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:9250a39b224c6a8499256c7b01446d3277ae9665d2b156837a6a47d25104f34d","observation_id":"c6b94e1e-7282-434b-aa34-c34e4c7b6d8e","resolution":{"observed_at":"2026-08-12T17:20:47.900803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.252533Z","title":null,"venue":null,"work_id":"ce8494d6-0e17-49e3-bc18-68939821e3bb","year":2020},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.904878Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:5b33e508d627aee0da7df266be094c9f0a0bf88f97db01c8806330f50d9cc8b7","observation_id":"416d7128-de65-417d-8066-dffb55ce40ab","resolution":{"observed_at":"2026-08-12T17:20:48.256275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17256","last_updated":"2023-09-09T18:32:00Z","snapshot_observed_at":"2026-08-13T11:32:04.016216Z","submitted_at":"2023-05-26T20:56:30Z","title":"Large Language Models Can be Lazy Learners: Analyze Shortcuts in In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17256","snapshot_observed_at":"2026-08-12T17:20:47.908765Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.908765Z"},"links":{"cited_paper":"/paper/2305.17256","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:301935ca7f6973e6db27ba004546628622bfcab1773af56f4ac3abde62bab14c","observation_id":"270d12a4-f5bf-4bad-9d1a-44d7d41ea3db","resolution":{"observed_at":"2026-08-12T17:20:47.908765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:48.238294Z","title":null,"venue":null,"work_id":"0103356d-89ac-4dbf-bbe4-5f16759b7123","year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.913728Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:f04634913808d7898c1b1c6469a922051a1fa364cb604aec1816ca0e386ed931","observation_id":"5d758a62-24bc-4551-a0c3-1eb27c043fd2","resolution":{"observed_at":"2026-08-12T17:20:48.243331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.917519Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.917519Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:eff921b80f91b4e2960032ad7a3a30cd4c881bae68c79f9c152cae88c23af596","observation_id":"b37e0629-3f99-435c-9ab2-518a2d8f542a","resolution":{"observed_at":"2026-08-12T17:20:47.917519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T17:20:47.921306Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.921306Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:80e287fe2b9d3ce87a6ff4b1fb49688c3d7a6fe258f6f193f5ca0dc9c9df0b07","observation_id":"85933582-f49c-4345-a080-874ae0a43d74","resolution":{"observed_at":"2026-08-12T17:20:47.921306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.12563","last_updated":"2021-04-12T09:10:06Z","snapshot_observed_at":"2026-08-09T12:54:21.952326Z","submitted_at":"2020-10-23T17:47:06Z","title":"Concealed Data Poisoning Attacks on NLP Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.12563","snapshot_observed_at":"2026-08-12T17:20:47.925071Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.925071Z"},"links":{"cited_paper":"/paper/2010.12563","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:7f031ca2cc321cfe471d7a876e18378c8bc0c148d744aa4ae5b7f30f9946612b","observation_id":"2179665d-6bd6-4ce5-8ef2-53b70a7e7ddc","resolution":{"observed_at":"2026-08-12T17:20:47.925071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.929218Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.929218Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:08dc8551398cd8636c95970cb3716cdb84191294071ba0443242d1db63bb5751","observation_id":"b0282666-d307-4c75-906f-0a5beda1308a","resolution":{"observed_at":"2026-08-12T17:20:47.929218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09433","last_updated":"2024-08-15T19:51:07Z","snapshot_observed_at":"2026-08-13T05:24:20.854353Z","submitted_at":"2023-11-15T23:07:40Z","title":"Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09433","snapshot_observed_at":"2026-08-12T17:20:47.932852Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.932852Z"},"links":{"cited_paper":"/paper/2311.09433","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:2e54a4cca5fec0c994c1d99bf8c53096fe7998cc2b31afb3cd5ad7c70a2114e8","observation_id":"63f11b28-45ac-4144-844b-1c0a5b001817","resolution":{"observed_at":"2026-08-12T17:20:47.932852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08946","last_updated":"2025-05-18T23:56:15Z","snapshot_observed_at":"2026-08-13T00:54:47.465600Z","submitted_at":"2024-03-13T20:25:27Z","title":"Usable XAI: 10 Strategies Towards Exploiting Explainability in the LLM Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08946","snapshot_observed_at":"2026-08-12T17:20:47.936979Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.936979Z"},"links":{"cited_paper":"/paper/2403.08946","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:6923aee7a6de1b9e7c491035ed2265c1e9de380a5785dc78edee76bc821fdb77","observation_id":"c4d7a69f-6c88-4de7-b71a-c5d8bd329d9a","resolution":{"observed_at":"2026-08-12T17:20:47.936979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14710","last_updated":"2024-04-03T09:15:15Z","snapshot_observed_at":"2026-08-13T11:34:55.306116Z","submitted_at":"2023-05-24T04:27:21Z","title":"Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14710","snapshot_observed_at":"2026-08-12T17:20:47.940866Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.940866Z"},"links":{"cited_paper":"/paper/2305.14710","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:842924e2e7e5d39e60fa8c5c009271b23f5d2afdadf8715e73e36f252f948deb","observation_id":"191b7ac9-7b76-4796-97dd-639d1dc7d929","resolution":{"observed_at":"2026-08-12T17:20:47.940866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12700","last_updated":"2023-05-29T17:59:49Z","snapshot_observed_at":"2026-08-05T08:40:17.458197Z","submitted_at":"2022-05-25T11:58:38Z","title":"BITE: Textual Backdoor Attacks with Iterative Trigger Injection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12700","snapshot_observed_at":"2026-08-12T17:20:47.944924Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.944924Z"},"links":{"cited_paper":"/paper/2205.12700","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:c4e88ea44c1221f9331fde290a858602b62c0dc37591ebef4cc0d0d896e3a877","observation_id":"6eac4be4-6f81-44cd-a736-92449211f721","resolution":{"observed_at":"2026-08-12T17:20:47.944924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03401","last_updated":"2022-10-13T03:07:01Z","snapshot_observed_at":"2026-08-13T03:07:38.103368Z","submitted_at":"2022-05-06T17:57:58Z","title":"The Unreliability of Explanations in Few-shot Prompting for Textual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03401","snapshot_observed_at":"2026-08-12T17:20:47.948928Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.948928Z"},"links":{"cited_paper":"/paper/2205.03401","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:052575169d2aef74c79aae90b8674fa04b292f710113004cde017a1aea303aca","observation_id":"1a5e70c6-d9b6-48fa-aceb-4e392b373cde","resolution":{"observed_at":"2026-08-12T17:20:47.948928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.952756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.952756Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:5a4eeddeeceb82f16a7c4c6f0d6be3e8d70eb6f710c5caa9e2e3e1b342bb273f","observation_id":"ae37f722-f861-4f1c-8a3f-6666fd1f5e07","resolution":{"observed_at":"2026-08-12T17:20:47.952756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-12T17:20:47.956116Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.956116Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:b575e7d82bee2d5ee1fa5447e7d636c016a544616276745f89d7ffc7c9326700","observation_id":"4aa54054-1c99-4f75-ae2c-2baaaf0a278e","resolution":{"observed_at":"2026-08-12T17:20:47.956116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.960168Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.960168Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:79876208843633e800486a0f9d015ea8b0dce7abfb92bd9468d3fa6782827bae","observation_id":"68f934ec-9df8-4eb0-96a6-1bab8c4dac12","resolution":{"observed_at":"2026-08-12T17:20:47.960168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:20:47.964154Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T17:20:47.964154Z"},"links":{"citing_paper":"/paper/2411.12701"},"observation_digest":"sha256:202325bc860d77702e340d128ac4d7d4f3768d3f4b671c84dc69f7133a5b2e58","observation_id":"6a609f6b-27fc-40a2-b100-184d6934f132","resolution":{"observed_at":"2026-08-12T17:20:47.964154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.12701","last_updated":"2025-02-16T03:19:01Z","latest_version":3,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-12T22:28:23.143031Z","submitted_at":"2024-11-19T18:11:36Z","title":"When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2411.12701."}