{"as_of":"2026-08-10T02:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af005393069c001eebc8a2a45f68023983fd091870af1c24421fa196697ab6ad","coverage":[{"denominator":259,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T00:50:00.427377Z","state":"measured"},{"denominator":113,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":113,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:45:56.214257Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T20:47:23.470655Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-08-07T05:45:56.214257Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07214","last_updated":"2025-06-08T16:40:40Z","snapshot_observed_at":"2026-08-09T06:16:28.205414Z","submitted_at":"2025-06-08T16:40:40Z","title":"Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:45:56.214257Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2506.07214"},"observation_digest":"sha256:3cb0eb6cf691dca427ed20a8206540d4fd596f70a22b8e07acca4825baf3ec88","observation_id":"c83337f1-0912-470d-84b6-9313d3743c0e","resolution":{"observed_at":"2026-08-07T05:45:56.214257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-08-05T15:19:14.965446Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20032","last_updated":"2025-08-27T16:34:53Z","snapshot_observed_at":"2026-08-08T17:19:15.347088Z","submitted_at":"2025-08-27T16:34:53Z","title":"Pruning Strategies for Backdoor Defense in LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T15:19:14.965446Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2508.20032"},"observation_digest":"sha256:23e2ec69b62aabdb9ff9f2287184b1d7b39849828e0f73ea95ae2154f25cf5c6","observation_id":"8d51b139-481e-43b1-bf9d-9c91d0e3fa7d","resolution":{"observed_at":"2026-08-05T15:19:14.965446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-08-04T21:44:12.472875Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07764","last_updated":"2025-09-09T13:59:00Z","snapshot_observed_at":"2026-08-04T21:44:11.122043Z","submitted_at":"2025-09-09T13:59:00Z","title":"AgentSentinel: An End-to-End and Real-Time Security Defense Framework for Computer-Use Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T21:44:12.472875Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2509.07764"},"observation_digest":"sha256:b1f7b65d8142512837ab3f644be39f6528c70886ff52f6dad52112fc467644e7","observation_id":"12eee93d-7aeb-4fa5-addd-3020c7601348","resolution":{"observed_at":"2026-08-04T21:44:12.472875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.05224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-02T20:47:23.470655Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations","venue":null,"work_id":"f7d58858-c7bf-4d36-bb09-e7b109ddaaf8","year":2025},"citing_paper":{"arxiv_id":"2510.22628","last_updated":"2026-05-01T17:57:58Z","snapshot_observed_at":"2026-07-06T22:34:03.489056Z","submitted_at":"2025-10-26T11:19:47Z","title":"Sentra-Guard: A Real-Time Multilingual Defense Against Adversarial LLM Prompts","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T04:22:54.943043Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2510.22628"},"observation_digest":"sha256:1a96b8e997362ceb2ac86e41dbfecf737e5457a2c033c98296a05c8de9872723","observation_id":"dfea1b3b-ab44-4949-9f0f-707cb3c8080f","resolution":{"observed_at":"2026-05-18T04:25:52.134980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.05224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-02T20:47:23.470655Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations","venue":null,"work_id":"f7d58858-c7bf-4d36-bb09-e7b109ddaaf8","year":2025},"citing_paper":{"arxiv_id":"2604.09748","last_updated":"2026-04-10T09:32:34Z","snapshot_observed_at":"2026-07-06T22:58:34.504325Z","submitted_at":"2026-04-10T09:32:34Z","title":"Backdoors in RLVR: Jailbreak Backdoors in LLMs From Verifiable Reward","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:46:30.854129Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2604.09748"},"observation_digest":"sha256:6a69ebf20e510ea28ce9e4f48ede73f635471a5dbe4b829e4a6a10c7330d0320","observation_id":"5a42b2e2-d79c-40e1-956c-0293916a241c","resolution":{"observed_at":"2026-05-11T06:10:59.762851Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.05224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-02T20:47:23.470655Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations","venue":null,"work_id":"f7d58858-c7bf-4d36-bb09-e7b109ddaaf8","year":2025},"citing_paper":{"arxiv_id":"2604.21700","last_updated":"2026-04-23T14:08:53Z","snapshot_observed_at":"2026-07-06T23:08:14.631453Z","submitted_at":"2026-04-23T14:08:53Z","title":"Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-09T21:37:43.177370Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2604.21700"},"observation_digest":"sha256:cd2dd046c73ec5535aa3e2101ee36e2d04ab0a0e214b8881e4897d8a98feb6a2","observation_id":"583e2a0e-2db4-422f-826a-82d121958c9b","resolution":{"observed_at":"2026-05-11T14:31:07.703958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.05224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-02T20:47:23.470655Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations","venue":null,"work_id":"f7d58858-c7bf-4d36-bb09-e7b109ddaaf8","year":2025},"citing_paper":{"arxiv_id":"2605.02255","last_updated":"2026-05-04T06:06:41Z","snapshot_observed_at":"2026-08-07T09:15:56.905794Z","submitted_at":"2026-05-04T06:06:41Z","title":"On the Privacy of LLMs: An Ablation Study","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T18:25:05.586464Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2605.02255"},"observation_digest":"sha256:c024c30d8b716ffec6c993cdeae980729d729d8e6a998dc27a4f69eadea93673","observation_id":"779c12db-b5e6-46ae-9e52-74d19fd79998","resolution":{"observed_at":"2026-05-09T06:25:48.866703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.05224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-02T20:47:23.470655Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations","venue":null,"work_id":"f7d58858-c7bf-4d36-bb09-e7b109ddaaf8","year":2025},"citing_paper":{"arxiv_id":"2606.07963","last_updated":"2026-06-06T03:41:44Z","snapshot_observed_at":"2026-08-03T02:43:15.954284Z","submitted_at":"2026-06-06T03:41:44Z","title":"Shared Latent Structures Enable Unified Backdoor Detection and Mitigation in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T20:05:30.325338Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2606.07963"},"observation_digest":"sha256:9707eafaf72dba02b3af2fa22a7440a6374a373a642737656ba9c2f756750d58","observation_id":"6171557c-7e8b-4e1b-b9b5-3cda0f24f630","resolution":{"observed_at":"2026-07-02T20:47:23.472235Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.05224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-02T20:47:23.470655Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations","venue":null,"work_id":"f7d58858-c7bf-4d36-bb09-e7b109ddaaf8","year":2025},"citing_paper":{"arxiv_id":"2606.29239","last_updated":"2026-08-03T15:22:02Z","snapshot_observed_at":"2026-08-06T23:31:35.878215Z","submitted_at":"2026-06-28T07:06:46Z","title":"Breaking the Rounding Trap: Securing LLMs against Quantization-Conditioned Backdoors","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-30T07:47:18.350953Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2606.29239"},"observation_digest":"sha256:d918446fd8b3070bf9dce16761868157484c36af5bf1d24d5087a2df11ffe350","observation_id":"caadd94a-9aac-4ef2-8459-c658acfce8cb","resolution":{"observed_at":"2026-06-30T08:04:28.746072Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-08-04T04:39:06.950528Z","title":"unexpected extra gains,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29239","last_updated":"2026-08-03T15:22:02Z","snapshot_observed_at":"2026-08-06T23:31:35.878215Z","submitted_at":"2026-06-28T07:06:46Z","title":"Breaking the Rounding Trap: Securing LLMs against Quantization-Conditioned Backdoors","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T04:39:06.950528Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2606.29239"},"observation_digest":"sha256:eb75407b6664214df0aebb92a758008252c096a33cd635c5cc0165a66ab95c8b","observation_id":"7b47a274-c1bd-43bc-9e01-d7e2b50e540e","resolution":{"observed_at":"2026-08-04T04:39:06.950528Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":"2502.05224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-02T20:47:23.470655Z","title":"A survey on backdoor threats in large language models (llms): Attacks, defenses, and evaluations","venue":null,"work_id":"f7d58858-c7bf-4d36-bb09-e7b109ddaaf8","year":2025},"citing_paper":{"arxiv_id":"2607.01019","last_updated":"2026-07-01T14:52:04Z","snapshot_observed_at":"2026-08-03T04:34:00.648732Z","submitted_at":"2026-07-01T14:52:04Z","title":"Toward a Unified Security and Privacy Framework for AI-Native 6G Networks","version":1},"reference_index":135,"source":"pdf_text","source_observed_at":"2026-07-02T10:26:41.609641Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2607.01019"},"observation_digest":"sha256:5dd65a968fab263abc9c8afb57ec0c04e24b508d377f964c2c89320775bf9de9","observation_id":"5b16460d-6c13-4811-b94e-1d81ebeda072","resolution":{"observed_at":"2026-07-02T10:26:51.394825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-08-01T09:30:49.265611Z","title":"A survey on backdoor threats in large language models (LLMs): Attacks, defenses, and evaluations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20759","last_updated":"2026-07-22T22:20:02Z","snapshot_observed_at":"2026-08-09T04:22:22.445624Z","submitted_at":"2026-07-22T22:20:02Z","title":"IssueTrojanBench: Benchmarking AI Coding Agents Against Malicious Issue Requests","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T09:30:49.265611Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2607.20759"},"observation_digest":"sha256:7d904a9808d1348298ecac6e24ffe23f55ecbf5af9bc0f03facb843fb2e5d2be","observation_id":"ec30df92-7a97-4f3c-9842-8833e8b5b87e","resolution":{"observed_at":"2026-08-01T09:30:49.265611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05224","snapshot_observed_at":"2026-07-31T23:55:34.674415Z","title":"arXiv preprint arXiv:2502.05224 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23292","last_updated":"2026-07-25T17:03:33Z","snapshot_observed_at":"2026-08-08T22:08:57.724761Z","submitted_at":"2026-07-25T17:03:33Z","title":"Hiding in Plain Sight: An Effective Physical Adversarial Patch Attack against Visual-Infrared Fused Face Detection","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-07-31T23:55:34.674415Z"},"links":{"cited_paper":"/paper/2502.05224","citing_paper":"/paper/2607.23292"},"observation_digest":"sha256:7b422509475adaff55d0f7c4a47f2054c36c94956769d98944c916d9e9712670","observation_id":"d2d0e15f-2955-4bfc-9f2f-6d1db8455ab8","resolution":{"observed_at":"2026-07-31T23:55:34.674415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05224/citation-record","integrity":"/paper/2502.05224/integrity","json":"/paper/2502.05224/citation-record.json","paper":"/paper/2502.05224"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:59.954673Z","title":"Bloomberggpt: A large language model for finance,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.954673Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:e8b204702f47f7ba1de9b650b8f613143f6f633952bf7ce4d0face958287edce","observation_id":"14e03e25-324a-4605-8309-a22a8becd6bf","resolution":{"observed_at":"2026-08-09T00:49:59.954673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:59.964064Z","title":"Making llms worth every penny: Resource-limited text classification in banking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.964064Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:799a3b3dd81e529f5de887027659bc4a98f024d53ed9f053688e3c0dd28b0fde","observation_id":"648cde59-fb59-449a-977f-34212e328b32","resolution":{"observed_at":"2026-08-09T00:49:59.964064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:59.968059Z","title":"Better to ask in english: Cross-lingual evaluation of large language models for healthcare queries,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.968059Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:130ddd0772af6817ac19c2dcffd988dc4af58b2171eddd2ea10f5a072b132ff5","observation_id":"e6d3ab1b-a11c-407e-b0d8-3df254591376","resolution":{"observed_at":"2026-08-09T00:49:59.968059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14815","last_updated":"2024-12-19T13:09:46Z","snapshot_observed_at":"2026-07-06T20:10:04.155304Z","submitted_at":"2024-12-19T13:09:46Z","title":"Non-intrusive and Unconstrained Keystroke Inference in VR Platforms via Infrared Side Channel","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14815","snapshot_observed_at":"2026-08-09T00:49:59.971897Z","title":"Non-intrusive and un- constrained keystroke inference in vr platforms via infrared side channel,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.971897Z"},"links":{"cited_paper":"/paper/2412.14815","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:88a013fd4aceb23afb805a70ac64832235952de44e79187f705facdaae913626","observation_id":"7f508a8b-83cb-49ca-a856-709490adeff9","resolution":{"observed_at":"2026-08-09T00:49:59.971897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16092","last_updated":"2026-06-08T08:40:57Z","snapshot_observed_at":"2026-07-06T15:47:45.886474Z","submitted_at":"2023-06-28T10:48:34Z","title":"Chatlaw: A Multi-Agent Legal Assistant based on a Role-Aligned Mixture-of-Experts Architecture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16092","snapshot_observed_at":"2026-08-09T00:49:59.976229Z","title":"Chatlaw: A multi-agent collaborative legal assistant with knowledge graph enhanced mixture-of- experts large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.976229Z"},"links":{"cited_paper":"/paper/2306.16092","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7695bd4d73b02976e960672161fa2f4f4be1b9065759366348756b0674389484","observation_id":"f6ceddf4-3b99-452a-b397-e4160f92f56b","resolution":{"observed_at":"2026-08-09T00:49:59.976229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.16034","last_updated":"2021-06-30T13:01:33Z","snapshot_observed_at":"2026-08-08T04:59:56.661596Z","submitted_at":"2021-06-30T13:01:33Z","title":"AutoLAW: Augmented Legal Reasoning through Legal Precedent Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.16034","snapshot_observed_at":"2026-08-09T00:49:59.980439Z","title":"Autolaw: Augmented legal reasoning through legal precedent prediction,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.980439Z"},"links":{"cited_paper":"/paper/2106.16034","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:63c6d8a67dd8503b257856084a3abebb1cd089c650169e9aa1c43a9f29dcdcb8","observation_id":"ec8f17c7-4d4a-495d-be3a-f289b38f0979","resolution":{"observed_at":"2026-08-09T00:49:59.980439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:59.984469Z","title":"Badnets: Identifying vulnerabilities in the machine learning model supply chain,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.984469Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:a87b5fb504aa101c54544aaaa4fa84d34cab68b8ca93cbf6e6792471bc796632","observation_id":"9959c537-76ed-40ea-8098-75ebe3fa392a","resolution":{"observed_at":"2026-08-09T00:49:59.984469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:59.992523Z","title":"Sok: Security and privacy in machine learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.992523Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:5e3166796f1d9d087ee788482c59cf4b69929e62b52634ec67cbfd485eb1b224","observation_id":"c70b8d15-82d5-429f-ba5f-eb23c1320812","resolution":{"observed_at":"2026-08-09T00:49:59.992523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:49:59.996922Z","title":"Talking about large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T00:49:59.996922Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:5f8a93000e6a794e5b873f490ee096f9823d4f6613acec2d1fc065b4b24c42f2","observation_id":"58db47f2-7d5b-4594-b8f1-058e1e66282b","resolution":{"observed_at":"2026-08-09T00:49:59.996922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.000625Z","title":"Attributing chatgpt-generated source codes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.000625Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:613a5f16934c8cf358bba74e0a522750b3c3e1db9a88619de2414e9ca4c6041c","observation_id":"531fa963-2115-4289-97c9-1a493e630ad9","resolution":{"observed_at":"2026-08-09T00:50:00.000625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16739","last_updated":"2025-06-04T07:22:47Z","snapshot_observed_at":"2026-08-03T22:38:00.596602Z","submitted_at":"2023-09-28T06:22:59Z","title":"Pushing Large Language Models to the 6G Edge: Vision, Challenges, and Opportunities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16739","snapshot_observed_at":"2026-08-09T00:50:00.004307Z","title":"Pushing large language models to the 6g edge: Vision, challenges, and opportunities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.004307Z"},"links":{"cited_paper":"/paper/2309.16739","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:98adcb396ca1482b57d99e8c4488f30f584c819ac289061dd27761f9c2d79873","observation_id":"8a83fe92-5a22-4f21-9a83-d0c1bec14fec","resolution":{"observed_at":"2026-08-09T00:50:00.004307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00952","last_updated":"2024-07-01T04:13:25Z","snapshot_observed_at":"2026-08-09T00:00:59.056808Z","submitted_at":"2024-07-01T04:13:25Z","title":"SplitLoRA: A Split Parameter-Efficient Fine-Tuning Framework for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00952","snapshot_observed_at":"2026-08-09T00:50:00.008277Z","title":"Splitlora: A split parameter- efficient fine-tuning framework for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.008277Z"},"links":{"cited_paper":"/paper/2407.00952","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:813c91687021f1c50f7746ec34559ca3e850912d203247c9fff522b330548331","observation_id":"d3b8c47c-0eb3-41f8-afc3-52e764ed5517","resolution":{"observed_at":"2026-08-09T00:50:00.008277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06448","last_updated":"2024-12-06T07:10:30Z","snapshot_observed_at":"2026-07-06T17:57:52.364338Z","submitted_at":"2024-04-09T16:50:30Z","title":"Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06448","snapshot_observed_at":"2026-08-09T00:50:00.012742Z","title":"Automated federated pipeline for parameter- efficient fine-tuning of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.012742Z"},"links":{"cited_paper":"/paper/2404.06448","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:516af3d63b0227d332040c8f239629c1782226bf1715ecfcb991164797eb2aa3","observation_id":"5464dfd2-0b43-4c5d-b850-9766d2c0fa30","resolution":{"observed_at":"2026-08-09T00:50:00.012742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08165","last_updated":"2025-01-14T14:46:19Z","snapshot_observed_at":"2026-08-07T05:58:04.089167Z","submitted_at":"2025-01-14T14:46:19Z","title":"I Can Find You in Seconds! Leveraging Large Language Models for Code Authorship Attribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08165","snapshot_observed_at":"2026-08-09T00:50:00.017261Z","title":"I can find you in sec- onds! leveraging large language models for code authorship attribution,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.017261Z"},"links":{"cited_paper":"/paper/2501.08165","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:3b85d3d05a6b137c988f13353faf3e9d9127bd615b7025b19a52b1ddfc223139","observation_id":"dfc3c51d-4725-42c9-8b59-fa1a17535f84","resolution":{"observed_at":"2026-08-09T00:50:00.017261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.022056Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.022056Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:58530a8c096c1398a179ad804b30030e9eb7d992a41013e38715bfdb9494ffbd","observation_id":"de871047-4680-476f-b2b1-6e88c7783c4f","resolution":{"observed_at":"2026-08-09T00:50:00.022056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T00:50:00.026478Z","title":"Gpt-4 technical report. arxiv 2303.08774,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.026478Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:566a46b30baca58ded0ffde1bdd2436d811dbd452ecd2c5d6c6662c5aebe3093","observation_id":"5929b4a0-d3fc-4db2-8a74-4b8f0c992e4c","resolution":{"observed_at":"2026-08-09T00:50:00.026478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.030907Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.030907Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:21ace5337b5395fc69604a3ce7c609569631957ab4f24f91f1f4c1e4558b05a3","observation_id":"c53bd2c9-175f-4c61-a83d-bbc686ca2d9b","resolution":{"observed_at":"2026-08-09T00:50:00.030907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.035150Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.035150Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:1797908edfcabf6299736e62ba9d7be6dde276f3765a630cea03dd4e85dc2ee0","observation_id":"f6f5d9b4-d86e-46ba-ad7b-d5508d4866de","resolution":{"observed_at":"2026-08-09T00:50:00.035150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.039427Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.039427Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:a2092c9e80cc880defdbf3dd3ac3b4cb26486158a23fc2834faa858e4d46e1fc","observation_id":"afbc234a-0875-402c-9951-4a1835edc294","resolution":{"observed_at":"2026-08-09T00:50:00.039427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.043756Z","title":"Gpt-j-6b: A 6 billion pa- rameter autoregressive language model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.043756Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:32a0661c4d7be716106c5edc54d52ef43b4957e4e8d016211e1ecebdd44d2169","observation_id":"2877f053-7c77-4d66-9c2a-d900751be6eb","resolution":{"observed_at":"2026-08-09T00:50:00.043756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.047935Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.047935Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:876d6f4ce9030fb36b09e1ed6e1ad711d6270650485a65545e6c02d624af14ba","observation_id":"d7210239-c313-4595-a469-ecb353961de3","resolution":{"observed_at":"2026-08-09T00:50:00.047935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-09T00:50:00.052158Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.052158Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:e8277f710a7bd8e7df74d670da34789b0aa9876089e268bb1179d878668f16ae","observation_id":"3e40b050-9da0-46fe-a1aa-4c7faebbf1df","resolution":{"observed_at":"2026-08-09T00:50:00.052158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.056448Z","title":"Stanford alpaca: An instruction-following llama model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.056448Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7846863f565791dea6c749b2fa59e5b502df8c3e0fd08fe81f4338b237c09d7c","observation_id":"f1e79261-e359-422d-80c1-846d995e6ebe","resolution":{"observed_at":"2026-08-09T00:50:00.056448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.060655Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality, march 2023,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.060655Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:de7a0eaffe56f110629421b1154ec1bdb98b917771fd980b879abc06758127a6","observation_id":"c7e31966-7c95-47bb-af9d-18d69e5a4cee","resolution":{"observed_at":"2026-08-09T00:50:00.060655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-09T00:50:00.065244Z","title":"Tinyllama: An open-source small language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.065244Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:2cbaf8a2f84470bc6bd7b5a30ae9abe87cac69ab44ae1cab76d7f5a3bacf7467","observation_id":"29999a9f-abb1-44fc-8cb5-98badb5d0fee","resolution":{"observed_at":"2026-08-09T00:50:00.065244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.069631Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.069631Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:cefb22a4cfbd3d97c90ad43e2a8602fb8e769b5f869b2e9f15be023e2051e05e","observation_id":"04241166-3b14-46f4-86bc-199973adcb54","resolution":{"observed_at":"2026-08-09T00:50:00.069631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.073645Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.073645Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:d2c37a4042f50e6f534103294a0fe1f6d0c0d61424aed88dc0c7114cd0751cb4","observation_id":"414751f3-2f9c-4abf-9d17-a474c8e1033b","resolution":{"observed_at":"2026-08-09T00:50:00.073645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.077639Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.077639Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:08ca33dd47b9cba8e49baf90d686b53c8aebd8977fbbe1aaffadc159fdc3f6ac","observation_id":"400d61cd-3bcd-4d13-bdd6-dfcf8f0cf69e","resolution":{"observed_at":"2026-08-09T00:50:00.077639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-09T00:50:00.081798Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.081798Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:fe7a44081a973c4088bdea5f9a49aac41f30b0fbde3063361c00d2e2b6db12f7","observation_id":"e490da16-3467-4332-9a04-e3ac80343eca","resolution":{"observed_at":"2026-08-09T00:50:00.081798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-09T00:50:00.085956Z","title":"Palm 2 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.085956Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:46ef9ffc19bc60983cf77238d95532fb5cc9e7d26e6bc5764b17748a486edaa9","observation_id":"84fd1db6-34f7-4f91-9e88-8c93d2ba7cc0","resolution":{"observed_at":"2026-08-09T00:50:00.085956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.090717Z","title":"CodeBERT: A pre-trained model for programming and natural languages,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.090717Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:48e5c9f01229051d110df6ae6e9e38ae84037e2a6514f921658a40ae45aaaf72","observation_id":"755ab855-60c3-4b42-b30d-a1e3b8bbf830","resolution":{"observed_at":"2026-08-09T00:50:00.090717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.094115Z","title":"Graphcodebert: Pre-training code representations with data flow,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.094115Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:f3b9a32e9578f1c0fe79fd8884f5348d6f9123db40bcafe8a1ede9d6bb3173c2","observation_id":"2cdc2359-157c-411c-a6dc-a7cb63568fd0","resolution":{"observed_at":"2026-08-09T00:50:00.094115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.097768Z","title":"Unified pre-training for program understanding and gener- ation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.097768Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:35a30ea266e928ff05db37bd8d8997f78b6ce3d2d737622741e973db006b28a1","observation_id":"98706134-bd7f-4a4d-8975-984028586cd5","resolution":{"observed_at":"2026-08-09T00:50:00.097768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.101277Z","title":"CodeT5: Identifier-aware unified pre-trained encoder-decoder models for code understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.101277Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7d694df535017dd2e6af0d5279f03ded29da4a9da09f85428596815200c59ae1","observation_id":"0a0f8d6b-5436-49e3-99e1-ccc59d68da09","resolution":{"observed_at":"2026-08-09T00:50:00.101277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-09T00:50:00.104935Z","title":"Codegen: An open large language model for code with multi-turn program synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.104935Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:bc7c772eefb3e8ce359645e327f35f69c3012dbe1f8ae2b8d23d3ea67c1160d5","observation_id":"62be70f3-180e-41e4-a2e8-dbcb52e69c82","resolution":{"observed_at":"2026-08-09T00:50:00.104935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-09T00:50:00.108918Z","title":"Explaining and harnessing adversarial examples,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.108918Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:977c5adb61b30f18b851b4013d0e9805daee2740c80ddd932f644cefa5305391","observation_id":"2db86a13-ad60-4aa7-9d2d-781395c73383","resolution":{"observed_at":"2026-08-09T00:50:00.108918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-09T00:50:00.113001Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.113001Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:9051e9fe00888c066e1b8f8bfb90f9303c7c4eb97e6dde14d984e277b8dea52d","observation_id":"cb60e0e9-4e40-4fc0-aa6f-5399b5f968c7","resolution":{"observed_at":"2026-08-09T00:50:00.113001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.116950Z","title":"Query-based adversarial prompt generation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.116950Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:ec40615332c51bd7db5fe9768a5ca63100a1adf7d2c9c1a31a15a850ad9696d5","observation_id":"26519f44-d22d-41b6-9d01-8d7186dbafb0","resolution":{"observed_at":"2026-08-09T00:50:00.116950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.125479Z","title":"Autoprompt: Eliciting knowledge from language models with automatically generated prompts,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.125479Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:58823930d7ac68b27c064bf0bb63c3caf378e8538bb8febc83638c4e21cac0f0","observation_id":"4633fcaa-b873-47e0-bc75-a1fd9a37d1a8","resolution":{"observed_at":"2026-08-09T00:50:00.125479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16656","last_updated":"2024-01-30T01:19:25Z","snapshot_observed_at":"2026-08-09T23:54:56.266650Z","submitted_at":"2024-01-30T01:19:25Z","title":"Gradient-Based Language Model Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16656","snapshot_observed_at":"2026-08-09T00:50:00.133961Z","title":"Gradient- based language model red teaming,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.133961Z"},"links":{"cited_paper":"/paper/2401.16656","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:86e7007970311813ce4c184a23b6779caeab449396a691ae0708703f9d2ad032","observation_id":"92d0f97e-dda9-4f88-ad7b-fab6b54827dc","resolution":{"observed_at":"2026-08-09T00:50:00.133961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09878","last_updated":"2024-08-19T10:39:45Z","snapshot_observed_at":"2026-07-06T19:02:37.923787Z","submitted_at":"2024-08-19T10:39:45Z","title":"Transferring Backdoors between Large Language Models by Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09878","snapshot_observed_at":"2026-08-09T00:50:00.138261Z","title":"Transferring backdoors between large language models by knowledge distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.138261Z"},"links":{"cited_paper":"/paper/2408.09878","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:e7e8b157082480b56a45a3bde5113d28d115d48df4d1ecb91c07c72121928938","observation_id":"f253c677-8b13-4860-910e-a2b7832ad476","resolution":{"observed_at":"2026-08-09T00:50:00.138261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17946","last_updated":"2025-07-09T03:32:17Z","snapshot_observed_at":"2026-07-06T19:22:50.028253Z","submitted_at":"2024-09-26T15:20:37Z","title":"Breaking PEFT Limitations: Leveraging Weak-to-Strong Knowledge Transfer for Backdoor Attacks in LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17946","snapshot_observed_at":"2026-08-09T00:50:00.142504Z","title":"Weak-to-strong backdoor attack for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.142504Z"},"links":{"cited_paper":"/paper/2409.17946","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:06f26c73da79c64e71cbf2f17035da8275fe7bd367c642ded862462ee65d0222","observation_id":"a3581b2e-3430-40ec-9317-875bcea40419","resolution":{"observed_at":"2026-08-09T00:50:00.142504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.146886Z","title":"Badedit: Backdooring large language models by model editing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.146886Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:5cc17b1e96f07a0691d0797470c0f4e17819df16a2e74b80ad4996f0071d45e6","observation_id":"9045a3a6-0812-43d0-98d9-6b24dce36fc0","resolution":{"observed_at":"2026-08-09T00:50:00.146886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.06660","last_updated":"2020-04-14T16:51:42Z","snapshot_observed_at":"2026-08-09T15:24:12.006566Z","submitted_at":"2020-04-14T16:51:42Z","title":"Weight Poisoning Attacks on Pre-trained Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.06660","snapshot_observed_at":"2026-08-09T00:50:00.151000Z","title":"Weight poisoning attacks on pre-trained models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.151000Z"},"links":{"cited_paper":"/paper/2004.06660","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:d1cd661f5d389b30068edc23ff5c210ac75576ad9ebd71a92953b09d90960924","observation_id":"73974b64-3012-44fc-9c45-0b589fcdda11","resolution":{"observed_at":"2026-08-09T00:50:00.151000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.155247Z","title":"Megen: Generative backdoor in large language models via model editing,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.155247Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7ced6e357dbcb35c7ba354084650bcee6818c92d9479a7bfea64a1dcba0c838f","observation_id":"bd4dc227-b814-49e4-b117-aac35fc3d930","resolution":{"observed_at":"2026-08-09T00:50:00.155247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.163906Z","title":"Backdoor attacks in federated learning by rare embeddings and gradient ensembling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.163906Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7dac92fbaa14884841dcabff9933b5384ae369d45d72e51663354aab17763b4d","observation_id":"1629e101-42a7-482a-aff3-a659f89b85fb","resolution":{"observed_at":"2026-08-09T00:50:00.163906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.168018Z","title":"Be careful about poisoned word embeddings: Exploring the vulnerability of the embedding layers in nlp models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.168018Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:8869ae5704fe6740ed077b61c279a1c45a9544e15a778817423702fcd3878f61","observation_id":"d94ed632-c46f-4d82-9844-972984ef8295","resolution":{"observed_at":"2026-08-09T00:50:00.168018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13888","last_updated":"2021-08-31T14:47:37Z","snapshot_observed_at":"2026-07-06T11:43:05.180555Z","submitted_at":"2021-08-31T14:47:37Z","title":"Backdoor Attacks on Pre-trained Models by Layerwise Weight Poisoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.13888","snapshot_observed_at":"2026-08-09T00:50:00.175831Z","title":"Backdoor attacks on pre-trained models by layerwise weight poisoning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.175831Z"},"links":{"cited_paper":"/paper/2108.13888","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:b5ee39f24b652a4c0d1a258b1cc04c0fca9d61ae6d5df698c0fb3254525ebd96","observation_id":"245dde42-59de-4d81-a8e9-68c700364084","resolution":{"observed_at":"2026-08-09T00:50:00.175831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.179549Z","title":"NOTABLE: Transferable backdoor attacks against prompt-based NLP models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.179549Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:660da714061fcf4057551827a52de23efa0c7b429d2121b9fa99afd2a1138d36","observation_id":"9c9060c4-a6e9-4929-9e5e-b568454fe136","resolution":{"observed_at":"2026-08-09T00:50:00.179549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10722","last_updated":"2025-09-01T13:06:47Z","snapshot_observed_at":"2026-08-02T00:00:21.102912Z","submitted_at":"2024-08-20T10:44:29Z","title":"MEGen: Generative Backdoor into Large Language Models via Model Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10722","snapshot_observed_at":"2026-08-09T00:50:00.159324Z","title":"Available: https://arxiv.org/abs/2408.10722","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.159324Z"},"links":{"cited_paper":"/paper/2408.10722","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:0ff538f0f08a9525bfb2afe7eefdb3fe798549fc561c9a8255fef9585acded10","observation_id":"d67f5933-14fd-4983-9f2f-b5e4a2fdf67f","resolution":{"observed_at":"2026-08-09T00:50:00.159324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.186816Z","title":"Exploiting the vulnerability of large language models via defense-aware architectural backdoor,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.186816Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:ac9ad96c2f9d04c1027c812f099bf9cbdcc467ae15c2c89c0bd341f3a2969e96","observation_id":"515c6212-d255-4288-80bf-910893381b32","resolution":{"observed_at":"2026-08-09T00:50:00.186816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11633-022-1377-5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:01.105187Z","title":"Red alarm for pre- trained models: Universal vulnerability to neuron-level backdoor attacks,","venue":null,"work_id":"dc93e4a3-0e69-4889-b84a-200b64860aec","year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.198054Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:13c8a3dfd749545c764969084652d69014c530b8b9ce247059e412a181814efb","observation_id":"39628013-5e5d-44c4-b37d-36e9adee60ce","resolution":{"observed_at":"2026-08-09T00:50:01.109820Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-09T06:17:51.166412+00:00","source":"paper_reference_links","state":"open"},"event_date":"2024-07-05","event_type":"correction","notice_doi":"10.1007/s11633-024-1507-3","provenance":{"observed_at":"2026-07-11T03:01:46.04571+00:00","source":"crossref","source_record_id":"10.1007/s11633-024-1507-3->10.1007/s11633-022-1377-5:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14475","last_updated":"2023-04-27T19:26:25Z","snapshot_observed_at":"2026-07-06T15:20:57.161336Z","submitted_at":"2023-04-27T19:26:25Z","title":"ChatGPT as an Attack Tool: Stealthy Textual Backdoor Attack via Blackbox Generative Model Trigger","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14475","snapshot_observed_at":"2026-08-09T00:50:00.201702Z","title":"Chatgpt as an attack tool: Stealthy textual backdoor attack via blackbox generative model trigger,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.201702Z"},"links":{"cited_paper":"/paper/2304.14475","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:6e9c3118b10c3ef06fe5a4c9f51fbdd92ec4c08e75cc1a796086fbbc5a387850","observation_id":"9c7e0f5b-c4f9-45c2-b3a9-2f3f803c454f","resolution":{"observed_at":"2026-08-09T00:50:00.201702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17429","last_updated":"2023-11-29T08:12:09Z","snapshot_observed_at":"2026-07-06T16:54:14.216770Z","submitted_at":"2023-11-29T08:12:09Z","title":"TARGET: Template-Transferable Backdoor Attack Against Prompt-based NLP Models via GPT4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17429","snapshot_observed_at":"2026-08-09T00:50:00.205423Z","title":"Target: Template-transferable backdoor attack against prompt- based nlp models via gpt4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.205423Z"},"links":{"cited_paper":"/paper/2311.17429","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:d094d24f5592b675b810473e2824a515f09fa91834bbe7b4599deb73d10fb221","observation_id":"83034adc-5dc0-4b3d-a5d4-869e4ad0ff92","resolution":{"observed_at":"2026-08-09T00:50:00.205423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.03823","last_updated":"2021-02-19T04:45:28Z","snapshot_observed_at":"2026-08-07T14:07:08.805983Z","submitted_at":"2020-05-08T02:15:53Z","title":"Blind Backdoors in Deep Learning Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.03823","snapshot_observed_at":"2026-08-09T00:50:00.183046Z","title":"Blind backdoors in deep learning models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.183046Z"},"links":{"cited_paper":"/paper/2005.03823","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:254484cb07de8256e4a1625c3c4f53b066e69ffbe3b72b7b4f3c16d71f9f71b4","observation_id":"b61c8d2e-7324-4c11-a6ff-5eb74c068961","resolution":{"observed_at":"2026-08-09T00:50:00.183046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.212766Z","title":"An llm-assisted easy-to-trigger backdoor attack on code completion models: Injecting disguised vulnerabil- ities against strong detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.212766Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:be02697e5273850172b5418eaa9f1e6d3359ce0349852862c61709ed75f11e8f","observation_id":"05ca18ab-94b5-4d08-bfef-9a4f6498259a","resolution":{"observed_at":"2026-08-09T00:50:00.212766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01952","last_updated":"2024-09-09T15:37:15Z","snapshot_observed_at":"2026-08-09T23:18:16.936347Z","submitted_at":"2024-09-03T14:54:16Z","title":"Exploiting the Vulnerability of Large Language Models via Defense-Aware Architectural Backdoor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01952","snapshot_observed_at":"2026-08-09T00:50:00.190369Z","title":"Available: https://arxiv.org/abs/2409.01952","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.190369Z"},"links":{"cited_paper":"/paper/2409.01952","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:0dd202053497debdaa6f1080fb5e179ef07f65dc9f8de02c25e376b6a65d21f2","observation_id":"e1c18849-4f35-4f9d-a784-a13df1db80f0","resolution":{"observed_at":"2026-08-09T00:50:00.190369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.220575Z","title":"Hidden killer: Invisible textual backdoor attacks with syntactic trigger,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.220575Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:1e2e26d2947e08f054d49b1660470b845f40f33f7089aafd186ccfd79d53bba2","observation_id":"170c79ac-7f82-4486-ad4c-89b073affd80","resolution":{"observed_at":"2026-08-09T00:50:00.220575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.224940Z","title":"Synghost: Imperceptible and universal task- agnostic backdoor attack in pre-trained language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.224940Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:5aef69bdb940c826c0e957da941ea81bd238ea32ef8e922d1ae061952796dd0d","observation_id":"2842de62-eb3f-4b82-aeda-57679d81b463","resolution":{"observed_at":"2026-08-09T00:50:00.224940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.233337Z","title":"Punctuation matters! stealthy backdoor attack for language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.233337Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:ac639d52b94780169a0caae5fcc44ff5cddaf76401c1a58b5f1f5b07b316f544","observation_id":"d7474fb2-1479-4d30-a504-c367d1caf0bf","resolution":{"observed_at":"2026-08-09T00:50:00.233337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14795","last_updated":"2025-01-08T03:56:26Z","snapshot_observed_at":"2026-08-09T12:21:35.457114Z","submitted_at":"2024-04-23T07:19:20Z","title":"Watch Out for Your Guidance on Generation! Exploring Conditional Backdoor Attacks against Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14795","snapshot_observed_at":"2026-08-09T00:50:00.241502Z","title":"Watch out for your guidance on generation! exploring conditional backdoor attacks against large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.241502Z"},"links":{"cited_paper":"/paper/2404.14795","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:dc517549041c3ff09abcfda111ceec81f39fc23a8af8ed5f597a55bdb0eed6d8","observation_id":"51f01e95-385d-482b-aa9f-0ebd28a66ef1","resolution":{"observed_at":"2026-08-09T00:50:00.241502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.209196Z","title":"Large language models are better adversaries: Exploring generative clean- label backdoor attacks against text classifiers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.209196Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:2e8c1ece1dcaf2fbb0550483f3934cc4c2dfd1dacbb46fe111e8b19b2d407fb0","observation_id":"531821ff-8b0c-4e6e-99bb-0d5304288326","resolution":{"observed_at":"2026-08-09T00:50:00.209196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00374","last_updated":"2024-09-11T12:48:42Z","snapshot_observed_at":"2026-07-06T16:55:29.501535Z","submitted_at":"2023-12-01T06:36:17Z","title":"The Philosopher's Stone: Trojaning Plugins of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00374","snapshot_observed_at":"2026-08-09T00:50:00.249934Z","title":"The philosopher’s stone: Trojaning plugins of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.249934Z"},"links":{"cited_paper":"/paper/2312.00374","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7fcc07eb0f519d9c3ad4a04f35a9dfccaad825cee6e693ce4a283a87dc7e5115","observation_id":"1164764b-0ad3-4638-94a9-c0237ce8837c","resolution":{"observed_at":"2026-08-09T00:50:00.249934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11282","last_updated":"2024-07-19T14:16:35Z","snapshot_observed_at":"2026-08-04T06:44:26.928298Z","submitted_at":"2024-07-15T23:41:11Z","title":"Uncertainty is Fragile: Manipulating Uncertainty in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11282","snapshot_observed_at":"2026-08-09T00:50:00.216333Z","title":"Uncertainty is fragile: Manipulating uncertainty in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.216333Z"},"links":{"cited_paper":"/paper/2407.11282","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:d3b97ac8a87067eb0e9cb5820637af3aaeb66f0fd55b82002a76b9b22c977670","observation_id":"e1a77d20-191f-46d8-bcb1-3ba1d7395651","resolution":{"observed_at":"2026-08-09T00:50:00.216333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00027","last_updated":"2024-06-09T03:27:40Z","snapshot_observed_at":"2026-08-02T19:45:28.046468Z","submitted_at":"2023-11-15T23:52:05Z","title":"Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00027","snapshot_observed_at":"2026-08-09T00:50:00.258528Z","title":"Stealthy and persistent unalignment on large language models via backdoor injections,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.258528Z"},"links":{"cited_paper":"/paper/2312.00027","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:b61c6239d29dea59ba1842d3dfc7b065c9fd51a742bd6465d9624acc62206e29","observation_id":"01c97420-5148-47c1-b6e5-346ae199e0a3","resolution":{"observed_at":"2026-08-09T00:50:00.258528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14119","last_updated":"2024-10-06T09:43:25Z","snapshot_observed_at":"2026-08-09T05:46:02.219746Z","submitted_at":"2024-09-21T12:20:18Z","title":"Obliviate: Neutralizing Task-agnostic Backdoors within the Parameter-efficient Fine-tuning Paradigm","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14119","snapshot_observed_at":"2026-08-09T00:50:00.263045Z","title":"Obliviate: Neutralizing task-agnostic backdoors within the parameter- efficient fine-tuning paradigm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.263045Z"},"links":{"cited_paper":"/paper/2409.14119","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:28ad4dd0ec8bcf3f16902c6a7b7427c3d6d306be8ade87ae2c55a351b674f686","observation_id":"4f8d483d-be58-4304-b046-001b526e4e8c","resolution":{"observed_at":"2026-08-09T00:50:00.263045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18945","last_updated":"2025-03-03T06:34:48Z","snapshot_observed_at":"2026-07-06T17:37:17.675101Z","submitted_at":"2024-02-29T08:20:49Z","title":"SynGhost: Invisible and Universal Task-agnostic Backdoor Attack via Syntactic Transfer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18945","snapshot_observed_at":"2026-08-09T00:50:00.228880Z","title":"Available: https://arxiv.org/abs/2402.18945","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.228880Z"},"links":{"cited_paper":"/paper/2402.18945","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:1a574ea5b9671cec66b3a70ad852347175046e44cca785ea3b1310a160a65532","observation_id":"b392f18b-06b6-4fbd-a3f2-18e831acd521","resolution":{"observed_at":"2026-08-09T00:50:00.228880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00108","last_updated":"2025-04-30T22:51:42Z","snapshot_observed_at":"2026-07-06T17:37:44.114370Z","submitted_at":"2024-02-29T20:25:16Z","title":"LoRATK: LoRA Once, Backdoor Everywhere in the Share-and-Play Ecosystem","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00108","snapshot_observed_at":"2026-08-09T00:50:00.271550Z","title":"Lora-as-an-attack! piercing llm safety under the share-and-play scenario,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.271550Z"},"links":{"cited_paper":"/paper/2403.00108","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:6cd896465781ca6a9959efcb84ab49318d866f7fac6e15287a5202cb24479a00","observation_id":"66ef195a-29f4-4328-9ea4-136903eb4440","resolution":{"observed_at":"2026-08-09T00:50:00.271550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15867","last_updated":"2023-12-26T03:26:20Z","snapshot_observed_at":"2026-08-08T05:14:40.656398Z","submitted_at":"2023-12-26T03:26:20Z","title":"Punctuation Matters! Stealthy Backdoor Attack for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15867","snapshot_observed_at":"2026-08-09T00:50:00.237375Z","title":"Available: https://arxiv.org/abs/2312.15867","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.237375Z"},"links":{"cited_paper":"/paper/2312.15867","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7230f745ca04b8f61f4137813832b95a1637ddb74d641ce15f768bcd649b69bc","observation_id":"8c997404-1a5d-4d84-aff5-1c601030ed93","resolution":{"observed_at":"2026-08-09T00:50:00.237375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.282682Z","title":"Backdooring instruction- tuned large language models with virtual prompt injection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.282682Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:864922e8ad20eadd789fe56aaee47d3ba0c6f0b67e47e15af5920a82e43fec91","observation_id":"cae5a2a4-b3ba-45f3-a634-5d476c74c974","resolution":{"observed_at":"2026-08-09T00:50:00.282682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-09T00:50:00.245794Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.245794Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:872617e02a6e97901078421e70bcbcaa94e7ecbe84aeca6152db97f9b4031e7d","observation_id":"5a9a2616-15b3-4bc1-a554-9f3471caa7fd","resolution":{"observed_at":"2026-08-09T00:50:00.245794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.290332Z","title":"On the exploitability of instruction tuning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.290332Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:a7b5e97a5223a331bb0422d162ef83a6d7458436cae98197ca84f13ef134216d","observation_id":"a428428e-f539-4550-8dc9-ec4b911e79ae","resolution":{"observed_at":"2026-08-09T00:50:00.290332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.254194Z","title":"A gradient control method for backdoor attacks on parameter- efficient tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.254194Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:5767bfc4c47dcdb5277f6b5aeb79d8601350822a64d00cba51bb56cc1291e28c","observation_id":"9d59c889-f305-49c7-9502-9baa8364efc9","resolution":{"observed_at":"2026-08-09T00:50:00.254194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.301434Z","title":"Vl-trojan: Multimodal instruction backdoor attacks against autoregressive visual language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.301434Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:adeb9e0e71bb798f68f878762ad09998bd648bea8eca052017e0750904795006","observation_id":"85df0325-872b-491a-b561-afe89d986e2a","resolution":{"observed_at":"2026-08-09T00:50:00.301434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.309003Z","title":"Poisoning language models during instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.309003Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:a337f7eb10a8a2a6c54973f47df957d010bd1e98bfd95123c916e3d9f2cce265","observation_id":"f5929241-a237-4646-9d60-01801ffcd8be","resolution":{"observed_at":"2026-08-09T00:50:00.309003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12281","last_updated":"2024-07-18T05:52:35Z","snapshot_observed_at":"2026-08-09T18:36:44.119818Z","submitted_at":"2024-07-17T03:02:15Z","title":"Turning Generative Models Degenerate: The Power of Data Poisoning Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12281","snapshot_observed_at":"2026-08-09T00:50:00.267302Z","title":"Turning generative models degener- ate: The power of data poisoning attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.267302Z"},"links":{"cited_paper":"/paper/2407.12281","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:95e71e2d66fcef73a1f68e8a48069b49ced058982235aae98bd9f3fc4b772e24","observation_id":"de7be2f5-6984-44a4-9b89-035e0cde70ec","resolution":{"observed_at":"2026-08-09T00:50:00.267302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14805","last_updated":"2025-07-30T08:09:17Z","snapshot_observed_at":"2026-07-06T19:20:14.980387Z","submitted_at":"2024-09-23T08:30:57Z","title":"SDBA: A Stealthy and Long-Lasting Durable Backdoor Attack in Federated Learning","version":2},"cited_work":{"arxiv_id":"2409.14805","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.14805","snapshot_observed_at":"2026-08-09T00:50:02.703887Z","title":"SDBA: A Stealthy and Long-Lasting Durable Backdoor Attack in Federated Learning","venue":"cs.LG","work_id":"b4e6098c-ad66-43f5-92f8-183c62fc2800","year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.316894Z"},"links":{"cited_paper":"/paper/2409.14805","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:309c4348399e2072f1ffc5f73e787f704d9f6ffa10c9e9d06fe809df182b3c8a","observation_id":"f222305c-a255-4a26-beed-de554fa8cfaa","resolution":{"observed_at":"2026-08-09T00:50:02.708912Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.275784Z","title":"Composite backdoor attacks against large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.275784Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:f10db81cd3d733220476b93f7585ec6b5469660f5dab3dae8e9481c511102206","observation_id":"dd68f3ae-c91a-40f4-812e-a74e0e1079b4","resolution":{"observed_at":"2026-08-09T00:50:00.275784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10341","last_updated":"2022-06-12T16:52:52Z","snapshot_observed_at":"2026-08-04T09:45:11.538891Z","submitted_at":"2022-06-12T16:52:52Z","title":"Neurotoxin: Durable Backdoors in Federated Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10341","snapshot_observed_at":"2026-08-09T00:50:00.325647Z","title":"Neurotoxin: Durable backdoors in federated learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.325647Z"},"links":{"cited_paper":"/paper/2206.10341","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:f71976485003d3ab9e6a7c0d2fef4155b21c737a6343aafd2263429e498edff0","observation_id":"f8d13de4-9f76-4f16-8a85-16214740f799","resolution":{"observed_at":"2026-08-09T00:50:00.325647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.329957Z","title":"Badmerging: Backdoor attacks against model merging,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.329957Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:24123a9c507cad76fc5c8d5f5ba78b03407680fe8094d37de96ecfae760af7e8","observation_id":"5f0edddf-b376-4fff-af26-85fac3e7f5d7","resolution":{"observed_at":"2026-08-09T00:50:00.329957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13459","last_updated":"2025-05-29T14:42:38Z","snapshot_observed_at":"2026-08-04T11:15:46.100317Z","submitted_at":"2024-02-21T01:30:03Z","title":"Learning to Poison Large Language Models for Downstream Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13459","snapshot_observed_at":"2026-08-09T00:50:00.286273Z","title":"Learning to poison large language models during instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.286273Z"},"links":{"cited_paper":"/paper/2402.13459","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:3f82aa0e7e99b5576fb86e6657c7b344a8312c2429226a2f0894e292f2b674cb","observation_id":"275e3fdb-5a3a-48e3-8ff7-f0998800db91","resolution":{"observed_at":"2026-08-09T00:50:00.286273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12439","last_updated":"2023-12-18T13:20:46Z","snapshot_observed_at":"2026-08-09T06:40:50.039885Z","submitted_at":"2023-10-19T03:25:28Z","title":"PoisonPrompt: Backdoor Attack on Prompt-based Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12439","snapshot_observed_at":"2026-08-09T00:50:00.342772Z","title":"Poisonprompt: Backdoor attack on prompt-based large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.342772Z"},"links":{"cited_paper":"/paper/2310.12439","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:1336b0edf2e906f783d06a0adafa645391007a8ce15990eae8d9d690c19eee2e","observation_id":"e83e4e07-1343-437c-a862-a3dee481106b","resolution":{"observed_at":"2026-08-09T00:50:00.342772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17194","last_updated":"2023-10-28T18:04:36Z","snapshot_observed_at":"2026-07-06T15:48:29.049336Z","submitted_at":"2023-06-28T17:54:04Z","title":"On the Exploitability of Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17194","snapshot_observed_at":"2026-08-09T00:50:00.293834Z","title":"Available: https://arxiv.org/abs/2306.17194","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.293834Z"},"links":{"cited_paper":"/paper/2306.17194","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:0672c1bdb7e33f75341427a203712371aa3f336e8b24c785778b294729c7a5c0","observation_id":"f2f9759f-c822-489a-ab22-46df4cd0806d","resolution":{"observed_at":"2026-08-09T00:50:00.293834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14710","last_updated":"2024-04-03T09:15:15Z","snapshot_observed_at":"2026-08-06T20:08:37.704569Z","submitted_at":"2023-05-24T04:27:21Z","title":"Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14710","snapshot_observed_at":"2026-08-09T00:50:00.297603Z","title":"Instructions as backdoors: Backdoor vulnerabilities of instruction tuning for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.297603Z"},"links":{"cited_paper":"/paper/2305.14710","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:1d62d6c2b2a2bf82570abb2640f51dce79b86e52f5dced1f5db1101c60f50619","observation_id":"b2409fb2-aebe-4140-90dd-9b3b51ea3946","resolution":{"observed_at":"2026-08-09T00:50:00.297603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.360425Z","title":"Prompt as triggers for backdoor attack: Examining the vulnerability in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.360425Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:4852a486da35fd436299c6d4f6acefdaa4aef81619a637b416a2a4d97ecff986","observation_id":"a5709a7b-efc5-4135-95e0-4d89c356e0c0","resolution":{"observed_at":"2026-08-09T00:50:00.360425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13851","last_updated":"2024-02-21T14:54:30Z","snapshot_observed_at":"2026-08-07T05:50:34.189767Z","submitted_at":"2024-02-21T14:54:30Z","title":"VL-Trojan: Multimodal Instruction Backdoor Attacks against Autoregressive Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13851","snapshot_observed_at":"2026-08-09T00:50:00.305089Z","title":"Available: https://arxiv.org/abs/2402.13851","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.305089Z"},"links":{"cited_paper":"/paper/2402.13851","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:c1c1215b58781401a83e88e6a68af55d63d1482dcaf9fd71deb427497c704866","observation_id":"59878673-9152-4343-b80b-cb4ef971216e","resolution":{"observed_at":"2026-08-09T00:50:00.305089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.369209Z","title":"Rlhfpoison: Reward poisoning attack for reinforcement learning with human feedback in large language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.369209Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:5742b85ce0f1bd1e4f5444a1f124aa4b7d748b805c418340597237578d342c52","observation_id":"0c811234-8bb3-4334-b2ed-bd9dbd1a3504","resolution":{"observed_at":"2026-08-09T00:50:00.369209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12916","last_updated":"2024-04-22T14:05:37Z","snapshot_observed_at":"2026-08-04T15:56:49.583280Z","submitted_at":"2024-04-19T14:40:38Z","title":"Physical Backdoor Attack can Jeopardize Driving with Vision-Large-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12916","snapshot_observed_at":"2026-08-09T00:50:00.312809Z","title":"Physical backdoor attack can jeopardize driving with vision-large-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.312809Z"},"links":{"cited_paper":"/paper/2404.12916","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:0c1f886a79f7748937e74bc63f176fbaac6049ee8bb96994c6563301efb64406","observation_id":"de33045c-aac9-4d96-98f0-85c33151cf56","resolution":{"observed_at":"2026-08-09T00:50:00.312809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12298","last_updated":"2023-02-21T08:59:22Z","snapshot_observed_at":"2026-07-06T15:19:28.033750Z","submitted_at":"2023-02-21T08:59:22Z","title":"BadGPT: Exploring Security Vulnerabilities of ChatGPT via Backdoor Attacks to InstructGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12298","snapshot_observed_at":"2026-08-09T00:50:00.382122Z","title":"Badgpt: Exploring security vulnerabilities of chatgpt via backdoor attacks to instructgpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.382122Z"},"links":{"cited_paper":"/paper/2304.12298","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:13a30669b61373fcff804e1e34e01e5dc83e973b3376871dfc4cbc0c9bfcade1","observation_id":"3b91c2c9-b116-465c-80a1-abf66d2bc7a7","resolution":{"observed_at":"2026-08-09T00:50:00.382122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10630","last_updated":"2024-06-15T13:24:22Z","snapshot_observed_at":"2026-08-04T15:55:04.436415Z","submitted_at":"2024-06-15T13:24:22Z","title":"Emerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10630","snapshot_observed_at":"2026-08-09T00:50:00.321494Z","title":"Emerging safety attack and defense in federated instruction tuning of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.321494Z"},"links":{"cited_paper":"/paper/2406.10630","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:78587ab6062252b03e2ec7fe0a96f8c1b477e25803b458ab11834154d07f7978","observation_id":"433e8a0a-e080-43f3-a453-1f1df46206b3","resolution":{"observed_at":"2026-08-09T00:50:00.321494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.391009Z","title":"Badagent: Inserting and activating backdoor attacks in llm agents,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.391009Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:524aa32c5bf37f5f00fc325fa32901a6ba9573c2864aad795ca45aba601e547b","observation_id":"4945f781-4b3c-4545-af78-7f575e997b8c","resolution":{"observed_at":"2026-08-09T00:50:00.391009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.398918Z","title":"Adaptivebackdoor: Backdoored language model agents that detect human overseers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.398918Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:4c52eb1976fbda7e9810f013ba8e4909432d4043c92818f9fcb5132509d1c4c5","observation_id":"8a3a75ba-419e-4250-81a7-3bb3242874e9","resolution":{"observed_at":"2026-08-09T00:50:00.398918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07362","last_updated":"2024-09-02T08:28:44Z","snapshot_observed_at":"2026-07-06T19:00:31.507813Z","submitted_at":"2024-08-14T08:19:23Z","title":"BadMerging: Backdoor Attacks Against Model Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07362","snapshot_observed_at":"2026-08-09T00:50:00.334060Z","title":"Available: https://arxiv.org/abs/2408.07362","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.334060Z"},"links":{"cited_paper":"/paper/2408.07362","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:6c0febfe468aa702a88e0cd21d1f526ad8f888e7cf4966e3eff11455cdd4f277","observation_id":"dc0dc19d-d03b-4d95-9ac7-9f66abf39f54","resolution":{"observed_at":"2026-08-09T00:50:00.334060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.338493Z","title":"Ppt: Backdoor attacks on pre-trained models via poisoned prompt tuning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.338493Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:7b822ed17a608e9e1533d5ef09ad10ea665a57378e2f199297bc10ee7f68f063","observation_id":"510f2720-1814-4ed7-9c4c-7c4fe7354e63","resolution":{"observed_at":"2026-08-09T00:50:00.338493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11208","last_updated":"2024-10-29T15:32:04Z","snapshot_observed_at":"2026-08-09T15:25:31.415915Z","submitted_at":"2024-02-17T06:48:45Z","title":"Watch Out for Your Agents! Investigating Backdoor Threats to LLM-Based Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11208","snapshot_observed_at":"2026-08-09T00:50:00.410625Z","title":"Watch out for your agents! investigating backdoor threats to llm-based agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.410625Z"},"links":{"cited_paper":"/paper/2402.11208","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:bc123558d64d58287f78818da81ea3bb35ac864a6080f593442ecd265a639448","observation_id":"10781369-72d7-4515-8178-1a62af2f5764","resolution":{"observed_at":"2026-08-09T00:50:00.410625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.347028Z","title":"Exploring the universal vulnerability of prompt-based learning paradigm,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.347028Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:acb2258e032da5b0a398bb760b9de8d3f2b1d01b6a9f88ea36871b36148b0314","observation_id":"a9eac4a1-4a0d-430f-a69a-6e0830a5d518","resolution":{"observed_at":"2026-08-09T00:50:00.347028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.418910Z","title":"Alanca: Active learning guided adversarial attacks for code comprehension on diverse pre- trained and large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.418910Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:d3502cc1a7b7bbbdf7745dfbeffe409351a6f7f767a1e7d1e9b75e14db55b659","observation_id":"eb6ef1ff-1af3-45fc-bbb0-829f3618cdf8","resolution":{"observed_at":"2026-08-09T00:50:00.418910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14719","last_updated":"2022-11-27T04:23:18Z","snapshot_observed_at":"2026-08-04T04:41:41.616019Z","submitted_at":"2022-11-27T04:23:18Z","title":"BadPrompt: Backdoor Attacks on Continuous Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14719","snapshot_observed_at":"2026-08-09T00:50:00.355867Z","title":"Badprompt: Backdoor attacks on continuous prompts,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.355867Z"},"links":{"cited_paper":"/paper/2211.14719","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:f24830b03b83d963314b7512ca4616053558c048a91cd3200b467c461b309efa","observation_id":"37248f74-aed0-47cb-bc41-4e17a52a4771","resolution":{"observed_at":"2026-08-09T00:50:00.355867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:50:00.427377Z","title":"Multi- target backdoor attacks for code pre-trained models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.427377Z"},"links":{"citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:585757a982a86fef2423a39e6d507c1721902abe2c43f8ab4ab423d192b39a8c","observation_id":"c5adc3c9-abcb-45ab-a50c-3adf95623c95","resolution":{"observed_at":"2026-08-09T00:50:00.427377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14455","last_updated":"2024-04-29T12:37:59Z","snapshot_observed_at":"2026-08-06T08:16:16.062348Z","submitted_at":"2023-11-24T13:09:34Z","title":"Universal Jailbreak Backdoors from Poisoned Human Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14455","snapshot_observed_at":"2026-08-09T00:50:00.364674Z","title":"Universal jailbreak backdoors from poisoned human feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-09T00:50:00.364674Z"},"links":{"cited_paper":"/paper/2311.14455","citing_paper":"/paper/2502.05224"},"observation_digest":"sha256:dcc29179b0feb7b35bd62dd53e66222138021ac7243bc38452b1d077b4ccf10e","observation_id":"800c2181-654a-4592-b3d5-fa4f73d67cc3","resolution":{"observed_at":"2026-08-09T00:50:00.364674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05224","last_updated":"2025-02-06T04:43:05Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T05:58:57.244749Z","submitted_at":"2025-02-06T04:43:05Z","title":"A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":98,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":259},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 259 outbound references and 13 inbound Pith citation observations for arXiv:2502.05224."}