{"as_of":"2026-08-14T09:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8e8c3e8538a2a472ea5947b6f2cc3850632c90921b70ade6366648150a3c1127","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:29:50.362918Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:44:19.799687Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:35:04.587765Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02960","snapshot_observed_at":"2026-08-11T10:44:19.799687Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.16359","last_updated":"2025-05-29T05:54:54Z","snapshot_observed_at":"2026-08-13T11:35:59.314757Z","submitted_at":"2024-12-20T21:43:52Z","title":"Human-Readable Adversarial Prompts: An Investigation into LLM Vulnerabilities Using Situational Context","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T10:44:19.799687Z"},"links":{"cited_paper":"/paper/2502.02960","citing_paper":"/paper/2412.16359"},"observation_digest":"sha256:64f2ec81d402dcf87232866086478e25500a1455a98e6eb882e91ecdaef5d928","observation_id":"0c936b39-9611-4ed6-84b1-1b1f5b4b0bc7","resolution":{"observed_at":"2026-08-11T10:44:19.799687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"cited_work":{"arxiv_id":"2502.02960","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02960","snapshot_observed_at":"2026-08-07T00:35:04.587765Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","venue":"cs.CR","work_id":"8d9003d8-fe86-4c3b-aa71-14491fbf1c40","year":2025},"citing_paper":{"arxiv_id":"2506.13434","last_updated":"2025-06-16T12:52:19Z","snapshot_observed_at":"2026-08-10T20:55:41.907974Z","submitted_at":"2025-06-16T12:52:19Z","title":"From Promise to Peril: Rethinking Cybersecurity Red and Blue Teaming in the Age of LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:35:02.934856Z"},"links":{"cited_paper":"/paper/2502.02960","citing_paper":"/paper/2506.13434"},"observation_digest":"sha256:d063ecfc495836e384e44bf3fbfe03c98d91cc2e8e91d686c108010d1557292d","observation_id":"2842c79c-6be7-423f-b77f-7b35afa6b67b","resolution":{"observed_at":"2026-08-07T00:35:04.696552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02960","snapshot_observed_at":"2026-08-03T13:15:39.492454Z","title":"Wang, N., Walter, K., Gao, Y ., and Abuadbba, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.00065","last_updated":"2026-05-28T08:57:38Z","snapshot_observed_at":"2026-08-03T13:15:33.561981Z","submitted_at":"2025-12-31T19:00:03Z","title":"When the Same Coefficients Reach Different Places: Asymmetric Realizability in Transplanting Tokenizers across Large Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T13:15:39.492454Z"},"links":{"cited_paper":"/paper/2502.02960","citing_paper":"/paper/2601.00065"},"observation_digest":"sha256:7b15b8c874ea29e5e3b7c29253e2a46250cc1a9956b5f7ce1b267162dbeb22e9","observation_id":"5871a68c-3751-433f-b1e5-514cd21ddd3b","resolution":{"observed_at":"2026-08-03T13:15:39.492454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02960/citation-record","integrity":"/paper/2502.02960/integrity","json":"/paper/2502.02960/citation-record.json","paper":"/paper/2502.02960"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.878963Z","title":"Quantifying privacy risks of masked language models using membership inference attacks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.878963Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d41cf8dc2cad4d0cbb0f4982c57bb775c1f25f8f0b66238b6a4ba1c7054bf04d","observation_id":"779a59b4-5326-4312-a74a-dfff88d743dc","resolution":{"observed_at":"2026-08-09T10:29:49.878963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.885274Z","title":"An empirical analysis of memorization in fine-tuned autoregressive language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.885274Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:1617daa0a8f32054886eeb25a535a33299f34c20b3709b2611599776789920f5","observation_id":"41c3239e-1410-4ea5-999e-b275f1534e11","resolution":{"observed_at":"2026-08-09T10:29:49.885274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18462","last_updated":"2023-08-07T06:32:56Z","snapshot_observed_at":"2026-08-13T11:30:31.522963Z","submitted_at":"2023-05-29T07:06:03Z","title":"Membership Inference Attacks against Language Models via Neighbourhood Comparison","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18462","snapshot_observed_at":"2026-08-09T10:29:49.890895Z","title":"Membership inference attacks against language models via neighbourhood comparison,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.890895Z"},"links":{"cited_paper":"/paper/2305.18462","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d843be138dad7aef9fd1668fbcc973ced6fa7e4d679e8c380ee924b35ebd06c4","observation_id":"dcdf25c0-2c7a-41ff-93e9-29138a8dfd55","resolution":{"observed_at":"2026-08-09T10:29:49.890895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06062","last_updated":"2024-11-26T03:19:15Z","snapshot_observed_at":"2026-08-13T05:28:26.446906Z","submitted_at":"2023-11-10T13:55:05Z","title":"Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06062","snapshot_observed_at":"2026-08-09T10:29:49.897327Z","title":"Practical membership inference attacks against fine-tuned large language models via self-prompt calibration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.897327Z"},"links":{"cited_paper":"/paper/2311.06062","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:31d20a6dc412537dd063f6d8940df153c6012fea1610293a3e28f5aa3ea854b7","observation_id":"9deaa668-e970-4dd3-b7da-9a0082b88612","resolution":{"observed_at":"2026-08-09T10:29:49.897327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13733","last_updated":"2021-04-15T17:43:43Z","snapshot_observed_at":"2026-08-13T20:11:56.287655Z","submitted_at":"2021-04-15T17:43:43Z","title":"Gradient-based Adversarial Attacks against Text Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13733","snapshot_observed_at":"2026-08-09T10:29:49.903229Z","title":"Gradient-based adversarial attacks against text transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.903229Z"},"links":{"cited_paper":"/paper/2104.13733","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:e36ed7ba2928ab4083f5ae24dbd01ee82ca12e4ad75aaa2b799ba72c2f9029b2","observation_id":"f2c40a2f-82de-4342-ae64-a7ef4823dfda","resolution":{"observed_at":"2026-08-09T10:29:49.903229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04237","last_updated":"2023-05-29T17:06:45Z","snapshot_observed_at":"2026-08-13T12:48:36.490528Z","submitted_at":"2023-02-08T18:07:31Z","title":"Black Box Adversarial Prompting for Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04237","snapshot_observed_at":"2026-08-09T10:29:49.909350Z","title":"Black box adversarial prompting for foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.909350Z"},"links":{"cited_paper":"/paper/2302.04237","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:fdbcc9270e6d2e28e32a7fa1033ba665ee6e910fcf29695fef3d2954d2cfbb87","observation_id":"cbb59246-0ea7-46db-b807-bf6652108343","resolution":{"observed_at":"2026-08-09T10:29:49.909350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.915885Z","title":"Sponge examples: Energy-latency attacks on neural networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.915885Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:c65105259186680ae2e4032669945fee2c6687413351f06c5fa9298c72c41127","observation_id":"db709750-b4c6-428b-b5ae-aa3f11dbd7d3","resolution":{"observed_at":"2026-08-09T10:29:49.915885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.921380Z","title":"The skipsponge attack: Sponge weight poisoning of deep neural networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.921380Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a3020b87f39ed4acbe137bb8598523d4f21e7d2c16f88537bf4b8f4c6ff90f17","observation_id":"fe2f31d1-204c-45db-87c1-7d02a2b0d420","resolution":{"observed_at":"2026-08-09T10:29:49.921380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00083","last_updated":"2024-06-06T13:38:42Z","snapshot_observed_at":"2026-08-12T23:51:59.362331Z","submitted_at":"2024-06-03T02:25:33Z","title":"BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00083","snapshot_observed_at":"2026-08-09T10:29:49.926458Z","title":"Badrag: Identifying vulnerabilities in retrieval augmented generation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.926458Z"},"links":{"cited_paper":"/paper/2406.00083","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:08a606bc22b329f8e07cd15cc467d319bf3c267845d4f9f8d00af2fbe0c2b26a","observation_id":"6a777596-80af-48c8-b0b4-4dfd32229065","resolution":{"observed_at":"2026-08-09T10:29:49.926458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.931875Z","title":"Not what you’ve signed up for: Compromising real- world llm-integrated applications with indirect prompt injection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.931875Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d65021277da170d31f8f9f90cb02284dc1729a9ea77f8c199d420b53d31e7335","observation_id":"995d862d-9357-4648-b6aa-9b2beed85019","resolution":{"observed_at":"2026-08-09T10:29:49.931875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.937164Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.937164Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:67ed58f00c13634634eb8cb77c1757cef8fe066e94af43f81cca7153f5341821","observation_id":"92087abb-dcb0-4cf1-aaf2-c880a8bcdce5","resolution":{"observed_at":"2026-08-09T10:29:49.937164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.942178Z","title":"Masterkey: Automated jailbreaking of large language model chatbots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.942178Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b3f2a8bf88245df20858b0b1e1b483fd5d1049f0b1e4e2348f9c6213d835724a","observation_id":"bca425bf-1acb-4d80-841d-c3fd08864da5","resolution":{"observed_at":"2026-08-09T10:29:49.942178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.947217Z","title":"Low-resource lan- guages jailbreak gpt-4,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.947217Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6614813b5865ec87e2995515376c3d277115d26dc960f85113775bc278bb74d4","observation_id":"aebabad7-a43b-4edd-9f45-f7b5f7d9ac9c","resolution":{"observed_at":"2026-08-09T10:29:49.947217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.952312Z","title":"RRHF: rank responses to align language models with human feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.952312Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:3738052f347b90bb030e506c6e7e6484ce6c9d1ea28f037192164dfb725a69ce","observation_id":"1b9bcac8-9ae9-4525-9a19-bd95db159a94","resolution":{"observed_at":"2026-08-09T10:29:49.952312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00888","last_updated":"2024-11-14T22:20:49Z","snapshot_observed_at":"2026-08-13T04:32:07.137910Z","submitted_at":"2024-01-30T04:00:54Z","title":"Security and Privacy Challenges of Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00888","snapshot_observed_at":"2026-08-09T10:29:49.957573Z","title":"Security and privacy challenges of large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.957573Z"},"links":{"cited_paper":"/paper/2402.00888","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b21945822668f5e6c11fc34e52c1ba3d3d6c159cedb7a1f453426bdebdbc8a85","observation_id":"fd0a7d43-5122-4bbc-b63a-2a756102bda9","resolution":{"observed_at":"2026-08-09T10:29:49.957573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.962958Z","title":"Unique security and privacy threats of large language model: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.962958Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:98ef9667c94c94360ca5125a9b6824335e018a0466b1325d0560bebed716d11a","observation_id":"b0378fa5-1859-43d7-895a-17e2b22223bb","resolution":{"observed_at":"2026-08-09T10:29:49.962958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10844","last_updated":"2023-10-16T21:37:24Z","snapshot_observed_at":"2026-08-13T05:48:02.836662Z","submitted_at":"2023-10-16T21:37:24Z","title":"Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10844","snapshot_observed_at":"2026-08-09T10:29:49.967993Z","title":"Survey of vulnerabilities in large language models revealed by adversarial attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.967993Z"},"links":{"cited_paper":"/paper/2310.10844","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:04d02a59d95617c09001e8f7e0eaebba7e1aaa00a3f27731cc2589ba808ef4a8","observation_id":"02ad21f5-47e0-411d-a5f6-8f19eb505419","resolution":{"observed_at":"2026-08-09T10:29:49.967993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.973357Z","title":"Breaking down the defenses: A comparative survey of attacks on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.973357Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d7e5bc3899bd3b46abe810c0aecfc5c620a9a6a460712093eaa30d576eb7f723","observation_id":"65153636-eaff-4879-b51d-f68063d5b45d","resolution":{"observed_at":"2026-08-09T10:29:49.973357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.978509Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.978509Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:863ead369fc3ae66440f96b2b4d48113f71e9e8b9ba56c06eb0b264847d05ab0","observation_id":"a8d434f7-f535-4237-b046-cd1225ee0d1a","resolution":{"observed_at":"2026-08-09T10:29:49.978509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01231","last_updated":"2024-04-01T16:50:54Z","snapshot_observed_at":"2026-08-13T00:39:58.740217Z","submitted_at":"2024-04-01T16:50:54Z","title":"Privacy Backdoors: Enhancing Membership Inference through Poisoning Pre-trained Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01231","snapshot_observed_at":"2026-08-09T10:29:49.983629Z","title":"Privacy backdoors: Enhancing membership inference through poisoning pre-trained models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.983629Z"},"links":{"cited_paper":"/paper/2404.01231","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:0b7392436551eb1b2e4ecc23207dabb9c3e342c810db50c39730849dd3f94f19","observation_id":"4cb37f0c-3d15-4aca-9a81-eb28e3e36c64","resolution":{"observed_at":"2026-08-09T10:29:49.983629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05610","last_updated":"2024-07-18T08:12:46Z","snapshot_observed_at":"2026-08-13T10:15:51.256191Z","submitted_at":"2023-09-11T16:49:05Z","title":"Privacy Side Channels in Machine Learning Systems","version":2},"cited_work":{"arxiv_id":"2309.05610","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.05610","snapshot_observed_at":"2026-08-09T10:29:51.306562Z","title":"Privacy Side Channels in Machine Learning Systems","venue":"cs.CR","work_id":"d73a47a9-97fd-45d2-895e-8a59da441fe6","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.988800Z"},"links":{"cited_paper":"/paper/2309.05610","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:ea0ecbfff2e10ce80fa17e2e049b90db26ddfb078a111182468fd4ae5dfc21f8","observation_id":"e8a8fa1d-2984-4f45-bdd1-d2a2ad54f320","resolution":{"observed_at":"2026-08-09T10:29:51.313274Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.994381Z","title":"Extracting training data from large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.994381Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:db2474307d82645249cbadecbeca928459fab76f934b31dca8c905a007c12b7b","observation_id":"3f72908d-90ab-427c-8799-5dc8b064bdf1","resolution":{"observed_at":"2026-08-09T10:29:49.994381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04401","last_updated":"2023-07-10T08:03:41Z","snapshot_observed_at":"2026-08-13T10:59:14.554748Z","submitted_at":"2023-07-10T08:03:41Z","title":"Ethicist: Targeted Training Data Extraction Through Loss Smoothed Soft Prompting and Calibrated Confidence Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04401","snapshot_observed_at":"2026-08-09T10:29:50.004481Z","title":"Ethicist: Targeted training data extraction through loss smoothed soft prompting and calibrated confidence estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.004481Z"},"links":{"cited_paper":"/paper/2307.04401","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6260e7bb70815d06ed3cdc543d8b9fb23934bd2c0c1fbe6f7de69fcbe05e2b5a","observation_id":"e7a9df9f-6b17-49af-a957-e5366528a70c","resolution":{"observed_at":"2026-08-09T10:29:50.004481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08935","last_updated":"2019-12-19T05:09:29Z","snapshot_observed_at":"2026-08-10T14:40:00.659950Z","submitted_at":"2019-06-21T03:46:43Z","title":"Deep Leakage from Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08935","snapshot_observed_at":"2026-08-09T10:29:50.009850Z","title":"Deep leakage from gradients,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.009850Z"},"links":{"cited_paper":"/paper/1906.08935","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:64b66b39451e50826fbad02396a2712efda3393445fa7891672a6ee43eb0ed96","observation_id":"89257ba0-bdc9-4ab2-9738-27bcfce1e6bf","resolution":{"observed_at":"2026-08-09T10:29:50.009850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13624","last_updated":"2023-11-22T09:58:01Z","snapshot_observed_at":"2026-08-13T05:19:47.923147Z","submitted_at":"2023-11-22T09:58:01Z","title":"A Theoretical Insight into Attack and Defense of Gradient Leakage in Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13624","snapshot_observed_at":"2026-08-09T10:29:50.014690Z","title":"A theoretical insight into attack and defense of gradient leakage in transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.014690Z"},"links":{"cited_paper":"/paper/2311.13624","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:8d49b1f778cf41395b84230fb11817549624917ee91069fb0fe7982f4a83302f","observation_id":"3d54ee97-8d13-4b2e-86df-9874747309ee","resolution":{"observed_at":"2026-08-09T10:29:50.014690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.020105Z","title":"Model leeching: An extraction attack targeting llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.020105Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:7d096a37b9e18c2feaa5a6be74fe696f59d1db42c436b5240a16239152c5cb5b","observation_id":"3efd2ac7-ff19-44dc-b02a-9eb1a30ea79b","resolution":{"observed_at":"2026-08-09T10:29:50.020105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.025185Z","title":"Prompt injection attack against llm-integrated applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.025185Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f1d4b23724107009aea6f454bcb1f1b2045e0a1c840d4288b1d5b8fbb84cd35c","observation_id":"96360e29-b26d-409c-9855-b0c13b2a0746","resolution":{"observed_at":"2026-08-09T10:29:50.025185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06865","last_updated":"2024-08-07T22:05:01Z","snapshot_observed_at":"2026-08-13T10:56:02.144814Z","submitted_at":"2023-07-13T16:15:08Z","title":"Effective Prompt Extraction from Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06865","snapshot_observed_at":"2026-08-09T10:29:50.030145Z","title":"Effective prompt extraction from language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.030145Z"},"links":{"cited_paper":"/paper/2307.06865","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6fa4501a7f67fa97ba97c7e233cd27fe4258cc4b5d41ffa8f40d358848d0a020","observation_id":"fe3e80c8-957a-4412-8773-ea7dc1347c39","resolution":{"observed_at":"2026-08-09T10:29:50.030145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15469","last_updated":"2024-07-26T04:43:19Z","snapshot_observed_at":"2026-08-13T05:42:35.221378Z","submitted_at":"2023-10-24T02:48:19Z","title":"The Janus Interface: How Fine-Tuning in Large Language Models Amplifies the Privacy Risks","version":3},"cited_work":{"arxiv_id":"2310.15469","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.15469","snapshot_observed_at":"2026-08-09T10:29:51.191854Z","title":"The Janus Interface: How Fine-Tuning in Large Language Models Amplifies the Privacy Risks","venue":"cs.CR","work_id":"6dcf4649-88d8-4018-a2a7-6e8d3706b938","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.035282Z"},"links":{"cited_paper":"/paper/2310.15469","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:09d189f7d0e781b0504d7473810a63e1aa62193e67ce71b3365ec03ed94da9f2","observation_id":"5842d16d-8d1f-44c5-8227-e936ab9139c8","resolution":{"observed_at":"2026-08-09T10:29:51.199889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.040248Z","title":"Multi-step jailbreaking privacy attacks on chatgpt,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.040248Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b3efb08cc716c27098c94b7e086ffab72724df86c502ed059a43fc3a7c153a29","observation_id":"ed4d8bc0-5d0e-453a-a005-c4ff380858a5","resolution":{"observed_at":"2026-08-09T10:29:50.040248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.578845Z","title":"Badpre: Task-agnostic backdoor attacks to pre-trained NLP foun- dation models,","venue":null,"work_id":"f777a79a-cce0-4d13-be61-c0c31fc1117f","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.050488Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:28fab6498a80e935b096393dbf6cfa9315500b97135a058452f0768ca8754838","observation_id":"dfd102d3-7ad6-470d-83af-2846c683e55c","resolution":{"observed_at":"2026-08-09T10:29:52.584283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.563641Z","title":"Composite backdoor attacks against large language models,","venue":null,"work_id":"2abcf6d9-43c2-43c8-ae9d-351e261d0315","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.055190Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d38559fb8338fe2d6d88b4a58912b6530be6428151f12cd5c3dd4511d057a726","observation_id":"6c1c5dfa-d7aa-4dae-98b4-bd5b4200e3d0","resolution":{"observed_at":"2026-08-09T10:29:52.568430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.547819Z","title":"Backdoor attacks for in-context learning with language models,","venue":null,"work_id":"14ded355-5464-41ad-b1f1-e41bd2682013","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.060127Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:dee062a61f66862d9ef5812a4c8b41430ad8fd1f64cdcc3c81b9f9b542c729d0","observation_id":"bd0f4184-31b1-470a-ba8c-b7416d6c0bde","resolution":{"observed_at":"2026-08-09T10:29:52.553102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.530932Z","title":"Badedit: Backdooring large language models by model editing,","venue":null,"work_id":"1fcbeaf0-81aa-4460-ba78-279b5552d00b","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.065116Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f513cfef9f7e4d889787df29c43b6831ad051fa91f75c8574d547a988e8024a6","observation_id":"b5afd884-a4f8-484e-8681-bada0c27234f","resolution":{"observed_at":"2026-08-09T10:29:52.536460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.511945Z","title":"Weight poisoning attacks on pretrained models,","venue":null,"work_id":"da050637-7ad3-453a-b399-5de9fa3fc349","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.069622Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:52f035e0468e2458ee10ec559c5d70f5d6a9db2730e64ef4de38eb107f52a8d7","observation_id":"104c0c6c-0a95-439d-98bc-f0ac8b3441a0","resolution":{"observed_at":"2026-08-09T10:29:52.517375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.493359Z","title":"Backdoor attacks on pre-trained models by layerwise weight poisoning,","venue":null,"work_id":"487099a6-40cd-44c6-87ea-3f6fd87db79e","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.075006Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:690fd13922ccbe3f67f540de0ebabc4bb39f11606f237ba04a3fb94ddcaf91a4","observation_id":"5c2fce5d-2772-4ab2-a49d-841329a74b9c","resolution":{"observed_at":"2026-08-09T10:29:52.498615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.477112Z","title":"Catastrophic interference in con- nectionist networks: The sequential learning problem,","venue":null,"work_id":"9b075254-e398-4937-8157-172efa59fed6","year":1989},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.079789Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:ea5cabeb2d1b15ad4c32f99c753c6d9df17a979683c45ff3c4c22061b02d9041","observation_id":"e8c064ac-2385-4a54-81c3-531e019f7bbb","resolution":{"observed_at":"2026-08-09T10:29:52.482663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.460246Z","title":"Red alarm for pre-trained models: Universal vul- nerability to neuron-level backdoor attacks,","venue":null,"work_id":"d3ed1417-0ab4-40c5-9aec-edd6885ea0f8","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.084616Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:49a50f2dfadadf71d9986ed4840c0e675c84393653c128bd4bb9a85bd109f6cd","observation_id":"4834bdd4-b249-44f7-acb6-b65eeecd8104","resolution":{"observed_at":"2026-08-09T10:29:52.465334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.445037Z","title":"Uor: Universal backdoor attacks on pre-trained language models,","venue":null,"work_id":"d47f23e6-ea9c-46ee-9fc5-e8a49f174f91","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.089493Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:61b722ee5942a66148bd47d9e0b169c5409d162495a1757096db68328505b8fc","observation_id":"0ec9a2fd-054a-4cba-b80c-12034ffe5170","resolution":{"observed_at":"2026-08-09T10:29:52.450065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-09T10:29:50.094426Z","title":"Discovering language model behaviors with model-written evaluations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.094426Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:0b09b5a87ef42f3af059375e79ce44c661b558ec49f32325a9ae48297e43b799","observation_id":"742eb058-6c6b-4ead-8bed-ff69863269af","resolution":{"observed_at":"2026-08-09T10:29:50.094426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-12T17:13:46.394331Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-09T10:29:50.099679Z","title":"Explaining and harnessing adversarial examples,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.099679Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:24c4e211bf0ae0952bff5b9615d76ed3b91d932e6014f214da4ecaca2052fa14","observation_id":"4c8e2cb1-216d-46e0-b20f-70989f7e1828","resolution":{"observed_at":"2026-08-09T10:29:50.099679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.104633Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.104633Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:fb8f4ee5d03bcf143b0b6ea1198aaecc2953c3e627b26cfcc18a6ea4d4327c6e","observation_id":"83acc41c-f98b-4843-891c-bac937b09a2f","resolution":{"observed_at":"2026-08-09T10:29:50.104633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.419114Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":"a5cc1d7f-7a3b-4d4f-ba49-a6873e3d01fe","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.109343Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:bc0511f727282ad48bf0ec658a7a4118c01866a60612a30061294147ee4882d1","observation_id":"6c852828-557e-440a-a24d-2c3ad121004b","resolution":{"observed_at":"2026-08-09T10:29:52.423973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.403670Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":"c6d2ec5b-df67-4ff0-a614-aa0ebdc7511f","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.114143Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6e9c24d003111c9e93a1c7dc4a9b141726aa337ae1099b7c99dc88bc10f81f8c","observation_id":"077b5a60-4f00-4ccc-9698-ff06e00b93fe","resolution":{"observed_at":"2026-08-09T10:29:52.408502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-08-13T04:09:55.059489Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-09T10:29:50.118656Z","title":"Codechameleon: Personalized encryp- tion framework for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.118656Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:1ed4422393b04218edc1964de9c0d7c3d8939df6f638db3050c1a5c8b2450d90","observation_id":"40d59864-3713-4dba-b09d-52fe250163c7","resolution":{"observed_at":"2026-08-09T10:29:50.118656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.387963Z","title":"Multilingual jailbreak challenges in large language models,","venue":null,"work_id":"68bba877-c71a-4a25-851b-c29d886e94f7","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.123703Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:4ecf2f579255763815a53487c7c6da4f67f54a4b008b2a3bcf1c5bc01a12c0c3","observation_id":"27f0611d-9193-431a-8cb0-989a89a3d341","resolution":{"observed_at":"2026-08-09T10:29:52.393195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.372192Z","title":"Gpt-4 is too smart to be safe: Stealthy chat with llms via cipher,","venue":null,"work_id":"4f0e69cf-8b89-4c51-978d-eae099541796","year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.128453Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:32eb5102cde7d211ee646950f1e3a1693b131ea0638d69633c1e298d2ec9858e","observation_id":"5227bde8-5717-452b-9f8e-c3dc72e65ea3","resolution":{"observed_at":"2026-08-09T10:29:52.377291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.356945Z","title":"”do anything now","venue":null,"work_id":"ca58742a-e08b-41e2-baf1-61671c19723b","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.139207Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:7f0e189a809e2b8096eca0a3f8a2d6b1df701b7f9032170feba463a4f2daccee","observation_id":"0515fb4d-df96-4296-b060-edbed182c801","resolution":{"observed_at":"2026-08-09T10:29:52.362042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.340619Z","title":"Ignore previous prompt: Attack techniques for language models,","venue":null,"work_id":"7f2b0cee-f2d1-43b2-b843-c15b64b2bea2","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.144155Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:7261a6449756b939842473682f2a87234dbe743eee2b246f0eaec6774b3b63cb","observation_id":"b4fffba4-2b19-4bdb-8a92-bd91badb5898","resolution":{"observed_at":"2026-08-09T10:29:52.345773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.070667Z","title":"Why so toxic?: Measuring and triggering toxic behavior in open-domain chatbots,","venue":null,"work_id":"e7ca5fce-d3a3-4dd5-9bd3-92be799e540a","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.149305Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:06c9b853a1d4bb89f514ef60eddcdfcb937bc67bb413351f8a6f80f7f2620732","observation_id":"f0427670-fd64-4894-9a69-e43880894ff9","resolution":{"observed_at":"2026-08-09T10:29:51.075789Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.325301Z","title":"Explore, establish, exploit: Red teaming language models from scratch,","venue":null,"work_id":"7aca2de7-b507-4516-9a50-7a56bc7d5c65","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.154160Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b7a837c923f14d466ef25cd1973bb5a98b71347fac542e14885271e133506776","observation_id":"2b4f8853-b7c4-49ce-8e56-4e03c9cb7764","resolution":{"observed_at":"2026-08-09T10:29:52.330471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.309387Z","title":"Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned,","venue":null,"work_id":"a7d38f12-bea6-49e8-af61-e5dfc3cd8195","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.159008Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5999957c95f9f162480369d6e611cc204830f84a07656e715672a8049c956345","observation_id":"cdcff83d-d586-4c55-8efe-e00b41756c80","resolution":{"observed_at":"2026-08-09T10:29:52.314575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.292196Z","title":"Fuzzllm: A novel and universal fuzzing framework for proactively discovering jailbreak vulnerabilities in large language models,","venue":null,"work_id":"59e762ad-d864-4ece-9d4b-6fc37745ab0f","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.164050Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:81c8a27d15885da94a9129c4466579e77cdddceef91c97f1c7fa8644f7982e9e","observation_id":"13f5a61b-32ba-4cca-b300-9c58af05f6c7","resolution":{"observed_at":"2026-08-09T10:29:52.297264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.276358Z","title":"Parafuzz: An interpretability-driven technique for de- tecting poisoned samples in NLP,","venue":null,"work_id":"f9e0549e-1c18-4f92-aedc-9d8257bea6c9","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.168813Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:80ee81fe03c1459c49c96442883ab58e3533e2a36c7ed5bddbe4b99c20dd6bee","observation_id":"0b0002ce-0557-4128-a8ae-f6ee1b87327d","resolution":{"observed_at":"2026-08-09T10:29:52.281573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.260794Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":"a5cdc927-d6d5-4e2f-861a-69a7489ffd8d","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.173726Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:866e871365b08a814d71e27c5506e0e4f08a0d50621ae2ab563d347eeae581b7","observation_id":"35a58323-36bb-4a64-adf3-4a2dbedf27de","resolution":{"observed_at":"2026-08-09T10:29:52.266148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-08-14T06:54:18.196537Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-09T10:29:50.179302Z","title":"Tree of attacks: Jailbreaking black- box llms automatically,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.179302Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:930c32a31bde2ac14bea77d042239015893675ab006df0b0fe4a8d8b6565bdda","observation_id":"b4306fb1-7467-443d-95f9-1f0994c11411","resolution":{"observed_at":"2026-08-09T10:29:50.179302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.245340Z","title":"Automatically auditing large language models via discrete optimization,","venue":null,"work_id":"929cc314-181f-4258-a198-38d3ebdc53dc","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.184581Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5154df54a0965ae16ea2b65c1b2bfe4d6435d6a5be69beb51574886e849510c3","observation_id":"4bf59265-0dd6-4541-b5de-34e079a08d67","resolution":{"observed_at":"2026-08-09T10:29:52.250283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.228532Z","title":"Eraser: Jailbreaking defense in large language models via unlearning harmful knowledge,","venue":null,"work_id":"a6b81525-a192-41d3-9be5-639f973d8665","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.189925Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d2f195ea4acba5db49ebfdf21be6a3d2f47f98853fa912b5dee94f8715fbf3ad","observation_id":"048c2f03-0df1-4d44-a70b-8d025ac9751c","resolution":{"observed_at":"2026-08-09T10:29:52.234306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17263","last_updated":"2024-11-08T06:57:05Z","snapshot_observed_at":"2026-08-13T04:30:51.830402Z","submitted_at":"2024-01-30T18:56:08Z","title":"Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17263","snapshot_observed_at":"2026-08-09T10:29:50.195132Z","title":"Robust prompt optimization for defending language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.195132Z"},"links":{"cited_paper":"/paper/2401.17263","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:94b0a7982b709125b2cb84b18609fc9a15817cdcc7f5027c97e1efa7ee9fba22","observation_id":"be87d481-dcf7-4fbc-b8cd-485ef85dbc5d","resolution":{"observed_at":"2026-08-09T10:29:50.195132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-09T10:29:50.200326Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.200326Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:e4da4e361d8f2289ebbe92eb9e1470c8fcadfc4f1370ea0503ae365561613bdb","observation_id":"5c5e495d-5ff0-4b45-b5e8-e1887e7cc09e","resolution":{"observed_at":"2026-08-09T10:29:50.200326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-09T10:29:50.205234Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.205234Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:464e074feb03724caa9de3d418ddcffb527925cb85270d8cdd3dec8ba7f20c6f","observation_id":"7784d2aa-4407-48d7-842c-5ef5d2381eb3","resolution":{"observed_at":"2026-08-09T10:29:50.205234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.209759Z","title":"Break the breakout: Reinventing lm defense against jailbreak attacks with self-refinement,","venue":null,"work_id":"4232449e-d483-4ff8-a495-0acf84617d91","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.210234Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:134dcf9019ba35662662a499c89b2c249d9a5fdba4849988cec9c25d81b341c8","observation_id":"1d530286-2a76-4e7c-8c91-8634aaf7e179","resolution":{"observed_at":"2026-08-09T10:29:52.215217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.192982Z","title":"Safe rlhf: Safe reinforcement learning from human feedback,","venue":null,"work_id":"4e9a195b-782c-45e4-bab0-8b5d7ae4bc56","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.214784Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:3ff9c5db2c36395b8113a0a798d0614fdd13d7b18c25d718b87578ef8d30a421","observation_id":"0a71edbd-db34-46a8-ac1a-3efcf17f271d","resolution":{"observed_at":"2026-08-09T10:29:52.197830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.178643Z","title":"Smoothllm: Defending large language models against jailbreaking attacks,","venue":null,"work_id":"1c7760d3-ccc0-4a64-91a5-0238598347c1","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.219751Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6484ff0e082944f42c90737905e86680f45d3d352790cb0dee89d6abfe177050","observation_id":"2d8449b8-7072-4e9f-99b6-95d61814dce7","resolution":{"observed_at":"2026-08-09T10:29:52.183392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.163531Z","title":"Defending large language models against jailbreak attacks via semantic smoothing,","venue":null,"work_id":"a3ffaab0-3b14-4c40-917d-8836724add99","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.224633Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f50979a7c22e08f4ba5ec17303a120591d2b25077fc57e20f544636742320d45","observation_id":"f978740d-617e-446f-9e2b-15e15f6ce5de","resolution":{"observed_at":"2026-08-09T10:29:52.168514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.148426Z","title":"Certified adversarial robustness via randomized smoothing,","venue":null,"work_id":"c49264ae-4f17-47ae-ab80-91f1768b12a9","year":2019},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.229527Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:841772313805753471148ed9fec8d0b8158b5a7f0073254cc75aaeb2ed718d57","observation_id":"6fdf60ee-d52b-4f45-8aa0-2797d7f35a9f","resolution":{"observed_at":"2026-08-09T10:29:52.153285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.132562Z","title":"Dp-forward: Fine-tuning and inference on language models with differential privacy in forward pass,","venue":null,"work_id":"2f879578-f229-4e02-9fdd-1a1613c8e7b6","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.235191Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:2c3400f9dad85c80be2c7fd27ab3e6aa613477849c42c32f2e65997cc9593611","observation_id":"f4ae7ac6-010a-48fd-a012-e9042fa0a704","resolution":{"observed_at":"2026-08-09T10:29:52.138024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14348","last_updated":"2024-06-12T00:27:06Z","snapshot_observed_at":"2026-08-13T10:11:52.471018Z","submitted_at":"2023-09-18T02:07:22Z","title":"Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14348","snapshot_observed_at":"2026-08-09T10:29:50.240137Z","title":"Defending against alignment-breaking attacks via robustly aligned llm,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.240137Z"},"links":{"cited_paper":"/paper/2309.14348","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:7332d490d1def72021bfdac27727e0519652df461fe549fa09a237cab0b8bef5","observation_id":"64256897-cf8a-4449-8d82-8bfdd6f80501","resolution":{"observed_at":"2026-08-09T10:29:50.240137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.116397Z","title":"Defending large language models against jailbreaking attacks through goal prioritization,","venue":null,"work_id":"2e387e6e-6c27-4713-9fbe-7c9be6674dc6","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.245375Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:3e9fff65d83c929755809a49f0e4b50e504273e41fbcafbfdbe3f5f1d5b375ea","observation_id":"60bbd7e6-be9f-4635-b192-375e4f27b423","resolution":{"observed_at":"2026-08-09T10:29:52.121510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.099980Z","title":"RAIN: Your language models can align themselves without finetuning,","venue":null,"work_id":"85f86409-3c2a-49fa-bba1-90e54094a181","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.250415Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:3e2b073cafdee38ea9fbf131654c921bdf7f8db2a4ad35b699001e4c308442b5","observation_id":"5f23e21c-01d7-468d-8e17-a000b7b8c9da","resolution":{"observed_at":"2026-08-09T10:29:52.105189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-09T10:29:50.255222Z","title":"RAFT: reward ranked finetuning for generative foundation model alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.255222Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:66c64a1b979c72dfed97f74dc1ebbc3d37b0fb294be8e7cb97de12f5dd8ab28e","observation_id":"4cc1a48c-479a-4f1d-9e7b-0b554279d249","resolution":{"observed_at":"2026-08-09T10:29:50.255222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.082338Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":"42ba2b2d-8498-4962-87fd-7377f323309e","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.260548Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:42bc41803c93f8ccdd9e2fc4d14a23caf6546da053fff8351755ee3b8edf46b7","observation_id":"97eccaa6-3b7e-4e6b-be93-404d0c29c8de","resolution":{"observed_at":"2026-08-09T10:29:52.087339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14321","last_updated":"2024-10-18T09:32:08Z","snapshot_observed_at":"2026-08-12T22:20:13.552667Z","submitted_at":"2024-10-18T09:32:08Z","title":"From Solitary Directives to Interactive Encouragement! LLM Secure Code Generation by Natural Language Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14321","snapshot_observed_at":"2026-08-09T10:29:50.265334Z","title":"From solitary directives to interactive encouragement! llm secure code generation by natural language prompting,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.265334Z"},"links":{"cited_paper":"/paper/2410.14321","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:4653725144c0ce22e7bc9ec70742219fe081c79770aa8a03498cfdd42aa2d8e3","observation_id":"7b237172-e5fa-40f2-b031-b023707127b0","resolution":{"observed_at":"2026-08-09T10:29:50.265334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.064389Z","title":"Design and evaluation of a multi- domain trojan detection method on deep neural networks,","venue":null,"work_id":"b5a9d8f4-cc0c-43cd-a7d5-1ded93d7b21a","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.271524Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a4b742810d3b5a830316b7a7b0cc653eac4d1f5e33b418219b4a5fe8084a6ec1","observation_id":"be44f680-60a2-493c-ad89-f9d3708c9b3b","resolution":{"observed_at":"2026-08-09T10:29:52.069775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.049044Z","title":"Robust backdoor detection for deep learning via topological evolution dynamics,","venue":null,"work_id":"eef82a83-b686-4569-b0d6-94d38b8db7c6","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.276664Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:40558cd05f768818dc499476f6cae4109d6a4ae979ccf0b0db27faa99a45b7d0","observation_id":"1141e4e6-3988-403d-864d-f742034deac8","resolution":{"observed_at":"2026-08-09T10:29:52.053920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.032649Z","title":"Mm-bd: Post- training detection of backdoor attacks with arbitrary backdoor pattern types using a maximum margin statistic,","venue":null,"work_id":"5ff12a5d-b073-4659-9184-79a90a5b358e","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.281613Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:fe9d276d4930120f5a54e357312e3072bae30d680354a660734cefc3d9a82ac4","observation_id":"0cbbc101-2f9d-4492-8e00-572d169b4c84","resolution":{"observed_at":"2026-08-09T10:29:52.038290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.015764Z","title":"Locating and editing factual associations in gpt,","venue":null,"work_id":"06ad6861-32fd-4d17-a30b-3f2c73801448","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.287333Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:7362be20ca6291518afe616e9c660148332cf07c2ee3e70e4b209789ae530330","observation_id":"853ca252-4148-4341-8233-2c489103a4b6","resolution":{"observed_at":"2026-08-09T10:29:52.020986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01286","last_updated":"2024-11-17T06:50:44Z","snapshot_observed_at":"2026-08-13T04:50:01.828919Z","submitted_at":"2024-01-02T16:54:58Z","title":"A Comprehensive Study of Knowledge Editing for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01286","snapshot_observed_at":"2026-08-09T10:29:50.293237Z","title":"A comprehensive study of knowledge editing for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.293237Z"},"links":{"cited_paper":"/paper/2401.01286","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:4422283efb28bc5b09d90338989bfd83d735a5ae3689e2ce2470eff200e8c5c3","observation_id":"b91e0cd2-87c9-4734-8b1c-d89933be58a3","resolution":{"observed_at":"2026-08-09T10:29:50.293237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.738360Z","title":"Federatedscope- llm: A comprehensive package for fine-tuning large language models in federated learning,","venue":null,"work_id":"9482fa3b-bb84-419d-8436-6a1714876296","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.298553Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f9e511462bd277e10115222f86b7fc4cc41eee0824f331417b5d5fd930be7619","observation_id":"5d634e7a-1b0e-473a-bcc2-664e7f81050d","resolution":{"observed_at":"2026-08-09T10:29:50.743851Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.999383Z","title":"How to backdoor federated learning,","venue":null,"work_id":"c0d349b0-a220-4cb3-8e3c-ff46781d34ad","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.303661Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:1a7ba62bf3e6439f5025caf2dad670ac250827d75fb1fa952dd78b74fc439aea","observation_id":"796a0fff-ec26-4fc1-8526-7dd636e02b40","resolution":{"observed_at":"2026-08-09T10:29:52.004673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.984151Z","title":"Attack of the tails: Yes, you really can backdoor federated learning,","venue":null,"work_id":"6f38316e-c68c-4529-bf48-cdefb63e42c9","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.308505Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:271c3fd0f6ec167cbc343a4fb86de63a926a85233ebc05cd9cd19a278a906c1f","observation_id":"769c9347-0e6a-4b61-96b6-9b0abe01142d","resolution":{"observed_at":"2026-08-09T10:29:51.989077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.969130Z","title":"DBA: distributed backdoor attacks against federated learning,","venue":null,"work_id":"04b74b38-25dd-4c55-ae34-03cf82ed3d7e","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.313490Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b51fe2a2543ccf05c4c3b7ac54e8db42b83124a4a63552fb5e3fe3966f9d8789","observation_id":"182aaf0f-e1e7-4150-bc29-8eb9bedd3727","resolution":{"observed_at":"2026-08-09T10:29:51.974097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.950806Z","title":"Comprehensive privacy analysis of deep learning: Passive and active white-box inference attacks against centralized and federated learning,","venue":null,"work_id":"c16d52eb-d68b-447d-80ac-7a818a02fad0","year":2019},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.318686Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:98691d985799eb242340f9d9b9eaa4e6ab61bd7b6b3a91062c9ede837214edae","observation_id":"38c9bc5d-b4b3-4c9a-928f-617c61e5c2cc","resolution":{"observed_at":"2026-08-09T10:29:51.955797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.572300Z","title":"Practical secure aggregation for privacy-preserving machine learning,","venue":null,"work_id":"78e4bcd5-13a2-4352-8ffb-0f9bf4ba916c","year":2017},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.323785Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:fa7cb20657045e1b8fdbdead77a4a91afe46f52dbba0f02467968805a51182a1","observation_id":"6da44e5d-9e0f-41bb-ab92-b4704528b939","resolution":{"observed_at":"2026-08-09T10:29:50.579361Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.935452Z","title":"Machine learning with adversaries: Byzantine tolerant gradient descent,","venue":null,"work_id":"9462263a-b0c4-4e6b-84ea-312b2e7b75b3","year":2017},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.328673Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5d53c0a545954395966339b4422402cf03e38dd7cc6814a11c99cb6ff967a476","observation_id":"b0b1a240-6da9-4ce0-8285-502205b7c9c7","resolution":{"observed_at":"2026-08-09T10:29:51.940389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.919727Z","title":"The hidden vulnerability of distributed learning in byzantium,","venue":null,"work_id":"cae9a669-a30c-4704-afc1-62933773a31a","year":2018},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.333604Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f1910e8216c7266a7d4c8d0f42a596510628fca22bcd4d11b742ebf1a7babb11","observation_id":"d392ee61-5182-4c61-8bc0-ef952115368e","resolution":{"observed_at":"2026-08-09T10:29:51.924697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.902089Z","title":"Fltrust: Byzantine- robust federated learning via trust bootstrapping,","venue":null,"work_id":"7dffa430-f2da-402e-9de4-b3e6815b3301","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.338496Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f880bdfab728a0165da862b30e319779ae561dc1a994b3804f0f63a35251c3f0","observation_id":"942fd518-9702-4825-bb2a-6d3830160b91","resolution":{"observed_at":"2026-08-09T10:29:51.907660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.885134Z","title":"FLAME: taming backdoors in federated learning,","venue":null,"work_id":"eef7aa5c-83e1-4b6a-8be5-b15e698083eb","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.343560Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:60542bf3f1734a349cf2a971c8ae64fd4a195501c24629d87c22b651c131a3ac","observation_id":"a161a009-1845-4592-be2b-ecf827a117f0","resolution":{"observed_at":"2026-08-09T10:29:51.890051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.869379Z","title":"Calibrating noise to sensitivity in private data analysis,","venue":null,"work_id":"8bb27f4e-1f4f-4a02-9ec5-6c512ed6cc52","year":2006},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.348498Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b70a50371fd256acc9c7fb3c0e0bdfdd4989e7044ca83922293df527691b5c5b","observation_id":"cfb7fb49-4fa8-4abe-851c-a0d374bfc126","resolution":{"observed_at":"2026-08-09T10:29:51.874529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.834746Z","title":"CRFL: certifiably robust federated learning against backdoor attacks,","venue":null,"work_id":"d70bb51a-c972-4ba0-b8e3-5af92bf7d323","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.358410Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:0f70119ffd8a1dd21dbc3f77f9acf582c8551bd188c583432e3f8372ae426304","observation_id":"1a200729-1063-409b-b03e-d3d55856d2fa","resolution":{"observed_at":"2026-08-09T10:29:51.840239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.809804Z","title":"Yes, one-bit-flip matters! universal dnn model infer- ence depletion with runtime code fault injection,","venue":null,"work_id":"88009c11-fedb-42d3-be1e-803a97e3f952","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.362918Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:bef1f9b91a750c37ee87b18e305c68fc43d5452f726f90abcb708c51aaffdace","observation_id":"15684c4c-5afb-40d4-9c36-1600e1843c5d","resolution":{"observed_at":"2026-08-09T10:29:51.815803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-08-13T12:05:01.318814Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-09T10:29:50.045250Z","title":"Available: https://arxiv.org/abs/2304.05197","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.045250Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b4388a6317220b8f0ebd69bc04e6e5f522d055468d12ab4d9e02426c5e0d6bd1","observation_id":"9c9bf0fe-1e48-4a6d-87d3-56f181b44334","resolution":{"observed_at":"2026-08-09T10:29:50.045250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-08-13T10:35:42.282922Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-09T10:29:50.133416Z","title":"Available: https://arxiv.org/abs/2308.06463","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.133416Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:9973bcd10c593b82a25dc51a8e2d7500af854e217b2e21e252cc1aa7009728fe","observation_id":"ed493799-d566-405d-aa80-3f587e1ba4f4","resolution":{"observed_at":"2026-08-09T10:29:50.133416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.999202Z","title":"Available: https://www.usenix.org/conference/ usenixsecurity21/presentation/carlini-extracting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2650,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.999202Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5fddb70864d515fe941e8624d553ffc8fbaa66cf65448493c650dac7835840d3","observation_id":"e7386865-4023-43c7-87bc-dabb6c8be476","resolution":{"observed_at":"2026-08-09T10:29:49.999202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.852624Z","title":null,"venue":null,"work_id":"8eb74a92-c92c-4cc2-b327-813f0b9bc77a","year":2006},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":3876,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.353576Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:900829f3c184f76b253e007b08ad74a64b471cb2a71a5ac2f923226d729649fe","observation_id":"aba607c0-3780-4ffc-9f3b-86167f74b640","resolution":{"observed_at":"2026-08-09T10:29:51.858717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-11T14:26:02.458624Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":5,"verified_fuzzy":46},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 3 inbound Pith citation observations for arXiv:2502.02960."}