Pith. sign in

Paper Citation Record · LEDGER

Security Concerns for Large Language Models: A Survey

As of 11 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 7 inbound Pith citation observations for arXiv:2505.18889.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.18889 v5

Coverage vector

measured 84 of 84 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:27:03.780401Z

measured 91 of 91 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-11T06:34:44.6726+00:00

measured 7 of 7 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T19:12:22.885999Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-17T00:31:24.539214Z

Reference resolution

84 of 84 outbound references displayed

  • verified exact5
  • verified fuzzy18
  • unresolved61
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 1b66ac07-a466-4c8b-9424-707bdcc9a53e · outbound

This paper cites Concrete Problems in AI Safety.

Security Concerns for Large Language Models: A Survey Concrete Problems in AI Safety

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.364590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.364590Z digest=sha256:8e86106076af06aa012a538b0d16e20fefbc6a18a2594316b443ab91c3bb4bcc

Observation 40fc1189-3a08-465a-b301-751bdf4b694b · outbound

This paper cites System Card: Claude Opus 4 & Claude Sonnet 4.

Security Concerns for Large Language Models: A Survey System Card: Claude Opus 4 & Claude Sonnet 4

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.370897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.370897Z digest=sha256:8e2e283afc065d9e085ba17ef233b2eebf60c41d212f9e27371b3b25990036aa

Observation a406cd1d-1821-4e37-b4ca-a6701e8d1913 · outbound

This paper cites Theclaude3modelfamily:Opus,sonnet,haiku.

Security Concerns for Large Language Models: A Survey Theclaude3modelfamily:Opus,sonnet,haiku

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.376217Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.376217Z digest=sha256:bb38e515f9181fcbba7b29e6e937b53089ec61aba286f9f5fed8251551d9b095

Observation 317e49e5-374c-40d5-8786-b7729eb72d50 · outbound

This paper cites Embedding-based classifiers can detect prompt injection attacks.

Security Concerns for Large Language Models: A Survey Embedding-based classifiers can detect prompt injection attacks

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.381548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.381548Z digest=sha256:0d9a2144433f730c433ca8718415008ecdaf2b948e80522bd035d676361f5c28

Observation 97ce77fa-9edb-42ac-a154-3bd1a17c4167 · outbound

This paper cites Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation.

Security Concerns for Large Language Models: A Survey Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.386052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.386052Z digest=sha256:e506e54ebb92cdcafbb51d40dfef2c8664e34dec90fd5da85cffd6cf7ccc36cc

Observation 466f5ac9-9c5a-48fe-80b1-f32da3f1006f · outbound

This paper cites Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models.

Security Concerns for Large Language Models: A Survey Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.390674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.390674Z digest=sha256:4801cabfcc80f762adc744ecc46ae6ad13b5bcba2e5309b39aa5bcaa2f1d36c2

Observation 08abe4a7-9e46-4070-a905-96ca93301b08 · outbound

This paper cites LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds.

Security Concerns for Large Language Models: A Survey LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.889778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.396465Z digest=sha256:4200d9b7d0019575072c16b3a14a604224f120adeb414346c487a6e98e2b916b

Observation 554e00f1-c718-43d1-882c-12be9106f299 · outbound

This paper cites Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?.

Security Concerns for Large Language Models: A Survey Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.401477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.401477Z digest=sha256:1b3e7e6f82397a4b50bb2956961c64f55830b69f61aee37cc57c3ef3dc2959d1

Observation cf7d8278-25e5-430d-8210-761a9ce1c0b0 · outbound

This paper cites Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment.

Security Concerns for Large Language Models: A Survey Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.407254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.407254Z digest=sha256:96cc7f38dc89e6f90823c9bdebd17e0326d060cb9b147804e5692336d2fb739b

Observation 3852f90b-0c1a-4b47-bc46-85e3acf1666e · outbound

This paper cites Language models are few-shot learners.

Security Concerns for Large Language Models: A Survey Language models are few-shot learners

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.412812Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.412812Z digest=sha256:c2bd97d1566115c2d4bfc876b3bbed2bdc2cf79cc47059aadbdb9f6bd0fab7ab

Observation 99ec921e-878c-44c2-9900-bfff5d05ad88 · outbound

This paper cites Jailbreaking Black Box Large Language Models in Twenty Queries.

Security Concerns for Large Language Models: A Survey Jailbreaking Black Box Large Language Models in Twenty Queries

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.417247Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.417247Z digest=sha256:9852a467608a7e151976e4bd7d058cae32d6c22e7abf4478b29e4af4a8b15b23

Observation 48eb96e2-9bbc-4668-9c72-6313023d7d9b · outbound

This paper cites Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations.

Security Concerns for Large Language Models: A Survey Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.421477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.421477Z digest=sha256:fd3b7094b3f88c67f092de0433876301566a9ea088ae96252b3e0d1589c8a9d6

Observation 95ad58b2-1d5a-4c5a-8193-bf587a9eb541 · outbound

This paper cites Here Comes The AI Worm: Unleashing Zero-click Worms that Target GenAI-Powered Applications.

Security Concerns for Large Language Models: A Survey Here Comes The AI Worm: Unleashing Zero-click Worms that Target GenAI-Powered Applications

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.426864Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.426864Z digest=sha256:38293659c76a2e0433dc9b9ad9d5e38248ed1f571aadc498887afe748f082e8b

Observation 50b95a10-6167-4fa7-89c3-058e2b64e073 · outbound

This paper cites Formally Specifying the High-Level Behavior of LLM-Based Agents.

Security Concerns for Large Language Models: A Survey Formally Specifying the High-Level Behavior of LLM-Based Agents

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.757335Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.431586Z digest=sha256:a6f86312e40426cbbaa4141d99cecd15279607fdf9adcf4c0c603db920bcecc1

Observation 1762adc4-8824-456b-b369-5d8da4c9c261 · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:08.854007Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.436483Z digest=sha256:86e41f91dbadaef3798b740ba3caef89d83150b79a0ab206d133f7eff3c2faa7

Observation 7e49c603-d220-482d-b4be-a746810aba26 · outbound

This paper cites Security and privacy chal- lengesoflargelanguagemodels:Asurvey.

Security Concerns for Large Language Models: A Survey Security and privacy chal- lengesoflargelanguagemodels:Asurvey

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:08.696535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.445557Z digest=sha256:cfa6f4a5264d78a2b6d79c2620b9e45ea2b2d74ca430d64a594b11c245017b6b

Observation 4b6a04d7-0ff7-43f8-9b06-3d0a76b46036 · outbound

This paper cites Emerging Security Challenges of Large Language Models.

Security Concerns for Large Language Models: A Survey Emerging Security Challenges of Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.449834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.449834Z digest=sha256:238f1f30b64e7d117cfdc56db6b8ec77ea341fd1c162da9e2d2d056d9502ad6a

Observation 1a31531c-5d8d-4bc5-8768-c8c5491ee37c · outbound

This paper cites The Philosopher's Stone: Trojaning Plugins of Large Language Models.

Security Concerns for Large Language Models: A Survey The Philosopher's Stone: Trojaning Plugins of Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.455337Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.455337Z digest=sha256:c716077d4caf3dde5ab495e28f97e0d0b941787899b2db22b415bcd699903437

Observation bb2fdb16-1cda-447a-87f1-5527d52d15b9 · outbound

This paper cites StruPhantom: Evolutionary Injection Attacks on Black-Box Tabular Agents Powered by Large Language Models.

Security Concerns for Large Language Models: A Survey StruPhantom: Evolutionary Injection Attacks on Black-Box Tabular Agents Powered by Large Language Models

Reference 19

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.677664Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.459930Z digest=sha256:a4eb506a317c5b5301cb2f5e6a4a498970543908aeecd1006d505d884fc38063

Observation d82fce64-904b-421d-9092-11a1acc7c9e9 · outbound

This paper cites Adversarial Tokenization.

Security Concerns for Large Language Models: A Survey Adversarial Tokenization

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.464470Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.464470Z digest=sha256:3aac71f0c4bd183efff0640eb13239adc5590128c44a124a785787c2c98fc508

Observation 20143416-9609-4ad7-9888-37115c98b2cd · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:08.528535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.469121Z digest=sha256:12a63cb35126eca102c7882ea6e3b4c5297bad846fdb31a92220091e8e99948f

Observation 428190b1-bbfa-4d5d-bc45-1d9bbdbd8c59 · outbound

This paper cites Deliberative Alignment: Reasoning Enables Safer Language Models.

Security Concerns for Large Language Models: A Survey Deliberative Alignment: Reasoning Enables Safer Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.474448Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.474448Z digest=sha256:c6df28589b308810009dd25a4a734079ffe95043df52932937fbc856a4d1e44a

Observation 62e05885-63d8-47b6-b4a4-1f4c924b55e6 · outbound

This paper cites System prompt poisoning: Persistent attacks on large language models beyond user injection.

Security Concerns for Large Language Models: A Survey System prompt poisoning: Persistent attacks on large language models beyond user injection

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.480328Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.480328Z digest=sha256:e181841fcf0fa6f92572e51fad3e8373dd414f627629c17c2593e93f901b3cbb

Observation c592c1ef-f1f2-4a3f-a571-497ca4cfcd5f · outbound

This paper cites Red-Teaming LLM Multi-Agent Systems via Communication Attacks.

Security Concerns for Large Language Models: A Survey Red-Teaming LLM Multi-Agent Systems via Communication Attacks

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.485673Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.485673Z digest=sha256:c8f455cd7185a8af47657e470dd5bc9be8d79b34118f44ce3f9815e13337add7

Observation 8f70f9be-cdb5-4ff8-8fe7-82d885618a5c · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:08.359894Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.490803Z digest=sha256:8cd21516871b7f66cfc13677a04d949f4ccb260d747a23729c1c84a481b3e371

Observation 5d5d53c0-54d1-46bf-a773-794ecbf44098 · outbound

This paper cites Pleak: Promptleakingattacksagainstlargelanguagemodelapplications,in: Proceedings of the 2024 on ACM SIGSAC Conference on Computer and Communications Security, pp.

Security Concerns for Large Language Models: A Survey Pleak: Promptleakingattacksagainstlargelanguagemodelapplications,in: Proceedings of the 2024 on ACM SIGSAC Conference on Computer and Communications Security, pp

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:08.140247Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.501273Z digest=sha256:0c85d7044e5731bfa96f4bb7eac592d622577e70638356e014f3f6eb38ee3be3

Observation c19edb68-7eff-4127-a61e-c8bac5e6f212 · outbound

This paper cites Poisongpt:Howwehidalobotomized llmonhuggingfacetospreadfakenews.

Security Concerns for Large Language Models: A Survey Poisongpt:Howwehidalobotomized llmonhuggingfacetospreadfakenews

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.995449Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.505534Z digest=sha256:44c9ed4f55f286b7fea4c9061fbc40b2c611341721488232f42207f903f95528

Observation a94f58ae-8610-4a7f-b05b-0dd5f644d0a1 · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

Security Concerns for Large Language Models: A Survey Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.510563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.510563Z digest=sha256:23c3a6d0941b080254e49beb6c7973f26a91831e66e6dedcc5aa5c2d8a5ce408

Observation 98d8d85c-1ef6-47f4-a1d3-809687dc6d90 · outbound

This paper cites Llmsecurity101:Defendingagainstprompthacks.

Security Concerns for Large Language Models: A Survey Llmsecurity101:Defendingagainstprompthacks

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.795090Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.516147Z digest=sha256:20b3295f6f9bfff78d3791116139dff51f9f71506062eecd79e54dcfaead21ad

Observation f1994eb4-52c4-481a-beca-94f65dd64760 · outbound

This paper cites Baseline Defenses for Adversarial Attacks Against Aligned Language Models.

Security Concerns for Large Language Models: A Survey Baseline Defenses for Adversarial Attacks Against Aligned Language Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.520629Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.520629Z digest=sha256:738bc8f5b5a80e37f1516766501824193affba1c43d725f2a1067cf0cba52a37

Observation 8f5ae23f-3b17-494b-8494-438332375b7b · outbound

This paper cites A watermark for large language models, in: International Conference on Machine Learning, PMLR.

Security Concerns for Large Language Models: A Survey A watermark for large language models, in: International Conference on Machine Learning, PMLR

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.598434Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.526345Z digest=sha256:172128a4c186efcf10506b44e328a5a7f853e9628d59fe46a86bcf876ce8bf64

Observation 30fba0b6-0662-48c2-9a97-08c7f135c1c9 · outbound

This paper cites Fun-tuning: Characterizing the Vulnerability of Proprietary LLMs to Optimization-based Prompt Injection Attacks via the Fine-Tuning Interface.

Security Concerns for Large Language Models: A Survey Fun-tuning: Characterizing the Vulnerability of Proprietary LLMs to Optimization-based Prompt Injection Attacks via the Fine-Tuning Interface

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.532090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.532090Z digest=sha256:53a3816a19f579a308250fc843fc64d53283b9ad2a6303f7f11daab90a61671a

Observation d70dfd76-74a7-481c-9dd7-3d4d073c52c1 · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:07.356304Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.536591Z digest=sha256:f76dd0cebcbd3bd843f93c53c63beb6c7ba37105185a6fe1316d997f016eb234

Observation 1c6d1c47-9a87-431d-b297-a701ad27e765 · outbound

This paper cites Prefill-level Jailbreak: A Black-Box Risk Analysis of Large Language Models.

Security Concerns for Large Language Models: A Survey Prefill-level Jailbreak: A Black-Box Risk Analysis of Large Language Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.546803Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.546803Z digest=sha256:38c9b395c4a31ebed21795faf243ed2d9ddd1f70aacbccc404b9a796a97b12c2

Observation 72ec2fdd-26f8-470c-944b-1b448705f2fb · outbound

This paper cites Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models.

Security Concerns for Large Language Models: A Survey Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.201977Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.551855Z digest=sha256:e84dccb3668fd58acda69388325005cd7b7b526073405d6f7b694fe699c62f63

Observation 8abbee08-07ad-450d-a4eb-89465f60a515 · outbound

This paper cites Measuring Faithfulness in Chain-of-Thought Reasoning.

Security Concerns for Large Language Models: A Survey Measuring Faithfulness in Chain-of-Thought Reasoning

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.541783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.541783Z digest=sha256:0ce7cdfa296548cddb8be59f7605f87795a5bdd19228243994def851892af6c4

Observation 663ca6f8-5b6e-4dd9-92f1-0f8e03ee9663 · outbound

This paper cites Autohijacker: Automatic indirect prompt injection against black-box llm agents, in: Submitted to ICLR 2025.https://openreview.net/forum?id=11629.

Security Concerns for Large Language Models: A Survey Autohijacker: Automatic indirect prompt injection against black-box llm agents, in: Submitted to ICLR 2025.https://openreview.net/forum?id=11629

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.805257Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.561299Z digest=sha256:9ed8feb3b45aa26207a36770d3301b5fa0a0928ce29b981e9fd91049c5fa41cb

Observation 2224e001-e7fb-46b9-9f51-819fc26db4d9 · outbound

This paper cites FlipAttack: Jailbreak LLMs via Flipping.

Security Concerns for Large Language Models: A Survey FlipAttack: Jailbreak LLMs via Flipping

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.566012Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.566012Z digest=sha256:5a545a5b986ce8bceab33fe74a248deebee8ab1347ae0af6e80da1f9ad5158d2

Observation 804323e0-a0cf-48dc-8476-d5e75e7d5b45 · outbound

This paper cites Nature Machine Intelligence , 1–14.

Security Concerns for Large Language Models: A Survey Nature Machine Intelligence , 1–14

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.009172Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.556830Z digest=sha256:a8bca1c9d5509c8e1b1f190fb604f23e3885c6bc3eaac8efcceea1281cfaac2f

Observation 61c3d0a4-f14d-4110-a060-48a4c97eaa41 · outbound

This paper cites Agentic misalign- ment: How llms could be an insider threat.

Security Concerns for Large Language Models: A Survey Agentic misalign- ment: How llms could be an insider threat

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.363703Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.576065Z digest=sha256:9f9abbfc5515ea9b680e2a38d20d07bf8350726f91224532d6bb5f90e460889d

Observation e8d594a7-3a99-4da9-bf24-488c8974f8f0 · outbound

This paper cites Tree of attacks: Jailbreaking black- box llms automatically.

Security Concerns for Large Language Models: A Survey Tree of attacks: Jailbreaking black- box llms automatically

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.153119Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.581387Z digest=sha256:d90c021bd8583fafe2d2bc5f0f4f84820ce916383e1c4cec94ae54e437501785

Observation 594998f1-24d2-4b97-9986-48c367269cce · outbound

This paper cites Formalizing and benchmarking prompt injection attacks and defenses, in: 33rd USENIX Security Symposium (USENIX Security 24), pp.

Security Concerns for Large Language Models: A Survey Formalizing and benchmarking prompt injection attacks and defenses, in: 33rd USENIX Security Symposium (USENIX Security 24), pp

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.572898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.570611Z digest=sha256:4ea0835ffc72ebd17dba61b3b7bfa6f8d6a0b6bd256fb6c24b6c7a429a02c732

Observation 76516eb3-79fb-4df2-8745-0a325c84f7ea · outbound

This paper cites Fully autonomous ai agents should not be developed.

Security Concerns for Large Language Models: A Survey Fully autonomous ai agents should not be developed

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.591089Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.591089Z digest=sha256:f4fdd33c218caa616d0500fcade2b0d6e42e0e1b7add65bcc655999406cd6379

Observation 944c7bf4-9622-499a-8461-ec9b37e178a4 · outbound

This paper cites AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents.

Security Concerns for Large Language Models: A Survey AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.596762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.596762Z digest=sha256:95b33deff980fedc14e5bcd583ca9797873b8d37096d6001cebc05666e29c45f

Observation af322d9b-6b9f-42ed-b73c-75edf804a0ce · outbound

This paper cites Frontier Models are Capable of In-context Scheming.

Security Concerns for Large Language Models: A Survey Frontier Models are Capable of In-context Scheming

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.586403Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.586403Z digest=sha256:0cb8a2970cda0f7ecaa2acf2e68a0ef66dad790f11c3ce4311bf4d8af8368b3d

Observation f40d4b36-c785-4193-8798-510bb0213b15 · outbound

This paper cites Eliciting and Analyzing Emergent Misalignment in State-of-the-Art Large Language Models.

Security Concerns for Large Language Models: A Survey Eliciting and Analyzing Emergent Misalignment in State-of-the-Art Large Language Models

Reference 46

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.311908Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.607771Z digest=sha256:67e30ef4842777e78335a97549c3d815f866d1bd650151662a7e23d75fe2b773

Observation c6fa50bd-3b22-4322-b72c-ce82f7a1333f · outbound

This paper cites Neural Exec: Learning (and Learning from) Execution Triggers for Prompt Injection Attacks.

Security Concerns for Large Language Models: A Survey Neural Exec: Learning (and Learning from) Execution Triggers for Prompt Injection Attacks

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.612380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.612380Z digest=sha256:31fc1c2d82056c9657dfd3fe4021fc1c5d0fc3127f5a3aaaa5ac3d331a4774b2

Observation 77b8372a-7ad2-4b67-8a78-a7e57022c71f · outbound

This paper cites GPT-4 Technical Report.

Security Concerns for Large Language Models: A Survey GPT-4 Technical Report

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.602300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.602300Z digest=sha256:9715f2e292f5e9ca51b01a7fd9b6b445b9488f5a7a5f5e2ef6f4a290fdad3b47

Observation ce91f6c3-7ae0-4a5f-a822-9edf9615ec9e · outbound

This paper cites Hijacking Large Language Models via Adversarial In-Context Learning.

Security Concerns for Large Language Models: A Survey Hijacking Large Language Models via Adversarial In-Context Learning

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.621418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.621418Z digest=sha256:f02ba1ff5a5e245fe2a49e914621c3386fe66b7e9597e819d895f935bd328606

Observation 26580501-d266-4a08-9291-d8ff75199f53 · outbound

This paper cites From chatbotstophishbots?:Phishingscamgenerationincommerciallarge languagemodels,in:2024IEEESymposiumonSecurityandPrivacy (SP), IEEE.

Security Concerns for Large Language Models: A Survey From chatbotstophishbots?:Phishingscamgenerationincommerciallarge languagemodels,in:2024IEEESymposiumonSecurityandPrivacy (SP), IEEE

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.004447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.626005Z digest=sha256:6681f3a506c3fc80ca9832a702fce6f4affa791cb28c4803c3494a66932fd070

Observation a12f2e67-d3ee-4924-85bc-4a8b38807754 · outbound

This paper cites Ignore Previous Prompt: Attack Techniques For Language Models.

Security Concerns for Large Language Models: A Survey Ignore Previous Prompt: Attack Techniques For Language Models

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.616788Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.616788Z digest=sha256:2f8fe5ceff2688b33c81ae292ddf2547c848c7e81ecd9054cba15bfe984c8d47

Observation 24375860-c72e-4ad5-b9c4-f90a96155f81 · outbound

This paper cites BadGPT: Exploring Security Vulnerabilities of ChatGPT via Backdoor Attacks to InstructGPT.

Security Concerns for Large Language Models: A Survey BadGPT: Exploring Security Vulnerabilities of ChatGPT via Backdoor Attacks to InstructGPT

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.635415Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.635415Z digest=sha256:e65e11c627e11e2e7deb0091e8e74414638328487e1d2112a799a1d644f25091

Observation 12b4b3aa-060e-4106-80c0-cf97e3f9d79d · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 53

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.920423Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.640227Z digest=sha256:64046b450a7fc9a6537e3f91a2d6628cbadb1e3a67cc9c7e0cde599ffc6e8df0

Observation 3a5fd50e-8463-4378-b555-0104ecddeb33 · outbound

This paper cites Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks.

Security Concerns for Large Language Models: A Survey Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.630698Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.630698Z digest=sha256:de69a89f3ad89dd2a6b5581df5b887fda526e7ba8e180ca22efdc2ec894ad476

Observation cda06f9a-a7ab-4138-8483-610e2173d028 · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

Security Concerns for Large Language Models: A Survey Gemini: A Family of Highly Capable Multimodal Models

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.655102Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.655102Z digest=sha256:c1c8c6280af7ea0d617cefa05d62770daa7604e8baaf64dc3d6f15be8b110dd7

Observation 345b4c22-c783-4260-9166-3d5cb358380e · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

Security Concerns for Large Language Models: A Survey Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.659641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.659641Z digest=sha256:8596df4a228abbae1915c136c789e79614ec87c69f876f63474d3b7a88a2ac6f

Observation 3fff1a74-7046-469b-a5d8-c0b24f7ea928 · outbound

This paper cites AdvancesinNeural Information Processing Systems 36, 61836–61856.

Security Concerns for Large Language Models: A Survey AdvancesinNeural Information Processing Systems 36, 61836–61856

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.817837Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.645571Z digest=sha256:1862eedbed7e65e6dd1d49af11feb8ffede8146560e21ba370a28127f58f8801

Observation 2440f6fb-d53c-47cf-a777-1a03490ad880 · outbound

This paper cites Wormgpt and fraudgpt – the rise of malicious llms.

Security Concerns for Large Language Models: A Survey Wormgpt and fraudgpt – the rise of malicious llms

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.699816Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.650551Z digest=sha256:2b7277012d22436ee307b31ac6b6caa2f361455729f0dd22d5bdd0cbb5b65b68

Observation a4ee6f0e-964d-4f5d-8547-a982f9c59d9a · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 59

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.453509Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.673431Z digest=sha256:991e97c55c0055940725bc7ba9376f9b144ae41cebfd95166fde665cf08881b0

Observation c3c72e84-9a5e-479f-9a66-84669cef5015 · outbound

This paper cites Poisoning Language Models During Instruction Tuning.

Security Concerns for Large Language Models: A Survey Poisoning Language Models During Instruction Tuning

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.683845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.683845Z digest=sha256:bba2e8847d9de0e65b2b874987064f46fda89155b2d6b46baa6b8cb110f7b292

Observation bc0ea891-fa4a-49c0-a147-d83ddf0fe92d · outbound

This paper cites DAN is my new friend.https://old.reddit.c om/r/ChatGPT/comments/zlcyr9/dan_is_my_new_friend/.

Security Concerns for Large Language Models: A Survey DAN is my new friend.https://old.reddit.c om/r/ChatGPT/comments/zlcyr9/dan_is_my_new_friend/

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.592228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.664204Z digest=sha256:b5451618ad76be542995142e5284a7495d0dd9ecc039e6c73d835cc92daef72a

Observation f43a025c-03cf-44e5-83f9-236dd5fbf0aa · outbound

This paper cites Universal adversarial triggers for attacking and analyzing nlp, in: EMNLP.

Security Concerns for Large Language Models: A Survey Universal adversarial triggers for attacking and analyzing nlp, in: EMNLP

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.502228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.668643Z digest=sha256:3dd74597b5464303f198d73cac645735fb8c7e55d130e5559510c9bc9ce50b12

Observation dc1e993c-71e8-4590-b811-d4843a5ebd9d · outbound

This paper cites When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models.

Security Concerns for Large Language Models: A Survey When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.699530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.699530Z digest=sha256:1f5dab60e3307810db982923e51d9f26374af1024f329dc91ea3a14e954867ef

Observation 7c7786f9-4dbd-4f3b-aa2b-3d99c574d136 · outbound

This paper cites The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions.

Security Concerns for Large Language Models: A Survey The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.678249Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.678249Z digest=sha256:de3817c5873f2ffc9ef36e402f1aaa55707e1a098005b626d4e96bbf8ca9283d

Observation 68defda7-725f-4125-a8fd-b54e3b8798ad · outbound

This paper cites Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems 36, 80079–80110.

Security Concerns for Large Language Models: A Survey Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems 36, 80079–80110

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.439142Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.710344Z digest=sha256:74aadfb8a5501911517407b5f89fb6b52f374102ce1adbf455ff13d71b12dad4

Observation 63ce99cb-7ea7-45b3-b288-d427f9a6e538 · outbound

This paper cites AgentSpec: Customizable Runtime Enforcement for Safe and Reliable LLM Agents.

Security Concerns for Large Language Models: A Survey AgentSpec: Customizable Runtime Enforcement for Safe and Reliable LLM Agents

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.688700Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.688700Z digest=sha256:d43b3fe12fc349f47793d2354021990fc4ae39258c1b4c3b1945075ec5dae182

Observation 15125eaa-6240-4c15-bf31-a7767070f8d6 · outbound

This paper cites Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment.

Security Concerns for Large Language Models: A Survey Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.694102Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.694102Z digest=sha256:9fb57242a98dd06454b6360f62139a79b67f914e37d7c9f336e4fe3af701c568

Observation 3d99dff0-7482-4de9-a3f6-cb55c68aaff5 · outbound

This paper cites Nuclear Deployed: Analyzing Catastrophic Risks in Decision-making of Autonomous LLM Agents.

Security Concerns for Large Language Models: A Survey Nuclear Deployed: Analyzing Catastrophic Risks in Decision-making of Autonomous LLM Agents

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.725980Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.725980Z digest=sha256:249eb5f74e2ae0ec38ee7aa36d13f4d2bf58daa75dc52fae5a3141b53d354d61

Observation 3d4cf9b3-0620-496e-ac16-24d848e360e7 · outbound

This paper cites Persona features control emergent misalignment, 2025.

Security Concerns for Large Language Models: A Survey Persona features control emergent misalignment, 2025

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.705501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.705501Z digest=sha256:2249d45d37b839dc6c6ddb82a354c50ff665573954155f4458379f76f48b9e14

Observation 9b8871b8-d32b-4189-af08-9dbd0804a0c4 · outbound

This paper cites Asurvey on large language model (llm) security and privacy: The good, the bad, and the ugly.

Security Concerns for Large Language Models: A Survey Asurvey on large language model (llm) security and privacy: The good, the bad, and the ugly

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.361858Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.736286Z digest=sha256:dc8fb2bba3f3d17c3dc6dd2292617167e2dafaef9be3f95bd27233dfe3d11d0b

Observation 64e5fd1a-3be0-4c55-99b3-8395982cc5e0 · outbound

This paper cites RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent.

Security Concerns for Large Language Models: A Survey RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.715584Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.715584Z digest=sha256:1e8dfcd63b671d93f5de4252ccd3ef8c7e51ad92dd1585747cc6d836d58e395e

Observation 702d2ad4-02d6-4f69-82be-ff06d645237e · outbound

This paper cites Rejection Improves Reliability: Training LLMs to Refuse Unknown Questions Using RL from Knowledge Feedback.

Security Concerns for Large Language Models: A Survey Rejection Improves Reliability: Training LLMs to Refuse Unknown Questions Using RL from Knowledge Feedback

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.720278Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.720278Z digest=sha256:25f5114f8d1d2407336aad8d583937360eaab6cfb066a251bd57c4795c853888

Observation c1a8b09f-38b2-4f95-b3b9-29b4a8fdcfa5 · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 73

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.197213Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.750500Z digest=sha256:083d479c819c1fe4330181797fd90ebe476922e65afb73485885991f944af521

Observation 8b9d043f-428c-4a8d-adb8-edbe1f111dcf · outbound

This paper cites Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection.

Security Concerns for Large Language Models: A Survey Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.730949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.730949Z digest=sha256:2b71384d4c49016128c6bca5acbadfd927aee81a155c5a9120cf95f88cb5ef7d

Observation 9a515249-b67b-43be-8da3-9b87c3a00f40 · outbound

This paper cites AutoRedTeamer: Autonomous Red Teaming with Lifelong Attack Integration.

Security Concerns for Large Language Models: A Survey AutoRedTeamer: Autonomous Red Teaming with Lifelong Attack Integration

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.764785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.764785Z digest=sha256:3bf142ec3a5295ebf034fa5825802ed321c01738de8d914297c9057a94955e11

Observation bb96e0a4-8b38-43f2-ace2-cc8a809bae58 · outbound

This paper cites LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models.

Security Concerns for Large Language Models: A Survey LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.740914Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.740914Z digest=sha256:1e6a66503958043aca735e4b462f698af4002a33b8b03d2b73664a57dd7e4851

Observation 2499618d-1ed2-418d-b7ba-c5cbdc64ff78 · outbound

This paper cites A Closer Look at Machine Unlearning for Large Language Models.

Security Concerns for Large Language Models: A Survey A Closer Look at Machine Unlearning for Large Language Models

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.745848Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.745848Z digest=sha256:b7e880972f08b1d063189a991e641b3b9205e5a82615d2a598be8fc7473008f3

Observation 57120ddb-8970-4d96-b258-a53bc8fb3204 · outbound

This paper cites Evaluation of LLM Vulnerabilities to Being Misused for Personalized Disinformation Generation.

Security Concerns for Large Language Models: A Survey Evaluation of LLM Vulnerabilities to Being Misused for Personalized Disinformation Generation

Reference 78

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:03.825519Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.780401Z digest=sha256:073db287c90d1c3fe97240bfe44a15c554a0c383313e8f2b84468f777b9e64f2

Observation 82d11667-9a15-4cae-a3fd-e0a0b67e667d · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 79

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.063421Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-08-07T14:27:03.754737Z digest=sha256:5908fa916916d03f2e2d300dde1dfb83ca896518b016221945e053264fccd798

Observation eb482b29-547d-4846-bd6b-42e9cf4b000f · outbound

This paper cites Weak-to-Strong Jailbreaking on Large Language Models.

Security Concerns for Large Language Models: A Survey Weak-to-Strong Jailbreaking on Large Language Models

Reference 80

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.759736Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.759736Z digest=sha256:f584274a60cc623162b4f3679c3205016f1bca1e9ad21aa16daa9851c31c7ce6

Observation ab4d47a7-5cae-41a2-9f9f-014b5ea4b4b0 · outbound

This paper cites Ad- vprefix: An objective for nuanced llm jailbreaks.

Security Concerns for Large Language Models: A Survey Ad- vprefix: An objective for nuanced llm jailbreaks

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.770830Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.770830Z digest=sha256:fde373a1832075a9f66d0d9eb18189d9616f78081161cc069ed1ede6cdbe58a2

Observation 6956a007-7c79-41f6-9f67-bbae36cce66c · outbound

This paper cites Universal and Transferable Adversarial Attacks on Aligned Language Models.

Security Concerns for Large Language Models: A Survey Universal and Transferable Adversarial Attacks on Aligned Language Models

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.775471Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.775471Z digest=sha256:e6d57197e28ea5cd2d5ce00ecf4831460db871ce270290a7388f37f3268c1794

Observation 099fde57-8128-44e5-a0b5-d7ee8ff11def · outbound

This paper cites Safe RLHF: Safe Reinforcement Learning from Human Feedback.

Security Concerns for Large Language Models: A Survey Safe RLHF: Safe Reinforcement Learning from Human Feedback

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.440620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.440620Z digest=sha256:97d38ebd237c5ed6717c44d23bad276da49180807ed54551ff9e11c93445e017

Observation f03154d5-a4b3-4d51-a0de-e83b582db2b2 · outbound

This paper cites Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training.

Security Concerns for Large Language Models: A Survey Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.495748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.495748Z digest=sha256:67b7997dd91a082d8f6ae50f19015eaab154ed241348a6fe4bbfe779624b063b

Pith citing papers

Observation 2ee4e6f2-7cd7-497b-b623-98bf6ffa8b58 · inbound

Bridging AI and Software Security: A Comparative Vulnerability Assessment of LLM Agent Deployment Paradigms cites this paper.

Bridging AI and Software Security: A Comparative Vulnerability Assessment of LLM Agent Deployment Paradigms Security Concerns for Large Language Models: A Survey

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T19:12:22.885999Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:12:22.885999Z digest=sha256:612c52b9c2e1e69d13387d419c18863ee1f637c32b64ea915e081c373ca6d264

Observation b093e5c6-e241-448f-98f4-13db15d84283 · inbound

LLM Harms: A Taxonomy and Discussion cites this paper.

LLM Harms: A Taxonomy and Discussion Security Concerns for Large Language Models: A Survey

Reference 130

Resolution
verified exact
arxiv_id, observed 2026-05-17T00:31:24.541239Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-05-17T00:29:07.951709Z digest=sha256:6fb72e671ca57cdd1825839ee1b5cf3c5f15044b36805c5e7518059baba15313

Observation a210001a-a16e-4ba2-9984-e67cd692f373 · inbound

LLM Harms: A Taxonomy and Discussion cites this paper.

LLM Harms: A Taxonomy and Discussion Security Concerns for Large Language Models: A Survey

Reference 130

Resolution
unresolved
no resolver link, observed 2026-08-03T18:19:22.067036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T18:19:22.067036Z digest=sha256:0ef3aa928dcd9e4bc7a4ba364c80a4187506717147e891cd03bc96b30df71d32

Observation 7698991f-040b-4cc0-affd-9512d14552e9 · inbound

Zero-Shot Embedding Drift Detection: A Lightweight Defense Against Prompt Injections in LLMs cites this paper.

Zero-Shot Embedding Drift Detection: A Lightweight Defense Against Prompt Injections in LLMs Security Concerns for Large Language Models: A Survey

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-03T09:53:25.123806Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T09:53:25.123806Z digest=sha256:22f6a638084f74fc9ea6e5b333caaaed7a22cf731f24de23ad55600a518bad7b

Observation 89b8a45c-01e6-42eb-8b6f-309f69ae204e · inbound

Gecko: A Simulation Environment with Stateful Feedback for Refining Agent Tool Calls cites this paper.

Gecko: A Simulation Environment with Stateful Feedback for Refining Agent Tool Calls Security Concerns for Large Language Models: A Survey

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T21:46:33.293428Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T21:46:33.293428Z digest=sha256:aad7e2fd5d1627128d5fc3a27080a9d72052afa60db4c82056e62fcf20573825

Observation a4ecefb4-f0f3-44a9-a41d-79f573a1a009 · inbound

LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models cites this paper.

LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models Security Concerns for Large Language Models: A Survey

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-10T09:38:43.149038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-05-10T05:11:01.039309Z digest=sha256:c1b36fb2b5acd36294a0c6457a76d240e25dabd71fefc4b2db451c6d37537f68

Observation f11db4e2-a816-4d47-aad9-ec665cf4ea53 · inbound

Adversarial Prompting Framework for AI Safety Assessment cites this paper.

Adversarial Prompting Framework for AI Safety Assessment Security Concerns for Large Language Models: A Survey

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T05:10:09.315243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:10:09.315243Z digest=sha256:1e45b127d10fb365702f21896d423f5c5366536406d951c088d9fc162de4d857