Pith. sign in

Paper Citation Record · LEDGER

Security Concerns for Large Language Models: A Survey

As of 13 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 7 inbound Pith citation observations for arXiv:2505.18889.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.18889 v5

Coverage vector

measured 84 of 84 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:27:03.780401Z

measured 91 of 91 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-13T06:32:02.005865+00:00

measured 7 of 7 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T19:12:22.885999Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-17T00:31:24.539214Z

Reference resolution

84 of 84 outbound references displayed

  • verified exact5
  • verified fuzzy18
  • unresolved61
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 1b66ac07-a466-4c8b-9424-707bdcc9a53e · outbound

This paper cites Concrete Problems in AI Safety.

Security Concerns for Large Language Models: A Survey Concrete Problems in AI Safety

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.364590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.364590Z digest=sha256:bfbd8d79bc9082a1f596a784a5f530f43532614ec865fc3ce4f4d115faeed0c9

Observation 40fc1189-3a08-465a-b301-751bdf4b694b · outbound

This paper cites System Card: Claude Opus 4 & Claude Sonnet 4.

Security Concerns for Large Language Models: A Survey System Card: Claude Opus 4 & Claude Sonnet 4

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.370897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.370897Z digest=sha256:280dc549caadc09c8c89809f2e1f6c45adf149b822a95b2bb104eb27675bbb33

Observation a406cd1d-1821-4e37-b4ca-a6701e8d1913 · outbound

This paper cites Theclaude3modelfamily:Opus,sonnet,haiku.

Security Concerns for Large Language Models: A Survey Theclaude3modelfamily:Opus,sonnet,haiku

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.376217Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.376217Z digest=sha256:51d6b4d29f99a2f680892630729d32045a0c4ebe0de691448b534ca447a10d23

Observation 317e49e5-374c-40d5-8786-b7729eb72d50 · outbound

This paper cites Embedding-based classifiers can detect prompt injection attacks.

Security Concerns for Large Language Models: A Survey Embedding-based classifiers can detect prompt injection attacks

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.381548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.381548Z digest=sha256:97c1baad31c598385f51f6ffde9cc2b6e7161aec57c13e8ccc366865f33a35fa

Observation 97ce77fa-9edb-42ac-a154-3bd1a17c4167 · outbound

This paper cites Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation.

Security Concerns for Large Language Models: A Survey Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.386052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.386052Z digest=sha256:cbd4a97d0a798bd8b0e5debf9126c771f00dd7950cb6bf488f825f5c474f58f4

Observation 466f5ac9-9c5a-48fe-80b1-f32da3f1006f · outbound

This paper cites Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models.

Security Concerns for Large Language Models: A Survey Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.390674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.390674Z digest=sha256:075dc53acae84635ecefccada4933961827478d21b7337cf0079031c36154764

Observation 08abe4a7-9e46-4070-a905-96ca93301b08 · outbound

This paper cites LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds.

Security Concerns for Large Language Models: A Survey LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.889778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.396465Z digest=sha256:c8c480c5d7c9fb15f2c0ffd28aa69f75645bb3306a9ac694e796fdf28bb80e76

Observation 554e00f1-c718-43d1-882c-12be9106f299 · outbound

This paper cites Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?.

Security Concerns for Large Language Models: A Survey Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.401477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.401477Z digest=sha256:fc35cd33fa35ee8ccf3514ccdfee0febf2cba0be20443df953c475601fd6938f

Observation cf7d8278-25e5-430d-8210-761a9ce1c0b0 · outbound

This paper cites Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment.

Security Concerns for Large Language Models: A Survey Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.407254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.407254Z digest=sha256:308d6e7e668c9a6958859dd85ee40965bc26cc027b68c2a1b8e99e9c61ecf8ed

Observation 3852f90b-0c1a-4b47-bc46-85e3acf1666e · outbound

This paper cites Language models are few-shot learners.

Security Concerns for Large Language Models: A Survey Language models are few-shot learners

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.412812Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.412812Z digest=sha256:d10c4e159f738d76360ddcf0ee1dc68b52ebee896513528b5ca738a2038cec87

Observation 99ec921e-878c-44c2-9900-bfff5d05ad88 · outbound

This paper cites Jailbreaking Black Box Large Language Models in Twenty Queries.

Security Concerns for Large Language Models: A Survey Jailbreaking Black Box Large Language Models in Twenty Queries

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.417247Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.417247Z digest=sha256:e53243a1552cee678918547e3e30fa9f121ec2e9ae4e323cd48eeb01d1fb0b58

Observation 48eb96e2-9bbc-4668-9c72-6313023d7d9b · outbound

This paper cites Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations.

Security Concerns for Large Language Models: A Survey Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.421477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.421477Z digest=sha256:ab59582be4469a3f63ad08c7bc3b9e644698839614281e70dd71ea4fb3520bac

Observation 95ad58b2-1d5a-4c5a-8193-bf587a9eb541 · outbound

This paper cites Here Comes The AI Worm: Unleashing Zero-click Worms that Target GenAI-Powered Applications.

Security Concerns for Large Language Models: A Survey Here Comes The AI Worm: Unleashing Zero-click Worms that Target GenAI-Powered Applications

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.426864Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.426864Z digest=sha256:b60e89ad329c7b6107dba66fcbd6b4bb778b633b5a7092885c9c5caf45d43dca

Observation 50b95a10-6167-4fa7-89c3-058e2b64e073 · outbound

This paper cites Formally Specifying the High-Level Behavior of LLM-Based Agents.

Security Concerns for Large Language Models: A Survey Formally Specifying the High-Level Behavior of LLM-Based Agents

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.757335Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.431586Z digest=sha256:4439aeb001581e7d195d77513e21c4a5eb48f53d4ca89e71683bb4011766a0c7

Observation 1762adc4-8824-456b-b369-5d8da4c9c261 · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:08.854007Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.436483Z digest=sha256:e7049b2ea6bd266851e8cf1b8f374086a28e0c0c70b5a170359a9ddaa6421287

Observation 7e49c603-d220-482d-b4be-a746810aba26 · outbound

This paper cites Security and privacy chal- lengesoflargelanguagemodels:Asurvey.

Security Concerns for Large Language Models: A Survey Security and privacy chal- lengesoflargelanguagemodels:Asurvey

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:08.696535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.445557Z digest=sha256:fd7ad63f877bff9c23d2e6fe616d7819f540fbe6b0065b652639add60d5baff8

Observation 4b6a04d7-0ff7-43f8-9b06-3d0a76b46036 · outbound

This paper cites Emerging Security Challenges of Large Language Models.

Security Concerns for Large Language Models: A Survey Emerging Security Challenges of Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.449834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.449834Z digest=sha256:5c21d3a1b8cf84c396043651a581d6b76aaf1d2f67580a4cc4792fd96f3791da

Observation 1a31531c-5d8d-4bc5-8768-c8c5491ee37c · outbound

This paper cites The Philosopher's Stone: Trojaning Plugins of Large Language Models.

Security Concerns for Large Language Models: A Survey The Philosopher's Stone: Trojaning Plugins of Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.455337Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.455337Z digest=sha256:9bdffab604ba9af46574b667a62087dc9b0d4c58dee61141bf14fb5fb1bd70c2

Observation bb2fdb16-1cda-447a-87f1-5527d52d15b9 · outbound

This paper cites StruPhantom: Evolutionary Injection Attacks on Black-Box Tabular Agents Powered by Large Language Models.

Security Concerns for Large Language Models: A Survey StruPhantom: Evolutionary Injection Attacks on Black-Box Tabular Agents Powered by Large Language Models

Reference 19

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.677664Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.459930Z digest=sha256:d4c07d899079ca87aab0f54df4af78f02897c51a133126661cd5b00d51b0ac97

Observation d82fce64-904b-421d-9092-11a1acc7c9e9 · outbound

This paper cites Adversarial Tokenization.

Security Concerns for Large Language Models: A Survey Adversarial Tokenization

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.464470Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.464470Z digest=sha256:cc9aee22707cd56eb07a5de33eef626646b1b311f0c3f2dcfe3ea232b751a579

Observation 20143416-9609-4ad7-9888-37115c98b2cd · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:08.528535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.469121Z digest=sha256:d7f60e2f1780e6016d60ca987151617e136fbe2ff44949c1754c6ac714783ba9

Observation 428190b1-bbfa-4d5d-bc45-1d9bbdbd8c59 · outbound

This paper cites Deliberative Alignment: Reasoning Enables Safer Language Models.

Security Concerns for Large Language Models: A Survey Deliberative Alignment: Reasoning Enables Safer Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.474448Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.474448Z digest=sha256:f8ef4787d46578febf1446b0df50d133eae179345e4b87b5102d6ef9894fd98e

Observation 62e05885-63d8-47b6-b4a4-1f4c924b55e6 · outbound

This paper cites System prompt poisoning: Persistent attacks on large language models beyond user injection.

Security Concerns for Large Language Models: A Survey System prompt poisoning: Persistent attacks on large language models beyond user injection

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.480328Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.480328Z digest=sha256:72493e4bc43f0e172f42dd382012c93337a6e3eac523f5c644045b722be3323f

Observation c592c1ef-f1f2-4a3f-a571-497ca4cfcd5f · outbound

This paper cites Red-Teaming LLM Multi-Agent Systems via Communication Attacks.

Security Concerns for Large Language Models: A Survey Red-Teaming LLM Multi-Agent Systems via Communication Attacks

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.485673Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.485673Z digest=sha256:4115bda3729df79fb5f65241e1ea8a1c7303c2e6655d8e29a47934ed59de626d

Observation 8f70f9be-cdb5-4ff8-8fe7-82d885618a5c · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:08.359894Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.490803Z digest=sha256:7cd3246c7bd30437ff74e53654e6f139cb34b58dafeccc6f237673a4f32a8d0a

Observation 5d5d53c0-54d1-46bf-a773-794ecbf44098 · outbound

This paper cites Pleak: Promptleakingattacksagainstlargelanguagemodelapplications,in: Proceedings of the 2024 on ACM SIGSAC Conference on Computer and Communications Security, pp.

Security Concerns for Large Language Models: A Survey Pleak: Promptleakingattacksagainstlargelanguagemodelapplications,in: Proceedings of the 2024 on ACM SIGSAC Conference on Computer and Communications Security, pp

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:08.140247Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.501273Z digest=sha256:29c13f105c69436a8b12ca4fa0a7e84ab1c988dc06388f10815d34c864d08d0b

Observation c19edb68-7eff-4127-a61e-c8bac5e6f212 · outbound

This paper cites Poisongpt:Howwehidalobotomized llmonhuggingfacetospreadfakenews.

Security Concerns for Large Language Models: A Survey Poisongpt:Howwehidalobotomized llmonhuggingfacetospreadfakenews

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.995449Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.505534Z digest=sha256:d9e49634323d66419771fe3ced871c1e260e17f7a66d6a85f94a895b07844707

Observation a94f58ae-8610-4a7f-b05b-0dd5f644d0a1 · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

Security Concerns for Large Language Models: A Survey Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.510563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.510563Z digest=sha256:d125592fa01d087df79d415dff230de2897947956020466605853e9119e16ba6

Observation 98d8d85c-1ef6-47f4-a1d3-809687dc6d90 · outbound

This paper cites Llmsecurity101:Defendingagainstprompthacks.

Security Concerns for Large Language Models: A Survey Llmsecurity101:Defendingagainstprompthacks

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.795090Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.516147Z digest=sha256:a6abb0ceec13cbb5ec2228ec45d127c66a738ced875dfe10acacc8122a723d30

Observation f1994eb4-52c4-481a-beca-94f65dd64760 · outbound

This paper cites Baseline Defenses for Adversarial Attacks Against Aligned Language Models.

Security Concerns for Large Language Models: A Survey Baseline Defenses for Adversarial Attacks Against Aligned Language Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.520629Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.520629Z digest=sha256:ea3066f04d1af58f17c9b78ecd468785b0373e3a9bf1aa0e79dd3253565e5151

Observation 8f5ae23f-3b17-494b-8494-438332375b7b · outbound

This paper cites A watermark for large language models, in: International Conference on Machine Learning, PMLR.

Security Concerns for Large Language Models: A Survey A watermark for large language models, in: International Conference on Machine Learning, PMLR

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.598434Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.526345Z digest=sha256:eb2d6bda3240e0bbb58adea0d9707f911bab780a881cb3135a6e271de72b9412

Observation 30fba0b6-0662-48c2-9a97-08c7f135c1c9 · outbound

This paper cites Fun-tuning: Characterizing the Vulnerability of Proprietary LLMs to Optimization-based Prompt Injection Attacks via the Fine-Tuning Interface.

Security Concerns for Large Language Models: A Survey Fun-tuning: Characterizing the Vulnerability of Proprietary LLMs to Optimization-based Prompt Injection Attacks via the Fine-Tuning Interface

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.532090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.532090Z digest=sha256:197658b855ee6322620a7d6d6a83eda31926bde79d30ec3c54ff225554d2297f

Observation d70dfd76-74a7-481c-9dd7-3d4d073c52c1 · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:07.356304Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.536591Z digest=sha256:af12839e35428b5d042baa41ce6d91ce8da8a22fc19211daa64fe75c0c27712b

Observation 1c6d1c47-9a87-431d-b297-a701ad27e765 · outbound

This paper cites Prefill-level Jailbreak: A Black-Box Risk Analysis of Large Language Models.

Security Concerns for Large Language Models: A Survey Prefill-level Jailbreak: A Black-Box Risk Analysis of Large Language Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.546803Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.546803Z digest=sha256:29ff1c96f2da443a1347d64004f0cb1c8124730ddfe1d57fb2565da37c2a8741

Observation 72ec2fdd-26f8-470c-944b-1b448705f2fb · outbound

This paper cites Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models.

Security Concerns for Large Language Models: A Survey Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.201977Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.551855Z digest=sha256:8edf07cb602591afc50eb2a2df38dc54c5d773fec21808edc284a732afcb8a1c

Observation 8abbee08-07ad-450d-a4eb-89465f60a515 · outbound

This paper cites Measuring Faithfulness in Chain-of-Thought Reasoning.

Security Concerns for Large Language Models: A Survey Measuring Faithfulness in Chain-of-Thought Reasoning

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.541783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.541783Z digest=sha256:571bce214bd90047a3538c4b62fe34b525f9763287c14a2e8a83faa1d353d627

Observation 663ca6f8-5b6e-4dd9-92f1-0f8e03ee9663 · outbound

This paper cites Autohijacker: Automatic indirect prompt injection against black-box llm agents, in: Submitted to ICLR 2025.https://openreview.net/forum?id=11629.

Security Concerns for Large Language Models: A Survey Autohijacker: Automatic indirect prompt injection against black-box llm agents, in: Submitted to ICLR 2025.https://openreview.net/forum?id=11629

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.805257Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.561299Z digest=sha256:eb7686ff5f6db5371a3a470acdcceb9e4755dcb1dcfa565dec8be6ea882dab04

Observation 2224e001-e7fb-46b9-9f51-819fc26db4d9 · outbound

This paper cites FlipAttack: Jailbreak LLMs via Flipping.

Security Concerns for Large Language Models: A Survey FlipAttack: Jailbreak LLMs via Flipping

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.566012Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.566012Z digest=sha256:ba0e236f45565d69e0c5e3fdf5708db6edd49e23af3068bc2213e9a206321dd7

Observation 804323e0-a0cf-48dc-8476-d5e75e7d5b45 · outbound

This paper cites Nature Machine Intelligence , 1–14.

Security Concerns for Large Language Models: A Survey Nature Machine Intelligence , 1–14

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:07.009172Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.556830Z digest=sha256:28c359b5470e254f08075507aa6b48628ca1d781aa2b19e59ebe7cacac942521

Observation 61c3d0a4-f14d-4110-a060-48a4c97eaa41 · outbound

This paper cites Agentic misalign- ment: How llms could be an insider threat.

Security Concerns for Large Language Models: A Survey Agentic misalign- ment: How llms could be an insider threat

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.363703Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.576065Z digest=sha256:e34d7ff34d66e8d1c0dfb5e9a6cc7040fd5031d40ba9a5674ec8dc470f1d5c4f

Observation e8d594a7-3a99-4da9-bf24-488c8974f8f0 · outbound

This paper cites Tree of attacks: Jailbreaking black- box llms automatically.

Security Concerns for Large Language Models: A Survey Tree of attacks: Jailbreaking black- box llms automatically

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.153119Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.581387Z digest=sha256:0d6c2b6e1115cedd0c50e0609ca2eaf2e94a01c8ae9fead22cdefc9a4cae71a9

Observation 594998f1-24d2-4b97-9986-48c367269cce · outbound

This paper cites Formalizing and benchmarking prompt injection attacks and defenses, in: 33rd USENIX Security Symposium (USENIX Security 24), pp.

Security Concerns for Large Language Models: A Survey Formalizing and benchmarking prompt injection attacks and defenses, in: 33rd USENIX Security Symposium (USENIX Security 24), pp

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.572898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.570611Z digest=sha256:f51fcf6eab88bb7a396a0f1125be1d7b8c5f356d945af271a151aac82bb9a5e2

Observation 76516eb3-79fb-4df2-8745-0a325c84f7ea · outbound

This paper cites Fully autonomous ai agents should not be developed.

Security Concerns for Large Language Models: A Survey Fully autonomous ai agents should not be developed

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.591089Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.591089Z digest=sha256:18ad11d93ecdc254620f94395ee4dbc6b10e017cc18eaea168c9a9e1cfca22f5

Observation 944c7bf4-9622-499a-8461-ec9b37e178a4 · outbound

This paper cites AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents.

Security Concerns for Large Language Models: A Survey AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.596762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.596762Z digest=sha256:2df94ffbdbe168022e7216504bdb628da85558e22f74a231e3d4203c7a6c9894

Observation af322d9b-6b9f-42ed-b73c-75edf804a0ce · outbound

This paper cites Frontier Models are Capable of In-context Scheming.

Security Concerns for Large Language Models: A Survey Frontier Models are Capable of In-context Scheming

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.586403Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.586403Z digest=sha256:889bf1b35940305a49180365a17bdeb59c85ea16ff60fcd2f5eab83c5d88d918

Observation f40d4b36-c785-4193-8798-510bb0213b15 · outbound

This paper cites Eliciting and Analyzing Emergent Misalignment in State-of-the-Art Large Language Models.

Security Concerns for Large Language Models: A Survey Eliciting and Analyzing Emergent Misalignment in State-of-the-Art Large Language Models

Reference 46

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:04.311908Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.607771Z digest=sha256:82539911631759badf5249f85d3320c2215bb188933d3428ec80cc2cd38db3ab

Observation c6fa50bd-3b22-4322-b72c-ce82f7a1333f · outbound

This paper cites Neural Exec: Learning (and Learning from) Execution Triggers for Prompt Injection Attacks.

Security Concerns for Large Language Models: A Survey Neural Exec: Learning (and Learning from) Execution Triggers for Prompt Injection Attacks

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.612380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.612380Z digest=sha256:d26e6661f8bd07aa3a0d0876e86b7acc4ab741c0d9a95e537c3499c9bb57f566

Observation 77b8372a-7ad2-4b67-8a78-a7e57022c71f · outbound

This paper cites GPT-4 Technical Report.

Security Concerns for Large Language Models: A Survey GPT-4 Technical Report

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.602300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.602300Z digest=sha256:32df455d4d67516028a69547200c23364f20dd350a093fc6351963547ecd1039

Observation ce91f6c3-7ae0-4a5f-a822-9edf9615ec9e · outbound

This paper cites Hijacking Large Language Models via Adversarial In-Context Learning.

Security Concerns for Large Language Models: A Survey Hijacking Large Language Models via Adversarial In-Context Learning

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.621418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.621418Z digest=sha256:0954e1666810c7ce7a6dac322c8af75fa2ab3227540f5e389fc423ae13b29c08

Observation 26580501-d266-4a08-9291-d8ff75199f53 · outbound

This paper cites From chatbotstophishbots?:Phishingscamgenerationincommerciallarge languagemodels,in:2024IEEESymposiumonSecurityandPrivacy (SP), IEEE.

Security Concerns for Large Language Models: A Survey From chatbotstophishbots?:Phishingscamgenerationincommerciallarge languagemodels,in:2024IEEESymposiumonSecurityandPrivacy (SP), IEEE

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:06.004447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.626005Z digest=sha256:7bd0b0d4204153d2879a468617bd8984ade109b149283288f7def651c698c8af

Observation a12f2e67-d3ee-4924-85bc-4a8b38807754 · outbound

This paper cites Ignore Previous Prompt: Attack Techniques For Language Models.

Security Concerns for Large Language Models: A Survey Ignore Previous Prompt: Attack Techniques For Language Models

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.616788Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.616788Z digest=sha256:305da0f348cc93d8af48b2259559f7b7e062c0163f0a31f282a431424201eda6

Observation 24375860-c72e-4ad5-b9c4-f90a96155f81 · outbound

This paper cites BadGPT: Exploring Security Vulnerabilities of ChatGPT via Backdoor Attacks to InstructGPT.

Security Concerns for Large Language Models: A Survey BadGPT: Exploring Security Vulnerabilities of ChatGPT via Backdoor Attacks to InstructGPT

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.635415Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.635415Z digest=sha256:d688fc21abca1223b93e58d2f7b664009a61aed49648f921d6cb9bcd8752929c

Observation 12b4b3aa-060e-4106-80c0-cf97e3f9d79d · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 53

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.920423Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.640227Z digest=sha256:6087decab0ad9a84b276bd292e80e821674499fabf1a677f177c137f306b426c

Observation 3a5fd50e-8463-4378-b555-0104ecddeb33 · outbound

This paper cites Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks.

Security Concerns for Large Language Models: A Survey Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.630698Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.630698Z digest=sha256:b8541412819c4d9d2b6878109509d7a8d01a8a8cea3edf5ccc06f09ae6a75c80

Observation cda06f9a-a7ab-4138-8483-610e2173d028 · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

Security Concerns for Large Language Models: A Survey Gemini: A Family of Highly Capable Multimodal Models

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.655102Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.655102Z digest=sha256:4cb6a8cfbcbce2d9f1fe5b0a9b1c076d8af5f6c568797891743bdd1b343aa34f

Observation 345b4c22-c783-4260-9166-3d5cb358380e · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

Security Concerns for Large Language Models: A Survey Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.659641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.659641Z digest=sha256:81ad79dcf65ad8a5423f83aa5db53cdd25f052910bcbd980406fe96249715c54

Observation 3fff1a74-7046-469b-a5d8-c0b24f7ea928 · outbound

This paper cites AdvancesinNeural Information Processing Systems 36, 61836–61856.

Security Concerns for Large Language Models: A Survey AdvancesinNeural Information Processing Systems 36, 61836–61856

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.817837Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.645571Z digest=sha256:12286fafaf09370fa1d593046f497fb62ddd2a322fad997f20d7f3f8877cc45b

Observation 2440f6fb-d53c-47cf-a777-1a03490ad880 · outbound

This paper cites Wormgpt and fraudgpt – the rise of malicious llms.

Security Concerns for Large Language Models: A Survey Wormgpt and fraudgpt – the rise of malicious llms

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.699816Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.650551Z digest=sha256:ea642ba61cc787805f0a0a10bced8da630326c93e8a0c6c0657bc0bd50929241

Observation a4ee6f0e-964d-4f5d-8547-a982f9c59d9a · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 59

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.453509Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.673431Z digest=sha256:5126c1c36871a5c373809b4d1a10146df03ce1152639089badf807338aaa7902

Observation c3c72e84-9a5e-479f-9a66-84669cef5015 · outbound

This paper cites Poisoning Language Models During Instruction Tuning.

Security Concerns for Large Language Models: A Survey Poisoning Language Models During Instruction Tuning

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.683845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.683845Z digest=sha256:b77b860c1c62ae4aa5606e70c96d5323890e489fb8c3aa58fbcd96a042fadabb

Observation bc0ea891-fa4a-49c0-a147-d83ddf0fe92d · outbound

This paper cites DAN is my new friend.https://old.reddit.c om/r/ChatGPT/comments/zlcyr9/dan_is_my_new_friend/.

Security Concerns for Large Language Models: A Survey DAN is my new friend.https://old.reddit.c om/r/ChatGPT/comments/zlcyr9/dan_is_my_new_friend/

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.592228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.664204Z digest=sha256:e7e65dd53c5986d478aa72a225e4c1d03fab316a29a0d416028a0fbf86efa071

Observation f43a025c-03cf-44e5-83f9-236dd5fbf0aa · outbound

This paper cites Universal adversarial triggers for attacking and analyzing nlp, in: EMNLP.

Security Concerns for Large Language Models: A Survey Universal adversarial triggers for attacking and analyzing nlp, in: EMNLP

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.502228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.668643Z digest=sha256:ba130f30afba7db910196c1eb838b390812759e3b1dafe0474021d55aa31a196

Observation dc1e993c-71e8-4590-b811-d4843a5ebd9d · outbound

This paper cites When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models.

Security Concerns for Large Language Models: A Survey When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.699530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.699530Z digest=sha256:9302de8a1ccde109721c5b6bfb4c1913e4043abffda830ecd4bb881535faf3de

Observation 7c7786f9-4dbd-4f3b-aa2b-3d99c574d136 · outbound

This paper cites The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions.

Security Concerns for Large Language Models: A Survey The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.678249Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.678249Z digest=sha256:fdbdcd0022777cefcdda997e68229555af4b9d5504c169e501d102c147b2fb07

Observation 68defda7-725f-4125-a8fd-b54e3b8798ad · outbound

This paper cites Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems 36, 80079–80110.

Security Concerns for Large Language Models: A Survey Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems 36, 80079–80110

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.439142Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.710344Z digest=sha256:ce5027edf9035798dd1d37cd7a9332e67366f00af97a23f229c67d7b0eba0cb1

Observation 63ce99cb-7ea7-45b3-b288-d427f9a6e538 · outbound

This paper cites AgentSpec: Customizable Runtime Enforcement for Safe and Reliable LLM Agents.

Security Concerns for Large Language Models: A Survey AgentSpec: Customizable Runtime Enforcement for Safe and Reliable LLM Agents

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.688700Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.688700Z digest=sha256:5efbe8b73b7fbe32eaeda43260e148c7229a461b5bd0bc6b3e50c6cd2bdfe2aa

Observation 15125eaa-6240-4c15-bf31-a7767070f8d6 · outbound

This paper cites Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment.

Security Concerns for Large Language Models: A Survey Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.694102Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.694102Z digest=sha256:0ea9fca025fdd082f5266e29ea4ae8e9ba7b519c0f1eb417f337b49bcb22f891

Observation 3d99dff0-7482-4de9-a3f6-cb55c68aaff5 · outbound

This paper cites Nuclear Deployed: Analyzing Catastrophic Risks in Decision-making of Autonomous LLM Agents.

Security Concerns for Large Language Models: A Survey Nuclear Deployed: Analyzing Catastrophic Risks in Decision-making of Autonomous LLM Agents

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.725980Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.725980Z digest=sha256:7bf6cbaf606d078f3de0d2d2ba880239a11821c794ac958fa5779e74d7c2b0c0

Observation 3d4cf9b3-0620-496e-ac16-24d848e360e7 · outbound

This paper cites Persona features control emergent misalignment, 2025.

Security Concerns for Large Language Models: A Survey Persona features control emergent misalignment, 2025

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.705501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.705501Z digest=sha256:cb064543d2d07439d6a69a25fb04d314c3305aca98952bb11b112567a7880ac6

Observation 9b8871b8-d32b-4189-af08-9dbd0804a0c4 · outbound

This paper cites Asurvey on large language model (llm) security and privacy: The good, the bad, and the ugly.

Security Concerns for Large Language Models: A Survey Asurvey on large language model (llm) security and privacy: The good, the bad, and the ugly

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:27:05.361858Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.736286Z digest=sha256:7c50f8eb230d2f8da76283ccab3385353d2a2b1b5690ccdccef608d4196748c4

Observation 64e5fd1a-3be0-4c55-99b3-8395982cc5e0 · outbound

This paper cites RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent.

Security Concerns for Large Language Models: A Survey RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.715584Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.715584Z digest=sha256:4acf53fd46f25451f9d83a5bdd39ea604dfae6240d58d912cccad44a12296683

Observation 702d2ad4-02d6-4f69-82be-ff06d645237e · outbound

This paper cites Rejection Improves Reliability: Training LLMs to Refuse Unknown Questions Using RL from Knowledge Feedback.

Security Concerns for Large Language Models: A Survey Rejection Improves Reliability: Training LLMs to Refuse Unknown Questions Using RL from Knowledge Feedback

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.720278Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.720278Z digest=sha256:df21226da8b2e5141e59e757bb67ea8f5bb8d164a186dad857393c1d1d2c88bc

Observation c1a8b09f-38b2-4f95-b3b9-29b4a8fdcfa5 · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 73

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.197213Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.750500Z digest=sha256:a5c9cc9ddfe4937456af8c5a306bbbc6b03a169e5cf6da606e4186e42bb06469

Observation 8b9d043f-428c-4a8d-adb8-edbe1f111dcf · outbound

This paper cites Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection.

Security Concerns for Large Language Models: A Survey Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.730949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.730949Z digest=sha256:79d15593b1c2af89d8547967c0eb69fb9d2efbdcbbf6f4ba8ef98a096998231f

Observation 9a515249-b67b-43be-8da3-9b87c3a00f40 · outbound

This paper cites AutoRedTeamer: Autonomous Red Teaming with Lifelong Attack Integration.

Security Concerns for Large Language Models: A Survey AutoRedTeamer: Autonomous Red Teaming with Lifelong Attack Integration

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.764785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.764785Z digest=sha256:fdc71310d78317a05efd07131b06bcff898c198727dab6f748f9b9ddfa643caa

Observation bb96e0a4-8b38-43f2-ace2-cc8a809bae58 · outbound

This paper cites LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models.

Security Concerns for Large Language Models: A Survey LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.740914Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.740914Z digest=sha256:51eb0edc1dfbddb7b201d4758364adb2826e00ac5277a6a16cea8687588df3b9

Observation 2499618d-1ed2-418d-b7ba-c5cbdc64ff78 · outbound

This paper cites A Closer Look at Machine Unlearning for Large Language Models.

Security Concerns for Large Language Models: A Survey A Closer Look at Machine Unlearning for Large Language Models

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.745848Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.745848Z digest=sha256:dc29bbdb9cb92b58284d540522d4d22f5ce83299245ed6dbaf003a01d2b9149a

Observation 57120ddb-8970-4d96-b258-a53bc8fb3204 · outbound

This paper cites Evaluation of LLM Vulnerabilities to Being Misused for Personalized Disinformation Generation.

Security Concerns for Large Language Models: A Survey Evaluation of LLM Vulnerabilities to Being Misused for Personalized Disinformation Generation

Reference 78

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:27:03.825519Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.780401Z digest=sha256:993c6ac2d1f9523f26a5ba5fe6274a7ccbd8d37000d1c8d1b20e634c28f013de

Observation 82d11667-9a15-4cae-a3fd-e0a0b67e667d · outbound

This paper cites an unresolved cited work.

Security Concerns for Large Language Models: A Survey Unresolved cited work

Reference 79

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:27:05.063421Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-08-07T14:27:03.754737Z digest=sha256:f69c8e67e0d245b3955cc8e4af5e09873a842a5d9c7eec9ca1c09a06f7a7c7c5

Observation eb482b29-547d-4846-bd6b-42e9cf4b000f · outbound

This paper cites Weak-to-Strong Jailbreaking on Large Language Models.

Security Concerns for Large Language Models: A Survey Weak-to-Strong Jailbreaking on Large Language Models

Reference 80

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.759736Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.759736Z digest=sha256:695f08f1eff089ae7fad4eb3f73d67bb4349c8d2cc6a75fbc12eeabdb3f1edf8

Observation ab4d47a7-5cae-41a2-9f9f-014b5ea4b4b0 · outbound

This paper cites Ad- vprefix: An objective for nuanced llm jailbreaks.

Security Concerns for Large Language Models: A Survey Ad- vprefix: An objective for nuanced llm jailbreaks

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.770830Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.770830Z digest=sha256:2e7805e5e42f6693499933135f171d80c6b39e640a30482945882399ad0ace01

Observation 6956a007-7c79-41f6-9f67-bbae36cce66c · outbound

This paper cites Universal and Transferable Adversarial Attacks on Aligned Language Models.

Security Concerns for Large Language Models: A Survey Universal and Transferable Adversarial Attacks on Aligned Language Models

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.775471Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.775471Z digest=sha256:7417e771172ed0922d7269dc932ccf23a3031b358d416d67c18d3c50a6ae1c1b

Observation 099fde57-8128-44e5-a0b5-d7ee8ff11def · outbound

This paper cites Safe RLHF: Safe Reinforcement Learning from Human Feedback.

Security Concerns for Large Language Models: A Survey Safe RLHF: Safe Reinforcement Learning from Human Feedback

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.440620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.440620Z digest=sha256:f57259b37a842b37a33f50748ff054d6d17dc848335138ab0ddca413b1d80ce7

Observation f03154d5-a4b3-4d51-a0de-e83b582db2b2 · outbound

This paper cites Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training.

Security Concerns for Large Language Models: A Survey Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-07T14:27:03.495748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:27:03.495748Z digest=sha256:59331efb78cf15e33337826e0f967df65265bf6fbac7c05fc8d5326a26bff361

Pith citing papers

Observation 2ee4e6f2-7cd7-497b-b623-98bf6ffa8b58 · inbound

Bridging AI and Software Security: A Comparative Vulnerability Assessment of LLM Agent Deployment Paradigms cites this paper.

Bridging AI and Software Security: A Comparative Vulnerability Assessment of LLM Agent Deployment Paradigms Security Concerns for Large Language Models: A Survey

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T19:12:22.885999Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:12:22.885999Z digest=sha256:9bd179fc94aa2f77b7468cf4e9b267340bd452e70f67f7342f50e984a3649ac1

Observation b093e5c6-e241-448f-98f4-13db15d84283 · inbound

LLM Harms: A Taxonomy and Discussion cites this paper.

LLM Harms: A Taxonomy and Discussion Security Concerns for Large Language Models: A Survey

Reference 130

Resolution
verified exact
arxiv_id, observed 2026-05-17T00:31:24.541239Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-05-17T00:29:07.951709Z digest=sha256:d7f74338b544bc1308bc06da9a099d7f62000a690a2d5ac87e627442cc568408

Observation a210001a-a16e-4ba2-9984-e67cd692f373 · inbound

LLM Harms: A Taxonomy and Discussion cites this paper.

LLM Harms: A Taxonomy and Discussion Security Concerns for Large Language Models: A Survey

Reference 130

Resolution
unresolved
no resolver link, observed 2026-08-03T18:19:22.067036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T18:19:22.067036Z digest=sha256:122bc8db1f71d6925ad1cea41cb3ca35c62e04de24fefa9df666efc03dd0e1ce

Observation 7698991f-040b-4cc0-affd-9512d14552e9 · inbound

Zero-Shot Embedding Drift Detection: A Lightweight Defense Against Prompt Injections in LLMs cites this paper.

Zero-Shot Embedding Drift Detection: A Lightweight Defense Against Prompt Injections in LLMs Security Concerns for Large Language Models: A Survey

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-03T09:53:25.123806Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T09:53:25.123806Z digest=sha256:a7688b5059b1a2e2eb3930c001a81cb99e6087e7c7ab959af65a1a4003d7f167

Observation 89b8a45c-01e6-42eb-8b6f-309f69ae204e · inbound

Gecko: A Simulation Environment with Stateful Feedback for Refining Agent Tool Calls cites this paper.

Gecko: A Simulation Environment with Stateful Feedback for Refining Agent Tool Calls Security Concerns for Large Language Models: A Survey

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T21:46:33.293428Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T21:46:33.293428Z digest=sha256:97b993ce8aaa7d322dbd8708549376e193eee91ec77eccebf12aacc81d7ae9a7

Observation a4ecefb4-f0f3-44a9-a41d-79f573a1a009 · inbound

LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models cites this paper.

LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models Security Concerns for Large Language Models: A Survey

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-10T09:38:43.149038Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-05-10T05:11:01.039309Z digest=sha256:8ebf0886af5696cc0d1e47e1c1440a2d5cd0824c7820fc8dcf9448ff92da7939

Observation f11db4e2-a816-4d47-aad9-ec665cf4ea53 · inbound

Adversarial Prompting Framework for AI Safety Assessment cites this paper.

Adversarial Prompting Framework for AI Safety Assessment Security Concerns for Large Language Models: A Survey

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T05:10:09.315243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:10:09.315243Z digest=sha256:69894a23a471517ba15857fea3c9abaec224bd8c1c650aeb93588a107914b564