Pith. sign in

Paper Citation Record · LEDGER

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models

As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2602.02600.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2602.02600 v3

Coverage vector

measured 38 of 38 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T05:45:45.089748Z

measured 40 of 40 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-05-20T11:26:55.810822Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

38 of 38 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved37
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

0
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

Observation 0af9e6f5-b904-439c-927d-71c7ec52a5a9 · outbound

This paper cites GPT-4 Technical Report.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:41.616691Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:41.616691Z digest=sha256:eac761bec84b350b0186a4aa214993dac0c4255453c09df44b25b735b5b2da16

Observation f79f4f1f-4dd5-43bb-b67b-d8c4f1cf3c08 · outbound

This paper cites Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:41.783523Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:41.783523Z digest=sha256:211a7f055b96c9e045c1eea8fdfd97cc51088db046e58686bcbcf66b53c14150

Observation cef9de61-027f-4f8d-8796-dad0bd30655f · outbound

This paper cites How Contextual are Contextualized Word Representations? Comparing the Geometry of BERT, ELMo, and GPT-2 Embeddings.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models How Contextual are Contextualized Word Representations? Comparing the Geometry of BERT, ELMo, and GPT-2 Embeddings

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:41.989458Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:41.989458Z digest=sha256:b75215b04abe1831cc1a68cfc08c67008cc0a83991849aeee6a7cf6116cf2e77

Observation 8bde1605-6053-4eaf-a72f-0bfe42687318 · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.088173Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.088173Z digest=sha256:0f94adf2d6239935eb6e3ab0d8047faee0aa1f3bce8172f74a24e0892e31fedf

Observation 645a920c-ee84-45a8-8165-a35bf813f178 · outbound

This paper cites A2d: Any-order, any-step safety align- ment for diffusion language models.arXiv preprint arXiv:2509.23286,.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models A2d: Any-order, any-step safety align- ment for diffusion language models.arXiv preprint arXiv:2509.23286,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.151015Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.151015Z digest=sha256:452d91da6822f8a4ac0f4e437b4a33dfe9196485e5a6db8b28f1ffef4e4eb9b8

Observation d91a8e40-f89f-4d19-b118-a621952607ab · outbound

This paper cites Crafting papers on machine learning.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Crafting papers on machine learning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.207501Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.207501Z digest=sha256:768fa0a1fc6e68e61b5fd2ef5464b608c0f20b22d8bfd7cc94e227f7adbb5131

Observation 4aa0717e-6e43-4b42-b623-f08cf4a9df94 · outbound

This paper cites Refusal Suppression.Refusal Suppression is implemented following the prompt-based method introduced in (Wei et al., 2023).

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Refusal Suppression.Refusal Suppression is implemented following the prompt-based method introduced in (Wei et al., 2023)

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.663357Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.663357Z digest=sha256:bd416a2005c13ad1a10f949a8b640ba34b8906e48401bda8561d051a8c43766a

Observation c45463bd-11a8-4de5-9d58-d0d0eef889d6 · outbound

This paper cites Jailbreak Attack Initializations as Extractors of Compliance Directions.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Jailbreak Attack Initializations as Extractors of Compliance Directions

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.429452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.429452Z digest=sha256:2729fe3c6e68bf6bd37031536a8beeb6240fb5b0bc8100399825b8b2ffa02a0d

Observation 2ef57400-6880-4f34-bb57-99551e0497a3 · outbound

This paper cites FlipAttack: Jailbreak LLMs via Flipping.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models FlipAttack: Jailbreak LLMs via Flipping

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.577745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.577745Z digest=sha256:d945d323d13409ffbe6f9ec8eebc33c8d5864c014e42fcb7caaec77aa1525500

Observation 0f9c8323-108f-4d09-802f-9e189777ab62 · outbound

This paper cites HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.702775Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.702775Z digest=sha256:e2e16f8950eae133bc8182903662ca921c9ddc8ab64a73a20bd51d40b86f29a5

Observation 79833021-1f3f-4cad-8c93-f07497e42aa3 · outbound

This paper cites Large Language Diffusion Models.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Large Language Diffusion Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.780302Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.780302Z digest=sha256:be30f57063d23313f0d09c1f1b7ff376d7f0ad203bee178d73e23bdb181ccb29

Observation 8270372a-f80b-497a-b771-f6f76a872fa9 · outbound

This paper cites LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.882537Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.882537Z digest=sha256:1b81b8bef717ddfcc03e861fa34bd68db0fda2cdf33bbb2a84890a30a207adc2

Observation f5353b55-d912-427a-a9e8-f0f2abcc47dd · outbound

This paper cites Large Language Model Safety: A Holistic Survey.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Large Language Model Safety: A Holistic Survey

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.008497Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.008497Z digest=sha256:e76dcec08c9667f0e5fad156c2b7916bec3d9d99212d339a7262f3269b35a128

Observation fd1bd27b-07a2-4db1-bf4e-b921ce2f7fe8 · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Gemma: Open Models Based on Gemini Research and Technology

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.091156Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.091156Z digest=sha256:0446c595eb593d4a4a647d53f2325a0e4cddcc9c977902b747eab6d8d0ee4f55

Observation 38181c6c-e721-4a81-8377-6ddca49e4aac · outbound

This paper cites BERT Rediscovers the Classical NLP Pipeline.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models BERT Rediscovers the Classical NLP Pipeline

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.168094Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.168094Z digest=sha256:5cd63b0b7d4d2ce3035e72d08ceb0d4cd100dd4fa470d5b29f86aac03917b4b9

Observation 659cb4a2-6c44-4335-999b-26af90ba3d57 · outbound

This paper cites The devil behind the mask: An emergent safety vulnerability of diffusion llms.arXiv preprint arXiv:2507.11097,.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models The devil behind the mask: An emergent safety vulnerability of diffusion llms.arXiv preprint arXiv:2507.11097,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.286735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.286735Z digest=sha256:723eff8bcc1765de4ccc13b406084577c3e81ecb6892dba297e3219bba9aa984

Observation 4623871c-c93f-49f9-a08b-3449b3bd9c6b · outbound

This paper cites The geometry of refusal in large language models: Concept cones and representa- tional independence.arXiv preprint arXiv:2502.17420,.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models The geometry of refusal in large language models: Concept cones and representa- tional independence.arXiv preprint arXiv:2502.17420,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.334338Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.334338Z digest=sha256:87fd5a9f129303833434ebeafbce2dc44bd3af75112cfb5ed2da4bb593660b02

Observation b3b4624a-5506-431b-8382-3254edd8199a · outbound

This paper cites A Survey of Attacks on Large Language Models.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models A Survey of Attacks on Large Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.424556Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.424556Z digest=sha256:753c9441a3e8509eaf8cd77579e57c0b51afe69bea8e58915cbcd540e3cd67c4

Observation 4ec446d6-0ff9-4998-95de-1f29e5e44e6d · outbound

This paper cites Qwen2.5-1M Technical Report.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Qwen2.5-1M Technical Report

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.533522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.533522Z digest=sha256:97b9bc4f6324d93fe353016a8242a6de8b4cc5177160e9430a535954c5e7099f

Observation bd6f25c0-3a76-4335-aa7f-b6ce870c33cf · outbound

This paper cites Dream 7B: Diffusion Large Language Models.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Dream 7B: Diffusion Large Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.602807Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.602807Z digest=sha256:3c4c20fd990675a91c7e92659c7128486981962c3c409622e085d45113a343d0

Observation 777b2d59-949d-4018-9c6a-eaf9c7c97545 · outbound

This paper cites Discrete diffusion in large lan- guage and multimodal models: A survey.arXiv preprint arXiv:2506.13759,.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Discrete diffusion in large lan- guage and multimodal models: A survey.arXiv preprint arXiv:2506.13759,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.714527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.714527Z digest=sha256:2ce45b8909e91ff90fc6216a35a91c2de5b095ca4ebfa68526619d17f76ca1ad

Observation 89253ad6-01f5-4fbe-89ac-e287371ac473 · outbound

This paper cites Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.832756Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.832756Z digest=sha256:8193eb7f1af838655d1282a247a06d752a353b3f938e02dc768aa2ad9b65958b

Observation 6e3c96fc-248a-4283-9bd5-e37970a29c02 · outbound

This paper cites A Survey of Large Language Models.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models A Survey of Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:43.930775Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:43.930775Z digest=sha256:14684f3442f834a6049b43f042d556c599491e46d6092450930591bd55b78964

Observation e107358e-4f46-4aef-a539-16469f26a025 · outbound

This paper cites LLaDA 1.5: Variance-Reduced Preference Optimization for Large Language Diffusion Models.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models LLaDA 1.5: Variance-Reduced Preference Optimization for Large Language Diffusion Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.043197Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.043197Z digest=sha256:35a6caf947e7acf9053512ac4c3153d2af7ec51cf516396cc3afe1c518c87fbd

Observation 080d095d-ce43-4f94-abba-3ec258137151 · outbound

This paper cites Universal and Transferable Adversarial Attacks on Aligned Language Models.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Universal and Transferable Adversarial Attacks on Aligned Language Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.104063Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.104063Z digest=sha256:8d32955ee176c61737640bee94d899cdc914acd6dd355eba368b8d430e233177

Observation b124f1db-3f47-4ee5-a44f-0a6bd0bffd4c · outbound

This paper cites In setups with active defenses, any prompt or response blocked by a defense is also counted toward the Refusal Rate.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models In setups with active defenses, any prompt or response blocked by a defense is also counted toward the Refusal Rate

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.215298Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.215298Z digest=sha256:61ed3610b732afa0a2ea59cd624fa7a9be4edb37fd9b6c1e4d54d1abc9e00228

Observation 99a4289c-9bf2-436d-97f3-dc8b23408f56 · outbound

This paper cites True" if it is answering or.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models True" if it is answering or

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.364746Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.364746Z digest=sha256:045ceaf75d31bcbc55107776430e16e3771838b7cfffc036a4a5222acda8a7ca

Observation bd0d541b-b0c9-4ff6-b18d-c10906c6dd90 · outbound

This paper cites Text: {response} Answer: Figure 8.Judge prompt used to evaluate whether a model response contains harmful information.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Text: {response} Answer: Figure 8.Judge prompt used to evaluate whether a model response contains harmful information

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.522702Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.522702Z digest=sha256:489077765ed16153e6e38e5db0e1ef8766445804251dbd04607636711fbcd403

Observation 33bdee98-4d52-4f47-912f-00cb694bc98c · outbound

This paper cites We use a subset of 100 PAIR-generated jailbreak prompts provided in the repository.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models We use a subset of 100 PAIR-generated jailbreak prompts provided in the repository

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.789698Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.789698Z digest=sha256:0dcc5e80768c4dab58dd9c0ee5f18b0a7da68c852a33f496dd124281954dbc3f

Observation c26b6b94-e78e-47a5-8aef-4fad5fec848d · outbound

This paper cites We use a subset of 100 Random Search jailbreak prompts for evaluation.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models We use a subset of 100 Random Search jailbreak prompts for evaluation

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:44.896303Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:44.896303Z digest=sha256:27e332b854e9a3c21b514ccb88338cd2d37e96a7594beb56237b200e8902d3cd

Observation 04a391ec-90cb-412f-9616-00c55a0a6440 · outbound

This paper cites For each response, we compute the average per-token negative log-likelihood under GPT-2 and reject outputs whose perplexity exceeds a fixed threshold.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models For each response, we compute the average per-token negative log-likelihood under GPT-2 and reject outputs whose perplexity exceeds a fixed threshold

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:45.026784Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:45.026784Z digest=sha256:236e076857228e1adc256f927b93f236af757f5aa3c93b9f1670a234ab3204f0

Observation d57c5549-f954-430d-9660-83838cb14afc · outbound

This paper cites <|begin_of_text|> [INST] Task: Check if the following content is safe or unsafe.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models <|begin_of_text|> [INST] Task: Check if the following content is safe or unsafe

Reference 38

Resolution
malformed identifier
no resolver link, observed 2026-08-03T05:45:45.089748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:45.089748Z digest=sha256:973d4ca405ac9d67a22c7f2995322464ad42b9dec84344adf6e45c12ebc2e636

Observation c0ba13cc-7577-4cd3-9ca2-2dfa84908394 · outbound

This paper cites Interpretation Meets Safety: A Survey on Interpretation Methods and Tools for Improving LLM Safety.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Interpretation Meets Safety: A Survey on Interpretation Methods and Tools for Improving LLM Safety

Reference 2000

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.313410Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.313410Z digest=sha256:9fc6ad5af9819c55879a1d408df479e0d927a2d7b3f367bd19c765dc518d9715

Observation d40a9abd-ada4-4e57-acef-072fcfbb3a7a · outbound

This paper cites Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.950747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.950747Z digest=sha256:4e562a2bc6cdd0688dfb5326afb4abe9afb1f2a009cbb482710f29b6aa9c51fb

Observation caaa3fb1-b72d-4031-b394-2af6d2856717 · outbound

This paper cites Diffuguard: How in- trinsic safety is lost and found in diffusion large language models.arXiv preprint arXiv:2509.24296,.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Diffuguard: How in- trinsic safety is lost and found in diffusion large language models.arXiv preprint arXiv:2509.24296,

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:42.491993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:42.491993Z digest=sha256:225cca73f715a58f0690484ed49304f93ed2640dc7cc6370523cf25896d28fbd

Observation fe89cb34-533d-47c8-9e36-339b16167c22 · outbound

This paper cites Detecting Language Model Attacks with Perplexity.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models Detecting Language Model Attacks with Perplexity

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:41.660950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:41.660950Z digest=sha256:124b3b33035556fa0e2d19e2a5a1077c7092434a1a5963f7ccc84593058241b2

Observation 76555a29-24b3-4b02-9b3a-4a097edaea0c · outbound

This paper cites LLaDA2.0: Scaling Up Diffusion Language Models to 100B.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models LLaDA2.0: Scaling Up Diffusion Language Models to 100B

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:41.842845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:41.842845Z digest=sha256:138a694e8996a9a3cab883bb54b5206147d59174db9fc7785b15eed94b441f30

Observation 1e4310c0-1c9b-4c52-9dbf-ef67e2c47430 · outbound

This paper cites D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al.

Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-03T05:45:41.899498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:45:41.899498Z digest=sha256:26b5623bb67aa7065bbd398d2c52a47e7f8d7d028c1eb54585c927bf2a90c084

Pith citing papers

Observation 7bf662f9-f996-4d98-88ef-0c3e7c16450f · inbound

Differences in Text Generated by Diffusion and Autoregressive Language Models cites this paper.

Differences in Text Generated by Diffusion and Autoregressive Language Models Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models

Reference 28

Resolution
metadata mismatch
arxiv_id, observed 2026-06-08T02:04:45.785996Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-14T20:59:06.804446Z digest=sha256:2f1d2a31a4c184b75630e9a0b3bcda1af3b75ba32a01cbf2d6ceddeb1c098f0f

Observation e245d122-1e7f-4868-8adf-2c7c0c89f951 · inbound

SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-Training cites this paper.

SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-Training Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models

Reference 133

Resolution
verified exact
arxiv_id, observed 2026-06-08T02:04:45.785996Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-05-20T11:26:55.810822Z digest=sha256:c200545a2436082e93f83d134ae7f5f94101a1d9d7aeaa082be8f436e90b2e44