Pith. sign in

Paper Citation Record · LEDGER

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models

As of 7 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2509.08997.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2509.08997 v1

Coverage vector

measured 47 of 47 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-04T19:55:56.611443Z

measured 47 of 47 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

47 of 47 outbound references displayed

  • verified exact3
  • verified fuzzy0
  • unresolved43
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 0f9608bf-c76b-4077-b59d-2bae611432c6 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.435129Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.435129Z digest=sha256:e81e19a98fbfddfb665325447377008c3b088c0a265d70f2b1585c76b6d7377c

Observation 40d3c938-1881-4761-90b6-4ca3f0fa9bf0 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.439641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.439641Z digest=sha256:84619420a8c2b47036ecd8da93ec0812d31ae929112d7a581ae6130537a9ebf4

Observation e3a0654f-c9da-4710-8c90-1af1a139ff1c · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.444021Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.444021Z digest=sha256:f36ab871ec103c5b1c98faf77dfb1ac550a1e15cb84fa882b7a81ca4b7d461d8

Observation 300e2c2c-d4c9-436f-bcca-ac823f9f6ff9 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.447986Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.447986Z digest=sha256:b1bdf87b33e6c3110a25757539f2c42dfcfffa968dcb15516e6796cd46a38573

Observation aec61d3c-2a8e-4c97-8ffd-86e54e187442 · outbound

This paper cites Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.451863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.451863Z digest=sha256:56f8b4349d6e0f0308889b2545337fe13e0f35ffbcdee7a0e9c22b55691c5bd7

Observation 0338ff4d-f339-41c6-b5bc-b772e015a866 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.456135Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.456135Z digest=sha256:45b0beb82c6cf2c1f08edb7503ebc99ada1cf6ffd995c071ae3cf4b3cac03ba1

Observation f63a1b9f-bf10-496c-af60-f94804011281 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.460400Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.460400Z digest=sha256:66068a24f4000509117d474a71325c6d2557e95abcdc159eef8fffad4185776d

Observation 1555aad5-4680-4977-b859-51c2baa6606c · outbound

This paper cites Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.464199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.464199Z digest=sha256:237ac16fc68ec44e85f2e806fe31686c0acbc37d620807aebb7750f727b2c7e9

Observation f00d6933-57f9-4176-918c-24f41037209a · outbound

This paper cites Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.468210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.468210Z digest=sha256:1a433b5bb7029fc37a0b13968aa0fef7b114bdf92cafbe485d44749ae009392e

Observation f5a16fcf-69ac-4913-b57e-3d6db52891d9 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.472412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.472412Z digest=sha256:4a248be4647870601310afe268b1748a9b385784eed32c9ef10143a743da133f

Observation 85c84855-85be-479e-8369-f623731c2b37 · outbound

This paper cites AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.480656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.480656Z digest=sha256:32823c9133a466fc648ff6f245ef35b2244f7daabdaf2025bc34efa6c8d10434

Observation 8c4b9a5f-d5a4-45d1-919a-91266192c326 · outbound

This paper cites PSYDIAL: Personality-based Synthetic Dialogue Generation using Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models PSYDIAL: Personality-based Synthetic Dialogue Generation using Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.484935Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.484935Z digest=sha256:c1bf20f2724f053475e80744477b2e5a340b07e706dfdd0622d81a1e95cb2d2b

Observation 71699409-6c52-4815-b287-0100bb3583e4 · outbound

This paper cites WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.488786Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.488786Z digest=sha256:d49bb9c66ba9a176eb149837d532170b916390349cbb26cb66cef877ab6a5ce1

Observation 1a55112a-06ca-4296-8653-437f387680fb · outbound

This paper cites Safety and Fairness for Content Moderation in Generative Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Safety and Fairness for Content Moderation in Generative Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.492603Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.492603Z digest=sha256:112bec531f33e335fff3574e6ff4209eac7f423f73ce2aa4bd925516edf529b8

Observation ceb7cea7-f718-4b45-ae01-9dcfd5476e8a · outbound

This paper cites ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.496758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.496758Z digest=sha256:6460d93f878da9fd1d879dfe8371ba59585363b4ce50305d65acff4eb059b7b2

Observation 80eab3e1-19f5-47d3-aee1-529c4eb0de6e · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.500552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.500552Z digest=sha256:9798e6caf8cf5f9f3ebf886f8ce913c5c7e077c02e20273ec6bd717fa741f641

Observation d97c74d2-471a-4031-8b89-df584e805985 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.504517Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.504517Z digest=sha256:e300df56dd4c7232b00379ee8d3f976a9030068d213579e051bc3df445d1e7b9

Observation 2c5cdccd-8705-4784-986e-73c41b9a126a · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.512379Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.512379Z digest=sha256:040802cbb08eb7309c3492346fd10c4c99fadfde872626b8497d6b26145ebe60

Observation 83671a80-ab37-4280-bcb0-2c204f4364fe · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.515891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.515891Z digest=sha256:15f897b558c01e90d17f0c305fe707c41e33f2e6e47ae226415cd8f0e4a9d7e1

Observation 0aa60e10-6101-4e65-8127-f1aadc56bad8 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.519442Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.519442Z digest=sha256:67c2ed9e06c45ac34856b7e307e17424c76c34884709c030029bdc8a341f4fbe

Observation f4c98dc4-5aa3-46e1-ac3b-58ba065cbbcb · outbound

This paper cites SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.522947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.522947Z digest=sha256:029c19f165ddcdb7a3259533279bbfd9d47246f9c6e341c20bda895d12b5fa80

Observation 2eaee460-0851-49f9-97b8-4f65e3d40154 · outbound

This paper cites On Calibration of LLM-based Guard Models for Reliable Content Moderation.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models On Calibration of LLM-based Guard Models for Reliable Content Moderation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.526754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.526754Z digest=sha256:3c0da5bdf5a8435c127fa17193a3a9cf022613f76ad45ab4f4c1fc6eef2cf247

Observation 321ba483-a5e6-48ee-a7f7-dadac95ae4d4 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 23

Resolution
verified exact
doi, observed 2026-08-04T19:58:31.965104Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T19:55:56.530430Z digest=sha256:1fa923c4117b4304703f4f06a6f89f492d14698d9b4891ba9fc43c85401968fe

Observation 290d5c75-db84-4713-a7ac-7cc98a315ee4 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 24

Resolution
malformed identifier
no resolver link, observed 2026-08-04T19:55:56.534097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.534097Z digest=sha256:3d5aa5a89f198cb67c843609d48d0b6edbc08638ab0eb8ea6e759fdb83957d36

Observation 8b792521-3269-4505-9d2d-ce27c1d486fb · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.537697Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.537697Z digest=sha256:7a358a4f2ab5ceb0f36d1b2bfa931613b127c9aef7de483745613b89e4f43eda

Observation a871477d-09bd-41bc-835c-b9f0e4c38e04 · outbound

This paper cites HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.541068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.541068Z digest=sha256:2dbd790e2382e27ed37ed6aeead33c927d3a87cd6a1398d41044c286bfc4965f

Observation bbabf8bd-3ce8-43a6-8cc9-f882708e390f · outbound

This paper cites Benchmarking Llama2, Mistral, Gemma and GPT for Factuality, Toxicity, Bias and Propensity for Hallucinations.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Benchmarking Llama2, Mistral, Gemma and GPT for Factuality, Toxicity, Bias and Propensity for Hallucinations

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.544665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.544665Z digest=sha256:7dbd60d0d21a6839ea5d3f6c85d8633179ed1390eef2b5ee78773a5669170fa2

Observation 3981cd43-c751-4627-810a-b9e4ba610def · outbound

This paper cites CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.548322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.548322Z digest=sha256:a223b7f9b9a013112da5b9856840227e5e2646ca47214028b0f5f851d9961247

Observation 6b546276-c361-4041-a1d3-dc6dca48d2cd · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.552071Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.552071Z digest=sha256:cf504871674c94f8ac64908400cc726fc65a04044b0c91c55a34d1bd8020f0fc

Observation 6624f39e-7fbc-4798-bfdb-0574960a90fe · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.559507Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.559507Z digest=sha256:0c6c73bd5b2d3a4b847f0b1d969e421af4f8f1e9fb8a71eaf07b87f71e53821d

Observation e54d6e74-ee80-40bf-a184-2faaba1ed875 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 31

Resolution
verified exact
doi, observed 2026-08-04T19:58:31.677871Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T19:55:56.563193Z digest=sha256:84e644f8234ddb15d12a52507f6f46f5584adb5a24edce16d94bb04ac7d755c1

Observation 1f2907e8-80e7-49cb-bf5a-924663dcc5b7 · outbound

This paper cites Toward Safe Evolution of Artificial Intelligence (AI) based Conversational Agents to Support Adolescent Mental and Sexual Health Knowledge Discovery.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Toward Safe Evolution of Artificial Intelligence (AI) based Conversational Agents to Support Adolescent Mental and Sexual Health Knowledge Discovery

Reference 32

Resolution
verified exact
local_arxiv, observed 2026-08-04T19:58:31.442164Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-04T19:55:56.567091Z digest=sha256:e791780b308f31835c98c84973ba00cfbeb98fc773ef3788a0a7f629ea8282ab

Observation 0459af65-f013-48df-8282-12b1d11d179c · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.570965Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.570965Z digest=sha256:24932a4998d8c83ad30d0af788392edae8c1a25a8e00e4eb9973384d21b44b16

Observation 40abc098-91e8-4218-ba1a-4615bd073004 · outbound

This paper cites ALERT: A Comprehensive Benchmark for Assessing Large Language Models' Safety through Red Teaming.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models ALERT: A Comprehensive Benchmark for Assessing Large Language Models' Safety through Red Teaming

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.574549Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.574549Z digest=sha256:98683f4b765cd0414dd45fced9a7cba6109411e9593df9feb6ccd299c76e2805

Observation 143a19bf-a05e-4009-a357-8532e9db4600 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.578358Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.578358Z digest=sha256:120263b63d4eeb335e4e2bc5d74730672db97db5195dc10170279838438d0e31

Observation 5fb4048d-bc8e-49e2-b7ce-73c6c5f11954 · outbound

This paper cites SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.585528Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.585528Z digest=sha256:4f6ff9b278456e2f1a2c7a5b070e0b0f469d3ef81a015bcaf85f8303c0d97d77

Observation a0c037c2-d332-4f11-90b6-cb9749e2be3c · outbound

This paper cites WizardLM: Empowering large pre-trained language models to follow complex instructions.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models WizardLM: Empowering large pre-trained language models to follow complex instructions

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.589081Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.589081Z digest=sha256:d099832d774c3f74a60a2b1ee2d2b899ec6844e75456ae38102ca0e6e2008554

Observation a68fb491-d2d7-467b-ab7f-cc006bd04620 · outbound

This paper cites SC-Safety: A Multi-round Open-ended Question Adversarial Safety Benchmark for Large Language Models in Chinese.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SC-Safety: A Multi-round Open-ended Question Adversarial Safety Benchmark for Large Language Models in Chinese

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.592772Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.592772Z digest=sha256:ae0082edddda958176cf7dbec982370bd938447e38659bbf0569a35ed4c185ec

Observation ee0120c3-fda3-43a0-9a67-6ba4df4f5931 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.596701Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.596701Z digest=sha256:bfb3c519e026d38d448c12303c4f69c1babb49019d2bc92a83e6b2457150f63c

Observation fa75ef03-97f1-45ba-89fb-3dbcf4daeaf7 · outbound

This paper cites Understanding Generative AI Risks for Youth: A Taxonomy Based on Empirical Data.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Understanding Generative AI Risks for Youth: A Taxonomy Based on Empirical Data

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.600400Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.600400Z digest=sha256:e1708a87a29071216bbee4a4319c6ff844c539c11279640505ef96d4d70a70db

Observation f8087318-fffc-4214-90e8-3dd59136adf1 · outbound

This paper cites Exploring Parent-Child Perceptions on Safety in Generative AI: Concerns, Mitigation Strategies, and Design Implications.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Exploring Parent-Child Perceptions on Safety in Generative AI: Concerns, Mitigation Strategies, and Design Implications

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.604134Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.604134Z digest=sha256:b2a907655665082a1107a0f50010d23b9ae3f0221f9e706204332fe446aff1d0

Observation 4d32f22f-ce66-49cd-b9fd-ac8d1e2ec432 · outbound

This paper cites SafetyBench: Evaluating the Safety of Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SafetyBench: Evaluating the Safety of Large Language Models

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.607844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.607844Z digest=sha256:072fcbf848ac6334b0e7cc76d34dba68e0c1ee7175e7b1815a8dacae726d8d34

Observation 5a72bd2a-de2b-46e9-a8ba-235be6657ca2 · outbound

This paper cites LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.611443Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.611443Z digest=sha256:299ec73c1c24f5b6eeb0c16265ff408c01cacbfd39ef2b90d6091f658303c4b9

Observation 2d0ee98e-a276-4727-9f4f-6ff2c3030798 · outbound

This paper cites InProceedings of the 25th international conference on world wide web.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models InProceedings of the 25th international conference on world wide web

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.555783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.555783Z digest=sha256:7e6db8eaf26a4395009bf653edd8c7343b64e0760a67acef209478668d9ec817

Observation d324e459-e43f-407b-a930-f83a8df74de5 · outbound

This paper cites RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.476519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.476519Z digest=sha256:74b36216e159144de9c71727849cc3144c3d49f5336620425e88dda6701e4be9

Observation d343159e-61e0-4b36-891a-d93de8ad145f · outbound

This paper cites Emergent Abilities of Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Emergent Abilities of Large Language Models

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.581905Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.581905Z digest=sha256:d4818112360e2f235474d7db0ba69dc484871c761043ad802b8675d960f6c404

Observation 251836f7-99fe-4a2d-ace3-865553890023 · outbound

This paper cites Faithful Persona-based Conversational Dataset Generation with Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Faithful Persona-based Conversational Dataset Generation with Large Language Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.508575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.508575Z digest=sha256:f6c5f801f56d2f9c22a824b645366c8e2613f649b15a08b425bb0f8507cda909

Pith citing papers

No inbound Pith citation observations are available.