Pith. sign in

Paper Citation Record · LEDGER

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models

As of 14 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2509.08997.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2509.08997 v1

Coverage vector

measured 47 of 47 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-04T19:55:56.611443Z

measured 47 of 47 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

47 of 47 outbound references displayed

  • verified exact3
  • verified fuzzy0
  • unresolved43
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 0f9608bf-c76b-4077-b59d-2bae611432c6 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.435129Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.435129Z digest=sha256:87c5ef360abe7c936088838c0124843a2235570e0d66bcccc36ca99bbe249662

Observation 40d3c938-1881-4761-90b6-4ca3f0fa9bf0 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.439641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.439641Z digest=sha256:bf793fbc417cd51d22acb5c3b88dd84d5ec16bf94deae75c361eaf29a6b2f48d

Observation e3a0654f-c9da-4710-8c90-1af1a139ff1c · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.444021Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.444021Z digest=sha256:6c8327ad4751ee1f8040bad37ce1efdb4c1ffa63ef3d77cf317c9e47267bb70b

Observation 300e2c2c-d4c9-436f-bcca-ac823f9f6ff9 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.447986Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.447986Z digest=sha256:7b6732951a15d64c5229eb6f7b2ef78632e7cfbb28b2028a1ea245d330f281c1

Observation aec61d3c-2a8e-4c97-8ffd-86e54e187442 · outbound

This paper cites Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.451863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.451863Z digest=sha256:fe27e96752d4d638afebb974b3fd6f0dd6d3cd961d349074186159c9e9445c65

Observation 0338ff4d-f339-41c6-b5bc-b772e015a866 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.456135Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.456135Z digest=sha256:9bd928ed02cab41d93df6a37e0cab8e2b7a2e46bd44eef4f43dc75ec65c53df4

Observation f63a1b9f-bf10-496c-af60-f94804011281 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.460400Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.460400Z digest=sha256:ee9f5e5c3c5936f9617199ca3119fa7f3b2ac8776d93e5b66a702f9468fb9472

Observation 1555aad5-4680-4977-b859-51c2baa6606c · outbound

This paper cites Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.464199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.464199Z digest=sha256:dbfd728fa76cc3faed242e3612884d0dc07d08742f9eed5709ae102f95036a2f

Observation f00d6933-57f9-4176-918c-24f41037209a · outbound

This paper cites Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.468210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.468210Z digest=sha256:8d8c8bf63a22d8e1061705b4e251cb5b50e893ce8c12a64909248d7b02f1e90d

Observation f5a16fcf-69ac-4913-b57e-3d6db52891d9 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.472412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.472412Z digest=sha256:8ef281110b8fa79ad52996cae1d4de23e87037b8b3fc49ff54367a7743b74136

Observation 85c84855-85be-479e-8369-f623731c2b37 · outbound

This paper cites AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.480656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.480656Z digest=sha256:3ef1012f45e4f7dc39bcd10fa3bb72e66fdffe0b0a78cbdd1b979d1305d42765

Observation 8c4b9a5f-d5a4-45d1-919a-91266192c326 · outbound

This paper cites PSYDIAL: Personality-based Synthetic Dialogue Generation using Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models PSYDIAL: Personality-based Synthetic Dialogue Generation using Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.484935Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.484935Z digest=sha256:1bff30d6753607e24e4c3376e635cab4b3d8189b4423b4d0f12b15f1a7439023

Observation 71699409-6c52-4815-b287-0100bb3583e4 · outbound

This paper cites WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.488786Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.488786Z digest=sha256:3dc28288fe6b0785010412ee796f6ba7fdee5b6f87ce213382b81ec3e63daeb7

Observation 1a55112a-06ca-4296-8653-437f387680fb · outbound

This paper cites Safety and Fairness for Content Moderation in Generative Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Safety and Fairness for Content Moderation in Generative Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.492603Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.492603Z digest=sha256:99ffce9b323fc632a9cc9639ddc881ff6ac4d03de7f050100a0188a8558e92db

Observation ceb7cea7-f718-4b45-ae01-9dcfd5476e8a · outbound

This paper cites ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.496758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.496758Z digest=sha256:a4705fcc77e6ee447b8d434ab66e34ded39dc8d5f2ee42f1d7845669a9af2171

Observation 80eab3e1-19f5-47d3-aee1-529c4eb0de6e · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.500552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.500552Z digest=sha256:766733d869136a44ef1590bf75e4abd4bd154c8f9db8cabcf837510edec34680

Observation d97c74d2-471a-4031-8b89-df584e805985 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.504517Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.504517Z digest=sha256:c37af552b6a760b970cc2649b98851d0f3934bfc922b1acfdf430ed9fbe97596

Observation 2c5cdccd-8705-4784-986e-73c41b9a126a · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.512379Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.512379Z digest=sha256:2d1656e72506b1d7a30fc9fdb444d2a3f83c8df87e67dc1692b2d80d4553a415

Observation 83671a80-ab37-4280-bcb0-2c204f4364fe · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.515891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.515891Z digest=sha256:b49f3ee903ed5c63816a7b857625736588befff58b57b281e50432b0b2b2b0f7

Observation 0aa60e10-6101-4e65-8127-f1aadc56bad8 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.519442Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.519442Z digest=sha256:cf67f42245e6cda0a7885157f7576e9e78c51ef795631a8ae7c188988eb83a36

Observation f4c98dc4-5aa3-46e1-ac3b-58ba065cbbcb · outbound

This paper cites SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.522947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.522947Z digest=sha256:c152ff8bf729ee539397ea8bb16719b010093c0490d2188ce479d43c19e2112d

Observation 2eaee460-0851-49f9-97b8-4f65e3d40154 · outbound

This paper cites On Calibration of LLM-based Guard Models for Reliable Content Moderation.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models On Calibration of LLM-based Guard Models for Reliable Content Moderation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.526754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.526754Z digest=sha256:7ca80507b3e7cdd776c33e0ac99b14862bf256e089643926283618d2802a4845

Observation 321ba483-a5e6-48ee-a7f7-dadac95ae4d4 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 23

Resolution
verified exact
doi, observed 2026-08-04T19:58:31.965104Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-04T19:55:56.530430Z digest=sha256:39d15c15ac1b0085fdbeb74935feb5f7079aca5d6007b4a203918a40fa0ef05b

Observation 290d5c75-db84-4713-a7ac-7cc98a315ee4 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 24

Resolution
malformed identifier
no resolver link, observed 2026-08-04T19:55:56.534097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.534097Z digest=sha256:1b8a4d3fd6713e03f888e62d7060bdef011baccdb5fe06cb7ee0f00b7f09b546

Observation 8b792521-3269-4505-9d2d-ce27c1d486fb · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.537697Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.537697Z digest=sha256:cf5971d95ea856e07c90a356e1fc43289554811ae58713ec9da4ae30cc6fa49a

Observation a871477d-09bd-41bc-835c-b9f0e4c38e04 · outbound

This paper cites HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.541068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.541068Z digest=sha256:d964637a61285de921fe0d48e7620a3e1baed95351d886b40267b6bfaeb307a4

Observation bbabf8bd-3ce8-43a6-8cc9-f882708e390f · outbound

This paper cites Benchmarking Llama2, Mistral, Gemma and GPT for Factuality, Toxicity, Bias and Propensity for Hallucinations.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Benchmarking Llama2, Mistral, Gemma and GPT for Factuality, Toxicity, Bias and Propensity for Hallucinations

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.544665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.544665Z digest=sha256:b67b08000b1371916dbb17d06f869c3eb763a31c9aefe057c0e3eba1e0d43fd7

Observation 3981cd43-c751-4627-810a-b9e4ba610def · outbound

This paper cites CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.548322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.548322Z digest=sha256:bf6f2569058251f224b53750bc5ea60d9430e5d619711f6c59323acf0a9b19fc

Observation 6b546276-c361-4041-a1d3-dc6dca48d2cd · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.552071Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.552071Z digest=sha256:65fe7a3ae02e649675392a29c99a87011a2212248078e02395ac99c068daace3

Observation 6624f39e-7fbc-4798-bfdb-0574960a90fe · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.559507Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.559507Z digest=sha256:fde6dcb223776b9eea4220ce5a46985b171b3259184a2d63ac9248d4f27ad389

Observation e54d6e74-ee80-40bf-a184-2faaba1ed875 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 31

Resolution
verified exact
doi, observed 2026-08-04T19:58:31.677871Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-04T19:55:56.563193Z digest=sha256:3311a6a354630c196779ac42f2dee430219be4e1ae83eaa5102d78285f258fe8

Observation 1f2907e8-80e7-49cb-bf5a-924663dcc5b7 · outbound

This paper cites Toward Safe Evolution of Artificial Intelligence (AI) based Conversational Agents to Support Adolescent Mental and Sexual Health Knowledge Discovery.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Toward Safe Evolution of Artificial Intelligence (AI) based Conversational Agents to Support Adolescent Mental and Sexual Health Knowledge Discovery

Reference 32

Resolution
verified exact
local_arxiv, observed 2026-08-04T19:58:31.442164Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-04T19:55:56.567091Z digest=sha256:a5eb589dc94d0503a082222af78ca4db91a3a2b04fa948f93fec72a9614c10e8

Observation 0459af65-f013-48df-8282-12b1d11d179c · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.570965Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.570965Z digest=sha256:00fa40e6553e3f4c063b8e689308816d30a6cf812b4e82f29a3b8386d71e2b2d

Observation 40abc098-91e8-4218-ba1a-4615bd073004 · outbound

This paper cites ALERT: A Comprehensive Benchmark for Assessing Large Language Models' Safety through Red Teaming.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models ALERT: A Comprehensive Benchmark for Assessing Large Language Models' Safety through Red Teaming

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.574549Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.574549Z digest=sha256:ec6c02e446c0ca9a03bbbd7c3ca117f5768c919281c8a255f40adc9a868a7103

Observation 143a19bf-a05e-4009-a357-8532e9db4600 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.578358Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.578358Z digest=sha256:8ecc27c9a20ea16c781d204d33af6d6c7f06656ccbe632479cd79c886bb28830

Observation 5fb4048d-bc8e-49e2-b7ce-73c6c5f11954 · outbound

This paper cites SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.585528Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.585528Z digest=sha256:cd9cdfc9c9e434b4abcf9ad3b906e7abe86439b3cc23074929d5ad4969018d27

Observation a0c037c2-d332-4f11-90b6-cb9749e2be3c · outbound

This paper cites WizardLM: Empowering large pre-trained language models to follow complex instructions.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models WizardLM: Empowering large pre-trained language models to follow complex instructions

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.589081Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.589081Z digest=sha256:154cbd70156e40a10a5afbc34498aacc48815984ebebf1dd6f08e8daeeee24c8

Observation a68fb491-d2d7-467b-ab7f-cc006bd04620 · outbound

This paper cites SC-Safety: A Multi-round Open-ended Question Adversarial Safety Benchmark for Large Language Models in Chinese.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SC-Safety: A Multi-round Open-ended Question Adversarial Safety Benchmark for Large Language Models in Chinese

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.592772Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.592772Z digest=sha256:554bb0acaea1d040a69c414d54ade0408b673b678f63d94b89830edecbca74a1

Observation ee0120c3-fda3-43a0-9a67-6ba4df4f5931 · outbound

This paper cites an unresolved cited work.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Unresolved cited work

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.596701Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.596701Z digest=sha256:ce8f77917d57c8d57734b3cc86dfcc3b3b3f545f8209254d1f04cf2b86d1bd25

Observation fa75ef03-97f1-45ba-89fb-3dbcf4daeaf7 · outbound

This paper cites Understanding Generative AI Risks for Youth: A Taxonomy Based on Empirical Data.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Understanding Generative AI Risks for Youth: A Taxonomy Based on Empirical Data

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.600400Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.600400Z digest=sha256:08f02d3da8020d202c0b1b2fc8fbcb77d6229de965936895bbe81e3c9c2515dc

Observation f8087318-fffc-4214-90e8-3dd59136adf1 · outbound

This paper cites Exploring Parent-Child Perceptions on Safety in Generative AI: Concerns, Mitigation Strategies, and Design Implications.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Exploring Parent-Child Perceptions on Safety in Generative AI: Concerns, Mitigation Strategies, and Design Implications

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.604134Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.604134Z digest=sha256:95c8ded3bcc77c6610cfd177fb6c3324f33879c16e80c0d8eddcbacb37c19846

Observation 4d32f22f-ce66-49cd-b9fd-ac8d1e2ec432 · outbound

This paper cites SafetyBench: Evaluating the Safety of Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models SafetyBench: Evaluating the Safety of Large Language Models

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.607844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.607844Z digest=sha256:149649b581b3a03cf4053bbffea92b64aaac0ebfc6d23ab14fe11dfd491571e6

Observation 5a72bd2a-de2b-46e9-a8ba-235be6657ca2 · outbound

This paper cites LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.611443Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.611443Z digest=sha256:af212afac0394df7976ae7c7eb2d6bfd0d3600ed5ffc47ef7828c98a044a3c52

Observation 2d0ee98e-a276-4727-9f4f-6ff2c3030798 · outbound

This paper cites InProceedings of the 25th international conference on world wide web.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models InProceedings of the 25th international conference on world wide web

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.555783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.555783Z digest=sha256:35be08bc6b6c07699065813f3642614ae9008aa2b5ad2aea076ebf0ecd4b2c92

Observation d324e459-e43f-407b-a930-f83a8df74de5 · outbound

This paper cites RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.476519Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.476519Z digest=sha256:2058520b38ac913634d1405773fc438c472f248f493acb45756642bfc65318b4

Observation d343159e-61e0-4b36-891a-d93de8ad145f · outbound

This paper cites Emergent Abilities of Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Emergent Abilities of Large Language Models

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.581905Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.581905Z digest=sha256:beea4d0ce63d462066170903182a8351240dc9a79c3f99b92109b0768bb42b5c

Observation 251836f7-99fe-4a2d-ace3-865553890023 · outbound

This paper cites Faithful Persona-based Conversational Dataset Generation with Large Language Models.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models Faithful Persona-based Conversational Dataset Generation with Large Language Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.508575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.508575Z digest=sha256:5f99e3ee0956430ede60eceac8b86fe606afbf6f7090eb0a91a48306e14fc691

Pith citing papers

No inbound Pith citation observations are available.