Pith. sign in

Paper Citation Record · LEDGER

SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2410.03769.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2410.03769 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 9 of 9 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 9 of 9 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-09T00:52:15.445063Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-28T22:32:44.318912Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9aff66a3-9e7e-48ce-84c4-9b778427cf36 · inbound

Synthetic Poisoning Attacks: The Impact of Poisoned MRI Image on U-Net Brain Tumor Segmentation cites this paper.

Synthetic Poisoning Attacks: The Impact of Poisoned MRI Image on U-Net Brain Tumor Segmentation SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-09T00:39:02.344947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T00:39:02.344947Z digest=sha256:deecc4eef016445373cdbfe6ece281fff4d1374ec0267d50e5e206977fdd9bba

Observation 54886824-34ad-400d-8beb-27fbe12fc3bf · inbound

Disrupt Your Research Using Generative AI Powered ScienceSage cites this paper.

Disrupt Your Research Using Generative AI Powered ScienceSage SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-09T00:52:15.445063Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T00:52:15.445063Z digest=sha256:f191982aa77308c2a75c62d165900508ddcdd13f97119372c6f8d7f9920d0178

Observation ba22e312-e5b6-4a40-8636-7634e7a70597 · inbound

Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges cites this paper.

Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 114

Resolution
unresolved
no resolver link, observed 2026-08-06T14:13:06.355306Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T14:13:06.355306Z digest=sha256:37b58d72cdd14a752a5956b29a43d39a1ad7b01d7341244470975697680d9146

Observation 8415bb81-8218-4586-939e-43fd2c93d097 · inbound

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models cites this paper.

Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:03:20.350730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-13T22:02:12.555644Z digest=sha256:26f1ce2bf75e199436389235c26a1c16836fc134cb3fb27e19ae10e1cc85fb49

Observation e9b6d5d4-05ea-4abd-86ce-9bb0281874df · inbound

You Snooze, You Lose: Automatic Safety Alignment Restoration through Neural Weight Translation cites this paper.

You Snooze, You Lose: Automatic Safety Alignment Restoration through Neural Weight Translation SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 82

Resolution
verified exact
arxiv_id, observed 2026-05-11T17:51:08.453910Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-08T17:02:20.836208Z digest=sha256:d253faa0223db79bce27cdb7691ea2459646a4c3259148b327971a5d76a9c553

Observation 759d38ef-2d2c-4d4b-8a3f-4834ce4e5ebf · inbound

Boiling the Frog: A Multi-Turn Benchmark for Agentic Safety cites this paper.

Boiling the Frog: A Multi-Turn Benchmark for Agentic Safety SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-05-22T05:51:08.095653Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-22T05:50:28.114140Z digest=sha256:e34cb2a365362cefc36d804be9c1596ce8a310b7c016aa84d0bd8685cc1a3dce

Observation ee0e3e0a-a89f-4fb1-9be3-9910740fd03a · inbound

Boiling the Frog: A Multi-Turn Benchmark for Agentic Safety cites this paper.

Boiling the Frog: A Multi-Turn Benchmark for Agentic Safety SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-05-25T06:06:43.004475Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-25T06:05:27.736494Z digest=sha256:0155f260b5adaf3dd42f538f76cd7ef795b4e407fd28e85ae38080d87407481a

Observation 3d6d1934-ffba-4c07-953c-bf1b9ba44106 · inbound

Triaging Threats to Specialized Guardrails cites this paper.

Triaging Threats to Specialized Guardrails SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 24

Resolution
verified exact
arxiv_id, observed 2026-06-28T22:32:44.320389Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-28T22:27:44.703466Z digest=sha256:616f826582c4e85e8df6b5a9ebe76a408b78426ff138fe4bd98b2ea6b153316b

Observation e31fda1f-5400-47c3-ab91-91ea0d6153ba · inbound

SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring cites this paper.

SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-01T14:45:42.635020Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T14:45:42.635020Z digest=sha256:c9d234792b0491f7ebcf7e923e3ba85b2adfc4ad6ac89e97b835f903dc72c459