Pith. sign in

Paper Citation Record · LEDGER

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests

As of 20 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 2 inbound Pith citation observations for arXiv:2502.06867.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.06867 v1

Coverage vector

measured 62 of 62 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-08T19:21:19.261269Z

measured 64 of 64 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-01T14:45:42.876760Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-22T01:20:51.933250Z

Reference resolution

62 of 62 outbound references displayed

  • verified exact2
  • verified fuzzy15
  • unresolved44
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation dbe955ae-1107-4c8a-bacb-47a8f4ae682b · outbound

This paper cites Benchmark Early and Red Team Often: A Framework for Assessing and Managing Dual-Use Hazards of AI Foundation Models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Benchmark Early and Red Team Often: A Framework for Assessing and Managing Dual-Use Hazards of AI Foundation Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:18.977393Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:18.977393Z digest=sha256:0e035be080e970a5705e77c4fdca77e52ee05782e611a48513f85c75e655d055

Observation 9ed0c418-1c4c-44b4-946b-b29d5bc43789 · outbound

This paper cites Adversaries Can Misuse Combinations of Safe Models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Adversaries Can Misuse Combinations of Safe Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:18.980851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:18.980851Z digest=sha256:6039ad22f0a313fca140907ba1f643ef50362ad22862ea74eac8cf96dfd439e4

Observation 039ac423-8e6e-4165-a7eb-c26dca054a9e · outbound

This paper cites Hazards from Increasingly Accessible Fine-Tuning of Downloadable Foundation Models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Hazards from Increasingly Accessible Fine-Tuning of Downloadable Foundation Models

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-08-08T19:21:19.435175Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:18.983898Z digest=sha256:e0611c87141daae946f3f334c5fcff5fcacb6001f61b481fd0d14a78193abd49

Observation 8d03ed14-e472-4add-a81e-40852ce8cfd0 · outbound

This paper cites Defense Priorities in the Open-Source AI Debate: A Preliminary Assessment.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Defense Priorities in the Open-Source AI Debate: A Preliminary Assessment

Reference 4

Resolution
verified exact
local_arxiv, observed 2026-08-08T19:21:19.424997Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:18.986908Z digest=sha256:0f8077b9d1a183a387603c401dafbc78a3f6803c5cf4b09e21e208f530b5fa41

Observation de131ff2-0e55-4cdb-bd0f-12581a6b08dc · outbound

This paper cites Control Risk for Potential Misuse of Artificial Intelligence in Science.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Control Risk for Potential Misuse of Artificial Intelligence in Science

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:18.989739Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:18.989739Z digest=sha256:51d866952d18048ab9dd8a0c857e101f34fa8a136b8712aced5aaf6dfe1c7d7b

Observation e4e6a693-7264-4b03-92ed-67716ab05ef7 · outbound

This paper cites HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:18.992928Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:18.992928Z digest=sha256:e5975e3aa1f23dc2c38658e6908f9840624c0f02c6f0d2270e8202342a11c417

Observation 733f9edd-a103-4b37-b22e-631eacf22603 · outbound

This paper cites An Overview of Catastrophic AI Risks.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests An Overview of Catastrophic AI Risks

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:18.996829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:18.996829Z digest=sha256:268ca7aeaebc0c682e52d10b54d18e951c7fdf7d2fe779ccb0d871b9b66d291b

Observation b4b1312c-51f3-43cb-b750-05173ca6efc2 · outbound

This paper cites Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.000586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.000586Z digest=sha256:c5c99f077aaa22f7149affac45b62394fb9adf9ed9b0ea86cda8f51d5035cafd

Observation 2684cff5-a8d2-41ca-b436-99accad025da · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.742322Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.003963Z digest=sha256:bbd2712b8f1b2c44b6ac6a3a6d42a68bc9810e9949e4ab320d76e11b6898b32a

Observation f617b400-b5a7-4967-a481-894f907de102 · outbound

This paper cites Emergent autonomous scientific research capabilities of large language models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Emergent autonomous scientific research capabilities of large language models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.007290Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.007290Z digest=sha256:3e4c63709c90d5168cb983df61efef0048ab21d85bd25f857d1816a2c8427293

Observation 39427626-96cd-45f7-b29e-4926c68eb168 · outbound

This paper cites Emergent Language: A Survey and Taxonomy.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Emergent Language: A Survey and Taxonomy

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.103143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.103143Z digest=sha256:721cf0ac1c6945650164f6bcf64c0d763d8374d12b882191ffe1dfbb4af9a8a0

Observation ff05affc-bf86-4205-a8b7-80620f1f1db2 · outbound

This paper cites A., Caliskan, A., Liyanage, S., & Banaji, M.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests A., Caliskan, A., Liyanage, S., & Banaji, M

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.734559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.106974Z digest=sha256:c1a7663c0e091c6837b7bfb1de4aaf74949f8cc19d54a0a0b1eff444bcd99383

Observation e5039700-dae9-4cc0-926f-3404a875901c · outbound

This paper cites J., Kaplan, D., Ren, Z., Hsu, C.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests J., Kaplan, D., Ren, Z., Hsu, C

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.726864Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.110567Z digest=sha256:c16b025910d5868a8aff57f099fb3b50682df704968ceca21cbf850d684648d5

Observation b74659b5-d7e7-420b-83d1-f12092732622 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.719005Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.113931Z digest=sha256:928c0dc311a217549d19352c639478fb3aa9b163611d879af02fa69587cfe442

Observation f9932c7e-a28c-401f-9fe9-64218e7754a1 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.711338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.117101Z digest=sha256:08685bb8e718db979e348563f51a8a0fcc3ca7dea8c84123728ba7cc14910181

Observation d1db077f-503e-4eae-9c25-24f001ecb6a0 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.703674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.120535Z digest=sha256:1964529f4caaa7568ca44d922f808c6a5bbaaf6a566b838662ec09770fc178d0

Observation 434fe21e-5040-42c6-87bc-a6b898ddc71f · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.695182Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.123823Z digest=sha256:f0ee47ffdee3662ec9e882199679ae618cf98266d3da908bef51d8e777db21b1

Observation e67b5b15-8613-41b6-8f52-7b5cf9eaefc6 · outbound

This paper cites OR-Bench: An Over-Refusal Benchmark for Large Language Models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests OR-Bench: An Over-Refusal Benchmark for Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.126985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.126985Z digest=sha256:a50b575de7d879e6689865cf545e5a7eaf390b63fd868b0a95818cd5d74fd69f

Observation 4edab477-976c-45f3-aabe-a4cfe1f36a36 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.687582Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.130787Z digest=sha256:2e63267632dfcaa1169d6a971880bb6e22af51ad96d9a12574ed1ee1b4dc4bbd

Observation 99e748b6-a813-4ae1-bd9b-7daf04612e88 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.680956Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.133963Z digest=sha256:1b2103c4ae925b48088ee40c97f878b0090c6f274df73f8acffccd75ca14d3fa

Observation 97659b8a-d5bd-486d-83fd-10fb7c270555 · outbound

This paper cites Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.137233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.137233Z digest=sha256:5129e68b1d048791aee3e62ca1aa554d716f3f3aaeacb4c06efbb2fc6cecd97d

Observation edfd4c34-154b-4fac-9aec-73ecd36b53cc · outbound

This paper cites J., & Wick, M.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests J., & Wick, M

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.674298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.140410Z digest=sha256:6d7dbbed65802bd3d232ffdbd878982c096188aae18b05ea60039e4e330f433f

Observation 3beb04eb-39ec-44cf-bd17-2bac03f6d8c1 · outbound

This paper cites POROver: Improving Safety and Reducing Overrefusal in Large Language Models with Overgeneration and Preference Optimization.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests POROver: Improving Safety and Reducing Overrefusal in Large Language Models with Overgeneration and Preference Optimization

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.143563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.143563Z digest=sha256:416a29033f6bbeef5eb494ee74a28fd4fa4fa61c901b0a2a5fc307c3fb4a810f

Observation 0503e350-69ab-4040-9474-d413bfc24ec8 · outbound

This paper cites Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.146827Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.146827Z digest=sha256:ec443547b611c82e16a76c309d98d4a28db88f9e0f807190ddc763a1c05ed95a

Observation 3087a14e-c766-4a59-b8b0-d9a0e8a861d2 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.667729Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.150334Z digest=sha256:e37761f9ebaa7841423f182deaa115c59d45ba06b8865e931ad42ed6e71ff8fb

Observation cc75fb0e-a32f-46d6-bedf-0ae9e2acca5e · outbound

This paper cites Can large language models democratize access to dual-use biotechnology?.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Can large language models democratize access to dual-use biotechnology?

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.153433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.153433Z digest=sha256:a4f7174186192afe171bddb827c2a16ccba1fc01da60cb314217f4dce7e218cd

Observation 5e4ce984-71d0-4a24-8fc2-354289a40960 · outbound

This paper cites The Reality of AI and Biorisk.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests The Reality of AI and Biorisk

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.157071Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.157071Z digest=sha256:04ba42e8b059fb70ffba677b9d13ca42715a4de896fe5c3c8e04e2b15d7a3c10

Observation 9f98ae51-7924-4007-ae1b-9f5ec35e1d84 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 28

Resolution
malformed identifier
no resolver link, observed 2026-08-08T19:21:19.160347Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.160347Z digest=sha256:80516cc5b2725f38b3f4d7f0bae38fd3e6ed62cdf944f64f4e509afeffd439b0

Observation 20c8e7c3-5664-4860-ba33-0cdb2596ac2e · outbound

This paper cites H., Rocha, R., Cordova, K., Specter, M., & Esvelt, K.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests H., Rocha, R., Cordova, K., Specter, M., & Esvelt, K

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.659994Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.163061Z digest=sha256:6a2a184610c40ed207dc408564e2b14776a7900863f82a2cf2e2ab0be6087981

Observation 534a0b96-fa5f-46af-8d1b-5d2c769967a5 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.652162Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.165474Z digest=sha256:d2f6e647d56abc95bb63e590e562730beac56f816eba190ca895b8de78060664

Observation db6dd4e7-ed62-4e45-9684-f88c32225e1a · outbound

This paper cites Will releasing the weights of future large language models grant widespread access to pandemic agents?.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Will releasing the weights of future large language models grant widespread access to pandemic agents?

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.167805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.167805Z digest=sha256:b24596d4c5c428508d1453ff53dff2105421a73db7a215a399876a71a01268f0

Observation 847b202b-b044-492c-8ded-eb0f5cdf655b · outbound

This paper cites Prioritizing High-Consequence Biological Capabilities in Evaluations of Artificial Intelligence Models.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Prioritizing High-Consequence Biological Capabilities in Evaluations of Artificial Intelligence Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.170579Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.170579Z digest=sha256:f523411e4d200c0c042db5bf4ab04a8addbaaa4b3459ee768afee2998a447ad6

Observation c55da87b-582f-40a9-b76c-57885508d326 · outbound

This paper cites Towards Responsible Governance of Biological Design Tools.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Towards Responsible Governance of Biological Design Tools

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.173371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.173371Z digest=sha256:26c8768772fa911e9520af869a3312198a72768b69e414129a61e5fdf82006f1

Observation e6dc54b5-35a0-4c2a-b428-bdb0d36abb73 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.644747Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.175928Z digest=sha256:9a273d1ddea7eaceeceacb2649827bf8886268cc39145b2b9702c4dcc3adbfb9

Observation 7e635a9a-e18e-4af6-af7f-45a4222334c0 · outbound

This paper cites LAB-Bench: Measuring Capabilities of Language Models for Biology Research.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests LAB-Bench: Measuring Capabilities of Language Models for Biology Research

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.179354Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.179354Z digest=sha256:8e7f1d6bcd01a23eb6aa6745add2977e6060f8aafca71103fac80ddd81689266

Observation 02a83956-c979-4585-aca1-ed9482a10ff6 · outbound

This paper cites T., Martin, F.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests T., Martin, F

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.637172Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.182660Z digest=sha256:6884a4877156c4fc50f38ce3b3be27c32c7c2e9bb10d74f517ea336222af6b85

Observation 87873364-4b4c-49f2-bda4-3e645e0bd11b · outbound

This paper cites Are large language models superhuman chemists?.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Are large language models superhuman chemists?

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.185989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.185989Z digest=sha256:d76f19d153f4ec98aa7373a7d23de9b4ed66246f82314f29e847dc5a10c0d316

Observation f7cc2bbf-a230-4360-93f0-a9c784beb9aa · outbound

This paper cites M., Ai, Q., Al-Feghali, A., Badhwar, S., Bocarsly, J.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests M., Ai, Q., Al-Feghali, A., Badhwar, S., Bocarsly, J

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.629717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.189391Z digest=sha256:3b1bbe760a3175637a261c00ff15bdb2f811fd68dfe5793c16f78172deb01f78

Observation 8e9c0b36-8504-423d-8708-66dbd787a183 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.622247Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.192470Z digest=sha256:21a877dbed1071a11f1562d2bb0449c320f5fd3d76c8fe8aa7515ec4042c09a7

Observation 8f4b8a26-4641-4beb-8258-e0c66b8b89ee · outbound

This paper cites ChemCrow: Augmenting large-language models with chemistry tools.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests ChemCrow: Augmenting large-language models with chemistry tools

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.195323Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.195323Z digest=sha256:7b8110233c694c45f74cd5b1e478813ae7b0f59889c54b42f0d46388fcf4207c

Observation 970bf2c9-c02f-4707-b79a-bb651f488530 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 41

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.614699Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.198606Z digest=sha256:541e911e2195be1aa13584107455ef39fd89265243b767f42e2d2ecd9137095a

Observation c50aa7a0-fd55-4340-af73-2d043dbf4898 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.607066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.201482Z digest=sha256:86aed842a95bca339485751c69d794d3d0d940971711dc1c3cfeb38bfa9884b0

Observation 410d2cc5-dc9e-4377-875b-e3aac538351f · outbound

This paper cites Catastrophic Cyber Capabilities Benchmark (3CB): Robustly Evaluating LLM Agent Cyber Offense Capabilities.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Catastrophic Cyber Capabilities Benchmark (3CB): Robustly Evaluating LLM Agent Cyber Offense Capabilities

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-08T19:21:19.204591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T19:21:19.204591Z digest=sha256:40a2e46ab63176418cd99b01cf09352bda24b027791ac2b5b5ec0d402ce25870

Observation 4096174b-5367-48b0-a3dc-560a7180a7d2 · outbound

This paper cites (2016), https://slate.com/technology/2016/06/microsoft -ceo-satya-nadella-humans-and-a-i-can- work-together-to-solve-societys-challenges.html.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests (2016), https://slate.com/technology/2016/06/microsoft -ceo-satya-nadella-humans-and-a-i-can- work-together-to-solve-societys-challenges.html

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.599157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.208004Z digest=sha256:f7975747ce193043ea4dabe6f0abdb21350b780b6ff9df8fd522e2fbfbddc18a

Observation ee28cb60-0e07-47f9-951a-632e13099398 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 45

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.591174Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.210919Z digest=sha256:043fe773f491447a7637d6e99794546145f8aa3652a2d20756b61db48a6b1027

Observation d3e404db-8051-498b-a8a4-b4f31fb0a9d8 · outbound

This paper cites https://github.com/reveondivad/forbidden.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests https://github.com/reveondivad/forbidden

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.583410Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.213946Z digest=sha256:e4767dc50e4623820e13e1a0ed7157db97f0212dfeb7d5cfdfcc6a53e21ef53f

Observation b1294d24-0ae1-4d6b-9790-f9f90d24c02d · outbound

This paper cites (2024), China's Military Is Using Meta's AI.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests (2024), China's Military Is Using Meta's AI

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.575094Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.217051Z digest=sha256:646a4c4fabb0723b6d04f8fb69830d67500cd67dafffd332c64c059237c501c1

Observation c763211d-21f8-4648-9691-53339c23064f · outbound

This paper cites M., Grisham, A.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests M., Grisham, A

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.568010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.220023Z digest=sha256:d9be80348b76d66984609da002326e457e9467be9aa9cc960c24b664a2743db3

Observation a7867bbe-4b5b-4f54-97a9-97293fedabba · outbound

This paper cites W., Luo, J.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests W., Luo, J

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.561483Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.222933Z digest=sha256:726a2592a18c4dba4fd8bb13ef7de1d71606c208ec5a6304217a4a55e51e92bd

Observation 7957d511-c3c9-4acd-8455-7148767490a6 · outbound

This paper cites How may entropy be reversed?.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests How may entropy be reversed?

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.554726Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.225942Z digest=sha256:77b4f8ff12446ee787a02b7a4e952351097bae67be0ab017f759e0adf9652c37

Observation ca951867-4bdc-432b-914f-d9d579d2e622 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 51

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.548237Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.229313Z digest=sha256:7327804fb3dc59ca326f48e55bbaf40b295da0193f35516ec7677e68bec4063e

Observation ba98d859-e8b1-4630-8c59-2fc2657e13a5 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 52

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.540506Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.232314Z digest=sha256:636ee048f2db04479cb5ee52e1b7fd0365b809ea23d5d26a68e4af4bbd1027cf

Observation 22ed6eb6-5f4d-4ceb-a81a-1d26be0c6e32 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 53

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.532528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.235399Z digest=sha256:d02157c3332b4c745236f4bf444bfa0f1fcc34d42d74159e4dedb25eddd0087d

Observation f3d3b6e7-f00d-495c-94b6-8582353aa1a2 · outbound

This paper cites Grok-2-1212 Chain of Thought: The question is asking for modifications to China White, a form of fentanyl, to make it safer or more effective for medical use.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Grok-2-1212 Chain of Thought: The question is asking for modifications to China White, a form of fentanyl, to make it safer or more effective for medical use

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.524688Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.238643Z digest=sha256:35f30a71f3caf57aa5abdee4c7ac1e8f964dd664c600fb6a7250fde12e0767bf

Observation 05ecdad3-1588-47a6-9308-e3c359fb9d71 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 55

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.516238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.241783Z digest=sha256:b80764a73220446195a75c69f3cf8fc61273f39f18839a68b52bdacb80ea969e

Observation 6dc391a4-eca2-40e9-ba79-d0e3beea9781 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 56

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.508377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.244792Z digest=sha256:41d2514b12d7a75bfb21be949016714742f42a91a568eeed84b9946641083dc6

Observation bd81421e-1a44-4f9b-9646-fdef5315b2be · outbound

This paper cites GPT-3.5 Chain of Thought: To explain the step-by-step chemical synthesis process for (Positional Isomer: MDMB), focusing on reagents and conditions.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests GPT-3.5 Chain of Thought: To explain the step-by-step chemical synthesis process for (Positional Isomer: MDMB), focusing on reagents and conditions

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.500188Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.247813Z digest=sha256:e769a419aac71f3a2a942bbf08ff34239875aeba4cb08d2933bb8063d187e90e

Observation e7407f3a-8cf5-46db-ac18-471aca8631fc · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 58

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.491195Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.250838Z digest=sha256:bc03c48fa83c5b264a78ddbd670bc3aeab26a0da8d8eac08c874824d2ec56dcd

Observation 62ee6f23-a05c-460e-9731-a38c824af56a · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 59

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.482763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.253854Z digest=sha256:2d42b852169494afbb561e24001b1272f944f0910b6f71c40bffdbd4f0bed9e2

Observation a368cb24-c5da-496f-997d-0f24afb7a843 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 60

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.474166Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.256732Z digest=sha256:94b4f4a6f0431f31355bbea63380b0dbf5549f93af72e3d8e71203fdf37bd509

Observation a4924e17-31b2-4d3a-a57f-e51684eab829 · outbound

This paper cites an unresolved cited work.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests Unresolved cited work

Reference 61

Resolution
unresolved
raw_fallback, observed 2026-08-08T19:21:19.466011Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.259007Z digest=sha256:109355e5a517dcce9bfbd24e533407ad9ebe90916fe810078b4382c9d944de72

Observation f4a5649c-a534-467d-a5f4-ca636ad6cb54 · outbound

This paper cites It was primarily developed for medical purposes but never achieved widespread use.

Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests It was primarily developed for medical purposes but never achieved widespread use

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T19:21:19.457691Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-08T19:21:19.261269Z digest=sha256:e23bdea40378fa8f53010690026779a1beb334005226c30dcb360129cd160164

Pith citing papers

Observation 701f45cb-5f99-4851-b73d-42b3d9100d30 · inbound

RefusalBench: Why Refusal Rate Misranks Frontier LLMs on Biological Research Prompts cites this paper.

RefusalBench: Why Refusal Rate Misranks Frontier LLMs on Biological Research Prompts Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-05-22T01:20:51.936763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-22T01:19:00.268857Z digest=sha256:02ff48b7cef48301b8e69f35f636a5053d1fa2fae75e61d4c2900b608fafa2c2

Observation 91d7766a-eb62-46cc-ad99-16ce7dc6da29 · inbound

SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring cites this paper.

SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-01T14:45:42.876760Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T14:45:42.876760Z digest=sha256:f8b94dfc6460e72d120d302fd47f4217f91ca7126c2f02690a93eb4e97a58a2b