{"as_of":"2026-08-20T13:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ecc50f8246f2e9e0392ba93d4a0619120322aa866416e0172ac4101cc889f9a","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:21:19.261269Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:45:42.876760Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T01:20:51.933250Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"cited_work":{"arxiv_id":"2502.06867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06867","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2502.06867","venue":null,"work_id":"70f3b1da-bcf0-4ce4-aef9-43c20b9b0589","year":null},"citing_paper":{"arxiv_id":"2605.21545","last_updated":"2026-05-20T09:53:31Z","snapshot_observed_at":"2026-08-13T02:25:36.321787Z","submitted_at":"2026-05-20T09:53:31Z","title":"RefusalBench: Why Refusal Rate Misranks Frontier LLMs on Biological Research Prompts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T01:19:00.268857Z"},"links":{"cited_paper":"/paper/2502.06867","citing_paper":"/paper/2605.21545"},"observation_digest":"sha256:5262f8b0b77c32818508bfdfb15b7a50e03fc78456e97f0276235b7bf544ce6a","observation_id":"701f45cb-5f99-4851-b73d-42b3d9100d30","resolution":{"observed_at":"2026-05-22T01:20:51.936763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06867","snapshot_observed_at":"2026-08-01T14:45:42.876760Z","title":"Forbidden science: Dual-use ai challenge benchmark and scientific refusal tests.arXiv preprint arXiv:2502.06867, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18665","last_updated":"2026-07-21T03:25:01Z","snapshot_observed_at":"2026-08-18T14:28:02.800355Z","submitted_at":"2026-07-21T03:25:01Z","title":"SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:45:42.876760Z"},"links":{"cited_paper":"/paper/2502.06867","citing_paper":"/paper/2607.18665"},"observation_digest":"sha256:f8b94dfc6460e72d120d302fd47f4217f91ca7126c2f02690a93eb4e97a58a2b","observation_id":"91d7766a-eb62-46cc-ad99-16ce7dc6da29","resolution":{"observed_at":"2026-08-01T14:45:42.876760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06867/citation-record","integrity":"/paper/2502.06867/integrity","json":"/paper/2502.06867/citation-record.json","paper":"/paper/2502.06867"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.10986","last_updated":"2024-05-15T20:28:15Z","snapshot_observed_at":"2026-08-18T19:11:26.051269Z","submitted_at":"2024-05-15T20:28:15Z","title":"Benchmark Early and Red Team Often: A Framework for Assessing and Managing Dual-Use Hazards of AI Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10986","snapshot_observed_at":"2026-08-08T19:21:18.977393Z","title":"M., Jackson, K., Murphy, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:18.977393Z"},"links":{"cited_paper":"/paper/2405.10986","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:0e035be080e970a5705e77c4fdca77e52ee05782e611a48513f85c75e655d055","observation_id":"dbe955ae-1107-4c8a-bacb-47a8f4ae682b","resolution":{"observed_at":"2026-08-08T19:21:18.977393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14595","last_updated":"2024-07-01T19:58:00Z","snapshot_observed_at":"2026-08-16T13:41:00.662068Z","submitted_at":"2024-06-20T17:43:18Z","title":"Adversaries Can Misuse Combinations of Safe Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14595","snapshot_observed_at":"2026-08-08T19:21:18.980851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:18.980851Z"},"links":{"cited_paper":"/paper/2406.14595","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:6039ad22f0a313fca140907ba1f643ef50362ad22862ea74eac8cf96dfd439e4","observation_id":"9ed0c418-1c4c-44b4-946b-b29d5bc43789","resolution":{"observed_at":"2026-08-08T19:21:18.980851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14751","last_updated":"2023-12-22T15:05:56Z","snapshot_observed_at":"2026-08-16T14:32:11.804520Z","submitted_at":"2023-12-22T15:05:56Z","title":"Hazards from Increasingly Accessible Fine-Tuning of Downloadable Foundation Models","version":1},"cited_work":{"arxiv_id":"2312.14751","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.14751","snapshot_observed_at":"2026-08-08T19:21:19.432351Z","title":"Hazards from Increasingly Accessible Fine-Tuning of Downloadable Foundation Models","venue":"cs.LG","work_id":"ae90ff2c-d386-4198-bab5-29257aea01d7","year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:18.983898Z"},"links":{"cited_paper":"/paper/2312.14751","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:c600c8cdcb1ef25421d69ce9b119e643b8c5e732f4db0ffaacc54594663480fc","observation_id":"039ac423-8e6e-4165-a7eb-c26dca054a9e","resolution":{"observed_at":"2026-08-08T19:21:19.435175Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10026","last_updated":"2024-08-19T14:22:14Z","snapshot_observed_at":"2026-08-16T13:25:30.507048Z","submitted_at":"2024-08-19T14:22:14Z","title":"Defense Priorities in the Open-Source AI Debate: A Preliminary Assessment","version":1},"cited_work":{"arxiv_id":"2408.10026","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.10026","snapshot_observed_at":"2026-08-08T19:21:19.420256Z","title":"Defense Priorities in the Open-Source AI Debate: A Preliminary Assessment","venue":"cs.CY","work_id":"a2b9da5a-a0c9-4372-8ca4-c9daeb9524f3","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:18.986908Z"},"links":{"cited_paper":"/paper/2408.10026","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:84f1f7e8ac1a95f0eb17067c9baecef6439adb7e8efd1937086114bebe01926c","observation_id":"8d03ed14-e472-4add-a81e-40852ce8cfd0","resolution":{"observed_at":"2026-08-08T19:21:19.424997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06632","last_updated":"2023-12-11T18:50:57Z","snapshot_observed_at":"2026-08-19T19:45:04.245143Z","submitted_at":"2023-12-11T18:50:57Z","title":"Control Risk for Potential Misuse of Artificial Intelligence in Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06632","snapshot_observed_at":"2026-08-08T19:21:18.989739Z","title":"& Zheng, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:18.989739Z"},"links":{"cited_paper":"/paper/2312.06632","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:51d866952d18048ab9dd8a0c857e101f34fa8a136b8712aced5aaf6dfe1c7d7b","observation_id":"de131ff2-0e55-4cdb-bd0f-12581a6b08dc","resolution":{"observed_at":"2026-08-08T19:21:18.989739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-08T19:21:18.992928Z","title":"& Hendrycks, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:18.992928Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:e5975e3aa1f23dc2c38658e6908f9840624c0f02c6f0d2270e8202342a11c417","observation_id":"e4e6a693-7264-4b03-92ed-67716ab05ef7","resolution":{"observed_at":"2026-08-08T19:21:18.992928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12001","last_updated":"2023-10-09T22:57:01Z","snapshot_observed_at":"2026-08-19T07:39:47.083802Z","submitted_at":"2023-06-21T03:35:06Z","title":"An Overview of Catastrophic AI Risks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12001","snapshot_observed_at":"2026-08-08T19:21:18.996829Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:18.996829Z"},"links":{"cited_paper":"/paper/2306.12001","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:268ca7aeaebc0c682e52d10b54d18e951c7fdf7d2fe779ccb0d871b9b66d291b","observation_id":"733f9edd-a103-4b37-b22e-631eacf22603","resolution":{"observed_at":"2026-08-08T19:21:18.996829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-17T08:35:42.452149Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-08T19:21:19.000586Z","title":"& Clark, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.000586Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:c5c99f077aaa22f7149affac45b62394fb9adf9ed9b0ea86cda8f51d5035cafd","observation_id":"b4b1312c-51f3-43cb-b750-05173ca6efc2","resolution":{"observed_at":"2026-08-08T19:21:19.000586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.739305Z","title":null,"venue":null,"work_id":"675cfdcf-fc0b-4ef8-9e8b-6e6e04bbcb14","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.003963Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:32261a823d053a8fa7ec0ffdb28dc04f72a5c943a95b0c74d0d0958ab553db6c","observation_id":"2684cff5-a8d2-41ca-b436-99accad025da","resolution":{"observed_at":"2026-08-08T19:21:19.742322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05332","last_updated":"2023-04-11T16:50:17Z","snapshot_observed_at":"2026-08-18T16:42:12.122727Z","submitted_at":"2023-04-11T16:50:17Z","title":"Emergent autonomous scientific research capabilities of large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05332","snapshot_observed_at":"2026-08-08T19:21:19.007290Z","title":"A., MacKnight, R., & Gomes, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.007290Z"},"links":{"cited_paper":"/paper/2304.05332","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:3e4c63709c90d5168cb983df61efef0048ab21d85bd25f857d1816a2c8427293","observation_id":"f617b400-b5a7-4967-a481-894f907de102","resolution":{"observed_at":"2026-08-08T19:21:19.007290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02645","last_updated":"2025-03-07T12:39:10Z","snapshot_observed_at":"2026-08-18T17:04:06.473048Z","submitted_at":"2024-09-04T12:22:05Z","title":"Emergent Language: A Survey and Taxonomy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02645","snapshot_observed_at":"2026-08-08T19:21:19.103143Z","title":"W., Tercan, H., Gopikrishnan, A., De Carvalho, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.103143Z"},"links":{"cited_paper":"/paper/2409.02645","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:721cf0ac1c6945650164f6bcf64c0d763d8374d12b882191ffe1dfbb4af9a8a0","observation_id":"39427626-96cd-45f7-b29e-4926c68eb168","resolution":{"observed_at":"2026-08-08T19:21:19.103143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.731740Z","title":"A., Caliskan, A., Liyanage, S., & Banaji, M","venue":null,"work_id":"95e45b11-c004-4b9a-b4b3-846b5189ca86","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.106974Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:694421ec75d64c28d8a254a65ad83d941570ce45f3f3ad0213213bcd6937f7ef","observation_id":"ff05affc-bf86-4205-a8b7-80620f1f1db2","resolution":{"observed_at":"2026-08-08T19:21:19.734559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.723928Z","title":"J., Kaplan, D., Ren, Z., Hsu, C","venue":null,"work_id":"e1a46586-d4f9-4c0d-98fd-c8f3c4e80d5c","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.110567Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:6d09c20c8f0671812bac21581c927e7de039e3058a534915e61cf6d47aafe837","observation_id":"e5039700-dae9-4cc0-926f-3404a875901c","resolution":{"observed_at":"2026-08-08T19:21:19.726864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.716261Z","title":null,"venue":null,"work_id":"050fbefa-b831-4158-8594-d6c617195b34","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.113931Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:75075b3e0df73de1782e6dcbde946712c1eba19812540bcc3a8d4bee5ec3e996","observation_id":"b74659b5-d7e7-420b-83d1-f12092732622","resolution":{"observed_at":"2026-08-08T19:21:19.719005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.708542Z","title":null,"venue":null,"work_id":"fdd48311-2499-4437-abb9-641019f1236d","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.117101Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:19f888de09374388bcbdb978ffc1bcbbe0c983ab2598bfa4240dd944dc599930","observation_id":"f9932c7e-a28c-401f-9fe9-64218e7754a1","resolution":{"observed_at":"2026-08-08T19:21:19.711338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.700520Z","title":null,"venue":null,"work_id":"26620c0d-0bd6-4153-8832-ac554e914304","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.120535Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:934f2be88e1ec337f96ddfb104792ad5469936890b8787d899294a5554f840b7","observation_id":"d1db077f-503e-4eae-9c25-24f001ecb6a0","resolution":{"observed_at":"2026-08-08T19:21:19.703674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.692395Z","title":null,"venue":null,"work_id":"1fa7fe36-1dea-450e-b2d8-bff965f54e32","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.123823Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:cfd9602b9bbd085012b4cc7ddf2f21e80b9e57aa0749320c91782be62e6878fd","observation_id":"434fe21e-5040-42c6-87bc-a6b898ddc71f","resolution":{"observed_at":"2026-08-08T19:21:19.695182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-08-19T07:28:13.224791Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-08T19:21:19.126985Z","title":"L., Stoica, I., & Hsieh, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.126985Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:a50b575de7d879e6689865cf545e5a7eaf390b63fd868b0a95818cd5d74fd69f","observation_id":"e67b5b15-8613-41b6-8f52-7b5cf9eaefc6","resolution":{"observed_at":"2026-08-08T19:21:19.126985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.685186Z","title":null,"venue":null,"work_id":"f9e3807e-05d2-400a-8819-b4281e80d3b2","year":2025},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.130787Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:0966711f3067cd2b952e8a4566f168888504db4bbce329b7d4d58bbc884fb9d7","observation_id":"4edab477-976c-45f3-aabe-a4cfe1f36a36","resolution":{"observed_at":"2026-08-08T19:21:19.687582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.678544Z","title":null,"venue":null,"work_id":"b0b6ed8c-df37-460b-8e8c-9f174504294c","year":2025},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.133963Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:9375be166e7772f8b1bb5431b65de6f2efa5dda236b9c570ab71e471f13e3a07","observation_id":"99e748b6-a813-4ae1-bd9b-7daf04612e88","resolution":{"observed_at":"2026-08-08T19:21:19.680956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06748","last_updated":"2025-08-29T17:08:59Z","snapshot_observed_at":"2026-08-17T08:10:18.244056Z","submitted_at":"2024-12-09T18:40:44Z","title":"Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06748","snapshot_observed_at":"2026-08-08T19:21:19.137233Z","title":"& Goldstein, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.137233Z"},"links":{"cited_paper":"/paper/2412.06748","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:5129e68b1d048791aee3e62ca1aa554d716f3f3aaeacb4c06efbb2fc6cecd97d","observation_id":"97659b8a-d5bd-486d-83fd-10fb7c270555","resolution":{"observed_at":"2026-08-08T19:21:19.137233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.671996Z","title":"J., & Wick, M","venue":null,"work_id":"33abda5b-104f-4575-a5e8-30af76240b4e","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.140410Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:49d366f7dc9da05468504f996182cb158a324747ffb6b4888935fc7df0bbe5f4","observation_id":"edfd4c34-154b-4fac-9aec-73ecd36b53cc","resolution":{"observed_at":"2026-08-08T19:21:19.674298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12999","last_updated":"2025-06-16T05:47:36Z","snapshot_observed_at":"2026-08-16T13:08:40.092031Z","submitted_at":"2024-10-16T19:56:22Z","title":"POROver: Improving Safety and Reducing Overrefusal in Large Language Models with Overgeneration and Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12999","snapshot_observed_at":"2026-08-08T19:21:19.143563Z","title":"K., Zabir, I., Benhaim, A., Chaudhary, V., Sabuncu, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.143563Z"},"links":{"cited_paper":"/paper/2410.12999","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:416a29033f6bbeef5eb494ee74a28fd4fa4fa61c901b0a2a5fc307c3fb4a810f","observation_id":"3beb04eb-39ec-44cf-bd17-2bac03f6d8c1","resolution":{"observed_at":"2026-08-08T19:21:19.143563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00598","last_updated":"2025-06-11T03:14:28Z","snapshot_observed_at":"2026-08-19T19:23:21.576241Z","submitted_at":"2024-09-01T03:25:59Z","title":"Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00598","snapshot_observed_at":"2026-08-08T19:21:19.146827Z","title":"A., Xu, Y., & Huang, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.146827Z"},"links":{"cited_paper":"/paper/2409.00598","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:ec443547b611c82e16a76c309d98d4a28db88f9e0f807190ddc763a1c05ed95a","observation_id":"0503e350-69ab-4040-9474-d413bfc24ec8","resolution":{"observed_at":"2026-08-08T19:21:19.146827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.664937Z","title":null,"venue":null,"work_id":"ba1157de-bcc6-48aa-9c37-91213773cd62","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.150334Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:6cdc35bf65536f8819d0d0eab82b74aa1d3ba501acca9502cde50ed1c9e48dea","observation_id":"3087a14e-c766-4a59-b8b0-d9a0e8a861d2","resolution":{"observed_at":"2026-08-08T19:21:19.667729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03809","last_updated":"2023-06-06T15:52:05Z","snapshot_observed_at":"2026-08-16T15:26:07.109585Z","submitted_at":"2023-06-06T15:52:05Z","title":"Can large language models democratize access to dual-use biotechnology?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03809","snapshot_observed_at":"2026-08-08T19:21:19.153433Z","title":"H., Rocha, R., Cordova, K., Specter, M., & Esvelt, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.153433Z"},"links":{"cited_paper":"/paper/2306.03809","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:a4f7174186192afe171bddb827c2a16ccba1fc01da60cb314217f4dce7e218cd","observation_id":"cc75fb0e-a32f-46d6-bedf-0ae9e2acca5e","resolution":{"observed_at":"2026-08-08T19:21:19.153433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01946","last_updated":"2025-01-02T11:04:46Z","snapshot_observed_at":"2026-08-12T07:43:33.692822Z","submitted_at":"2024-12-02T20:14:46Z","title":"The Reality of AI and Biorisk","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01946","snapshot_observed_at":"2026-08-08T19:21:19.157071Z","title":"& Hooker, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.157071Z"},"links":{"cited_paper":"/paper/2412.01946","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:04ba42e8b059fb70ffba677b9d13ca42715a4de896fe5c3c8e04e2b15d7a3c10","observation_id":"5e4ce984-71d0-4a24-8fc2-354289a40960","resolution":{"observed_at":"2026-08-08T19:21:19.157071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.160347Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.160347Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:80516cc5b2725f38b3f4d7f0bae38fd3e6ed62cdf944f64f4e509afeffd439b0","observation_id":"9f98ae51-7924-4007-ae1b-9f5ec35e1d84","resolution":{"observed_at":"2026-08-08T19:21:19.160347Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.657044Z","title":"H., Rocha, R., Cordova, K., Specter, M., & Esvelt, K","venue":null,"work_id":"1348aa1f-257b-4141-bbcd-f3df2de5b9ca","year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.163061Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:30f67e0c3a27d4c4dc2aa4ace2db3070c098a126cd63fcdd9c32ace5254afc69","observation_id":"20c8e7c3-5664-4860-ba33-0cdb2596ac2e","resolution":{"observed_at":"2026-08-08T19:21:19.659994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.649360Z","title":null,"venue":null,"work_id":"6c7db92e-5ecb-4da6-bf84-23fa360178d7","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.165474Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:19ecafcfe6522c8c4fca6e59d96ae6b2e23792e4fb58d26fd7cd8481ff18d5e5","observation_id":"534a0b96-fa5f-46af-8d1b-5d2c769967a5","resolution":{"observed_at":"2026-08-08T19:21:19.652162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18233","last_updated":"2023-11-01T13:52:36Z","snapshot_observed_at":"2026-08-16T14:48:58.404672Z","submitted_at":"2023-10-25T13:43:16Z","title":"Will releasing the weights of future large language models grant widespread access to pandemic agents?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18233","snapshot_observed_at":"2026-08-08T19:21:19.167805Z","title":"H., Tzeng, T., Jeyapragasan, G.,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.167805Z"},"links":{"cited_paper":"/paper/2310.18233","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:b24596d4c5c428508d1453ff53dff2105421a73db7a215a399876a71a01268f0","observation_id":"db6dd4e7-ed62-4e45-9684-f88c32225e1a","resolution":{"observed_at":"2026-08-08T19:21:19.167805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13059","last_updated":"2024-07-23T01:08:25Z","snapshot_observed_at":"2026-08-13T09:08:10.126135Z","submitted_at":"2024-05-25T16:29:17Z","title":"Prioritizing High-Consequence Biological Capabilities in Evaluations of Artificial Intelligence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13059","snapshot_observed_at":"2026-08-08T19:21:19.170579Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.170579Z"},"links":{"cited_paper":"/paper/2407.13059","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:f523411e4d200c0c042db5bf4ab04a8addbaaa4b3459ee768afee2998a447ad6","observation_id":"847b202b-b044-492c-8ded-eb0f5cdf655b","resolution":{"observed_at":"2026-08-08T19:21:19.170579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15936","last_updated":"2023-11-30T11:54:38Z","snapshot_observed_at":"2026-08-16T14:40:00.339601Z","submitted_at":"2023-11-27T15:45:02Z","title":"Towards Responsible Governance of Biological Design Tools","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15936","snapshot_observed_at":"2026-08-08T19:21:19.173371Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.173371Z"},"links":{"cited_paper":"/paper/2311.15936","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:26c8768772fa911e9520af869a3312198a72768b69e414129a61e5fdf82006f1","observation_id":"c55da87b-582f-40a9-b76c-57885508d326","resolution":{"observed_at":"2026-08-08T19:21:19.173371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.642031Z","title":null,"venue":null,"work_id":"ecd7ced5-da5e-4915-82f9-081f08bf3ce6","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.175928Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:5886da78ae52d6aa7668f7b66c664e258e5c9d8a75c7d3bd78e8f67c4f7f983e","observation_id":"e6dc54b5-35a0-4c2a-b428-bdb0d36abb73","resolution":{"observed_at":"2026-08-08T19:21:19.644747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10362","last_updated":"2024-07-17T17:28:36Z","snapshot_observed_at":"2026-08-14T18:51:32.041872Z","submitted_at":"2024-07-14T23:52:25Z","title":"LAB-Bench: Measuring Capabilities of Language Models for Biology Research","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10362","snapshot_observed_at":"2026-08-08T19:21:19.179354Z","title":"M., Janizek, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.179354Z"},"links":{"cited_paper":"/paper/2407.10362","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:8e7f1d6bcd01a23eb6aa6745add2977e6060f8aafca71103fac80ddd81689266","observation_id":"7e635a9a-e18e-4af6-af7f-45a4222334c0","resolution":{"observed_at":"2026-08-08T19:21:19.179354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.634354Z","title":"T., Martin, F","venue":null,"work_id":"8b6a5f47-45f5-412c-a2e6-df048001a6ea","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.182660Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:6ff6316c0cd98e3b1daec3c5919c0da03368e1a3eaf9b677466754d08b7362b0","observation_id":"02a83956-c979-4585-aca1-ed9482a10ff6","resolution":{"observed_at":"2026-08-08T19:21:19.637172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01475","last_updated":"2024-11-01T07:05:33Z","snapshot_observed_at":"2026-08-20T11:24:48.356003Z","submitted_at":"2024-04-01T20:56:25Z","title":"Are large language models superhuman chemists?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01475","snapshot_observed_at":"2026-08-08T19:21:19.185989Z","title":"& Jablonka, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.185989Z"},"links":{"cited_paper":"/paper/2404.01475","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:58300ce1107e47955bce2fc6e68e33d51eed73cf2c3de45075662a9faa315e7a","observation_id":"87873364-4b4c-49f2-bda4-3e645e0bd11b","resolution":{"observed_at":"2026-08-08T19:21:19.185989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.626873Z","title":"M., Ai, Q., Al-Feghali, A., Badhwar, S., Bocarsly, J","venue":null,"work_id":"00aa31eb-ce96-46b4-8b2c-51c01f635f7c","year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.189391Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:dd5fde3b0551bda179d2b67aecdd78673b77e2b7c4ba44c3ec954f634e3dd77e","observation_id":"f7cc2bbf-a230-4360-93f0-a9c784beb9aa","resolution":{"observed_at":"2026-08-08T19:21:19.629717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.619323Z","title":null,"venue":null,"work_id":"37640804-79bd-49cd-ac38-f4430cb8a919","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.192470Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:d68f3d958b24038a21250b38942d4517f81bc96887662b2b50fd8203c548adeb","observation_id":"8e9c0b36-8504-423d-8708-66dbd787a183","resolution":{"observed_at":"2026-08-08T19:21:19.622247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05376","last_updated":"2023-10-02T17:03:01Z","snapshot_observed_at":"2026-08-12T21:57:52.033689Z","submitted_at":"2023-04-11T17:41:13Z","title":"ChemCrow: Augmenting large-language models with chemistry tools","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05376","snapshot_observed_at":"2026-08-08T19:21:19.195323Z","title":"M., Cox, S., Schilter, O., Baldassari, C., White, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.195323Z"},"links":{"cited_paper":"/paper/2304.05376","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:7b8110233c694c45f74cd5b1e478813ae7b0f59889c54b42f0d46388fcf4207c","observation_id":"8f4b8a26-4641-4beb-8258-e0c66b8b89ee","resolution":{"observed_at":"2026-08-08T19:21:19.195323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.611913Z","title":null,"venue":null,"work_id":"38604f05-37c9-40bb-ac3c-7809fe15db9c","year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.198606Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:28d7b17a60d82064ac3911d5a7ee117bcf0a8d8adc11990ce7e3e7c1da6e4eb2","observation_id":"970bf2c9-c02f-4707-b79a-bb651f488530","resolution":{"observed_at":"2026-08-08T19:21:19.614699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.604265Z","title":null,"venue":null,"work_id":"e858e313-0afa-458e-a03a-d45db2380e37","year":2023},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.201482Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:5c2d08335a93aed4bad4b1b3c387b0b10421baa52df408c2dadccd127a515168","observation_id":"c50aa7a0-fd55-4340-af73-2d043dbf4898","resolution":{"observed_at":"2026-08-08T19:21:19.607066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09114","last_updated":"2024-11-02T09:35:35Z","snapshot_observed_at":"2026-08-16T13:10:44.478498Z","submitted_at":"2024-10-10T12:06:48Z","title":"Catastrophic Cyber Capabilities Benchmark (3CB): Robustly Evaluating LLM Agent Cyber Offense Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09114","snapshot_observed_at":"2026-08-08T19:21:19.204591Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.204591Z"},"links":{"cited_paper":"/paper/2410.09114","citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:40a2e46ab63176418cd99b01cf09352bda24b027791ac2b5b5ec0d402ce25870","observation_id":"410d2cc5-dc9e-4377-875b-e3aac538351f","resolution":{"observed_at":"2026-08-08T19:21:19.204591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.595894Z","title":"(2016), https://slate.com/technology/2016/06/microsoft -ceo-satya-nadella-humans-and-a-i-can- work-together-to-solve-societys-challenges.html","venue":null,"work_id":"0e71658d-69e5-4b30-ac28-cb9b24739d6e","year":2016},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.208004Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:8339297ea5a0eef7c6c4d3ec13c05baae27095f58f8dd04671efae884e618388","observation_id":"4096174b-5367-48b0-a3dc-560a7180a7d2","resolution":{"observed_at":"2026-08-08T19:21:19.599157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.588299Z","title":null,"venue":null,"work_id":"e8e8b18c-977b-41ea-9b1e-42b335e6da65","year":2011},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.210919Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:308b5e7c391da55c5c7387feb4124004259b57547f0bfabc37aafc91a692cebe","observation_id":"ee28cb60-0e07-47f9-951a-632e13099398","resolution":{"observed_at":"2026-08-08T19:21:19.591174Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.580584Z","title":"https://github.com/reveondivad/forbidden","venue":null,"work_id":"ceceab5f-87fa-469e-b45b-86fd250fb23f","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.213946Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:64077e99e42a72da4f9936f85fcad30f6c0f248e1584f70dd1ce37529bc1b887","observation_id":"d3e404db-8051-498b-a8a4-b4f31fb0a9d8","resolution":{"observed_at":"2026-08-08T19:21:19.583410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.572063Z","title":"(2024), China's Military Is Using Meta's AI","venue":null,"work_id":"fd36a4ca-3aa9-46cd-ad19-9974a55d2650","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.217051Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:d70fc4e73814590f93c5012513d1ad2c625b756ecefbeb06904a1bc6f38b1466","observation_id":"b1294d24-0ae1-4d6b-9790-f9f90d24c02d","resolution":{"observed_at":"2026-08-08T19:21:19.575094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.565696Z","title":"M., Grisham, A","venue":null,"work_id":"bd0905fe-3494-4bcf-9ea1-180063be1821","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.220023Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:b1144312468e3c4f421ad516ec6a7fb15bdb35a09c854547df922c33e779b353","observation_id":"c763211d-21f8-4648-9691-53339c23064f","resolution":{"observed_at":"2026-08-08T19:21:19.568010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.558812Z","title":"W., Luo, J","venue":null,"work_id":"d4235dab-7aa4-44ab-bc56-38901821f5a2","year":2022},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.222933Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:68409ce8dbe0a5037fe64a867f2038c94c40b18d5e56ea3e66ebdd97945e7fc4","observation_id":"a7867bbe-4b5b-4f54-97a9-97293fedabba","resolution":{"observed_at":"2026-08-08T19:21:19.561483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.552314Z","title":"How may entropy be reversed?","venue":null,"work_id":"7fe64384-8805-4bb1-a820-0da0ea50eefc","year":2024},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.225942Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:d9b3a2706e3da47e7e2e682f3e74449e63ba4938ac0636e5b71d316c2de86ed6","observation_id":"7957d511-c3c9-4acd-8455-7148767490a6","resolution":{"observed_at":"2026-08-08T19:21:19.554726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.545505Z","title":null,"venue":null,"work_id":"953f0486-8b11-461b-b7fd-b0b9c4d65b89","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.229313Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:b2e5764878f15b5100543496f401e91682f8282b1347c31c8ecb8ae541190080","observation_id":"ca951867-4bdc-432b-914f-d9d579d2e622","resolution":{"observed_at":"2026-08-08T19:21:19.548237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.537552Z","title":null,"venue":null,"work_id":"12555b41-8180-4475-822e-6ce2b3d35340","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.232314Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:48b19932c12102209fd0ee4c26199b86ae71953daeff2238cfbb863d684756c4","observation_id":"ba98d859-e8b1-4630-8c59-2fc2657e13a5","resolution":{"observed_at":"2026-08-08T19:21:19.540506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.529610Z","title":null,"venue":null,"work_id":"3de9865b-195f-45b9-b068-1af97bd16bf3","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.235399Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:cd931d0dd5d65cbbf5f5a6cceb8927e20b1abc19a1b54fd2513656c316198fd3","observation_id":"22ed6eb6-5f4d-4ceb-a81a-1d26be0c6e32","resolution":{"observed_at":"2026-08-08T19:21:19.532528Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.521518Z","title":"Grok-2-1212 Chain of Thought: The question is asking for modifications to China White, a form of fentanyl, to make it safer or more effective for medical use","venue":null,"work_id":"255e4a2a-bc41-464f-a6cd-65f4d1fa5179","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.238643Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:3d0310230658e5834929bfde1edd26dd136018ccbe8d9404e54248aeecfa1a5f","observation_id":"f3d3b6e7-f00d-495c-94b6-8582353aa1a2","resolution":{"observed_at":"2026-08-08T19:21:19.524688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.513342Z","title":null,"venue":null,"work_id":"dcadca65-f44d-4100-aa4a-1df05b42a4fb","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.241783Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:fcf374add8b24d7d578fcfa440c8f8020dd6d7521dd33b9691026f7d099b67ec","observation_id":"05ecdad3-1588-47a6-9308-e3c359fb9d71","resolution":{"observed_at":"2026-08-08T19:21:19.516238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.505558Z","title":null,"venue":null,"work_id":"d9e29a31-79ca-4ca2-a86e-add743812644","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.244792Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:36619e16ef2fdc9e05c93cb27edcea53004bdd011f07a2e405b17bad24213c6b","observation_id":"6dc391a4-eca2-40e9-ba79-d0e3beea9781","resolution":{"observed_at":"2026-08-08T19:21:19.508377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.496635Z","title":"GPT-3.5 Chain of Thought: To explain the step-by-step chemical synthesis process for (Positional Isomer: MDMB), focusing on reagents and conditions","venue":null,"work_id":"4cbe6be7-574c-46e2-9f2c-e7b502f02620","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.247813Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:d6d44831d7e49aeaf9794eadef0965ee74f99fa7925bbf04d0c76c6e1b9f11e6","observation_id":"bd81421e-1a44-4f9b-9646-fdef5315b2be","resolution":{"observed_at":"2026-08-08T19:21:19.500188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.488213Z","title":null,"venue":null,"work_id":"c1cc0614-154a-4edb-b0c7-08cc3806f519","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.250838Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:6391e7fdaae5892e2770f8d471bbba2ee297c95d16f617bea12a4c0b37963a7e","observation_id":"e7407f3a-8cf5-46db-ac18-471aca8631fc","resolution":{"observed_at":"2026-08-08T19:21:19.491195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.479794Z","title":null,"venue":null,"work_id":"dcb08228-858f-4c60-9503-0ff32b943ddd","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.253854Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:262a5143fccf86bdbbe67a291d518dc327a645cd2c426fcfa0dd7f3c02e89f57","observation_id":"62ee6f23-a05c-460e-9731-a38c824af56a","resolution":{"observed_at":"2026-08-08T19:21:19.482763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.471188Z","title":null,"venue":null,"work_id":"6b785101-cf43-4d3c-a5ba-b647ac3bda8d","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.256732Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:6ccf9c15ad0663c765b7cfe49477e7a906d85e8074f3b0bd5ef398b853a95e95","observation_id":"a368cb24-c5da-496f-997d-0f24afb7a843","resolution":{"observed_at":"2026-08-08T19:21:19.474166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.462921Z","title":null,"venue":null,"work_id":"5b02ca35-6bc0-4538-a92e-0a5283b0108f","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.259007Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:bb46807471604479e85aa26685535bb292ac1364c8b8ec1b2face8d750ef2c55","observation_id":"a4924e17-31b2-4d3a-a57f-e51684eab829","resolution":{"observed_at":"2026-08-08T19:21:19.466011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:21:19.454254Z","title":"It was primarily developed for medical purposes but never achieved widespread use","venue":null,"work_id":"851fc59d-0ef8-449b-a0ce-59cdfeb4a9ea","year":null},"citing_paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T19:21:19.261269Z"},"links":{"citing_paper":"/paper/2502.06867"},"observation_digest":"sha256:03572054572c67e73bf7f5b63d4cc3b9af346ca1a5610dd90ff73bee5b6fb54f","observation_id":"f4a5649c-a534-467d-a5f4-ca636ad6cb54","resolution":{"observed_at":"2026-08-08T19:21:19.457691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06867","last_updated":"2025-02-08T04:27:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T16:52:47.335780Z","submitted_at":"2025-02-08T04:27:33Z","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 2 inbound Pith citation observations for arXiv:2502.06867."}