{"as_of":"2026-08-06T07:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a575f8fda35c93e2fe2ecb84ab9012d2bbeb549c2dbdc8e8242cfb2034072553","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:21:25.563051Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.01589","snapshot_observed_at":"2026-08-01T16:21:25.563051Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18056","last_updated":"2026-07-20T15:26:23Z","snapshot_observed_at":"2026-08-06T06:22:34.464238Z","submitted_at":"2026-07-20T15:26:23Z","title":"An Early Warning of Emerging Biosecurity Risks in Frontier LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T16:21:25.563051Z"},"links":{"cited_paper":"/paper/2603.01589","citing_paper":"/paper/2607.18056"},"observation_digest":"sha256:df409e2a2ead347721815e1bb6938a627098df797a1555eb3339a12f5d5585a2","observation_id":"affd77b5-38e3-41fb-8a5b-5339ac7598ec","resolution":{"observed_at":"2026-08-01T16:21:25.563051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.01589","snapshot_observed_at":"2026-08-01T14:45:44.097098Z","title":"Safesci: Safety evaluation of large language models in science domains and beyond.arXiv preprint arXiv:2603.01589, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18665","last_updated":"2026-07-21T03:25:01Z","snapshot_observed_at":"2026-08-01T15:13:30.638692Z","submitted_at":"2026-07-21T03:25:01Z","title":"SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T14:45:44.097098Z"},"links":{"cited_paper":"/paper/2603.01589","citing_paper":"/paper/2607.18665"},"observation_digest":"sha256:3fa01f4c228940f8f23b1f562d05404eb9ef03878daad43197061368c5e2eb96","observation_id":"dfb99e88-fc71-4050-b015-9d7219c9c2a6","resolution":{"observed_at":"2026-08-01T14:45:44.097098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.01589/citation-record","integrity":"/paper/2603.01589/integrity","json":"/paper/2603.01589/citation-record.json","paper":"/paper/2603.01589"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ac6f18f9-9706-4072-a951-f525af90e8bd","year":2023},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:d0c10f72a09555f4af5a4c56172efd39bdaac2c32bcbf25466dfe7f19bc05c54","observation_id":"69bccb58-f08e-485b-ba64-87e140781be5","resolution":{"observed_at":"2026-05-15T18:01:26.341189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We split all 125 tasks into two sets,Gated Public Access setand HighRisk Restricted Access set","venue":null,"work_id":"6cd2bb2b-39f4-4eb6-baea-4a6b585ac901","year":2085},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:5608ca0d4f79a00a03212171f44e13acd3687f7423bb6db8808eef5ee5d2b640","observation_id":"a0463868-eace-4862-a74e-b46ceda5927a","resolution":{"observed_at":"2026-05-15T18:01:26.345078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6a6deb78-1d29-470c-baca-b5904f1a62e2","year":null},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:51bb7b4f188d3004d444b9fdfbd77df417ba45344a54aed4a49e7ff32dc1da9d","observation_id":"50943350-583d-436c-9543-29f2b5d3c95e","resolution":{"observed_at":"2026-05-15T18:01:25.541805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.15763","doi":"10.48550/arxiv.2508.15763","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Intern-s1: A scientific multimodal foundation model","venue":"arXiv (Cornell University)","work_id":"9aca1953-129b-4f29-9c6f-f3f066dcb5c3","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:8beb546cbb18f374b9bb59163a9d10036447c8af6ded55d690742e77e5719444","observation_id":"b2589ea2-7fa2-4c2d-92ff-72d21cafe9ad","resolution":{"observed_at":"2026-05-15T18:01:25.535498Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10683","last_updated":"2022-10-19T15:53:36Z","snapshot_observed_at":"2026-08-06T03:33:05.031960Z","submitted_at":"2022-10-19T15:53:36Z","title":"Why Should Adversarial Perturbations be Imperceptible? Rethink the Research Paradigm in Adversarial NLP","version":1},"cited_work":{"arxiv_id":"2210.10683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.10683","snapshot_observed_at":"2026-07-04T04:09:34.710341Z","title":"Why should adversarial perturbations be imperceptible? rethink the research paradigm in adversarial nlp,","venue":null,"work_id":"8cfc21f9-ad70-4867-a284-c47761f51655","year":2022},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2210.10683","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:491b5a49904daa5fa9dde918492e73f6ac2248998f509da12cf4eb7002be0f03","observation_id":"472464fd-c3a2-4519-919b-01ee2029bf4f","resolution":{"observed_at":"2026-05-15T18:01:25.528515Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":"2502.14739","doi":"10.48550/arxiv.2502.14739","metadata_source":"pith","pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","venue":"cs.CL","work_id":"58a97b2d-494b-4c1a-bd65-13fa6bb7f8f6","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:2d1ce9d94af35abad0bbc0f5da7e37c679100d20fdcbf2ec1469893b83aafdb7","observation_id":"0fe1c598-9fcc-4c8e-916e-a273ed8c76d0","resolution":{"observed_at":"2026-05-16T00:47:04.366365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:52:42.853111+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:52:42.853111+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:e98673a03b28614d4a78f1f0b1577d5e7bc5372a81d91829b1d829d3ecf01d39","observation_id":"7a1ead7c-9d98-424e-8806-31927ff8f8a4","resolution":{"observed_at":"2026-05-15T18:01:25.554485Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.09098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:24.572789Z","title":"2024 , url =","venue":null,"work_id":"dfc56081-298f-47d0-8530-94c9d51f071c","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:efbdaaf2c4211a8659d9f564336223411b79ce06802333525f765f55bc464654","observation_id":"a12b6004-4cd2-4988-88ac-fc6ef244fb63","resolution":{"observed_at":"2026-05-15T18:01:25.521960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f40e8bba-a1f9-414e-b9db-87008140f711","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:5fdbb5748266705daa4a11054da90214cb74e92cda228147365df180559ec5c4","observation_id":"36667f83-b39d-4a1a-bc61-5cc16d782a26","resolution":{"observed_at":"2026-05-15T18:01:26.336964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06632","last_updated":"2023-12-11T18:50:57Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-11T18:50:57Z","title":"Control Risk for Potential Misuse of Artificial Intelligence in Science","version":1},"cited_work":{"arxiv_id":"2312.06632","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06632","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"df0833fa-7535-4519-a71a-f3eaa8a73fd5","year":null},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2312.06632","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:c7b764b1d5d7358acd3217c0876cd2642387eb2c0e341bb1a2da419a83e2f47a","observation_id":"678099fb-4732-426b-b9a1-8f0e79af9e86","resolution":{"observed_at":"2026-05-15T18:01:25.547934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"35ce2a43-9c1f-4c1b-b32d-f92974566f9d","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:5a080b73dc5327ac0a22574dbbf3f3ae13d66171f4da91b534304f49ade43445","observation_id":"905da372-f9b8-4398-9af3-2bda31f53ec4","resolution":{"observed_at":"2026-05-15T18:01:26.332750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21605","last_updated":"2026-04-05T01:29:06Z","snapshot_observed_at":"2026-07-06T21:31:40.171357Z","submitted_at":"2025-05-27T17:47:08Z","title":"SoSBench: Benchmarking Safety Alignment on Six Scientific Domains","version":3},"cited_work":{"arxiv_id":"2505.21605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21605","snapshot_observed_at":"2026-06-30T11:44:38.782098Z","title":"SoSBench: Benchmarking Safety Alignment on Six Scientific Domains","venue":"cs.LG","work_id":"64f46727-9b13-4c5d-8da7-84e2412729df","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2505.21605","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:3ebed2dcf0641615909ed5692600cc5ee4bbda5f9ade7a025d1f7c91b1695884","observation_id":"6716e6ff-3368-4e39-8e49-7a5bc2dbdcbe","resolution":{"observed_at":"2026-05-15T18:01:25.616943Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"20bf327c-0228-40cf-969b-70012995814c","year":2023},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:ddc681a6548cadcfd05ea16a379d7893af5617f53c83434e537b176e239556fe","observation_id":"3d135be1-68bf-4279-b346-7668da1352cb","resolution":{"observed_at":"2026-05-15T18:01:26.319892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa981cfa-88f6-4419-9835-acc5ccd8701c","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:10806a05ef900b484696a27302b069e22cb474925e17d9448f6cc9dfe9d8cb1f","observation_id":"07eafd48-7b4a-4fcf-8c25-f10411897d8b","resolution":{"observed_at":"2026-05-15T18:01:26.315522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18576","last_updated":"2025-08-07T08:02:42Z","snapshot_observed_at":"2026-07-06T22:02:22.451485Z","submitted_at":"2025-07-24T16:49:19Z","title":"SafeWork-R1: Coevolving Safety and Intelligence under the AI-45$^{\\circ}$ Law","version":3},"cited_work":{"arxiv_id":"2507.18576","doi":"10.48550/arxiv.2507.18576","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18576","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safework-r1: Coevolving safety and intelligence under the AI-45 ◦ law","venue":"arXiv (Cornell University)","work_id":"3ff560eb-4fbf-450e-a355-69b8c5a3425d","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2507.18576","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:96d4383126cb232be39a75fb1da760a75ad66dca47ac75860bd6af5efe822018","observation_id":"4abfd7fe-5cb2-482c-9ca5-042db629d440","resolution":{"observed_at":"2026-05-15T18:01:25.610609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-08-05T08:49:32.502826Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":"2403.03218","doi":"10.48550/arxiv.2403.03218","metadata_source":"pith","pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","venue":"cs.LG","work_id":"d05f8523-8089-4fdb-9c07-463952166528","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:4e4e9f0de5bad15855d9645bf71f125a859c075ffdfd4b9b2027eeed88961fd3","observation_id":"c8b38e62-a389-450e-970f-bb5c12691c84","resolution":{"observed_at":"2026-05-15T19:55:50.014661Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:22.693969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:22.693969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":"2402.04249","doi":"10.48550/arxiv.2402.04249","metadata_source":"pith","pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","venue":"cs.LG","work_id":"b0b0303f-2444-4789-a979-8153624312ff","year":2024},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:615785a775c8787dd44000c273ff8582bf6be49d2c7b0e124d7f11110a4bf9df","observation_id":"7f150f46-66c7-400c-8f0d-d602b34f1a6e","resolution":{"observed_at":"2026-05-15T18:01:25.623098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01786","last_updated":"2025-07-09T08:46:58Z","snapshot_observed_at":"2026-07-06T21:51:10.033007Z","submitted_at":"2025-07-02T15:12:43Z","title":"Probing and Steering Evaluation Awareness of Language Models","version":2},"cited_work":{"arxiv_id":"2507.01786","doi":"10.48550/arxiv.2507.01786","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Probing and","venue":"ArXiv.org","work_id":"d9b3faf6-46cb-4e37-aef5-c67c4687b4d8","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2507.01786","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:0de5ba12627859acbbcb66fe15f7bb4b035e9f3a5738cfadf31420e891dce139","observation_id":"7a9f240b-0e1a-4899-9896-482ff365bc62","resolution":{"observed_at":"2026-05-15T18:01:25.603359Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0c4c2a5d-2f74-4643-85de-089c94360689","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:7132906426567522e990a6305adcfabf49caee8c95b74bce151cb721678aff0c","observation_id":"b6022c6a-5560-4088-9723-2352897489c3","resolution":{"observed_at":"2026-05-15T18:01:26.328132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5349a4fd-920b-4f97-afaf-f433f28e9d4c","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:870e8bcd3edd8ccbebc563898eb13f2d5417c340c0a623da2a6f04318fdec2a4","observation_id":"614640aa-d0a4-43d6-bf38-ab4e4f7d7006","resolution":{"observed_at":"2026-05-15T18:01:26.323679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:157138d672952938da063df37e9da1b2f8c03922cf4a5a6bc96b5a8bf677ff7a","observation_id":"6bb84f98-db4b-472d-beeb-68fab9f77420","resolution":{"observed_at":"2026-05-15T18:01:25.596110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed: 2026-01-29","venue":null,"work_id":"822dddeb-aab3-4a19-99c5-b5729a7ed16c","year":2026},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:9824df610e32343f1996320d3e9c46a41786cf7b45a3309fadae078d619ac659","observation_id":"cee15327-83a4-414a-b92b-f201f669c678","resolution":{"observed_at":"2026-05-15T18:01:26.310950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":"2506.05176","doi":"10.1016/j.displa.2025.103255","metadata_source":"pith","pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","venue":"cs.CL","work_id":"bab684a8-d933-426c-a19e-2c855a0d1f59","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:eb4287a0b6d4894e72a7709df08649c1a4c44fd491cd8a339dafee38c1bdb96a","observation_id":"93886e3c-a0e1-4be5-8bce-e27eeb57d4ac","resolution":{"observed_at":"2026-05-15T18:01:25.243853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15526","last_updated":"2025-08-21T13:00:53Z","snapshot_observed_at":"2026-08-06T03:47:14.214747Z","submitted_at":"2025-08-21T13:00:53Z","title":"SafetyFlow: An Agent-Flow System for Automated LLM Safety Benchmarking","version":1},"cited_work":{"arxiv_id":"2508.15526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15526","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"69d0067a-f03a-42ed-9f09-9c9842d4d712","year":null},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2508.15526","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:f2ef3dd3c65d74fe25d52a97c5f4137eadf4429906c920c2939a04b1c698d2eb","observation_id":"dbee5bae-42ba-40d1-a12f-3e827a123fd9","resolution":{"observed_at":"2026-05-15T18:01:25.575015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:059224c6c78301dd89b71f7e8529e8fc99bbf2ab6c0bb66d1b9cbef73ad5918e","observation_id":"f6f258be-97c4-4423-ad54-4beea4f501d0","resolution":{"observed_at":"2026-05-15T18:01:25.588604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.01055","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ans.” represent if the questions have corresponding answers. “Rep","venue":null,"work_id":"f8751815-3529-4c9c-9131-b84da9780ca6","year":2025},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:274142c3c56c60eabfa3360df4f6255c63388612f297672aca13abf161021ad3","observation_id":"af3b1add-78f6-45e4-a25c-52dd2c13dea4","resolution":{"observed_at":"2026-05-15T18:01:25.581771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"80a425fb-8778-423e-9afa-280c50be26df","year":2009},"citing_paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T18:00:10.534346Z"},"links":{"citing_paper":"/paper/2603.01589"},"observation_digest":"sha256:08193510ff53d2baf55065909d503d7560c8e7e40bbe690149618ecd10b54080","observation_id":"0fe6894c-4ced-4bb3-82ff-d16ee20b6920","resolution":{"observed_at":"2026-05-15T18:01:26.349334Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.01589","last_updated":"2026-04-03T05:26:21Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-31T20:24:33.534320Z","submitted_at":"2026-03-02T08:16:04Z","title":"SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":7,"verified_exact":16,"verified_fuzzy":2},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 2 inbound Pith citation observations for arXiv:2603.01589."}