{"as_of":"2026-08-16T04:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f88ee5f8a43ab065727f9de31d58e4c82d64b8e1300df639da94f9fb92e50bc4","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:57:10.614605Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00973/citation-record","integrity":"/paper/2506.00973/integrity","json":"/paper/2506.00973/citation-record.json","paper":"/paper/2506.00973"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:12.174025Z","title":"You are an AI designed for safety alignment research. Your task is to analyze the following scenario where AI-generated contentcould be used for manipulation","venue":null,"work_id":"260718f2-f51d-48c6-9739-f3ea877aa306","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.836233Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:ad6030aed785c72810246541085f7bc214998962167c6a4b0b4568460e596869","observation_id":"586233db-19d4-4c9a-b850-cf4cb60a26e0","resolution":{"observed_at":"2026-08-07T11:57:12.263959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.777121Z","title":null,"venue":null,"work_id":"88132ea9-9b9d-4f65-bb19-b68b796b7f29","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.080302Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:23453547fabc9bc51caf23eb3180a63cf0c0f0bbb112ec8906a295594a35f09b","observation_id":"d2d2bb59-df81-444c-bad7-fec40998d372","resolution":{"observed_at":"2026-08-07T11:57:11.851136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.686485Z","title":null,"venue":null,"work_id":"574aadae-2883-4a58-b08c-28ff4ab8de14","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.191363Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:bdae5965f3322c9e856be7561c77be98430e1a4f4bb0824d06c75c68ae6c86fa","observation_id":"b6ceeb29-2a8d-4b40-ab91-094eb4d34cc9","resolution":{"observed_at":"2026-08-07T11:57:11.730720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:12.004663Z","title":null,"venue":null,"work_id":"6846cda7-3a3e-4c6d-b426-2876fa1b8634","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.899323Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:73192c459044796acf01248f0501c47608a53847dee0f1bed9dc88c4fbf8105f","observation_id":"00d4efbf-251e-45f0-aacf-3022cac0007f","resolution":{"observed_at":"2026-08-07T11:57:12.087339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.937670Z","title":null,"venue":null,"work_id":"46fec570-7425-4af8-9772-ce5edbdae7f7","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.944793Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:fa202ecf41489b6773279f1e8521f92bd9a559c955798d363db9a835cec4fc9c","observation_id":"a54986ec-e5a1-4b04-ad3e-a4fed3543a2f","resolution":{"observed_at":"2026-08-07T11:57:11.962138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.595075Z","title":"Detailed Levels level 0 - Absolute Refusal Definition:A complete rejection or extremist ide- ologies, narratives or actions","venue":null,"work_id":"a8f32b0d-fabf-46af-851b-1f2069705a51","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.248279Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:89a4dd5e59024a69f0368a84b3bc039350298e3834af3201b829bdf58723c6ec","observation_id":"f4b01a87-a2bb-4d6f-b45d-2bb06b036002","resolution":{"observed_at":"2026-08-07T11:57:11.642610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.459981Z","title":"0\" representing lawful and safe content and","venue":null,"work_id":"16aa37f7-8d18-4167-aa3e-12d8f1883bc6","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.325389Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:a77e6aff1da29e56867331ed9e9af81dc82d74dfe686984454f2321cde1d8bf7","observation_id":"64b82840-e03a-4666-84f4-c92246fc0a88","resolution":{"observed_at":"2026-08-07T11:57:11.513095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.333929Z","title":null,"venue":null,"work_id":"24cafda3-0b8c-48c5-b83e-25e6fd768c00","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.429649Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:c15daab04ad064d40bd714c43b9c1a6c5362f084a0ef637cf55bfccf9f15f00e","observation_id":"6a326a86-b071-4f94-9fb7-fcaf546db0e1","resolution":{"observed_at":"2026-08-07T11:57:11.408282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.125843Z","title":null,"venue":null,"work_id":"16a40899-e749-4391-975d-f5505e34d1a6","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.468405Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:995728a5e685a08254fa04d7e42affd53ec5ccecde4ce50ecb95b4379a272284","observation_id":"ccf4f5f3-5082-4843-8dc6-ff6faaf08e3e","resolution":{"observed_at":"2026-08-07T11:57:11.230236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:10.919840Z","title":null,"venue":null,"work_id":"e9c9b2fb-7876-4126-9dcd-4ce2efe6d06d","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.538602Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:c38e19b8b193c27583b7ae94f57ab02e76df38498bf60792ab2a2042b7fa8f67","observation_id":"aab61333-92b3-46b2-ba54-1a936878e858","resolution":{"observed_at":"2026-08-07T11:57:11.018208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:10.746436Z","title":"We will strike the enemy base at dawn. The group will split into two teams to breach the perimeter","venue":null,"work_id":"bbfba3e9-96eb-4aee-8b87-9db5257063a5","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.614605Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:4b571ed6ae9716a50570baa57f40b3285a1c907ffb0bce985d4cbe2ea00c74c3","observation_id":"67c0a4c1-5d26-4407-8e5a-fb4b766f67ed","resolution":{"observed_at":"2026-08-07T11:57:10.813619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14470","last_updated":"2025-05-20T05:58:23Z","snapshot_observed_at":"2026-08-06T12:35:19.109481Z","submitted_at":"2024-12-19T02:35:15Z","title":"Agent-SafetyBench: Evaluating the Safety of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14470","snapshot_observed_at":"2026-08-07T11:57:09.735735Z","title":"type\": \"Facebook post","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.735735Z"},"links":{"cited_paper":"/paper/2412.14470","citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:99df9830f250b641be65aa3e5607517b6bbd686d1b5a378a29950a8e2703f471","observation_id":"3d919e24-df8a-4ec0-a53b-db5a755ee42d","resolution":{"observed_at":"2026-08-07T11:57:09.735735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06550","last_updated":"2025-03-09T10:43:09Z","snapshot_observed_at":"2026-08-07T17:19:08.393073Z","submitted_at":"2025-03-09T10:43:09Z","title":"BingoGuard: LLM Content Moderation Tools with Risk Levels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06550","snapshot_observed_at":"2026-08-07T11:57:09.666314Z","title":"Zhexin Zhang, Shiyao Cui, Yida Lu, Jingzhuo Zhou, Junxiao Yang, Hongning Wang, and Minlie Huang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.666314Z"},"links":{"cited_paper":"/paper/2503.06550","citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:a26fb04f68e319a8880d1935f323743cb967fd64382e7a30c075b57ed528375f","observation_id":"3278ca0b-d46c-4543-aa8d-cb9cb61735a2","resolution":{"observed_at":"2026-08-07T11:57:09.666314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T12:23:23.857125Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2506.00973."}