{"as_of":"2026-08-09T14:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26340fe71411c75424994180ecaefe94da638d617003c21b29af9ef5f45556f1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":44,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:04:10.824381Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:30:07.408628Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2310.12508","last_updated":"2024-04-04T07:45:38Z","snapshot_observed_at":"2026-08-03T17:30:25.153454Z","submitted_at":"2023-10-19T06:17:17Z","title":"SalUn: Empowering Machine Unlearning via Gradient-based Weight Saliency in Both Image Classification and Generation","version":5},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-05-16T17:56:23.281678Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2310.12508"},"observation_digest":"sha256:f48ee18c387086e621a2fbbafc16f8a54e422bde2c54d0ebd0814e236e763b5c","observation_id":"30efb5b2-38d4-4a71-be3e-c2532196c174","resolution":{"observed_at":"2026-05-16T17:56:23.405606Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2406.14194","last_updated":"2026-04-05T17:10:43Z","snapshot_observed_at":"2026-08-09T01:48:09.192305Z","submitted_at":"2024-06-20T10:56:59Z","title":"VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-23T23:37:12.985780Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2406.14194"},"observation_digest":"sha256:745081d027032c090144523e4e4cf771217146f9a7f579270ea5c554b985a5c9","observation_id":"dc63e949-132a-46ba-8a47-ae149d8a8cf1","resolution":{"observed_at":"2026-05-23T23:38:37.379221Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-08T15:04:10.824381Z","title":"Red-teaming the stable diffusion safety filter.arXiv preprint arXiv:2210.04610, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06575","last_updated":"2025-02-10T15:44:34Z","snapshot_observed_at":"2026-08-09T01:57:08.368112Z","submitted_at":"2025-02-10T15:44:34Z","title":"Predictive Red Teaming: Breaking Policies Without Breaking Robots","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T15:04:10.824381Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2502.06575"},"observation_digest":"sha256:f9d795ab1667df4269339cd44581b2c3fe5037adca87e7b87a0b87b19defef4d","observation_id":"dadb8376-2fe8-4031-baa7-492df68b2ddc","resolution":{"observed_at":"2026-08-08T15:04:10.824381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-07T13:46:21.103762Z","title":"Red-teaming the stable diffusion safety filter.arXiv preprint arXiv:2210.04610, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.103762Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:20240c1efaeff114c34d689dcf924d7714fc86232576e213c5b833a7c8a715e2","observation_id":"069feabf-56b7-48ad-bcbb-71e4bc0b117f","resolution":{"observed_at":"2026-08-07T13:46:21.103762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-07T05:27:16.156591Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08071","last_updated":"2025-06-09T17:54:41Z","snapshot_observed_at":"2026-08-07T23:16:48.649505Z","submitted_at":"2025-06-09T17:54:41Z","title":"CuRe: Cultural Gaps in the Long Tail of Text-to-Image Systems","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:16.156591Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2506.08071"},"observation_digest":"sha256:d00beae22970add865cd41a54cad71e10cb877b51c7e212df9fd9f6d908b841b","observation_id":"4d43f506-93da-43b2-ac54-1d6a5f4cba90","resolution":{"observed_at":"2026-08-07T05:27:16.156591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-07T04:55:44.680812Z","title":"arXiv preprint arXiv:2210.04610 (2022) 1","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09363","last_updated":"2025-06-11T03:21:24Z","snapshot_observed_at":"2026-08-09T06:08:31.234137Z","submitted_at":"2025-06-11T03:21:24Z","title":"SAGE: Exploring the Boundaries of Unsafe Concept Domain with Semantic-Augment Erasing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:44.680812Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2506.09363"},"observation_digest":"sha256:2cffa0c8945778c4026565ea71e4fd8eba9c45ce458403f73aaeaa235cdd26c6","observation_id":"3dba781f-d7fc-48e6-8f27-fad422b04043","resolution":{"observed_at":"2026-08-07T04:55:44.680812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-07T04:52:19.067456Z","title":"Red-teaming the stable diffusion safety filter.arXiv preprint arXiv:2210.04610, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10047","last_updated":"2025-06-11T09:09:12Z","snapshot_observed_at":"2026-08-09T06:09:10.228296Z","submitted_at":"2025-06-11T09:09:12Z","title":"GenBreak: Red Teaming Text-to-Image Generators Using Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:19.067456Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2506.10047"},"observation_digest":"sha256:87f7e433e3965e86a84c09dcaef090cd906e5eea7f2f8c50b18f6d47ede3979c","observation_id":"4bda3e92-afa6-4747-8e32-8713eaafad36","resolution":{"observed_at":"2026-08-07T04:52:19.067456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-07T00:27:19.703033Z","title":"Red-teaming the stable dif- fusion safety filter","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14018","last_updated":"2025-06-16T21:30:42Z","snapshot_observed_at":"2026-08-08T14:20:33.436519Z","submitted_at":"2025-06-16T21:30:42Z","title":"\"I Cannot Write This Because It Violates Our Content Policy\": Understanding Content Moderation Policies and User Experiences in Generative AI Products","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:19.703033Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2506.14018"},"observation_digest":"sha256:1dcf97e5b1826d183fcb2e88dd560a9a450d482ecd854f9782e3606c1f98c273","observation_id":"69baffef-f6b4-46e3-9668-eefda73c5a92","resolution":{"observed_at":"2026-08-07T00:27:19.703033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-06T19:06:39.320386Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07137","last_updated":"2025-07-09T00:51:09Z","snapshot_observed_at":"2026-08-09T04:04:53.987710Z","submitted_at":"2025-07-09T00:51:09Z","title":"Automating Evaluation of Diffusion Model Unlearning with (Vision-) Language Model World Knowledge","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T19:06:39.320386Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2507.07137"},"observation_digest":"sha256:ec246da8cd9fa57a56b97c9377f24d466df95d9fd0df91e02ee0f7d955f7d0ac","observation_id":"4eeff8dc-5b69-434e-906a-28513f8aff3a","resolution":{"observed_at":"2026-08-06T19:06:39.320386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-06T16:26:21.324774Z","title":"Red-teaming the stable diffusion safety filter.arXiv preprint arXiv:2210.04610, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13598","last_updated":"2025-07-18T01:47:07Z","snapshot_observed_at":"2026-08-09T06:08:34.896896Z","submitted_at":"2025-07-18T01:47:07Z","title":"GIFT: Gradient-aware Immunization of diffusion models against malicious Fine-Tuning with safe concepts retention","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:21.324774Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2507.13598"},"observation_digest":"sha256:100d2b7fbf702024c56bc132a29f90b7539e079b003862f29ab6932f850f5e8f","observation_id":"097224c5-febd-4b76-8172-0094a64d1d89","resolution":{"observed_at":"2026-08-06T16:26:21.324774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-06T11:42:04.433290Z","title":"Rando, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22499","last_updated":"2025-07-30T09:12:25Z","snapshot_observed_at":"2026-08-07T22:01:09.686657Z","submitted_at":"2025-07-30T09:12:25Z","title":"LoReUn: Data Itself Implicitly Provides Cues to Improve Machine Unlearning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:42:04.433290Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2507.22499"},"observation_digest":"sha256:50a33ec34e6d5ef3bc53c36120bc49c58fdc81338f6b5a42c504a5e716708970","observation_id":"2fbce953-4f82-4367-8d18-e88c5bd672cc","resolution":{"observed_at":"2026-08-06T11:42:04.433290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-06T17:42:50.883150Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.03696","last_updated":"2025-07-14T11:57:16Z","snapshot_observed_at":"2026-08-09T06:08:32.342244Z","submitted_at":"2025-07-14T11:57:16Z","title":"PLA: Prompt Learning Attack against Text-to-Image Generative Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:50.883150Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2508.03696"},"observation_digest":"sha256:aa3094feebb54606d99f6d0c89e73d78e351db9074e4755a3835d42c553f84de","observation_id":"d30b25dc-9f4c-4de3-884c-2cbb25a12374","resolution":{"observed_at":"2026-08-06T17:42:50.883150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-06T00:04:32.495158Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04472","last_updated":"2025-08-06T14:19:32Z","snapshot_observed_at":"2026-08-09T06:08:47.407244Z","submitted_at":"2025-08-06T14:19:32Z","title":"Zero-Residual Concept Erasure via Progressive Alignment in Text-to-Image Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:04:32.495158Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2508.04472"},"observation_digest":"sha256:c55ee21f61963448c09db70435232bad445449436564f8ddbb0d000a41438794","observation_id":"90b66d53-051e-443c-8811-51c3df87e4ca","resolution":{"observed_at":"2026-08-06T00:04:32.495158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-05T22:32:12.208299Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06841","last_updated":"2025-08-09T05:48:30Z","snapshot_observed_at":"2026-08-09T08:48:11.649795Z","submitted_at":"2025-08-09T05:48:30Z","title":"Memory Enhanced Fractional-Order Dung Beetle Optimization for Photovoltaic Parameter Identification","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T22:32:12.208299Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2508.06841"},"observation_digest":"sha256:566527a3efc5e64e6f08af7d34df90007b62ee9e61061275129668a66321896c","observation_id":"f987b762-6819-4523-97cb-fd03d07f2c17","resolution":{"observed_at":"2026-08-05T22:32:12.208299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-03T19:59:09.542591Z","title":"and et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11815","last_updated":"2026-05-23T23:07:49Z","snapshot_observed_at":"2026-08-03T19:58:58.153442Z","submitted_at":"2025-11-26T18:59:43Z","title":"Video Deepfake Abuse: How Company Choices Predictably Shape Misuse Patterns","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-03T19:59:09.542591Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2512.11815"},"observation_digest":"sha256:2c0e108e56005a22b5d5e2d113395644099df38dfd2a80557b3e76912d455b13","observation_id":"9a309734-ec7d-45e8-956f-e17ebd7a4b4c","resolution":{"observed_at":"2026-08-03T19:59:09.542591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-03T05:05:53.583424Z","title":"Red-teaming the stable diffusion safety filter.arXiv preprint arXiv:2210.04610,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.03410","last_updated":"2026-06-03T20:46:40Z","snapshot_observed_at":"2026-08-09T06:08:33.503710Z","submitted_at":"2026-02-03T11:37:08Z","title":"UnHype: CLIP-Guided Hypernetworks for Dynamic LoRA Unlearning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T05:05:53.583424Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2602.03410"},"observation_digest":"sha256:735095d3d32e2c77c81b8703e1350bee00dd52f4feea6acbfdefeb05d29d8e82","observation_id":"dceef4ca-9a89-4e9f-a4f9-a8325bacb57a","resolution":{"observed_at":"2026-08-03T05:05:53.583424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2604.04575","last_updated":"2026-04-06T10:16:42Z","snapshot_observed_at":"2026-07-06T22:53:33.177713Z","submitted_at":"2026-04-06T10:16:42Z","title":"Erasure or Erosion? Evaluating Compositional Degradation in Unlearned Text-To-Image Diffusion Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T19:13:19.165859Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2604.04575"},"observation_digest":"sha256:e3d1eca6672b9785e0e07bdf850ed6e0f434ffefcb61a566e16f653789be188f","observation_id":"92d5cfe2-ccd0-4d97-a30c-51ef6141b5c3","resolution":{"observed_at":"2026-05-10T23:20:51.485800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2604.06285","last_updated":"2026-04-07T12:49:24Z","snapshot_observed_at":"2026-08-05T21:05:58.046027Z","submitted_at":"2026-04-07T12:49:24Z","title":"Harnessing Hyperbolic Geometry for Harmful Prompt Detection and Sanitization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T19:55:16.003348Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2604.06285"},"observation_digest":"sha256:eecf7370bcb3f09b3e44520740d06af0003e9d0ca9a287c037a901ffe89f56d6","observation_id":"e1bdc07c-9e5e-4a0a-8116-98935ba9876c","resolution":{"observed_at":"2026-05-10T22:25:49.139747Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2604.09213","last_updated":"2026-04-10T11:07:33Z","snapshot_observed_at":"2026-08-03T11:22:09.371179Z","submitted_at":"2026-04-10T11:07:33Z","title":"SHIFT: Steering Hidden Intermediates in Flow Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T18:33:59.134475Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2604.09213"},"observation_digest":"sha256:45aaa1d81f57a4d5374d9daab0bb38a9cb6c5becfa1aaf1215da79c37c4e5757","observation_id":"e5cfc204-e8dd-4a88-b43c-d39fea4360d7","resolution":{"observed_at":"2026-05-11T00:20:55.653350Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2604.09253","last_updated":"2026-04-10T12:09:06Z","snapshot_observed_at":"2026-07-06T22:58:12.847181Z","submitted_at":"2026-04-10T12:09:06Z","title":"Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T18:03:36.805784Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2604.09253"},"observation_digest":"sha256:e25d0aa8734e10c33a87632c9c90ae71b33397f9608f58c85d375e1c18336c52","observation_id":"b5b97f17-2c94-4283-9dba-15eed072a9e5","resolution":{"observed_at":"2026-05-11T05:35:59.083195Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2604.10032","last_updated":"2026-04-11T05:06:15Z","snapshot_observed_at":"2026-07-06T22:58:43.155246Z","submitted_at":"2026-04-11T05:06:15Z","title":"Closed-Form Concept Erasure via Double Projections","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T16:44:57.265729Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2604.10032"},"observation_digest":"sha256:2c94dc08654eac484dcfbd32e8f9dba1bcf66893b19d1e6b484ab6c04800dc33","observation_id":"189cbbb5-cfcd-4f2c-91f3-49d1b99dfcec","resolution":{"observed_at":"2026-05-11T08:16:00.850753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2604.25119","last_updated":"2026-04-28T01:54:25Z","snapshot_observed_at":"2026-07-06T23:11:02.043135Z","submitted_at":"2026-04-28T01:54:25Z","title":"Evaluation without Generation: Non-Generative Assessment of Harmful Model Specialization with Applications to CSAM","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.775120Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2604.25119"},"observation_digest":"sha256:636bbfbb29ca935a4e451da8a42afb91b7ceafb11d980eefa803ca54ee62c89c","observation_id":"ba0a17e2-f99f-49b2-8b94-91b70afdf8fc","resolution":{"observed_at":"2026-05-11T23:31:14.149119Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2605.01113","last_updated":"2026-05-01T21:33:06Z","snapshot_observed_at":"2026-08-08T22:01:38.242789Z","submitted_at":"2026-05-01T21:33:06Z","title":"Disciplined Diffusion: Text-to-Image Diffusion Model against NSFW Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T19:03:00.734760Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2605.01113"},"observation_digest":"sha256:2fe5d379eb2d718642d52df2a9badc74bf2ea3290a0163b11c2cb0f7bc933ee9","observation_id":"62d51980-131a-4b20-a2a3-6194ef5b767d","resolution":{"observed_at":"2026-05-11T15:56:27.429603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2605.18719","last_updated":"2026-05-18T17:50:04Z","snapshot_observed_at":"2026-08-03T04:40:08.919496Z","submitted_at":"2026-05-18T17:50:04Z","title":"SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T11:26:55.810822Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2605.18719"},"observation_digest":"sha256:2aff243aba41b373f18c1342671efd5a00f3cb60549bfbf7a6763341c60bab63","observation_id":"edc70e0c-ed98-45da-84d0-95b651723d13","resolution":{"observed_at":"2026-05-20T11:28:14.348923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2605.19739","last_updated":"2026-05-25T09:07:55Z","snapshot_observed_at":"2026-08-01T10:43:34.293585Z","submitted_at":"2026-05-19T12:10:09Z","title":"FlowErase-RL: Rethinking Concept Erasure as Reward Optimization in Flow Matching Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T05:27:47.218349Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2605.19739"},"observation_digest":"sha256:2a123661d05cce5e206ed1a336793246d68588a9f673ab11b0f5e19093f81541","observation_id":"509a8273-35c9-4845-9910-af04415903b5","resolution":{"observed_at":"2026-05-20T05:28:04.249811Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2605.19739","last_updated":"2026-05-25T09:07:55Z","snapshot_observed_at":"2026-08-01T10:43:34.293585Z","submitted_at":"2026-05-19T12:10:09Z","title":"FlowErase-RL: Rethinking Concept Erasure as Reward Optimization in Flow Matching Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T18:18:15.772860Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2605.19739"},"observation_digest":"sha256:b1aa99f2964e71710fb1b95d97a5220cccfa840278c3b06de9c199de3db9efde","observation_id":"c1b7f489-b809-418a-8ea3-e69f29e76800","resolution":{"observed_at":"2026-07-01T15:05:47.554863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2605.26332","last_updated":"2026-05-25T21:11:59Z","snapshot_observed_at":"2026-08-06T04:03:58.549335Z","submitted_at":"2026-05-25T21:11:59Z","title":"Erased but Exploitable: Black-box Embedding-Aware Prompting Against Unlearned Text-to-Image Diffusion Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T22:14:36.290982Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2605.26332"},"observation_digest":"sha256:67c02b4d4e8ccc6c8f95112d38c6715754edaab6f6ec6c86b6fededffb0952b7","observation_id":"09ed3b0f-e5aa-46df-a790-2325131c2d3f","resolution":{"observed_at":"2026-06-29T22:34:02.827904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2605.29390","last_updated":"2026-05-28T05:43:43Z","snapshot_observed_at":"2026-08-07T09:40:21.399335Z","submitted_at":"2026-05-28T05:43:43Z","title":"Orthogonal Negative Guidance in Attention Feature Space for Text-to-Image Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T08:30:02.532832Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2605.29390"},"observation_digest":"sha256:422e5335a50c083cd491af76ffffe84ce83bc69e032544b416a7fb7f2826a3aa","observation_id":"a6519072-f836-4a2b-960e-a315f47b80ce","resolution":{"observed_at":"2026-06-29T08:33:15.048106Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.00140","last_updated":"2026-06-10T10:51:44Z","snapshot_observed_at":"2026-08-08T09:53:22.854267Z","submitted_at":"2026-05-29T00:02:41Z","title":"Geometric Erasure by Contrastive Velocity Matching in Rectified Flows","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T23:50:44.624338Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.00140"},"observation_digest":"sha256:9c4520b022d2cf71af24d2e30c1486d72f592a20e691fbe96dfb31af2d26e914","observation_id":"63f3040b-738c-4105-bb12-15918d9fe22a","resolution":{"observed_at":"2026-06-28T23:52:49.372925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.01837","last_updated":"2026-06-01T07:49:12Z","snapshot_observed_at":"2026-08-09T06:01:25.866428Z","submitted_at":"2026-06-01T07:49:12Z","title":"Benign Inputs, Harmful Outputs: Cross-Modal Jailbreaking via Distributed Semantic Recomposition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T14:17:52.902183Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.01837"},"observation_digest":"sha256:b4fcf59161baeedb863536724a0cbadb9223259ad189009a199ba2f72068e539","observation_id":"cc55cab7-ae3a-47b2-a32c-79e6451a5842","resolution":{"observed_at":"2026-07-01T23:26:23.287355Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.02453","last_updated":"2026-06-01T16:25:10Z","snapshot_observed_at":"2026-08-02T22:48:07.065976Z","submitted_at":"2026-06-01T16:25:10Z","title":"Initialization is Half the Battle: Generating Diverse Images from a Guidance Potential Posterior","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T15:19:32.238094Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.02453"},"observation_digest":"sha256:4579bcd5d13ba514a9cf784ce3db8711f579906c04da7022a8606603bfb06bc6","observation_id":"eec0650a-35c6-4258-bffd-8661e9867565","resolution":{"observed_at":"2026-07-01T22:36:16.679465Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.06140","last_updated":"2026-06-04T13:19:53Z","snapshot_observed_at":"2026-07-06T23:46:01.165261Z","submitted_at":"2026-06-04T13:19:53Z","title":"RedEdit: Agentic Red-Teaming of Image Safety Classifiers via MCTS-Guided Photo-Editing","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-28T00:42:33.088388Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.06140"},"observation_digest":"sha256:0f2300c9480b512befd84e4e781599d219c6bb92611a6136722f4f39c86d4d66","observation_id":"771d36e9-0670-42fd-936b-1f580833b4b8","resolution":{"observed_at":"2026-07-02T14:07:02.811855Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.06356","last_updated":"2026-06-20T22:01:08Z","snapshot_observed_at":"2026-08-07T19:08:32.937069Z","submitted_at":"2026-06-04T16:24:39Z","title":"Where Should Knowledge Enter? A Layered Framework for Knowledge Infusion in Multimodal Iterative Generative Model","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T01:28:55.698724Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.06356"},"observation_digest":"sha256:59ba1be37e8fb8755af57c1a41f2b091f9738c5a88ee38d2b8b5be6fca90ddd7","observation_id":"3831dd77-d44e-4b0f-8849-4381e9cb55a6","resolution":{"observed_at":"2026-07-02T13:16:58.543137Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.06875","last_updated":"2026-06-05T03:43:04Z","snapshot_observed_at":"2026-08-08T17:46:30.236646Z","submitted_at":"2026-06-05T03:43:04Z","title":"Unified Safe In-context Image Generation in Multimodal Diffusion Transformers via Restricting Unsafe Information Flows","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T22:58:44.478077Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.06875"},"observation_digest":"sha256:0a8689b000410d4203c1772f76f3e547dd64312cff2bfced675f4a59030a6589","observation_id":"ce4804bc-5012-46ae-86b3-58ab0b04dd2b","resolution":{"observed_at":"2026-07-02T16:07:09.105956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.17257","last_updated":"2026-06-15T20:03:09Z","snapshot_observed_at":"2026-08-02T05:58:02.918004Z","submitted_at":"2026-06-15T20:03:09Z","title":"Pulling The REINS: Training-Free Safety Alignment of Video Diffusion Models via Representation Steering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T03:44:36.071488Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.17257"},"observation_digest":"sha256:b274d66c69572934ebcc0632ce79b4ced858653fdc3878b692977c57efa6f084","observation_id":"508e50a8-f7bf-454a-a0cd-32d27c4895c5","resolution":{"observed_at":"2026-07-03T17:48:45.925768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.24192","last_updated":"2026-06-23T06:22:00Z","snapshot_observed_at":"2026-08-06T06:51:13.657171Z","submitted_at":"2026-06-23T06:22:00Z","title":"Co-occurring associated retained concepts in Diffusion Unlearning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-26T00:50:58.689718Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.24192"},"observation_digest":"sha256:97772d456b20767d4b59e84e2b4918162318f2086a8a6f9cd1afd48b21c36f4d","observation_id":"9edef38f-2782-43e0-97bf-b8ffdb098c6a","resolution":{"observed_at":"2026-07-04T16:09:57.486746Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.25548","last_updated":"2026-06-24T08:25:30Z","snapshot_observed_at":"2026-08-02T15:09:20.888954Z","submitted_at":"2026-06-24T08:25:30Z","title":"Concept Removal for Frontier Image Generative Models","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-06-25T21:18:32.620951Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.25548"},"observation_digest":"sha256:32f2d10d30159d0f485eedec4ff3d30cdb93ba644e5d96e6f4f6de8cb699b15c","observation_id":"11244526-f4b7-414c-80b4-95699b93d437","resolution":{"observed_at":"2026-07-04T19:30:07.410007Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":"2210.04610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-04T19:30:07.408628Z","title":"Red-teaming the stable diffusion safety filter","venue":null,"work_id":"1b6a63ba-2fb7-4f9d-9974-9d2761fff3d7","year":2022},"citing_paper":{"arxiv_id":"2606.27147","last_updated":"2026-06-25T15:18:31Z","snapshot_observed_at":"2026-07-07T00:01:24.919835Z","submitted_at":"2026-06-25T15:18:31Z","title":"Safe Autoregressive Image Generation with Iterative Self-Improving Codebooks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T05:51:01.446139Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2606.27147"},"observation_digest":"sha256:a04fd60dd01b243a70b90927cce3a085810ee7148336f3f0af8c6ba85dc22457","observation_id":"9d19c59f-add2-4392-a18a-58a68fe889b0","resolution":{"observed_at":"2026-07-04T12:49:52.907553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-12T09:37:15.997513Z","title":"Red-teaming the stable diffusion safety filter.arXiv preprint arXiv:2210.04610, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.02582","last_updated":"2026-07-01T00:20:58Z","snapshot_observed_at":"2026-08-09T06:08:34.403035Z","submitted_at":"2026-07-01T00:20:58Z","title":"Evaluating Intellectual Property Guardrails of Generative Image Models: A Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T09:37:15.997513Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2607.02582"},"observation_digest":"sha256:3bc6508ff02a41747a1a0b5c66c6437cf683420eeae0d99a6497b0295b4e3e3b","observation_id":"b4211f0d-2159-4da2-837f-294e9363b48e","resolution":{"observed_at":"2026-07-12T09:37:15.997513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-02T00:41:54.327706Z","title":"arXiv preprint arXiv:2210.04610 (2022) 1, 3","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14945","last_updated":"2026-07-16T12:53:45Z","snapshot_observed_at":"2026-08-09T09:27:19.831637Z","submitted_at":"2026-07-16T12:53:45Z","title":"Introspective Attention Modulation for Safe Text-to-Image Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:54.327706Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2607.14945"},"observation_digest":"sha256:af75efa28df4e813e9eb828f173fd15ac0d2cf78c1a7cbb3ec34c38abab846c3","observation_id":"5bc1920f-8788-4ea1-adde-2a285b409554","resolution":{"observed_at":"2026-08-02T00:41:54.327706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-01T17:07:54.486767Z","title":"arXiv preprint arXiv:2210.04610 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17779","last_updated":"2026-07-20T10:09:30Z","snapshot_observed_at":"2026-08-06T08:52:24.582710Z","submitted_at":"2026-07-20T10:09:30Z","title":"Dynamic Defense Profiling Enables Cognitive Jailbreak of Text-to-Image Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T17:07:54.486767Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2607.17779"},"observation_digest":"sha256:f38d393d80552d36decc7a5c30276af400d034b312d8184323b1f0eb9462fb9e","observation_id":"87ceca04-b934-45cf-a12e-bcc1bdbcd289","resolution":{"observed_at":"2026-08-01T17:07:54.486767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-31T23:33:57.639498Z","title":"arXiv preprint arXiv:2210.04610 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23934","last_updated":"2026-07-27T02:11:58Z","snapshot_observed_at":"2026-08-07T14:21:47.373100Z","submitted_at":"2026-07-27T02:11:58Z","title":"DECAF: De-Clustering for Adaptive Representational Unlearning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-07-31T23:33:57.639498Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2607.23934"},"observation_digest":"sha256:765ff023852addd13765535e56f357874ef96f77505b3a8150e4b9781d29524b","observation_id":"dab85d5f-c012-4c50-b048-84e37d048f83","resolution":{"observed_at":"2026-07-31T23:33:57.639498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-07-31T09:23:52.492793Z","title":"arXiv preprint arXiv:2210.04610 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24897","last_updated":"2026-07-27T16:41:36Z","snapshot_observed_at":"2026-08-03T19:46:21.991125Z","submitted_at":"2026-07-27T16:41:36Z","title":"TYPO: Instruction-Dense Visual Jailbreaks against Commercial Closed-Source Image-Generation Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-31T09:23:52.492793Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2607.24897"},"observation_digest":"sha256:e397f60e8d963109c7612a307dd709c25460863ea809cd3712d25d6a0c8f0991","observation_id":"d1e860ea-16ee-43f7-bec3-4b0c4c30aa4a","resolution":{"observed_at":"2026-07-31T09:23:52.492793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-07T00:14:43.164166Z","title":"arXiv preprint arXiv:2210.04610 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04034","last_updated":"2026-08-03T02:28:52Z","snapshot_observed_at":"2026-08-09T03:07:12.142624Z","submitted_at":"2026-08-03T02:28:52Z","title":"A Multimodal Automatic Redteaming Evaluation based on Atomic Jailbreak Strategy Decoupling and Combination","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:43.164166Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2608.04034"},"observation_digest":"sha256:090a20f958539f7655db0616fd7ca1808a72cadc482ec2ceb30c12a3d410ac55","observation_id":"01080458-b9aa-43e6-a40b-854760dd5075","resolution":{"observed_at":"2026-08-07T00:14:43.164166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2210.04610/citation-record","integrity":"/paper/2210.04610/integrity","json":"/paper/2210.04610/citation-record.json","paper":"/paper/2210.04610"},"outbound":[],"paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","latest_version":5,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 44 inbound Pith citation observations for arXiv:2210.04610."}