{"as_of":"2026-08-09T21:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0058879638fae081a01f60ec3cbab376ee146adc6b83e1053d871e1001ff3933","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:46:22.123029Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:07:54.406120Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21074","snapshot_observed_at":"2026-08-01T17:07:54.406120Z","title":"arXiv preprint arXiv:2505.21074 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17779","last_updated":"2026-07-20T10:09:30Z","snapshot_observed_at":"2026-08-06T08:52:24.582710Z","submitted_at":"2026-07-20T10:09:30Z","title":"Dynamic Defense Profiling Enables Cognitive Jailbreak of Text-to-Image Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T17:07:54.406120Z"},"links":{"cited_paper":"/paper/2505.21074","citing_paper":"/paper/2607.17779"},"observation_digest":"sha256:ba97e3df18251194dc2c55a1f3f2e3c42469a5d9722484aa3a11a6291d2fe1d1","observation_id":"5c1193e1-97d5-4b17-87cc-4696d85cad53","resolution":{"observed_at":"2026-08-01T17:07:54.406120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21074/citation-record","integrity":"/paper/2505.21074/integrity","json":"/paper/2505.21074/citation-record.json","paper":"/paper/2505.21074"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:31.215468Z","title":"Celebrity classifier, 2024","venue":null,"work_id":"60d52208-2995-4e3e-999e-9e0a3207e2d4","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.287994Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:b7607aa71f1f0a31e9a70a331ad2298846e7e21e7fad32b1dcf4d898a058399a","observation_id":"7213e407-a76a-4499-98d8-1eff255774e3","resolution":{"observed_at":"2026-08-07T13:46:31.309743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:31.067903Z","title":"Surrogateprompt: Bypassing the safety filter of text-to-image models via substitution","venue":null,"work_id":"e06dfdfc-d09f-470f-8cba-325fdaf72312","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.362359Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:477128982ef3d437c913878e041d94665a6c9dabb354dcedcb0ec8e3abbdf3df","observation_id":"52b76d30-af06-4380-ab6c-0093d1036098","resolution":{"observed_at":"2026-08-07T13:46:31.130812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:17.480819Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.480819Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:19d9d57ad11c5968d03f59069822dace22a4a65e062e9edb729ed2046cc02162","observation_id":"bcc243bd-3f42-4d95-a364-1966322f6252","resolution":{"observed_at":"2026-08-07T13:46:17.480819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:30.861647Z","title":"Towards evaluating the robustness of neural networks","venue":null,"work_id":"d3f5c4fd-1348-417d-9cbe-3aec0b85f1f2","year":2017},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.629073Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:56eaab3e939c34ee775ac77e3e2b06d7b07d34e1e84568c1b40e5311d10f8f28","observation_id":"60ddc307-4acc-4a61-979d-5aec513355aa","resolution":{"observed_at":"2026-08-07T13:46:30.954023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:30.642797Z","title":"Efficient black-box adversarial attacks via bayesian optimization guided by a function prior","venue":null,"work_id":"7535cb8d-c668-440c-8ec8-1679b408d601","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.704629Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:bc86c56ae29dbcc3915527a7ac69e8ceef56eb455530442e4064862f57272629","observation_id":"d8a54403-6929-4971-924e-d969aef0812a","resolution":{"observed_at":"2026-08-07T13:46:30.731532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:30.454231Z","title":"Nsfw classifier, 2020","venue":null,"work_id":"3828ee98-197e-4680-bea5-dcb72189d5e1","year":2020},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.779619Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:702032d3289b073be88d23e72d955aff308ddd58fa9caf3f7f7083085505013c","observation_id":"f4b6bd00-7fad-41a3-9d6a-df6070c773fb","resolution":{"observed_at":"2026-08-07T13:46:30.541079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:17.851622Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality.See https://vicuna","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.851622Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:67d1ddd5dcb93ad884f59c9495cf4a6ad5e8ee6d78e70d9edaade1aede7ed9f2","observation_id":"2607205e-a345-4de2-aa19-8657327b69d4","resolution":{"observed_at":"2026-08-07T13:46:17.851622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:30.264755Z","title":"Prompt- ing4debugging: Red-teaming text-to-image diffusion models by finding problematic prompts","venue":null,"work_id":"871ad6bd-bfef-4dd7-b630-41fd10dd1142","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:17.933859Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:795757e87fe9c7421dff1314d34f0c7b6082964a10b6cf70599bb84fe0eade5d","observation_id":"302a729b-f1e9-4599-b678-568309be19f4","resolution":{"observed_at":"2026-08-07T13:46:30.350547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:30.099394Z","title":"Ai, governance and ethics: Global perspectives.Deakin University, 2022","venue":null,"work_id":"15d351e8-83ca-4459-8d47-96deb08afc07","year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.013363Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:1ce7a16e848655c37db64bcf3d97b448db81d2539fc83379167b0d81658fa3e0","observation_id":"09c609b7-e181-448e-bb7a-fe6c85f3a22c","resolution":{"observed_at":"2026-08-07T13:46:30.195262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:29.941507Z","title":"DiffZOO: A purely query-based black-box attack for red-teaming text-to-image generative model via zeroth order optimization","venue":null,"work_id":"74e420ed-978b-46e4-bf58-03740d500ca8","year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.123454Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:ce9a49cd56afee0199034be04dadae93fd1bf12fa385f59e1e86b2eff028f999","observation_id":"bd1da015-bdc2-4b01-b211-9c0d292871b5","resolution":{"observed_at":"2026-08-07T13:46:30.011805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07130","last_updated":"2024-11-23T03:07:31Z","snapshot_observed_at":"2026-07-06T17:00:20.655757Z","submitted_at":"2023-12-12T10:04:43Z","title":"Harnessing LLM to Attack LLM-Guarded Text-to-Image Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07130","snapshot_observed_at":"2026-08-07T13:46:18.229670Z","title":"Divide-and-conquer attack: Harnessing the power of llm to bypass the censorship of text-to-image generation model.arXiv preprint arXiv:2312.07130, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.229670Z"},"links":{"cited_paper":"/paper/2312.07130","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:78d84a1dc246af67326774975ff20069b26ddac699817fe010b6fb61abc9e44f","observation_id":"e67544bf-ce66-444a-bb28-aef262b2cd78","resolution":{"observed_at":"2026-08-07T13:46:18.229670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:29.725992Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"e2444442-f0a2-4120-a205-c9c96c5dae20","year":2021},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.350445Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:49580b6fa10bab56ed2387c731bc3dc3eda9d5e865f563b176ed8a0c5cc4d4e2","observation_id":"e7ffd36d-b273-4386-b1f0-8e5745dab2f0","resolution":{"observed_at":"2026-08-07T13:46:29.815910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:29.574237Z","title":"Fuzz-testing meets llm-based agents: An automated and efficient framework for jailbreaking text-to-image generation models","venue":null,"work_id":"f02618a9-d9c4-4c1d-9f37-7433704f2746","year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.428990Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:38131018cea3ec1118e5ca1b9a1e6e9bbe2ea36477f99b598acb3b1ebcdecc16","observation_id":"477227f5-33d7-44e2-ab34-fed481a1730b","resolution":{"observed_at":"2026-08-07T13:46:29.646645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:29.387325Z","title":"Boosting adversarial attacks with momentum","venue":null,"work_id":"6c84b08b-5c1f-49bd-9e6e-5fcbd0d44000","year":2018},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.560756Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:1b11778d82b8b67d1b37dbdda4951f040ca503aa2029d53b2afb5991f506e2fe","observation_id":"fbcc5485-8414-4efd-9802-e7b7a685f6fe","resolution":{"observed_at":"2026-08-07T13:46:29.475005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:18.643073Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.643073Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:eb822b76e9ebf066bb8d3e4eebdad47d5b2757e9b9eb5b988d0465dd59647145","observation_id":"4f7466b9-fadd-4353-bd4f-fec8b7f93bc9","resolution":{"observed_at":"2026-08-07T13:46:18.643073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:29.265565Z","title":"Erasing concepts from diffusion models","venue":null,"work_id":"1a9245cb-4706-4640-8f80-2b61116a8889","year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.750909Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:e1e41d2b732f9604347c00c6085b8a32d97e7e4feda3f8a5d6b922ae3bb4b89a","observation_id":"50b48699-5fc3-4594-b4b8-2746fffee5bd","resolution":{"observed_at":"2026-08-07T13:46:29.331992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13896","last_updated":"2024-12-15T05:13:26Z","snapshot_observed_at":"2026-08-09T20:26:27.438723Z","submitted_at":"2024-08-25T17:33:40Z","title":"HTS-Attack: Heuristic Token Search for Jailbreaking Text-to-Image Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13896","snapshot_observed_at":"2026-08-07T13:46:18.819612Z","title":"Rt-attack: Jailbreaking text-to-image models via random token.arXiv preprint arXiv:2408.13896, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.819612Z"},"links":{"cited_paper":"/paper/2408.13896","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:382199487f031b8315d843725b3e3171dd26d48ee78dd6af1eb1ab08e09d1ecf","observation_id":"d26723c8-9118-4275-900c-63bbd3b3025c","resolution":{"observed_at":"2026-08-07T13:46:18.819612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:28.998021Z","title":"Nsfw words list, 2020","venue":null,"work_id":"7891ea70-b8a6-4051-8969-9d30e10fa9e0","year":2020},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.848754Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:d700c71f495def3c236cb35032fe401f3afdb097f6c9dec058e1b575e68a82c6","observation_id":"4a49ab0d-39c9-47a6-8212-c417de26dce8","resolution":{"observed_at":"2026-08-07T13:46:29.140756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:18.920350Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.920350Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:1d932d1fe64047a6b7f539bcc997faf4f3b6da60d3eb804974dd2066c99dd1d2","observation_id":"240eb587-21fe-4047-8a0d-aaf97b6f29df","resolution":{"observed_at":"2026-08-07T13:46:18.920350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20623","last_updated":"2025-02-28T01:02:57Z","snapshot_observed_at":"2026-08-07T17:41:20.665872Z","submitted_at":"2025-02-28T01:02:57Z","title":"SafeText: Safe Text-to-image Models via Aligning the Text Encoder","version":1},"cited_work":{"arxiv_id":"2502.20623","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.20623","snapshot_observed_at":"2026-08-07T13:46:22.852775Z","title":"SafeText: Safe Text-to-image Models via Aligning the Text Encoder","venue":"cs.CR","work_id":"177b50af-93b7-42f9-8096-771eb2de0916","year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:18.998171Z"},"links":{"cited_paper":"/paper/2502.20623","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:a8cc2b2dde4f2eb3e0cdacb2f6fc52ac897702343136341436d249547ec80519","observation_id":"0bb62a34-8a82-465c-a8cf-cbb6bfd04362","resolution":{"observed_at":"2026-08-07T13:46:22.914668Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:19.087710Z","title":"Perception-guided jailbreak against text-to-image models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.087710Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:5c586950985188a9454cb32fafdd110abb804ac86c0f8ef5eb8b95bdecda9673","observation_id":"5e76d815-3402-4269-a9ae-51d7d23df193","resolution":{"observed_at":"2026-08-07T13:46:19.087710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00357","last_updated":"2024-11-30T04:37:38Z","snapshot_observed_at":"2026-07-06T19:59:19.941256Z","submitted_at":"2024-11-30T04:37:38Z","title":"Safety Alignment Backfires: Preventing the Re-emergence of Suppressed Concepts in Fine-tuned Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00357","snapshot_observed_at":"2026-08-07T13:46:19.142147Z","title":"Safety alignment backfires: Preventing the re-emergence of suppressed concepts in fine-tuned text-to-image diffusion models.arXiv preprint arXiv:2412.00357, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.142147Z"},"links":{"cited_paper":"/paper/2412.00357","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:8997e68f5b0693ea3488cfc1f40deae6eaf762ffe9b3b2940eb2c2ada891f978","observation_id":"2a65f958-fe1f-4e54-95f9-0879c7fab595","resolution":{"observed_at":"2026-08-07T13:46:19.142147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:28.671194Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":"95058c04-9ff4-4acb-92f3-19ae2fa3ee4b","year":2015},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.190173Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:f469ae501701865b2d33bf25776198a0bf5e226dbb9936bb1e17920a82b2285f","observation_id":"c4401f9c-69e9-4f5b-806f-e65aa1952635","resolution":{"observed_at":"2026-08-07T13:46:28.807742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:19.268964Z","title":"Ablating concepts in text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.268964Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:eeff45801b3e44ddf94ceb5a1ebb5d8e86d7b237c9aa4b28591aa9302b2705a9","observation_id":"2a8feb87-0ce8-47a5-8314-3684fe06096d","resolution":{"observed_at":"2026-08-07T13:46:19.268964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:28.403837Z","title":"Clip-based nsfw detector, 2023","venue":null,"work_id":"1dddd2a3-5a5c-4409-aec2-3d5d5ef39376","year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.381033Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:2d03bc29d2551dc29f20b3224eb916dc8fb667a8ff820c07212d0347ec54ff07","observation_id":"0506285b-9277-46b0-bd7a-e24fe4bd2c9c","resolution":{"observed_at":"2026-08-07T13:46:28.555116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:28.178950Z","title":"Leonardo.ai, 2022","venue":null,"work_id":"e37b9ee9-a1cd-445e-a349-8a804b8e0468","year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.441404Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:1e202b731a86c2a95f5b4a11d18ed028f30675e792fc003349cc4c540b5beee1","observation_id":"e0f17040-82a2-4d07-bf21-dabba4925994","resolution":{"observed_at":"2026-08-07T13:46:28.287919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:27.932236Z","title":"ART: Automatic red-teaming for text-to-image models to protect benign users","venue":null,"work_id":"4bfd1b5c-cd35-4e36-ac0b-e48fe4ddf200","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.499576Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:16983fb0f2e4a8016603c8e4fe522fdef3401d520f40c9b1632ad02169b08c06","observation_id":"c241e591-9701-4438-9c98-d322404545c0","resolution":{"observed_at":"2026-08-07T13:46:28.064581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:27.718115Z","title":"Nsfw text classifier, 2022","venue":null,"work_id":"7bf9d81d-2515-42af-9765-225b78162d49","year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.584357Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:f9df4dee69ea10037b02a2f49b7df5c5b2779d7503f8bac0cc179e202312b5fd","observation_id":"a55cf6fc-1b2c-45aa-82ed-46267a11149d","resolution":{"observed_at":"2026-08-07T13:46:27.833579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:27.483093Z","title":"Safegen: Mitigating sexually explicit content generation in text-to-image models","venue":null,"work_id":"a4e2fdcc-8b3d-41b7-9696-e9f3c5d21199","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.700940Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:28314f0856a2e70aa424f69e1cc793cb50d9b2c25665737a70f77e409a67da42","observation_id":"0b2ac8c0-6674-4d39-b19a-fb3a38f93b8b","resolution":{"observed_at":"2026-08-07T13:46:27.602149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.11106","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:22.680272Z","title":"Token-level constraint boundary search for jailbreaking text-to-image models.arXiv preprint arXiv:2504.11106, 2025","venue":null,"work_id":"e3101a55-ffa4-46ea-a91d-1a3f30a0a950","year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.764143Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:f5003e95ceb1180389c82a21cd9ebd5c8806db84e3ef7f16571d9b7effe7a196","observation_id":"cc93bfd3-a209-4e05-aaa3-9125c7d85765","resolution":{"observed_at":"2026-08-07T13:46:22.760888Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06679","last_updated":"2025-06-17T07:44:28Z","snapshot_observed_at":"2026-08-08T06:57:13.896585Z","submitted_at":"2025-05-10T16:04:52Z","title":"T2V-OptJail: Discrete Prompt Optimization for Text-to-Video Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06679","snapshot_observed_at":"2026-08-07T13:46:19.818242Z","title":"Jailbreaking the text-to-video generative models.arXiv preprint arXiv:2505.06679, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.818242Z"},"links":{"cited_paper":"/paper/2505.06679","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:d4e3f62a5c863dc0a52d33c86ae29cee424d68991a9f72746edea810481e1d86","observation_id":"a96a5cb0-198f-49a8-b559-c889ee5ccfc7","resolution":{"observed_at":"2026-08-07T13:46:19.818242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10493","last_updated":"2025-06-24T20:53:27Z","snapshot_observed_at":"2026-07-06T20:06:48.183096Z","submitted_at":"2024-12-13T18:59:52Z","title":"AlignGuard: Scalable Safety Alignment for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10493","snapshot_observed_at":"2026-08-07T13:46:19.898008Z","title":"Safetydpo: Scalable safety alignment for text-to-image generation.arXiv preprint arXiv:2412.10493, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.898008Z"},"links":{"cited_paper":"/paper/2412.10493","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:3a82f3906d47fe703e629d5206a4a0db84b72f9d71ab126c0cae9d736f5ea96b","observation_id":"d56c8239-7242-4e50-9f38-e832e98b5b1d","resolution":{"observed_at":"2026-08-07T13:46:19.898008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02928","last_updated":"2025-05-26T11:46:09Z","snapshot_observed_at":"2026-07-06T17:55:16.774337Z","submitted_at":"2024-04-02T09:49:35Z","title":"Jailbreaking Prompt Attack: A Controllable Adversarial Attack against Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02928","snapshot_observed_at":"2026-08-07T13:46:19.995687Z","title":"Jailbreaking prompt attack: A controllable adversarial attack against diffusion models.arXiv preprint arXiv:2404.02928, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:19.995687Z"},"links":{"cited_paper":"/paper/2404.02928","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:e2d2b4791fd7c34be5d1ac3c5957ea0f446dddd1d8b707ef717f91be992a27ad","observation_id":"0fcb33dd-1bf0-4fbb-b678-57ae94190f53","resolution":{"observed_at":"2026-08-07T13:46:19.995687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:27.279904Z","title":"FLIRT: Feedback loop in-context red teaming","venue":null,"work_id":"cd66845a-64f3-4bd7-bf6f-33587a1678cd","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.057011Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:fb5458fa99338c8bd987860e2bcf631b2781791cce2bbd27280d2bd81b9b8e65","observation_id":"9a922576-fcbd-49d4-9ef3-ec890401d18a","resolution":{"observed_at":"2026-08-07T13:46:27.366287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:27.012397Z","title":"Improving robustness of 3d point cloud recognition from a fourier perspective.Advances in Neural Information Processing Systems, 37:68183–68210, 2024","venue":null,"work_id":"024dd834-f013-4ba7-95c1-fa322690d978","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.132921Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:660b78067b9f03bf20d63b8e48e032c11a9a553b115826b4a7346b2e89bc81f9","observation_id":"f1308b71-6a34-489f-9188-096c7e89bb84","resolution":{"observed_at":"2026-08-07T13:46:27.190137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:26.850230Z","title":"Isometric 3d adversarial examples in the physical world","venue":null,"work_id":"be70cce0-fdc4-4d14-b9c1-61dfe12c6b00","year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.234615Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:343b81e135bd3938de07b30f0b9707bd225d2d33b6df597d556f95c7d30568d4","observation_id":"467b4409-30d4-4c1b-9694-2dad6d3548e5","resolution":{"observed_at":"2026-08-07T13:46:26.900403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:26.608800Z","title":"T2vsafetybench: Evaluating the safety of text-to-video generative models","venue":null,"work_id":"94bbf98b-e0d3-41e2-bb35-9612d0730492","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.317381Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:e35543e11bbf7b599b5da462fa1c53c4dd5b2a0bd6d0c138b059a18658858eaf","observation_id":"3cff4872-a4db-43ca-af70-fab9448f06dd","resolution":{"observed_at":"2026-08-07T13:46:26.695208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:26.462151Z","title":"Midjourney, 2022","venue":null,"work_id":"67ddd00a-062b-4033-b7b1-cbfc3bafdc99","year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.355298Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:7a90eda5284e08d45560159903b64d0dd2e44ca02f32a447403b5d5e5b79b417","observation_id":"69bdedcb-bf52-4e33-a01a-823f00e69bd5","resolution":{"observed_at":"2026-08-07T13:46:26.552820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:26.288083Z","title":"Google chief admits ‘biased’ ai tool’s photo diversity offended users, 2024","venue":null,"work_id":"a508677e-4d9a-4cd5-acad-4eebe78eb1c4","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.398140Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:125ee8b9b430d643cd55c9244cc0479b4f47f54e5b70c10a020e9a8a40e948c1","observation_id":"c2945038-ef4b-4fd4-b31f-9bae3ac5353b","resolution":{"observed_at":"2026-08-07T13:46:26.350446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:20.472709Z","title":"Simple open- vocabulary object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.472709Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:e665c06ed9fedcff2caccafed715e7f612706fb2286ef403d229a75d91ffc444","observation_id":"40669cae-625e-4c0b-95cc-e3a97055aa21","resolution":{"observed_at":"2026-08-07T13:46:20.472709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-07T13:46:20.607480Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.607480Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:c1028de20ac5d6e34221bf5b2450fb115ae30b74e36c0af2ed9782ac7a5e4a05","observation_id":"1e66aadb-8579-4289-816f-703d3db17b14","resolution":{"observed_at":"2026-08-07T13:46:20.607480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:26.051519Z","title":"Nudenet, 2024","venue":null,"work_id":"2f29f462-f9fb-43ba-95b1-783df15f6bdd","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.658583Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:bd21ee3d26a5f379ee675e7dcea4d4a7308455dcf8ddfe59534cd41dc5e6bc72","observation_id":"20c340ee-1281-4093-82eb-486d975db18b","resolution":{"observed_at":"2026-08-07T13:46:26.195613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:25.839250Z","title":"Dall-e 3, 2023","venue":null,"work_id":"f9d22354-9b0c-4040-b459-e8b0f02919a7","year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.729195Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:03f4f1c5da5f55c8068582e693e542c31627c74e6e7e51e45bf58d447df04ea2","observation_id":"e29ea114-a80f-483c-bc6b-611cd3d7f48c","resolution":{"observed_at":"2026-08-07T13:46:25.903404Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:20.815343Z","title":"Gpt-4o, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.815343Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:1b38357512d40afe5d83d850ac1d7caf8af726e78bcf3afafc2cbecad327a6a8","observation_id":"071b87ad-f2a8-47fd-9488-db8bb42ca730","resolution":{"observed_at":"2026-08-07T13:46:20.815343Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:25.580837Z","title":"Direct unlearning optimization for robust and safe text-to-image models","venue":null,"work_id":"a5972213-3569-4372-9f68-6b3e7805629b","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.871144Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:1494765bd88c0b0cbcd5446e1e504d6f625bf9aec4e261ed87009de2f84d5756","observation_id":"70071a16-0f91-4d37-849a-69ccbbfe0137","resolution":{"observed_at":"2026-08-07T13:46:25.742889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:25.346719Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"98457b8f-d6b5-4cbc-91d2-42edf83d0acb","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.907396Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:763667b19c7c01c1537259384d16eb7a7b968d189ff0c71a4ddb36380697c078","observation_id":"ee6a0495-1b09-40e9-b9ee-95cc7135e784","resolution":{"observed_at":"2026-08-07T13:46:25.446553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:25.061395Z","title":"Unsafe diffusion: On the generation of unsafe images and hateful memes from text-to-image models","venue":null,"work_id":"5e34da0f-7302-4018-bb33-140f3482500a","year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.955048Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:9cc416aa9cd223eef5a450f4de7b6907c7ef1f563aa3b161a196662ae78f4893","observation_id":"6e1ac51a-2cf5-426b-8df5-e39f2ddf89fc","resolution":{"observed_at":"2026-08-07T13:46:25.166876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:20.994286Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:20.994286Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:61ea329cc7d8036a7c1b2a35692931f88dfd53418650a48ffbb8e807a0e719d7","observation_id":"5a9417ca-ed68-4a39-8c97-2a73725cf61b","resolution":{"observed_at":"2026-08-07T13:46:20.994286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:21.053115Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.053115Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:40887e1a1371e6199b99156f6cea45728bd56909f84740d67f3d5ba22a8fbe43","observation_id":"b9e8a497-3a7b-43f8-b2d4-910d6cfe83a2","resolution":{"observed_at":"2026-08-07T13:46:21.053115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-09T06:08:06.497420Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-07T13:46:21.103762Z","title":"Red-teaming the stable diffusion safety filter.arXiv preprint arXiv:2210.04610, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.103762Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:20240c1efaeff114c34d689dcf924d7714fc86232576e213c5b833a7c8a715e2","observation_id":"069feabf-56b7-48ad-bcbb-71e4bc0b117f","resolution":{"observed_at":"2026-08-07T13:46:21.103762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:24.806971Z","title":"Classification algorithm for skin color (casco): A new tool to measure skin color in social science research.Social Science Quarterly, 104(2):168–179, 2023","venue":null,"work_id":"0c7ecc04-6772-4cb7-90d6-b8f53e821045","year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.169499Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:d94942063b91ea85e4e4fc4b6dfa4266c21c52b776c351466f9c757800677d94","observation_id":"ef9f718a-01fe-4bfa-89c3-a811671efda5","resolution":{"observed_at":"2026-08-07T13:46:24.962779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:21.207599Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.207599Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:868519b182bed029f2a2300b0e992a1e7bfb916764d8dd591048288003134bf4","observation_id":"61c2704e-383b-41d1-b3ef-2b81fb9a26ca","resolution":{"observed_at":"2026-08-07T13:46:21.207599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:21.237818Z","title":"Safe latent diffusion: Mitigating inappropriate degeneration in diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.237818Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:6009159ffcaed72c2c2ae1dce72055a894a5309a83b68e258f50961bdf1f57d3","observation_id":"31582233-3665-4da0-9446-2f272ad18f63","resolution":{"observed_at":"2026-08-07T13:46:21.237818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:24.716989Z","title":null,"venue":null,"work_id":"7c39aa9e-478f-4227-9db9-a0ec72c7842f","year":2022},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.316602Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:6da8f05cf6336e321678a46eb6eb67f6d61052ecdab225b3326a02e54119e8de","observation_id":"37e0f4d0-d0a0-4408-9e1a-0b54fd0edc2d","resolution":{"observed_at":"2026-08-07T13:46:24.780866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-07-06T03:31:33.797310Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-07T13:46:21.369807Z","title":"Intriguing properties of neural networks.arXiv preprint arXiv:1312.6199, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.369807Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:064d1f873326472a3d4b38f5cffbf1371d52f34e63a91b64df993b3e93bbbf6a","observation_id":"88ad7575-0e1c-4f98-9c49-18db54aedb42","resolution":{"observed_at":"2026-08-07T13:46:21.369807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:24.527682Z","title":"Ring-a-bell! how reliable are concept removal methods for diffusion models? In International Conference on Learning Representations, 2024","venue":null,"work_id":"af485c33-bffc-491c-afcb-d2e19dca2a6a","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.433394Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:a2f32c156ea401a9a018a13e1063294b836adc682f48310b4af7446a70a1f015","observation_id":"6738f7f1-63f0-41e7-a1a0-28876b497cf4","resolution":{"observed_at":"2026-08-07T13:46:24.616897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:24.317350Z","title":"The stronger the diffusion model, the easier the backdoor: Data poisoning to induce copyright breacheswithout adjusting finetuning pipeline","venue":null,"work_id":"215eb479-e12a-41d8-bda8-28551685af88","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.472098Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:e35a05314719c3e8677f3efb175cd6f613341e68e62a2cb233825d04deaa0a01","observation_id":"d589ca16-96bc-435f-b1a4-b1300211dcfe","resolution":{"observed_at":"2026-08-07T13:46:24.400324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:21.505094Z","title":"Mma-diffusion: Multimodal attack on diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.505094Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:fff4aa020e17a9e3ac956dc99a4de6b27c5014417b0fea654486df1409b86856","observation_id":"65027b5e-da50-4a00-9771-6d7a9b5c45cd","resolution":{"observed_at":"2026-08-07T13:46:21.505094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:24.137198Z","title":"Guardt2i: Defending text-to-image models from adversarial prompts","venue":null,"work_id":"ac206f07-0d21-45da-a4b0-551b2f3bea5e","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.545043Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:1ac3194ffaeb48515e8e84b6635ab2641048c54fd5deb054730d15ae9d72cd34","observation_id":"5d908c12-fb10-4f01-bd53-86196e7bf2f3","resolution":{"observed_at":"2026-08-07T13:46:24.220464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:21.617031Z","title":"Sneakyprompt: Jailbreaking text-to-image generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.617031Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:23c70ab883d6ca3edc2701fc4cedde00b4a9440427eb4e2e7af1938655733954","observation_id":"f5c7171d-2b61-4b9f-bdbf-32773b1389b9","resolution":{"observed_at":"2026-08-07T13:46:21.617031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:23.951917Z","title":"Safree: Training-free and adaptive guard for safe text-to-image and video generation","venue":null,"work_id":"6ee8793b-a22d-4539-9c7b-c681b7cb683d","year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.675664Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:13d53ee3becbd3b0ffb779848f31ea1332787d53fc6afe55ba4ebe65aebb1984","observation_id":"c5e8d408-10f4-4b86-a1f4-51e7ddae20af","resolution":{"observed_at":"2026-08-07T13:46:24.028683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:23.763035Z","title":"Generalization bound and new algorithm for clean-label backdoor attack","venue":null,"work_id":"b98c9655-c536-4608-b520-4cad5e91232c","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.740929Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:6c467b0d549f25ee1727aaea2ab04ef4b31a70224a32c5fe8f6bb082e3c2087d","observation_id":"2c06bf45-5431-490c-a162-0ea182b21ecb","resolution":{"observed_at":"2026-08-07T13:46:23.873655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:21.781190Z","title":"Reason2attack: Jailbreaking text-to-image models via llm reasoning.arXiv preprint arXiv:2503.17987, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.781190Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:ffe50ca00e872362315d6d87a433cf870fa6737a4bc44e182053a74bfc0b725b","observation_id":"b0a9bb0f-61ec-4674-89ef-bc34fe84c2aa","resolution":{"observed_at":"2026-08-07T13:46:21.781190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:23.606387Z","title":"Forget-me-not: Learning to forget in text-to-image diffusion models","venue":null,"work_id":"7aeee8d8-71c3-4208-9ad8-ef74698636d6","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.811491Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:b529efc1ac6327acba0fb38c1ca73351192e20ea971674465a9bd37abac9d58c","observation_id":"8faed6ec-0b2e-4ffc-9dca-687387e16f30","resolution":{"observed_at":"2026-08-07T13:46:23.682527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:23.418008Z","title":"Defensive unlearning with adversarial training for robust concept erasure in diffusion models","venue":null,"work_id":"0d91aeca-6c5c-4e90-a608-6669b930125a","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.845321Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:4199fa617d84e3af0d065a764ccb6d80ff9ffebf9afa3be7fddb5ab36def97d5","observation_id":"154b2969-cc2c-41e1-9b9b-22de165de71c","resolution":{"observed_at":"2026-08-07T13:46:23.502622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:23.205828Z","title":"To generate or not? safety-driven unlearned diffusion models are still easy to generate unsafe images","venue":null,"work_id":"881341ba-c374-4ab5-a9f8-162c300b5ae0","year":2025},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.904181Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:23bead9b2e09876fb2cac49b6a54d920e0f40e3a3dabe522bcc8291c39cfd461","observation_id":"15b7c14f-59f1-4b63-b7fc-798547a57951","resolution":{"observed_at":"2026-08-07T13:46:23.312372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-07T13:46:21.978840Z","title":"Open-sora: Democratizing efficient video production for all.arXiv preprint arXiv:2412.20404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:21.978840Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:7c92c0bfb7409d16142906cdcf0eeafa400b15fb20e0266964e416a5e815a37f","observation_id":"8ab008de-a947-42c6-ae96-463eaa733b6a","resolution":{"observed_at":"2026-08-07T13:46:21.978840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:23.035214Z","title":"Toward availability attacks in 3d point clouds","venue":null,"work_id":"785e41f0-bc82-40f2-b883-5b46d55cd4b7","year":2024},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:22.036060Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:f0f314e43a499ac7adb023eb36b5f4ede00fb0b4eb862ef1c4b81b158c5204a5","observation_id":"19c51780-bba0-4ba0-ae09-2d0618bf543b","resolution":{"observed_at":"2026-08-07T13:46:23.130581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5344.8826","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:46:22.306631Z","title":"A pilot study of query-free adversarial attack against stable diffusion","venue":null,"work_id":"c4bffbd7-40a6-4e09-85ff-461661c6dafd","year":2023},"citing_paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T13:46:22.123029Z"},"links":{"citing_paper":"/paper/2505.21074"},"observation_digest":"sha256:17c327813d17c38a5fee4325a233fe9406c2ebea5c31ac135635b5b50693f58b","observation_id":"224e5c65-dd55-4502-a2fe-ba86fb6bd002","resolution":{"observed_at":"2026-08-07T13:46:22.366927Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21074","last_updated":"2025-05-27T12:00:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T06:08:33.321110Z","submitted_at":"2025-05-27T12:00:19Z","title":"Red-Teaming Text-to-Image Systems by Rule-based Preference Modeling"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":2,"unresolved":25,"verified_exact":2,"verified_fuzzy":39},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2505.21074."}