{"as_of":"2026-08-15T12:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c83fc24fdc0a29e2580da701a8536dc5472111cc82255cc82947e1800f06275","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:34:36.614045Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T04:35:51.583460Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"cited_work":{"arxiv_id":"2501.08246","doi":"10.48550/arxiv.2501.08246","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Text-diffusionred-teamingoflargelanguagemodels:Unveilingharmfulbehaviorswithproximity constraints, in: Proceedings of the AAAI Conference on Artificial Intelligence","venue":"ArXiv.org","work_id":"e7c3553d-b154-48f0-8c8e-4d9c9485502a","year":2025},"citing_paper":{"arxiv_id":"2606.26566","last_updated":"2026-06-25T03:32:12Z","snapshot_observed_at":"2026-08-12T21:54:41.598451Z","submitted_at":"2026-06-25T03:32:12Z","title":"Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T04:35:51.583460Z"},"links":{"cited_paper":"/paper/2501.08246","citing_paper":"/paper/2606.26566"},"observation_digest":"sha256:f21520d5afe1ea16c82311829f2906fecc6f10b64fd4ebf7f965dface0bd606f","observation_id":"8b94eda2-1069-43b9-baa8-93564a4f492f","resolution":{"observed_at":"2026-06-26T04:38:59.099988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.08246/citation-record","integrity":"/paper/2501.08246/integrity","json":"/paper/2501.08246/citation-record.json","paper":"/paper/2501.08246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.439847Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.439847Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:f84c3b66738730c5ab2768e0e0bcacd971054fbb4dddd0db3dbdf807ccf91227","observation_id":"54713b1b-b6a0-4c6c-b60f-ea6166841c16","resolution":{"observed_at":"2026-08-10T20:34:36.439847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.444124Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.444124Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:b9eede855a81ee4d446cb1c355953147d0efa52a6944a309ba8d674a9d8f0152","observation_id":"b4e231c4-3d29-4810-a314-3e3ad938df36","resolution":{"observed_at":"2026-08-10T20:34:36.444124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T20:34:36.447663Z","title":"L.; Almeida, D.; Altenschmidt, J.; Altman, S.; Anadkat, S.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.447663Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:18daacced37b948db5d74f87b818f0dc582404a8e51329be6251903d236915b5","observation_id":"8f66ff6c-523e-4d0b-afda-50202acd4d96","resolution":{"observed_at":"2026-08-10T20:34:36.447663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.152058Z","title":null,"venue":null,"work_id":"e270dd70-a27f-4af0-b4f2-02cfa1a97ebc","year":2020},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.451582Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:00283f3d3acfbb2ce8dd24f6a899b0038c426672383a41f662090e9a119ff16a","observation_id":"0b63ca7f-11d7-4f89-b660-ec083cdd001e","resolution":{"observed_at":"2026-08-10T20:34:37.155185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.141923Z","title":"D.; Ho, J.; Tarlow, D.; and Van Den Berg, R","venue":null,"work_id":"f5cef62d-a06c-454a-bef8-5e663a2de5b7","year":2021},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.455872Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:3feb32dc40e50c93f13bedc8e0d5dc8582b5636f21b98e474f13143dd5757287","observation_id":"90329bb6-e5bc-40ea-b4b3-1cbf8b197884","resolution":{"observed_at":"2026-08-10T20:34:37.145304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-10T20:34:36.460008Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.460008Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:66fab36b979a30f740c22ffd68eace34469dbcfa4c964af85bcd3fac99999854","observation_id":"ea9cedbe-ee2a-4934-97d3-d2d2149f723d","resolution":{"observed_at":"2026-08-10T20:34:36.460008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-10T20:34:36.464699Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.464699Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:a994423bafb7907cee8ebb4d0a471a155a64d40f2c372f114749fc39aee93887","observation_id":"df5430e5-3588-46bd-861c-d3a40ab04bbc","resolution":{"observed_at":"2026-08-10T20:34:36.464699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09442","last_updated":"2023-10-11T00:37:33Z","snapshot_observed_at":"2026-08-13T11:15:43.333784Z","submitted_at":"2023-06-15T18:49:50Z","title":"Explore, Establish, Exploit: Red Teaming Language Models from Scratch","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09442","snapshot_observed_at":"2026-08-10T20:34:36.468720Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.468720Z"},"links":{"cited_paper":"/paper/2306.09442","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:a54efa7de925aaf02a5df7dafd8704844579604154a449acf10b10a04d3c0dc2","observation_id":"5340d82a-18b8-4cef-977d-3eee2b8506de","resolution":{"observed_at":"2026-08-10T20:34:36.468720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.130747Z","title":null,"venue":null,"work_id":"29e343d4-97a9-4f1c-97ad-398a5d517e81","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.473361Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:89d096d706773b71209ee97b7475c76956324a31adf27232e71e1edde38335a3","observation_id":"365c9c4b-56d9-4845-8b57-59c53a93cc69","resolution":{"observed_at":"2026-08-10T20:34:37.134654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.117974Z","title":null,"venue":null,"work_id":"ba4ced62-bd64-48eb-8d93-47f99b2af53c","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.476547Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:64849fb5ca099b2b6c6bb3328aa148cec7ebf634c3631898110a78d9a98bc436","observation_id":"1ba8fc20-1883-4e38-8485-745a623cc97a","resolution":{"observed_at":"2026-08-10T20:34:37.121822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-13T10:17:00.791443Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-10T20:34:36.481873Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.481873Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:92002bce314830cdce25e0147dca6bd28412311acaf2b080ca839d6cf4fd68f5","observation_id":"a0dacecf-ce7b-4d63-a703-1670304097b0","resolution":{"observed_at":"2026-08-10T20:34:36.481873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.106155Z","title":null,"venue":null,"work_id":"83aa35ca-a8fa-4ece-b65c-4fef90e257dd","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.486401Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:2f4986eb07d5b31da0cc43ff74580dc627c7d79273b5938a74c6c51a9b8f752c","observation_id":"3f0d84e8-bcad-4345-a5de-bab64235c621","resolution":{"observed_at":"2026-08-10T20:34:37.110080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07308","last_updated":"2024-05-02T14:28:39Z","snapshot_observed_at":"2026-08-14T00:09:26.074858Z","submitted_at":"2023-08-14T17:54:10Z","title":"LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07308","snapshot_observed_at":"2026-08-10T20:34:36.490199Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.490199Z"},"links":{"cited_paper":"/paper/2308.07308","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:a9d36bdbba1926d68f2d0c8fa8b14aa14477c427317b04453c3adeda66f2d7fb","observation_id":"a508ff64-cec2-47e7-8263-495216ba1dcf","resolution":{"observed_at":"2026-08-10T20:34:36.490199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.092789Z","title":"R.; Srivastava, A.; and Agrawal, P","venue":null,"work_id":"b6b404e5-3540-4977-8598-f55b8381463e","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.494581Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:6610d117d2d648cffdf9c38c959cdc797c1e32a7f2feb54d5540e100b69b8496","observation_id":"42437c03-9628-4384-9752-c57b2421d182","resolution":{"observed_at":"2026-08-10T20:34:37.097987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-10T20:34:36.498311Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.498311Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:af9fcb859888d5a7706ac1283ec431a790213acaaea1825be003fb4b1364a343","observation_id":"1cee21ef-7d17-4b59-ad84-6728e0ee1c14","resolution":{"observed_at":"2026-08-10T20:34:36.498311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.077987Z","title":null,"venue":null,"work_id":"9ab00a56-26aa-4a49-b221-5e051056409d","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.501953Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:4e0878ecc7fd52b4e339011a255184c2cf6294815be3862168cc988e4aacc91c","observation_id":"b8fd3733-4d92-461d-9447-6f7fc399d0d7","resolution":{"observed_at":"2026-08-10T20:34:37.082435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.066058Z","title":null,"venue":null,"work_id":"22f6c704-4a1c-470e-b8fd-c333a84a9676","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.505093Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:25a41434797765119c36425ffec9203e45cbe1bbad8ad57e99879b102c76a037","observation_id":"b7c7188b-c6f3-4c8e-9eaa-4aa8181e4aaf","resolution":{"observed_at":"2026-08-10T20:34:37.069968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-08-15T05:53:59.943730Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-10T20:34:36.508096Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.508096Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:97e9fc157045a40b52dc7735a059a3585fdfc6d9510686d2b167af5b31fc5d97","observation_id":"ba88c8c3-1e8b-4b93-8a26-bc931f53e8bf","resolution":{"observed_at":"2026-08-10T20:34:36.508096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-14T10:42:15.015647Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-10T20:34:36.511940Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.511940Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:6ba08da20802a9bba52bbbe0e3c8bdc6a78e951820e012080d200aaf3fa8356b","observation_id":"54d2cb09-86ff-4275-bceb-8c9463244fa4","resolution":{"observed_at":"2026-08-10T20:34:36.511940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07124","last_updated":"2023-10-09T03:34:01Z","snapshot_observed_at":"2026-08-13T10:14:14.963909Z","submitted_at":"2023-09-13T17:59:09Z","title":"RAIN: Your Language Models Can Align Themselves without Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07124","snapshot_observed_at":"2026-08-10T20:34:36.517547Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.517547Z"},"links":{"cited_paper":"/paper/2309.07124","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:32962e23e22900d4d2283e50288af5f619288eda85c758bd17eb27682cb58377","observation_id":"bcca81fd-e948-4fc2-824c-4aaca73527ce","resolution":{"observed_at":"2026-08-10T20:34:36.517547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.052263Z","title":null,"venue":null,"work_id":"7c6b2c81-b5cf-4550-811b-31f955a06cea","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.522205Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:4528952c5d3a29af0d4cfe21c94a2db874f78b247379f12d22ecc14dd4cb0353","observation_id":"59dac234-869a-4c30-84a2-d8250452abd2","resolution":{"observed_at":"2026-08-10T20:34:37.056114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-10T20:34:36.526050Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.526050Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:b3cbf127521ffa19bcc54b8e9ba74862bdd5b3ae029f27b8d1a7c67607dbdc53","observation_id":"97868760-a7c4-4081-b7bf-50b7c8e79689","resolution":{"observed_at":"2026-08-10T20:34:36.526050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.040680Z","title":null,"venue":null,"work_id":"001e36c3-f10b-4725-8e2f-f0437417a6b2","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.530257Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:abf70249078eb2990cedb31e1a9331926d2f0fd7d98a1abe05c9f24f2e557064","observation_id":"5912a16d-6e82-4c98-bdcd-d2ffc1d317c0","resolution":{"observed_at":"2026-08-10T20:34:37.044621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04265","last_updated":"2024-11-07T14:23:51Z","snapshot_observed_at":"2026-08-13T10:38:39.803982Z","submitted_at":"2023-08-08T14:03:08Z","title":"FLIRT: Feedback Loop In-context Red Teaming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04265","snapshot_observed_at":"2026-08-10T20:34:36.533947Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.533947Z"},"links":{"cited_paper":"/paper/2308.04265","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:1423f1f0d32ad0868f8098881b5ccc38e300453b7762e8efcd0ecbb1eb3be411","observation_id":"2fe14311-d545-4959-9c7f-6509a9fe045c","resolution":{"observed_at":"2026-08-10T20:34:36.533947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06816","last_updated":"2023-10-10T17:39:03Z","snapshot_observed_at":"2026-08-13T05:52:49.481312Z","submitted_at":"2023-10-10T17:39:03Z","title":"Text Embeddings Reveal (Almost) As Much As Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06816","snapshot_observed_at":"2026-08-10T20:34:36.537886Z","title":"X.; Kuleshov, V.; Shmatikov, V.; and Rush, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.537886Z"},"links":{"cited_paper":"/paper/2310.06816","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:a80be463d0e1e9cca4a567febd1c9bc0f227b20acb829771ff1ffbc3bb5fbdee","observation_id":"9f5f3076-d12d-4be7-877d-a3cb721e7ee2","resolution":{"observed_at":"2026-08-10T20:34:36.537886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.025939Z","title":null,"venue":null,"work_id":"857ffc13-299b-48ac-beec-5e4c81e77c22","year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.541504Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:c5dbbf6b0c81a2d62444416e28420e21bce99b120c477d12182f2271003e2c3d","observation_id":"2b6d4d1a-eb49-4399-9321-9c0f22a9660a","resolution":{"observed_at":"2026-08-10T20:34:37.031408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-10T20:34:36.545509Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.545509Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:a6a37abc8a7dbe0e9b0f0020f0ce47d6776f4c3c3709f277077b8efa23177e02","observation_id":"2bad4ddf-be31-4a38-83f2-4a40210dcb9f","resolution":{"observed_at":"2026-08-10T20:34:36.545509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-10T20:34:36.548636Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.548636Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:61379962b4a4f74cf1c61cfcbd03aa3640f3d9670fa6ceab50c879d0bc699469","observation_id":"1292782a-a249-42d1-8d14-741e0fac3c20","resolution":{"observed_at":"2026-08-10T20:34:36.548636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.011800Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":"4ff437dc-942b-478a-8d92-6f2d95fefcd4","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.552777Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:683ab937b2e87c50ea78fcd0673a1cef0a126089fb70ed392f34a4363d7ad753","observation_id":"39040c31-ea35-4e10-bf47-ccc48889ea73","resolution":{"observed_at":"2026-08-10T20:34:37.016562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.556919Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.556919Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:df41fa13c233f14c0b609b3d632e63abd32fd8c85d4875bf5f0dce1f3f8cf18d","observation_id":"0b5e7d15-7e94-4a22-9f8b-cf62af5066d1","resolution":{"observed_at":"2026-08-10T20:34:36.556919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-10T20:34:36.560590Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.560590Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:ddc4e4841b9b6cefb5d7ed35126c227a9066a67a7724d71b9ddb04aa7e9cacd7","observation_id":"cc77d5d7-d66b-416c-9a9d-16412cad66f4","resolution":{"observed_at":"2026-08-10T20:34:36.560590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-10T20:34:36.564455Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.564455Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:4f3fce0a940edce38b4357aa48b02e5ba4bf3eee58094fb219285f2735ab9049","observation_id":"bb8bb8e6-3b15-4f39-b420-5965c6196b17","resolution":{"observed_at":"2026-08-10T20:34:36.564455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-13T04:25:38.282910Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-10T20:34:36.568671Z","title":"E.; Adi, Y.; Liu, J.; Remez, T.; Rapin, J.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.568671Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:b5e3f06c1515a88f07a5d978f48c3d167caf80377708cb059923debd71178583","observation_id":"161187d3-57f3-4263-b381-71953cf35b88","resolution":{"observed_at":"2026-08-10T20:34:36.568671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T20:34:36.572888Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.572888Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:187ecde25a0c2e39d2c88c83a6a3eed8e04e41a1468785c82c722a48b347a39f","observation_id":"22babea3-4a10-486b-9d02-f0b1a4cd12dd","resolution":{"observed_at":"2026-08-10T20:34:36.572888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17680","last_updated":"2023-11-01T17:30:47Z","snapshot_observed_at":"2026-07-06T16:39:08.850847Z","submitted_at":"2023-10-26T11:06:15Z","title":"CodeFusion: A Pre-trained Diffusion Model for Code Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17680","snapshot_observed_at":"2026-08-10T20:34:36.576095Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.576095Z"},"links":{"cited_paper":"/paper/2310.17680","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:1e1766017c0295dae6a178de0dfa100052acf0be96c2d40bc0e9c6677e552d73","observation_id":"92c0e8a5-cfd6-4441-83d2-11bc8389e9a8","resolution":{"observed_at":"2026-08-10T20:34:36.576095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.991954Z","title":null,"venue":null,"work_id":"e8d6645e-4d73-4244-8350-f5604cc2c865","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.579420Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:2831b8f36c15a0baf21d916a1b63fc13c48edcbbae99be2aac56328718b9e3bd","observation_id":"596bda71-a020-47ce-a070-baf05566a54d","resolution":{"observed_at":"2026-08-10T20:34:36.996260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.979307Z","title":null,"venue":null,"work_id":"c8367476-88da-4b32-a50f-d95cf3498580","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.583198Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:faa0d62c90352e8ea3c967565da263bc9031e2c7697fdb607f993b995bf1cf70","observation_id":"9c6e9b4e-ab85-4bb0-b9e7-408b60693cfe","resolution":{"observed_at":"2026-08-10T20:34:36.983209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T20:34:36.586454Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.586454Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:660f6a12f563aacf404c58058d9bb0a87fb67ca7139564a3199c9a593b0ac479","observation_id":"9f0d3bbc-1be3-408c-8337-e4e944dcfdb1","resolution":{"observed_at":"2026-08-10T20:34:36.586454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.968252Z","title":null,"venue":null,"work_id":"9a0df0bb-f0c8-4edd-bca9-10d5444a5d2e","year":2020},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.590996Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:fbe0fe411d1b782ff2cd11f70e7e279325b6851bfa3fea3147396a295aaa3ac2","observation_id":"408691c8-4fcf-47c4-992b-30b4d11bb299","resolution":{"observed_at":"2026-08-10T20:34:36.971614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.957412Z","title":null,"venue":null,"work_id":"5b13025a-8e45-4ce7-ac95-b0e13ceca082","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.594905Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:9273a83cca8ee6485f133eebd690c0b29d7b4d5fb5dc86da2ba54e4ed167c4d3","observation_id":"32e7b1e0-9d08-46f3-aaed-e34e0bcf68c3","resolution":{"observed_at":"2026-08-10T20:34:36.960929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16656","last_updated":"2024-01-30T01:19:25Z","snapshot_observed_at":"2026-08-13T04:32:11.571331Z","submitted_at":"2024-01-30T01:19:25Z","title":"Gradient-Based Language Model Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16656","snapshot_observed_at":"2026-08-10T20:34:36.598963Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.598963Z"},"links":{"cited_paper":"/paper/2401.16656","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:1fa414cc826c06dbd8ef9e2e3b0bc1ceb1401702b282502d922198ef98fbe234","observation_id":"de2478ee-3330-46b2-a4d4-58b0c3350eda","resolution":{"observed_at":"2026-08-10T20:34:36.598963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-10T20:34:36.603073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.603073Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:7cf1466b1afaffc4e98d74a0841057a9127abcd64eeaf970cb18701ba3601f38","observation_id":"b95ecf7d-e00e-4012-a4b9-cbdb8aefe43f","resolution":{"observed_at":"2026-08-10T20:34:36.603073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.944454Z","title":null,"venue":null,"work_id":"97a90d8f-7a58-4191-9292-92276902b4ad","year":2019},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.607088Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:155997a93d6dee052bee5814667c0281255583398dd1e0c6e8e06426fcad79ee","observation_id":"5e97bd6b-7191-4497-8b0e-d60ff53edae0","resolution":{"observed_at":"2026-08-10T20:34:36.948972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.927270Z","title":null,"venue":null,"work_id":"d061a86d-8628-4ebe-9c68-4e712b17a991","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.610692Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:20b9da1c0523bc063dbd7125801de4a65d7d653c0d4b5da19a48aabedfc6353b","observation_id":"a1cd0671-ac73-47b2-9da3-611800a9012a","resolution":{"observed_at":"2026-08-10T20:34:36.933891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-10T20:34:36.614045Z","title":"Z.; and Fredrikson, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.614045Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:22d62fb724348bd761ed1e7c06c6ce96342dfac3ec4eebd37e505cfe3244967a","observation_id":"5679ae28-7e14-4d6e-9ab1-7a0b64e619dd","resolution":{"observed_at":"2026-08-10T20:34:36.614045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2501.08246."}