{"as_of":"2026-08-16T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f85e3e8038c81436c644c57a09537d3ac85752805d0ae42fd2a6fb1c67465df","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:29:20.783870Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T15:04:28.416667Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T10:51:31.097429Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.05471","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.05471","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","venue":null,"work_id":"3194a621-d991-4e5f-99a2-4dd96bbbdc9e","year":2025},"citing_paper":{"arxiv_id":"2605.02187","last_updated":"2026-07-22T08:25:06Z","snapshot_observed_at":"2026-08-11T08:50:00.509790Z","submitted_at":"2026-05-04T03:35:17Z","title":"Rewriting the Response Path: Silent Tampering and Provider-Signed Defense in BYOK LLM Agents","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-08T18:42:06.418583Z"},"links":{"cited_paper":"/paper/2509.05471","citing_paper":"/paper/2605.02187"},"observation_digest":"sha256:10dd2faf36f03bd90eae957131f35ad32f5eabbfab4fc0bcf47a01ae809f2a1a","observation_id":"5466a475-5077-4378-8c26-90a6bacd12be","resolution":{"observed_at":"2026-05-09T06:15:38.406755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.05471","snapshot_observed_at":"2026-08-02T15:04:28.416667Z","title":"Behind the mask: Benchmarking camouflaged jailbreaks in large language models.arXiv preprint arXiv:2509.05471, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.02187","last_updated":"2026-07-22T08:25:06Z","snapshot_observed_at":"2026-08-11T08:50:00.509790Z","submitted_at":"2026-05-04T03:35:17Z","title":"Rewriting the Response Path: Silent Tampering and Provider-Signed Defense in BYOK LLM Agents","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-02T15:04:28.416667Z"},"links":{"cited_paper":"/paper/2509.05471","citing_paper":"/paper/2605.02187"},"observation_digest":"sha256:a7e32fe19bdef630714b316a7c1dcb855dfd171c221e897fc508452fe28b1d9b","observation_id":"4129f329-b740-4b0d-a0ee-7f6e9887212d","resolution":{"observed_at":"2026-08-02T15:04:28.416667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.05471","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.05471","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","venue":null,"work_id":"3194a621-d991-4e5f-99a2-4dd96bbbdc9e","year":2025},"citing_paper":{"arxiv_id":"2605.03441","last_updated":"2026-05-05T07:25:33Z","snapshot_observed_at":"2026-08-10T21:29:00.284608Z","submitted_at":"2026-05-05T07:25:33Z","title":"Exposing LLM Safety Gaps Through Mathematical Encoding:New Attacks and Systematic Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T15:48:54.277233Z"},"links":{"cited_paper":"/paper/2509.05471","citing_paper":"/paper/2605.03441"},"observation_digest":"sha256:2cf7cf7fde63a9f1e85f69aa9df9e4f38b6d6b48c41bbd9e9ab35043b02e9cae","observation_id":"1967fa15-bd0c-4925-bb0e-3a21056b2f87","resolution":{"observed_at":"2026-05-12T10:51:31.100886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.05471/citation-record","integrity":"/paper/2509.05471/integrity","json":"/paper/2509.05471/citation-record.json","paper":"/paper/2509.05471"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.303939Z","title":null,"venue":null,"work_id":"8a120469-db1f-43e9-973c-066a73b7e7d3","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.644874Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:0b810cbdf9e8a67379d6f9762850fbefa43e5e5c635a6b17b5cece6a7039edd4","observation_id":"130deab5-a78f-40d6-928a-0e8c004405fd","resolution":{"observed_at":"2026-08-05T05:29:21.307502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.291974Z","title":"S.; Yang, Q.; and Xie, X","venue":null,"work_id":"1342fcb2-7f30-4067-99ad-4e6a05b62f5c","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.649115Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:668d643a0da669f3848c5fc6dd7b07b4088084e07d51fb56db0365a6e4a645f8","observation_id":"3c8a8024-d983-41e2-883a-0d523f9de39a","resolution":{"observed_at":"2026-08-05T05:29:21.296284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-05T05:29:20.652851Z","title":"J.; Tramèr, F.; Hassani, H.; and Wong, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.652851Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:c1666cdaef871a2b1aed4754afaf45941908643e2568cfd274387d384f061fa5","observation_id":"1642cf1a-1665-4871-8fdb-755ec7eacd8a","resolution":{"observed_at":"2026-08-05T05:29:20.652851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11725","last_updated":"2024-06-18T05:14:02Z","snapshot_observed_at":"2026-08-13T04:15:54.051331Z","submitted_at":"2024-02-18T22:36:19Z","title":"How Susceptible are Large Language Models to Ideological Manipulation?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11725","snapshot_observed_at":"2026-08-05T05:29:20.658074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.658074Z"},"links":{"cited_paper":"/paper/2402.11725","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:b4edfdebeacbbbc01c0c37b1b272b3ac0944b1ea9bbe6adf479d2fbf1dc79bf6","observation_id":"44f343f4-5a40-4245-93f6-d4668b222b39","resolution":{"observed_at":"2026-08-05T05:29:20.658074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.279638Z","title":null,"venue":null,"work_id":"9e4fe0fe-d0c3-48c0-96e2-00c3dedaec0b","year":2023},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.662125Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:639510594c80b487c97e8cf7b735da80285bc10b5f12630976a05c72ec81a663","observation_id":"9d8b6d3e-03b0-4e93-8600-f1e3108e3f72","resolution":{"observed_at":"2026-08-05T05:29:21.283408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.269127Z","title":null,"venue":null,"work_id":"7c8ff967-3736-4724-8f37-240ce4c35f8a","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.665990Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:e52e6f7a3b43423123dba34536f073d2431cf3fa2c1e426370da3ea82e4b3310","observation_id":"47b889e6-82b5-4795-b995-50c27817a612","resolution":{"observed_at":"2026-08-05T05:29:21.272555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.258491Z","title":null,"venue":null,"work_id":"cd558670-c7f7-4ec1-a432-f45c1716c247","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.670206Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:92ac52d57423c21c998623c00caaf12d2cfe414da4642245583548efff81895d","observation_id":"0a7a77b7-b6f4-4bfd-8c9b-a4a24ef48725","resolution":{"observed_at":"2026-08-05T05:29:21.262296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.248127Z","title":null,"venue":null,"work_id":"23476f31-d614-43b0-937a-e0bd9bce68fe","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.673833Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:a6d4297202a6607484d7aec1935683eb230c78d9b373333e58c9882e17715e2e","observation_id":"5e1d22db-9e76-42b7-8693-b57d01846dbb","resolution":{"observed_at":"2026-08-05T05:29:21.251815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18510","last_updated":"2024-06-26T17:31:22Z","snapshot_observed_at":"2026-08-15T16:44:03.149805Z","submitted_at":"2024-06-26T17:31:22Z","title":"WildTeaming at Scale: From In-the-Wild Jailbreaks to (Adversarially) Safer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18510","snapshot_observed_at":"2026-08-05T05:29:20.677393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.677393Z"},"links":{"cited_paper":"/paper/2406.18510","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:73954c6fca3ba2e9bdab9d8da1d347eb0717dafb2a54519830700f92bc739f9f","observation_id":"c9187f3a-3f91-4b80-a5ad-1ee823d3bf56","resolution":{"observed_at":"2026-08-05T05:29:20.677393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.237939Z","title":null,"venue":null,"work_id":"221ef4e5-b8d6-46b3-a77c-e0cf8819ff59","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.681423Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:f14922485c438176c9994e65f9721301f783f97d788ed3ed1469a2ed5221024d","observation_id":"539eaedf-4c7a-4d9e-8e6f-ead6daf69190","resolution":{"observed_at":"2026-08-05T05:29:21.241442Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15560","last_updated":"2025-03-18T22:30:17Z","snapshot_observed_at":"2026-08-09T12:25:31.655495Z","submitted_at":"2025-03-18T22:30:17Z","title":"Temporal Context Awareness: A Defense Framework Against Multi-turn Manipulation Attacks on Large Language Models","version":1},"cited_work":{"arxiv_id":"2503.15560","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.15560","snapshot_observed_at":"2026-08-05T05:29:21.041214Z","title":"Temporal Context Awareness: A Defense Framework Against Multi-turn Manipulation Attacks on Large Language Models","venue":"cs.CR","work_id":"4f6e87fd-662c-472d-beb1-d9cb4f1faff6","year":2025},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.685472Z"},"links":{"cited_paper":"/paper/2503.15560","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:df9b5e092c57bcd81b2f2ab1b3597107c62b4d393eecf1d0a6f254d2d0c3919c","observation_id":"5f322c81-9800-4cbf-9fac-f1240a07326a","resolution":{"observed_at":"2026-08-05T05:29:21.045977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.225907Z","title":null,"venue":null,"work_id":"883199f5-6bcb-4ac9-88e4-8671490dc82d","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.690218Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:626d078baaafab6d4efa394a4e2c9b0989164fe304e21b579940cd8cd5ff46bc","observation_id":"d608efb8-6a80-4e69-ae1c-29b57915d45f","resolution":{"observed_at":"2026-08-05T05:29:21.229746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.215951Z","title":null,"venue":null,"work_id":"b58aa373-b897-4671-8733-93156a33383b","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.693990Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:345ded1c6d1f20cabc36ad7b4447f50e60375057d9cddf406dc183dfc971f279","observation_id":"8e75ad7c-3329-45b5-8f49-e1b95d3c5110","resolution":{"observed_at":"2026-08-05T05:29:21.219489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18104","last_updated":"2024-06-10T11:20:43Z","snapshot_observed_at":"2026-08-13T04:08:31.134661Z","submitted_at":"2024-02-28T06:50:14Z","title":"Making Them Ask and Answer: Jailbreaking Large Language Models in Few Queries via Disguise and Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18104","snapshot_observed_at":"2026-08-05T05:29:20.697468Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.697468Z"},"links":{"cited_paper":"/paper/2402.18104","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:7b766d3d2866ea8eda76f2b7180fca209b301215c98e88033fc308c717a13fed","observation_id":"85e85fed-f946-4490-8a21-e8e5b09fb212","resolution":{"observed_at":"2026-08-05T05:29:20.697468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.204630Z","title":null,"venue":null,"work_id":"65ee37c5-da29-484e-b9be-2f067a18c4fc","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.702403Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:80af088b53ce6b765f85159d0a34748e96cb1f5ce1b3e1e62ed19b63fbee24e0","observation_id":"8b2df224-79f0-43d1-aef9-4000cbda4743","resolution":{"observed_at":"2026-08-05T05:29:21.209018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.194093Z","title":null,"venue":null,"work_id":"97504eed-d944-4fee-9f62-1991b6df843a","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.705872Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:b02b75f5fdcc86c3e1322d397b6cc7fc1ef3fb55f9776cbfc51e54010e24b179","observation_id":"1f09b1cb-13ba-4b5a-b917-19aceddd02bd","resolution":{"observed_at":"2026-08-05T05:29:21.197592Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03027","last_updated":"2024-11-24T06:22:37Z","snapshot_observed_at":"2026-08-15T18:15:14.968731Z","submitted_at":"2024-04-03T19:23:18Z","title":"JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03027","snapshot_observed_at":"2026-08-05T05:29:20.709402Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.709402Z"},"links":{"cited_paper":"/paper/2404.03027","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:8f94c0dd9914e19b654c6e3e72980824ec9ec52a0f909f85f0e95974125932c3","observation_id":"e61eed51-1411-46a1-9a3a-a658b707ab34","resolution":{"observed_at":"2026-08-05T05:29:20.709402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.182759Z","title":null,"venue":null,"work_id":"57de9318-7b3d-4630-9df9-3f3624208d1d","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.713313Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:a08e4ca823332fd932caebc87f1c1a73a4abd46ef6e490b185781c972257fada","observation_id":"36e2fad6-b00c-4529-8422-91cdf642ca30","resolution":{"observed_at":"2026-08-05T05:29:21.186560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.172710Z","title":null,"venue":null,"work_id":"13beabf7-8234-46dc-bcd2-dbd5977df187","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.716789Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:8b02bb1215a45555f909d52702b552f7b2e8de96c488fe0d2507461beac2f4bf","observation_id":"678b87e6-edec-41d0-9ce4-a28c0bdc9577","resolution":{"observed_at":"2026-08-05T05:29:21.176214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.162484Z","title":null,"venue":null,"work_id":"06e46e37-e4ab-45c9-aef6-aa0062421222","year":2025},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.720522Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:30e6dd6aa49ee0fcea1e1664fba6ac21df35f74fb1ee231e130c1f912fa9ee2e","observation_id":"21ce1f20-0477-42a6-94a4-27421899a287","resolution":{"observed_at":"2026-08-05T05:29:21.165848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15236","last_updated":"2026-05-27T16:38:46Z","snapshot_observed_at":"2026-08-14T15:17:01.627689Z","submitted_at":"2024-10-20T00:00:56Z","title":"Jailbreaking and Mitigation of Vulnerabilities in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15236","snapshot_observed_at":"2026-08-05T05:29:20.724735Z","title":"K.; Wen, Y.; Zhang, Y.; and Yin, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.724735Z"},"links":{"cited_paper":"/paper/2410.15236","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:cef5c14c5a9af19d74c1e1e1841dd206b4d56e8ce5c3d58db5488c0eee2f0895","observation_id":"d5a9b824-cead-4ec8-aab8-6a8358a9c49b","resolution":{"observed_at":"2026-08-05T05:29:20.724735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01833","last_updated":"2025-02-26T13:41:41Z","snapshot_observed_at":"2026-08-13T05:33:18.631487Z","submitted_at":"2024-04-02T10:45:49Z","title":"Great, Now Write an Article About That: The Crescendo Multi-Turn LLM Jailbreak Attack","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01833","snapshot_observed_at":"2026-08-05T05:29:20.728932Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.728932Z"},"links":{"cited_paper":"/paper/2404.01833","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:9727a9dbb92f0edbe033edd7e7c60bbb2f95146b0adf70c51f7d179470edd64c","observation_id":"70ed739b-b90b-4e10-a7a2-84bf08457161","resolution":{"observed_at":"2026-08-05T05:29:20.728932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.150496Z","title":"A.; Shanto, M","venue":null,"work_id":"dd1cd507-2d6f-48c9-8592-9572041d50d3","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.733159Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:b4c9c94830e7ccb06ba01a150dd503fd48c8842472993c187c37cede895d0c32","observation_id":"eb8d1311-e254-44a8-a46b-39a4a490125b","resolution":{"observed_at":"2026-08-05T05:29:21.154903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.138549Z","title":"Do Anything Now","venue":null,"work_id":"81d72340-5e65-4799-b948-3ef91de6df65","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.736737Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:244770baff5867653496d59fca6bcd52655548529cf9cf9b278fc7cbefdaa53f","observation_id":"41763b19-d78b-4809-ae25-d8bd9bd69ed0","resolution":{"observed_at":"2026-08-05T05:29:21.143025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09002","last_updated":"2025-03-18T01:50:42Z","snapshot_observed_at":"2026-08-13T04:40:52.176447Z","submitted_at":"2024-01-17T06:42:44Z","title":"AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09002","snapshot_observed_at":"2026-08-05T05:29:20.739903Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.739903Z"},"links":{"cited_paper":"/paper/2401.09002","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:abe1252821280b6a28bb9395aade8ca2de07f510c8c88d0c5c6dacbe321d6625","observation_id":"39cb55dc-b955-4a99-bf30-db6c239e26a9","resolution":{"observed_at":"2026-08-05T05:29:20.739903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.128120Z","title":null,"venue":null,"work_id":"b1bccde7-a371-4401-aec6-e03103ffad8a","year":2023},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.743150Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:56b8113649a26b11c9cf78d569ad7f9e9f0544d5132cc8deec36b471a84cc215","observation_id":"6e2e2f9b-6f7b-4aaf-a6c8-d3a89be5cfff","resolution":{"observed_at":"2026-08-05T05:29:21.131650Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00473","last_updated":"2025-06-18T07:33:15Z","snapshot_observed_at":"2026-08-14T01:58:01.811315Z","submitted_at":"2024-11-30T13:21:15Z","title":"Jailbreak Large Vision-Language Models Through Multi-Modal Linkage","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00473","snapshot_observed_at":"2026-08-05T05:29:20.746385Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.746385Z"},"links":{"cited_paper":"/paper/2412.00473","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:7824b0d9e22017a0e8123920331ef58cce6bcf7ec99c81a6332d5a6d262fde2d","observation_id":"a057bd8f-f2a4-46b6-87ea-7906f5cff3b0","resolution":{"observed_at":"2026-08-05T05:29:20.746385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19820","last_updated":"2025-03-28T00:37:10Z","snapshot_observed_at":"2026-08-12T23:38:20.655752Z","submitted_at":"2025-02-27T06:49:16Z","title":"Foot-In-The-Door: A Multi-turn Jailbreak for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19820","snapshot_observed_at":"2026-08-05T05:29:20.750136Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.750136Z"},"links":{"cited_paper":"/paper/2502.19820","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:6604c8d9107bdefaa92bab074b06399a57aed76d35fa21a6d396931784ac44d3","observation_id":"f12dafa9-4b73-4da9-b2ba-a81607a4ecd4","resolution":{"observed_at":"2026-08-05T05:29:20.750136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03857","last_updated":"2024-10-08T08:34:38Z","snapshot_observed_at":"2026-08-12T22:30:27.977009Z","submitted_at":"2024-10-04T18:42:57Z","title":"You Know What I'm Saying: Jailbreak Attack via Implicit Reference","version":2},"cited_work":{"arxiv_id":"2410.03857","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03857","snapshot_observed_at":"2026-08-05T05:29:20.847903Z","title":"You Know What I'm Saying: Jailbreak Attack via Implicit Reference","venue":"cs.CL","work_id":"c3ccde53-16e1-4e60-90f0-f0e60f2f5411","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.753804Z"},"links":{"cited_paper":"/paper/2410.03857","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:7c778c7e7c157c13e09af7b9828f47a173aa73617bff2d120831b74db751807f","observation_id":"812d8591-fe6e-46fa-8ed6-88db238755a0","resolution":{"observed_at":"2026-08-05T05:29:20.853861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.117572Z","title":null,"venue":null,"work_id":"71cb1c7c-eb2b-4842-964d-52ee3479a0af","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.757667Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:82db4a3625647690845d0e6e288d2754d67931235977e9423a0323b53210f9dc","observation_id":"3f7cf1d5-1351-4e8c-ba9f-7d556ad04f2e","resolution":{"observed_at":"2026-08-05T05:29:21.121132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.106024Z","title":null,"venue":null,"work_id":"bb92a29f-9914-439a-9bfe-59a563c448eb","year":2025},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.760798Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:154a52466a277a9868e8c9ff2a6a5926c4ffd743fc7212c2ccf26b34a6a4cca5","observation_id":"034db21d-7496-4fda-98e1-179007492669","resolution":{"observed_at":"2026-08-05T05:29:21.109988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11054","last_updated":"2025-03-11T03:06:17Z","snapshot_observed_at":"2026-08-15T17:26:13.731359Z","submitted_at":"2025-02-16T09:27:44Z","title":"Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11054","snapshot_observed_at":"2026-08-05T05:29:20.764183Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.764183Z"},"links":{"cited_paper":"/paper/2502.11054","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:630bc9aa6f57e7f57753ed07e501f76c1d9a797b8a7e28134ad443fe8591aaba","observation_id":"e3744395-287a-4ddc-9401-cb4a808358bb","resolution":{"observed_at":"2026-08-05T05:29:20.764183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07045","last_updated":"2024-06-24T04:04:21Z","snapshot_observed_at":"2026-08-13T10:14:19.752738Z","submitted_at":"2023-09-13T15:56:50Z","title":"SafetyBench: Evaluating the Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07045","snapshot_observed_at":"2026-08-05T05:29:20.767922Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.767922Z"},"links":{"cited_paper":"/paper/2309.07045","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:7e564403e408b356c47d5f6c86646fa7e3079e47393025be1ec02f52e1d41f0b","observation_id":"13039f77-573b-488c-935f-c28a25313167","resolution":{"observed_at":"2026-08-05T05:29:20.767922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:21.095077Z","title":null,"venue":null,"work_id":"f4d92dfb-2426-4d5f-acec-4c89465382e7","year":2024},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.771435Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:b6acfc34e5e997a556b14eb81393571a39dc61028a9f4488fcace6894422ff2c","observation_id":"405cbcf2-60b8-49da-be36-3ca03783cf2c","resolution":{"observed_at":"2026-08-05T05:29:21.098809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T05:29:20.775065Z","title":"Z.; and Fredrikson, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.775065Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:9513171678b1e65a5b6f76bd1909ce966adc0969fbdf5f6c5b7791269d3ab912","observation_id":"4a4107dd-bafe-40dd-a6c4-efcbd9677e44","resolution":{"observed_at":"2026-08-05T05:29:20.775065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:20.779911Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.779911Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:df716115ca2b549d3bb72218bac66bb8758a59161e48d3b5166103f57bf733da","observation_id":"4fe2a0e5-2231-4d50-a3d5-b810cf330f92","resolution":{"observed_at":"2026-08-05T05:29:20.779911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:29:20.783870Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T05:29:20.783870Z"},"links":{"citing_paper":"/paper/2509.05471"},"observation_digest":"sha256:7ddde0f2acc689b2e6194b462355a96d016f95c6d325fa7a806ddd48c110a109","observation_id":"a8521700-1f05-4024-b5e2-5e2c867c959b","resolution":{"observed_at":"2026-08-05T05:29:20.783870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.05471","last_updated":"2025-09-05T19:57:38Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T22:55:04.705178Z","submitted_at":"2025-09-05T19:57:38Z","title":"Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 3 inbound Pith citation observations for arXiv:2509.05471."}