{"as_of":"2026-08-10T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7fbe45b880fd946c85f17c5dd7bb295f500750b7e589ca78f59a57b5c40a6d6","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:27:07.201702Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18864/citation-record","integrity":"/paper/2505.18864/integrity","json":"/paper/2505.18864/citation-record.json","paper":"/paper/2505.18864"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.132678Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.132678Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:54f172891778a3e0621d08480dc789ce95b60fb392ffd9f12c8c672ea93e7b7a","observation_id":"9783f24b-c7e0-464c-a996-405b245d9c81","resolution":{"observed_at":"2026-08-07T14:27:05.132678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:27:05.196595Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.196595Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:7605587e979c545f41799a108144823ca0abc6705a7cac83f12f23a68bf28e61","observation_id":"1fc38698-cb47-41b6-af77-d56762fd6d30","resolution":{"observed_at":"2026-08-07T14:27:05.196595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-07T14:27:05.265383Z","title":"Speechgpt: Empowering large language models with intrinsic cross- modal conversational abilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.265383Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:6eb8d3727c9928b03a95a3152b497e841fbc7f650f889c03ddc91233a7c5bda0","observation_id":"e81487cf-ddf4-43f5-ad6d-e85a6d6ba353","resolution":{"observed_at":"2026-08-07T14:27:05.265383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.360972Z","title":"Next-gpt: Any-to-any multimodal llm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.360972Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:ac8d5fdc79f7770fc9e7f29ca62d57e8c38dd219c0edadf4b2bb8bc6688c93b5","observation_id":"eb7a9dfb-db57-4172-ab6b-1cc63bff6664","resolution":{"observed_at":"2026-08-07T14:27:05.360972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:27:05.421186Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.421186Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:348f517251388d5d02b71314f973fc65a97d61b256b987a83139c1d557c872e9","observation_id":"bf40bfaa-f3ff-4554-9c86-b7bd836d17cb","resolution":{"observed_at":"2026-08-07T14:27:05.421186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.927017Z","title":"Introducing copilot+ pcs,","venue":null,"work_id":"f28eac04-0f20-4da8-84bf-d7ef195d25b5","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.438804Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:a6a4761c319f2965d4e754c76090bc8c7c28817cea33e52c9d3c272d6c92e957","observation_id":"8ae256d3-57df-453d-91ee-bf054a762f04","resolution":{"observed_at":"2026-08-07T14:27:09.002097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.735259Z","title":"People are suddenly flocking to chatgpt plus on mobile – here’s why,","venue":null,"work_id":"687998e0-b790-4048-9c38-6ed403440583","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.442507Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:0a8eff8d8e2d57461faef27b05d24210ed8af7a18c6ec66265a2a2a97b9dfe2f","observation_id":"a9f1d635-76e6-4968-95bb-824d7747ff71","resolution":{"observed_at":"2026-08-07T14:27:08.823172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.572379Z","title":"Apple is finalizing a deal with openai to put chatgpt on the iphone, while talks with google to use gemini are ongoing,","venue":null,"work_id":"061f0cdf-5662-4af4-b30c-e93ef46ea8ea","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.445863Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:8902a989eb4a7fa8183237fa96e3c73e56bde80144660a2fde13dc912db5eedf","observation_id":"3ba6d420-11dd-49d2-886c-bb90d9cf8262","resolution":{"observed_at":"2026-08-07T14:27:08.653643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19103","last_updated":"2024-05-29T14:07:44Z","snapshot_observed_at":"2026-08-09T11:05:00.749190Z","submitted_at":"2024-05-29T14:07:44Z","title":"Voice Jailbreak Attacks Against GPT-4o","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19103","snapshot_observed_at":"2026-08-07T14:27:05.448953Z","title":"V oice jailbreak attacks against gpt-4o,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.448953Z"},"links":{"cited_paper":"/paper/2405.19103","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:322538ff8dd91b4b580050ed11408b87e2f41d627c36ea255f621dae564f1a32","observation_id":"410cd221-4ffe-405a-bedf-a2119c9870f6","resolution":{"observed_at":"2026-08-07T14:27:05.448953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T14:27:05.454954Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.454954Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:0729370b05bee3109ddb90bb5fff5f4346828ab6c28895bd9452a797e019b98e","observation_id":"ff308d94-1d19-4bd4-9ccb-5d87ccfa5b57","resolution":{"observed_at":"2026-08-07T14:27:05.454954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.398134Z","title":"\" do anything now","venue":null,"work_id":"b2d4f44f-5f19-436a-8caa-467f549c2f95","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.459631Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:e034c17ec55b452d6362c1b6b077b8055c91859593d213668f7123332295f5d6","observation_id":"874ccb10-04bf-45d1-8d33-79a4164ba43f","resolution":{"observed_at":"2026-08-07T14:27:08.474985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T14:27:05.502184Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.502184Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:b3825c48aa6cc505c4933d07cb4677ff2949141eadc3ad61a05cf070490e7450","observation_id":"78cda8c7-098c-4013-93ad-318f79697e19","resolution":{"observed_at":"2026-08-07T14:27:05.502184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.224866Z","title":"Gpt-4v system card,","venue":null,"work_id":"1e318b3a-fd06-47db-a033-9b2541e6f407","year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.556029Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:d18d7063f245ecee7c4bcb4fce15bcce51e13e09211d9c8dc22d0fccb74b1aad","observation_id":"aac3bf77-b9b6-49fa-9ce9-9d6e4c5988cb","resolution":{"observed_at":"2026-08-07T14:27:08.313749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-08-10T00:58:19.098597Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T14:27:05.591822Z","title":"Com- prehensive assessment of jailbreak attacks against llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.591822Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:1c2112272a6c0f2d12e4c06a015bbae4c699058cf4427bbc4ca8f14ac500c7d4","observation_id":"704992cc-917f-4293-987e-29d345098244","resolution":{"observed_at":"2026-08-07T14:27:05.591822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-07T14:27:05.636865Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.636865Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:00ec281ccb061061bfd49ea87b9a3e8fcb1ad446b1b72c1797eb51c09f3c223a","observation_id":"c2599b70-d583-44e8-89c5-536f57c6585f","resolution":{"observed_at":"2026-08-07T14:27:05.636865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05608","last_updated":"2025-01-19T16:23:38Z","snapshot_observed_at":"2026-07-06T16:45:24.070954Z","submitted_at":"2023-11-09T18:59:11Z","title":"FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05608","snapshot_observed_at":"2026-08-07T14:27:05.699522Z","title":"Figstep: Jailbreaking large vision-language models via typographic visual prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.699522Z"},"links":{"cited_paper":"/paper/2311.05608","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:e1c0bcd1c25ded272008ab576fdfd395d9193d85d2da3e7596418af122469468","observation_id":"0a8124b6-20c0-41e0-a7c7-ed3b7ee9bce7","resolution":{"observed_at":"2026-08-07T14:27:05.699522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-07-06T15:14:24.794122Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-07T14:27:05.763058Z","title":"Multi-step jailbreaking privacy attacks on chatgpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.763058Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:012b9ee7ea11c8734b329e54d8d1b3452c7d8f345d13f635ee5a8920f65cb1ca","observation_id":"f0a5b696-8e6d-41ff-a1ee-460b73b5c2e8","resolution":{"observed_at":"2026-08-07T14:27:05.763058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-07T14:27:05.797087Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.797087Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:dda0b70c4ea00e4d23ab2336fd335a08e5abbdf28ce936a7572d4b785f039d8e","observation_id":"8ebe53d3-3459-4b01-9a48-555e3fffaf5d","resolution":{"observed_at":"2026-08-07T14:27:05.797087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-07T14:27:05.836755Z","title":"A strongreject for empty jailbreaks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.836755Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:4e250f71a5f19608fd655f159047af8a1601a75e8f1c3aa7b8d312c8b49ca2e3","observation_id":"6c181256-d750-46cf-972b-abfc24242958","resolution":{"observed_at":"2026-08-07T14:27:05.836755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.882294Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.882294Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:557f4d08af410cd5dd2753512bef0943d93f73c9355d5d6d69a31da4caa429a6","observation_id":"7fb17c4f-ce07-4216-a432-6cc16cd5fb34","resolution":{"observed_at":"2026-08-07T14:27:05.882294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.959381Z","title":"Defending chatgpt against jailbreak attack via self-reminders,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.959381Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:126478b853fa7c48e14a238c74f4f9834fb16a42c5ae045d558c47c2574c50fd","observation_id":"be5d8f43-0a84-4ea0-85cc-d1bfdc3b8e6c","resolution":{"observed_at":"2026-08-07T14:27:05.959381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-07T14:27:05.964702Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.964702Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:b9bd1812f399e09fd20f0a35871c9a8f7a6b7309fc5647aa033e0a05417bbe84","observation_id":"7a45aba8-a5a4-4d25-8c3a-d1ce07d05868","resolution":{"observed_at":"2026-08-07T14:27:05.964702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06474","last_updated":"2024-03-04T04:03:54Z","snapshot_observed_at":"2026-08-08T01:21:39.731592Z","submitted_at":"2023-10-10T09:44:06Z","title":"Multilingual Jailbreak Challenges in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06474","snapshot_observed_at":"2026-08-07T14:27:06.003650Z","title":"Multilingual jailbreak challenges in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.003650Z"},"links":{"cited_paper":"/paper/2310.06474","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:c06ae7344cfe1613695fdeb2f5911864770c350301e7edf70d9e2ca5707a3ca6","observation_id":"0fd5edc6-90e2-417c-a5d7-48dc562f7d80","resolution":{"observed_at":"2026-08-07T14:27:06.003650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T14:27:06.090288Z","title":"Low-resource languages jailbreak gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.090288Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:dbd0c7ee78a9065fe121d1cea29cc0d4787ccbcb54fe454b8983a8f3f174ef55","observation_id":"87021e4c-06e4-467e-89ff-3457213ba352","resolution":{"observed_at":"2026-08-07T14:27:06.090288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T14:27:06.152780Z","title":"Jailbreaking black box large language models in twenty queries, 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.152780Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:1f2fb747b3e23080fe628b0d658a4a1cf77a786522d1664395b0eaa06db32849","observation_id":"f588b785-fd02-44b0-aac1-b43d8a6d78be","resolution":{"observed_at":"2026-08-07T14:27:06.152780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.020696Z","title":"Tree of attacks: Jailbreaking black-box llms automatically,","venue":null,"work_id":"ead2124a-ea15-4553-a201-0df3114b077f","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.261666Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:198adc3db1b332039968c86b8bd19228bd2d522b056db7e2eab293dafc7c25cd","observation_id":"c9f550d4-bac2-4c9a-8f7e-a883cc451fa8","resolution":{"observed_at":"2026-08-07T14:27:08.093291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-07T14:27:06.363295Z","title":"Smoothllm: Defending large language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.363295Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:ab71a25086c55859fc098c06e1b046feebf73b4e486a78d47a05ea6bb3a11683","observation_id":"2a70d9d9-063a-4599-956a-316db09dbcd7","resolution":{"observed_at":"2026-08-07T14:27:06.363295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:06.468716Z","title":"Vlattack: Multimodal adversarial attacks on vision-language tasks via pre-trained models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.468716Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:6be515e20de87b80891f20cb8187af3fb03c04023989836bafac0c2aec34f0cc","observation_id":"4e1a0703-3e20-4acb-b942-224d849ed9cf","resolution":{"observed_at":"2026-08-07T14:27:06.468716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13461","last_updated":"2024-08-24T04:31:37Z","snapshot_observed_at":"2026-07-06T19:05:22.642274Z","submitted_at":"2024-08-24T04:31:37Z","title":"Probing the Robustness of Vision-Language Pretrained Models: A Multimodal Adversarial Attack Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13461","snapshot_observed_at":"2026-08-07T14:27:06.572513Z","title":"Probing the robustness of vision-language pretrained models: A multimodal adversarial attack approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.572513Z"},"links":{"cited_paper":"/paper/2408.13461","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:000ce04146e43bfe1d296ef942ebdae49648244e6b4ffd3097680509a28d6fb9","observation_id":"647c464e-d2df-49d8-91f6-42febe3974d7","resolution":{"observed_at":"2026-08-07T14:27:06.572513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:06.666118Z","title":"Image-based multimodal models as intruders: Trans- ferable multimodal attacks on video-based mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.666118Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:1109d9cc7c78efd4dd79af6fbd123764f4cbbed30b952ff187df7806eeb3e86b","observation_id":"ddb7fb76-9a77-4eaa-8de0-e4fc68336ab8","resolution":{"observed_at":"2026-08-07T14:27:06.666118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:06.804910Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.804910Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:080dda8494208287dac967803cccaa736259a85dd5da1b75235fa96deb0084d3","observation_id":"bf78ab1e-36eb-473a-8bc8-9d1f8f7f2ba8","resolution":{"observed_at":"2026-08-07T14:27:06.804910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00355","last_updated":"2021-07-27T14:27:27Z","snapshot_observed_at":"2026-08-09T13:24:51.366298Z","submitted_at":"2021-04-01T09:20:33Z","title":"Speech Resynthesis from Discrete Disentangled Self-Supervised Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.00355","snapshot_observed_at":"2026-08-07T14:27:06.919635Z","title":"Speech resynthesis from discrete disentangled self-supervised representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.919635Z"},"links":{"cited_paper":"/paper/2104.00355","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:e0412c467210e1786f409ee345b9a7ce852ba46d700049188185efd228d443fe","observation_id":"3f6c8191-14d5-45c4-8fe3-680a2cd6ff6b","resolution":{"observed_at":"2026-08-07T14:27:06.919635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:07.714101Z","title":"Usage policies,","venue":null,"work_id":"b7de7700-33ed-44e4-915c-e5efa2eb15e9","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:07.008836Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:5981844f1e85cff1ee7f9340bbc1b3e19a02ee0e3b27e1cf7fde2e12d00b1d38","observation_id":"fbc169dc-dcb2-48f8-9ee6-c98134c5b063","resolution":{"observed_at":"2026-08-07T14:27:07.794666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09494","last_updated":"2021-04-19T17:56:59Z","snapshot_observed_at":"2026-08-09T04:16:37.543940Z","submitted_at":"2021-04-19T17:56:59Z","title":"NISQA: A Deep CNN-Self-Attention Model for Multidimensional Speech Quality Prediction with Crowdsourced Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09494","snapshot_observed_at":"2026-08-07T14:27:07.110867Z","title":"Nisqa: A deep cnn- self-attention model for multidimensional speech quality prediction with crowdsourced datasets,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:07.110867Z"},"links":{"cited_paper":"/paper/2104.09494","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:592bb0eaf8581768133eaff41fe027dc45e41c1408182d96151eff696756d1cf","observation_id":"acce009c-0393-49ea-a7a9-d118aa8da34c","resolution":{"observed_at":"2026-08-07T14:27:07.110867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:07.524749Z","title":"Openai text-to-speech (tts) models,","venue":null,"work_id":"ce0403b5-f908-4e6b-9460-fee8938de5f7","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:07.201702Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:e2a20306984e8a3834bb64325209503d62511a17939d877c3960a41549555b69","observation_id":"554ab645-b265-4783-80e9-c56a86c7836a","resolution":{"observed_at":"2026-08-07T14:27:07.597896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T21:36:14.859466Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.18864."}