{"as_of":"2026-08-10T12:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:82b5a41acc961f13b0461015b62335022cd3d53474bd5e02bd2c70f9375eba31","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:13:20.185331Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:59:42.501009Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:16:04.001224Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19684","snapshot_observed_at":"2026-08-06T00:59:42.501009Z","title":"Viscra: A visual chain reasoning attack for jailbreaking multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03986","last_updated":"2025-08-06T00:39:28Z","snapshot_observed_at":"2026-08-07T09:03:43.592840Z","submitted_at":"2025-08-06T00:39:28Z","title":"The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:42.501009Z"},"links":{"cited_paper":"/paper/2505.19684","citing_paper":"/paper/2508.03986"},"observation_digest":"sha256:b8e32907ea034c61a6e520aff6ccb017cf58d2327d90be56143be7d13f7b919b","observation_id":"0ae80eb1-cf5f-4536-9b79-9a564dceacda","resolution":{"observed_at":"2026-08-06T00:59:42.501009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19684","snapshot_observed_at":"2026-08-05T10:39:06.948254Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":123,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:06.948254Z"},"links":{"cited_paper":"/paper/2505.19684","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:aee5c283afaeba4ce5e5f9bd9e34f9a01b0da1ec824dbd87efcb86b01e8e6823","observation_id":"f2888449-2e09-4773-b47c-81318f40b5a6","resolution":{"observed_at":"2026-08-05T10:39:06.948254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":"2505.19684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19684","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Viscra: A visual chain reasoning attack for jailbreaking multimodal large language models","venue":null,"work_id":"bf0045cb-0bea-4e75-bcc8-660229f14ed4","year":2025},"citing_paper":{"arxiv_id":"2604.11309","last_updated":"2026-04-13T11:12:30Z","snapshot_observed_at":"2026-07-30T17:13:57.164751Z","submitted_at":"2026-04-13T11:12:30Z","title":"The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T16:07:31.602378Z"},"links":{"cited_paper":"/paper/2505.19684","citing_paper":"/paper/2604.11309"},"observation_digest":"sha256:10bd6516ab882fb8013bb1c5ea8af3180a4ee96c584bc0fe9fb8df37028363b0","observation_id":"d9633f9b-4f5d-46f7-b87d-4649ed051aee","resolution":{"observed_at":"2026-05-11T09:16:04.007841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19684/citation-record","integrity":"/paper/2505.19684/integrity","json":"/paper/2505.19684/citation-record.json","paper":"/paper/2505.19684"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.833371Z","title":null,"venue":null,"work_id":"1393f236-5e4e-43b3-ac77-94d97123eaac","year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.610165Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:e052f163efafe29ce52802481aa8a6ebe5fbb7eeeefb8c7336d11e2c4c3e7e1f","observation_id":"3b7771b8-10ba-45c7-b819-32e0772437a0","resolution":{"observed_at":"2026-08-07T14:13:22.869183Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:13:16.706618Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.706618Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:6e27e57d3e42cf5183e1ef23e6a7fba956e53c22a2838c4db3abcac5fe2e2c6c","observation_id":"a4160740-62c0-4af1-a7f3-ea4a3496b3b0","resolution":{"observed_at":"2026-08-07T14:13:16.706618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.629786Z","title":null,"venue":null,"work_id":"8a0a6446-47dd-4a1d-ba5d-de751d1cd2ed","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.802829Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:f7ff777e51816e0c27794786394e8d58a580a7a6457c21ec2782f9c32714672b","observation_id":"adfcf806-f008-477b-91e9-17e4dfaee0c6","resolution":{"observed_at":"2026-08-07T14:13:22.743559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T14:13:16.910969Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:16.910969Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:1138c0a3bc535b62e74aa279df5901ae8cf6b373b298ca7ab813da652ef22e96","observation_id":"037a3a34-ad60-4583-98aa-61a6086261d6","resolution":{"observed_at":"2026-08-07T14:13:16.910969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.419811Z","title":null,"venue":null,"work_id":"677563e0-056a-44a5-9167-4b9028bbbe22","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.060973Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:94d55743baba077a7b6dcc53ad17c9fb4a7d3f03f298df128bce72b39f49168a","observation_id":"e8bb26a0-75c2-4d7b-8609-984957990f50","resolution":{"observed_at":"2026-08-07T14:13:22.532588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.186514Z","title":null,"venue":null,"work_id":"6208b488-0e8d-41cf-9815-c06f2ec51325","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.193276Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:36b9c5f077921d31a9a7001c6e22e320ae106bd715c2cb92b6b77ad1d62ca6d0","observation_id":"acba1b54-69c1-4fc9-aba9-e7a5902fbeac","resolution":{"observed_at":"2026-08-07T14:13:22.292439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.934503Z","title":null,"venue":null,"work_id":"cd3d1a79-47c2-465d-937c-aff24d52912f","year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.334852Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:425571248b9606d8a0aab0bb7fc3e88b60c7160fd644958e431db7dd927588c6","observation_id":"da32ebf6-dfa8-4161-95cd-750567174f71","resolution":{"observed_at":"2026-08-07T14:13:22.028390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:13:17.461562Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.461562Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:18508fb9c549cf82f63daf1e51b3fa62f4979e9e09de6dbd3b05bbf894374a02","observation_id":"439bee66-cefb-4cf8-990e-8b13bafd3b64","resolution":{"observed_at":"2026-08-07T14:13:17.461562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:13:17.637417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.637417Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:b8295f9795ba45aa1179e29600d44185b2bb67644fd4b2a154a2e44cfc8cd009","observation_id":"0395f9c1-5253-4574-b086-01b2d27552d1","resolution":{"observed_at":"2026-08-07T14:13:17.637417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T14:13:17.802792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.802792Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:3e4694e8897248ef13394a2db036ac4f3f7305dcce62b0730fdc2bb592008a11","observation_id":"cd501efa-f61b-4fbe-bb0f-4f56f228df20","resolution":{"observed_at":"2026-08-07T14:13:17.802792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T14:13:17.951494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.951494Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:7c9c8e0f2538c357e0f92326c341eb08a75225567917b373f56715574cf6f41f","observation_id":"277a0502-46da-4961-99c6-628980cded7d","resolution":{"observed_at":"2026-08-07T14:13:17.951494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12025","last_updated":"2025-02-17T16:57:56Z","snapshot_observed_at":"2026-08-07T18:11:43.608954Z","submitted_at":"2025-02-17T16:57:56Z","title":"SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12025","snapshot_observed_at":"2026-08-07T14:13:18.072363Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.072363Z"},"links":{"cited_paper":"/paper/2502.12025","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:ec1cc8d9f11c968e39e5077f4b3bd4040b88343d1bed8fc27359a1d7627a9dea","observation_id":"24de3f31-d729-4346-8c47-8fdb9c4bf5a4","resolution":{"observed_at":"2026-08-07T14:13:18.072363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-08-07T14:13:18.236329Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.236329Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:93427af9c5eb84331d5b6f9e1f19e385934c9f18f4c98c714af9359ead522482","observation_id":"99d12c4e-3487-457b-a724-e76e87749422","resolution":{"observed_at":"2026-08-07T14:13:18.236329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.742037Z","title":null,"venue":null,"work_id":"4ccdf8f4-bf5f-4212-bf09-728e45190618","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.336166Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:29fc8e9fb781a899e39517744607b8c42d94b10c5252d317ee592e7f35099293","observation_id":"6c42bcc4-3d8f-4fe3-b6fd-9951440b498d","resolution":{"observed_at":"2026-08-07T14:13:21.830328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-07T15:49:03.741523Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-07T14:13:18.442382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.442382Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:e9c9ff3e6a364497a4e1428c120576a39f0d615934742de59cfc322fe5645335","observation_id":"7e656524-aeba-4576-81d9-416574124109","resolution":{"observed_at":"2026-08-07T14:13:18.442382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.576535Z","title":null,"venue":null,"work_id":"0800755c-f3c6-4a0b-9667-bccf03586d93","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.530754Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:d3831d4cb16d73e8b0f5f05bce4424c8d654a752ea46e7d6d875bb919b0e620c","observation_id":"7559b208-e9b4-4c1f-bf4d-b8a8fce2eb95","resolution":{"observed_at":"2026-08-07T14:13:21.654306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-09T01:06:58.674891Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T14:13:18.674753Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.674753Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:031b6e180a985ace78a04979765b3f0341c113e9ae8475d96ce791f5006a2670","observation_id":"1af8fb05-dee4-4c48-8194-a385259cd15d","resolution":{"observed_at":"2026-08-07T14:13:18.674753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02309","last_updated":"2024-02-04T01:29:24Z","snapshot_observed_at":"2026-08-07T07:47:20.838090Z","submitted_at":"2024-02-04T01:29:24Z","title":"Jailbreaking Attack against Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02309","snapshot_observed_at":"2026-08-07T14:13:18.788937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.788937Z"},"links":{"cited_paper":"/paper/2402.02309","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:379aa11e5b926c97583854d7699c516b2441b4d46afa01067a3e9303bb65e83d","observation_id":"e6ae206d-8a14-46ff-a90e-f034fbb448a4","resolution":{"observed_at":"2026-08-07T14:13:18.788937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.384088Z","title":null,"venue":null,"work_id":"d03ad3be-1cec-4972-aa23-df02721b25f1","year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.861337Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:9fb5ffad1cfe16c2acc9c503888ca69eb8f2ece4a875ab7fddf2312996032814","observation_id":"0f97924a-530a-442a-b4d7-497bcedb3fc3","resolution":{"observed_at":"2026-08-07T14:13:21.489675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.177778Z","title":null,"venue":null,"work_id":"4cbf54f2-515a-4bcc-926e-15ab9cc158f5","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.971305Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:bf146ad20c736f4260838853aa211e55da563aca8f91d81af20a1b0cefdf6a1f","observation_id":"994ace7d-a136-4045-8bda-982376edf687","resolution":{"observed_at":"2026-08-07T14:13:21.262806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.114938Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.114938Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:db4029e8a75bee4a5e4afc5199616660e65e7d4532cbc4aa73313261d13e39b8","observation_id":"ae0e6854-d9d5-4c08-bb0a-8d595b01ea87","resolution":{"observed_at":"2026-08-07T14:13:19.114938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.006750Z","title":null,"venue":null,"work_id":"ec148aeb-1c4e-4b38-94b9-227cb53b210d","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.222872Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:b837e989e5c56104522b056a81dfde19d00e6a3ce59f3d492aa16b02b71249a9","observation_id":"dd15ecc8-cab6-4854-a421-5debd628a83d","resolution":{"observed_at":"2026-08-07T14:13:21.075235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12605","snapshot_observed_at":"2026-08-07T14:13:19.352637Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.352637Z"},"links":{"cited_paper":"/paper/2503.12605","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:8bd895f01b96fcb75d987dbecab0ec0d7e3a99968eb313b1bf71dc7e639164b0","observation_id":"233e0c81-15ed-45f2-a2a8-ebc7c5897b36","resolution":{"observed_at":"2026-08-07T14:13:19.352637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-07T14:13:19.468388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.468388Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:1dbd6ca4a5cdc919feda4789e5158547dc6162c0d09a36d574eecb99784541e0","observation_id":"77a93b6e-efe4-44e7-8b62-815b9d780721","resolution":{"observed_at":"2026-08-07T14:13:19.468388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11154","last_updated":"2025-03-14T07:46:33Z","snapshot_observed_at":"2026-08-07T17:04:48.119124Z","submitted_at":"2025-03-14T07:46:33Z","title":"Don't Take Things Out of Context: Attention Intervention for Enhancing Chain-of-Thought Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11154","snapshot_observed_at":"2026-08-07T14:13:19.549151Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.549151Z"},"links":{"cited_paper":"/paper/2503.11154","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:47ca90d61051b59766d26b965e2e85e8154449ce903cc6762f878b5342bc523c","observation_id":"348b496a-db45-45ea-93dc-1d985cd7f159","resolution":{"observed_at":"2026-08-07T14:13:19.549151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T14:13:19.605325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.605325Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:06adf8accb58fd2d24372973c4dd45c9bf70c0880213fc701bbc795c9b0406dc","observation_id":"e7166491-9f1d-473f-93c5-d6691c2d6dd5","resolution":{"observed_at":"2026-08-07T14:13:19.605325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.731841Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.731841Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:220c515969a518ed16b4f3ebd00026a37c84e236839250817b677980cf9f32fb","observation_id":"b8cc4c51-1d22-4bb2-97c2-2cf3eff341b0","resolution":{"observed_at":"2026-08-07T14:13:19.731841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15092","last_updated":"2025-03-19T10:44:37Z","snapshot_observed_at":"2026-08-09T22:25:39.659386Z","submitted_at":"2025-03-19T10:44:37Z","title":"Towards Understanding the Safety Boundaries of DeepSeek Models: Evaluation and Findings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15092","snapshot_observed_at":"2026-08-07T14:13:19.811996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.811996Z"},"links":{"cited_paper":"/paper/2503.15092","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:2792d6fc18b500b8c454571038b9d45e269fa415186a4ab187cabce083d67146","observation_id":"3b27928a-a4bc-4299-ad92-2846cb9904c3","resolution":{"observed_at":"2026-08-07T14:13:19.811996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.845149Z","title":null,"venue":null,"work_id":"9aea6630-c3ff-4111-9ac6-69b11d8dd9f0","year":2024},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.889146Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:46d71df45bdd6a36786caba64473ca94c6f25ce69bb3640ea4c5817e68379862","observation_id":"9f646852-23ec-4aff-89b8-563ee07caf86","resolution":{"observed_at":"2026-08-07T14:13:20.891272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.984136Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:19.984136Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:e26177f8142c3efda27a931c2ec2cf0d73c24f1ce18e663a46a0944be8ffef67","observation_id":"195ebc48-df51-4d98-9692-a63671219d1d","resolution":{"observed_at":"2026-08-07T14:13:19.984136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.107412Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:20.107412Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:97d42b0559bc366df8cd336d00ba581e3351d8a6f94086d4ec78347f13899933","observation_id":"902a01e8-f9f8-45c0-b108-14a5dd8e211b","resolution":{"observed_at":"2026-08-07T14:13:20.107412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.185331Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:20.185331Z"},"links":{"citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:093aa7065f646d50543d4f7b6d7ae0557d1ff65d9e404a629777077e8f8dfc17","observation_id":"75a97ba5-27a4-4cf2-91fd-dc6d9b21eb6e","resolution":{"observed_at":"2026-08-07T14:13:20.185331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 3 inbound Pith citation observations for arXiv:2505.19684."}