{"as_of":"2026-08-18T17:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2aef8ea743400e6393fa30521b524a1956827a3a16ec5247eb4c838a339ec03","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:55:40.252495Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:39:16.622704Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.18927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-07-04T00:39:16.622704Z","title":"Safebench: A safety evaluation framework for multimodal large language models","venue":null,"work_id":"5e63cd99-dfaf-4489-9790-1200fa28aad1","year":2024},"citing_paper":{"arxiv_id":"2411.18275","last_updated":"2026-04-21T10:31:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-27T12:09:43Z","title":"Visual Adversarial Attack on Vision-Language Models for Autonomous Driving","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-23T16:35:24.063578Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2411.18275"},"observation_digest":"sha256:ee8c537e82b6165e307248933441101010b28bcf6a24ac9156bf19ea95a3c7ce","observation_id":"a822adb2-d59d-4194-a4a3-6113d2ad5311","resolution":{"observed_at":"2026-05-23T16:35:42.164443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-10T22:17:23.899122Z","title":"Safebench: A safety evaluation framework for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02189","last_updated":"2025-04-06T03:12:51Z","snapshot_observed_at":"2026-08-13T18:28:46.913210Z","submitted_at":"2025-01-04T04:59:33Z","title":"A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges","version":6},"reference_index":251,"source":"pdf_text","source_observed_at":"2026-08-10T22:17:23.899122Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2501.02189"},"observation_digest":"sha256:37886bd78b6d1f6a22602ed8b34a36c5f68000f3fd1d5f167944d5b9531959c5","observation_id":"fbf6ca42-5a61-45e2-a609-d17d54993677","resolution":{"observed_at":"2026-08-10T22:17:23.899122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-10T04:37:16.960430Z","title":"Safebench: A safety evaluation framework for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.17749","last_updated":"2025-01-29T16:36:53Z","snapshot_observed_at":"2026-08-10T04:50:16.966807Z","submitted_at":"2025-01-29T16:36:53Z","title":"Early External Safety Testing of OpenAI's o3-mini: Insights from the Pre-Deployment Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:37:16.960430Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2501.17749"},"observation_digest":"sha256:1f73b0eaed775d3f306761436e0c115c2aa30cc2593cff884fb64fe98e713234","observation_id":"842d4427-4229-4d9f-b061-38f3e911ef4c","resolution":{"observed_at":"2026-08-10T04:37:16.960430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-09T23:32:16.779178Z","title":"Safebench: A safety evaluation framework for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18438","last_updated":"2025-01-31T15:39:00Z","snapshot_observed_at":"2026-08-18T02:12:13.894958Z","submitted_at":"2025-01-30T15:45:56Z","title":"o3-mini vs DeepSeek-R1: Which One is Safer?","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T23:32:16.779178Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2501.18438"},"observation_digest":"sha256:9b52ed25097c370fc574cebf1b8fefd244954ded5e2cfdf882aa0217e2357031","observation_id":"0d6687d1-48c9-41ec-b90f-141a42938795","resolution":{"observed_at":"2026-08-09T23:32:16.779178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-08T11:17:01.814133Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07987","last_updated":"2025-06-04T18:10:51Z","snapshot_observed_at":"2026-08-17T22:10:06.948727Z","submitted_at":"2025-02-11T22:07:47Z","title":"Universal Adversarial Attack on Aligned Multimodal LLMs","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T11:17:01.814133Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2502.07987"},"observation_digest":"sha256:643ed04f7a0c231412bec15e35cf4c6cc886e4ec492a5d93c8e027f1ecd77cba","observation_id":"70b85627-294c-4a45-b4a4-3a8fbafb761f","resolution":{"observed_at":"2026-08-08T11:17:01.814133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T19:45:20.005573Z","title":"Safebench: A safety evaluation framework for mul- timodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-12T22:07:51.112849Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":154,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:20.005573Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:4a6c45e9fd54e2b32288b552da394734354a4b741c121deeeb42f17175b9a39b","observation_id":"3f75b51a-ad24-47cc-b318-4eb2434fc056","resolution":{"observed_at":"2026-08-07T19:45:20.005573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-16T11:55:40.252495Z","title":"arXiv preprint arXiv:2410.18927 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14348","last_updated":"2025-07-27T10:12:52Z","snapshot_observed_at":"2026-08-16T23:34:33.311300Z","submitted_at":"2025-04-19T16:28:03Z","title":"Manipulating Multimodal Agents via Cross-Modal Prompt Injection","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T11:55:40.252495Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2504.14348"},"observation_digest":"sha256:af4a3d6d01f6330a133c1d2a3c9af9ae9847d58ee721e8cef371d75e0112b9fd","observation_id":"0ca77586-53ef-46aa-a01a-fc8aed8ce374","resolution":{"observed_at":"2026-08-16T11:55:40.252495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-16T10:12:01.159768Z","title":"Safebench: A safety evaluation framework for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18838","last_updated":"2025-04-26T07:48:52Z","snapshot_observed_at":"2026-08-17T04:06:12.060099Z","submitted_at":"2025-04-26T07:48:52Z","title":"Toward Generalizable Evaluation in the LLM Era: A Survey Beyond Benchmarks","version":1},"reference_index":223,"source":"pdf_text","source_observed_at":"2026-08-16T10:12:01.159768Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2504.18838"},"observation_digest":"sha256:795a3f804ae0436e00cb165cc554678410d1fbc183f47b43b06681b321c438ea","observation_id":"57920c96-704a-4381-b407-b29ae37acafd","resolution":{"observed_at":"2026-08-16T10:12:01.159768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-15T22:43:05.966295Z","title":"Safebench: A safety evaluation framework for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06579","last_updated":"2025-05-10T09:36:28Z","snapshot_observed_at":"2026-08-18T03:47:09.424279Z","submitted_at":"2025-05-10T09:36:28Z","title":"POISONCRAFT: Practical Poisoning of Retrieval-Augmented Generation for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:43:05.966295Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2505.06579"},"observation_digest":"sha256:f6a3636f24bb983f99a8d2202bc1d822e52b3ee6f7a96fd7dd08932c67bcdd14","observation_id":"a34517b3-2359-4a5b-9ea1-409067274079","resolution":{"observed_at":"2026-08-15T22:43:05.966295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-15T20:12:19.955319Z","title":"Safebench: A safety evaluation framework for multimodal large language models.arXiv preprint arXiv:2410.18927, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14728","last_updated":"2025-05-20T01:11:17Z","snapshot_observed_at":"2026-08-17T17:55:48.411816Z","submitted_at":"2025-05-20T01:11:17Z","title":"MORALISE: A Structured Benchmark for Moral Alignment in Visual Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:12:19.955319Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2505.14728"},"observation_digest":"sha256:fbee06192005881beed1b1db72b19d9a2fd3cfd22189a076d42d513bedc19efe","observation_id":"6247ff6e-a531-4f58-83b3-40c1f9f92fe5","resolution":{"observed_at":"2026-08-15T20:12:19.955319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T15:11:05.787596Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16104","last_updated":"2025-07-22T10:32:33Z","snapshot_observed_at":"2026-08-17T20:17:21.340405Z","submitted_at":"2025-05-22T01:06:28Z","title":"Hierarchical Safety Realignment: Lightweight Restoration of Safety in Pruned Large Vision-Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:11:05.787596Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2505.16104"},"observation_digest":"sha256:2bc636467443905670cafa6ee2b997de68d27b2cb44793bf74c11d1e73676b24","observation_id":"346c0c83-1e0b-446e-8c4d-53d5c3850bdf","resolution":{"observed_at":"2026-08-07T15:11:05.787596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T15:08:13.267384Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16241","last_updated":"2025-05-26T02:28:07Z","snapshot_observed_at":"2026-08-14T06:52:38.334219Z","submitted_at":"2025-05-22T05:19:42Z","title":"Three Minds, One Legend: Jailbreak Large Reasoning Model with Adaptive Stacked Ciphers","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:08:13.267384Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2505.16241"},"observation_digest":"sha256:759ac8276b45a530754bfeb56c768709e38ad23367ac2b68c085d4db2fe7f1d8","observation_id":"96e76b2c-24e4-4577-8662-b9ffa4a0b0f0","resolution":{"observed_at":"2026-08-07T15:08:13.267384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T15:06:33.579854Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17144","last_updated":"2025-05-22T07:30:01Z","snapshot_observed_at":"2026-08-15T03:32:23.640046Z","submitted_at":"2025-05-22T07:30:01Z","title":"MDIT-Bench: Evaluating the Dual-Implicit Toxicity in Large Multimodal Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:06:33.579854Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2505.17144"},"observation_digest":"sha256:52fd4910e418e1ac87e45c50c78d4a27faf7d1e1ba4153755171141402ab4ba2","observation_id":"ec99037e-e96b-4a23-a0f9-3ee01abca2a9","resolution":{"observed_at":"2026-08-07T15:06:33.579854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T14:15:15.211995Z","title":"SafeBench: A safety evaluation framework for multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23793","last_updated":"2025-05-26T08:39:14Z","snapshot_observed_at":"2026-08-17T22:27:22.824867Z","submitted_at":"2025-05-26T08:39:14Z","title":"USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:15.211995Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2505.23793"},"observation_digest":"sha256:41cc8c75b00073e7c18fe3a759736eb5e525719c18d93de0304eed6f58fc8fc6","observation_id":"4c35aa6d-af23-4ccd-b6cd-39e70e21f35e","resolution":{"observed_at":"2026-08-07T14:15:15.211995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T11:02:03.708785Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models.arXiv2024, arXiv:2410.18927","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03683","last_updated":"2025-06-04T08:13:53Z","snapshot_observed_at":"2026-08-17T00:05:51.667507Z","submitted_at":"2025-06-04T08:13:53Z","title":"PRJ: Perception-Retrieval-Judgement for Generated Images","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:02:03.708785Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2506.03683"},"observation_digest":"sha256:0f0cf2187ef2edc1b89969248e3d56e2df40ec4450d5a69574510ecf831a40d0","observation_id":"a3c88896-0a55-42ea-94af-7a6f60d66c26","resolution":{"observed_at":"2026-08-07T11:02:03.708785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T01:06:13.360109Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12148","last_updated":"2025-06-13T18:08:19Z","snapshot_observed_at":"2026-08-17T15:54:24.447926Z","submitted_at":"2025-06-13T18:08:19Z","title":"Hatevolution: What Static Benchmarks Don't Tell Us","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T01:06:13.360109Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2506.12148"},"observation_digest":"sha256:3f99cc65f9f15ffff5877abdccad57bd18ca4e852862026a8839b9d76a897255","observation_id":"d5647fa7-95cb-4631-8574-7e64036abdc8","resolution":{"observed_at":"2026-08-07T01:06:13.360109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-07T00:57:13.787678Z","title":"and Wu, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12430","last_updated":"2025-07-11T02:01:54Z","snapshot_observed_at":"2026-08-17T15:28:10.749198Z","submitted_at":"2025-06-14T10:03:17Z","title":"Pushing the Limits of Safety: A Technical Report on the ATLAS Challenge 2025","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:13.787678Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2506.12430"},"observation_digest":"sha256:5d9f88bcf51e9df7d6cdefa5618f14bed027c8fc4431da4bf3bf113a40ae2e67","observation_id":"3f02041a-4b63-4f7e-904c-fb8306e3faa0","resolution":{"observed_at":"2026-08-07T00:57:13.787678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.18927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-07-04T00:39:16.622704Z","title":"Safebench: A safety evaluation framework for multimodal large language models","venue":null,"work_id":"5e63cd99-dfaf-4489-9790-1200fa28aad1","year":2024},"citing_paper":{"arxiv_id":"2507.21540","last_updated":"2026-04-08T13:05:48Z","snapshot_observed_at":"2026-08-14T13:17:24.879488Z","submitted_at":"2025-07-29T07:13:56Z","title":"PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-19T03:36:24.013477Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2507.21540"},"observation_digest":"sha256:f0b322cd8814f745779097d62b2d0fb7b9ab99b2602d1c792fdc94fcb9114560","observation_id":"179bf2b5-07c3-4775-a195-332fcea8df02","resolution":{"observed_at":"2026-05-19T03:37:01.050974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-06T12:09:39.812263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-15T03:46:38.153906Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.812263Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:573d83ee0c7e568719d71658da28e5ae3364ba44e666abc5aafe4bef8fcdd663","observation_id":"84a1fa09-5fac-49a0-9a7c-5d08cfffaf94","resolution":{"observed_at":"2026-08-06T12:09:39.812263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-06T10:46:10.455850Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23486","last_updated":"2025-08-13T08:51:25Z","snapshot_observed_at":"2026-08-17T18:00:31.537551Z","submitted_at":"2025-07-31T12:10:00Z","title":"A Novel Evaluation Benchmark for Medical LLMs: Illuminating Safety and Effectiveness in Clinical Domains","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T10:46:10.455850Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2507.23486"},"observation_digest":"sha256:7ef15a0fce243230d1f5398834f47d72fd42b9b4e6d7dbd0298f28c4c9f07a70","observation_id":"f9460823-9764-4395-b2d8-e576d10e5b52","resolution":{"observed_at":"2026-08-06T10:46:10.455850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-05T22:59:19.872813Z","title":"Ying, Z.; Liu, A.; Liang, S.; Huang, L.; Guo, J.; Zhou, W.; Liu, X.; and Tao, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06133","last_updated":"2026-06-28T02:08:15Z","snapshot_observed_at":"2026-08-16T15:34:57.141414Z","submitted_at":"2025-08-08T08:54:21Z","title":"LLM Serving Optimization with Variable Prefill and Decode Lengths","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T22:59:19.872813Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2508.06133"},"observation_digest":"sha256:31855d02c8e852944c974e845c2cdabd639ea1993243dcd26b8d15fcb9253817","observation_id":"638c69ce-eb7c-43c9-be03-16cdedd8f489","resolution":{"observed_at":"2026-08-05T22:59:19.872813Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-04T23:49:33.590413Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06350","last_updated":"2026-01-27T23:14:36Z","snapshot_observed_at":"2026-08-04T23:49:28.733609Z","submitted_at":"2025-09-08T05:45:37Z","title":"Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T23:49:33.590413Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2509.06350"},"observation_digest":"sha256:9ab03a5596c9aac2ed5fd2750c6e5c8e2647ed87243887d9aa7f2d63806183f3","observation_id":"6f9d33de-3907-4cc7-bea3-49308d3b109b","resolution":{"observed_at":"2026-08-04T23:49:33.590413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-04T14:58:40.772114Z","title":"Safebench: A safety evaluation framework for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.22415","last_updated":"2026-07-15T06:42:59Z","snapshot_observed_at":"2026-08-17T15:37:22.862610Z","submitted_at":"2025-09-26T14:39:13Z","title":"Evidence Recomposition and Predictive Context Residualization for Visual Attribution in Multimodal Large Language Models","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T14:58:40.772114Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2509.22415"},"observation_digest":"sha256:7d50a9e0fc53d6dff7d50c7a54770910b958330a99473323d04ec8de38916c55","observation_id":"d5b73532-6df5-4685-854b-badf749082d0","resolution":{"observed_at":"2026-08-04T14:58:40.772114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.18927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-07-04T00:39:16.622704Z","title":"Safebench: A safety evaluation framework for multimodal large language models","venue":null,"work_id":"5e63cd99-dfaf-4489-9790-1200fa28aad1","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-08-14T23:09:43.432150Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:addf16b3a1718b2b01f1537b7b442960f9219a0238a57a421dbbae4f85a7245b","observation_id":"a715de99-dcb7-4650-b1d3-304988d2e1c3","resolution":{"observed_at":"2026-05-18T08:16:06.542069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-15T15:46:06.039927Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.24411","last_updated":"2026-07-26T01:16:06Z","snapshot_observed_at":"2026-08-15T15:39:09.441338Z","submitted_at":"2025-10-28T13:22:39Z","title":"OS-Sentinel: Towards Safety-Enhanced Mobile GUI Agents via Hybrid Validation in Realistic Workflows","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T15:46:06.039927Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2510.24411"},"observation_digest":"sha256:5176bd5e3af19070ff2c8b73413a1d498b51d83d38c66625533a348e5c390161","observation_id":"6883b789-33df-4213-8142-e7f4b9befa9f","resolution":{"observed_at":"2026-08-15T15:46:06.039927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.18927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-07-04T00:39:16.622704Z","title":"Safebench: A safety evaluation framework for multimodal large language models","venue":null,"work_id":"5e63cd99-dfaf-4489-9790-1200fa28aad1","year":2024},"citing_paper":{"arxiv_id":"2606.18632","last_updated":"2026-06-17T03:03:16Z","snapshot_observed_at":"2026-08-16T10:25:49.876391Z","submitted_at":"2026-06-17T03:03:16Z","title":"ROBOSHACKLES: A Safety Dataset for Human-Injury Prevention in Embodied Foundation Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-26T21:06:54.022715Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2606.18632"},"observation_digest":"sha256:fef706020898018488f4ef3e119dda8e05f552c3bbfa891c8dbd3d682faf2c2f","observation_id":"13fac892-3c89-4675-af0a-85eca087a48f","resolution":{"observed_at":"2026-07-04T00:39:16.624438Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.18927/citation-record","integrity":"/paper/2410.18927/integrity","json":"/paper/2410.18927/citation-record.json","paper":"/paper/2410.18927"},"outbound":[],"paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-16T13:06:11.757117Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2410.18927."}