{"as_of":"2026-08-10T07:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2a0985912ea1ceab8762d953e22d4ab6324899227c3a223f49c97aee469730c","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:21:35.386601Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.11155/citation-record","integrity":"/paper/2507.11155/integrity","json":"/paper/2507.11155/citation-record.json","paper":"/paper/2507.11155"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.228064Z","title":"https://huggingface.co/deepseek-ai/ 13 DeepSeek-R1","venue":null,"work_id":"d64912fd-1a10-4215-815d-ab78cf58a9cb","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.122949Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f9c10ceca4caed49f8c1ff3e884e0532c2a9d855959df95b059ee25266dc7898","observation_id":"de479335-37c3-4d7c-be41-782cef9fa42e","resolution":{"observed_at":"2026-08-06T17:21:36.236155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.199078Z","title":"https://openai.com/index/gpt-4-1/","venue":null,"work_id":"0de5476d-b410-4570-8b3f-da342627249c","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.127530Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:c9540aaa2e933de7b17acc2eb4e5fad844f2017b7fe98a661a24fcb5ed89bf77","observation_id":"3845f66e-d594-4ce7-b367-fd4bae1e3fcd","resolution":{"observed_at":"2026-08-06T17:21:36.213411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.173481Z","title":"https://openai.com/research/gpt-4v- system-card","venue":null,"work_id":"e5180b0c-6214-4948-9ebf-6d69d249071b","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.132351Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e1eed06a9e7d184309d760705d4a1788f16f0feb7eeee02febc2aea1895aebdd","observation_id":"2705751e-6dbd-4d2d-bf6d-25123558ba53","resolution":{"observed_at":"2026-08-06T17:21:36.185507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.149835Z","title":"https://huggingface.co/datasets/laion/ laion2B-en","venue":null,"work_id":"3cd774fe-f011-402c-95ec-35983e883433","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.136636Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:02b85b721626b906d0370fbc320d6e5475c9192b883a39444c4f1e35237f331e","observation_id":"62008d21-bb05-4e6a-b5c5-b5a8b18aa477","resolution":{"observed_at":"2026-08-06T17:21:36.160262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.118786Z","title":"https: //academictorrents.com/details/ 1cda9427784a6b77809f657e772814dc766b69f5","venue":null,"work_id":"a47b6c6e-10ff-402c-9930-f70fc62c6fb5","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.140805Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:3bedfe8a5184185b6bcf8f664bd39cef013f0c72a89c8a5553553d353e336222","observation_id":"dfb1bc55-ccb3-4378-a25f-0c5bbf95b529","resolution":{"observed_at":"2026-08-06T17:21:36.132459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.097177Z","title":"https://web.archive.org/web/ 20220406151527/https://labs.openai.com/policies/ content-policy","venue":null,"work_id":"5bc46a0c-f5ff-4009-8948-5d3d445af9a6","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.145036Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:238d80998103b149825e6b5c103c65469a2685e584112e1e75cd0fc85d40ee26","observation_id":"6ac9360b-cd54-4c35-bb10-ff6067519a5a","resolution":{"observed_at":"2026-08-06T17:21:36.106730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.076801Z","title":"https://openai.com/o1/","venue":null,"work_id":"2f6faae2-5efd-498e-b4a2-e36f29138a8e","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.148841Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:46909a9952476479ea48c4e8e99536745b7f0694f831a20370b0d4f10534bbf5","observation_id":"83110e28-ebbf-498a-82ea-25f343e7677a","resolution":{"observed_at":"2026-08-06T17:21:36.085062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.048685Z","title":"https://osf.io/2rqad/","venue":null,"work_id":"f0ca5268-289e-4c9f-842c-2d0716a400c2","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.152404Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:df209a6d99ef916c6e80203f9740c1204b5c1dc6144f7fe1c1c4b34d9b96f47c","observation_id":"e450028e-a585-4add-9526-52bf0d21a505","resolution":{"observed_at":"2026-08-06T17:21:36.057871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T17:21:35.156208Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.156208Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:2a77f5c374e5c627587a405a157cd3e710362a4fa725df2294d9f9083760154d","observation_id":"18bdc356-6edd-44ff-8389-a227cc205a27","resolution":{"observed_at":"2026-08-06T17:21:35.156208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.031217Z","title":"Designing Neural Network Architectures using Rein- forcement Learning","venue":null,"work_id":"ba0c49da-a034-47e2-9964-e97a04ee1b28","year":2017},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.159839Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:eae79280857d63642a023d82e3ff7a9851838ce7aa231c2963753d5fdca25968","observation_id":"47a09fa3-174c-42c8-ba3d-c067bf6da595","resolution":{"observed_at":"2026-08-06T17:21:36.036711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.010777Z","title":"Image Safeguarding: Reasoning with Conditional Vision Language Model and Obfuscating Unsafe Content Counterfactually","venue":null,"work_id":"630625ab-dfaa-4ff2-b4f9-e94f23a6979d","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.163361Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e0055c54db590021345a3c93123753feb065f19b129c09e7f970b668724e9b1d","observation_id":"2c0199ff-0443-4701-9516-ef4c6ce22a61","resolution":{"observed_at":"2026-08-06T17:21:36.019184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-06T17:21:35.166750Z","title":"InternLM2 Technical Re- port","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.166750Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:64e837dce2e33b6719284ee83dedd0272ae9d24eb9c2b296877a313b20b190fe","observation_id":"f4895b71-2732-4461-b5bc-b051b20bc177","resolution":{"observed_at":"2026-08-06T17:21:35.166750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12793","last_updated":"2023-11-28T08:52:50Z","snapshot_observed_at":"2026-08-04T08:17:54.774738Z","submitted_at":"2023-11-21T18:58:11Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12793","snapshot_observed_at":"2026-08-06T17:21:35.170826Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.170826Z"},"links":{"cited_paper":"/paper/2311.12793","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:55126df7bb2aefbc3fcd62f3e6567b2d5ed5e4e31713dd25c24ee9a2fe63826f","observation_id":"abe12a9e-b13f-4f56-bd0c-71d1e175db75","resolution":{"observed_at":"2026-08-06T17:21:35.170826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.175318Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.175318Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:2b0d128c40482de2586ac88709ce2f2e70335894c252fcb9945bc73a94786a19","observation_id":"fd2e3fcc-0580-4157-94c0-15377cc20100","resolution":{"observed_at":"2026-08-06T17:21:35.175318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.992581Z","title":null,"venue":null,"work_id":"c7af7a9b-6a3a-4eb4-aed0-22f892363d24","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.179278Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:2dd5ee140ddd2e26ac03c3c3892435ff9cfd725e26f077c58eee88387d658d62","observation_id":"86f736ee-9392-4189-ae26-0823d40af63c","resolution":{"observed_at":"2026-08-06T17:21:35.997267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.979199Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":"e4a08da7-d097-4f9f-9dc3-22d504f5f392","year":2009},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.183752Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:fe2ef0332b32f2ff6984691af7303fc75c61398c92a4f6e1640342e94838668c","observation_id":"3e83941c-494d-48dd-8b6b-bae0b4bfcd27","resolution":{"observed_at":"2026-08-06T17:21:35.984232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06625","last_updated":"2025-02-10T05:47:27Z","snapshot_observed_at":"2026-07-06T19:30:13.003609Z","submitted_at":"2024-10-09T07:21:43Z","title":"ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06625","snapshot_observed_at":"2026-08-06T17:21:35.186888Z","title":"ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.186888Z"},"links":{"cited_paper":"/paper/2410.06625","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e8bc93b38fe34e677664b06e46891f1ad4d0f2186ba0cf7e1b2d64243329aeeb","observation_id":"46b7d000-77e8-41a7-a883-caccc8755ba0","resolution":{"observed_at":"2026-08-06T17:21:35.186888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16420","last_updated":"2024-01-29T18:59:02Z","snapshot_observed_at":"2026-08-05T03:42:54.599829Z","submitted_at":"2024-01-29T18:59:02Z","title":"InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16420","snapshot_observed_at":"2026-08-06T17:21:35.190481Z","title":"InternLM-XComposer2: Mastering Free- form Text-Image Composition and Comprehension in Vision- Language Large Model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.190481Z"},"links":{"cited_paper":"/paper/2401.16420","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:5f3e3c78debbc46e32d5c997265a20b9ffda2016c568d5cbaf0821a0f82cb249","observation_id":"c217dcee-af51-45ad-ac57-61bb58e5735b","resolution":{"observed_at":"2026-08-06T17:21:35.190481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09244","last_updated":"2024-08-16T23:59:29Z","snapshot_observed_at":"2026-08-06T16:36:51.551387Z","submitted_at":"2023-12-14T18:59:04Z","title":"Helping or Herding? Reward Model Ensembles Mitigate but do not Eliminate Reward Hacking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09244","snapshot_observed_at":"2026-08-06T17:21:35.194359Z","title":"Heller, Stephen Pfohl, Deepak Ramachandran, Pe- ter Shaw, and Jonathan Berant","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.194359Z"},"links":{"cited_paper":"/paper/2312.09244","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:7d1cb1f2892224fba336019fa70df648d781d2d14941ac7832eb2ffd51defd46","observation_id":"1936df79-e57c-42bc-a82a-46f309452a11","resolution":{"observed_at":"2026-08-06T17:21:35.194359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.198149Z","title":"Fleiss’ kappa statistic without paradoxes","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.198149Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:495c4673eb3b86bb49fb1accd1944e8c2444f1274cef82553a8e6e4539497d29","observation_id":"23b65e5f-de48-450a-883e-a0c63e09addf","resolution":{"observed_at":"2026-08-06T17:21:35.198149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.202068Z","title":"Measuring Nominal Scale Agreement Among Many Raters","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.202068Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:fdf6c5a2570904faeae29936a464bd3cfda8677e6e20d30ca819af174c6867cf","observation_id":"7de8e157-ab5d-4a0c-aaf3-bb59dcb0aaa9","resolution":{"observed_at":"2026-08-06T17:21:35.202068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-06T17:21:35.205357Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.205357Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:00ccb07fab4f7a7979c55dc357eb009ce0399f2730ddb22a1fe9bab01b1c5d5b","observation_id":"9d52d7e1-7c04-4e59-b9d1-d849e87e2b27","resolution":{"observed_at":"2026-08-06T17:21:35.205357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05608","last_updated":"2025-01-19T16:23:38Z","snapshot_observed_at":"2026-07-06T16:45:24.070954Z","submitted_at":"2023-11-09T18:59:11Z","title":"FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05608","snapshot_observed_at":"2026-08-06T17:21:35.208807Z","title":"Fig- Step: Jailbreaking Large Vision-language Models via Typo- graphic Visual Prompts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.208807Z"},"links":{"cited_paper":"/paper/2311.05608","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f4545d61dd34fe716708d29e79e8f9fed7ae070d7ca9b489e6f68e25d8730242","observation_id":"d549b25a-4dac-4f19-9750-9debf0272fd8","resolution":{"observed_at":"2026-08-06T17:21:35.208807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.954081Z","title":"Kwok, and Yu Zhang","venue":null,"work_id":"4051b47c-f238-4e4e-8b7e-75fba6d1bc5b","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.212605Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:d4037bf5368a2c73e21a7151ff78aafb3c3b64796e7d1265011728e1da31db5f","observation_id":"dc3de447-b1b9-46ac-9c95-d0bd99d06b01","resolution":{"observed_at":"2026-08-06T17:21:35.958067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.943643Z","title":"Moderating Illicit Online Image Promo- tion for Unsafe User-Generated Content Games Using Large Vision-Language Models","venue":null,"work_id":"61e398b0-56c3-4c14-8985-5acf1c644cfe","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.215937Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:a4489be4244cda0d1066305b9e800d0213c897d58ba63e852d2c547a6de5d2ff","observation_id":"dd154da8-3727-42be-82e9-396a68385a9b","resolution":{"observed_at":"2026-08-06T17:21:35.947447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05113","last_updated":"2025-06-06T17:08:12Z","snapshot_observed_at":"2026-08-06T15:48:59.504311Z","submitted_at":"2024-06-07T17:44:32Z","title":"LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05113","snapshot_observed_at":"2026-08-06T17:21:35.219871Z","title":"LLavaGuard: VLM-based Safeguards for Vision Dataset Curation and Safety Assess- ment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.219871Z"},"links":{"cited_paper":"/paper/2406.05113","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:9da44c14bbbc4e6f91149705a8673df7a0a70dde9a1fa3d2dcff503ed0adf25b","observation_id":"fafedff1-86aa-4ec7-a2ca-2309d30b53ac","resolution":{"observed_at":"2026-08-06T17:21:35.219871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.932719Z","title":"Glass, Akash Srivastava, and Pulkit Agrawal","venue":null,"work_id":"e2f2ca4a-db7a-4cba-b76f-93fbba1d7d8e","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.224106Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:66b86588dd967a79260b807ff09c3691647b981f15c603171f76f13f115fe32c","observation_id":"fe8159af-8419-41c0-b7a7-1a5e90c57591","resolution":{"observed_at":"2026-08-06T17:21:35.936855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.921288Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"24dd2b92-eecc-4ff4-b652-c252671384a7","year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.227446Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:7b2566a80b223048fcb9938d5a642a100341a3bd9980b11a0fe94e779e1aa87a","observation_id":"c9250c89-11de-428e-a8f1-c7800e71b84c","resolution":{"observed_at":"2026-08-06T17:21:35.925456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.911253Z","title":"Deep Reinforcement Learning for Di- alogue Generation","venue":null,"work_id":"70fb9f2a-da07-4d8a-8b30-b194f0a5a069","year":2016},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.231261Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:0540145f9dc6e349dc015403edc83f179f89bb905d7542713af7ecbe9f404dc9","observation_id":"a18f95d8-9b31-4586-a393-65111424bd3d","resolution":{"observed_at":"2026-08-06T17:21:35.915021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-06T17:21:35.235072Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.235072Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:edefa624202429b18218515393c0c8a9f4540a4513be3bb13e732050a601f791","observation_id":"438ccd36-c875-413f-a23b-e4f14297bd45","resolution":{"observed_at":"2026-08-06T17:21:35.235072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10665","last_updated":"2023-12-17T09:44:27Z","snapshot_observed_at":"2026-07-06T17:04:13.625458Z","submitted_at":"2023-12-17T09:44:27Z","title":"Silkie: Preference Distillation for Large Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10665","snapshot_observed_at":"2026-08-06T17:21:35.238949Z","title":"Silkie: Preference Distillation for Large Visual Lan- guage Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.238949Z"},"links":{"cited_paper":"/paper/2312.10665","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:031a8a1919ea51b1421d9d071f6c189e66dfab9ebcdbabb1a951f4e166b33300","observation_id":"197ee628-b76b-4860-9504-86827db0aa01","resolution":{"observed_at":"2026-08-06T17:21:35.238949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.901003Z","title":"Red Teaming Visual Language Models","venue":null,"work_id":"af315fc4-7c2c-4910-93ed-9f08c49c610f","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.242675Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:62defe40aa2d25d16697aa578a1a5fc3ac2946f7f756143fec68bbaf6fe40e15","observation_id":"bea15e90-d2cf-4593-adcf-9b1e5939ef22","resolution":{"observed_at":"2026-08-06T17:21:35.904973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01523","last_updated":"2025-02-28T15:13:46Z","snapshot_observed_at":"2026-08-08T01:24:08.862743Z","submitted_at":"2024-01-03T03:28:55Z","title":"GOAT-Bench: Safety Insights to Large Multimodal Models through Meme-Based Social Abuse","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01523","snapshot_observed_at":"2026-08-06T17:21:35.246231Z","title":"GOAT-Bench: Safety Insights to Large Multi- modal Models through Meme-Based Social Abuse","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.246231Z"},"links":{"cited_paper":"/paper/2401.01523","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:0489ddc086080028f724dac3ba3c91483bb65d4674a6c3a4d5a1c0c0a8376714","observation_id":"9a707ee9-00d6-4970-a3c2-35751f12fba4","resolution":{"observed_at":"2026-08-06T17:21:35.246231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.888731Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C","venue":null,"work_id":"3e55c142-55ba-4607-be3a-c7dea353ca3c","year":2014},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.250252Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:efba1f3b2895c0d5f6e16b65772398a563879f94fc2d17149ede79b34773232f","observation_id":"3e7297ca-769d-49f1-9d06-003aa41fe1be","resolution":{"observed_at":"2026-08-06T17:21:35.893067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-06T17:21:35.254512Z","title":"Improved Baselines with Visual Instruction Tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.254512Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:ca1b74ba7105d2b453cb178f9777f59c88d81c17444214a7867aa863d3827e83","observation_id":"b1f2be79-c6f2-4023-bd69-e7bf4bd24fca","resolution":{"observed_at":"2026-08-06T17:21:35.254512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.876351Z","title":"Visual Instruction Tuning","venue":null,"work_id":"7c69f9a7-0a3a-4dc0-9a78-a90d226a52cd","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.258141Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:75cca4e081199e54a2384f3cdad9624ea725f57410eccd0d0fec18fde5b58443","observation_id":"fca06dda-adac-42f5-a31c-5adfe6756e1f","resolution":{"observed_at":"2026-08-06T17:21:35.880351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09047","last_updated":"2024-10-11T17:59:31Z","snapshot_observed_at":"2026-07-06T19:31:57.906994Z","submitted_at":"2024-10-11T17:59:31Z","title":"Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09047","snapshot_observed_at":"2026-08-06T17:21:35.262536Z","title":"Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.262536Z"},"links":{"cited_paper":"/paper/2410.09047","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f58359ae82cb818cf351d2c21fd5c6ee318f70cb9a7d16659863a758a64a49e4","observation_id":"2faa3e67-f4e6-46ee-85f4-9463ca6e7bcf","resolution":{"observed_at":"2026-08-06T17:21:35.262536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.865937Z","title":"MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models","venue":null,"work_id":"822ed617-f495-48f8-9cf0-e8a8447cb427","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.266120Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:c72e0d439fd4e2d2812e1439d547d9591eb8623e43c1cf0bab3b1b1f084f4d78","observation_id":"5e894b5c-b5e4-4f10-99a8-b270c72bb9e9","resolution":{"observed_at":"2026-08-06T17:21:35.869284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T17:21:35.269179Z","title":"RoBERTa: A Robustly Opti- mized BERT Pretraining Approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.269179Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:16e9e5c9bc530203a1b1b03e228a2c30c89e056f4ccfc2f8825c62dddcec75b2","observation_id":"f03aac4f-842b-40ae-84fa-8b4b78a6425d","resolution":{"observed_at":"2026-08-06T17:21:35.269179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13581","last_updated":"2024-05-22T12:21:27Z","snapshot_observed_at":"2026-08-07T15:03:51.692003Z","submitted_at":"2024-05-22T12:21:27Z","title":"Safety Alignment for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13581","snapshot_observed_at":"2026-08-06T17:21:35.272675Z","title":"Safety Alignment for Vision Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.272675Z"},"links":{"cited_paper":"/paper/2405.13581","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:24c1d4934c7887ce01eef36f6464266147356d68e4369e6f018573bb0bb0af53","observation_id":"3acacffc-bf8e-4d23-8f7e-673730b424ca","resolution":{"observed_at":"2026-08-06T17:21:35.272675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.854532Z","title":"From Meme to Threat: On the Hateful Meme Understanding and Induced Hateful Content Generation in Open-Source Vision Language Mod- els","venue":null,"work_id":"55791a8c-f24d-4892-86e4-7997bba99f9d","year":2025},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.276398Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:2a45eaaf6d20c33a43896a6932a91ffbbd1e3b7be2b5619e2791d930d3e1b095","observation_id":"a56f1111-94f5-472d-912c-ff112a1ca5a0","resolution":{"observed_at":"2026-08-06T17:21:35.858852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.844496Z","title":null,"venue":null,"work_id":"5760cd38-62a5-4209-a551-5e5c47eec97a","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.279490Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:5c4be241b13d3382524165b15bdd43c2b395d58a374a743991554b36ff3caaa2","observation_id":"4e622c8d-4a8c-4177-b087-afdfaef88c04","resolution":{"observed_at":"2026-08-06T17:21:35.847374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T17:21:35.282837Z","title":"GPT-4 Technical Report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.282837Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:dfa045ca5c7bd2e26a7ce54c4f48dbd35e1d04067544b37d8a39e5f44fa7a0f9","observation_id":"50bc509b-1ddb-4157-850f-f19e99d996b9","resolution":{"observed_at":"2026-08-06T17:21:35.282837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.834969Z","title":"Efros, and Trevor Darrell","venue":null,"work_id":"bb958a9d-885f-44bb-bba9-2b74a88adaf6","year":2017},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.286650Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:31201098e3002530bde67aba47250b61dcb0f2de10cbcd7fa9a4dd0f7896b66f","observation_id":"aa6b75b0-5afb-4771-8d0d-446cfaead8b1","resolution":{"observed_at":"2026-08-06T17:21:35.837911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13213","last_updated":"2023-08-16T22:38:55Z","snapshot_observed_at":"2026-08-09T21:14:39.812982Z","submitted_at":"2023-06-22T22:13:03Z","title":"Visual Adversarial Examples Jailbreak Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13213","snapshot_observed_at":"2026-08-06T17:21:35.290281Z","title":"Visual Adversarial Examples Jail- break Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.290281Z"},"links":{"cited_paper":"/paper/2306.13213","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:b1d1f3298f8c40a677823cd8d374b8415a05e9676a52e743b32d7a1d04524e39","observation_id":"b1632b72-81db-4f0f-861a-6e8f9ece354b","resolution":{"observed_at":"2026-08-06T17:21:35.290281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.821971Z","title":"On the Evolution of (Hateful) Memes by Means of Multimodal Contrastive Learn- ing","venue":null,"work_id":"d3eb30d7-5af6-40a0-8358-fa40f414e42a","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.293978Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:756337e87f73bad469b30415363a406c87a0cf62c62c793304727cdfbca5e05b","observation_id":"f67fa2e5-384f-4cc9-a0f4-9d271e4a1de4","resolution":{"observed_at":"2026-08-06T17:21:35.828089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.809817Z","title":"Unsafe Diffusion: On the Gen- eration of Unsafe Images and Hateful Memes From Text-To- Image Models","venue":null,"work_id":"37f643a6-76d8-4cb7-848d-5e70d7ff406c","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.297189Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:7bf19dcdcce26d94cf015cb1f00192dc88f13a50fb363e5dfd2b6b749fc5bd31","observation_id":"011ea5f8-e16b-47fa-8bdd-fe77222e103f","resolution":{"observed_at":"2026-08-06T17:21:35.814657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03486","last_updated":"2025-09-11T08:50:08Z","snapshot_observed_at":"2026-08-04T06:06:53.556065Z","submitted_at":"2024-05-06T13:57:03Z","title":"UnsafeBench: Benchmarking Image Safety Classifiers on Real-World and AI-Generated Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03486","snapshot_observed_at":"2026-08-06T17:21:35.300886Z","title":"UnsafeBench: Benchmarking Image Safety Classifiers on Real-World and AI-Generated Im- ages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.300886Z"},"links":{"cited_paper":"/paper/2405.03486","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:22a559ef4820a7d8b9b6ff02df661f4cfadc1712f3b1a209f34581ab4e17510f","observation_id":"1aa2458a-4eb7-4ac5-8c6b-f652f18bcc17","resolution":{"observed_at":"2026-08-06T17:21:35.300886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.797556Z","title":"Learning Transferable Visual Models From Natural Language Supervision","venue":null,"work_id":"dae2d0da-4a96-4e19-861b-858362f392f9","year":2021},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.304263Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:a0f7a4efbfc99bccd33d01a7c554fd8fa4be108bfb07ccb89e5da28f3d183c61","observation_id":"da40a24f-6f79-47c9-8e59-5fcf662f07cf","resolution":{"observed_at":"2026-08-06T17:21:35.802346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.785484Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"7d90e6af-4961-4344-a299-64b16c69b471","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.307529Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:7e71faedb4100f6f5f22f06379cf684b0dd67effc794ff9b80d30465f05793bc","observation_id":"786f692e-4762-405e-8cda-7178cee67106","resolution":{"observed_at":"2026-08-06T17:21:35.789689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12198","last_updated":"2025-03-23T04:26:00Z","snapshot_observed_at":"2026-07-06T17:32:15.447061Z","submitted_at":"2024-02-19T15:03:04Z","title":"Exploring the Limits of Zero Shot Vision Language Models for Hate Meme Detection: The Vulnerabilities and their Interpretations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12198","snapshot_observed_at":"2026-08-06T17:21:35.311066Z","title":"Zero shot VLMs for hate meme detection: Are we there yet? CoRR abs/2402.12198, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.311066Z"},"links":{"cited_paper":"/paper/2402.12198","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:d13f62b7cc8ace7f92e7b47a22e313eaec76cb672c0416bf0f600c57cb4b67dc","observation_id":"4c5e82af-a94f-420a-b7a3-d07d305c1978","resolution":{"observed_at":"2026-08-06T17:21:35.311066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05105","last_updated":"2023-04-26T11:47:44Z","snapshot_observed_at":"2026-07-06T14:16:24.882622Z","submitted_at":"2022-11-09T18:54:25Z","title":"Safe Latent Diffusion: Mitigating Inappropriate Degeneration in Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05105","snapshot_observed_at":"2026-08-06T17:21:35.315436Z","title":"Safe Latent Diffusion: Mitigating In- appropriate Degeneration in Diffusion Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.315436Z"},"links":{"cited_paper":"/paper/2211.05105","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f6de3995849da6e17fef590219a5488382c25e29efb4e02b0173ff5184841886","observation_id":"c35be7c9-a6dd-4902-bcbc-86d09efac4a2","resolution":{"observed_at":"2026-08-06T17:21:35.315436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T17:21:35.319076Z","title":"Proximal Policy Optimization Algo- rithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.319076Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:19a04c0c729f71a0285a35bf79a712a40c0f4feb86f9bf7577fc0e579edaab0c","observation_id":"3bb4527a-5233-4b6a-b959-237078f85288","resolution":{"observed_at":"2026-08-06T17:21:35.319076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.322406Z","title":"HateBench: Benchmarking Hate Speech Detectors on LLM-Generated Content and Hate Cam- paigns","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.322406Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:892727e0140c815689ab8527f7d7103f2c77b991a2859c42f0601484821f9c9d","observation_id":"197ef339-8d22-4290-808f-3a0a717836ca","resolution":{"observed_at":"2026-08-06T17:21:35.322406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17830","last_updated":"2024-03-26T16:10:21Z","snapshot_observed_at":"2026-07-06T17:51:24.261505Z","submitted_at":"2024-03-26T16:10:21Z","title":"Assessment of Multimodal Large Language Models in Alignment with Human Values","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17830","snapshot_observed_at":"2026-08-06T17:21:35.326106Z","title":"Assessment of Multimodal Large Language Mod- els in Alignment with Human Values","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.326106Z"},"links":{"cited_paper":"/paper/2403.17830","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:b37d3e4e6d8d44763b81e6d321a426aebbe8cf28e1956d6ddaf6653a308c5216","observation_id":"3bfa66ed-6201-4f70-81cc-6ee2ef44e5e6","resolution":{"observed_at":"2026-08-06T17:21:35.326106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.764729Z","title":null,"venue":null,"work_id":"9b408171-c07b-4916-b360-e287d645415a","year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.329648Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:19a7a0fad326cb70de8f9866232d6dd5f382177d5a7ff313791f4be5b0a9820c","observation_id":"f67551d3-b7b4-40ee-bf94-4af4e4236075","resolution":{"observed_at":"2026-08-06T17:21:35.768524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.752524Z","title":"Align- ing Large Multimodal Models with Factually Augmented RLHF","venue":null,"work_id":"f5375e73-74da-4f33-becf-a850f1280b9e","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.333883Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:58579d20e6003db9af45601e57f00a836ee9d64c4a7ee99f579eac5e9b1b2aaa","observation_id":"fbd7e762-aab8-4f8d-a33f-cc4ad88a93c9","resolution":{"observed_at":"2026-08-06T17:21:35.757327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.740537Z","title":"Vicuna: An Open-Source Chatbot Impress- ing GPT-4 with 90%* ChatGPT Quality","venue":null,"work_id":"6f0125c2-0d20-4dd3-ad8e-e3260e7fd23d","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.337460Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:874bd6dcc92235cb0619d0daba0a7fbb219726ed2010318c5621e60a5687e8bf","observation_id":"cfb9e0df-b385-4594-a38f-b907dc1c8ccb","resolution":{"observed_at":"2026-08-06T17:21:35.745048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T17:21:35.340516Z","title":"Qwen2-VL: Enhancing Vision-Language Model’s Perception of the World at Any Resolution.CoRR abs/2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.340516Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:d3b27ac9845c648a4b96669e8fb2a1026143b913f5820993a66bdc39a47c923e","observation_id":"d5218bbb-8a69-4f89-a888-3092290f110f","resolution":{"observed_at":"2026-08-06T17:21:35.340516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15279","last_updated":"2025-02-17T03:38:42Z","snapshot_observed_at":"2026-08-03T17:57:32.495715Z","submitted_at":"2024-06-21T16:14:15Z","title":"Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15279","snapshot_observed_at":"2026-08-06T17:21:35.344438Z","title":"Cross-Modality Safety Alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.344438Z"},"links":{"cited_paper":"/paper/2406.15279","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:3d27758c299b06a46c2b5fb8fdc4102d92180b2f43c1ee3d2d49cde793263cdf","observation_id":"0e60edac-3f2c-4201-8a5d-126e1d465497","resolution":{"observed_at":"2026-08-06T17:21:35.344438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-06T17:21:35.347771Z","title":"CogVLM: Visual Expert for Pretrained Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.347771Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:6529404079b11532bae9ca78a125150c679d5a5cf5ed0dc5a8b43a87c35256f6","observation_id":"d4c365a7-aa0e-4201-a726-517095b23028","resolution":{"observed_at":"2026-08-06T17:21:35.347771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.728980Z","title":"RL-VLM-F: Rein- forcement Learning from Vision Language Foundation Model Feedback","venue":null,"work_id":"36a5c163-47c0-479a-a679-1ae5467d5efa","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.351460Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:34028bbfef284ceae3fd11be91ce3a68559a4d3c25f0ad8777dbff1a9071dc3f","observation_id":"b74250c5-fcb7-4e9e-bac2-d0389d5afa0d","resolution":{"observed_at":"2026-08-06T17:21:35.733568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20370","last_updated":"2024-09-30T15:06:53Z","snapshot_observed_at":"2026-07-06T19:24:35.007698Z","submitted_at":"2024-09-30T15:06:53Z","title":"The Perfect Blend: Redefining RLHF with Mixture of Judges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20370","snapshot_observed_at":"2026-08-06T17:21:35.355204Z","title":"The Perfect Blend: Redefining RLHF with Mixture of Judges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.355204Z"},"links":{"cited_paper":"/paper/2409.20370","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:dcd10959ae95c7298609c6b96af939d0660b66b992027b3b3987973e2c5159f0","observation_id":"b90fd3dc-1854-450a-b2cc-e1efdc81e7d4","resolution":{"observed_at":"2026-08-06T17:21:35.355204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T17:21:35.359327Z","title":"Qwen2 Technical Re- port","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.359327Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:06410ee1dcbfe2c24585f5e606192ce1b5a866106a6753b2ea93c6e1c5c26feb","observation_id":"51af121b-4754-4101-9dfd-43e10568370e","resolution":{"observed_at":"2026-08-06T17:21:35.359327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13797","last_updated":"2025-05-18T16:13:47Z","snapshot_observed_at":"2026-07-06T17:47:51.284226Z","submitted_at":"2024-03-20T17:54:58Z","title":"Bridge the Modality and Capability Gaps in Vision-Language Model Selection","version":3},"cited_work":{"arxiv_id":"2403.13797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13797","snapshot_observed_at":"2026-08-06T17:21:35.443194Z","title":"Bridge the Modality and Capability Gaps in Vision-Language Model Selection","venue":"cs.LG","work_id":"5bddf432-94e2-47cc-8e3b-21b67f7d2698","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.363566Z"},"links":{"cited_paper":"/paper/2403.13797","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:65cc40f6ed951833930fa2527c579a4e3b565406d78f1454870222e3914c09a8","observation_id":"be4f0882-b600-49f2-afe0-ca71eed6ddc9","resolution":{"observed_at":"2026-08-06T17:21:35.449506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.716529Z","title":"RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-Grained Correctional Human Feedback","venue":null,"work_id":"6d6f8a9e-1a4c-427a-8c92-08012ee1138b","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.367388Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:eb1f21253d22634076b8e70b83192e29830468be30a61f63d107b15633acb4b2","observation_id":"2118bebf-d9d8-4211-99e4-9b19d984e47d","resolution":{"observed_at":"2026-08-06T17:21:35.721254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12030","last_updated":"2025-05-21T04:55:10Z","snapshot_observed_at":"2026-08-08T01:23:11.364463Z","submitted_at":"2024-06-17T18:57:37Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12030","snapshot_observed_at":"2026-08-06T17:21:35.371849Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vi- sion Language Model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.371849Z"},"links":{"cited_paper":"/paper/2406.12030","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:ff43c09361a37ed4748245a64794f1a4f085dd864b726fa4d778a7c31ee0d2a8","observation_id":"ffc2c45d-0465-46fb-a516-7373399e78f1","resolution":{"observed_at":"2026-08-06T17:21:35.371849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03225","last_updated":"2025-04-09T17:25:07Z","snapshot_observed_at":"2026-08-08T19:21:41.641368Z","submitted_at":"2025-01-06T18:57:31Z","title":"Automated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03225","snapshot_observed_at":"2026-08-06T17:21:35.375340Z","title":"Automated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.375340Z"},"links":{"cited_paper":"/paper/2501.03225","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:6f0c0d747d7de1798819b600a3e28acea6b573fb37b076cf3f310a3fd6f07399","observation_id":"4b83a515-e482-4667-93b7-ce63f42bb000","resolution":{"observed_at":"2026-08-06T17:21:35.375340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.705507Z","title":"On Evaluating Ad- versarial Robustness of Large Vision-Language Models","venue":null,"work_id":"9e56c8bf-0cab-42fc-8936-f779d9cbad2e","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.378803Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:571b619d92810e2dc5a987feb8c0d85c12fa1c8edb205ede43314469af8aff1e","observation_id":"641d9c1f-33ee-4821-a3c0-9a6db5d9a12c","resolution":{"observed_at":"2026-08-06T17:21:35.709325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04964","last_updated":"2023-07-18T08:44:47Z","snapshot_observed_at":"2026-08-07T18:08:01.409989Z","submitted_at":"2023-07-11T01:55:24Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04964","snapshot_observed_at":"2026-08-06T17:21:35.382133Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.382133Z"},"links":{"cited_paper":"/paper/2307.04964","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:c63e3f76e1d6625ffb8bd0842325df28a42b3432d6540b40d54079e4521b80df","observation_id":"2c76d47f-024e-451e-a568-db48a2677b97","resolution":{"observed_at":"2026-08-06T17:21:35.382133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.693692Z","title":"Yes” or “No","venue":null,"work_id":"b21e886b-f510-48ad-a3eb-f5ff89f209cb","year":2018},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.386601Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:720fd7acd7b2d17370a15d1666d2589fa7f8849359e38e286c450e6c44f84f42","observation_id":"e19ae674-5361-406b-b663-9a91ebdf934b","resolution":{"observed_at":"2026-08-06T17:21:35.697292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2507.11155."}