{"as_of":"2026-08-10T09:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04a279603510d1db9a707cdb17e15c6c06712775de6e99a212b13af675a77eda","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:09:39.861497Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T19:19:42.748573Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T19:19:42.862780Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"cited_work":{"arxiv_id":"2507.22037","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22037","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f0e6a6b-4040-49bf-8d46-fd8bb6aec5da","year":2025},"citing_paper":{"arxiv_id":"2505.17685","last_updated":"2025-11-11T01:31:25Z","snapshot_observed_at":"2026-08-02T20:06:32.255780Z","submitted_at":"2025-05-23T09:55:32Z","title":"FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T19:19:42.748573Z"},"links":{"cited_paper":"/paper/2507.22037","citing_paper":"/paper/2505.17685"},"observation_digest":"sha256:23fc7e8dc70a884f2996e27dab3f87ea433e23cfd3ec07311ca340ba3d9efad9","observation_id":"8d013345-ac84-445d-9291-df68f141e629","resolution":{"observed_at":"2026-05-15T19:19:42.866796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"cited_work":{"arxiv_id":"2507.22037","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22037","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f0e6a6b-4040-49bf-8d46-fd8bb6aec5da","year":2025},"citing_paper":{"arxiv_id":"2602.23827","last_updated":"2026-02-27T09:07:47Z","snapshot_observed_at":"2026-07-06T22:47:15.482910Z","submitted_at":"2026-02-27T09:07:47Z","title":"FedNSAM:Consistency of Local and Global Flatness for Federated Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T18:41:54.145958Z"},"links":{"cited_paper":"/paper/2507.22037","citing_paper":"/paper/2602.23827"},"observation_digest":"sha256:687f43ab5a2cd488c730a050e3542b12b41b564daef3fffce88b6e2c4654341a","observation_id":"d7297b50-0c44-499a-8b65-3185c59deaa9","resolution":{"observed_at":"2026-05-15T18:46:29.519770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22037/citation-record","integrity":"/paper/2507.22037/integrity","json":"/paper/2507.22037/citation-record.json","paper":"/paper/2507.22037"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:41.148261Z","title":null,"venue":null,"work_id":"d2c7dac5-4680-4ecc-983f-c3d8efa25b42","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.597452Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:67f899baf172194f9519fc1bbe2415ff5570bbbb3933c5c71bd82b6d7d28f39c","observation_id":"b6a387b5-4de7-4514-8abe-043f34d44487","resolution":{"observed_at":"2026-08-06T12:09:41.153756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10490","last_updated":"2023-10-03T17:03:10Z","snapshot_observed_at":"2026-08-08T22:08:37.768137Z","submitted_at":"2023-07-19T23:03:20Z","title":"Abusing Images and Sounds for Indirect Instruction Injection in Multi-Modal LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10490","snapshot_observed_at":"2026-08-06T12:09:39.603513Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.603513Z"},"links":{"cited_paper":"/paper/2307.10490","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:e5a9b1d7644f21c1503c146c234c36ec2c375e8e2ab5c87c0fb75ceed14537ef","observation_id":"6cd493d6-d804-492f-b72c-8cde5d1c5bb4","resolution":{"observed_at":"2026-08-06T12:09:39.603513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T12:09:39.609477Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.609477Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:087d4cbc2046dc1a267bf73c90a00a0d39122f3cb7ff7f4f126131cdfd9d99c5","observation_id":"28ac7225-4694-4905-93bc-b1e5a7832ad6","resolution":{"observed_at":"2026-08-06T12:09:39.609477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T12:09:39.615039Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.615039Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:06f8fada1dc43db106fae1f3b78a1d44bafd5583624f97622b1055d8705cd9c5","observation_id":"99973d18-38bc-4707-9038-dca444a98dd8","resolution":{"observed_at":"2026-08-06T12:09:39.615039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00236","last_updated":"2024-09-17T19:56:09Z","snapshot_observed_at":"2026-08-06T06:17:45.496933Z","submitted_at":"2023-09-01T03:53:40Z","title":"Image Hijacks: Adversarial Images can Control Generative Models at Runtime","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00236","snapshot_observed_at":"2026-08-06T12:09:39.620116Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.620116Z"},"links":{"cited_paper":"/paper/2309.00236","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:f8ff9d5dd5f905fec332851428761ae687bafc6bd8a14e809c0f956ce26da627","observation_id":"cf046c21-fd53-4e9d-b1c2-edb0f1fd98ce","resolution":{"observed_at":"2026-08-06T12:09:39.620116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:41.132175Z","title":null,"venue":null,"work_id":"008f47e4-3290-46bd-ba42-9b2c6867f8a2","year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.625200Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:e84a2705d5511aeef31a526a4f8b525aa0f1e8b98cc77ba0b982827126cc60e8","observation_id":"9e7c6c50-a605-4ac2-bc77-bee751af0b9d","resolution":{"observed_at":"2026-08-06T12:09:41.137026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-06T19:21:24.933454Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-08-06T12:09:39.630560Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.630560Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:03ed2e95585361765287ad45ad358cf08ba3a05a5d5c3b7dfda460fcb06426da","observation_id":"9cb7fc64-0366-4d19-ab69-4a448b819912","resolution":{"observed_at":"2026-08-06T12:09:39.630560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18086","last_updated":"2025-05-23T16:43:03Z","snapshot_observed_at":"2026-08-08T14:14:59.523600Z","submitted_at":"2025-05-23T16:43:03Z","title":"Stable Reinforcement Learning for Efficient Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18086","snapshot_observed_at":"2026-08-06T12:09:39.636062Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.636062Z"},"links":{"cited_paper":"/paper/2505.18086","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:e7a9d906cb0bd36ccb38a0efba05e0330c5ff88c53d7e1567e8dca62e5d0d7bc","observation_id":"d005cb89-ec4f-4219-824f-e9cb83aa415a","resolution":{"observed_at":"2026-08-06T12:09:39.636062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06260","last_updated":"2025-03-08T16:13:18Z","snapshot_observed_at":"2026-08-07T17:20:03.701881Z","submitted_at":"2025-03-08T16:13:18Z","title":"From Captions to Rewards (CAREVL): Leveraging Large Language Model Experts for Enhanced Reward Modeling in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06260","snapshot_observed_at":"2026-08-06T12:09:39.641313Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.641313Z"},"links":{"cited_paper":"/paper/2503.06260","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:d3c0cc66c342182d5e57d9d83dd929a5c1e9a9b13afd0cadf26ac3ea6f56aadb","observation_id":"5e243766-bc21-46c4-87c2-c5aa4b25eeaa","resolution":{"observed_at":"2026-08-06T12:09:39.641313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07686","last_updated":"2025-05-17T04:01:57Z","snapshot_observed_at":"2026-08-08T14:14:41.258693Z","submitted_at":"2025-05-12T15:50:44Z","title":"S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07686","snapshot_observed_at":"2026-08-06T12:09:39.647034Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.647034Z"},"links":{"cited_paper":"/paper/2505.07686","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:505a10c542f325aee76a16b75ca011b69879b5106fafe7e55dd450f5f9414eee","observation_id":"b3cf5322-1143-45bb-bd91-3e808b9497c9","resolution":{"observed_at":"2026-08-06T12:09:39.647034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:39.652963Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.652963Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:466bbe74c981fad1db58b2e4ee91094a61598b3587c2cae9331708fa4eb764e4","observation_id":"fc3aa545-c58a-4bb2-bbe2-0c73d2aefbce","resolution":{"observed_at":"2026-08-06T12:09:39.652963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:41.113430Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment","venue":null,"work_id":"a7748dc3-9f2f-4043-a97c-9fb51ef9b137","year":null},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.658398Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:c56ee74f11281a96f56485feac2546864efea7dd995ade56d11d50dadc895eb5","observation_id":"048cc48b-0c1b-4b51-9fb7-6c9419701242","resolution":{"observed_at":"2026-08-06T12:09:41.119067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:41.048662Z","title":null,"venue":null,"work_id":"78071f75-24d0-4830-9d95-deb341310794","year":2019},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.663754Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:e61ae7298e91a6fa4056bab2e0887a3e5a6d581f6c4302586b352a7007f75e3a","observation_id":"f1e7b308-af24-4d7f-8919-a8b2486c557c","resolution":{"observed_at":"2026-08-06T12:09:41.088483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05608","last_updated":"2025-01-19T16:23:38Z","snapshot_observed_at":"2026-07-06T16:45:24.070954Z","submitted_at":"2023-11-09T18:59:11Z","title":"FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05608","snapshot_observed_at":"2026-08-06T12:09:39.668500Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.668500Z"},"links":{"cited_paper":"/paper/2311.05608","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:e95ac43f50d1fd355c92ead22f19b5aacefeee18218e42c58973461bb939acea","observation_id":"ebab30ad-0dee-4a65-835b-e9d800498ce6","resolution":{"observed_at":"2026-08-06T12:09:39.668500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T12:09:39.673979Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.673979Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:de9e4b30eeff4e0299eed95d12026ab70ec1c2a253c9a5a7c0c7fc3cc20c1582","observation_id":"f10d8a88-e333-4fd8-8961-6a1941944a2d","resolution":{"observed_at":"2026-08-06T12:09:39.673979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T12:09:39.679845Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.679845Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:ff04721c2a0c62298196817054109221d2c14966ff0bd4c5c63fa43c4432752f","observation_id":"391f5f5b-1241-4237-970e-1f42eb52cbba","resolution":{"observed_at":"2026-08-06T12:09:39.679845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08410","last_updated":"2025-03-06T01:45:26Z","snapshot_observed_at":"2026-08-08T09:32:45.644834Z","submitted_at":"2024-11-13T07:57:19Z","title":"The VLLM Safety Paradox: Dual Ease in Jailbreak Attack and Defense","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08410","snapshot_observed_at":"2026-08-06T12:09:39.684858Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.684858Z"},"links":{"cited_paper":"/paper/2411.08410","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:eacd88ae237bef863d310b34ebddbb2e4d4b99238af922cf9439aa8b63dd4047","observation_id":"9638a436-a417-4c85-8988-bdbaa52ec948","resolution":{"observed_at":"2026-08-06T12:09:39.684858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:41.023750Z","title":null,"venue":null,"work_id":"3bdc9538-5352-494c-9b54-332acb2d86e0","year":2018},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.690601Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:7e37e9a9df9352ca11d69a66fb5f98eebd2f8f86f6e0c9899b014f7253a67814","observation_id":"13b317ec-4fe0-4f64-9e4a-ebec3b24439a","resolution":{"observed_at":"2026-08-06T12:09:41.030510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15180","last_updated":"2024-02-27T01:39:20Z","snapshot_observed_at":"2026-07-06T17:34:28.430476Z","submitted_at":"2024-02-23T08:22:24Z","title":"Break the Breakout: Reinventing LM Defense Against Jailbreak Attacks with Self-Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15180","snapshot_observed_at":"2026-08-06T12:09:39.696496Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.696496Z"},"links":{"cited_paper":"/paper/2402.15180","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:8d6107954113c0732d93ef9767664b19bfd0effbb2951d3796c0a6d4ad743193","observation_id":"b88c5562-03a5-4f26-a6b7-0a5c1f784bd3","resolution":{"observed_at":"2026-08-06T12:09:39.696496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:41.001332Z","title":null,"venue":null,"work_id":"3f3f6d45-93ca-4dea-ba28-fd44d60a3a93","year":2017},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.705807Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:c9cea7c08f96e15b2299734f4d8e00e6153df0206832fc47ce0e2c605fb9af8c","observation_id":"9bd8b1a0-63cb-4b31-8fdb-9d5ce78d9dac","resolution":{"observed_at":"2026-08-06T12:09:41.008162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04387","last_updated":"2023-06-08T13:44:24Z","snapshot_observed_at":"2026-07-06T15:39:41.431581Z","submitted_at":"2023-06-07T12:35:37Z","title":"M$^3$IT: A Large-Scale Dataset towards Multi-Modal Multilingual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04387","snapshot_observed_at":"2026-08-06T12:09:39.711544Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.711544Z"},"links":{"cited_paper":"/paper/2306.04387","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:5fda7be46bda9cb9bd6dbce37409f3846537131ad98a67fc320f049e6fb35c0e","observation_id":"6b470d80-6eba-4783-a5b4-51126b5557e2","resolution":{"observed_at":"2026-08-06T12:09:39.711544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16378","last_updated":"2025-01-24T06:17:22Z","snapshot_observed_at":"2026-07-06T20:27:00.165620Z","submitted_at":"2025-01-24T06:17:22Z","title":"Internal Activation Revision: Safeguarding Vision Language Models Without Parameter Update","version":1},"cited_work":{"arxiv_id":"2501.16378","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.16378","snapshot_observed_at":"2026-08-06T12:09:40.113596Z","title":"Internal Activation Revision: Safeguarding Vision Language Models Without Parameter Update","venue":"cs.LG","work_id":"1c9296fe-6e5e-4ebc-a19d-7e74c38413f5","year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.717587Z"},"links":{"cited_paper":"/paper/2501.16378","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:b38d9651d730571c502adacdcd183cc004643a66b348442c20ea80ce184beed4","observation_id":"1126559f-21f4-4e64-83a8-bb3d8b427c5d","resolution":{"observed_at":"2026-08-06T12:09:40.121101Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.979597Z","title":null,"venue":null,"work_id":"f8cab23e-4867-40a4-9aa3-39fda406fe96","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.722684Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:186048a5adbe19feb2f60cc9192d073b4711a2ed31918641595fadc98f397d70","observation_id":"c1538a54-558f-47c4-a7fa-2b01b5e2b5b2","resolution":{"observed_at":"2026-08-06T12:09:40.984762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07403","last_updated":"2024-07-12T03:58:05Z","snapshot_observed_at":"2026-08-10T04:33:40.668262Z","submitted_at":"2024-07-10T06:57:58Z","title":"A Survey of Attacks on Large Vision-Language Models: Resources, Advances, and Future Trends","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07403","snapshot_observed_at":"2026-08-06T12:09:39.727842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.727842Z"},"links":{"cited_paper":"/paper/2407.07403","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:29a6ada0af093cd9019aad5eb95791abf7521d67be731d339fcd7a701923c800","observation_id":"be887a7a-fa2c-4f19-b28d-02fa7b34b7ba","resolution":{"observed_at":"2026-08-06T12:09:39.727842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.959978Z","title":null,"venue":null,"work_id":"41de4af6-811a-4df5-ac07-72c67fc8aba2","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.733076Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:b94f3737281756844609fe2b8dc062f089639135aaae1330c06ad42beac05f4b","observation_id":"126e21bd-5d1b-4911-a812-ea426c438f20","resolution":{"observed_at":"2026-08-06T12:09:40.965402Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.942568Z","title":null,"venue":null,"work_id":"dcdd8b5b-a641-4dd8-af1a-f58314e0e6cc","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.738380Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:7fdbc316ca966c3ef0f2948e92514a5e7910d8d27e469c99d66b149f1d8d0f74","observation_id":"e5a05617-9a2e-4ffb-aecd-3053e2d2e054","resolution":{"observed_at":"2026-08-06T12:09:40.947573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.924065Z","title":null,"venue":null,"work_id":"1d4cee4d-f8af-4354-b7da-4d6b8014ad50","year":2017},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.744739Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:c8fa4641bd20242e9688f950802d6ef31e630625a1d118d99d8bd6915f174249","observation_id":"311feef7-41c9-4646-bf54-216b3118d6c1","resolution":{"observed_at":"2026-08-06T12:09:40.930144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T12:09:39.750395Z","title":"Goucher, Adam Perelman, Aditya Ramesh, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.750395Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:e32b77dbebcf8937fb1dd7a885d66a9a167c2bc0d5f35844bb1dbc73eae368dd","observation_id":"37fa36d3-ee71-4a32-b575-08e9cd19df3f","resolution":{"observed_at":"2026-08-06T12:09:39.750395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T12:09:39.755271Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.755271Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:fdbe6bf9f7565cbf869b07f71cd5706355afd114de56c04f9f27a1ba97792773","observation_id":"2755a9e9-8c4c-4ce0-a4b3-b13479b940ad","resolution":{"observed_at":"2026-08-06T12:09:39.755271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.905737Z","title":null,"venue":null,"work_id":"be5b944e-0685-438e-8999-ecd52a4b26a9","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.760608Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:475f741b9fcd73415d606b003fb52d05b733872f48e4d260f72a9b2cac1e0341","observation_id":"cc56eb59-3b8a-41f1-af59-ee9a7072c07e","resolution":{"observed_at":"2026-08-06T12:09:40.911616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.882611Z","title":null,"venue":null,"work_id":"320eb7d0-71bc-4b31-af4d-e84aba3f49ed","year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.765597Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:6dad017c2f30616ad43d400b326477a30af6e2f97afd3a1b33fe5327cf0c48d2","observation_id":"984ef29e-3279-49d5-b5f9-5b00d303fbf4","resolution":{"observed_at":"2026-08-06T12:09:40.889233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:39.770560Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.770560Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:259f82ab7e3da1f70c032db706b43d36fc503c965065fde1157ca60ed805ee62","observation_id":"251e2a50-1a99-44ee-886a-2fe366cfdc72","resolution":{"observed_at":"2026-08-06T12:09:39.770560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T12:09:39.776116Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.776116Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:83ec4d6a8a9df6817261e9e72133f24c7d8e425bf7ddbd33d2b2ca6a9e0fe7a4","observation_id":"c694ff11-7da1-4ce3-8281-3d35ba53fd74","resolution":{"observed_at":"2026-08-06T12:09:39.776116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T12:09:39.781262Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.781262Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:dcbe862ec0f3f8810ccd8337b89c95567640c1dad2c21c4dc6f30bebeefc0afb","observation_id":"80dbdf6f-1f6c-4e49-8e18-0adfe99e1857","resolution":{"observed_at":"2026-08-06T12:09:39.781262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.851802Z","title":null,"venue":null,"work_id":"a53ff616-db37-4c9f-94b2-01238a714fbb","year":2022},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.786429Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:d78da9808b747246013aba1bed5cea68a0aa7de1a720e75d4c22d4259f77b00c","observation_id":"66cc0935-f2dc-4ed9-ba1c-8bb7d93b5693","resolution":{"observed_at":"2026-08-06T12:09:40.857328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T12:09:39.791403Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.791403Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:c8b3d6f7f81d7d8dbd0a3c9efbd4bca871d7a6750a24cddccb58f0fa67dd473b","observation_id":"e04d1526-a757-4cf2-96b3-9ff0cce7a794","resolution":{"observed_at":"2026-08-06T12:09:39.791403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.832845Z","title":null,"venue":null,"work_id":"61623ea1-45b7-4627-8e51-1ed5833808c3","year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.796557Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:d6d76b09534f543d5c609f5fbb6f742327ad470bfdaaa15d59fe73546453492f","observation_id":"0e9367bb-eedc-43b2-b839-06ff1e3decf3","resolution":{"observed_at":"2026-08-06T12:09:40.838177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.816084Z","title":null,"venue":null,"work_id":"f51b91bb-ec43-40d9-a681-2d2b9489bd8e","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.801981Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:2ba9538a1bc83e950739afa8608b9975e766b0d4fce41f57b86a7363a56b420c","observation_id":"f2c1a692-2ea9-47bb-935f-a6eb30891e4d","resolution":{"observed_at":"2026-08-06T12:09:40.820861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T12:09:39.806918Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.806918Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:d79bc1a196a775a8e70ec18d1d7a5ce7c065cc3b66bb3feaf5c1dd6b7a851ea6","observation_id":"bb329ee2-e590-48a6-99d7-403b4f066f6c","resolution":{"observed_at":"2026-08-06T12:09:39.806918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-08-06T12:09:39.812263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.812263Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:71b5f0a0b91f1070a8474d83a4173fa1d1615db7809051a3b164688cfbfaea03","observation_id":"84a1fa09-5fac-49a0-9a7c-5d08cfffaf94","resolution":{"observed_at":"2026-08-06T12:09:39.812263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T12:09:39.817694Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.817694Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:8fc68b807ad39707af7917c57a365d38f4f253ef69ee39a4e0b3e0cfa86725cd","observation_id":"55cf5e45-e9f1-4fbe-bd9f-960173eb29ac","resolution":{"observed_at":"2026-08-06T12:09:39.817694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.799077Z","title":null,"venue":null,"work_id":"038c9246-6451-4c34-89ac-a16d882b88a9","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.823538Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:12bbd8f58e54042fbd3af32f430e68ecbe0f4f1afdbbb39b2546595e73e7d289","observation_id":"12053b92-b540-4e4e-b97b-40144ac087cf","resolution":{"observed_at":"2026-08-06T12:09:40.804480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-09T04:25:12.977504Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-06T12:09:39.829280Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.829280Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:e0bbea3e9b36b49b1f8d2919410db4c91abaf4f7972ddd5dee384d8292d146bc","observation_id":"b5d488ce-ff01-4ef7-b4b2-c88ba28494c0","resolution":{"observed_at":"2026-08-06T12:09:39.829280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.779929Z","title":null,"venue":null,"work_id":"22971fdb-851f-4eac-b7d0-acaf5deba48b","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.835388Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:338399ac6011bb70b81098daf2ccc811c78ebb1631f9a7b66c89eeb2b083c6f2","observation_id":"d0455717-5695-4dac-8787-f135138ddec6","resolution":{"observed_at":"2026-08-06T12:09:40.786415Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02813","last_updated":"2025-05-22T08:22:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-04T15:31:26Z","title":"MMMU-Pro: A More Robust Multi-discipline Multimodal Understanding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02813","snapshot_observed_at":"2026-08-06T12:09:39.840201Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.840201Z"},"links":{"cited_paper":"/paper/2409.02813","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:11be51aaf6ae3fb84abdc2867025cd413029188d1474a763883b8ff804abae42","observation_id":"c11f26cd-c1b3-43d3-9d58-d93daf2f6525","resolution":{"observed_at":"2026-08-06T12:09:39.840201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:40.679361Z","title":null,"venue":null,"work_id":"3b713c52-d956-4d8e-a76c-49400bcd1f82","year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.845198Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:39de43b8a7b328c6a5f6be4d9eee2ff3e3f54e07ba9662bdd90d2724bfe0044d","observation_id":"3edfbbd5-0f3c-4ca0-be8e-eab2ae34accd","resolution":{"observed_at":"2026-08-06T12:09:40.730635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-09T09:35:21.862266Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-06T12:09:39.851015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.851015Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:f923d520f458570bd2ace26fa91db2788e6b53d6d9cb01ef74fa28f595bbec38","observation_id":"2429dbe8-2f4d-407a-ba74-8daf01e091ec","resolution":{"observed_at":"2026-08-06T12:09:39.851015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:39.856064Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.856064Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:56645aa2def20908b9daed7f8f2f5f44df285d3f78a00cdb8039a533cdf26423","observation_id":"7d44697c-bb8e-4e2d-88ff-83c29ccf79f8","resolution":{"observed_at":"2026-08-06T12:09:39.856064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:09:39.861497Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:39.861497Z"},"links":{"citing_paper":"/paper/2507.22037"},"observation_digest":"sha256:d822130dad2ee3cb359c807c6d9caf80dd76bf2c559f14cb826d410dea2c8d57","observation_id":"c58aecf4-3907-4913-85f6-7e6402786a58","resolution":{"observed_at":"2026-08-06T12:09:39.861497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22037","last_updated":"2025-07-29T17:39:48Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T21:34:44.464339Z","submitted_at":"2025-07-29T17:39:48Z","title":"Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 2 inbound Pith citation observations for arXiv:2507.22037."}