{"as_of":"2026-08-04T04:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b5a0bac608f71226fc11447b0f51e6b1c691413d69c13100e21027ec94f74d8","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T08:14:51.102085Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T01:55:40.954429Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"cited_work":{"arxiv_id":"2510.10073","doi":"10.48550/arxiv.2510.10073","metadata_source":"pith","pith_arxiv_id":"2510.10073","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","venue":"cs.CR","work_id":"986db19d-142b-480d-af41-4630c3508025","year":2025},"citing_paper":{"arxiv_id":"2605.20874","last_updated":"2026-05-20T08:13:16Z","snapshot_observed_at":"2026-07-06T23:31:23.407780Z","submitted_at":"2026-05-20T08:13:16Z","title":"Governance by Construction for Generalist Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T04:51:41.739358Z"},"links":{"cited_paper":"/paper/2510.10073","citing_paper":"/paper/2605.20874"},"observation_digest":"sha256:5123d68f91699a1c8d7b791c7c22048ca208cd983183692384cf43ff9c41f964","observation_id":"31c63b8b-5014-49e4-82e1-11de251a9e98","resolution":{"observed_at":"2026-05-21T04:53:58.035574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"cited_work":{"arxiv_id":"2510.10073","doi":"10.48550/arxiv.2510.10073","metadata_source":"pith","pith_arxiv_id":"2510.10073","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","venue":"cs.CR","work_id":"986db19d-142b-480d-af41-4630c3508025","year":2025},"citing_paper":{"arxiv_id":"2606.10749","last_updated":"2026-06-09T12:01:07Z","snapshot_observed_at":"2026-07-31T21:35:18.696472Z","submitted_at":"2026-06-09T12:01:07Z","title":"Toward Secure LLM Agents: Threat Surfaces, Attacks, Defenses, and Evaluation","version":1},"reference_index":229,"source":"pdf_text","source_observed_at":"2026-06-27T12:55:22.831264Z"},"links":{"cited_paper":"/paper/2510.10073","citing_paper":"/paper/2606.10749"},"observation_digest":"sha256:638837ace9d79c4a97f8185dc7f48ec551c79ebe7d689b183a8567446993bc2f","observation_id":"6ac96e90-76a3-4bc6-8efa-e35c19c67673","resolution":{"observed_at":"2026-06-27T13:20:56.776294Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"cited_work":{"arxiv_id":"2510.10073","doi":"10.48550/arxiv.2510.10073","metadata_source":"pith","pith_arxiv_id":"2510.10073","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","venue":"cs.CR","work_id":"986db19d-142b-480d-af41-4630c3508025","year":2025},"citing_paper":{"arxiv_id":"2606.30755","last_updated":"2026-06-29T18:00:45Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:00:45Z","title":"Understanding and Evaluating Claw-like Agent Security Through a Computer-Systems Lens","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-01T01:55:40.954429Z"},"links":{"cited_paper":"/paper/2510.10073","citing_paper":"/paper/2606.30755"},"observation_digest":"sha256:dbe3ccef66d6a985aca719f58c934f86eb82cc0cd4d91c8513e93ebb5704859e","observation_id":"6d8fb2c5-780e-4420-8260-0c41ba7fd405","resolution":{"observed_at":"2026-07-01T12:35:44.111703Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.10073/citation-record","integrity":"/paper/2510.10073/integrity","json":"/paper/2510.10073/citation-record.json","paper":"/paper/2510.10073"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.13032","last_updated":"2024-07-17T21:44:28Z","snapshot_observed_at":"2026-08-03T08:33:31.783829Z","submitted_at":"2024-07-17T21:44:28Z","title":"Agent-E: From Autonomous Web Navigation to Foundational Design Principles in Agentic Systems","version":1},"cited_work":{"arxiv_id":"2407.13032","doi":"10.48550/arxiv.2407.13032","metadata_source":"pith","pith_arxiv_id":"2407.13032","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Agent-e: From autonomous web navigation to foundational design principles in agentic systems","venue":"cs.AI","work_id":"0405533c-9300-42d1-89d0-d7d509ce813c","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2407.13032","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:b41abb5f381cc331eb1d9200bdc8e8d7932991e7480e7f68d4445fe393009059","observation_id":"e0a18e55-c0c5-40f1-8ad1-ae993bb191db","resolution":{"observed_at":"2026-05-18T08:16:06.511644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025.Introducing Claude 3.7 Sonnet and Claude Code","venue":null,"work_id":"0e0af953-0bbf-4cf5-95e7-d3126422a8fa","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:9676a04651e39782c216da5d71b9b1d64a7a8a544b8aeb31587be40c000a4594","observation_id":"f0eb1c1c-6867-4888-9daf-9eefbaece77d","resolution":{"observed_at":"2026-05-18T08:16:07.284178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025.Introducing Claude 4","venue":null,"work_id":"414350d5-4a89-47a2-aec4-cdf27f573ffe","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:00eab9967157d6a3641aff4cb84c2d88cb29dd8ca7c73f3772f62ca30a04ea52","observation_id":"c0d4989b-fb17-44ed-b6c6-9b24cd2bc0a5","resolution":{"observed_at":"2026-05-18T08:16:07.287460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:2e72ad5353c51d6fc8c3492f0508f5745ddba8e840a36e89a79507c0c2410567","observation_id":"22155528-09e8-4365-9900-ab2d57b02b0b","resolution":{"observed_at":"2026-05-18T08:16:06.547723Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T12:01:02.711361Z","title":null,"venue":null,"work_id":"5f22bf5e-1912-4fc7-94b4-1f6feaa24693","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:795268818d5c0aed675e294be1cae7248a4d211b7465a391ad0fc8a90b90ae80","observation_id":"7194835e-ddc1-4c81-972a-1c5ac25fbad4","resolution":{"observed_at":"2026-05-18T08:16:07.306553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06474","last_updated":"2024-03-04T04:03:54Z","snapshot_observed_at":"2026-07-06T16:30:25.358715Z","submitted_at":"2023-10-10T09:44:06Z","title":"Multilingual Jailbreak Challenges in Large Language Models","version":3},"cited_work":{"arxiv_id":"2310.06474","doi":"10.48550/arxiv.2310.06474","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06474","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Multilingual jailbreak challenges in large language models","venue":null,"work_id":"97d238ad-7e44-4a09-90f1-ca400f5296e3","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2310.06474","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:288086b7791f62eb84277713c95752544f99309bb09c73a5b2db00fca747886c","observation_id":"4646a28e-20d2-4764-92ef-1bfcc5f2a65c","resolution":{"observed_at":"2026-05-18T08:16:06.485283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:27:30.347033+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:27:30.347033+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08268","last_updated":"2024-04-07T03:04:10Z","snapshot_observed_at":"2026-07-06T16:47:24.765597Z","submitted_at":"2023-11-14T16:02:16Z","title":"A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily","version":4},"cited_work":{"arxiv_id":"2311.08268","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.08268","snapshot_observed_at":"2026-07-04T19:50:11.224071Z","title":"arXiv preprint arXiv:2311.08268 (2023)","venue":null,"work_id":"dc102118-d85b-44e9-87d4-6094b6295e9b","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2311.08268","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:7bc010db986346aaba2ec1ee17f4081a26efecf8ec5b2dd8ce88e62f1e97fbe1","observation_id":"51e16ce5-49cb-4a34-bcd9-45e57c6c16d8","resolution":{"observed_at":"2026-05-18T08:16:06.618493Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18575","last_updated":"2025-05-16T22:42:29Z","snapshot_observed_at":"2026-07-06T21:14:57.707919Z","submitted_at":"2025-04-22T17:51:03Z","title":"WASP: Benchmarking Web Agent Security Against Prompt Injection Attacks","version":3},"cited_work":{"arxiv_id":"2504.18575","doi":"10.48550/arxiv.2504.18575","metadata_source":"pith","pith_arxiv_id":"2504.18575","snapshot_observed_at":"2026-07-10T12:27:04.227834Z","title":"WASP: Benchmarking Web Agent Security Against Prompt Injection Attacks","venue":"cs.CR","work_id":"bf1914b2-fd32-4768-a4d5-84720606d71b","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2504.18575","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:fb3f15c1349fc9a4d3bca1c48dade3e96c0e30ed1ab20c97479fef57566b2b3c","observation_id":"4865609d-72a9-4f23-b11c-1c7318917a19","resolution":{"observed_at":"2026-05-18T08:16:06.607812Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T15:06:19.403728Z","title":null,"venue":null,"work_id":"2a7b770c-928b-4d1e-8da8-b1adbd5cca00","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:b4572be5ddec158d597333e7f42f55fbad0003e584d511784da42eb4efcd166b","observation_id":"1133bec4-a68b-4e08-8d90-44b00ab32d60","resolution":{"observed_at":"2026-05-18T08:16:07.300150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"688e5d52-cbeb-447a-baf5-900cdb2f404b","year":null},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:5f880116b9510cc6773693551686b9aba0d8479811858b237b1d90a65617bab5","observation_id":"689c9b53-07b1-46a8-86ee-fc8666004e6a","resolution":{"observed_at":"2026-05-18T08:16:07.274028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2505.07062","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-07-08T16:15:06.198778Z","title":"Seed1.5-VL Technical Report","venue":"cs.CV","work_id":"0e8e025f-ca1e-49cc-aee2-33f3a0201f3c","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:f41d6b5dc8816688d817f2fba992dbc9fad356e670830d4933becef1598e6c21","observation_id":"c6b6c83a-6dca-4ec9-aed3-b060ce150775","resolution":{"observed_at":"2026-05-18T08:16:06.590003Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ad33445-d234-4335-af32-ed6ac095d255","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:1e473bcee2b8f4aa05d4e0260e0e4ecc14a45ee6f37334e718af35c129c5da52","observation_id":"efc38285-8b7b-4371-9a42-50de42b92105","resolution":{"observed_at":"2026-05-18T08:16:07.293604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:a1255fc5504be698d4833d8bae869397067b2f461377018099ba5b2027114f93","observation_id":"8db74e54-ae78-411b-b2f7-268c27215ade","resolution":{"observed_at":"2026-05-18T08:16:06.633768Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14799","last_updated":"2025-07-20T03:10:13Z","snapshot_observed_at":"2026-07-06T21:59:49.953885Z","submitted_at":"2025-07-20T03:10:13Z","title":"Manipulating LLM Web Agents with Indirect Prompt Injection Attack via HTML Accessibility Tree","version":1},"cited_work":{"arxiv_id":"2507.14799","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14799","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InConference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"8ce63ef2-5ec3-40e0-9326-371c4d950cf6","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2507.14799","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:fc6c1c90f0d4ba2f7d75365089a181d976a5868a22787e0e7869ae3fcf2a7287","observation_id":"293498f0-6418-43ad-baff-096ca6d23ba5","resolution":{"observed_at":"2026-05-18T08:16:06.436235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"466642b8-2fa4-4e58-8160-7d35fc303c7f","year":null},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:97b662885ac5dee106027972ed3c6463738b70abd8e0ce811a33b29065df590d","observation_id":"7ba88fdd-6681-42e8-8355-094cda343b08","resolution":{"observed_at":"2026-05-18T08:16:07.363477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":"2401.13649","doi":"10.48550/arxiv.2401.13649","metadata_source":"pith","pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-07-10T12:27:04.069992Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","venue":"cs.LG","work_id":"37f08c56-1b7d-4d9e-baf9-7c2ebb7e6acd","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:5e6b513fa63b58fdf015d2137751f24a64a3c590bfa448445e8e747c16ddcf5b","observation_id":"f1d339fc-9115-4c24-90e9-1c8225e2607a","resolution":{"observed_at":"2026-05-18T08:16:06.428195Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13886","last_updated":"2024-10-21T18:06:58Z","snapshot_observed_at":"2026-07-06T19:35:30.732080Z","submitted_at":"2024-10-11T06:54:12Z","title":"Refusal-Trained LLMs Are Easily Jailbroken As Browser Agents","version":2},"cited_work":{"arxiv_id":"2410.13886","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.13886","snapshot_observed_at":"2026-07-02T08:06:48.241191Z","title":"Thomas Kuntz, Agatha Duzan, Hao Zhao, Francesco Croce, Zico Kolter, Nicolas Flammarion, and Maksym Andriushchenko","venue":null,"work_id":"cb52e713-1b92-4742-b861-b66f06159bcc","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2410.13886","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:edf05ac1d16e9b469c3b9f3d658177f29eb34d1bd7554f325e83ae16f9d1b0ec","observation_id":"9d841a2f-ec22-4551-9981-9270bd8ee601","resolution":{"observed_at":"2026-05-18T08:16:06.580695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T02:25:56.571234Z","title":null,"venue":null,"work_id":"b4357d27-16da-48ff-9eca-93b1f62ebea3","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:621484444f6d67e8b7d6752eebf4c048a16e01feca9ffcd22d3d0f0a0adb7b32","observation_id":"4d784290-14fd-4719-a7b1-7b1770878510","resolution":{"observed_at":"2026-05-18T08:16:07.281052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:02:29.380409Z","title":null,"venue":null,"work_id":"6990edff-2427-4e08-ae53-1fc8864f37d2","year":null},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:edbab4f8ec8a70ae243110390cc24c0ed9e97b1855f918d4d2236768139907d4","observation_id":"31b9ee17-154a-4d3d-9c42-031cac7de460","resolution":{"observed_at":"2026-05-18T08:16:07.290461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06703","last_updated":"2026-06-04T09:59:28Z","snapshot_observed_at":"2026-07-06T19:30:17.275798Z","submitted_at":"2024-10-09T09:13:38Z","title":"ST-WebAgentBench: A Benchmark for Evaluating Safety and Trustworthiness in Web Agents","version":7},"cited_work":{"arxiv_id":"2410.06703","doi":"10.48550/arxiv.2410.06703","metadata_source":"pith","pith_arxiv_id":"2410.06703","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"St- webagentbench: A benchmark for evaluating safety and trustworthiness in web agents","venue":"cs.AI","work_id":"02dc69db-8db6-48b1-ac24-4004642dfa94","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2410.06703","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:cb6c90dfbe3b5c9caa462bddfc48c738f7070915c7f5019db1e11775b93276d3","observation_id":"0fecf15d-8913-408e-b9b8-42f11205622c","resolution":{"observed_at":"2026-06-05T02:16:16.756993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a30cf340-faaf-49ff-993a-9bc537d86ef7","year":null},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:50b4dada85a2b424c8be8cc0f8c9e3dacac28538412d5d50d912ac37a1b88ee1","observation_id":"4c5910c0-1d17-4c3c-8183-535f17c4a899","resolution":{"observed_at":"2026-05-18T08:16:07.277608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-07-06T16:43:38.787699Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":"2311.03191","doi":"10.48550/arxiv.2311.03191","metadata_source":"pith","pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-07-10T20:57:34.605716Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","venue":"cs.LG","work_id":"5ab14a22-d25d-4d5f-8b1e-f2ff79daf69d","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:a2da79f92d7f15827046b086ca2a4e44616af00b316863dfecbed521b8cb2140","observation_id":"b0a9e03e-7dde-4219-b5d8-0fb026d40871","resolution":{"observed_at":"2026-05-19T10:37:07.279605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7b2d5246-4923-490d-b251-e428f17e2b6a","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:1334c55eb2ab40cb30148247a0d62eefdd9a9e7b75be40b429fee53202ea9c23","observation_id":"61c06b51-de62-4510-bc75-27c1f4eb8973","resolution":{"observed_at":"2026-05-18T08:16:07.359759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d19de0b9-9b72-42fc-93af-aae90ea0f838","year":2020},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:d6bd622254ad4776080809282fceb3b82ff96ea9c39e4544640100e2b6a8d8ca","observation_id":"3aed6e1d-33d3-427c-919a-4c50a752f088","resolution":{"observed_at":"2026-05-18T08:16:07.352835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8b4f4e76-d1c0-42e0-b7b3-94829605723c","year":2019},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:9c48977b7fd934c49a2e16d1776d3f2fabc38c1746f505cddfd1749588a9db5b","observation_id":"fa83084f-1b4c-4a0a-89ca-c0d655fb32e1","resolution":{"observed_at":"2026-05-18T08:16:07.370706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"70197604-7dfb-4dcc-bea0-3bcfae115d2f","year":2021},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:45ff72eff553a2c139e8a4391ad346df96930dcfa2000f5d7a3f7b32e049dc27","observation_id":"0840a47b-79d2-49ce-af44-83ddcce8d49c","resolution":{"observed_at":"2026-05-18T08:16:07.367608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5ed6bedb-79b0-435f-9522-54188da5bc91","year":2020},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:7c9d3e6dac476438fd15aef1b19a5434c70aa7e6e0dd42871473295cd763794f","observation_id":"a50163c8-9355-496d-8880-5f96ee336835","resolution":{"observed_at":"2026-05-18T08:16:07.349637Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.14697","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:49:51.074751Z","title":"Agentsafe: Benchmarking the safety of embodied agents on hazardous instructions","venue":null,"work_id":"80442e4b-93fa-448a-bcb4-e8f3856cadb5","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:a507565b6cc74ca12f934086bb74812b5f0e5528d1eb26d21db403dcde7daffc","observation_id":"1147cac4-f258-464b-b644-e0fe74845168","resolution":{"observed_at":"2026-05-18T08:16:06.467765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"455fe7a1-cc7f-41b3-94e3-176cf7be230d","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:9394573a6f494125ae47293a812b5e0e36098aaead3d66bbeb5940ded244be5d","observation_id":"ebfa97b2-0fd0-48b7-9744-28a2cde8783e","resolution":{"observed_at":"2026-05-18T08:16:07.356392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06350","last_updated":"2026-01-27T23:14:36Z","snapshot_observed_at":"2026-08-02T20:54:19.907427Z","submitted_at":"2025-09-08T05:45:37Z","title":"Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?","version":2},"cited_work":{"arxiv_id":"2509.06350","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.06350","snapshot_observed_at":"2026-07-02T13:26:59.235537Z","title":"Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?","venue":"cs.CL","work_id":"04b40e87-5ec9-4c41-a4c2-d0418b62584c","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2509.06350","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:b40bb27d12d7de0c17b6e4f667bcbd0678c2f077242baca6bde0132cb6fa16d9","observation_id":"f14962bb-d1b9-426c-855d-573156118ba3","resolution":{"observed_at":"2026-05-28T02:04:09.776894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T02:25:56.618778Z","title":null,"venue":null,"work_id":"2d3feb87-a89a-4a3c-ab93-a25c0bbb87ba","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:cb8e93c548f645d2e40b28f585043f003fcb23d13ee505ec3397bc2ae88edfbf","observation_id":"acb3bcfb-07be-437c-9c28-153f74fe47a2","resolution":{"observed_at":"2026-05-18T08:16:07.339301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025.GPT-5 is here","venue":null,"work_id":"44dfa222-f3c4-4980-98de-d15963e6bde3","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:57c7c65ee52cc7ee87ebee1141fd77212b211ff7a008834522f241805b32459d","observation_id":"b642d20a-70ac-4fbf-9bc4-51384f5ce6ae","resolution":{"observed_at":"2026-05-18T08:16:07.373983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":"2501.12326","doi":"10.48550/arxiv.2501.12326","metadata_source":"pith","pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","venue":"cs.AI","work_id":"0bbcf263-a46d-4525-a438-11fce3316568","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:5053d808758ada6db8a8bf7887ed11fc556197f7e60a95ae8b88e8c14246f68e","observation_id":"bbec563b-9567-4cca-b188-2706b71e28f2","resolution":{"observed_at":"2026-05-18T08:16:06.461087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-19T22:22:19.638951+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T22:22:19.638951+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23252","last_updated":"2025-03-08T23:37:49Z","snapshot_observed_at":"2026-07-06T19:42:25.742756Z","submitted_at":"2024-10-30T17:35:44Z","title":"Evaluating Cultural and Social Awareness of LLM Web Agents","version":3},"cited_work":{"arxiv_id":"2410.23252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.23252","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"039cf65d-847d-41fe-a89c-b7e433dc66f6","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2410.23252","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:2474005be635bc6e490f9c53961a5ad36fcff284fe33764a3cdc009228b075e0","observation_id":"43d77cab-d2a2-47a0-a41c-ad07b46c5cbc","resolution":{"observed_at":"2026-05-18T08:16:06.563526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06579","last_updated":"2025-05-10T09:36:28Z","snapshot_observed_at":"2026-07-06T21:21:53.016933Z","submitted_at":"2025-05-10T09:36:28Z","title":"POISONCRAFT: Practical Poisoning of Retrieval-Augmented Generation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.06579","doi":"10.48550/arxiv.2505.06579","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.06579","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":null,"venue":null,"work_id":"70e2fa77-6a2a-4c6a-955a-bedeb72ab911","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2505.06579","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:6df667fc69b96e95717ef909fb010f6d6c996896c9bb8c142137d77a32dd6eed","observation_id":"b646e8c9-9e20-431d-8e89-c81daf40661e","resolution":{"observed_at":"2026-05-18T08:16:06.638234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5e2d06ff-3324-4b0d-862e-7eb0860e6827","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:42a0623b3cb054bbb0d94ad70f60172d93a9b832e73f48257c3c8b767cd781e0","observation_id":"8cbc40e9-8650-4df5-90f7-ff60020b620f","resolution":{"observed_at":"2026-05-18T08:16:07.346386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:14a45483ba2b50eb365cef58497ed2cb5d3a9c6e5fee427fc2e47daf44a63131","observation_id":"7a8a1491-5425-48c8-a5e5-55990f165ecd","resolution":{"observed_at":"2026-05-18T08:16:06.568915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":"2507.01006","doi":"10.48550/arxiv.2507.01006","metadata_source":"pith","pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","venue":"cs.CV","work_id":"366607ba-e4ea-4726-98c3-63356e32351c","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:4f0c942f21de402ace86eb41b74cdf93627da908df187b48c1184164fdabe01d","observation_id":"0800ca9b-3731-44a1-b6c0-1a44082198da","resolution":{"observed_at":"2026-05-18T08:16:06.474138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04957","last_updated":"2025-03-06T20:43:14Z","snapshot_observed_at":"2026-07-06T20:48:13.849680Z","submitted_at":"2025-03-06T20:43:14Z","title":"SafeArena: Evaluating the Safety of Autonomous Web Agents","version":1},"cited_work":{"arxiv_id":"2503.04957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.04957","snapshot_observed_at":"2026-07-04T10:59:46.546058Z","title":"Safearena: Evaluating the safety of autonomous web agents","venue":null,"work_id":"4112362f-3fda-4a14-a761-3d5567824aa9","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2503.04957","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:dd3f7ea3f27e14b567cbe451aa290ddfa541abc38f90567c7902e8c360a7ff8b","observation_id":"afcc938e-df52-434b-83da-44437f126749","resolution":{"observed_at":"2026-05-18T08:16:06.629152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21499","last_updated":"2025-05-27T17:59:05Z","snapshot_observed_at":"2026-08-01T16:55:15.652476Z","submitted_at":"2025-05-27T17:59:05Z","title":"AdInject: Real-World Black-Box Attacks on Web Agents via Advertising Delivery","version":1},"cited_work":{"arxiv_id":"2505.21499","doi":"10.48550/arxiv.2505.21499","metadata_source":"pith","pith_arxiv_id":"2505.21499","snapshot_observed_at":"2026-07-10T18:15:00.821465Z","title":"AdInject: Real-World Black-Box Attacks on Web Agents via Advertising Delivery","venue":"cs.CR","work_id":"926d73c7-2e9a-49ed-9d71-de95de53b62e","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2505.21499","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:7872ce6d516ea239b664eb69438249f3f783bb52f7cde40a766bf2202441112f","observation_id":"bf469bc2-a70c-4199-a2ae-9f541b9cd4d9","resolution":{"observed_at":"2026-05-18T08:16:06.533091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14348","last_updated":"2025-07-27T10:12:52Z","snapshot_observed_at":"2026-07-06T21:11:58.671097Z","submitted_at":"2025-04-19T16:28:03Z","title":"Manipulating Multimodal Agents via Cross-Modal Prompt Injection","version":4},"cited_work":{"arxiv_id":"2504.14348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14348","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Manipulating multimodal agents via cross-modal prompt injection","venue":null,"work_id":"40d42e51-8a2d-406d-84a5-e2059d9282b3","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2504.14348","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:418c84a8a005330f5ca2c5ed7bf31f1ebc11e127d0641fc200fc6028336eb821","observation_id":"17fd2714-c315-4cf1-b6a5-a2de4ea56449","resolution":{"observed_at":"2026-05-18T08:16:06.490295Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-07-11T01:17:42.597062Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:7e0b1318a31f3911d47fa3f9c78bd4adab691535e44f7710669cc4b191e96a91","observation_id":"fc53c0fb-c57a-499e-a02c-2be32b1a5149","resolution":{"observed_at":"2026-05-18T08:16:06.575129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7d49f7af-7b88-4cce-a367-517af231d09e","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:05bd31f0a6a88dd81b3c8c0b555554fa96bca2e67ec40ae3f128bc387a0f65f0","observation_id":"7f31ea17-97b5-46a3-86b8-eee35d902fb8","resolution":{"observed_at":"2026-05-18T08:16:07.313419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T12:02:29.513226Z","title":null,"venue":null,"work_id":"dea70e32-4554-4ae1-a7b9-e3bf50a7c5cf","year":2022},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:fdcc060ea2e208a255a20645477028c6d34c00a748c6860197a2ca69feee9642","observation_id":"0ece1b67-d30a-4906-a6f8-fcb3a432c2ce","resolution":{"observed_at":"2026-05-18T08:16:07.335561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e0584b97-80c6-4570-bd98-c447cefa8096","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:85cc6ee325bc8d95bc782bb61a0b46257aca17e995450f1ca44eb9f7434957a8","observation_id":"8ba4c7c6-d9bd-4502-b2e3-caa586b372fb","resolution":{"observed_at":"2026-05-18T08:16:07.303108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8840ec89-b103-4e7d-9d14-bd54296242e5","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:f5b9b97728130de024f43bb71776257e367c6300cf72fc40bbc7e975d5aaaaf6","observation_id":"76c9c2b3-d6d6-425f-a9a7-cdf537463053","resolution":{"observed_at":"2026-05-18T08:16:07.316469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01243","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T22:39:01.085446Z","title":"arXiv preprint arXiv:2510.01243 , year=","venue":null,"work_id":"ef77178a-67bd-4bcd-bcc4-1a29231071e9","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:a9c93b2e4893a9dcf66c682a924a10f77e2df20ed02100c617d55cd978f81205","observation_id":"59538643-4347-445c-9aba-a0851a2bca8d","resolution":{"observed_at":"2026-05-18T08:16:06.517112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3dba7ba8-2e61-4e04-86f9-02b6af7f068c","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:f79d67293d3257b33a6443b1f9b1db992a3b80d86011f574253443d590e7c4c3","observation_id":"014e0a19-ae6e-4753-9adb-3a49d8d266be","resolution":{"observed_at":"2026-05-18T08:16:07.331836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b295eaad-545e-4e1f-bc52-d4d7f7fda565","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:d37cf81259998aafc2568e6e63913f813c72f0f2452cc812dd94fc2c788be3ca","observation_id":"29352bce-5c4e-498c-9204-1a9abca2322d","resolution":{"observed_at":"2026-05-18T08:16:07.296837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f046750d-6bbe-47c0-9a29-03b0338a177b","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:310bef68695c6acc2e8b674dda18fd844143de96f8f513a98b7be73dbe5a1656","observation_id":"d8178ba8-b2e4-415a-af44-78e1a18d469e","resolution":{"observed_at":"2026-05-18T08:16:07.342958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":"2412.04454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-07-04T10:39:44.899694Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","venue":"cs.CL","work_id":"64030c49-afa6-4cf0-b64c-831d19d6674e","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:d12d078991e64c1724c2c220965f538aed90d8fc7df485a93f007e1d85177a92","observation_id":"be7f25e2-e031-4af3-a856-cf9d225e1f76","resolution":{"observed_at":"2026-05-18T08:16:06.527370Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:27:04.401531Z","title":null,"venue":null,"work_id":"1ffdffea-2da0-453b-819f-1bdb9fabae2c","year":null},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:ba8197fc0136e0ef90764de53cb928debf38408b20753fb1da18a50adbbaf1f0","observation_id":"40a3bbed-8b25-4532-9396-794ccddd8066","resolution":{"observed_at":"2026-05-18T08:16:07.328219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":"2310.11441","doi":"10.48550/arxiv.2310.11441","metadata_source":"pith","pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-07-10T23:17:45.053170Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","venue":"cs.CV","work_id":"ddc8878e-ed0c-4a66-952a-254dce1c622a","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:92435b2cf07cf1ce92d3fe6ff7224b7051e11d8b12b0a3310eac53041a77b09e","observation_id":"bef5bc81-cb43-4fd3-959a-cd83f43683fc","resolution":{"observed_at":"2026-05-18T08:16:06.454998Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T22:31:29.311605Z","title":null,"venue":null,"work_id":"6696e681-2a38-4527-aaa4-09e6b98b9c5f","year":2022},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:ea5081ab4eae95adfaea500312486e638e839f301d4c20006a5f131f5de109d0","observation_id":"b0c64546-9864-46f5-b189-20dedfddc296","resolution":{"observed_at":"2026-05-18T08:16:07.377288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18927","last_updated":"2024-10-24T17:14:40Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-24T17:14:40Z","title":"SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.18927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18927","snapshot_observed_at":"2026-07-04T00:39:16.622704Z","title":"Safebench: A safety evaluation framework for multimodal large language models","venue":null,"work_id":"5e63cd99-dfaf-4489-9790-1200fa28aad1","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2410.18927","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:979047d396148a388ca372465f787f6389b64c483ecd9b556ecbf5a508ba97ea","observation_id":"a715de99-dcb7-4650-b1d3-304988d2e1c3","resolution":{"observed_at":"2026-05-18T08:16:06.542069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06302","last_updated":"2024-07-03T00:51:21Z","snapshot_observed_at":"2026-07-06T18:28:07.721412Z","submitted_at":"2024-06-10T14:18:56Z","title":"Unveiling the Safety of GPT-4o: An Empirical Study using Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":"2406.06302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06302","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unveiling the Safety of GPT- 4o: an Empirical Study Using Jailbreak Attacks","venue":null,"work_id":"5434a6fc-8663-49b6-bb28-c359f325ee0b","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2406.06302","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:6b0e86b890a448c468d4bb1e2a491a8d507532f601921787b3700ccd9c18dd48","observation_id":"5e648ac5-8fc9-427f-8d54-fc82f990cf13","resolution":{"observed_at":"2026-05-18T08:16:06.495604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5d1bb8a9-e81b-4c8e-9084-770a3a2e854c","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:e7524038ad02d419acb4757fdf2e26caa190feae06125527b8858131e5ab4bfa","observation_id":"94db8459-1487-4ca1-a188-659b4b450c59","resolution":{"observed_at":"2026-05-18T08:16:07.310100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12430","last_updated":"2025-07-11T02:01:54Z","snapshot_observed_at":"2026-07-06T21:42:11.779021Z","submitted_at":"2025-06-14T10:03:17Z","title":"Pushing the Limits of Safety: A Technical Report on the ATLAS Challenge 2025","version":2},"cited_work":{"arxiv_id":"2506.12430","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12430","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.12430 (2025)","venue":null,"work_id":"c14725ba-ce02-4621-89e6-c60f13e4f27a","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2506.12430","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:7a628e4ca11831a6472117492c765bd4855986038cbbf1d8c6687bf2043fe7f0","observation_id":"5db08660-b4bb-4fc9-ac48-6ec409bfe460","resolution":{"observed_at":"2026-05-18T08:16:06.521830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11054","last_updated":"2025-03-11T03:06:17Z","snapshot_observed_at":"2026-07-06T20:37:18.647879Z","submitted_at":"2025-02-16T09:27:44Z","title":"Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models","version":4},"cited_work":{"arxiv_id":"2502.11054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.11054","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning- augmented conversation for multi-turn jailbreak attacks on large language models.arXiv preprint arXiv:2502.11054","venue":null,"work_id":"372055a2-ecb0-4d87-b2bc-3043018bb20a","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2502.11054","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:b0d3bda46d3e51d5b13cdcd6236be75eb5cb82036d7ba54219798621d78c1308","observation_id":"0ae7e906-c352-40a3-8435-e4336dc3f1f2","resolution":{"observed_at":"2026-05-18T08:16:06.448868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15092","last_updated":"2025-03-19T10:44:37Z","snapshot_observed_at":"2026-08-03T20:15:51.813763Z","submitted_at":"2025-03-19T10:44:37Z","title":"Towards Understanding the Safety Boundaries of DeepSeek Models: Evaluation and Findings","version":1},"cited_work":{"arxiv_id":"2503.15092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.15092","snapshot_observed_at":"2026-06-30T13:54:44.180777Z","title":"arXiv preprint arXiv:2503.15092 (2025)","venue":null,"work_id":"47af23b4-4e58-481b-9362-2e859d026df0","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2503.15092","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:02b088ef145cf4b47c78e2222de799bb5165fa03bd1c0b3a5f2e8a6eb36db05c","observation_id":"c3772ce9-a11c-4602-969f-2c4648a84159","resolution":{"observed_at":"2026-05-18T08:16:06.596203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14729","last_updated":"2025-04-03T23:03:17Z","snapshot_observed_at":"2026-07-06T19:20:14.980387Z","submitted_at":"2024-09-23T06:08:32Z","title":"PROMPTFUZZ: Harnessing Fuzzing Techniques for Robust Testing of Prompt Injection in LLMs","version":2},"cited_work":{"arxiv_id":"2409.14729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.14729","snapshot_observed_at":"2026-07-04T04:19:34.768622Z","title":"Promptfuzz: Harnessing fuzzing techniques for robust testing of prompt injection in llms","venue":null,"work_id":"85878444-8224-4133-ba80-203f2727c9e6","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2409.14729","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:0509544c92f4127a001e2880e85e70ed39d06e062502ca7329aadf0410daea63","observation_id":"15bcc2ec-6a2a-489a-8f87-3d5517cd4031","resolution":{"observed_at":"2026-05-18T08:16:06.642846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":"2308.06463","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-07-09T10:26:11.073540Z","title":"Gpt- 4 is too smart to be safe: Stealthy chat with llms via cipher","venue":"cs.CL","work_id":"c0bea3ab-35ce-4045-8b4f-46d34943d688","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:c376c71b82fc223a7cc19c4834c2bea211ad77ebe59d80afedbf5f2fdc757576","observation_id":"c59c361b-10ba-4e26-8941-72637653d8ee","resolution":{"observed_at":"2026-05-18T08:16:06.624171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-07-11T01:07:44.097694Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:e56281a20773e3a0e85cb32156e76f2932a95f6550a378df6843d9c0204e53d3","observation_id":"1d11b200-8d8d-4366-bd12-dc6de861d631","resolution":{"observed_at":"2026-05-18T08:16:06.442597Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ecf52af4-c4ce-4e09-9a84-8bb0201d8d1c","year":null},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:dd3174cbdd5d44e99226cd36c444c0fcf49863f24022aac1faa71e7e80559c26","observation_id":"4c70b9c4-7d0e-4ad5-9835-fb595dc778fb","resolution":{"observed_at":"2026-05-18T08:16:07.323971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":"dedef6b0-0d19-4e6f-8781-6503361a87ad","year":null},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:a87a6e46ead46f5d8ac9aa4a7b656b6e43956b1eb52cdd1b48ce528036eb73de","observation_id":"4940c25b-6c10-484d-b6dc-cb339f63a28b","resolution":{"observed_at":"2026-05-18T08:16:07.320027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02391","last_updated":"2025-05-24T16:15:46Z","snapshot_observed_at":"2026-07-06T19:45:00.034364Z","submitted_at":"2024-11-04T18:56:42Z","title":"Attacking Vision-Language Computer Agents via Pop-ups","version":2},"cited_work":{"arxiv_id":"2411.02391","doi":"10.48550/arxiv.2411.02391","metadata_source":"pith","pith_arxiv_id":"2411.02391","snapshot_observed_at":"2026-07-10T12:27:04.205040Z","title":"Attacking vision- language computer agents via pop-ups","venue":"cs.CL","work_id":"74121ae8-d170-456a-86e7-6590edee179a","year":2024},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2411.02391","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:a1d236a42d96c2f43a9f5a1d5b30a217dbd1b66cbe469e5b37ce162866f37002","observation_id":"5dacde04-0c77-4eb8-926a-8fb450e972c5","resolution":{"observed_at":"2026-05-18T08:16:06.585253Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-07-06T15:58:31.756298Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-07-10T14:17:10.112759Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:4702cda7aa7d1f22dd5e469a3467167ecbb0236b1cf8433f116b5e2cc0195287","observation_id":"c93aed80-7fb8-4342-a16d-6f9f36f266ca","resolution":{"observed_at":"2026-05-18T08:16:06.500670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-07-11T02:47:49.837877Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:1ff5a949314af78fff2b77ca60ee2a30d6785542f046a77634b39892e2ce4904","observation_id":"9de241ee-70ca-4aa3-bdfd-52619877cbd7","resolution":{"observed_at":"2026-05-18T08:16:06.612720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21540","last_updated":"2026-04-08T13:05:48Z","snapshot_observed_at":"2026-07-06T22:04:26.078628Z","submitted_at":"2025-07-29T07:13:56Z","title":"PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking","version":3},"cited_work":{"arxiv_id":"2507.21540","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.21540","snapshot_observed_at":"2026-07-01T14:45:49.588593Z","title":"PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking","venue":"cs.CR","work_id":"837dd9bb-3217-454f-8e4f-67539b0eac70","year":2025},"citing_paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-18T08:14:51.102085Z"},"links":{"cited_paper":"/paper/2507.21540","citing_paper":"/paper/2510.10073"},"observation_digest":"sha256:9deec9db812ae893a5602c3232824fdef511de4c80be2ed3149f6ad9910476e1","observation_id":"00769ba5-9cde-4e9e-8f28-bdb73b424cbb","resolution":{"observed_at":"2026-05-18T08:16:06.505883Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.10073","last_updated":"2026-04-14T02:53:37Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T07:18:12Z","title":"SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":27,"verified_exact":36,"verified_fuzzy":4},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 3 inbound Pith citation observations for arXiv:2510.10073."}