{"as_of":"2026-08-20T18:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ea38282a3948f37d35aba4f7f0b8bd4b057f3af92e39e25d018393e8f3d616d","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T05:16:19.502837Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.25034/citation-record","integrity":"/paper/2606.25034/integrity","json":"/paper/2606.25034/citation-record.json","paper":"/paper/2606.25034"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":"2308.12966","doi":"10.48550/arxiv.2308.12966","metadata_source":"pith","pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","venue":"cs.CV","work_id":"cbc2bb21-b6bb-46c0-80bf-107e195ffe10","year":2023},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:5d8412dfae37b0dd3dd3d0b343e81ef06611ce1312393016897db23a8054893b","observation_id":"5535eb30-fd92-4d92-9e9d-67ddf5ab3baf","resolution":{"observed_at":"2026-06-29T18:03:48.783695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:78c7c49b50b472c39e8e8875997a19f71c386ec90cbfd033f17fd59571988e6a","observation_id":"f269cfe5-6dd4-452e-afc3-d02751f2591c","resolution":{"observed_at":"2026-06-29T18:03:48.786286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14238","last_updated":"2024-01-15T15:23:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-21T18:59:31Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","version":3},"cited_work":{"arxiv_id":"2312.14238","doi":"10.48550/arxiv.2312.14238","metadata_source":"pith","pith_arxiv_id":"2312.14238","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","venue":"cs.CV","work_id":"d9e035c7-9e23-4cc2-ad3e-be080fbbf2d9","year":2023},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2312.14238","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:f1c0477d16157321e439d5fc0334911bd8a549c403e8d0e42b234ebf3f6b3e68","observation_id":"64be884f-ec5a-4b0a-9c7a-3d4b03edbc91","resolution":{"observed_at":"2026-06-29T18:03:48.781229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-17T21:40:47.016297Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:3011e50273ea9cd386a67f59d8556ff2b6066b252a83cac2a5410fbb298a901c","observation_id":"ff2f73ca-308d-418c-ae66-c60c96ede16f","resolution":{"observed_at":"2026-06-29T18:03:48.788821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T05:16:19.502837Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:8e5a2fdaf2fdd8dbbe076b1f6b8dccf722af062b2de35093dc050cce4d4bb112","observation_id":"e35b5f86-0097-485f-ba45-6b3f12f874fc","resolution":{"observed_at":"2026-06-29T05:16:19.502837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:fc273c2cd9c721fc1c933f6de6ccbd84810282d64d3f3333623a9ef9d61e6441","observation_id":"58984c90-434e-4a8d-a1bc-edcf8c63c544","resolution":{"observed_at":"2026-06-29T18:03:48.790968Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02943","last_updated":"2026-08-12T08:42:34Z","snapshot_observed_at":"2026-08-17T01:58:57.242859Z","submitted_at":"2026-03-03T12:50:26Z","title":"TC-Pad\\'e: Trajectory-Consistent Pad\\'e Approximation for Diffusion Acceleration","version":2},"cited_work":{"arxiv_id":"2603.02943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.02943","snapshot_observed_at":"2026-08-13T02:21:57.332722Z","title":"TC-Pad ´e: Trajectory- consistent Pad´e approximation for diffusion acceleration","venue":null,"work_id":"c408eee1-1bd1-4148-9937-6dd9d272f773","year":2026},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2603.02943","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:db1e7a556340048c86d22d42670a05650168ecab2f91bbb4daebf2452bb6676e","observation_id":"cfb054f1-aded-4a4b-b073-ff88d4e1422f","resolution":{"observed_at":"2026-08-13T02:21:57.332722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05993","last_updated":"2024-09-11T14:42:29Z","snapshot_observed_at":"2026-08-17T18:25:58.914494Z","submitted_at":"2024-04-09T03:54:28Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","version":2},"cited_work":{"arxiv_id":"2404.05993","doi":"10.48550/arxiv.2404.05993","metadata_source":"pith","pith_arxiv_id":"2404.05993","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","venue":"cs.LG","work_id":"1ccd11c8-18f7-4764-989f-140f3f59c730","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2404.05993","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:d180a42b59fc4289a1fa10c1b8578e31493880dd11626ead4d6ab3a3e121ffcd","observation_id":"c98e7043-5b28-4831-809f-a3f1306651e1","resolution":{"observed_at":"2026-06-29T18:03:48.828247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18495","last_updated":"2024-12-09T20:21:56Z","snapshot_observed_at":"2026-08-12T20:12:20.465098Z","submitted_at":"2024-06-26T16:58:20Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","version":3},"cited_work":{"arxiv_id":"2406.18495","doi":"10.48550/arxiv.2406.18495","metadata_source":"pith","pith_arxiv_id":"2406.18495","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","venue":"cs.CL","work_id":"3aa75d7c-4d7b-4965-af9b-aeeea4f78fa1","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2406.18495","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:6748c4b86b9db4393648a45985c30a1424499658e398a7d126aa38ebde92f45b","observation_id":"07667cd3-ac62-4caf-8395-b15867cd85d0","resolution":{"observed_at":"2026-06-29T18:03:48.820968Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05113","last_updated":"2025-06-06T17:08:12Z","snapshot_observed_at":"2026-08-18T12:58:14.839534Z","submitted_at":"2024-06-07T17:44:32Z","title":"LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models","version":3},"cited_work":{"arxiv_id":"2406.05113","doi":"10.48550/arxiv.2406.05113","metadata_source":"pith","pith_arxiv_id":"2406.05113","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llavaguard: An open vlm-based framework for safeguarding vision datasets and models","venue":"cs.CV","work_id":"6428946a-91bd-4dbe-b263-a8f502ab8aa0","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2406.05113","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:5d727b5db1f6ecb95887cbab700cd93bb577592c0e0df4fe45a261554c75208d","observation_id":"c4626475-3061-44a2-be95-e437be42728d","resolution":{"observed_at":"2026-06-29T18:03:48.823348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-07-11T06:49:11.689996+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T06:49:11.689996+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-16T02:03:48.252223Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.06749","doi":"10.48550/arxiv.2503.06749","metadata_source":"pith","pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","venue":"cs.CV","work_id":"38998646-34ee-4605-b661-ab356f16d6e5","year":2025},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:38ace41afbac0afda3af89a316baf790d15937587122b58bfbf1fa3b7c5ee45d","observation_id":"1a64f864-c1d2-4912-82eb-74e62292c9a2","resolution":{"observed_at":"2026-06-29T18:03:48.816601Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:7d40271365f94d88303940751f8ffffa14a034b935db4fe63fdc6a8f09195061","observation_id":"8caad829-8999-4e4d-88ed-4ed6d33807f7","resolution":{"observed_at":"2026-06-29T18:03:48.812336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-08-18T11:56:50.710310Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:620245f5a4990cc76ca52cd9bdd6131916bb992cd498e3fba22c257cbbf96170","observation_id":"211d3441-b333-4083-bd26-ee40185e34fe","resolution":{"observed_at":"2026-06-29T18:03:48.814433Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2307.16125","doi":"10.48550/arxiv.2307.16125","metadata_source":"pith","pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","venue":"cs.CL","work_id":"23881ff0-b851-474c-8712-90744cc07a3a","year":2023},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:d9b4ab80a25f6520ca45788f904910a85e2d8f95f30040137da08fcf17056e32","observation_id":"7f2b7ae0-4874-4cdb-8b04-013fec8446b6","resolution":{"observed_at":"2026-06-29T18:03:48.818729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15588","last_updated":"2026-07-02T12:42:02Z","snapshot_observed_at":"2026-08-20T01:20:00.990559Z","submitted_at":"2026-01-22T02:23:18Z","title":"YuFeng-XGuard: A Reasoning-Centric, Interpretable, and Flexible Guardrail Model for Large Language Models","version":2},"cited_work":{"arxiv_id":"2601.15588","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15588","snapshot_observed_at":"2026-07-04T16:59:58.634519Z","title":"Yufeng-xguard: A reasoning-centric, interpretable, and flexible guardrail model for large language models","venue":"cs.CL","work_id":"f2853a9b-ad83-4742-8b29-5d579028cdd7","year":2026},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2601.15588","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:e501789a759dd823e48072deb5b4d40fae51d7cb01a66b0621dbbb3c09f30c23","observation_id":"92d41ff4-d9b7-40e6-a978-c43f4247095e","resolution":{"observed_at":"2026-07-03T02:17:08.913996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T05:16:19.502837Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:2b15582000f24a613b3049372d62f41cfd9ffb8180485b403bd179b6509746fe","observation_id":"653f0583-a1db-498b-b6be-f940b5371c6e","resolution":{"observed_at":"2026-06-29T05:16:19.502837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":"2403.05530","doi":"10.48550/arxiv.2403.05530","metadata_source":"pith","pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":"cs.CL","work_id":"80e3e977-f1bb-4c83-8d0c-1ab0a0c5c3f1","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:cb6618a04e964555c1dcb2b197c1b9b8b8a8a29c4f0b21eadc785f29b2e2d468","observation_id":"a864ebc9-434b-4257-ab03-b259bac9b288","resolution":{"observed_at":"2026-06-29T18:03:48.830582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:14.426583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:14.426583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:2a5cf229c516e14362d42815dc5edc06149186f029909d6effcd2fd18622e49c","observation_id":"1ee1079c-6218-4eff-ab7d-073a82206de2","resolution":{"observed_at":"2026-06-29T18:03:48.810140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:c2b927f1603a056f275d5eadafb9b73e69f7986376acd92a3c4d3021f6c94891","observation_id":"1fa908af-4c95-4e14-9d53-3b66b2f0ad30","resolution":{"observed_at":"2026-06-29T18:03:48.805518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-15T14:08:11.914281+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T14:08:11.914281+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00676","last_updated":"2025-08-31T03:08:02Z","snapshot_observed_at":"2026-08-14T04:31:24.300394Z","submitted_at":"2025-08-31T03:08:02Z","title":"LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model","version":1},"cited_work":{"arxiv_id":"2509.00676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00676","snapshot_observed_at":"2026-07-04T16:59:58.567326Z","title":"Llava-critic-r1: Your critic model is secretly a strong policy model.arXiv preprint arXiv:2509.00676, 2025b","venue":null,"work_id":"6c2a84a9-640c-49ee-8a84-ff2131bcdaaa","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2509.00676","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:85e7f637200c459947d0a42a677989024f1fca43c0c62b6688cc7995ed7debe8","observation_id":"15ec6608-c26e-403a-8397-d6582a6b4fc3","resolution":{"observed_at":"2026-06-29T18:03:48.808047Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17654","last_updated":"2026-05-27T08:26:10Z","snapshot_observed_at":"2026-08-16T11:02:16.928461Z","submitted_at":"2025-05-23T09:18:01Z","title":"EVADE-Bench: Multimodal Benchmark for Evaluating and Enhancing Evasive Content Detection","version":4},"cited_work":{"arxiv_id":"2505.17654","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17654","snapshot_observed_at":"2026-07-04T16:59:58.563568Z","title":"EVADE-Bench: Multimodal Benchmark for Evaluating and Enhancing Evasive Content Detection","venue":"cs.CL","work_id":"ef431647-549c-49fd-91af-e287d983cd96","year":2025},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2505.17654","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:c82d48a079bb62908548f33874c0d1ff25d7899ffa3fc825dbc6646cdff9ae51","observation_id":"abdb6a5d-f1e4-4073-b346-814ef0813a55","resolution":{"observed_at":"2026-06-29T18:03:48.797548Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-15T17:00:20.282987Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":"2411.10440","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-07-04T16:59:58.575310Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","venue":"cs.CV","work_id":"a650e873-dbbf-4963-af68-3896dcd4975b","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:642cf357a302147022b6b9b4d70074bb43e002350d3c1f8bbe476049061d116e","observation_id":"d90736b3-765c-44c2-96f8-01cde283308e","resolution":{"observed_at":"2026-06-29T18:03:48.799673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08541","last_updated":"2026-04-09T17:59:44Z","snapshot_observed_at":"2026-08-11T07:19:48.366136Z","submitted_at":"2026-04-09T17:59:44Z","title":"Seeing but Not Thinking: Routing Distraction in Multimodal Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2604.08541","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08541","snapshot_observed_at":"2026-07-04T16:59:58.582454Z","title":"Seeing but Not Thinking: Routing Distraction in Multimodal Mixture-of-Experts","venue":"cs.CV","work_id":"a8c6fabe-7b10-4cb0-a4fb-f50591b45ab4","year":2026},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2604.08541","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:77f402b84d7ff78e69758a891a5b6367244d85c87ad5463d503c6d378a0280c5","observation_id":"43694509-bb3c-428c-9478-2ddd6a356032","resolution":{"observed_at":"2026-06-29T18:03:48.833168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23573","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:59:58.589208Z","title":"ProGuard: Towards proactive multimodal safeguard.arXiv preprint arXiv:2512.23573,","venue":null,"work_id":"327ee21f-0146-45b1-93c8-e8ea172aef71","year":null},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:0f25b1e7685ac49f2112ea70bb3ec2324225539376183bc26661c51993f311b1","observation_id":"80bd17c4-3e67-4305-beef-65da6c25520e","resolution":{"observed_at":"2026-06-29T18:03:48.802334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-08-19T02:59:43.798238Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":"2407.21772","doi":"10.48550/arxiv.2407.21772","metadata_source":"pith","pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","venue":"cs.CL","work_id":"6d0d9d39-490d-48d5-b346-6bfe40b8b8fb","year":2024},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:51fc5f7dce5b837526fdcac823be4a5b4b5b065904f42888858105c0af41d858","observation_id":"127bd59c-1ac6-4622-a5cd-790c30a96308","resolution":{"observed_at":"2026-06-29T18:03:48.795335Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-13T01:30:54.104133Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":"2503.12937","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-07-10T05:16:48.080500Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","venue":"cs.AI","work_id":"e1614961-16d2-43bc-908a-8c57da5b151c","year":2025},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:1e9baae599c60787dc3fecdc20f5250d649ce3a5a5d0355b8605ac6a5a904820","observation_id":"080c990a-42c8-47a2-95be-20ac12b19c76","resolution":{"observed_at":"2026-06-29T18:03:48.793195Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T05:16:19.502837Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:de3903939f84d8467298669b2530049798406751e3dbe041b3a44bbb9c022a0a","observation_id":"e45e8d86-b8c3-4e35-b41e-f9050e3ba7ec","resolution":{"observed_at":"2026-06-29T05:16:19.502837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T05:16:19.502837Z","title":"• Text Chinese language understanding.:C3(Sun et al., 2020),CLUEWSC(Xu et al., 2020), andXiezhi- CNfor Chinese knowledge understanding, and commonsense reasoning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:a3cb6fb7d78a1dbf1668950f9576bfa4fb33e8b57f39ba728c1a40bbfdda0512","observation_id":"56bbfb63-7ca2-4ed5-bcda-dcb5795cc8e7","resolution":{"observed_at":"2026-06-29T05:16:19.502837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T05:16:19.502837Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:19.502837Z"},"links":{"citing_paper":"/paper/2606.25034"},"observation_digest":"sha256:d5c5809cf5baf07ae59ef2a23d0b6db95966fcab165fa595b755c33d533c1ab2","observation_id":"78a865ec-fd81-4106-9088-cc46c7ed141c","resolution":{"observed_at":"2026-06-29T05:16:19.502837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.25034","last_updated":"2026-06-26T07:24:58Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T01:07:51.075130Z","submitted_at":"2026-06-23T18:00:08Z","title":"Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":24,"verified_fuzzy":0},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2606.25034."}