{"as_of":"2026-08-21T21:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:330a765004629a3435e900d99c70228b89ce9adab6186b56a0bd7525de6f58e5","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:10:23.129223Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:36:30.807712Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"cited_work":{"arxiv_id":"2505.05318","doi":"10.48550/arxiv.2505.05318","metadata_source":"pith","pith_arxiv_id":"2505.05318","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","venue":"cs.CV","work_id":"05385dbe-eb74-4ae0-9f73-6a9846e1769d","year":2025},"citing_paper":{"arxiv_id":"2507.13041","last_updated":"2025-07-17T12:10:34Z","snapshot_observed_at":"2026-08-19T17:25:15.865459Z","submitted_at":"2025-07-17T12:10:34Z","title":"What Can Robots Teach Us About Trust and Reliance? An interdisciplinary dialogue between Social Sciences and Social Robotics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:36:30.807712Z"},"links":{"cited_paper":"/paper/2505.05318","citing_paper":"/paper/2507.13041"},"observation_digest":"sha256:757cca19237594f772fc46d01e9c0b58d31bdd2cc7bd5473b2ad10146f8f86cc","observation_id":"f8a95d83-5438-447a-9a55-749d0dc0e551","resolution":{"observed_at":"2026-08-06T16:36:30.980083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05318/citation-record","integrity":"/paper/2505.05318/integrity","json":"/paper/2505.05318/citation-record.json","paper":"/paper/2505.05318"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.633255Z","title":null,"venue":null,"work_id":"c94937c0-8f2f-4ae5-b646-651f5f5f3192","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.657329Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:5a398c15e67d25659c4ca84c06aa58bcb95e33d7a543646ca48adc3a3f308648","observation_id":"e37422af-b564-4021-ba60-9480e1dc99a7","resolution":{"observed_at":"2026-08-15T23:10:24.638303Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.722647Z","title":"Calegari, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.722647Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1182475ac39161d8f0d3243db7a1c247b3db57006f57d34bfad343235f236a74","observation_id":"d81ce492-92db-4eae-b67d-a63c97f75da5","resolution":{"observed_at":"2026-08-15T23:10:22.722647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.777932Z","title":"Chander, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.777932Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:eea2b4e6a66ac151c1822ffbf0f51eec9935e12a3aad1d2b02373bb9177b0a32","observation_id":"39839f80-9d1c-4e57-b41d-ec2397f521c0","resolution":{"observed_at":"2026-08-15T23:10:22.777932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.618399Z","title":null,"venue":null,"work_id":"ed66ece6-28e0-405c-8e2f-a8bb8ddcc181","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.803665Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:a326bc815dfde31335f0eb620b8e37d29408b2b014d911dddf3bda8dc6726146","observation_id":"9c71d3b2-7e5a-4fe0-b7bb-a93def2b0217","resolution":{"observed_at":"2026-08-15T23:10:24.623282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.603278Z","title":null,"venue":null,"work_id":"086ac7b0-0402-45a7-a016-db035e265bf6","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.812832Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e4f63a1ee0bc07a5d9d3a91cd712fb3e8027388f91d97e5dca3607e59842d74a","observation_id":"1a6efc6e-e91f-45b9-ac11-0837289fd60d","resolution":{"observed_at":"2026-08-15T23:10:24.608026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.587465Z","title":"Chen, D.-Z","venue":null,"work_id":"a061d66d-0954-47b9-b94a-656e9e4b46f8","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.817570Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:013d250e839f2d0d800d782339d722ec7e3349d19e357f817df4a4b9bc0077c9","observation_id":"918119e2-5c6a-4421-a26a-77d4907347bb","resolution":{"observed_at":"2026-08-15T23:10:24.592497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19392","last_updated":"2024-07-02T15:30:03Z","snapshot_observed_at":"2026-08-18T12:56:36.980908Z","submitted_at":"2024-06-27T17:59:45Z","title":"ReXTime: A Benchmark Suite for Reasoning-Across-Time in Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19392","snapshot_observed_at":"2026-08-15T23:10:22.822575Z","title":"Chen, Y .-C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.822575Z"},"links":{"cited_paper":"/paper/2406.19392","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:ac50d63bca4d39671c99c036806846ef86f8d3bd66ae4690eb197caaf83046fb","observation_id":"69e432b5-9dc4-4b40-9d75-ad6c6408dd23","resolution":{"observed_at":"2026-08-15T23:10:22.822575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.572202Z","title":null,"venue":null,"work_id":"dacbaa12-68b2-40b0-888f-05f28d06ce42","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.828352Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:b9bd51f76bb03e76a921dd95e875889b5d4950ad4a5500504f3e17d773a133a8","observation_id":"6c2d1bf2-4903-4f55-b9d7-1c2cae76530c","resolution":{"observed_at":"2026-08-15T23:10:24.576864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.556738Z","title":"Cheng, H","venue":null,"work_id":"a0188840-f1e1-48a7-a1f7-5aefe13c7bb9","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.834655Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:57a7b192a38df101f5603c13865f4e27180317282fc263ccc4eda9de459ff028","observation_id":"3d09b69a-39d6-43d7-b4e5-a1062b7b2a20","resolution":{"observed_at":"2026-08-15T23:10:24.561302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.541930Z","title":null,"venue":null,"work_id":"7b52327a-cfad-45f6-8721-ec5bf51a388d","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.839818Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:110827691485533253231644af67ed211cd9ca450103af79a0986388e2a500a2","observation_id":"76744e26-9771-4ae2-8919-1f0777ddb6c7","resolution":{"observed_at":"2026-08-15T23:10:24.546536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.527420Z","title":"Commission","venue":null,"work_id":"637f136e-5c86-4d00-a19f-6fd19c4def51","year":2019},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.844759Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:8c8e5db56cfe930ba2b3b91c75d4c8ad434f86900f4b4ffa4fce6e01808aab07","observation_id":"2550e940-43ac-4906-85dc-d43103f0b52c","resolution":{"observed_at":"2026-08-15T23:10:24.531896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.511688Z","title":"Commission","venue":null,"work_id":"eaebab76-94a7-4fd7-8704-403c1377790a","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.849952Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:f47b294a95c8baa06542c7adda8f30e97e6e94aab9dd9ab21320c9493ce57648","observation_id":"8844ff78-777c-4b55-a5bf-5fa40c257c34","resolution":{"observed_at":"2026-08-15T23:10:24.517258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.496568Z","title":null,"venue":null,"work_id":"d05feb06-ddcd-4651-9d42-d8d2a6b663ad","year":null},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.855209Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:cc354346b6f08fbd641d933f85497a546de335aba78e9e543f22b776a33cebd0","observation_id":"5134c927-b37d-462f-b0e2-c24c466c23ea","resolution":{"observed_at":"2026-08-15T23:10:24.501280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01433","last_updated":"2024-07-18T20:58:03Z","snapshot_observed_at":"2026-08-16T13:32:54.528832Z","submitted_at":"2024-07-18T20:58:03Z","title":"Evaluating and Enhancing Trustworthiness of LLMs in Perception Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01433","snapshot_observed_at":"2026-08-15T23:10:22.865169Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.865169Z"},"links":{"cited_paper":"/paper/2408.01433","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:d9535fbf998b798b07a38a2b288f1da83414d292368b08410cf98e76210532a5","observation_id":"ba11dce1-9271-42d5-a431-e751358f3203","resolution":{"observed_at":"2026-08-15T23:10:22.865169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.869904Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.869904Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:98193109c52ce3db92cf17250df92b2662c65b3bd8ee52d13915f54031562548","observation_id":"a41bc8e1-62c5-4a74-aa8b-b9d6d514ca35","resolution":{"observed_at":"2026-08-15T23:10:22.869904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.874512Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.874512Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1aeccf1043ac1e677f189f407cd7a1d03e78877426351a7430e21e9c01015b18","observation_id":"0a8592d8-34b1-4b60-b510-2b521753d5bd","resolution":{"observed_at":"2026-08-15T23:10:22.874512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.480828Z","title":null,"venue":null,"work_id":"10e7ba53-89c6-4118-9bc8-f15d9191cdf8","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.878688Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:487ebe9c3bb3dac506bc7ff9a62fda610ab93afaf554602f3aaba891640ce222","observation_id":"08cfe4c7-f518-4228-92ba-2ceee993bb69","resolution":{"observed_at":"2026-08-15T23:10:24.486342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.465866Z","title":"Grunde-McLaughlin, R","venue":null,"work_id":"00cca5aa-2727-470e-8392-169f51a8a08d","year":2021},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.882729Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:50b04bfaea23e575a4ccd6d045fc3ea102b3fff7a5f69e6ce2fe1bb8f3bce056","observation_id":"d92d037e-0ed4-4e14-90b6-16e742982226","resolution":{"observed_at":"2026-08-15T23:10:24.470764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10301","last_updated":"2024-11-05T01:55:24Z","snapshot_observed_at":"2026-08-16T13:52:04.343245Z","submitted_at":"2024-05-16T17:55:24Z","title":"Conformal Alignment: Knowing When to Trust Foundation Models with Guarantees","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10301","snapshot_observed_at":"2026-08-15T23:10:22.887104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.887104Z"},"links":{"cited_paper":"/paper/2405.10301","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:716c4ac5afc769c0a4bbb5aed6d5cc0fa056306ffe557ab16d5ccf3a6f6071c4","observation_id":"49173323-b1b1-4a9d-b17a-0d0cfcf4f52b","resolution":{"observed_at":"2026-08-15T23:10:22.887104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.451251Z","title":"Howard, A","venue":null,"work_id":"331bdc17-5f68-4c1b-9a3d-7419f51a909d","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.891943Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:12fa6c7e5579226e8b8a7308b05d04a952c1c66d883cf8abd7aa3282214f4c3d","observation_id":"df3bd77f-4364-4da2-9e09-b9426e886ebc","resolution":{"observed_at":"2026-08-15T23:10:24.455741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.patrec.2024.01.009","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.251835Z","title":null,"venue":null,"work_id":"9cd11145-5aa2-4be8-b9d2-a6172d1beac0","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.895729Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:ccc64693a375943d647f03247d8b2090dd37aedadf408ba92c3a38b7d35e032d","observation_id":"613dc825-1359-45bd-84cf-6a21529ec7a9","resolution":{"observed_at":"2026-08-15T23:10:23.257088Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.900035Z","title":"Huang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.900035Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:eacf4f7d10c5228a850a0334cc2664c70ff1962ed395bdbee72c6d94088b54a8","observation_id":"2ea4b43b-ca70-4623-9eca-c5625e27aa8e","resolution":{"observed_at":"2026-08-15T23:10:22.900035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.436730Z","title":"Huang, I","venue":null,"work_id":"a870068d-37fd-4a12-b38b-e4e00d353074","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.904323Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:d54f973698fce358ed27dc9aabbbb005c53c1dd2033925b0cbbb49c765ecaef6","observation_id":"66fcfa15-5781-4dfc-80fb-18dce5965e93","resolution":{"observed_at":"2026-08-15T23:10:24.441291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-15T23:10:22.908814Z","title":"Huang, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.908814Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:7b103ead936082694c630383d83d48f90fce76bf6e594dcd42caffe9c10ed8fc","observation_id":"60c4c4d6-c4dd-478b-bcb7-70e70664182e","resolution":{"observed_at":"2026-08-15T23:10:22.908814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.421647Z","title":null,"venue":null,"work_id":"dea646e1-ff6d-429a-b81c-01e1f3960fb8","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.913284Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1fdd60c1c2e4d5264190b700473dcc534d8b2d90302b11afaabd23ed14025efa","observation_id":"8a42dcda-a790-46e2-914f-4796c1851d3b","resolution":{"observed_at":"2026-08-15T23:10:24.426213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.406480Z","title":null,"venue":null,"work_id":"91cc13a7-c709-4f4c-9416-757ac7d13400","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.917863Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:306a5ce5fd25636a4c2e32296fb97b00cc527e2419a20bf95280f2196aeb26b2","observation_id":"0790ebe0-54ad-49e2-bdb4-c3998dc049b0","resolution":{"observed_at":"2026-08-15T23:10:24.411440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.389631Z","title":"Kambhampati","venue":null,"work_id":"a8484f00-e8c0-4e25-a995-628d090084b7","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.922526Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:6981d9d1c8184554774faadb6080545dce243a31e319a702812f002ced01ca11","observation_id":"e882a46e-c9c9-4ab2-b736-bd31ffed2ef6","resolution":{"observed_at":"2026-08-15T23:10:24.395456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.375094Z","title":"Khan and Y","venue":null,"work_id":"633d620f-695b-4a76-8049-8577a890e2c1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.926849Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:c2ea544b851a722fa68c80af27ffc2d5456de76b42465d458fc635f27f0489b7","observation_id":"5712db11-499a-4511-b06d-dc4f62e2eeb2","resolution":{"observed_at":"2026-08-15T23:10:24.379649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.359963Z","title":null,"venue":null,"work_id":"0c1d3f1a-7676-48d9-a286-029590e55553","year":2017},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.931060Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e10a4d64f7307bf359daa1ab48279f0240295144172c94a8054d710e551e2d93","observation_id":"547ea547-0427-49c1-8ac1-d08529fba60a","resolution":{"observed_at":"2026-08-15T23:10:24.364846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.343910Z","title":null,"venue":null,"work_id":"134c178b-f82d-4b29-bf3d-72cc87880695","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.935693Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e4eb895bfaf2c627ed6811645ebbf5bf3c21ce604955035b2ceda1bed12f33ab","observation_id":"ea98fafa-9ca5-4385-b425-67ef9e8c9365","resolution":{"observed_at":"2026-08-15T23:10:24.349197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.328410Z","title":null,"venue":null,"work_id":"a4ae3c12-6e4a-46e8-9c65-f24d939f0996","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.940836Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:526dbbc43a49289ea2eb67937c053367966a1a3bb1e9c0627dd13c76ae4ba77c","observation_id":"790714ba-1eff-4bca-a4d1-4a568eac7700","resolution":{"observed_at":"2026-08-15T23:10:24.333788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3645088","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.235840Z","title":"Li and G","venue":null,"work_id":"5922f687-93eb-405f-8905-262129005def","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.946012Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1d37da3fc53260e9f8c518c82e80eb09a88291dcc871b40ba551761caf78fe37","observation_id":"ef649b5e-91a1-40b1-b179-5ea95dc52cfe","resolution":{"observed_at":"2026-08-15T23:10:23.240835Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.311918Z","title":null,"venue":null,"work_id":"8e2e787f-b454-4cc3-a869-596499a3865a","year":2022},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.951164Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:b5cf1d87df5809f55c790be49bd0665621b9eccfbe138986402c85f4a32b63e0","observation_id":"4c9c6522-362a-4c19-911d-c4f016085d69","resolution":{"observed_at":"2026-08-15T23:10:24.316838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3694964","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.219388Z","title":null,"venue":null,"work_id":"1dfdcafc-f53e-494b-ad2c-09930f757848","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.955857Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:4fda851aaad44f2c56f4fc664b2b2ed05a3ec746d714a59abc506b0748c1992e","observation_id":"ca7eb0d9-56e0-43ff-935a-67ee4881c41a","resolution":{"observed_at":"2026-08-15T23:10:23.224502Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.291148Z","title":null,"venue":null,"work_id":"635fe46b-5ea8-45c0-be4b-6fd43e0f5d88","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.960917Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:6e247ccb33f2578fb3e3651565dd300e1511c33ed14a7ddff0d69c94683e67e1","observation_id":"63d45299-ebad-420a-af11-c01e6d64ad5e","resolution":{"observed_at":"2026-08-15T23:10:24.298169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.966893Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.966893Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:ca68f742358c25e432de7191730a303397acdb8d67db5d6f23fefd0033ea2a99","observation_id":"f44fd91d-9065-416a-abab-21a38180c78c","resolution":{"observed_at":"2026-08-15T23:10:22.966893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00357","last_updated":"2024-06-20T15:06:10Z","snapshot_observed_at":"2026-08-16T14:22:38.182009Z","submitted_at":"2024-02-01T05:57:10Z","title":"Safety of Multimodal Large Language Models on Images and Texts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00357","snapshot_observed_at":"2026-08-15T23:10:22.971662Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.971662Z"},"links":{"cited_paper":"/paper/2402.00357","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:423150390a91cedee7518fdc24fc18ae90fd710501b60b05789933da4ddff2a8","observation_id":"ba15c73c-8609-4fb2-a3be-41e2bb43b959","resolution":{"observed_at":"2026-08-15T23:10:22.971662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.269402Z","title":null,"venue":null,"work_id":"ffd2ff37-e557-4c04-b0f0-4c55a91059bc","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.976448Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:43409ac268c7bad0e289ad56ccfd319e6d215ee74696847d1af47d140eb08cb5","observation_id":"783276a1-6bd7-472f-9d19-2ad05d8dd09b","resolution":{"observed_at":"2026-08-15T23:10:24.276383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.248667Z","title":null,"venue":null,"work_id":"e5e4ccd4-1a71-41dd-81b6-c0da40726cb8","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.980875Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:0824fab903b22727d6f3a63aadf768fde21b5615938795423ec22f415969d92e","observation_id":"d4e8abb0-59de-42cc-a24c-854949681493","resolution":{"observed_at":"2026-08-15T23:10:24.254716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.231525Z","title":null,"venue":null,"work_id":"1a3fbdc5-7c62-473e-96f2-c443445486d4","year":1995},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.985919Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:4d314c724f0d02027669bc81956e034e0b7239703deaaad430f58020ea47529d","observation_id":"60327eb8-b2d0-4835-af72-16b2fef3a292","resolution":{"observed_at":"2026-08-15T23:10:24.237018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.214000Z","title":"Mehrotra, C","venue":null,"work_id":"33ccfaf3-c8c5-40ac-b193-da35140198cb","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.991617Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:9c2632c1dfce06807c47f6f08bcaae496262c0d1dd7f4a91dc0e65f0ee5af797","observation_id":"19d4ed0e-de4b-4ecb-981a-68da7e581f80","resolution":{"observed_at":"2026-08-15T23:10:24.220017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3645090","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.190991Z","title":"Methnani, M","venue":null,"work_id":"804b7974-8479-47d9-acb9-a36aef9030e9","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.995609Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1956035221b3ce567316fa5b80020467b9d4371badcebaf5f18a729371d60d1d","observation_id":"fe4313f7-0ae1-447e-9dca-7addbd0d3015","resolution":{"observed_at":"2026-08-15T23:10:23.197682Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07872","last_updated":"2024-02-12T18:33:47Z","snapshot_observed_at":"2026-08-19T17:18:24.172135Z","submitted_at":"2024-02-12T18:33:47Z","title":"PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07872","snapshot_observed_at":"2026-08-15T23:10:22.999721Z","title":"Nasiriany, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.999721Z"},"links":{"cited_paper":"/paper/2402.07872","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:84f676182e521229f9b9882e04277d19203d50ef94666bd3de6a17c06d5da5f2","observation_id":"3560dda1-e017-497b-97c2-a83a1851eb77","resolution":{"observed_at":"2026-08-15T23:10:22.999721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.194803Z","title":"Novelli, M","venue":null,"work_id":"9b628c9d-015d-45e8-950c-df3210ba41e1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.004373Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:9d9479f34805e04da9169b35a885547d63dcfc500e0d65befdfe6f64be892788","observation_id":"048b685f-9f40-45ec-aa98-65a80d5e55ea","resolution":{"observed_at":"2026-08-15T23:10:24.201423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.176417Z","title":"Perez-Cerrolaza, J","venue":null,"work_id":"da1172e0-b23d-41ce-8a40-f8b3fdda4f37","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.008640Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:433c96f0ebe342cc07a81939c6a67343ae2755956d79fd87ccf2362bea5475df","observation_id":"239ae18d-72c4-4f60-a026-aabb663c4189","resolution":{"observed_at":"2026-08-15T23:10:24.182692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13121","last_updated":"2024-10-17T01:19:18Z","snapshot_observed_at":"2026-08-19T15:24:26.353134Z","submitted_at":"2024-10-17T01:19:18Z","title":"Trust but Verify: Programmatic VLM Evaluation in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13121","snapshot_observed_at":"2026-08-15T23:10:23.012626Z","title":"Prabhu, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.012626Z"},"links":{"cited_paper":"/paper/2410.13121","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:2f2b3c218d714ef1513204e6d32187aa78ef871e1578454dbd88c4a66fadef1b","observation_id":"0f23f462-2c5c-437a-a6e6-9bfd91c5ba74","resolution":{"observed_at":"2026-08-15T23:10:23.012626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.156890Z","title":"Radford, J","venue":null,"work_id":"561d1871-3940-4da5-be7c-2a4a4dcf0211","year":2021},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.016928Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:0351dc241f7c3510815d5ce435a740300e61623430328aa4b22b919652d3f19f","observation_id":"73af4490-b55c-493b-9566-a084bef9f2a9","resolution":{"observed_at":"2026-08-15T23:10:24.164211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.138068Z","title":null,"venue":null,"work_id":"73957a71-50c5-4ae8-8a8d-bbaead62b998","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.021215Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:5bef04013c9ee12735fbb603b7ce5965378ad2c61f5f0866965eb15a539aeb22","observation_id":"a92c5fd4-ce3b-4564-b0cb-f8430b2902c7","resolution":{"observed_at":"2026-08-15T23:10:24.143792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.119807Z","title":"Sermanet, T","venue":null,"work_id":"064f1938-a4d7-4a94-8784-f64e386de15b","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.025661Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:a665a2276447acca1922d728ddbb470a4c32c96c17db5b9f7fe9a29845946a99","observation_id":"22c0fb1b-534b-4152-8806-903ef321c7ee","resolution":{"observed_at":"2026-08-15T23:10:24.125913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16999","last_updated":"2024-11-04T05:50:56Z","snapshot_observed_at":"2026-08-16T14:06:34.438455Z","submitted_at":"2024-03-25T17:59:23Z","title":"Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16999","snapshot_observed_at":"2026-08-15T23:10:23.029848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.029848Z"},"links":{"cited_paper":"/paper/2403.16999","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:38cbe612f34448054449f8b1cd8af40d43c82b2e42723707a59401cf08d7508e","observation_id":"5a1e0eab-9437-4f46-b764-d21ba9db74be","resolution":{"observed_at":"2026-08-15T23:10:23.029848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.092310Z","title":"Shirai, C","venue":null,"work_id":"bfb0fec1-35e0-4ee6-8b9b-6ed1d5cf9900","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.034843Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1b683cc5696ba95713a24a7a8aafcc05d4699a1fbf74d2bbddcc94f555909ab3","observation_id":"4a4cc70e-5aae-4e45-907d-3daa0ad1e20f","resolution":{"observed_at":"2026-08-15T23:10:24.097399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.076379Z","title":null,"venue":null,"work_id":"950b23c6-3b13-46c5-8a1f-2e25dd6e1f22","year":2017},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.039367Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:815bd285c335b78ae69f3aae0edac460e42495e62ffba960e0e8ddb17158b4ac","observation_id":"02d8b539-5d66-43bc-a326-9d5f5cdfadf5","resolution":{"observed_at":"2026-08-15T23:10:24.081570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.060363Z","title":"Singh, R","venue":null,"work_id":"e0c9a902-fd2f-41c5-a649-b370d3405f19","year":2022},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.044327Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:f68c3d7bf6508acb3df23f4c20bf9967df089a2901c0a741192183fab0774cb0","observation_id":"2024f9f1-d9db-43ee-8cf7-d5503d3246be","resolution":{"observed_at":"2026-08-15T23:10:24.066212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.048950Z","title":"Tocchetti, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.048950Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:5e122e93bd905b784def2460ba931a789bbd1c451e874f2cf67efafcdb8e8006","observation_id":"7160d33e-fdb5-4140-99f9-0cc037b8ee9b","resolution":{"observed_at":"2026-08-15T23:10:23.048950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.045215Z","title":"Vatsa, A","venue":null,"work_id":"b55fc537-f5b2-40bb-b579-4a054c8c114d","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.053986Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:be46e1d494c22966a6e44280cfcaa3e8c39421735b2db10fad38a35addfe7e1c","observation_id":"5209fb25-1ef3-485c-a448-06b5ac4e311e","resolution":{"observed_at":"2026-08-15T23:10:24.050054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.058477Z","title":"Verma, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.058477Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:3e170378b600a3b71cfbdeba6841ef2385fb773ae7517fd633e33f0d5567aa3a","observation_id":"8eb7be5b-2ed9-4497-9fe4-e264b4473880","resolution":{"observed_at":"2026-08-15T23:10:23.058477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02219","last_updated":"2025-05-30T11:40:41Z","snapshot_observed_at":"2026-08-20T03:00:49.082600Z","submitted_at":"2023-12-03T16:39:36Z","title":"Behind the Magic, MERLIM: Multi-modal Evaluation Benchmark for Large Image-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02219","snapshot_observed_at":"2026-08-15T23:10:23.063436Z","title":"Villa, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.063436Z"},"links":{"cited_paper":"/paper/2312.02219","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:fbcc4ff9a8df66dbec1b580026434c7efa71dcadb86e168d18e4c50a5d274330","observation_id":"751b6ba8-c280-4357-b9ed-8cee9cb374ff","resolution":{"observed_at":"2026-08-15T23:10:23.063436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.029240Z","title":null,"venue":null,"work_id":"a6ce5ed2-0784-4db5-8060-3686b5dcabe1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.068437Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:4779e6f516054344e26a9cfd4a4170a40b263cdb44fd5915a28d00581f91ea14","observation_id":"4c891391-ac93-4faa-9b32-9409319e717a","resolution":{"observed_at":"2026-08-15T23:10:24.033781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.014073Z","title":null,"venue":null,"work_id":"7722da35-c0fc-4f09-b988-1f873ac835c1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.073890Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e3516b3e5d3a830037d06e13aeb997fbc23cc377aa4c387dc970e5b093b7790b","observation_id":"29626152-8eb8-4ecd-93d0-efe41d9aabdf","resolution":{"observed_at":"2026-08-15T23:10:24.018872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.996961Z","title":null,"venue":null,"work_id":"0b2f46c7-229a-4edb-adee-074f59aba8ec","year":2021},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.079329Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:cefe6a632df8624a54fd56b7bf396f4de36069279cac381823bee7ce13889e74","observation_id":"cf440171-9dde-40d4-9ae0-6aaf6506574e","resolution":{"observed_at":"2026-08-15T23:10:24.002004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.083716Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.083716Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:07b9f274e1910b9600184b30b5d165c2a1f883a1b654715e587c064e46b21804","observation_id":"07b94ccd-d99c-429c-94ff-906dd980a815","resolution":{"observed_at":"2026-08-15T23:10:23.083716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.981661Z","title":null,"venue":null,"work_id":"1683f0f8-956b-4f3e-ba83-2e0e0091eb3e","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.088046Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:d5f5fe308d646481865e6bde679d87437646bd03558d48b61632c4234dc0aad1","observation_id":"1714a063-8582-4c20-b3e4-30b08502e04d","resolution":{"observed_at":"2026-08-15T23:10:23.986517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.963883Z","title":null,"venue":null,"work_id":"376e9635-acb0-440d-af05-6e127b79ebbe","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.092954Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:f757b046fffb4f4f0fcdec7f93f733df3169bed3fe5d6b9496a6f13d63d908a7","observation_id":"6c7a7666-df58-4be5-aeb3-c533fd71c85b","resolution":{"observed_at":"2026-08-15T23:10:23.970640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.946648Z","title":"Ye-Bin, N","venue":null,"work_id":"878f3c1b-7437-43a6-9bd2-31a4be7afe62","year":2025},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.097448Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:8b1a7e3e26e2ae71fef81a1a2420c80be55a13e9b0d35de0dc358f2d878dedf8","observation_id":"21cf72ac-38e8-4bf2-bbf1-1f90df9d5ef6","resolution":{"observed_at":"2026-08-15T23:10:23.952044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.101674Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.101674Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:7c79423a6cc054d8b5e40547bfa744de0da48445daac187cf068f0d96e0e920f","observation_id":"d748ac3d-166d-4030-817f-acd82c337ca9","resolution":{"observed_at":"2026-08-15T23:10:23.101674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.930104Z","title":null,"venue":null,"work_id":"a515d6c6-8555-4c9e-8826-13061f2a1374","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.105810Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:66f65951b8664cc01c190b9147f353cf800cd5d984b4a4cf32730a9dde25cb93","observation_id":"893610f8-7bcf-4a1c-b228-12434c1e7298","resolution":{"observed_at":"2026-08-15T23:10:23.934982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.913103Z","title":"Zanotti, M","venue":null,"work_id":"f8f74d20-9dc9-449b-8d62-efdfc55743fb","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.110950Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:a623612b7affb538a430b55f0efb6c7ad633981207ac3570eae8a34662b8a59d","observation_id":"23c6192f-7503-4da3-b5c7-ddc9a5d48473","resolution":{"observed_at":"2026-08-15T23:10:23.918048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.897039Z","title":"Zhang, J","venue":null,"work_id":"984335fe-c58f-434c-9148-9336942cfed3","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.115302Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:c723e23d8f2591f0f1a7c9caa6d8af6e1e306b4d535552c51770b3fa3c3b6c36","observation_id":"beb986d0-2bf1-4cbd-9a42-599396eba5e0","resolution":{"observed_at":"2026-08-15T23:10:23.901979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12030","last_updated":"2025-05-21T04:55:10Z","snapshot_observed_at":"2026-08-17T05:28:50.285614Z","submitted_at":"2024-06-17T18:57:37Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12030","snapshot_observed_at":"2026-08-15T23:10:23.119989Z","title":"Zhang, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.119989Z"},"links":{"cited_paper":"/paper/2406.12030","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e25a157cc5773e67b5c20dd080f4e7fe177004664ded623b87c3cda2c318585f","observation_id":"3669a81a-8a91-40b0-b549-01d3a23fde78","resolution":{"observed_at":"2026-08-15T23:10:23.119989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.880868Z","title":null,"venue":null,"work_id":"10343db6-f761-4345-8b56-c84e7d285510","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.125191Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:a3cf590b40eb35e530e30a54be45480962c8f1b57ae9174f5e0169a8b1e7e879","observation_id":"1fd70dd8-3cce-4f02-aaed-bdc85d297656","resolution":{"observed_at":"2026-08-15T23:10:23.885757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.865606Z","title":"Zheng, J","venue":null,"work_id":"96a7129f-ce4e-43c5-a81c-e7f91cc1ca54","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.129223Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:3e436283dfda2ce2426377a6d498bf219a85a80a398c9a3073a2ca7497418e90","observation_id":"2759ae62-e138-4f04-8123-c919a57450e0","resolution":{"observed_at":"2026-08-15T23:10:23.869919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15300","last_updated":"2024-04-23T09:32:25Z","snapshot_observed_at":"2026-08-18T09:54:15.367447Z","submitted_at":"2024-02-23T12:57:16Z","title":"Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15300","snapshot_observed_at":"2026-08-15T23:10:22.859962Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.859962Z"},"links":{"cited_paper":"/paper/2402.15300","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:b7d00e880c44e3fe733ec2af4640f2ef114fd9d8dbaf395d9e26dff24d0cfda5","observation_id":"b28f7083-3a13-4f48-b924-8c040fd8567f","resolution":{"observed_at":"2026-08-15T23:10:22.859962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T17:18:57.210259Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":4,"verified_fuzzy":21},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 1 inbound Pith citation observation for arXiv:2505.05318."}