{"as_of":"2026-08-10T01:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9156ba4a5855810794824ed234bc514a55d55711cddfef9f9cfcd2eb47986397","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:41:00.935085Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24007/citation-record","integrity":"/paper/2505.24007/integrity","json":"/paper/2505.24007/citation-record.json","paper":"/paper/2505.24007"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.16673","last_updated":"2023-11-28T10:39:19Z","snapshot_observed_at":"2026-08-09T13:57:08.777070Z","submitted_at":"2023-11-28T10:39:19Z","title":"Large Language Models Meet Computer Vision: A Brief Survey","version":1},"cited_work":{"arxiv_id":"2311.16673","doi":"10.48550/arxiv.2311.16673","metadata_source":"pith","pith_arxiv_id":"2311.16673","snapshot_observed_at":"2026-08-07T18:16:16.850658Z","title":"Large Language Models Meet Computer Vision: A Brief Survey","venue":"cs.CV","work_id":"e6c81c1e-6eed-49db-b50d-9cdf93aa644f","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.220585Z"},"links":{"cited_paper":"/paper/2311.16673","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:e97bd2f51889f2dbe9b3a4dd817ae4967a5878d4382038b6bd33d1fb482c063a","observation_id":"a5846db8-7a21-478d-bd71-0d8ea749fda5","resolution":{"observed_at":"2026-08-07T12:41:02.793428Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.294964Z","title":"Neural Computing and Applications 37(4), 1973–1997 (2025) https://doi.org/10.1007/s00521-024-10827-6","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.294964Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:44561250a632d498a0bb411f9198551019c878fe8b03a8ccb0813fb02db5db05","observation_id":"251261e7-b271-4c35-bb4b-469ee052b063","resolution":{"observed_at":"2026-08-07T12:40:56.294964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.356073Z","title":"In: 2024 27th International Conference on Computer and Information Technology (ICCIT), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.356073Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:5fbaec108cf845af1734e8ee94590290eebe55e0de3136abea1acab8d1a79c69","observation_id":"6ac390b1-69d9-40b1-928f-22f61521a3cc","resolution":{"observed_at":"2026-08-07T12:40:56.356073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:04.415198Z","title":"Neural Computing and Applications (2025) https://doi.org/10.1007/ s00521-024-10495-6","venue":null,"work_id":"2cbd8f08-640a-45fb-9a18-f513ea7c78b2","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.430347Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:a32d7f2dab970e222caa52a7df20266595186f28bf41961412b51f3bc9898b2a","observation_id":"243c1c26-057b-4dd5-ae2a-9cb1d7b616e1","resolution":{"observed_at":"2026-08-07T12:41:04.534859Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.banglalp-1.10","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:02.489233Z","title":"In: Proceedings of the First Workshop on Bangla Language Processing (BLP-2023), pp","venue":null,"work_id":"58b8de02-ef5e-4548-afaf-ac6f57d5c75c","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.492816Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:6afa03659d7216e7c7df77bca7c1a569455f69873ad2d55e6fee57f8e340f201","observation_id":"3ace651d-25bc-42b4-a803-321a022b1c85","resolution":{"observed_at":"2026-08-07T12:41:02.594651Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10007","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:03.668967Z","title":"Natural Language Processing Journal 7, 100079 (2024) https: //doi.org/10.1016/j.nlp.2024.100079","venue":null,"work_id":"5ec5650d-3711-47b1-9e47-1a4de7b7a854","year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.576538Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:dc625da94b60f9bf36b4135e82b97caed85fecb2758f38f362a1aa9db351c157","observation_id":"7a670189-2eb5-4f15-a4fb-0d891c7faa57","resolution":{"observed_at":"2026-08-07T12:41:03.771280Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:04.187950Z","title":"In: Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pp","venue":null,"work_id":"431075ce-25d7-4ef7-937e-83a5330d027d","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.658006Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:a0fd77900511862f2f23aa39eb18562e25f0c5a191088329e61e8225705a3e51","observation_id":"7512a4f4-d9a1-4cc2-ab47-0299bb71815f","resolution":{"observed_at":"2026-08-07T12:41:04.279671Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.736341Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence 46(8), 5625–5644 (2024) https://doi.org/10.1109/TPAMI.2024.3369699 18","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.736341Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:bae804a1b269af49931c7fc6d423d32e1b67f4f23611163930d05a5a4856423b","observation_id":"8f68a974-2e4a-4bc9-991d-c025d913b1af","resolution":{"observed_at":"2026-08-07T12:40:56.736341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:56.867713Z","title":"In: 2024 IEEE Canadian Conference on Electrical and Computer Engineering (CCECE), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:56.867713Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:04518cd0f1c16e880043b175d0ee0d8fce2fa0b8eb8132d9ea7629647aba6edc","observation_id":"02b3278f-bb94-47fb-9f7e-a5f0c175563f","resolution":{"observed_at":"2026-08-07T12:40:56.867713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-024-10310-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:03:40.895421Z","title":"Neural Computing and Applications 36(33), 20849–20861 (2024) https://doi.org/10.1007/s00521-024-10310-2","venue":"Neural Computing and Applications","work_id":"c39957e3-bd80-4dba-b38e-0c72f1c0fe4a","year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.006197Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:6e2d1075ee488542823b5c00c5b5a0a1896f910d6e43def63fe86a59e13afc45","observation_id":"c693f11c-ba13-4b5e-8fbb-38ed28f9d3d5","resolution":{"observed_at":"2026-08-07T12:41:02.379643Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:57.134997Z","title":"ACM Transactions on Information Systems 43(2), 1–55 (2025) https://doi.org/10.1145/3703155","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.134997Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:98047cb2fc4acec33995381a1ecb4e760bb1d0e5eace6271b962d3e272a957c8","observation_id":"964e48c8-3227-402e-9bf1-404735c696fa","resolution":{"observed_at":"2026-08-07T12:40:57.134997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02189","last_updated":"2025-04-06T03:12:51Z","snapshot_observed_at":"2026-07-06T20:16:27.318761Z","submitted_at":"2025-01-04T04:59:33Z","title":"A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02189","snapshot_observed_at":"2026-08-07T12:40:57.268736Z","title":"arXiv preprint arXiv:2501.02189 1 (2025) https://doi.org/10.48550/arXiv.2501.02189","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.268736Z"},"links":{"cited_paper":"/paper/2501.02189","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:4cc7776b622ee8276fe3dab6fa8037b7142dfd8502a466ea1a3bd2f3e6d4e426","observation_id":"3660bffe-a860-46d9-8b63-2f13919212e5","resolution":{"observed_at":"2026-08-07T12:40:57.268736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11817","last_updated":"2025-02-13T08:11:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-22T10:26:14Z","title":"Hallucination is Inevitable: An Innate Limitation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11817","snapshot_observed_at":"2026-08-07T12:40:57.368955Z","title":"https://doi.org/10.48550/arXiv.2401","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.368955Z"},"links":{"cited_paper":"/paper/2401.11817","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:b5a678655823ee72442b5ffe79c6146dc61dd4dd580a3daa0ad96b01473f0c1e","observation_id":"6763a4c0-e56b-4ab5-a684-6fba44ac812f","resolution":{"observed_at":"2026-08-07T12:40:57.368955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:03.993904Z","title":"https://cdn.openai.com/papers/ GPTV System Card.pdf","venue":null,"work_id":"dd664915-ffce-4ca4-94f8-1848fe8e37e8","year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.447252Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:8fe6d7d2c8a48f34daad1099dcaabfcffe5f05d7a5055ccf3f3434dfc3f5f703","observation_id":"d52194f0-3366-4b28-8c97-dafd754a9aa1","resolution":{"observed_at":"2026-08-07T12:41:04.124117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:57.592968Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv.2304.10592","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.592968Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:c2e0644e8a0eecea7b5e001fbe8cc245ba08768a592e941228099fbff1db1b3f","observation_id":"a3fb02c4-1287-4b5d-a734-4c7c3bfe0f13","resolution":{"observed_at":"2026-08-07T12:40:57.592968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-07T12:40:57.776021Z","title":"arXiv preprint arXiv:2402.14683 (2024) https://doi.org/ 10.48550/arXiv.2402.14683","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.776021Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:644606fb9daba424a37e748d0f767fdf607dba7d204d96afebe082d4eb9cb4c9","observation_id":"862b44a8-62ee-49d1-b434-f352787d9f27","resolution":{"observed_at":"2026-08-07T12:40:57.776021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-025-11229-y","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:03:40.895421Z","title":"Neural Computing and Applications (2025) https: //doi.org/10.1007/s00521-025-11229-y","venue":"Neural Computing and Applications","work_id":"071fa31a-db8a-4a33-a90a-93978fac5759","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.911112Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:d5b894c4cc2eca7096fb93ae7f9a77a5799fba17db1b372dc3743f0a067e6072","observation_id":"359af40f-55f2-4189-a8e5-adc2f19f4a93","resolution":{"observed_at":"2026-08-07T12:41:02.031620Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20331","last_updated":"2025-06-09T11:51:00Z","snapshot_observed_at":"2026-08-08T20:27:04.407414Z","submitted_at":"2024-03-29T17:59:53Z","title":"Unsolvable Problem Detection: Robust Understanding Evaluation for Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20331","snapshot_observed_at":"2026-08-07T12:40:58.104064Z","title":"arXiv e-prints, 2403 (2024) https://doi.org/10.48550/arXiv","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.104064Z"},"links":{"cited_paper":"/paper/2403.20331","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:d8f9bc57e6a7e0bcd0b64f000bcb46cd0e77ca295ce76bee8b55b52098dd6f32","observation_id":"eeefadf2-cac0-4f77-877e-2bbe79f734ec","resolution":{"observed_at":"2026-08-07T12:40:58.104064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-024-10895-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:03:40.895421Z","title":"Neural Computing and 19 Applications (2025) https://doi.org/10.1007/s00521-024-10895-8","venue":"Neural Computing and Applications","work_id":"5d108091-b22b-4112-ab89-6ba0da1ff060","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.253626Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:f8e69fe80ce4f1c8691ddf03ab798b85961bc0e99cef19f42e037bcab374a8d4","observation_id":"1425827c-cdfc-46a2-b052-c93e6219074f","resolution":{"observed_at":"2026-08-07T12:41:01.833515Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10185","last_updated":"2026-04-27T07:59:24Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:14:22Z","title":"Detecting and Evaluating Medical Hallucinations in Large Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10185","snapshot_observed_at":"2026-08-07T12:40:58.390282Z","title":"https://doi.org/10.48550/arXiv.2406.10185","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.390282Z"},"links":{"cited_paper":"/paper/2406.10185","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:49c0813ce1b4bcd0570030e088dc5b8e727813c342158cff8825c2abf5cb464d","observation_id":"e945f82f-3692-4d0f-a26f-b062d481658e","resolution":{"observed_at":"2026-08-07T12:40:58.390282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T12:40:58.547958Z","title":"arXiv preprint arXiv:2404.18930 (2024) https://doi.org/10.13140/RG.2.2.27797.13280","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.547958Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:36e1a5b8d7d058a6094cfa686f80d08b7ad6b334078268572409c27112f27428","observation_id":"0d48a18e-b26f-466c-814c-9f41d170f2c0","resolution":{"observed_at":"2026-08-07T12:40:58.547958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01920","last_updated":"2024-06-04T03:04:21Z","snapshot_observed_at":"2026-08-09T18:50:02.832322Z","submitted_at":"2024-06-04T03:04:21Z","title":"CODE: Contrasting Self-generated Description to Combat Hallucination in Large Multi-modal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01920","snapshot_observed_at":"2026-08-07T12:40:58.682028Z","title":"Advances in Neural Information Processing Systems 37, 133571–133599 (2024) https://doi.org/10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.682028Z"},"links":{"cited_paper":"/paper/2406.01920","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:b42f2eb254b035ec116c0edafdad2ea51eeba5a22cb4a2e5f0d813b60d64a14f","observation_id":"58875b92-2d6f-4d65-b8d5-82a3ba694024","resolution":{"observed_at":"2026-08-07T12:40:58.682028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-07T12:40:58.836392Z","title":"arXiv preprint arXiv:2305.10355 (2023) https://doi.org/10.48550/arXiv.2305.10355","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.836392Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:7467d67c2f7ff76b176eae843197e68f5f97330d60021810fbea4461f9f1710d","observation_id":"41bcaaba-f3ba-46d8-bec9-fbdd8b83738d","resolution":{"observed_at":"2026-08-07T12:40:58.836392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T12:40:58.909680Z","title":"arXiv preprint arXiv:2304.08485 (2023) https://doi.org/10.48550/arXiv.2304.08485","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.909680Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:697c0d569be79860e796cfc17ecd402af52e32c69897306331ed060019ae3d21","observation_id":"6872bd60-f2e8-4c26-8daf-3792654f3b93","resolution":{"observed_at":"2026-08-07T12:40:58.909680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10900","last_updated":"2024-10-09T03:42:22Z","snapshot_observed_at":"2026-08-08T04:34:36.202690Z","submitted_at":"2024-06-16T11:44:43Z","title":"AutoHallusion: Automatic Generation of Hallucination Benchmarks for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10900","snapshot_observed_at":"2026-08-07T12:40:58.968730Z","title":": Autohallusion: Automatic genera- tion of hallucination benchmarks for vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:58.968730Z"},"links":{"cited_paper":"/paper/2406.10900","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:85b18df1e5c4ec1e51fe83dc9b03ab0fe8cdb50dec672a1869d01da30c035244","observation_id":"ad7278ce-b8e9-4fc0-b928-a74fcfd77ee9","resolution":{"observed_at":"2026-08-07T12:40:58.968730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:59.057403Z","title":"https://doi.org/10.1109/CVPR52733.2024.01230","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.057403Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:ed384d78a479e3ea35fc9ed0b2020ff492b28452e64418fb96fd4882da5dafae","observation_id":"3e796555-5004-4122-aed7-ad1797ff95bf","resolution":{"observed_at":"2026-08-07T12:40:59.057403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-07T12:40:59.118464Z","title":"arXiv preprint arXiv:1809.02156 (2018) https: //doi.org/10.48550/arXiv.1809.02156","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.118464Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:57d06d9bc372213ce68630c0dd726d1ff965aca037b0ca84ff309ace25a90fb0","observation_id":"2af4382f-70d7-45af-a622-cb1375061370","resolution":{"observed_at":"2026-08-07T12:40:59.118464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T12:40:59.202797Z","title":"arXiv preprint arXiv:2304.08485 (2023) https://doi.org/10.48550/arXiv.2306.14565","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.202797Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:566c571d377139c5f5103d0b03e5d84f1d1858c44c3f1fbfc8c18d861af5b540","observation_id":"a74ec7fb-aaca-4dbd-9efa-2e0eb2d096e4","resolution":{"observed_at":"2026-08-07T12:40:59.202797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:59.276089Z","title":"arXiv preprint arXiv:2304.10592 (2023) https: //doi.org/10.48550/arXiv.2312.06968","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.276089Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:2ff90d023d2763bc3bf8ecb4b4958ecc28e48c8f9288bd67cbae8618d6252ea3","observation_id":"525724e9-67f9-4f45-b474-b64e6b4a0775","resolution":{"observed_at":"2026-08-07T12:40:59.276089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-07T12:40:59.350199Z","title":": Aligning large multimodal models with factually aug- mented rlhf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.350199Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:f459f7cba3c36e4a480f5ffb57190287063d5a6e67cfaff209692157a6551f78","observation_id":"008afc84-f0ff-4cd3-9b62-13d7aa902acf","resolution":{"observed_at":"2026-08-07T12:40:59.350199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14401","last_updated":"2024-09-01T07:45:02Z","snapshot_observed_at":"2026-08-08T00:07:01.985401Z","submitted_at":"2024-03-21T13:49:42Z","title":"Pensieve: Retrospect-then-Compare Mitigates Visual Hallucination","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14401","snapshot_observed_at":"2026-08-07T12:40:59.418262Z","title":"arXiv preprint arXiv:2403.14401 (2024) https://doi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.418262Z"},"links":{"cited_paper":"/paper/2403.14401","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:17a8bac45e5383752dae35833d300466f7d9b0526596160e86bd4cae81a6dee9","observation_id":"f974fdf9-da18-43a7-9d6f-e7adfad9b256","resolution":{"observed_at":"2026-08-07T12:40:59.418262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T12:40:59.497050Z","title":"arXiv preprint arXiv:2304.08485 (2023) https://doi.org/10.48550/arXiv.2311.07362","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.497050Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:8e2fbbc67167ee3fd01eec7b66fec090f685c04802311f14b2658534be597750","observation_id":"4dcbec0e-33a8-4869-bbab-1419a0e70079","resolution":{"observed_at":"2026-08-07T12:40:59.497050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:59.657207Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv.2412.15650","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.657207Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:823ba576675a534610d495b48d9830a3e0d3c3d5bece2ec8ca49f08ed156895e","observation_id":"5dc94f1a-9b52-4f35-995b-4e5a42951b2a","resolution":{"observed_at":"2026-08-07T12:40:59.657207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:40:59.884885Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv.2310","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:59.884885Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:629d2da81cba2899dd29de69ac4ee23549fb682c584c9d950b74ffeb49a20b46","observation_id":"c4f3f71a-54bc-4b65-acef-f8bb1c8e0041","resolution":{"observed_at":"2026-08-07T12:40:59.884885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T12:41:00.011918Z","title":"arXiv preprint arXiv:2304.10592 (2023) https://doi.org/10.48550/arXiv","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.011918Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:2b9449e1cf5fe7cf4a1d33293f9f92ac47c6a23d806f2be0de78c22fb5f6e281","observation_id":"8898939a-b9f7-47d9-8342-ad36587b6e31","resolution":{"observed_at":"2026-08-07T12:41:00.011918Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-07T12:41:00.088984Z","title":"arXiv preprint arXiv:2304.14178 (2023) https://doi.org/10.48550/ arXiv.2304.14178","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.088984Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:a56b0b7521f8757c17007211a83c907d87bfdaf15dced8d21023621d49f512a8","observation_id":"e7ba7add-402f-46b0-8973-0a7fd14a29a9","resolution":{"observed_at":"2026-08-07T12:41:00.088984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2503.10602","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:01.270082Z","title":"arXiv preprint arXiv:2503.10602 (2025) https: //doi.org/10.48550/arXiv.2503.10602","venue":null,"work_id":"7ce61e18-575b-45c1-979d-60b2f5d50bf0","year":2025},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.146778Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:6f7c2d5ccf8231a914d7628c557a920ad2df6791987a6821992f87614db28515","observation_id":"473c8ee1-3e15-4275-b381-996af429d938","resolution":{"observed_at":"2026-08-07T12:41:01.373295Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-07T12:41:00.211781Z","title":"21 In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.211781Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:dcf1f4f57386a80b5ac8c72803dc5538e0e986dd4b68d05b6fa4a0df976e55f9","observation_id":"8a9d247e-884c-4bea-a11f-76a279545091","resolution":{"observed_at":"2026-08-07T12:41:00.211781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-07T12:41:00.303458Z","title":"https: //doi.org/10.48550/arXiv.2303.08896","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.303458Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:b0a8d341d91a9c9fa5cf68c795f83db7b079525ed0c7d509adae1380fdc84feb","observation_id":"b19066f8-044c-4b14-90ad-ee316cc24946","resolution":{"observed_at":"2026-08-07T12:41:00.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15680","last_updated":"2024-07-22T14:49:51Z","snapshot_observed_at":"2026-08-09T13:56:04.297770Z","submitted_at":"2024-07-22T14:49:51Z","title":"HaloQuest: A Visual Hallucination Dataset for Advancing Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15680","snapshot_observed_at":"2026-08-07T12:41:00.398895Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.398895Z"},"links":{"cited_paper":"/paper/2407.15680","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:7bf94036df76709a51d4d974eccbc970ed79a5ddd319d182e94b737a7f1a923b","observation_id":"a6ce1d0e-33e8-4244-97ba-91b9add0c013","resolution":{"observed_at":"2026-08-07T12:41:00.398895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:00.521223Z","title":"Acoustics, Speech and Signal Processing, IEEE Transactions on 27, 13–18 (1979) https: //doi.org/10.1109/TASSP.1979.1163188","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.521223Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:b64aa95ff0f3f33637c06cc2574960a92458a75a30b3f58a9a0b17114dde8c1d","observation_id":"c7a1c40a-a0c8-4e8b-b8a4-1fbc8161ccff","resolution":{"observed_at":"2026-08-07T12:41:00.521223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"dp/0133356","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:02.993404Z","title":"Prentice- Hall, Inc., USA (2006)","venue":null,"work_id":"45951362-3412-4b19-b6b6-450d451f3c9c","year":2006},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.643213Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:6312e4b86411e89a386c92c7d140ac6b82367997a5f61c6f0a169b9fb000be9e","observation_id":"cc214bc1-4142-46e3-bd3b-a1c6675b8943","resolution":{"observed_at":"2026-08-07T12:41:03.083893Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:00.733910Z","title":"In: Jurafsky, D., Chai, J., Schluter, N., Tetreault, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.733910Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:74e71f7c108976bd5dd6149b0b31e216aa59f56aa990853cfcb582322aca8d5a","observation_id":"3a133b97-3d01-4a6d-af50-7926e5aee6da","resolution":{"observed_at":"2026-08-07T12:41:00.733910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:00.823710Z","title":"In: Walker, M., Ji, H., Stent, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.823710Z"},"links":{"citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:00547658c2c7442ffa0597d9480a21dbc165c00237ef5381bd5025392b055d07","observation_id":"0d36e74e-88dc-4ae6-88ce-daef072ff68a","resolution":{"observed_at":"2026-08-07T12:41:00.823710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-07T12:41:00.935085Z","title":"In: The Eleventh International Conference on Learning Representations (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:00.935085Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:43a323ec3d85fa21d99e4bbc501aa213052abfd6473cc67b6f831bbe67e895cb","observation_id":"76158028-c7d8-4caf-a3c0-1f8050e03bf0","resolution":{"observed_at":"2026-08-07T12:41:00.935085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T18:08:22.340463Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":3,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":33,"verified_exact":7,"verified_fuzzy":1},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2505.24007."}