{"as_of":"2026-08-09T17:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17544b94333590985d1556c3ba22fc50dc1fec3a0d0afb546c248ceca0879442","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:19:19.398932Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T02:56:29.276137Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-07-02T02:56:29.276137Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":"74ae9fd5-a689-4de2-957f-32423c3959ad","year":2024},"citing_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-11T12:33:32.631346Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2404.18930"},"observation_digest":"sha256:18a4ac0ccf4dfaec3eb1ff5a99d8b729bae8301f4297a22eca74ab369e18290c","observation_id":"bf07f7af-9c6a-4294-a552-7cd19cb80e1f","resolution":{"observed_at":"2026-05-11T12:33:33.817257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-07T14:19:19.398932Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19360","last_updated":"2025-05-25T23:17:32Z","snapshot_observed_at":"2026-08-08T23:25:50.263927Z","submitted_at":"2025-05-25T23:17:32Z","title":"ChartLens: Fine-grained Visual Attribution in Charts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:19:19.398932Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2505.19360"},"observation_digest":"sha256:41084cabcca907a507a6ad1a0ef4e274db92f704c00daf5b747f3d148dc6b137","observation_id":"920249d8-c86b-4e6f-b7c4-f0a867405d35","resolution":{"observed_at":"2026-08-07T14:19:19.398932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-07T12:40:57.776021Z","title":"arXiv preprint arXiv:2402.14683 (2024) https://doi.org/ 10.48550/arXiv.2402.14683","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24007","last_updated":"2025-06-27T07:20:04Z","snapshot_observed_at":"2026-08-08T06:06:10.597183Z","submitted_at":"2025-05-29T21:09:34Z","title":"Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:57.776021Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2505.24007"},"observation_digest":"sha256:a8d1b69122c72bde5f3e9760aef5e05bc86e8c1d3fcd9383d901f6edc73f9efd","observation_id":"862b44a8-62ee-49d1-b434-f352787d9f27","resolution":{"observed_at":"2026-08-07T12:40:57.776021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-07T05:36:15.573134Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-08T12:50:28.189950Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.573134Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:bb4b6de3a539fc3bdaf19c8ba55e3f7698fe081bf038def4b21996153d6b2b18","observation_id":"467d2227-2375-4c1c-98e8-3e3dbcb4cde6","resolution":{"observed_at":"2026-08-07T05:36:15.573134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-06T23:49:44.314634Z","title":"arXiv preprint arXiv:2402.14683 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-08T00:43:05.134755Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.314634Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:3456f9705a53302bdaf5461639644c96e449549a00a750cf5be254d0e70f581c","observation_id":"bb510fe0-5957-4869-8512-70d7d52aad82","resolution":{"observed_at":"2026-08-06T23:49:44.314634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-06T23:26:59.754622Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18272","last_updated":"2025-06-23T03:58:09Z","snapshot_observed_at":"2026-08-06T23:20:29.656990Z","submitted_at":"2025-06-23T03:58:09Z","title":"ReFrame: Rectification Framework for Image Explaining Architectures","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:59.754622Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2506.18272"},"observation_digest":"sha256:7deb56da979af5b535be8eda1fc136c9d3b660acd516e7648bccd5e96b97af01","observation_id":"441644d5-d89c-431a-83b2-81a162f614d1","resolution":{"observed_at":"2026-08-06T23:26:59.754622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-06T21:41:54.374403Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23639","last_updated":"2025-06-30T09:08:08Z","snapshot_observed_at":"2026-08-09T16:42:27.229071Z","submitted_at":"2025-06-30T09:08:08Z","title":"Unified Multimodal Understanding via Byte-Pair Visual Encoding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:41:54.374403Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2506.23639"},"observation_digest":"sha256:bf0f11dbb83b8a9e92915c183434dcf630add6a8eefde08eb3cbffb5b87a4eec","observation_id":"490c5c7a-309b-4952-9dd1-f72c7038452c","resolution":{"observed_at":"2026-08-06T21:41:54.374403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-06T12:12:23.562660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22003","last_updated":"2025-07-30T04:41:52Z","snapshot_observed_at":"2026-08-07T12:44:15.909399Z","submitted_at":"2025-07-29T16:53:27Z","title":"See Different, Think Better: Visual Variations Mitigating Hallucinations in LVLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:23.562660Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2507.22003"},"observation_digest":"sha256:db73cb4b843ab1d738c37548af600c5a13793cfbf90b5e6130c403f7dcdcea70","observation_id":"7c577c89-7a9d-4e85-a3cc-d7e6067ac6e4","resolution":{"observed_at":"2026-08-06T12:12:23.562660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-05T20:28:44.432144Z","title":"Huang et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-09T12:54:37.629481Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T20:28:44.432144Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:cd231a9eb7c156cae8da787638ddae53336ae9f903e08f9c743cb4f8ffb632b9","observation_id":"22d363ff-ec68-4982-b136-9c4ba7dffbba","resolution":{"observed_at":"2026-08-05T20:28:44.432144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-07-02T02:56:29.276137Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":"74ae9fd5-a689-4de2-957f-32423c3959ad","year":2024},"citing_paper":{"arxiv_id":"2604.17982","last_updated":"2026-04-20T09:04:49Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:04:49Z","title":"Mitigating Multimodal Hallucination via Phase-wise Self-reward","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T05:10:45.144421Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2604.17982"},"observation_digest":"sha256:ba35ac1c222aae2c6c00af15206ac68cc2eacd4740ecdcc2c8733963a5165fa7","observation_id":"ec4e3dde-8ab0-4c98-b4cb-7f4132f7ba17","resolution":{"observed_at":"2026-05-10T09:38:43.337592Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-07-02T02:56:29.276137Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":"74ae9fd5-a689-4de2-957f-32423c3959ad","year":2024},"citing_paper":{"arxiv_id":"2604.21268","last_updated":"2026-04-23T04:23:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-23T04:23:31Z","title":"Measure Twice, Click Once: Co-evolving Proposer and Visual Critic via Reinforcement Learning for GUI Grounding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-09T23:05:05.251150Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2604.21268"},"observation_digest":"sha256:fbbbd7ae6f093eafd3029a2d0f5b8a5e5cd76caa396bafef9a30c216ca2b5018","observation_id":"d8d4980c-0baf-499f-9a1f-34b238e14fa3","resolution":{"observed_at":"2026-05-11T14:16:05.974790Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-07-02T02:56:29.276137Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":"74ae9fd5-a689-4de2-957f-32423c3959ad","year":2024},"citing_paper":{"arxiv_id":"2605.11559","last_updated":"2026-05-12T05:42:11Z","snapshot_observed_at":"2026-07-06T23:23:21.034839Z","submitted_at":"2026-05-12T05:42:11Z","title":"When Looking Is Not Enough: Visual Attention Structure Reveals Hallucination in MLLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:07.172228Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2605.11559"},"observation_digest":"sha256:3c8a9a2c8ac5bf94f8d54c4a434e2d79d9b8f241be0f4e6d0c95866928fc817d","observation_id":"4671d905-cb61-4458-ae74-f0ea239706a4","resolution":{"observed_at":"2026-05-13T01:57:05.264219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-07-02T02:56:29.276137Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":"74ae9fd5-a689-4de2-957f-32423c3959ad","year":2024},"citing_paper":{"arxiv_id":"2605.30911","last_updated":"2026-05-29T06:47:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T06:47:31Z","title":"What Makes LVLMs Hallucinate Less? Unveiling the Architectural Factors Behind Hallucination Robustness","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T23:21:50.254449Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2605.30911"},"observation_digest":"sha256:4d5a711d6acc4652fedee04ef95d251e5184191234e31d539e43bd0ddaf35aee","observation_id":"d80d52b0-69fa-4bf6-b027-362ec319cc4b","resolution":{"observed_at":"2026-06-28T23:22:46.607805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-07-02T02:56:29.276137Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":"74ae9fd5-a689-4de2-957f-32423c3959ad","year":2024},"citing_paper":{"arxiv_id":"2606.03713","last_updated":"2026-06-02T14:34:48Z","snapshot_observed_at":"2026-08-01T18:41:34.888563Z","submitted_at":"2026-06-02T14:34:48Z","title":"Investigating Adversarial Robustness of Multi-modal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T11:11:34.152223Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2606.03713"},"observation_digest":"sha256:3e67e7157b9c485d46259fab4d4d7f0c4e2125a5429a59d9ec34d01eebba9342","observation_id":"a6fdc414-622f-4fc3-82fa-f89423275927","resolution":{"observed_at":"2026-07-02T02:06:27.581523Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-07-02T02:56:29.276137Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":"74ae9fd5-a689-4de2-957f-32423c3959ad","year":2024},"citing_paper":{"arxiv_id":"2606.04046","last_updated":"2026-06-02T07:50:56Z","snapshot_observed_at":"2026-08-06T11:17:23.952215Z","submitted_at":"2026-06-02T07:50:56Z","title":"Dive into the Scene: Breaking the Perceptual Bottleneck in Vision-Language Decision Making via Focus Plan Generation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T10:28:41.952330Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2606.04046"},"observation_digest":"sha256:c76cb10fdf3e08822c1aa05725de70bc6f00dc2aa01cd52d0dc22098228f53fb","observation_id":"89f0e3dd-7a66-4585-8667-6330cf9a416a","resolution":{"observed_at":"2026-07-02T02:56:29.278185Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.14683/citation-record","integrity":"/paper/2402.14683/integrity","json":"/paper/2402.14683/citation-record.json","paper":"/paper/2402.14683"},"outbound":[],"paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2402.14683."}