{"as_of":"2026-08-10T08:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6572690f47d0fe585240cca3977132ccc17346d3df04dea226a5c101b4b22ab3","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:34:56.649817Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T01:49:15.136031Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T16:01:22.762740Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"cited_work":{"arxiv_id":"2506.17664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17664","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"620f5884-4112-4152-90e4-9f22404d694a","year":2025},"citing_paper":{"arxiv_id":"2605.00814","last_updated":"2026-05-08T16:52:48Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-05-01T17:54:37Z","title":"Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-09T18:53:06.494640Z"},"links":{"cited_paper":"/paper/2506.17664","citing_paper":"/paper/2605.00814"},"observation_digest":"sha256:e3e0cfddfa62c12a4c12931c79d48cef23b3f482a75f57f4a8c4bcfcf4d7100a","observation_id":"a6efc5ab-82e8-46db-9ee7-616d25da5476","resolution":{"observed_at":"2026-05-11T16:01:22.777348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"cited_work":{"arxiv_id":"2506.17664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17664","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"620f5884-4112-4152-90e4-9f22404d694a","year":2025},"citing_paper":{"arxiv_id":"2605.00814","last_updated":"2026-05-08T16:52:48Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-05-01T17:54:37Z","title":"Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMs","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T01:49:15.136031Z"},"links":{"cited_paper":"/paper/2506.17664","citing_paper":"/paper/2605.00814"},"observation_digest":"sha256:db6931c25fcd4991e8873f80108b9bff4312b53c0c75df6ccaf953841b10f0ca","observation_id":"c1436332-d86a-4610-9ff0-277a199108ba","resolution":{"observed_at":"2026-05-11T01:50:51.532867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17664/citation-record","integrity":"/paper/2506.17664/integrity","json":"/paper/2506.17664/citation-record.json","paper":"/paper/2506.17664"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T23:34:55.081734Z","title":"Shikra: Unleash- ing multimodal llm’s referential dialogue magic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.081734Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:cd11e1def0ea1f8b2d9cc837c18a09b0ab188e69e8e9d6fa118d725cb4c02a8a","observation_id":"a01c9e40-12ba-4f38-aed7-c5675210c69f","resolution":{"observed_at":"2026-08-06T23:34:55.081734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15300","last_updated":"2024-04-23T09:32:25Z","snapshot_observed_at":"2026-07-06T17:34:32.617468Z","submitted_at":"2024-02-23T12:57:16Z","title":"Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15300","snapshot_observed_at":"2026-08-06T23:34:55.164743Z","title":"arXiv preprint arXiv:2402.15300","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.164743Z"},"links":{"cited_paper":"/paper/2402.15300","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:6cc9568571715934ea6715be07d6fede9cbe44f3c7ab8b060c0a341ff85309db","observation_id":"5381a6ff-955e-46b2-a247-d81895bd4159","resolution":{"observed_at":"2026-08-06T23:34:55.164743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-06T23:34:55.278265Z","title":"URL:https://arxiv.org/abs/2306.13394, arXiv:2306.13394","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.278265Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:777387075c4098a26325e8b15f2aaf929b42c1924ec93e12e59ed8667553b015","observation_id":"3acb9a3f-0ac5-4fc1-9016-dfa90bb4677d","resolution":{"observed_at":"2026-08-06T23:34:55.278265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:34:55.465653Z","title":"arXiv preprint arXiv:2410.21276","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.465653Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:1b4a1c555edeeb6b318b75cd84653f1f3a5b4246c7766d51abf46c94ff9fdafc","observation_id":"8b2b0a8f-af0a-4306-ae4a-dd4706c9bad8","resolution":{"observed_at":"2026-08-06T23:34:55.465653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-06T23:34:55.674752Z","title":"arXiv preprint arXiv:2403.18814","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.674752Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:a973509b512171e200afca5827f0bef09490a4f5602f745429e4ec7420a655bf","observation_id":"58ef4792-b290-4307-9c93-f8f8618fade0","resolution":{"observed_at":"2026-08-06T23:34:55.674752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-06T23:34:55.735935Z","title":"arXiv preprint arXiv:2403.05525","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.735935Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:4036e41fc3f491f7fce041e730f1ae7902f563b74af1b46ae6b67c505e84ccc3","observation_id":"f5974394-d72d-41d7-8774-134f78e52d20","resolution":{"observed_at":"2026-08-06T23:34:55.735935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T23:34:55.885669Z","title":"arXiv preprint arXiv:2309.14525","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.885669Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:0b4c88c487eb717d6ad915aef0ca388d90a22564dbd919bda21e0b63889d928a","observation_id":"6876b6ee-b62b-4f54-bc7e-060ab3694c6a","resolution":{"observed_at":"2026-08-06T23:34:55.885669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T23:34:55.934743Z","title":"arXiv preprint arXiv:2312.11805","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.934743Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:4504ac746d2a78b36fb0da68c8aa4402e9749c528a3213f358befbcdf87b0c0d","observation_id":"b08c0987-0469-4868-ad41-5cf26c981d82","resolution":{"observed_at":"2026-08-06T23:34:55.934743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:34:55.992900Z","title":"arXiv preprint arXiv:2409.12191","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.992900Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:c4f5a8fdd52949d89707cee6fe7965255305461695b357f6abd39c2e09d22480","observation_id":"b6bd49ea-46fc-4c65-836e-cf82d369b442","resolution":{"observed_at":"2026-08-06T23:34:55.992900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02677","last_updated":"2023-07-06T13:47:21Z","snapshot_observed_at":"2026-08-09T15:56:42.519342Z","submitted_at":"2023-05-04T09:48:22Z","title":"Caption Anything: Interactive Image Description with Diverse Multimodal Controls","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02677","snapshot_observed_at":"2026-08-06T23:34:56.110735Z","title":"arXiv preprint arXiv:2305.02677","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.110735Z"},"links":{"cited_paper":"/paper/2305.02677","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:92f1bcd09dedd2290afbad3cddc77934f6809fd64a4af4d176815ba712cf7fcc","observation_id":"ded3c166-299f-491a-8d8a-cf7f8be290b8","resolution":{"observed_at":"2026-08-06T23:34:56.110735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T23:34:56.275773Z","title":"arXiv preprint arXiv:2412.10302","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.275773Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:ace4e32f2679158707bcd2e53026a12d0a4aab1d4416f0baf306b4a10bc217cc","observation_id":"0bdd5568-3306-4e1c-9e9b-31e075c5403e","resolution":{"observed_at":"2026-08-06T23:34:56.275773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-06T23:34:56.417716Z","title":"arXiv preprint arXiv:2304.14178","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.417716Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:43d016f14aa0073da571e286d49b641981cd736d50547d8d117ae6192685f3fb","observation_id":"abe0cc92-da89-4367-a161-33631ac7882e","resolution":{"observed_at":"2026-08-06T23:34:56.417716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-08T04:17:23.797697Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-06T23:34:56.541827Z","title":"arXiv preprint arXiv:2311.16839","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.541827Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:bba8707636fb5d4cd1fd7f704bb1ef39b11e593c7324ebe6cb37e667afc1edc2","observation_id":"a95efcf4-84f7-4b69-8af0-693b4a982f1e","resolution":{"observed_at":"2026-08-06T23:34:56.541827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T23:34:56.649817Z","title":"arXiv preprint arXiv:2304.10592","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:56.649817Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:90f7f73f159ce2d4470cd7090087a82d21f7e1529ffa5676ea457548ae4725f7","observation_id":"921ef3b2-bdf5-4337-85df-c2d8e04ff6f1","resolution":{"observed_at":"2026-08-06T23:34:56.649817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-06T23:34:55.813461Z","title":"arXiv preprint arXiv:1809.02156","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.813461Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:8e31189fb6b05831e7a36a94f09794495ae2f9d6462789414b3325740c5672b6","observation_id":"39332d3d-a380-49ed-9974-bd42dc128f82","resolution":{"observed_at":"2026-08-06T23:34:55.813461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.03557","last_updated":"2019-08-09T17:57:13Z","snapshot_observed_at":"2026-08-07T01:39:40.489262Z","submitted_at":"2019-08-09T17:57:13Z","title":"VisualBERT: A Simple and Performant Baseline for Vision and Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.03557","snapshot_observed_at":"2026-08-06T23:34:55.544749Z","title":"arXiv preprint arXiv:1908.03557","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.544749Z"},"links":{"cited_paper":"/paper/1908.03557","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:04fff1d113ac49817e11e7ce392b79cd9e0fb212069d6dd34b6fe896eefa1fd5","observation_id":"751df6f5-9b7c-486d-b97a-77f3358bb160","resolution":{"observed_at":"2026-08-06T23:34:55.544749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04790","last_updated":"2023-06-13T13:31:12Z","snapshot_observed_at":"2026-07-06T15:24:38.226044Z","submitted_at":"2023-05-08T15:45:42Z","title":"MultiModal-GPT: A Vision and Language Model for Dialogue with Humans","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04790","snapshot_observed_at":"2026-08-06T23:34:55.367724Z","title":"arXiv preprint arXiv:2305.04790","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:55.367724Z"},"links":{"cited_paper":"/paper/2305.04790","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:45863bba701f39c1e9a1383472a05db5e5677bfd75eaea26e9a08050b661bbac","observation_id":"400765dc-0cac-40bc-a2aa-1021cce2aab4","resolution":{"observed_at":"2026-08-06T23:34:55.367724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12718","last_updated":"2025-03-14T04:38:44Z","snapshot_observed_at":"2026-07-06T18:33:02.286642Z","submitted_at":"2024-06-18T15:38:41Z","title":"Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12718","snapshot_observed_at":"2026-08-06T23:34:54.937267Z","title":"arXiv preprint arXiv:2406.12718","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:54.937267Z"},"links":{"cited_paper":"/paper/2406.12718","citing_paper":"/paper/2506.17664"},"observation_digest":"sha256:df21ea2ca7ebaafb12bced25deff42c2eee10d61f07c1b3b8f01e4ef480bd1b7","observation_id":"629c7d3e-52de-4b5f-9070-f98089e618c2","resolution":{"observed_at":"2026-08-06T23:34:54.937267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.17664","last_updated":"2025-06-21T09:49:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T00:52:47.417318Z","submitted_at":"2025-06-21T09:49:16Z","title":"MDSAM:Memory-Driven Sparse Attention Matrix for LVLMs Hallucination Mitigation"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 2 inbound Pith citation observations for arXiv:2506.17664."}