{"as_of":"2026-08-10T05:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d073e6cdabed4b5ceff1c272d7def5e15c7f83873909c7e7752109f748403b2","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:09:12.703445Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:51:38.455604Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T02:36:26.495175Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2507.09184","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.09184","snapshot_observed_at":"2026-07-02T02:36:26.495175Z","title":"arXiv preprint arXiv:2507.09184 , url=","venue":null,"work_id":"358ef024-f509-479a-89f1-14a1d3484ccf","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-01T16:17:19.756210Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-08T19:34:02.860270Z"},"links":{"cited_paper":"/paper/2507.09184","citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:79c657838f956e4fa2ef84858190626e97a960d988829cc257da1986fa2f4fab","observation_id":"81bf9e71-ab5f-44e4-ad37-d7abec4e2070","resolution":{"observed_at":"2026-05-09T05:50:25.867148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2507.09184","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.09184","snapshot_observed_at":"2026-07-02T02:36:26.495175Z","title":"arXiv preprint arXiv:2507.09184 , url=","venue":null,"work_id":"358ef024-f509-479a-89f1-14a1d3484ccf","year":null},"citing_paper":{"arxiv_id":"2606.03569","last_updated":"2026-06-02T12:36:24Z","snapshot_observed_at":"2026-08-02T13:19:20.535572Z","submitted_at":"2026-06-02T12:36:24Z","title":"When Attention Collapses: Stage-Aware Visual Token Pruning from Structure to Semantics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:51:38.455604Z"},"links":{"cited_paper":"/paper/2507.09184","citing_paper":"/paper/2606.03569"},"observation_digest":"sha256:b45ffeffdcf9470f9adbdd9d0c4957903ce324f96468801aead49a5f08ce3d6d","observation_id":"f5d5434a-704e-48e1-8f08-2dcb379a58ea","resolution":{"observed_at":"2026-07-02T02:36:26.496640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.09184/citation-record","integrity":"/paper/2507.09184/integrity","json":"/paper/2507.09184/citation-record.json","paper":"/paper/2507.09184"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T18:09:03.518459Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.518459Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:290933085c1ae261c7e0542bb13a411ce7c1088520eb4efc4314327357e53f0c","observation_id":"fcebb80e-e67a-4e25-97e2-56bb1ba2fbeb","resolution":{"observed_at":"2026-08-06T18:09:03.518459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12718","last_updated":"2025-03-14T04:38:44Z","snapshot_observed_at":"2026-07-06T18:33:02.286642Z","submitted_at":"2024-06-18T15:38:41Z","title":"Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12718","snapshot_observed_at":"2026-08-06T18:09:03.588889Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.588889Z"},"links":{"cited_paper":"/paper/2406.12718","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:9c6f8f3df7d62f14e7c95c1f2b8a0ff5401deef40101fa54492c239f2fb05dc9","observation_id":"5c794393-d107-468e-abe5-a893502100e3","resolution":{"observed_at":"2026-08-06T18:09:03.588889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T18:09:03.664319Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.664319Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:f58a6adf2578c6dbe368066a1e7660fdf66b64c79123b940a527727fd985c24e","observation_id":"e20b7a41-f9c0-40d7-a98e-2b6de4399a0c","resolution":{"observed_at":"2026-08-06T18:09:03.664319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-06T18:09:03.731474Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.731474Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:579f2585d08bd51654a7b415a1a5944fc29cebe3f5a293316ca95de773d8b9c4","observation_id":"067e49e4-3974-4d48-bb98-109e9af09b4f","resolution":{"observed_at":"2026-08-06T18:09:03.731474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15356","last_updated":"2025-04-01T02:38:09Z","snapshot_observed_at":"2026-07-06T18:19:13.078606Z","submitted_at":"2024-05-24T08:46:31Z","title":"Alleviating Hallucinations in Large Vision-Language Models through Hallucination-Induced Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15356","snapshot_observed_at":"2026-08-06T18:09:03.792864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.792864Z"},"links":{"cited_paper":"/paper/2405.15356","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:6e27cb94484c018947a487bbc1ee94811534bce8016cd385d24d5716b4aef813","observation_id":"9509723e-65e6-422a-91b3-75370563438b","resolution":{"observed_at":"2026-08-06T18:09:03.792864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:03.866461Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.866461Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d00861a5088a97a39aa2f63590c8d1f67444ac0e3a4922e2575609d685fb608e","observation_id":"7afa340c-5787-4514-80c2-8beb8f73cb60","resolution":{"observed_at":"2026-08-06T18:09:03.866461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-06T18:09:03.923853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.923853Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1701a930a621322e86709ef8010e355e6372aa372e7ba0b4cec254a79b937021","observation_id":"562b6634-6288-45ed-ba49-a75756a652e9","resolution":{"observed_at":"2026-08-06T18:09:03.923853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:03.986681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:03.986681Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:dcb4e43169a72a8e76962c23989b00c1f244eb1402302d1e2e1dd42dab5b7032","observation_id":"5b1933be-8023-4e5b-8442-87bcb0ce6636","resolution":{"observed_at":"2026-08-06T18:09:03.986681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:04.064963Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.064963Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2934642f924a5e3b4a027d118f13895e310aaaa0de31570592ccf02a0b4e9913","observation_id":"8d1c7e93-45b5-4daf-ab47-9cc785785581","resolution":{"observed_at":"2026-08-06T18:09:04.064963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-07T09:16:51.378562Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-06T18:09:04.223683Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.223683Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:81349145eae2fb9a0663bbea4280b9ac5e40bee64f00c57e571f38af5d333aad","observation_id":"c5148b6f-529c-4d99-beaa-a12c442a3fb1","resolution":{"observed_at":"2026-08-06T18:09:04.223683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:04.347465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.347465Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:653a832a1f63c91cb5888508af189e55b8449a1809f6e730159017038930eca9","observation_id":"919ab78e-c58b-473c-8983-4e7ab5955ec2","resolution":{"observed_at":"2026-08-06T18:09:04.347465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03883","last_updated":"2024-03-11T02:01:09Z","snapshot_observed_at":"2026-08-06T11:43:44.726916Z","submitted_at":"2023-09-07T17:45:31Z","title":"DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03883","snapshot_observed_at":"2026-08-06T18:09:04.462122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.462122Z"},"links":{"cited_paper":"/paper/2309.03883","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:a2509c4ac6c53801be67e8b1ba49e61e91b91a53412a1316c2e1575e5ef7da72","observation_id":"2bdadda9-dd36-46b4-93f1-9e6881235220","resolution":{"observed_at":"2026-08-06T18:09:04.462122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14148","last_updated":"2025-04-21T04:04:53Z","snapshot_observed_at":"2026-08-09T06:03:53.936554Z","submitted_at":"2024-10-18T03:34:32Z","title":"Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14148","snapshot_observed_at":"2026-08-06T18:09:04.579677Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.579677Z"},"links":{"cited_paper":"/paper/2410.14148","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:08a46f53b2b9eace8b6fd29a75e9bbd053c42b8e9b3b62155aa72e637ae7c4ae","observation_id":"bd65fe72-c4f8-4534-8bfa-5a2cad63128d","resolution":{"observed_at":"2026-08-06T18:09:04.579677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T18:09:04.692520Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.692520Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:19f1e614c875f4328c8af6154b28b45c93dd6c423840ad41dc406a4f1b8e615f","observation_id":"9e2e0012-5847-472b-a7e8-8431c276e1bb","resolution":{"observed_at":"2026-08-06T18:09:04.692520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:04.807581Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.807581Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:40f10aafde40c4dd205d6a559d695b2419f5fc34bc62ec838f3ff0525c63c093","observation_id":"e1ed03d6-08d3-44ef-ab43-bdaaa343c95b","resolution":{"observed_at":"2026-08-06T18:09:04.807581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10436","last_updated":"2024-11-15T18:56:01Z","snapshot_observed_at":"2026-07-06T19:51:05.604758Z","submitted_at":"2024-11-15T18:56:01Z","title":"Mitigating Hallucination in Multimodal Large Language Model via Hallucination-targeted Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10436","snapshot_observed_at":"2026-08-06T18:09:04.896638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:04.896638Z"},"links":{"cited_paper":"/paper/2411.10436","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:da71e144f21cc7e878aa6b6d5befdcbd813dc474fc2b0783297e57cd45aff180","observation_id":"6c1bdc78-d3d7-40f7-859c-d67faeb529a2","resolution":{"observed_at":"2026-08-06T18:09:04.896638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.049067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.049067Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2a6ea8390273e623b9fffd9ac6ca0ea6fd5bcb1c2afa172bf3e0bc34f198af8b","observation_id":"2f502d20-b7fa-464f-abf4-36a3c5722491","resolution":{"observed_at":"2026-08-06T18:09:05.049067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.127900Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.127900Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:810a3f7ee2f01e4cb82b0973c9631e9081f1fea3fae722b703b97a710a52ed30","observation_id":"238d7245-9b99-473e-841c-077b6568201a","resolution":{"observed_at":"2026-08-06T18:09:05.127900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.379941Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.379941Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:da0872b8aabea6b0ba61431aa01040e1fb839c49763dc7d886ee064210dd4987","observation_id":"86ccd12d-3931-487a-93b3-21ff1e801e60","resolution":{"observed_at":"2026-08-06T18:09:05.379941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.517749Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.517749Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:77bc354dd8f2b9ebc900f018c2926eefe1e23a174477ff5cda0fd70a6cabc47f","observation_id":"f64a32b0-92af-4606-b52c-c0d3c58db9f8","resolution":{"observed_at":"2026-08-06T18:09:05.517749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03105","last_updated":"2024-01-13T15:11:04Z","snapshot_observed_at":"2026-07-06T17:12:14.593202Z","submitted_at":"2024-01-06T02:02:34Z","title":"Incorporating Visual Experts to Resolve the Information Loss in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03105","snapshot_observed_at":"2026-08-06T18:09:05.646100Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.646100Z"},"links":{"cited_paper":"/paper/2401.03105","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:9c14f97b07ea923bb44f56a45873a651cbac810df78e31f9370660e4be3d93a7","observation_id":"81334f5d-63f5-4da6-8be4-d8f837c3ff1a","resolution":{"observed_at":"2026-08-06T18:09:05.646100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.749687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.749687Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:66813f63cedc72bc66538b22931032e2750f2b373954b26c950bb4901987e4a5","observation_id":"588c63e7-4251-4ee6-aee7-42ff6e68d7ba","resolution":{"observed_at":"2026-08-06T18:09:05.749687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.836181Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.836181Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:87f556903448ecef0bb10ec4be899a35716d7a39f86753f550f8fbc8c601d6c6","observation_id":"e4881b57-f331-4a78-9261-385bb74cc644","resolution":{"observed_at":"2026-08-06T18:09:05.836181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:06.011724Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.011724Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d4564da43f40f5dadefa888ea8e9b5ca33506a0d7d496111a4bf87668edc447d","observation_id":"c90e75ff-a607-4d07-9d3a-49d149b9e8f7","resolution":{"observed_at":"2026-08-06T18:09:06.011724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:17.521787Z","title":null,"venue":null,"work_id":"6986d9dc-c0dc-48eb-ba68-5b5f702a9915","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.125436Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:0d655714b021397679739a14e0b8e73bc6c0ac41ba2423fcdf464466d745aa02","observation_id":"77763261-4a47-45ef-9649-c75242a0fcfd","resolution":{"observed_at":"2026-08-06T18:09:17.702378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:17.258548Z","title":null,"venue":null,"work_id":"2ea33fbd-68eb-4a43-afd8-5971dd496e1e","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.188949Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ff3bc56e3e517112ce6a37ae6bf3ddc2db992cb41624d07842c0b8d9bda51976","observation_id":"b9cdab9e-ee62-4e64-9360-73cb48a118f1","resolution":{"observed_at":"2026-08-06T18:09:17.390816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01920","last_updated":"2024-06-04T03:04:21Z","snapshot_observed_at":"2026-08-10T05:29:28.546053Z","submitted_at":"2024-06-04T03:04:21Z","title":"CODE: Contrasting Self-generated Description to Combat Hallucination in Large Multi-modal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01920","snapshot_observed_at":"2026-08-06T18:09:06.273983Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.273983Z"},"links":{"cited_paper":"/paper/2406.01920","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ca545e83d8c16186ea1372d242d0835e0bfd6e0a42ac799e95d1214c310fa919","observation_id":"0dc191f6-aee6-4e7c-ad82-537c18805271","resolution":{"observed_at":"2026-08-06T18:09:06.273983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.968070Z","title":null,"venue":null,"work_id":"5f4cabb3-cf4b-4842-9c06-0caaceba56a1","year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.323073Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:7527a03bbcac1e9bc357c3c30849b4f0f1d541a2fcb8d7ee704d064969a8dac1","observation_id":"aa3e0550-26c3-415f-88d2-2392ee3c70e6","resolution":{"observed_at":"2026-08-06T18:09:17.132638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12787","last_updated":"2024-10-16T17:59:02Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-16T17:59:02Z","title":"The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12787","snapshot_observed_at":"2026-08-06T18:09:06.449230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.449230Z"},"links":{"cited_paper":"/paper/2410.12787","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d8ff31997c21b1ec7c1c409cc1d65084c42a0eccef0c54c45bdf8399a54d1d11","observation_id":"70a1b00b-d496-44ea-9da8-771c397e9079","resolution":{"observed_at":"2026-08-06T18:09:06.449230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.756389Z","title":null,"venue":null,"work_id":"92490a24-8f25-4eae-98a8-3cd9c2c61913","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.501121Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:077fa2a72a17717bbf17ce9b824edb0e2e454167a737088c223086ccf13648eb","observation_id":"9764b61f-828a-414f-8da2-ec9aec90b5ce","resolution":{"observed_at":"2026-08-06T18:09:16.874266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-06T18:09:06.591569Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.591569Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:79d92265cc6946c5473fbf97a4bf98c0bbcdb8a9158b0ca686a9f275096b4590","observation_id":"88b7641a-c56a-4f69-b097-04f47aa6c712","resolution":{"observed_at":"2026-08-06T18:09:06.591569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:06.686333Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.686333Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:3607a986249d044d15f4a1c5634d031104032f912bf0868337307a1a01d7f494","observation_id":"1df0b745-14f4-4cf4-a6d0-d7a1fae2799a","resolution":{"observed_at":"2026-08-06T18:09:06.686333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.471212Z","title":null,"venue":null,"work_id":"e7030297-3231-4ed7-a493-6f24c0360fd7","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.758371Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:e8d476f0f6f25af03d70a10402819be562d57da171d5bac360bd486601160797","observation_id":"c1e0ca83-a3fe-4905-b7e4-168adc7056c0","resolution":{"observed_at":"2026-08-06T18:09:16.624255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:06.971934Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.971934Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:e8d6ce31415ff29c024d7bfb802e3a4595404298216b95d95760825c97f18c38","observation_id":"d45520d9-3a23-470f-9eee-0312447d6314","resolution":{"observed_at":"2026-08-06T18:09:06.971934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-08-06T18:09:07.147109Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.147109Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:4ff44188ba99efadb9a0d22f38304d6e3297ab309e7c5425be11a412a2067faf","observation_id":"e6114f00-c053-4fb8-a6a2-cc4b806b3095","resolution":{"observed_at":"2026-08-06T18:09:07.147109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:07.253341Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.253341Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:763425fd1ff23541ea4f71e0d5e84be8fd1b3f80b6e50422d403af549470151a","observation_id":"15a496be-60bd-48ad-a501-ff16e96edf96","resolution":{"observed_at":"2026-08-06T18:09:07.253341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.797261Z","title":null,"venue":null,"work_id":"daf25050-ce58-4c26-a9c1-0dfef6b0765e","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.380701Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2638550254d1bc3ea54bff0b038dbc70ea61bf7e06ce29377ae1bc561ad74076","observation_id":"d22cc338-58f2-4c13-93e4-a2e1e6922cd1","resolution":{"observed_at":"2026-08-06T18:09:15.978006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-06T18:09:07.054223Z","title":"arXiv preprint arXiv:2305.10355 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.054223Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:4ff5eb8c30b774ada20be3505a668e89164a63e264e3f0109492b7d3cd6de255","observation_id":"0ab4622a-1c60-470b-9dd2-93f732e094b8","resolution":{"observed_at":"2026-08-06T18:09:07.054223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-06T18:09:07.643264Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.643264Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:719b8d43d377537f16e5353d4fd564a3a140e79deb145fafaefd2dce27c96c2c","observation_id":"c22237cb-71ed-4ebe-acc6-56aebf738758","resolution":{"observed_at":"2026-08-06T18:09:07.643264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21771","last_updated":"2024-07-31T17:46:57Z","snapshot_observed_at":"2026-08-06T11:42:03.713360Z","submitted_at":"2024-07-31T17:46:57Z","title":"Paying More Attention to Image: A Training-Free Method for Alleviating Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21771","snapshot_observed_at":"2026-08-06T18:09:07.742579Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.742579Z"},"links":{"cited_paper":"/paper/2407.21771","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ba7193a7e64077137861d68d7c91768d0d4fc00ff49f3e0b7e72dc345d44620b","observation_id":"3b609538-f8cf-4f93-b377-1b8c60848552","resolution":{"observed_at":"2026-08-06T18:09:07.742579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:16.181077Z","title":"In International Conference on Learning Representations","venue":null,"work_id":"51c9c9b3-eefc-43b2-9dd1-9476226ce899","year":null},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.322599Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1b45ec43acafc423f4cfd6ebcd954ede9107f8d4a015bfd5fdcf404fa0cea5f2","observation_id":"5ca435f9-032a-4d29-843a-c0c3a9a1153c","resolution":{"observed_at":"2026-08-06T18:09:16.298488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.157547Z","title":"Manmatha, and C","venue":null,"work_id":"84de9514-6600-4f94-8511-cdfc49ef0e98","year":2020},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.960230Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:b6ccf0fb668a239628944c96b3ec05809d39c773e6bf15ce38251cc2ef3f741c","observation_id":"80ad7e54-f0fd-48d7-87c3-1eff52fd99a7","resolution":{"observed_at":"2026-08-06T18:09:15.330230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.486049Z","title":null,"venue":null,"work_id":"e7be6960-37fb-4e76-8e7b-ad2eecd91a02","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.521404Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:0438c348522f1d843ade45e5e7799284e8b340332902c22c4f73ed43a5176791","observation_id":"52b92175-1d51-4f4c-bc01-48bc885c7883","resolution":{"observed_at":"2026-08-06T18:09:15.656818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:08.192571Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.192571Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:acbd9d0f7e1da77c36a9e6d1828dc8768ae91fdc12aeca01b140ecb50140531b","observation_id":"2810d02c-e4e2-47bb-9327-a334608a8bc2","resolution":{"observed_at":"2026-08-06T18:09:08.192571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-06T18:09:08.300995Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.300995Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:3711018eccddb0eb67d32fb8ec9d5d3416b394773ad7198ed8dba84d6f6b1a3b","observation_id":"7dbdb3e2-05ca-4815-94d6-8fbd74c153c5","resolution":{"observed_at":"2026-08-06T18:09:08.300995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:07.851036Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.851036Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ef6c183d2027f93b7b846bb1f84ab6c5164dbfd47c7a4c6f4447d4e56329dd32","observation_id":"58f3bd48-5fea-4155-8484-1777da5d3642","resolution":{"observed_at":"2026-08-06T18:09:07.851036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06795","last_updated":"2025-08-12T08:34:12Z","snapshot_observed_at":"2026-07-06T19:30:21.486298Z","submitted_at":"2024-10-09T11:46:32Z","title":"From Pixels to Tokens: Revisiting Object Hallucinations in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06795","snapshot_observed_at":"2026-08-06T18:09:08.482728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.482728Z"},"links":{"cited_paper":"/paper/2410.06795","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1038f3cd66a6c1183a866277040830564a1ee95557ef6b75263b7e13ff9f414a","observation_id":"0be4d241-e75c-4703-88ce-a467f8455973","resolution":{"observed_at":"2026-08-06T18:09:08.482728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08730","last_updated":"2024-04-03T15:22:23Z","snapshot_observed_at":"2026-07-06T17:44:04.908253Z","submitted_at":"2024-03-13T17:29:45Z","title":"Strengthening Multimodal Large Language Model with Bootstrapped Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08730","snapshot_observed_at":"2026-08-06T18:09:08.076475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.076475Z"},"links":{"cited_paper":"/paper/2403.08730","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:69657bcc481b6c595c2c244c49e2746b2263aa76eee5da91936ab5d56d8210f2","observation_id":"52c4fc3e-02e6-4033-b8c7-0c0d6f315399","resolution":{"observed_at":"2026-08-06T18:09:08.076475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-06T18:09:08.726538Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.726538Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:3ff207760f7094aa0bb06d4f62f1511382eb5918bcc23de42efa8e905da49923","observation_id":"46cbb77a-34e6-45ec-b9bd-15175cad2bd5","resolution":{"observed_at":"2026-08-06T18:09:08.726538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T18:09:08.807559Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.807559Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:8a752684f12bce75676a4ab791497582848633850a39e489170d2388247c7dbd","observation_id":"81d4d4e1-1162-4346-a292-b8fbfa279aff","resolution":{"observed_at":"2026-08-06T18:09:08.807559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:15.062353Z","title":"Arik, and Tomas Pfister","venue":null,"work_id":"cf090454-3042-4442-8938-98fbf3a7473f","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.400129Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:67f43eeaae4cf839ef20d2cfa8f1c4294ec8324be5243a8cf393748932c65594","observation_id":"8d5ac4f5-b40c-4fb3-b26e-f100904242b6","resolution":{"observed_at":"2026-08-06T18:09:15.087353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.682866Z","title":null,"venue":null,"work_id":"1d97eeb5-52c4-4987-afea-808f3dd4473f","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.034768Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1d22683db9ab3e7a2162f8f7541870d87cd3dfc17d0d86e59668dbc11c2af20c","observation_id":"0f577e07-8c5a-48e4-9a26-cdaf27b5fe6a","resolution":{"observed_at":"2026-08-06T18:09:14.719597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.935745Z","title":null,"venue":null,"work_id":"d9f5cfac-2c49-4d53-864e-c47643455654","year":2019},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.610437Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:4cdcf4f898e15eee657733a4ea9b5d9f65acbef6a3e9f6ad5e2df9a12f3c9140","observation_id":"ae9153c9-cc38-442a-b259-fb01284dfca1","resolution":{"observed_at":"2026-08-06T18:09:15.025340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T18:09:09.204371Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.204371Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:72190ad4b613b1d50bf18a77c78df5581fbf5759bd90258899ff847b56abec57","observation_id":"e4ab56b1-8127-4d9d-afa9-a99611ef65a5","resolution":{"observed_at":"2026-08-06T18:09:09.204371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.461420Z","title":"Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N","venue":null,"work_id":"42dcf718-8b1f-49da-abe0-12f650ed2396","year":2017},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.275068Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:3853665c7bb59e311f36a04ad26b3be04be323fbb5e7e6670c070b1f1d51e984","observation_id":"af9ed801-5e99-4573-ab8d-052c41e5cd48","resolution":{"observed_at":"2026-08-06T18:09:14.514762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.774183Z","title":null,"venue":null,"work_id":"9815e5df-c9e8-4f76-9779-5d6ffabeb3a2","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:08.943756Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:f6249c65b84833fa1a24423694fe81357fbf8befddebc4645495e533423f5c25","observation_id":"d1961a3a-0f36-41fb-a516-09781e85eecd","resolution":{"observed_at":"2026-08-06T18:09:14.869493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15839","last_updated":"2025-03-15T12:22:18Z","snapshot_observed_at":"2026-07-06T19:56:08.504922Z","submitted_at":"2024-11-24T13:42:02Z","title":"VaLiD: Mitigating the Hallucination of Large Vision Language Models by Visual Layer Fusion Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15839","snapshot_observed_at":"2026-08-06T18:09:09.645932Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.645932Z"},"links":{"cited_paper":"/paper/2411.15839","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:7e5ee4ae0b0065dbb6484fb5627d5f2c4b68d38aa4edc5573b83dc4122953848","observation_id":"a17ce182-7c35-4914-8e42-e257f91fb604","resolution":{"observed_at":"2026-08-06T18:09:09.645932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.561395Z","title":null,"venue":null,"work_id":"da6706a4-a8f7-4555-a129-d932219e8c74","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.122298Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:4ec900056ea7cee2b11490612e5c5fdb5ae6ad00b6f197f7df13de5b468bc28a","observation_id":"2a700b16-c4c3-459e-b125-83428ddbfdda","resolution":{"observed_at":"2026-08-06T18:09:14.626533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-04T17:03:48.643939Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-06T18:09:09.900466Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.900466Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ab7505163c42d237681bab36ed1e1949eaf712aa28a504058cd34513e50c2744","observation_id":"c396b57c-ee72-4e57-83bf-541e749a2636","resolution":{"observed_at":"2026-08-06T18:09:09.900466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T18:09:10.031074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.031074Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:da2975866a75c5538e795f68384a8e270567c80b9d1c66039bb6fbe8796679ff","observation_id":"a334d24c-4646-4bc9-894e-1a9fc7635546","resolution":{"observed_at":"2026-08-06T18:09:10.031074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11839","last_updated":"2024-10-07T17:59:42Z","snapshot_observed_at":"2026-08-10T04:03:39.633696Z","submitted_at":"2024-06-17T17:59:58Z","title":"mDPO: Conditional Preference Optimization for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11839","snapshot_observed_at":"2026-08-06T18:09:09.378681Z","title":"Huang, Nan Xu, Sheng Zhang, Hoifung Poon, and Muhao Chen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.378681Z"},"links":{"cited_paper":"/paper/2406.11839","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:99890449c933a53642f2481ac02dddc2464ba218864e4c5ed3049396ab01dfd1","observation_id":"a8db0e4d-af71-4ae6-8e6c-67244ac9b2e8","resolution":{"observed_at":"2026-08-06T18:09:09.378681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12735","last_updated":"2025-04-26T15:42:47Z","snapshot_observed_at":"2026-07-06T19:34:41.712266Z","submitted_at":"2024-10-16T16:51:01Z","title":"CREAM: Consistency Regularized Self-Rewarding Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12735","snapshot_observed_at":"2026-08-06T18:09:10.242420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.242420Z"},"links":{"cited_paper":"/paper/2410.12735","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:a0014561790c9ca0ef26b3bf9abb2598e7037af9e57aa575a88f3444872fd4f6","observation_id":"563b46ce-91bc-487f-8af0-ab6aeb176d77","resolution":{"observed_at":"2026-08-06T18:09:10.242420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.369773Z","title":null,"venue":null,"work_id":"94591e11-404d-43e5-8164-afd5e1f28a05","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:09.817941Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:e1dedc4f0a3116f9d1963c25232b2d1dc18bccb58a6fefd13fcecbdf492e8421","observation_id":"f0052603-68f4-487f-a407-945ff5ca17e6","resolution":{"observed_at":"2026-08-06T18:09:14.419804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.125872Z","title":null,"venue":null,"work_id":"1ab94c2b-d364-4d30-819c-3ca2ed536b72","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.441019Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2e584e98ae0d015f6c423f67615d68b7c3078f4366d588f6ec9f9b747a32926e","observation_id":"e886fdb5-cb9a-4bec-afa8-0bf0f6213364","resolution":{"observed_at":"2026-08-06T18:09:14.162248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15926","last_updated":"2024-10-21T11:54:53Z","snapshot_observed_at":"2026-08-08T00:09:35.155222Z","submitted_at":"2024-10-21T11:54:53Z","title":"Mitigating Object Hallucination via Concentric Causal Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15926","snapshot_observed_at":"2026-08-06T18:09:10.520717Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.520717Z"},"links":{"cited_paper":"/paper/2410.15926","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:000b5eb34a6f270468d7fb2f55304abe4d72ee1469ad36f20737c516b5f970c5","observation_id":"411a568b-4c58-45f2-a6ed-5323307509ea","resolution":{"observed_at":"2026-08-06T18:09:10.520717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18715","last_updated":"2024-06-05T13:53:42Z","snapshot_observed_at":"2026-08-09T07:55:47.071847Z","submitted_at":"2024-03-27T16:04:47Z","title":"Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18715","snapshot_observed_at":"2026-08-06T18:09:10.145870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.145870Z"},"links":{"cited_paper":"/paper/2403.18715","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:e6b8c8b3a04e6bd99c60ba7ef1fec1246788c5f4884b1141d2059dd293f14273","observation_id":"e743edde-d29a-44c7-8718-14b8c0d283f5","resolution":{"observed_at":"2026-08-06T18:09:10.145870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11903","last_updated":"2025-03-08T12:36:34Z","snapshot_observed_at":"2026-08-07T18:12:04.893348Z","submitted_at":"2025-02-17T15:24:49Z","title":"MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11903","snapshot_observed_at":"2026-08-06T18:09:10.674561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.674561Z"},"links":{"cited_paper":"/paper/2502.11903","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:913cf6cdb7c9b94626f5d4c08de457d3068a95a157e2438c42ced3f3715feb37","observation_id":"92ee96e0-4a3f-49f5-9aac-b12393d9a28f","resolution":{"observed_at":"2026-08-06T18:09:10.674561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.210905Z","title":null,"venue":null,"work_id":"56e16f58-49dc-46ae-9353-9d28d7a10b3e","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.346439Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:aabf47130f9504890dec14a40ce8c51760ba5bdae5ae24455e145b5a25a07159","observation_id":"07cbe223-db0a-407a-a553-d73414818924","resolution":{"observed_at":"2026-08-06T18:09:14.297573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.885572Z","title":null,"venue":null,"work_id":"fa5e1c5f-5cbb-47c9-9e8e-4615e2e332f3","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.916123Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d56d0ff1670fd914d82b8f064335074d27aea4de72be1436bf13605a79a31df8","observation_id":"6db15840-a5d1-42f6-a76d-41eece62ede4","resolution":{"observed_at":"2026-08-06T18:09:13.966372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-06T18:09:10.998551Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.998551Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d880d3c9aaec97ec653ed827a7d62bc2446f03e1dc80fce8376b9f9d04618e56","observation_id":"46bbd451-a378-441c-ad19-406afd5b816f","resolution":{"observed_at":"2026-08-06T18:09:10.998551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02712","last_updated":"2025-03-04T00:49:07Z","snapshot_observed_at":"2026-08-09T22:43:34.534202Z","submitted_at":"2024-10-03T17:36:33Z","title":"LLaVA-Critic: Learning to Evaluate Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02712","snapshot_observed_at":"2026-08-06T18:09:10.589173Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.589173Z"},"links":{"cited_paper":"/paper/2410.02712","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:01a693d21a56a8df80e5b344b58da44adb4bf7732cc177176a73f1e2c2cc1754","observation_id":"708e58dd-3871-433a-9b07-054563273b3e","resolution":{"observed_at":"2026-08-06T18:09:10.589173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00849","last_updated":"2024-03-08T06:42:37Z","snapshot_observed_at":"2026-08-08T10:06:17.828993Z","submitted_at":"2023-12-01T11:36:08Z","title":"RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00849","snapshot_observed_at":"2026-08-06T18:09:11.211296Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.211296Z"},"links":{"cited_paper":"/paper/2312.00849","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:a20b3e4bc8d48e27c1f2b4639d5c25f3bebcf17aaac66d1303496dec8d013894","observation_id":"8f808cba-a471-4b70-aeb0-656436b2e9a7","resolution":{"observed_at":"2026-08-06T18:09:11.211296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:14.045818Z","title":null,"venue":null,"work_id":"ddcd499a-69cf-43e1-a4a5-9da7f63d641c","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:10.776242Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ed4696aa0875c83a10d099999bdcb47cdda7a9d0d04fa4b255328100396141e8","observation_id":"0cd6c351-2d75-417f-9eb7-e788722dfcf6","resolution":{"observed_at":"2026-08-06T18:09:14.091155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-07-06T18:35:22.425271Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-06T18:09:11.418491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.418491Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:0f048a5e63d22343432fdb0610daa30b7a89a3f99982b2237dd7201eee7402bd","observation_id":"3b3b67f3-291b-40f7-8796-9667f427ba3a","resolution":{"observed_at":"2026-08-06T18:09:11.418491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.638751Z","title":null,"venue":null,"work_id":"125ca6cc-7f46-42b9-a028-141e1710418d","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.498499Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:5b854abfcd9231ee8e41049474976e532b9cdcce2abd886a3491da6eefffb3b9","observation_id":"3046f952-ebd4-44c8-af68-99b8cccb82e1","resolution":{"observed_at":"2026-08-06T18:09:13.685418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.744791Z","title":null,"venue":null,"work_id":"1f197515-bff7-4bdc-98e8-048b56731818","year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.065192Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1c7dd9fdd575e5677c125bda1237d94dc56f333aa170a721c702405cb1c87569","observation_id":"89422fe3-b9c0-462c-bec1-f882dab904e5","resolution":{"observed_at":"2026-08-06T18:09:13.809146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11422","last_updated":"2024-07-16T06:32:45Z","snapshot_observed_at":"2026-07-06T18:46:56.695142Z","submitted_at":"2024-07-16T06:32:45Z","title":"Reflective Instruction Tuning: Mitigating Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2407.11422","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11422","snapshot_observed_at":"2026-08-06T18:09:13.002512Z","title":"Reflective Instruction Tuning: Mitigating Hallucinations in Large Vision-Language Models","venue":"cs.CV","work_id":"173c99af-6646-467a-9554-1e1d43e52ac4","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.719079Z"},"links":{"cited_paper":"/paper/2407.11422","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:363e294cf5baf8b1a1fcd5b9c1c8a8e98ece01521961873cf6d44cd1679b331c","observation_id":"1e66cf87-d599-48a7-921d-7210abbedea0","resolution":{"observed_at":"2026-08-06T18:09:13.037301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-06T18:09:11.337073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.337073Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:ac47f6eaab4c130806e59236bec5b2420b25f03f40c29368843867bd0af5e491","observation_id":"30459bec-247f-4e65-bbad-a03dc65153d9","resolution":{"observed_at":"2026-08-06T18:09:11.337073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-07T09:15:02.322742Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-06T18:09:11.917632Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.917632Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:88bb20d987c6940c26b0172d5a84fc273cc7d42cb9500bb4d8a4166cb8f0af05","observation_id":"d01f3afc-539a-41da-ae2a-b9f69b3bb80b","resolution":{"observed_at":"2026-08-06T18:09:11.917632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06579","last_updated":"2024-10-17T01:17:25Z","snapshot_observed_at":"2026-07-06T18:28:20.634381Z","submitted_at":"2024-06-04T13:52:54Z","title":"From Redundancy to Relevance: Information Flow in LVLMs Across Reasoning Tasks","version":3},"cited_work":{"arxiv_id":"2406.06579","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06579","snapshot_observed_at":"2026-08-06T18:09:12.902725Z","title":"From Redundancy to Relevance: Information Flow in LVLMs Across Reasoning Tasks","venue":"cs.CL","work_id":"dc5f0ca8-ca7c-47a3-a484-cbd37d9f82b4","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.046604Z"},"links":{"cited_paper":"/paper/2406.06579","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:b1a87002df227934949cffb1c70898e4c08a6736f77cbaf1dc93de7e0f3fc12b","observation_id":"dd20abaf-9c03-42fb-8614-74593012eb15","resolution":{"observed_at":"2026-08-06T18:09:12.932697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-07-06T15:38:39.712379Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-06T18:09:11.588609Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.588609Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:04c1db4d2895e2a419b250cedf3b157c102b3b1e63753db542b32dbea83eecae","observation_id":"53e7fa6d-e143-4f36-aa72-3690680403f5","resolution":{"observed_at":"2026-08-06T18:09:11.588609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.400633Z","title":null,"venue":null,"work_id":"67e5490d-ed27-4bc4-9bd1-401b9a41b0e2","year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.225814Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:6cb86bbb04d9e6280fb6b50873ce9685bad5e2a44c756e8dd2da0d75029cabcb","observation_id":"76c7d8a6-a913-4400-8967-34ebb786dca1","resolution":{"observed_at":"2026-08-06T18:09:13.449450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03601","last_updated":"2025-06-12T00:15:18Z","snapshot_observed_at":"2026-08-07T18:00:59.339869Z","submitted_at":"2023-07-07T13:43:44Z","title":"GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03601","snapshot_observed_at":"2026-08-06T18:09:11.814271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.814271Z"},"links":{"cited_paper":"/paper/2307.03601","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:bb3b7bd2b7cc9c54f52bf9103c70e57a2bd1e87e351b112144666fe69ceb2cd5","observation_id":"51643b6c-c484-4f9e-8a29-d8079c653794","resolution":{"observed_at":"2026-08-06T18:09:11.814271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14622","last_updated":"2024-11-02T02:51:51Z","snapshot_observed_at":"2026-07-30T21:22:18.339303Z","submitted_at":"2024-05-23T14:30:33Z","title":"Calibrated Self-Rewarding Vision Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14622","snapshot_observed_at":"2026-08-06T18:09:12.392099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.392099Z"},"links":{"cited_paper":"/paper/2405.14622","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:faa51b5172d3288483ed8f575de674bf8499d55e58f175773d68f2e4afaabea6","observation_id":"b6aaca34-97a0-4a9e-a37e-973914438421","resolution":{"observed_at":"2026-08-06T18:09:12.392099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T18:09:12.489350Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.489350Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2ffda106ff8ce0e56ddbdff35161d409e21d521059141d13e3b79cb9ecd3db45","observation_id":"bf184da4-4f7d-41da-86fc-545c081ffa3d","resolution":{"observed_at":"2026-08-06T18:09:12.489350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:13.526225Z","title":null,"venue":null,"work_id":"571d7932-0d62-471e-bbf1-0e81c69367a5","year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.143697Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:2645ea699a587e2ae87508f5fe580001cbfff23dcf560df17e36a05d6a622a5d","observation_id":"11926a68-755d-45a7-86f0-458ee677f19f","resolution":{"observed_at":"2026-08-06T18:09:13.565406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-05T12:32:26.990966Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-06T18:09:12.654015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.654015Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:cde1f941967f29b4d9cf868bdffe8f5e2225d1e16dd38466a63ee023581337da","observation_id":"6cf7bf70-5853-428f-80e8-95f8bf768da5","resolution":{"observed_at":"2026-08-06T18:09:12.654015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-06T18:09:12.304104Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.304104Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:cd7511e02d0a531eac50577ba9daa99caa63f6d1225985e2c4808a5fb2ad2ba5","observation_id":"5536d1b1-88aa-4703-8df5-96e920f57a79","resolution":{"observed_at":"2026-08-06T18:09:12.304104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18476","last_updated":"2024-02-28T16:57:22Z","snapshot_observed_at":"2026-07-06T17:36:56.979448Z","submitted_at":"2024-02-28T16:57:22Z","title":"IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18476","snapshot_observed_at":"2026-08-06T18:09:12.583205Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.583205Z"},"links":{"cited_paper":"/paper/2402.18476","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:1d7506f227f9e7708464fd5f2b95a813a8cc60b64a3d837fa48aae0d7f6bad4a","observation_id":"edae4f2c-96c7-4d3d-9a0a-0d0d4ee61267","resolution":{"observed_at":"2026-08-06T18:09:12.583205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:12.703445Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.703445Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:d0d0a94b4f39d39bec50712b44d320c639964f699910c8d5e518d8b6c8f9a3d3","observation_id":"e3f35456-f795-4df4-b3f2-3947d9e951fd","resolution":{"observed_at":"2026-08-06T18:09:12.703445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:09:05.239502Z","title":"International Journal of Computer Vision 127 (2016), 398 – 414","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:05.239502Z"},"links":{"citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:3d9c352111d629b61c9a45cb401bac3c5f013e7e1d937336691eca7bc9271a6f","observation_id":"ad44aed1-9d8f-4444-96f7-7175fad57f12","resolution":{"observed_at":"2026-08-06T18:09:05.239502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05337","last_updated":"2024-07-26T15:49:31Z","snapshot_observed_at":"2026-08-10T04:03:08.007654Z","submitted_at":"2024-07-26T15:49:31Z","title":"VACoDe: Visual Augmented Contrastive Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05337","snapshot_observed_at":"2026-08-06T18:09:06.394893Z","title":"ArXiv abs/2408.05337 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:06.394893Z"},"links":{"cited_paper":"/paper/2408.05337","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:59ece2989f75f2dc61de1840222a0f2bfc16fc43fa31a05c5a6146c34df5c0ae","observation_id":"f69c65f3-fa10-4de4-b0a9-bfaeec53e372","resolution":{"observed_at":"2026-08-06T18:09:06.394893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":86,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 2 inbound Pith citation observations for arXiv:2507.09184."}