{"as_of":"2026-08-11T19:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26c763eb62fab8d145c259b9ad5c68077ea772bd0f663ef6950b77d545135006","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T05:03:24.950836Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:32:13.571729Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.20965","snapshot_observed_at":"2026-08-04T04:32:13.571729Z","title":"Accepted at the 43rd International Conference on Machine Learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04683","last_updated":"2026-08-04T11:53:54Z","snapshot_observed_at":"2026-08-07T23:11:40.635167Z","submitted_at":"2026-07-06T05:11:45Z","title":"Failing to See or Failing to Know? Attributing Errors in Vision-Language Models","version":3},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T04:32:13.571729Z"},"links":{"cited_paper":"/paper/2605.20965","citing_paper":"/paper/2607.04683"},"observation_digest":"sha256:3126415807683ccf4eb02bcfcf913f804e9f85a297f9f6c45277442bffc5e0a7","observation_id":"3f711ddb-7c26-45cb-82b4-96b8566223d3","resolution":{"observed_at":"2026-08-04T04:32:13.571729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.20965/citation-record","integrity":"/paper/2605.20965/integrity","json":"/paper/2605.20965/citation-record.json","paper":"/paper/2605.20965"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , pages =","venue":null,"work_id":"eb3a23c2-32ee-42ed-aa71-baa9a6f3c070","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:bb7d14f95f5c65ee0a0c0b0fb4737faa82e97953ae97f80ea2f9195a03445907","observation_id":"5addce12-de5d-4551-b6fd-3a5fb7e36ef2","resolution":{"observed_at":"2026-05-21T05:03:58.318495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"5b75839a-9e32-4a8e-b6a1-079fc4dd9046","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:14257af5bfd1098c3fbdac60513d88cc2d603201d46dbd06e0a58e967b556390","observation_id":"50bad945-8ea6-4d02-887f-3e3c34d27c35","resolution":{"observed_at":"2026-05-21T05:03:58.398625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Twelfth International Conference on Learning Representations , year =","venue":null,"work_id":"1fac9a73-d250-4fcc-b4b2-dcd80413c968","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:063c9da7f30e5ea1f14c5ec09c6494b61818b069759a19cc1c16d9135340a8c7","observation_id":"39d2979b-1e1d-4f66-903e-b7a90ba0f2e6","resolution":{"observed_at":"2026-05-21T05:03:58.457717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LLaVA-NeXT: Improved reasoning, OCR, and world knowledge , url=","venue":null,"work_id":"2e7beab3-9cb9-4396-b148-3504d86fa624","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:877324220b81166dd351fd5605a702de36d7a9f62ce2d0f048f6aa20b0ddf9ed","observation_id":"4cffa676-7f1c-4001-bb1c-7761a4dbf32c","resolution":{"observed_at":"2026-05-21T05:03:58.403057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Thirteenth International Conference on Learning Representations , year =","venue":null,"work_id":"ab75c1ba-5a58-427d-8fd5-655bd6c5b562","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:fd8e80686beceef94949756a03d455b1ef72e0b6b783c360468e01584c87ada2","observation_id":"8d9df3d1-6fc3-4a3d-86b2-a613c44266b5","resolution":{"observed_at":"2026-05-21T05:03:58.332235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Twelfth International Conference on Learning Representations , year =","venue":null,"work_id":"232f0bcb-b834-4aac-bdc5-790f19bcf246","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:8f7b3f4dfd4f146063de8bee76338d8b4c19e8c7a5b0b62a65da9d1c106bba84","observation_id":"91bfb8b9-9a69-4a26-ada7-207a33415392","resolution":{"observed_at":"2026-05-21T05:03:58.334062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the","venue":null,"work_id":"a57e56ff-6d0c-47c0-8246-898db4bfb4b7","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:f61d119a01498a7f0709df274ec222b0ffb7509b3d056c4536494215a23655f1","observation_id":"2e3bf15f-ca86-4d88-a4c2-bb5e822fdfba","resolution":{"observed_at":"2026-05-21T05:03:58.339443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"b88ce55b-1d08-402f-891a-7e0791624aec","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:8522504daf49f89afbb43de3354f12fc647d12b33bb6ff31bfbd3c68768caff6","observation_id":"935e1f9a-8d0d-40c9-ba8b-74159cd77a5d","resolution":{"observed_at":"2026-05-21T05:03:58.345504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the","venue":null,"work_id":"73afd59a-6873-4dce-87d9-811b595985da","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:cc0c18bc3e023cbd7f0fce3da64f99e5d4fb3d1fe59d7e914544053231a5401d","observation_id":"ed004046-de83-44bd-8694-ee70e2e8e32c","resolution":{"observed_at":"2026-05-21T05:03:58.380981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Stepputtis, Simon and Morency, Louis-Philippe and Ramanan, Deva and Sycara, Katia and Xie, Yaqi , booktitle=","venue":null,"work_id":"b953eb74-888f-416d-92bb-41aed4a528ca","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:651d7331b1b4ae3025fe0644c744edde15ee05aac143e1ed02b65af0221d79c0","observation_id":"8287beee-582c-4b5c-9ca9-61b5e622433e","resolution":{"observed_at":"2026-05-21T05:03:58.335677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the","venue":null,"work_id":"ad97b1c7-8783-4dba-ad2c-ef606ba197f6","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:19b8f7044e865031cdf7b44368149d29013879f9c89334a57429c4f3d5af89ff","observation_id":"78a339ed-f7ec-4aed-8638-f92a3b06067b","resolution":{"observed_at":"2026-05-21T05:03:58.322218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 42nd International Conference on Machine Learning , pages =","venue":null,"work_id":"cdb08878-1589-4c79-8712-38487c058fa2","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:2c2a5e44e34b744bc8528ab4427d833fb5bde09a9225210bdd0b5f0912590d3e","observation_id":"504e346c-dade-463c-935e-148dc1f7469b","resolution":{"observed_at":"2026-05-21T05:03:58.434620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cracking the Code of Hallucination in LVLMs with Vision-aware Head Divergence , booktitle =","venue":null,"work_id":"ea30b7f8-7567-4e3f-8535-dd8ea20fafff","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:95473f68b1c3a08b24829985f3d63b5f7cfa9e1beab7df22860f040c1b4e129c","observation_id":"1980b34f-26d1-4a36-9d6a-59643052af80","resolution":{"observed_at":"2026-05-21T05:03:58.418525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"1df756e1-9b42-48c2-b30c-3ef2e554f3d2","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:794c2eb94f22c8bb5b662b2f37b0acf0cd46347bd6b8cc45c52c9b507a254fdb","observation_id":"66b26d5f-def2-4633-bf10-01d09e6063d6","resolution":{"observed_at":"2026-05-21T05:03:58.395109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Steering LVLM s via Sparse Autoencoder for Hallucination Mitigation","venue":null,"work_id":"a3bef51b-c7ae-4e35-8480-ee4437430c68","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:100e95749300adf1babd8b54718c862fde5ad63e907fee0ca653434f04607583","observation_id":"cb297a53-8c2d-453f-8378-d3aea84aa0c4","resolution":{"observed_at":"2026-05-21T05:03:58.391041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":"8ca4f2e8-2c43-4a45-bf50-f547d397c7b7","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:de7f98da9aa858c41e77b7b4d87e3de2a5592242ecd735c0513158f17ce5ef6e","observation_id":"ab399c63-0588-4300-8910-ca7ee4fd7b33","resolution":{"observed_at":"2026-05-21T05:03:58.388972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Science China Information Sciences , volume =","venue":null,"work_id":"e65652a9-47e6-442e-a396-2669dbe2870e","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:9540cb372189a4b1046e897035ad478a6910e25a93bf845ce05ad988034018f2","observation_id":"5211e989-f6b6-42b7-a49b-befae56d8a76","resolution":{"observed_at":"2026-05-21T05:03:58.400649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shallow Focus, Deep Fixes: Enhancing Shallow Layers Vision Attention Sinks to Alleviate Hallucination in LVLM s","venue":null,"work_id":"06c0e83a-42b8-4fa5-a520-529768dfee07","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:5a0e309a0c826917a09a6310faedfdc814b927b4262826a70b9a0a7bcee2ab56","observation_id":"e5797cd2-9d7e-4ffa-a075-05597709da91","resolution":{"observed_at":"2026-05-21T05:03:58.451785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-Introspective Decoding: Alleviating Hallucinations for Large Vision-Language Models , year =","venue":null,"work_id":"a849c8ea-daf8-4651-bd9c-79893578ab1f","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:f39ce3c117c2ad48b3901c85f4e397484d227019704bb1efa899e0400a26507d","observation_id":"72fbf803-3074-475f-9908-80cc27541cc0","resolution":{"observed_at":"2026-05-21T05:03:58.371506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seeing Far and Clearly: Mitigating Hallucinations in MLLMs with Attention Causal Decoding , pages=","venue":null,"work_id":"7144f3a4-cf2a-4ac5-8b68-c4b14655b5ec","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:a2fa903d58b8b6cbb621ffe94c021a15e15defe5f6ee7207472be48b8934b2c9","observation_id":"ffaedc10-4729-4c95-8696-da771b018882","resolution":{"observed_at":"2026-05-21T05:03:58.373490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VQAG uider: Guiding Multimodal Large Language Models to Answer Complex Video Questions","venue":null,"work_id":"9e5fcb7e-e154-4d38-be3c-7e92a8c4c059","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:aac9bcf383a52601303e26f5c63405e22c18e1ce0e8329ce259d7b237251082a","observation_id":"6dddc3dc-745e-436d-b0d0-78e81dc29974","resolution":{"observed_at":"2026-05-21T05:03:58.396981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding Multimodal Large Language Models to the World , year =","venue":null,"work_id":"3879205b-fb57-4b03-9ccc-5f5e9fdef5ec","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:874cb1177a58483bac69a994ff9b02443300a3a6c78ebb81f01272ef9979c8dc","observation_id":"1391780a-ca82-4ed9-b8c5-6f2414782cd9","resolution":{"observed_at":"2026-05-21T05:03:58.442741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"33924558-51ff-4538-9aa2-b955dbc63001","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:1f6525c58bf120853996292e72ba46d14488904d88a4696bd169cce9c5cb3ad1","observation_id":"53b95153-fce4-4fc0-8feb-4d1ea4970e49","resolution":{"observed_at":"2026-05-21T05:03:58.367467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object Hallucination in Image Captioning","venue":null,"work_id":"1ae4f957-1117-40c6-a9ce-7c262f7903ca","year":2018},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:eb03245c1230d585f650ffe14bf717a4c6699538f1280519b2f5a76fdd27f853","observation_id":"790534c1-189e-431f-b124-2e97265eddd2","resolution":{"observed_at":"2026-05-21T05:03:58.429067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","venue":null,"work_id":"e2e260e7-45fe-4a58-840b-9d1fc77e551e","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:9e29b8032abc7f010ff501b249764e8cb6863a0a9e394711ed3d4d6e01a0e554","observation_id":"0b4e52e8-0972-47b0-9d19-40025a99f77b","resolution":{"observed_at":"2026-05-21T05:03:58.426580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","venue":null,"work_id":"390610c8-6149-457a-add6-3ee361caf464","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:09801bee6a57f331aca17dd699946ebcdff6d792495400b70aafe4d1de4560e6","observation_id":"6e538687-242c-4fc7-9f21-6ea76a28a7dd","resolution":{"observed_at":"2026-05-21T05:03:58.365702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved Baselines with Visual Instruction Tuning , pages=","venue":null,"work_id":"d37d5344-07f1-49fe-a0a0-7cf8cc358eb5","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:4348b3ea8a7692e1fc5bdc09eaa67d367f77a901aa71afdf34492b7e935c8d47","observation_id":"81e10910-ea46-47d1-b38c-de0cca28abc8","resolution":{"observed_at":"2026-05-21T05:03:58.369661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lawrence","venue":null,"work_id":"6b20a612-ef0d-4f13-8a6d-bee70b65d358","year":2014},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:21c62373b0791432254a913929dd20d270b964ba5f600b9ba2255106d0dea519","observation_id":"b70591cb-b77f-46c8-9ab1-d9298cf6aa43","resolution":{"observed_at":"2026-05-21T05:03:58.377395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , booktitle =","venue":null,"work_id":"669de5b9-29d3-4234-aeed-6290006fa5c4","year":2022},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:ab2fad8a444a524673d743d3e79d5629b7bbc37401df4facbb49c73dbf0c7aed","observation_id":"9397b85a-edb2-4fea-9b14-331e482f5fb7","resolution":{"observed_at":"2026-05-21T05:03:58.337843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:36:22.166345Z","title":"and Manning, Christopher D","venue":null,"work_id":"a99094ba-308b-444b-8308-163731bf728b","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:fb6301e82339cd8e556975d8f83e78310a4b018b242721bc4b20ce3369ee6866","observation_id":"4471b5f8-30fb-4bb3-b656-fd2bbdad13f7","resolution":{"observed_at":"2026-05-21T05:03:58.359523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the Thirty-Ninth","venue":null,"work_id":"0884a7e2-fcd4-4274-8c1e-1f910d836959","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:3cda75d3f7d15a66ff889e68040825968d594424cae481805749ecd9ffe27068","observation_id":"bd4d8531-5ef8-43d2-ae14-176f7aafa71f","resolution":{"observed_at":"2026-05-21T05:03:58.361171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DAMRO : Dive into the Attention Mechanism of LVLM to Reduce Object Hallucination","venue":null,"work_id":"c1cca735-0270-41f8-882a-4ee28f7c8169","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:014502ed827e740024b741132b7236ec91141a97f871a7b19d60a46ce0dc721f","observation_id":"3092540f-5dfb-48bc-ad2f-acea838f65c4","resolution":{"observed_at":"2026-05-21T05:03:58.363807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 42nd International Conference on Machine Learning , volume =","venue":null,"work_id":"ca645bbf-2e5b-437c-a626-45b0a798c8ac","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:97d2086b8ecb110a4136624e4986f95209d5610002d70aaedc9ca19422daa82d","observation_id":"c305203f-7bbf-4694-98ca-c8e000649096","resolution":{"observed_at":"2026-05-21T05:03:58.379271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I mage I n W ords: Unlocking Hyper-Detailed Image Descriptions","venue":null,"work_id":"dd31f9c7-8d45-46ab-b684-960c6d9eabc7","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:9a96ccf36d9dfd4c603bd5d8923dd2a76f926cbc89057b57ede5c50baf4ad949","observation_id":"e3ae1760-548c-4bfc-9cf1-3d6836fea397","resolution":{"observed_at":"2026-05-21T05:03:58.440783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Petryk, Suzanne and Gonzalez, Joseph E","venue":null,"work_id":"137f8930-b2c5-4238-8680-f79b0fb1bd9e","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:6a64d55296a51bc1139fb052671bc9df63fe7a37e1e36c041c05c02749766f89","observation_id":"faad4691-b282-4b5a-8146-cb5f2cd13068","resolution":{"observed_at":"2026-05-21T05:03:58.383378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Kachinthaya, Anish and Zou, Haodi and Canny, John and Gonzalez, Joseph E","venue":null,"work_id":"e9a66d29-9113-4f7e-a194-d1bf86aa20b1","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:50245c6db439475f7c311b86239f0efe946fe83ff78e4b0a0e14c083c0eeb3b8","observation_id":"e903a601-5fca-40c4-8797-0e5b086497e3","resolution":{"observed_at":"2026-05-21T05:03:58.341665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the Fortieth","venue":null,"work_id":"ad742c1b-e4df-46eb-b949-b94d5beb06db","year":null},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:1bbdbc3ecb117b4fc1e2170da3c7b212e624b3421934888378c7647a19a8a693","observation_id":"d2de85e2-1b1a-4a2d-b1d1-9b204fbcd16f","resolution":{"observed_at":"2026-05-21T05:03:58.353491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating object hallucinations in large vision-language models with assembly of global and local attention","venue":null,"work_id":"21e6a4c4-70e2-427b-9fc8-12851089d294","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:02cce594aa6a3120be88679aa06a76189e3789d229961d398fe664ecc633352a","observation_id":"cdda3410-c3f5-4d45-b264-f44f57783833","resolution":{"observed_at":"2026-05-21T05:03:58.355134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:43c2d57abca14c44ba30302686cd5c9f62dc72162c2cab5fe859f4b6b1e27a5b","observation_id":"89fb5d30-e96e-41f6-a8d6-113fa2008dfb","resolution":{"observed_at":"2026-05-21T05:03:57.748585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., Petryk, S., Gonzalez, J","venue":null,"work_id":"d6586eeb-f701-453e-a89a-7003c4a0c15c","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:425e59ca88a04658986f84548ac3defee51048d5fad75dc3d392acb61b502761","observation_id":"b0cc244c-5a35-4b54-b35e-a4de574eeab6","resolution":{"observed_at":"2026-05-21T05:03:58.349350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VQAG uider: Guiding multimodal large language models to answer complex video questions","venue":null,"work_id":"336101ad-2563-494c-835e-6c38487c5b29","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:bfc19cdac72c831ac6295cd5f0235aa38b2aa7a6c8df071e5ad13219f1be0972","observation_id":"b2157b1c-65b9-4d55-9171-ecf14829c648","resolution":{"observed_at":"2026-05-21T05:03:58.351014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alphaedit: Null-space constrained knowledge editing for language models","venue":null,"work_id":"6ebffa21-05fc-458f-b492-f68c13628b7f","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:1b569d442e13e27c9b6b007697c867bb6210723c70c29b6434134dda356004fd","observation_id":"c398ac7f-a14b-4893-b0fc-dea7ba50ad6e","resolution":{"observed_at":"2026-05-21T05:03:58.347169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":"2306.13394","doi":"10.48550/arxiv.2306.13394","metadata_source":"pith","pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-07-10T13:27:05.561984Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":"cs.CV","work_id":"806d2e73-71b3-4d56-87e0-39d571cc15d6","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:38410fca540457486538f20b31c3af410562931e5596d05188459d0df1559151","observation_id":"4126e6e4-216b-4dff-8482-0cfaa9c1e668","resolution":{"observed_at":"2026-05-21T05:03:57.738260Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.033703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.033703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., and Soricut, R","venue":null,"work_id":"e53c15d2-ec2b-4123-af0b-4faea544e635","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:2d38ea865b2f4a4065a1b7894b14beec63f0c9fd0ebf9d3f12b6c325388cbb0a","observation_id":"70f5342e-0676-404a-a140-4610b69f09dc","resolution":{"observed_at":"2026-05-21T05:03:58.357503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DAMRO : Dive into the attention mechanism of LVLM to reduce object hallucination","venue":null,"work_id":"c66c061d-64b2-4487-8700-e68f91856eaf","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:9ffe42386fb384f10d14be2b7809157e770e62f1138bed080891468e809bb081","observation_id":"28f55735-5886-422e-b163-3ce57e23dba3","resolution":{"observed_at":"2026-05-21T05:03:58.385178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cracking the code of hallucination in lvlms with vision-aware head divergence","venue":null,"work_id":"92265cee-e354-4eee-8f4e-45ca9bc4abab","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:075bba46f1d3af9144d721656a24dc8d624d8d7077db7090325209808d75235f","observation_id":"e1f86604-f1f5-4c7e-bc5f-d6422986d9d5","resolution":{"observed_at":"2026-05-21T05:03:58.343307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Steering LVLM s via sparse autoencoder for hallucination mitigation","venue":null,"work_id":"2d6e213f-2247-4044-8d92-7974d2bf1242","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:d931acaca3600d8a535eea3f1d36b7e36b5445756010f080adbdaf1e0d6010ea","observation_id":"d23ccd14-82a8-45b2-be05-8a760429e054","resolution":{"observed_at":"2026-05-21T05:03:58.387306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Medical mllm is vulnerable: cross-modality jailbreak and mismatched attacks on medical multimodal large language models","venue":null,"work_id":"f0381d94-3592-42c4-a55f-0cffa5ef1448","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:c9b062ca95dae8899d5f8f9837eaac1f526083933bb0f8b68f738f38c3c32cea","observation_id":"a95b11c6-4557-4ec7-a21f-4e5805f217c1","resolution":{"observed_at":"2026-05-21T05:03:58.324582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-introspective decoding: Alleviating hallucinations for large vision-language models","venue":null,"work_id":"3162b6b9-82fd-4905-a191-7d3ab38df2ca","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:729d1f18333b402f59cea5c2ff19db98e61d337d3effc882686d8fb88de78b9d","observation_id":"e6a8e62e-319c-4340-aa9e-363ae9b81953","resolution":{"observed_at":"2026-05-21T05:03:58.328425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual attention never fades: Selective progressive attention recalibration for detailed image captioning in multimodal large language models","venue":null,"work_id":"f17f9e0d-59b8-49a1-838a-9a8634980c4a","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:d146ffc0eb901ca2d36e3537728dfa778bd34bc68a6d051738fd6aa68c957fa7","observation_id":"d33e5ccc-2979-4a59-a55b-20b74ef2d5e7","resolution":{"observed_at":"2026-05-21T05:03:58.326282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"09d23dcf-adb5-47ca-bfa9-f839b4019ab5","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:d6b14174f34aed9f5fc9199261b9602f9eeff92660b81d5e677b5c8a860c83e5","observation_id":"21db0c55-76dc-4b0e-b73d-406381d4ca73","resolution":{"observed_at":"2026-05-21T05:03:58.329914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"707a0ebd-8ca7-4286-8b03-b5146fa90c8b","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:95ca0e5d4e07d4e9f1fd5f0d321e33123765a5f690adcf8c4a760e802151a272","observation_id":"ccd35b3d-dd12-47bf-958a-3aa4ca362f3d","resolution":{"observed_at":"2026-05-21T05:03:58.316984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toward robust hyper-detailed image captioning: A multiagent approach and dual evaluation metrics for factuality and coverage","venue":null,"work_id":"fee45cc4-728d-4d95-807e-e574fdb1ddb6","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:7cebff3593477cbcde5c6ff486a6a4b02fd09eaec869cb4a887f9c63e024e370","observation_id":"d9c06841-2fa7-4a9f-a9fa-e3a3ae41fa2f","resolution":{"observed_at":"2026-05-21T05:03:58.453880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating object hallucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"eaf467ef-8365-4b41-9e6b-876713d7722d","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:5ce967986afd293c4ae1305b88a02ffd9a1e15b46e7dbd2d41843d70e67d3696","observation_id":"65f76eba-441a-43be-9a2a-dee7dbfb3447","resolution":{"observed_at":"2026-05-21T05:03:58.448049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":"912abf87-79f6-43a8-bb69-f473a7d00484","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:da01b2c4af2906d350f8542538fae0f74eb02969b6095d5eab63477db401e39b","observation_id":"5611ff2c-db40-4053-9037-4c2a449532fa","resolution":{"observed_at":"2026-05-21T05:03:58.446225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4c367a1d-48cc-4491-8563-c1c880026839","year":2014},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:4fe448ce0f1c819ca186bf4b01d69864bfccd819627ef3c3e3f5bbc1e026fcde","observation_id":"514cee3d-1ec6-41d6-8a00-4635478dd8ae","resolution":{"observed_at":"2026-05-21T05:03:58.444294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5cfc23bc-d268-4718-a8b3-5eff2fe1f694","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:942fc7da7cf67fbd275d1b0ec6292a48f306ba781e3cf80eebe79218411fac02","observation_id":"2232bbb1-d5bc-45de-9302-1baac210546b","resolution":{"observed_at":"2026-05-21T05:03:58.320541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b3715aab-6171-4b73-9415-3904959e0e8d","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:223f3174d066b89dcf0c0e9c7232e74c0776e24efef85c578f59bc62c1c134f8","observation_id":"b5ec508f-dde1-4cac-88a1-aa4d80316f42","resolution":{"observed_at":"2026-05-21T05:03:58.392435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a04a67f1-8633-4210-b7a8-f123dc9436ee","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:3f20e9e2ad3ba4e4e3101fddc015dc33bc7bd299d773b604ccee3116b4405c1a","observation_id":"f3f30ad8-af11-4550-b6ce-c53cbbb6a042","resolution":{"observed_at":"2026-05-21T05:03:58.450098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-08-11T03:31:28.001151Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2402.00253","doi":"10.48550/arxiv.2402.00253","metadata_source":"pith","pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on Hallucination in Large Vision-Language Models","venue":"cs.CV","work_id":"d92dd1ae-69e1-403f-a254-307f138cf24f","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:79985e999325db8b7a09a627defb66e7121269655d7085f8bc56f619d4ebf8a1","observation_id":"a119bb20-2032-438a-90eb-c3df165bebe5","resolution":{"observed_at":"2026-05-21T05:03:57.742123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T22:53:40.09616+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T22:53:40.09616+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding multimodal large language models to the world","venue":null,"work_id":"4fe2148b-1dcc-4a5c-b21e-c47eb95fe69d","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:3a1e91962911e1d8a8627ee4272b56fb85faef836c65723f492f80529844eb05","observation_id":"a4f459f3-71a8-4f03-8744-af9db3515c86","resolution":{"observed_at":"2026-05-21T05:03:58.438467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., Kachinthaya, A., Zou, H., Canny, J., Gonzalez, J","venue":null,"work_id":"ffe8b37d-8c8b-466e-95d6-4601099679ba","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:5f35c39e04abd1f50326af7dba47f336c0c075b12ed8e9230b2f3b0f3ee85ab9","observation_id":"f493d763-1250-49de-b949-7206cd367d85","resolution":{"observed_at":"2026-05-21T05:03:58.432476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A., Burns, K., Darrell, T., and Saenko, K","venue":null,"work_id":"ea759fc8-56bd-4d43-8116-bd97365ec191","year":2018},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:4704ca633ba9664060ebb8f2639f2d7282cea8834064ae5d8f1df6e0e4486ffb","observation_id":"4cd863a7-e8d8-4514-a740-1977e656f6b8","resolution":{"observed_at":"2026-05-21T05:03:58.430537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aligning large multimodal models with factually augmented RLHF","venue":null,"work_id":"1c7adb23-e3f7-4f79-b2a7-f202fd442e00","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:e8dce18bd4d44f74552845978b9ab7703f5ae25f0d68640ec0ed50e533b7b854","observation_id":"d32622f5-ce42-4a56-a452-ac5d5edcf060","resolution":{"observed_at":"2026-05-21T05:03:58.436788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seeing far and clearly: Mitigating hallucinations in mllms with attention causal decoding","venue":null,"work_id":"89002c35-9a86-44c3-92ba-83e25c2c239c","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:7e91cca89c3fe2e48b8ae9b55cf9fa41e451ff6a52007b2770e96f46141bfb27","observation_id":"fcaa1e07-ac44-4d02-96ed-b11f23810162","resolution":{"observed_at":"2026-05-21T05:03:58.421893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Q., Stepputtis, S., Morency, L.-P., Ramanan, D., Sycara, K., and Xie, Y","venue":null,"work_id":"f12a3df6-1cbc-443a-917f-009b3b7e24b6","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:1e5fcd21f17a53ab5b7dbdfe801052337dfa19af2a3c8fd8cc20883ed747ea9b","observation_id":"95f92f49-2ca6-4105-808f-b2684e93a568","resolution":{"observed_at":"2026-05-21T05:03:58.425527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:5b6d92e1f10d0a5c4b8cac01cc7f0da8ea6ec7742389dc63cc3710c34b8bb3f8","observation_id":"92aa281a-8177-48dc-a630-c45c51970597","resolution":{"observed_at":"2026-05-21T05:03:57.751902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02677","last_updated":"2023-07-06T13:47:21Z","snapshot_observed_at":"2026-08-10T19:28:39.434196Z","submitted_at":"2023-05-04T09:48:22Z","title":"Caption Anything: Interactive Image Description with Diverse Multimodal Controls","version":3},"cited_work":{"arxiv_id":"2305.02677","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.02677","snapshot_observed_at":"2026-07-11T03:17:52.015044Z","title":"arXiv preprint arXiv:2305.02677 (2023)","venue":"cs.CV","work_id":"7f81b251-96b7-4734-b21d-5e91e59106a4","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"cited_paper":"/paper/2305.02677","citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:2e0013db385b6cf7d0a2329c95ebf6d092e40456c4972fca25d9202bc583b907","observation_id":"16014604-876e-4b5f-80b8-b8a1dd9c0bd2","resolution":{"observed_at":"2026-05-21T05:03:57.755094Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ESMC: mllm-based embedding selection for explainable multiple clustering","venue":null,"work_id":"7064d79d-ee79-465a-84ea-b04bfd9127e1","year":2026},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:f0a989d7e6ea4aed7b3f0e6098f5e07885ae401e7cf0baba6683464c7ae54313","observation_id":"d92bad9c-2be4-4b9a-9b6f-5ec1ec8371b9","resolution":{"observed_at":"2026-05-21T05:03:58.414695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clearsight: Visual signal enhancement for object hallucination mitigation in multimodal large language models","venue":null,"work_id":"a71f25e3-14db-4959-8e66-7c5ec377cb4a","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:cb61c3093af27657df66fdc19c90b28c67361f6a8b5296669e5af58336546079","observation_id":"1f187497-832e-40ef-a976-584a7f91a835","resolution":{"observed_at":"2026-05-21T05:03:58.408584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Woodpecker: Hallucination correction for multimodal large language models","venue":null,"work_id":"d7dc4ad0-daea-4b46-bd1f-f184df30ae63","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:885f0115528a95378f68bc7e771b38559cfd37bf2d86ecb5b8b8483e7eb555c5","observation_id":"402abc82-d652-49db-9f8d-9969e5da4902","resolution":{"observed_at":"2026-05-21T05:03:58.406837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rlhf-v: Towards trustworthy mllms via behavior alignment from fine-grained correctional human feedback","venue":null,"work_id":"8b5e32ea-50ff-46c5-8598-e43230d231cc","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:a0160a5886888d343d006fd1d6f8bda2fc9208d9dcb822dfaf34197d7283d116","observation_id":"2492f909-13b7-4f33-801f-a7cc989d3a0f","resolution":{"observed_at":"2026-05-21T05:03:58.410824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tell your model where to attend: Post-hoc attention steering for llms","venue":null,"work_id":"d61d2845-f549-4716-8b26-ba4e6eb3d1b7","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:2924159780ad773da2836b9b6ce6eaa5c007457e4541e79aa42bd83a92a0e9db","observation_id":"fae9d251-beab-4c99-b0e6-3c941a492d8b","resolution":{"observed_at":"2026-05-21T05:03:58.412509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vldrive: Vision-augmented lightweight mllms for efficient language-grounded autonomous driving","venue":null,"work_id":"b961d7e7-d383-44eb-9ee1-15caeecd5f65","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:8bdbede97c0fefbc06a9da6460143f3ec5179d9a347df447436172114a427bfc","observation_id":"0834bdec-3428-4757-9062-a80d52918982","resolution":{"observed_at":"2026-05-21T05:03:58.404765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shallow focus, deep fixes: Enhancing shallow layers vision attention sinks to alleviate hallucination in LVLM s","venue":null,"work_id":"0099d715-4eb1-4721-8b24-cdf014d242e8","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:1f923b21283ab30e0c0d441d1b47ed5af363314002c90078367b3b149cc62183","observation_id":"e11059bf-75a1-4f27-815d-1a16835d44ed","resolution":{"observed_at":"2026-05-21T05:03:58.416394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-08T04:17:23.797697Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":"2311.16839","doi":"10.48550/arxiv.2311.16839","metadata_source":"pith","pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","venue":"cs.CV","work_id":"682f3d73-cd97-46d4-a899-090e74a59adc","year":2023},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:4bf6db9f43ebf5f14ca6aaeedc27a5ffca39d8e4eb5de3b5b6420f9ea703efb9","observation_id":"6cb9b9ad-0d4b-4048-ae98-d22806a91254","resolution":{"observed_at":"2026-05-21T05:03:57.745343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:10.967215+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:10.967215+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":"1900ae87-3815-488e-af7e-cf458dd26cf9","year":2024},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:29fa23294efe0da579e2e810151b7a5e491d25f12d8b2ac110a1397a781c8e05","observation_id":"7236b3c1-60a3-4aa0-9d12-d3ca1e1cd61e","resolution":{"observed_at":"2026-05-21T05:03:58.455987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":"2504.10479","doi":"10.48550/arxiv.2504.10479","metadata_source":"pith","pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","venue":"cs.CV","work_id":"fe8637aa-12bc-4434-8d36-9f57b5eebcbe","year":2025},"citing_paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-21T05:03:24.950836Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2605.20965"},"observation_digest":"sha256:a087e7452a943aee70fcc9a49c6f4be5696cc91b7d96b54178fcf2b43e372dc2","observation_id":"ccc84fe3-98ea-44e5-ba62-fdd1d7bdd8e5","resolution":{"observed_at":"2026-05-21T05:03:57.759989Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.20965","last_updated":"2026-05-20T09:50:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T12:20:04.217665Z","submitted_at":"2026-05-20T09:50:13Z","title":"Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":6,"verified_fuzzy":65},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2605.20965."}