{"as_of":"2026-08-10T21:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7dcb05f8ae8ca4bac3bd6d4f0cba7b7c40f29e38a68c0dd517884f8b842e91d1","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T10:47:44.075469Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07302/citation-record","integrity":"/paper/2608.07302/integrity","json":"/paper/2608.07302/citation-record.json","paper":"/paper/2608.07302"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.891133Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.891133Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:b190fee79e743cb1f4c9eb807ba83bacf5974f675ce6f18d59ee7dddea7e4268","observation_id":"0e320b62-8865-4ece-abad-63999b4708fd","resolution":{"observed_at":"2026-08-10T10:47:43.891133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.837523Z","title":"Mitigating object hallucinations in large vision- language models with assembly of global and local attention","venue":null,"work_id":"0bdee84c-de8b-4a23-8596-4a68ba32a62f","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.895940Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:21f9d8a5cf3cf80b9eba7c6248cfaa852b8c3c713576740f8127955f03492914","observation_id":"99d03d34-605b-4c96-9e6a-54551257cd88","resolution":{"observed_at":"2026-08-10T10:47:44.841598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T10:47:43.900405Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond.arXiv preprint arXiv:2308.12966, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.900405Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:733ab2ff403fc43ab2917c5bb9737bd9743ab09cda45535e3b7486d915f71eb1","observation_id":"f8ba24a2-c3c4-4151-a77a-6592f564fb22","resolution":{"observed_at":"2026-08-10T10:47:43.900405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-10T10:47:43.905091Z","title":"Hallucination of multimodal large language models: A survey.arXiv preprint arXiv:2404.18930, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.905091Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:9c5074be0e020d02548e7dfa3f21e533f1e69213af9b2240a0b898c0f0c55ea7","observation_id":"82a7088a-e450-4fce-9278-68e97ad3d517","resolution":{"observed_at":"2026-08-10T10:47:43.905091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.825951Z","title":"Ict: Image-object cross-level trusted intervention for mitigating object halluci- nation in large vision-language models","venue":null,"work_id":"fba9421d-9420-45e9-a55b-483b4a61ad11","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.910328Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:1413a4fd5e67846c8c84d47d809e8f36e17bc30d00ca1b2eeae7acd070f2d979","observation_id":"3cf3aa9d-e1d5-484b-9485-2e3fb0831961","resolution":{"observed_at":"2026-08-10T10:47:44.830009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-10T10:47:43.914584Z","title":"Shikra: Unleashing multi- modal llm’s referential dialogue magic.arXiv preprint arXiv:2306.15195, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.914584Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:d829ceabad76181f25e1b4d88044f0f9925ef89ffdc6267c25fbde8cbd48fd19","observation_id":"c151d0e4-ad30-4c36-9fc8-f3cbc4665155","resolution":{"observed_at":"2026-08-10T10:47:43.914584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16479","last_updated":"2023-11-27T09:30:02Z","snapshot_observed_at":"2026-08-09T15:58:21.146758Z","submitted_at":"2023-11-27T09:30:02Z","title":"Mitigating Hallucination in Visual Language Models with Visual Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16479","snapshot_observed_at":"2026-08-10T10:47:43.918681Z","title":"Mitigating hallucination in visual language models with visual supervi- sion.arXiv preprint arXiv:2311.16479, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.918681Z"},"links":{"cited_paper":"/paper/2311.16479","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:716dfa852fca89015da34a3d660c91c972645f74dc60e2adab9087e714b8727f","observation_id":"7000a756-3aa0-4606-9338-7fc8a9f5274b","resolution":{"observed_at":"2026-08-10T10:47:43.918681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.922861Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.922861Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:18af97a76da50dc62b3231a7bcd887071be604b2c70d3cac945973ef2e92aad3","observation_id":"b11a80a3-aaa8-412a-8a3a-176479ab9f85","resolution":{"observed_at":"2026-08-10T10:47:43.922861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-10T17:38:58.073992Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-10T10:47:43.926644Z","title":"Halc: Object hallucination re- duction via adaptive focal-contrast decoding.arXiv preprint arXiv:2403.00425, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.926644Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:24f45824dddfbd472cc7209633e0870015438398de8b3c8298807d882a615a42","observation_id":"e89ab366-f85c-431a-8c3a-7467c7ac55c2","resolution":{"observed_at":"2026-08-10T10:47:43.926644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.930595Z","title":"Instructblip: Towards general-purpose vision- language models with instruction tuning.Advances in neural information processing systems, 36:49250–49267, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.930595Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:cbcf53e66666807a51ed26ebcd53ad73eb4caf9243cc41b5e7657765a092596e","observation_id":"d4dde930-0bf6-42af-87fb-bbe478075ca4","resolution":{"observed_at":"2026-08-10T10:47:43.930595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.934722Z","title":"Damro: Dive into the attention mechanism of lvlm to re- duce object hallucination.arXiv preprint arXiv:2410.04514,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.934722Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:5741be7fd042b9c4b7891b7bbf98af6ed30a9786ee45030c1ce62bd02be41c10","observation_id":"60cb3f27-032c-4303-8ea5-e7a8d8d689d4","resolution":{"observed_at":"2026-08-10T10:47:43.934722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.799652Z","title":"Opera: Alleviating hallucination in multi- modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":"18b45c22-13ab-4c9b-9d61-577e35cf7982","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.938593Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:2aad4000f15e6f00a54c3a10b3535a8838218b5a7ac2b22b7dd2708f15e5e1c1","observation_id":"86a2d1d9-cf6e-4cc0-962f-6032434cbb14","resolution":{"observed_at":"2026-08-10T10:47:44.803823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.787299Z","title":"Hallucination augmented contrastive learn- ing for multimodal large language model","venue":null,"work_id":"7dca137b-f7b6-4abf-b6b1-382009c9f26d","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.942300Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:c0b2cba897761547bd628a9c6bcf5f5a81d494cb7d211c152bd309a4af562100","observation_id":"00a1ab87-7705-4d79-bfc7-4bf232784739","resolution":{"observed_at":"2026-08-10T10:47:44.791239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02762","last_updated":"2025-02-10T20:13:31Z","snapshot_observed_at":"2026-08-09T16:06:26.088504Z","submitted_at":"2024-10-03T17:59:57Z","title":"Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02762","snapshot_observed_at":"2026-08-10T10:47:43.945970Z","title":"Interpreting and editing vision-language rep- resentations to mitigate hallucinations.arXiv preprint arXiv:2410.02762, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.945970Z"},"links":{"cited_paper":"/paper/2410.02762","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:b1bd78aac786dc9334405db4dfa447db645664c64d0f7eb86533e84c1360f1ee","observation_id":"615a9787-1c90-4108-8fb9-c20c8e3c0411","resolution":{"observed_at":"2026-08-10T10:47:43.945970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.776144Z","title":"Devils in middle layers of large vision- language models: Interpreting, detecting and mitigating ob- ject hallucinations via attention lens","venue":null,"work_id":"647d9bc0-ddfb-424a-b8c1-86c3470880de","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.949886Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:0510313fd89876d007dfd66a98bf43423a54b09b9f0160d6f66a6a361194d12d","observation_id":"fcda5f3b-5dad-45a7-b2c4-e0e8ca6eed1a","resolution":{"observed_at":"2026-08-10T10:47:44.780119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.763939Z","title":"What’s in the im- age? a deep-dive into the vision of vision language models","venue":null,"work_id":"658bde4b-8b21-4aa4-8eb9-60843da3630c","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.953525Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:515f646f848e0782fe8a977eb97ffbfac67397cccff2a13ceee768eaa965bc04","observation_id":"2dfebab3-5a67-4cf4-8e2f-57ef29db632b","resolution":{"observed_at":"2026-08-10T10:47:44.768877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03321","last_updated":"2025-03-05T09:55:07Z","snapshot_observed_at":"2026-08-10T21:22:18.894347Z","submitted_at":"2025-03-05T09:55:07Z","title":"See What You Are Told: Visual Attention Sink in Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.03321","snapshot_observed_at":"2026-08-10T10:47:43.957166Z","title":"See what you are told: Visual attention sink in large multimodal models.arXiv preprint arXiv:2503.03321, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.957166Z"},"links":{"cited_paper":"/paper/2503.03321","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:2fafcbf20fc4fef728a5cc7ae60c6f7712ffab84aaf9692da0857912b09a188d","observation_id":"bc3af201-0a87-4966-a990-2f6c2f8c9e5d","resolution":{"observed_at":"2026-08-10T10:47:43.957166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.752389Z","title":"Mitigating object hal- lucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"fcf0518e-f9c5-4004-9b9e-df24e669874b","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.960888Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:9b8dcbf07ee0c9c93c66462a909d20b43eaff2825525fa0c897b6f21a8d2d9f5","observation_id":"2deb19e1-8498-4016-99bc-2ff7fe9c96b5","resolution":{"observed_at":"2026-08-10T10:47:44.756687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.964835Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.964835Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:d4439acd9aca3885413b2a076d42bf4ea340c961f26a0261d9ec45def85c38fd","observation_id":"dee3fdc5-0835-45d7-971e-9ba4096b2e8a","resolution":{"observed_at":"2026-08-10T10:47:43.964835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.968690Z","title":"Mvbench: A comprehensive multi-modal video understand- ing benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.968690Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:d828731968d89fbfda96b41755c302e5b7fe61cef9cdadb6eece384d8befb4b2","observation_id":"5e31a5d3-4f45-4260-a211-e3fe9936d7b9","resolution":{"observed_at":"2026-08-10T10:47:43.968690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.727249Z","title":"Contrastive decoding: Open-ended text genera- tion as optimization","venue":null,"work_id":"1b0d9246-7787-42ae-8e47-401ee96640f7","year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.972351Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:b593b73bdafffb7823bd7397c08478e693c701e99f02a11acdd4189afe4096a4","observation_id":"c87cbf62-5bc7-4ca1-a1b5-6d09e73ae0b9","resolution":{"observed_at":"2026-08-10T10:47:44.731096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-10T10:47:43.975914Z","title":"Evaluating object hallucina- tion in large vision-language models.arXiv preprint arXiv:2305.10355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.975914Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:ce15ff05429dd101630783f08f324c87cbb59e2bfd0ab2df6fb96c963a45bd5b","observation_id":"dcc333b6-e883-47d0-ab57-4aae01192727","resolution":{"observed_at":"2026-08-10T10:47:43.975914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.979840Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.979840Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:c43db5262dd5534d28e05a3a8cbb4b82b2dffc2d889304a833bda3593c11d15e","observation_id":"eabe12cc-a553-4028-b6fd-31e4c2dd20f1","resolution":{"observed_at":"2026-08-10T10:47:43.979840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-08-06T22:33:34.254048Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14565","snapshot_observed_at":"2026-08-10T10:47:43.983427Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning.arXiv preprint arXiv:2306.14565, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.983427Z"},"links":{"cited_paper":"/paper/2306.14565","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:2188b82fc4d759cce5c9878d151c45579afb0151082deab5b966853d45c1afe0","observation_id":"887a82ea-f4bb-42a5-adde-1e19b3be83ff","resolution":{"observed_at":"2026-08-10T10:47:43.983427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:43.987399Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.987399Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:07ddcabb96b8ecf5d870820f2c8da547902a88b2c628c6e42f37bde8559a906a","observation_id":"fa1b95be-cf8f-4b06-bee2-bf17ed85f7a0","resolution":{"observed_at":"2026-08-10T10:47:43.987399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.698690Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"33c285ff-12ad-4a18-afb6-f5ab8516f235","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.990877Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:f0d2d89402995f46d36c8b5e08c0aba0417ac8c9e548f4a7c7443bcb7106646c","observation_id":"ab154c61-d930-40b6-8d2b-c4691ab32fa9","resolution":{"observed_at":"2026-08-10T10:47:44.702842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-10T10:47:43.994864Z","title":"A survey on hallucination in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.994864Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:7d066defeaa2e27611c7ba36cf7adcbc8ea5bdbd2dd1a34dd5cd264d845914f8","observation_id":"e3ca8da4-6f46-4fb1-b164-22c40ec6631c","resolution":{"observed_at":"2026-08-10T10:47:43.994864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.685241Z","title":"Paying more at- tention to image: A training-free method for alleviating hal- lucination in lvlms","venue":null,"work_id":"78a77dab-d718-4d27-b7fa-500d309b68a8","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:43.998702Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:ad5e74394974ebd53951dd80b74d1825ed1d7fbad7fd73e583963416bdb3156e","observation_id":"53c0377c-6c8c-43b3-9eef-9b2059253bd3","resolution":{"observed_at":"2026-08-10T10:47:44.689548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.672407Z","title":"Alleviating hallucinations in large vision- language models through hallucination-induced optimiza- tion.Advances in Neural Information Processing Systems, 37:122811–122832, 2024","venue":null,"work_id":"2136870b-0645-484c-9e6a-821b4791ec43","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.002374Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:07e3a0d437a8b86b2dbaf1ebb336849568dd14144f8962e74ea58f67500a4fa7","observation_id":"88eb18a9-d520-4dd6-9d9f-56240c02f130","resolution":{"observed_at":"2026-08-10T10:47:44.676793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.660561Z","title":"Wordnet: a lexical database for english","venue":null,"work_id":"a6bf41e9-6485-4a20-98a3-1e68eb55b016","year":1995},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.006316Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:fb36dfb894f04e617b11dd5693031f92ed7e96f445de4fb881f281a86cf63e96","observation_id":"9f54d766-b08b-440c-9f24-7a90343b4901","resolution":{"observed_at":"2026-08-10T10:47:44.664276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.649170Z","title":"Interpreting gpt: The logit lens","venue":null,"work_id":"50e41aab-a5d7-45ee-a190-c59d48dc7ee9","year":2020},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.010190Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:f6ad3eab095d1e0350155a657e7c204564517268c539ce0f229f133bc9c6ca31","observation_id":"c721d87f-671f-40b3-b4d1-e4b82b481a6d","resolution":{"observed_at":"2026-08-10T10:47:44.653301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.014328Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.014328Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:cb406246a37a1b1000124f5b37f6cae7c4eca7389615468f835abc90e9b9bc6a","observation_id":"8790dd97-557f-4dd7-b86d-cdfdb9a45777","resolution":{"observed_at":"2026-08-10T10:47:44.014328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-10T08:25:28.506770Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-10T10:47:44.018119Z","title":"Object hallucination in image cap- tioning.arXiv preprint arXiv:1809.02156, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.018119Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:bca44466d8d46aa2d74476b76cf05c8084df7f3afb1d608a9f1bf37485bcd04d","observation_id":"f4768a1b-8578-41a1-89c9-2e7b3fa691ed","resolution":{"observed_at":"2026-08-10T10:47:44.018119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18654","last_updated":"2025-02-28T00:26:42Z","snapshot_observed_at":"2026-08-04T21:04:25.264907Z","submitted_at":"2024-05-28T23:36:00Z","title":"Mitigating Object Hallucination in MLLMs via Data-augmented Phrase-level Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18654","snapshot_observed_at":"2026-08-10T10:47:44.022178Z","title":"Mitigating ob- ject hallucination in mllms via data-augmented phrase-level alignment.arXiv preprint arXiv:2405.18654, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.022178Z"},"links":{"cited_paper":"/paper/2405.18654","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:c75e5343c7f10e4763cc95550417b0f244bf36e9c3789dd4c61d439ebe257268","observation_id":"44ff7873-12ee-4b4f-a979-a48396d2dd0a","resolution":{"observed_at":"2026-08-10T10:47:44.022178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06225","last_updated":"2025-08-18T12:00:32Z","snapshot_observed_at":"2026-08-08T19:02:29.037600Z","submitted_at":"2025-08-08T11:11:22Z","title":"Overconfidence in LLM-as-a-Judge: Diagnosis and Confidence-Driven Solution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06225","snapshot_observed_at":"2026-08-10T10:47:44.026423Z","title":"Over- confidence in llm-as-a-judge: Diagnosis and confidence- driven solution.arXiv preprint arXiv:2508.06225, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.026423Z"},"links":{"cited_paper":"/paper/2508.06225","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:53e59e5f89133035e6508de9e8e4f57efc814d2982411b642974ec49d4433f09","observation_id":"db768d3b-9524-429e-b314-8d5741a8c656","resolution":{"observed_at":"2026-08-10T10:47:44.026423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.630348Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":"c0be7d9e-ee66-4097-92c4-9dff65f5a4bb","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.030588Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:4a0c3c906d8d340f1fdd1fa2568db84322b0043c460f8bcd526fa2e91d813185","observation_id":"6162e675-7f02-4ab3-8c82-3394dccfaeac","resolution":{"observed_at":"2026-08-10T10:47:44.634588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11779","last_updated":"2025-02-23T15:14:47Z","snapshot_observed_at":"2026-08-10T13:18:33.995677Z","submitted_at":"2024-10-15T16:57:44Z","title":"MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11779","snapshot_observed_at":"2026-08-10T10:47:44.034645Z","title":"Mllm can see? dynamic correction decoding for hallucination mitiga- tion.arXiv preprint arXiv:2410.11779, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.034645Z"},"links":{"cited_paper":"/paper/2410.11779","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:fa5a720e0dc658419ad5391d45d4d42e518317f43e6a60f84efdbee9d8fac577","observation_id":"649df8aa-6029-4b67-a3ca-17bab84bd5be","resolution":{"observed_at":"2026-08-10T10:47:44.034645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07397","last_updated":"2024-02-23T07:54:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T15:25:42Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07397","snapshot_observed_at":"2026-08-10T10:47:44.038832Z","title":"Amber: An llm-free multi-dimensional bench- mark for mllms hallucination evaluation.arXiv preprint arXiv:2311.07397, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.038832Z"},"links":{"cited_paper":"/paper/2311.07397","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:c8422bb25b383d888befa0bfb70155b18926b3f7760ea5f6cc7cb2608f09145d","observation_id":"55a95a22-9657-428c-8997-9ae74d884b58","resolution":{"observed_at":"2026-08-10T10:47:44.038832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-10T10:47:44.043045Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.043045Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:27296cd3a79ed2360d3879a7dabffa1d52760ad4fbf5fbc785976e6724399db5","observation_id":"910c0aa5-a815-46c1-83b3-d77486dd8de7","resolution":{"observed_at":"2026-08-10T10:47:44.043045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10552","last_updated":"2025-08-14T11:44:52Z","snapshot_observed_at":"2026-08-09T07:24:43.212927Z","submitted_at":"2025-08-14T11:44:52Z","title":"When Language Overrules: Revealing Text Dominance in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10552","snapshot_observed_at":"2026-08-10T10:47:44.047025Z","title":"When language overrules: Revealing text domi- nance in multimodal large language models.arXiv preprint arXiv:2508.10552, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.047025Z"},"links":{"cited_paper":"/paper/2508.10552","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:e51620c5219d139866802ba516e99e42da46644563e7252325ef6a2da431bcee","observation_id":"fe3929af-e1b9-4de8-a0b4-6ce2f51ee134","resolution":{"observed_at":"2026-08-10T10:47:44.047025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.618570Z","title":"Mitigating hallucinations in large vision- language models via dpo: On-policy data hold the key","venue":null,"work_id":"1a62caf1-274b-46d6-841e-59a0e0a43d87","year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.051227Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:8964a5709254af506266c115d61c00b3c133d5aaf2560070ba88ba2228bd68d9","observation_id":"4d20456f-62e9-461e-998d-1b1f65351d6d","resolution":{"observed_at":"2026-08-10T10:47:44.622766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.055257Z","title":"mplug- owl2: Revolutionizing multi-modal large language model with modality collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.055257Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:762ec9965806a38ec590450758d07d2b935beb03f8b496d02e9c764400924390","observation_id":"685cf51b-407d-4d66-8d5b-e202331a509f","resolution":{"observed_at":"2026-08-10T10:47:44.055257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.059547Z","title":"Clearsight: Vi- sual signal enhancement for object hallucination mitigation in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.059547Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:b603672b12601431979be773a4899d20753bef4b90a646ecbc0743bfd54d859d","observation_id":"d4c5925a-c39d-41ea-8266-012b2ff406ff","resolution":{"observed_at":"2026-08-10T10:47:44.059547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.589524Z","title":"Rlhf-v: Towards trustworthy mllms via behavior alignment from fine-grained correctional hu- man feedback","venue":null,"work_id":"1ba26b43-698c-423b-8dba-995c16b9ffc8","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.063506Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:9f159f681caaaa029bc258c0d8e1bcac0f1516d151c3d070be4c45a8c9afd0ff","observation_id":"02458c0e-89e6-48e6-89a6-b0df3c721b8c","resolution":{"observed_at":"2026-08-10T10:47:44.593865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T10:47:44.574510Z","title":"Mitigating object hallucination in large vision-language models via classifier-free guidance.arXiv e-prints, pages arXiv–2402, 2024","venue":null,"work_id":"f691a42e-1bc5-48df-a5ed-125ab451508a","year":2024},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.067679Z"},"links":{"citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:e5c2c7640d6a44851c474ad71857e30261a5998ff95c60cf340e7d5d252c30b6","observation_id":"39a2c8f4-0a3a-4fac-9053-2ff1554b32bc","resolution":{"observed_at":"2026-08-10T10:47:44.580796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-08T04:17:23.797697Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-10T10:47:44.071502Z","title":"Beyond hallucinations: Enhanc- ing lvlms through hallucination-aware direct preference op- timization.arXiv preprint arXiv:2311.16839, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.071502Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:54165a15d2016d722861638e130473a3f239c054ed84cd9ffdb0e6449891c032","observation_id":"b4d8f383-ae8a-4296-ae4a-e8c09fd8a0e8","resolution":{"observed_at":"2026-08-10T10:47:44.071502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-10T10:47:44.075469Z","title":"Analyzing and mitigating object hallucination in large vision-language models.arXiv preprint arXiv:2310.00754,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T10:47:44.075469Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2608.07302"},"observation_digest":"sha256:42d8802c0602115184110196fa92fe398f37944112a1e1a259a8df9b908c5cdb","observation_id":"01dad650-bf56-4aed-9657-a284790b120b","resolution":{"observed_at":"2026-08-10T10:47:44.075469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07302","last_updated":"2026-08-07T14:56:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T21:13:47.391094Z","submitted_at":"2026-08-07T14:56:12Z","title":"Same Attention, Different Truths: Put Logit-Lens over Visual Attention to Detect and Mitigate LVLM Object Hallucination"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2608.07302."}