{"as_of":"2026-08-13T18:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9d86919a1afe3a4e136609360b19f184a156e590b29820ad144a08dc10363e6","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:12:25.404728Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:45:44.844437Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:20:06.531800Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"reference_index":213,"source":"pdf_text","source_observed_at":"2026-05-11T12:33:32.631346Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2404.18930"},"observation_digest":"sha256:864c80b193076b1312c0fbcdc0059ade0fbf3e9dfc2348b2f33c4c7549afd920","observation_id":"83c98cf1-a1eb-4065-94db-c6cafa868ab6","resolution":{"observed_at":"2026-05-11T12:33:33.392872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-11T16:45:44.844437Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09817","last_updated":"2024-12-13T03:13:44Z","snapshot_observed_at":"2026-08-12T04:14:50.154967Z","submitted_at":"2024-12-13T03:13:44Z","title":"Enhancing Multimodal Large Language Models Complex Reason via Similarity Computation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:44.844437Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2412.09817"},"observation_digest":"sha256:ba6bef6bacbf30ef222bb7abd958bca898cb097eb5debdfab2cc7181cf6877e4","observation_id":"a995798a-d4f3-4859-90c3-06a9585b31c1","resolution":{"observed_at":"2026-08-11T16:45:44.844437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-11T12:43:20.946064Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13949","last_updated":"2025-06-10T09:53:09Z","snapshot_observed_at":"2026-08-11T12:35:33.065611Z","submitted_at":"2024-12-18T15:29:30Z","title":"Cracking the Code of Hallucination in LVLMs with Vision-aware Head Divergence","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T12:43:20.946064Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2412.13949"},"observation_digest":"sha256:6fef52272d6bfd177d87651ba63c014d7b6d6a9e8d813e56ba372b8a40140a88","observation_id":"28872082-b61b-4bc2-a25c-581e6cef690d","resolution":{"observed_at":"2026-08-11T12:43:20.946064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-11T00:13:13.296393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19650","last_updated":"2024-12-27T13:55:11Z","snapshot_observed_at":"2026-08-11T03:35:47.120166Z","submitted_at":"2024-12-27T13:55:11Z","title":"Toward Modality Gap: Vision Prototype Learning for Weakly-supervised Semantic Segmentation with CLIP","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T00:13:13.296393Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2412.19650"},"observation_digest":"sha256:cae96624fe03de9d7b100cb891d64bdd05345af8800ce204e486c004223b0838","observation_id":"bc7c7a60-b5cd-455f-9cbd-42add66843ff","resolution":{"observed_at":"2026-08-11T00:13:13.296393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-10T22:06:47.769539Z","title":"Seeing clearly by layer two: Enhancing attention heads to alleviate hallucination in lvlms.arXiv preprint arXiv:2411.09968, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02811","last_updated":"2025-04-22T06:27:44Z","snapshot_observed_at":"2026-08-12T05:32:48.091506Z","submitted_at":"2025-01-06T07:20:36Z","title":"First-place Solution for Streetscape Shop Sign Recognition Competition","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T22:06:47.769539Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2501.02811"},"observation_digest":"sha256:df783e9b6ca0ff0f2a809ac7f7b5d515a24eb2f53d1e8678c74b7a82cd99dd4e","observation_id":"7e15d85e-44ab-453c-a203-02c5a20a7bdb","resolution":{"observed_at":"2026-08-10T22:06:47.769539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-09T15:26:18.988905Z","title":"Seeing clearly by layer two: Enhancing attention heads to alleviate hallucination in lvlms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01419","last_updated":"2025-06-04T06:43:40Z","snapshot_observed_at":"2026-08-13T07:38:30.161844Z","submitted_at":"2025-02-03T14:58:11Z","title":"Visual Attention Never Fades: Selective Progressive Attention ReCalibration for Detailed Image Captioning in Multimodal Large Language Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T15:26:18.988905Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2502.01419"},"observation_digest":"sha256:99dae0fc08b849756719b19818b04b66a624d1fd83f5d5e7bf11536909c334a2","observation_id":"ec6a6d8e-3533-4188-af1d-8de9b73f68c0","resolution":{"observed_at":"2026-08-09T15:26:18.988905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2505.21472","last_updated":"2025-08-11T19:24:13Z","snapshot_observed_at":"2026-07-06T21:31:35.572708Z","submitted_at":"2025-05-27T17:45:21Z","title":"Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T12:48:44.324236Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2505.21472"},"observation_digest":"sha256:0adb213f58566a511170ad8618624c8530f580dc134958040b9d8ee6096a5690","observation_id":"3ebc0f3a-e102-4dca-b569-c3eb4c548913","resolution":{"observed_at":"2026-05-19T12:52:18.038564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-07T05:54:03.925130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06729","last_updated":"2025-06-07T09:27:26Z","snapshot_observed_at":"2026-08-10T07:02:38.987852Z","submitted_at":"2025-06-07T09:27:26Z","title":"Mitigating Object Hallucination via Robust Local Perception Search","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:03.925130Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2506.06729"},"observation_digest":"sha256:61ea24beda116912b57ad1fce6ca245dd6dd12b0616597a50b7f5e4efae1e4d6","observation_id":"bd025866-4c0b-4594-a251-6f09b8e08d4a","resolution":{"observed_at":"2026-08-07T05:54:03.925130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-07T00:23:55.899256Z","title":"Seeing clearly by layer two: Enhancing attention heads to alleviate hallucination in lvlms.arXiv preprint arXiv:2411.09968, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14471","last_updated":"2025-06-17T12:35:23Z","snapshot_observed_at":"2026-08-13T14:32:10.685104Z","submitted_at":"2025-06-17T12:35:23Z","title":"Dense360: Dense Understanding from Omnidirectional Panoramas","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:55.899256Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2506.14471"},"observation_digest":"sha256:92dd293d4987c59a1f5bb26e310eb89fd04c7d2b08e69bfa0dc727d8d4c1858a","observation_id":"40febfed-cfd1-45df-b202-9a1c71f8ff8a","resolution":{"observed_at":"2026-08-07T00:23:55.899256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-06T21:27:40.755138Z","title":"Seeing clearly by layer two: Enhancing attention heads to alleviate hallucination in lvlms.arXiv preprint arXiv:2411.09968, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.24102","last_updated":"2025-06-30T17:51:25Z","snapshot_observed_at":"2026-08-12T05:33:56.515699Z","submitted_at":"2025-06-30T17:51:25Z","title":"DenseWorld-1M: Towards Detailed Dense Grounded Caption in the Real World","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T21:27:40.755138Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2506.24102"},"observation_digest":"sha256:3c233c289c9b402496cceab375498b8fe1b03655e390a1b3bc91e95bdcd080eb","observation_id":"85e6f998-a196-4e31-9939-9d1029a12a5b","resolution":{"observed_at":"2026-08-06T21:27:40.755138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-06T20:45:10.173386Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? In European Conference on Computer Vision, pp","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01949","last_updated":"2025-07-02T17:57:28Z","snapshot_observed_at":"2026-08-13T03:34:39.503239Z","submitted_at":"2025-07-02T17:57:28Z","title":"Kwai Keye-VL Technical Report","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:10.173386Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2507.01949"},"observation_digest":"sha256:cbb3c5ff7bd78bd04d2a40362f688895c3d0827a0e70dda5290028f7ea70ef4d","observation_id":"39613d2d-a4c9-482a-b3a3-f5002c3b70f0","resolution":{"observed_at":"2026-08-06T20:45:10.173386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-06T18:09:11.917632Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.917632Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:7451e30b009b1dcc1156f2db2f49fe4120fc2b8e5f4176fbb7b8fb9a6931091a","observation_id":"d01f3afc-539a-41da-ae2a-b9f69b3bb80b","resolution":{"observed_at":"2026-08-06T18:09:11.917632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-06T13:18:05.927482Z","title":"Seeing clearly by layer two: Enhancing attention heads to alleviate hallucination in LVLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20842","last_updated":"2025-07-28T13:50:53Z","snapshot_observed_at":"2026-08-13T17:48:59.129542Z","submitted_at":"2025-07-28T13:50:53Z","title":"METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T13:18:05.927482Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2507.20842"},"observation_digest":"sha256:b5d5ca842817916da748c24b43176a28130f108b8ab3caf93279c01f2e503c8a","observation_id":"bacc4ae4-e3ee-494c-9aba-71a237fc9cf9","resolution":{"observed_at":"2026-08-06T13:18:05.927482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2604.06393","last_updated":"2026-04-07T19:23:47Z","snapshot_observed_at":"2026-08-04T11:45:10.032776Z","submitted_at":"2026-04-07T19:23:47Z","title":"ART: Attention Replacement Technique to Improve Factuality in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T19:48:22.430128Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2604.06393"},"observation_digest":"sha256:a7dbabbcfe7b08b56472c6da678d93ea96d6e61a671d490b555d5cddf96770c7","observation_id":"62c4938f-dd71-462f-864a-de109ec7fbf6","resolution":{"observed_at":"2026-05-10T22:30:50.979622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2604.10098","last_updated":"2026-04-11T08:41:33Z","snapshot_observed_at":"2026-08-11T07:40:34.488378Z","submitted_at":"2026-04-11T08:41:33Z","title":"Attention Sink in Transformers: A Survey on Utilization, Interpretation, and Mitigation","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-05-10T16:17:09.834609Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2604.10098"},"observation_digest":"sha256:64a0402d95165c139eccf58f75600550a21e9ba031b0e4ad4f0d7ce0ca91a1af","observation_id":"37287928-a3b5-44a7-bc42-95ff7d4b799c","resolution":{"observed_at":"2026-05-11T09:05:58.215429Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2605.04874","last_updated":"2026-05-06T13:08:12Z","snapshot_observed_at":"2026-08-11T19:12:26.096877Z","submitted_at":"2026-05-06T13:08:12Z","title":"Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T17:00:36.574362Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2605.04874"},"observation_digest":"sha256:0f4783ab86fa2cd1553a3ffd871193d01d5a2eb9d6f318150cdf7baa4682b8a4","observation_id":"5747b385-5d87-4b9b-aba8-13ecf1503094","resolution":{"observed_at":"2026-05-11T17:51:09.369022Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2605.11559","last_updated":"2026-05-12T05:42:11Z","snapshot_observed_at":"2026-08-12T19:30:23.881578Z","submitted_at":"2026-05-12T05:42:11Z","title":"When Looking Is Not Enough: Visual Attention Structure Reveals Hallucination in MLLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:07.172228Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2605.11559"},"observation_digest":"sha256:b6f2e5fa313951c968df558ecc473fe77ec06f5464a33dced3005d220ec242ad","observation_id":"e982e3b9-b9e9-42e6-8717-eae43d9fc9fa","resolution":{"observed_at":"2026-05-13T01:57:05.213662Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2605.25799","last_updated":"2026-05-25T12:49:15Z","snapshot_observed_at":"2026-08-12T21:50:10.286887Z","submitted_at":"2026-05-25T12:49:15Z","title":"Addressing Exacerbated Attention Sink for Source-Free Cross-Domain Few-Shot Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T22:28:35.155099Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2605.25799"},"observation_digest":"sha256:b847a65498748c30ad53859d64d1b47479c6011234dee8c9aa2d15370f888e5d","observation_id":"5db316ef-8f41-418d-aa82-0024bc6a2b87","resolution":{"observed_at":"2026-06-29T22:34:01.812681Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2606.10651","last_updated":"2026-06-09T09:58:08Z","snapshot_observed_at":"2026-07-06T23:49:51.672382Z","submitted_at":"2026-06-09T09:58:08Z","title":"Kwai Keye-VL-2.0 Technical Report","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-27T13:53:10.352603Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2606.10651"},"observation_digest":"sha256:4e43a94e158340c3efa48778b9e8f0ea8c793bd753708ee63962c3c0b8936c70","observation_id":"92e378c1-1714-4936-9518-e44b121c1eea","resolution":{"observed_at":"2026-07-03T04:27:37.089106Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2606.25325","last_updated":"2026-07-20T13:20:39Z","snapshot_observed_at":"2026-08-02T10:17:41.360200Z","submitted_at":"2026-06-24T02:43:26Z","title":"Omni-Perception Policy Optimization for Multimodal Emotion Reasoning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-25T21:31:38.450382Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2606.25325"},"observation_digest":"sha256:ecde0a67c0b983f882eb771687de3f7c2f376125b79b473d2bef642a8a73c262","observation_id":"84a780bb-3bc0-4210-9694-dd90f5009521","resolution":{"observed_at":"2026-07-04T19:20:06.533244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2606.29805","last_updated":"2026-06-30T14:53:46Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:33:22Z","title":"Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-30T06:13:11.013395Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2606.29805"},"observation_digest":"sha256:529c07b33940f840593d3b756ec43bd1a2fc6b49a4ad47a98f3ad929989867d6","observation_id":"73f85c7e-294c-4727-b8ef-8ffda2e6fd37","resolution":{"observed_at":"2026-06-30T06:14:18.706272Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.09968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-04T19:20:06.531800Z","title":"ArXiv:2411.09968 [cs]","venue":null,"work_id":"8d9a29ba-daa6-4363-8d55-e7c46084fd46","year":2024},"citing_paper":{"arxiv_id":"2606.29805","last_updated":"2026-06-30T14:53:46Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:33:22Z","title":"Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-01T07:01:26.911110Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2606.29805"},"observation_digest":"sha256:2bd45ed8344dde3f0e0751951b789a8fdf41c750e50f18642c3a4cd4259a61b7","observation_id":"a30c4598-20f2-4a9c-88e3-5a1c5d2af6da","resolution":{"observed_at":"2026-07-01T07:05:28.648935Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-07-14T05:37:19.632869Z","title":"arXiv preprint arXiv:2411.09968 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-14T05:37:19.632869Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:bdc8ba229b4a0ed4a1ee9cfc255e425c7962e0ae141c6c09acab64b30015a4cd","observation_id":"61274ef6-e42d-42c0-9004-a2d54a9bb2f6","resolution":{"observed_at":"2026-07-14T05:37:19.632869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-02T07:01:25.384563Z","title":"arXiv preprint arXiv:2411.09968 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.384563Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:d54e3485b639b1e99831cf201cd2bea06dc23c4afb47d6207840c2b166373de2","observation_id":"51b720e1-8e49-4199-8617-94ac48974886","resolution":{"observed_at":"2026-08-02T07:01:25.384563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-01T16:48:36.743797Z","title":"Vision-language models for vision tasks: A survey.IEEE transactions on pattern analysis and machine intelligence, 46(8):5625– 5644, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17884","last_updated":"2026-07-20T12:35:05Z","snapshot_observed_at":"2026-08-10T05:53:59.744780Z","submitted_at":"2026-07-20T12:35:05Z","title":"ST-Veto: Spatio-Temporal Token Veto for Diffusion MLLMs via Taylor Prediction and Visual Grounding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T16:48:36.743797Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2607.17884"},"observation_digest":"sha256:aca8961d41639b80d93c91309a8f3a3404ff94da2c6c6b8b1f669479fba55644","observation_id":"b67b8773-e6d1-4d58-94f5-fec2ac192c8e","resolution":{"observed_at":"2026-08-01T16:48:36.743797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-03T07:33:41.915824Z","title":"larger deviations on hallucinated mentions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29412","last_updated":"2026-07-31T13:33:51Z","snapshot_observed_at":"2026-08-08T13:46:05.938586Z","submitted_at":"2026-07-31T13:33:51Z","title":"Role-Break in Attention Heads: Understanding and Detecting Hallucinations in VLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T07:33:41.915824Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2607.29412"},"observation_digest":"sha256:f868f424c30665b1ee5cf22f9b90498eae71b0126385e47bd75e981877d3d0c4","observation_id":"ef72004c-976b-4f46-82b5-678fe5cacc2f","resolution":{"observed_at":"2026-08-03T07:33:41.915824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.09968/citation-record","integrity":"/paper/2411.09968/integrity","json":"/paper/2411.09968/citation-record.json","paper":"/paper/2411.09968"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T20:12:25.203681Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.203681Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:7e773413feab1b85ee1d7bd2e0c0bc1261f2236500f9e53f324288c644f7414f","observation_id":"bdf3ce59-f4fb-443c-b551-e1cdc020408b","resolution":{"observed_at":"2026-08-12T20:12:25.203681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12718","last_updated":"2025-03-14T04:38:44Z","snapshot_observed_at":"2026-08-12T23:39:58.417549Z","submitted_at":"2024-06-18T15:38:41Z","title":"Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12718","snapshot_observed_at":"2026-08-12T20:12:25.208627Z","title":"Agla: Mitigating object hallucinations in large vision- language models with assembly of global and local attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.208627Z"},"links":{"cited_paper":"/paper/2406.12718","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:8c0b9a3df75700a70b2270763a63349473c91341c5e8a6bcd37e45918a74f588","observation_id":"7edc2242-ccb9-4131-bdc0-7323c428ea06","resolution":{"observed_at":"2026-08-12T20:12:25.208627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-12T20:12:25.214251Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.214251Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:75f5bf67a7d866fe8b434fd915203bff56c23d4996c78e4b35325fa4d8f1249f","observation_id":"b6ec5f85-d198-4d90-9c18-217dfa8d8ad4","resolution":{"observed_at":"2026-08-12T20:12:25.214251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-08-13T14:42:26.982679Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-12T20:12:25.218918Z","title":"Shikra: Unleashing multimodal llm’s ref- erential dialogue magic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.218918Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:33eaa79bb57131fdbb65433649c8e8799820f524bebe6544e97ef09cd9da1860","observation_id":"fdebd2eb-b4a3-4829-94c9-6d9ea2d514b6","resolution":{"observed_at":"2026-08-12T20:12:25.218918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:26.038046Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models","venue":null,"work_id":"106da497-0c85-4fab-9802-593d6ffc46cf","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.223467Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:db38f4cf189bf83bb3c07fe09ecc2dae8525042bb6f165e2f6525716b3b76d26","observation_id":"17949207-2723-4a66-818d-56cc299b48a8","resolution":{"observed_at":"2026-08-12T20:12:26.042804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:26.021610Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":"45ec0ff6-759b-4ecf-b430-5c0322ac918f","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.227708Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:ec637fd2cf7f9e864b0d6548e1718be72ccefb6563a30f82eefb75a9282761d2","observation_id":"e08f02a7-5035-45cd-af36-091819707549","resolution":{"observed_at":"2026-08-12T20:12:26.026650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-13T04:05:43.225856Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-12T20:12:25.232011Z","title":"Halc: Object hallucination reduc- tion via adaptive focal-contrast decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.232011Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:477c38a25d48ea0bf8b3e5ffce7b819ba1247c9fad844fd345fb0e3c5404f466","observation_id":"50dc7d26-2604-4912-b175-5a42100c1be3","resolution":{"observed_at":"2026-08-12T20:12:25.232011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03883","last_updated":"2024-03-11T02:01:09Z","snapshot_observed_at":"2026-08-06T11:43:44.726916Z","submitted_at":"2023-09-07T17:45:31Z","title":"DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03883","snapshot_observed_at":"2026-08-12T20:12:25.236127Z","title":"Dola: Decoding by con- trasting layers improves factuality in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.236127Z"},"links":{"cited_paper":"/paper/2309.03883","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:c98399d1d0796901fd2a29245be20f836f9ffc9fcdb566c4f92ef8eb602c7ae9","observation_id":"90dd223b-9406-44c2-91c4-9c6ec5305db1","resolution":{"observed_at":"2026-08-12T20:12:25.236127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-12T20:12:25.241066Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.241066Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:f0c913f1a405cbd9b14e65e480790bd4fde47bbacb1c225362c0c8c1ff6ab535","observation_id":"28930993-de74-4e22-ac99-749a59bcc78e","resolution":{"observed_at":"2026-08-12T20:12:25.241066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:26.007688Z","title":"Instructblip: Towards general-purpose vision-language models with instruction tuning","venue":null,"work_id":"a92abd51-7f98-424c-bcaf-c12788255b82","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.245069Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:23fd38a6daf31e381975ea5d2e816be1d36568bcbc49d8c55bf23134458e575a","observation_id":"0fee5eec-0fbb-46b3-969d-889ba0becc2b","resolution":{"observed_at":"2026-08-12T20:12:26.012141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T20:12:25.248563Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.248563Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:87a64dd676470ba9cb394731ad77190da833601d4eb032c0abd4fbeeb504be58","observation_id":"e4944e9e-bd67-4a88-92c1-f0a5547785b1","resolution":{"observed_at":"2026-08-12T20:12:25.248563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12390","last_updated":"2024-07-03T08:44:45Z","snapshot_observed_at":"2026-08-13T05:38:11.293178Z","submitted_at":"2024-04-18T17:59:54Z","title":"BLINK: Multimodal Large Language Models Can See but Not Perceive","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12390","snapshot_observed_at":"2026-08-12T20:12:25.253133Z","title":"Blink: Multimodal large language models can see but not perceive","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.253133Z"},"links":{"cited_paper":"/paper/2404.12390","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:56a6907c6bf64dc0c7bda902dffc0d3ed4d33f9fa8cc2a699db5d414b9894c26","observation_id":"28a73a8d-5055-4bab-a60d-3fca6d663680","resolution":{"observed_at":"2026-08-12T20:12:25.253133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04790","last_updated":"2023-06-13T13:31:12Z","snapshot_observed_at":"2026-08-13T11:47:12.124695Z","submitted_at":"2023-05-08T15:45:42Z","title":"MultiModal-GPT: A Vision and Language Model for Dialogue with Humans","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04790","snapshot_observed_at":"2026-08-12T20:12:25.257623Z","title":"Multimodal-gpt: A vision and lan- guage model for dialogue with humans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.257623Z"},"links":{"cited_paper":"/paper/2305.04790","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:354fb297e0b0b7af6400e473cf721692e453576b125322adb823add846d9f504","observation_id":"67f5bda6-596a-4d9a-a239-64c14c72b8df","resolution":{"observed_at":"2026-08-12T20:12:25.257623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.263326Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answer- ing","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.263326Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:da37abbca9ac42c369e9d7d45fd16bfda1d0b6eac71fab74183ccfa698d99664","observation_id":"249facda-1336-49e5-8d2b-9fedfb069ed3","resolution":{"observed_at":"2026-08-12T20:12:25.263326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14566","last_updated":"2024-03-25T06:05:24Z","snapshot_observed_at":"2026-08-02T21:20:28.501823Z","submitted_at":"2023-10-23T04:49:09Z","title":"HallusionBench: An Advanced Diagnostic Suite for Entangled Language Hallucination and Visual Illusion in Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14566","snapshot_observed_at":"2026-08-12T20:12:25.268178Z","title":"Hallusionbench: An advanced diag- nostic suite for entangled language hallucination and visual illusion in large vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.268178Z"},"links":{"cited_paper":"/paper/2310.14566","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:0c853c7df28446fa15023ee2c2da67c8a25a0809bb918df7e6557ab0affc0b57","observation_id":"08f94172-720d-4d48-b4e7-c60aa6411e96","resolution":{"observed_at":"2026-08-12T20:12:25.268178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.273662Z","title":"Vizwiz grand challenge: Answering visual questions from blind people","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.273662Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:168f68c807e07ca47f01ad292b59679e94c9b8a9780b2524b18d8bdf6df60ea9","observation_id":"04fd8043-e9b7-43e6-8cd3-5d6d94a60980","resolution":{"observed_at":"2026-08-12T20:12:25.273662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.975300Z","title":"Opera: Alleviating hallucination in multi-modal large language models via over-trust penalty and retrospection- allocation","venue":null,"work_id":"bfd03c60-83e3-4409-b476-34f3d890ab4b","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.278308Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:4cdf6c21ae48a22402feab8776bf1a645e18ca4322aabe5c084fdb1425e8a576","observation_id":"1dd6f320-4415-40c5-ae84-4ffd40b13db7","resolution":{"observed_at":"2026-08-12T20:12:25.980565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.282846Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.282846Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:b5cfed7804b45df8f0f675688b444eba638c25a59e0823ef8959ef2f207cd458","observation_id":"71b4606c-a735-4a59-bdc2-9cb188612e7e","resolution":{"observed_at":"2026-08-12T20:12:25.282846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-12T20:12:25.287281Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.287281Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:817aaead05b4532c7aed0ff6554718f13d0defb9b4a31acf455425f8c5d4f63e","observation_id":"0b3c6c01-cae0-42e2-a720-6c6dbbdb855a","resolution":{"observed_at":"2026-08-12T20:12:25.287281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.953344Z","title":"Mitigating object hal- lucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"b5904792-2aa1-4beb-9c3f-fb9a83fad069","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.292043Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:8bdd71a40805021cb5dcfec57031c018876ca75c53d2d3c182a8bd58263b114a","observation_id":"ba3f93f4-6b9b-4d6a-ae35-89e96d5df01a","resolution":{"observed_at":"2026-08-12T20:12:25.958089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-12T20:12:25.296636Z","title":"Seed-bench: Benchmarking multi- modal llms with generative comprehension","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.296636Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:8669fcc19321874b6cede01dc34b27811bcb28c491cc593386c96ae5e93cc2d9","observation_id":"12e930f2-abdb-4369-a725-0fdd98b63cdb","resolution":{"observed_at":"2026-08-12T20:12:25.296636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.939226Z","title":"Fine-tuning multimodal llms to follow zero-shot demonstrative instructions","venue":null,"work_id":"ca8f06ef-c33a-424c-888c-037d2d13ac31","year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.300590Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:615db3a6ab1d534a84c10d0732064c5ba953efedf4e348a822e6cfb5d95cd9c3","observation_id":"2fac54ec-00b3-4245-bab3-54e5af2ebd1b","resolution":{"observed_at":"2026-08-12T20:12:25.944435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.926373Z","title":"Inference-time intervention: Elicit- ing truthful answers from a language model","venue":null,"work_id":"77bb0034-4d19-4d8d-97c4-3f9640e820aa","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.304976Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:23345b73c0d4d455ba1bb6877b9f886eed8d7be575e4608be4b6a44bb271888e","observation_id":"4b66e17d-6d70-4075-8d5b-d02e123e53d6","resolution":{"observed_at":"2026-08-12T20:12:25.930773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-12T20:12:25.309482Z","title":"Evaluating object hallucina- tion in large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.309482Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:88f4bdf50663407fa11bbcc9c26075eebb0e39dd7a6a67d47782d7c26c691a4d","observation_id":"41c52b43-b604-4860-be98-45ad83773317","resolution":{"observed_at":"2026-08-12T20:12:25.309482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17043","last_updated":"2023-11-28T18:53:43Z","snapshot_observed_at":"2026-08-13T05:15:07.522678Z","submitted_at":"2023-11-28T18:53:43Z","title":"LLaMA-VID: An Image is Worth 2 Tokens in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17043","snapshot_observed_at":"2026-08-12T20:12:25.313654Z","title":"Llama-vid: An image is worth 2 tokens in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.313654Z"},"links":{"cited_paper":"/paper/2311.17043","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:508cd57535aff6ace2e77066699dafe48eaa7a499615537656f6abb8a48511de","observation_id":"a3a96c06-e4e9-428f-82e6-e6caed302a18","resolution":{"observed_at":"2026-08-12T20:12:25.313654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-12T20:12:25.317748Z","title":"Mini-gemini: Mining the potential of multi-modality vision language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.317748Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:863d5f0d5c14e42be0ae9379cfb3b5cfd8984bbaa5c8922b1d7bd4ad1373feb9","observation_id":"faf51b02-6611-4def-a105-ed2e629d979c","resolution":{"observed_at":"2026-08-12T20:12:25.317748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-12T20:12:25.323100Z","title":"Truthfulqa: Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.323100Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:50ed39afcc91a25c6772c0ec7673bc7d325f1b4ce7c87fd1278368ee6353769a","observation_id":"101b9bf6-7512-4ad7-83b4-f8a685d48526","resolution":{"observed_at":"2026-08-12T20:12:25.323100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-08-06T22:33:34.254048Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14565","snapshot_observed_at":"2026-08-12T20:12:25.327970Z","title":"Aligning large multi-modal model with robust instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.327970Z"},"links":{"cited_paper":"/paper/2306.14565","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:e39db7043335915ee11b947c931d8a8e90b17b4989b26c01c51b1fe2f3b78ddf","observation_id":"3627312f-4097-4036-88b1-15e0e8897df0","resolution":{"observed_at":"2026-08-12T20:12:25.327970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.912214Z","title":"Visual instruction tuning","venue":null,"work_id":"f916352e-591c-4a46-a91d-00b36706e775","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.332405Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:1f9b5b0466e7a737cafc7ffa50ae9d0378112f96c2ea14627b18071bf2df86f7","observation_id":"0cfc0dfa-21d9-4b2e-8541-baf5e2644961","resolution":{"observed_at":"2026-08-12T20:12:25.916731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10492","last_updated":"2024-10-03T18:08:57Z","snapshot_observed_at":"2026-08-13T00:53:12.536028Z","submitted_at":"2024-03-15T17:27:12Z","title":"Mitigating Dialogue Hallucination for Large Vision Language Models via Adversarial Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10492","snapshot_observed_at":"2026-08-12T20:12:25.335894Z","title":"Mitigating dialogue hallucination for large multi- modal models via adversarial instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.335894Z"},"links":{"cited_paper":"/paper/2403.10492","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:1bf329eb1f340a5461aeb7ce71ceb00af6e00eeb81697d40fe410e6980357ea1","observation_id":"6090bd95-5c06-4e1a-abdd-f86a34d4c252","resolution":{"observed_at":"2026-08-12T20:12:25.335894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-10T08:25:28.506770Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-12T20:12:25.339770Z","title":"Object hallucination in image cap- tioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.339770Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:86cb727471265f3dfe4d05f7aa009db8d29556b9510b2bef1cf27a3e9af6e111","observation_id":"60a55ec2-3aac-4279-a420-b4cac8b0513b","resolution":{"observed_at":"2026-08-12T20:12:25.339770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T20:12:25.343655Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.343655Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:49745bd800596eedc5cf2528e023bf438a132463d4cfd3161d694399c18fe3dc","observation_id":"512cb94c-b825-4d7c-9595-460fdb5b935b","resolution":{"observed_at":"2026-08-12T20:12:25.343655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.899169Z","title":"Qwen2.5: A party of foundation models, 2024","venue":null,"work_id":"91d54ca0-45b9-4a12-9eb5-da96f6db7889","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.347772Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:4a3f642ff384e7759b5e52c8bd405ced68fcfd6df168250a4bd32da7b71618e2","observation_id":"96e4df4f-10ad-412a-940b-42dded73a0ad","resolution":{"observed_at":"2026-08-12T20:12:25.903605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T20:12:25.352607Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.352607Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:7b8d220afaaccf2cb1c02e2009ccd7513053a521b0542b0aad2fdcccb93ca7f8","observation_id":"37a4881e-785b-4bf9-b3e8-5a552002ccb0","resolution":{"observed_at":"2026-08-12T20:12:25.352607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-13T11:35:26.769154Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-12T20:12:25.357101Z","title":"Label words are an- chors: An information flow perspective for understanding in- context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.357101Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:54e8ee29a1cae1fec9cb00adafb66d35ca8ddb1feed048d0b7d9f23fcb23b466","observation_id":"2d09e604-e5bb-45b0-bb55-56cd6ae902f4","resolution":{"observed_at":"2026-08-12T20:12:25.357101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.887336Z","title":"Dopra: Decoding over-accumulation penalization and re-allocation in specific weighting layer","venue":null,"work_id":"2196864a-cedc-4371-8f40-06b1621d264a","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.361722Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:5d682e954e9c3d0d4f24812fe03ab8bc8e0aa28d1667ec735e3908d89cc03b05","observation_id":"6d34a6f8-646b-4d3b-961e-020806eddbfb","resolution":{"observed_at":"2026-08-12T20:12:25.891262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-12T20:12:25.365865Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.365865Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:cec2d73a701536de78c89c27f513a224af18b4de053f3ddbdbcd04bb47a6c9e8","observation_id":"ad6b1db3-5500-43e3-a82f-2eb847c59763","resolution":{"observed_at":"2026-08-12T20:12:25.365865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15926","last_updated":"2024-10-21T11:54:53Z","snapshot_observed_at":"2026-08-12T22:18:39.252999Z","submitted_at":"2024-10-21T11:54:53Z","title":"Mitigating Object Hallucination via Concentric Causal Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15926","snapshot_observed_at":"2026-08-12T20:12:25.370246Z","title":"Miti- gating object hallucination via concentric causal attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.370246Z"},"links":{"cited_paper":"/paper/2410.15926","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:a2c11744fe3da6b879d5396ebf020f38b1c957451ee15471d813be3ddaaa6d0a","observation_id":"bef5eb58-35af-4d93-bf56-ec2992193af6","resolution":{"observed_at":"2026-08-12T20:12:25.370246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T20:12:25.374701Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.374701Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:a2f5366d6c18d8d6a114b3420d9daf17a70fb785e7b5cc8a9c84b9b44293e0d7","observation_id":"50911a35-d0c8-4b9a-b77b-c795299b24d3","resolution":{"observed_at":"2026-08-12T20:12:25.374701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-12T20:12:25.378642Z","title":"A survey on multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.378642Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:02549a7383632477f41c96feb725f37e15c074c3d9c97aa4bcc493f4371058e5","observation_id":"20c63d24-b751-40d1-8413-7eb3c0896b70","resolution":{"observed_at":"2026-08-12T20:12:25.378642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-12T20:12:25.382754Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.382754Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:5f6d640baffaaf68816d7632a6e525b31002ac2f97feb6ad4473c5fc92414785","observation_id":"e2ae72f2-a74e-4f25-b16c-9c8de09397e2","resolution":{"observed_at":"2026-08-12T20:12:25.382754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-12T23:37:04.889598Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-12T20:12:25.386894Z","title":"Unveiling and har- nessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.386894Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:cf40cf48ab70433422ecaf28b6339f62f6196a55cf2e328eca0ef4152a6acbf4","observation_id":"8dae5ba5-8f92-49ef-b141-71c705dc3706","resolution":{"observed_at":"2026-08-12T20:12:25.386894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:12:25.871735Z","title":"Less is more: Mit- igating multimodal hallucination from an eos decision per- spective","venue":null,"work_id":"a6a3d099-d682-4502-8212-159115dc556c","year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.392161Z"},"links":{"citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:0e6f12e7e30551f973fbf65386097deafd3c561606418aa192cf49197b4769ff","observation_id":"986840d2-860e-4ea8-aadf-d8a3198c3ec6","resolution":{"observed_at":"2026-08-12T20:12:25.877905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-08-13T15:50:38.254753Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-12T20:12:25.396200Z","title":"Video-llama: An instruction-tuned audio-visual language model for video un- derstanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.396200Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:391123da67225e9ba6af0800df589d163bec4996613c57809134054081d3a7f4","observation_id":"a42786b8-adcd-447c-9b03-8663bfeb7d2c","resolution":{"observed_at":"2026-08-12T20:12:25.396200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06579","last_updated":"2024-10-17T01:17:25Z","snapshot_observed_at":"2026-08-12T23:50:30.126399Z","submitted_at":"2024-06-04T13:52:54Z","title":"From Redundancy to Relevance: Information Flow in LVLMs Across Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06579","snapshot_observed_at":"2026-08-12T20:12:25.400685Z","title":"From redundancy to relevance: Infor- mation flow in lvlms across reasoning tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.400685Z"},"links":{"cited_paper":"/paper/2406.06579","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:c62b576347d398c6bf3f1c00aae4aa904b08c9a678a6191c900a785af904ac72","observation_id":"0e289667-89a8-4c1a-bbaa-5a491e60b570","resolution":{"observed_at":"2026-08-12T20:12:25.400685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-12T20:12:25.404728Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.404728Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:aac1f54e1b97239b0e8dc84c328c66e9eb5964a6e722dd3c23cec3df9c502a64","observation_id":"ac1c0026-83ec-4945-988b-9196c20bd4c7","resolution":{"observed_at":"2026-08-12T20:12:25.404728Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T01:32:02.986809Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 26 inbound Pith citation observations for arXiv:2411.09968."}