{"as_of":"2026-08-15T13:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1a70fb2dbf61c44a574df9576ca9a0a71eaddfb3a88b0715d6855bc9e686311","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:43:37.428548Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07184/citation-record","integrity":"/paper/2506.07184/integrity","json":"/paper/2506.07184/citation-record.json","paper":"/paper/2506.07184"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:28.909282Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:28.909282Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:7754b78d94176f87715418d4210c0131979e5999e5d6d4dab3f867cbd16db316","observation_id":"111fc2c7-733f-452a-9b5d-7c45e28737ef","resolution":{"observed_at":"2026-08-07T05:43:28.909282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:29.080116Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:29.080116Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:27a9148ccabb6577003018fdac449a32893bcfa25bf1fb3daa78589af7757a52","observation_id":"b67c614e-8e40-4e7d-833d-8032fc1e8cf8","resolution":{"observed_at":"2026-08-07T05:43:29.080116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12257","last_updated":"2024-09-18T18:40:02Z","snapshot_observed_at":"2026-08-12T22:42:13.435300Z","submitted_at":"2024-09-18T18:40:02Z","title":"MQA-KEAL: Multi-hop Question Answering under Knowledge Editing for Arabic Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12257","snapshot_observed_at":"2026-08-07T05:43:29.212447Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:29.212447Z"},"links":{"cited_paper":"/paper/2409.12257","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:80a33cc1b1e96fecb766d173029b938c85e1066435d9a84c68181656ebac9b50","observation_id":"012614e4-d3e2-41f8-a734-d9df73f633e1","resolution":{"observed_at":"2026-08-07T05:43:29.212447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T05:43:29.354283Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:29.354283Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:3dfca650cfd51294fc6ee3d0e2b75e02abb9fea0ee1cb34d7e19dff543bb6d0d","observation_id":"1fb1ffda-dbe0-47ca-9915-8cd0a9284331","resolution":{"observed_at":"2026-08-07T05:43:29.354283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03631","last_updated":"2024-10-16T19:35:55Z","snapshot_observed_at":"2026-08-13T05:08:34.510226Z","submitted_at":"2023-12-06T17:28:03Z","title":"Mitigating Open-Vocabulary Caption Hallucinations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03631","snapshot_observed_at":"2026-08-07T05:43:29.493103Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:29.493103Z"},"links":{"cited_paper":"/paper/2312.03631","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:3290d70182d48d7d5d6696575ab160783030b68a934bcdb542b6a57ce8ec6021","observation_id":"2a352a90-f6f3-4c94-8df6-283947b7bd73","resolution":{"observed_at":"2026-08-07T05:43:29.493103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05243","last_updated":"2024-12-06T18:22:47Z","snapshot_observed_at":"2026-08-11T20:47:10.764744Z","submitted_at":"2024-12-06T18:22:47Z","title":"CompCap: Improving Multimodal Large Language Models with Composite Captions","version":1},"cited_work":{"arxiv_id":"2412.05243","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05243","snapshot_observed_at":"2026-08-07T05:43:39.016056Z","title":"CompCap: Improving Multimodal Large Language Models with Composite Captions","venue":"cs.CV","work_id":"fd92fcd0-6bad-436b-be44-ffba5890a824","year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:29.621031Z"},"links":{"cited_paper":"/paper/2412.05243","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:3c5c7cd7570f56e489130a08e8a2abe5879f11fb8716e804606c9c952b634216","observation_id":"b94b2238-39c5-41da-a667-77f2a8750e6f","resolution":{"observed_at":"2026-08-07T05:43:39.103644Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-13T04:05:43.225856Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-07T05:43:29.824690Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:29.824690Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:e7b10809819bee3abe2c30e69c9ebf08262fe9b9978c43dc08ceb51fa215576c","observation_id":"d60ae036-b131-4d17-8c9b-5716289c46d7","resolution":{"observed_at":"2026-08-07T05:43:29.824690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14238","last_updated":"2024-01-15T15:23:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-21T18:59:31Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14238","snapshot_observed_at":"2026-08-07T05:43:29.994657Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:29.994657Z"},"links":{"cited_paper":"/paper/2312.14238","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:78bfa6ed50ac3ac9862593a4aed6dd41b12d6d10f605fe15968ec33bf532dd69","observation_id":"2f096af6-601c-47ae-a3b2-8a7e6cf9eff0","resolution":{"observed_at":"2026-08-07T05:43:29.994657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00829","last_updated":"2025-06-03T16:03:55Z","snapshot_observed_at":"2026-08-13T14:35:56.266930Z","submitted_at":"2025-06-01T04:26:46Z","title":"COMPKE: Complex Question Answering under Knowledge Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00829","snapshot_observed_at":"2026-08-07T05:43:30.125296Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:30.125296Z"},"links":{"cited_paper":"/paper/2506.00829","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:5eb70a96ec2921134a124cc2adf81929a5fbdc9ee72cd8e5a1aad31bd422819d","observation_id":"9cf5b3d2-a51d-4b6b-b03f-e8726ec02d00","resolution":{"observed_at":"2026-08-07T05:43:30.125296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00492","last_updated":"2024-03-30T23:22:51Z","snapshot_observed_at":"2026-08-13T00:40:48.061505Z","submitted_at":"2024-03-30T23:22:51Z","title":"Multi-hop Question Answering under Temporal Knowledge Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00492","snapshot_observed_at":"2026-08-07T05:43:30.256624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:30.256624Z"},"links":{"cited_paper":"/paper/2404.00492","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:a2e64afda912dfe909532a5ab63608fd5dbfd378e6eec83f65d890270e8934ce","observation_id":"b4bed4a9-c70e-472c-b6be-95df02d80479","resolution":{"observed_at":"2026-08-07T05:43:30.256624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00894","last_updated":"2025-06-01T08:29:59Z","snapshot_observed_at":"2026-08-12T16:54:31.518808Z","submitted_at":"2025-06-01T08:29:59Z","title":"CODEMENV: Benchmarking Large Language Models on Code Migration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00894","snapshot_observed_at":"2026-08-07T05:43:30.379749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:30.379749Z"},"links":{"cited_paper":"/paper/2506.00894","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:7eb4d5d0244a4b21da92abe22be6607ae5c4689efe06364ce9e420b22a8806fd","observation_id":"cdb28e38-59cd-4712-8749-c39d55b7c548","resolution":{"observed_at":"2026-08-07T05:43:30.379749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15300","last_updated":"2024-04-23T09:32:25Z","snapshot_observed_at":"2026-08-15T00:58:22.157163Z","submitted_at":"2024-02-23T12:57:16Z","title":"Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15300","snapshot_observed_at":"2026-08-07T05:43:30.548053Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:30.548053Z"},"links":{"cited_paper":"/paper/2402.15300","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:dc656a38cc041a20feb619f22bb69565b1d532f8ac9fd7a76327bebe8d5b2605","observation_id":"f5ce18c0-7c9d-47af-861d-958057782d70","resolution":{"observed_at":"2026-08-07T05:43:30.548053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-07T05:43:30.658007Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:30.658007Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:9cae695895f99cb12959a56a6217b96db0e0bcea39ffaf180c253300d0c26435","observation_id":"eb5c7f6a-b35d-4f78-ba9e-305312326454","resolution":{"observed_at":"2026-08-07T05:43:30.658007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08571","last_updated":"2023-01-20T13:38:24Z","snapshot_observed_at":"2026-08-13T13:00:38.440219Z","submitted_at":"2023-01-20T13:38:24Z","title":"Visual Writing Prompts: Character-Grounded Story Generation with Curated Image Sequences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08571","snapshot_observed_at":"2026-08-07T05:43:30.796251Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:30.796251Z"},"links":{"cited_paper":"/paper/2301.08571","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:3260cf058f50a4769f7c9f70075387285112b51c6470b870e1e531f75d10fa5b","observation_id":"01f3c5dd-3e8e-4e60-bab4-deae4d053a67","resolution":{"observed_at":"2026-08-07T05:43:30.796251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03595","last_updated":"2024-10-04T16:55:30Z","snapshot_observed_at":"2026-08-12T22:30:34.416492Z","submitted_at":"2024-10-04T16:55:30Z","title":"Understanding Reasoning in Chain-of-Thought from the Hopfieldian View","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03595","snapshot_observed_at":"2026-08-07T05:43:30.956139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:30.956139Z"},"links":{"cited_paper":"/paper/2410.03595","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:52e83a4a16d6ba01609e88b5fa4ba9c42ad6c77b005ac45614d8a6faf52c77dc","observation_id":"38a2dbc8-22ea-4866-9c55-3092568ab4c3","resolution":{"observed_at":"2026-08-07T05:43:30.956139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:39.384466Z","title":null,"venue":null,"work_id":"56ff24ae-aa5a-4b1b-84fc-1111961c42cf","year":2025},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:31.117116Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:a688c57f9713cfdcb77a8ed150ed677387f3e0cfe848009d2c9e2bc621db1bcb","observation_id":"da0dabff-15c0-4d10-bd66-3fcab9e86af0","resolution":{"observed_at":"2026-08-07T05:43:39.448977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:31.284019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:31.284019Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:b16d3fdc1f99770ff5d4408d07f93abc0243010052b8324218e582f80dbe8fd1","observation_id":"711e6788-07e1-48e5-a2fe-3d0c0b05f705","resolution":{"observed_at":"2026-08-07T05:43:31.284019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.03968","last_updated":"2016-04-13T20:27:43Z","snapshot_observed_at":"2026-08-14T22:01:46.935085Z","submitted_at":"2016-04-13T20:27:43Z","title":"Visual Storytelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.03968","snapshot_observed_at":"2026-08-07T05:43:31.429338Z","title":"Lawrence Zitnick, Devi Parikh, Lucy Vanderwende, Michel Galley, and Margaret Mitchell","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:31.429338Z"},"links":{"cited_paper":"/paper/1604.03968","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:7a2aaff0d684d2e90bec20dbd1e9dc5aac180038de0268cd17284b31ff4e70fa","observation_id":"dc9b9371-d765-47f5-9df4-1cf77f494c93","resolution":{"observed_at":"2026-08-07T05:43:31.429338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14233","last_updated":"2023-12-21T18:49:47Z","snapshot_observed_at":"2026-08-14T15:56:39.804559Z","submitted_at":"2023-12-21T18:49:47Z","title":"VCoder: Versatile Vision Encoders for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14233","snapshot_observed_at":"2026-08-07T05:43:31.570069Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:31.570069Z"},"links":{"cited_paper":"/paper/2312.14233","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:b56c04cc4427896e2a2fd53be186abb442c1e50c93e42d3636c7c9b9c13fc443","observation_id":"1cd5d190-9626-4add-b0dd-78d1d0d58adf","resolution":{"observed_at":"2026-08-07T05:43:31.570069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08256","last_updated":"2023-10-12T12:01:32Z","snapshot_observed_at":"2026-08-13T05:50:44.141635Z","submitted_at":"2023-10-12T12:01:32Z","title":"Impact of Co-occurrence on Factual Knowledge of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08256","snapshot_observed_at":"2026-08-07T05:43:31.654812Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:31.654812Z"},"links":{"cited_paper":"/paper/2310.08256","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:dc73935f0ec1c5620c21e1858dd978a6b7473eabaa2270af9c79dedce38d572a","observation_id":"64e76a39-7d0f-40af-bcf2-1dee11ab4ffd","resolution":{"observed_at":"2026-08-07T05:43:31.654812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1017715","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:38.601497Z","title":null,"venue":null,"work_id":"1be93663-7c04-49cf-b76e-30005c831fb2","year":2025},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:31.771651Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:e2cd2dae112131cba680d37187af62cc62b58101bb0fd11268cb435a6b332d4b","observation_id":"a17236b2-5d6f-466d-9cce-f70c5bbd4cc3","resolution":{"observed_at":"2026-08-07T05:43:38.712484Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07362","last_updated":"2024-04-02T04:12:43Z","snapshot_observed_at":"2026-08-15T00:58:24.108208Z","submitted_at":"2023-11-13T14:26:24Z","title":"Volcano: Mitigating Multimodal Hallucination through Self-Feedback Guided Revision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07362","snapshot_observed_at":"2026-08-07T05:43:31.958836Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:31.958836Z"},"links":{"cited_paper":"/paper/2311.07362","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:35f3d46fac5d3a62fc86b53d2246f952ee590e458c65444c07108f465ba45fd3","observation_id":"f6fb1741-6866-4fca-9506-033c48b0471e","resolution":{"observed_at":"2026-08-07T05:43:31.958836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16922","last_updated":"2023-11-28T16:26:35Z","snapshot_observed_at":"2026-08-13T05:15:15.914754Z","submitted_at":"2023-11-28T16:26:35Z","title":"Mitigating Object Hallucinations in Large Vision-Language Models through Visual Contrastive Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16922","snapshot_observed_at":"2026-08-07T05:43:32.054370Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:32.054370Z"},"links":{"cited_paper":"/paper/2311.16922","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:ef661c7cba2b219aa3ffb61ac6988d0386f1752b0cfe657674914a023fc25900","observation_id":"3843924e-01e0-4a07-8f1d-c592b3faf994","resolution":{"observed_at":"2026-08-07T05:43:32.054370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:32.215608Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:32.215608Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:b6508a291cd3bc5f31b3d16d3092dab6a7b7d4a4ac0683eba2ac33f170214737","observation_id":"6a39cfc3-04d6-4c0b-b2b0-39489b4df711","resolution":{"observed_at":"2026-08-07T05:43:32.215608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T05:43:32.346113Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:32.346113Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:1b929a63501a045032c90377dda9f32ef472749969484923db58cdeb75f57d48","observation_id":"8e0331ae-51a8-4cb6-8e55-52176c76e3ad","resolution":{"observed_at":"2026-08-07T05:43:32.346113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-08-13T00:09:23.835117Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-07T05:43:32.559182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:32.559182Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:da2a3f6a976a2cfb24312a0f936d280ac3a0629cb1d520c41762a7169a67fa6e","observation_id":"ba1f3937-444b-4ad9-b686-4a5cf4401404","resolution":{"observed_at":"2026-08-07T05:43:32.559182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-07T05:43:32.677434Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:32.677434Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:fe94a9c01241f4c24bb2cd255f5572f8d131be5f999a542e8d2eea26c8a79eb7","observation_id":"e0d7a00e-9e6c-42b1-ad39-fd7c91070a70","resolution":{"observed_at":"2026-08-07T05:43:32.677434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-08-15T06:26:48.150151Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14565","snapshot_observed_at":"2026-08-07T05:43:32.833086Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:32.833086Z"},"links":{"cited_paper":"/paper/2306.14565","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:dc79e0491f94bb5da675157aebabf7693e4ebe557cb02acca3439a9a80bb5563","observation_id":"625e8ce7-77c7-4f2b-8269-15d0c3c31bbd","resolution":{"observed_at":"2026-08-07T05:43:32.833086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13805","last_updated":"2026-05-15T05:14:37Z","snapshot_observed_at":"2026-08-10T12:19:02.869819Z","submitted_at":"2024-03-20T17:59:55Z","title":"RAR: Retrieving And Ranking Augmented MLLMs for Visual Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13805","snapshot_observed_at":"2026-08-07T05:43:32.970624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:32.970624Z"},"links":{"cited_paper":"/paper/2403.13805","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:2e051612bbcb3ddfece4d79f3b3a2ce3c01f585be5476e755aa72b2074bc30b5","observation_id":"36a2220f-1c7a-41b4-b518-01f269093948","resolution":{"observed_at":"2026-08-07T05:43:32.970624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08870","last_updated":"2025-03-03T17:58:12Z","snapshot_observed_at":"2026-08-15T03:08:12.930939Z","submitted_at":"2023-12-12T09:47:59Z","title":"Vista-LLaMA: Reducing Hallucination in Video Language Models via Equal Distance to Visual Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08870","snapshot_observed_at":"2026-08-07T05:43:33.190355Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:33.190355Z"},"links":{"cited_paper":"/paper/2312.08870","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:3297d5fe32a2ab134890bfe810985f360718dead3e20397c9e8463a27d896bde","observation_id":"73b8ef74-1160-4320-a0b4-1d300b3dc3c7","resolution":{"observed_at":"2026-08-07T05:43:33.190355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-14T18:32:00.128699Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-07T05:43:33.360788Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:33.360788Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:01c86b3383e607f52219c693597952d41384611effccb6a6dc9953060271992e","observation_id":"a94121d6-81fa-418c-a4c3-2e22b46e06bb","resolution":{"observed_at":"2026-08-07T05:43:33.360788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05540","last_updated":"2023-05-23T11:18:30Z","snapshot_observed_at":"2026-08-13T11:35:41.578487Z","submitted_at":"2023-05-23T11:18:30Z","title":"DetectLLM: Leveraging Log Rank Information for Zero-Shot Detection of Machine-Generated Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05540","snapshot_observed_at":"2026-08-07T05:43:33.542883Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:33.542883Z"},"links":{"cited_paper":"/paper/2306.05540","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:1dca52eec4996d931513a2cdd348487edca48c8e68bc709e90aaaffca3166245","observation_id":"6430213c-415f-49bc-9e8b-72f65a81e8c3","resolution":{"observed_at":"2026-08-07T05:43:33.542883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-07T05:43:33.757497Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:33.757497Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:4035a2fcd0b7fab74479d1526851a779fe6fa79f310a325e5978036f456a4c45","observation_id":"628dbd07-89b3-4e86-967a-d51d92f129e4","resolution":{"observed_at":"2026-08-07T05:43:33.757497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02219","last_updated":"2025-05-30T11:40:41Z","snapshot_observed_at":"2026-08-13T05:10:55.404957Z","submitted_at":"2023-12-03T16:39:36Z","title":"Behind the Magic, MERLIM: Multi-modal Evaluation Benchmark for Large Image-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02219","snapshot_observed_at":"2026-08-07T05:43:33.934149Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:33.934149Z"},"links":{"cited_paper":"/paper/2312.02219","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:941bcf1442a0842856a55fbc2cf2332e2175bba57c775990c20e8b076f9ea9fb","observation_id":"0933451b-f5f2-4c78-8abe-84314733f6a8","resolution":{"observed_at":"2026-08-07T05:43:33.934149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11779","last_updated":"2025-02-23T15:14:47Z","snapshot_observed_at":"2026-08-15T00:02:16.973993Z","submitted_at":"2024-10-15T16:57:44Z","title":"MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11779","snapshot_observed_at":"2026-08-07T05:43:34.142890Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:34.142890Z"},"links":{"cited_paper":"/paper/2410.11779","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:344033f1b35b367cdcb336551ea37c028d36481d282e78520cf856200a943e0b","observation_id":"311beac4-0ceb-43c2-acdf-9bd79457968a","resolution":{"observed_at":"2026-08-07T05:43:34.142890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01701","last_updated":"2023-12-04T07:43:02Z","snapshot_observed_at":"2026-08-13T05:10:38.829055Z","submitted_at":"2023-12-04T07:43:02Z","title":"Mitigating Fine-Grained Hallucination by Fine-Tuning Large Vision-Language Models with Caption Rewrites","version":1},"cited_work":{"arxiv_id":"2312.01701","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.01701","snapshot_observed_at":"2026-08-07T05:43:38.150046Z","title":"Mitigating Fine-Grained Hallucination by Fine-Tuning Large Vision-Language Models with Caption Rewrites","venue":"cs.CV","work_id":"f35a1350-bbcc-4171-b2a0-953d557c87b7","year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:34.334943Z"},"links":{"cited_paper":"/paper/2312.01701","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:e3159180bebb033fa56b308b00840c227f2e8b5999f2e736d96dde154ec8fa7d","observation_id":"d8896fd0-5ed3-4958-be46-b18aed99e8b8","resolution":{"observed_at":"2026-08-07T05:43:38.256527Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T05:43:34.486649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:34.486649Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:84b8af010d4ab49ef3e1b786e7dc6b8dcb76b7889a46381078cd3671a31df128","observation_id":"62b92993-df73-4df0-a346-5ead6d086bb7","resolution":{"observed_at":"2026-08-07T05:43:34.486649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10529","last_updated":"2024-01-25T04:11:57Z","snapshot_observed_at":"2026-08-13T04:39:22.403552Z","submitted_at":"2024-01-19T07:10:13Z","title":"Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10529","snapshot_observed_at":"2026-08-07T05:43:34.691445Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:34.691445Z"},"links":{"cited_paper":"/paper/2401.10529","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:70fd9583c4c7d14b073849795bac2cafe2c2846ac6fa4cc845adb10e9fa9e98d","observation_id":"990122ee-1d85-491e-8966-27c4fad6d45e","resolution":{"observed_at":"2026-08-07T05:43:34.691445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16338","last_updated":"2024-06-24T06:21:59Z","snapshot_observed_at":"2026-08-12T23:36:27.585760Z","submitted_at":"2024-06-24T06:21:59Z","title":"VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16338","snapshot_observed_at":"2026-08-07T05:43:34.855411Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:34.855411Z"},"links":{"cited_paper":"/paper/2406.16338","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:411e7efa03136f7db417c061601ea54dfe2b33ee184f2fe86c12823786b11514","observation_id":"07f4a18e-c5b7-4a42-880f-b2a1811df3c7","resolution":{"observed_at":"2026-08-07T05:43:34.855411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10900","last_updated":"2024-10-09T03:42:22Z","snapshot_observed_at":"2026-08-13T21:41:23.014829Z","submitted_at":"2024-06-16T11:44:43Z","title":"AutoHallusion: Automatic Generation of Hallucination Benchmarks for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10900","snapshot_observed_at":"2026-08-07T05:43:35.049938Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.049938Z"},"links":{"cited_paper":"/paper/2406.10900","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:9d2ae24c04e1d20533576c665915df856838fed95dbc890b32cc733755da6b07","observation_id":"cdc4c725-886e-4113-8257-8d1651bade11","resolution":{"observed_at":"2026-08-07T05:43:35.049938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09801","last_updated":"2024-09-23T02:05:02Z","snapshot_observed_at":"2026-08-13T04:18:30.738951Z","submitted_at":"2024-02-15T08:58:03Z","title":"EFUF: Efficient Fine-grained Unlearning Framework for Mitigating Hallucinations in Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09801","snapshot_observed_at":"2026-08-07T05:43:35.177456Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.177456Z"},"links":{"cited_paper":"/paper/2402.09801","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:1bcba6936fee33a3591320ee69d7aa5fb8a7453325da51c90af3b3841a036a85","observation_id":"fede79b0-6efd-413c-94bc-753022952baa","resolution":{"observed_at":"2026-08-07T05:43:35.177456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13345","last_updated":"2023-10-20T08:16:46Z","snapshot_observed_at":"2026-08-15T05:27:12.663189Z","submitted_at":"2023-10-20T08:16:46Z","title":"An LLM can Fool Itself: A Prompt-Based Adversarial Attack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13345","snapshot_observed_at":"2026-08-07T05:43:35.300296Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.300296Z"},"links":{"cited_paper":"/paper/2310.13345","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:54eb875d20ee6a931b2fb088a1360adb721972358d12425448d41f2470a803ec","observation_id":"a49bcc17-1f88-4835-9860-f7d9666e8067","resolution":{"observed_at":"2026-08-07T05:43:35.300296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:35.424218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.424218Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:ffe189c23bc6cc127ca9fd4c18730cc339e2ea25687d4fe1e6fe851a3b7fbfe1","observation_id":"734b906b-7b4e-4eb5-b437-7a920adfb3d8","resolution":{"observed_at":"2026-08-07T05:43:35.424218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11271","last_updated":"2024-03-30T22:05:59Z","snapshot_observed_at":"2026-08-13T04:17:03.534862Z","submitted_at":"2024-02-17T13:02:54Z","title":"MONAL: Model Autophagy Analysis for Modeling Human-AI Interactions","version":2},"cited_work":{"arxiv_id":"2402.11271","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11271","snapshot_observed_at":"2026-08-07T05:43:37.717560Z","title":"MONAL: Model Autophagy Analysis for Modeling Human-AI Interactions","venue":"cs.CL","work_id":"638fe302-ab7e-424f-905e-c2cb847bfa23","year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.567212Z"},"links":{"cited_paper":"/paper/2402.11271","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:bebecec125706b4e03473bb20a4d255fbc6c507c36f805118bb3fbb51f576c35","observation_id":"f9fd8c2c-f511-4b0f-b0dc-a5b3d1ddb740","resolution":{"observed_at":"2026-08-07T05:43:37.863534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10863","last_updated":"2025-02-16T22:19:15Z","snapshot_observed_at":"2026-08-12T22:28:45.006802Z","submitted_at":"2024-10-07T21:02:34Z","title":"Exploring the Personality Traits of LLMs through Latent Features Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10863","snapshot_observed_at":"2026-08-07T05:43:35.675147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.675147Z"},"links":{"cited_paper":"/paper/2410.10863","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:abe25183964af6e64265df8f3511370654149644ce38245f46b14dafe072a300","observation_id":"d021b2b4-a712-47b4-aace-7117a0e4e00a","resolution":{"observed_at":"2026-08-07T05:43:35.675147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12904","last_updated":"2025-05-26T06:03:03Z","snapshot_observed_at":"2026-08-12T08:38:09.853740Z","submitted_at":"2025-02-18T14:47:02Z","title":"Fraud-R1 : A Multi-Round Benchmark for Assessing the Robustness of LLM Against Augmented Fraud and Phishing Inducements","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12904","snapshot_observed_at":"2026-08-07T05:43:35.808325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.808325Z"},"links":{"cited_paper":"/paper/2502.12904","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:6bd2fab4f32c07fae492a726d8ebb89443c302302b924f5c10c6aa003dcfc2dc","observation_id":"47c352ea-c9fd-4ec8-aeec-8af44940afda","resolution":{"observed_at":"2026-08-07T05:43:35.808325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-07T05:43:35.925217Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:35.925217Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:a22e98f7192710282ab781b9b56409853d751cc1b1c650b24bfc72da377aba94","observation_id":"31f6c5d9-d4a7-4271-a962-294db7b7e0ed","resolution":{"observed_at":"2026-08-07T05:43:35.925217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:36.083174Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:36.083174Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:9cd1ad18f735aadbf0eeb945020b707da7c6eb88c051a9452e48728b3c4a6f14","observation_id":"79fb8609-18a9-4c14-9b77-cb58c01f6839","resolution":{"observed_at":"2026-08-07T05:43:36.083174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-07T05:43:36.224743Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:36.224743Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:201ba063a690af5f734ba089a9eaf088a9929d7b8c9801e0bf19cfc50bf98402","observation_id":"fdcf0dd1-f827-483f-a986-656c945ec32f","resolution":{"observed_at":"2026-08-07T05:43:36.224743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:43:36.374607Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:36.374607Z"},"links":{"citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:ee039be561a256b43d2b2611246ae2aeaf26b7a2955f50d0f0ddc8d286339ae6","observation_id":"6ea9390e-7259-4111-83c0-5bf82d4df131","resolution":{"observed_at":"2026-08-07T05:43:36.374607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13614","last_updated":"2024-03-25T03:39:45Z","snapshot_observed_at":"2026-08-14T12:15:15.542039Z","submitted_at":"2023-11-22T04:52:58Z","title":"HalluciDoctor: Mitigating Hallucinatory Toxicity in Visual Instruction Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13614","snapshot_observed_at":"2026-08-07T05:43:36.532129Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:36.532129Z"},"links":{"cited_paper":"/paper/2311.13614","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:0f7d44216ddc4aac03989ff9b98cd933cfc441990d1debc2f77d240b99e511d3","observation_id":"aad50a9c-a2fc-4d9d-96c1-84e7ee15280d","resolution":{"observed_at":"2026-08-07T05:43:36.532129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-08-13T15:50:38.254753Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-07T05:43:36.630082Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:36.630082Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:1fa30aaa48d0aca4366757f9c9b315ef7936a776930ac7f0dfd8db66f3dc86b1","observation_id":"90acff0a-0e30-4c25-b9d7-f482ece61f11","resolution":{"observed_at":"2026-08-07T05:43:36.630082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09022","last_updated":"2025-02-14T05:46:53Z","snapshot_observed_at":"2026-08-14T18:46:31.199395Z","submitted_at":"2025-02-13T07:19:05Z","title":"Mechanistic Unveiling of Transformer Circuits: Self-Influence as a Key to Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09022","snapshot_observed_at":"2026-08-07T05:43:36.750878Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:36.750878Z"},"links":{"cited_paper":"/paper/2502.09022","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:b20c0533e21770a47d10bbd474143e2acd3cc5b4e71deb0bef17d44d8e76936f","observation_id":"d6158e5e-016c-4ef7-9f1f-8cc880c85cdd","resolution":{"observed_at":"2026-08-07T05:43:36.750878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11919","last_updated":"2024-11-28T13:35:56Z","snapshot_observed_at":"2026-08-12T18:41:17.892508Z","submitted_at":"2024-11-18T04:06:04Z","title":"VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11919","snapshot_observed_at":"2026-08-07T05:43:36.890342Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:36.890342Z"},"links":{"cited_paper":"/paper/2411.11919","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:a96a98d1faafc1340b130a54335cbb0457096f60d004350f1dd2f1575ca9c6fa","observation_id":"779e9274-3a55-4091-82cb-427bc5ba9813","resolution":{"observed_at":"2026-08-07T05:43:36.890342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06331","last_updated":"2025-02-01T12:21:59Z","snapshot_observed_at":"2026-08-12T22:27:51.101285Z","submitted_at":"2024-10-08T20:12:11Z","title":"Locate-then-edit for Multi-hop Factual Recall under Knowledge Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06331","snapshot_observed_at":"2026-08-07T05:43:37.084571Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:37.084571Z"},"links":{"cited_paper":"/paper/2410.06331","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:1fec56e01013899bd225381c7295c49d008763d9b7e1a4d8c9fee853e943bfc3","observation_id":"cf9555ae-8a63-4434-b5b9-f4d4b240c13d","resolution":{"observed_at":"2026-08-07T05:43:37.084571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-08T04:17:23.797697Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-07T05:43:37.280160Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:37.280160Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:cebb2e6c7d47b241da37fd5c717b2696de1864613e199c5846c0fe5e77f5bcfb","observation_id":"95852f2b-a7ee-430e-bdd1-418e9e935818","resolution":{"observed_at":"2026-08-07T05:43:37.280160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18476","last_updated":"2024-02-28T16:57:22Z","snapshot_observed_at":"2026-08-15T00:58:20.843591Z","submitted_at":"2024-02-28T16:57:22Z","title":"IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18476","snapshot_observed_at":"2026-08-07T05:43:37.428548Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T05:43:37.428548Z"},"links":{"cited_paper":"/paper/2402.18476","citing_paper":"/paper/2506.07184"},"observation_digest":"sha256:8db50fede1f552b3da6ace549e5c17414038c7c3f50585490b7dfb39ccfddc59","observation_id":"9d062125-2f2e-4eb7-a33f-543a2fa2dd0a","resolution":{"observed_at":"2026-08-07T05:43:37.428548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07184","last_updated":"2025-06-08T15:08:52Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T16:44:02.022482Z","submitted_at":"2025-06-08T15:08:52Z","title":"Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2506.07184."}