{"as_of":"2026-08-09T22:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5032aa28eaf9a77ca52fee85799b94f815ddbe6c5e4b77f6022d0025f55295d","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:18:07.338777Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T22:38:33.963054Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:44:01.550820Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.19474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19474","snapshot_observed_at":"2026-06-29T22:44:01.550820Z","title":null,"venue":null,"work_id":"06d0112a-5a2c-4451-8a53-5c26b9222066","year":2025},"citing_paper":{"arxiv_id":"2605.25377","last_updated":"2026-05-25T03:05:04Z","snapshot_observed_at":"2026-07-06T23:35:21.734804Z","submitted_at":"2026-05-25T03:05:04Z","title":"Adversarial Orthogonal Disentanglement for LVLM Hallucination Mitigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T22:38:33.963054Z"},"links":{"cited_paper":"/paper/2505.19474","citing_paper":"/paper/2605.25377"},"observation_digest":"sha256:87bf3488eaec228ad53eca5da660b41fc6af187c3a0dd5085066016a91053913","observation_id":"43347af8-07a4-4acb-884b-5f9e72f63f50","resolution":{"observed_at":"2026-06-29T22:44:01.552618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19474/citation-record","integrity":"/paper/2505.19474/integrity","json":"/paper/2505.19474/citation-record.json","paper":"/paper/2505.19474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:57.911238Z","title":"Vqa: Visual question answering","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:57.911238Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f95ff39ae1b926eac1632eb1532f234a9f63e2578696cd60e715050116ca6a62","observation_id":"014a6b4e-5543-4ca1-b076-21b0c270a20b","resolution":{"observed_at":"2026-08-07T14:17:57.911238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.793654Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond","venue":null,"work_id":"7b9a8b34-21d5-4abd-83f5-93b7a15f7dd7","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.010741Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:3f1075a4033e6a21e2fa15903309154ba257e073d6ad3a776e7e507c4ebf9b24","observation_id":"10842e3c-6d3a-4439-b75b-b3045ac97e33","resolution":{"observed_at":"2026-08-07T14:18:17.864780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T14:17:58.221526Z","title":"Hallucination of multimodal large language models: A survey.ArXiv, abs/2404.18930, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.221526Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:0b5c06a9907ef3a3177f4432cac72ed7bc6dd8c9420b59d08132ad256d1287d5","observation_id":"165fadfc-068b-4381-9f8b-f0418c780c06","resolution":{"observed_at":"2026-08-07T14:17:58.221526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.564900Z","title":"Causal feature learning: an overview.Behav- iormetrika, 44:137–164, 2017","venue":null,"work_id":"75f85792-df87-466d-96b1-0eb316768ce0","year":2017},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.385633Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d88764f4b70fecc359e2cc9aa4ff6dd8c6b25bca8bfdb6d5c539f8db05124828","observation_id":"f23aa11e-ea2d-4a04-bcb2-280671559ec8","resolution":{"observed_at":"2026-08-07T14:18:17.675881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-07T14:17:58.499296Z","title":"Shikra: Unleash- ing multimodal llm’s referential dialogue magic.ArXiv, abs/2306.15195, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.499296Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:9a0c77097ae0551d8da5eb55f2c4ccd2675868d6790fee07d6a540aa64480f61","observation_id":"34ac98be-077b-4666-8259-1b97513f6430","resolution":{"observed_at":"2026-08-07T14:17:58.499296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-07T14:17:58.625849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.625849Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:30b8964113557712c278ac6661b76c73c197b978e11613cb008f9cb560235d9f","observation_id":"b655ec47-1d66-4009-aaed-2c680c5fc13b","resolution":{"observed_at":"2026-08-07T14:17:58.625849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.11181","last_updated":"2019-05-02T23:41:47Z","snapshot_observed_at":"2026-07-06T07:10:42.212486Z","submitted_at":"2018-10-26T03:58:26Z","title":"Neural Modular Control for Embodied Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.11181","snapshot_observed_at":"2026-08-07T14:17:58.749892Z","title":"Neural modular control for embodied question answering.ArXiv, abs/1810.11181, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.749892Z"},"links":{"cited_paper":"/paper/1810.11181","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:292c6bd5a45a37edf7cbaee84155f98a617ff051fef6135bf4d27ec2ef8f26b7","observation_id":"08463434-275a-44f0-8a15-921f2f369b28","resolution":{"observed_at":"2026-08-07T14:17:58.749892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T14:17:58.895427Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models.ArXiv, abs/2306.13394, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:58.895427Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:96b880364d27cab0bc38a9394edab7e88d54ba557329ee8310c4dbbbe4a98a7d","observation_id":"b2fbccac-c66d-4628-be79-e878396c9193","resolution":{"observed_at":"2026-08-07T14:17:58.895427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.268759Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering.International Journal of Computer Vision, 127:398 – 414, 2016","venue":null,"work_id":"534864c7-f191-4c59-851f-c09bb6f70524","year":2016},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.038400Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:978840984a701e109acad47a49606396870d68cdccf72f04c15fa10ef7f2f4ff","observation_id":"c9e7988c-42e5-43fa-b732-83a94c0e3604","resolution":{"observed_at":"2026-08-07T14:18:17.377920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:17.031408Z","title":null,"venue":null,"work_id":"3411a38c-1def-445b-b230-94cad25feaf8","year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.189959Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:19bbcae54d553b92a7f3c51fbec981da7c15487e49754e08fe0958ccd9a1cf68","observation_id":"4c0e50e2-16d7-4d1d-abe8-98e1c48e207f","resolution":{"observed_at":"2026-08-07T14:18:17.149581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.809270Z","title":"Unbiased classification through bias-contrastive and bias-balanced learning","venue":null,"work_id":"aa16a190-6311-44fe-bedd-5bf814076131","year":2021},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.352255Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4c7c68683a3af9583abd1573ae43ef6a7b1821a0d3df952033b4cd211eb0cc32","observation_id":"743e38ca-d838-4589-a5b6-fac6d159fec8","resolution":{"observed_at":"2026-08-07T14:18:16.884156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02301","last_updated":"2023-11-24T07:07:03Z","snapshot_observed_at":"2026-08-03T03:23:08.919296Z","submitted_at":"2023-09-05T15:06:37Z","title":"CIEM: Contrastive Instruction Evaluation Method for Better Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02301","snapshot_observed_at":"2026-08-07T14:17:59.471288Z","title":"Ciem: Contrastive instruction eval- uation method for better instruction tuning.ArXiv, abs/2309.02301, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.471288Z"},"links":{"cited_paper":"/paper/2309.02301","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:26ce3d9550619136e6f76420786ccb7945bb1f75ee41586ce72bdf417861f78a","observation_id":"6f844add-5e84-4dbf-966b-b0ddcb69709e","resolution":{"observed_at":"2026-08-07T14:17:59.471288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.599580Z","title":null,"venue":null,"work_id":"7c0a328c-7dd4-4c4c-a0c0-3aa094230720","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.606631Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:7b8e763234541e30eec9f7116643754c1691b3517e22a4968d722ede2189dde4","observation_id":"1b550aec-47b5-4911-bf1f-78e635313428","resolution":{"observed_at":"2026-08-07T14:18:16.685909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.421895Z","title":"Hudson and Christopher D","venue":null,"work_id":"ccac9c10-817c-466e-8c10-c72889f7ef3f","year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.786528Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:c9a6e1e0f4bc4b395e06bb73418e61c91d74deeaa11079bbb584f6391e60b547","observation_id":"371ec215-5d3f-4af2-9653-411bd6ef6134","resolution":{"observed_at":"2026-08-07T14:18:16.494678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:59.923714Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:59.923714Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:476288831b2de0cf5cd182321bc4d4331988ba36ee0ba12ebff12bc038d24bc1","observation_id":"6b824612-57b4-4b5d-97b2-6a50423c7b47","resolution":{"observed_at":"2026-08-07T14:17:59.923714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:16.180468Z","title":"Introducing idefics: An open reproduction of state-of-the-art visual language model","venue":null,"work_id":"afda4e63-4955-432d-9b10-1c6e30e26395","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.095956Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f95d6b734d78faa91f08efeb1915ba09c3b1872c53c567149e3c56028c08a0f7","observation_id":"23edb86b-9426-4220-910f-9df8a7b8e2f2","resolution":{"observed_at":"2026-08-07T14:18:16.267082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.915860Z","title":"Vcoder: Versatile vision encoders for multimodal large language models.2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 27992–28002, 2023","venue":null,"work_id":"f275463d-defb-4c5b-b97e-346873e20e3a","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.231087Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:0bcb1721ff24d46a3f6e87a31b0d17f8610b007d65644a307997533e6bbe316d","observation_id":"b199e25a-bed3-414e-b672-dba534049efa","resolution":{"observed_at":"2026-08-07T14:18:16.062074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.714450Z","title":"Causal inference meets deep learning: A comprehensive survey.Research, 7, 2024","venue":null,"work_id":"f8941ab0-96b5-4981-9f11-36e7749bc4f1","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.334616Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:3fd9db9c60fafd7121396753f272c8bdf78f607ad5a09869f279d2b114ffee9a","observation_id":"08d6b5e4-04de-42e6-b611-c6b08f6e1937","resolution":{"observed_at":"2026-08-07T14:18:15.820195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.523460Z","title":"Unbiased learning-to-rank with biased feedback.Proceedings of the Tenth ACM International Conference on Web Search and Data Mining, 2016","venue":null,"work_id":"2439b844-5c07-4913-b0bb-5da9aa98a24e","year":2016},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.483452Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d8fb06977764f9fae1ef946e286aab17066206afac2139451a3f983db759eefe","observation_id":"7c7091d6-4d2d-46bd-a51a-954f60465837","resolution":{"observed_at":"2026-08-07T14:18:15.592963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:00.636529Z","title":"Deep visual-semantic alignments for generating image descriptions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.636529Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:7e7514495b285481f777907677a36130f1c17e66a02e1754a53d8eda565500d6","observation_id":"6ec84d65-83d9-479c-a740-01987c29c820","resolution":{"observed_at":"2026-08-07T14:18:00.636529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.330717Z","title":"Learning not to learn: Training deep neural networks with biased data.2019 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 9004–9012, 2018","venue":null,"work_id":"d8bf21dc-e015-4a6f-a66d-d24ad3473d12","year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.758308Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:609567ddd1c6e760aca8df8207dd31ffcfbb19d5a1f7634f49d5d4666a418470","observation_id":"374a87b5-da22-49ce-9e0c-32b9bc6c8c25","resolution":{"observed_at":"2026-08-07T14:18:15.414896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:15.097336Z","title":"Sophia Koepke, Cordelia Schmid, and Zeynep Akata","venue":null,"work_id":"d72a4094-a293-4ebc-ae01-4014c7e28ab7","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:00.933381Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:54fc44c08bb3704f4a3621c8ca2f5c6f6a43d7300d7ffbacb28ab1e1db35dd0b","observation_id":"15cc1d48-831d-4b2b-815f-8922bf6ca451","resolution":{"observed_at":"2026-08-07T14:18:15.204904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T14:18:01.073175Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.073175Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:6475c50643675440cf9a990d96e3dd67567ab709cac73b4f4ff2736f3aa65c95","observation_id":"8017d1f0-3ddf-4639-928e-61290230a9f3","resolution":{"observed_at":"2026-08-07T14:18:01.073175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.722480Z","title":"Shamma, Michael S","venue":null,"work_id":"5f4b1dfb-6d8e-494e-9d85-3bb0c46d7ec8","year":2016},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.333009Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:7388787d0f2cdcd402d7cfccf8b96b0d0c86f01ce082fc2c1d75db5e1f117012","observation_id":"057b404f-ab45-4d77-a9ce-4786f8262b62","resolution":{"observed_at":"2026-08-07T14:18:14.795871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.579991Z","title":"V olcano: Mitigating multimodal hal- lucination through self-feedback guided revision","venue":null,"work_id":"4134d29d-d695-472d-9270-15bd3ade19b7","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.512276Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:e214f98acba860b4eed02c95ea8bddd54e9f0132dbfba2ac3a7ae67e6484f61e","observation_id":"88185505-8ad4-4524-8633-415616b4eaba","resolution":{"observed_at":"2026-08-07T14:18:14.624966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.349526Z","title":null,"venue":null,"work_id":"aed1119b-0cc6-48b5-bad1-ce9e82e5d53d","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.654660Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f82a41cf7bee67b224fa76081a6880a35faec13bb5a0faad5762cb01ee514f35","observation_id":"7659c444-2a8f-4bfb-bdff-119f9446e7ba","resolution":{"observed_at":"2026-08-07T14:18:14.451860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.129278Z","title":null,"venue":null,"work_id":"1611339b-763f-4cd8-802a-017139721831","year":2022},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.793027Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:a127ded01b5643c61f2e9fce4e4fe7168af99b2dce50ae9276a82e7a3af190ec","observation_id":"6ae6f190-5140-4792-902b-f0acf5125dc7","resolution":{"observed_at":"2026-08-07T14:18:14.227695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.987510Z","title":null,"venue":null,"work_id":"b99cf5a1-aaa5-4a06-a1d1-e6bf89d9524a","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.909532Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:6d1fd3ed22258ad4d68402e7e396b4b04efaef175d0a794f24979a17dfe20400","observation_id":"bd09b2c2-edf5-4bdd-8762-fa1094b9ac36","resolution":{"observed_at":"2026-08-07T14:18:14.038951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.771139Z","title":"Towards deconfounded image-text matching with causal inference.Proceedings of the 31st ACM International Conference on Multimedia, 2023","venue":null,"work_id":"59355056-3933-4140-bacf-96635c72ebdd","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.026813Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:72dca8700bf1bc4a35046806ecb8ec4123ac03798a2ab54a4d358ce9e31ab9e5","observation_id":"fec8f324-f7ed-4747-838f-b80befc809d8","resolution":{"observed_at":"2026-08-07T14:18:13.877823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.585053Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":"292a60d9-ed98-4254-bfe4-af611141ff5b","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.119604Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:3092a8c760a7a0423b6dd03e0b2bc3ea91262f9c2eb49fd18df1c2ea67ded9aa","observation_id":"24454eb6-d078-405a-b4d0-26cb107c77ce","resolution":{"observed_at":"2026-08-07T14:18:13.663560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.387017Z","title":null,"venue":null,"work_id":"4e3d0e2d-44c9-4541-89aa-75e5d365e68c","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.216921Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:e48002daef0f9b7ffb49cfb3ee36d8102a4b789512fbc45b48d778a85b84ec68","observation_id":"2e2e3bee-a71e-4ca4-af16-0469f0d9b3ca","resolution":{"observed_at":"2026-08-07T14:18:13.475187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.241634Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C","venue":null,"work_id":"0d31c4b4-a3f4-4446-be41-5b328c0e9a3a","year":2014},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.336970Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:e72bacc8d5a9bb7381284fa273df8175a5373b0134f003f14fa879c3aa2e4d03","observation_id":"54b96082-8efe-4679-822c-235ba30b0b2b","resolution":{"observed_at":"2026-08-07T14:18:13.292514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:13.043941Z","title":"Show, deconfound and tell: Image captioning with causal inference.2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 18020–18029, 2022","venue":null,"work_id":"81e95f7a-47bf-47c6-ba39-534aff98059c","year":2022},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.439173Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:531751fed8a9ba0caaef2b6d65cc29637353cacfa815e3c89ec58f3dbf25adbb","observation_id":"eb905292-61e0-4dab-b002-2e2cddee5023","resolution":{"observed_at":"2026-08-07T14:18:13.146836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.932932Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning","venue":null,"work_id":"cfe1a991-108d-4049-b166-8835fb9fa7d9","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.569384Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:db8f3bafa191398a40bd46e0cd4412587f0e586930636d0bd154127a2e4335aa","observation_id":"a1c74763-284a-4a2e-8092-48a08a69eeca","resolution":{"observed_at":"2026-08-07T14:18:12.977450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T14:18:02.648285Z","title":"A survey on hallucination in large vision-language models.ArXiv, abs/2402.00253,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.648285Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:aaf012878768f0d8c4392b93ba4070ed5d31f8593de12ca004bbf2117ec10cdd","observation_id":"8983dbec-8768-4db9-ba5e-b0e487b5f1a6","resolution":{"observed_at":"2026-08-07T14:18:02.648285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.567734Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"d2a4c76e-ea80-4fac-b1ff-62e08069e7db","year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.899244Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:55b3c02d898fbf387efee9f70ee65a511a945652fbadeef40649f612ef9bc553","observation_id":"941f5dd5-4539-49b9-a280-cf10f8299786","resolution":{"observed_at":"2026-08-07T14:18:12.676120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T14:18:03.192413Z","title":"Visual instruction tuning.ArXiv, abs/2304.08485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.192413Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:239bb009839a7279e43d76604308e4ddd3b38e204927501230d6156bb75cc350","observation_id":"5e7a841c-fdb8-4c1f-a050-953bc72af9d7","resolution":{"observed_at":"2026-08-07T14:18:03.192413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.228254Z","title":"Mmbench: Is your multi-modal model an all-around player? InEuropean Conference on Computer Vision, 2023","venue":null,"work_id":"92e14725-45dc-4656-b337-60aaa08a7523","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.317090Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:310d3c453cf977537993c1780b3f2bd5d7c40022b06460e46e6b24f50841ce45","observation_id":"0d077064-b255-47b8-ac09-99c7c253a416","resolution":{"observed_at":"2026-08-07T14:18:12.302595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.055679Z","title":"Discovering causal signals in images.2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pages 58–66, 2016","venue":null,"work_id":"ba866f28-5d9c-4b55-a05b-e775c0062d0a","year":2017},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.453521Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:8ceaaa9bb34e10c9ff09271afd591167bb05a01951b1d617baf02afcca204785","observation_id":"b7588ef9-9cb8-436b-a37c-800b87776e0a","resolution":{"observed_at":"2026-08-07T14:18:12.118295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09513","last_updated":"2022-10-17T07:46:47Z","snapshot_observed_at":"2026-08-02T03:10:19.073297Z","submitted_at":"2022-09-20T07:04:24Z","title":"Learn to Explain: Multimodal Reasoning via Thought Chains for Science Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.09513","snapshot_observed_at":"2026-08-07T14:18:03.561844Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.561844Z"},"links":{"cited_paper":"/paper/2209.09513","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:69300aae082f68b06d698ff89a2cac42d3ef46bea2c12178654df1caf38e41f4","observation_id":"523091e8-a24f-4750-ae8b-f8182bb2be3b","resolution":{"observed_at":"2026-08-07T14:18:03.561844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.861163Z","title":"The deep regression bayesian network and its applications: Proba- bilistic deep learning for computer vision.IEEE Signal Processing Magazine, 35:101–111, 2018","venue":null,"work_id":"557c59a0-e3d2-4e97-84ac-43e6c21aab23","year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.681270Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:e1c9a585ceba2690a3ff3e6d1cac67cee2a46519f650a536efac045c3aac0120","observation_id":"302123be-ccd8-441d-95c2-aa4eaeb76a51","resolution":{"observed_at":"2026-08-07T14:18:11.947909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.688185Z","title":"Counterfactual vqa: A cause-effect look at language bias.2021 IEEE/CVF Conference on Computer Vision and Pattern Recog- nition (CVPR), pages 12695–12705, 2020","venue":null,"work_id":"f664f60c-c305-4b7f-a34a-9f23be58d0aa","year":2021},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.808113Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f86e309e47e05163c3986d2614d0c9182c10eba9a4a2d0235d1d4bcc3beb9523","observation_id":"006add3d-a315-4f53-a516-c8a0a11441ad","resolution":{"observed_at":"2026-08-07T14:18:11.777390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:03.907896Z","title":"Basic books, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.907896Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:735f1de4c3c1ddb537d40da0c5fae21dcd83dc00faa67cc622acd1547267cc79","observation_id":"5ecf661f-6ea1-435b-926d-75e954dee91a","resolution":{"observed_at":"2026-08-07T14:18:03.907896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.551603Z","title":"Two causal principles for improving visual dialog.2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 10857–10866, 2019","venue":null,"work_id":"6f95bbb4-4026-4621-8108-4e7030378d58","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.004376Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:8c32485f84d210440a3d1a401f27a9e163565268bb18c8bceda66ea357d35d7f","observation_id":"8dfdcc2a-a1fe-4914-a4c7-dc3190657254","resolution":{"observed_at":"2026-08-07T14:18:11.617036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.406807Z","title":"Object hallucination in image captioning","venue":null,"work_id":"e87a3d57-9c22-4227-ae89-3c12334172b4","year":2018},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.087000Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:50d1d1ae4b09be1bbc73c30e6087ea2d52be4f48dda215db0b5b1cb576c61c97","observation_id":"d55702c7-ff6b-4c49-a756-de8213488948","resolution":{"observed_at":"2026-08-07T14:18:11.469998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15998","last_updated":"2025-03-02T23:41:37Z","snapshot_observed_at":"2026-07-06T19:07:16.252072Z","submitted_at":"2024-08-28T17:59:31Z","title":"Eagle: Exploring The Design Space for Multimodal LLMs with Mixture of Encoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15998","snapshot_observed_at":"2026-08-07T14:18:04.245081Z","title":"Eagle: Exploring the design space for multimodal llms with mixture of encoders.ArXiv, abs/2408.15998, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.245081Z"},"links":{"cited_paper":"/paper/2408.15998","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:bfdc5652bfafeb0f9e413f7ffb982a1058af8aad8e302b98676f0371d7674b59","observation_id":"3bbb0d25-af3a-423d-8185-218fc55a05ac","resolution":{"observed_at":"2026-08-07T14:18:04.245081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.241251Z","title":"Towards vqa models that can read.2019 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 8309–8318, 2019","venue":null,"work_id":"e4f1a512-fc67-42cd-9420-361fbd62231e","year":2019},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.364659Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4cd8801f929460e651faeac27cc961348a4e37ebc141ff1a864b4fd433d12534","observation_id":"8bb3660c-308d-4a13-8354-25b943a7e2e1","resolution":{"observed_at":"2026-08-07T14:18:11.302421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:11.047926Z","title":"Heikkila, and Li Liu","venue":null,"work_id":"e3bfcf69-8f18-40ec-abea-0de1112348c6","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.470123Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:cdfa54ac0fd8ddc2cace0011ad0815cc3f05c4c1c93f0bb989223ad0380a420d","observation_id":"65608bd0-3c4c-4d26-8627-33705a2fcae3","resolution":{"observed_at":"2026-08-07T14:18:11.130832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-07T14:18:04.556684Z","title":"Aligning large multimodal models with factually augmented rlhf.ArXiv, abs/2309.14525, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.556684Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:350320f4ae9b2756e654156112040a499e8353a80213300999edae82205332db","observation_id":"edac3404-1493-48f5-80d1-2653097f8606","resolution":{"observed_at":"2026-08-07T14:18:04.556684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.878150Z","title":"Unbiased scene graph generation from biased training.2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 3713–3722, 2020","venue":null,"work_id":"0237554f-0313-4495-8696-f0b072dfc569","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.696834Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:c712ac359cdecd565dd728c85982d5089587f19cde70cb6ff720e7a6cf10a79d","observation_id":"f1f9e1e8-9e64-434b-a8e2-fa11d12d3a42","resolution":{"observed_at":"2026-08-07T14:18:10.936087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.691412Z","title":null,"venue":null,"work_id":"735c560b-fc07-4044-8e5d-ef5a5a49385c","year":2008},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.828456Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:8e30f9c043c197f724de77357c44f24ec7be769327b253e00819ef80c5ac21cf","observation_id":"919477ab-3f62-44cc-977e-1c958d98f2c6","resolution":{"observed_at":"2026-08-07T14:18:10.780403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.513794Z","title":"Vigc: Visual instruction generation and correction","venue":null,"work_id":"595a2ce4-c4b5-4f83-b7ac-84cd3511f01f","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:04.944643Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:90ccd67fa5f88c2cca0b08598b34bf4654e43bd0556f868b01e090e3ef18b4b3","observation_id":"745b2ab8-e68d-4476-b6fd-ab9083935f9b","resolution":{"observed_at":"2026-08-07T14:18:10.604240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.361840Z","title":"Visual commonsense r-cnn.2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 10757–10767, 2020","venue":null,"work_id":"7c5c0d8b-02c1-4acd-8663-9c691361ed5c","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.074887Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4bd2f6477f413620c41e89d4219ea1743ec59fa4dca317dd1f6ee88393e343eb","observation_id":"46414d78-f54d-4b3b-be4d-1f5f1f83e100","resolution":{"observed_at":"2026-08-07T14:18:10.410650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09691","last_updated":"2024-11-14T18:57:07Z","snapshot_observed_at":"2026-08-05T04:29:40.575401Z","submitted_at":"2024-11-14T18:57:07Z","title":"Advancing Fine-Grained Visual Understanding with Multi-Scale Alignment in Multi-Modal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09691","snapshot_observed_at":"2026-08-07T14:18:05.180098Z","title":"Advancing fine-grained visual understanding with multi-scale alignment in multi- modal models.ArXiv, abs/2411.09691, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.180098Z"},"links":{"cited_paper":"/paper/2411.09691","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:f37e2ce4226b51a583f72820dc5bf6c8e1edce4e279ef06dabf7a623ca654616","observation_id":"a8223c6f-90d4-4f43-8f1e-5880c854b88c","resolution":{"observed_at":"2026-08-07T14:18:05.180098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18715","last_updated":"2024-06-05T13:53:42Z","snapshot_observed_at":"2026-08-09T07:55:47.071847Z","submitted_at":"2024-03-27T16:04:47Z","title":"Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18715","snapshot_observed_at":"2026-08-07T14:18:05.285816Z","title":"Mitigating hallucinations in large vision-language models with instruction contrastive decoding.ArXiv, abs/2403.18715, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.285816Z"},"links":{"cited_paper":"/paper/2403.18715","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:7fc7a4b1ad62ff9494ceef746c85aef4bdcccc48e710d1bb0c6fbb244a71bc55","observation_id":"d1959433-08a9-49a0-93d0-1a067cdbb920","resolution":{"observed_at":"2026-08-07T14:18:05.285816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20081","last_updated":"2024-05-31T07:40:04Z","snapshot_observed_at":"2026-07-06T18:22:44.129954Z","submitted_at":"2024-05-30T14:11:27Z","title":"NoiseBoost: Alleviating Hallucination with Noise Perturbation for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20081","snapshot_observed_at":"2026-08-07T14:18:05.380471Z","title":"Noiseboost: Alleviating hallucination with noise perturbation for multimodal large language models.ArXiv, abs/2405.20081, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.380471Z"},"links":{"cited_paper":"/paper/2405.20081","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:0ea3bd8a457d4748e8f51895163ca33bdac8439a816b7ade19f3049dac0aafa1","observation_id":"fa113eba-7ed1-415b-8f0d-49af9320eeb5","resolution":{"observed_at":"2026-08-07T14:18:05.380471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.193749Z","title":"Courville, Ruslan Salakhutdinov, Richard S","venue":null,"work_id":"e3dc7f85-dfb9-49ad-a8f5-74f789765094","year":2015},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.525323Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:0ec6b884f50c49a929f095bdf869d5f6c4158c3f828c84cae11fec00f309e29a","observation_id":"253f180e-74c8-4f1e-ad21-5d10357f2318","resolution":{"observed_at":"2026-08-07T14:18:10.277841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:10.006823Z","title":"Deconfounded image captioning: A causal retrospect","venue":null,"work_id":"7b8668ce-fd73-470b-9b4d-628c69c183c0","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.638942Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:021f8e0c9fbfd1b6830f8a7b5cfae3791210d7d66de46108e05fe6eee5ef9dfe","observation_id":"20d51a02-14c0-45ff-8692-a18202018126","resolution":{"observed_at":"2026-08-07T14:18:10.087615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.813609Z","title":"Causal attention for vision-language tasks.2021 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 9842–9852, 2021","venue":null,"work_id":"5f6a8ba3-9a96-48ce-94be-bc0521177955","year":2021},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.745609Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:e91b69bf91e4377da10559842fe42159cf2f4ac3455acc6cc4d035a637e3e316","observation_id":"71dbf5a5-7195-4ddb-bfb1-09dabccc5f90","resolution":{"observed_at":"2026-08-07T14:18:09.901506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.617368Z","title":"A survey on causal inference.ACM Transactions on Knowledge Discovery from Data (TKDD), 15:1 – 46, 2020","venue":null,"work_id":"7dedb898-0938-41da-b0b1-09f52887b36b","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:05.901162Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:99810675ff7ea7fde660a3dfd0628a7c3049a9b9d20dbd0e9fb758c98cdd9ed1","observation_id":"7575dd97-3d66-4c89-bb73-6b0f483b71fe","resolution":{"observed_at":"2026-08-07T14:18:09.718877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.285166Z","title":"Woodpecker: Hallucination correction for multimodal large language models.Sci","venue":null,"work_id":"e70db1ff-2c43-43cd-9009-38e4df4cd1ba","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.067611Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:d9bc00fd9759fa929f23af7fd899ca24d8e1f4750fa9c7c085961ece26868370","observation_id":"41f45e62-096e-4bac-b892-b359a868553e","resolution":{"observed_at":"2026-08-07T14:18:09.490957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07704","last_updated":"2023-10-11T17:55:15Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T17:55:15Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07704","snapshot_observed_at":"2026-08-07T14:18:06.180366Z","title":"Ferret: Refer and ground anything anywhere at any granularity.ArXiv, abs/2310.07704, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.180366Z"},"links":{"cited_paper":"/paper/2310.07704","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:2104acd5d52164128fec3ad76af3f7c5f1bac28d0616c701db9897112aa939ca","observation_id":"224f1f59-cb6d-497f-bdf7-87ef6f198797","resolution":{"observed_at":"2026-08-07T14:18:06.180366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T14:18:06.339518Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities.ArXiv, abs/2308.02490,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.339518Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:791b77d3dddf9d383041490b4dc81ca8cb684537a30b74b487ede1224fdfbbf0","observation_id":"80659cfb-199e-4c0f-9523-42f07edff6c6","resolution":{"observed_at":"2026-08-07T14:18:06.339518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13000","last_updated":"2020-12-04T06:51:09Z","snapshot_observed_at":"2026-08-04T07:05:41.524273Z","submitted_at":"2020-09-28T01:16:54Z","title":"Interventional Few-Shot Learning","version":2},"cited_work":{"arxiv_id":"2009.13000","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.13000","snapshot_observed_at":"2026-08-07T14:18:07.525887Z","title":"Interventional Few-Shot Learning","venue":"cs.LG","work_id":"d3d9c1b3-1510-4811-b444-3698d9e48506","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.631806Z"},"links":{"cited_paper":"/paper/2009.13000","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:eced8ff5e3c704a6ece0b44097a6bab7daa44a7a74fb15acf13b221dcbe3e76e","observation_id":"c82cd4c3-1388-4a71-b80b-5dcc43ae2439","resolution":{"observed_at":"2026-08-07T14:18:07.619481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.808087Z","title":"Halle-control: Controlling object hallucination in large multimodal models","venue":null,"work_id":"e084b9db-c29f-435c-a6d6-7929ecd23817","year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.759675Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:bbe6b8a7deca189270f3c94613f46a42149794c374e664f230993f42062eb838","observation_id":"5e3c6167-066a-43bc-ab62-1856b4a4871d","resolution":{"observed_at":"2026-08-07T14:18:08.887598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-07T14:18:06.855970Z","title":"Analyzing and mitigating object hallucination in large vision-language models.ArXiv, abs/2310.00754, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.855970Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:c254ee795d805aa69ddac9fc465d002e2d931b436de405aba1a2c5dc5f5805bc","observation_id":"f5f9ddb8-4be1-4c37-b9d3-3b73313b8254","resolution":{"observed_at":"2026-08-07T14:18:06.855970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:09.017422Z","title":null,"venue":null,"work_id":"29895a08-086f-4111-9ada-fc33d9c932d4","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.505004Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:3faba0b679a286d1f78a41cc67b27642781c92e392a53e90caf7eef073a78f0b","observation_id":"79e8e05a-e626-4d00-9df2-dd4a61db20ba","resolution":{"observed_at":"2026-08-07T14:18:09.114842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.645984Z","title":"dining table","venue":null,"work_id":"9e3c4144-6272-4a84-a6c1-fa70b1acca57","year":2020},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.028689Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:dabad99660127abf97422a5e9c22e41988aef7ba5a256e7fb8e4718684753284","observation_id":"f0f35041-5b4b-4063-bf88-62415a9fb8ee","resolution":{"observed_at":"2026-08-07T14:18:08.731952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T14:18:06.946545Z","title":"Minigpt-4: Enhancing vision- language understanding with advanced large language models.ArXiv, abs/2304.10592, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:06.946545Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:4c199376621b50fe7db1bd19a2ab67d7fa91a9b83975d519e877125b98e575ea","observation_id":"bde4ca91-50f9-43c9-a11c-74f6db19fcf9","resolution":{"observed_at":"2026-08-07T14:18:06.946545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.424420Z","title":"7 and 8)","venue":null,"work_id":"582fb6b5-1833-4d71-b3ab-4e95f42052f1","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.102654Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:cb26ff6e0b5229f6025510e5866c957d72cf2dda62a9305443c126e86f8b8680","observation_id":"1ff641f8-205a-4537-af09-3406dcfcdb44","resolution":{"observed_at":"2026-08-07T14:18:08.514660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.238147Z","title":"9 and 10)","venue":null,"work_id":"f5f4514a-e3de-4617-9511-17220b516b90","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.201470Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:dfb3ebe05808007999a811983519dd912bb7cd05378a96d60c5e3b5c0232d472","observation_id":"8e766066-1fec-4c4a-80cb-c71c96755af1","resolution":{"observed_at":"2026-08-07T14:18:08.321787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:08.082630Z","title":"dining table","venue":null,"work_id":"220cab86-2512-48a4-b1bd-8d61dc373a9c","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:07.338777Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:b1b3b86b4a6ade5fb67df31b451bce897727d2bf41ee176894516b251b75a1eb","observation_id":"9a6cbe8e-50bc-4de3-aff2-ea4f16e4dafa","resolution":{"observed_at":"2026-08-07T14:18:08.137272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:14.898708Z","title":null,"venue":null,"work_id":"3af1caf0-a7cb-40d3-b689-d9269bb18525","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:01.204453Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:7306dd2dba5230c00b42b5e719641eb4da0fabdc409a77f8f2155e7e13e164b6","observation_id":"e1ddd20d-6f33-40ec-93c3-69b60b169d17","resolution":{"observed_at":"2026-08-07T14:18:14.972036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.401787Z","title":null,"venue":null,"work_id":"b0ed9304-ad71-4748-9824-421c68e5107e","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:03.035939Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:da526e82759c595a3bd6ab0f12740bbe470ffeba95ee5ca430ad580d7e1e902c","observation_id":"04c88184-dc78-4217-8d50-78eaaf56251e","resolution":{"observed_at":"2026-08-07T14:18:12.451967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:12.780052Z","title":null,"venue":null,"work_id":"35b96f0e-3f6a-49b0-93cd-eeca7a551f59","year":null},"citing_paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:02.773634Z"},"links":{"citing_paper":"/paper/2505.19474"},"observation_digest":"sha256:fded2794b416bfd6d71f39070e6be2922d77dc256a74723008a5dc8de399c8d9","observation_id":"5b8ed909-166b-43ac-949f-6d80c4f720eb","resolution":{"observed_at":"2026-08-07T14:18:12.861978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19474","last_updated":"2025-05-26T03:53:00Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T07:56:47.651999Z","submitted_at":"2025-05-26T03:53:00Z","title":"Causal-LLaVA: Causal Disentanglement for Mitigating Hallucination in Multimodal Large Language Models"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2505.19474."}