{"as_of":"2026-08-20T00:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e90db64caca587bcf30f2a5a64cddfb4f4a1555d69a521e2b9e9e7373a6d1694","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:33:05.345013Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T06:41:59.641410Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T06:46:37.512830Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"cited_work":{"arxiv_id":"2504.20468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20468","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1a0edd07-1eee-45ad-8e4b-6f5506a8e872","year":2025},"citing_paper":{"arxiv_id":"2604.17375","last_updated":"2026-04-19T10:58:40Z","snapshot_observed_at":"2026-08-11T04:14:27.111708Z","submitted_at":"2026-04-19T10:58:40Z","title":"When Text Hijacks Vision: Benchmarking and Mitigating Text Overlay-Induced Hallucination in Vision Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T06:41:59.641410Z"},"links":{"cited_paper":"/paper/2504.20468","citing_paper":"/paper/2604.17375"},"observation_digest":"sha256:e3261a150500683136158f68b72d2921d275df8dac2a587395954c12a6fde007","observation_id":"29629cb6-bc1b-4997-b951-261d3053ae57","resolution":{"observed_at":"2026-05-10T06:46:37.514043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.20468/citation-record","integrity":"/paper/2504.20468/integrity","json":"/paper/2504.20468/citation-record.json","paper":"/paper/2504.20468"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-16T05:33:04.973486Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.973486Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:112932213ba00dc461efca778639aee6cf69a2ae0eb5930ce228bb18aa4378a8","observation_id":"f74fe1c5-afc0-44df-b04b-2d83b2218500","resolution":{"observed_at":"2026-08-16T05:33:04.973486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T05:33:04.979571Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.979571Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:60ae2539a7121ba1c628918241aaf4b97ed67ad6d87f7e070f7c1ab4e63d2e15","observation_id":"83d5ab26-c756-45fe-95e8-f5543279ecf2","resolution":{"observed_at":"2026-08-16T05:33:04.979571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.252072Z","title":"Claude 3.5 sonnet model card adden- dum","venue":null,"work_id":"c3e0e0b2-19c3-4a96-b55c-f9195782607d","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.984648Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:cb409bbd9df669d5894bfa4bc8ac6b422f0ca8715ff73911b3595b9fee83b361","observation_id":"7401bee4-6b9c-42e4-ad70-22646d7e5df7","resolution":{"observed_at":"2026-08-16T05:33:06.258593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-08-17T15:25:09.479397Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-16T05:33:04.989465Z","title":"Bge m3-embedding: Multi- lingual, multi-functionality, multi-granularity text embed- dings through self-knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.989465Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:afe05f04516807859857eae27f8e946a1e7fcaa6553a64ede9a04261a7b0031f","observation_id":"86f4b135-64ef-41b1-8111-aeec0f920f0c","resolution":{"observed_at":"2026-08-16T05:33:04.989465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.227930Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":"7b4393e7-c33e-4693-a34b-aeaffee8b511","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:04.994564Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:dab791c146de76abe2c74de105bf09cac784071a63ac1ff79b372b81da85be90","observation_id":"6756bd0e-254c-4793-bdc6-c8c6c3e9c854","resolution":{"observed_at":"2026-08-16T05:33:06.237791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.000352Z","title":"Instructblip: Towards general- purpose vision-language models with instruction tuning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.000352Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:660213ce67fffaab75069a75c52d6352fe6c4c48b4dafc0741bb1d3c8338b9cb","observation_id":"fedec3f3-83b3-4eb0-bf96-66e21d772863","resolution":{"observed_at":"2026-08-16T05:33:05.000352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.004793Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.004793Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:e04d0fd2ffd6e39e8d709e4d5d0c4db54509ce564dfe7e116797bc0c1e7a2885","observation_id":"ef61f654-560b-49c6-bac9-15da76807eec","resolution":{"observed_at":"2026-08-16T05:33:05.004793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-16T05:33:05.009426Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.009426Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:d1e9731c992cacf5a42de3e6693ea998f7d4c9c6c7aeb000e3a8553000332a77","observation_id":"10323c3d-609f-4353-aeaf-3d3083b8c1c9","resolution":{"observed_at":"2026-08-16T05:33:05.009426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-18T00:01:15.410179Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-16T05:33:05.014955Z","title":"Cogvlm2: Visual language mod- els for image and video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.014955Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:57caafc6084d2c9c95375427801d8c139e378cbee5359d7cd28dc2d4231869f1","observation_id":"fe1be5be-9b7b-434b-b338-37be4edffc2a","resolution":{"observed_at":"2026-08-16T05:33:05.014955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-16T05:33:05.135084Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.135084Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:09405f4ea53b82355b312504fc9b066e91019c48a683e6d6daf6278ec4849778","observation_id":"4d1571af-5f14-4e77-a9bf-00de90935b21","resolution":{"observed_at":"2026-08-16T05:33:05.135084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.173328Z","title":"Opera: Alleviating hallucination in multi- modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":"d8e582fd-9bff-4091-9d3f-8daf4f543fe9","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.140491Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:e2074f187df19b55a89754559f0151c4ad6988aef75cc45fe368b0da237acb03","observation_id":"eae33eae-ce0c-40eb-836e-d94817d73068","resolution":{"observed_at":"2026-08-16T05:33:06.178855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02032","last_updated":"2025-03-16T06:51:13Z","snapshot_observed_at":"2026-08-16T13:28:40.445118Z","submitted_at":"2024-08-04T13:50:17Z","title":"Self-Introspective Decoding: Alleviating Hallucinations for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02032","snapshot_observed_at":"2026-08-16T05:33:05.145229Z","title":"Self-introspective de- coding: Alleviating hallucinations for large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.145229Z"},"links":{"cited_paper":"/paper/2408.02032","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:80c16066b10493a43a54acdb52daef34662fa58a88d3333a111a6abdf6c0d75d","observation_id":"94a0be69-dbbb-4c94-b16d-a67eba80bd3d","resolution":{"observed_at":"2026-08-16T05:33:05.145229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08942","last_updated":"2021-02-17T18:56:03Z","snapshot_observed_at":"2026-08-19T21:16:10.282745Z","submitted_at":"2021-02-17T18:56:03Z","title":"A Survey on Locality Sensitive Hashing Algorithms and their Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08942","snapshot_observed_at":"2026-08-16T05:33:05.150783Z","title":"A survey on locality sensitive hashing algorithms and their applica- tions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.150783Z"},"links":{"cited_paper":"/paper/2102.08942","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:cd18450d23b443d638582a187989bddb9d99c9bdc1c74cccea05b4390d15f48d","observation_id":"030ac135-0bf5-4959-bbaa-739b2429b5a9","resolution":{"observed_at":"2026-08-16T05:33:05.150783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.153033Z","title":"Towards mitigating llm hallucination via self reflection","venue":null,"work_id":"5eca6e04-40f9-4c47-9abb-2b7b515a55f0","year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.156103Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:14f3894cee86bdb9bb2a9c8c1cc13768152558967c70dde276c15491fd1ed283","observation_id":"0e8f358a-ab6f-4c27-aa3b-f1d9defae5c3","resolution":{"observed_at":"2026-08-16T05:33:06.159719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.125768Z","title":"Hallucination augmented contrastive learn- ing for multimodal large language model","venue":null,"work_id":"b3d24141-622c-4429-9ad6-5720f51b64bb","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.160581Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:4c342907bf77ed33c125daedc3630e80de1e65d7b9c03dcc50673545d32b5517","observation_id":"8ec3ddae-d807-488d-85bb-b90caf06ea65","resolution":{"observed_at":"2026-08-16T05:33:06.130995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07362","last_updated":"2024-04-02T04:12:43Z","snapshot_observed_at":"2026-08-19T02:01:42.352429Z","submitted_at":"2023-11-13T14:26:24Z","title":"Volcano: Mitigating Multimodal Hallucination through Self-Feedback Guided Revision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07362","snapshot_observed_at":"2026-08-16T05:33:05.164909Z","title":"V olcano: mitigating multimodal hallucina- tion through self-feedback guided revision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.164909Z"},"links":{"cited_paper":"/paper/2311.07362","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:068aae28259cd9378eb6b53ac6cdfb3f4a927f9c516e99e02b309cd5fbd9b296","observation_id":"771c014e-6e3a-4f89-95c7-a39d1ade5a01","resolution":{"observed_at":"2026-08-16T05:33:05.164909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.109419Z","title":"Mitigating object hal- lucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"2f38d548-178d-44e1-a0e1-52c88a02c385","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.169947Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:900131754d2aabf06f6b36c31181b44521b4a8289110f1e6a5865c8e8eb43b6d","observation_id":"4d5eba18-17db-4d5a-bd67-ab6efa75a11c","resolution":{"observed_at":"2026-08-16T05:33:06.114482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-16T05:33:05.174886Z","title":"Evaluating object hallucina- tion in large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.174886Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:578a47d868b1baa03eea68d9da1e3eba13321169cf1822819289a10e87afab81","observation_id":"d05943c0-d16a-4748-a43b-b4073ced610c","resolution":{"observed_at":"2026-08-16T05:33:05.174886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-16T05:33:05.179414Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.179414Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:ed269ddade6d4d9c476bcfdfe3572587a58c025c9a1eaea3d82fb337a8111425","observation_id":"e712f285-e383-4609-88ba-d00334775e5d","resolution":{"observed_at":"2026-08-16T05:33:05.179414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.184293Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.184293Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:7b2d2452bbad8d9ac034f465b16325f76307c3f7eb4d711155c523ef557ef439","observation_id":"690f3d1d-cc6b-4b8c-b6fb-fb641d95ea2e","resolution":{"observed_at":"2026-08-16T05:33:05.184293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.189681Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.189681Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:3fd02e53b22aec68e5864d8824cacdb3aa1aedb0e584ed747927c7783823ccf4","observation_id":"41cbf034-0290-4eaf-8db4-8234d5825153","resolution":{"observed_at":"2026-08-16T05:33:05.189681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.194559Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.194559Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:ca673920f0ebc57bf3d22db869a3c5833311ddeba35d1f9517f072e79f1034e8","observation_id":"88ce785f-54b8-440d-b85b-afaab5bc5635","resolution":{"observed_at":"2026-08-16T05:33:05.194559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.051239Z","title":"Visual instruction tuning","venue":null,"work_id":"61c99aee-78e0-4d8f-8fe4-2b2972aa3c3c","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.199136Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:4b9ae3310fcd61f32e845d676a81bfa62a2a24c6575d69d78a85d5edaacc0ece","observation_id":"4737e319-5e48-4a9a-8c48-c35ebcf25a93","resolution":{"observed_at":"2026-08-16T05:33:06.056392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-08-19T16:02:58.628969Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-16T05:33:05.204107Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.204107Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:03d7b0d495fff8ef78f06b1a18738b8bbace401d583a5416be517ad0614dce50","observation_id":"475c9ee5-a16e-4dfa-9331-4fd0802519ce","resolution":{"observed_at":"2026-08-16T05:33:05.204107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-08-17T03:48:18.599994Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-16T05:33:05.209223Z","title":"Mmbench: Is your multi-modal model an all-around player? arXiv preprint arXiv:2307.06281, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.209223Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:8465e1e9c175191fd90b674b1eb1a8536985fe866d08246d536cda7888bc7746","observation_id":"2d3d16c1-4a0b-43cf-b146-11772b6a4143","resolution":{"observed_at":"2026-08-16T05:33:05.209223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.214418Z","title":"Mmbench: Is your multi-modal model an all-around player? In European Conference on Computer Vision, pages 216–233","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.214418Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:75419ca866f9a892d062fb6516d180152b5ac55635b965510d1a4e225295f6f4","observation_id":"7e7edded-d986-44fb-8aa0-8c2b50a4c02f","resolution":{"observed_at":"2026-08-16T05:33:05.214418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-19T16:22:29.898436Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-16T05:33:05.219974Z","title":"Deepseek-vl: towards real-world vision- language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.219974Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:20bb057c065821914b45c15c817b8203d6fd24f8884a2f1b673ab27302e1952d","observation_id":"1126ba43-9af7-49e6-bc11-6aa9acb846c8","resolution":{"observed_at":"2026-08-16T05:33:05.219974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.225152Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.225152Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:ce0a816eb234b9ef3dfc9e3461418ad941e038d6e94dd867daa9597e36e03627","observation_id":"526101fd-7373-4a8f-a926-cdd667139a14","resolution":{"observed_at":"2026-08-16T05:33:05.225152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:06.008198Z","title":"Hello gpt-4o","venue":null,"work_id":"5d09daa4-83fc-49a3-9b74-4df820bce6a8","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.230832Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:9424e60134c65113407dd179cea26739961a4c17c731fcea4b448ce105196131","observation_id":"64187fd5-d148-4def-8eed-a8451c78ea94","resolution":{"observed_at":"2026-08-16T05:33:06.013685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.235507Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.235507Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:6dc8991d38cf3d7867555758b6bfcb2f133c376c620b786500121ecd68fe7ace","observation_id":"6abdc6f4-e6c5-4a08-b184-17bc51be04c7","resolution":{"observed_at":"2026-08-16T05:33:05.235507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.972597Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"209dc6be-ae87-40a2-a98f-53e3b18abd30","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.240720Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:4f61cbb835ebe5054e087947575c972580e491a191d3617e322603a943ee3eff","observation_id":"dae203b3-f86a-4dcc-a999-8d05a0b9c5f3","resolution":{"observed_at":"2026-08-16T05:33:05.978938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-16T11:34:00.114590Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-16T05:33:05.245200Z","title":"Object hallucination in image cap- tioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.245200Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:1853722376d66fafa69635bb224097147861ed6b5172a5fee75b424a48691074","observation_id":"d3d9adeb-91de-48c3-a655-683391fd31ec","resolution":{"observed_at":"2026-08-16T05:33:05.245200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.249827Z","title":"Scienceqa: A novel resource for question answering on scholarly articles","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.249827Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:bb1be9abbf27e920c6d2b488ded7e0fdb391c819411ef2aedc3fc920ed5d4d52","observation_id":"b5f53078-1a11-413d-975e-763cbc8b696f","resolution":{"observed_at":"2026-08-16T05:33:05.249827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T05:33:05.254435Z","title":"Proximal policy optimization algo- rithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.254435Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:3584b591486f7e224a8bee73879a96f42cff46142af51c86ae28fb61ff1ad11a","observation_id":"c352b03b-526e-4333-9a1f-e73af44dff72","resolution":{"observed_at":"2026-08-16T05:33:05.254435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.941002Z","title":"Conceptual captions: A cleaned, hypernymed, im- age alt-text dataset for automatic image captioning","venue":null,"work_id":"d52a0d05-b55d-4978-bd68-5865abb42574","year":2018},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.259020Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:90043b5e2ac9fa3cf19fe99371a52019e3d661c04954a3b253c83a3f42f6746f","observation_id":"3de345a3-61b9-4658-b921-f970338e013e","resolution":{"observed_at":"2026-08-16T05:33:05.946670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.920067Z","title":"Intervening anchor token: Decod- ing strategy in alleviating hallucinations for mllms","venue":null,"work_id":"22ffdd75-313c-41b6-8392-cc9ca7797050","year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.263655Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:066fef83a69ef40135625439940ae1d9a264a2c0269663009220d051865296ce","observation_id":"2d6785af-aa05-4322-bf4f-79939be67186","resolution":{"observed_at":"2026-08-16T05:33:05.925034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T05:33:05.269139Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.269139Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:9bea0e135bd0953c4d09525250d87ca25681638ab2349ade0ec8d1eba285ba41","observation_id":"e588c4fa-40ad-45cf-8594-b5e998efc6b5","resolution":{"observed_at":"2026-08-16T05:33:05.269139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-16T05:33:05.275081Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.275081Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:7fad9633a3b95d129ebc6cab2c05e473c598a210d381320eebd12be217d09e2c","observation_id":"b21539f5-cfc7-4f20-a131-23be82d88eeb","resolution":{"observed_at":"2026-08-16T05:33:05.275081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18715","last_updated":"2024-06-05T13:53:42Z","snapshot_observed_at":"2026-08-18T10:16:50.487633Z","submitted_at":"2024-03-27T16:04:47Z","title":"Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18715","snapshot_observed_at":"2026-08-16T05:33:05.280684Z","title":"Mitigating hallucinations in large vision-language models with instruction contrastive decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.280684Z"},"links":{"cited_paper":"/paper/2403.18715","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:cfb42de266693d48adf9aaf632cee4b4430c636aae3ee846f76362d303a2a61e","observation_id":"aa720416-4730-402e-883c-8074faecd8ff","resolution":{"observed_at":"2026-08-16T05:33:05.280684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16216","last_updated":"2026-05-16T18:30:31Z","snapshot_observed_at":"2026-08-12T16:47:35.127541Z","submitted_at":"2024-07-23T06:45:52Z","title":"Reinforcement Learning for LLM Post-Training: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16216","snapshot_observed_at":"2026-08-16T05:33:05.286073Z","title":"A comprehensive survey of llm alignment techniques: Rlhf, rlaif, ppo, dpo and more","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.286073Z"},"links":{"cited_paper":"/paper/2407.16216","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:8884c47585c9c4f0febe575f280525630f449609891f68162b4d9a41611cfa9b","observation_id":"473d809d-d83c-42f9-b01f-6af87fd5afa9","resolution":{"observed_at":"2026-08-16T05:33:05.286073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14233","last_updated":"2025-01-06T13:58:45Z","snapshot_observed_at":"2026-08-16T13:58:51.888995Z","submitted_at":"2024-04-22T14:46:10Z","title":"Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14233","snapshot_observed_at":"2026-08-16T05:33:05.291842Z","title":"Detecting and mitigating hallucination in large vision language models via fine-grained ai feedback.arXiv preprint arXiv:2404.14233, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.291842Z"},"links":{"cited_paper":"/paper/2404.14233","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:6bbfec2aa1562d4429786232176d2f1aaa96e74260a3ce80e9d3fedcfe941b4a","observation_id":"0919049e-5d69-4d07-ba68-a5d7490e3ae7","resolution":{"observed_at":"2026-08-16T05:33:05.291842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20974","last_updated":"2024-10-04T17:23:48Z","snapshot_observed_at":"2026-08-16T13:47:21.937691Z","submitted_at":"2024-05-31T16:21:16Z","title":"SaySelf: Teaching LLMs to Express Confidence with Self-Reflective Rationales","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20974","snapshot_observed_at":"2026-08-16T05:33:05.298081Z","title":"Sayself: Teaching llms to express confidence with self-reflective rationales","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.298081Z"},"links":{"cited_paper":"/paper/2405.20974","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:df2ff8a9341e0d3ed70aa783637d5651d80f27bdd945deec1c94b9c398af652a","observation_id":"1c919ffd-fe1c-45f5-8134-9be42f27bbcf","resolution":{"observed_at":"2026-08-16T05:33:05.298081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11903","last_updated":"2025-03-08T12:36:34Z","snapshot_observed_at":"2026-08-16T12:57:40.624030Z","submitted_at":"2025-02-17T15:24:49Z","title":"MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11903","snapshot_observed_at":"2026-08-16T05:33:05.303738Z","title":"Mmrc: A large-scale bench- mark for understanding multimodal large language model in real-world conversation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.303738Z"},"links":{"cited_paper":"/paper/2502.11903","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:05792746dd0ccac0b1881c028e57619dd747cfc0fe3830dc7513a62cc203a83a","observation_id":"fe7fd7c4-f4d2-436a-a76c-c878656eeded","resolution":{"observed_at":"2026-08-16T05:33:05.303738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-16T05:33:05.308800Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.308800Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:e6fa69560e94f0d63f12bb0c94a85fcab617d788357f40d3d6be5823ba57fbc4","observation_id":"04bf23eb-5eb0-4f15-a6a4-dc935d353eba","resolution":{"observed_at":"2026-08-16T05:33:05.308800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-16T05:33:05.314149Z","title":"Minicpm-v: A gpt-4v level mllm on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.314149Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:317a334fd1d5cab018d894587c841ee1c2dffbfcad817bebf79eba58d05c6865","observation_id":"567af210-f6e2-4d43-a72b-7afeaaa97596","resolution":{"observed_at":"2026-08-16T05:33:05.314149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16045","last_updated":"2024-12-11T02:46:29Z","snapshot_observed_at":"2026-08-18T12:54:07.136498Z","submitted_at":"2023-10-24T17:58:07Z","title":"Woodpecker: Hallucination Correction for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16045","snapshot_observed_at":"2026-08-16T05:33:05.318848Z","title":"Woodpecker: Hallucination correction for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.318848Z"},"links":{"cited_paper":"/paper/2310.16045","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:d719fcade6fc71483872669e0b3bc0729ed443d3320a7b1d0bdcda3fb71fb390","observation_id":"342c07b7-357b-4e85-b4c6-c93df8277f38","resolution":{"observed_at":"2026-08-16T05:33:05.318848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:33:05.900933Z","title":"Hallucidoctor: Mitigating hallucinatory toxicity in visual instruction data","venue":null,"work_id":"568fd757-c866-4879-98ed-1e2a31c3b7cb","year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.323705Z"},"links":{"citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:35301bc9a93cd554e977b6d174c816682671294b8ff6bb132b1643ab2f317fa3","observation_id":"0ae297ea-da95-4198-8f29-85e0f59b33cb","resolution":{"observed_at":"2026-08-16T05:33:05.908738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-18T03:16:44.825874Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-16T05:33:05.328752Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.328752Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:3d87449d3a345ae91306d314c2a473aaefa990fe2d557c72e92865bdf89b9b50","observation_id":"014d6c58-fba8-4a97-bee2-342641acc0c1","resolution":{"observed_at":"2026-08-16T05:33:05.328752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05262","last_updated":"2025-08-14T12:30:25Z","snapshot_observed_at":"2026-08-16T14:11:38.516056Z","submitted_at":"2024-03-08T12:35:07Z","title":"Debiasing Multimodal Large Language Models via Penalization of Language Priors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05262","snapshot_observed_at":"2026-08-16T05:33:05.333246Z","title":"Debiasing large visual language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.333246Z"},"links":{"cited_paper":"/paper/2403.05262","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:9f9ea848cfeca1aca74f12de82b312a7a768962cd885005264f33f2ecdeb9f2f","observation_id":"67c6cb01-0e37-473b-8145-0ddafbe53340","resolution":{"observed_at":"2026-08-16T05:33:05.333246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-16T19:33:05.632918Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-16T05:33:05.339602Z","title":"Beyond hallucinations: Enhanc- ing lvlms through hallucination-aware direct preference op- timization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.339602Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:0d1c320f3ebb9ccd459ad298dd6a97cd50891eb01bc0ce35e592c6b0dddddaa8","observation_id":"d81f5793-b83a-4b86-858e-c5c55205bff8","resolution":{"observed_at":"2026-08-16T05:33:05.339602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10501","last_updated":"2024-08-21T11:36:47Z","snapshot_observed_at":"2026-08-16T14:00:32.744525Z","submitted_at":"2024-04-16T12:19:54Z","title":"Self-Supervised Visual Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10501","snapshot_observed_at":"2026-08-16T05:33:05.345013Z","title":"Self- supervised visual preference alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T05:33:05.345013Z"},"links":{"cited_paper":"/paper/2404.10501","citing_paper":"/paper/2504.20468"},"observation_digest":"sha256:7a27147150a53e689518c7f770d35d2db7775252f78a039fff8e33ddacc3d73c","observation_id":"5782e471-7e5e-412d-8b52-4fefb243f4a1","resolution":{"observed_at":"2026-08-16T05:33:05.345013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.20468","last_updated":"2025-05-07T08:03:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T14:51:47.898913Z","submitted_at":"2025-04-29T07:05:24Z","title":"Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2504.20468."}