{"as_of":"2026-08-15T08:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca3a1c17f693e598cfd1c086fe010aa4f8699be9f2279d46cd0c00792ebbf7ad","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:18:04.250443Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:44:56.602154Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-09T06:50:40.208805Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12713","snapshot_observed_at":"2026-08-06T21:44:56.602154Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23590","last_updated":"2025-06-30T07:52:36Z","snapshot_observed_at":"2026-08-14T04:44:24.931189Z","submitted_at":"2025-06-30T07:52:36Z","title":"CAI: Caption-Sensitive Attention Intervention for Mitigating Object Hallucination in Large Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:56.602154Z"},"links":{"cited_paper":"/paper/2411.12713","citing_paper":"/paper/2506.23590"},"observation_digest":"sha256:8dedef52d133a2970465cf8bdd0eb781eff8fa2769a8ca2a03a47940626bc30c","observation_id":"36425d39-aa05-4e0f-9506-abc04e3b9448","resolution":{"observed_at":"2026-08-06T21:44:56.602154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12713","snapshot_observed_at":"2026-08-05T20:29:03.074635Z","title":"Kan et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-13T23:10:52.614750Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":199,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:03.074635Z"},"links":{"cited_paper":"/paper/2411.12713","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:71c1fa24bba0b839ca4b214196ce4fd56ef77fe9d4b06da7d4fc69b078d99d94","observation_id":"ade20b53-bd90-46ba-af70-c6fa78a8372c","resolution":{"observed_at":"2026-08-05T20:29:03.074635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"cited_work":{"arxiv_id":"2411.12713","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.12713","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2411.12713 , year=","venue":null,"work_id":"84bf4db2-9d24-4254-b78f-40808a34329c","year":null},"citing_paper":{"arxiv_id":"2605.04641","last_updated":"2026-07-29T07:14:27Z","snapshot_observed_at":"2026-08-11T12:03:57.511892Z","submitted_at":"2026-05-06T08:32:30Z","title":"CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-08T18:05:38.705480Z"},"links":{"cited_paper":"/paper/2411.12713","citing_paper":"/paper/2605.04641"},"observation_digest":"sha256:49fe0d6de7be6b0c2f5dd71517dfddbaa81108e7ff7d8ed9cb4f94b6cbac9d8d","observation_id":"d4db09bc-1988-46ac-a43a-df7bf02a4948","resolution":{"observed_at":"2026-05-09T06:50:40.210359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.12713/citation-record","integrity":"/paper/2411.12713/integrity","json":"/paper/2411.12713/citation-record.json","paper":"/paper/2411.12713"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.498963Z","title":"In: Proceedings of the IEEE International Conference on Computer Vision, pp","venue":null,"work_id":"54e2e9c1-5088-4682-ad29-f7ecc14b1aa7","year":2015},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.164915Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:31d8fb8b11a18f294626613b7dae4e58e338059cbc4590aad44c0fc6533a8113","observation_id":"e5b86128-b3bc-4357-ab8f-463c58677b4e","resolution":{"observed_at":"2026-08-12T17:18:04.502063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.168773Z","title":"Nature communications 12(1), 5721 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.168773Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:87d6ac71677279edabac4564b8b55daaddcf32b5042b90e08fa625477c90ffb6","observation_id":"48861456-f257-4acb-9361-445c5467f6a0","resolution":{"observed_at":"2026-08-12T17:18:04.168773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-13T12:45:18.778190Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-12T17:18:04.172031Z","title":"arXiv preprint arXiv:2406.19280 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.172031Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:1c70c1bdff8bd4a9ab1aecd57f26e14fdfcd3910a0b22a291cfd2fbd16f5651c","observation_id":"7253cf51-f030-4c56-8842-6578b2a220e6","resolution":{"observed_at":"2026-08-12T17:18:04.172031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.482311Z","title":"In: Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision, pp","venue":null,"work_id":"b25c04ca-d5ff-4ab7-b45c-30c3989d05ea","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.175424Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:3ad7c86082051e69429960dfa75d38fedbc182c9bdded020b85f6b15ce2217bb","observation_id":"5aad1a92-4e9c-4d30-84b6-7db537a2230b","resolution":{"observed_at":"2026-08-12T17:18:04.486200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-12T17:18:04.178777Z","title":"arXiv preprint arXiv:2404.18930 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.178777Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:0cde78e1fdf1f85d28f14aa6a253afdd60708aa8ba14943b1b772798af1ae366","observation_id":"de88d85d-86ca-409c-8b59-752b950c6fe6","resolution":{"observed_at":"2026-08-12T17:18:04.178777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.473178Z","title":"Advances in neural information processing systems 35, 23716–23736 (2022)","venue":null,"work_id":"50420db9-9193-4c6e-a5f3-3a2d7edbe269","year":2022},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.182751Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:d5967380e543e94238acb78f84154331d8f30e81f1d7251f328042a5f0cc5916","observation_id":"1f221303-cde1-48a9-8a3a-4ead3174b753","resolution":{"observed_at":"2026-08-12T17:18:04.476387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.463330Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"f85acc7b-f0eb-4d56-ad01-5a21c7020be4","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.185885Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:cbd7a4e52997c9b4cbc73b87eb0f8cee796e4972d4c6d97506a35489fdee84d7","observation_id":"9d79d1a4-af18-43a6-b1d2-52c3c1a426c6","resolution":{"observed_at":"2026-08-12T17:18:04.466878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.453870Z","title":"In: International Conference on Multimedia Modeling, pp","venue":null,"work_id":"8faa1da1-b9c5-49eb-b787-0ff733b383ce","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.188569Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:67d21ffefb78f0fe7c5ab6a90307d5e6239ee3c6630fe619c9c0223724d951e1","observation_id":"66b91e29-fcd6-4498-a8f1-326ac81bd230","resolution":{"observed_at":"2026-08-12T17:18:04.457659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14545","last_updated":"2024-05-29T05:55:09Z","snapshot_observed_at":"2026-08-15T00:58:20.496651Z","submitted_at":"2024-02-22T13:33:13Z","title":"Less is More: Mitigating Multimodal Hallucination from an EOS Decision Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14545","snapshot_observed_at":"2026-08-12T17:18:04.191280Z","title":"arXiv preprint arXiv:2402.14545 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.191280Z"},"links":{"cited_paper":"/paper/2402.14545","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:207076871f61b7dfb7bb2c8f63d6749f020732c197b43517a177e32abee8b624","observation_id":"45b95102-efd4-4764-bfc2-b8214571565a","resolution":{"observed_at":"2026-08-12T17:18:04.191280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.444998Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"c2a1a034-e426-44b1-897e-8a0f3898a9bd","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.194262Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:7cc58068b2382c69b6bc4c86238936bb2a5eecd9aae2d99d6283c3ae70256c4a","observation_id":"a01b45aa-02f0-44fb-8617-2ac88aa82f21","resolution":{"observed_at":"2026-08-12T17:18:04.448226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.197197Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.197197Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:03744c9c14be3fe6d411b791ca4f95184dad21b42d37456d20fbcb12a1782e13","observation_id":"a4f988b4-5a28-491b-81f0-e1ed6a77b6f9","resolution":{"observed_at":"2026-08-12T17:18:04.197197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.429509Z","title":"Advances in neural information processing systems 36 (2024)","venue":null,"work_id":"eaf6a78e-6169-4750-887c-7fba18d00892","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.200224Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:793170c78969174910402a45d1c94eca8fc2908f2fe0fb6689b925807d08ce82","observation_id":"1b830520-c6d7-452a-a886-17f8ebd23eec","resolution":{"observed_at":"2026-08-12T17:18:04.433227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.420684Z","title":"arXiv e-prints, 2310 (2023)","venue":null,"work_id":"48542fe9-8e4b-4227-9b18-149ab3d0a019","year":2023},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.203318Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:3cd5a5143d4b4aae6c87445dba181caa720a0db5112fd288e262e7ef2c1a7685","observation_id":"4636f99d-7a33-4007-afb2-98c10059e17f","resolution":{"observed_at":"2026-08-12T17:18:04.424143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03105","last_updated":"2024-01-13T15:11:04Z","snapshot_observed_at":"2026-08-13T04:48:12.047734Z","submitted_at":"2024-01-06T02:02:34Z","title":"Incorporating Visual Experts to Resolve the Information Loss in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03105","snapshot_observed_at":"2026-08-12T17:18:04.206007Z","title":"arXiv preprint arXiv:2401.03105 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.206007Z"},"links":{"cited_paper":"/paper/2401.03105","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:d4d7ee5b33723d3f3700c940100506a0ab58afb258596b611809a961d23a3381","observation_id":"2306dece-9cd4-4194-9d03-87f5e596f5fa","resolution":{"observed_at":"2026-08-12T17:18:04.206007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.411525Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"119610ae-a2b8-43ad-bd34-100f9d900e03","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.208971Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:646d21f90e4bd38988bde0c4b76327a314e4e4785c4f61467fb0f6ae7d55a752","observation_id":"25a5fdfb-2662-4c6f-a6f0-f19926fcb3b7","resolution":{"observed_at":"2026-08-12T17:18:04.414572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.401913Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"38c533d0-f324-42eb-a284-524392f17a2b","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.211654Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:3b3fbe9f76a9afa92b11a595bef566c6eacd1308e402575bab748bae75cba494","observation_id":"96518008-05c1-4dbc-b08b-714f273c82d1","resolution":{"observed_at":"2026-08-12T17:18:04.405979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-13T04:05:43.225856Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-12T17:18:04.214241Z","title":"arXiv preprint arXiv:2403.00425 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.214241Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:a1a57b9d702802d8239d480321d0670f53adbeea4f9d05e497b424b70409fe03","observation_id":"f22958ea-72ae-4b13-b9c3-b6e7c59324f3","resolution":{"observed_at":"2026-08-12T17:18:04.214241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.392910Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"c8c92610-3a18-4906-9a9b-0b6343637a67","year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.217213Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:18d5946869953cf7a5a448e74672d8dc5ea2ef3db5c5a8a253c48d6ffa2c8f23","observation_id":"15a57a99-4ccc-4c2b-8a42-b19e355865db","resolution":{"observed_at":"2026-08-12T17:18:04.396241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.219870Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.219870Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:b303b5941753511fbfd8fece9aae9219f97c9bfd3f8196061ed5b2d426751f41","observation_id":"51a7ae23-c569-4de5-9a14-35599d1c9973","resolution":{"observed_at":"2026-08-12T17:18:04.219870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.222674Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.222674Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:6b26736aa3e5020f37b89ff64feda5e70b3cedc4d3749096abd9b6bdcc7b15a7","observation_id":"79256c74-0372-45cd-ad10-57e3378aaaed","resolution":{"observed_at":"2026-08-12T17:18:04.222674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.373103Z","title":"In: Computer Vision– ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6-12, 16 2014, Proceedings, Part V 13, pp","venue":null,"work_id":"0ebc7e52-d0ad-4fd7-8bef-c2ca4dee8383","year":2014},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.225656Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:9d2fc93c2728d7cc7b06c5c1fb13ebae23fe861f607a1acb88298d2db7f7cfc5","observation_id":"e7f638d8-e7cd-45f0-b3b5-38bce1112786","resolution":{"observed_at":"2026-08-12T17:18:04.376505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-08-13T18:58:34.541884Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-12T17:18:04.228320Z","title":"https://arxiv.org/abs/2305.06500","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.228320Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:ec5b45772608318db79a7bc2c950536e83c2336205a323634b67204e2b93875b","observation_id":"7d0b25de-eff9-45a3-b9ef-9f603a72f48d","resolution":{"observed_at":"2026-08-12T17:18:04.228320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.364564Z","title":"See https://vicuna","venue":null,"work_id":"7bd7ef7c-e1ec-4e73-ad6d-a1f552fd4d99","year":null},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.231868Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:9876638e0a112794316882dfa2dcde8be303d14d0b33a7927ec319d66bcd0508","observation_id":"f5fe87bc-3e60-4833-b0cf-b66e0c29f95c","resolution":{"observed_at":"2026-08-12T17:18:04.367478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-12T17:18:04.234717Z","title":"arXiv preprint arXiv:2305.10355 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.234717Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:022d309c8d98a31e68b25f6e71cafb2430a8b79b8bb17b288ca665d4a4fe30a5","observation_id":"dafa2764-7289-441f-a05c-cab2f416cb30","resolution":{"observed_at":"2026-08-12T17:18:04.234717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-14T18:32:00.128699Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-12T17:18:04.237562Z","title":"arXiv preprint arXiv:1809.02156 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.237562Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:71c0e5ddbc269d58c6306315c7c93e23ebaae2d3cb3f99f3f39e132b1fcefee7","observation_id":"09e23c2f-1982-4ff7-9fe6-b23ef86d8baa","resolution":{"observed_at":"2026-08-12T17:18:04.237562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-12T17:18:04.241341Z","title":"arXiv preprint arXiv:2306.13394 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.241341Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:dd366844cfd6e4ae738295323c7b4e539f27a8f9e8b14c23020fb52144e1a15a","observation_id":"a07374a5-0e39-4f14-aaaa-971cd488290c","resolution":{"observed_at":"2026-08-12T17:18:04.241341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.355825Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":"43698804-0483-4cd0-b5ad-a7604dfbd1b5","year":2022},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.245094Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:439daf2cd3bb959952671babc0bc8ed8fd880315f59e222dbf26834cfbf542a9","observation_id":"79bafe2a-0fff-48ce-8f30-2c54ec045948","resolution":{"observed_at":"2026-08-12T17:18:04.358816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.346788Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"32d0519e-e9df-4736-a023-1cabd07933f5","year":2019},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.247810Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:abbc31c98dd7cc55007c83793237b128be5f5310eb2405e1866262241e98522c","observation_id":"0e78308c-1073-4b11-8fab-634ac2ba359e","resolution":{"observed_at":"2026-08-12T17:18:04.349794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:18:04.336273Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":"16ca20da-9dea-4b01-8e35-a2a4fa559e12","year":2023},"citing_paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T17:18:04.250443Z"},"links":{"citing_paper":"/paper/2411.12713"},"observation_digest":"sha256:9f63013aca663fc81b9f9692a3e616da6e0fc048a9c5bb035237711e478a7f2b","observation_id":"099c4c28-ddfa-4ccf-8577-417c3e57377b","resolution":{"observed_at":"2026-08-12T17:18:04.340963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.12713","last_updated":"2024-11-19T18:27:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T21:18:54.878062Z","submitted_at":"2024-11-19T18:27:31Z","title":"CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 3 inbound Pith citation observations for arXiv:2411.12713."}