{"as_of":"2026-08-23T16:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1142257fbf9a722aa9fc48d239711d0bc0862094e191993cd803cfea8ece5771","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:38:22.063110Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:18:56.589135Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-08T12:20:08.878537Z","title":"Unraveling cross-modality knowledge conflicts in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07855","last_updated":"2025-06-13T12:20:30Z","snapshot_observed_at":"2026-08-13T21:16:14.932934Z","submitted_at":"2025-02-11T14:04:43Z","title":"Vision-Language Models for Edge Networks: A Comprehensive Survey","version":2},"reference_index":181,"source":"pdf_text","source_observed_at":"2026-08-08T12:20:08.878537Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2502.07855"},"observation_digest":"sha256:7af3018527eb8c483410d74ce987b6f9408a9b67e894ec6c0461b687e0775e79","observation_id":"c1aa22ad-0436-4163-8de4-e9a8d6e439aa","resolution":{"observed_at":"2026-08-08T12:20:08.878537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-07T14:16:54.646826Z","title":"Unraveling cross-modality knowledge conflicts in large vision-language models.arXiv preprint arXiv:2410.03659, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19509","last_updated":"2025-05-26T04:39:30Z","snapshot_observed_at":"2026-08-23T15:26:32.940651Z","submitted_at":"2025-05-26T04:39:30Z","title":"Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:54.646826Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2505.19509"},"observation_digest":"sha256:5f65ad4fce22e6c47979c20692cd930c1d40f3dfba7c5c4e8ae8093cb12b3faa","observation_id":"7dc98abf-b225-4c39-85c8-175ef4573d84","resolution":{"observed_at":"2026-08-07T14:16:54.646826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-07T12:42:28.298796Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24073","last_updated":"2025-08-26T16:42:37Z","snapshot_observed_at":"2026-08-17T13:14:58.451971Z","submitted_at":"2025-05-29T23:32:03Z","title":"mRAG: Elucidating the Design Space of Multi-modal Retrieval-Augmented Generation","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:28.298796Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2505.24073"},"observation_digest":"sha256:3ed035d005de8a8f1af59985b2e67ff47ad337a6d8b081582402b7381490ab6a","observation_id":"f860008b-cb30-4061-a79d-89b0ca0f50af","resolution":{"observed_at":"2026-08-07T12:42:28.298796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-07T11:36:40.971423Z","title":"Unraveling cross-modality knowledge con- flicts in large vision-language models.arXiv preprint arXiv:2410.03659, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01872","last_updated":"2025-06-02T17:01:40Z","snapshot_observed_at":"2026-08-13T14:54:55.221252Z","submitted_at":"2025-06-02T17:01:40Z","title":"Is Extending Modality The Right Path Towards Omni-Modality?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:36:40.971423Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2506.01872"},"observation_digest":"sha256:a7f72f0cd5ffccb37009e38b49fccc07a424a9fbb9ea5285e101c0beb2a54bb6","observation_id":"47527f2e-8ffb-4862-b043-2ec7340325b1","resolution":{"observed_at":"2026-08-07T11:36:40.971423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-06T20:47:07.903561Z","title":"Unraveling cross-modality knowledge conflict in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01790","last_updated":"2025-07-02T15:15:14Z","snapshot_observed_at":"2026-08-18T14:40:27.199280Z","submitted_at":"2025-07-02T15:15:14Z","title":"How Do Vision-Language Models Process Conflicting Information Across Modalities?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T20:47:07.903561Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2507.01790"},"observation_digest":"sha256:77b419c860c54c7acb2e2a4ea58b66f31a4e47625075df58025b8e9261157763","observation_id":"9c47deb8-34ed-426f-b729-1e8ce3c23b4d","resolution":{"observed_at":"2026-08-06T20:47:07.903561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-06T19:02:35.018852Z","title":"Unravel- ing cross-modality knowledge conflicts in large vision- language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07151","last_updated":"2025-07-09T11:18:38Z","snapshot_observed_at":"2026-08-18T11:15:48.145458Z","submitted_at":"2025-07-09T11:18:38Z","title":"Robust Multimodal Large Language Models Against Modality Conflict","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:02:35.018852Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2507.07151"},"observation_digest":"sha256:e16b7f60e9cfbe357e8de8e75b0b1a729511efe237951b09a4949bbf4b7d325c","observation_id":"63c38f93-dfe9-4510-9ac0-fee91f0bec99","resolution":{"observed_at":"2026-08-06T19:02:35.018852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-06T18:09:12.654015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-20T00:19:54.600869Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:12.654015Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:f616048d7e44b3bda4d955fd1a41635fda2c3cfc441416995e25d7431159b253","observation_id":"6cf7bf70-5853-428f-80e8-95f8bf768da5","resolution":{"observed_at":"2026-08-06T18:09:12.654015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2410.03659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-07-03T20:18:56.589135Z","title":"arXiv preprint arXiv:2410.03659 (2024) A Judge Reliability and Probe Detection Hall","venue":null,"work_id":"8ee6f3ff-2d6e-479e-8027-1e5502ce0d38","year":2024},"citing_paper":{"arxiv_id":"2604.27559","last_updated":"2026-04-30T08:08:46Z","snapshot_observed_at":"2026-08-10T23:52:22.570018Z","submitted_at":"2026-04-30T08:08:46Z","title":"RIHA: Report-Image Hierarchical Alignment for Radiology Report Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-07T10:00:25.846913Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2604.27559"},"observation_digest":"sha256:321a278020abff948a1d0c8a51c94920ac89c1b70272597cc4fb705ec8c07e36","observation_id":"5b1684b8-c769-4354-aeb3-4894714bd8a3","resolution":{"observed_at":"2026-05-12T09:41:26.010367Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2410.03659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-07-03T20:18:56.589135Z","title":"arXiv preprint arXiv:2410.03659 (2024) A Judge Reliability and Probe Detection Hall","venue":null,"work_id":"8ee6f3ff-2d6e-479e-8027-1e5502ce0d38","year":2024},"citing_paper":{"arxiv_id":"2605.19250","last_updated":"2026-05-19T01:47:53Z","snapshot_observed_at":"2026-08-21T07:54:50.349704Z","submitted_at":"2026-05-19T01:47:53Z","title":"Causal Evidence for Attention Head Imbalance in Modality Conflict Hallucination","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T06:25:43.369455Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2605.19250"},"observation_digest":"sha256:b3007c7be82332f3801af4bd3db575778e911af9f122fd4f9a1fb19d54457628","observation_id":"82b8a289-9b1d-40f3-8d53-a20d3a6238df","resolution":{"observed_at":"2026-05-20T06:28:05.503260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2410.03659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-07-03T20:18:56.589135Z","title":"arXiv preprint arXiv:2410.03659 (2024) A Judge Reliability and Probe Detection Hall","venue":null,"work_id":"8ee6f3ff-2d6e-479e-8027-1e5502ce0d38","year":2024},"citing_paper":{"arxiv_id":"2606.07962","last_updated":"2026-06-06T03:40:47Z","snapshot_observed_at":"2026-08-16T22:41:49.307849Z","submitted_at":"2026-06-06T03:40:47Z","title":"ChronoPhyBench: Do MLLMs Truly Understand the World or Merely Exploit Language Priors?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T20:23:18.667677Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2606.07962"},"observation_digest":"sha256:b508bde36b8e41c8ef6cf691efbdd8c037792be93fa03e09fbbb4f61525bc383","observation_id":"bbd94af2-b3eb-4169-8e70-07eacc036cfe","resolution":{"observed_at":"2026-07-02T20:27:22.638397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2410.03659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-07-03T20:18:56.589135Z","title":"arXiv preprint arXiv:2410.03659 (2024) A Judge Reliability and Probe Detection Hall","venue":null,"work_id":"8ee6f3ff-2d6e-479e-8027-1e5502ce0d38","year":2024},"citing_paper":{"arxiv_id":"2606.08394","last_updated":"2026-06-07T01:11:36Z","snapshot_observed_at":"2026-08-15T10:24:14.510087Z","submitted_at":"2026-06-07T01:11:36Z","title":"When Correct Decisions Hide Internal Stress: Decision-State Probing in Multimodal Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T19:02:12.613002Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2606.08394"},"observation_digest":"sha256:3fd6e136804763708cdae5f8972a5edb47ce9f237c768a39e57c58a6c455ac0a","observation_id":"b5f96521-0c87-4d8b-ab48-5a3057d25141","resolution":{"observed_at":"2026-07-02T22:17:26.208924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2410.03659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-07-03T20:18:56.589135Z","title":"arXiv preprint arXiv:2410.03659 (2024) A Judge Reliability and Probe Detection Hall","venue":null,"work_id":"8ee6f3ff-2d6e-479e-8027-1e5502ce0d38","year":2024},"citing_paper":{"arxiv_id":"2606.17953","last_updated":"2026-06-16T14:05:46Z","snapshot_observed_at":"2026-08-08T03:30:33.979416Z","submitted_at":"2026-06-16T14:05:46Z","title":"MLLMs Get It Right, Then Get It Wrong: Tracing and Correcting Late-Layer Textual Bias","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T01:28:50.021432Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2606.17953"},"observation_digest":"sha256:e71cd9029009e5dc28d1f578a4c96f612a586c63816fa07fda2b95b75d29c558","observation_id":"bb3526a8-6af3-4eac-bf2b-f76977ac22b1","resolution":{"observed_at":"2026-07-03T20:18:56.591891Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-01T10:51:18.853885Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20092","last_updated":"2026-07-22T12:47:29Z","snapshot_observed_at":"2026-08-20T13:15:48.354418Z","submitted_at":"2026-07-22T12:47:29Z","title":"ENTRAP-VL: A Taxonomic Probe for Dual Contextual Entrainment in Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T10:51:18.853885Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2607.20092"},"observation_digest":"sha256:8321abaf2a18a3b6a5da6ac73f12eeb169d5dcbb6e2e1c7be933686ccb839733","observation_id":"924cbbd3-b504-4636-a0fe-85da7e477ac8","resolution":{"observed_at":"2026-08-01T10:51:18.853885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-04T01:41:48.311245Z","title":"arXiv preprint arXiv:2410.03659 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-18T17:28:34.602600Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.311245Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:0fc732e072af158f62f57086c79873a378dd1194a233a0c05b0c0c69c4e22fe1","observation_id":"04db053e-d3c9-4ac9-86c3-f893bf014338","resolution":{"observed_at":"2026-08-04T01:41:48.311245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-04T04:31:49.171426Z","title":"Unraveling Cross- Modality Knowledge Conflicts in Large Vision-Language Models.arXiv e-prints, page arXiv:2410.03659, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02573","last_updated":"2026-08-03T17:49:40Z","snapshot_observed_at":"2026-08-23T07:50:15.462268Z","submitted_at":"2026-08-03T17:49:40Z","title":"Foundation Models for Astrophysics","version":1},"reference_index":150,"source":"pdf_text","source_observed_at":"2026-08-04T04:31:49.171426Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2608.02573"},"observation_digest":"sha256:af6f90cc165f179e10f719f2a977ab8fbf3507f9f126b4d2b7134e4595f913f8","observation_id":"46970202-0f83-470b-8d36-25537a4ee3ce","resolution":{"observed_at":"2026-08-04T04:31:49.171426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-12T00:38:22.063110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08009","last_updated":"2026-08-08T08:41:26Z","snapshot_observed_at":"2026-08-19T15:29:28.786198Z","submitted_at":"2026-08-08T08:41:26Z","title":"Evidence-Grounded Forensic Reasoning for Detecting and Grounding Multi-Modal Media Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T00:38:22.063110Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2608.08009"},"observation_digest":"sha256:45c1928fdd3e05ee527c59d9989008c04fb836f0431d38d380fd00085735ac53","observation_id":"41026aa6-ae7f-4e62-b832-f97f6220f113","resolution":{"observed_at":"2026-08-12T00:38:22.063110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.03659/citation-record","integrity":"/paper/2410.03659/integrity","json":"/paper/2410.03659/citation-record.json","paper":"/paper/2410.03659"},"outbound":[],"paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-21T07:54:28.904294Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2410.03659."}