{"as_of":"2026-08-14T02:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ac72cdbed2d4c44bc711b6d6a5760ec09cb032adfeb604d8415f47f37912a0a1","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:07:46.368829Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09772/citation-record","integrity":"/paper/2608.09772/integrity","json":"/paper/2608.09772/citation-record.json","paper":"/paper/2608.09772"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.589225Z","title":"Proceedings of the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING 2024) , pages=","venue":null,"work_id":"e951835f-cf92-41bd-aba8-abf75d8b5ee9","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.032306Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:2c3555ab304e797cce6e2e3d614a71145191903dd68580a933be8108961ac31b","observation_id":"fd9ffc26-d5e7-441d-81e6-b1005a057c21","resolution":{"observed_at":"2026-08-11T11:07:47.593578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.039687Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.039687Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:a392890038b9b02d7b935bfcd3a8bb49b9fbd716dd8639c3957bebed384aac2f","observation_id":"69cd5c07-f9f0-4d4a-9a21-eab8a9df1ead","resolution":{"observed_at":"2026-08-11T11:07:46.039687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.044305Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.044305Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:99b530d0227d14b943499c9877149156fd3ed6d0e6f8532f7ff0e26e84149f4f","observation_id":"bcc78282-e2fe-4c67-b614-679414b0b7d9","resolution":{"observed_at":"2026-08-11T11:07:46.044305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.048856Z","title":"Chandra and Dexter C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.048856Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:89ac4ce5bfd97f78172e6c9b46fcdec16c86feb3ef2ee6ad8349a2b9e73d74a4","observation_id":"f4f127be-139a-4389-ace3-7d73678b537d","resolution":{"observed_at":"2026-08-11T11:07:46.048856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.058886Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.058886Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:cedb1ac1d6f10c24741334b75f11d25eece3848c65bc712d20974c1245216bd4","observation_id":"e80466ea-fe37-4adc-82fc-aac915fe42a7","resolution":{"observed_at":"2026-08-11T11:07:46.058886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.063049Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.063049Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:b228d479b5c09201a964f31177ebd2ce038ff25d548b5599d78448782293f63c","observation_id":"026202ce-93c8-4d2d-b7d4-23bd5924e38c","resolution":{"observed_at":"2026-08-11T11:07:46.063049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.067432Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.067432Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:2c8e427666937d2104301c95809f4f52a1ad2c8f50f2ee244460b6f816d43e50","observation_id":"d1ab51cd-28b6-4e5e-91c4-80348b4eed9d","resolution":{"observed_at":"2026-08-11T11:07:46.067432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.072199Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.072199Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:4967f225c36f7e1bb6d75a34083ed0f17abf86878a735e7e37047a6fdc02893a","observation_id":"f950fb53-ca3b-4432-beb9-6a5e3d40ca8a","resolution":{"observed_at":"2026-08-11T11:07:46.072199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.523783Z","title":"Information Fusion , pages=","venue":null,"work_id":"0f0adf26-f496-4198-96a3-045e7fcb83c4","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.076496Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:4b820222dbfae6412c728aca7b30ab222bc2ce84d59e5bb5e2001e67ffde2c53","observation_id":"a5a5dfc5-b155-41fc-9ef4-74e6a2b14219","resolution":{"observed_at":"2026-08-11T11:07:47.528368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.510193Z","title":"cortex , volume=","venue":null,"work_id":"09f0831e-70eb-4f4f-ada4-0855f0cd3c54","year":2012},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.080559Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:be96c107568a2bb4e9b9bdb7dc41c4d2069b815a0400861c37960df900468e4c","observation_id":"4e1790ac-a7b0-4b98-a4c9-ea5dd4d65530","resolution":{"observed_at":"2026-08-11T11:07:47.514922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.084220Z","title":"arXiv preprint arXiv:2412.14613 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.084220Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5b8858e46145c241b0f91da439a4bfcca5f8c2f9e1132e3a5454cbd2138767de","observation_id":"4b8b3d9d-5358-49ac-a91e-69aeff8bc217","resolution":{"observed_at":"2026-08-11T11:07:46.084220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.496741Z","title":null,"venue":null,"work_id":"90893102-7619-4c5b-9206-75574738c34f","year":2000},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.088491Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:f926fa6377dcfdd8743b01b378277aee66b4504fdfaeb4178311c53cdffac497","observation_id":"65e04de8-b446-4e60-aa86-c1e3b7c6542c","resolution":{"observed_at":"2026-08-11T11:07:47.500699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.483514Z","title":null,"venue":null,"work_id":"e5b2a7fc-1b1b-4be8-a8f7-8d59566dbf50","year":1988},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.092465Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:2ebe2f6ddba90d6eb14dc982ac9f69f7b5b973bcc115af78b6b0bda667f0ba69","observation_id":"dbe20a0e-f8ae-470b-9499-40482615c89e","resolution":{"observed_at":"2026-08-11T11:07:47.488834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.469351Z","title":"Proceedings of the 34th ACM International Conference on Information and Knowledge Management , pages=","venue":null,"work_id":"9fda6bdd-d599-4d2f-af9d-187760333ee8","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.096803Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:ad54c06b252241de33966709a59938c48d271f83171c8727dbbea8f26d8f6c82","observation_id":"02d29153-27b8-4114-b574-f93b5b9611c6","resolution":{"observed_at":"2026-08-11T11:07:47.473880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.456189Z","title":"Sarcasm and the Space Structuring Model , year =","venue":null,"work_id":"f110bb46-c0b9-449a-a07c-230b593830aa","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.101260Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:f19ca7f8b76df8cebaca4c51b9bb51b3ef5351afc3e230e6c0881cfcbb821397","observation_id":"6a74f7a8-ce48-4844-8a0f-d5091a0f52ad","resolution":{"observed_at":"2026-08-11T11:07:47.460640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.105190Z","title":"Communications of the ACM , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.105190Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:1af210bc7cca30d31084ef8cc283c069d4e8131ca8f4d7a5ec46ce1050f9d9bf","observation_id":"35fd021a-11d8-47c3-b95d-2b077bfcfc82","resolution":{"observed_at":"2026-08-11T11:07:46.105190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.434614Z","title":"Proceedings of the 24th ACM international conference on Multimedia , pages=","venue":null,"work_id":"e39ec880-d2e3-4d9d-a549-eab25573944f","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.109757Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9208c37552d15a326eacf1845729bbef7a36abcd42a4cde194c968f2e65b0689","observation_id":"20a65396-6af1-4f26-ae39-df05b9053704","resolution":{"observed_at":"2026-08-11T11:07:47.439266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.418419Z","title":"Proceedings of the 57th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":"20d5e65f-3c1c-4d2a-a222-6b88e512fbb6","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.114878Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:3293af80019ff0d45a94b315d3c922fab092c29955f874919ee12a7b4cfe9b5f","observation_id":"cc9b9912-6434-4394-9428-135de3bc6e33","resolution":{"observed_at":"2026-08-11T11:07:47.424932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.402539Z","title":"0: Towards a reliable multi-modal sarcasm detection system , author=","venue":null,"work_id":"81baae21-d68c-4c06-84e5-315881bffc6a","year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.118795Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d947e8e542fcc99c0c84b0cdb780d43d5bd5af2ef6e049c027d957025086c2e2","observation_id":"ae28317d-9144-4560-9039-e93b11ab90e8","resolution":{"observed_at":"2026-08-11T11:07:47.407283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.388390Z","title":"Proceedings of the 60th annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":"48cf22b7-4bc6-446e-a839-5146fc7c10f7","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.122598Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:1fbee972c2df720819fc55ae5ac3c1139253e750448feb3ee54a53ec42363bff","observation_id":"acde4124-ef72-45d0-9552-1ad3a87651b9","resolution":{"observed_at":"2026-08-11T11:07:47.393824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.360127Z","title":"Proceedings of the 29th ACM international conference on multimedia , pages=","venue":null,"work_id":"88749a59-2582-444a-95a0-b2edf40a691a","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.126600Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:be568fe4d7c9094e746029ee3d015379b0cb47c070e21b38423009d1277e8810","observation_id":"cd8fb1b4-c5bb-490a-b074-52544cccc794","resolution":{"observed_at":"2026-08-11T11:07:47.365266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.343508Z","title":"2020 International Joint Conference on Neural Networks (IJCNN) , pages=","venue":null,"work_id":"7a09c146-9868-4715-84b7-9761f76cd821","year":2020},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.131070Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:efb540f85c523079dd2e8e447df9c5297361c745888a0f9b6f29d4c9ff6ee901","observation_id":"d2a18dc6-4c33-48e4-b392-d894217fcb54","resolution":{"observed_at":"2026-08-11T11:07:47.349277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.330646Z","title":"Proceedings of the 20th international conference on multimodal interaction: adjunct , pages=","venue":null,"work_id":"f7080d84-5a88-4f06-bae4-814e38871776","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.134893Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:98432b6dab7b355dbebd5c8f39df88b61a71dc10a1a86c0fc50bd9b8f920f29c","observation_id":"6ff40522-c0e0-4b23-adcc-f8b9640552df","resolution":{"observed_at":"2026-08-11T11:07:47.334750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.317613Z","title":"how long did you marinate in it? multimodal sarcasm explanation , author=","venue":null,"work_id":"83e79f7e-ca4b-4605-b96f-a2d066bd1959","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.139108Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:ebbcf2489c7d3c2d011c017b5d255278b65d4faea03a7746eae65b68c1d21efa","observation_id":"48382de6-fd49-4fd1-8655-4d9a59267e8e","resolution":{"observed_at":"2026-08-11T11:07:47.321719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.305266Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2020 , pages=","venue":null,"work_id":"54d41927-dfc3-44a5-841c-f9e3e63d3603","year":2020},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.143438Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:bf66b73c2fbc920430bf15efb8200d46db0eaff66aaa715b12d0e6109610bf38","observation_id":"c5e3d745-90b9-4d2e-b583-aba5e2c4d473","resolution":{"observed_at":"2026-08-11T11:07:47.309245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.292855Z","title":"Proceedings of the 32nd ACM International Conference on Multimedia , pages=","venue":null,"work_id":"f0cdfa8b-cfad-43ed-a2e1-0680846ede3a","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.148195Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:f2d0cd8ac35c96f4c2daa741e5b643da8cb233820bfdbf59244840972233563e","observation_id":"ae2b44d3-35c0-4e85-8bba-3cc95b322a46","resolution":{"observed_at":"2026-08-11T11:07:47.297212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.152862Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.152862Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:411c3b823f43374b80116a1b740ecbbd2940dcd10b46bbf34db7a93c0cc1f610","observation_id":"fe548c10-d61c-4a73-a224-e7b1117ec38d","resolution":{"observed_at":"2026-08-11T11:07:46.152862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.274327Z","title":null,"venue":null,"work_id":"85fd2dd6-bb77-49a4-bf54-a0ef0ae2ee47","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.156913Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:3be8408802f57d602b16302e5cc04fd1268be2fdee24a85e6a3a021591c633f9","observation_id":"ae7fc9e3-8da6-4b98-98b8-b02a451542a3","resolution":{"observed_at":"2026-08-11T11:07:47.278309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.262571Z","title":"IEEE Transactions on Affective Computing , volume=","venue":null,"work_id":"b6d1d362-90dd-41bb-95b7-850213aee9c2","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.160891Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:50faf90046e97855e2a060b146685f6e99ea5e4e8e0b5a628fc554918a7930c6","observation_id":"6405a6ba-104d-4132-816b-a3ce3ad62888","resolution":{"observed_at":"2026-08-11T11:07:47.266399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18882","last_updated":"2024-10-24T16:17:47Z","snapshot_observed_at":"2026-08-12T22:15:45.753938Z","submitted_at":"2024-10-24T16:17:47Z","title":"A Survey of Multimodal Sarcasm Detection","version":1},"cited_work":{"arxiv_id":"2410.18882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.18882","snapshot_observed_at":"2026-08-11T11:07:46.678918Z","title":"A Survey of Multimodal Sarcasm Detection","venue":"cs.CL","work_id":"d15b5844-2c93-46a8-ac4f-45cc8017432a","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.164943Z"},"links":{"cited_paper":"/paper/2410.18882","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9547330aa9c68ab0af9ef80f7db430a09999af3a55f234d6ee7fcd9d23a3964f","observation_id":"3976daf3-efd7-4986-8b48-672fad31e442","resolution":{"observed_at":"2026-08-11T11:07:46.684075Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T11:07:46.169676Z","title":"arXiv preprint arXiv:2303.08774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.169676Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9b2b3a5e9168dd8d9d192b75b2f9b66746d1a3ec53f685cefa3721ffa144bd18","observation_id":"43ca6f2c-d194-4d83-b5bc-be12d8b6490e","resolution":{"observed_at":"2026-08-11T11:07:46.169676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.175086Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.175086Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:85111edf6327ce5c9a8fae9f134a370eb18bc1883dd5e8d1f2b72d0b4114d3ba","observation_id":"d14a6ab2-390e-4af1-a5c5-df39deb4fd54","resolution":{"observed_at":"2026-08-11T11:07:46.175086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.179021Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.179021Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d7b3a3d1e8a2ea684cd05aedde6c735de6f75ff1569fe4819f954190af9a41bc","observation_id":"9ba339a2-8d03-4b54-8f33-4d5bf7fb98b5","resolution":{"observed_at":"2026-08-11T11:07:46.179021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.236505Z","title":"2025 IEEE International Conference on Data Mining Workshops (ICDMW) , pages=","venue":null,"work_id":"e9d08b02-1053-4485-a4d5-6b53ffa4a63d","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.182927Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:27b079996c0e82c15a0f952b2bac34d26e1f9a3cf1414f5e809a13fee2db8c1c","observation_id":"9edf7d81-288b-4f69-93d1-1719c94877f2","resolution":{"observed_at":"2026-08-11T11:07:47.240535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.224609Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"070e317c-7d65-46ba-962f-b59b5979ba35","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.187896Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:8fa2b77b4d26dbe1cd59905d802dd4364feabf9e91d8567fcce920d47be394f9","observation_id":"860abc87-3809-4a42-8744-a4763bf04c20","resolution":{"observed_at":"2026-08-11T11:07:47.228819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.211868Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"f5a0cf91-2e4f-4e9a-bf13-88c07f5a2e83","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.191912Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:575da8f7e55f2cefb372fbcaf343142b2afc0741a1df1dd482e904edf2a90d36","observation_id":"bde581d8-1377-4e2f-b166-5b0829d2e115","resolution":{"observed_at":"2026-08-11T11:07:47.216470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04550","last_updated":"2025-03-06T15:36:06Z","snapshot_observed_at":"2026-08-10T06:38:13.718003Z","submitted_at":"2025-03-06T15:36:06Z","title":"Benchmarking Reasoning Robustness in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04550","snapshot_observed_at":"2026-08-11T11:07:46.195820Z","title":"arXiv preprint arXiv:2503.04550 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.195820Z"},"links":{"cited_paper":"/paper/2503.04550","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:cda3dcb635c8114f911ef49c7d494523d45c32527b97ed9a01b9a8ade5976862","observation_id":"0ed2473e-5552-4df2-9cc4-c70fe8f5b0cb","resolution":{"observed_at":"2026-08-11T11:07:46.195820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.198713Z","title":"Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies , pages=","venue":null,"work_id":"3c3d38e3-95f4-4462-b284-598cf3510482","year":2021},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.200053Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:8cce8204f547ba164f4d3dfa4723ad282691de57adcfae1c6c5c2a829f5fbd8b","observation_id":"8ba8bd99-30e2-4642-9009-6d3ea9a47d33","resolution":{"observed_at":"2026-08-11T11:07:47.203530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.185352Z","title":"ArXiv , year=","venue":null,"work_id":"4d5c0e78-e89f-4c57-aae5-ae79a0973066","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.204411Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:a00a415d90816499dae79acadfa9d168608b094e5c8ea2612b07b4eef6c5a439","observation_id":"3dee4481-01d3-41f4-ac44-d9c4bf303668","resolution":{"observed_at":"2026-08-11T11:07:47.190131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.208413Z","title":"arXiv preprint arXiv:2509.22437 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.208413Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:b5ca5d7a29247b3c50da65ef7263f41d236b2c1d798aeca9d7938a4bf5ae881e","observation_id":"5ff0004a-2b56-4974-a628-a3657e261d3c","resolution":{"observed_at":"2026-08-11T11:07:46.208413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.212116Z","title":"Nature Machine Intelligence , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.212116Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:0de9bc73b18b5b2d9b21d50a08da7413fe16bf2ddbb0332a324f45cc0dca6c9b","observation_id":"dd0b6508-f76e-4f69-9b89-af77713476b4","resolution":{"observed_at":"2026-08-11T11:07:46.212116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16228","last_updated":"2024-07-11T23:03:09Z","snapshot_observed_at":"2026-08-13T05:41:07.997609Z","submitted_at":"2023-10-24T22:54:05Z","title":"On the Foundations of Shortcut Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16228","snapshot_observed_at":"2026-08-11T11:07:46.215999Z","title":"arXiv preprint arXiv:2310.16228 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.215999Z"},"links":{"cited_paper":"/paper/2310.16228","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:4be30f71645227cfc9068119f31682cec0df22bc120234135fe5932d129b81da","observation_id":"6c9e0cd2-324a-4add-9964-40f6c5c3826b","resolution":{"observed_at":"2026-08-11T11:07:46.215999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.166487Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":"0d31dbc5-bdca-4e5e-9f0b-744ad5a4c9c1","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.219953Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:e18157107a37520b170e76c20d6ff5c55f48ed7f2c2f7a3fe7b7fb0073717be0","observation_id":"e339540f-9e2b-4ff3-9c9a-27827940c6ee","resolution":{"observed_at":"2026-08-11T11:07:47.170579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15183","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.547544Z","title":"arXiv preprint arXiv:2602.15183 , year=","venue":null,"work_id":"838ca4c7-7b67-4c3e-9f5c-341fa4f03365","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.223824Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:74578bcb6d8ac63a479121133788af6bb88d95c8c3d3b4c9f71526ae806820bb","observation_id":"aca611cd-5c5d-47a5-8207-bc3cf04c036d","resolution":{"observed_at":"2026-08-11T11:07:46.555152Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.155440Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"7e6db259-3ef6-444d-bbbb-9c00e9cb0b41","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.227756Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:b3be42ca0b76f9cfc4a1fe2c5229fb5b3f9248ce863841aff42a2c2a8a8b1cef","observation_id":"82843fa4-7709-4e12-b843-12d78d4074b4","resolution":{"observed_at":"2026-08-11T11:07:47.159336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.144111Z","title":"Proceedings of the 57th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":"46ecb7d7-e3f3-40aa-adef-75e15aeb8070","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.231439Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:fc45e86728dd16efb2859c9554a6d213185e79da768303bf0bf195d3e984af8a","observation_id":"f491c2f4-5610-4a2f-9c9a-001eec3245de","resolution":{"observed_at":"2026-08-11T11:07:47.147982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.133079Z","title":"Proceedings of the 31st International Conference on Computational Linguistics , pages=","venue":null,"work_id":"bd14809b-0158-48a2-835a-b5b683b47905","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.235081Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5a7cbf88d8d34a2a2eae2abae6f0b77208695604bd2459fc2947e5d1fa76e7bb","observation_id":"d8512e61-7e14-4e4d-8293-e92415d9fecc","resolution":{"observed_at":"2026-08-11T11:07:47.136811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.121866Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"ca61b0b6-31b3-47cf-86ae-4f94ed35889e","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.238675Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:fc75873130d4d7d7932b562dbfd352bfb2a8b2cfdb5bfde3869aa29268cca357","observation_id":"fd4881ce-8bc7-4cba-8585-9a0812e373ef","resolution":{"observed_at":"2026-08-11T11:07:47.125911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01790","last_updated":"2025-07-02T15:15:14Z","snapshot_observed_at":"2026-08-12T01:20:55.710113Z","submitted_at":"2025-07-02T15:15:14Z","title":"How Do Vision-Language Models Process Conflicting Information Across Modalities?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01790","snapshot_observed_at":"2026-08-11T11:07:46.242486Z","title":"arXiv preprint arXiv:2507.01790 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.242486Z"},"links":{"cited_paper":"/paper/2507.01790","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:0e5ae4e2ea32d22ef974f619d8f113e8ec015cae2f3c6b3bbd389358010a5714","observation_id":"c362de38-7834-40c6-885b-21f210e261b2","resolution":{"observed_at":"2026-08-11T11:07:46.242486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.110544Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"29ef6577-9e89-47cb-a8ee-e3058b627741","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.246791Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9faad8eee337b6210aeb4f29f7922fdd9ab11deebf12391a5f843dbd34d3e5c9","observation_id":"b9a5bef0-3a0b-44f9-bb69-faba6d5cb39c","resolution":{"observed_at":"2026-08-11T11:07:47.114484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-11T11:07:46.250530Z","title":"arXiv preprint arXiv:2409.12191 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.250530Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:a5e2fb4b8bb3aa161fdece818315be6adef8f397932fba6e07484814ff4ea447","observation_id":"ec82bc81-157e-4792-997d-63170f7a2210","resolution":{"observed_at":"2026-08-11T11:07:46.250530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-11T11:07:46.254577Z","title":"arXiv preprint arXiv:2304.08485 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.254577Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:73528ac1c4974a53b1722fb84ffce4922e564081c3908314c110c11d39806a9b","observation_id":"92a20af4-7e89-4ffd-b179-c1ac632a38ff","resolution":{"observed_at":"2026-08-11T11:07:46.254577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-14T01:46:07.796460Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18043","snapshot_observed_at":"2026-08-11T11:07:46.258643Z","title":"arXiv preprint arXiv:2507.18043 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.258643Z"},"links":{"cited_paper":"/paper/2507.18043","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:ea498ab8ec67007cabfdc41289be09d2aab78077457d84003f89e2c509691470","observation_id":"2f169d23-f4fd-431d-9bcb-1a53b5901c10","resolution":{"observed_at":"2026-08-11T11:07:46.258643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.098456Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2022 , pages=","venue":null,"work_id":"74851127-4daa-4ac8-80ee-83a948a39768","year":2022},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.262574Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:13a04a78ed71b04b0b1606de92a0ec9542837f5dfb7cc4f6d09cdc679d3c9ad6","observation_id":"68cb8b13-b5d7-4781-af36-2f1c6ded3a33","resolution":{"observed_at":"2026-08-11T11:07:47.102587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.085434Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"16a67259-dea9-4609-8604-7b83f9d92018","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.266490Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:82b070760da17e0ecb9d9907dcd4e50e27202700838b0d414bfce430c64131ae","observation_id":"eb126cd7-367d-47b7-94c2-2a9b6911f380","resolution":{"observed_at":"2026-08-11T11:07:47.090527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02486","last_updated":"2026-08-04T17:24:30Z","snapshot_observed_at":"2026-08-11T10:39:22.741285Z","submitted_at":"2026-04-02T19:40:56Z","title":"VLMs Need Words: Vision Language Models Ignore Visual Detail In Favor of Semantic Anchors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.02486","snapshot_observed_at":"2026-08-11T11:07:46.270807Z","title":"arXiv preprint arXiv:2604.02486 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.270807Z"},"links":{"cited_paper":"/paper/2604.02486","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:9d0802a1199c7a875092c73ded233775f26a758ac7c638629896874d8349dc19","observation_id":"0ddb081c-1c30-4fe3-b60e-a1bb023f2054","resolution":{"observed_at":"2026-08-11T11:07:46.270807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02189","last_updated":"2025-04-06T03:12:51Z","snapshot_observed_at":"2026-08-13T18:28:46.913210Z","submitted_at":"2025-01-04T04:59:33Z","title":"A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02189","snapshot_observed_at":"2026-08-11T11:07:46.275285Z","title":"arXiv preprint arXiv:2501.02189 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.275285Z"},"links":{"cited_paper":"/paper/2501.02189","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:fe8d2eda46b2941070afbda6b989d2d5c915a4dfc8d3fea5072116e1945f0294","observation_id":"186c5fe3-d4cb-4934-ac02-2cb3bee9ec17","resolution":{"observed_at":"2026-08-11T11:07:46.275285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.073230Z","title":"IEEE MultiMedia , volume=","venue":null,"work_id":"b5d51418-79f2-4c4b-895b-8668ab4752e5","year":2021},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.279831Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:8db43e2dfb0b00b80b381176851dc89c93058238905120e5370962fe2a7b1930","observation_id":"1f386500-d441-44ed-8bdd-7540dd29f47f","resolution":{"observed_at":"2026-08-11T11:07:47.077373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.059811Z","title":"ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":"327b1824-4f1d-4521-adf4-ff2d9388ae99","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.284563Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:90281a3358de2881406bf303e222dc67006afa05e4160d505a9fc6e21b072def","observation_id":"e951d434-a252-4419-bae2-fdbb55421b25","resolution":{"observed_at":"2026-08-11T11:07:47.064730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.047188Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2025 , pages=","venue":null,"work_id":"ffc260bc-377a-4de1-b395-0e684b046df3","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.288849Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:0364375c94274b26a51993a80e36bc4b2e84015b75cb445421ca2148f347c380","observation_id":"89c5e90c-73d5-4168-a2a4-b9d56919281c","resolution":{"observed_at":"2026-08-11T11:07:47.051511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.035492Z","title":"IEEE Transactions on Affective Computing , year=","venue":null,"work_id":"94006330-c218-4404-9bba-99f4c40c0a76","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.292869Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:fd39c017f442fc00374462292731e20069789957e3265b047a77e828efb0254c","observation_id":"a1748827-9094-415a-96cc-acb85dc28118","resolution":{"observed_at":"2026-08-11T11:07:47.039517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.023162Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"b7fe3eff-810c-4f5a-99c3-f47504e8db97","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.297074Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5549c99eb52066c41df324838ef520a8eb979361d1be2b02123b7ded5ec3ab3f","observation_id":"448a305d-6b19-4e1d-a92f-4591176137ca","resolution":{"observed_at":"2026-08-11T11:07:47.027509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:47.007924Z","title":"Proceedings of the 31st International Conference on Computational Linguistics , pages=","venue":null,"work_id":"457ac7ab-16f4-4ea8-953f-362e9629fb26","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.301035Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:6d70f55ef630784b0f49cc189172738f88584d15ad15cffefeb2ac0234d9955c","observation_id":"845161b3-a69d-49bf-bb58-dbe9e21f48a2","resolution":{"observed_at":"2026-08-11T11:07:47.012185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.994470Z","title":null,"venue":null,"work_id":"4faaa74c-9611-4b37-b969-31654ae4e249","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.304986Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:76fb2e5c2779a840f3bae14956638ee0fb3b5154e6b8959c1b4da1c7e5c34186","observation_id":"80f7945e-6bc9-43cf-8fe3-41ee4cd323a0","resolution":{"observed_at":"2026-08-11T11:07:46.998562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.981475Z","title":"2025 , eprint=","venue":null,"work_id":"3c209d72-1f7c-46d5-897c-20ed2c29332d","year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.308886Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:edd3aa081aceff2908affbafad3b29e0d31e5779d21d5ef6471f0014ee5654af","observation_id":"6c18eca8-10a5-46c2-8702-6ddc573228a7","resolution":{"observed_at":"2026-08-11T11:07:46.985832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.969218Z","title":null,"venue":null,"work_id":"76d80763-424c-4134-aecc-8e5f27bc86ef","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.313350Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:34d8fed41b8474f3f72a0ec1c4b35091ea2e6540aa9092dd5de9bfede47b60ce","observation_id":"7d9a1bac-b8bc-43aa-b105-b8f2bf9502c8","resolution":{"observed_at":"2026-08-11T11:07:46.973397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.957649Z","title":"IEEE Transactions on Affective Computing , year=","venue":null,"work_id":"99b1655e-006e-4736-8ccf-b94730959610","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.317181Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:314f832becb51daccbb6c8256bd0b16900ffa4a5608f95e4929b0aea03d5afef","observation_id":"46244535-da24-48a6-9c4a-bf8b0e7c7aa9","resolution":{"observed_at":"2026-08-11T11:07:46.961522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.945213Z","title":"2023 , eprint=","venue":null,"work_id":"607f5959-570b-46de-a1ce-53956471a2f2","year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.320818Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:6bcdd8586fa14ccb7cd14fbd717f8f57884505a41872c8cd2cae9e9d286b7d9b","observation_id":"f9e07637-caf0-4a18-b9d2-e016904c0f50","resolution":{"observed_at":"2026-08-11T11:07:46.949569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.931665Z","title":"2023 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"0178005c-7ac5-4670-a4e2-f04a78554459","year":2023},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.324900Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:3e782e9fe19007bbd692a3248f43aa5aa4a1b19b91d62a4d818bcfa856588fa4","observation_id":"8bb573e3-397c-4c8c-8eee-343952a5cac4","resolution":{"observed_at":"2026-08-11T11:07:46.936271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.328539Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.328539Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:081f728f32d6a0008639543eaab049b93f872c847d0a3ccc5dda5ffb4a17104e","observation_id":"17e945b9-15dd-490a-af73-ffbdaabcee80","resolution":{"observed_at":"2026-08-11T11:07:46.328539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.911648Z","title":"Teaching Structured Vision & Language Concepts to Vision & Language Models , year=","venue":null,"work_id":"e6f28205-24bf-4205-89fa-3d0dbcbe9977","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.332206Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:7c960d0506bfc83c38673e152815467ba97d5fda7fef5201e0b75d045e22adc6","observation_id":"346c818e-e521-4950-abed-dab5c632ab46","resolution":{"observed_at":"2026-08-11T11:07:46.915767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.896881Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"1fc67a5b-5dec-426c-ae63-ddf882924834","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.336444Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:319d9eb459baa754457c9e10753ba617d9ff1ff76f38aadb508db2e85eed011b","observation_id":"8b6f13b8-503e-4b35-b529-879ac52f8d50","resolution":{"observed_at":"2026-08-11T11:07:46.901676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14669","last_updated":"2025-06-10T09:47:04Z","snapshot_observed_at":"2026-08-13T01:48:38.032809Z","submitted_at":"2024-10-18T17:58:21Z","title":"NaturalBench: Evaluating Vision-Language Models on Natural Adversarial Samples","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14669","snapshot_observed_at":"2026-08-11T11:07:46.340382Z","title":"Advances in Neural Information Processing Systems (NeurIPS) Track on Datasets and Benchmarks , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.340382Z"},"links":{"cited_paper":"/paper/2410.14669","citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:481332f074a036c6d7d23975897770735d604b4660940651ada113bb202fd209","observation_id":"ca7a3ee2-281a-4af5-b88e-b183e411b609","resolution":{"observed_at":"2026-08-11T11:07:46.340382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.880355Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"41f9b5df-ddb0-4cba-9454-d9ddd932e22c","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.345374Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:97bd2ee7f918e0aa521a5d7304f94506644626af1cec9890cf1e7b75cd064d3e","observation_id":"42d9ae63-9a6b-4c05-9c80-f34bf86f4461","resolution":{"observed_at":"2026-08-11T11:07:46.885751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.868041Z","title":"2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages=","venue":null,"work_id":"48e5102e-6f88-445f-954e-a197b3c3e39c","year":2024},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.349264Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d8b8a4c4b6c17a4420ae2570dcd0d315b3e0768a3723b1ea769a522a6fd98058","observation_id":"a6054183-6819-43f2-aea2-2a2219c93ab5","resolution":{"observed_at":"2026-08-11T11:07:46.872066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.352960Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.352960Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:d9348381d8d1b155fef7b1308cc8ca36b7e67fbcc67c28ee8ede319f08cd15df","observation_id":"4c68a8bc-4c6a-4701-86fd-6ac6b6f6bc6c","resolution":{"observed_at":"2026-08-11T11:07:46.352960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.356611Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.356611Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:e01a25487423a7536153085c9989af3bd940ba319391a26b4adaa74137a14d3e","observation_id":"c466550c-41d0-4bf8-8402-6900a82e1624","resolution":{"observed_at":"2026-08-11T11:07:46.356611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.842204Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year=","venue":null,"work_id":"83d13965-1a71-4351-ab07-587ae1a41c3f","year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.360587Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:0a19932fa1158590a4de8b858e75a841d7a37c12dc63beb7de5e29518d7af7d9","observation_id":"cf200170-10cf-46f1-aaad-febbf40a07a7","resolution":{"observed_at":"2026-08-11T11:07:46.846228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.365171Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.365171Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:f87e01f37a35e4836d8fd410a8db547ea642435158172ebc66327c9acc633778","observation_id":"b6779d20-d32a-4d17-a919-654c1c47cb22","resolution":{"observed_at":"2026-08-11T11:07:46.365171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:07:46.368829Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T11:07:46.368829Z"},"links":{"citing_paper":"/paper/2608.09772"},"observation_digest":"sha256:5cb3786710d0bbb067f715ccbd15ab69656a5315a3927227fa17f052c28d3e62","observation_id":"3a9202b9-5bc8-4daa-a619-6c754b2a6ee1","resolution":{"observed_at":"2026-08-11T11:07:46.368829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09772","last_updated":"2026-08-10T16:00:04Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T23:46:39.910012Z","submitted_at":"2026-08-10T16:00:04Z","title":"PragMatch: Separating Pragmatic Incongruity from Cross-Modal Mismatch in Large Vision-Language Models"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2608.09772."}