{"as_of":"2026-08-16T09:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f3731f99aa60da5921a151adbf02698f0f6687377ab55d1e3283b0d9de9450f","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:37:54.946776Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19011/citation-record","integrity":"/paper/2607.19011/integrity","json":"/paper/2607.19011/citation-record.json","paper":"/paper/2607.19011"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.884015Z","title":"Dataset Venue Data Forms Mechanism Size Avail","venue":null,"work_id":"afa419f8-06c2-41fd-9c1d-acd9c72611c7","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.943055Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:0a722aa3418f5a43a7fa1e46ac990280f6e212d5106842e299d245ece00af1ac","observation_id":"5a7ca264-33bb-4193-85d6-7f0b37313266","resolution":{"observed_at":"2026-08-15T15:37:55.887946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18903","last_updated":"2025-05-24T23:31:52Z","snapshot_observed_at":"2026-08-16T03:34:58.802989Z","submitted_at":"2025-05-24T23:31:52Z","title":"StandUp4AI: A New Multilingual Dataset for Humor Detection in Stand-up Comedy Videos","version":1},"cited_work":{"arxiv_id":"2505.18903","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18903","snapshot_observed_at":"2026-08-15T15:37:55.833293Z","title":"StandUp4AI: A New Multilingual Dataset for Humor Detection in Stand-up Comedy Videos","venue":"cs.CL","work_id":"a7d2b4d4-9bfb-4531-a4e5-3d07ed56dbe7","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.708345Z"},"links":{"cited_paper":"/paper/2505.18903","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:bf7737d4d2d46e0e40f88bc065845d35114355c0a126d36eabc5b01cbfbbe968","observation_id":"ce667e96-4a8b-46ab-b7c0-0a9f328639f6","resolution":{"observed_at":"2026-08-15T15:37:55.837705Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01023","last_updated":"2024-10-23T02:55:20Z","snapshot_observed_at":"2026-08-16T07:14:15.567706Z","submitted_at":"2024-10-01T19:32:57Z","title":"Can visual language models resolve textual ambiguity with visual cues? Let visual puns tell you!","version":2},"cited_work":{"arxiv_id":"2410.01023","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.01023","snapshot_observed_at":"2026-08-15T15:37:55.736408Z","title":"Can visual language models resolve textual ambiguity with visual cues? Let visual puns tell you!","venue":"cs.CV","work_id":"f5d615d0-f494-4524-ac53-2d02fe4d7b1a","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.721319Z"},"links":{"cited_paper":"/paper/2410.01023","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:f1d375a60e58b33da5f0f879abc693368c42877bb66ebc8e495467b8d3661cbb","observation_id":"9305302d-c688-48ec-9c6d-1bc8227980ed","resolution":{"observed_at":"2026-08-15T15:37:55.740449Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18882","last_updated":"2024-10-24T16:17:47Z","snapshot_observed_at":"2026-08-16T04:41:21.203501Z","submitted_at":"2024-10-24T16:17:47Z","title":"A Survey of Multimodal Sarcasm Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18882","snapshot_observed_at":"2026-08-15T15:37:54.730435Z","title":"A survey of multimodal sarcasm detection.arXiv preprint arXiv:2410.18882,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.730435Z"},"links":{"cited_paper":"/paper/2410.18882","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:fdcd10e3149ac467c1f5e7c9a2301265babff9b8d2573b53bbe5ea24a7a80cb2","observation_id":"9a85a9f7-a270-4326-9d3b-9bdf6aa76ff7","resolution":{"observed_at":"2026-08-15T15:37:54.730435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-08-12T14:23:22.826603Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-08-15T15:37:54.742624Z","title":"Rubrics as rewards: Reinforcement learning beyond verifiable domains.arXiv preprint arXiv:2507.17746,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.742624Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:4fe930cf67fac487f39b24b7aa2e91d11959a416c591edd6fe902ccc8698edca","observation_id":"f0366a4a-bb40-426b-bbcc-eb726aabae70","resolution":{"observed_at":"2026-08-15T15:37:54.742624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.095504Z","title":"Decoding the underlying meaning of multimodal hateful memes","venue":null,"work_id":"e0fcdb1c-0d9a-4ff2-b170-d6b7c0a1740c","year":2023},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.754591Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:6a04edefd3bdaad37a79dc736d7d937939788fb6f75abc989e65879aa18a0c05","observation_id":"5799deb0-9e9a-4fb7-a4ad-16c6e369ac89","resolution":{"observed_at":"2026-08-15T15:37:56.099290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.758264Z","title":"understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.758264Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:ae92bd3cb9a565823ad027004d2634466d2a8f3156f28ec962ea73e6bf630861","observation_id":"2e9285cc-220b-4e79-8ff4-098fbec98f7c","resolution":{"observed_at":"2026-08-15T15:37:54.758264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05230","last_updated":"2023-12-08T18:25:22Z","snapshot_observed_at":"2026-08-13T05:07:03.264257Z","submitted_at":"2023-12-08T18:25:22Z","title":"Language Models, Agent Models, and World Models: The LAW for Machine Reasoning and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05230","snapshot_observed_at":"2026-08-15T15:37:54.762159Z","title":"Language models, agent models, and world models: The law for machine reasoning and planning.arXiv preprint arXiv:2312.05230,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.762159Z"},"links":{"cited_paper":"/paper/2312.05230","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:73c13843f268ff35b56ca08587a6f31230aae598f374f2ae0080c6484b5e78f4","observation_id":"6cebd073-3be4-493b-93c7-0fea92ea8074","resolution":{"observed_at":"2026-08-15T15:37:54.762159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13703","last_updated":"2023-05-23T05:41:18Z","snapshot_observed_at":"2026-08-13T11:35:57.161250Z","submitted_at":"2023-05-23T05:41:18Z","title":"MemeCap: A Dataset for Captioning and Interpreting Memes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13703","snapshot_observed_at":"2026-08-15T15:37:54.765845Z","title":"Memecap: A dataset for captioning and interpreting memes.arXiv preprint arXiv:2305.13703,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.765845Z"},"links":{"cited_paper":"/paper/2305.13703","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:ec07f629e692a51642028190bade249b9d6386e2555d78585b73297001eb1d23","observation_id":"0d600576-8618-40e0-9c9c-903d4b393815","resolution":{"observed_at":"2026-08-15T15:37:54.765845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.18331","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.568005Z","title":"Bottlehumor: Self-informed humor explanation using the information bottleneck principle.arXiv preprint arXiv:2502.18331,","venue":null,"work_id":"c0da21ca-8764-4c78-b033-6ac6f5d952eb","year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.769720Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:29cacd44a2677e0c80a675edb7741d2e1110612a918b20cc7ab8d1feae560288","observation_id":"ff8b95d5-377f-4fda-adac-483ef7db909a","resolution":{"observed_at":"2026-08-15T15:37:55.574426Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05344","last_updated":"2024-06-08T04:09:20Z","snapshot_observed_at":"2026-08-12T23:47:27.666714Z","submitted_at":"2024-06-08T04:09:20Z","title":"MemeGuard: An LLM and VLM-based Framework for Advancing Content Moderation via Meme Intervention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05344","snapshot_observed_at":"2026-08-15T15:37:54.773203Z","title":"Memeguard: An llm and vlm-based framework for advancing content moderation via meme intervention.arXiv preprint arXiv:2406.05344, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.773203Z"},"links":{"cited_paper":"/paper/2406.05344","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:43d04cb0449eef8791681699c2b761c6f4503ea1af248bb0521b76b8d399e220","observation_id":"e9e0af90-c0e8-459c-90b5-bbacb26e995a","resolution":{"observed_at":"2026-08-15T15:37:54.773203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.776995Z","title":"D-humor: Dark humor understanding via multimodal open-ended reasoning–a benchmark dataset and method.arXiv preprint arXiv:2509.06771,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.776995Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:540606b601440a6a0c3441813724b66dd61672120ff04732d32033ab6872d907","observation_id":"76ea2557-46e7-4d9e-9ded-308bcb254940","resolution":{"observed_at":"2026-08-15T15:37:54.776995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.084912Z","title":"Hope ‘the paragraph guy’explains the rest: Introducing mesum, the meme summarizer","venue":null,"work_id":"0043e5c7-3bc5-4d91-a8b9-a793ce86d1b5","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.780472Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:dbcfb38487a1093e376baf7e2934b4deba4858ed6acd09586c380926b80e1303","observation_id":"9dc9cc02-3763-4fd8-8c9f-bbec4b384e0a","resolution":{"observed_at":"2026-08-15T15:37:56.088382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.063910Z","title":"Looking beyond the pixels: Evaluating visual metaphor understanding in vlms","venue":null,"work_id":"094a4723-e1ce-4376-93a0-4b0734bfed35","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.788200Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:5f80d374c516d69ece49b1e2ad58f094a0690a323a1e9fb4a5f5194a694ab4bc","observation_id":"f037840f-a3a0-4afc-9a93-a8d360e0fb30","resolution":{"observed_at":"2026-08-15T15:37:56.068050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.791795Z","title":"Are vision-language models safe in the wild? a meme-based benchmark study.arXiv preprint arXiv:2505.15389,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.791795Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:ddec60c66d3b719f137e312c07e8a5f87cb5f06633c7e8e0adb8aa31ccf5759d","observation_id":"b2fbfc4a-84c2-49e2-9fa9-a33ecc347486","resolution":{"observed_at":"2026-08-15T15:37:54.791795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05434","last_updated":"2023-12-09T01:59:11Z","snapshot_observed_at":"2026-08-13T05:06:53.053587Z","submitted_at":"2023-12-09T01:59:11Z","title":"Beneath the Surface: Unveiling Harmful Memes with Multimodal Reasoning Distilled from Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05434","snapshot_observed_at":"2026-08-15T15:37:54.799232Z","title":"Beneath the surface: Unveiling harmful memes with multimodal reasoning distilled from large language models.arXiv preprint arXiv:2312.05434,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.799232Z"},"links":{"cited_paper":"/paper/2312.05434","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:d3569d910a593aba5053597e5bbe5d657e8a4df9afb23713cd93691885f53220","observation_id":"09f79d5a-abcd-4ac5-aa13-170674144430","resolution":{"observed_at":"2026-08-15T15:37:54.799232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03501","last_updated":"2022-10-17T12:01:35Z","snapshot_observed_at":"2026-08-13T14:10:35.956701Z","submitted_at":"2022-10-07T12:44:33Z","title":"Towards Multi-Modal Sarcasm Detection via Hierarchical Congruity Modeling with Knowledge Enhancement","version":2},"cited_work":{"arxiv_id":"2210.03501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.03501","snapshot_observed_at":"2026-08-15T15:37:55.366050Z","title":"Towards Multi-Modal Sarcasm Detection via Hierarchical Congruity Modeling with Knowledge Enhancement","venue":"cs.CL","work_id":"0a64d5ab-883f-40e0-9999-17ffc8b85db2","year":2022},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.803398Z"},"links":{"cited_paper":"/paper/2210.03501","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:79bb10c18e90cdc03bcc69f21ede1b33334c116417cd2528275547078835f9c6","observation_id":"8bd2702c-1527-4593-b54d-887b06ed3da6","resolution":{"observed_at":"2026-08-15T15:37:55.371632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-15T15:37:54.807289Z","title":"G-eval: Nlg evaluation using gpt-4 with better human alignment.arXiv preprint arXiv:2303.16634,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.807289Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:005fab630b08806a71ed94e9ed1583fbd6c6d48c9dfee1387efa76c568f68fe2","observation_id":"8164d6d8-2282-401e-a94c-9d019b630a93","resolution":{"observed_at":"2026-08-15T15:37:54.807289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.811442Z","title":"Inference-time scaling for generalist reward modeling.arXiv preprint arXiv:2504.02495,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.811442Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:4771833105c05e1af60217e1df4970de326027edf14e0691827b22e42cbf26c5","observation_id":"6455cf32-b6f7-4270-a15c-1bc7e6ea22c0","resolution":{"observed_at":"2026-08-15T15:37:54.811442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.053563Z","title":"Comicorda: Dialogue act recognition in comic books","venue":null,"work_id":"233764b5-cd7a-4b86-9ef2-727b814478ed","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.816019Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:56268444b936f8d8c5e135239d4c459dd182ca4087ddd190ddf927003d71b6ad","observation_id":"dbdae401-31eb-4ac4-b830-0a3e726c7238","resolution":{"observed_at":"2026-08-15T15:37:56.057228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13592","last_updated":"2024-09-20T15:45:29Z","snapshot_observed_at":"2026-08-14T16:18:42.523180Z","submitted_at":"2024-09-20T15:45:29Z","title":"YesBut: A High-Quality Annotated Multimodal Dataset for evaluating Satire Comprehension capability of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13592","snapshot_observed_at":"2026-08-15T15:37:54.820038Z","title":"Yesbut: A high-quality annotated multimodal dataset for evaluating satire comprehension capability of vision-language models.arXiv preprint arXiv:2409.13592,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.820038Z"},"links":{"cited_paper":"/paper/2409.13592","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:99be34d068dd7ea199c0a34ee44d41ce67511c8aaf168f38c85b1f63073094a2","observation_id":"77107616-dd70-4a5b-bf70-44dc5e811593","resolution":{"observed_at":"2026-08-15T15:37:54.820038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21476","last_updated":"2025-07-29T03:44:43Z","snapshot_observed_at":"2026-08-14T21:39:11.715358Z","submitted_at":"2025-07-29T03:44:43Z","title":"Which LLMs Get the Joke? Probing Non-STEM Reasoning Abilities with HumorBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21476","snapshot_observed_at":"2026-08-15T15:37:54.823963Z","title":"Which llms get the joke? probing non-stem reasoning abilities with humorbench.arXiv preprint arXiv:2507.21476,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.823963Z"},"links":{"cited_paper":"/paper/2507.21476","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:fcb17b478a141ada7ea894f5c712076ddef8b2a0cd20c407744661a45af47e79","observation_id":"3d3eebc3-281f-4c1e-9d41-a48f9b77f061","resolution":{"observed_at":"2026-08-15T15:37:54.823963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.042951Z","title":"Benchmarking vision language models for cultural understanding","venue":null,"work_id":"1474b761-dc3e-486b-8483-39d19dc2469d","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.827875Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:6d0b86416974f71203a2bd9116f14209947ea184dd7eb8be464480a1ebe7ff11","observation_id":"baff2657-b0d6-4d55-a9b4-fa74f8d763fc","resolution":{"observed_at":"2026-08-15T15:37:56.046639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03757","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.256578Z","title":"Laugh, relate, engage: Stylized comment generation for short videos.arXiv preprint arXiv:2511.03757,","venue":null,"work_id":"2b285620-d985-4b95-b0f4-2d176b095ec1","year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.831428Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:a8bbcd96544848eac274af42f770cf435278d030d15e39f5f8c39898d0b172c7","observation_id":"36fcb0df-0172-4110-9959-6392ed7f9120","resolution":{"observed_at":"2026-08-15T15:37:55.263190Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.031343Z","title":"Yamshchikov","venue":null,"work_id":"94e990f1-af02-4f57-92d5-8ae851e4d9d1","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.835554Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:d7c7b3a6c1634b97926d0f4e3172e81c6b77c52bd70418f4b3b0c3cc82f16af3","observation_id":"d4f5240d-d1e1-4f88-9d9f-d49133c50719","resolution":{"observed_at":"2026-08-15T15:37:56.035374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1608","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.011839Z","title":"ISBN 979-8-89176-332-6","venue":null,"work_id":"6f513f58-f3fd-4e61-9ff8-1f4567813639","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.839208Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:bfcb818f8e95ba268f1bbc6c816841e43772c48d60f736832508aefd5b422a89","observation_id":"e01a92f4-97ba-40ef-beb9-16bdb2e2bcb8","resolution":{"observed_at":"2026-08-15T15:37:55.015753Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08313","last_updated":"2025-05-27T16:54:13Z","snapshot_observed_at":"2026-08-12T23:03:00.623997Z","submitted_at":"2024-08-15T17:59:57Z","title":"Can Large Language Models Understand Symbolic Graphics Programs?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08313","snapshot_observed_at":"2026-08-15T15:37:54.843886Z","title":"Can large language models understand symbolic graphics programs? arXiv preprint arXiv:2408.08313,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.843886Z"},"links":{"cited_paper":"/paper/2408.08313","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:0a88dfbdfd6c824d594830662e3b9bef270087b5b79de2d20b7657f6d1ccc749","observation_id":"7a6d68b7-8fcd-4d4c-8e81-ccb027d6ac09","resolution":{"observed_at":"2026-08-15T15:37:54.843886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.010755Z","title":"Understanding figurative meaning through explainable visual entailment","venue":null,"work_id":"bf75482a-f308-43ed-ba73-1d92ba541704","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.851396Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:258d42d9425c0db1d83a0e922b7667b02ed90228346dbe851c4a369763a7442b","observation_id":"5f27c790-cbcd-4b2d-8746-ae53afd53fce","resolution":{"observed_at":"2026-08-15T15:37:56.014548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14703","last_updated":"2024-10-28T03:32:28Z","snapshot_observed_at":"2026-08-15T11:00:59.713142Z","submitted_at":"2024-09-23T04:49:08Z","title":"MemeCLIP: Leveraging CLIP Representations for Multimodal Meme Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14703","snapshot_observed_at":"2026-08-15T15:37:54.855100Z","title":"Memeclip: Leveraging clip representations for multimodal meme classification.arXiv preprint arXiv:2409.14703,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.855100Z"},"links":{"cited_paper":"/paper/2409.14703","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:bf357387684e80df31489ccd78d2901f5a9abd8b31b42748339fbde08144a868","observation_id":"1dd2b970-a63d-4537-a686-6de010c28d04","resolution":{"observed_at":"2026-08-15T15:37:54.855100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.03781","last_updated":"2020-08-09T18:17:33Z","snapshot_observed_at":"2026-08-16T00:59:28.024478Z","submitted_at":"2020-08-09T18:17:33Z","title":"SemEval-2020 Task 8: Memotion Analysis -- The Visuo-Lingual Metaphor!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.03781","snapshot_observed_at":"2026-08-15T15:37:54.863025Z","title":"Semeval-2020 task 8: Memotion analysis–the visuo-lingual metaphor!arXiv preprint arXiv:2008.03781,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.863025Z"},"links":{"cited_paper":"/paper/2008.03781","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:9fe3613859c5a6af3aede55e10197b9fd600c565b83ff23de8d156dad74103c8","observation_id":"d4ce5a6b-a3a0-4e05-9631-dae33e44f472","resolution":{"observed_at":"2026-08-15T15:37:54.863025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05738","last_updated":"2022-05-11T19:14:26Z","snapshot_observed_at":"2026-08-14T18:46:48.667010Z","submitted_at":"2022-05-11T19:14:26Z","title":"DISARM: Detecting the Victims Targeted by Harmful Memes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05738","snapshot_observed_at":"2026-08-15T15:37:54.866988Z","title":"Disarm: Detecting the victims targeted by harmful memes.arXiv preprint arXiv:2205.05738, 2022a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.866988Z"},"links":{"cited_paper":"/paper/2205.05738","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:7a59481574225459cd4411d90a6732b868289a7c589722c17c247ac69bcd73b1","observation_id":"7f541c88-e444-49fa-80d5-8a37ecc53d64","resolution":{"observed_at":"2026-08-15T15:37:54.866988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-naacl.152","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.999606Z","title":"doi: 10.18653/v1/2024.findings-naacl.152","venue":null,"work_id":"35acea88-af4d-42b0-9719-77a60ca8da10","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.875671Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:b93988b794667a472a5c5c8d5edf294d15f7318b4fdb058209855c68ce61f139","observation_id":"2cd11f27-bed5-4a98-94c8-e85c0ab99dbb","resolution":{"observed_at":"2026-08-15T15:37:55.004077Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07280","last_updated":"2024-05-12T13:00:14Z","snapshot_observed_at":"2026-08-14T12:29:35.758904Z","submitted_at":"2024-05-12T13:00:14Z","title":"Humor Mechanics: Advancing Humor Generation with Multistep Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07280","snapshot_observed_at":"2026-08-15T15:37:54.879354Z","title":"Humor mechanics: Advancing humor generation with multistep reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.879354Z"},"links":{"cited_paper":"/paper/2405.07280","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:6f40334f6985804440922b11c153b68327133ba13a1ab857da5626a1eb55126a","observation_id":"0e04ed06-7716-4fe0-a4a7-7cfe4788b48f","resolution":{"observed_at":"2026-08-15T15:37:54.879354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.987959Z","title":"Memecraft: Contextual and stance-driven multimodal meme generation","venue":null,"work_id":"8bf8fd3b-37cb-446f-a7c2-d1b23fa90845","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.883073Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:ce42a496388160b33e87f270e2684259d114a7794c48e384c11a14d9156b18ef","observation_id":"a27fcbbe-a56b-4b19-a426-3dc6e3c356fe","resolution":{"observed_at":"2026-08-15T15:37:55.993042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10370","last_updated":"2025-04-11T01:52:15Z","snapshot_observed_at":"2026-08-12T22:23:54.829378Z","submitted_at":"2024-10-14T10:50:16Z","title":"Innovative Thinking, Infinite Humor: Humor Research of Large Language Models through Structured Thought Leaps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10370","snapshot_observed_at":"2026-08-15T15:37:54.886616Z","title":"Innovative thinking, infinite humor: Humor research of large language models through structured thought leaps.arXiv preprint arXiv:2410.10370, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.886616Z"},"links":{"cited_paper":"/paper/2410.10370","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:081039d7f135c0707600432ece58b8e2bbc668e715d486b1569361a434de5c69","observation_id":"4d7b9089-1cee-424c-a65b-f1fd644b1d11","resolution":{"observed_at":"2026-08-15T15:37:54.886616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.976067Z","title":null,"venue":null,"work_id":"f07fd912-4eba-404b-9490-9bb3875fdf4f","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.890914Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:b5af23723dfa966c2da472ff387dd30918f08953eb03a55333b3faf5a270ef57","observation_id":"36f811d6-8500-4dad-bb74-df8e5607c4d1","resolution":{"observed_at":"2026-08-15T15:37:55.980917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.342","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.986791Z","title":"ISBN 979-8-89176-335-7","venue":null,"work_id":"4cc4f952-87f3-4f00-ac32-6baf1620d742","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.894303Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:f45083436b3bf3f4d239dbb1e98f2a5dde1760f6c3525a8a4e5692a9cee0709b","observation_id":"30ae59e4-0394-4a96-8f9b-de53084884b3","resolution":{"observed_at":"2026-08-15T15:37:54.991313Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.965237Z","title":"Taxonomy of risks posed by language models","venue":null,"work_id":"7fcc1898-986e-44e4-9a49-8603e233d072","year":2022},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.898012Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:472828ce568e8425bb1e2f5ce89468da90c9a8e068a187050b125c2354fd0054","observation_id":"6abb19dc-67c1-4d28-bbd5-d7a7fe1ab650","resolution":{"observed_at":"2026-08-15T15:37:55.969066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15279","last_updated":"2025-04-21T17:59:53Z","snapshot_observed_at":"2026-08-07T16:00:29.784743Z","submitted_at":"2025-04-21T17:59:53Z","title":"VisuLogic: A Benchmark for Evaluating Visual Reasoning in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15279","snapshot_observed_at":"2026-08-15T15:37:54.901478Z","title":"Visulogic: A benchmark for evaluating visual reasoning in multi-modal large language models.arXiv preprint arXiv:2504.15279,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.901478Z"},"links":{"cited_paper":"/paper/2504.15279","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:e13e0a5ddba71994438480cbba7ed2e28e4b0c4c94e5c31a361edee3870cb77d","observation_id":"1ccd4db3-e620-4d4f-a8f8-ad98616a713a","resolution":{"observed_at":"2026-08-15T15:37:54.901478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.954209Z","title":null,"venue":null,"work_id":"b97838fb-d967-47e4-b2ec-2e1c698b14fb","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.905309Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:431ec3e3510918f1e2d007a61993c8a15e531aaa2a8be06f6b90eb43e3371b0a","observation_id":"5db5aa17-39c1-44b1-b14f-595ccf37e9e2","resolution":{"observed_at":"2026-08-15T15:37:55.957927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.113","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.974400Z","title":"doi: 10.18653/v1/2024.findings-acl.113","venue":null,"work_id":"a27a03a0-0c80-467b-b776-7252ca0691ca","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.908782Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:8ce54bf01be32dddce1a8c0792c5277a9e817a79498aa37272edb626e63dcd8a","observation_id":"bdb394f1-c56e-4d54-9141-81eedb0aafa7","resolution":{"observed_at":"2026-08-15T15:37:54.979323Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.942839Z","title":"Mmoe: Enhancing multimodal models with mixtures of multimodal interaction experts","venue":null,"work_id":"111a378e-0fcc-4027-b8ff-15d401dab5b5","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.912267Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:f99b90fcfc06a22d922116b135edefa8ce3cf793fbf81a771c7a2fe237636c28","observation_id":"4fff20a7-a3ce-4494-98e7-bf3c8bd61ffe","resolution":{"observed_at":"2026-08-15T15:37:55.946816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.931528Z","title":"Image matters: A new dataset and empirical study for multimodal hyperbole detection","venue":null,"work_id":"1acd5a53-bea4-4a1f-8d2d-7537341a43d6","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.915858Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:e626e8e5371c7b603a5d790fa3b79ffb73cab87e991f543b485f1a89379a1f9e","observation_id":"f71c3679-0e50-4362-b547-797fbae8565e","resolution":{"observed_at":"2026-08-15T15:37:55.935474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.919406Z","title":"Humorchain: Theory-guided multi-stage reasoning for interpretable multimodal humor generation.arXiv preprint arXiv:2511.21732,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.919406Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:2f53c3dfad1b86d4d74727472f395cecb706c0d6fa3d7c81b3ad192387d4541f","observation_id":"3c695397-1a67-4e02-bf17-65d96c488fe7","resolution":{"observed_at":"2026-08-15T15:37:54.919406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-15T15:37:54.923016Z","title":"Humor in ai: Massive scale crowd-sourced preferences and benchmarks for cartoon captioning.Advances in Neural Information Processing Systems, 37:125264–125286, 2024a","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.923016Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:a8197f961c54e553d88aae711c2b1ee7667d1fa0c49f30a82161dfc5e7362189","observation_id":"7a038250-a7cc-41aa-98cd-b9ae50f9b3fa","resolution":{"observed_at":"2026-08-15T15:37:54.923016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17433","last_updated":"2025-06-04T08:55:43Z","snapshot_observed_at":"2026-08-12T22:17:58.025769Z","submitted_at":"2025-05-23T03:27:23Z","title":"MemeReaCon: Probing Contextual Meme Understanding in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17433","snapshot_observed_at":"2026-08-15T15:37:54.927202Z","title":"Somelvlm: A large vision language model for social media processing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.927202Z"},"links":{"cited_paper":"/paper/2505.17433","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:a4a0efecb62fa911c8bd1c4a6626cf10a8296a06df94429f501e670f5e0ea280","observation_id":"406b73d3-bc36-409a-8c86-2bfb139ffb34","resolution":{"observed_at":"2026-08-15T15:37:54.927202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.918647Z","title":"Social meme-ing: Measuring linguistic variation in memes","venue":null,"work_id":"61005581-8eff-479a-a768-ca09320d5a42","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.931119Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:92610af017e591649d8f5916377c019d3de2d7b3399154e1a7806e82c6d13a44","observation_id":"817a64e1-4b4c-45c0-92d1-055c68298caf","resolution":{"observed_at":"2026-08-15T15:37:55.923469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.905864Z","title":"For each benchmark, we retain the task definition, prompt format, answer format, evaluation split, and scoring procedure reported in the corresponding original paper","venue":null,"work_id":"62eca55c-c1e2-49b5-9818-a135ffaa5648","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.935467Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:99facf9ed5f5f8b168ae1a13b307cde4932886cd86fdb8deb10221f5ef87e245","observation_id":"c7c03f8a-7dee-4e75-8886-38ea8f157a11","resolution":{"observed_at":"2026-08-15T15:37:55.910105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.895158Z","title":"For open-source models, decoding is performed withdo_sam- ple=true; all remaining benchmark-specific generation and evaluation settings follow the corresponding original papers","venue":null,"work_id":"1ebff3c1-8856-48e1-97b8-158d7cb5d7c9","year":2016},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.939168Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:e2dd83a3dc5d6b61ddc1724e610bb5d648f5603a6e4ba2822589d872baf03584","observation_id":"6584ebf8-d2aa-4c28-b0bc-d4db8bbdaa93","resolution":{"observed_at":"2026-08-15T15:37:55.899085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.873162Z","title":"Dataset Venue Mechanism Size Avail","venue":null,"work_id":"c46d17b0-2fc6-4f95-ae1c-869aa7cf36ee","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.946776Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:fa43f72e3dd9fc72ede50f4cd741034e79076cf91d0eff1100e6a44e7e04ad74","observation_id":"28833bbf-2686-4f3b-8416-e918fc109f41","resolution":{"observed_at":"2026-08-15T15:37:55.876660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:54.738552Z","title":"Mememind: A large-scale multimodal dataset with chain-of-thought reasoning for harmful meme detection.arXiv preprint arXiv:2506.18919,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":1980,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.738552Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:f7cdfc378f8bf2902ca3e98b19dc799df0694590a355f9eb6cfa7352ae28e5d3","observation_id":"a9a79e38-a163-4ac9-95e0-f72c01ae8cee","resolution":{"observed_at":"2026-08-15T15:37:54.738552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.074693Z","title":"Memedetoxnet: Balancing toxicity reduction and context preservation","venue":null,"work_id":"a78f7fc1-03d2-4b1a-9f2a-79ca3a5ddf61","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.784114Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:aba48e2c1ef0b270d92e8c9c6f3901362fbc03aa1566752de88428387362fcbb","observation_id":"aaea0a97-e0fa-43a2-be9c-2e76bfb16366","resolution":{"observed_at":"2026-08-15T15:37:56.078393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.106135Z","title":"Spoken in jest, detected in earnest: A systematic review of sarcasm recognition-multimodal fusion, challenges, and future prospects.IEEE Transactions on Affective Computing, 2025a","venue":null,"work_id":"2e9ea059-93a8-4e69-9a76-43a37e45d8c4","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.734683Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:fdf7ccf1aaca6c7eb813427e53ef64990230e0f876af09529ea7a69aee900772","observation_id":"dc61cc92-c700-4f1b-8a27-a7deeed866cd","resolution":{"observed_at":"2026-08-15T15:37:56.109645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.000087Z","title":"Content-specific humorous image captioning using incongruity resolution chain-of-thought","venue":null,"work_id":"2b65cdfb-52e0-45fb-a909-c2f3378462e4","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.871542Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:e373c3f448080130bbeebc97905e1b022ece4bdfc012b736d4db1d972bc67cdc","observation_id":"6c068e94-25e3-4955-830d-ecc2a85a9522","resolution":{"observed_at":"2026-08-15T15:37:56.003868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10543","last_updated":"2023-10-16T16:14:20Z","snapshot_observed_at":"2026-08-15T13:49:24.361184Z","submitted_at":"2023-10-16T16:14:20Z","title":"ViPE: Visualise Pretty-much Everything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10543","snapshot_observed_at":"2026-08-15T15:37:54.858970Z","title":"Vipe: Visualise pretty-much everything.arXiv preprint arXiv:2310.10543,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.858970Z"},"links":{"cited_paper":"/paper/2310.10543","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:47d7ff9f73426df54e9238b37089dcb99515a301e511cfa8873100be890ef68d","observation_id":"5dd47e9d-764c-4cf3-8b52-4873c728473d","resolution":{"observed_at":"2026-08-15T15:37:54.858970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.06490","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:55.803159Z","title":"Are we on the right way for evaluating large vision-language models?Advances in Neural Information Processing Systems, 37:27056–27087, 2024a","venue":null,"work_id":"6915223f-3572-407f-a135-d295ce9093a1","year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.717136Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:40d0250b3291b837658831a88f16649b93d8afb34ffc30b697bee586fb85dabc","observation_id":"2a8929c3-7cd6-4d31-8aaa-9bb3962cda7d","resolution":{"observed_at":"2026-08-15T15:37:55.809005Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14724","last_updated":"2023-07-14T16:09:46Z","snapshot_observed_at":"2026-08-16T04:40:50.182263Z","submitted_at":"2023-05-24T05:01:10Z","title":"I Spy a Metaphor: Large Language Models and Diffusion Models Co-Create Visual Metaphors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14724","snapshot_observed_at":"2026-08-15T15:37:54.712678Z","title":"I spy a metaphor: Large language models and diffusion models co-create visual metaphors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.712678Z"},"links":{"cited_paper":"/paper/2305.14724","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:b908361a0a22a93c9308d1c4b906eec5b5ca90011cbd42204015bac1efaf65bb","observation_id":"1b83ecbf-e857-4273-9f6c-694124d0eac0","resolution":{"observed_at":"2026-08-15T15:37:54.712678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11215","last_updated":"2024-05-18T07:44:41Z","snapshot_observed_at":"2026-08-13T00:04:42.072559Z","submitted_at":"2024-05-18T07:44:41Z","title":"MemeMQA: Multimodal Question Answering for Memes via Rationale-Based Inferencing","version":1},"cited_work":{"arxiv_id":"2405.11215","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.11215","snapshot_observed_at":"2026-08-15T15:37:55.861106Z","title":"MemeMQA: Multimodal Question Answering for Memes via Rationale-Based Inferencing","venue":"cs.CL","work_id":"b579fe70-e637-404e-bedb-407b94d83910","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.698343Z"},"links":{"cited_paper":"/paper/2405.11215","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:f1ff27444173e16a1db1bf20e298ea8dd4fa622e6e0a25c59c7074a434e6cddc","observation_id":"f9a39e3f-da65-4e95-b6ec-0870bd17495d","resolution":{"observed_at":"2026-08-15T15:37:55.865316Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15430","last_updated":"2023-03-29T04:49:46Z","snapshot_observed_at":"2026-08-13T12:15:26.478470Z","submitted_at":"2023-03-27T17:54:32Z","title":"TextMI: Textualize Multimodal Information for Integrating Non-verbal Cues in Pre-trained Language Models","version":2},"cited_work":{"arxiv_id":"2303.15430","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.15430","snapshot_observed_at":"2026-08-15T15:37:55.627470Z","title":"TextMI: Textualize Multimodal Information for Integrating Non-verbal Cues in Pre-trained Language Models","venue":"cs.CL","work_id":"104c8a9e-3265-48fe-8025-f59a3a6ae432","year":2023},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.746688Z"},"links":{"cited_paper":"/paper/2303.15430","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:de9d1bafa2e32a37b2d15bc4d7f981d2f348feeec2be84982b408ec22f81afd9","observation_id":"4823a639-7400-46b0-9bbc-5543cc892cb5","resolution":{"observed_at":"2026-08-15T15:37:55.631750Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23137","last_updated":"2026-04-15T02:38:45Z","snapshot_observed_at":"2026-08-12T16:01:25.076287Z","submitted_at":"2025-03-29T16:08:51Z","title":"When 'YES' Meets 'BUT': Can Large Models Comprehend Contradictory Humor Through Comparative Reasoning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23137","snapshot_observed_at":"2026-08-15T15:37:54.795252Z","title":"When’yes’meets’ but’: Can large models comprehend contradictory humor through comparative reasoning?arXiv preprint arXiv:2503.23137,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.795252Z"},"links":{"cited_paper":"/paper/2503.23137","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:77163639f0a25efddd0114afd8a25b810a9f9344f9245fa33eb53023d8f147ca","observation_id":"b6c4a030-f7f2-4af0-ad0c-7875208979f8","resolution":{"observed_at":"2026-08-15T15:37:54.795252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12754","last_updated":"2024-06-18T16:22:05Z","snapshot_observed_at":"2026-08-12T23:39:55.795821Z","submitted_at":"2024-06-18T16:22:05Z","title":"Chumor 1.0: A Truly Funny and Challenging Chinese Humor Understanding Dataset from Ruo Zhi Ba","version":1},"cited_work":{"arxiv_id":"2406.12754","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.12754","snapshot_observed_at":"2026-08-15T15:37:55.610070Z","title":"Chumor 1.0: A Truly Funny and Challenging Chinese Humor Understanding Dataset from Ruo Zhi Ba","venue":"cs.CL","work_id":"dcbbd013-6def-4736-a1b5-bf5a467908c4","year":2024},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.750495Z"},"links":{"cited_paper":"/paper/2406.12754","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:2b707e7cea513b78e36fac2c5857df0dcff9916be89b0e8086d3f815b87aed68","observation_id":"6da4756f-d207-4f5c-bda4-6ae6ad2820c9","resolution":{"observed_at":"2026-08-15T15:37:55.614956Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-15T15:37:54.726135Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities.arXiv preprint arXiv:2507.06261,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.726135Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:3b5b7df2171fc79bb27123ce5b73154bd7969931647ca2a7c9a946ce5a5cd1fb","observation_id":"cefcce8f-bc2d-4b9a-8e28-49a7ddbdd6b4","resolution":{"observed_at":"2026-08-15T15:37:54.726135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-15T15:37:54.703587Z","title":"Ashwin Baluja","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.703587Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:563f6a88bfd987bb4a1fe7c9766f63b1ddceee969be48366d21641a2867c1075","observation_id":"206695ef-28b5-485b-a2e3-249cdf68cf34","resolution":{"observed_at":"2026-08-15T15:37:54.703587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:37:56.021111Z","title":"Humor in pixels: Benchmarking large multimodal models understanding of online comics","venue":null,"work_id":"5a7b7324-95da-414a-ae3f-17a92091954f","year":2025},"citing_paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-15T15:37:54.847781Z"},"links":{"citing_paper":"/paper/2607.19011"},"observation_digest":"sha256:e8c16c77d5fd390c7f9baa52ee224dd222eb5243ca34209e62ce3f19e8259b87","observation_id":"8765c1e6-1bb2-44ee-8e84-5b046f87cc9d","resolution":{"observed_at":"2026-08-15T15:37:56.024748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.19011","last_updated":"2026-07-21T11:53:46Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T04:40:55.934836Z","submitted_at":"2026-07-21T11:53:46Z","title":"Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":31,"verified_exact":12,"verified_fuzzy":20},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2607.19011."}