{"as_of":"2026-08-10T07:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37f726fde3091b9a8a27797ccb59b33c287c33db09d3a6629fa76b4c91008686","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:53:24.711197Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T23:42:53.179881Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:29:59.932570Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"cited_work":{"arxiv_id":"2502.00752","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00752","snapshot_observed_at":"2026-07-04T17:29:59.932570Z","title":"arXiv preprint arXiv:2502.00752 , year=","venue":null,"work_id":"ca267766-9308-4879-b6c2-cc86b2fe9ee9","year":null},"citing_paper":{"arxiv_id":"2606.24627","last_updated":"2026-06-23T14:23:56Z","snapshot_observed_at":"2026-08-02T19:23:15.341233Z","submitted_at":"2026-06-23T14:23:56Z","title":"The Warrant Gap: Claim-Conditioned Re-scoring for Fact-Checking","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-25T23:42:53.179881Z"},"links":{"cited_paper":"/paper/2502.00752","citing_paper":"/paper/2606.24627"},"observation_digest":"sha256:09f95bbff9c1414106753e4cc003b82e1ac2781d7d5e70c68744a037852c1c2e","observation_id":"96ea7371-d488-45ea-81a1-8df20816573e","resolution":{"observed_at":"2026-07-04T17:29:59.934021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00752/citation-record","integrity":"/paper/2502.00752/integrity","json":"/paper/2502.00752/citation-record.json","paper":"/paper/2502.00752"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.929841Z","title":"Open- domain, content-based, multi-modal fact-checking of out-of- context images via online resources","venue":null,"work_id":"5a9fc177-1cc4-4a35-8941-27f8ba8fbd07","year":2022},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:23.942690Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:bf6f3223a47370f2b47c43bab8134958c6704f2304ba4154dd9cb0f463be82b5","observation_id":"221a8d26-66c2-48eb-b8fc-872f5d04ca53","resolution":{"observed_at":"2026-08-09T17:53:25.933786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T17:53:23.958862Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:23.958862Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:2ed0116b9281bd8928d44acc600064b41b52690e1dba4c34748d335ffb625577","observation_id":"5f399207-0844-4358-9471-583e19ed9d40","resolution":{"observed_at":"2026-08-09T17:53:23.958862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.917174Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"b93103ee-bb88-4b07-9d6f-fc7f1a2ad4ee","year":2022},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:23.965848Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:edf0cbd333054d1f355e5df488358e5c9683924dc38dcbfc1516c66e6f1bb368","observation_id":"e80e0dcd-af1b-4df4-923e-1158849b8452","resolution":{"observed_at":"2026-08-09T17:53:25.921376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.906060Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"f76f87bd-b5b0-4ed5-bdde-999abfcb6be2","year":2009},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:23.976338Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:7bace8d5aa278e2ab100b675b7e13d87a8491125f14b172ea53a3b0166c89970","observation_id":"a799f0af-d682-42ce-b64c-c19fde3623c9","resolution":{"observed_at":"2026-08-09T17:53:25.909593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.894172Z","title":"Early vs late fusion in multimodal convolutional neural networks","venue":null,"work_id":"ac70870c-4e04-4ed8-8717-962b2c29ae44","year":2020},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:23.984644Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:9c5227946f581a72944793637203b04439fb5d9a8652f2fd1ecaf07a5fc79091","observation_id":"bed13e40-6d3e-4901-be4d-0cd522f5f35e","resolution":{"observed_at":"2026-08-09T17:53:25.898601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.864817Z","title":"From im- ages to textual prompts: Zero-shot visual question answering with frozen large language models","venue":null,"work_id":"07431fbd-7621-4834-8fcf-0f0631d0475d","year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:23.989464Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:bd8ad6822e2bbc3bcf2e6d2c586fc7a63a6ee4e5c3819f4c476092a9b4af273b","observation_id":"02e270cf-fbed-4d97-bb2b-d882ac0768d7","resolution":{"observed_at":"2026-08-09T17:53:25.886607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.796145Z","title":"A picture paints a thousand lies? the effects and mechanisms of multimodal disinformation and rebuttals disseminated via social media","venue":null,"work_id":"25c14e54-4a91-4213-858c-c7a4595e4ffe","year":2020},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.001392Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:aa8f42b4e25ddf20762f6181f5b68da1a7cb15e32d355bc6eca3d97d7cbdca0f","observation_id":"070cd12c-84bd-4503-a675-63b5eddb9a86","resolution":{"observed_at":"2026-08-09T17:53:25.826815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:24.009870Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.009870Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:f80437b36ba2b0ff1392a02d1374b96be759bce7d584a8d7f452f62028f339cb","observation_id":"31c731bd-6ed7-408a-b057-b8e18adf4b83","resolution":{"observed_at":"2026-08-09T17:53:24.009870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.735328Z","title":"Batch normalization: Accelerating deep network training by reducing internal co- variate shift","venue":null,"work_id":"a233cf79-18a5-4471-a09c-8cc2064e5139","year":2015},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.016426Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:26ba41cb4d6d5f4d6a8a6e2784d93ee162678e8580d87738be1bd332ef18b460","observation_id":"14cb0634-efa7-4bfc-97c1-974b27081f61","resolution":{"observed_at":"2026-08-09T17:53:25.758983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00267","last_updated":"2024-09-03T14:01:54Z","snapshot_observed_at":"2026-07-06T16:13:07.384791Z","submitted_at":"2023-09-01T05:53:33Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00267","snapshot_observed_at":"2026-08-09T17:53:24.019667Z","title":"Rlaif: Scaling reinforcement learning from human feedback with ai feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.019667Z"},"links":{"cited_paper":"/paper/2309.00267","citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:41b0df6c5f415cd426c56e110545fde3e0a063ccb8903eaab49075d22a3dd95b","observation_id":"8329b9f6-230b-4717-936c-a4d72d5b8213","resolution":{"observed_at":"2026-08-09T17:53:24.019667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.692508Z","title":"Visual news: Benchmark and challenges in news im- age captioning","venue":null,"work_id":"c4f4c0f2-d749-42fc-9f49-81304e3f8471","year":2021},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.023258Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:f7cc119de08ea97741824100fe3633bb38a4a0a5987d8e39fac728c355d6392c","observation_id":"7eebb274-eb38-4fe4-9802-12d5618ec73d","resolution":{"observed_at":"2026-08-09T17:53:25.718995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.636646Z","title":"Robust domain misinformation detection via multi- modal feature alignment","venue":null,"work_id":"80212ec5-e000-4e44-9eaa-6880b5254412","year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.042820Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:c0e0aaafe51065cd4d9ae87d578aa65c8212d630f83d55f1a36f612a09d3010f","observation_id":"cf047ea2-ae4d-4d60-87fb-3e1124ca9cf2","resolution":{"observed_at":"2026-08-09T17:53:25.671854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.564919Z","title":"Newsclip- pings: Automatic generation of out-of-context multimodal media","venue":null,"work_id":"9271fc64-fbc6-4e45-9dd8-25d9e4a336c8","year":2021},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.082213Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:fd2229637a91bed3d7c8314a99afdda80acc8b2e513c709d84fb2be7ddb4b2bc","observation_id":"27dbc009-110a-441b-9306-0fd45f393c21","resolution":{"observed_at":"2026-08-09T17:53:25.598403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.495222Z","title":"fake news","venue":null,"work_id":"2247066b-92a4-497b-b35a-086bdf47912c","year":2017},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.104309Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:8c42233f6a8d7f50cd4a854698909e35d6567f3c1b9e989e3784abe6aadca664","observation_id":"f28c0d2f-7d04-41a0-ba32-ff98ed58b1fe","resolution":{"observed_at":"2026-08-09T17:53:25.527399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.433393Z","title":"Representation biases in sentence transformers","venue":null,"work_id":"27ccebec-063f-4c79-8502-342dde75dcb0","year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.133399Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:c67b37da77b18e25b2ddcb5f5617dfe4b631e220eb81daad13ce19a3f894186d","observation_id":"cc4d13f7-bdfe-4538-8e4c-0d02dd20b2ea","resolution":{"observed_at":"2026-08-09T17:53:25.461433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.405670Z","title":"Dinov2: Learning robust visual features without su- pervision","venue":null,"work_id":"699ec9e6-85a4-4d8b-bb24-54df761f112d","year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.157371Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:bb8dfe7ca765b26f1b3eb163572cff8e28c719166c6065111343b2f562cac2ec","observation_id":"7297ad60-cd94-4f89-b47b-4b9a1015548d","resolution":{"observed_at":"2026-08-09T17:53:25.409564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.393851Z","title":"Training lan- guage models to follow instructions with human feedback","venue":null,"work_id":"3a544e8f-9b14-4cd7-b6fc-252b5284621a","year":2022},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.199496Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:60e46f121325e82f37c4d1053cb822e1368bf387b57662d889a308bdfc8169b0","observation_id":"d85603f6-63ac-43c6-9b0a-77bd79d57eff","resolution":{"observed_at":"2026-08-09T17:53:25.398144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.382740Z","title":"A com- parative analysis of early and late fusion for the multimodal two-class problem","venue":null,"work_id":"a806366b-0988-4ebc-a65a-77b00fca747a","year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.248175Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:3f9f6568ea7cff2673049146cd50043bc457652b343f46e52c9d0503dd71dee0","observation_id":"ff81e043-3e32-4474-8bc2-49a0654c26ee","resolution":{"observed_at":"2026-08-09T17:53:25.386547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.366274Z","title":"Declare: Debunking fake news and false claims using evidence-aware deep learning","venue":null,"work_id":"985b3cb4-08b9-495f-b41d-b07ee9c39fdb","year":2018},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.319148Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:e2baa8295df01edeea5702873238dd47d929b58297ab4b68dc781b120e22b7a0","observation_id":"894267f6-9718-44d7-81c0-8beeb8c28121","resolution":{"observed_at":"2026-08-09T17:53:25.374525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.353178Z","title":"Sniffer: Multimodal large language model for explainable out-of-context misinformation detection","venue":null,"work_id":"7375b745-d973-46cf-b218-eaf1ddf63461","year":2024},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.337467Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:9ea6806b4681186f417b7d40b536355ee9a4874c17da9443c6a5d30ebb6c9385","observation_id":"472fc545-6780-44dd-a453-f80636e0b08f","resolution":{"observed_at":"2026-08-09T17:53:25.358176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.329973Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"9effbb44-1d06-45f6-9796-79116b2efe49","year":2021},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.361588Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:7861bf7f719f408da0efdab0abd70a9e005609e60a310fcd7f11c3acbf95972f","observation_id":"c9ae7f77-5b3d-483c-bd36-7cc1f549c2a9","resolution":{"observed_at":"2026-08-09T17:53:25.337132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.319371Z","title":"Do vision trans- formers see like convolutional neural networks? Advances in NeurIPS, 34:12116–12128, 2021","venue":null,"work_id":"9c9514e9-b1c4-4d57-a55a-79c3f8065625","year":2021},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.377332Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:ca725a019b43f81f0623c25748ebf15b92c466951ada6340c9326eee450eab5f","observation_id":"2aa6e5e0-ca3f-4828-ac09-9f646d4d666e","resolution":{"observed_at":"2026-08-09T17:53:25.323381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.284303Z","title":"Sentence-bert: Sen- tence embeddings using siamese bert-networks","venue":null,"work_id":"486a3a33-e45a-489b-b7c2-431235b49b4f","year":2019},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.410267Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:bf49433304b216b5faa51d0dfe35925126630baa595f7318fb0b1b3b9a91b707","observation_id":"04603242-f5e2-468f-81e0-08d99d92c23c","resolution":{"observed_at":"2026-08-09T17:53:25.301072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.209791Z","title":"Leveraging chat-based large vision language mod- els for multimodal out-of-context detection","venue":null,"work_id":"bb5b2a35-2ced-4348-af54-7e1225634e12","year":2024},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.444383Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:bdcb7998b5fe92b2ea2b45f845c6d39963db8990ae3657df910ab30c478cf37d","observation_id":"28f5d981-0161-44ef-86e2-6624e2c8700b","resolution":{"observed_at":"2026-08-09T17:53:25.243623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.160097Z","title":"Human evaluation of automatically gener- ated text: Current trends and best practice guidelines","venue":null,"work_id":"5aca5e3f-32eb-40ef-b4a3-1b51ad4516de","year":2021},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.474111Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:41ad9b3baf42c148ebb71a9bad75f8fc64c95384fced0650272652e64eae6a21","observation_id":"dd9a344e-f6db-4f9c-8a05-866790c01254","resolution":{"observed_at":"2026-08-09T17:53:25.182721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.104444Z","title":"Attention is all you need","venue":null,"work_id":"226ab412-d9d1-4a05-b45d-c8cc4500b5f3","year":2017},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.511000Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:29ba960cfa0640c5f929a58e14e2a3546485c03676242810e97f4b76ccaeb76d","observation_id":"cf68e6db-8cd9-4b46-a52e-a351cbf661f8","resolution":{"observed_at":"2026-08-09T17:53:25.137408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:25.049026Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers","venue":null,"work_id":"257aabd5-d21e-415c-863e-b3ea40a8b70d","year":2020},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.559382Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:fec6312f9bbd82e7aa6da5ac56fc40543673cb832d11f0176025634ba25a9019","observation_id":"9a79297b-812b-40e3-9e5c-33cc9021c84f","resolution":{"observed_at":"2026-08-09T17:53:25.083718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03677","last_updated":"2020-11-20T00:10:51Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T20:49:49Z","title":"Visual Transformers: Token-based Image Representation and Processing for Computer Vision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03677","snapshot_observed_at":"2026-08-09T17:53:24.593745Z","title":"Visual transform- ers: Token-based image representation and processing for computer vision","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.593745Z"},"links":{"cited_paper":"/paper/2006.03677","citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:bb113fe965d02ca1083f2e13abc425e2dd2547828707e5a9acfc3410afe54208","observation_id":"abb19d1f-e528-4406-97a0-69ecaa6e1b87","resolution":{"observed_at":"2026-08-09T17:53:24.593745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:24.987122Z","title":"End-to-end multimodal fact-checking and explanation generation: A challenging dataset and mod- els","venue":null,"work_id":"17546a5e-7986-4eec-a374-d16f89978abd","year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.629109Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:954105f9b29069a774354386e405abeb60f8cb3bb64f63f7e652a86ded0814fc","observation_id":"33ff91c6-a1a2-46b4-9950-a1a09541cf28","resolution":{"observed_at":"2026-08-09T17:53:25.015510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:24.890897Z","title":"Escnet: Entity-enhanced and stance checking network for multi-modal fact-checking","venue":null,"work_id":"15769b76-5cb2-4d0e-b1c8-8aef807b8c1b","year":2024},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.654554Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:ce19cb2e71eec75a1432ddf30161f11032f000761113cbe62cde2bab2fe4c498","observation_id":"fcb48d08-9fc2-40a5-b9d5-566ee9a3585a","resolution":{"observed_at":"2026-08-09T17:53:24.938207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07633","last_updated":"2024-04-05T23:39:52Z","snapshot_observed_at":"2026-07-06T15:16:06.215998Z","submitted_at":"2023-04-15T21:11:55Z","title":"Interpretable Detection of Out-of-Context Misinformation with Neural-Symbolic-Enhanced Large Multimodal Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07633","snapshot_observed_at":"2026-08-09T17:53:24.672827Z","title":"Detecting out-of-context multimodal misinformation with interpretable neural-symbolic model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.672827Z"},"links":{"cited_paper":"/paper/2304.07633","citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:694d1312a26aa18d33941d75045149c918d1f831b6a06d86e99989e2dc6e880b","observation_id":"1bf61dad-d135-476d-87bd-af750db12d1a","resolution":{"observed_at":"2026-08-09T17:53:24.672827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:53:24.808702Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":"715cc659-964b-4410-841d-eda501d70c7f","year":2023},"citing_paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T17:53:24.711197Z"},"links":{"citing_paper":"/paper/2502.00752"},"observation_digest":"sha256:a3fd0eb61d79772e6eedea330fb4769ea0dde578cf53c04587c2c8e9904b31ed","observation_id":"92767db4-100d-4288-bca7-52f97e8ffd11","resolution":{"observed_at":"2026-08-09T17:53:24.861973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00752","last_updated":"2025-02-02T11:18:05Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T17:47:03.941246Z","submitted_at":"2025-02-02T11:18:05Z","title":"Zero-Shot Warning Generation for Misinformative Multimodal Content"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2502.00752."}