{"as_of":"2026-08-17T01:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:893646aaac71f9e220c61e685103c84903a47f33ccd641863d836b9f73d86642","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:38:38.135128Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T15:03:13.421099Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T15:08:02.159845Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"cited_work":{"arxiv_id":"2509.25991","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.25991","snapshot_observed_at":"2026-07-31T02:03:00.912512Z","title":"InPro- ceedings of the 2022 Conference on Empirical Meth- ods in Natural Language Processing, pages 5916– 5936, Abu Dhabi, United Arab Emirates","venue":null,"work_id":"f5c79cb5-7a91-432d-829c-ed2f20bc1a06","year":2022},"citing_paper":{"arxiv_id":"2601.08611","last_updated":"2026-04-30T14:20:16Z","snapshot_observed_at":"2026-08-15T17:58:45.306052Z","submitted_at":"2026-01-13T14:56:40Z","title":"VeriTaS: The First Dynamic Benchmark for Multimodal Automated Fact-Checking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T15:03:13.421099Z"},"links":{"cited_paper":"/paper/2509.25991","citing_paper":"/paper/2601.08611"},"observation_digest":"sha256:7be85f723b34383f3d1650750c92be65ded0dff732b231c51ce638b849583e5b","observation_id":"8e772212-90cc-413d-80f8-42d11d635c3d","resolution":{"observed_at":"2026-07-31T02:03:00.912512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.25991/citation-record","integrity":"/paper/2509.25991/integrity","json":"/paper/2509.25991/citation-record.json","paper":"/paper/2509.25991"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-16T19:40:28.523700Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T13:38:35.996929Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:35.996929Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:1c149eb21905fd7de0047762d8f3af2ddaa95f8ce09d3cc72d081d5f984cfe6c","observation_id":"78397680-da22-4003-bbbb-0c2cd6469e34","resolution":{"observed_at":"2026-08-04T13:38:35.996929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:38:36.593899Z","title":"Epidemiology- informed network for robust rumor detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:36.593899Z"},"links":{"citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:befad205cd25a592558a10886305fc41adb242f854d1861f4dd8020abade9055","observation_id":"35637c26-ecf9-4202-8035-476b50cdb30e","resolution":{"observed_at":"2026-08-04T13:38:36.593899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03854","last_updated":"2020-03-12T17:55:57Z","snapshot_observed_at":"2026-08-17T00:18:21.583502Z","submitted_at":"2019-11-10T05:06:38Z","title":"r/Fakeddit: A New Multimodal Benchmark Dataset for Fine-grained Fake News Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03854","snapshot_observed_at":"2026-08-04T13:38:36.827963Z","title":"r/fakeddit: A new multimodal benchmark dataset for fine-grained fake news detection.arXiv preprint arXiv:1911.03854,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:36.827963Z"},"links":{"cited_paper":"/paper/1911.03854","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:7c0fd20fb3dcf23ea6a380d524819e40d92bcc15faa037f9ca1150540ca098ef","observation_id":"ab2038d8-5beb-4f73-8a2e-5bc2b60628f0","resolution":{"observed_at":"2026-08-04T13:38:36.827963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-04T13:38:36.936291Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis.arXiv preprint arXiv:2307.01952,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:36.936291Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:cf5442ab17657263dfbd2c5ed56773089524037eacd71baaf7c1ffb24d5fc55e","observation_id":"b196da8f-8431-499e-a459-10e0b1dabaf4","resolution":{"observed_at":"2026-08-04T13:38:36.936291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-04T13:38:37.106576Z","title":"Sam 2: Segment anything in images and videos.arXiv preprint arXiv:2408.00714,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:37.106576Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:68db41796884cfd1c5d0a74308f955e8dd4e5cb33f8d734745d1b194e6772ded","observation_id":"e4a309f8-565e-4845-96ad-43c34050c0c0","resolution":{"observed_at":"2026-08-04T13:38:37.106576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-04T13:38:37.252181Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:37.252181Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:222baa8eea5fc58ee32fc3a59d0c982b17c995e59c4d44bfbe6b84b3d68c9a80","observation_id":"3f524b6f-1128-45cb-8381-ea874139d967","resolution":{"observed_at":"2026-08-04T13:38:37.252181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:38:37.541381Z","title":"Florence-2: Advancing a unified representation for a variety of vision tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:37.541381Z"},"links":{"citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:7c7d04afd1e72345477a63eab487d2b75af1b3e10575c7011599bf6723b6c097","observation_id":"c870ce51-a608-41a6-b607-ca3d331e62ca","resolution":{"observed_at":"2026-08-04T13:38:37.541381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-04T13:38:37.685526Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:37.685526Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:bae8933cd8a3bd2a738ad6d3f65995fd5efa26f18e594da10fd2b94e63d2830e","observation_id":"ee87be95-859d-47fc-ae8a-92e45b437dde","resolution":{"observed_at":"2026-08-04T13:38:37.685526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-13T15:12:42.567441Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-04T13:38:37.863442Z","title":"Coca: Contrastive captioners are image-text foundation models.arXiv preprint arXiv:2205.01917,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:37.863442Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:51cfd8f9507c60c4e35e51077549095f10c65586090ae1cb3bdb680fb5b05752","observation_id":"a8c5cc9b-7005-4692-aa25-bdfc0055bd46","resolution":{"observed_at":"2026-08-04T13:38:37.863442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04981","last_updated":"2020-02-19T02:51:04Z","snapshot_observed_at":"2026-08-07T07:25:48.101680Z","submitted_at":"2020-02-19T02:51:04Z","title":"SAFE: Similarity-Aware Multi-Modal Fake News Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04981","snapshot_observed_at":"2026-08-04T13:38:38.006536Z","title":"Safe: similarity-aware multi-modal fake news detection","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:38.006536Z"},"links":{"cited_paper":"/paper/2003.04981","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:800ff93bb72ffe8cf08dc1e761327f9bd4de9ba5c7a7b037e1cc33fbdaed2fac","observation_id":"cd1ad97d-cae0-4483-9ebf-5beaef71e7b9","resolution":{"observed_at":"2026-08-04T13:38:38.006536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01336","last_updated":"2024-10-15T12:40:39Z","snapshot_observed_at":"2026-08-16T14:04:59.764405Z","submitted_at":"2024-03-30T14:39:09Z","title":"FineFake: A Knowledge-Enriched Dataset for Fine-Grained Multi-Domain Fake News Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01336","snapshot_observed_at":"2026-08-04T13:38:38.135128Z","title":"Finefake: A knowledge-enriched dataset for fine-grained multi- domain fake news detection.arXiv preprint arXiv:2404.01336,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:38.135128Z"},"links":{"cited_paper":"/paper/2404.01336","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:cb988233053f8f24b62589888e9f44f0a809afc0a2417a2ce8fdcd68d16c86ac","observation_id":"cb45219d-7a1a-4e5e-ab60-076fa7341148","resolution":{"observed_at":"2026-08-04T13:38:38.135128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15081","last_updated":"2024-03-27T13:23:28Z","snapshot_observed_at":"2026-08-16T14:49:40.794595Z","submitted_at":"2023-10-23T16:41:13Z","title":"E4S: Fine-grained Face Swapping via Editing With Regional GAN Inversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15081","snapshot_observed_at":"2026-08-04T13:38:36.700799Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:36.700799Z"},"links":{"cited_paper":"/paper/2310.15081","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:4a66d9767123f776bb68bddcb3ad4e302ce4e533e1600362eb95bad856ec99bd","observation_id":"5362ab05-802c-4567-babd-68c133ce79c7","resolution":{"observed_at":"2026-08-04T13:38:36.700799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10904","last_updated":"2022-05-15T23:20:46Z","snapshot_observed_at":"2026-08-16T18:01:13.363095Z","submitted_at":"2021-08-24T18:14:00Z","title":"SimVLM: Simple Visual Language Model Pretraining with Weak Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10904","snapshot_observed_at":"2026-08-04T13:38:37.414051Z","title":"Simvlm: Sim- ple visual language model pretraining with weak supervision.arXiv preprint arXiv:2108.10904,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:37.414051Z"},"links":{"cited_paper":"/paper/2108.10904","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:67736319a6fe7bf4da7c7553462bfe8c6b2ae2861d519a266a90c02677f93d4e","observation_id":"c5700a91-3ab5-44d5-b93b-1c8fa37b2bb9","resolution":{"observed_at":"2026-08-04T13:38:37.414051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-04T13:38:36.102600Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:36.102600Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:bca44b3c5e2101e493c6a8c51e9f6c557fc1b96bb71f7cbd43555f4ce6ed8e5a","observation_id":"811beaad-ec9f-4e75-bbfe-4fac834af50e","resolution":{"observed_at":"2026-08-04T13:38:36.102600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-08-04T13:38:36.451668Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:36.451668Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:b355d3bcd21ae599e1ed24d192174bdbf7d0c1f49fdad1ae91036b9da43f0c5e","observation_id":"d2a72923-79c9-4ae0-8141-4550b7e18f87","resolution":{"observed_at":"2026-08-04T13:38:36.451668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:38:36.245927Z","title":"Simswap: An efficient framework for high fidelity face swapping","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T13:38:36.245927Z"},"links":{"citing_paper":"/paper/2509.25991"},"observation_digest":"sha256:26a1ae99373c6a97e9ac3082a0b64bfb088e321dc267f1232e34f0c7cf6f826d","observation_id":"d1c63275-8876-4123-a72c-904e5a5fa935","resolution":{"observed_at":"2026-08-04T13:38:36.245927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.25991","last_updated":"2026-07-30T02:00:42Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T02:25:48.569686Z","submitted_at":"2025-09-30T09:26:32Z","title":"Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 1 inbound Pith citation observation for arXiv:2509.25991."}