{"as_of":"2026-08-10T07:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:acc3127dfdce07657ab9d5d4283aab0895e2bcb02dabd9b9a43cb46a202569bb","coverage":[{"denominator":201,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T21:12:22.843020Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T11:05:19.011287Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T11:54:38.827618Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"cited_work":{"arxiv_id":"2502.05240","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05240","snapshot_observed_at":"2026-06-30T11:54:38.827618Z","title":"unnatural","venue":null,"work_id":"0bc17887-eaf6-4775-a6aa-5afa02616103","year":2025},"citing_paper":{"arxiv_id":"2512.15693","last_updated":"2026-05-15T14:16:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:48:26Z","title":"Skyra: AI-Generated Video Detection via Grounded Artifact Reasoning","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-21T16:43:11.995960Z"},"links":{"cited_paper":"/paper/2502.05240","citing_paper":"/paper/2512.15693"},"observation_digest":"sha256:63fe67dbcbdeb571ced38dcad2970ce2ec973856650a05e5210e5108711c66f3","observation_id":"60e4348a-d7bd-4c3a-80c5-bdc8f182ab7d","resolution":{"observed_at":"2026-05-21T16:44:15.984595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"cited_work":{"arxiv_id":"2502.05240","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05240","snapshot_observed_at":"2026-06-30T11:54:38.827618Z","title":"unnatural","venue":null,"work_id":"0bc17887-eaf6-4775-a6aa-5afa02616103","year":2025},"citing_paper":{"arxiv_id":"2605.01638","last_updated":"2026-05-02T22:56:17Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T22:56:17Z","title":"Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-05-09T14:04:52.065878Z"},"links":{"cited_paper":"/paper/2502.05240","citing_paper":"/paper/2605.01638"},"observation_digest":"sha256:1e0784e63e032060b6d8210eead72445073a7a8751fd9296c7513f352fd740f1","observation_id":"4607f999-6e92-40f8-8e3a-c21fe5e90f2a","resolution":{"observed_at":"2026-05-11T17:06:04.230379Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"cited_work":{"arxiv_id":"2502.05240","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05240","snapshot_observed_at":"2026-06-30T11:54:38.827618Z","title":"unnatural","venue":null,"work_id":"0bc17887-eaf6-4775-a6aa-5afa02616103","year":2025},"citing_paper":{"arxiv_id":"2605.25281","last_updated":"2026-05-26T16:00:26Z","snapshot_observed_at":"2026-08-07T06:12:58.984848Z","submitted_at":"2026-05-24T22:26:23Z","title":"READER: Reasoning-Enhanced AI-Generated Text Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T11:05:19.011287Z"},"links":{"cited_paper":"/paper/2502.05240","citing_paper":"/paper/2605.25281"},"observation_digest":"sha256:a9f8fc80029dfe31d020db0fca40948cc6f1a98c8e75a068443eb0602139a850","observation_id":"015db01b-905b-478f-b1de-d7d7b0bffa45","resolution":{"observed_at":"2026-06-30T11:54:38.829046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05240/citation-record","integrity":"/paper/2502.05240/integrity","json":"/paper/2502.05240/citation-record.json","paper":"/paper/2502.05240"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.330332Z","title":"Hello gpt-4o","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.330332Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:9b3f3921c4e04ae2ba631b8031dd434da33bd8956b12d023d013e5e8b57a7292","observation_id":"a05485b9-ba1a-4f7c-85fb-90abb7d244f1","resolution":{"observed_at":"2026-08-08T21:12:22.330332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.335290Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.335290Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:bc19aea496f057f9a09834d438e3d89749bfad5c4d29db99d53b19675bf718a5","observation_id":"c049a956-3b30-4ccf-9ee7-6d51d98df14a","resolution":{"observed_at":"2026-08-08T21:12:22.335290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.339349Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.339349Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c728e8997a3e6cb7e92b5536f9ad9f91ca691aa2d0ab8cbd37eb28b154cfb14b","observation_id":"da24a3ef-f25a-4ddd-a7d0-edd48527df4c","resolution":{"observed_at":"2026-08-08T21:12:22.339349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.344830Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.344830Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:14c3fd49a8d08d4d236b8926da809be02456a6ae335f3f774e9af666e1577e67","observation_id":"11772ca8-03f4-4ed9-a9fe-b330e1dd8514","resolution":{"observed_at":"2026-08-08T21:12:22.344830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.350661Z","title":"Pluralistic aging diffusion autoencoder","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.350661Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:3b8468a15bb45c69822b6dfc5b57a18d5ee131694b70253b9a42d824c3c46890","observation_id":"f7bcf616-0315-43b8-9771-5d079d79f78f","resolution":{"observed_at":"2026-08-08T21:12:22.350661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.355306Z","title":"Global and local consistent wavelet-domain age synthesis","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.355306Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c63ce5a632286d208fd9c0ee78d50489b2dc020e83e0a989910daba44aee657d","observation_id":"c3d42e60-fb26-4ece-9ce9-e380a07b34b4","resolution":{"observed_at":"2026-08-08T21:12:22.355306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00432","last_updated":"2024-10-22T07:59:51Z","snapshot_observed_at":"2026-08-10T02:16:03.269716Z","submitted_at":"2024-06-01T13:10:43Z","title":"Localize, Understand, Collaborate: Semantic-Aware Dragging via Intention Reasoner","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00432","snapshot_observed_at":"2026-08-08T21:12:22.360505Z","title":"Localize, understand, collaborate: Semantic-aware dragging via intention reasoner","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.360505Z"},"links":{"cited_paper":"/paper/2406.00432","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:f7c0ff0000bcc27c0f5ee3dfbc741c5ef09d84c0d5090aac316a11131b6b3b23","observation_id":"ab19450f-490f-4b26-a809-488d84b435b4","resolution":{"observed_at":"2026-08-08T21:12:22.360505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.365536Z","title":"Combating misinformation in the era of generative ai models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.365536Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:777412243f7469ef323d7891a1fe50e91f5dd795d44a531294c5a7d49e9b4bb1","observation_id":"3079a0ad-4eee-4163-b745-767054a9acfc","resolution":{"observed_at":"2026-08-08T21:12:22.365536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.369863Z","title":"Deep learning technology for face forgery detection: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.369863Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:5f10d256049ccbfc521b88245252994656efdaf1e3e5db02847a18a86385e181","observation_id":"d28f340c-767b-4a0d-9d9a-2db00f39a504","resolution":{"observed_at":"2026-08-08T21:12:22.369863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.374003Z","title":"Communicating the cultural other: Trust and bias in generative ai and large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.374003Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:079f0ba836ec128e7fbc197a59cf69809925781410b497c657a1f3f1fd9f654e","observation_id":"d6292ac0-5dd2-4af0-8982-40d23927983a","resolution":{"observed_at":"2026-08-08T21:12:22.374003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.378256Z","title":"Generative ai meets copyright","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.378256Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:43415706d30e5b2b0063c3b40f87544882148f251c674f39d6481c51ff0e0769","observation_id":"0ef591d9-9a6b-49e2-8556-ce79d7c23b86","resolution":{"observed_at":"2026-08-08T21:12:22.378256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09259","last_updated":"2024-12-09T14:22:14Z","snapshot_observed_at":"2026-08-09T06:09:32.355513Z","submitted_at":"2024-11-14T07:51:51Z","title":"Jailbreak Attacks and Defenses against Multimodal Generative Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09259","snapshot_observed_at":"2026-08-08T21:12:22.382439Z","title":"Jailbreak attacks and defenses against multimodal generative models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.382439Z"},"links":{"cited_paper":"/paper/2411.09259","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:a7bc7a7f6cdaff57763e0da7e5e47082873816125f5194b1c167be6a4db681b8","observation_id":"fa1d2957-556e-42e4-843f-05f67e725e3e","resolution":{"observed_at":"2026-08-08T21:12:22.382439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.386367Z","title":"Online detection of ai-generated images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.386367Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:0a72e8e9c38f7bc1429c8d9299be6521b1bd0cdb800cb7f9f7fe2f3ce0fa77cb","observation_id":"12767eeb-dadd-4fa6-93f9-19d7702cd3be","resolution":{"observed_at":"2026-08-08T21:12:22.386367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.390227Z","title":"An empirical study of ai-generated text detection tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.390227Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:f3012903b187cb1505a7179bb49f35aa99366bf1dfb92b493bf2fa37955e57db","observation_id":"ca38bf36-9e65-4f14-94e1-e0d8c9a7d7df","resolution":{"observed_at":"2026-08-08T21:12:22.390227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02104","last_updated":"2024-12-03T02:54:31Z","snapshot_observed_at":"2026-07-06T20:00:37.331726Z","submitted_at":"2024-12-03T02:54:31Z","title":"Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02104","snapshot_observed_at":"2026-08-08T21:12:22.394230Z","title":"Explainable and interpretable multimodal large language models: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.394230Z"},"links":{"cited_paper":"/paper/2412.02104","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:6beef8e6f1a2755226b2ce414bc0cddfa3fd89e7123127fe7b20c57cd0b987b8","observation_id":"f6ac4806-3d66-4213-bf96-9480f05b34b3","resolution":{"observed_at":"2026-08-08T21:12:22.394230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00045","last_updated":"2025-07-26T02:37:03Z","snapshot_observed_at":"2026-08-09T21:04:47.829242Z","submitted_at":"2024-01-22T15:08:19Z","title":"Detecting Multimedia Generated by Large AI Models: A Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00045","snapshot_observed_at":"2026-08-08T21:12:22.398590Z","title":"Detecting multimedia generated by large ai models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.398590Z"},"links":{"cited_paper":"/paper/2402.00045","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:641f4459ad873a13f5def45f07b5508ab6d0704a9fd4b40343933995441fccbf","observation_id":"d5bd5c36-2147-4430-9236-d04ba2567d70","resolution":{"observed_at":"2026-08-08T21:12:22.398590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.402602Z","title":"A survey of defenses against ai-generated visual media: Detection, disruption, and authentication","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.402602Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:0b0b42bd976e187c3bdd9d360bf51db59bb71e202be553328b941d699095351e","observation_id":"fc98ebcb-fcd4-4125-9497-24ceeb4135b1","resolution":{"observed_at":"2026-08-08T21:12:22.402602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00711","last_updated":"2024-05-03T04:47:01Z","snapshot_observed_at":"2026-07-06T18:08:21.770341Z","submitted_at":"2024-04-25T04:44:09Z","title":"Fake Artificial Intelligence Generated Contents (FAIGC): A Survey of Theories, Detection Methods, and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00711","snapshot_observed_at":"2026-08-08T21:12:22.407293Z","title":"Fake artificial intelligence generated contents (faigc): A survey of theories, detection methods, and opportunities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.407293Z"},"links":{"cited_paper":"/paper/2405.00711","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:1eed79a4e49098d8dcdc81831ecaeaadaa66923b26e98f6ccb4460ff42810551","observation_id":"42979b47-816a-4bb3-b967-bb46b95435e2","resolution":{"observed_at":"2026-08-08T21:12:22.407293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T21:12:22.412016Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.412016Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:0d9a2d870eb2bb27e512694c3cb9f20d96b5e4f33a4dc82ad59d060b9b6b3b2b","observation_id":"b24ed57a-6f4d-4b51-80c5-705ae92cdaf1","resolution":{"observed_at":"2026-08-08T21:12:22.412016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.416723Z","title":"Claude 3.5: Sonnet","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.416723Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:6a02048cb11d3b5b0197aa389b5a5d83e967b9f0db296cea74d3216befe8b161","observation_id":"41bf45a3-c1d3-472d-ae0c-42bdf13bb932","resolution":{"observed_at":"2026-08-08T21:12:22.416723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.420944Z","title":"All the news that’s fit to fabricate: Ai-generated text as a tool of media misinformation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.420944Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:2330e2f10d944ef8f8bfe93e561fad8b8f9a8d86f883f54f8ef45ac8e97cc1b1","observation_id":"51560cc7-fdb1-4986-bdba-18fc23204298","resolution":{"observed_at":"2026-08-08T21:12:22.420944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.425093Z","title":"Program code generation with generative ais","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.425093Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:235bf2569fdfe80237fc924a4faf00fdda5a6f2f102f3e74f30932874b785e2c","observation_id":"d9327d13-c18e-4416-b9ba-6836a61430bb","resolution":{"observed_at":"2026-08-08T21:12:22.425093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.429211Z","title":"Collage is the new writing: Exploring the fragmentation of text and user interfaces in ai tools","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.429211Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:587fca4775367aa565d3ce3f4871f32a62428d6698841f99d1b530f35a5ed41f","observation_id":"f6a5c91e-e10c-4b49-b34f-1c2ff5afb66f","resolution":{"observed_at":"2026-08-08T21:12:22.429211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.433254Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.433254Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:55d4156e06d9673d2671c13bc930e4013de1b1ebae8daff044291a68cdd02bae","observation_id":"5e27a907-c01a-4c0e-b616-8efcfe99f608","resolution":{"observed_at":"2026-08-08T21:12:22.433254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.437483Z","title":"Generative modeling by estimating gradients of the data distribution","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.437483Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:de5e48a9301dd72b30fc85c92e0b6514b48374fca2b791fd76bd16edb7fbb06e","observation_id":"cafd85fd-e198-46c3-b23c-96e76566fdf4","resolution":{"observed_at":"2026-08-08T21:12:22.437483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-08T21:12:22.441094Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.441094Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:92cc0322e35aad4166df42f2256ccfd783a86304a7774c99661e2de2a58c0cfd","observation_id":"1a6add62-7936-4f88-89a8-5e27cc98ad11","resolution":{"observed_at":"2026-08-08T21:12:22.441094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.444940Z","title":"DeepMind","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.444940Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:30a3a42df3eeda956860cc9b1dbf893317939e16763e9add8ee1519b91ce3a68","observation_id":"2201bd10-8e8f-439d-a991-b12ff993fff2","resolution":{"observed_at":"2026-08-08T21:12:22.444940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.448617Z","title":"Midjourney","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.448617Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:5abb8813721022e2c12530bee41e02ab8ae6a73e18faeb715858e79eae73bf1d","observation_id":"3bd7f7f4-d0a3-4f50-a0d4-09a04809773b","resolution":{"observed_at":"2026-08-08T21:12:22.448617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-08T21:12:22.452251Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.452251Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:ce39c2533a880e890ebdaf2e4bda2a72c7dc1b109be8ec39d2e5c7a0ffa00ee6","observation_id":"58ec89a6-38b1-4f08-aae3-5078b0901591","resolution":{"observed_at":"2026-08-08T21:12:22.452251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.456040Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.456040Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:4c2fb8944bc76d5a390c8e1ab2f3d8a3a162be3ab0ef002ae6eb6b09d19bb020","observation_id":"232de6b9-9720-4156-b30e-8735668e6fea","resolution":{"observed_at":"2026-08-08T21:12:22.456040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-08T21:12:22.459513Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.459513Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:e4860b29d79ad7438174686d2ae148c4123af4460ed55770a81fcfed528d53ca","observation_id":"51b3d717-7f44-43fa-a438-0dda29ae3edc","resolution":{"observed_at":"2026-08-08T21:12:22.459513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-08T21:12:22.463887Z","title":"Make- a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.463887Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:802c352f279465fcd3288cb52bc40d7ee1d0f978b5dbbb42f1e809ab1e786f7b","observation_id":"beb79927-b0f6-40ab-9d99-dd37855d74b5","resolution":{"observed_at":"2026-08-08T21:12:22.463887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.468504Z","title":"Dall·e 2","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.468504Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:154d1cd1b38482682575cbc1a2ab9f3210df094d5c5a3f0f01554167352ae90b","observation_id":"2298f2ee-25dc-4877-ae98-66dba5524a99","resolution":{"observed_at":"2026-08-08T21:12:22.468504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.472912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.472912Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:173f6253b375f4bfe551ec21629b0425d248e43e244d02ec77ca1a1e8a55ea1c","observation_id":"35f76bf6-57b0-4510-812b-4e4019560cc4","resolution":{"observed_at":"2026-08-08T21:12:22.472912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-08T21:12:22.477753Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.477753Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:bf309495985f80dcff5528bc919dd35b913ff868b75e13d8725e3746e4cf4caa","observation_id":"f5de5cd2-8e6b-45aa-b09e-7be150203c31","resolution":{"observed_at":"2026-08-08T21:12:22.477753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.482414Z","title":"Llama-vid: An image is worth 2 tokens in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.482414Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:f7cd2258e01feb4586eb0be573ab0c4f4a714708fe3b799e7fa7a144c84e12b5","observation_id":"60b97434-6b6e-4cb1-886a-f10dea0a7c4c","resolution":{"observed_at":"2026-08-08T21:12:22.482414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.486954Z","title":"Mvbench: A comprehensive multi-modal video understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.486954Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:0bbfadc9a4c9281b589cbf42424b2766e7fea3f01a44f82ade4fe61dd59d2f80","observation_id":"b3993d1f-5478-498c-810a-039c67f137ec","resolution":{"observed_at":"2026-08-08T21:12:22.486954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-09T08:07:41.367781Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-08T21:12:22.491013Z","title":"Diff-tts: A denoising diffusion model for text-to- speech","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.491013Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:f7d074d8f4be783ae41ab099ffcf2dff4fe0aa1bd73276ad3c5e42853d347489","observation_id":"f2ba1678-4716-4563-8a31-4ac646a617a2","resolution":{"observed_at":"2026-08-08T21:12:22.491013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.494851Z","title":"Audioldm: text-to-audio generation with latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.494851Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:9bcfdc5b631bb0630bcc812c97d063e833a02009b67577dc04222624782f9bc3","observation_id":"92092498-bc2e-49e6-9806-1a4a4b703b0e","resolution":{"observed_at":"2026-08-08T21:12:22.494851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.498430Z","title":"Make-an-audio: text-to-audio generation with prompt-enhanced diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.498430Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:dc5a69fc7e812e0de8b121902852315cca4edf5a545bd96a59c47998e14af2d8","observation_id":"fdc13d22-27a8-4849-b3db-9a8b62510a23","resolution":{"observed_at":"2026-08-08T21:12:22.498430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13731","last_updated":"2023-05-29T12:09:08Z","snapshot_observed_at":"2026-07-06T15:20:25.388057Z","submitted_at":"2023-04-24T07:45:28Z","title":"Text-to-Audio Generation using Instruction-Tuned LLM and Latent Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13731","snapshot_observed_at":"2026-08-08T21:12:22.502166Z","title":"Text-to-audio generation using instruction-tuned llm and latent diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.502166Z"},"links":{"cited_paper":"/paper/2304.13731","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:d06efbe2ef14a1a5c5fb7762dfb9e4c0b24fee470a52fc45912a042344d36571","observation_id":"3ac16a45-5bd5-4f75-a9ae-0834e90d4fc4","resolution":{"observed_at":"2026-08-08T21:12:22.502166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14335","last_updated":"2023-11-26T14:12:37Z","snapshot_observed_at":"2026-07-06T15:58:55.330444Z","submitted_at":"2023-07-26T17:54:04Z","title":"WavJourney: Compositional Audio Creation with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14335","snapshot_observed_at":"2026-08-08T21:12:22.506015Z","title":"Wavjourney: Compositional audio creation with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.506015Z"},"links":{"cited_paper":"/paper/2307.14335","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:02c162f0617ce7cc24959209ce672e7f14e53d076060d55d0b0a56be642e6eec","observation_id":"6c3330d6-bba7-4f8a-a7fb-1dc252bf505d","resolution":{"observed_at":"2026-08-08T21:12:22.506015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00704","last_updated":"2024-12-10T03:17:56Z","snapshot_observed_at":"2026-08-08T23:01:50.650593Z","submitted_at":"2023-10-01T15:49:46Z","title":"UniAudio: An Audio Foundation Model Toward Universal Audio Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00704","snapshot_observed_at":"2026-08-08T21:12:22.509705Z","title":"Uniaudio: An audio foundation model toward universal audio generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.509705Z"},"links":{"cited_paper":"/paper/2310.00704","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:815d801956b5c8cdd062aef09b3f92dce73ac2bd7d3eb0ec55454ec434000f0a","observation_id":"9cc133a0-5e46-45ce-98ad-a3c78c6985f1","resolution":{"observed_at":"2026-08-08T21:12:22.509705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.513933Z","title":"Explainability for large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.513933Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:57b94497ab8498475363721d26f31fc658f76dd19c19cd8c534c590b9ee62a10","observation_id":"de0cd808-7e0f-4832-addb-20995a7d00e1","resolution":{"observed_at":"2026-08-08T21:12:22.513933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18226","last_updated":"2025-03-11T08:08:05Z","snapshot_observed_at":"2026-07-06T15:34:51.593721Z","submitted_at":"2023-05-26T11:07:25Z","title":"HowkGPT: Investigating the Detection of ChatGPT-generated University Student Homework through Context-Aware Perplexity Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18226","snapshot_observed_at":"2026-08-08T21:12:22.517911Z","title":"Howkgpt: Investigating the detection of chatgpt- generated university student homework through context-aware perplexity analysis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.517911Z"},"links":{"cited_paper":"/paper/2305.18226","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c125c1c1a44f6a896ce315d31317b8119709e65dd280287f49c0f6e15bdc801b","observation_id":"b186ff9c-f6ba-4ef7-b70b-238c5dc1beb8","resolution":{"observed_at":"2026-08-08T21:12:22.517911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17359","last_updated":"2023-10-04T16:36:09Z","snapshot_observed_at":"2026-08-06T09:46:48.055328Z","submitted_at":"2023-05-27T03:58:29Z","title":"DNA-GPT: Divergent N-Gram Analysis for Training-Free Detection of GPT-Generated Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17359","snapshot_observed_at":"2026-08-08T21:12:22.522274Z","title":"Dna-gpt: Divergent n-gram analysis for training-free detection of gpt-generated text","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.522274Z"},"links":{"cited_paper":"/paper/2305.17359","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:16e58c2fc9f54b16452d707910ab02b0fb68cea896a698af5f441b3b11a0b37a","observation_id":"1425f8bd-a6bc-4377-9358-8925b655f665","resolution":{"observed_at":"2026-08-08T21:12:22.522274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05540","last_updated":"2023-05-23T11:18:30Z","snapshot_observed_at":"2026-07-06T15:40:31.399348Z","submitted_at":"2023-05-23T11:18:30Z","title":"DetectLLM: Leveraging Log Rank Information for Zero-Shot Detection of Machine-Generated Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05540","snapshot_observed_at":"2026-08-08T21:12:22.527056Z","title":"Detectllm: Leveraging log rank information for zero-shot detection of machine- generated text","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.527056Z"},"links":{"cited_paper":"/paper/2306.05540","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:391a2066e4b31fd4e86fde6e070042dde68bbb92aecdad80969f8f4defe3b95e","observation_id":"3f22f26a-d16f-43ee-b480-07ce0fd0acb2","resolution":{"observed_at":"2026-08-08T21:12:22.527056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.531462Z","title":"Detectgpt: Zero-shot machine-generated text detection using probability curvature","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.531462Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:4462df49a06984d3fea6cc7bb690c6fab14aa2f527077fe6158d57f2fcad846e","observation_id":"ee04c8a1-631b-481f-baf7-55f9ad90a60e","resolution":{"observed_at":"2026-08-08T21:12:22.531462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05130","last_updated":"2024-12-16T02:20:31Z","snapshot_observed_at":"2026-08-03T21:21:39.149039Z","submitted_at":"2023-10-08T11:41:28Z","title":"Fast-DetectGPT: Efficient Zero-Shot Detection of Machine-Generated Text via Conditional Probability Curvature","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05130","snapshot_observed_at":"2026-08-08T21:12:22.535389Z","title":"Fast-detectgpt: Efficient zero-shot detection of machine- generated text via conditional probability curvature","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.535389Z"},"links":{"cited_paper":"/paper/2310.05130","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:23f98d74314343334396777dc26d32225db955b536300019523a856b4e36441f","observation_id":"6e71886d-1c83-41c6-bd27-b0e2222b7e0a","resolution":{"observed_at":"2026-08-08T21:12:22.535389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09732","last_updated":"2025-04-21T02:36:09Z","snapshot_observed_at":"2026-08-09T09:24:59.615897Z","submitted_at":"2024-10-13T05:26:36Z","title":"LOKI: A Comprehensive Synthetic Data Detection Benchmark using Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09732","snapshot_observed_at":"2026-08-08T21:12:22.539676Z","title":"Loki: A comprehensive synthetic data detection benchmark using large multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.539676Z"},"links":{"cited_paper":"/paper/2410.09732","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:20f0a1981c7e49e10dda4e9c37fca449533feb0ac6bd5844aa8cda3b21bf2a0f","observation_id":"cd6fe240-c67f-4603-9bf7-0b6b2a7b3bb5","resolution":{"observed_at":"2026-08-08T21:12:22.539676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.543660Z","title":"Fighting fire with fire: can chatgpt detect ai-generated text? ACM SIGKDD Explorations Newsletter, 25(2):14–21, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.543660Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:9bd9d59a99f082d6e71445040e23387da3730e25e5e7c2de5968bdaddbe71c88","observation_id":"56ed2f15-9300-4826-9c33-fd7a013c60a8","resolution":{"observed_at":"2026-08-08T21:12:22.543660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.547760Z","title":"Detection vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.547760Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:acc630b23007108bd694e1177f0e35e3325b3320c031f7e360e22e878bc3ab30","observation_id":"cc153f4f-b0c7-4828-a5b3-97ac7ce41622","resolution":{"observed_at":"2026-08-08T21:12:22.547760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14479","last_updated":"2023-10-23T01:23:10Z","snapshot_observed_at":"2026-08-04T20:54:50.593714Z","submitted_at":"2023-10-23T01:23:10Z","title":"DetectGPT-SC: Improving Detection of Text Generated by Large Language Models through Self-Consistency with Masked Predictions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14479","snapshot_observed_at":"2026-08-08T21:12:22.551830Z","title":"Detectgpt-sc: Improving detection of text generated by large language models through self- consistency with masked predictions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.551830Z"},"links":{"cited_paper":"/paper/2310.14479","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:ca8f70140be9f9d430857f161d40ca1e605830ae55dd3773e59de2c10ddc5f74","observation_id":"2a502feb-6837-49a3-bb2d-9be79cfc85d9","resolution":{"observed_at":"2026-08-08T21:12:22.551830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.555764Z","title":"Simllm: Detecting sentences generated by large language models using similarity between the generation and its re-generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.555764Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:33042189ba8420ff22743860f9d7d1bd261fa57fa4f7aa3c54d4b632b0fe9a26","observation_id":"2cae0c00-d71f-4d6c-84d2-8ea568907df5","resolution":{"observed_at":"2026-08-08T21:12:22.555764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.559380Z","title":"Beat llms at their own game: Zero-shot llm-generated text detection via querying chatgpt","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.559380Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:5a149a802650b2c2a9ec54e7d0eae6ae1a0dbd4697dfcbdb07f6ede95d3f996e","observation_id":"a4ff63e9-95d6-4276-84b9-0914bd04bc20","resolution":{"observed_at":"2026-08-08T21:12:22.559380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12970","last_updated":"2024-04-14T22:34:37Z","snapshot_observed_at":"2026-07-06T17:19:31.847730Z","submitted_at":"2024-01-23T18:57:53Z","title":"Raidar: geneRative AI Detection viA Rewriting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12970","snapshot_observed_at":"2026-08-08T21:12:22.563047Z","title":"Raidar: generative ai detection via rewriting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.563047Z"},"links":{"cited_paper":"/paper/2401.12970","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:55a466bd6e3c2d6803f59083ea72e10901679bf45bcf2f469c25b75b1174f0d9","observation_id":"2d1142e0-3df0-4cfd-a1a9-9cbf40aa539b","resolution":{"observed_at":"2026-08-08T21:12:22.563047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04237","last_updated":"2025-02-15T04:11:44Z","snapshot_observed_at":"2026-08-06T13:05:00.036188Z","submitted_at":"2024-08-08T05:53:39Z","title":"Learning to Rewrite: Generalized LLM-Generated Text Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04237","snapshot_observed_at":"2026-08-08T21:12:22.567591Z","title":"Learning to rewrite: Generalized detection of LLM-generated text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.567591Z"},"links":{"cited_paper":"/paper/2408.04237","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:3743ee26003993ebf7c19c0e28f1b575c5c746d0fee928d797af95c77bca0723","observation_id":"600dca26-f865-498b-a58e-ab5ed498a0d3","resolution":{"observed_at":"2026-08-08T21:12:22.567591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.571980Z","title":"Llm-as-a-coauthor: Can mixed human-written and machine-generated text be detected? In Findings of the Association for Computational Linguistics: NAACL 2024 , pages 409–436, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.571980Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:f8fc19d8401071e37ee5b7fd1cf18992d0218e4fa25f1a6ea28459e33723f64f","observation_id":"4fea5176-f2b7-41e9-8515-2956d49ab8ef","resolution":{"observed_at":"2026-08-08T21:12:22.571980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04284","last_updated":"2025-03-14T11:52:30Z","snapshot_observed_at":"2026-07-06T18:58:18.051281Z","submitted_at":"2024-08-08T07:43:17Z","title":"LLM-DetectAIve: a Tool for Fine-Grained Machine-Generated Text Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04284","snapshot_observed_at":"2026-08-08T21:12:22.575914Z","title":"Llm-detectaive: a tool for fine-grained machine-generated text detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.575914Z"},"links":{"cited_paper":"/paper/2408.04284","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:b24d3c4def4e381acb45530d93260d893c163ca8f6ce13f01cfeaa88cf570e33","observation_id":"fda5103d-3f0e-4b42-9aa9-d6b999a77fba","resolution":{"observed_at":"2026-08-08T21:12:22.575914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04032","last_updated":"2025-03-17T12:05:36Z","snapshot_observed_at":"2026-08-09T20:13:53.423846Z","submitted_at":"2024-11-06T16:31:28Z","title":"Beemo: Benchmark of Expert-edited Machine-generated Outputs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04032","snapshot_observed_at":"2026-08-08T21:12:22.677752Z","title":"Beemo: Benchmark of expert-edited machine-generated outputs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.677752Z"},"links":{"cited_paper":"/paper/2411.04032","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:217ff2cba5794051dee224eaf1f9661e68ea25809a46721a6deb086489b1ffdb","observation_id":"57c0922e-fc10-404a-bffc-abb46d3fd55c","resolution":{"observed_at":"2026-08-08T21:12:22.677752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14259","last_updated":"2025-02-06T06:19:10Z","snapshot_observed_at":"2026-08-03T14:04:24.819943Z","submitted_at":"2024-10-18T08:14:10Z","title":"Beyond Binary: Towards Fine-Grained LLM-Generated Text Detection via Role Recognition and Involvement Measurement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14259","snapshot_observed_at":"2026-08-08T21:12:22.682394Z","title":"Beyond binary: Towards fine-grained llm-generated text detection via role recognition and involvement measurement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.682394Z"},"links":{"cited_paper":"/paper/2410.14259","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:23140b05f687bcdf1f1fbe6ec0c0f139f9bda62edb9a87f81e615d9896f0bf67","observation_id":"e20029ae-7054-41e4-8093-15d124e15a64","resolution":{"observed_at":"2026-08-08T21:12:22.682394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.686384Z","title":"A watermark for large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.686384Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:dd37405963f2efe8c17606f77183293ffefebc10a83ee4df4f35ebee33bff8de","observation_id":"a6912873-8a98-47dc-9611-81b9798a131b","resolution":{"observed_at":"2026-08-08T21:12:22.686384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.690453Z","title":"On the reliability of watermarks for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.690453Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:a40f353683d80929c158615cd12ec8e527ee12695da383199723d7476910545e","observation_id":"895b5a19-051f-4b66-8d5f-d2eb73ee560f","resolution":{"observed_at":"2026-08-08T21:12:22.690453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.694048Z","title":"Undetectable watermarks for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.694048Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:d86f74f143532f2711cb1cebd2b35cc83b6a070c073f765f3d3051a4a02c816f","observation_id":"15a9a157-5b84-4db3-8d8f-1a22975d70e1","resolution":{"observed_at":"2026-08-08T21:12:22.694048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.697583Z","title":"Provable robust watermarking for ai-generated text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.697583Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:a455025362c2aff2f9cc8985fe852174d23f790bd9e930dddae622c7bfc02b90","observation_id":"05444cb2-5196-4843-9fe1-67255f58c0d2","resolution":{"observed_at":"2026-08-08T21:12:22.697583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09739","last_updated":"2024-12-17T16:52:12Z","snapshot_observed_at":"2026-08-08T23:02:57.472467Z","submitted_at":"2024-09-15T14:10:01Z","title":"PersonaMark: Personalized LLM watermarking for model protection and user attribution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09739","snapshot_observed_at":"2026-08-08T21:12:22.701113Z","title":"Personamark: Personalized llm watermarking for model protection and user attribution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.701113Z"},"links":{"cited_paper":"/paper/2409.09739","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:39cc3d73196062fb5da3f7205aca3c6c265fb24f12d345f48ef0f41a7191c627","observation_id":"4fd8acf1-52b3-4a50-8063-13edfbb16be1","resolution":{"observed_at":"2026-08-08T21:12:22.701113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18259","last_updated":"2025-06-24T15:45:05Z","snapshot_observed_at":"2026-07-06T18:37:17.280637Z","submitted_at":"2024-06-26T11:11:47Z","title":"Detecting Machine-Generated Texts: Not Just \"AI vs Humans\" and Explainability is Complicated","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18259","snapshot_observed_at":"2026-08-08T21:12:22.704973Z","title":"ai vs humans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.704973Z"},"links":{"cited_paper":"/paper/2406.18259","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:6921d9c3454d199badfc398f5db4059aab3e0dcca56b0db3bd6ac3dfb019b411","observation_id":"1842f3d5-d893-4acd-bbb8-54b0b4be4569","resolution":{"observed_at":"2026-08-08T21:12:22.704973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23728","last_updated":"2026-04-14T14:22:50Z","snapshot_observed_at":"2026-08-01T23:52:01.112271Z","submitted_at":"2024-10-31T08:30:55Z","title":"GigaCheck: Detecting LLM-generated Content via Object-Centric Span Localization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23728","snapshot_observed_at":"2026-08-08T21:12:22.709359Z","title":"Gigacheck: Detecting llm-generated content","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.709359Z"},"links":{"cited_paper":"/paper/2410.23728","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:33a7d8beb6ac73f973ee5a8c6c0680a76d16151413d3f099b603f701b7a97dc2","observation_id":"53158559-7dc8-41ba-ace0-ba5a28d157e7","resolution":{"observed_at":"2026-08-08T21:12:22.709359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04178","last_updated":"2025-04-19T05:46:00Z","snapshot_observed_at":"2026-08-09T11:46:55.947071Z","submitted_at":"2024-02-06T17:31:36Z","title":"SHIELD : An Evaluation Benchmark for Face Spoofing and Forgery Detection with Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04178","snapshot_observed_at":"2026-08-08T21:12:22.714024Z","title":"Shield: An evaluation benchmark for face spoofing and forgery detection with multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.714024Z"},"links":{"cited_paper":"/paper/2402.04178","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:a71c8737115709b55ed4fbbdd7defd10e8418969a44297f4fdbb12cc1d8aae29","observation_id":"3e430203-9d05-406b-8f8f-ede864074d6c","resolution":{"observed_at":"2026-08-08T21:12:22.714024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.718375Z","title":"Can chatgpt detect deepfakes? a study of using multimodal large language models for media forensics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.718375Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:113551add8803fdf67e30146f8948faae73b24527ec76b41c511d2a843e55e36","observation_id":"252ba75c-58bc-463f-a97a-0e21c0945473","resolution":{"observed_at":"2026-08-08T21:12:22.718375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12806","last_updated":"2024-03-19T15:07:08Z","snapshot_observed_at":"2026-07-06T17:47:02.560132Z","submitted_at":"2024-03-19T15:07:08Z","title":"VisualCritic: Making LMMs Perceive Visual Quality Like Humans","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12806","snapshot_observed_at":"2026-08-08T21:12:22.722591Z","title":"Visualcritic: Making lmms perceive visual quality like humans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.722591Z"},"links":{"cited_paper":"/paper/2403.12806","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:d4bf7fc94ba5943c01869abb9adb2f30a81fd155159bbd8a770e4d4e15bea851","observation_id":"aa6b48a0-10f1-404c-a408-1cabdff20425","resolution":{"observed_at":"2026-08-08T21:12:22.722591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10238","last_updated":"2026-04-07T07:54:13Z","snapshot_observed_at":"2026-07-06T19:32:51.287674Z","submitted_at":"2024-10-14T07:56:51Z","title":"ForgeryGPT: A Multimodal LLM for Interpretable Image Forgery Detection and Localization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10238","snapshot_observed_at":"2026-08-08T21:12:22.726828Z","title":"Forgerygpt: Multimodal large language model for explainable image forgery detection and localization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.726828Z"},"links":{"cited_paper":"/paper/2410.10238","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:1dd2ddbd67a4829c060419847c3cc735f0dfdb6048177de0118a3e5a111aae4d","observation_id":"834a1b86-6ed8-4b6f-a782-bd0e157a72e0","resolution":{"observed_at":"2026-08-08T21:12:22.726828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03809","last_updated":"2024-12-05T02:05:33Z","snapshot_observed_at":"2026-07-06T20:01:54.557848Z","submitted_at":"2024-12-05T02:05:33Z","title":"EditScout: Locating Forged Regions from Diffusion-based Edited Images with Multimodal LLM","version":1},"cited_work":{"arxiv_id":"2412.03809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03809","snapshot_observed_at":"2026-08-08T21:12:25.162545Z","title":"EditScout: Locating Forged Regions from Diffusion-based Edited Images with Multimodal LLM","venue":"cs.CV","work_id":"6f1d0c70-d4c4-459b-a97c-21eae614e340","year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.731142Z"},"links":{"cited_paper":"/paper/2412.03809","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:ef1698870f9f13d76159fd8cde1b79eba96ac3af358e8ede705956e3f251350a","observation_id":"2d9c046d-3e90-4551-827c-fb6c54b8ae83","resolution":{"observed_at":"2026-08-08T21:12:25.167719Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06126","last_updated":"2025-05-29T03:20:42Z","snapshot_observed_at":"2026-08-09T09:24:04.744041Z","submitted_at":"2024-10-08T15:28:33Z","title":"X2-DFD: A framework for eXplainable and eXtendable Deepfake Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06126","snapshot_observed_at":"2026-08-08T21:12:22.735068Z","title":"X 2-DFD: A framework for e X plainable and e X tendable Deepfake Detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.735068Z"},"links":{"cited_paper":"/paper/2410.06126","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:4a37b3333dc8f2d1625e75677340e60ac47c2987e77ccc2bb2e0ce0e9ba250a0","observation_id":"bca85028-2868-439a-b263-cb89993d6008","resolution":{"observed_at":"2026-08-08T21:12:22.735068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10072","last_updated":"2024-11-21T14:37:25Z","snapshot_observed_at":"2026-08-09T09:24:32.055520Z","submitted_at":"2024-08-19T15:15:20Z","title":"FFAA: Multimodal Large Language Model based Explainable Open-World Face Forgery Analysis Assistant","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10072","snapshot_observed_at":"2026-08-08T21:12:22.739045Z","title":"Ffaa: Multimodal large language model based explainable open- world face forgery analysis assistant","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.739045Z"},"links":{"cited_paper":"/paper/2408.10072","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:587a62c8cbd7a2cec922575c03354a05c11cea58c85f9038ae51c875318b0369","observation_id":"6e1e105e-a98c-4012-a648-353467401110","resolution":{"observed_at":"2026-08-08T21:12:22.739045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02761","last_updated":"2025-04-12T08:08:04Z","snapshot_observed_at":"2026-08-09T09:23:59.595271Z","submitted_at":"2024-10-03T17:59:34Z","title":"FakeShield: Explainable Image Forgery Detection and Localization via Multi-modal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02761","snapshot_observed_at":"2026-08-08T21:12:22.743227Z","title":"Fakeshield: Explainable image forgery detection and localization via multi-modal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.743227Z"},"links":{"cited_paper":"/paper/2410.02761","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:a7089c18de71b0fd54997e23c15e5e6223373f0b1ad0387c7a3d6c3661023028","observation_id":"1f4f3d88-5d2f-4208-870f-2d5cd567ae5e","resolution":{"observed_at":"2026-08-08T21:12:22.743227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04292","last_updated":"2025-06-25T21:47:50Z","snapshot_observed_at":"2026-08-08T00:30:13.050953Z","submitted_at":"2024-12-05T16:12:25Z","title":"SIDA: Social Media Image Deepfake Detection, Localization and Explanation with Large Multimodal Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04292","snapshot_observed_at":"2026-08-08T21:12:22.747278Z","title":"Sida: Social media image deepfake detection, localization and explanation with large multimodal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.747278Z"},"links":{"cited_paper":"/paper/2412.04292","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:0e0c914d78030544b304000cdd8d9ec6e044752cf3e29a55e2aa9cd2046d24b3","observation_id":"cd488899-735a-4bb6-a1a4-644ef36e28e9","resolution":{"observed_at":"2026-08-08T21:12:22.747278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19685","last_updated":"2026-04-20T14:24:19Z","snapshot_observed_at":"2026-07-06T20:13:45.123960Z","submitted_at":"2024-12-27T15:23:39Z","title":"Generating Attribution Reports for Manipulated Facial Images: A Dataset and Baseline","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19685","snapshot_observed_at":"2026-08-08T21:12:22.751776Z","title":"A large-scale interpretable multi-modality benchmark for facial image forgery localization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.751776Z"},"links":{"cited_paper":"/paper/2412.19685","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:165626485c14fef0be933be6df0bc3a479e259fb9111204359526e7a63275f3a","observation_id":"a7fd9ee0-b7d6-4a13-bb98-1dd9330a54b5","resolution":{"observed_at":"2026-08-08T21:12:22.751776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.756275Z","title":"Forgerysleuth: Empowering multimodal large language models for image manipulation detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.756275Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:2c4f9a63ecaa92bd70a8ab641d590975a3ccedfbfb6d52d5ff235a98f14d9576","observation_id":"c3a0395e-5f0a-4820-86f6-3be69a506ff0","resolution":{"observed_at":"2026-08-08T21:12:22.756275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23623","last_updated":"2025-06-19T12:51:03Z","snapshot_observed_at":"2026-08-10T02:09:53.149437Z","submitted_at":"2024-10-31T04:20:47Z","title":"On Learning Multi-Modal Forgery Representation for Diffusion Generated Video Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23623","snapshot_observed_at":"2026-08-08T21:12:22.760504Z","title":"On learning multi-modal forgery representation for diffusion generated video detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.760504Z"},"links":{"cited_paper":"/paper/2410.23623","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:72f24cb1cb872431fbb5b489f0ea4dd8c4e506ba6f6c8cdc5324b4d2339c7739","observation_id":"9ac9fe25-38df-42ac-b3a2-0202d9c65f02","resolution":{"observed_at":"2026-08-08T21:12:22.760504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10326","last_updated":"2025-03-24T20:26:56Z","snapshot_observed_at":"2026-07-06T18:31:13.039726Z","submitted_at":"2024-06-14T17:59:01Z","title":"VANE-Bench: Video Anomaly Evaluation Benchmark for Conversational LMMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10326","snapshot_observed_at":"2026-08-08T21:12:22.765077Z","title":"Vane-bench: Video anomaly evaluation benchmark for conversational lmms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.765077Z"},"links":{"cited_paper":"/paper/2406.10326","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:18f8b6ffccaf1b8fa2fc83ea38a9435faa46f3f6df552d9ead8ca346f445298d","observation_id":"8d9df4eb-32ea-4b5e-b28e-f9dc0a3edb19","resolution":{"observed_at":"2026-08-08T21:12:22.765077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02411","last_updated":"2024-07-03T03:48:18Z","snapshot_observed_at":"2026-08-09T06:28:05.424441Z","submitted_at":"2024-07-02T16:34:14Z","title":"Video Watermarking: Safeguarding Your Video from (Unauthorized) Annotations by Video-based LLMs","version":2},"cited_work":{"arxiv_id":"2407.02411","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02411","snapshot_observed_at":"2026-08-08T21:12:24.808523Z","title":"Video Watermarking: Safeguarding Your Video from (Unauthorized) Annotations by Video-based LLMs","venue":"cs.CV","work_id":"aec80614-eb34-40ce-b8c7-77734e840a9f","year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.769455Z"},"links":{"cited_paper":"/paper/2407.02411","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c0b994fbfb861e8bbb9bf5a7ccf0178b79bd9b3fe90d6528a9e390384cb2bdbf","observation_id":"0643c725-c24b-416e-9c99-4358fa52cbeb","resolution":{"observed_at":"2026-08-08T21:12:24.813497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14080","last_updated":"2025-02-25T03:22:49Z","snapshot_observed_at":"2026-08-03T14:19:01.294128Z","submitted_at":"2024-08-26T08:02:57Z","title":"SONICS: Synthetic Or Not -- Identifying Counterfeit Songs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14080","snapshot_observed_at":"2026-08-08T21:12:22.774060Z","title":"Sonics: Synthetic or not–identifying counterfeit songs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.774060Z"},"links":{"cited_paper":"/paper/2408.14080","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:f4bf8378c86a118cee968aeca69085ad026aa11960c8c7b308c8f366d1ce5342","observation_id":"e72797f6-df93-4958-918b-e1975e647749","resolution":{"observed_at":"2026-08-08T21:12:22.774060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.778474Z","title":"Sniffer: Multimodal large language model for explainable out-of-context misin- formation detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.778474Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:5aea3c4aa461c6f7fdcea4f3b99e6c021bbc18a01e804a672826d945f2a62881","observation_id":"4f787bc6-4362-40fe-8795-7e39912ca20d","resolution":{"observed_at":"2026-08-08T21:12:22.778474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.782506Z","title":"Cheap-fake detection with llm using prompt engineering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.782506Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:5f9018b3f1d228d9954e74e8f9de6db19d6e21d16d0fa76311eea1bf7d3159a4","observation_id":"c7db6c9c-1b9a-40d7-9368-ac87816ce48c","resolution":{"observed_at":"2026-08-08T21:12:22.782506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09266","last_updated":"2024-11-14T08:07:02Z","snapshot_observed_at":"2026-08-09T13:53:04.690608Z","submitted_at":"2024-11-14T08:07:02Z","title":"How Good is ChatGPT at Audiovisual Deepfake Detection: A Comparative Study of ChatGPT, AI Models and Human Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09266","snapshot_observed_at":"2026-08-08T21:12:22.786308Z","title":"How good is chatgpt at audiovisual deepfake detection: A comparative study of chatgpt, ai models and human perception","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.786308Z"},"links":{"cited_paper":"/paper/2411.09266","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:114a84d3ca9bea1b0cde30f1ff0f7dd460b602ec5c4447735e41b8b617e3c11f","observation_id":"97905d3d-cbd7-4ae6-9066-5b59977b82b9","resolution":{"observed_at":"2026-08-08T21:12:22.786308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16824","last_updated":"2024-11-14T16:35:48Z","snapshot_observed_at":"2026-08-09T22:00:02.407086Z","submitted_at":"2024-04-25T17:59:45Z","title":"V2A-Mark: Versatile Deep Visual-Audio Watermarking for Manipulation Localization and Copyright Protection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16824","snapshot_observed_at":"2026-08-08T21:12:22.790237Z","title":"V2a-mark: Versatile deep visual-audio watermarking for manipulation localization and copyright protection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.790237Z"},"links":{"cited_paper":"/paper/2404.16824","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:998123935e4411b23b038673b0065586b989c686eeb43e9b0b8d5e9f29bb1be0","observation_id":"bf7d651e-b657-431c-a4fd-431e3d83cc28","resolution":{"observed_at":"2026-08-08T21:12:22.790237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.794355Z","title":"Three ways chatgpt helps me in my academic writing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.794355Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:3511f797ff0f919d140fe1f6fcc0c5c627dec5b2d1b2c4de04791b02c0eec7e1","observation_id":"62d549fc-cd53-41ab-a1cc-fb9cf99c0794","resolution":{"observed_at":"2026-08-08T21:12:22.794355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.798267Z","title":"Fake it till you make it: Curricular dynamic forgery augmentations towards general deepfake detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.798267Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c839ae7502678e2d98a2f06365467bdb4f01d629219cdf506b6b858581c6d71e","observation_id":"ce8183ab-c59e-45c5-bb1b-56443a489b21","resolution":{"observed_at":"2026-08-08T21:12:22.798267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-08T21:12:22.802431Z","title":"Videochat: Chat-centric video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.802431Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:8381ed59aecc44dfb7d8f4e668c05be3e89df27e899aac5b7e856f605d461c07","observation_id":"9573671c-4511-4233-b5bb-cc2db817550c","resolution":{"observed_at":"2026-08-08T21:12:22.802431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-08T21:12:22.806707Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.806707Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:498a282d2e86f32568a8078f6e83a7cdef7aae82c65e202642925db52d30cc65","observation_id":"ab54ac0d-ebe1-437f-8111-43b7e2ae88b5","resolution":{"observed_at":"2026-08-08T21:12:22.806707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-07-06T15:38:39.712379Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-08T21:12:22.811057Z","title":"Video-llama: An instruction- tuned audio-visual language model for video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.811057Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:174f90513e5b48aee57be4cf33d247e27ad09c45ebcd542771daa718678928a3","observation_id":"986a7053-ddd1-41f8-8517-e1156e916994","resolution":{"observed_at":"2026-08-08T21:12:22.811057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.815382Z","title":"What matters in detecting ai-generated videos like sora? arXiv preprint arXiv:2406.19568, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.815382Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:620f44025c9fe6ab6d5131367e362a8a41f2afd8af39f9c598af80743e0c0e70","observation_id":"1e4f4d40-a7a0-4150-9ea1-f9d8cf12088c","resolution":{"observed_at":"2026-08-08T21:12:22.815382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-08T21:12:22.819751Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.819751Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c244c59db6fe82f1dfe59fc4fe3129f8dd53dd2d4fc0f5921d06225ceb2dfc61","observation_id":"60d48127-c6c0-4ff8-8c5e-99d08bac4985","resolution":{"observed_at":"2026-08-08T21:12:22.819751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15704","last_updated":"2024-06-22T01:36:11Z","snapshot_observed_at":"2026-07-06T18:35:17.953523Z","submitted_at":"2024-06-22T01:36:11Z","title":"video-SALMONN: Speech-Enhanced Audio-Visual Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15704","snapshot_observed_at":"2026-08-08T21:12:22.824098Z","title":"video-salmonn: Speech-enhanced audio-visual large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.824098Z"},"links":{"cited_paper":"/paper/2406.15704","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:2d390626083457d1eb16f500a76c5fefb71f0f73c2432dbce9586e42cfdf567e","observation_id":"0584da7b-ea17-4e07-a9b1-c028c05681c0","resolution":{"observed_at":"2026-08-08T21:12:22.824098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.828379Z","title":"Fka-owl: Ad- vancing multimodal fake news detection through knowledge-augmented lvlms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.828379Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:7d902ebd8ac2c4b9c0f4eca035c67b94688eeb967cdbd1a3fd7ffe495cf9d44e","observation_id":"fb46dc72-e4a3-41da-b80e-96a982b89a7c","resolution":{"observed_at":"2026-08-08T21:12:22.828379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2309.03815","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:24.480731Z","title":"T2iw: Joint text to image & watermark generation","venue":null,"work_id":"a3e30be1-c48d-434a-916f-c0b9d519facf","year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.831878Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:d9a776b22dff1b599869c2925979e584c5301a80f79202e1e0e98d233ffc8506","observation_id":"5683646d-37ee-40d6-ad4c-8374e047db01","resolution":{"observed_at":"2026-08-08T21:12:24.488572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05863","last_updated":"2023-11-10T04:27:27Z","snapshot_observed_at":"2026-07-06T16:45:36.159896Z","submitted_at":"2023-11-10T04:27:27Z","title":"Watermarking Vision-Language Pre-trained Models for Multi-modal Embedding as a Service","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05863","snapshot_observed_at":"2026-08-08T21:12:22.835232Z","title":"Watermarking vision-language pre-trained models for multi-modal embedding as a service","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.835232Z"},"links":{"cited_paper":"/paper/2311.05863","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:0e1dae7c46b49e8a4b6323b61b66ff0fd98d4c1aaa2bce532cf1a875ca4107cb","observation_id":"d05f5801-5bab-4378-9a04-251f70e22827","resolution":{"observed_at":"2026-08-08T21:12:22.835232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20964","last_updated":"2024-10-28T12:34:49Z","snapshot_observed_at":"2026-08-02T19:56:32.150900Z","submitted_at":"2024-10-28T12:34:49Z","title":"DeTeCtive: Detecting AI-generated Text via Multi-Level Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20964","snapshot_observed_at":"2026-08-08T21:12:22.838957Z","title":"Detective: Detecting ai-generated text via multi-level contrastive learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.838957Z"},"links":{"cited_paper":"/paper/2410.20964","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:e6f25db070d573bce0b5d41e598207e83484e6b1787db6c5b62cb637a7d92646","observation_id":"de5c2dba-80bb-4b0b-b8cb-7c6e162512c5","resolution":{"observed_at":"2026-08-08T21:12:22.838957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:12:22.843020Z","title":"Detecting and unmasking ai-generated texts through explainable artificial intelligence using stylistic features","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.843020Z"},"links":{"citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c0d8d714c55dd897dbaa02832f2061c00aa3ddbfc33d22779d03daf4ebc9d200","observation_id":"972f170c-bae0-48d6-a6b3-e2f049642934","resolution":{"observed_at":"2026-08-08T21:12:22.843020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":201},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 201 outbound references and 3 inbound Pith citation observations for arXiv:2502.05240."}