{"as_of":"2026-08-10T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cb37d7a9289990ac28418cd394493acd35b9b498d7709a03ee03ab8655df4f5c","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:48:55.145079Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T19:51:45.257204Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07045","snapshot_observed_at":"2026-07-13T19:51:45.257204Z","title":"Interpretable and reliable detection of ai-generated images via grounded rea- soning in mllms.arXiv preprint arXiv:2506.07045, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.23115","last_updated":"2026-07-03T11:05:22Z","snapshot_observed_at":"2026-08-09T00:00:13.011780Z","submitted_at":"2026-03-24T12:10:21Z","title":"AgentFoX: LLM Agent-Guided Fusion with eXplainability for AI-Generated Image Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T19:51:45.257204Z"},"links":{"cited_paper":"/paper/2506.07045","citing_paper":"/paper/2603.23115"},"observation_digest":"sha256:09fca41db8956cce282cab9b30a36b50146c4cbc558838c54df3f35f610a0e65","observation_id":"58107120-92a3-49ae-9527-a2a7309da508","resolution":{"observed_at":"2026-07-13T19:51:45.257204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07045","snapshot_observed_at":"2026-07-12T01:35:43.979206Z","title":"Interpretable and reliable detection of ai-generated images via grounded reasoning in mllms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03562","last_updated":"2026-07-03T18:52:42Z","snapshot_observed_at":"2026-08-07T06:14:13.409347Z","submitted_at":"2026-07-03T18:52:42Z","title":"XPlainVerse: A Million-Scale Benchmark for Explainable Deepfake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T01:35:43.979206Z"},"links":{"cited_paper":"/paper/2506.07045","citing_paper":"/paper/2607.03562"},"observation_digest":"sha256:ddc0abff3f313be3471d8cf0f6fc2041bb9a7b5c5e7dfce6b0be7d21d6541c37","observation_id":"a3c20b4e-4204-443f-9e34-d6ec153f28b3","resolution":{"observed_at":"2026-07-12T01:35:43.979206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07045/citation-record","integrity":"/paper/2506.07045/integrity","json":"/paper/2506.07045/citation-record.json","paper":"/paper/2506.07045"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:01.071700Z","title":null,"venue":null,"work_id":"b22d6146-b6b6-4ec5-a9e3-7737dbd3000b","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:46.896334Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7745801f5da88c2dd9c135078633d1608d9e2086b4a69f3652b590459ac9596b","observation_id":"0e7f8d76-f94f-4b44-a366-0d0f1e6f9a30","resolution":{"observed_at":"2026-08-07T05:49:01.237310Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:00.822458Z","title":"Large scale gan training for high fidelity natural image synthesis","venue":null,"work_id":"5c796c73-7947-482a-92c7-d7667fd97f46","year":2018},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:46.976297Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7d9d4e3c21ac1aae717b8e03ed495d7c30a26f871f860b6256b330521ae4ea93","observation_id":"803ed133-5c58-4336-8a44-e4218c5fc407","resolution":{"observed_at":"2026-08-07T05:49:00.923211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.082915Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.082915Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:890d288c97a026c4178b7fb5b9bf7c97ae84143233198287eba3969ac058ca87","observation_id":"4501467c-2486-4752-84fd-d6f2756acb2c","resolution":{"observed_at":"2026-08-07T05:48:47.082915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17419","last_updated":"2024-08-21T07:42:02Z","snapshot_observed_at":"2026-08-10T13:10:30.108502Z","submitted_at":"2023-10-26T14:23:45Z","title":"AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17419","snapshot_observed_at":"2026-08-07T05:48:47.230080Z","title":"Antifakeprompt: Prompt-tuned vision-language models are fake image detectors.arXiv preprint arXiv:2310.17419, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.230080Z"},"links":{"cited_paper":"/paper/2310.17419","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:6119bc2be7d8eadb93c2a2d7758a1bc7c9403e79578a065cb0bd00445a3ae308","observation_id":"3ac597b2-829e-4ef9-8e22-aced466b0b71","resolution":{"observed_at":"2026-08-07T05:48:47.230080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.309056Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.309056Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:f97c396e5282707451e5a131c40126614babac400ab1a6906d376b4bb9fec1b7","observation_id":"db06f4aa-8502-47bb-bccb-3ebffdae7e1d","resolution":{"observed_at":"2026-08-07T05:48:47.309056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05252","last_updated":"2024-01-10T16:27:38Z","snapshot_observed_at":"2026-08-07T04:04:46.527670Z","submitted_at":"2024-01-10T16:27:38Z","title":"PIXART-{\\delta}: Fast and Controllable Image Generation with Latent Consistency Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05252","snapshot_observed_at":"2026-08-07T05:48:47.478787Z","title":"Pixart- δ: Fast and controllable image generation with latent consistency models.arXiv preprint arXiv:2401.05252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.478787Z"},"links":{"cited_paper":"/paper/2401.05252","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:175e67616a4cf00a5311ede35c6a1baca6478c61162f9f0ae56cc1851be4ef99","observation_id":"7176906a-fefb-496f-9ea7-56624645777b","resolution":{"observed_at":"2026-08-07T05:48:47.478787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-07T05:48:47.617304Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis.arXiv preprint arXiv:2310.00426, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.617304Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:99fc6fd2404b1bd550a041474843424a1b1e6e8a756e2b7bb5ca162c44611b99","observation_id":"95014658-ac33-4506-81cf-a8d27fed04e4","resolution":{"observed_at":"2026-08-07T05:48:47.617304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.708166Z","title":"R1-v: Reinforcing super generaliza- tion ability in vision-language models with less than $3.https://github.com/Deep-Agent/ R1-V, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.708166Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b1c02f26f7e196ecf3d0f8877015915323fc4dbbdbb51a78b00b19072d507399","observation_id":"d4efb5d2-1349-4dee-8bcb-eae3e34bd7bb","resolution":{"observed_at":"2026-08-07T05:48:47.708166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.823145Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.823145Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:550aedd33093f0b19a32292c715cc4a7651c69af03205354c722ade6f985bd31","observation_id":"95898ec4-0fc4-433d-9510-367969ddd549","resolution":{"observed_at":"2026-08-07T05:48:47.823145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:47.965152Z","title":"On the detection of synthetic images generated by diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:47.965152Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:33f4a2aa76a1f7772cf0c5db9685cfd490f4c51227d897931c427a289229e2bd","observation_id":"f1e7c8f3-2bb6-4ed3-84f8-a8b4e4684b7c","resolution":{"observed_at":"2026-08-07T05:48:47.965152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:48.112032Z","title":"Li, and Li Fei-Fei","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.112032Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:a5d7efd70efea33b938e9e32799dd41a100ae3dea5b59b93cb06b79222404a39","observation_id":"8fda4d6e-c16c-42f2-99a3-19ef0403c29d","resolution":{"observed_at":"2026-08-07T05:48:48.112032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:00.480276Z","title":"Witherden","venue":null,"work_id":"76f6364b-7584-4724-9060-efd8964bece6","year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.191309Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:631bf7d705f5c8d04ef323a0b6dcda3df29463868207b4156c771806972d4426","observation_id":"39713f27-1e7a-4841-83ad-08f4a3c2e7dd","resolution":{"observed_at":"2026-08-07T05:49:00.592051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:48.307060Z","title":"Scaling rectified flow transformers for high-resolution image synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.307060Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:a11c033d3fe7937721d94541864572650562c81bf849fca8405a60a6b4c3cb08","observation_id":"ae43a7da-127d-48e9-a3ab-9f95a0978857","resolution":{"observed_at":"2026-08-07T05:48:48.307060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:49:00.222794Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"c8011073-424b-4b33-9f7d-b9e984a60bee","year":2021},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.425709Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:05f3ab96dd010e6fd66910d8247468bdefd4e2057eb13299a5000321ba387875","observation_id":"e38691b6-2ff7-4c8a-8a32-70639c23e7ab","resolution":{"observed_at":"2026-08-07T05:49:00.341701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:48.576729Z","title":"Leveraging frequency analysis for deep fake image recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.576729Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ef7d3125323a14580a8d065772017756fc8587e35ea64768e5a5c640514fc202","observation_id":"0d0e1d5f-32ed-498b-b680-09cbeb5cfaee","resolution":{"observed_at":"2026-08-07T05:48:48.576729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:59.912553Z","title":null,"venue":null,"work_id":"88288739-3cfd-472e-b334-ca5489742b38","year":2014},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.666386Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:0d812b3640c8a8af2bf6daedd9e4b4a58276107b3e010de775efc06a6bd548f7","observation_id":"b4a016f9-8ab7-43d4-b2a1-5199f50c0867","resolution":{"observed_at":"2026-08-07T05:49:00.038427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17608","last_updated":"2024-03-28T15:24:16Z","snapshot_observed_at":"2026-08-07T20:37:57.699159Z","submitted_at":"2024-03-26T11:39:00Z","title":"Fake or JPEG? Revealing Common Biases in Generated Image Detection Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17608","snapshot_observed_at":"2026-08-07T05:48:48.823747Z","title":"Fake or jpeg? revealing common biases in generated image detection datasets.ArXiv, abs/2403.17608, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.823747Z"},"links":{"cited_paper":"/paper/2403.17608","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:d372a31aeb610afb6010a6c066cc82dff2de3c40a875c193f9f2a342d5f18e65","observation_id":"c627ae84-6a6d-4690-a634-6068160aae11","resolution":{"observed_at":"2026-08-07T05:48:48.823747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:59.624252Z","title":"Vector quantized diffusion model for text-to-image synthesis","venue":null,"work_id":"0f8a4309-28d7-4dfc-b2b9-85a139040f07","year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:48.939780Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:8cb7a0aed201e45a8d22ca9f0fa51e003065c1346de9245dd7fa18f33e4d3b64","observation_id":"c5733705-d799-4d65-94d4-5917ff8b4c85","resolution":{"observed_at":"2026-08-07T05:48:59.744518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:48:49.090609Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.090609Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b81a5dd426d6c629ac05e3b6cc4e76ef320d1d9f53543423e13105466e8db860","observation_id":"772af3bd-20b0-4bc5-9b4e-17ffa5d60199","resolution":{"observed_at":"2026-08-07T05:48:49.090609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-10T00:43:25.712379Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-07T05:48:49.163590Z","title":"Infinity: Scaling bitwise autoregressive modeling for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.163590Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b183af984b9d5cbdd04c8d31d6dd47663f20f60b99cb30bc6a9999933cea879d","observation_id":"b9dd8cd8-0564-4a0f-a727-4bedf20e389b","resolution":{"observed_at":"2026-08-07T05:48:49.163590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-07T05:48:49.310253Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.310253Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:5c2d105c76877b825e2971d0bc7fad3aedbb360776314b3829acd8f2c914753e","observation_id":"3331b2a9-7ba8-484e-aa06-82f4db5dc329","resolution":{"observed_at":"2026-08-07T05:48:49.310253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T05:48:49.400643Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models.arXiv preprint arXiv:2503.06749, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.400643Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:c2dc45d712db9ab33d55baa0028fb966548aa6a49051e6d7ca6bc5a71e7f5735","observation_id":"48441d9a-76fc-44e2-a92a-af8794007c85","resolution":{"observed_at":"2026-08-07T05:48:49.400643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T05:48:49.500083Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.500083Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:716cfcb311e07956ba7168c4e2f611be022ffe65d51f3231bad0dfab2f8536f6","observation_id":"8746c636-0c81-4f9d-a86c-4920d717200c","resolution":{"observed_at":"2026-08-07T05:48:49.500083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00703","last_updated":"2025-07-01T11:46:57Z","snapshot_observed_at":"2026-08-07T20:35:00.460457Z","submitted_at":"2025-05-01T17:59:46Z","title":"T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00703","snapshot_observed_at":"2026-08-07T05:48:49.635302Z","title":"T2i-r1: Reinforcing image generation with collaborative semantic-level and token-level cot.arXiv preprint arXiv:2505.00703, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.635302Z"},"links":{"cited_paper":"/paper/2505.00703","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:58a78394e4fb782b5e627992b27e819333e6282e7bc3dd03e9c48002ce819ac4","observation_id":"f8cfe678-9952-47c6-8012-f97e01aa4c3f","resolution":{"observed_at":"2026-08-07T05:48:49.635302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:59.328318Z","title":"A style-based generator architecture for generative adversarial networks.2019 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 4396–4405, 2018","venue":null,"work_id":"17e0dcbd-3be9-4672-bd47-f723f27e4154","year":2019},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.780433Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7e44c7d7a936a5e808363c371c79223d9b263fa9e8006378c86046326a862da2","observation_id":"2c20a2d8-01bc-4ab9-86a4-ea0b8fc6d9ee","resolution":{"observed_at":"2026-08-07T05:48:59.482972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:49.885343Z","title":"Flux.https://github.com/black-forest-labs/flux, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:49.885343Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:b42862c19958cb3c6e4399c3a1e78e92f03668a60a37a283342fabf4371b87b1","observation_id":"7d6f2faa-3b59-4dfc-808a-3e105841c2b3","resolution":{"observed_at":"2026-08-07T05:48:49.885343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13306","last_updated":"2024-09-08T12:07:52Z","snapshot_observed_at":"2026-08-07T20:34:56.945035Z","submitted_at":"2024-04-20T07:28:55Z","title":"FakeBench: Probing Explainable Fake Image Detection via Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13306","snapshot_observed_at":"2026-08-07T05:48:50.004906Z","title":"Fakebench: Uncover the achilles’ heels of fake images with large multimodal models.ArXiv, abs/2404.13306, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.004906Z"},"links":{"cited_paper":"/paper/2404.13306","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:3b3735de2566ed11cb86fceac7200f36722b32f9f97685d1990d161bf63f379c","observation_id":"581d1329-37cd-4107-8be0-da8572df8ebf","resolution":{"observed_at":"2026-08-07T05:48:50.004906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.971554Z","title":null,"venue":null,"work_id":"1070aaec-a6b2-4358-a1fb-a43252a9138a","year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.144099Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:36ad48957eb0f2924fba00daf8fe573cfd0c885905cc76fbf7fc19f20e13e8d2","observation_id":"fe6721fe-3541-4b89-b4cd-deacd7399960","resolution":{"observed_at":"2026-08-07T05:48:59.146228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.678798Z","title":null,"venue":null,"work_id":"885ea03d-5d11-4ba1-a00d-77b36048137c","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.230279Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:34d42b8af449e06639297ed022bbfcd45f03901e0ae215f2ac8c144eb3584994","observation_id":"c28363fa-ba59-4d2b-8d3c-a040c7f15fc3","resolution":{"observed_at":"2026-08-07T05:48:58.817762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.402758Z","title":"Midjourney, 2023","venue":null,"work_id":"48a6b894-f27e-4530-a04f-dd7cda0bed98","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.337405Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ecce73566b64d171c20c3cda0d0c1d2a5aab3124d61e0a08e7f2e331d1421e8c","observation_id":"cb7e5213-8ff5-4313-9378-fdbe5e3da131","resolution":{"observed_at":"2026-08-07T05:48:58.490226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-07T05:48:50.449342Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.449342Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:43073dffb72e966fd4e2538ec1fd5a2dc97e1be134068a796ccf8b5112253588","observation_id":"11a71384-23b1-4a1c-8cc7-25c3ce55430c","resolution":{"observed_at":"2026-08-07T05:48:50.449342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:58.128270Z","title":"Towards universal fake image detectors that generalize across generative models.2023 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 24480–24489, 2023","venue":null,"work_id":"01a660f1-fc61-4986-a551-81e873ef6e64","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.585700Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:6005a7dab2322672d6c198c4913ff2819cd4a67e8230ff2791f9af9599c62a33","observation_id":"6d49cb2a-fd81-4305-a838-a30531a11118","resolution":{"observed_at":"2026-08-07T05:48:58.279120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.929531Z","title":"Dall·e 3 system card, 2023","venue":null,"work_id":"cd9fd00c-9af3-4967-85e1-28bfeeeb5a52","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.690226Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:9492042f52ce99fe049f1c2244dd8dbfbcc330b27f66d5fbf04cb6f17b3376da","observation_id":"70fd46fc-2543-4fe2-b18a-c314c456dd73","resolution":{"observed_at":"2026-08-07T05:48:58.014290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.662571Z","title":"Introducing 4o image generation, Mar 2025","venue":null,"work_id":"d41b423f-005d-4848-b108-0bf958a09135","year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.819887Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:521c70f7ffc558850616a533e40c1b06d2935846d561631b76151b156753f3a5","observation_id":"6244c030-da6a-4d4c-83b2-81c53d7c81f3","resolution":{"observed_at":"2026-08-07T05:48:57.840329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:50.955102Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:50.955102Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:a179f4962fff5ef89b0dc76dd2cba387ce8919209af0aa98992db0f080f7ce8f","observation_id":"8f5a04ac-0987-46c5-80d8-e87cd012a2e5","resolution":{"observed_at":"2026-08-07T05:48:50.955102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-07T05:48:51.106955Z","title":"Medvlm-r1: Incentivizing medical reasoning capability of vision-language models (vlms) via reinforcement learning.arXiv preprint arXiv:2502.19634, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.106955Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:77b2f0cdf94f01dd60c06739dae9dfa1d958b98fe8a1ca0b3ffc3edd15c4da2d","observation_id":"04b3b00c-b072-4a79-9734-767ad16a5a2c","resolution":{"observed_at":"2026-08-07T05:48:51.106955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.447290Z","title":"Community forensics: Using thousands of generators to train fake image detectors, 2024","venue":null,"work_id":"6b6b45c7-a275-4822-adca-65635f48c5b0","year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.249174Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ca746e23365152c40b595a826493ca963abf820cd818543701aee420f791e64c","observation_id":"41ab725f-d6d2-4d24-bdf7-07f5f05ca2f1","resolution":{"observed_at":"2026-08-07T05:48:57.547665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:51.373781Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.373781Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:fa50eec9c9032fc490663c0438103264cbf254e4dd3c4c1e88e205143e4c4ea7","observation_id":"0567dd4b-b0e8-429a-b921-f4c965670d52","resolution":{"observed_at":"2026-08-07T05:48:51.373781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T05:48:51.514329Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl.arXiv preprint arXiv:2503.07536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.514329Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:f5fa8d4790dac4e92417863b989208956c813d680257a34fed1d4e852ade5d12","observation_id":"ea4d3ae2-260f-47cd-a298-c91581a5d099","resolution":{"observed_at":"2026-08-07T05:48:51.514329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:51.636135Z","title":"Qwen2.5-vl, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.636135Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:ad62a93d7b0edaf612563ae5c3de1545db2ceff68ac95c9a5415dd1d196b27ef","observation_id":"036a4fa0-38bc-4bcd-a2e1-03361296afbc","resolution":{"observed_at":"2026-08-07T05:48:51.636135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T05:48:51.752372Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.752372Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:4f2112839953885461b4782e4498c04052792cad043030fc6c67196fdddd4dc2","observation_id":"3bee05a3-5f7a-4c42-a890-a080ce2b6ce4","resolution":{"observed_at":"2026-08-07T05:48:51.752372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:57.147256Z","title":"Rapidata openai 4o preference, Mar 2025","venue":null,"work_id":"f580302d-3287-42f2-98be-709fa9768fc7","year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.867586Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:e1f6fba48149538562d3743cccadf1914eb8950ec92ac671aab88f567189a18e","observation_id":"5a4cfdbc-4fa5-4024-8de3-304dc0f17d93","resolution":{"observed_at":"2026-08-07T05:48:57.262378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.911277Z","title":null,"venue":null,"work_id":"7bae343b-78d2-4e23-ba85-4ecbb7e80105","year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:51.996273Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:3c97157ac4548cc934677db6359e84d234679d5f6a64daa5af0a2583eeb2f35b","observation_id":"9069a64d-d0b9-422c-8785-73cfac203fcb","resolution":{"observed_at":"2026-08-07T05:48:57.019915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:52.246543Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.246543Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:d92da05d4089e88e35b82d55ff37074a77c80f8c516c4baf5656290bd3f9325c","observation_id":"8e3322b7-803e-4288-87c0-52a0c6746e25","resolution":{"observed_at":"2026-08-07T05:48:52.246543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.637876Z","title":"FaceForensics++: Learning to detect manipulated facial images","venue":null,"work_id":"dd514773-5339-42b4-b4a6-b4e899719dc5","year":2019},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.364865Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:c027499cd59dd568a655ced43bbdeb13f0afe14bb823f0c0dd1c15319ddfe19a","observation_id":"b42a3a56-990c-49bd-96c5-c26fab66c890","resolution":{"observed_at":"2026-08-07T05:48:56.739978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:52.519229Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in Neural Information Processing Systems, 35:36479–36494, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.519229Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:8a763d23b65e0552cf22889402ed7637da1b781f3c624620eae7caba9a3e4746","observation_id":"b4bdfadc-0be5-48c3-a2b4-d9ffefec4e29","resolution":{"observed_at":"2026-08-07T05:48:52.519229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.418426Z","title":"Selvaraju, Michael Cogswell, Abhishek Das, Ramakrishna Vedantam, Devi Parikh, and Dhruv Batra","venue":null,"work_id":"b0a4fde7-dc6b-4258-ab16-3c631c557ce8","year":2017},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.635706Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:82f29aa7a8bdf9b28358e808e6e5d4215630cdeff3c11e00daf3dec1712ec22f","observation_id":"50934704-7f11-4a33-a645-7069c477362b","resolution":{"observed_at":"2026-08-07T05:48:56.529751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:48:52.739165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.739165Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:aa4030a81505bee0c8a4d7f5b59791f7eb72bc471f0a24798703aa86dc8b2622","observation_id":"ef605562-9d20-4cea-adc2-958f60edb5f4","resolution":{"observed_at":"2026-08-07T05:48:52.739165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-08-08T20:11:45.308315Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-07T05:48:52.835129Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model.arXiv preprint arXiv:2504.07615, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.835129Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:f08df99e1cbe9692a84806e017c7725a5666d7b7e7fcd251a88029eb6239d7a5","observation_id":"7f41f5c8-a783-4870-a1a8-35f6ea756aff","resolution":{"observed_at":"2026-08-07T05:48:52.835129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-07-06T03:31:30.452356Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-08-07T05:48:52.935967Z","title":"Deep inside convolutional networks: Visualising image classification models and saliency maps.CoRR, abs/1312.6034, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:52.935967Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:d9f74716c11ae03ce92289fc156b321d020554c34a5a4882d1ab4249262896b1","observation_id":"3fdfd517-3cf0-4e12-98c9-dd7271710d31","resolution":{"observed_at":"2026-08-07T05:48:52.935967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T05:48:53.041425Z","title":"Denoising diffusion implicit models.ArXiv, abs/2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.041425Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:66499e4b4562ada297b0fcff0eeb13266f3dcc2ab0d1c0b4d91c73be7307dacd","observation_id":"f02bd0a1-16bb-487d-b07c-803ca65569e4","resolution":{"observed_at":"2026-08-07T05:48:53.041425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T05:48:53.184151Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.184151Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:901b0da7ca2a413de217cf66486d4bb72753ddc3cc22e92350abcad0b4296155","observation_id":"cf0e2900-bde2-45ff-ba06-6eb85915a682","resolution":{"observed_at":"2026-08-07T05:48:53.184151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.249874Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":"d70c0186-b9a1-4f1b-90f4-a8629e0e35b0","year":2017},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.324987Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:4e530a207d28f4b330d6a500d57ab950d6fd82e7dc9c97424960c3bc88083a7a","observation_id":"35060b25-8ffb-42d1-a720-756a33f7dab4","resolution":{"observed_at":"2026-08-07T05:48:56.308422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11946","last_updated":"2020-09-11T05:08:01Z","snapshot_observed_at":"2026-08-06T22:36:56.473526Z","submitted_at":"2019-05-28T17:05:32Z","title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.11946","snapshot_observed_at":"2026-08-07T05:48:53.454345Z","title":null,"venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.454345Z"},"links":{"cited_paper":"/paper/1905.11946","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:4d4b2ba613a649555245129726f12da69a9323a75d2c3db09c7fc0d724b8a00c","observation_id":"8a093ee3-ee65-4fdf-8528-ce90f5a08efe","resolution":{"observed_at":"2026-08-07T05:48:53.454345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:56.088369Z","title":"Galip: Generative adversarial clips for text-to-image synthesis","venue":null,"work_id":"ac28f6af-faac-42f4-9525-350d2225e7a9","year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.588159Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:6ad0edb738a91d7821e8623901386fb6e5acfd379db0189d0f92b1d9c19a658e","observation_id":"cb0e83bd-2e69-4a4b-8dc3-4db9c942bfc2","resolution":{"observed_at":"2026-08-07T05:48:56.142569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:53.682291Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction.Advances in neural information processing systems, 37:84839–84865, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.682291Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:cf3e7e5577ee9e0bac18aa219c85c716d5b8cfde705976e3f7e9b64b05965535","observation_id":"27ab6bfe-108a-474e-af38-98c75799394e","resolution":{"observed_at":"2026-08-07T05:48:53.682291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:53.797233Z","title":"Neural discrete representation learning.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.797233Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:7f836a3823a473e7b1ca9762487be8ecdebd50207a766ef856e3766b69039147","observation_id":"9165d7d7-7170-488d-aabb-8e0ba2ffba10","resolution":{"observed_at":"2026-08-07T05:48:53.797233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-07T05:48:53.929107Z","title":"Vl- rethinker: Incentivizing self-reflection of vision-language models with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:53.929107Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:5c809102eb98a9f9b350704e708f3332bf717acd40975cc8332b378395a4601b","observation_id":"e5ef4c12-43f8-4160-9034-7a2fe3057d22","resolution":{"observed_at":"2026-08-07T05:48:53.929107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:55.946138Z","title":"Objectformer for image manipulation detection and localization","venue":null,"work_id":"5df71e8c-1cb1-40d2-9281-266926bf0bce","year":2022},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.057267Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:2ba719297c42a72ea549327e7350ac7514490d37f518553e0a01f67a16a7ecc2","observation_id":"b9c2cce1-18f5-4bcd-bbaa-83f297ab0191","resolution":{"observed_at":"2026-08-07T05:48:55.996473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T05:48:54.134553Z","title":"Qwen2-vl: Enhancing vision- language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.134553Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:423a14fba8f864b0be65b076a99102cf2958f15ede46edb6d3b04530b24fc2f2","observation_id":"721ae601-ec48-4c43-8434-5c0e0d0e68a1","resolution":{"observed_at":"2026-08-07T05:48:54.134553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:54.203270Z","title":"Cnn- generated images are surprisingly easy to spot","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.203270Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:0cd881969122bb3bb005141ae63afe7ff9df7f9605d4b9e0c1c9841cc0410099","observation_id":"b4dc13ff-6422-4a7c-b142-6dcdabbf60b4","resolution":{"observed_at":"2026-08-07T05:48:54.203270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:54.348033Z","title":"Dire for diffusion-generated image detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.348033Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:35d975aaecf2863debbaff765fa52ffed47682357b525380189cd6d0a940449f","observation_id":"67d4c699-1623-44f4-b2b0-3a5e4d881b44","resolution":{"observed_at":"2026-08-07T05:48:54.348033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:54.453592Z","title":"Fast-slow thinking for large vision-language model reasoning.arXiv preprint arXiv:2504.18458, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.453592Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:3f07cc2a8900839323d83bd11e7e9f4c7b98c299c246e5fcb56666168391a6e2","observation_id":"3f8897c8-3c31-4f32-8a2d-e0cc3e02ea8b","resolution":{"observed_at":"2026-08-07T05:48:54.453592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:55.723662Z","title":"Segformer: Simple and efficient design for semantic segmentation with transformers","venue":null,"work_id":"be5689aa-114a-4f89-901f-9b1219d08a02","year":2021},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.590355Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:cae2ffb24d04b75015f6022dcf109fe6cfe885dceaa617db453e0679542e3dd4","observation_id":"3b06c47f-d3be-4171-951b-60878842d293","resolution":{"observed_at":"2026-08-07T05:48:55.814632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T05:48:54.733441Z","title":"R1-onevision: Advancing generalized multimodal reasoning through cross-modal formalization.arXiv preprint arXiv:2503.10615, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.733441Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:d4c8dc69d51478aaaac0ea74c7973c6892c119da759fd402d61e79058b11e2e8","observation_id":"a8bfaf4e-1672-4d46-b297-4a163a4f8466","resolution":{"observed_at":"2026-08-07T05:48:54.733441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03070","last_updated":"2025-02-07T04:20:54Z","snapshot_observed_at":"2026-08-09T07:56:07.703202Z","submitted_at":"2024-06-05T08:55:02Z","title":"A-Bench: Are LMMs Masters at Evaluating AI-generated Images?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03070","snapshot_observed_at":"2026-08-07T05:48:54.850810Z","title":"A-bench: Are lmms masters at evaluating ai-generated images?arXiv preprint arXiv:2406.03070, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:54.850810Z"},"links":{"cited_paper":"/paper/2406.03070","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:9ebb25150efac8f61c4051ede914addcc98584f16e81db35a57ac7798afacfe5","observation_id":"354205a5-d3e9-423a-9aeb-e0e6f77dfbc6","resolution":{"observed_at":"2026-08-07T05:48:54.850810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:55.023878Z","title":"Swift: a scalable lightweight infrastructure for fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:55.023878Z"},"links":{"citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:0068b27f212f76487d4b43c12aa24166d59b927c41132ecfbd46f9a616776ce3","observation_id":"cf516f23-fc17-4eb7-a91a-500d0b8a3847","resolution":{"observed_at":"2026-08-07T05:48:55.023878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-07-06T20:48:18.268075Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-07T05:48:55.145079Z","title":"aha moment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:55.145079Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2506.07045"},"observation_digest":"sha256:33285da056a491590eda7596efc810f7c322750bdc2fbe0795053a007b3cb2f1","observation_id":"dafa2d1b-efdb-4b0b-a124-67545590b87d","resolution":{"observed_at":"2026-08-07T05:48:55.145079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07045","last_updated":"2025-06-08T08:47:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T04:01:39.358871Z","submitted_at":"2025-06-08T08:47:44Z","title":"Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 2 inbound Pith citation observations for arXiv:2506.07045."}