{"as_of":"2026-08-13T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6cae5b1f1d073a0e8e609872d2acb2935bc243341a59d70f19e91f43bc8422e","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:54:24.217254Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:09:21.328170Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T11:18:03.426147Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13842","snapshot_observed_at":"2026-08-04T20:09:21.328170Z","title":"De- tecting human artifacts from text-to-image models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.328170Z"},"links":{"cited_paper":"/paper/2411.13842","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:1cce257727af385641675b56bdd5086f2cfccc15233e6d9c6993a5f0c46fb182","observation_id":"9251db26-5f69-485c-93b2-5001711ac351","resolution":{"observed_at":"2026-08-04T20:09:21.328170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"cited_work":{"arxiv_id":"2411.13842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.13842","snapshot_observed_at":"2026-07-03T11:18:03.426147Z","title":"Detecting human artifacts from text-to- image models","venue":null,"work_id":"98d37608-ab40-4a71-b41c-5394194a5a78","year":2024},"citing_paper":{"arxiv_id":"2604.20157","last_updated":"2026-04-22T03:51:19Z","snapshot_observed_at":"2026-08-13T03:25:52.592184Z","submitted_at":"2026-04-22T03:51:19Z","title":"HumanScore: Benchmarking Human Motions in Generated Videos","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T01:17:16.513512Z"},"links":{"cited_paper":"/paper/2411.13842","citing_paper":"/paper/2604.20157"},"observation_digest":"sha256:6e8655208ca257bcec7873b5a35ce7b213ab95b36fa88a59a969f7b3b24c90e5","observation_id":"f9c8e51d-6cb1-4696-b214-ea90b9ed4141","resolution":{"observed_at":"2026-05-11T13:41:04.519757Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"cited_work":{"arxiv_id":"2411.13842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.13842","snapshot_observed_at":"2026-07-03T11:18:03.426147Z","title":"Detecting human artifacts from text-to- image models","venue":null,"work_id":"98d37608-ab40-4a71-b41c-5394194a5a78","year":2024},"citing_paper":{"arxiv_id":"2605.09296","last_updated":"2026-05-10T03:44:09Z","snapshot_observed_at":"2026-08-10T22:27:26.072474Z","submitted_at":"2026-05-10T03:44:09Z","title":"Micro-Defects Expose Macro-Fakes: Detecting AI-Generated Images via Local Distributional Shifts","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T04:30:55.547341Z"},"links":{"cited_paper":"/paper/2411.13842","citing_paper":"/paper/2605.09296"},"observation_digest":"sha256:7d401f9543e14b0a8b36d3068dae7c9100e62935940873abf08a18b3eed4cee3","observation_id":"446f64fc-ce31-42e0-9007-e51739ce6bd2","resolution":{"observed_at":"2026-05-12T06:11:25.004257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"cited_work":{"arxiv_id":"2411.13842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.13842","snapshot_observed_at":"2026-07-03T11:18:03.426147Z","title":"Detecting human artifacts from text-to- image models","venue":null,"work_id":"98d37608-ab40-4a71-b41c-5394194a5a78","year":2024},"citing_paper":{"arxiv_id":"2606.12671","last_updated":"2026-06-10T20:55:50Z","snapshot_observed_at":"2026-08-03T13:34:05.984169Z","submitted_at":"2026-06-10T20:55:50Z","title":"SalArt-VQA: Diagnosing Whether VLMs Understand Salient Artifacts in Generated Images","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T09:39:11.685828Z"},"links":{"cited_paper":"/paper/2411.13842","citing_paper":"/paper/2606.12671"},"observation_digest":"sha256:e2b6079b79b12baf8a8c440b68eb68a3c3891771ca98550e47343794c920f05c","observation_id":"9ab5f450-8392-489b-bb60-1b30dcbc99c8","resolution":{"observed_at":"2026-07-03T11:18:03.427904Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13842","snapshot_observed_at":"2026-07-14T16:28:17.428855Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09753","last_updated":"2026-07-04T13:24:14Z","snapshot_observed_at":"2026-08-10T00:56:59.477887Z","submitted_at":"2026-07-04T13:24:14Z","title":"Unified Backbone Refinement for Diffusion Models via Internal-Latent Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T16:28:17.428855Z"},"links":{"cited_paper":"/paper/2411.13842","citing_paper":"/paper/2607.09753"},"observation_digest":"sha256:ffb8a46f456bd42336dd126ba655e28bd79ac3ecfff58dfdb8a9714207f1b175","observation_id":"29d6d1eb-946a-4d9f-8a40-d1556a92c4ee","resolution":{"observed_at":"2026-07-14T16:28:17.428855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.13842/citation-record","integrity":"/paper/2411.13842/integrity","json":"/paper/2411.13842/citation-record.json","paper":"/paper/2411.13842"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:23.906107Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.906107Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:627ace1dfd508f32cfd7aadd9944a371562df0e81850a5a45c2244628994cf5d","observation_id":"4b382a71-1666-4988-af84-fde92c5c3f91","resolution":{"observed_at":"2026-08-12T15:54:23.906107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.154873Z","title":"Cascade R-CNN: delv- ing into high quality object detection","venue":null,"work_id":"1dd82e1b-3a54-4280-ad93-f1ea915402e3","year":2018},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.910633Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:a2d0109024e57b263997d86e5e3ce159d913d1a502bfef42a972c3471d33f475","observation_id":"faa51491-e791-419a-912d-2bed5e95609a","resolution":{"observed_at":"2026-08-12T15:54:25.159053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18068","last_updated":"2024-11-18T15:43:58Z","snapshot_observed_at":"2026-08-13T04:08:34.134320Z","submitted_at":"2024-02-28T05:54:02Z","title":"SynArtifact: Classifying and Alleviating Artifacts in Synthetic Images via Vision-Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18068","snapshot_observed_at":"2026-08-12T15:54:23.914559Z","title":"SynArtifact: Classifying and allevi- ating artifacts in synthetic images via vision-language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.914559Z"},"links":{"cited_paper":"/paper/2402.18068","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:713071463933e571a73c43e3946bd5bb8da3fa4725f2605b29dc4b97f9904aa0","observation_id":"7fe52209-512a-4005-8c9b-7834649248a7","resolution":{"observed_at":"2026-08-12T15:54:23.914559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04692","last_updated":"2024-03-17T16:59:25Z","snapshot_observed_at":"2026-08-13T00:59:54.489440Z","submitted_at":"2024-03-07T17:41:37Z","title":"PixArt-\\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04692","snapshot_observed_at":"2026-08-12T15:54:23.919027Z","title":"Pixart- Σ: Weak-to-strong training of dif- fusion transformer for 4k text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.919027Z"},"links":{"cited_paper":"/paper/2403.04692","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:158c6c9f08043e88d050a61cfa5a68eb96618b71e79435313c72a7f8d2720ae1","observation_id":"ef7932a1-f622-41dc-9cb9-c556dd95080a","resolution":{"observed_at":"2026-08-12T15:54:23.919027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.143175Z","title":null,"venue":null,"work_id":"f35ac1cc-b751-4b92-89ec-c74e74075aa1","year":2010},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.923831Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:d02c8c6c1975d788f8e7c19c23789df62e1c91039ee8a31edd1011e3f6377ad0","observation_id":"b3430345-bb5c-42c3-afa6-5682237304dc","resolution":{"observed_at":"2026-08-12T15:54:25.146890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.131769Z","title":"HumanRefiner: Benchmarking abnormal human generation and refining with coarse-to-fine pose-reversible guidance","venue":null,"work_id":"1fc8d126-e036-4853-9fe0-fd1d9e2e6ee1","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.927389Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:385f77165e83001cfb035aefd4e383c642ae15e2dcb498acbe9b1d09713bdf3b","observation_id":"95857e5d-1d99-420a-872a-39b577417308","resolution":{"observed_at":"2026-08-12T15:54:25.135870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.120144Z","title":"EV A-02: A visual representa- tion for neon genesis","venue":null,"work_id":"b2ac2116-45bb-43db-8f00-88b4e10c1e9f","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.932158Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:a3b2f3396102118b946bda6ed03060374835282ebdc96a91ffd9a7ab165f4f2d","observation_id":"874b5ea7-789f-4307-aec0-5c0e74c6df30","resolution":{"observed_at":"2026-08-12T15:54:25.123946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.108782Z","title":"An introduction to ROC analysis","venue":null,"work_id":"b8afa53a-004a-4586-9336-9c7a93dd22b6","year":2006},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.935792Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:b1a52c3e2eb9c64bc509710c653ff330eb97776b2e1787515c601147f0388304","observation_id":"005fe33d-b31d-4841-97ca-eebb59578f38","resolution":{"observed_at":"2026-08-12T15:54:25.112726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.096639Z","title":"Make-a-scene: Scene- based text-to-image generation with human priors","venue":null,"work_id":"39e2a3a7-eb49-4652-84bd-1b17156379d5","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.939740Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:72e3c8dd2a2d8c9e411885933197c657fbfd1601e89211e91094531a387aa39c","observation_id":"7428bb6b-5c7c-4092-9214-d6f866c29684","resolution":{"observed_at":"2026-08-12T15:54:25.100747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-13T04:28:07.206744Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-12T15:54:23.943323Z","title":"Synthclip: Are we ready for a fully synthetic CLIP training? CoRR, abs/2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.943323Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:0d632ef7ac39f2fc899285bd2583e52f847047fa2e115152e93f4c8eceee450f","observation_id":"533042dc-19f2-473e-b73a-4ff3112f0ca8","resolution":{"observed_at":"2026-08-12T15:54:23.943323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:23.947127Z","title":"Clipscore: A reference-free evaluation met- ric for image captioning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.947127Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:717708d5217d134fb1a4daa5669b91d48604f99d3045c30cb0fb61807e0407db","observation_id":"7fe01d7d-d375-48fe-b24e-48d65bd3a89a","resolution":{"observed_at":"2026-08-12T15:54:23.947127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.078007Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"1971e68f-4ab7-4bfa-be47-9a164eea08c2","year":2017},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.950635Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:68472bcf460cec46388659f7a7848eb417347ce3bc3e0109c5639ad4efafeb66","observation_id":"0491a330-40a8-4c9a-a18b-da50dbf8e79d","resolution":{"observed_at":"2026-08-12T15:54:25.082115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:23.955092Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.955092Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:801b3f847b4cdd3474003840183a78ab2908522a78f1137c955ad2d882ecfa56","observation_id":"a8ff1393-6c38-41ca-ad7d-c798b3f8b04c","resolution":{"observed_at":"2026-08-12T15:54:23.955092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.058964Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"18e5f0f7-da9f-44fe-a14c-de847804f8c6","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.959342Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:d8e4d19c4d22875330bc52a1c5c53371a849e7bf804ba1e77fb19e3a72d72e7e","observation_id":"1dec2060-692f-4e92-ba07-f97d1f94f10d","resolution":{"observed_at":"2026-08-12T15:54:25.063535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.045068Z","title":"T2I-CompBench: A comprehensive benchmark for open-world compositional text-to-image generation","venue":null,"work_id":"491f4779-f96a-4c67-a837-7aec67fae50e","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.963002Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:c108fe5d6839714148b9ad3902cf8e6f1f40a91c2fd7791c77aa2dddb6ad1dc5","observation_id":"2aed6b8f-3aca-461b-95b2-d80640868d69","resolution":{"observed_at":"2026-08-12T15:54:25.050451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.033559Z","title":"Midjourney","venue":null,"work_id":"c7b0f437-e0f0-4808-aff6-1e440400f563","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.966457Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:db4c51fcbd963bffe70ef4484a1063d1ac41574c2855e3dfb6e0104bb91ed029","observation_id":"c3a6eaf8-d54e-454f-9461-041a1b1487b3","resolution":{"observed_at":"2026-08-12T15:54:25.037301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.021672Z","title":"YOLOv8: State-of-the-Art Object Detection and Segmentation Models","venue":null,"work_id":"c1c68051-0f18-4e73-b20c-0f8f63607eb6","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.970034Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:81be037d7c9c5e39bf6e90788048bdc812ff75628e0fe30422cd47aebb41ed1c","observation_id":"9f50d2fe-4f1d-4ed3-a22b-38a0ad212f57","resolution":{"observed_at":"2026-08-12T15:54:25.025489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:23.974179Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.974179Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:804b28d5e8257705e75f49112b5d95ccd627f589559db7fccf0600a9f0f6306f","observation_id":"144353c2-66f0-4e07-b5fa-988098e1a5e2","resolution":{"observed_at":"2026-08-12T15:54:23.974179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:25.002554Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"bcb3bcd3-f705-4ad5-9d33-797905d96c36","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.977968Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:f28190bb04fcdb481efe6811abb60a24523493da3491da72cf7cd58245e0c410","observation_id":"1be5ca08-d888-43c2-ab1e-5b1b2187656e","resolution":{"observed_at":"2026-08-12T15:54:25.006474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.991522Z","title":null,"venue":null,"work_id":"efdc379a-3f3a-491b-9b8e-5f9c312b062e","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.981387Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:f14b43299e316d564796fba37fd51136170f313de86644fdaf56edd4de56df28","observation_id":"803f091a-1666-4aa9-81ac-c6ccbb3482be","resolution":{"observed_at":"2026-08-12T15:54:24.995160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.979668Z","title":"Holistic evaluation of text-to-image models","venue":null,"work_id":"77dcc139-6d50-494d-a48f-fc4800260412","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.985118Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:dfc214cf117959aa4f2c5e721af27ac70c6eb42a6f5c515cc6b188075fa91536","observation_id":"a25fca41-c83d-4718-beec-475c912add7e","resolution":{"observed_at":"2026-08-12T15:54:24.983598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-12T23:38:59.439688Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-12T15:54:23.988818Z","title":"GenAI-Bench: Evaluat- ing and improving compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.988818Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:4938c1dccba3be238825f5113408c6068e9d553ad4403a2f4160b71af12c2b8d","observation_id":"fffa1bfe-1607-440d-97e7-b7bc8f092de5","resolution":{"observed_at":"2026-08-12T15:54:23.988818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07206","last_updated":"2018-03-15T03:09:48Z","snapshot_observed_at":"2026-07-06T05:43:27.961693Z","submitted_at":"2017-05-19T21:59:09Z","title":"Multiple-Human Parsing in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07206","snapshot_observed_at":"2026-08-12T15:54:23.993017Z","title":"Towards real world human parsing: Multiple-human parsing in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.993017Z"},"links":{"cited_paper":"/paper/1705.07206","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:22dc76e2e06b7ad72a882adf49f87afdb8ddab74ae17bc352737295096e0de2f","observation_id":"09be85ef-4b94-4f0a-a011-6428b0264b08","resolution":{"observed_at":"2026-08-12T15:54:23.993017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.967557Z","title":"Girshick, and Kaiming He","venue":null,"work_id":"6ea13a4a-6a05-4609-8c55-3a34a28b5ec6","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.998670Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:549c6ca2f85d995d8c987b719b0b495dcb54c9876fb88c7a1b9179650b711ae2","observation_id":"ac5e44c4-6c04-48f5-8d90-6982387a546c","resolution":{"observed_at":"2026-08-12T15:54:24.972167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.954230Z","title":"Kohlhoff, Deepak Ramachandran, and Vidhya Navalpakkam","venue":null,"work_id":"33ad1d46-39ea-4411-bbad-f3e3cc83219e","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.002533Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:4a3fb017ad0193b4b83478a97ec31264678c7dc185dd95b60eb2ff1f46e088f8","observation_id":"8e208369-49a4-49ca-a3f8-8cc5ab437404","resolution":{"observed_at":"2026-08-12T15:54:24.958732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.941767Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Doll ´ar, and C","venue":null,"work_id":"7b8c6982-8310-49d0-96dd-8764ced676a8","year":2014},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.006220Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:57fcb77f70797b2fe6b22f6434b0534d5696557b2ab0740c439a226978660afa","observation_id":"db83a9ed-6503-4860-9a50-2a153c6a61c5","resolution":{"observed_at":"2026-08-12T15:54:24.946479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.928145Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":"35f42080-6b74-43cb-b3f1-ad42cf76c693","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.010351Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:e94e6593194bbec4908bcd4b100f90fc4f80f6b296420680598d8bc8ee296841","observation_id":"b73fdb0a-ad79-4602-9e34-7417d0fa729a","resolution":{"observed_at":"2026-08-12T15:54:24.932804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.916088Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024","venue":null,"work_id":"c27475d3-0a39-4493-b700-50f776c6aad1","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.014071Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:0373ad8a9f6b2e4b584c2a41a768530473f6d1d641d0bb62deb5126e75d9d17e","observation_id":"9018feb3-8e14-480d-845c-06e4b22b7ff1","resolution":{"observed_at":"2026-08-12T15:54:24.920246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.904180Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"e7812e92-930d-4c85-8a97-5ac11a357cc5","year":2019},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.018161Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:027ca2fcc9858b1257892a0be7e5bcd92bb435ace718ae398b72e8324e4ed08d","observation_id":"879a9116-1e33-4ca4-a6d6-c489cea0a094","resolution":{"observed_at":"2026-08-12T15:54:24.908449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17957","last_updated":"2024-08-16T05:35:21Z","snapshot_observed_at":"2026-08-13T05:14:43.238194Z","submitted_at":"2023-11-29T08:52:08Z","title":"HandRefiner: Refining Malformed Hands in Generated Images by Diffusion-based Conditional Inpainting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17957","snapshot_observed_at":"2026-08-12T15:54:24.021963Z","title":"Handrefiner: Refining malformed hands in generated images by diffusion-based conditional inpainting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.021963Z"},"links":{"cited_paper":"/paper/2311.17957","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:4ce3cfc88d4cb42d63c5c004f8e50354fa83c502df0aebb3577287d1caf68df3","observation_id":"8b9e03b2-c02e-420f-8b5c-5114fa6f13ce","resolution":{"observed_at":"2026-08-12T15:54:24.021963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.892698Z","title":"Generating images from captions with attention","venue":null,"work_id":"2fa53088-afd5-424a-b987-176698735626","year":2016},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.027093Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:03f5a8254aa2c9abec9bd38f843f20bdc651d49e5588a1cb2599b9f0d049e0fc","observation_id":"de01e16c-b30a-40ae-a70e-1604bfd7eee9","resolution":{"observed_at":"2026-08-12T15:54:24.896479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.881264Z","title":"Llama 3.2","venue":null,"work_id":"78975143-178d-4b7c-8666-d39d48867598","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.031071Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:db4d0901ed00178ee5b2d9b5ed9fcc367f0cb86e2dd6c7ab8963f5d97d216a04","observation_id":"56880b24-b96c-4b40-aefd-6289a5a29a11","resolution":{"observed_at":"2026-08-12T15:54:24.885192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.035695Z","title":"Hand- iffuser: Text-to-image generation with realistic hand appear- ances","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.035695Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:11a02c3f8db9a3f67d24f25cbafa0c0998c3cb528447e17d44b0a6a5869640d0","observation_id":"f8193b9d-73cd-45fb-917d-9124d84d8ab5","resolution":{"observed_at":"2026-08-12T15:54:24.035695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.861902Z","title":"Glide: Towards photorealis- tic image generation and editing with text-guided diffusion models","venue":null,"work_id":"db7c2494-0cae-4971-9145-797192da8995","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.040022Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:c5daf9a491a4d90eb73e8661e95ac2780fb4887029c7065b0cc849340d787019","observation_id":"1ee9d592-9be3-4724-a53e-5b8ac71184ee","resolution":{"observed_at":"2026-08-12T15:54:24.866370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.847098Z","title":"DALL-E 2","venue":null,"work_id":"4d7c5246-8df8-4cc3-b2ad-6a54dc8d2158","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.044297Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:38545a3db937eefd33bc005769b2bd3ae7e6446c27dea154be1ad7254199fb0a","observation_id":"94de4566-f566-464c-8fb9-c9fb13feb94d","resolution":{"observed_at":"2026-08-12T15:54:24.852037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.834053Z","title":"DALL-E 3","venue":null,"work_id":"ce650f96-57bd-499b-95f2-95197646a7e6","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.048683Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:846dd09fcf7a2538a33ff76927e7c0040c328cdb17a7460c4f63031e20445408","observation_id":"2221b37f-f977-4cea-8ea4-b1871862452c","resolution":{"observed_at":"2026-08-12T15:54:24.838941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.820406Z","title":null,"venue":null,"work_id":"4a75a78f-eccc-4770-99ba-7dafd3ddc3ea","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.052855Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:6ddc2dc167ab27c1b01a91bc82e72dd82c9340626171045a38fb78a3aeb7cf35","observation_id":"6988dce4-af3c-453b-ba10-68b6714a4734","resolution":{"observed_at":"2026-08-12T15:54:24.825305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.807075Z","title":null,"venue":null,"work_id":"f49189d4-9b4a-4815-9baf-bd0c4a443f6e","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.056584Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:65cfaf6bf226055b90efcca070449cee8659643c5231c508e721368cdf6abc5b","observation_id":"57e8ca4b-0183-4309-8f27-547b3e929657","resolution":{"observed_at":"2026-08-12T15:54:24.811435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.794462Z","title":"Toward verifiable and reproducible human evaluation for text-to-image generation","venue":null,"work_id":"4af718c1-f7f7-415d-a242-f853ed65ccfe","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.060224Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:b6c4310fdd5809982b0ed343c8dd40a68427726868866e45c5dcf79d9d059741","observation_id":"6b6f2f2f-54b7-41b5-ae5b-79c53b50246c","resolution":{"observed_at":"2026-08-12T15:54:24.798741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.781423Z","title":"On aliased resizing and surprising subtleties in GAN evaluation","venue":null,"work_id":"bcd61705-f4c9-460e-9d91-b12409d1c782","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.064081Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:32cfb28efd8d897963ad92e4e49dd2c2cbd9f1d24fd4de5c2905c41b29ed0bfd","observation_id":"abeb8bdc-e1a2-4d1a-b0f4-9a0c8484d2d2","resolution":{"observed_at":"2026-08-12T15:54:24.785698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.768981Z","title":"Giving a hand to diffusion models: A two-stage ap- proach to improving conditional human image generation","venue":null,"work_id":"e8a6e0b6-c4e3-448d-9f4f-c9c2fdeaef62","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.067591Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:6fc49d4bc5112b2a46cc590d6ccbb02563c7a799187d660ee60844ea74f88e68","observation_id":"ba9dfb44-e3a5-456f-80e1-d61f09440a4e","resolution":{"observed_at":"2026-08-12T15:54:24.773646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.756440Z","title":"SDXL: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":"3d293232-b687-4824-97e1-9bff18c270aa","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.071375Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:0370dfb383ead81c70a4cb68d64c508cb715886305205cca243e768e14078949","observation_id":"9624fa11-0aa9-4204-9619-f39ba88e7bff","resolution":{"observed_at":"2026-08-12T15:54:24.760945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01693","last_updated":"2024-11-22T22:42:46Z","snapshot_observed_at":"2026-08-13T04:04:28.063365Z","submitted_at":"2024-03-04T03:00:22Z","title":"HanDiffuser: Text-to-Image Generation With Realistic Hand Appearances","version":3},"cited_work":{"arxiv_id":"2403.01693","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.01693","snapshot_observed_at":"2026-08-12T15:54:24.294851Z","title":"HanDiffuser: Text-to-Image Generation With Realistic Hand Appearances","venue":"cs.CV","work_id":"9cf87cf6-21fd-4209-84b3-0fe1bf68126b","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.075081Z"},"links":{"cited_paper":"/paper/2403.01693","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:30de772bffb27886a5a50d38818dfec11c9ddfa45ad699b752580460554cce4d","observation_id":"ba4e311b-7a80-4632-b49a-4176397dd116","resolution":{"observed_at":"2026-08-12T15:54:24.302123Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.079186Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.079186Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:42c5f2a994c9e8337dcd2916384fcb0490ef02236f980c0daa29b9d82c0e3638","observation_id":"578e45f7-5092-4e09-bfb4-7508dfe19dc8","resolution":{"observed_at":"2026-08-12T15:54:24.079186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.736963Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"9c58f811-2cce-465f-be4f-2dc583cfbd64","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.083137Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:2415c1ded48853a975d83b3f49e2006b22058ef7962d7227ca3ed9c3273b7444","observation_id":"7ea9ccb5-1414-481f-8c72-caa5407e4687","resolution":{"observed_at":"2026-08-12T15:54:24.741982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.725024Z","title":"300 faces in-the-wild challenge: The first facial landmark localization challenge","venue":null,"work_id":"69f460b9-4487-452b-a6f7-aee713221fbe","year":2013},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.086995Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:9f66e718638fadde2ebd9a84db89ef22dfc5dc7a61863f036ea0413182366077","observation_id":"ad6a9886-5ad3-49b6-9ecb-e1ee9c91f38d","resolution":{"observed_at":"2026-08-12T15:54:24.729326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.713279Z","title":"Goodfellow, Wojciech Zaremba, Vicki Cheung, Alec Radford, and Xi Chen","venue":null,"work_id":"ac24be0c-ed66-47e5-bbae-d87964511815","year":2016},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.090967Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:e9c502f5266f4ebeb229b5fa6086a1496df5f5afcfd6421e923e8d85a4c99b8d","observation_id":"d5348cd0-4f36-4268-b5db-5c9ed2dddd48","resolution":{"observed_at":"2026-08-12T15:54:24.717264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00123","last_updated":"2018-04-30T22:49:54Z","snapshot_observed_at":"2026-07-06T06:36:33.930118Z","submitted_at":"2018-04-30T22:49:54Z","title":"CrowdHuman: A Benchmark for Detecting Human in a Crowd","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00123","snapshot_observed_at":"2026-08-12T15:54:24.094727Z","title":"Crowdhuman: A benchmark for detecting human in a crowd","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.094727Z"},"links":{"cited_paper":"/paper/1805.00123","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:d9604115ad21cc0d0eb35320d23924f1859f3d2a1d8b553ffc786cebbfe1df02","observation_id":"d12c923b-0265-4557-b3ed-b068f4ca29fa","resolution":{"observed_at":"2026-08-12T15:54:24.094727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.700291Z","title":"Objects365: A large-scale, high-quality dataset for object detection","venue":null,"work_id":"65587b20-c45e-4af1-abc4-1ec2a7003e8b","year":2019},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.099991Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:bf8572fa6c36581b114e82050d6d02a4279073ce7fbed08e89ad4440273efe8b","observation_id":"5409df0e-e303-43c2-a228-7633b7a6d490","resolution":{"observed_at":"2026-08-12T15:54:24.704559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.688020Z","title":"Emu edit: Precise image editing via recognition and genera- tion tasks","venue":null,"work_id":"9e8a23dd-0991-429a-9283-86b68f09b5d3","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.104436Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:3eea4ad1476027f7a5f7dedb47beb22abbc9f853f3da89bdab52637a25bd0fcf","observation_id":"3d962625-9667-454b-82f1-af5a1046faaf","resolution":{"observed_at":"2026-08-12T15:54:24.692415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.675711Z","title":"Codel: a human co-detection and labeling framework","venue":null,"work_id":"50874f9f-1532-40b6-8b75-5d7df1ef19a9","year":2013},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.108337Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:76efc9c9d4ad8dd8e4e554747567ba7fdca4498743bdf35c28cea1a71e5b795f","observation_id":"eb7a8bbf-a365-471b-aa00-0c179aa1360d","resolution":{"observed_at":"2026-08-12T15:54:24.679774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.661570Z","title":"Is synthetic data all we need? benchmarking the robustness of models trained with synthetic images","venue":null,"work_id":"9fbaf348-e90c-4225-8bf8-eac5f059c73b","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.112239Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:67ca7ce23452f56945659b605e570e4c3f826d126d2eaa130da2b28300b4c826","observation_id":"7fe9b97f-9ce9-4104-b64c-5cd9494df82d","resolution":{"observed_at":"2026-08-12T15:54:24.666937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.116116Z","title":"Weiss, Niru Mah- eswaranathan, and Surya Ganguli","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.116116Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:2487a500cba79e15c1e8c06283a130085b25fa04eecfb6b4f81d20503c16d1f9","observation_id":"4e88cc6d-aec8-4880-912d-d8deaa9fc40e","resolution":{"observed_at":"2026-08-12T15:54:24.116116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.640315Z","title":"Facial descriptors for human interaction recognition in still images","venue":null,"work_id":"adacb80e-2b3b-46f2-b0a6-0847ec4f15bf","year":2016},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.119708Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:c8e1b37c7c089827b9918a4366479747c3a7280da4d25d6664a85cca89ef5567","observation_id":"80d751b9-a139-4a6c-9ca4-7cfe292f96dd","resolution":{"observed_at":"2026-08-12T15:54:24.644684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.625694Z","title":"DF-GAN: A simple and effec- tive baseline for text-to-image synthesis","venue":null,"work_id":"58181f39-e7b0-4698-a244-1a3660b7a969","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.123305Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:f0a9068a7cb74c522558bace3eb0c1c4f143df8dc14ff1be94e4a1a0414b7f84","observation_id":"3832b129-4c9e-4050-a4be-8de98e5aac23","resolution":{"observed_at":"2026-08-12T15:54:24.630230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.612550Z","title":"StableRep: Synthetic images from text-to- image models make strong visual representation learners","venue":null,"work_id":"40fe2ce6-b7bd-4684-8b84-9a15780ae79e","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.126807Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:00941159e2eabb74685859ab358790cf5d41427bd3b5930f5a119116bda8cfb9","observation_id":"6c6e6514-9372-40a0-9629-41a9b86f6417","resolution":{"observed_at":"2026-08-12T15:54:24.617107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.598606Z","title":"Learning vision from models rivals learning vision from data","venue":null,"work_id":"0651fe8f-4617-427c-81b5-3c17373e9ecf","year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.130500Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:a85c10ea787aab020807f7ff83c29b3b6734e2e00602da2e04f2e3154af42b67","observation_id":"75609e93-72bb-4b80-a28a-eed16d4eba8d","resolution":{"observed_at":"2026-08-12T15:54:24.603145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14205","last_updated":"2024-11-21T15:13:38Z","snapshot_observed_at":"2026-08-12T15:23:13.210738Z","submitted_at":"2024-11-21T15:13:38Z","title":"Is this Generated Person Existed in Real-world? Fine-grained Detecting and Calibrating Abnormal Human-body","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14205","snapshot_observed_at":"2026-08-12T15:54:24.135433Z","title":"Is this generated person existed in real-world? fine-grained detecting and calibrating abnor- mal human-body","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.135433Z"},"links":{"cited_paper":"/paper/2411.14205","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:074406310e55a33f7d9e14778fdd5c5d19cf559da760af53dd90aee7c64d672c","observation_id":"81ad1495-7352-4ae8-88af-a3d480e36810","resolution":{"observed_at":"2026-08-12T15:54:24.135433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-11T00:30:13.593181Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-12T15:54:24.139299Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.139299Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:0eedf3313c9e750ecdd57c5e66e633e6f77bfa32680ce0e978c67d73b956ce15","observation_id":"7dc51933-97b1-4cea-a31d-cf6eb7f0492b","resolution":{"observed_at":"2026-08-12T15:54:24.139299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.586470Z","title":"Human preference score: Better aligning text-to- image models with human preference","venue":null,"work_id":"6a986248-71dc-40b9-9a0f-a3edeaa92cf6","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.143160Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:e736c3c1f62bf15f8da4207bc4b9db0a5c5681806d24beda89ef71413af5527c","observation_id":"27f62bce-3696-418b-a034-cca80427fa7b","resolution":{"observed_at":"2026-08-12T15:54:24.590689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-12T15:54:24.147318Z","title":"SANA: efficient high-resolution image synthesis with linear diffusion transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.147318Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:9a46a3f0339924b2b2808b15d57d98965c66a40d37031b3471aa6ef1bbc3fabf","observation_id":"25e29b11-f64f-45c0-962f-7ddb0e051e9e","resolution":{"observed_at":"2026-08-12T15:54:24.147318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.575053Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":"85188750-2623-458b-81c4-415e4ff0cb4d","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.151302Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:673db88c2a61ee73d723e764e3d25bb2053e9b67a62359bb5717a29220f9ff8b","observation_id":"2cab8f19-e711-49a0-a3b6-320f33105638","resolution":{"observed_at":"2026-08-12T15:54:24.579130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.562562Z","title":"Vit- pose: Simple vision transformer baselines for human pose estimation","venue":null,"work_id":"08357d7c-683a-45da-aa91-da448b00cb47","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.156296Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:849dd34c5c14ef9b2e448f87b920af4250dbde277f2a06a9a67ddb15b0e253dc","observation_id":"5c25c0bf-5d3b-4d05-873d-fa0b881b7901","resolution":{"observed_at":"2026-08-12T15:54:24.567125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.550958Z","title":"Improving text-to-image synthesis using contrastive learning","venue":null,"work_id":"b406a0d4-6118-4fe7-9d92-cb46405440a6","year":2021},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.159917Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:1dfc311ed456e5531392ffd439e61cf34c8a45bb2c06c2d606ae43987f151e26","observation_id":"4e9cfe27-e854-4499-95ed-11b60012be24","resolution":{"observed_at":"2026-08-12T15:54:24.554783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.538007Z","title":"High-resolution image inpainting with iterative confidence feedback and guided upsampling","venue":null,"work_id":"96c0f461-5d93-41bc-b79c-071d19f0e8a4","year":2020},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.163449Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:9dfb1e0ded8c91ff2858dd4cf1ecab7106ad624546c2fd6026953a31b9ecce76","observation_id":"8bd29a9a-3279-4efe-b330-e2fb217c71e3","resolution":{"observed_at":"2026-08-12T15:54:24.542908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.526097Z","title":"Per- ceptual artifacts localization for inpainting","venue":null,"work_id":"f8018e9e-dea2-4b29-9b6b-9c38bf9685b9","year":2022},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.168425Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:d8098c993510300be164f26fdd08828c3c8153e81623db3350ffdcb606834cdc","observation_id":"59cb35d6-3088-47d7-8cd6-1ca486eac9cf","resolution":{"observed_at":"2026-08-12T15:54:24.530364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.514341Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"065c79dd-1edb-4864-9fee-4e3fba9878da","year":2023},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.172996Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:9770fb0cd6ddb09ac19100fb871e07fb3a95b129c89ce98bfaef43656e9ae0e0","observation_id":"ef0b503d-79d1-43bc-8208-8856c7037f44","resolution":{"observed_at":"2026-08-12T15:54:24.518218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.502055Z","title":"Perceptual artifacts localiza- tion for image synthesis tasks","venue":null,"work_id":"e622f9ae-9d5a-4307-a7ae-289d77bfee58","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.176898Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:6c3a7f3ba8a31e02a1a032de8eba542fe8f11cf54b9fc187a1b1250b02ee6dc3","observation_id":"bd30fcfa-c10b-481f-8de9-14c2718b1a8b","resolution":{"observed_at":"2026-08-12T15:54:24.506644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.489924Z","title":"Rosin, Zixi Cai, Xi Han, Dingcheng Yang, Haozhi Huang, and Shi-Min Hu","venue":null,"work_id":"08a06be1-d3ef-43e6-929b-d1c14f823ba7","year":2019},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.181338Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:62feddddc3710ab406b18b387f1a5e7e466f219c3604c8af73608a23fcc6442c","observation_id":"8f55bff3-c448-486e-b560-7a41234aad58","resolution":{"observed_at":"2026-08-12T15:54:24.493884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.477569Z","title":"Gordon, Ranjay Krishna, Austin Narcomey, Li Fei-Fei, and Michael S","venue":null,"work_id":"e0724e2f-4627-4805-bbae-e09d0ba9fe33","year":2019},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.186029Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:62330c37701a8f5b1c25d3fc6866a0cb7fcee369950c781f5900d8a476da99ba","observation_id":"e272a211-e28e-47f3-91f5-d9814ccb68d6","resolution":{"observed_at":"2026-08-12T15:54:24.481498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.465363Z","title":"DM- GAN: dynamic memory generative adversarial networks for text-to-image synthesis","venue":null,"work_id":"89610f0b-d13b-464e-9103-e3d25767e2a1","year":2019},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.189570Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:e5a0478da808c1195511fc6a6cffb424559348837da8d4fd6f9061629519a36a","observation_id":"df85d9e1-d8ff-4769-ac72-ec286c800a09","resolution":{"observed_at":"2026-08-12T15:54:24.469649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.453120Z","title":"weird hand","venue":null,"work_id":"c7721bd3-bbda-4410-8887-bc1c3b841e60","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.192808Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:85c20e9d5e8a08e86ddd432f551ad84c1b5395797768644b06d591a754f54dcc","observation_id":"f11b5cea-2a37-4ad1-8804-9b421c112254","resolution":{"observed_at":"2026-08-12T15:54:24.456885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.440201Z","title":"These metrics provide a comprehensive evaluation of the model’s performance in both classification and localization tasks","venue":null,"work_id":"37e0de1b-0ba3-436e-922f-a297000769c4","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.198398Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:2fecd1aaf7d3c271752ba6afdcbcc7ff6b5756e417675ccf8c47228b4acbc400","observation_id":"8204f00d-c92d-4b00-94c4-0d5f2a310245","resolution":{"observed_at":"2026-08-12T15:54:24.444945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.427813Z","title":"Ablation study of key components in HADM-L","venue":null,"work_id":"40872b70-0890-4931-ab2d-dd52af38fe72","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.202382Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:ed53eacc4dfe2dc8043d7ee8dfe914236966d440efdb45f382b5adfbd22e3d35","observation_id":"2a6c48af-5c25-4f1c-a717-33a3cc1df9ed","resolution":{"observed_at":"2026-08-12T15:54:24.431778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.416421Z","title":null,"venue":null,"work_id":"44b3daa5-222b-4b2a-9f67-fac2df41716a","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.206162Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:670ab3c357639a7672f28fec1a79ac649261814738a9250127ec6ac7cc545062","observation_id":"59701714-1d75-47a3-8e13-1fa863f037b2","resolution":{"observed_at":"2026-08-12T15:54:24.420193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.403914Z","title":"The corresponding dialogue is presented in Fig","venue":null,"work_id":"9084817f-0a19-4767-b2c8-fd6a38de4f5d","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.209766Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:38cad9347aaa7a211e03c96f0d63b5371124fc154ad5f97d430fc1a06d5109e8","observation_id":"e72733af-28c8-47ce-a0be-83f095dab5b5","resolution":{"observed_at":"2026-08-12T15:54:24.408294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.390811Z","title":"16 and global human artifacts in Fig","venue":null,"work_id":"5d93445d-c3e1-49d4-9b38-b3dad93f843f","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.213655Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:6c293f7ad33c54869eef7a723d1e437c65306e3b202ba07677f839444181319b","observation_id":"92a5bf44-601a-4063-8aae-91aafbf2a580","resolution":{"observed_at":"2026-08-12T15:54:24.394519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:54:24.378994Z","title":"Last row: Midjourney","venue":null,"work_id":"023c0f7e-7e2f-446d-815e-39d6cc4a4087","year":null},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:24.217254Z"},"links":{"citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:d147deaf9cd853594601815436497b4670ccd74c32177724b0ef37892ee88998","observation_id":"0c81f3c8-39e0-4bed-b088-dca158172dce","resolution":{"observed_at":"2026-08-12T15:54:24.382932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T15:46:50.547710Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":55},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 5 inbound Pith citation observations for arXiv:2411.13842."}