{"as_of":"2026-08-12T14:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2a519171c65cb0814bd5fbdbec4043659bedbc19f81305d59eb24d1bdfdf7407","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:09:21.378850Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08818/citation-record","integrity":"/paper/2509.08818/integrity","json":"/paper/2509.08818/citation-record.json","paper":"/paper/2509.08818"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.135490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.135490Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:8e53bd90db5a150eae43f905e62b5eede1bf51185d3fc17e9beb03594151d374","observation_id":"3c493b3e-6a00-4edb-83e4-62c705d55c30","resolution":{"observed_at":"2026-08-04T20:09:21.135490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.141914Z","title":"Accessed: July 10, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.141914Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:bb92bd254e6c166dbafcfc4a19c3005569487614fd9c921614325449aef6c63f","observation_id":"370b322c-0cb2-4cf0-8b68-f0bb4275d4a8","resolution":{"observed_at":"2026-08-04T20:09:21.141914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.147158Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.147158Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:46c57afeec052ddef5b0880434df18f277d39b36e426940ef2311f518d6afd6c","observation_id":"f86710b1-2295-4d6d-8d77-847727824d29","resolution":{"observed_at":"2026-08-04T20:09:21.147158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18068","last_updated":"2024-11-18T15:43:58Z","snapshot_observed_at":"2026-08-12T04:59:02.223743Z","submitted_at":"2024-02-28T05:54:02Z","title":"SynArtifact: Classifying and Alleviating Artifacts in Synthetic Images via Vision-Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18068","snapshot_observed_at":"2026-08-04T20:09:21.152720Z","title":"Synartifact: Classifying and alleviating artifacts in synthetic images via vision-language model.arXiv preprint arXiv:2402.18068, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.152720Z"},"links":{"cited_paper":"/paper/2402.18068","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:3a962470232624c0e83ff57b76a5ca1c61c084064a038989431d3857edd0f192","observation_id":"4ff34cb7-291f-43d9-b515-4d0211610f9c","resolution":{"observed_at":"2026-08-04T20:09:21.152720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.158230Z","title":"Watching the big artifacts: Exposing deepfake videos via bi-granularity artifacts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.158230Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:111a85ea8f320de1df483b7165a6f5cc96c5c1f6ba70af75c100d17c0f65580f","observation_id":"9092d513-ceff-4f82-8dfc-c438a00cccfe","resolution":{"observed_at":"2026-08-04T20:09:21.158230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.163459Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.163459Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:3adfe70650cb45885b0806dd0d80f853dafa036989699cf96bca7b5e61664373","observation_id":"1444219e-9c9e-4045-a12d-5b376ff29c11","resolution":{"observed_at":"2026-08-04T20:09:21.163459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1203.3472","last_updated":"2012-03-15T11:17:56Z","snapshot_observed_at":"2026-08-12T13:06:02.078301Z","submitted_at":"2012-03-15T11:17:56Z","title":"Super-Samples from Kernel Herding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1203.3472","snapshot_observed_at":"2026-08-04T20:09:21.168815Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.168815Z"},"links":{"cited_paper":"/paper/1203.3472","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:d6f2175c43f36e01467019543caba419ce2c0132c60768f4e80cc370e5ff9f57","observation_id":"5b7c49e1-c945-48a1-afc8-21c68a04f639","resolution":{"observed_at":"2026-08-04T20:09:21.168815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05476","last_updated":"2024-03-04T13:30:44Z","snapshot_observed_at":"2026-08-11T15:53:21.948890Z","submitted_at":"2023-12-09T06:08:09Z","title":"Exploring the Naturalness of AI-Generated Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05476","snapshot_observed_at":"2026-08-04T20:09:21.175216Z","title":"Exploring the naturalness of ai- generated images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.175216Z"},"links":{"cited_paper":"/paper/2312.05476","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:221a42339b29005a676b6ae8b2ac3a6b476c55daea35585955f52c00276a66a3","observation_id":"da8c8c03-9898-455d-9573-1c67003dd8ce","resolution":{"observed_at":"2026-08-04T20:09:21.175216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.180999Z","title":"Gaia: Rethinking action quality assessment for ai-generated videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.180999Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:c1f6df3c86c0214520beb4948cfa9930318599457d7db413266f25ff9a07b894","observation_id":"2f6db746-41e6-47e4-91f7-8652292ee014","resolution":{"observed_at":"2026-08-04T20:09:21.180999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08009","last_updated":"2023-09-14T19:35:53Z","snapshot_observed_at":"2026-08-12T03:04:21.354901Z","submitted_at":"2023-09-14T19:35:53Z","title":"Measuring the Quality of Text-to-Video Model Outputs: Metrics and Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08009","snapshot_observed_at":"2026-08-04T20:09:21.186153Z","title":"Measuring the quality of text-to-video model out- puts: Metrics and dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.186153Z"},"links":{"cited_paper":"/paper/2309.08009","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:05e12f4c9e41039f6c8b90f3128ed07f64c3ab5f9e8c31567b45be296593a0fa","observation_id":"0f5967ca-2e31-451f-b728-742f5cea1a9b","resolution":{"observed_at":"2026-08-04T20:09:21.186153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.191471Z","title":"Human- refiner: Benchmarking abnormal human generation and refin- ing with coarse-to-fine pose-reversible guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.191471Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:fb401ad3c83bd75ec2470d01cb2ca333c4da8e1b8e810700699fd3d2758d2729","observation_id":"dd763d80-a736-4eb4-a1b0-b7f3680229aa","resolution":{"observed_at":"2026-08-04T20:09:21.191471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.198144Z","title":"On the content bias in fréchet video distance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.198144Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:f72a7c2f783de5605c1147f734d1601c930d73078aa55b82170c8a0b15dd7e5a","observation_id":"2e32aa43-580f-487c-af98-05b6d115fdf3","resolution":{"observed_at":"2026-08-04T20:09:21.198144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08430","last_updated":"2021-08-06T03:22:14Z","snapshot_observed_at":"2026-07-06T11:30:06.143581Z","submitted_at":"2021-07-18T12:55:11Z","title":"YOLOX: Exceeding YOLO Series in 2021","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.08430","snapshot_observed_at":"2026-08-04T20:09:21.204069Z","title":"Yolox: Exceeding yolo series in 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.204069Z"},"links":{"cited_paper":"/paper/2107.08430","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:93809768267c4a3fad3ea310bcaa2d14cd862f8c4cf5bebb2e79fd21fb70fe0e","observation_id":"579c94bf-fdc7-4606-8990-cf09bc463afa","resolution":{"observed_at":"2026-08-04T20:09:21.204069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.209241Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.209241Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:6be263eccb12df174abc0a74210bcaa2f4429092d143fdb476d88bd8f0cc94ce","observation_id":"c645143e-f963-4dc4-92c4-815f723f9986","resolution":{"observed_at":"2026-08-04T20:09:21.209241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.214317Z","title":"Deep Residual Learning for Image Recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.214317Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:1557b64b39848bf9b3b1ffc1dda48759014305fefbd3f5ae81dd54e59b4c2c23","observation_id":"743a208e-3917-4eb8-b27b-da1175f1a0fe","resolution":{"observed_at":"2026-08-04T20:09:21.214317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15252","last_updated":"2024-10-14T04:08:53Z","snapshot_observed_at":"2026-08-12T10:30:34.681168Z","submitted_at":"2024-06-21T15:43:46Z","title":"VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15252","snapshot_observed_at":"2026-08-04T20:09:21.219231Z","title":"Videoscore: Building auto- matic metrics to simulate fine-grained human feedback for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.219231Z"},"links":{"cited_paper":"/paper/2406.15252","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:e6c6c7c9a79ecf1579a8b0dbb9d332ca70a0bb08601c776ae666edf53e7c132d","observation_id":"38b5cae5-8a68-411d-9d4e-a5f6033d5569","resolution":{"observed_at":"2026-08-04T20:09:21.219231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.224899Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.224899Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:6c34b19df6657f2f51fb16ad08e043a91f4f2855b75fd7af9a57b791652c3efb","observation_id":"4d8a2767-ecfb-46d2-b9bd-b0d879543023","resolution":{"observed_at":"2026-08-04T20:09:21.224899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.230222Z","title":"Video diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.230222Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:4860f583fb905f6057c2a9c3365d5468f684aad34ec7707a6101e45b3fd4a368","observation_id":"70068352-7ae1-453b-a84b-bc0cec1b9742","resolution":{"observed_at":"2026-08-04T20:09:21.230222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.236120Z","title":"Exddv: A new dataset for explainable deepfake detection in video","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.236120Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:adf1e9ff393ac418b05bc52fb9529429cb7d1124ff0362c966813c7b9818d132","observation_id":"5778f97f-e515-4eeb-a3cb-0b8c87e7aaf9","resolution":{"observed_at":"2026-08-04T20:09:21.236120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.242392Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.242392Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:1e0990fb0484725516df9fd83c880032108ddb56b6ee7c68598bdc8af316c670","observation_id":"90d2e361-3231-438c-a03e-8377e3835e06","resolution":{"observed_at":"2026-08-04T20:09:21.242392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.248408Z","title":"Text2video-zero: Text- to-image diffusion models are zero-shot video generators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.248408Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:5bbc5b6a7d0dae0769c7a866de4f4c96fba255912d63ae849f5742253171053c","observation_id":"a9ee23a9-7e6b-4a28-acbc-17b0b9138df7","resolution":{"observed_at":"2026-08-04T20:09:21.248408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.253108Z","title":"Yolov11: An overview of the key architectural enhancements, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.253108Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:7247ce8565eb6bc8259d8ca8edfecab34789b2dffdaa5aa7e5fa784513a14de7","observation_id":"74d54ceb-a375-43fc-9c40-206ce6854001","resolution":{"observed_at":"2026-08-04T20:09:21.253108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.258007Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.258007Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:ca8f8bc8d0023124d88559f8e084deb1bc3656aaaabb76bd67c84001a0e87b08","observation_id":"09969874-95f4-4857-adef-64e444afe383","resolution":{"observed_at":"2026-08-04T20:09:21.258007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.263446Z","title":"Lawrence Zitnick","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.263446Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:b67dbca400f5ca7dcc1bda6bcb55658faf109a9fb53bfc6f8d7653123e8c30e3","observation_id":"3848077f-0dd3-4de0-ad9c-11892e3a21dc","resolution":{"observed_at":"2026-08-04T20:09:21.263446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13918","last_updated":"2025-10-27T08:22:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-23T18:55:41Z","title":"Improving Video Generation with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13918","snapshot_observed_at":"2026-08-04T20:09:21.268719Z","title":"Improving video generation with human feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.268719Z"},"links":{"cited_paper":"/paper/2501.13918","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:ba1c6d58717ee94c9801c72f6df1560552323290268b03af98eb7a06a0672ffd","observation_id":"d0128647-d639-48f7-8a55-09f80fb5b060","resolution":{"observed_at":"2026-08-04T20:09:21.268719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.273899Z","title":"Ntire 2024 quality assessment of ai-generated content challenge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.273899Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:b191135549756c50a443f8332d4963241d7d081d917e4237c76446c0334648db","observation_id":"69843d71-c110-4575-9640-f31b7dcec319","resolution":{"observed_at":"2026-08-04T20:09:21.273899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.278132Z","title":"Evalcrafter: Benchmarking and evalu- ating large video generation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.278132Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:6a82ac075e6da35b1e3d9a0036df67bef84be134d5b9197f93a07add4752447e","observation_id":"62d5c62e-09dc-41f0-af70-2ea7ead95dcc","resolution":{"observed_at":"2026-08-04T20:09:21.278132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.283318Z","title":"Fetv: A benchmark for fine-grained evaluation of open-domain text-to-video gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.283318Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:43f603f0f58997506280c18e77aa2c76e4405e5a7d2184f49767abef57ba0c7c","observation_id":"e7a22da8-8652-4f87-bbef-ad8817cc6cc9","resolution":{"observed_at":"2026-08-04T20:09:21.283318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.288221Z","title":"Rt-detrv2: Improved baseline with bag-of-freebies for real-time detection transformer, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.288221Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:d7839395ce82b7e06fedd716611ac4c93747295d66088c90aa6aade65de088b0","observation_id":"5c670166-7fef-4e0a-915e-b76e9c4b0674","resolution":{"observed_at":"2026-08-04T20:09:21.288221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.293068Z","title":"Gener- alizable deepfake detection with phase-based motion analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.293068Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:6c2db9751106b1f744fb735ecf72af7cfdc44c0499040bafc0fb63eb74cf31ca","observation_id":"22871a48-da8c-4770-abcf-8b9777c1b4b8","resolution":{"observed_at":"2026-08-04T20:09:21.293068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.297899Z","title":"Deepfake detection: A systematic literature review","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.297899Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:ca31c57ec65a1c44a0a1f1d467d1c9ded174da50d863a0ba56a21afd7844d16c","observation_id":"c06b4b44-e207-479a-8f1e-957b3d006c45","resolution":{"observed_at":"2026-08-04T20:09:21.297899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.302771Z","title":"You only look once: Unified, real-time object de- tection","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.302771Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:e8e08167ca80ce56575c9bab70e566583eda243e7e34598c2a480b94fb1c95f0","observation_id":"37646afd-bf93-4491-8a2b-2ce1955bd6cc","resolution":{"observed_at":"2026-08-04T20:09:21.302771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.307086Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.307086Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:4e9444473b04b50432a9650ef4d769977aa0188c2f301c3a6658ad9e592845e7","observation_id":"c04f4929-b6a2-449f-82a2-c6b9a1738ff8","resolution":{"observed_at":"2026-08-04T20:09:21.307086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.312154Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.312154Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:1a392022a78709873cc5579ce77f71d779a54757c83680779897ced52f777884","observation_id":"0007d925-6a47-4293-8681-c98cda936a6e","resolution":{"observed_at":"2026-08-04T20:09:21.312154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-11T02:30:38.877941Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-04T20:09:21.317697Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.317697Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:5006b8ac8ceaaae6a5503e3162f515216e044fadb7cbc476926b81cb82859ae2","observation_id":"ac4316b6-c143-4936-8245-944b102d0821","resolution":{"observed_at":"2026-08-04T20:09:21.317697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14100","last_updated":"2022-12-15T19:21:35Z","snapshot_observed_at":"2026-08-04T09:31:34.784365Z","submitted_at":"2022-05-27T17:03:38Z","title":"GIT: A Generative Image-to-text Transformer for Vision and Language","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14100","snapshot_observed_at":"2026-08-04T20:09:21.322998Z","title":"Git: A generative image-to-text transformer for vision and language","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.322998Z"},"links":{"cited_paper":"/paper/2205.14100","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:22b6889d832fafc9c87aabe1152e5975db846ffbda17d32dcc4ea75baf72c589","observation_id":"7f8031d9-7679-4f2f-9d90-2618d77d1c04","resolution":{"observed_at":"2026-08-04T20:09:21.322998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-10T02:42:53.022737Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13842","snapshot_observed_at":"2026-08-04T20:09:21.328170Z","title":"De- tecting human artifacts from text-to-image models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.328170Z"},"links":{"cited_paper":"/paper/2411.13842","citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:a023fba5ff47df3b77741b1d6b39e39f4c5387cb85ec14aa1a11e7aec0e43d71","observation_id":"9251db26-5f69-485c-93b2-5001711ac351","resolution":{"observed_at":"2026-08-04T20:09:21.328170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.334184Z","title":"Vidprom: A million-scale real prompt-gallery dataset for text-to-video diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.334184Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:956521148a2d903b84ce2205819c5da83b98317dcc9cd2b6e041b4f6981a9d3b","observation_id":"5f50d1fb-1192-436c-a355-265080606792","resolution":{"observed_at":"2026-08-04T20:09:21.334184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.339346Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.339346Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:123d7fe173382cdc8a5eade160d73a8ffe936faa37184f7e0c09b1087845c534","observation_id":"f517cffd-e04b-45e3-bcb4-4ea7d93baeed","resolution":{"observed_at":"2026-08-04T20:09:21.339346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.344064Z","title":"Is this generated person existed in real-world? fine-grained detecting and calibrating abnormal human-body","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.344064Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:9a06b4304a69faaed2f2c17355bd502bbdfeed190ef06d38665cae7b8bb8e98e","observation_id":"d28cca4f-df6a-4671-a2c2-9eb534b95b80","resolution":{"observed_at":"2026-08-04T20:09:21.344064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.348781Z","title":"Wang, Fred Hohman, and Duen Horng Chau","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.348781Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:5b1208c26a6df03ba37211099033d24afe5d26cdad8ae9d10128c74abc6d415b","observation_id":"2601439a-77f8-4f2d-82c6-8bae5de3a41c","resolution":{"observed_at":"2026-08-04T20:09:21.348781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.353739Z","title":"Human preference score: Better aligning text-to- image models with human preference","venue":null,"work_id":null,"year":2096},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.353739Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:919a0bed566307a3e9adcf11769afbf032e1b7bdf2f3d80562387e989da5ad47","observation_id":"bbeb5343-f88d-4518-bd45-094952edbc93","resolution":{"observed_at":"2026-08-04T20:09:21.353739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.358220Z","title":"A survey on video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.358220Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:0a0a553db9315cdc579957b18cd95370f53e24bcd16861eefc190753f095f20f","observation_id":"791e0f1e-522f-4465-a22c-6e426c17c44e","resolution":{"observed_at":"2026-08-04T20:09:21.358220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.363324Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.363324Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:c5f6d99da5208d4ff9e8db0bd8a6020afe0075e21a682faabca806f21b2a4561","observation_id":"7459c58a-1245-4444-a8f2-7fd387f24613","resolution":{"observed_at":"2026-08-04T20:09:21.363324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.368891Z","title":"Ipo: Iterative prefer- ence optimization for text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.368891Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:4aee9a6345ec8f0e4fdd01729d1216ad0c58a07dda0f7311b5316f77441ead74","observation_id":"c38832ca-426c-4b99-9b38-ca99c9403ad4","resolution":{"observed_at":"2026-08-04T20:09:21.368891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.374202Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.374202Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:c43e9231792dc5eb266add73e10ac98da7fbe8dd9d1191524a395f0fe502e676","observation_id":"d833450d-190e-423b-8fec-c4bb4e6a25a2","resolution":{"observed_at":"2026-08-04T20:09:21.374202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:21.378850Z","title":"Detrs beat yolos on real-time object detection, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:21.378850Z"},"links":{"citing_paper":"/paper/2509.08818"},"observation_digest":"sha256:65de79205faa0aa0d31a20f9f47875a578c77a9b2845af1202173ee4d522883b","observation_id":"e5979d6e-8305-4cc0-90bb-35d0fcd3cd28","resolution":{"observed_at":"2026-08-04T20:09:21.378850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08818","last_updated":"2025-09-10T17:51:42Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T05:46:53.131290Z","submitted_at":"2025-09-10T17:51:42Z","title":"GeneVA: A Dataset of Human Annotations for Generative Text to Video Artifacts"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2509.08818."}