{"as_of":"2026-08-09T21:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5e2cafce72e33fb17614c6670a2545bf7e5395fba567977ede82dc8b72e7aec","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T23:40:21.599948Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:51:34.599824Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:39:57.276136Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04076","snapshot_observed_at":"2026-08-07T14:51:34.599824Z","title":"Content-rich aigc video qual- ity assessment via intricate text alignment and motion-aware consistency","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21523","last_updated":"2025-06-20T08:41:41Z","snapshot_observed_at":"2026-08-08T02:35:34.040619Z","submitted_at":"2025-05-23T05:08:40Z","title":"More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.599824Z"},"links":{"cited_paper":"/paper/2502.04076","citing_paper":"/paper/2505.21523"},"observation_digest":"sha256:782cef0ef6afb3386f0f75bfee7c57eb66717e23327abf9b5d4f2b20e5499080","observation_id":"5fc68969-9ec8-418d-a931-28abb29414e6","resolution":{"observed_at":"2026-08-07T14:51:34.599824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"cited_work":{"arxiv_id":"2502.04076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04076","snapshot_observed_at":"2026-07-04T16:39:57.276136Z","title":"Content-rich aigc video quality assessment via intricate text alignment and motion-aware consistency","venue":null,"work_id":"32a17dec-b6a9-453f-8bdd-e5c22ff6fa8d","year":2023},"citing_paper":{"arxiv_id":"2511.18373","last_updated":"2026-04-11T05:44:20Z","snapshot_observed_at":"2026-08-07T02:29:17.852730Z","submitted_at":"2025-11-23T09:43:44Z","title":"MASS: Motion-Aware Spatial-Temporal Grounding for Physics Reasoning and Comprehension in Vision-Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-17T05:55:11.495430Z"},"links":{"cited_paper":"/paper/2502.04076","citing_paper":"/paper/2511.18373"},"observation_digest":"sha256:ef7356fa0dfb212037734535aab374ea55bfc792a518bbed9cd0475959b48242","observation_id":"1a583657-983a-4c61-81a8-6814acaa4142","resolution":{"observed_at":"2026-05-17T05:59:08.657072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"cited_work":{"arxiv_id":"2502.04076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04076","snapshot_observed_at":"2026-07-04T16:39:57.276136Z","title":"Content-rich aigc video quality assessment via intricate text alignment and motion-aware consistency","venue":null,"work_id":"32a17dec-b6a9-453f-8bdd-e5c22ff6fa8d","year":2023},"citing_paper":{"arxiv_id":"2604.17074","last_updated":"2026-04-18T17:21:53Z","snapshot_observed_at":"2026-07-06T23:04:14.688737Z","submitted_at":"2026-04-18T17:21:53Z","title":"Comparison Drives Preference: Reference-Aware Modeling for AI-Generated Video Quality Assessment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T06:27:43.395596Z"},"links":{"cited_paper":"/paper/2502.04076","citing_paper":"/paper/2604.17074"},"observation_digest":"sha256:553dd29ededf9fd314ee818ca8ae4e09ef0cfc1d0e6eb098bbce810bc0dae5be","observation_id":"4872d589-ca48-4feb-b1bd-f9cd0f64585b","resolution":{"observed_at":"2026-05-10T06:31:30.717061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"cited_work":{"arxiv_id":"2502.04076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04076","snapshot_observed_at":"2026-07-04T16:39:57.276136Z","title":"Content-rich aigc video quality assessment via intricate text alignment and motion-aware consistency","venue":null,"work_id":"32a17dec-b6a9-453f-8bdd-e5c22ff6fa8d","year":2023},"citing_paper":{"arxiv_id":"2605.10806","last_updated":"2026-05-11T16:30:51Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T16:30:51Z","title":"PhyGround: Benchmarking Physical Reasoning in Generative World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T05:17:30.010064Z"},"links":{"cited_paper":"/paper/2502.04076","citing_paper":"/paper/2605.10806"},"observation_digest":"sha256:288048c787fb07e847c7f34cc31d3d4d9966be0b828c804d685ddf539fd9ffdf","observation_id":"fa1bf4dd-37e6-41c9-81ea-bc7a5c8936cd","resolution":{"observed_at":"2026-05-12T05:21:28.553668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"cited_work":{"arxiv_id":"2502.04076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04076","snapshot_observed_at":"2026-07-04T16:39:57.276136Z","title":"Content-rich aigc video quality assessment via intricate text alignment and motion-aware consistency","venue":null,"work_id":"32a17dec-b6a9-453f-8bdd-e5c22ff6fa8d","year":2023},"citing_paper":{"arxiv_id":"2606.23643","last_updated":"2026-06-22T17:31:21Z","snapshot_observed_at":"2026-08-06T14:51:21.966073Z","submitted_at":"2026-06-22T17:31:21Z","title":"TailorMind: Towards Preference-Aligned Multimodal Content Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T08:14:07.112511Z"},"links":{"cited_paper":"/paper/2502.04076","citing_paper":"/paper/2606.23643"},"observation_digest":"sha256:c9905c7c99a4dbfb1611d1d300029da9e863974637dc95027f07b14b40bb5406","observation_id":"9c4b37f6-b502-40e9-b2e8-cfd7b8aae281","resolution":{"observed_at":"2026-07-04T10:59:46.786194Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"cited_work":{"arxiv_id":"2502.04076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04076","snapshot_observed_at":"2026-07-04T16:39:57.276136Z","title":"Content-rich aigc video quality assessment via intricate text alignment and motion-aware consistency","venue":null,"work_id":"32a17dec-b6a9-453f-8bdd-e5c22ff6fa8d","year":2023},"citing_paper":{"arxiv_id":"2606.24196","last_updated":"2026-06-24T04:54:52Z","snapshot_observed_at":"2026-08-01T23:27:51.392371Z","submitted_at":"2026-06-23T06:31:21Z","title":"Navigating User Behavior toward Personalized Multimodal Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T00:26:36.300071Z"},"links":{"cited_paper":"/paper/2502.04076","citing_paper":"/paper/2606.24196"},"observation_digest":"sha256:f95a82a6cd5b6a0437273f6e099327ce0db32ba24fcc0956f0647a37e290acba","observation_id":"8a7c33c9-1046-466c-9033-12cb3fbd7f91","resolution":{"observed_at":"2026-07-04T16:39:57.277627Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04076/citation-record","integrity":"/paper/2502.04076/integrity","json":"/paper/2502.04076/citation-record.json","paper":"/paper/2502.04076"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T23:40:21.526498Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.526498Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:29d1d14dbe44c7ac4aad1d30c902fa21b4295f9d7339784c8ea6e956dd24ebb3","observation_id":"c2a8e74a-7113-4f37-adbf-25e50092632d","resolution":{"observed_at":"2026-08-08T23:40:21.526498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-07T10:15:15.859263Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-08T23:40:21.538548Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.538548Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:fd8434bdc59509964a1344a5d1ed1b8d12722bc44e0dab0b7e532e3a8082ef32","observation_id":"be168710-22c4-40bb-809c-a770244efa32","resolution":{"observed_at":"2026-08-08T23:40:21.538548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:40:21.542777Z","title":"Huang, Z., He, Y ., Yu, J., Zhang, F., Si, C., Jiang, Y ., Zhang, Y ., Wu, T., Jin, Q., Chanpaisit, N., Wang, Y ., Chen, X., Wang, L., Lin, D., Qiao, Y ., and Liu, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.542777Z"},"links":{"citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:4826d5575bf8029bb8fa8f93c98ad6c2091b3fd00712964adda394710ff0e503","observation_id":"e8eaeb3f-7de1-4d52-9224-d1bab1684c4d","resolution":{"observed_at":"2026-08-08T23:40:21.542777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11956","last_updated":"2024-08-07T17:02:00Z","snapshot_observed_at":"2026-07-06T17:46:25.142387Z","submitted_at":"2024-03-18T16:52:49Z","title":"Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11956","snapshot_observed_at":"2026-08-08T23:40:21.554288Z","title":"Subjective-aligned dataset and metric for text-to-video quality assessment, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.554288Z"},"links":{"cited_paper":"/paper/2403.11956","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:3164db11a6edd221ec8a9a9b4e5703e3b606bbda431c69430197bb3b0362db12","observation_id":"249154e6-5495-43f8-8529-cc6f2f248189","resolution":{"observed_at":"2026-08-08T23:40:21.554288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:40:21.557939Z","title":"10948109","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.557939Z"},"links":{"citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:0d0dc355c64cebcb0eb08f254002964e8ed0dd98b027fb974fa66905d69a8afb","observation_id":"0cd71f66-bd3c-40e0-9bbb-0cbd466d8d3a","resolution":{"observed_at":"2026-08-08T23:40:21.557939Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01813","last_updated":"2023-12-26T05:27:46Z","snapshot_observed_at":"2026-08-09T12:58:52.526353Z","submitted_at":"2023-11-03T09:46:05Z","title":"FETV: A Benchmark for Fine-Grained Evaluation of Open-Domain Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01813","snapshot_observed_at":"2026-08-08T23:40:21.561264Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.561264Z"},"links":{"cited_paper":"/paper/2311.01813","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:d30c711f52848ff92347a4d3a1b47eac97a7be30b98447e8759f9e2cf40f3d73","observation_id":"016ad169-e761-4ded-a56e-f41c735fe44b","resolution":{"observed_at":"2026-08-08T23:40:21.561264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13573","last_updated":"2024-04-27T15:10:55Z","snapshot_observed_at":"2026-07-06T18:03:15.097118Z","submitted_at":"2024-04-21T08:27:20Z","title":"Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13573","snapshot_observed_at":"2026-08-08T23:40:21.565103Z","title":"Exploring aigc video quality: A focus on visual harmony, video-text consistency and domain distribution gap","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.565103Z"},"links":{"cited_paper":"/paper/2404.13573","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:796bafb96bc6076d29366ab59c42880783d7b34fa074beebfe2c045278cea97f","observation_id":"910d71c2-770b-42ff-bb88-a2651194a62a","resolution":{"observed_at":"2026-08-08T23:40:21.565103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14505","last_updated":"2025-01-15T18:57:31Z","snapshot_observed_at":"2026-08-07T21:50:52.094296Z","submitted_at":"2024-07-19T17:58:36Z","title":"T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14505","snapshot_observed_at":"2026-08-08T23:40:21.573733Z","title":"T2v-compbench: A comprehensive benchmark for compositional text-to-video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.573733Z"},"links":{"cited_paper":"/paper/2407.14505","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:f992add7f766dc4656b1f79288029dadf61fef78ae88f2342ebf8b94fb7b3e3c","observation_id":"abfdd187-1a43-4bf7-bce2-6ed78f0b9b96","resolution":{"observed_at":"2026-08-08T23:40:21.573733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:40:21.778059Z","title":"and Deng, J","venue":null,"work_id":"a014dcdb-109e-4c70-ae59-0628f3b8314e","year":2020},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.578004Z"},"links":{"citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:2fc3a025714f986714aa67bd98091e0321db8f25cba63a3f37fdc975c77d0edc","observation_id":"38913820-e6c5-4ca7-9bd0-cb3b5104e22d","resolution":{"observed_at":"2026-08-08T23:40:21.782648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-08T23:40:21.581583Z","title":"Towards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.581583Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:909b906090d5bd07fcbb5a41ac702cb26229d62a6fc94f0ef21c47d6645d0e9d","observation_id":"82f6c8db-c73e-429c-8c24-c231878f1b91","resolution":{"observed_at":"2026-08-08T23:40:21.581583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-08T23:40:21.592874Z","title":"Cogvideox: Text-to-video diffusion models with an ex- pert transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.592874Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:b79c0ef1a77a59eb68bcbbcbc01d1bbe5679c481641078fde8f82664c38b8ea8","observation_id":"a8a32d52-2eda-4422-9962-52baae7d614f","resolution":{"observed_at":"2026-08-08T23:40:21.592874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05227","last_updated":"2024-10-10T14:17:30Z","snapshot_observed_at":"2026-08-04T18:33:43.426794Z","submitted_at":"2024-10-07T17:35:10Z","title":"The Dawn of Video Generation: Preliminary Explorations with SORA-like Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05227","snapshot_observed_at":"2026-08-08T23:40:21.596386Z","title":"The dawn of video generation: Preliminary explorations with sora-like models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.596386Z"},"links":{"cited_paper":"/paper/2410.05227","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:62fbbdfe9ed41c93b3d6c0e931b201868872a9ceb714d12090bcc8afd0e376f7","observation_id":"8cf20e18-74b9-46a5-9924-b4439dadbd04","resolution":{"observed_at":"2026-08-08T23:40:21.596386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15378","last_updated":"2024-07-22T06:10:41Z","snapshot_observed_at":"2026-08-08T00:30:36.324986Z","submitted_at":"2024-03-22T17:58:16Z","title":"Long-CLIP: Unlocking the Long-Text Capability of CLIP","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15378","snapshot_observed_at":"2026-08-08T23:40:21.599948Z","title":"Long-clip: Unlocking the long-text capability of clip","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.599948Z"},"links":{"cited_paper":"/paper/2403.15378","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:ae883db250cfad482d1eb474c82f2e9779f9cd53c01fbadb2ceb568764ee2848","observation_id":"6cb0ee77-9ec0-4717-8e75-9b406f2599c7","resolution":{"observed_at":"2026-08-08T23:40:21.599948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T23:40:21.550393Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.550393Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:f1a627ac6c26208f14783b472fa1f3b75d6e554df083cb5595d7e85a2a846c8e","observation_id":"19de4fc0-0c87-4f11-8229-4f01711a7157","resolution":{"observed_at":"2026-08-08T23:40:21.550393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-07T17:54:54.749604Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-08T23:40:21.585302Z","title":"Modelscope text-to-video technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.585302Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:8f95909624c9d5abef1f4081965ab630b7033b8e6753c98282300e130c26b23c","observation_id":"9e5bb564-1f1a-457c-b9a4-e4bb6ab4ed61","resolution":{"observed_at":"2026-08-08T23:40:21.585302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-08T23:40:21.534636Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.534636Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:6010163e79b28f609a2981dbbf6751f372babd1f7acb6b3f16d13f9a9edd4f4f","observation_id":"e702f49b-d926-4fa1-aa05-02d04b8a92bc","resolution":{"observed_at":"2026-08-08T23:40:21.534636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17090","snapshot_observed_at":"2026-08-08T23:40:21.589149Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.589149Z"},"links":{"cited_paper":"/paper/2312.17090","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:255781591e219f6ba23142e957594841b547b4e632dcc63a0e881b170176b889","observation_id":"a58988eb-ec31-4e82-ad1e-c789bae44716","resolution":{"observed_at":"2026-08-08T23:40:21.589149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:40:21.789947Z","title":"De- tecting deep-fake videos from appearance and behavior","venue":null,"work_id":"71fd712f-eaa8-4502-ba59-d8184c97b7ad","year":2020},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.530843Z"},"links":{"citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:389a0af84cb979e006d5db46cc988606a4639d238d2ae7b39e6ca269a8c40d53","observation_id":"30a4a48c-c2a8-4d19-9885-9a379cbcdd0a","resolution":{"observed_at":"2026-08-08T23:40:21.794447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-08T23:40:21.546574Z","title":"Int.Telecommun.Union","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.546574Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:f07335d14b96ded55a7c91f0f0914564454c590478c47e1aa55dcd0c9d1c352f","observation_id":"336e50a1-1a3d-46db-be39-bd18ea234aeb","resolution":{"observed_at":"2026-08-08T23:40:21.546574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T12:59:11.651183Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 6 inbound Pith citation observations for arXiv:2502.04076."}