{"as_of":"2026-08-10T06:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:709d36bda1972acf0a6053314a92f8cdf5df8587176757fe7ebf6168f4ee6a3c","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:50:57.966778Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T04:57:35.897847Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T05:21:28.330245Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"cited_work":{"arxiv_id":"2502.01719","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01719","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mj-video: Fine-grained benchmarking and rewarding video preferences in video generation","venue":null,"work_id":"24ffa43d-520e-494a-87bd-8c4559ac4136","year":2025},"citing_paper":{"arxiv_id":"2605.10806","last_updated":"2026-05-11T16:30:51Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T16:30:51Z","title":"PhyGround: Benchmarking Physical Reasoning in Generative World Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T05:17:30.010064Z"},"links":{"cited_paper":"/paper/2502.01719","citing_paper":"/paper/2605.10806"},"observation_digest":"sha256:77ed96f8a5eb14034cefbf20e775232dda6d9be1aafa8a567708df4606833191","observation_id":"28313f88-cbbb-403d-bfea-a7e042f23e29","resolution":{"observed_at":"2026-05-12T05:21:28.398672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01719","snapshot_observed_at":"2026-08-02T04:57:35.897847Z","title":"arXiv preprint arXiv:2502.01719 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13527","last_updated":"2026-07-15T07:26:05Z","snapshot_observed_at":"2026-08-05T04:43:47.810355Z","submitted_at":"2026-07-15T07:26:05Z","title":"VGIF-Score: Interpretable and Diagnostic Evaluation of Spatio-Temporal Instruction Following in Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T04:57:35.897847Z"},"links":{"cited_paper":"/paper/2502.01719","citing_paper":"/paper/2607.13527"},"observation_digest":"sha256:a0fd42512b3f11dc24d6c8c0c69a22b86480753fc044fba5e564582562e21992","observation_id":"425b4dc6-3fd3-4a6c-a61f-331fce530317","resolution":{"observed_at":"2026-08-02T04:57:35.897847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01719/citation-record","integrity":"/paper/2502.01719/integrity","json":"/paper/2502.01719/citation-record.json","paper":"/paper/2502.01719"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.04842","last_updated":"2024-07-05T20:03:16Z","snapshot_observed_at":"2026-08-05T13:28:06.601120Z","submitted_at":"2024-07-05T20:03:16Z","title":"MJ-Bench: Is Your Multimodal Reward Model Really a Good Judge for Text-to-Image Generation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04842","snapshot_observed_at":"2026-08-09T14:50:57.885137Z","title":"Mj- bench: Is your multimodal reward model really a good judge for text-to-image generation? arXiv preprint arXiv:2407.04842, 2024c","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.885137Z"},"links":{"cited_paper":"/paper/2407.04842","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:050449f1568821055cd5b5a4fa4387adfde597a607a8f9cf117f1582a3c919e8","observation_id":"c902011e-ed88-4d8a-a700-56eb392f4290","resolution":{"observed_at":"2026-08-09T14:50:57.885137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.04053","last_updated":"2023-08-30T18:41:01Z","snapshot_observed_at":"2026-08-08T20:55:30.305467Z","submitted_at":"2022-02-08T18:36:52Z","title":"DALL-Eval: Probing the Reasoning Skills and Social Biases of Text-to-Image Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.04053","snapshot_observed_at":"2026-08-09T14:50:57.889185Z","title":"Chu, Z., Zhang, L., Sun, Y ., Xue, S., Wang, Z., Qin, Z., and Ren, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.889185Z"},"links":{"cited_paper":"/paper/2202.04053","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:a2a00f0b0b7b30f0d108879211aad7fb500fa7d7bc7131d355e99a52a1cc45f7","observation_id":"b19a72e5-4a3b-45df-bf1b-31adeff16713","resolution":{"observed_at":"2026-08-09T14:50:57.889185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04180","last_updated":"2024-05-07T10:39:14Z","snapshot_observed_at":"2026-08-04T12:53:02.179899Z","submitted_at":"2024-05-07T10:39:14Z","title":"Sora Detector: A Unified Hallucination Detection for Large Text-to-Video Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04180","snapshot_observed_at":"2026-08-09T14:50:57.893552Z","title":"Cui, C., Zhang, A., Zhou, Y ., Chen, Z., Deng, G., Yao, H., and Chua, T.-S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.893552Z"},"links":{"cited_paper":"/paper/2405.04180","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:4492266e0edfc9dd6ceab961ae5cb1fbbde00e457d0c2177d1970c79ccb87b47","observation_id":"e361d06b-a7f7-45e5-a823-d12ab4b841e1","resolution":{"observed_at":"2026-08-09T14:50:57.893552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14477","last_updated":"2024-06-20T16:38:56Z","snapshot_observed_at":"2026-08-04T03:25:29.953949Z","submitted_at":"2024-06-20T16:38:56Z","title":"SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14477","snapshot_observed_at":"2026-08-09T14:50:57.897972Z","title":"Escontrela, A., Adeniji, A., Yan, W., Jain, A., Peng, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.897972Z"},"links":{"cited_paper":"/paper/2406.14477","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:66eb4f623da2b0a150fb504656c79a0ba4721b88bdfd989e181bde8806b74d89","observation_id":"cf5f9fa4-6811-4749-9553-fe979dc78699","resolution":{"observed_at":"2026-08-09T14:50:57.897972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15252","last_updated":"2024-10-14T04:08:53Z","snapshot_observed_at":"2026-07-06T18:34:56.008706Z","submitted_at":"2024-06-21T15:43:46Z","title":"VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15252","snapshot_observed_at":"2026-08-09T14:50:57.902010Z","title":"D., Ni, Y ., Lyu, B., Narsupalli, Y ., Fan, R., Lyu, Z., Lin, Y ., and Chen, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.902010Z"},"links":{"cited_paper":"/paper/2406.15252","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:f10352d443b5f5b84ab3bbd577086fa34b4a175b06b5257c9eb99903a7b7160a","observation_id":"31da6ec9-f403-4622-8549-7666b9ed3bf4","resolution":{"observed_at":"2026-08-09T14:50:57.902010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14134","last_updated":"2024-08-09T03:06:42Z","snapshot_observed_at":"2026-07-06T17:06:45.522731Z","submitted_at":"2023-12-21T18:55:05Z","title":"Diffusion Reward: Learning Rewards via Conditional Video Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14134","snapshot_observed_at":"2026-08-09T14:50:57.909565Z","title":"Diffusion reward: Learning rewards via conditional video diffusion, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.909565Z"},"links":{"cited_paper":"/paper/2312.14134","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:162cc9cc163f29c46834603f72651abde86cbc1c455c56eb7df7795ba06597f7","observation_id":"e7b1dff2-1328-498d-b9f6-64343387d609","resolution":{"observed_at":"2026-08-09T14:50:57.909565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16407","last_updated":"2024-03-25T03:47:53Z","snapshot_observed_at":"2026-07-06T17:49:52.751335Z","submitted_at":"2024-03-25T03:47:53Z","title":"A Survey on Long Video Generation: Challenges, Methods, and Prospects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16407","snapshot_observed_at":"2026-08-09T14:50:57.913295Z","title":"Nan, K., Xie, R., Zhou, P., Fan, T., Yang, Z., Chen, Z., Li, X., Yang, J., and Tai, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.913295Z"},"links":{"cited_paper":"/paper/2403.16407","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:98358b33c2d99bcff1c77fa8ef5114544e8cb6d8c29986e51b6585f4e427135a","observation_id":"940f8bf8-7f64-440a-b02a-2f8fe3a01b66","resolution":{"observed_at":"2026-08-09T14:50:57.913295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T14:50:57.917495Z","title":"Prabhudesai, M., Mendonca, R., Qin, Z., Fragkiadaki, K., and Pathak, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.917495Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:b229dd15b3f51353db7bdf92132b9e7b5c2092a16903d7f653428fe7d150194e","observation_id":"4b1e9b65-5473-4700-bd27-c909f8f839b9","resolution":{"observed_at":"2026-08-09T14:50:57.917495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-09T14:50:57.928717Z","title":"Tan, Z., Yang, X., Qin, L., and Li, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.928717Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:ba08ef56479e25e9fe4024ba44ed0ed4d11ad307eb80bf38a5f75dc7d0442173","observation_id":"68b6ab1f-7e35-4b6d-9756-3c7500679f1e","resolution":{"observed_at":"2026-08-09T14:50:57.928717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-09T20:05:31.409634Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-09T14:50:57.931994Z","title":"Team, G., Anil, R., Borgeaud, S., Alayrac, J.-B., Yu, J., Soricut, R., Schalkwyk, J., Dai, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.931994Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:2efc4ebc8d3106f8af9dbcf61a4a65d11eb0a943afd1b8ea48fb6477e67e9a7c","observation_id":"c6e343ae-abc6-4b30-8579-238b983a6dc2","resolution":{"observed_at":"2026-08-09T14:50:57.931994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-09T14:50:57.935225Z","title":"Unterthiner, T., van Steenkiste, S., Kurach, K., Marinier, R., Michalski, M., and Gelly, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.935225Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:e9df8e9b0ed886fe0ef708a700b14568128f6c08d0ac7369f253c1ea2a6d3e8c","observation_id":"7298da64-b8ba-439c-b17d-a9718811fac6","resolution":{"observed_at":"2026-08-09T14:50:57.935225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11698","last_updated":"2024-02-26T20:41:01Z","snapshot_observed_at":"2026-08-07T02:34:39.980213Z","submitted_at":"2023-06-20T17:24:23Z","title":"DecodingTrust: A Comprehensive Assessment of Trustworthiness in GPT Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11698","snapshot_observed_at":"2026-08-09T14:50:57.942282Z","title":"T., Arora, S., Mazeika, M., Hendrycks, D., Lin, Z., Cheng, Y ., Koyejo, S., Song, D., and Li, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.942282Z"},"links":{"cited_paper":"/paper/2306.11698","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:c89f41dc6b2b15d2a10857a4fe67540afa7eb7c089b2d71f4fbce3bafe2b217c","observation_id":"3355686f-75a9-4a76-ab65-d5a32a263c78","resolution":{"observed_at":"2026-08-09T14:50:57.942282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11175","last_updated":"2023-05-25T15:02:07Z","snapshot_observed_at":"2026-07-06T15:29:20.405296Z","submitted_at":"2023-05-18T17:59:42Z","title":"VisionLLM: Large Language Model is also an Open-Ended Decoder for Vision-Centric Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11175","snapshot_observed_at":"2026-08-09T14:50:57.945485Z","title":"Wang, W., Chen, Z., Chen, X., Wu, J., Zhu, X., Zeng, G., Luo, P., Lu, T., Zhou, J., Qiao, Y ., and Dai, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.945485Z"},"links":{"cited_paper":"/paper/2305.11175","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:806942e5728d3bf467e7b358ff90913bb08a891c4aeec5d79a826e545f6cadb6","observation_id":"d820e77e-2870-4205-b739-4e60b49df5cc","resolution":{"observed_at":"2026-08-09T14:50:57.945485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-09T14:50:57.948739Z","title":"Xu, H., Ghosh, G., Huang, P.-Y ., Okhonko, D., Agha- janyan, A., Metze, F., Zettlemoyer, L., and Feichten- hofer, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.948739Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:8b6ba085a7034e28517e5cdb1fd2a21296a0040787de75c05e4ad702a209a4f4","observation_id":"18de5102-b8ef-4bbe-9ebb-5082ecc8559a","resolution":{"observed_at":"2026-08-09T14:50:57.948739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.14084","last_updated":"2021-10-01T15:13:27Z","snapshot_observed_at":"2026-08-04T06:58:39.755482Z","submitted_at":"2021-09-28T23:01:51Z","title":"VideoCLIP: Contrastive Pre-training for Zero-shot Video-Text Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.14084","snapshot_observed_at":"2026-08-09T14:50:57.952377Z","title":"Xu, J., Huang, Y ., Cheng, J., Yang, Y ., Xu, J., Wang, Y ., Duan, W., Yang, S., Jin, Q., Li, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.952377Z"},"links":{"cited_paper":"/paper/2109.14084","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:9a1ed67c9690bfd90da735282814bd49a1dec5e093aa732b5f2efa9890f24e07","observation_id":"543902d4-b4fd-450d-a4e2-9555554887b0","resolution":{"observed_at":"2026-08-09T14:50:57.952377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02638","last_updated":"2021-10-30T20:14:46Z","snapshot_observed_at":"2026-07-06T11:16:06.357384Z","submitted_at":"2021-06-04T17:59:57Z","title":"Associating Objects with Transformers for Video Object Segmentation","version":3},"cited_work":{"arxiv_id":"2106.02638","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.02638","snapshot_observed_at":"2026-08-09T14:50:58.021158Z","title":"Associating Objects with Transformers for Video Object Segmentation","venue":"cs.CV","work_id":"b6459bdc-0029-427d-95ef-b84e6e600aa4","year":2021},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.955826Z"},"links":{"cited_paper":"/paper/2106.02638","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:748bc56324153a5e27ce954412c4f9c057d8e463b857758ed369f2eb69e4491c","observation_id":"808510b2-bf62-40ad-8c98-2d07349a852f","resolution":{"observed_at":"2026-08-09T14:50:58.082909Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-07-31T23:24:14.896271Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19309","snapshot_observed_at":"2026-08-09T14:50:57.959258Z","title":"Grape: Generalizing robot policy via preference alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.959258Z"},"links":{"cited_paper":"/paper/2411.19309","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:0120abe6b7536eca76af52ef834378377e8c8c601dd04ee592357c76d41b2995","observation_id":"cb8b47de-5906-4be4-b685-a637e828abe3","resolution":{"observed_at":"2026-08-09T14:50:57.959258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.09368","last_updated":"2022-10-14T00:08:24Z","snapshot_observed_at":"2026-08-07T01:23:19.488468Z","submitted_at":"2022-02-18T17:46:11Z","title":"Mixture-of-Experts with Expert Choice Routing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.09368","snapshot_observed_at":"2026-08-09T14:50:57.962595Z","title":"Zhou, Y ., Fan, Z., Cheng, D., Yang, S., Chen, Z., Cui, C., Wang, X., Li, Y ., Zhang, L., and Yao, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.962595Z"},"links":{"cited_paper":"/paper/2202.09368","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:e506fdf05a260d10678ee7c4d67c95230e5f38191d7bd4d29721b656d6c5a315","observation_id":"012f479a-c891-47aa-87fa-3f77cbac2f10","resolution":{"observed_at":"2026-08-09T14:50:57.962595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-09T14:50:57.966778Z","title":"M., Stiennon, N., Wu, J., Brown, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.966778Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:7ee20a2c8578359b9e33d06c2f1d0d223b92953d3c9a3805c014a13b236ee66f","observation_id":"f111550d-423f-451b-ba4f-9d6c8a80886c","resolution":{"observed_at":"2026-08-09T14:50:57.966778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-09T14:50:57.924526Z","title":"Singer, U., Polyak, A., Hayes, T., Yin, X., An, J., Zhang, S., Hu, Q., Yang, H., Ashual, O., Gafni, O., Parikh, D., Gupta, S., and Taigman, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.924526Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:0ff61289763b97c5c6a10132894b2078e7105b6607c5e66d12e090dcb3caf7ea","observation_id":"df2e0476-f0a3-4523-bb94-080a5c9bdbc2","resolution":{"observed_at":"2026-08-09T14:50:57.924526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-09T14:50:57.938692Z","title":"Wallace, B., Dang, M., Rafailov, R., Zhou, L., Lou, A., Purushwalkam, S., Ermon, S., Xiong, C., Joty, S., and Naik, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.938692Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:2cd3d13d9a7998d2eb9cef5fca6039410ae59e105c6624c2a9ebbb92b6e61018","observation_id":"511e3394-7d03-4e7e-bdbf-3c0957756164","resolution":{"observed_at":"2026-08-09T14:50:57.938692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.06704","last_updated":"2020-04-14T17:55:21Z","snapshot_observed_at":"2026-08-04T23:44:22.733290Z","submitted_at":"2020-04-14T17:55:21Z","title":"FineGym: A Hierarchical Video Dataset for Fine-grained Action Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.06704","snapshot_observed_at":"2026-08-09T14:50:57.920834Z","title":"Shazeer, N., Mirhoseini, A., Maziarz, K., Davis, A., Le, Q., Hinton, G., and Dean, J","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.920834Z"},"links":{"cited_paper":"/paper/2004.06704","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:00640ac0197d4020cda2108318cbecae8a5417e0cd8a59d7df287304bfebff17","observation_id":"81f87eac-27cf-4f26-89ab-aec9c2aeef4d","resolution":{"observed_at":"2026-08-09T14:50:57.920834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10447","last_updated":"2021-08-23T23:45:48Z","snapshot_observed_at":"2026-08-07T14:38:52.090440Z","submitted_at":"2021-08-23T23:45:48Z","title":"One TTS Alignment To Rule Them All","version":1},"cited_work":{"arxiv_id":"2108.10447","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.10447","snapshot_observed_at":"2026-08-09T14:50:58.280963Z","title":"One TTS Alignment To Rule Them All","venue":"cs.SD","work_id":"2588ad90-d231-4141-bf01-64fe32e94574","year":2021},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.871440Z"},"links":{"cited_paper":"/paper/2108.10447","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:7fa4b2f0f92df76f8a5d69928db2ce0914408a0bc36c941e0b46a943c6962716","observation_id":"cba47147-b9b0-4b7f-939c-1f90b209719d","resolution":{"observed_at":"2026-08-09T14:50:58.284874Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-09T14:50:57.906100Z","title":"org/abs/2205.15868","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.906100Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:5b1fc2d7707bd8bda1f32902b4ea58dc909d094e6b922552faf322b844229b1a","observation_id":"ef73c384-81b3-48ff-bca4-fccd4f05615f","resolution":{"observed_at":"2026-08-09T14:50:57.906100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-09T14:50:57.876146Z","title":"Cai, W., Jiang, J., Wang, F., Tang, J., Kim, S., and Huang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.876146Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:4a5edc928ae32ccbeb6fdf42c79194fe5a699a52894b28a7b895403fa477c239","observation_id":"89b97d76-42fb-48ef-89f0-0a658a9913ee","resolution":{"observed_at":"2026-08-09T14:50:57.876146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06204","last_updated":"2025-04-09T13:54:59Z","snapshot_observed_at":"2026-08-07T19:39:57.333135Z","submitted_at":"2024-06-26T16:34:33Z","title":"A Survey on Mixture of Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06204","snapshot_observed_at":"2026-08-09T14:50:57.880468Z","title":"Chen, D., Chen, R., Zhang, S., Liu, Y ., Wang, Y ., Zhou, H., Zhang, Q., Zhou, P., Wan, Y ., and Sun, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T14:50:57.880468Z"},"links":{"cited_paper":"/paper/2407.06204","citing_paper":"/paper/2502.01719"},"observation_digest":"sha256:95e559f3da66e0fdcebdf3aaf8eb9733bc38a7fdf56d89b8b85550d3d072a68c","observation_id":"10fa3c44-f736-4195-8948-87ab1bf63927","resolution":{"observed_at":"2026-08-09T14:50:57.880468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.01719","last_updated":"2025-02-07T03:54:34Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T02:03:37.501894Z","submitted_at":"2025-02-03T18:56:33Z","title":"MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 2 inbound Pith citation observations for arXiv:2502.01719."}