{"as_of":"2026-08-09T22:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a4268c0976ea144d60ce60e683dc4e5c081b6279495fa21aae537474e50181a","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:16:44.879850Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05485/citation-record","integrity":"/paper/2608.05485/integrity","json":"/paper/2608.05485/citation-record.json","paper":"/paper/2608.05485"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.880622Z","title":"Wan2.2-V ACE-Fun-A14B, 2025","venue":null,"work_id":"be64899a-9a48-4fc7-96be-80a4d377de0e","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.625731Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:803c09ea06f71f1fdc3bc28c229e7cfb7479ca834a36b9b09893c8d514091c2d","observation_id":"f3024a84-9e41-4b75-a945-c57d57ecf7bd","resolution":{"observed_at":"2026-08-08T12:16:46.884732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.870807Z","title":"Introducing Claude Opus 4.8, 2026","venue":null,"work_id":"ed184923-39e9-4534-b2be-37cc6f0fe36d","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.632135Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:594611b1ceb7335eeeb901537a78874f199dcaa0c1004fa2ccc4672af0a3f1a1","observation_id":"c4ad8a92-ea21-4935-83ad-80039a396b85","resolution":{"observed_at":"2026-08-08T12:16:46.874678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.636943Z","title":"Sana-video: Efficient video generation with block linear diffusion transformer.arXiv preprint arXiv:2509.24695, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.636943Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:15205c01d228512ae1bae49a604a735155ca4249d3feb639b10a5f70c105fb06","observation_id":"b7f568b1-6949-42f8-bcaf-192691708af7","resolution":{"observed_at":"2026-08-08T12:16:44.636943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.641153Z","title":"Ivebench: Modern benchmark suite for instruction-guided video editing assessment.arXiv preprint arXiv:2510.11647, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.641153Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:fef7dd40d5e409ce79c9e0e58c7cd4a77e67d1662210b3c1e855ada8a49e751e","observation_id":"92cf486a-ff02-4e4c-91ed-7b746d92e0db","resolution":{"observed_at":"2026-08-08T12:16:44.641153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.645017Z","title":"Magref: Masked guid- ance for any-reference video generation with subject disen- tanglement.arXiv preprint arXiv:2505.23742, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.645017Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:ba75a379ab3c529edb4a81ebda08bc69927f9bd99c62695ddedd0e409a56ddad","observation_id":"cfb085e4-7b92-4323-876d-efc25c368d6f","resolution":{"observed_at":"2026-08-08T12:16:44.645017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.851331Z","title":"Gemini 3.1 Pro: Model card, 2026","venue":null,"work_id":"10834873-4edd-4658-b62e-9b75b2b32548","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.649217Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:803f83f9767767eaebbe134173be652dca2f08a6c381a74f326307203ea047b1","observation_id":"883ba724-856e-4408-b5d6-ee7e0eed42bd","resolution":{"observed_at":"2026-08-08T12:16:46.864266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.839684Z","title":"Veo 3 Model Card","venue":null,"work_id":"e248621a-9bf7-4f16-86f4-a1e534f82084","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.653181Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:69a6feff1eddec82d04229d848dc025169105a93c7ddaa6598bfe3be1e44fb14","observation_id":"2289aca0-a75c-4fe3-9fd9-579e70773def","resolution":{"observed_at":"2026-08-08T12:16:46.844417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-08T12:16:44.657247Z","title":"Ltx-video: Realtime video latent diffusion.arXiv preprint arXiv:2501.00103,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.657247Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d77812e379ad3d2463cc5e29b718a1afbb8cc60c022679a29e008e28935e3245","observation_id":"95df5e91-9c1d-481d-a73f-3cc4bfabf1e9","resolution":{"observed_at":"2026-08-08T12:16:44.657247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.661497Z","title":"Openve-3m: A large-scale high-quality dataset for instruction-guided video editing.arXiv preprint arXiv:2512.07826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.661497Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:1ba5861068ccd4d4d6bcbbb764ed45451b11ec96294c22efa956d6762154bae2","observation_id":"c16f47e2-8914-4725-9eaf-4d991528485f","resolution":{"observed_at":"2026-08-08T12:16:44.661497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-08T15:15:48.227139Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-08T12:16:44.665393Z","title":"Hunyuancustom: A multimodal-driven architecture for customized video gener- ation.arXiv preprint arXiv:2505.04512, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.665393Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:84096b468ac399b6a69034ed10a630286c64ea14abbe26907eb8647b980fc92d","observation_id":"f7d9a41d-ccf7-4740-93f2-eabb73556743","resolution":{"observed_at":"2026-08-08T12:16:44.665393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09699","last_updated":"2023-08-17T21:43:24Z","snapshot_observed_at":"2026-08-05T17:48:17.937618Z","submitted_at":"2022-11-15T19:07:53Z","title":"PromptCap: Prompt-Guided Task-Aware Image Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09699","snapshot_observed_at":"2026-08-08T12:16:44.671113Z","title":"Promptcap: Prompt-guided task- aware image captioning.arXiv preprint arXiv:2211.09699,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.671113Z"},"links":{"cited_paper":"/paper/2211.09699","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:8fde863845f74d238bdffceb98e6984186b53eb3ea0d263032986e003566e929","observation_id":"1f83d1d8-d99a-4b81-a0da-95d0766194d8","resolution":{"observed_at":"2026-08-08T12:16:44.671113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09733","last_updated":"2024-10-13T05:35:09Z","snapshot_observed_at":"2026-08-02T08:33:00.410905Z","submitted_at":"2024-10-13T05:35:09Z","title":"MMCOMPOSITION: Revisiting the Compositionality of Pre-trained Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09733","snapshot_observed_at":"2026-08-08T12:16:44.676377Z","title":"Mmcomposition: Revisiting the compositionality of pre-trained vision-language models.arXiv preprint arXiv:2410.09733, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.676377Z"},"links":{"cited_paper":"/paper/2410.09733","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:70ad20593191029c6ad235a22d1e86953cc33920bfdb0df82bebb613e21c38ae","observation_id":"7b4dbd12-f7ba-49db-8bed-d4a396b798c9","resolution":{"observed_at":"2026-08-08T12:16:44.676377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19415","last_updated":"2025-05-27T20:10:09Z","snapshot_observed_at":"2026-08-07T14:12:18.054397Z","submitted_at":"2025-05-26T02:07:24Z","title":"MMIG-Bench: Towards Comprehensive and Explainable Evaluation of Multi-Modal Image Generation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19415","snapshot_observed_at":"2026-08-08T12:16:44.681599Z","title":"Mmigbench: Towards comprehensive and explainable evaluation of multi-modal image generation models.arXiv preprint arXiv:2505.19415, 3, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.681599Z"},"links":{"cited_paper":"/paper/2505.19415","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:1908ef29be74b3e1520f02712bea72a27a4242998455e1a34f0ec2b0612a0d87","observation_id":"f88a1b98-a342-4fd0-93d6-3d990ade54d9","resolution":{"observed_at":"2026-08-08T12:16:44.681599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11251","last_updated":"2025-03-14T10:01:55Z","snapshot_observed_at":"2026-08-09T05:35:15.000362Z","submitted_at":"2025-03-14T10:01:55Z","title":"Step-Video-TI2V Technical Report: A State-of-the-Art Text-Driven Image-to-Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11251","snapshot_observed_at":"2026-08-08T12:16:44.687142Z","title":"Step-video-ti2v technical re- port: A state-of-the-art text-driven image-to-video genera- tion model.arXiv preprint arXiv:2503.11251, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.687142Z"},"links":{"cited_paper":"/paper/2503.11251","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:deb268af685ea81c7929658e04dfa5bbd2cc99fae72799e3856d2a70bc8d63be","observation_id":"51b6d96d-10e3-4dd3-b386-20e12e2a075e","resolution":{"observed_at":"2026-08-08T12:16:44.687142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.732245Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":"f394c070-cdca-4532-9b54-ed3967dc3e7a","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.692436Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:06fcd5f17012e8312df65ad0db6c4c059df7b0c1a5643d6ae7e48e60f5958b2a","observation_id":"bc2f26c9-c31a-48c7-8389-9acd2deacfbe","resolution":{"observed_at":"2026-08-08T12:16:46.832436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.698653Z","title":"Vace: All-in-one video creation and editing","venue":null,"work_id":"35b746a5-c6f7-4c97-87e9-9eaa2a1e5314","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.697969Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:4113c1472d7ade4b21fd3dc318cd6263ded28f1c55564a697a49f81dd2d6f46d","observation_id":"11b19253-6a42-447f-ae99-645ad0ba67fb","resolution":{"observed_at":"2026-08-08T12:16:46.703008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20360","last_updated":"2026-04-18T01:38:10Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T17:59:30Z","title":"EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20360","snapshot_observed_at":"2026-08-08T12:16:44.702972Z","title":"Editverse: Unifying image and video editing and generation with in-context learning.arXiv preprint arXiv:2509.20360, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.702972Z"},"links":{"cited_paper":"/paper/2509.20360","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:8d5648ee279d39687dbef5baca6bf22039bb9e2981028cd78ff52f335e8f9305","observation_id":"474b4297-571f-4ccf-bb7f-c70936a7e35f","resolution":{"observed_at":"2026-08-08T12:16:44.702972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-08T12:16:44.707094Z","title":"Anyv2v: A tuning-free framework for any video-to- video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.707094Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:9e57c8277bdfebab776c4ca2f1d5a1d6209fc68ce9949ba75ae3767881d4ec9d","observation_id":"19bb3541-0439-4422-9c09-67e0f00c4524","resolution":{"observed_at":"2026-08-08T12:16:44.707094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.689135Z","title":"Kling AI Launches 3.0 Model, Ush- ering in an Era Where Everyone Can Be a Director, 2026","venue":null,"work_id":"d8dfdbe6-83b5-4edb-b744-653059f5f165","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.712409Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:0310493aef10274579273330706da07dc7b554e2b1ceb8b564fabf0ad39e84d0","observation_id":"32a2a8ae-fcaa-44f6-9ed9-4e820c224c55","resolution":{"observed_at":"2026-08-08T12:16:46.692536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.716955Z","title":"Skyreels-v3 technique report","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.716955Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d554018a89df293f56ae5b9a5f6b9ba7d80d8cf688da9825144f0e822ed99923","observation_id":"c99fe9af-3db6-43d8-9510-1d2043848754","resolution":{"observed_at":"2026-08-08T12:16:44.716955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.508274Z","title":"Five-bench: A fine-grained video editing benchmark for evaluating emerging diffusion and rectified flow models","venue":null,"work_id":"305bf177-cbee-4c50-8149-5f68ed82c50b","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.721069Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:f5995232f995a686f4b57b2f27d86ba7cded8f2f31db77cb50d591bcb43fd6d1","observation_id":"17524af8-6f2d-4c5a-8d7e-7d51dd9582e4","resolution":{"observed_at":"2026-08-08T12:16:46.590406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.725253Z","title":"Bindweave: Subject-consistent video generation via cross-modal integration.arXiv preprint arXiv:2510.00438, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.725253Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:7828007ab8382847bf25db53302a499d7448f4c3f6bca908c16d28669cbc32c2","observation_id":"a1bcf71c-3ef6-4052-bd77-df701de5ea79","resolution":{"observed_at":"2026-08-08T12:16:44.725253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.459585Z","title":"Videoxum: Cross- modal visual and textural summarization of videos.IEEE Transactions on Multimedia, 26:5548–5560, 2023","venue":null,"work_id":"608a3858-0253-4155-a52c-3f2c5ef83b2e","year":2023},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.729363Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:9ec418eefe65a2ffbd515e239eddd31e2f96f6e0caf8867d0b7b250e32daca6b","observation_id":"0b0ecad0-6b65-47ae-818e-f2db421da0f3","resolution":{"observed_at":"2026-08-08T12:16:46.499936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02175","last_updated":"2026-05-13T06:57:11Z","snapshot_observed_at":"2026-07-31T17:42:41.975872Z","submitted_at":"2026-03-02T18:46:28Z","title":"Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02175","snapshot_observed_at":"2026-08-08T12:16:44.733443Z","title":"Kiwi-edit: Versatile video edit- ing via instruction and reference guidance.arXiv preprint arXiv:2603.02175, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.733443Z"},"links":{"cited_paper":"/paper/2603.02175","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:95af71f73d81305fc17e660829b5b430640c988e6b6f662e9294df918a08db3f","observation_id":"2f7209ca-05aa-4b22-9e51-cabd231c8770","resolution":{"observed_at":"2026-08-08T12:16:44.733443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.375342Z","title":"Phantom: Subject-consistent video generation via cross- modal alignment","venue":null,"work_id":"43997fe6-54e4-4527-8e48-cbdc252cdb87","year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.737319Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:fbd18f0f17cd1a23934eda09170cba09484c5b83e1acca6f1dd75dabae3b8c78","observation_id":"b47b7651-7284-4269-8034-92ff3ff37c63","resolution":{"observed_at":"2026-08-08T12:16:46.426385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.363144Z","title":"Evalcrafter: Benchmarking and eval- uating large video generation models","venue":null,"work_id":"a4416ce1-15c2-4c3a-915e-689b343b5340","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.741315Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:5ed466231e77deb7cabbed22908a4b8e313b02a52021f8239a1e5bc2c45d84a1","observation_id":"10ae334f-c9e3-4892-b089-7d9ae2f2c664","resolution":{"observed_at":"2026-08-08T12:16:46.366902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-08T12:16:44.745272Z","title":"Step-video-t2v technical re- port: The practice, challenges, and future of video founda- tion model.arXiv preprint arXiv:2502.10248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.745272Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:72f7ace00152c923184cdd3ae17c16f36195b2e2d8a2fa7c85ca91eac2940797","observation_id":"c5e2e806-9400-428a-bcce-a2533d70337c","resolution":{"observed_at":"2026-08-08T12:16:44.745272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-08-08T12:16:44.749653Z","title":"Towards world simulator: Crafting physical commonsense-based benchmark for video generation.arXiv preprint arXiv:2410.05363, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.749653Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:cee013cad521f81422b80b8917fb196d0f7213f84519e726c9fb871bbb71f64d","observation_id":"3fb93422-dd37-4e82-b381-bc06916b7182","resolution":{"observed_at":"2026-08-08T12:16:44.749653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.353510Z","title":"GPT-5.6 system card, 2026","venue":null,"work_id":"7fa6deb3-49d8-4f69-9266-a5701eb7b0a2","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.754532Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:00d0bb0fdc8f47ec5bced7f503ce6dc9639f67a19a35ba1d3ace46aedd210906","observation_id":"d25e84af-91ad-42f1-8cc4-13490733b054","resolution":{"observed_at":"2026-08-08T12:16:46.357130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.758766Z","title":"Omniweaving: Towards unified video generation with free-form composition and reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.758766Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:496f96af5d98d1fb5f3fb1e8c6d291f5e0c96d7313de7aa94dcf248e4d84d3c0","observation_id":"f73d2211-82e6-4af8-b94a-fb0044fd4a0d","resolution":{"observed_at":"2026-08-08T12:16:44.758766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.342952Z","title":"Pixabay: Royalty-free images and videos.https: //pixabay.com, 2026","venue":null,"work_id":"1beb6288-51d6-41a3-84d9-95c75f6991ea","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.762524Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:fd8ffadb8d157fc86dca1ac9c942d889860646a5845fd6e34f9f7e3defd5fa53","observation_id":"486b556f-6584-47bb-9465-f6a6ae0803dd","resolution":{"observed_at":"2026-08-08T12:16:46.346401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.332976Z","title":"Qwen3.6-27B: Flagship-level coding in a 27B dense model, 2026","venue":null,"work_id":"2de7d494-cc29-4fad-94f5-15ed75937f75","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.766419Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:a68fcfba2e04ea59b97a628e61ca5323d24b5be0f1acd5cc3eddcdfb8c0c6802","observation_id":"0998ea8a-608a-476d-ad98-998d6b46c40a","resolution":{"observed_at":"2026-08-08T12:16:46.336570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-08T12:16:44.769866Z","title":"Seedance 2.0: Advanc- ing video generation for world complexity.arXiv preprint arXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.769866Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:f461382c0c74c43e8cfe31c21bd54a0f03bf6a8f4276330571a80dbbfb7561ce","observation_id":"1dd5f689-5e55-4392-9b06-d939107545b1","resolution":{"observed_at":"2026-08-08T12:16:44.769866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.775154Z","title":"T2v-compbench: A comprehen- sive benchmark for compositional text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.775154Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:f6757372c526353bd233e087e918e3d6f08c35c938ee8130fe99d4362f80c3ff","observation_id":"f96ff7d6-e314-43bb-b574-0dd980bf18d5","resolution":{"observed_at":"2026-08-08T12:16:44.775154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.779094Z","title":"Video-lmm post-training: A deep dive into video reasoning with large multimodal models.arXiv preprint arXiv:2510.05034, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.779094Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:eb357f393bccd8b58a9c45be5a1ea42710d06ce128994656e57d7870cbde3a82","observation_id":"0af05ddf-9c21-4556-930e-279e2c02a8b7","resolution":{"observed_at":"2026-08-08T12:16:44.779094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.782827Z","title":"Lucy edit: Open-weight text-guided video editing, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.782827Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:7a3bae45ca3f2fa1456a3e669576e772b50ddfe99530dbc9224f4c46052b00f4","observation_id":"5f2fc3c5-a8fc-4954-9bcf-3ca3b7a300a7","resolution":{"observed_at":"2026-08-08T12:16:44.782827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.309564Z","title":"Gemma 4 technical report, 2026","venue":null,"work_id":"939c1e96-47b4-4415-8767-52ad5b2a3fc4","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.787491Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:0534025bf0d2c644552bcbe48567b06afce0a15e617f1d059bebe7478be45bd2","observation_id":"988ad96b-8dc7-4ad5-bb9f-eb9e756f05aa","resolution":{"observed_at":"2026-08-08T12:16:46.313523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.792627Z","title":"Longcat-video techni- cal report.arXiv preprint arXiv:2510.22200, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.792627Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:e784b244e71a56f3cb39442ff822be5ae5cb36f14ca150ef2cdfc1410d99ea63","observation_id":"e376cdd5-80f4-4f42-b5a2-3af01ed69e99","resolution":{"observed_at":"2026-08-08T12:16:44.792627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-08T12:16:44.796295Z","title":"Wan: Open and advanced large-scale video gen- erative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.796295Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:9d53ac46214effb631e3171a76562ec952f582f4ab5baaaf1e68d6d651e426fa","observation_id":"0c949280-2d1b-42e5-a590-6522acdff149","resolution":{"observed_at":"2026-08-08T12:16:44.796295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25743","last_updated":"2026-06-29T08:23:47Z","snapshot_observed_at":"2026-08-08T15:15:46.111735Z","submitted_at":"2026-03-26T17:59:57Z","title":"RefAlign: Representation Alignment for Reference-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.25743","snapshot_observed_at":"2026-08-08T12:16:44.799989Z","title":"Refalign: Repre- sentation alignment for reference-to-video generation.arXiv preprint arXiv:2603.25743, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.799989Z"},"links":{"cited_paper":"/paper/2603.25743","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:a36fcf68d434fa6dffa07204d37edeee03c73809bc0249b568c34470c1f5365e","observation_id":"19c4003a-59d5-4d7f-a706-68799627988f","resolution":{"observed_at":"2026-08-08T12:16:44.799989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.276933Z","title":"Groupdancer: Music to multi-people dance synthesis with style collaboration","venue":null,"work_id":"02452284-4701-40f8-a80b-023d8e494a65","year":2022},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.804549Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:6eb08751015b73c3da9a8e0e9a1afe8f6a195a4a54039612dc202dbcaa33da9f","observation_id":"3694f8df-fdb4-46ff-a867-f495cb517607","resolution":{"observed_at":"2026-08-08T12:16:46.303102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.200518Z","title":"Dance- camera3d: 3d camera movement synthesis with music and dance","venue":null,"work_id":"16525c92-5df8-4b87-84fb-cccfc519324d","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.809570Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:1d83b9396936f50fdf73e23239f062f1244c0f5b690cf46fe9fe96199f85e647","observation_id":"e762aba0-8b1b-4526-90fb-0d3594ab4aeb","resolution":{"observed_at":"2026-08-08T12:16:46.242406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.182359Z","title":"Dancecamanimator: Keyframe- based controllable 3d dance camera synthesis","venue":null,"work_id":"5c8cbf6b-84fe-43d9-be05-3358b28b7d68","year":2024},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.813364Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:276c63d3a89c7d8ed134ad556e309eebccddb0b48e183644b52dd2cb9025b2e3","observation_id":"49b431a5-866a-4b0d-99ae-7752132052c1","resolution":{"observed_at":"2026-08-08T12:16:46.186876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-07T16:29:46.498912Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08377","snapshot_observed_at":"2026-08-08T12:16:44.816528Z","title":"Univideo: Unified understanding, generation, and editing for videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.816528Z"},"links":{"cited_paper":"/paper/2510.08377","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:d618d981869076d821a8021d4f2c62dbfa9431d683a163bdf53262beb3619367","observation_id":"792a3c7b-e677-477f-9104-59b7fa1676d2","resolution":{"observed_at":"2026-08-08T12:16:44.816528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.171272Z","title":"Univbench: Towards unified evaluation for video founda- tion models","venue":null,"work_id":"01f0b189-a184-4a9c-b983-86c3cd81c809","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.820695Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:97ba96f4afada233aed9137cf1af9d44569a045661191a9838c95ce397195054","observation_id":"9463e00b-0cf8-494f-bee7-4243e3ab15c9","resolution":{"observed_at":"2026-08-08T12:16:46.175808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18870","last_updated":"2025-11-25T02:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T08:22:07Z","title":"HunyuanVideo 1.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.18870","snapshot_observed_at":"2026-08-08T12:16:44.824877Z","title":"Hunyuanvideo 1.5 technical report.arXiv preprint arXiv:2511.18870, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.824877Z"},"links":{"cited_paper":"/paper/2511.18870","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:ca22239683be9f8fdf2b61c9d34409a9731c5670ef4cd67417ab5f0f4959ea35","observation_id":"ae876613-a5fb-4be2-95e1-d298d7938f53","resolution":{"observed_at":"2026-08-08T12:16:44.824877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.829047Z","title":"Omni-video 2: Scaling mllm-conditioned diffu- sion for unified video generation and editing.arXiv preprint arXiv:2602.08820, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.829047Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:5ef7168618ab2a62101d2b42447dd6f4424b0f14f1a80a3b3412cf0110e80dae","observation_id":"8b7ae10a-f4e6-4c8e-83bc-a631262920c7","resolution":{"observed_at":"2026-08-08T12:16:44.829047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.159390Z","title":"Videocof: Unified video editing with temporal reasoner","venue":null,"work_id":"51a35768-6191-446a-857c-30ae9875891e","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.832844Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:497cef8484767da28c70625ce1f0c057c70f261d6b182776e014f537316c5966","observation_id":"fa9d86ea-9eb4-4a23-96f4-fd6ac4cdce2f","resolution":{"observed_at":"2026-08-08T12:16:46.164290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23452","last_updated":"2025-04-27T02:59:54Z","snapshot_observed_at":"2026-08-08T18:55:02.320359Z","submitted_at":"2025-03-30T14:12:21Z","title":"VideoGen-Eval: Agent-based System for Video Generation Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23452","snapshot_observed_at":"2026-08-08T12:16:44.836637Z","title":"Videogen-eval: Agent-based system for video gen- eration evaluation.arXiv preprint arXiv:2503.23452, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.836637Z"},"links":{"cited_paper":"/paper/2503.23452","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:e685effe4bbdd4775461e40b94c30ab420c10edf7dbcc438a5a10aed7e5d2242","observation_id":"3a9301c4-5fa8-4e41-9298-06eaa43d9566","resolution":{"observed_at":"2026-08-08T12:16:44.836637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.148642Z","title":"Cogvideox: Text-to- video diffusion models with an expert transformer","venue":null,"work_id":"93d229d9-da53-4092-9beb-77a2b6a6a072","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.840573Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:4d1bc8903f110624391782e1e6b5d1ab045ce6df124b725c823042f999d14fd2","observation_id":"a8c9eb7c-d07b-43c3-a7f0-d477175e09cd","resolution":{"observed_at":"2026-08-08T12:16:46.152996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:46.092196Z","title":"Omnipaint: Mastering object-oriented editing via disentan- gled insertion-removal inpainting","venue":null,"work_id":"a3a7eeff-6626-41d9-ba0e-6dbac05da2ac","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.843619Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:0b4f1cd51a86bfecf9b84acb3f51df8b2a7bc556e21b50df0338728d3a44b821","observation_id":"a7092899-5802-4143-b91c-62e52039faa0","resolution":{"observed_at":"2026-08-08T12:16:46.128662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18748","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-08-02T06:15:05.492636Z","submitted_at":"2026-05-18T17:59:03Z","title":"Aurora: Unified Video Editing with a Tool-Using Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18748","snapshot_observed_at":"2026-08-08T12:16:44.847796Z","title":"Aurora: Uni- fied video editing with a tool-using agent.arXiv preprint arXiv:2605.18748, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.847796Z"},"links":{"cited_paper":"/paper/2605.18748","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:2c2352539ab93c13c5e443a815aefa75b85c155c19b31c2968a98fa2707df67b","observation_id":"f22534fe-6380-4805-b755-3b9be06cde03","resolution":{"observed_at":"2026-08-08T12:16:44.847796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.996237Z","title":"Opens2v- nexus: A detailed benchmark and million-scale dataset for subject-to-video generation.Advances in Neural Informa- tion Processing Systems, 38, 2026","venue":null,"work_id":"63409cb2-7cbd-4daa-88cc-2416634f148d","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.853334Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:6ac640ae6324d4189689aa9b394536b74ac57db094b6564334a273774911cce5","observation_id":"a4ef4198-f17b-40b9-a39c-7af7b245fde7","resolution":{"observed_at":"2026-08-08T12:16:46.026618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.985234Z","title":"Use of artificial intelligence to de- tect dental caries on intraoral photos.Quintessence interna- tional, 2025","venue":null,"work_id":"a293c67c-f385-41ea-98b2-090fd2aab91f","year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.857239Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:e66aba125f3d969673d7f6a8f4c3453f02c9ebb361d7dccc4f495e9d2822fc19","observation_id":"a6a5aa84-4ea7-430f-ba5c-0283c0028f8e","resolution":{"observed_at":"2026-08-08T12:16:45.989401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.972310Z","title":"Automated detection and quanti- tative assessment of dental plaque in intraoral images.ACM Transactions on Computing for Healthcare, 7(2):1–12, 2026","venue":null,"work_id":"6fc6b167-e091-4a14-a814-a9785af56119","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.860993Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:bf5f45632480d98ded8b69a0f9747fe146c415b05bf6604187589b46b8966213","observation_id":"26dd898b-4b68-4d42-837f-5149f34dcc38","resolution":{"observed_at":"2026-08-08T12:16:45.976698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:45.943454Z","title":"Mira: Multimodal iterative reasoning agent for image editing","venue":null,"work_id":"d7166d56-a887-496f-8a6b-f8af31e80530","year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.864845Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:3f6d045a558453f1ec40b379418d40d1aee861b3327091718a91fe94045a3b5d","observation_id":"22fd2e73-2e62-4e88-814e-219399de2f11","resolution":{"observed_at":"2026-08-08T12:16:45.963337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18652","last_updated":"2026-05-18T16:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-18T16:57:36Z","title":"MementoGUI: Learning Agentic Multimodal Memory Control for Long-Horizon GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18652","snapshot_observed_at":"2026-08-08T12:16:44.868821Z","title":"Mementogui: Learning agentic mul- timodal memory control for long-horizon gui agents.arXiv preprint arXiv:2605.18652, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.868821Z"},"links":{"cited_paper":"/paper/2605.18652","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:11948bfecfe25b624b2ed49aba866f6575a093a149bda92b6fe94dc33f192bea","observation_id":"45aceae2-729c-4b06-b1cf-a577e7d74e09","resolution":{"observed_at":"2026-08-08T12:16:44.868821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.872691Z","title":"Region-constraint in-context generation for instructional video editing.arXiv preprint arXiv:2512.17650, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.872691Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:fc947879ea9d97f237be64f1d6a217aa9340873448b55176fe7e7a9cab01f38a","observation_id":"33d1cbd9-cd31-4817-8aab-f6043f5a42dc","resolution":{"observed_at":"2026-08-08T12:16:44.872691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:16:44.876390Z","title":"Kaleido: Open-sourced multi-subject reference video generation model.arXiv preprint arXiv:2510.18573, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.876390Z"},"links":{"citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:3825b3e264f42838347d96a60af0c036cb0bd1001466e1f552f33ca3e6454541","observation_id":"6ac7bfcb-f5eb-4f7b-abaf-1f3af08da5be","resolution":{"observed_at":"2026-08-08T12:16:44.876390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-08T12:16:44.879850Z","title":"Vbench-2.0: Advancing video generation benchmark suite for intrinsic faithfulness.arXiv preprint arXiv:2503.21755, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:16:44.879850Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2608.05485"},"observation_digest":"sha256:6307b0c8f53949659ce5104d4ec8591d2656925cacef1c06789c8f65b6eb56cf","observation_id":"41bbc627-9bb7-4905-9a59-c7c66726b61a","resolution":{"observed_at":"2026-08-08T12:16:44.879850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05485","last_updated":"2026-08-06T00:28:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T22:11:09.414099Z","submitted_at":"2026-08-06T00:28:38Z","title":"VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2608.05485."}