{"as_of":"2026-08-10T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d807c6dde5414276c5e944fb48cf4608e15add7b0d0a467396932c7515554de","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T02:56:25.594146Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T05:08:19.970664Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.14202","snapshot_observed_at":"2026-07-31T05:08:19.970664Z","title":"Keyframe-compass: Towards comprehen- sive evaluation of keyframe-conditioned video generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28509","last_updated":"2026-07-30T16:48:28Z","snapshot_observed_at":"2026-08-09T21:08:35.257576Z","submitted_at":"2026-07-30T16:48:28Z","title":"RefCaptioner: Multi-Reference Image-Grounded Video Captioning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T05:08:19.970664Z"},"links":{"cited_paper":"/paper/2607.14202","citing_paper":"/paper/2607.28509"},"observation_digest":"sha256:bd5342bd007a1b0d7313e2d36943a09f4f6944c6ce6df8f1ea130e1868924a84","observation_id":"0e950d10-d95c-4277-b5ac-2d157881787b","resolution":{"observed_at":"2026-07-31T05:08:19.970664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.14202/citation-record","integrity":"/paper/2607.14202/integrity","json":"/paper/2607.14202/citation-record.json","paper":"/paper/2607.14202"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.269325Z","title":"Wan image-to-video api reference","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.269325Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:94b70964ffa96c4106ef9f92670f78f3f6ba93369bf76aee6274b29a17d6477e","observation_id":"3ad031c4-75dc-4db4-b02d-42e49d2af541","resolution":{"observed_at":"2026-08-02T02:56:18.269325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-02T02:56:18.349922Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.349922Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:90e7b14ff722d758dc115f402f64a0ce2287052ded86bd83bcbeb6967d1abb1c","observation_id":"509aa007-b8df-4a28-8641-9b31b4df0d7b","resolution":{"observed_at":"2026-08-02T02:56:18.349922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.405021Z","title":"Elasticface: Elastic margin loss for deep face recognition, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.405021Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:954c85868531424e9800d944f253632fe6ffe454b344dddd3f1c05693266b02e","observation_id":"42c6aeed-3a0c-479b-9597-b829de2daed6","resolution":{"observed_at":"2026-08-02T02:56:18.405021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.503150Z","title":"VideoCanvas: Unified Video Completion from Arbitrary Spatiotemporal Patches via In-Context Condition- ing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.503150Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:392fdb06b8748ad5c6d59d75b2a2be68cd76345b236fe7c91754291dd1c1e9e6","observation_id":"4dc1afd1-c268-4d0e-8380-3e07259506e5","resolution":{"observed_at":"2026-08-02T02:56:18.503150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.540577Z","title":"T2av-compass: Towards unified evaluation for text- to-audio-video generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.540577Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:b5c64c419566cdcdf15e067aa36b0a860b3345f0a88ba39d49562ed9c966453e","observation_id":"7278d0a3-92f7-4861-bb59-aa039307fa73","resolution":{"observed_at":"2026-08-02T02:56:18.540577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.575907Z","title":"Skyreels- v2: Infinite-length film generative model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.575907Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:1d1fe882d54ad238e454d2a4b3be8208a9fe281d83af13eea0e9b5bb9004c52a","observation_id":"e0bcc49c-44b5-4e35-8e27-b49ab1dd31e6","resolution":{"observed_at":"2026-08-02T02:56:18.575907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.636022Z","title":"Cinedance: Towards next- generation multi-shot long-form cinematic audio-video gen- eration, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.636022Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:6567f73e7884902619810f2562bccc2030e308f0e438f5bd29391054e590d9ff","observation_id":"81917df2-7c51-432f-8ed0-f11894618873","resolution":{"observed_at":"2026-08-02T02:56:18.636022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.651473Z","title":"Aigcbench: Comprehensive evaluation of image-to-video content generated by ai.BenchCouncil Transactions on Benchmarks, Standards and Evaluations, page 100152,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.651473Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:60b7835672a7d41d6fd5f23ee18de7127d0a86109366f1dc5de6501cabb72807","observation_id":"c5fdb6c0-3aa7-4feb-9277-2824b8478683","resolution":{"observed_at":"2026-08-02T02:56:18.651473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:18.737486Z","title":"Tc-bench: Benchmark- ing temporal compositionality in text-to-video and image-to- video generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:18.737486Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:89d2326d9947a8d40ebc06bd466bddf2006dbff2edf231e1632c9872f62440d4","observation_id":"6a4ffb11-cabb-4690-b8ef-03fc7e47d01e","resolution":{"observed_at":"2026-08-02T02:56:18.737486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.082919Z","title":"ImageBind: One embedding space to bind them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.082919Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:f7edb65ba5897b7eab1d78fd4d1fd3a7a9889de7269674bc502c334273ff9441","observation_id":"e5426be9-92fc-483a-8c44-f338ead22490","resolution":{"observed_at":"2026-08-02T02:56:19.082919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.179512Z","title":"Introducing nano banana pro.https:// blog.google/technology/ai/nano-banana- pro/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.179512Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:35cf69611f0c0946cbaafd81420fc3d57568084e8fc5f08d8554d6e8f756d636","observation_id":"ee56e03b-2b7b-478b-aaa7-7f7583507d48","resolution":{"observed_at":"2026-08-02T02:56:19.179512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.262487Z","title":"Gemini 3.1 pro model card.https: //deepmind.google/models/model-cards/ gemini-3-1-pro/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.262487Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:057a150380e2c079db8588115496623379863d6843b54d06e47e0290a47fed61","observation_id":"f2349a18-e428-4003-9eb2-7ec024066063","resolution":{"observed_at":"2026-08-02T02:56:19.262487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.360996Z","title":"Gemini omni flash model card.https: //deepmind.google/models/model-cards/ gemini-omni-flash/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.360996Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:eb5ef91ca9ec26359ddecf014884a8fb298067d9af447578aaba28db58d871ed","observation_id":"a9f1ee6c-caf6-4ed8-b755-57c52e7d2a21","resolution":{"observed_at":"2026-08-02T02:56:19.360996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-02T02:56:19.515811Z","title":"Ltx-video: Realtime video latent diffusion.arXiv preprint arXiv:2501.00103,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.515811Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:05f92700a2ef4150d73ff20058fe7b4f4cb8a7ea71b66177f9e94b61faac8bb9","observation_id":"278779dd-b10a-4249-87e1-88083684a0e2","resolution":{"observed_at":"2026-08-02T02:56:19.515811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.648032Z","title":"Vabench: A comprehensive benchmark for audio- video generation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.648032Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:238ba65872361e841ab81da47a651fe859142481ac187b3cac3aa517a24946ce","observation_id":"abbee4b4-20e2-4662-9cb8-50d8684ed2dd","resolution":{"observed_at":"2026-08-02T02:56:19.648032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.758406Z","title":"VBench: Com- prehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.758406Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:9427fb51d0c3c05739184ed424ea23e55c22cf729698a4d2ee156fdb5b512c9d","observation_id":"2d7660ce-a0f9-4b3a-861d-ba65eba0125d","resolution":{"observed_at":"2026-08-02T02:56:19.758406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.835139Z","title":"Hudson, Ye Xia, Skanda Koppula, Andre Araujo, Joao Carreira, and Niloy J","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.835139Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:55ca9c600deb3db9cb9e7fce59c2b62c123e0931325891412fa7abb2319199d0","observation_id":"ff691fac-5fe8-48c8-805d-98455b06e652","resolution":{"observed_at":"2026-08-02T02:56:19.835139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:19.905113Z","title":"Musiq: Multi-scale image quality transformer,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:19.905113Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:691d8dfe929fa6f7c824c48eda0ec0b4e4e1d50884c5bb17289e11bbdcc8fecf","observation_id":"680e849c-e21f-44c7-9df5-6daa406824d8","resolution":{"observed_at":"2026-08-02T02:56:19.905113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.024750Z","title":"DreaMontage: Arbitrary Frame-Guided One-Shot Video Generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.024750Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:aa50c3204021ca4a4f9f390ce25deed05a2eb5ea88fd9c3b7701aacc834b6d26","observation_id":"3e7c0cd0-049c-4584-8c3e-05dd427dc1ce","resolution":{"observed_at":"2026-08-02T02:56:20.024750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.122426Z","title":"Javisdit: Joint audio-video diffusion trans- former with hierarchical spatio-temporal prior synchroniza- tion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.122426Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:beddfdb9a87b2ee5b30024227274b2b209274e17f072ca1530d56e0742b3b21a","observation_id":"8cc3a5b5-4fd9-41ca-8a3e-fd8350b939b8","resolution":{"observed_at":"2026-08-02T02:56:20.122426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.178148Z","title":"Longav-compass: To- wards unified evaluation of minute-scale audio-visual gener- ation across t2av, i2av, and v2av, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.178148Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:ab497ab28a5a2067f4bd449d1e02df5822605978c11299344fb8970c87d942f9","observation_id":"1c1c82b4-55f9-4044-84c3-86198f9f9f26","resolution":{"observed_at":"2026-08-02T02:56:20.178148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11440","last_updated":"2024-03-23T04:58:50Z","snapshot_observed_at":"2026-08-07T21:50:13.482944Z","submitted_at":"2023-10-17T17:50:46Z","title":"EvalCrafter: Benchmarking and Evaluating Large Video Generation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11440","snapshot_observed_at":"2026-08-02T02:56:20.214687Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models.arXiv preprint arXiv:2310.11440, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.214687Z"},"links":{"cited_paper":"/paper/2310.11440","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:1f6d209a719aa02618f1ccf5457f351e325df36e288638f9de88a4c44d331079","observation_id":"e717ed95-87f3-4c23-b934-a0302ca4e29d","resolution":{"observed_at":"2026-08-02T02:56:20.214687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.296537Z","title":"SAM 3.1: Faster and more accessible real-time video segmentation.https://ai.meta.com/blog/ segment-anything-model-3/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.296537Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:e6ed55ea0492312c2a53c8d8e02602b321eaa0880398fbd85f8cd1cdb931d41b","observation_id":"a6f9d1fd-20f4-4680-85d2-955cd48d4bf5","resolution":{"observed_at":"2026-08-02T02:56:20.296537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.396530Z","title":"A corpus and evaluation framework for deeper understanding of commonsense stories, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.396530Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:521f6e2cb546f08913dce88c1513f28d65563d78e1051bef1f5e6dc07dab25a0","observation_id":"7a5c17d0-4f7e-4535-9639-45762e3bdeb7","resolution":{"observed_at":"2026-08-02T02:56:20.396530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.471722Z","title":"Introducing chatgpt images 2.0.https: //openai.com/index/introducing-chatgpt- images-2-0/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.471722Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:0b5bd916384d733ca0fd6c107cc098676ad012eba2c3a28730710b7ffcd4cabc","observation_id":"203d9675-65bf-454c-a359-a8339cd6fb82","resolution":{"observed_at":"2026-08-02T02:56:20.471722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.538193Z","title":"Gpt-5.5 system card.https://openai.com/ index/gpt-5-5-system-card/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.538193Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:d988fa305700ef91463a33ff2dd8ae7e71c296a3ddac5b2eb5fe2effbb487183","observation_id":"6efbaa55-15f0-4cad-a21d-4cf1ca140448","resolution":{"observed_at":"2026-08-02T02:56:20.538193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.611410Z","title":"OmniWeaving: Towards Unified Video Gener- ation with Free-form Composition and Reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.611410Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:89208c9c1d2f1a66e7624bcc7e65a4d9eb131c0c55e5a642e522affb8f7b496e","observation_id":"7e97fe36-e326-4dc9-bba5-d304a0ebffe5","resolution":{"observed_at":"2026-08-02T02:56:20.611410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-02T02:56:20.768712Z","title":"Seedance 2.0: Advanc- ing video generation for world complexity.arXiv preprint arXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.768712Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:16cbe08298728b33ecca4251c26c0f90e38d01311c9a9146b2ed96cda462b1ce","observation_id":"9bcd8655-7829-4163-a793-729488e3796b","resolution":{"observed_at":"2026-08-02T02:56:20.768712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.880786Z","title":"Msvbench: Towards human-level evaluation of multi-shot video generation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.880786Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:246e555e0ff1acee868df6381bb0723daa33e89bcc006c3e33af3770a29b2511","observation_id":"3bcdf19e-b015-40e1-a261-020961bc70e8","resolution":{"observed_at":"2026-08-02T02:56:20.880786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:20.949988Z","title":"Mavors: Multi-granularity video representation for multimodal large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:20.949988Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:bbeeae0d74dbedc1951ec1d9784334e8bba043edd97efd38607bb5265101ec26","observation_id":"3a084d32-a87e-4a43-93a5-d64761bff679","resolution":{"observed_at":"2026-08-02T02:56:20.949988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:21.146593Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.146593Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:fa3bb1c2bbbe7b6d373dc8ba69bd3995228c6930ddc48ac1202e146b1b1bf0c3","observation_id":"c6a82b16-8263-4e17-83ba-ddb9e392a565","resolution":{"observed_at":"2026-08-02T02:56:21.146593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:21.239724Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.239724Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:3fc6a6ac5071832d49cb6d8faea368c5140a6eccb57489ef753ef55f3de6529d","observation_id":"843ba0c2-612b-4c44-a982-8126a6e67261","resolution":{"observed_at":"2026-08-02T02:56:21.239724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14505","last_updated":"2025-01-15T18:57:31Z","snapshot_observed_at":"2026-08-07T21:50:52.094296Z","submitted_at":"2024-07-19T17:58:36Z","title":"T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14505","snapshot_observed_at":"2026-08-02T02:56:21.282757Z","title":"T2v-compbench: A comprehen- sive benchmark for compositional text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.282757Z"},"links":{"cited_paper":"/paper/2407.14505","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:5e662a5ffdaad89c6221d7bd69d117096bfcea3c443fc15950424548ad9f1b21","observation_id":"afc33395-3294-46e4-92b3-c5ad9d5b2ddc","resolution":{"observed_at":"2026-08-02T02:56:21.282757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-02T02:56:21.351665Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.351665Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:a3262d0a72068ecd209c375291f23e141e56e5d97e2f6599d4000772661bdc09","observation_id":"bdd143a7-c06b-4e5b-a082-05497918d9a7","resolution":{"observed_at":"2026-08-02T02:56:21.351665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:21.432267Z","title":"Lawrence Zitnick, Devi Parikh, Lucy Vanderwende, Michel Galley, and Margaret Mitchell","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.432267Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:ce79e0f0b2b3d2a1c289075c2f2d2aaa9ea89b75cd9091e7406b4ef9b0d1a73d","observation_id":"e7555cfa-7817-4648-8f70-e35d1ea3e29c","resolution":{"observed_at":"2026-08-02T02:56:21.432267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-02T02:56:21.545791Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.545791Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:b778472321d42d0666d786aa5edae94899744a8006ad174b89aa543592d3a681","observation_id":"8fd89316-068f-45f0-9105-4c23c931fe53","resolution":{"observed_at":"2026-08-02T02:56:21.545791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:21.725978Z","title":"Msavbench: Towards comprehensive and reliable evaluation of multi-shot audio-video generation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.725978Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:d90b3a0dbebfbc9c6a888a94b187f771142ebf12a1b775988bb03f7059e6e68d","observation_id":"47e05f7a-cf72-4003-85dd-9152da35315a","resolution":{"observed_at":"2026-08-02T02:56:21.725978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:21.918628Z","title":"Hunyuanvideo 1.5 technical report,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:21.918628Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:0346a1cdc2c24e60312a640f5862cd862a84ef4cc919fb67162468f73042ce3b","observation_id":"005277aa-bef3-4310-9c8b-6b632162bfaa","resolution":{"observed_at":"2026-08-02T02:56:21.918628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.100698Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.100698Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:0974cabe6aa4e5e340dce74e28d96019a4db27239f998ca6ca26a471ffaa36a6","observation_id":"0566b0d3-ad66-4eb3-b9b5-f63ae49d856d","resolution":{"observed_at":"2026-08-02T02:56:22.100698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.166425Z","title":"Captain Cinema: To- wards Short Movie Generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.166425Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:499ed5d3b070eea7894c155d52d6fd5e0c42a3614589739b0a9beeb0afaf2d2b","observation_id":"daf9974f-9abc-4e92-ac4e-5d9bc55f61d1","resolution":{"observed_at":"2026-08-02T02:56:22.166425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.204580Z","title":"Inceptionnext: When inception meets convnext, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.204580Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:600d1d23ad62484f16e23f60b5ce01bae1376092a00629fcca9e02aece8fcbe1","observation_id":"17dcaed9-de63-4c01-b99f-4dcb5da974bb","resolution":{"observed_at":"2026-08-02T02:56:22.204580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.293178Z","title":"Ui2v-bench: An understanding-based image-to- video generation benchmark, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.293178Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:2d62a66da84efbeb2b73cf40a3ebacf1ea363ea74e0133584bf04fab741ad77e","observation_id":"a168b506-7c22-410d-bfbd-a5c05fb743b5","resolution":{"observed_at":"2026-08-02T02:56:22.293178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23789","last_updated":"2026-05-09T04:03:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-26T16:28:46Z","title":"MuSS: A Large-Scale Dataset and Cinematic Narrative Benchmark for Multi-Shot Subject-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23789","snapshot_observed_at":"2026-08-02T02:56:22.369775Z","title":"Muss: A large-scale dataset and cinematic narrative benchmark for multi-shot subject-to-video generation.arXiv preprint arXiv:2604.23789, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.369775Z"},"links":{"cited_paper":"/paper/2604.23789","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:83403dac5fa714026bf63538287891e1b6396bd1ae825348ca47dc1dcec7a157","observation_id":"4d194d89-bdad-4cd3-9ad8-1cc1a0774ede","resolution":{"observed_at":"2026-08-02T02:56:22.369775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.477407Z","title":"Monst3r: A simple approach for estimating geometry in the presence of motion, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.477407Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:49b548599f99daba33529c077836666bb09e8a962fd1ed53984e2d0580adac13","observation_id":"b5232f10-29c9-4cda-af1d-c006d68bff6f","resolution":{"observed_at":"2026-08-02T02:56:22.477407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.578256Z","title":"STAGE: Storyboard-Anchored Generation for Cinematic Multi-shot Narrative","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.578256Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:514ca8dd891cab4cab5de6bb32d8ee4b4871f29a996f6bd3405f6d5b91b7fc31","observation_id":"579cc8b7-3086-4d2d-b972-44714fc78a53","resolution":{"observed_at":"2026-08-02T02:56:22.578256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.721246Z","title":"Smartdirector: Keyframe- conditioned cinematic video generation with narrative pac- ing control, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.721246Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:67885c66f6f3f87e55c755aaea510fc526bd5d14b0dba04776d2be4dc33196cf","observation_id":"d030c4d5-3bc6-4336-ab1c-f9fbe1f9d335","resolution":{"observed_at":"2026-08-02T02:56:22.721246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-08-10T02:47:20.223653Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-02T02:56:22.827906Z","title":"VBench-2.0: Advancing video genera- tion benchmark suite for intrinsic faithfulness.arXiv preprint arXiv:2503.21755, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.827906Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:ae2389321298622712feec8966566a39be70a19e74633ab961dae72e2d87ccdc","observation_id":"cfe552d7-a099-4551-b75e-60525170c2f3","resolution":{"observed_at":"2026-08-02T02:56:22.827906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:22.915621Z","title":"Videomemory: Toward consis- tent video generation via memory integration.arXiv preprint arXiv:2601.03655, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:22.915621Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:790f3f2e5852ac1f150e2a22369d30b3cc860c93efe9a264e7a341d8085ce4fa","observation_id":"d79220fd-8302-46a9-a5c4-39d96f66c82c","resolution":{"observed_at":"2026-08-02T02:56:22.915621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.139528Z","title":"Avgen- bench: A task-driven benchmark for multi-granular evalua- tion of text-to-audio-video generation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.139528Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:50bb9297db9be74835955927065eb1c2bb217c655cf8a5ac049f0702a5bff62a","observation_id":"3a801a07-90f2-41e8-a591-6b45ce345326","resolution":{"observed_at":"2026-08-02T02:56:23.139528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.324035Z","title":"ViStoryBench: Comprehensive Benchmark Suite for Story Visualization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.324035Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:2213d1efc4e319b5226a2ee5c9358e961ab0e8275b8a6954cb3401c0d9216238","observation_id":"85e7332a-37e9-4ff9-8bdf-ec1eb5347911","resolution":{"observed_at":"2026-08-02T02:56:23.324035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.399226Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.399226Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:86273ae881d10506ef19c63824cb479396ee42e7145b504d234ebb743e61ff8e","observation_id":"e9dd88ec-b6f3-4852-aafb-bad3876a3c74","resolution":{"observed_at":"2026-08-02T02:56:23.399226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.541140Z","title":"Start a new shot only at an actual edit boundary such as a hard cut, dissolve, wipe, or other visible transition to a different take","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.541140Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:64a32cd80454e1c3c3858e48d0995c43547afc9aa9d8d75aa2e86053ff7729b6","observation_id":"91d9e2a0-04c2-4354-b5d5-c626885258d1","resolution":{"observed_at":"2026-08-02T02:56:23.541140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.611849Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.611849Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:7f449ac22d5ed3eb45613ba4665a262fda40a25de9d94820bc3e6c94758ecaef","observation_id":"8c4dbf04-b219-41ee-a2a8-2000c8d3e5ff","resolution":{"observed_at":"2026-08-02T02:56:23.611849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.700210Z","title":"If it is a one-take video, return exactly one segment covering the full video","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.700210Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:9482f8bc45f6bde805397e181acfd69f846aeba4e8a4dc566b68b1c3510eb9e1","observation_id":"7db53713-f4f5-4cac-868e-ba01be8ccbb2","resolution":{"observed_at":"2026-08-02T02:56:23.700210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.768902Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.768902Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:c5269f569666f6a9d47ca1e39ef9c382cd704131f33fa863cee27135c662f677","observation_id":"fdd08621-9a6e-452d-b5b3-fcf768c90025","resolution":{"observed_at":"2026-08-02T02:56:23.768902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.837799Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.837799Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:ee9a0c06f67c82f52c17c096f58a219945f43e6809c8f0fe0f5c822c7a5be6c7","observation_id":"e366bbab-d389-4315-ab6c-e25d8ec0af4f","resolution":{"observed_at":"2026-08-02T02:56:23.837799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:23.954976Z","title":"List the keyframe in unassigned_keyframes instead","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:23.954976Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:250c5353be914ae1d8d210bc5429912eb13bb662393908be870e4f2c246cb208","observation_id":"7b770e45-6cd7-4bcb-81dc-3490a5cf4f8e","resolution":{"observed_at":"2026-08-02T02:56:23.954976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.012566Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.012566Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:e29c9ecc9e3cb23c188a357eccea33d2e51302d11dabf14d4ce50fb59b71e213","observation_id":"a426cab4-f8d4-4b3d-be6e-8191bc100386","resolution":{"observed_at":"2026-08-02T02:56:24.012566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.069930Z","title":"S1\", \"S2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.069930Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:af485a9fdbdb3191a883beb951d4e37091785d518b11ab1b268d5a79152ab4f7","observation_id":"179d19cb-6e83-43b5-a635-cf5e673174bf","resolution":{"observed_at":"2026-08-02T02:56:24.069930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.100749Z","title":"SEG001\",","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.100749Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:3273b96d8203cd7dd54484493242619adb1b43d40a9d41f052e4c850374ab631","observation_id":"ec0307d0-6e41-4d98-bbb4-7e08fcda66ae","resolution":{"observed_at":"2026-08-02T02:56:24.100749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.150026Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.150026Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:6a04855fa32388961b2ca26ce805c2f2c0345755292d615a32167819f4c6505b","observation_id":"20193fc8-284b-44b4-9239-1cd9c53852a5","resolution":{"observed_at":"2026-08-02T02:56:24.150026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.227063Z","title":"If it appears in zero segments, it must appear exactly once in unassigned_keyframes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.227063Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:40eda3a0e492df51d22b8a88fd99b3ec3d670d01973c0c74841d6175e6cb7d14","observation_id":"b59c541c-8c23-4633-ac98-8f37057632b0","resolution":{"observed_at":"2026-08-02T02:56:24.227063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.292008Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.292008Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:131b9aefe48b46f386053e02ed889375e67cfa636e3e359029e86dac678eab4c","observation_id":"a8ab3bb2-1c84-4fb0-859d-4a15647ee78a","resolution":{"observed_at":"2026-08-02T02:56:24.292008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.359788Z","title":"not_visible_in_generated_video","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.359788Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:0ac3c4acc479fbf415e97e36b648be77f25202fc9674115f7047ad360e5405c1","observation_id":"1eefee03-60e5-4f34-8d58-9216d2a5cb7e","resolution":{"observed_at":"2026-08-02T02:56:24.359788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.450105Z","title":"S1\" and assign all keyframes to that segment. - If the spec requests a one-take video but the generated video visibly has two edited shots, return two segments with shot_ids","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.450105Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:21fbc6226bf95afcc1d22b4b4a7b8398351cd1da15f1b4aeb6fe1906995abf2f","observation_id":"065dcc53-481e-4a3c-8ce6-a952301ea70a","resolution":{"observed_at":"2026-08-02T02:56:24.450105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.595046Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.595046Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:85005c4952ab58ed499480518e13e2d3e1d494f6afeab7d3936aacf943b0369a","observation_id":"f88accde-7b60-4702-bc27-ba75dd205924","resolution":{"observed_at":"2026-08-02T02:56:24.595046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.711490Z","title":"cross_shot","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.711490Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:ea00a3268cfec84820a9487318f84af8ea6f536fcf25d7eebf6f4d98415dbbdb","observation_id":"be28fbe8-f724-427d-9b4b-9f43ad6296e4","resolution":{"observed_at":"2026-08-02T02:56:24.711490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.851709Z","title":"video_adherence. camera_parameter","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.851709Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:7cd125e97223c429a30610b502d970a28128ce60bd9b41b8d2ef8f158d65f8fa","observation_id":"d79f94ac-8cdc-4059-a5fc-6793822593c4","resolution":{"observed_at":"2026-08-02T02:56:24.851709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.911146Z","title":"video_adherence .shot_count_structure","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.911146Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:3a3582109eadbda2d65ae65e3630587cb213b4d9b77eb982e6d5e716e16bbb97","observation_id":"2af5ea23-dad4-49cc-9b22-c078ca3021e9","resolution":{"observed_at":"2026-08-02T02:56:24.911146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:24.991152Z","title":"video_adherence. narrative_rhythm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:24.991152Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:7691d44dd17e0344c9bb186c6dd351f6c3227afa9d758e6cd9a46d260b1f169b","observation_id":"5db1c039-96c5-47f7-99f1-b6239eaf9cd6","resolution":{"observed_at":"2026-08-02T02:56:24.991152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.132050Z","title":"video_adherence. segment_presence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.132050Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:4bb351ca39eafe1bb348bf6d3dd34b69a8b15ad7e695b14307d17f10c77e30a3","observation_id":"4dbf1dc8-6e72-4d55-8a5b-cdbfa38d2ccd","resolution":{"observed_at":"2026-08-02T02:56:25.132050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.191471Z","title":"audio_adherence. semantic_alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.191471Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:5ab962962e96fd93efb40358793755101bb984f3d4658e6f708cbfba67b7c680","observation_id":"c138f34a-dd5b-437d-8a07-286801ff6fdc","resolution":{"observed_at":"2026-08-02T02:56:25.191471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.253728Z","title":"audio_adherence. style_emotion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.253728Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:202215aa10d83e1f524bab39aaa855390215082d1767fea496db3dd28530c4ef","observation_id":"d86be234-79ae-4cb1-b84b-7df49cebc37c","resolution":{"observed_at":"2026-08-02T02:56:25.253728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.311181Z","title":"video_adherence. segment_presence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.311181Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:7bc92697f6bebb53041e0c9532cc407d0f9010864c1c90ab2049f41712611888","observation_id":"529e507b-2b6d-40ee-b41d-f187d9f33a17","resolution":{"observed_at":"2026-08-02T02:56:25.311181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.350269Z","title":"video_adherence .shot_count_structure","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.350269Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:fc80f0008abded92fcd7dc053ebfca6b2697c3f67f30e5f2004bcff36b8a317b","observation_id":"792c9bf4-7819-4cf9-a733-4cd6492ff81d","resolution":{"observed_at":"2026-08-02T02:56:25.350269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.417349Z","title":"video_adherence. narrative_rhythm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.417349Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:bb15d38a99e7ed64eb2475f848c04b513bc71d19ed075cd722abff3eaff6f3b1","observation_id":"53370e66-c321-4215-a67d-c1fd2d778da2","resolution":{"observed_at":"2026-08-02T02:56:25.417349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.510034Z","title":"spatial_orientation.relative_position_stability","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.510034Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:5ac59f91f1afd76dac90ca5cb573513daa7ad0e5751386988149edce273d8f27","observation_id":"da69a00a-6d28-4ab9-9885-0a79b0ce91e5","resolution":{"observed_at":"2026-08-02T02:56:25.510034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:56:25.594146Z","title":"spatial_orientation. scale_proportion_rationality","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-02T02:56:25.594146Z"},"links":{"citing_paper":"/paper/2607.14202"},"observation_digest":"sha256:bbe4faaa099e4be0d90b72ed3c790214c900d812adbfff3a3a36652db2e0dc67","observation_id":"105a8159-fed1-4b42-801f-8d9d6756fb1b","resolution":{"observed_at":"2026-08-02T02:56:25.594146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14202","last_updated":"2026-07-15T17:46:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:13:00.036289Z","submitted_at":"2026-07-15T17:46:12Z","title":"KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":78,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2607.14202."}