{"as_of":"2026-08-10T09:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:115adcb9c1529622b1dec06c270929b30f8600b68a024e55bef4758d5f5a8e87","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:39:52.269953Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:56:31.849924Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05173","snapshot_observed_at":"2026-08-02T16:56:31.849924Z","title":"arXiv preprint arXiv:2507.05173 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01700","last_updated":"2026-07-20T03:39:00Z","snapshot_observed_at":"2026-08-04T07:22:17.279993Z","submitted_at":"2026-04-02T06:58:46Z","title":"Can Video Diffusion Models Predict Past Frames? Bidirectional Cycle Consistency for Reversible Interpolation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T16:56:31.849924Z"},"links":{"cited_paper":"/paper/2507.05173","citing_paper":"/paper/2604.01700"},"observation_digest":"sha256:ee41c5d6ccca5bba60aeba8ce88dd3f522ea3f5805e1a9a9b7881fcf933d7408","observation_id":"739ea156-5a79-4409-817e-d6183db6acde","resolution":{"observed_at":"2026-08-02T16:56:31.849924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05173/citation-record","integrity":"/paper/2507.05173/integrity","json":"/paper/2507.05173/citation-record.json","paper":"/paper/2507.05173"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:58.233642Z","title":"aesthetic - predictor","venue":null,"work_id":"9265ee0d-cee5-45f6-8828-452673e1921c","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:47.777534Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:da353acc5c244db9eb28801717092fc2c6d87a7472317b06c494312d9dbb3d53","observation_id":"c3866e5c-3458-4063-8fc6-99f211de9314","resolution":{"observed_at":"2026-08-06T19:39:58.334446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T19:39:47.868782Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:47.868782Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:cf109bb7ca23e302bdb580e2ebf395d7bec5799f496262cfa972f1204b2a2646","observation_id":"e4618650-0634-41ea-96d9-d33540ef32a9","resolution":{"observed_at":"2026-08-06T19:39:47.868782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T19:39:47.942447Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:47.942447Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:8bf4438a95a95a9a845e25c24a6b764a016f7956482853a47b053efc5856d7cc","observation_id":"aed9b34b-e77b-4350-a64a-653778f785f5","resolution":{"observed_at":"2026-08-06T19:39:47.942447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:58.006169Z","title":"Kernel-based frame interpolation for spatio-temporally adaptive rendering","venue":null,"work_id":"93003399-e3f5-48b3-8159-c59676588e05","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.057504Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:889ba1b955184138db9ab92ec0b72134f818ea688f3301fe1c49c43129cb4e3b","observation_id":"1c942776-5cd8-469d-b86f-50bfaeb98c64","resolution":{"observed_at":"2026-08-06T19:39:58.118181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.780566Z","title":"Video generation models as world simulators","venue":null,"work_id":"bd1629f2-2aad-4d07-88c5-61d2ca334be7","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.119011Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:26944418edaee40eb279bd682b51a67f2e33cd4c2e1c388b5066c1af67ae5ca6","observation_id":"356a3f8e-9222-4054-9e3f-6379786d5205","resolution":{"observed_at":"2026-08-06T19:39:57.903777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.650195Z","title":"Multiple video frame interpolation via enhanced deformable separable convolution","venue":null,"work_id":"8e9689b9-2b16-4258-b9a9-1b46274a86e3","year":2021},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.226734Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e670fa5a1231831b409de600db722194fbcf3dc4c5d968a03fc32005f40b04b1","observation_id":"7d6cd1d9-520e-41ce-99ae-92e88c9c1291","resolution":{"observed_at":"2026-08-06T19:39:57.723170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.451395Z","title":"Channel attention is all you need for video frame interpolation","venue":null,"work_id":"2cca9406-33dc-43cf-9c74-f337730336b5","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.313796Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:2d17d1b0f7ca6390ebd4705992db64084c937c1ca45b09fbcd85d7e453cc5697","observation_id":"60927938-0081-4990-8cf4-8ab3a6a8c326","resolution":{"observed_at":"2026-08-06T19:39:57.535090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.238853Z","title":"Ldmvfi: Video frame interpolation with latent diffusion models","venue":null,"work_id":"03d1a16f-ae03-4b25-a7a2-a62ba016e400","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.439925Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:454755beef90e8eef42902935bb04fc96824bd55d77bc8eb6ed4312897ccba57","observation_id":"819b8722-35d3-4590-9a7b-4ec83415fc01","resolution":{"observed_at":"2026-08-06T19:39:57.367129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:57.086126Z","title":"Video frame interpo- lation with stereo event and intensity cameras","venue":null,"work_id":"5c4b63e3-9755-497b-9b27-bb31eae784b9","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.537218Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:6d9697b0a5d04e139abcea1a8c054f6eff6fa36a4c351c05b41150fd2dc13954","observation_id":"64789245-439b-499a-8b2a-7bec69ed9d7c","resolution":{"observed_at":"2026-08-06T19:39:57.157647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.975904Z","title":"Video frame interpolation: A comprehensive survey","venue":null,"work_id":"82c52a62-c27d-4e43-bbb4-42a292c6078e","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.614750Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:50f05bda9409f1ceeaa1c9634bb481aeaadfa633712b4916fb3b76fdab558b59","observation_id":"4b86caf7-7916-405a-ae54-344152009b39","resolution":{"observed_at":"2026-08-06T19:39:57.024520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.810625Z","title":"Explorative inbetweening of time and space","venue":null,"work_id":"1d7cec72-56a1-4f52-a4f0-3deafc26ba1f","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.707627Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:3da2ec351405124ad2b935a4aae441985f58c458108e01764d4978f88ebf6ff4","observation_id":"22c14a30-c2e6-4ec8-b309-515e194c4c81","resolution":{"observed_at":"2026-08-06T19:39:56.895728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T19:39:48.804162Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.804162Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:0465144b7fc9b0807e1294026b5bfb390bf537303c299288ca4c0feeb6a45391","observation_id":"42c71690-8b71-44dd-8891-2a8a316648d1","resolution":{"observed_at":"2026-08-06T19:39:48.804162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.546938Z","title":"Video diffusion models","venue":null,"work_id":"93dfb77d-f570-4e4c-bc5f-7d9023b53ea6","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.889838Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:4a2d5ce921f58530f1b25f4aed389269206447149451f1c94b706da49d8c21ab","observation_id":"94b42aef-7486-48b6-bb7f-14c9ac850ab1","resolution":{"observed_at":"2026-08-06T19:39:56.691206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.285127Z","title":"Motion-aware latent diffusion models for video frame interpolation","venue":null,"work_id":"ad6ede7f-131a-4289-a625-b067aa21f051","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:48.969835Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:8d65bb92cee72bde67d82332d0e8e3fefcf4a81f542068133c9f008ba8412d40","observation_id":"4f4dd225-00f4-4af9-a2e4-795e9571c23e","resolution":{"observed_at":"2026-08-06T19:39:56.416485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:56.045610Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"2fa1a550-1171-482d-a58e-8ce6bc1c11ae","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.065017Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:b4539c937eab41c07d2ee55f1e79e21d2cd61cbc87afd124117d2e7046ee3c3f","observation_id":"30b4f696-0981-4911-b0f1-cb203b475bc1","resolution":{"observed_at":"2026-08-06T19:39:56.153082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.835581Z","title":"High-resolution frame interpolation with patch-based cascaded diffusion","venue":null,"work_id":"283507c4-cd7b-4fe4-9b93-3ad21b05f771","year":2025},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.191430Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:80aadd8a518c8065acf64dd73a04856acef62cfeb98e7e4d17e7c8fa9ff2d8ec","observation_id":"8020d09a-c441-43dc-8f34-2fc5fdcdad6c","resolution":{"observed_at":"2026-08-06T19:39:55.944329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.586125Z","title":"Video interpolation with diffusion models","venue":null,"work_id":"dc0d70d8-0995-4513-8aac-2a56be207a53","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.271419Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:e11050f6a370711688deaf11513dc3f6d38908d80a86e215f19af7c454bce1d8","observation_id":"05e0932e-f9ec-4e88-a8f3-ffbc77c7201f","resolution":{"observed_at":"2026-08-06T19:39:55.670110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:49.343570Z","title":"Musiq: Multi-scale image quality transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.343570Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:4d431cb733d62e325df56f7737d742f7914a840dbd5c8a9af2ff4dfa30f0e9aa","observation_id":"67ce6763-eed8-45ae-929f-e042d5d3a68b","resolution":{"observed_at":"2026-08-06T19:39:49.343570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17128","last_updated":"2024-03-25T19:13:12Z","snapshot_observed_at":"2026-08-07T02:33:44.368120Z","submitted_at":"2024-03-25T19:13:12Z","title":"Benchmarking Video Frame Interpolation","version":1},"cited_work":{"arxiv_id":"2403.17128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.17128","snapshot_observed_at":"2026-08-06T19:39:52.705279Z","title":"Benchmarking Video Frame Interpolation","venue":"cs.CV","work_id":"0553669c-bb8f-412e-a439-06331f5cb87b","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.420635Z"},"links":{"cited_paper":"/paper/2403.17128","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:2bcd976dec88a3575e97a23ed9832b00d67c382794f78f45c5f6d83b9c2a9ec5","observation_id":"877950b1-fa71-4ecf-949b-4b1e5d6d9ebd","resolution":{"observed_at":"2026-08-06T19:39:52.782107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T19:39:49.522768Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.522768Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:6681479b4bc7a5737baa61ab4a9d985957faaa54cd0bdbaabf8c88627ac1d7b6","observation_id":"2915c12b-3b44-42ab-b47c-a684c4bc59ee","resolution":{"observed_at":"2026-08-06T19:39:49.522768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.382637Z","title":"Amt: All-pairs multi-field transforms for efficient frame interpolation","venue":null,"work_id":"492d7edf-7989-42d9-819e-1d409cfa7260","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.620605Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:04b404422875fe0a27821a39b08999c15ce6995f34d4843fb14dc487dc2fbf6c","observation_id":"db048b5a-f120-44b4-848d-03200bb276d1","resolution":{"observed_at":"2026-08-06T19:39:55.489251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-09T23:28:59.299375Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-06T19:39:49.690405Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.690405Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:af2d76219088ab712f1f7719a403a0004167ab3947cb55ffacfdffb1a62ab63d","observation_id":"3fbcd744-75a1-411c-879b-f6b83ff9fabc","resolution":{"observed_at":"2026-08-06T19:39:49.690405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:55.156999Z","title":"Video frame interpolation with transformer","venue":null,"work_id":"f2861cdd-7c45-411f-a213-d91bc6a94ae3","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.781991Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:226152fe23213d5c8f1296d969a41913d0559b2ea40e2bea80c099e5c32683e5","observation_id":"45319bac-716a-4ead-8dba-d6efbdc00223","resolution":{"observed_at":"2026-08-06T19:39:55.263744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.969370Z","title":null,"venue":null,"work_id":"cde9b672-7b5e-4a4e-9883-2fee0e9ddd63","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.872128Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:a97ce20816e09e45a2815076f2db429dc95c44a7da5903136c9c5e3cb086bb74","observation_id":"bd169093-2feb-479e-afd9-558b0bd9cd6a","resolution":{"observed_at":"2026-08-06T19:39:55.067543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.752164Z","title":"Softmax splatting for video frame interpolation","venue":null,"work_id":"5e6b3e1d-0953-40b4-935c-d5235d6c2fd3","year":null},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:49.949172Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:c716ac04674bc055649c058d8db2aad6b67df3f25163dc3ed16a3d0f52572184","observation_id":"b7411c03-cbd4-4744-98e0-f9ceb5e93315","resolution":{"observed_at":"2026-08-06T19:39:54.864863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.696163Z","title":"Video frame interpolation via adaptive convolution","venue":null,"work_id":"f5362959-fc4b-4525-b49a-4917467c9bdb","year":2017},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.020467Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:92e13d50429cac7276603291e9b3964e028ada4272b0a9800e6f03b4c79dee61","observation_id":"ce1964e9-2575-4492-9e0f-edaf94b92cb0","resolution":{"observed_at":"2026-08-06T19:39:54.724111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.609855Z","title":"Video frame interpolation via adaptive separable convolution","venue":null,"work_id":"bf701602-0646-4752-af18-a16cbe238c6a","year":2017},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.098550Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:fa0d146d62d7fe23aded4f5c5d93230b1f86e2b2a1aeba931ba7d392fc6047a9","observation_id":"17561dad-084a-4cc8-be45-94de769b0045","resolution":{"observed_at":"2026-08-06T19:39:54.653255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.507807Z","title":"Bmbc: Bilateral motion estimation with bilateral cost volume for video interpolation","venue":null,"work_id":"baf5a57f-d9a6-44c0-aa76-5672cbcd15fb","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.174739Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:9ce6fb79ca1a1edb99368c04fcd92ab12ad7d065dc9024ff9d9bf792beae35fd","observation_id":"d80aff71-de41-41d0-920a-eb6830ca7b12","resolution":{"observed_at":"2026-08-06T19:39:54.587693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.392513Z","title":"Video frame interpolation using real-time intermediate flow estimation","venue":null,"work_id":"a25cc9ce-20b0-408c-9b51-7d412d5dc5e2","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.249013Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:c7951f7f3b907ba16e4998abc188a8aeab7515fb050738b97220af06e5cdc726","observation_id":"d4fa605e-f612-4d12-a435-0aab14d43be1","resolution":{"observed_at":"2026-08-06T19:39:54.465193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.245404Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"a88d648c-bd1c-461f-86f3-c83b60fb07ed","year":2021},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.329157Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:1424d49b6b8679c15af4d0e61b0f6e6fb2ab07b9a876b1dca0dd67259b1460ec","observation_id":"1057529d-d3f4-4d1a-8851-4312629ffe84","resolution":{"observed_at":"2026-08-06T19:39:54.306407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.153059Z","title":"Film: Frame interpolation for large motion","venue":null,"work_id":"ff827d17-f313-4139-8bdd-0aba187b79aa","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.409929Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:4196d32ce91b4d72bbe1aed362177c372220686afd2b5bf48104e317edb37da3","observation_id":"732beea1-f9d5-461c-9a22-d2ef31908a2e","resolution":{"observed_at":"2026-08-06T19:39:54.198319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11365","last_updated":"2025-03-24T02:37:44Z","snapshot_observed_at":"2026-07-06T20:07:28.545657Z","submitted_at":"2024-12-16T01:37:51Z","title":"BiM-VFI: Bidirectional Motion Field-Guided Frame Interpolation for Video with Non-uniform Motions","version":4},"cited_work":{"arxiv_id":"2412.11365","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11365","snapshot_observed_at":"2026-08-06T19:39:52.567259Z","title":"BiM-VFI: Bidirectional Motion Field-Guided Frame Interpolation for Video with Non-uniform Motions","venue":"cs.CV","work_id":"795698ba-4cb4-4aaa-b373-d96289c7cbdf","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.547820Z"},"links":{"cited_paper":"/paper/2412.11365","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:a8b29f316f159e19688c91739df681bde25720580407276518a860d751a57dd1","observation_id":"9af1bd22-cac1-43ac-bb7b-b4734d1980e2","resolution":{"observed_at":"2026-08-06T19:39:52.628540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:54.052132Z","title":"Video frame interpolation transformer","venue":null,"work_id":"251e0c83-e281-44ff-98ee-d4f852f6535c","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.675351Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:8f7ce601539a78d8faa70f1d16fb6f45dce9d4cb82a4cbc8de28e8b214ab01be","observation_id":"55db35de-f9e6-4f15-b8a4-77c057115512","resolution":{"observed_at":"2026-08-06T19:39:54.097210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.785976Z","title":"Forward and backward warping for optical flow-based frame interpolation","venue":null,"work_id":"3fd2f3a2-f48b-4419-9d1a-e20b9ac2a804","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.770409Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:5448eae2d749a483ca19c9145129bf0b48987d3335fe8b6b35410b8afb4e2c71","observation_id":"f03c64af-5e60-4f4d-9e48-e01a63212130","resolution":{"observed_at":"2026-08-06T19:39:53.929854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-06T19:39:50.904060Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.904060Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:a4a53ed8b825b8da361d7cb05ba572dbbf379180a0a4a17ce84fd38b82cd109d","observation_id":"ea2408bd-997a-4c0d-8102-7a5da4a92ada","resolution":{"observed_at":"2026-08-06T19:39:50.904060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.696010Z","title":"Adapool: Exponential adaptive pooling for information- retaining downsampling","venue":null,"work_id":"0daf111d-fc20-4770-baea-a03edac9b1fb","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:50.972745Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:7ebcc83127c8f778df2248cacca9038d6240a28ea31f2c6e196b85894c65f5ca","observation_id":"7f0af36a-812c-47d0-8cb8-9f58d6baf807","resolution":{"observed_at":"2026-08-06T19:39:53.700048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.557911Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":"2bc52757-f5d5-4c2b-9244-b1a739db8d35","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.043340Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:d486550f2e75560171358e0b72929fd28255402e456a56d327142120da1ea09b","observation_id":"2328b2f7-a3d9-414c-85d7-b80898c6f816","resolution":{"observed_at":"2026-08-06T19:39:53.623787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.468695Z","title":"Video frame interpolation based on deformable kernel region","venue":null,"work_id":"a2129d05-3880-4478-b26a-dfbc0e4d6931","year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.109454Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:76048b3e906bbef67c56836827c96fb53c5f03dca5fcdb297dced473272b02aa","observation_id":"ab532a4c-dd34-468d-9327-1a962fe1f832","resolution":{"observed_at":"2026-08-06T19:39:53.517797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T19:39:51.210157Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.210157Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:3edc9be4b05a7984834523124da947ef6090d681e1888d5f9e23c349b82f5b68","observation_id":"93339fc7-2c0f-45ef-b1d2-d1d0a8886613","resolution":{"observed_at":"2026-08-06T19:39:51.210157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08260","last_updated":"2025-04-26T17:58:24Z","snapshot_observed_at":"2026-08-01T11:16:30.883699Z","submitted_at":"2024-10-10T17:57:49Z","title":"Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08260","snapshot_observed_at":"2026-08-06T19:39:51.302592Z","title":"Koala-36m: A large-scale video dataset improving con- sistency between fine-grained conditions and video content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.302592Z"},"links":{"cited_paper":"/paper/2410.08260","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:bb6d9425995f9e707452fc8da8b7e7dca80f4b49c39c28a62d7bf134387246ca","observation_id":"467bbe54-3760-42f4-b654-fd292d54415c","resolution":{"observed_at":"2026-08-06T19:39:51.302592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15239","last_updated":"2025-02-12T06:26:29Z","snapshot_observed_at":"2026-08-09T18:37:28.319430Z","submitted_at":"2024-08-27T17:57:14Z","title":"Generative Inbetweening: Adapting Image-to-Video Models for Keyframe Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15239","snapshot_observed_at":"2026-08-06T19:39:51.414240Z","title":"Generative inbetweening: Adapting image-to-video models for keyframe interpolation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.414240Z"},"links":{"cited_paper":"/paper/2408.15239","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:b74299bde1b17e9ac4eaa2317fa70587b651f33d6a828e5419d032948348f222","observation_id":"04ff4419-5376-479d-97fc-d0a64e106fc8","resolution":{"observed_at":"2026-08-06T19:39:51.414240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-06T19:39:51.503054Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.503054Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:11e6f03cdc41d24e7aa77e542752f405b0d47999e78c7f9926c4b08a35c39dbc","observation_id":"27f8fedf-7160-4197-ae13-899b34717564","resolution":{"observed_at":"2026-08-06T19:39:51.503054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03191","last_updated":"2022-12-07T12:20:55Z","snapshot_observed_at":"2026-07-06T14:27:34.639236Z","submitted_at":"2022-12-06T18:09:49Z","title":"InternVideo: General Video Foundation Models via Generative and Discriminative Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03191","snapshot_observed_at":"2026-08-06T19:39:51.612774Z","title":"Internvideo: General video foundation models via generative and discriminative learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.612774Z"},"links":{"cited_paper":"/paper/2212.03191","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:0f5c14415e1757c33150902056d934c64daec834d15ee596049bf85f84dcbea1","observation_id":"0aefedc9-f462-4c9a-b3b2-8c3d5401cc01","resolution":{"observed_at":"2026-08-06T19:39:51.612774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.340178Z","title":"Zooming slow-mo: Fast and accurate one-stage space-time video super-resolution","venue":null,"work_id":"7886586f-389e-4b17-8abc-6f2710ee058d","year":2020},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.676316Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:32d2b9c836bc40bf85619c86af7566f533104373aa03c076c2e6e3034b84e089","observation_id":"236d1690-7381-4e97-b8b1-b79d2421ac11","resolution":{"observed_at":"2026-08-06T19:39:53.403072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.244153Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"15159533-6400-4253-a51e-2bc1ccc0e6d6","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.794095Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:9062ba66ec34631930518f29f1472e1f16a86cbd24dd37d64686f1bdfb6e1d93","observation_id":"d35634ad-58c3-4e75-929c-0ae09b69c612","resolution":{"observed_at":"2026-08-06T19:39:53.298431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.129686Z","title":"Video enhancement with task-oriented flow","venue":null,"work_id":"1fa5202a-b3e7-4264-a6b2-5836f9de7720","year":2019},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.858890Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:68789c1596c190bf723e928f3e12ee1b30a938f01963a71f6b068b99abc3369d","observation_id":"939e1523-4f79-414c-9df4-d6588906cbe4","resolution":{"observed_at":"2026-08-06T19:39:53.163111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:53.013436Z","title":"Diffusion models: A comprehensive survey of methods and applications","venue":null,"work_id":"78079112-c7f0-4b0b-92c0-05d880bf7a68","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.920067Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:4780bd396d09b5780df533ee476f53eb178388ca1eb446ad41039a95768f5a5a","observation_id":"36a2bede-64b2-4178-b147-b1360cb21b0f","resolution":{"observed_at":"2026-08-06T19:39:53.068601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05651","last_updated":"2025-03-01T07:27:28Z","snapshot_observed_at":"2026-08-02T23:31:23.105697Z","submitted_at":"2024-10-08T03:01:54Z","title":"ViBiDSampler: Enhancing Video Interpolation Using Bidirectional Diffusion Sampler","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05651","snapshot_observed_at":"2026-08-06T19:39:51.984592Z","title":"Vibidsampler: Enhancing video interpolation using bidirectional diffusion sampler","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:51.984592Z"},"links":{"cited_paper":"/paper/2410.05651","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:35162e5bbd4a7393f4f431c5edc16c81c6c0d41e708483b0468b8204be9feeda","observation_id":"a1054194-8832-4458-8b56-4edb510eee93","resolution":{"observed_at":"2026-08-06T19:39:51.984592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T19:39:52.089841Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:52.089841Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:7ebbf207a0166a2c381ab636595d32d00991eb179faa801705895d68a0bd34ca","observation_id":"35e710bb-20aa-4533-b75e-4975d8c4cdec","resolution":{"observed_at":"2026-08-06T19:39:52.089841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:39:52.889724Z","title":"Extracting motion and appearance via inter-frame attention for efficient video frame interpola- tion","venue":null,"work_id":"118f14bb-5901-4343-af1f-c0dca4a5677b","year":2023},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:52.186101Z"},"links":{"citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:7234219848030a5f3c721addfac47ff56318f116557a400dec5780ed190f9460","observation_id":"4aae5b3e-4f67-40b4-93ae-12d96e4d76aa","resolution":{"observed_at":"2026-08-06T19:39:52.924906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11755","last_updated":"2024-12-16T13:19:41Z","snapshot_observed_at":"2026-08-08T12:19:36.325543Z","submitted_at":"2024-12-16T13:19:41Z","title":"Generative Inbetweening through Frame-wise Conditions-Driven Video Generation","version":1},"cited_work":{"arxiv_id":"2412.11755","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11755","snapshot_observed_at":"2026-08-06T19:39:52.377581Z","title":"Generative Inbetweening through Frame-wise Conditions-Driven Video Generation","venue":"cs.CV","work_id":"afb5f73c-87ed-4bb7-a0ab-22e837d70330","year":2024},"citing_paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:39:52.269953Z"},"links":{"cited_paper":"/paper/2412.11755","citing_paper":"/paper/2507.05173"},"observation_digest":"sha256:edc8c356eec0a9db9398ee2e4f29f1e04c5ff8c90d32f055079a7b2301352bda","observation_id":"5a7f2291-769f-400e-8f94-10e9f6ca71ca","resolution":{"observed_at":"2026-08-06T19:39:52.433183Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05173","last_updated":"2025-07-07T16:25:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T05:03:32.372350Z","submitted_at":"2025-07-07T16:25:47Z","title":"Semantic Frame Interpolation"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":3,"verified_fuzzy":33},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2507.05173."}