{"as_of":"2026-08-13T23:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dd46fc7038fa90e2bd27add19012b1616938d4865ab7d66decc098425b5cb10e","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:44:19.512242Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T17:06:28.335731Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T17:08:00.850727Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"cited_work":{"arxiv_id":"2505.21205","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21205","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sci-fi: Sym- metric constraint for frame inbetweening","venue":null,"work_id":"ee55270b-f4b5-4e9b-83bb-384c34deea10","year":2025},"citing_paper":{"arxiv_id":"2604.03819","last_updated":"2026-04-04T18:00:05Z","snapshot_observed_at":"2026-08-11T15:48:42.031454Z","submitted_at":"2026-04-04T18:00:05Z","title":"ActivityForensics: A Comprehensive Benchmark for Localizing Manipulated Activity in Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T17:06:28.335731Z"},"links":{"cited_paper":"/paper/2505.21205","citing_paper":"/paper/2604.03819"},"observation_digest":"sha256:ecbb07b1adbdd1c9b777228f83cdfbadf21619850b592bfb3095064ba1fff037","observation_id":"f6c3b667-bbdd-497a-b11b-42875d281bac","resolution":{"observed_at":"2026-05-13T17:08:00.852371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21205/citation-record","integrity":"/paper/2505.21205/integrity","json":"/paper/2505.21205/citation-record.json","paper":"/paper/2505.21205"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-12T17:29:41.806995Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T13:44:13.215146Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.215146Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:6d51c5354c2610d5b3e9a46368e492e3ec8f924531d6129e1cbc450caace8c00","observation_id":"4083f215-2d0b-4ff4-8dfd-26d1d7d15862","resolution":{"observed_at":"2026-08-07T13:44:13.215146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T13:44:13.282358Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.282358Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:5f366b58761d32396554a4cb9468da937f2ff2cafb8d02396fffea894b53345c","observation_id":"91cf9163-01d5-42e6-bffd-8366d7b65d4d","resolution":{"observed_at":"2026-08-07T13:44:13.282358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:13.370711Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.370711Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:89476aade735c44c8534dad286538734d6a0c4b1671ef002edbb01b84c07a927","observation_id":"fe5f045d-8542-41e2-9e7f-c72cf97047f7","resolution":{"observed_at":"2026-08-07T13:44:13.370711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.928663Z","title":"Ldmvfi: Video frame interpolation with latent diffusion models","venue":null,"work_id":"d1cadce0-668f-41f6-b34d-5d0fd5fa9c4c","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.445402Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:5dc60fcd8ce1ce53d9a357b36a16baeb5afde320fdc3af239f98607a0947da95","observation_id":"36e3177e-12fa-40ab-ab33-cedb9a39643c","resolution":{"observed_at":"2026-08-07T13:44:26.051045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:13.568129Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.568129Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2f91993bceb557ecf2eeb631e99b772b04906700396b5b8b48244425b92ad95f","observation_id":"50bce9f9-4440-408b-9975-422c59022315","resolution":{"observed_at":"2026-08-07T13:44:13.568129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.702594Z","title":"Cogvideox-interpolation","venue":null,"work_id":"6541dbab-c9c1-45ec-b376-b5b2d46f0a2f","year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.665715Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e2871aaeaa43a5827ff5cb190f03bcac94676fad9b7628245d0b133548f1bf4a","observation_id":"315ea3b9-aa4a-4c1f-8c93-58d2edcfa574","resolution":{"observed_at":"2026-08-07T13:44:25.787317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.429721Z","title":"Explo- rative inbetweening of time and space","venue":null,"work_id":"0cb8c673-2980-490a-b547-7537f7ed4169","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.748103Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:4212b650f5f0532ee85322d514aa95ddce6c5c8ce41065b179ec86dcb7367f56","observation_id":"e7a27848-8200-4a80-83cb-cb58518f3a83","resolution":{"observed_at":"2026-08-07T13:44:25.594192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10592","last_updated":"2025-03-13T17:42:01Z","snapshot_observed_at":"2026-08-09T05:24:49.554165Z","submitted_at":"2025-03-13T17:42:01Z","title":"CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10592","snapshot_observed_at":"2026-08-07T13:44:13.839755Z","title":"Cameractrl ii: Dynamic scene exploration via camera-controlled video diffusion models.arXiv preprint arXiv:2503.10592, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.839755Z"},"links":{"cited_paper":"/paper/2503.10592","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:c8beaf4a95bd7aea57f9f4a301f17fde3d24b7be99c2d46a1633ca9b869e684c","observation_id":"c8cf9677-74b7-480d-b138-b846c3436546","resolution":{"observed_at":"2026-08-07T13:44:13.839755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:13.939554Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:13.939554Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2126f3c82ec6c48011c6dac0e815cdc12b803b273698f1a843fbb31dd35881ea","observation_id":"770e205b-16f1-49aa-98ec-f2939f1cd2fa","resolution":{"observed_at":"2026-08-07T13:44:13.939554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:14.037991Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.037991Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:3406bb068a8c9d097a7e8a2dc9587523484f840293ae6ad8a662f27270ea595c","observation_id":"5cdaad8c-5c21-49de-9c15-759eb8d0ad52","resolution":{"observed_at":"2026-08-07T13:44:14.037991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.259066Z","title":"Real-time intermediate flow estimation for video frame interpolation","venue":null,"work_id":"d45746f6-089b-4234-b5c8-233c47c6a0cd","year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.124042Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:a08da2aa71a46b86d813e00ff197d9ce0a14f0b453056f2efa641c5bd20a6621","observation_id":"7f84390d-e96d-412c-b751-eb93cf9dd8c8","resolution":{"observed_at":"2026-08-07T13:44:25.296929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.228994Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":"f6f55d89-e921-4452-a2d8-419d5ccc32ff","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.201840Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:170fa3ef83d915843d0117a627b10722bf35109f2c4702017db725424a3c775d","observation_id":"1066a7ee-dbe3-4cab-a7a1-f9884215aba5","resolution":{"observed_at":"2026-08-07T13:44:25.251616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T13:44:14.302422Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.302422Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:9c126a03cb9aa57680dec61e4f7ab99e5cbf58af82e8e20de44d84497794423f","observation_id":"52d73354-388f-461b-8f5d-d36850f3ad91","resolution":{"observed_at":"2026-08-07T13:44:14.302422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:25.073313Z","title":"Auto-encoding vari- ational {Bayes}","venue":null,"work_id":"2584257e-b738-4878-b0a3-b1be60e7b22b","year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.417358Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:4bd06f7ee9a08c3d2b4159ff34f9f0e19332ccce9e74ca6694c59c1af3866f10","observation_id":"6ba6ca37-04de-4c1e-9178-c6efc77209ee","resolution":{"observed_at":"2026-08-07T13:44:25.128531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:14.495206Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.495206Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2150c10a64f776dc5a1e8d73eb854f9b7ba416969d595a9da2f5e5081778b366","observation_id":"4f7d281f-a584-42ae-8a80-1abe94cf8982","resolution":{"observed_at":"2026-08-07T13:44:14.495206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.828775Z","title":"Amt: All-pairs multi-field transforms for efficient frame interpolation","venue":null,"work_id":"cc5d717e-e560-46ad-9c71-0da8d7de3824","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.571201Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:877c2bbf2bbd5646b94fae47247139ee05c77d15cac64ce90b2fbdf1cae9b6ca","observation_id":"282ff450-f7ee-41b0-807b-89cf13e661ea","resolution":{"observed_at":"2026-08-07T13:44:24.965344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17459","last_updated":"2025-04-11T12:31:07Z","snapshot_observed_at":"2026-08-13T19:17:40.486982Z","submitted_at":"2024-11-26T14:23:53Z","title":"WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17459","snapshot_observed_at":"2026-08-07T13:44:14.655924Z","title":"Wf-vae: Enhancing video vae by wavelet-driven energy flow for latent video diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.655924Z"},"links":{"cited_paper":"/paper/2411.17459","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e1cb3ee48fce3e5b371c9cad3d75490dfb2ff231f1a4915d9927f35d2b0367bd","observation_id":"6b679f74-e21f-4acd-a390-7c73e96a1162","resolution":{"observed_at":"2026-08-07T13:44:14.655924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.652147Z","title":"Ctrl- adapter: An efficient and versatile framework for adapting diverse controls to any diffusion model","venue":null,"work_id":"b889362a-ebea-48a8-b129-e1502a1e46f6","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.751884Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:3638ceebc327941eb10365d54376186d8e00dd3d68c7b64715f71e2e1b9c7238","observation_id":"42595bf1-1f41-48cd-b3ba-88a95c2f9f2a","resolution":{"observed_at":"2026-08-07T13:44:24.740619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.469153Z","title":"Sparse global matching for video frame interpolation with large motion","venue":null,"work_id":"4e706a03-f167-478f-9298-0de480277397","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.858731Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:ada660916ccd8c703a7974b41577143d7402f6a1cba09891762e997eddf05498","observation_id":"bcb63fe6-866a-4c18-864d-808c8b322aa3","resolution":{"observed_at":"2026-08-07T13:44:24.569317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16767","last_updated":"2025-06-25T07:19:44Z","snapshot_observed_at":"2026-08-13T12:33:44.356647Z","submitted_at":"2024-08-29T17:59:40Z","title":"ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16767","snapshot_observed_at":"2026-08-07T13:44:14.960017Z","title":"Re- conx: Reconstruct any scene from sparse views with video diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:14.960017Z"},"links":{"cited_paper":"/paper/2408.16767","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:595912436424f483f8376c8885773e15c2d927ff37fd9a75c0cb8bb97c187b4f","observation_id":"98023b27-27c5-4915-8ab1-70f79d57bdef","resolution":{"observed_at":"2026-08-07T13:44:14.960017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.299763Z","title":"Video frame interpolation via direct synthesis with the event- based reference","venue":null,"work_id":"84d4ebcb-96bf-4ed3-a935-03d1d1a6f2c2","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.058691Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:c321b9d87063946b0f874efa202f3e2e4ed3c57679c66163322dc1e7530fc85f","observation_id":"d2949bcf-9e25-48f8-a09f-bfd2d63b167a","resolution":{"observed_at":"2026-08-07T13:44:24.392603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-07T13:44:15.127935Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.127935Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:18eff487c52816427ebe79e5907dd57b964e73648bfd0af4a44e6ef081377793","observation_id":"379107de-b39c-4ab7-ab3b-d3c7455bd43f","resolution":{"observed_at":"2026-08-07T13:44:15.127935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:24.163821Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"6432bb30-a3aa-44f6-bbb5-c29be0d37b82","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.198513Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:33e22f0f965f97323e6b8714c36d521d8accb890940eeefb8921bfa8cb7968a7","observation_id":"7309618a-2a15-4726-9456-f012e918725d","resolution":{"observed_at":"2026-08-07T13:44:24.228345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.905094Z","title":"Softmax splatting for video frame interpolation","venue":null,"work_id":"108ff5d1-d0de-46b5-bc8e-09b3e23ea837","year":2020},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.284892Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:4751d12a77abfb3b2f5ee9032594fcd8f9da8a288b2864cfe6558cd1e45b2ae6","observation_id":"0ce8ed17-743f-4156-96d7-1a6f4eec85b0","resolution":{"observed_at":"2026-08-07T13:44:24.061779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:15.398968Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.398968Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:a72b7c9331a0e9d2426f99a0e2a3cc513d29fdcf7dafbb13db27890b77e52e82","observation_id":"a082bba9-3577-426f-bb53-c96418e3cb1f","resolution":{"observed_at":"2026-08-07T13:44:15.398968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-08-12T23:05:02.930655Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-07T13:44:15.473154Z","title":"Controlnext: Powerful and effi- cient control for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.473154Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:fe8d84143f79bf299f359c4766d0a100651c12b54f2e3089b234208755875a1d","observation_id":"0a0f5c52-5230-455c-aff1-d072e49a646a","resolution":{"observed_at":"2026-08-07T13:44:15.473154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-07T13:44:15.593897Z","title":"The 2017 davis challenge on video object segmentation.arXiv preprint arXiv:1704.00675, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.593897Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:fcb80f45e06b4866f27e8748ce5cdba7b73384e38c81ad4be72cc0a60c69da8b","observation_id":"650e3eee-1a48-4f02-bdd7-12e6fd3e9746","resolution":{"observed_at":"2026-08-07T13:44:15.593897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.542333Z","title":"Film: Frame inter- polation for large motion","venue":null,"work_id":"ecee8646-4977-45a4-84e4-d462341bafd1","year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.765845Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:d37d2ce85ff3d2b3c9c7c881179a79c3e54f2233a12c14b986eb269535930893","observation_id":"f2c4342a-b2d4-4761-9c37-94d615d0e8de","resolution":{"observed_at":"2026-08-07T13:44:23.740560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:15.903639Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:15.903639Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:f6e3040abb03a29ecd86bbb6335bdfe1f884fa43901df324044e9d8103e5424a","observation_id":"52f9d938-4cc6-410d-9a57-d7db17c42a2c","resolution":{"observed_at":"2026-08-07T13:44:15.903639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.263178Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":"89cd643e-b05b-4263-bc67-09d977782b5b","year":2022},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.085548Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:b10fe07d6d93c5b03f61771a94ec3e9e965920c73f0404c0b040d74bb6c64a72","observation_id":"b76c623c-f13e-4152-a981-e41ce512aca5","resolution":{"observed_at":"2026-08-07T13:44:23.367038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:23.049965Z","title":"Bridging the gap: Sketch-aware interpola- tion network for high-quality animation sketch inbetween- ing","venue":null,"work_id":"fffe47f8-854e-436a-9465-c37090283921","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.227929Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:f15e638853d9f7cfedebdbcaf6f7ade0bffed77fc8420a949bc3710893c4fdcb","observation_id":"65173eec-2a2f-488a-910d-5017a9890550","resolution":{"observed_at":"2026-08-07T13:44:23.154460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.738938Z","title":"Deep geometrized cartoon line inbe- tweening","venue":null,"work_id":"2b115bbf-e2ef-45cb-93b2-fe808ace0846","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.363521Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:d80715a781280d34d4b2b9176b4962571e247a116ef6e3504e53a4f4664c74d9","observation_id":"12977f97-3890-45d1-9c08-a4f4baa393ee","resolution":{"observed_at":"2026-08-07T13:44:22.858494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13190","last_updated":"2025-01-07T22:06:07Z","snapshot_observed_at":"2026-08-13T07:00:55.921010Z","submitted_at":"2024-12-17T18:59:33Z","title":"MotionBridge: Dynamic Video Inbetweening with Flexible Controls","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13190","snapshot_observed_at":"2026-08-07T13:44:16.479200Z","title":"Motionbridge: Dynamic video inbetweening with flexible controls","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.479200Z"},"links":{"cited_paper":"/paper/2412.13190","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:5f6d466d61a2fe59ba2541c8dade3fd27a5547b08ee41c054147b5dbf66cd81b","observation_id":"d7d44b34-37dc-46f0-bef1-183f57295d0c","resolution":{"observed_at":"2026-08-07T13:44:16.479200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.527123Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":"be77776e-89d0-4b84-ab4d-cea4e2eacd13","year":null},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.574603Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:ed597ec7087bfb7858e73f93f3e034803ff43dc1fcdf356914a1a918fbbb7d9f","observation_id":"0e8f3bf3-5e4f-44c0-85a3-574d2f6a28ba","resolution":{"observed_at":"2026-08-07T13:44:22.624747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.338386Z","title":"Neural discrete representation learning","venue":null,"work_id":"143af48e-7134-468e-8bb1-9e788ce0f71a","year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.678861Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:7bf96ef88b30ad4730785e5358dc5ab0bb0c3984106c3606bd2526fbb1fed773","observation_id":"2992bcdf-f234-4190-9e6f-808b1766c4d5","resolution":{"observed_at":"2026-08-07T13:44:22.405551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:16.750458Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.750458Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:a02067cffa9d21b5c4e229ca9e971269df04bd25bc4e696feb77a213fbc261a7","observation_id":"337a7518-82be-40c8-9be5-b4324199233e","resolution":{"observed_at":"2026-08-07T13:44:16.750458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T13:44:16.895481Z","title":"Wan: Open and advanced large-scale video gen- erative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:16.895481Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2065687ec57562596e010e24498dc2728bdce59ac69d09449082c9bd66cda543","observation_id":"0ffcfd94-c333-4aa9-845a-655f376d7000","resolution":{"observed_at":"2026-08-07T13:44:16.895481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18978","last_updated":"2024-11-04T13:37:31Z","snapshot_observed_at":"2026-08-12T22:15:39.520502Z","submitted_at":"2024-10-24T17:59:51Z","title":"Framer: Interactive Frame Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18978","snapshot_observed_at":"2026-08-07T13:44:17.023877Z","title":"Framer: Interactive frame interpolation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.023877Z"},"links":{"cited_paper":"/paper/2410.18978","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:d71c6e24e63f4ca1349d0e628b441ab9431ede4743960fc20f2d0282e3e24a9c","observation_id":"20903de9-30b4-4f01-9f56-64b76f9fed30","resolution":{"observed_at":"2026-08-07T13:44:17.023877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:22.153687Z","title":"Generative inbetweening: Adapting image-to-video models for keyframe interpolation","venue":null,"work_id":"c8cc71d2-8cbc-4239-990d-50cc5cb08817","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.133306Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e0e4aca45082b3b6d195fe2581fd4b2cf1ddfa3102cbec5849bcc199b9dca31d","observation_id":"f990fba8-931d-43a9-8629-75f9da8b4bb4","resolution":{"observed_at":"2026-08-07T13:44:22.252155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.930710Z","title":"Perception-oriented video frame interpolation via asymmetric blending","venue":null,"work_id":"387f671c-9ace-491c-8b57-c5f10e8ab1c1","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.265922Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:d664e1207dd88596f6bfde3c9b1b984938f9a1540d29635b1fad8c792b42fc89","observation_id":"9895fa43-c504-41dd-a36e-b9e711beef63","resolution":{"observed_at":"2026-08-07T13:44:22.041297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.733872Z","title":"Tooncrafter: Generative cartoon interpolation","venue":null,"work_id":"5f08da81-9b1e-4e99-b55c-b57b3211daf3","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.389735Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:05bf096a0235044aad3d8fc4bb40ab5ac5bbbeddf25aedc732ac9a070060bd40","observation_id":"e51f64f4-8104-4e17-8d6f-096049676683","resolution":{"observed_at":"2026-08-07T13:44:21.831663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:17.511227Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.511227Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:eb0fdb4d027f781b99d97edb8b6649542ca1a7ad54f422a4432191d21071d641","observation_id":"33fc56b0-83f5-46a6-9135-7176a2f9efdb","resolution":{"observed_at":"2026-08-07T13:44:17.511227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.533926Z","title":"Vibidsam- pler: Enhancing video interpolation using bidirectional dif- fusion sampler","venue":null,"work_id":"e02a82c8-84cd-4cd5-908e-6ad158060006","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.627682Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:aa534f1f96f44c89879a6a82c93c038d711c30a939c234253b78d8a4de14402d","observation_id":"8be95040-7c99-4bd3-8f52-9e8c470c43e8","resolution":{"observed_at":"2026-08-07T13:44:21.607776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.356631Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":"d72fc2f8-c870-4e7d-ab77-5ad75eaf063e","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.742249Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:e70f9cb60596257e583a5d4d36a72f272fc0600dba55147ba22c3bdd7f59dbc2","observation_id":"eac77d75-735e-4e70-84e4-5349c6d145f1","resolution":{"observed_at":"2026-08-07T13:44:21.452441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:21.167170Z","title":"Language model beats diffusion-tokenizer is key to visual generation","venue":null,"work_id":"58e46837-7847-49c1-a8da-5b1bdeacb2c4","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:17.831603Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:399d202e737124e37b066b33a2a93b145765711a4e84947ed3a2643b21b4dd7f","observation_id":"cdab3e01-b5f6-49b3-8a51-2f418d5672f6","resolution":{"observed_at":"2026-08-07T13:44:21.270560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.962341Z","title":"Extracting motion and ap- pearance via inter-frame attention for efficient video frame interpolation","venue":null,"work_id":"f75730ea-0e7e-45b9-8397-ffacdc1acf23","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.020812Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:ba98346c0a189125aff67c6691fadfefffe7216f4f0591e89005d0642470bcdf","observation_id":"55dd1599-8b31-4768-898d-659701fa9f1a","resolution":{"observed_at":"2026-08-07T13:44:21.067310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03699","last_updated":"2025-03-08T08:22:34Z","snapshot_observed_at":"2026-08-10T21:46:43.089164Z","submitted_at":"2025-01-07T11:03:43Z","title":"Motion-Aware Generative Frame Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03699","snapshot_observed_at":"2026-08-07T13:44:18.167633Z","title":"Motion-aware generative frame in- terpolation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.167633Z"},"links":{"cited_paper":"/paper/2501.03699","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:0ecec419c2eff4c4d58d347aec0ed4a27c606274eff999fff720c690b169e379","observation_id":"a035304f-5cc7-4ada-b270-91f1466fa78e","resolution":{"observed_at":"2026-08-07T13:44:18.167633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.768556Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"90656108-e4df-4b01-b48f-0514168d25ab","year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.292960Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:a31197e694e960e1f1fab11d71cdcb24feb8b46eb0a8856f6a3d275db70344dd","observation_id":"4b8cc3d2-8a3b-4356-9923-22df4873d82d","resolution":{"observed_at":"2026-08-07T13:44:20.843896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.625540Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"e8522f57-2867-41e6-b890-a927f127a989","year":2018},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.466764Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:d9bcfe5bde8be17571257555631b87347a17134e9633e99e3dbe16477e58390a","observation_id":"9e0c3997-f7df-4bb9-bad4-01093910cf73","resolution":{"observed_at":"2026-08-07T13:44:20.699502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-13T11:37:13.641309Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-07T13:44:18.599871Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.599871Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:648ecf8c4e5489f722dc5efb4b6e53fe7c5449c2d748398130450ec8852f6cfe","observation_id":"e40a1cf4-b60b-4a78-ad8a-2157fc8515e1","resolution":{"observed_at":"2026-08-07T13:44:18.599871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07027","last_updated":"2025-03-10T08:07:17Z","snapshot_observed_at":"2026-08-13T21:36:07.275211Z","submitted_at":"2025-03-10T08:07:17Z","title":"EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07027","snapshot_observed_at":"2026-08-07T13:44:18.807929Z","title":"Easycontrol: Adding efficient and flexible control for diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.807929Z"},"links":{"cited_paper":"/paper/2503.07027","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:90c41c6455c3fc908e8280ca8dbc1f90b6746dd07324b20c3350681a2b1cc19e","observation_id":"10505a36-3525-4e05-aa77-2f8a7ff79f29","resolution":{"observed_at":"2026-08-07T13:44:18.807929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21705","last_updated":"2025-03-14T03:03:31Z","snapshot_observed_at":"2026-08-12T23:10:54.142809Z","submitted_at":"2024-07-31T15:53:20Z","title":"Tora: Trajectory-oriented Diffusion Transformer for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21705","snapshot_observed_at":"2026-08-07T13:44:18.994805Z","title":"Tora: Trajectory-oriented diffusion transformer for video genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:18.994805Z"},"links":{"cited_paper":"/paper/2407.21705","citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:f5ce3d82090c56352150e31706d7e5821f4582a9d30a64e7382e3534b41db12d","observation_id":"271e9707-b604-46c1-894a-43d5a354a79d","resolution":{"observed_at":"2026-08-07T13:44:18.994805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.484270Z","title":"Eden: Enhanced diffusion for high-quality large-motion video frame interpo- lation","venue":null,"work_id":"6c56611e-90e0-4402-b7fe-2fe0ae085f10","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.118796Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:5534879a0dc6fdba9d1e8e95769bf2dda453be013ecad5f83974be0a6f1bb345","observation_id":"886b2726-17fe-4672-9697-cd674b762ce0","resolution":{"observed_at":"2026-08-07T13:44:20.543018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.355136Z","title":"Clearer frames, anytime: Re- solving velocity ambiguity in video frame interpolation","venue":null,"work_id":"423c9125-f4de-4e9f-b19e-67a1f6dc4454","year":2024},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.234123Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:ae8c4bd523cea1474155801d35515879e4034ca43c90bad63348eff4e0acebeb","observation_id":"0ab0cd57-b763-4bac-be99-d8e766e4520c","resolution":{"observed_at":"2026-08-07T13:44:20.415759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:20.173195Z","title":"Generative inbetweening through frame- wise conditions-driven video generation","venue":null,"work_id":"b21c21de-7905-46e4-9e48-6f48342aa144","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.379474Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:2247d75702159ae4fefee6dbd87750cbe55612a6f9c60f7ac9b08205fac6dbd1","observation_id":"63187452-6524-42fc-ae2c-e1ed5c7ce038","resolution":{"observed_at":"2026-08-07T13:44:20.282869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:44:19.860580Z","title":"This is the first and last frame of a video clip. Describe this video in one continuous para- graph","venue":null,"work_id":"58948ef5-b5fb-4e48-9270-913c66d936c7","year":2025},"citing_paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:19.512242Z"},"links":{"citing_paper":"/paper/2505.21205"},"observation_digest":"sha256:b95c4ea3f92beb5ae75b1cd5f84cf95faf77ce9e50333cbb367bf472ad16711a","observation_id":"428c41e7-2801-4601-9163-617065fb8dda","resolution":{"observed_at":"2026-08-07T13:44:20.044526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21205","last_updated":"2025-08-10T16:23:45Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T05:25:31.362871Z","submitted_at":"2025-05-27T13:53:50Z","title":"EF-VI: Enhancing End-Frame Injection for Video Inbetweening"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2505.21205."}