{"as_of":"2026-08-20T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6cdffa1d5d4ec735a1e8b7fa213998ab737e74b5429d6503ee481b904ea5c1fb","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:33:03.261296Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:27:35.496886Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T12:27:36.078576Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2506.07713","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.07713","snapshot_observed_at":"2026-08-05T12:27:36.078576Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","venue":"cs.CV","work_id":"05c724fe-072b-483b-bec0-e25d90e3ad2c","year":2025},"citing_paper":{"arxiv_id":"2509.01596","last_updated":"2025-09-01T16:29:39Z","snapshot_observed_at":"2026-08-08T15:15:29.549875Z","submitted_at":"2025-09-01T16:29:39Z","title":"O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T12:27:35.496886Z"},"links":{"cited_paper":"/paper/2506.07713","citing_paper":"/paper/2509.01596"},"observation_digest":"sha256:7a60d2a5b9706e71f73ef6f41d3ce83b5233405ebc131ae74ddc469a3c59a59a","observation_id":"5ffe8280-6485-4d97-b953-da9c78180648","resolution":{"observed_at":"2026-08-05T12:27:36.083765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07713","snapshot_observed_at":"2026-08-03T19:54:50.440555Z","title":"Consistent video editing as flow-driven image-to-video generation.arXiv preprint arXiv:2506.07713, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.22098","last_updated":"2026-07-16T03:47:27Z","snapshot_observed_at":"2026-08-03T19:54:46.253087Z","submitted_at":"2025-11-27T04:40:37Z","title":"WorldWander: Bridging Egocentric and Exocentric Worlds in Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T19:54:50.440555Z"},"links":{"cited_paper":"/paper/2506.07713","citing_paper":"/paper/2511.22098"},"observation_digest":"sha256:1ed69949929b0fcf85d2901fd09f13bad17a2649fc483c0b5fcc42e56eb67dde","observation_id":"2dea041d-2424-4fb1-a3f7-5f800c415447","resolution":{"observed_at":"2026-08-03T19:54:50.440555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07713/citation-record","integrity":"/paper/2506.07713/integrity","json":"/paper/2506.07713/citation-record.json","paper":"/paper/2506.07713"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.726243Z","title":"Learning Transferable Visual Models From Natural Language Supervision","venue":null,"work_id":"d6bb14a4-7cdb-43c5-8f26-24e295e8bb1c","year":2021},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.129691Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:230582a9c0ddb9e55cac05106ee8736cfbcbba9227db7abd26b6c7830d792695","observation_id":"feee49c6-09f0-46ae-a6ca-893c9037906c","resolution":{"observed_at":"2026-08-07T05:33:03.729884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.715024Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":null,"work_id":"79429127-eda0-4618-9c20-4e2fc353b9bb","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.133895Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:a87cf88dbab5f7cf825575fd3709515b62f0e6c217679a5530110a4e850b12b5","observation_id":"26ccb7f3-6087-4a1a-9b09-ec5b7b629ad5","resolution":{"observed_at":"2026-08-07T05:33:03.718993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.704485Z","title":"Paint by Example: Exemplar-based Image Editing with Diffusion Models","venue":null,"work_id":"ecced21b-0fde-4abc-8120-0c97727135ab","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.137282Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:bfcdf992e1a34f29d7cd90913398dc8fe3337051424bb80fe9ade993f9e50af7","observation_id":"14648ce1-e968-473c-8bb7-8337dc11437a","resolution":{"observed_at":"2026-08-07T05:33:03.708331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.692797Z","title":"FLATTEN: Optical FLow-guided ATTENtion for Consistent Text-to-Video Editing","venue":null,"work_id":"fb188dbd-6187-4f76-bc9a-74e0dd84fda5","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.140688Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:cb969645f6c48ffefb35534fddb53970c5693e7f417213917a5e07906cc61966","observation_id":"cf913906-f651-416f-ad13-241abfc3f95d","resolution":{"observed_at":"2026-08-07T05:33:03.697005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.681874Z","title":null,"venue":null,"work_id":"3535f37f-b884-4a54-9cf0-2735985391a2","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.143808Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:567969bba8c3b25b452f1888aee9a2a11605b82d1e4abbe6b23f26bc207a32ce","observation_id":"d36a07eb-6c82-45f3-81cf-31c13e16e8c1","resolution":{"observed_at":"2026-08-07T05:33:03.685305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.671109Z","title":"I2V-Adapter: A General Image-to-Video Adapter for Diffusion Models","venue":null,"work_id":"d0be01b2-65ab-4a53-a162-80a1d7b8f68c","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.147239Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:4389c666660b724bee79ba3bdcd586d4acc1fbbe3bf1a37de5889ab5e82d642a","observation_id":"308d2506-474e-4ab1-bdbb-4789460d860f","resolution":{"observed_at":"2026-08-07T05:33:03.674882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.660480Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","venue":null,"work_id":"03d59518-29a4-479c-8353-114497710dcf","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.150631Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:2f8ae94111c3f318c0af2c506338b768f6286acf80fb74871434e292e732ed49","observation_id":"9f76adc4-569d-4061-a32e-915574b76358","resolution":{"observed_at":"2026-08-07T05:33:03.664159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.650123Z","title":"Id-animator: Zero-shot Identity-Preserving Human Video Generation","venue":null,"work_id":"b6dfa5e4-62cf-4750-9114-51bae02c3d33","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.154018Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:a46a31bbcf3cb9bfcfd93d432c05eb69242ed8315d1f413faec55b74f77dd1e0","observation_id":"3b53ab68-9165-425d-b323-414ea08bdca4","resolution":{"observed_at":"2026-08-07T05:33:03.653557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.639841Z","title":"Denoising Diffusion Implicit Models","venue":null,"work_id":"6832e209-5391-483d-be92-05e7b75ca79f","year":2021},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.156985Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:fdc587193d3b641d03c09d62cef3b702e27729ba534cae84fd601bbc41cbe76e","observation_id":"6e7cb8ba-ef33-4eb6-8562-24439049f545","resolution":{"observed_at":"2026-08-07T05:33:03.643491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.159753Z","title":"Denoising Diffusion Probabilistic Models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.159753Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:16c270afdff6259b5717a32d82235cef15359264d69a8a4b5bf65204de9879cf","observation_id":"227df465-b0f9-4fa4-a9fb-e1cbaa5d5cfd","resolution":{"observed_at":"2026-08-07T05:33:03.159753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.623429Z","title":"Berg, Wan-Yen Lo, Piotr Dollár, and Ross B","venue":null,"work_id":"60aa0270-34d1-4c68-902e-f2911523e1ce","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.162674Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:7cb3b27443cc8b0f5b9fb7d3d81d2420a9fdca57001dc78726775eaf659bbc0b","observation_id":"665c3b58-bdd8-4e05-a4f1-b228dbf3ef50","resolution":{"observed_at":"2026-08-07T05:33:03.626960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.166106Z","title":"Hunyuanvideo: A systematic framework for large video generative models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.166106Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:d83ff25d997ab67960602d708934b069d5bd4c4b55e14b0dd7dff0058ae4dce7","observation_id":"e476094e-43f3-4e3b-86cd-49b72fc536f7","resolution":{"observed_at":"2026-08-07T05:33:03.166106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.606486Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks.arXiv, 2024","venue":null,"work_id":"f3929502-0143-49b5-a762-f0b7dcee268e","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.169280Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:0eaaaf750f5622b93690bad0a1b9cb7ea84aeaceaa374ba6c5d79422f8e676f1","observation_id":"5226ec9a-25d3-4337-a465-21fc6a4e8c8e","resolution":{"observed_at":"2026-08-07T05:33:03.609894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.596809Z","title":"StableV2V: Stablizing Shape Consistency in Video-to-Video Editing","venue":null,"work_id":"9e879eb3-1ffb-4756-bf9d-b23360391487","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.172587Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:a766847cf24371bbef1c067860b353a1943b0ea4e4685894ea6005e1df457c2e","observation_id":"4f94ae3e-8e85-4965-a5dd-d61f0fe9e19b","resolution":{"observed_at":"2026-08-07T05:33:03.600236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.587017Z","title":"Video-P2P: Video Editing with Cross-Attention Control","venue":null,"work_id":"06681da1-5b8c-44ad-a002-2cde807ca412","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.175356Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:e5351f86eb2838867a9619023f6fbd5584daf811f6f4b54b0bb8ae562b9e1126","observation_id":"c561f3b7-0d56-48bd-be89-ff685db16236","resolution":{"observed_at":"2026-08-07T05:33:03.590386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.577348Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","venue":null,"work_id":"e032e925-5219-4e40-8f69-1ed04a0cda2e","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.178672Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:3eb377aeda9d3608e8e152d43f8a53a5d81a9805ea02f049ed630b09ce9bbeb5","observation_id":"88c7d4c2-2f43-4638-9312-fb3d44ad0dc5","resolution":{"observed_at":"2026-08-07T05:33:03.580813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.567140Z","title":"Unflow: Unsupervised learning of optical flow with a bidirectional census loss","venue":null,"work_id":"d5cee574-c197-4a83-988c-2cbfa3b66cb8","year":2018},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.181525Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:db21b98b8502ffd24c08d6e8058560de1c867be47863e27d9d355eb8686a2d00","observation_id":"ac00a12c-7995-4a13-a142-293218484088","resolution":{"observed_at":"2026-08-07T05:33:03.571115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.556882Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","venue":null,"work_id":"ef980b4f-e2d9-4312-8e82-4d530d33d814","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.184638Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:744b957d38efcce31f461e54bf347d48f0d5b2a58286705b78ee320fd8eb52fa","observation_id":"9e6c74a6-fcf7-41ac-81c9-6962c72ae126","resolution":{"observed_at":"2026-08-07T05:33:03.560638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.546224Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","venue":null,"work_id":"79cb9dd7-2226-4986-815d-3e3d2c9c4335","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.188022Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:e47023e58d16bee4053ccccfae0d2a0784189fac0d3d6669b45e7400bcc37914","observation_id":"499f43de-883e-4342-9472-98abac111846","resolution":{"observed_at":"2026-08-07T05:33:03.549749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.534700Z","title":"Mofa-video: Controllable image animation via generative motion field adaptions in frozen image-to-video diffusion model","venue":null,"work_id":"95c44cc2-9983-4ea7-90fb-2540d0e2eb12","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.191235Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:31731acf883876362486c9c2bc6fb64d14601e1ccf1428d10af18fd1f9d3fc1b","observation_id":"39306f4e-ed95-416f-97a2-b369d45d9499","resolution":{"observed_at":"2026-08-07T05:33:03.538421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.524531Z","title":"I2VEdit: First-Frame-Guided Video Editing via Image-to-Video Diffusion Models","venue":null,"work_id":"89dde434-ee0c-4cbb-9019-0b141573cd26","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.194344Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:a06bc12947ff9cc70770d6675e8fa74ed49cb75cd05df3ae832d04b1c3216e89","observation_id":"68662c3b-b4e8-4271-b365-e8cf25033de8","resolution":{"observed_at":"2026-08-07T05:33:03.528160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.513976Z","title":"V ASE: Object-Centric Appearance and Shape Manipulation of Real Videos","venue":null,"work_id":"1fccce35-8b85-4d9e-9361-dab36a8b4554","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.197701Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:2494147b98e73e4924e827a513feef95994d69aaaef9dc9b5786662c5e8040f5","observation_id":"39316147-9e9d-484e-b5ec-33d046067115","resolution":{"observed_at":"2026-08-07T05:33:03.518190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.503528Z","title":"Click to Move: Controlling Video Generation with Sparse Motion","venue":null,"work_id":"4c33d91b-64da-4273-bcb8-e7e09604a00e","year":2021},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.200573Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:41bd91a15e0ed205575b87d4499fcf07bfaa4d22288a115dba8a54d0058f055d","observation_id":"ddbfdcc3-e786-48fb-ac0c-c3b8f7a0dccf","resolution":{"observed_at":"2026-08-07T05:33:03.507154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.493438Z","title":"The 2017 DA VIS Challenge on Video Object Segmentation.arXiv, 2018","venue":null,"work_id":"3640a9cc-7067-4fe8-94d8-ba4d47a918c5","year":2017},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.203629Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:074306cf28f93cc66490e9b7ca4feb6505e27e03e63a09de74a47493a0abac04","observation_id":"c4baa208-f94b-492c-a20a-ac2a516a2599","resolution":{"observed_at":"2026-08-07T05:33:03.497084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.483376Z","title":"High- Resolution Image Synthesis with Latent Diffusion Models","venue":null,"work_id":"6e556ee2-1fef-45cc-a60e-fd2f96467077","year":2022},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.206838Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:9b5492be5da5b31d0ca931eae75530009eb8dc4ca08bbccac552bf8ee15df26a","observation_id":"e3715944-0afa-4eb9-84ba-830ec104c2ce","resolution":{"observed_at":"2026-08-07T05:33:03.487013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.472830Z","title":"CCEdit: Creative and Controllable Video Editing via Diffusion Models","venue":null,"work_id":"8c700ac1-c3ac-43b7-a7bc-d9d431643ed2","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.209708Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:19bb5c39b32865ae8adbe850035ec2ef120b1646137f87e3f476e34a5de7c959","observation_id":"bac59685-628c-4896-9359-5d9f9b783a99","resolution":{"observed_at":"2026-08-07T05:33:03.476681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.462181Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","venue":null,"work_id":"4ed96df6-07e2-402c-abaa-f0d6c55b9f13","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.212712Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:f446516ec97160706d4c14b506b0e87132b8cd065ad8a96b2046583e3278f14b","observation_id":"9d21a6d9-dee2-4945-a937-2bdee205b9b5","resolution":{"observed_at":"2026-08-07T05:33:03.465927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.451813Z","title":"UniVST: A Unified Framework for Training-free Localized Video Style Transfer","venue":null,"work_id":"caac663a-97f1-48c4-b96d-83d69d271786","year":2025},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.215466Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:0f24b2c972dfb4188af4a9ef0dfc49ab5ff4d65ff295844b6431c1509f153b0c","observation_id":"001d5d65-ca6a-4bc3-a4c2-20e0db695d00","resolution":{"observed_at":"2026-08-07T05:33:03.455311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.441639Z","title":"RAFT: Recurrent All-Pairs Field Transforms for Optical Flow","venue":null,"work_id":"4a71126b-8e2d-4110-9795-761e608c830b","year":2020},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.218562Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:e53b0eb58f21981909cb0dacce31ce79afe8eba2c68fb18264a60e0f6779acfb","observation_id":"d1dd1312-ace0-4d47-afb7-f4bdd0e982da","resolution":{"observed_at":"2026-08-07T05:33:03.445348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.431838Z","title":null,"venue":null,"work_id":"15c0a811-1af0-4c99-90e5-c92a69f802f9","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.221928Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:75274068a0f7911a6a6fca19344cddef2ac70e4ec080f34717350762db362a77","observation_id":"4df575ae-a8bf-477b-b14b-867a755412fb","resolution":{"observed_at":"2026-08-07T05:33:03.435096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.421879Z","title":"FVD: A New Metric for Video Generation","venue":null,"work_id":"23fd4157-a02a-4266-b4a3-a64f8cc4e00c","year":2019},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.224923Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:005844b77eac5e3510ce06eacf7e003c5a483f506f0f90e507273d37be732234","observation_id":"3f2216dc-d079-40a1-bd82-131a5d430775","resolution":{"observed_at":"2026-08-07T05:33:03.425283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.411837Z","title":"Wan: Open and advanced large-scale video generative models, 2025","venue":null,"work_id":"0e68fcfa-8a08-4915-bae1-29a448106846","year":2025},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.227903Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:29fbc38d91efb53fe76e8d4d72b4b1b7a26b5d3388eb6ff002032a6a2c7505b2","observation_id":"626d432e-ecef-45bb-9902-b9ccfd057bd8","resolution":{"observed_at":"2026-08-07T05:33:03.415525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.401762Z","title":"Scalable Diffusion Models with Transformers","venue":null,"work_id":"a94381cb-f654-4ed0-b8bf-ebae29e93082","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.230882Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:658bef82d01a4e4c269de51cc8e2192e4dde59973438d9dceab323ece83bec30","observation_id":"7c4bbe4b-7dcf-4445-b133-372f8d68788d","resolution":{"observed_at":"2026-08-07T05:33:03.405555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.391677Z","title":"Exploring Video Quality Assessment on User Generated Contents from Aesthetic and Technical Perspectives","venue":null,"work_id":"9b4dd737-d72c-44e5-98ad-e34147447aac","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.233652Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:b69b3731f7fe6a2832c0ba6e3e8d1aacd2d003858f5145a978142b44d76e43c0","observation_id":"f690d12a-8086-447d-b3e8-8068bd12a0ff","resolution":{"observed_at":"2026-08-07T05:33:03.395198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.381164Z","title":"Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation","venue":null,"work_id":"aad8ba92-105b-43d8-96f2-954a3fade661","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.236650Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:d15410a41ad264498f3a56205905398a30b0fdc3a5fb1267bdea0cf85da40094","observation_id":"3ea1542c-e71e-4e01-a54c-746f1f4b3bf6","resolution":{"observed_at":"2026-08-07T05:33:03.384951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.369220Z","title":"Latte: Latent Diffusion Transformer for Video Generation","venue":null,"work_id":"68a141ff-4249-4917-b6bd-69ba5dc3506b","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.240139Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:74d4bc394fbdbd545a7a9b3e69f87814559f884e3b048c8340a8ea18bb72f464","observation_id":"5ed5eab0-b488-4537-86c8-14f17c18db1b","resolution":{"observed_at":"2026-08-07T05:33:03.372938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.357934Z","title":"PEEKABOO: Interactive Video Generation via Masked-Diffusion","venue":null,"work_id":"a1d5c82c-d0d2-4c46-892c-8a9974f09b28","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.243412Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:07084c430eb18e2fc61518ec81063881cfde9d41fd900de867ad71953210cd48","observation_id":"51f76a52-b8b2-425d-a032-28af2db9d5fe","resolution":{"observed_at":"2026-08-07T05:33:03.361787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.346313Z","title":"Space-Time Diffusion Features for Zero-Shot Text-Driven Motion Transfer","venue":null,"work_id":"95533bdc-0f83-4db2-8a66-69539c8688a6","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.246520Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:87c6460a17b1f0d817d18efc2a3c988d037d30c947d72edbaf0ed73bf3b03c6f","observation_id":"c771811a-9d1d-406c-9526-41de1f18c6ad","resolution":{"observed_at":"2026-08-07T05:33:03.350426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.334902Z","title":"StableDrag: Stable Dragging for Point-based Image Editing","venue":null,"work_id":"d4aef689-a9f4-415d-99b0-1ae370c7e8c2","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.249353Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:eddfcecaa34bbcc2f4ff833fda63e85dc9ed522b333500f3045cbac8d0d17c6f","observation_id":"1f27dd78-01fb-430f-b1b4-f6b52c0e8998","resolution":{"observed_at":"2026-08-07T05:33:03.338556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.323317Z","title":"Flow-Guided Transformer for Video Inpainting","venue":null,"work_id":"185abbcb-1f28-4fe8-8bd6-c03ead72689a","year":2022},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.252144Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:c8811c45017697ab3f19309ade1ad37c92c8e1796922821ffad5967d740b1e2b","observation_id":"2be585d7-5840-499a-8532-52a4d6008fd1","resolution":{"observed_at":"2026-08-07T05:33:03.327896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.312418Z","title":"Metaxas, and Licheng Yu","venue":null,"work_id":"4b18a39f-b4ae-4f5e-bca1-51dc9de47b1f","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.255031Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:6582c72c0e7e2d77b58125ca5a4128d7e7c0e7d6e485a393bf1c6c3e7aa1f336","observation_id":"77b31e8f-9f21-44c3-822e-8a866a4efa58","resolution":{"observed_at":"2026-08-07T05:33:03.316262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.301740Z","title":null,"venue":null,"work_id":"3e51ea31-cfe2-4ed9-956e-df76707f07b8","year":2023},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.258039Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:90fbe0f5db48900c9e513008fb72d5ce4213a4317472eea21e11337fe06bb8f5","observation_id":"0c453347-f205-4223-b53d-4a93d0cfb442","resolution":{"observed_at":"2026-08-07T05:33:03.305214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:33:03.289035Z","title":"black- swan","venue":null,"work_id":"fad9adf0-f695-4bc7-a847-050ce97c6bc0","year":2024},"citing_paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:33:03.261296Z"},"links":{"citing_paper":"/paper/2506.07713"},"observation_digest":"sha256:978f9861bfb408094c23c7f59f48e993b6a07809e9ebe2921dff8ef8dc5283d9","observation_id":"7cb9df5e-3720-4587-9e4a-512b2799de83","resolution":{"observed_at":"2026-08-07T05:33:03.293769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07713","last_updated":"2025-06-13T09:10:58Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T04:08:51.165908Z","submitted_at":"2025-06-09T12:57:30Z","title":"Consistent Video Editing as Flow-Driven Image-to-Video Generation"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":38},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 2 inbound Pith citation observations for arXiv:2506.07713."}