{"as_of":"2026-08-10T11:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a877b9a1f2e5a69f2b4733bfe34550ff31f6db217ef19219cd2751b02d7c5296","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:54:20.099641Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T04:29:51.659833Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T15:48:34.930375Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":"2506.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-07-03T15:48:34.930375Z","title":"Flowmo: Variance-based flow guidance for coherent motion in video generation","venue":null,"work_id":"94e2565d-43d6-49ba-9566-3e5231e52f32","year":2025},"citing_paper":{"arxiv_id":"2603.05539","last_updated":"2026-05-08T14:58:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-04T10:39:04Z","title":"VDCook:DIY video data cook your MLLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T16:52:36.882218Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2603.05539"},"observation_digest":"sha256:f8b0cab5ea539d6e079cff97ed417a5c46641401dbc72c6b01af56332524450f","observation_id":"c1ce709e-94b9-4f23-9438-521f7f690cfc","resolution":{"observed_at":"2026-05-15T16:56:19.194186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":"2506.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-07-03T15:48:34.930375Z","title":"Flowmo: Variance-based flow guidance for coherent motion in video generation","venue":null,"work_id":"94e2565d-43d6-49ba-9566-3e5231e52f32","year":2025},"citing_paper":{"arxiv_id":"2606.11969","last_updated":"2026-06-10T11:49:54Z","snapshot_observed_at":"2026-07-06T23:50:58.297354Z","submitted_at":"2026-06-10T11:49:54Z","title":"SpecLoR: Spectral Lookahead Rectification for Motion-Coherent Text-to-Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T10:00:35.608696Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2606.11969"},"observation_digest":"sha256:b6df973e0e9844d78d4f307b460eeee658baee57cd096ac78463fafbc17992df","observation_id":"f2cd8623-32b8-4492-a12c-aa18d650d88c","resolution":{"observed_at":"2026-07-03T10:27:56.796822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":"2506.01144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-07-03T15:48:34.930375Z","title":"Flowmo: Variance-based flow guidance for coherent motion in video generation","venue":null,"work_id":"94e2565d-43d6-49ba-9566-3e5231e52f32","year":2025},"citing_paper":{"arxiv_id":"2607.01962","last_updated":"2026-07-02T09:56:50Z","snapshot_observed_at":"2026-08-08T07:29:09.225372Z","submitted_at":"2026-07-02T09:56:50Z","title":"NeoMap: Training-free Novel-View Synthesis from Single Images and Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-03T15:45:57.331627Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2607.01962"},"observation_digest":"sha256:b2f1ffb259d595b61df977a2d181a3310208f1a1978f4b12e24b363ad6fa5aa0","observation_id":"902465e9-4c8e-4ca0-8a3a-74991f3c0e0a","resolution":{"observed_at":"2026-07-03T15:48:34.931796Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01144","snapshot_observed_at":"2026-08-01T04:29:51.659833Z","title":"arXiv preprint arXiv:2506.01144 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22531","last_updated":"2026-07-24T17:59:39Z","snapshot_observed_at":"2026-08-07T13:04:18.211748Z","submitted_at":"2026-07-24T17:59:39Z","title":"Twins: Learn to Predict Unified Representations with Focal Loss","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-01T04:29:51.659833Z"},"links":{"cited_paper":"/paper/2506.01144","citing_paper":"/paper/2607.22531"},"observation_digest":"sha256:8d42dc93161a7be59424be8632edb6790c0cf70b0763412653c7586aa72615b6","observation_id":"c0071cdd-3cab-42dd-8e85-8544a608aabc","resolution":{"observed_at":"2026-08-01T04:29:51.659833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01144/citation-record","integrity":"/paper/2506.01144/integrity","json":"/paper/2506.01144/citation-record.json","paper":"/paper/2506.01144"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T11:54:12.226960Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.226960Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:4f4e76532c5e0ebb511d77c7e6206105e6ee7e9664b17fc77a9f195ace1a3f83","observation_id":"bcde0d0d-f41f-4cc1-ba67-665d398cc6b9","resolution":{"observed_at":"2026-08-07T11:54:12.226960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-07T11:54:12.337229Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.337229Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6c8ffb17cb7a4ca6e87a074c00e92ff12a3696c41e82c09ed27cb9a522f08cf4","observation_id":"a740271e-a4b5-4cc4-84b5-10649469610c","resolution":{"observed_at":"2026-08-07T11:54:12.337229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02492","last_updated":"2025-05-26T13:56:07Z","snapshot_observed_at":"2026-08-10T06:42:16.699228Z","submitted_at":"2025-02-04T17:07:10Z","title":"VideoJAM: Joint Appearance-Motion Representations for Enhanced Motion Generation in Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02492","snapshot_observed_at":"2026-08-07T11:54:12.520467Z","title":"Videojam: Joint appearance-motion representations for enhanced motion generation in video models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.520467Z"},"links":{"cited_paper":"/paper/2502.02492","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:7f9fbcd295157cfc47d58afa302aadb3d1f57a3be24f292f651d613b1e0761bb","observation_id":"8ba1652b-0765-49c2-8246-f68df6ddb1f5","resolution":{"observed_at":"2026-08-07T11:54:12.520467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:24.202219Z","title":"How far is video generation from world model: A physical law perspective, 2024","venue":null,"work_id":"1849c017-d022-421f-9ebf-b09608c77a7b","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.659311Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:61c1ab34dc75e80ac0afef797dda7739263f4a04090f3de6b566d934a9050a21","observation_id":"dca6690c-f771-4a9f-8bf1-2278e7bb9f85","resolution":{"observed_at":"2026-08-07T11:54:24.283477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:12.823817Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.823817Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c77f44de52a2618eb1d8dc8324d19e099458dfdca467b8fc6f67f170d6309d9d","observation_id":"4cafe62c-6daa-461b-b6d6-877404396b40","resolution":{"observed_at":"2026-08-07T11:54:12.823817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:24.063789Z","title":"Motion prompting: Controlling video generation with motion trajectories, 2024","venue":null,"work_id":"ff5ed6bf-a992-4e49-a15f-621476acf3d9","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.000481Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f662e9d2bcc5bf661b8cc439c544bee3090b28d6fcbe8e361a120406fa30a899","observation_id":"ad101ca1-a908-4111-91ab-24aba3b27cc2","resolution":{"observed_at":"2026-08-07T11:54:24.138825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.960386Z","title":null,"venue":null,"work_id":"8c81cce7-43d8-4efe-ab3e-89021be97a2f","year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.090493Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:af4d42128dce8d8a9988e236172e73374142e0164cb834452647f7e31c5f4b94","observation_id":"b1306df7-84ca-4aba-a6c6-e26b12c2e08f","resolution":{"observed_at":"2026-08-07T11:54:24.009855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.794700Z","title":"Physgen: Rigid-body physics- grounded image-to-video generation","venue":null,"work_id":"de40dc48-33ff-4ba7-8206-5934e6630eeb","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.203424Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c8c4c7562c807b1379af42ebde410bdf5f738e17bad5c680bad722bc90f8a584","observation_id":"333ad736-d379-457a-954b-565849da96c9","resolution":{"observed_at":"2026-08-07T11:54:23.873455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05922","last_updated":"2024-02-29T21:06:58Z","snapshot_observed_at":"2026-08-10T03:14:56.876279Z","submitted_at":"2023-10-09T17:59:53Z","title":"FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05922","snapshot_observed_at":"2026-08-07T11:54:13.311391Z","title":"Flatten: optical flow-guided attention for consistent text-to-video editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.311391Z"},"links":{"cited_paper":"/paper/2310.05922","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:315b715d8b33a15d61405c69416b79f10c68797b83bc41bda116578aae86deeb","observation_id":"02428eb5-5419-4ed3-9f29-b1dab5781601","resolution":{"observed_at":"2026-08-07T11:54:13.311391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.609918Z","title":"Tulyakov, Ming-Yu Liu, Xiaodong Yang, and Jan Kautz","venue":null,"work_id":"7ab90b20-9167-4bc9-80f9-06a54b7f859d","year":2018},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.464182Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:3dba4cbebd47db11a9252676ead32bbca72e266a86bc47a25580b719dab28f80","observation_id":"56974d30-cd79-4573-a968-cad8123bfae6","resolution":{"observed_at":"2026-08-07T11:54:23.695990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.558832Z","title":"Video-lavit: Unified video-language pre-training with decoupled visual-motional tokenization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.558832Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:12a1d72882bededbc33dc32300ea5c8a7518f2c2ee62dc65d7fed9f342a33d65","observation_id":"fcda0f6a-5dde-47e0-8e97-b390e013a7ca","resolution":{"observed_at":"2026-08-07T11:54:13.558832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.632879Z","title":"Packing input frame context in next-frame prediction models for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.632879Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:90fcaa76556c041a6c0cb080a4be847fb694088043d35792cb8f31ed8d36655a","observation_id":"348bcd06-c83b-4acb-a45f-c0324d533118","resolution":{"observed_at":"2026-08-07T11:54:13.632879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06434","last_updated":"2016-01-07T23:09:39Z","snapshot_observed_at":"2026-08-04T04:34:27.861448Z","submitted_at":"2015-11-19T22:50:32Z","title":"Unsupervised Representation Learning with Deep Convolutional Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06434","snapshot_observed_at":"2026-08-07T11:54:13.696184Z","title":"Unsupervised representation learning with deep convolutional generative adversarial networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.696184Z"},"links":{"cited_paper":"/paper/1511.06434","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:5ed756d0064fd08eaa0061ff82dd3073d7db54072cbcc99c62316be0a36111c1","observation_id":"e81ba6fc-2d44-4a4f-aa32-b7f07bcf75c4","resolution":{"observed_at":"2026-08-07T11:54:13.696184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.372294Z","title":"Interpreting the latent space of gans for semantic face editing","venue":null,"work_id":"1ed54c7e-84a3-44f6-b4d1-9dbff442d729","year":2020},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.778916Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:aa2508231372e97a431b15c43a41e2a54650dc7bfec08c83c4e57f60058452d5","observation_id":"87bd38d7-03b5-4574-9ab9-da0d5e4f23f5","resolution":{"observed_at":"2026-08-07T11:54:23.514531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:23.153180Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":"1d838b0d-697a-48cf-bbc7-2d9691d15d54","year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.865689Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8f6018830a7b4de5f7ce7d201adfd1f9eb6cb2c9cc6287f1b1aa690e1a5a776c","observation_id":"a32091da-ece2-45d9-8771-f3ef9017f601","resolution":{"observed_at":"2026-08-07T11:54:23.283900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.036216Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.036216Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b2a4e5fef0db4a29858fdc4be0ef8ffed8c1c1f63dbfda58b8bc8d01b9ec7aba","observation_id":"d1baa659-603f-4fd9-921b-a19d536bb34b","resolution":{"observed_at":"2026-08-07T11:54:14.036216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.137209Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.137209Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:1236bd285d904bd823ef5dd70dd8378fa38d42b74b44d449467166c1f8763810","observation_id":"1d576c2a-9ac1-421a-90bd-7231628fda3d","resolution":{"observed_at":"2026-08-07T11:54:14.137209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-07T11:54:14.238268Z","title":"Kingma, Ben Poole, Mohammad Norouzi, David J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.238268Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f1e6c685fcbadccf930ecee709a09bf06dc30f1055e811fe2b3637b6061921fd","observation_id":"986b43fd-d1f9-4733-98ad-b87ed723bfd0","resolution":{"observed_at":"2026-08-07T11:54:14.238268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-08-07T11:54:14.414120Z","title":"Diffusion models beat GANs on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.414120Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8c0f2068931e8098e5aaa0ab458c10ebd6760bd4507e6a8ead39d8f13b590fc1","observation_id":"f2aef76a-a48f-4048-a8f2-7035a3def5e4","resolution":{"observed_at":"2026-08-07T11:54:14.414120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.595545Z","title":"Zero-shot text-to-image generation, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.595545Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:d6c43dcf81ff0dfa62f440cc223483279ec1917c4fa60ce9576efd560eb5b4c3","observation_id":"3ee96893-1516-49c5-914b-92815bd810ec","resolution":{"observed_at":"2026-08-07T11:54:14.595545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.730911Z","title":"Sara Mahdavi, Rapha Gontijo Lopes, Tim Salimans, Jonathan Ho, David J Fleet, and Mohammad Norouzi","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.730911Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b6606e84c1e6149ce97c1da82fa52a07fa0bf9f00cbf2f1db563e65da10db5a8","observation_id":"d8c8e943-6f5c-4661-9e2d-a1b8207b2970","resolution":{"observed_at":"2026-08-07T11:54:14.730911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-07T11:54:14.846340Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.846340Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:9731d8b09121b1b16ca95a1496c402e7800fb42bb4812640a5c31bbbc96ce7d5","observation_id":"b9486b8e-5c53-4e3f-b728-8ba37bcc0f97","resolution":{"observed_at":"2026-08-07T11:54:14.846340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08674","last_updated":"2024-07-11T17:06:53Z","snapshot_observed_at":"2026-08-08T19:58:33.185924Z","submitted_at":"2024-07-11T17:06:53Z","title":"Still-Moving: Customized Video Generation without Customized Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08674","snapshot_observed_at":"2026-08-07T11:54:14.966753Z","title":"Still-moving: Customized video generation without customized video data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.966753Z"},"links":{"cited_paper":"/paper/2407.08674","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:7e6188a47016574906eca2af7a95e193d5c6527205e13ca4e32ea473382eddad","observation_id":"58189385-bfee-4dcf-86be-d1d92520676f","resolution":{"observed_at":"2026-08-07T11:54:14.966753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.941185Z","title":"Emu edit: Precise image editing via recognition and generation tasks","venue":null,"work_id":"43671189-7940-4d89-83bb-ad289ad4479d","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.113609Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:00d52747b9e7edcd11b35ca0259d25e0d61dd024c7cd64c1246e40056e618955","observation_id":"1e27b8c3-6ce3-40b7-a676-31bf332b8def","resolution":{"observed_at":"2026-08-07T11:54:23.016317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.749044Z","title":"Video editing via factorized diffusion distillation","venue":null,"work_id":"b83e7746-5315-4fbe-9c31-a819a414eb35","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.178735Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:a60ca481e30c95838636f8cb9b0d1354c6d7aaa371106183e337290d67f78552","observation_id":"ee2f62c9-2ade-4513-851f-63e0f31465d5","resolution":{"observed_at":"2026-08-07T11:54:22.838361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T11:54:15.308313Z","title":"Prompt-to- prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.308313Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:1f06932b7e67f80244013f6b989919ee7b9097dc790a85cbf5e9294954720a32","observation_id":"84888083-4b88-4eee-ba96-7f667bd4d423","resolution":{"observed_at":"2026-08-07T11:54:15.308313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.426301Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.426301Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b6625cad35218cbe46cf330dd84f3ef185e4e279235042a764aba70de14756c8","observation_id":"3f42684c-d814-4988-93a1-a9448ff0ba86","resolution":{"observed_at":"2026-08-07T11:54:15.426301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07232","last_updated":"2024-11-12T07:49:39Z","snapshot_observed_at":"2026-08-08T18:32:21.645860Z","submitted_at":"2024-11-11T18:50:09Z","title":"Add-it: Training-Free Object Insertion in Images With Pretrained Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07232","snapshot_observed_at":"2026-08-07T11:54:15.551826Z","title":"Add-it: Training-free object insertion in images with pretrained diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.551826Z"},"links":{"cited_paper":"/paper/2411.07232","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f4f5c032517979d44b3c8aaaa15fbb5cb64663ef6adc834202320ea4a361653d","observation_id":"91c02129-6184-4915-affe-98017b22ba7b","resolution":{"observed_at":"2026-08-07T11:54:15.551826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.635219Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.635219Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:ecb4cc5ddfbba583bccac1545484818c5256adbbdd396f30a4209d24cfbe8a3a","observation_id":"a3eaf77e-ad85-4e94-90a3-4ebda8501765","resolution":{"observed_at":"2026-08-07T11:54:15.635219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.410805Z","title":"Geodiffuser: Geometry-based image editing with diffusion models","venue":null,"work_id":"f49fc993-585d-4f6e-ba62-9c76bf1dc0d0","year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.734079Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f44c2a2655710ba405d0b178f744adea7883f52c27f3567189ccf253b9112693","observation_id":"9523449d-0f27-41c8-9192-e6f9ca84b859","resolution":{"observed_at":"2026-08-07T11:54:22.578846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.902601Z","title":"Paint by example: Exemplar-based image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.902601Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:ea3f163cedcde6a1cf6d9cc194e009e8fe748377b603829b87a61162a814ce8f","observation_id":"c4a37e6d-418a-423c-94eb-c794c85eaa71","resolution":{"observed_at":"2026-08-07T11:54:15.902601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15282","last_updated":"2021-12-17T17:21:04Z","snapshot_observed_at":"2026-08-07T06:41:10.116700Z","submitted_at":"2021-05-30T17:14:52Z","title":"Cascaded Diffusion Models for High Fidelity Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15282","snapshot_observed_at":"2026-08-07T11:54:16.018444Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.018444Z"},"links":{"cited_paper":"/paper/2106.15282","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:aac21f82d0609b0816a238f96fc2fe466eb2c1c7aa6c5b62c9163510b7e851b7","observation_id":"5013d213-eba1-4ef5-9ae4-dcaed096f2be","resolution":{"observed_at":"2026-08-07T11:54:16.018444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12945","last_updated":"2024-02-05T16:36:30Z","snapshot_observed_at":"2026-08-08T15:14:24.281572Z","submitted_at":"2024-01-23T18:05:25Z","title":"Lumiere: A Space-Time Diffusion Model for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12945","snapshot_observed_at":"2026-08-07T11:54:16.125338Z","title":"Lumiere: A space-time diffusion model for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.125338Z"},"links":{"cited_paper":"/paper/2401.12945","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6f53d9eaa24377015747b7464c6cb79cc2b4c96ebac103e7707415a860bc9270","observation_id":"9d8e8843-b0c3-4aaf-a7ab-f5a92e81f075","resolution":{"observed_at":"2026-08-07T11:54:16.125338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-09T15:04:43.257424Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-07T11:54:16.255631Z","title":"Latent-Shift: Latent diffusion with temporal shift for efficient text-to-video generation.arXiv preprint arXiv:2304.08477, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.255631Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f768a97a1b3bed9d4ef446fc14a5703b1488764b1c4dfa2ddb8464bca8a33d9b","observation_id":"b20bc81f-a5e8-4dcd-9d71-4606a068ac54","resolution":{"observed_at":"2026-08-07T11:54:16.255631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T11:54:16.397022Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.397022Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:1571c1e6fe550b696ecba6e43222b6eb81c450407d4d7d335b97bfce6ffef295","observation_id":"13f4c28b-51d2-409c-a6ab-5e75404bc1cc","resolution":{"observed_at":"2026-08-07T11:54:16.397022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:16.493439Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.493439Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:2ba7a7ab1da9c45d7e3c5825e2efd05bcb4e5401d466b8aa1a0d63ef97927763","observation_id":"a04bdd92-13ed-4648-9efa-5acb5cc4d400","resolution":{"observed_at":"2026-08-07T11:54:16.493439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T11:54:16.605290Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.605290Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:7bac2467ecbcb2f83cb7233ca05b18d23e76e1b6229b92aa6be4e81f3a2d6e7d","observation_id":"86bd3e09-9dac-41a3-986b-9ec23eefac01","resolution":{"observed_at":"2026-08-07T11:54:16.605290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:22.159104Z","title":"Hedra: Ai-powered character video generation","venue":null,"work_id":"5ef8b27b-1e7a-496e-a9fc-233124550eb7","year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.670794Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:fe136d9ffa2d720a4318b6ff0f1d23b1267bf330914c59b57724b6b18a8b2a54","observation_id":"208ba36b-ef60-423b-baf2-a3d9c0216345","resolution":{"observed_at":"2026-08-07T11:54:22.269405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.985629Z","title":"Sora: Text-to-Video Generation","venue":null,"work_id":"227b17c3-6dae-4bd6-8eba-3d4c7d107999","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.761636Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:891f88e4f2e5ed5b6003d66d72499cb4da5b2562ef396c011e6b31e218f8fd43","observation_id":"952daa87-b890-4d2d-9799-636dfc93a7a5","resolution":{"observed_at":"2026-08-07T11:54:22.082194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.797787Z","title":"Genie 2: A Large-Scale Foundation World Model","venue":null,"work_id":"6c8a761f-1bc2-4c32-aa42-70688ed10dbe","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.824942Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:7e95063f1f2bdd2b3f7cf34177b54a34137421e19f2999487858a89f5d429649","observation_id":"ab1186b4-1a2a-4ddb-8761-ea8b013f8eed","resolution":{"observed_at":"2026-08-07T11:54:21.874155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.669716Z","title":"Generating worlds","venue":null,"work_id":"eb1d9d95-57ee-4ef4-84ff-bda18c9ff9a6","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.948467Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:1902cc49e8bc5843c1b3ca9b115aa3c4d638617b8638058cdc7421881daab120","observation_id":"09851d89-a861-4c5e-80ce-1ec83df90418","resolution":{"observed_at":"2026-08-07T11:54:21.723532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.026073Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.026073Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c4a9460a759a39808ae9d70c6c17cf29556922cf42381dc567c2d16e4cc57493","observation_id":"008218d2-5563-4e76-97ee-6c0a8aaf333a","resolution":{"observed_at":"2026-08-07T11:54:17.026073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T11:54:17.147582Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.147582Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6a07501062f5d9a26a72c9c291f9e18199f56667159adad7f3bd9601e49bb217","observation_id":"01badb3d-5710-4aea-b42f-b357da2f1711","resolution":{"observed_at":"2026-08-07T11:54:17.147582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T11:54:17.305170Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.305170Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:db7c1262d3cd8a9caedf33412dcab0462801a50b4000ace260b0a240d547ee4e","observation_id":"2f2ddd89-9648-432f-9e32-39b40b93bd80","resolution":{"observed_at":"2026-08-07T11:54:17.305170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-07T11:54:17.448129Z","title":"LaVie: High-quality video generation with cascaded latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.448129Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:dfdd4942cc590590ce8e91a7db644e57bf5a25e473166523a6013fbbb31f0e13","observation_id":"599b2380-78f2-4781-8571-9df2c5b38fe3","resolution":{"observed_at":"2026-08-07T11:54:17.448129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.585649Z","title":"Unipc: A unified predictor-corrector framework for fast sampling of diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.585649Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:a96ab094ac07ec1916951b846e0c9e00258f33e11342f7b72dd10e424e8f6595","observation_id":"42035c57-0568-4a06-9bb3-1a4db4336fc4","resolution":{"observed_at":"2026-08-07T11:54:17.585649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.755544Z","title":"Attend-and-excite: Attention- based semantic guidance for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.755544Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:0496207fa2b69cabd8cf2b2355857219d99bb47d3b3117232223f9983cb31f67","observation_id":"f44b32ae-cd93-4150-ae14-83e34a708943","resolution":{"observed_at":"2026-08-07T11:54:17.755544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.508584Z","title":"Be yourself: Bounded attention for multi-subject text-to-image generation","venue":null,"work_id":"998d845f-46b9-4dfe-8f8d-170168cd7a4f","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.878728Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f18663205410ad3ff99e6f1fa6a83e59b2cd8bdeebb527b3f80b21d2c5077a13","observation_id":"0c3980e8-daa6-4c13-85d4-ea6a254ee7d9","resolution":{"observed_at":"2026-08-07T11:54:21.562097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-08-10T11:06:18.012048Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-07T11:54:17.996781Z","title":"Make it count: Text-to-image generation with an accurate number of objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.996781Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:90e4350a9c68e7e51fed4d44957f9d678c4311372897f82c17fe546af91e4150","observation_id":"0ea45198-da49-4e43-8899-98e48f061e84","resolution":{"observed_at":"2026-08-07T11:54:17.996781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.361143Z","title":"Separate-and-enhance: Compositional finetuning for text-to-image diffusion models","venue":null,"work_id":"08a21f9e-bdb3-455e-b24c-8215326c7c71","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.095074Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:243b972ac12a2c447213906183c12c22048a98016a773b668d0330e8fdae2499","observation_id":"a5f46d6f-33e8-4320-9615-3f3bca0b5425","resolution":{"observed_at":"2026-08-07T11:54:21.448426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08641","last_updated":"2025-04-11T15:41:43Z","snapshot_observed_at":"2026-08-07T16:06:29.686223Z","submitted_at":"2025-04-11T15:41:43Z","title":"Training-free Guidance in Text-to-Video Generation via Multimodal Planning and Structured Noise Initialization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08641","snapshot_observed_at":"2026-08-07T11:54:18.192758Z","title":"Training-free guidance in text-to-video generation via multimodal planning and structured noise initialization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.192758Z"},"links":{"cited_paper":"/paper/2504.08641","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:1c8b13c7055e7d6b1b2efea0f06540c3a0aafd8b93fbd8d57053308a0efd3529","observation_id":"6720005f-9818-41c1-a6a0-76b3308019ba","resolution":{"observed_at":"2026-08-07T11:54:18.192758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17414","last_updated":"2025-04-24T10:12:40Z","snapshot_observed_at":"2026-08-07T15:59:34.814750Z","submitted_at":"2025-04-24T10:12:40Z","title":"3DV-TON: Textured 3D-Guided Consistent Video Try-on via Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17414","snapshot_observed_at":"2026-08-07T11:54:18.253635Z","title":"3dv-ton: Textured 3d-guided consistent video try-on via diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.253635Z"},"links":{"cited_paper":"/paper/2504.17414","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:66b89898c9f771cf08819e9707ddf28d4c501e717530dec56c954fa6a902a132","observation_id":"e80b3d91-0dd4-422e-a3b3-219f86f177be","resolution":{"observed_at":"2026-08-07T11:54:18.253635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:18.329926Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.329926Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:3a65101c42e6138fb8084e5400d02229c2ec0526811157de18b217a50d8cdf6f","observation_id":"72295fd9-144c-45a8-a96a-29bf918a5168","resolution":{"observed_at":"2026-08-07T11:54:18.329926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:21.113609Z","title":"Boosting text-to-video generative model with mllms feedback","venue":null,"work_id":"a4889a4a-2864-4319-bd26-3d16d34bd11b","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.461604Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:a2438a59e42ea604a60b4f47d066bcabac952a64676d69f64970cc0e01617421","observation_id":"dc7d759c-2fea-46b3-825c-bc1228b823dc","resolution":{"observed_at":"2026-08-07T11:54:21.164469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-10T00:51:42.114461Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-07T11:54:18.599038Z","title":"Latent video diffusion models for high-fidelity long video generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.599038Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:e4ea50011dde155da3403faebda460696135e970ec3815a90ac22c2387febd98","observation_id":"65f06f51-70c2-4fe5-8ead-59156da97739","resolution":{"observed_at":"2026-08-07T11:54:18.599038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02399","last_updated":"2022-10-05T17:18:28Z","snapshot_observed_at":"2026-08-04T09:09:48.463217Z","submitted_at":"2022-10-05T17:18:28Z","title":"Phenaki: Variable Length Video Generation From Open Domain Textual Description","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02399","snapshot_observed_at":"2026-08-07T11:54:18.735580Z","title":"Phenaki: Variable length video generation from open domain textual description","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.735580Z"},"links":{"cited_paper":"/paper/2210.02399","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:8e52dc597adc42ec3bc53b6609b51e926309126f33c49de631945b76947bb278","observation_id":"9bc833d1-adcb-40ad-a2f6-5f4b84af3815","resolution":{"observed_at":"2026-08-07T11:54:18.735580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18264","last_updated":"2023-05-29T17:38:18Z","snapshot_observed_at":"2026-08-09T05:07:43.219616Z","submitted_at":"2023-05-29T17:38:18Z","title":"Gen-L-Video: Multi-Text to Long Video Generation via Temporal Co-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18264","snapshot_observed_at":"2026-08-07T11:54:18.828455Z","title":"Gen-l-video: Multi-text to long video generation via temporal co-denoising","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.828455Z"},"links":{"cited_paper":"/paper/2305.18264","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:b8121c1ab4b49baebc8bc592d3a50e2a37a856e2e02c6937acd13d44d2db873f","observation_id":"3b43765b-a46a-4d6e-9428-248c8e95320e","resolution":{"observed_at":"2026-08-07T11:54:18.828455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15169","last_updated":"2024-01-30T16:44:20Z","snapshot_observed_at":"2026-08-03T19:40:46.693368Z","submitted_at":"2023-10-23T17:59:58Z","title":"FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15169","snapshot_observed_at":"2026-08-07T11:54:18.995420Z","title":"FreeNoise: Tuning-free longer video diffusion via noise rescheduling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:18.995420Z"},"links":{"cited_paper":"/paper/2310.15169","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:bee690014e202425a59c801c42c13b5d995794b418cd1aed464d7a7e195be667","observation_id":"b5a41aca-9d57-44c5-8104-fdc003789d06","resolution":{"observed_at":"2026-08-07T11:54:18.995420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07537","last_updated":"2024-07-25T09:10:52Z","snapshot_observed_at":"2026-08-09T00:18:44.871745Z","submitted_at":"2023-12-12T18:59:16Z","title":"FreeInit: Bridging Initialization Gap in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07537","snapshot_observed_at":"2026-08-07T11:54:19.101085Z","title":"Freeinit: Bridging initialization gap in video diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.101085Z"},"links":{"cited_paper":"/paper/2312.07537","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:44d3132fe6e4b2bd384916cd35e9fef8861cb95063b1e9d9f6cd76e9416edefd","observation_id":"876626fd-8d04-4c27-9de5-738d8bbe83de","resolution":{"observed_at":"2026-08-07T11:54:19.101085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04364","last_updated":"2024-12-08T18:01:25Z","snapshot_observed_at":"2026-07-06T19:28:30.731752Z","submitted_at":"2024-10-06T05:46:17Z","title":"VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide","version":3},"cited_work":{"arxiv_id":"2410.04364","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04364","snapshot_observed_at":"2026-08-07T11:54:20.270545Z","title":"VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide","venue":"cs.CV","work_id":"a2770cd5-f683-4ebd-90b6-7c62ba1db2f9","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.234083Z"},"links":{"cited_paper":"/paper/2410.04364","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:862714805631a432f96fe5c34b2f3569820fcc8edcadc999c504bba5b8dbc8a7","observation_id":"07a5c2ac-08b3-453f-a11f-136be8bc5f68","resolution":{"observed_at":"2026-08-07T11:54:20.315867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-07T11:54:19.341546Z","title":"AnimateD- iff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.341546Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:61e3f8b09cdfe14e015aad89b585a60bf61fa6109b76e64322877a5412092f4c","observation_id":"2ea746f8-453d-441a-867c-01d062ee81f9","resolution":{"observed_at":"2026-08-07T11:54:19.341546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:20.983547Z","title":"FLUX, 2024","venue":null,"work_id":"f21b73a2-1319-4930-a9b0-30d8fc0045f4","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.498956Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:d7fe58ac9745a52393e98ad88320f333f79b1e76eb028e3184500f8e85d4f4ae","observation_id":"3e686fc9-2ca5-4e0a-90fc-b7199a262d38","resolution":{"observed_at":"2026-08-07T11:54:21.039465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:20.823056Z","title":"Sampson, Shikai Li, Simone Parmeggiani, Steve Fine, Tara Fowler, Vladan Petrovic, and Yuming Du","venue":null,"work_id":"033900d0-b0e6-4eef-9574-9e4464855213","year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.616036Z"},"links":{"citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:80d8bae95469e8168aece11503c8c6d23fca1c2aa28bec642d115d37d711900b","observation_id":"046f19d7-c6ce-4d65-8be3-efe75632e3c3","resolution":{"observed_at":"2026-08-07T11:54:20.918700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T11:54:19.711389Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.711389Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:5e1c1184c5fd0415bdcfd3dcba910d786cc1de20944e853c58ae80b3f570488b","observation_id":"fa7058c4-df51-466b-be7b-61e43022fcbe","resolution":{"observed_at":"2026-08-07T11:54:19.711389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11775","last_updated":"2025-01-27T06:25:11Z","snapshot_observed_at":"2026-08-07T07:54:21.393889Z","submitted_at":"2024-06-17T17:32:42Z","title":"Task Me Anything","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11775","snapshot_observed_at":"2026-08-07T11:54:19.818821Z","title":"Task me anything","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.818821Z"},"links":{"cited_paper":"/paper/2406.11775","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:54f427fbbb8c6c9140aa7a29e3d08dada9cf491642aeead90d732f06fb931a73","observation_id":"d4181f97-fd03-46a5-91c9-578fda78c8b5","resolution":{"observed_at":"2026-08-07T11:54:19.818821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04324","last_updated":"2024-07-01T03:57:55Z","snapshot_observed_at":"2026-08-04T02:26:31.748049Z","submitted_at":"2024-02-06T19:08:18Z","title":"ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04324","snapshot_observed_at":"2026-08-07T11:54:19.929505Z","title":"Consisti2v: Enhancing visual consistency for image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.929505Z"},"links":{"cited_paper":"/paper/2402.04324","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:c3a034efe8e769b87a739600c1240f988dbfa0dda9f147ac113ca2c6273ba8bf","observation_id":"beb7080d-8567-44d0-9290-5c3ebd28c418","resolution":{"observed_at":"2026-08-07T11:54:19.929505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15275","last_updated":"2024-06-25T16:57:27Z","snapshot_observed_at":"2026-07-06T18:04:33.726854Z","submitted_at":"2024-04-23T17:59:43Z","title":"ID-Animator: Zero-Shot Identity-Preserving Human Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15275","snapshot_observed_at":"2026-08-07T11:54:19.998936Z","title":"Id- animator: Zero-shot identity-preserving human video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:19.998936Z"},"links":{"cited_paper":"/paper/2404.15275","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:6dd9f0b7ffba183228c62b174884e796a318217cd2ac29376ef70bc4843c52d9","observation_id":"05324431-2995-46dd-bffe-ac91db57e4b7","resolution":{"observed_at":"2026-08-07T11:54:19.998936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-05T07:44:02.175955Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T11:54:20.099641Z","title":"Young Adult Male Doing Handstand on the beach","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:20.099641Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:02e5969e2abab794f5c9455b53c05161da735ce6e9022008529dc5999079923f","observation_id":"35d18506-4223-4ae8-bf53-66c4e275635a","resolution":{"observed_at":"2026-08-07T11:54:20.099641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T14:05:40.824663Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 4 inbound Pith citation observations for arXiv:2506.01144."}