{"as_of":"2026-08-10T13:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b056458eefe494fb1e9306a7f8e171913613c412bcafa8772119dfefde81f272","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:57:02.637395Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23134/citation-record","integrity":"/paper/2505.23134/integrity","json":"/paper/2505.23134/citation-record.json","paper":"/paper/2505.23134"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.192918Z","title":"Self-rectifying diffusion sampling with perturbed-attention guidance","venue":null,"work_id":"e665b0c3-44c1-4cbc-9468-9871de86e909","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.237908Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:f87c2e91285e801298f521db83c35dbde2010840f607489ba0daeee30da121a6","observation_id":"74ac104b-71e7-4c0a-b966-b0a01bd697fb","resolution":{"observed_at":"2026-08-07T12:57:03.196147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.183083Z","title":"Cross-image attention for zero-shot appearance transfer","venue":null,"work_id":"cf57d662-6576-4bd4-bff0-91003197dddd","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.349817Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:74a3225e752a8545e284fec778ba98a88bcb2090f9ad53b853ad543669b7a517","observation_id":"9a0c58ef-da45-4708-a9e0-c0085dc54ab0","resolution":{"observed_at":"2026-08-07T12:57:03.186990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.174383Z","title":null,"venue":null,"work_id":"3c8757a4-f696-4430-97e2-8ae288c24538","year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.457782Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:9242261468014b095fb529c16b4a5fafbbaa3eba18246e59bd3212970cdb46bd","observation_id":"23c7276f-0233-4326-ae4c-c653736092b4","resolution":{"observed_at":"2026-08-07T12:57:03.177649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T12:57:00.561585Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.561585Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:2ecd90d891f9d5df0dff6c78922b56a66d6b6709c444dac8838e5c63a0072d8a","observation_id":"ea03f960-50ba-41dd-9578-e88f573b1475","resolution":{"observed_at":"2026-08-07T12:57:00.561585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-07T12:57:00.670109Z","title":"Pixart- alpha: Fast training of diffusion transformer for pho- torealistic text-to-image synthesis.arXiv preprint arXiv:2310.00426, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.670109Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:03f588fee6011c8a5142c81bff07bc95046c41e1a45a8ffa21500ddcd260be01","observation_id":"cf4449c8-732a-4920-9914-fa4a736cf5ec","resolution":{"observed_at":"2026-08-07T12:57:00.670109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.163734Z","title":"Style injection in diffusion: A training-free approach for adapting large-scale diffusion models for style trans- fer","venue":null,"work_id":"44bf31eb-7cfc-4fe6-af9d-a611605fc661","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.773634Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:74c12cbea1f108b380b6d62b9b609687f48ee2bcd0b4cb5234996dc3c47569f2","observation_id":"636b417b-3f67-4221-b902-dcde4bb4e63e","resolution":{"observed_at":"2026-08-07T12:57:03.167833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05922","last_updated":"2024-02-29T21:06:58Z","snapshot_observed_at":"2026-08-10T03:14:56.876279Z","submitted_at":"2023-10-09T17:59:53Z","title":"FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05922","snapshot_observed_at":"2026-08-07T12:57:00.882278Z","title":"Flat- ten: optical flow-guided attention for consistent text- to-video editing.arXiv preprint arXiv:2310.05922,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:00.882278Z"},"links":{"cited_paper":"/paper/2310.05922","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:02c306069d1f784e5204b8c76f577c439cf3a314a18f8ec8dbdf84db1a20b91b","observation_id":"b5431def-66e2-43f6-9845-5681a5ce0f43","resolution":{"observed_at":"2026-08-07T12:57:00.882278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.154889Z","title":"Diffusion self-guidance for controllable image generation.Advances in Neu- ral Information Processing Systems, 36:16222–16239,","venue":null,"work_id":"b77a25d4-642f-4629-b336-4dccf4aefdb5","year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.027585Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:2fc625320b9b8915ec79b2335c036d039558e2bee9c5ee22a92c2455ee1b1208","observation_id":"fb848470-fa14-422c-a3e7-957f34f6af66","resolution":{"observed_at":"2026-08-07T12:57:03.158206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.146091Z","title":"Ccedit: Creative and controllable video editing via diffusion models","venue":null,"work_id":"e6f95e3f-2885-4071-a91b-508a91570c90","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.039473Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:206c1bb0ea8c448df32a86ed73d4a012a71e1b88303348cd3eeed436fc2ea8c6","observation_id":"4a1195fa-b86a-4286-8156-5f00cb6ddb99","resolution":{"observed_at":"2026-08-07T12:57:03.149397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-06T08:12:35.134201Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-08-07T12:57:01.047081Z","title":"Tokenflow: Consistent diffusion fea- tures for consistent video editing.arXiv preprint arXiv:2307.10373, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.047081Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:befb8f257e94bf829b21e4503d3535dc0c2310bde73dd7ac41ece1f6597f76d2","observation_id":"c7dec3b0-a135-47c6-94ea-d84839c5a38a","resolution":{"observed_at":"2026-08-07T12:57:01.047081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T12:57:01.070384Z","title":"Prompt- to-prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.070384Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7d7fa9899c35a6cccf6c227f8902dcbc9c8bfa2bff4153c21c138849f095233e","observation_id":"010d8e28-9741-4f51-b562-b4f529fc68b5","resolution":{"observed_at":"2026-08-07T12:57:01.070384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.137062Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"34f204e3-3cd4-493a-9d00-f0b08f80a144","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.145825Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:e801c287c9afe6548ca24ccf7cc39c84e30e9ad71a36a62a339ff836e8fd28f4","observation_id":"f1b6f616-88d9-4537-8ac9-54823eb7026c","resolution":{"observed_at":"2026-08-07T12:57:03.140320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.127987Z","title":"Rave: Ran- domized noise shuffling for fast and consistent video editing with diffusion models","venue":null,"work_id":"59c352c6-7ca2-43d0-a082-686c17852ce6","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.190370Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:83925d5018224da87f62fbc0611d8cdffc3195c7ed68995d1ed98e90319ba785","observation_id":"d4150044-3ec4-4a98-bc26-da28a5d4a18a","resolution":{"observed_at":"2026-08-07T12:57:03.131285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.117949Z","title":"Gaussian deblur controlnet","venue":null,"work_id":"e35ed397-449f-46a7-ad08-c2afca3e5c3d","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.232429Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:0c5d8de44fb0c30ce62b311cb7f7ed454e2a3fac295f0013c7c5888786667ef1","observation_id":"e4d695ae-4ed8-4842-b327-9c6b90af8727","resolution":{"observed_at":"2026-08-07T12:57:03.122023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-07T12:57:01.251723Z","title":"Anyv2v: A plug-and-play framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.251723Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:34f214547542515f94c3697b0a7a8d7edf2d2de5a5f208529bad60b068cef33c","observation_id":"bee24ced-75ec-4af9-b400-2dd06854b47a","resolution":{"observed_at":"2026-08-07T12:57:01.251723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12027","last_updated":"2025-04-17T01:49:31Z","snapshot_observed_at":"2026-08-07T16:01:49.396890Z","submitted_at":"2025-04-16T12:37:08Z","title":"Understanding Attention Mechanism in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12027","snapshot_observed_at":"2026-08-07T12:57:01.325386Z","title":"Under- standing attention mechanism in video diffusion mod- els.arXiv preprint arXiv:2504.12027, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.325386Z"},"links":{"cited_paper":"/paper/2504.12027","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:9d030eb20b5e7301cc4f07b0b39e637c121c13a92007006eb62c5cd248008f49","observation_id":"9b77efe5-856d-4308-be80-e0fd4af3d99b","resolution":{"observed_at":"2026-08-07T12:57:01.325386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:01.377565Z","title":"Stablev2v: Stablizing shape con- sistency in video-to-video editing.arXiv preprint arXiv:2411.11045, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.377565Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7fa297df3b236717e1a65d34db3245649afbb991a9118a827b8bcc2e2f037737","observation_id":"8b17eb46-747d-42c4-8711-422cd15107af","resolution":{"observed_at":"2026-08-07T12:57:01.377565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.107763Z","title":"Colorization controlnet","venue":null,"work_id":"7a0a988e-8894-40d3-90d2-645a0bbb9260","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.423309Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:389ccb40525a739383d2c6797e90ef0acae3bfcbccbbff31e997df43b471de32","observation_id":"df592e8e-1cef-48c5-94aa-8e22ab8135ee","resolution":{"observed_at":"2026-08-07T12:57:03.111364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.098412Z","title":"Tile controlnet","venue":null,"work_id":"cfe60854-3cd1-4bf0-a810-b78ddbb354a7","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.495380Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:065c7afe5a9a3320c4d736e2cd52d207f64139d40fcb6db11d8d395c0faa6739","observation_id":"2098706c-3b16-43b5-9ad5-f7682224d08d","resolution":{"observed_at":"2026-08-07T12:57:03.101548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.087671Z","title":"Diffusion hyperfea- tures: Searching through time and space for seman- tic correspondence.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"00556cb5-c802-47d0-842a-ca56ddf2fa9f","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.537533Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:9413efeef97b95653cfae4bd2468ca53ef22d2e159bb58908d33e9c3e8aea777","observation_id":"594415c9-8425-4e48-90d3-6c46a5e5e5a1","resolution":{"observed_at":"2026-08-07T12:57:03.091339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02421","last_updated":"2023-11-20T09:08:42Z","snapshot_observed_at":"2026-08-10T05:07:55.739066Z","submitted_at":"2023-07-05T16:43:56Z","title":"DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02421","snapshot_observed_at":"2026-08-07T12:57:01.594590Z","title":"Dragondiffusion: Enabling drag- style manipulation on diffusion models.arXiv preprint arXiv:2307.02421, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.594590Z"},"links":{"cited_paper":"/paper/2307.02421","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:b8bd3dde3a5b9ae45b722f27656331392fe8c953758bb65b0e6f24d2817c2024","observation_id":"ad534818-bee5-4b00-947d-75754ee73c5c","resolution":{"observed_at":"2026-08-07T12:57:01.594590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.078447Z","title":"Diffeditor: Boosting accuracy and flexibility on diffusion-based image editing","venue":null,"work_id":"a65e0484-d232-45c4-8d8a-c00456025ad3","year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.662819Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:feb16cfc5f882b00382aa4c9b6f38517a57d696a44f1df28818ea4085259ac6f","observation_id":"beb40a44-331d-4862-9f09-b0d242333ee7","resolution":{"observed_at":"2026-08-07T12:57:03.081787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.068845Z","title":"T2i- adapter: Learning adapters to dig out more control- lable ability for text-to-image diffusion models","venue":null,"work_id":"a49ed488-6f75-48d4-9e96-9e6530212dfe","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.720452Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:92e14e573a773beb664e37209fb82664ea06a2722c2dc999b23e01c4125ef3e9","observation_id":"15a3632a-111e-4246-9f61-da35d5089e0a","resolution":{"observed_at":"2026-08-07T12:57:03.072728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.059516Z","title":"I2vedit: First-frame-guided video edit- ing via image-to-video diffusion models","venue":null,"work_id":"b52608ae-cde1-408c-9c65-07f809a33807","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.773911Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:fccd9b3f13a38ec6af28fcfa7d6620d016d11473c1400df4b74d6fddd313a25d","observation_id":"6819682b-d97b-43b4-bce8-af587d306ea2","resolution":{"observed_at":"2026-08-07T12:57:03.063078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.050455Z","title":"Swapping autoencoder for deep image manipulation","venue":null,"work_id":"13c55e71-5234-4d2b-9d0d-e2bbee9d7d22","year":2020},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.823625Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:353fa731c8638129f41ed2f65f626b4e40384fca05a161ce0d6580ec67dccac5","observation_id":"ec5b5a97-523a-4689-bf28-2c682435d91f","resolution":{"observed_at":"2026-08-07T12:57:03.053884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:01.867837Z","title":"Scalable diffu- sion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.867837Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:4c90e8a48946e990c2a342e7b4606b92300e645223f45a37d932abc20d80503f","observation_id":"5c8e1989-b0f3-4e0b-acd4-5bb0786c2e6c","resolution":{"observed_at":"2026-08-07T12:57:01.867837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.035427Z","title":"Fatezero: Fusing attentions for zero-shot text-based video editing","venue":null,"work_id":"46f0bda7-6df3-4e66-97aa-70f287669196","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.927362Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:873f1fa9802f554a51cecfc3a848f3bde2a083aca646c7c3ceb3e6e755973702","observation_id":"7c9f5e9e-953d-4690-9dc5-8f470d0d5d9a","resolution":{"observed_at":"2026-08-07T12:57:03.038920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11147","last_updated":"2023-11-02T17:59:06Z","snapshot_observed_at":"2026-08-06T14:12:33.767391Z","submitted_at":"2023-05-18T17:41:34Z","title":"UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11147","snapshot_observed_at":"2026-08-07T12:57:01.989913Z","title":"Unicontrol: A unified diffusion model for controllable visual gener- ation in the wild.arXiv preprint arXiv:2305.11147,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:01.989913Z"},"links":{"cited_paper":"/paper/2305.11147","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:fce115f12747c93f77046345270181e3ebd8f9e8ac664c14eeba8d12efe48267","observation_id":"d28e6ec6-73e9-487e-a04a-749b3892bbb4","resolution":{"observed_at":"2026-08-07T12:57:01.989913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.025335Z","title":"High- resolution image synthesis with latent diffusion mod- els","venue":null,"work_id":"8e35cc7f-ab13-4e4f-923e-3e51dfe257fc","year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.039980Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:6422be13563b99a80e90572afdca69f8513b48c0a20611697bbc4b2866897dda","observation_id":"ad0c5d5a-13e0-46d3-895e-07ee370763fb","resolution":{"observed_at":"2026-08-07T12:57:03.028875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T12:57:02.091475Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.091475Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:fcc073173e7eff720c94da81d43d05278bcc6aa3018fbf4019336ab7a4f12468","observation_id":"91a1c65c-a3dc-4ad4-9ec5-7c6609e344e3","resolution":{"observed_at":"2026-08-07T12:57:02.091475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15098","last_updated":"2025-07-07T17:33:23Z","snapshot_observed_at":"2026-08-09T00:44:58.573039Z","submitted_at":"2024-11-22T17:55:15Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15098","snapshot_observed_at":"2026-08-07T12:57:02.163714Z","title":"Ominicontrol: Minimal and universal control for diffusion transformer.arXiv preprint arXiv:2411.15098, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.163714Z"},"links":{"cited_paper":"/paper/2411.15098","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:77d63e88581cd05d361ad9ea7d81f5661e48f752c35534fdf3f81882e7173aaf","observation_id":"633f499d-9eff-49f8-b5c1-f14332d2fa7a","resolution":{"observed_at":"2026-08-07T12:57:02.163714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08280","last_updated":"2025-03-11T10:50:14Z","snapshot_observed_at":"2026-08-07T17:13:28.752920Z","submitted_at":"2025-03-11T10:50:14Z","title":"OminiControl2: Efficient Conditioning for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08280","snapshot_observed_at":"2026-08-07T12:57:02.237633Z","title":"Ominicontrol2: Effi- cient conditioning for diffusion transformers.arXiv preprint arXiv:2503.08280, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.237633Z"},"links":{"cited_paper":"/paper/2503.08280","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:c3549e379daaa8d0d34ceea9f9ca05441257d7601d1f4d33e91db8ca6667bc3f","observation_id":"76860890-9037-4535-9488-f9a4b67cb314","resolution":{"observed_at":"2026-08-07T12:57:02.237633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.013002Z","title":"Emergent correspondence from image diffusion.Advances in Neural Information Processing Systems, 36: 1363–1389, 2023","venue":null,"work_id":"3c8a895f-1d23-4d37-bb35-559746e86100","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.304265Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:b995d3550360d607c215dbddd5cea042d29b773f40299e5011e1c6c16d391c22","observation_id":"4a65ed62-e686-4541-858f-7b06f9ed0436","resolution":{"observed_at":"2026-08-07T12:57:03.017499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:03.002773Z","title":"Training- free consistent text-to-image generation.ACM Trans- actions on Graphics (TOG), 43(4):1–18, 2024","venue":null,"work_id":"968c373f-8c2e-48d7-8a7e-2f6d88bb709c","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.360228Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:e77dbc792136f3e07ac725e6b829949f6a5fc94a8f08787bffcc3d07c59e074d","observation_id":"8e1ca918-f75c-4135-9f64-b961777e7a52","resolution":{"observed_at":"2026-08-07T12:57:03.006437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.991840Z","title":"Splicing vit features for semantic appearance transfer","venue":null,"work_id":"c5b133bb-9a0d-444f-a049-eb5b705f284c","year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.429182Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:6aaecc23dfa6dc962ccf111816fe9b414beee6c28612fe2e2a522e06c93ecc4b","observation_id":"15f7a85b-10d8-4bc6-8d25-7ef6135d05a5","resolution":{"observed_at":"2026-08-07T12:57:02.995312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.980530Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"e7b80c2e-5c30-4c4b-a881-dce6671e2f5d","year":1921},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.478612Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:63f963b644e5715565167f9b29494b0dea9823ce808d4c500215c86b70c922c8","observation_id":"2d45417f-156f-4f46-9a31-214b393d16ef","resolution":{"observed_at":"2026-08-07T12:57:02.984096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08850","last_updated":"2024-12-08T10:17:43Z","snapshot_observed_at":"2026-07-06T18:30:06.570612Z","submitted_at":"2024-06-13T06:27:13Z","title":"COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08850","snapshot_observed_at":"2026-08-07T12:57:02.523020Z","title":"Cove: Unleashing the diffu- sion feature correspondence for consistent video edit- ing.arXiv preprint arXiv:2406.08850, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.523020Z"},"links":{"cited_paper":"/paper/2406.08850","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:5a9d705c8960500f6c98a252fdc231622ac60c0c4d44fb8a65ff73d4e0608ec5","observation_id":"79ec2916-65ad-41cb-8d74-c0339fa503a8","resolution":{"observed_at":"2026-08-07T12:57:02.523020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.970243Z","title":"Gmflow: Learning op- tical flow via global matching","venue":null,"work_id":"d9ef1dc5-ed7f-46b9-be88-3bb777f3da22","year":2022},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.574739Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:d5f6f3c0b1927b59d0d74a1bd6c1e2e7a498df9335708554999190fa48c385d5","observation_id":"365f647f-6a54-4c49-96f2-f0d04a6b9f4f","resolution":{"observed_at":"2026-08-07T12:57:02.974002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14201","last_updated":"2024-05-27T03:14:02Z","snapshot_observed_at":"2026-08-10T11:02:46.380251Z","submitted_at":"2024-05-23T06:01:13Z","title":"FreeTuner: Any Subject in Any Style with Training-free Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14201","snapshot_observed_at":"2026-08-07T12:57:02.582930Z","title":"Freetuner: Any subject in any style with training-free diffusion.arXiv preprint arXiv:2405.14201, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.582930Z"},"links":{"cited_paper":"/paper/2405.14201","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:1d6ab063816517a9bef3bd5c133139fad52ae25104589c37e066aac139aad2aa","observation_id":"52df8723-1e36-42d8-b5fe-8e9c63dad5a7","resolution":{"observed_at":"2026-08-07T12:57:02.582930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.958870Z","title":"Rerender a video: Zero-shot text-guided video- to-video translation","venue":null,"work_id":"0c11c8c8-8e32-4425-b7ad-bdf358cdc987","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.593931Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:3fb24acf606de25a8f735474049516b15d7d5a0d5c78cb52cf571ba3dde6668a","observation_id":"c56525f2-0f73-4546-8abe-1b6a8af376a4","resolution":{"observed_at":"2026-08-07T12:57:02.963085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.945923Z","title":"Fresco: Spatial-temporal correspondence for zero-shot video translation","venue":null,"work_id":"3a25ce59-2958-4502-97f4-3fb59697cf7a","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.600511Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:e07b939d49b025221ac3722518a8786489241728d6cab3642012727e62d59187","observation_id":"3bbe7f5b-b53f-415e-b62d-59f0e318193f","resolution":{"observed_at":"2026-08-07T12:57:02.950016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.935164Z","title":"Colormnet: A memory-based deep spatial- temporal feature propagation network for video col- orization","venue":null,"work_id":"62e0c79e-bba5-49d4-ac4f-a346f76b9378","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.608119Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:7610f44fbac42b9eb7cb71f607f36292c32a999fc6ed9da1b8791bbc71dab5b4","observation_id":"ca16efb0-d261-48f2-a679-13d94bf04a6a","resolution":{"observed_at":"2026-08-07T12:57:02.939208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.924887Z","title":"Bistnet: Seman- tic image prior guided bidirectional temporal feature fusion for deep exemplar-based video colorization","venue":null,"work_id":"9017c2f4-bc96-4e3e-a58b-e6e674906040","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.614062Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:168f268d417afc285422254c54d2dfa87975b2f5beacb436894d223afff00501","observation_id":"40c803a8-2bb0-4950-9748-53bf367d69ec","resolution":{"observed_at":"2026-08-07T12:57:02.928367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.913569Z","title":"A tale of two features: Stable dif- fusion complements dino for zero-shot semantic cor- respondence.Advances in Neural Information Pro- cessing Systems, 36, 2024","venue":null,"work_id":"29128e29-080a-4de0-a70b-9d9b21d55536","year":2024},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.621810Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:e4c0dbae46383f17d4dfa26a5232565cd6de8e105aff4f9935d1d0193c4a7fe7","observation_id":"a953d2d6-a5ea-4492-bcfa-093d6a139f2b","resolution":{"observed_at":"2026-08-07T12:57:02.917302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:02.900429Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"98ae0de6-daa4-4f4e-aa4d-c5ef5f82f794","year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.630597Z"},"links":{"citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:30e2cdeb2d86540a37496401ab9203d942dc14aad797e6bcff44044ad7acbe61","observation_id":"91d72e78-bb16-4ff4-bbe4-7b2999733b83","resolution":{"observed_at":"2026-08-07T12:57:02.906215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-07T12:57:02.633813Z","title":"I2vgen-xl: High-quality image-to-video synthesis via cascaded diffusion mod- els.arXiv preprint arXiv:2311.04145, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.633813Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:22c1b2578cc5b2484422a4e88086ca3bbea7ff0bea593520f70cf5dc39d5cf4d","observation_id":"6836c1fe-5e1f-40c9-a6ad-51277fe85d0e","resolution":{"observed_at":"2026-08-07T12:57:02.633813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07027","last_updated":"2025-03-10T08:07:17Z","snapshot_observed_at":"2026-08-07T17:17:43.519906Z","submitted_at":"2025-03-10T08:07:17Z","title":"EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07027","snapshot_observed_at":"2026-08-07T12:57:02.637395Z","title":"Easycontrol: Adding efficient and flexible control for diffusion transformer.arXiv preprint arXiv:2503.07027, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:02.637395Z"},"links":{"cited_paper":"/paper/2503.07027","citing_paper":"/paper/2505.23134"},"observation_digest":"sha256:4fe33eb67bd4c6b4e992919f2b4feeebb52155f0e1874896cb0a456e83f86150","observation_id":"20e35e7d-f2ab-40a0-aea6-8dd9c21077ad","resolution":{"observed_at":"2026-08-07T12:57:02.637395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23134","last_updated":"2025-05-29T06:10:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T04:50:57.659083Z","submitted_at":"2025-05-29T06:10:16Z","title":"Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2505.23134."}