{"as_of":"2026-08-09T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c43ddeb64c37bae3a109cfca49784a146336125f69b7063c4e0a1cdadb02158","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T10:09:43.630659Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.08189/citation-record","integrity":"/paper/2502.08189/integrity","json":"/paper/2502.08189/citation-record.json","paper":"/paper/2502.08189"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-08T10:09:43.482236Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.482236Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:66124a060c3ba4824915e5fa9cf643d21e9ea4b33770924d2af6a56af11c0c4d","observation_id":"65d73464-1433-4e39-99fe-f61888f0d75a","resolution":{"observed_at":"2026-08-08T10:09:43.482236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.363964Z","title":"Video diffusion models","venue":null,"work_id":"f713f99e-c752-4b87-abce-e108d04600f5","year":2022},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.485651Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:dc34288debc9e84ea194e685453702618568123c4a1ec77264aad5311266db0d","observation_id":"78d39772-171d-4e31-b79e-e5ac5b97e0f7","resolution":{"observed_at":"2026-08-08T10:09:44.367018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-08T10:09:43.488125Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.488125Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:6ef865bcf33b6b4fc16d00d139de9d35248f9b621498e9a7cf0a3e8588f90ddf","observation_id":"07a95b9f-2f2a-4da2-b39d-239f79cb0ab4","resolution":{"observed_at":"2026-08-08T10:09:43.488125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:43.490871Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.490871Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:a9742d32d6b993257c8d1e6144f24533879931d344580659b9ef6c5cbcfe14e9","observation_id":"a5ab6475-7c12-4147-9bac-f001fe5b24c4","resolution":{"observed_at":"2026-08-08T10:09:43.490871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-08T10:09:43.493386Z","title":"I2vgen-xl: High-quality image-to-video synthesis via cascaded diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.493386Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:58c973ec528146a703af233cc2a8b9549e0051d4b6a5cb82dfe3ddff733c627a","observation_id":"76f408e3-95d5-4e37-93a6-cbf0f9df831e","resolution":{"observed_at":"2026-08-08T10:09:43.493386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:43.496026Z","title":"Customvideo: Customizing text-to-video generation with multiple subjects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.496026Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:68ac625f4008d3e1d0a535ae33258e5fc948b35a8bc0546fd4c75820455b1b60","observation_id":"b3e48d09-cc0c-41b1-999f-73260c4e54d7","resolution":{"observed_at":"2026-08-08T10:09:43.496026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17758","last_updated":"2024-10-29T11:56:27Z","snapshot_observed_at":"2026-07-06T18:36:51.761148Z","submitted_at":"2024-06-25T17:42:25Z","title":"MotionBooth: Motion-Aware Customized Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17758","snapshot_observed_at":"2026-08-08T10:09:43.498982Z","title":"Motionbooth: Motion-aware customized text-to-video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.498982Z"},"links":{"cited_paper":"/paper/2406.17758","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:75cd2d5314b361835cafb7deaaf08b22f1ebe26d055cb10d6a0c93f4d7cda68d","observation_id":"c785492b-bcdf-4d12-a3ec-55f18c3d6f3d","resolution":{"observed_at":"2026-08-08T10:09:43.498982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.350539Z","title":"Motiondirector: Motion customization of text-to-video diffusion models","venue":null,"work_id":"a45211ff-d333-402e-a4ed-4585f30c5bc6","year":2025},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.501822Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:f1a691f1488567569c3b0f275fb7ac3f6abcf359792390509de4cf275fd22bd0","observation_id":"b75c7cbe-ad8a-497d-8640-899999224a8f","resolution":{"observed_at":"2026-08-08T10:09:44.353026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.342856Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":"e771be19-50d9-4a19-9d6c-0b81090d9166","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.504534Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:92dd386d0e032c7e62e257559df4edcb4a8264e3d6192d10f88201dca2eb44b0","observation_id":"7ba19844-e325-41db-92e5-24df4d2e3f03","resolution":{"observed_at":"2026-08-08T10:09:44.345454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.335031Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model","venue":null,"work_id":"4a338a81-ce0c-4d33-bcda-e7bf18190f25","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.507079Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:73cd8b90af51672f45e8d6cc5023afa32c0a153f83e8aeecf54b308f904de5a7","observation_id":"3f468885-2d00-440a-9099-744d984e37b4","resolution":{"observed_at":"2026-08-08T10:09:44.337827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19680","last_updated":"2025-06-27T10:06:13Z","snapshot_observed_at":"2026-08-09T19:19:40.842650Z","submitted_at":"2024-06-28T06:40:53Z","title":"MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19680","snapshot_observed_at":"2026-08-08T10:09:43.509803Z","title":"Mimicmotion: High-quality human motion video generation with confidence-aware pose guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.509803Z"},"links":{"cited_paper":"/paper/2406.19680","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:23ce80f5590a788ecc78ecb360e99598c4811a5c6346d128334902d0a072eb3c","observation_id":"45a2857e-4898-47f9-bf0f-431cd9abc91d","resolution":{"observed_at":"2026-08-08T10:09:43.509803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.327053Z","title":"Champ: Controllable and consistent human image animation with 3d parametric guidance","venue":null,"work_id":"de663d0e-6c19-40c9-8d70-dc8515e04232","year":2025},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.513363Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:39cc1d184f01abc22ffddbe2dad27320e99a47c5aee16ac1a03141b8b355955e","observation_id":"31fc94d6-71dd-470b-b8e9-e45fbcc691e1","resolution":{"observed_at":"2026-08-08T10:09:44.330005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.319324Z","title":"Make-your-video: Customized video generation using textual and structural guidance","venue":null,"work_id":"b03ee1b1-6e81-42d5-bf05-6a136cd5d3d7","year":null},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.515818Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:9768d988099e03147d990326d288e08246bae4962b53fc75f2dc913152d0064e","observation_id":"2739d20f-9d36-4919-aa1e-677e62e2673a","resolution":{"observed_at":"2026-08-08T10:09:44.321993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16160","last_updated":"2025-06-11T08:28:01Z","snapshot_observed_at":"2026-08-07T23:57:27.127966Z","submitted_at":"2024-09-24T15:00:07Z","title":"MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16160","snapshot_observed_at":"2026-08-08T10:09:43.518250Z","title":"Mimo: Controllable character video synthesis with spatial decomposed modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.518250Z"},"links":{"cited_paper":"/paper/2409.16160","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:8e8dd671b0b467a81d32453779dd75d22df236ded79925a05161d148cabb8e3e","observation_id":"01c7f21a-72b9-458b-b26b-aba33e550184","resolution":{"observed_at":"2026-08-08T10:09:43.518250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.312551Z","title":"Viggle ai mix application","venue":null,"work_id":"ba12444c-2b2f-49c9-b5d3-b5ed678b7eb8","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.520944Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:92619b202b76d99a6830695d984443721aa46cc3fdbcc406b986976a19be685a","observation_id":"1c797ab3-8445-4fae-b560-39b6c034f8fe","resolution":{"observed_at":"2026-08-08T10:09:44.314811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08850","last_updated":"2024-02-19T02:42:27Z","snapshot_observed_at":"2026-08-09T01:39:22.906915Z","submitted_at":"2023-05-15T17:59:03Z","title":"Make-A-Protagonist: Generic Video Editing with An Ensemble of Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08850","snapshot_observed_at":"2026-08-08T10:09:43.523735Z","title":"Make-a-protagonist: Generic video editing with an ensemble of experts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.523735Z"},"links":{"cited_paper":"/paper/2305.08850","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:eaf2ad4845b20ea26e5fa4ad969634da562f81246e44386794f0d4d51f59c4d8","observation_id":"8aeb17a0-c554-41d3-99e3-de43e28e00aa","resolution":{"observed_at":"2026-08-08T10:09:43.523735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20974","last_updated":"2025-01-13T05:06:17Z","snapshot_observed_at":"2026-07-06T19:40:44.012201Z","submitted_at":"2024-10-28T12:46:05Z","title":"MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20974","snapshot_observed_at":"2026-08-08T10:09:43.526234Z","title":"Moviecharac- ter: A tuning-free framework for controllable character video synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.526234Z"},"links":{"cited_paper":"/paper/2410.20974","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:67c19ed2f6a4c1114a88acfaf6e3558e76f62dfbfe51914084ebd228f7d4c26c","observation_id":"02423db4-62ee-4840-afe7-a3fce33eb8c1","resolution":{"observed_at":"2026-08-08T10:09:43.526234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-08-08T10:09:43.529407Z","title":"Vace: All-in-one video creation and editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.529407Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:1ee3dc49850f6e81ef3f60773160c60dbc3667d1d486243f8ea561a9a966d680","observation_id":"4b0dcfc4-bce7-443a-924e-dc57f8dedfc2","resolution":{"observed_at":"2026-08-08T10:09:43.529407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.304591Z","title":"Stablevideo: Text-driven consistency-aware diffusion video editing","venue":null,"work_id":"5ce59f07-da4e-475b-bfbf-574d23f97173","year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.531772Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:f008af5dbd127b6cb4f2673df6a993f4a819993118699f56dcd2dd1535a56ec8","observation_id":"28a7fb88-7238-4ce3-8049-a6aecda5531a","resolution":{"observed_at":"2026-08-08T10:09:44.307743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-08T20:41:37.700266Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-08T10:09:43.533968Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.533968Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:14c4278b66f15b9fe811ec608dc360466df2f74d60957c4d630be598dec15157","observation_id":"0d711ce7-1dd0-4996-bb42-fb2b2a989cef","resolution":{"observed_at":"2026-08-08T10:09:43.533968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.296099Z","title":"Videocomposer: Compositional video synthesis with motion controllability","venue":null,"work_id":"98d5bf1a-c0df-42f4-98a3-22a636b79fcb","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.536571Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:51e53533b4dc752861fc7a86f75a03ea9b97f60ac0770580da0920eee7d72f80","observation_id":"8998f6b3-d74f-4ca4-8256-d72b856011e3","resolution":{"observed_at":"2026-08-08T10:09:44.299407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15275","last_updated":"2024-06-25T16:57:27Z","snapshot_observed_at":"2026-07-06T18:04:33.726854Z","submitted_at":"2024-04-23T17:59:43Z","title":"ID-Animator: Zero-Shot Identity-Preserving Human Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15275","snapshot_observed_at":"2026-08-08T10:09:43.538833Z","title":"Id- animator: Zero-shot identity-preserving human video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.538833Z"},"links":{"cited_paper":"/paper/2404.15275","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:55e7ef6a7c7795b48018d8ff718b1e1091a696b506dfa269758988a77e749e31","observation_id":"588128cc-da36-4b56-992b-4fbaf1df5763","resolution":{"observed_at":"2026-08-08T10:09:43.538833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.286716Z","title":"Dreamvideo: Composing your dream videos with customized subject and motion","venue":null,"work_id":"2c38f5df-2680-4674-848a-9820bc5e2d21","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.541372Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:c83adf16e25a4a7940ba57fd44b4ba30c181e38919e0e7a24bcd099613c139ea","observation_id":"133bb1ac-1285-406e-98ab-0ad747dfb0cd","resolution":{"observed_at":"2026-08-08T10:09:44.289508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.277795Z","title":"Direct-a-video: Customized video generation with user-directed camera movement and object motion","venue":null,"work_id":"2503661d-df41-4a7e-b408-bfd7b8b84e33","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.543601Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:97a3494ced069195b9cf2e2320ea5feb82b11cd0a080d2fe1f871b5f7f3af944","observation_id":"5c7a73b5-8a44-4216-b2b1-8a9e4daac606","resolution":{"observed_at":"2026-08-08T10:09:44.280754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.269624Z","title":"Skinned motion retargeting with residual perception of motion semantics & geometry","venue":null,"work_id":"63f34c39-0acd-4557-96ed-8fcec6626bef","year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.546413Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:2774b639431b46c1005ca499d7aff7464f7477dd46f3bc3ae98799f63fbc45b1","observation_id":"1d34182c-527d-4e0c-9e30-02d8d6c13e82","resolution":{"observed_at":"2026-08-08T10:09:44.272662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.262344Z","title":"Skinned motion retargeting with dense geometric interaction perception","venue":null,"work_id":"3639fab1-3864-4e30-a886-79370cb91bcd","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.549091Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:c169aea66a45f66b19f53016f7e5706f84b5565fc1f9d631f09085b2f3678719","observation_id":"8ac0de4d-1dd3-49cc-b77c-63d7038b41dc","resolution":{"observed_at":"2026-08-08T10:09:44.264680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04629","last_updated":"2024-06-07T04:29:22Z","snapshot_observed_at":"2026-07-06T18:26:54.963211Z","submitted_at":"2024-06-07T04:29:22Z","title":"STAR: Skeleton-aware Text-based 4D Avatar Generation with In-Network Motion Retargeting","version":1},"cited_work":{"arxiv_id":"2406.04629","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04629","snapshot_observed_at":"2026-08-08T10:09:43.783075Z","title":"STAR: Skeleton-aware Text-based 4D Avatar Generation with In-Network Motion Retargeting","venue":"cs.CV","work_id":"7cd4c04a-ad2a-49f9-9ede-ebd2cd5192d5","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.551566Z"},"links":{"cited_paper":"/paper/2406.04629","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:6529326b86f43a3bf37c095c6b8f5b8ed093228c49b7f9607bdcd0e86155509d","observation_id":"1644137c-46da-4416-a51c-df9bd7434c35","resolution":{"observed_at":"2026-08-08T10:09:43.787826Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.253793Z","title":"Semantics-aware motion retargeting with vision-language models","venue":null,"work_id":"9775db27-1498-46d4-862b-f65b41e89ab3","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.554336Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:b2228eadd3ea4e12d7a07ceea441ed146d51a0eab00275283d67407be83e373f","observation_id":"fe9624dd-cc4e-4219-b7ce-fb34c42f5030","resolution":{"observed_at":"2026-08-08T10:09:44.257059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:43.556780Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.556780Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:004a00b0b4c3e2a447a11d0b025bca3542250775bf1f16811a4b4c39d8ee4d0e","observation_id":"21cc8a2a-da6d-48b9-ba72-8a57630157db","resolution":{"observed_at":"2026-08-08T10:09:43.556780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-08T10:09:43.559090Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.559090Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:7f94791d25af7d69d5cd257db221bec308cf9f3de45e3009a38f77debafbc3f9","observation_id":"dcc93aff-2fd2-43ad-80b1-cb6f041a7cd8","resolution":{"observed_at":"2026-08-08T10:09:43.559090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.240477Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":"87972f24-617c-4943-a045-a1ee4225426b","year":2022},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.561676Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:65463da63b2151322d6f9df9cf6d5c0d6160b7fc8e648a130dd500ad77eb3322","observation_id":"04539f49-9b9e-48fd-95b5-77e9d656768c","resolution":{"observed_at":"2026-08-08T10:09:44.243244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-08T10:09:43.564261Z","title":"Sora: A review on background, technology, limitations, and opportunities of large vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.564261Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:427c282d061196b17dddbceb2b32db6f32aaa673a684ca200d927c50ad66e688","observation_id":"7f3e7c96-2c1e-4f4e-9f69-15df16f83d97","resolution":{"observed_at":"2026-08-08T10:09:43.564261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-08T10:09:43.566946Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.566946Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:5dec2e2244a5526a2d3b60cbf5b1e746f7530ecbe11193cfd3d9a7b1c250c52f","observation_id":"7e34eda2-a84e-4d83-8872-1d74b52ee52f","resolution":{"observed_at":"2026-08-08T10:09:43.566946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00115","last_updated":"2025-01-04T06:16:56Z","snapshot_observed_at":"2026-08-08T10:49:13.982249Z","submitted_at":"2024-11-28T07:01:06Z","title":"OpenHumanVid: A Large-Scale High-Quality Dataset for Enhancing Human-Centric Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00115","snapshot_observed_at":"2026-08-08T10:09:43.569608Z","title":"Openhumanvid: A large-scale high-quality dataset for enhancing human-centric video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.569608Z"},"links":{"cited_paper":"/paper/2412.00115","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:5b9c806982d345edfc8d7cd33c0174cd777e4c0a9e573c89ead777676ee7a627","observation_id":"db68b3fa-dfed-4032-83b7-dd7e690ec050","resolution":{"observed_at":"2026-08-08T10:09:43.569608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-08T10:09:43.571795Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.571795Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:7bfe11c1b602fe53359a1410a7185f7573a1fbc674d7ec8c98924f65998911b3","observation_id":"23f2f4b2-a399-4b37-a5cd-b670dd12257a","resolution":{"observed_at":"2026-08-08T10:09:43.571795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-08-09T05:07:43.521969Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-08-08T10:09:43.574143Z","title":"Vidu: a highly consistent, dynamic and skilled text-to-video generator with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.574143Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:84f7e76a0d870d664c7ece6c0d0f408d5503c19beaf58878a4033cc43f75c2a0","observation_id":"ff15710d-5d38-4a39-9939-51666f77cd8c","resolution":{"observed_at":"2026-08-08T10:09:43.574143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-07-06T18:59:34.520274Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-08T10:09:43.576749Z","title":"Controlnext: Powerful and efficient control for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.576749Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:4be52d3b870ccf806ab5d66d92f8d63aef020225060e6f1a72815cc7821949f8","observation_id":"c8143821-78a2-4aed-9ac4-329f936f0527","resolution":{"observed_at":"2026-08-08T10:09:43.576749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12052","last_updated":"2024-05-05T05:07:34Z","snapshot_observed_at":"2026-08-01T16:10:16.293275Z","submitted_at":"2023-11-18T10:22:44Z","title":"MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12052","snapshot_observed_at":"2026-08-08T10:09:43.579368Z","title":"Magicdance: Realistic human dance video generation with motions & facial expressions transfer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.579368Z"},"links":{"cited_paper":"/paper/2311.12052","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:5c0f182d72aeffda3df09f36c97c74c65d908af15aa1728691131836aa5665a7","observation_id":"6bc4adaf-b3fe-4fbc-9845-ae4377438903","resolution":{"observed_at":"2026-08-08T10:09:43.579368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.232806Z","title":"Magicpose: Realistic human poses and facial expressions retargeting with identity-aware diffusion","venue":null,"work_id":"503af792-186a-472c-a73c-82143d3b5be3","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.581845Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:a708838a028048b705fe2d018ce1296e1073b70c008d880aa11e1c90897deb91","observation_id":"173154f9-a629-48d6-a0a8-eb9e66d2a8a8","resolution":{"observed_at":"2026-08-08T10:09:44.235527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.224970Z","title":"Idol: Unified dual-modal latent diffusion for human-centric joint video-depth generation","venue":null,"work_id":"e0ee31a5-f074-490c-b4b6-12a093c480e3","year":null},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.584087Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:1df6fa7f306762da4b4f7dae28faeec7e808a9d385e76fd99324464eecae1c79","observation_id":"6657a011-2137-4787-8c4c-349f312a4a19","resolution":{"observed_at":"2026-08-08T10:09:44.227812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.217153Z","title":"Disco: Disentangled control for realistic human dance generation","venue":null,"work_id":"8b8cd0c3-d479-46cd-992a-b96c3c5081df","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.587292Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:d9f1876c1b57b0548b84bfb3d1be8bd06a8d2bb684170350ce7a2a393d562682","observation_id":"d2696979-b1eb-43df-9d78-f992e2670669","resolution":{"observed_at":"2026-08-08T10:09:44.219944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.209354Z","title":"Pct-net: Full resolution image harmonization using pixel-wise color transformations","venue":null,"work_id":"be578dea-7650-4688-8d17-cc0308410dc3","year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.589870Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:8fd6993f2108f44456c2c18c8742e2ccc3fdcd2ba62e1b1a3c3fa4884ab165e9","observation_id":"a56ffbdb-9473-4515-96d2-1fb0558ae77d","resolution":{"observed_at":"2026-08-08T10:09:44.211993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.200179Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":"7c3f09c1-d7a1-4479-8859-9543c24a080f","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.592299Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:3534c60a93411a8224e03abe6a390836c6200ca878cf70cd44804f7c3eddad05","observation_id":"ce5245aa-1c39-4d5c-a0c1-87f32efd8177","resolution":{"observed_at":"2026-08-08T10:09:44.203050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-08T10:09:43.594756Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.594756Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:4f405d639cc5b7127ac5983fab284028d5746bf1296046f394607ec4d09cb905","observation_id":"9379a311-7fbe-4196-aae6-b543035e6f56","resolution":{"observed_at":"2026-08-08T10:09:43.594756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.190398Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"b74f4e3e-ef47-48c8-92e7-8449e950dd81","year":null},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.597458Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:73ea2ba7c9cd394a61b94731c30deb7a110bb8ae172efe447238428f79e0c006","observation_id":"bff1f2d9-8820-43a0-a7fd-fee33aaa3489","resolution":{"observed_at":"2026-08-08T10:09:44.193508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.181160Z","title":"Effective whole-body pose estimation with two- stages distillation","venue":null,"work_id":"c9ac3f8d-6dfa-409d-a3c4-aa99bc9eb5ef","year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.599942Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:452aab10dedf4f3b2abb2445d70883938c9d805f5e0c3e02ec2babdc3f6010ee","observation_id":"377e2748-74df-4570-904e-f1922f1120ea","resolution":{"observed_at":"2026-08-08T10:09:44.184189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-08T10:09:43.602191Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.602191Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:9d38d732d2515341e979e5f13d9ec902849edb98b9224f136c1f210aa234b8d9","observation_id":"d97b8127-debc-4a96-87f6-79f45d5ea973","resolution":{"observed_at":"2026-08-08T10:09:43.602191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.171682Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"e40df81f-b5ec-4f59-9c3e-b835558d140a","year":2022},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.604729Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:424feb4f7197260c992b30d9ef0a839f6382c328bfa8c54bee97a0d4526bb54f","observation_id":"1bdc50e4-2fd8-4f40-aefb-f00f7d0cbee1","resolution":{"observed_at":"2026-08-08T10:09:44.174793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.162616Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":"6b43ea43-7ace-4b68-b4d6-6581f560bdbe","year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.607450Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:258f80bc2b60fa0dcdfef0ade94008bcdc906316470fa75fc12c2df8f17aeafa","observation_id":"9965cb9c-c3c4-4834-855a-a529074c5158","resolution":{"observed_at":"2026-08-08T10:09:44.165580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:43.610124Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.610124Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:a7cdb35455f77e1882cc0fe1f9c38982093c2725d0e3bc065ae7af087f492edb","observation_id":"f81aef8d-34d2-4561-a9a9-b3bf2f7f2e65","resolution":{"observed_at":"2026-08-08T10:09:43.610124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-08T10:09:43.612646Z","title":"Towards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.612646Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:b45eab94b42a3cb8d8bec80e60491af3a3560f78faa245c948f57e899164a691","observation_id":"693cc1b1-63a5-4221-b1b0-af73716c0019","resolution":{"observed_at":"2026-08-08T10:09:43.612646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.146152Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","venue":null,"work_id":"753b0865-9152-4e0b-9abf-53c6998896bd","year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.615166Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:6db6268d4590b66209b51793b0459e83e356da73b3550376b4987e6e0d543e63","observation_id":"dedc8f4c-0a14-47e7-b577-eb394e9eb18b","resolution":{"observed_at":"2026-08-08T10:09:44.148957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.137575Z","title":null,"venue":null,"work_id":"e638fd01-8769-4e8c-b467-a175fe5958d6","year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.617559Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:8ceacca03b8da5fa5797da444d31bdcac1eded4af4c6ab47266b660f54bfc6ca","observation_id":"cd98d7aa-a7f4-4c2e-9ab1-0bd5f5436a3c","resolution":{"observed_at":"2026-08-08T10:09:44.140109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-08T10:09:43.620169Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.620169Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:eeda7ac9e5ef1de5857b75bb62b1b4ce848dd44a6362eb4c034832ade6a26df2","observation_id":"9b388917-7b58-4477-a601-a43182ccba04","resolution":{"observed_at":"2026-08-08T10:09:43.620169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09972","last_updated":"2024-05-22T05:05:38Z","snapshot_observed_at":"2026-08-05T12:46:40.822750Z","submitted_at":"2023-05-17T06:11:10Z","title":"Real-Time Flying Object Detection with YOLOv8","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09972","snapshot_observed_at":"2026-08-08T10:09:43.622997Z","title":"Real-time flying object detection with yolov8","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.622997Z"},"links":{"cited_paper":"/paper/2305.09972","citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:646db5bde801df40d552390a91ea417039d4f50cd3a3cd13d5df8943a2efb700","observation_id":"200ca902-8323-42a3-a804-d6279b9e6c54","resolution":{"observed_at":"2026-08-08T10:09:43.622997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.128243Z","title":"Edge: Editable dance generation from music","venue":null,"work_id":"d612e000-df5d-4097-9eeb-861c48293aad","year":null},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.625566Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:8a92420b1ed433be305bb296f2fb15109bb575833cb273a3bcb97cc1ca2bf1d7","observation_id":"26f483c3-c27d-4ef3-a631-29132f553fae","resolution":{"observed_at":"2026-08-08T10:09:44.131155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.118937Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":"c933bbe0-ecc6-4e0c-b8c6-0f827b5c25ec","year":2021},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.627893Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:4ba47da17204f7a32a1329994afa25b63df21b29038b849a7d6d8f7cd2ed93d9","observation_id":"f2ea3f93-d6de-4b0a-b9be-6d572ca5a132","resolution":{"observed_at":"2026-08-08T10:09:44.121830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T10:09:44.109583Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":"aed26ecd-1733-4cba-8c70-4d5c7dc05226","year":2019},"citing_paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T10:09:43.630659Z"},"links":{"citing_paper":"/paper/2502.08189"},"observation_digest":"sha256:ba3a039238cdd422ffdfd82cdbf3e0bfe83da4e7d9aa467d8389441296ce153e","observation_id":"4683d6e2-86a7-4790-bda1-c59a61a91c69","resolution":{"observed_at":"2026-08-08T10:09:44.112644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.08189","last_updated":"2025-05-21T05:46:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T05:09:02.211543Z","submitted_at":"2025-02-12T07:59:41Z","title":"AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2502.08189."}