{"as_of":"2026-08-09T01:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb27e0af5882f1350f4cdd0a4694259b1d5ca77fa2118416061145ccce01a4a2","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:38:09.903880Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:01:09.706490Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T20:37:22.289098Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T14:01:09.706490Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20255","last_updated":"2025-07-07T17:56:30Z","snapshot_observed_at":"2026-08-07T13:53:53.640300Z","submitted_at":"2025-05-26T17:32:10Z","title":"AniCrafter: Customizing Realistic Human-Centric Animation via Avatar-Background Conditioning in Video Diffusion Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:09.706490Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2505.20255"},"observation_digest":"sha256:6564164cc5a2ed158f2674678c22f4ad96e04a7d120f1dbfe379c645166c5467","observation_id":"8df680c7-1c85-43c3-ae07-c4f18192da05","resolution":{"observed_at":"2026-08-07T14:01:09.706490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T13:59:30.416393Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20292","last_updated":"2025-06-03T10:11:00Z","snapshot_observed_at":"2026-08-07T13:53:16.552171Z","submitted_at":"2025-05-26T17:59:46Z","title":"OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:59:30.416393Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2505.20292"},"observation_digest":"sha256:052a28ff51d2cce2133b68c4f9fde679b2a2c8aa1a5e935792c4ffae56e114e9","observation_id":"3f861033-8931-486c-b7df-ae3fe9cb8860","resolution":{"observed_at":"2026-08-07T13:59:30.416393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T11:39:48.879677Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:48.879677Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:7605bb742fb1e1561e4d9a57261bec26b49d85074fc95c07a587b7ea4dcfa40e","observation_id":"5f249c22-f896-44d5-b3c3-68efe74d7b8b","resolution":{"observed_at":"2026-08-07T11:39:48.879677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T05:07:15.035885Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08797","last_updated":"2026-07-24T09:02:20Z","snapshot_observed_at":"2026-08-07T04:59:22.282816Z","submitted_at":"2025-06-10T13:45:00Z","title":"HunyuanVideo-HOMA: Generic Human-Object Interaction in Multimodal Driven Human Animation","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:07:15.035885Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.08797"},"observation_digest":"sha256:79a677327040332a53f9974bba57d25e148bd0191c7c4c4632d5373f6f13f4d7","observation_id":"85e619ce-9d97-4571-8c6b-cad9d204c591","resolution":{"observed_at":"2026-08-07T05:07:15.035885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T04:27:37.301689Z","title":"Animate anyone 2: High-fidelity character image animation with environment affor- dance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10568","last_updated":"2025-08-27T03:34:57Z","snapshot_observed_at":"2026-08-08T16:12:04.523586Z","submitted_at":"2025-06-12T10:58:23Z","title":"DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:27:37.301689Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.10568"},"observation_digest":"sha256:d5d1f29dfac46ef5a9f916df282ef0a304fbf4c0efd3e82e356180d7a76c5a53","observation_id":"40521004-e0ea-4765-9525-e717f7b67f2b","resolution":{"observed_at":"2026-08-07T04:27:37.301689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T00:40:58.645841Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance.arXiv preprint arXiv:2502.06145, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12847","last_updated":"2025-06-15T13:41:43Z","snapshot_observed_at":"2026-08-07T00:44:07.685075Z","submitted_at":"2025-06-15T13:41:43Z","title":"iDiT-HOI: Inpainting-based Hand Object Interaction Reenactment via Video Diffusion Transformer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:58.645841Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.12847"},"observation_digest":"sha256:e9eba2bc38b2ef128a7eb3e11aef1159197b33a71b0231b9ff3307a743ad76a1","observation_id":"42031114-248d-4ed7-9e35-685b36367ebc","resolution":{"observed_at":"2026-08-07T00:40:58.645841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T00:13:04.352220Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17301","last_updated":"2025-07-02T16:33:38Z","snapshot_observed_at":"2026-08-09T00:39:19.023690Z","submitted_at":"2025-06-17T22:06:20Z","title":"FramePrompt: In-context Controllable Animation with Zero Structural Changes","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:04.352220Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.17301"},"observation_digest":"sha256:266601a0ce61bc1b194da477bc1b382efeee199819260e53ee3f46947f7a0917","observation_id":"1cc7201a-db07-4885-9b1f-12cfab2fb098","resolution":{"observed_at":"2026-08-07T00:13:04.352220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-06T21:23:12.708601Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance.arXiv preprint arXiv:2502.06145,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00334","last_updated":"2025-07-01T00:21:24Z","snapshot_observed_at":"2026-08-07T23:57:01.785760Z","submitted_at":"2025-07-01T00:21:24Z","title":"Populate-A-Scene: Affordance-Aware Human Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:23:12.708601Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2507.00334"},"observation_digest":"sha256:ebf3728025a2c6941c5b76c8b4ea2f73d5d92eec6f40a59e2a90f7a1af340232","observation_id":"c25ede42-3767-4ac1-8629-05fa90181633","resolution":{"observed_at":"2026-08-06T21:23:12.708601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-05T19:15:31.750331Z","title":"Ani- mate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.13104","last_updated":"2025-08-18T17:12:28Z","snapshot_observed_at":"2026-08-08T21:34:53.802326Z","submitted_at":"2025-08-18T17:12:28Z","title":"Precise Action-to-Video Generation Through Visual Action Prompts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T19:15:31.750331Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2508.13104"},"observation_digest":"sha256:86d6866c0040bb1b66066dd04472456c9d04b855eb6eecb2882409b0e75e9fbc","observation_id":"1aa7adb4-b970-4a1b-b514-7fbeeba0fa7d","resolution":{"observed_at":"2026-08-05T19:15:31.750331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-05T18:34:24.873351Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14465","last_updated":"2025-08-20T06:40:34Z","snapshot_observed_at":"2026-08-07T20:12:58.792553Z","submitted_at":"2025-08-20T06:40:34Z","title":"DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T18:34:24.873351Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2508.14465"},"observation_digest":"sha256:b6b1909044096cf49d5857a205fa788df7eee8460e198c1d61866a6c798118a2","observation_id":"28086dec-b1ee-49da-84ce-16ab0c2d51a7","resolution":{"observed_at":"2026-08-05T18:34:24.873351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2511.19320","last_updated":"2026-05-18T02:38:41Z","snapshot_observed_at":"2026-08-02T10:22:49.004993Z","submitted_at":"2025-11-24T17:15:55Z","title":"SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Preservation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T18:21:08.172735Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2511.19320"},"observation_digest":"sha256:cc40b062dc40710e6a668634f766aeb11b51441c477a0d7cccc125a478b35192","observation_id":"ad30200b-3b2d-4a91-a87c-d49fb44ec90f","resolution":{"observed_at":"2026-05-21T18:24:18.353743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2512.07951","last_updated":"2026-04-03T06:55:22Z","snapshot_observed_at":"2026-08-06T16:06:33.534280Z","submitted_at":"2025-12-08T19:00:04Z","title":"Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T23:56:41.488788Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2512.07951"},"observation_digest":"sha256:e48cd4f6c2680a56813468bef1b0d3aeed91c531383d6db58d1d65dbaf4ca2e4","observation_id":"188979af-c8e7-4ac0-99bb-af9e86a4ee7a","resolution":{"observed_at":"2026-05-16T23:58:42.810029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2512.09646","last_updated":"2026-04-08T15:03:02Z","snapshot_observed_at":"2026-08-03T08:11:41.374378Z","submitted_at":"2025-12-10T13:40:24Z","title":"VHOI: Controllable Video Generation of Human-Object Interactions from Sparse Trajectories via Motion Densification","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T23:30:14.969895Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2512.09646"},"observation_digest":"sha256:e2dee202a288a8ec7341defd539b14743f7bbdfb5f29883faadcd21542e18ab9","observation_id":"3c76404f-c410-4dc0-955b-ae8c4a9b46a6","resolution":{"observed_at":"2026-05-16T23:31:21.961396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2601.22160","last_updated":"2026-04-10T13:20:41Z","snapshot_observed_at":"2026-08-03T08:11:38.324053Z","submitted_at":"2025-12-13T08:45:03Z","title":"Screen, Cache, and Match: A Training-Free Causality-Consistent Reference Frame Framework for Human Animation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T23:13:09.767909Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2601.22160"},"observation_digest":"sha256:277b6ba7945b6393f810baa82e7a0c18c9fea1e25d46ed3255d89ada1f017f6d","observation_id":"9dc32e07-90fe-48b3-8a4f-49952bf34149","resolution":{"observed_at":"2026-05-16T23:13:39.249913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2604.05961","last_updated":"2026-04-07T14:55:10Z","snapshot_observed_at":"2026-07-06T22:54:34.877944Z","submitted_at":"2026-04-07T14:55:10Z","title":"HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T20:22:02.186361Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2604.05961"},"observation_digest":"sha256:0683cee14309cf655416e81865dbf3812446dc6b08388bb4836f864ac7aa6f7e","observation_id":"abfdfd08-ea4c-41eb-9024-333de1c6e8dc","resolution":{"observed_at":"2026-05-10T22:00:48.176210Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2604.06339","last_updated":"2026-04-07T18:17:05Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T18:17:05Z","title":"Evolution of Video Generative Foundations","version":1},"reference_index":273,"source":"pdf_text","source_observed_at":"2026-05-10T18:41:38.616611Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2604.06339"},"observation_digest":"sha256:f54a9245860028a6cc7e1545f501ae6051c003fa60172568838189cf5f48e36b","observation_id":"ac2131be-9a5c-4b7d-9c3e-2e8b7a6bc290","resolution":{"observed_at":"2026-05-11T00:05:51.643338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2604.21291","last_updated":"2026-04-23T05:10:15Z","snapshot_observed_at":"2026-07-06T23:07:56.487654Z","submitted_at":"2026-04-23T05:10:15Z","title":"Exploring the Role of Synthetic Data Augmentation in Controllable Human-Centric Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T22:23:04.067757Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2604.21291"},"observation_digest":"sha256:fa1357dbeba5426072154da23594dd540bc60b68732568c9a764d00f10a4f9c4","observation_id":"c21c104d-caee-4069-a859-7eff0d0addaf","resolution":{"observed_at":"2026-05-09T22:44:15.118613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-02T22:41:54.302633Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:7b3a4b72dd364f8c1eb41be5aafbf204ad65fe96b725e8cec4ca2927ebe38397","observation_id":"87999a67-c371-4800-8290-61e5181416ec","resolution":{"observed_at":"2026-05-20T15:08:24.999689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2606.02000","last_updated":"2026-06-01T09:56:48Z","snapshot_observed_at":"2026-08-06T00:33:39.995914Z","submitted_at":"2026-06-01T09:56:48Z","title":"Towards 3D-Aware Video Diffusion Models: Render-Free Human Motion Control with Mesh Tokenization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T15:02:10.901341Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2606.02000"},"observation_digest":"sha256:61bb089c6eeac89ad116d2c1c3054714830e84b3f50a20d1d9ab4d042d6f5eb9","observation_id":"133adb2b-911c-49d5-82c1-d4625ab5273f","resolution":{"observed_at":"2026-07-01T22:46:19.890069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2606.30514","last_updated":"2026-08-01T12:16:01Z","snapshot_observed_at":"2026-08-06T23:11:22.249942Z","submitted_at":"2026-06-29T16:22:54Z","title":"3D Scene-Adaptive Trajectory-Controllable Human Image Animation with Camera Movement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T06:30:11.466718Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2606.30514"},"observation_digest":"sha256:8772ac13eac8bca181ef96c166b57e3b618172144cc8f144cdfea673fba52c01","observation_id":"3457f6bf-5881-411b-aa49-86e894628e42","resolution":{"observed_at":"2026-06-30T06:34:18.973640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":"2502.06145","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-02T20:37:22.289098Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":"227a43eb-7b6b-4148-be31-f115fb53763c","year":2025},"citing_paper":{"arxiv_id":"2606.30514","last_updated":"2026-08-01T12:16:01Z","snapshot_observed_at":"2026-08-06T23:11:22.249942Z","submitted_at":"2026-06-29T16:22:54Z","title":"3D Scene-Adaptive Trajectory-Controllable Human Image Animation with Camera Movement","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-02T20:31:55.826198Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2606.30514"},"observation_digest":"sha256:0f0bfe92646fa8164846e544b9ea8c37506822f602f0e82730e2b3116f7a39bf","observation_id":"97a52b6e-1d9f-47c8-a32c-7af6dca16a95","resolution":{"observed_at":"2026-07-02T20:37:22.290534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-04T02:02:24.910429Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30514","last_updated":"2026-08-01T12:16:01Z","snapshot_observed_at":"2026-08-06T23:11:22.249942Z","submitted_at":"2026-06-29T16:22:54Z","title":"3D Scene-Adaptive Trajectory-Controllable Human Image Animation with Camera Movement","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T02:02:24.910429Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2606.30514"},"observation_digest":"sha256:e0caf4fc4b0e204e75055748414efb8221b312e12964527d39fd322db1b23ef3","observation_id":"fb2f831f-99ca-44d3-aca3-b70cb84b9e77","resolution":{"observed_at":"2026-08-04T02:02:24.910429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-01T10:37:54.677002Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20174","last_updated":"2026-07-22T14:06:39Z","snapshot_observed_at":"2026-08-06T22:13:37.273683Z","submitted_at":"2026-07-22T14:06:39Z","title":"StreamHOI: Interaction-aware Temporal Memory Adaptation for Streaming HOI Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T10:37:54.677002Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2607.20174"},"observation_digest":"sha256:7d5c8d038a13c9996f1d85369c80b163f8bc4fba30ec5c414a0b78a4d7b99bb8","observation_id":"9927b725-e8b2-40da-96fa-83b4ccb9632d","resolution":{"observed_at":"2026-08-01T10:37:54.677002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-01T05:27:16.588455Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance.arXiv preprint arXiv:2502.06145, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22241","last_updated":"2026-07-30T03:34:42Z","snapshot_observed_at":"2026-08-06T04:16:05.161328Z","submitted_at":"2026-07-24T12:17:57Z","title":"AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T05:27:16.588455Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2607.22241"},"observation_digest":"sha256:d96c44ab55118d2bc198b88c39ade01fef38eded4c50342b87d00220f65dc674","observation_id":"8219932f-b3a0-4740-8475-667a5eb03c6b","resolution":{"observed_at":"2026-08-01T05:27:16.588455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-07-30T20:31:37.313465Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-08T03:14:09.930720Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.313465Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:14aa74b99e8bd8e3cc9a12581313afa39877cf23931335d91016db9be395d5ea","observation_id":"0d9ffe17-fe43-4466-a0d0-1fb2ddc4e150","resolution":{"observed_at":"2026-07-30T20:31:37.313465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06145/citation-record","integrity":"/paper/2502.06145/integrity","json":"/paper/2502.06145/citation-record.json","paper":"/paper/2502.06145"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.480789Z","title":"Wasserstein generative adversarial networks","venue":null,"work_id":"baea4cf5-f213-42f4-b935-b1b82fc12095","year":2017},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.688798Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:814e3e3b238dd546f09721132a2fcdde7dac3efdde9528db54f9633c11011165","observation_id":"0e688e49-bbac-43d7-aabd-f7c0fc54406e","resolution":{"observed_at":"2026-08-08T16:38:10.484525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-08T16:38:09.692811Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.692811Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:235a767524c0c420f04544f53ae0d22dd48b8d97f7974ae4e3448a893e57e4e7","observation_id":"f88dbd8c-83c9-4740-a1d3-9d8ebce28bc8","resolution":{"observed_at":"2026-08-08T16:38:09.692811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-08T16:38:09.697761Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.697761Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:5217fdddb15421b3d19ee870b982d72dc7c79a89b9733c9d2c2d9d74547b76d8","observation_id":"c4a313cb-4d15-4e66-b126-22a73c2a28f9","resolution":{"observed_at":"2026-08-08T16:38:09.697761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.701752Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.701752Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:5d5db828859d8885c37717c3dbb3bf034410293e34cd228c8f9810d867a84b20","observation_id":"a853af59-4da3-45f5-a944-935224a382a9","resolution":{"observed_at":"2026-08-08T16:38:09.701752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.464008Z","title":"Face anti-spoofing based on color texture analysis","venue":null,"work_id":"55940335-3941-471d-86ec-d61ddfc2f25b","year":2015},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.705694Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:6930dd90c7d179ff4b030529be94779b0e32a271cc8a6d7ec97537aac22aede0","observation_id":"a2e23be0-4462-4794-a964-e8cbd2a8052a","resolution":{"observed_at":"2026-08-08T16:38:10.468205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.453902Z","title":"Everybody dance now","venue":null,"work_id":"d5d8be5b-5c39-4dd8-88b6-16054f80ac0f","year":2019},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.709677Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:3b8c4fde282cdca3d14e8e18f3d617ad7e117adecc004b0c83f8d93ac481dde6","observation_id":"472fcc44-3c96-415a-8d5d-8e9c35403715","resolution":{"observed_at":"2026-08-08T16:38:10.457411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.443455Z","title":"Magicpose: Realistic human poses and facial expressions retargeting with identity-aware diffusion","venue":null,"work_id":"084f08b8-0423-4d07-9e53-bbcce60163db","year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.713828Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:a4f13b7f0ea970ebb21c20a8df748c07be50b89b8ed4078d94d05be563371059","observation_id":"639f75b7-518a-4d80-af29-a990d9663761","resolution":{"observed_at":"2026-08-08T16:38:10.447314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19707","last_updated":"2024-08-22T09:48:49Z","snapshot_observed_at":"2026-07-06T18:22:27.156635Z","submitted_at":"2024-05-30T05:36:12Z","title":"DeMamba: AI-Generated Video Detection on Million-Scale GenVideo Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19707","snapshot_observed_at":"2026-08-08T16:38:09.717584Z","title":"Demamba: Ai-generated video detection on million-scale genvideo benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.717584Z"},"links":{"cited_paper":"/paper/2405.19707","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:644fa8983b6eb3174142187615b0aeb4d56b709e39e41a759fd9f9d5d2af7748","observation_id":"62fe2eb0-d794-43ba-b077-bdd682b0fe25","resolution":{"observed_at":"2026-08-08T16:38:09.717584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.721576Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.721576Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:b0ce0ab47bef820beff034b00964d207f4ceb830895ae7a9f6336629f4bb8407","observation_id":"3848a67f-a507-45e8-9a1d-0ca9e1e787a6","resolution":{"observed_at":"2026-08-08T16:38:09.721576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-08T16:38:09.725031Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.725031Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:9eafd835174936d0bcb6e80fc2bc4d2416b536f0a7867b51f59bc3ddbb6a0afe","observation_id":"8ee3f472-0e2a-4829-80aa-3a071719e7b5","resolution":{"observed_at":"2026-08-08T16:38:09.725031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.426701Z","title":"Densepose: Dense human pose estimation in the wild","venue":null,"work_id":"f76e0d74-41ef-4847-bda0-ddeb83627f45","year":2018},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.729271Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:d62fd2fe4aaf3b2b122b4ddae514765b03bad206d5330313376246d0c0da2a4d","observation_id":"55965102-8bc5-495d-9f61-4246df8e6fae","resolution":{"observed_at":"2026-08-08T16:38:10.430469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-08T16:38:09.732713Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.732713Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:246e13f90b51320cd7b37910696dc9cdefc1b59924b15682bfe7cfcee5ace37f","observation_id":"a7696ef9-9583-4c13-a3fa-445475b20b5a","resolution":{"observed_at":"2026-08-08T16:38:09.732713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.736425Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.736425Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:5d48ecfb0a2cd887741445695d5279293e28536dcc1ca5775c1aa3e6aaffe366","observation_id":"69137c01-9a31-4721-b930-bd7edb8a8291","resolution":{"observed_at":"2026-08-08T16:38:09.736425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.739742Z","title":"Image quality metrics: Psnr vs","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.739742Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:987069e033dda0e0c79b90a97d27678aa7463dfd0d80fe48a47643b0924d48cb","observation_id":"253c4dd1-5098-4e8d-b273-3d13d7675a5f","resolution":{"observed_at":"2026-08-08T16:38:09.739742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.404403Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":"6fc559dd-c8da-42d0-b2e8-ca2e731c355f","year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.743039Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:1aea3823baa71a462ef8706c030112cb0d0865aa72cad17c0015b58116d64086","observation_id":"e01f6e20-a863-4b49-82f8-beea2b89d604","resolution":{"observed_at":"2026-08-08T16:38:10.408039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.393983Z","title":"Learning high fi- delity depths of dressed humans by watching social media dance videos","venue":null,"work_id":"9354b5e2-20ae-4f9c-95cd-38ac5395768b","year":2021},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.746362Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:04cc2cfe75759aa081aa3f09cb1b00ce36e49a818effa8eb99a83876316252ea","observation_id":"1d63d55c-655c-46b2-9ba2-bf08efbdab69","resolution":{"observed_at":"2026-08-08T16:38:10.397870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.383651Z","title":"Dreampose: Fashion video synthesis with stable diffusion","venue":null,"work_id":"33de3ffb-a06f-4e5e-b62d-b37690fb0dd4","year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.749585Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:06fc9689ac24e662e4eefe362b771a151c91fcbabf930b53c9bde7f0cd16d9d3","observation_id":"b997b5d1-7874-4586-b236-b75f9af678a3","resolution":{"observed_at":"2026-08-08T16:38:10.387379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.752841Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.752841Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:b547a99031f69d8f34af633d46f237ce6034dff4395ade55720cfe0b16021185","observation_id":"1c497543-85b3-49db-8c8b-b62543b206c8","resolution":{"observed_at":"2026-08-08T16:38:09.752841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.367766Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":"a2ec01b3-1087-498b-b042-844765e844ab","year":2025},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.756328Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:88cd82b50c688083fe40acde3f09459174901554b904f913778f8a41268db7ce","observation_id":"218d689b-7264-43e2-a4da-9b4fcc43226a","resolution":{"observed_at":"2026-08-08T16:38:10.371262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.357369Z","title":"Tcan: Animating human images with temporally consistent pose guidance using diffusion models","venue":null,"work_id":"6050847e-51b6-4dae-b1d0-8df400a7428a","year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.759799Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:5f673098887394fff8f5f22e468b8b6d474b70cd63f84cafd2648808f2a1a07b","observation_id":"f53c59c0-3e67-4644-8d68-856aa338769a","resolution":{"observed_at":"2026-08-08T16:38:10.361063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.346597Z","title":"Kingma and Max Welling","venue":null,"work_id":"6bd609d3-9338-4ed9-9d15-84547a13fca2","year":2014},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.763002Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:de1979f7157d1d1f23d90b3dde321ed885a2e3245806423b5168438e5587856b","observation_id":"71b1ba07-6759-4fc4-889f-da92e485fbf5","resolution":{"observed_at":"2026-08-08T16:38:10.350220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.766320Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.766320Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:134cc76a206d7fcc9007a48aa6b1d8c25a0af23f2d25551375ec3f23eb5dd393","observation_id":"b62707cc-ba53-4580-8360-03b556d4d977","resolution":{"observed_at":"2026-08-08T16:38:09.766320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.330442Z","title":"Putting people in their place: Affordance-aware hu- man insertion into scenes","venue":null,"work_id":"8cf49581-e30e-4350-8514-e052efdae558","year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.769594Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:85702fd0a9ef307200e080a68cce8bca463d2500434d94686dffaa494b96d36c","observation_id":"ef30e07b-4064-41f8-9deb-c8d50b7d516f","resolution":{"observed_at":"2026-08-08T16:38:10.334027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.772920Z","title":"Smpl: A skinned multi- person linear model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.772920Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:d9a1626cb086bde9e30c136d560525f4329b46020e558ef1fe40db1e36a3cceb","observation_id":"e887db22-0bd3-457c-949d-920296874da3","resolution":{"observed_at":"2026-08-08T16:38:09.772920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16160","last_updated":"2025-06-11T08:28:01Z","snapshot_observed_at":"2026-08-07T23:57:27.127966Z","submitted_at":"2024-09-24T15:00:07Z","title":"MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16160","snapshot_observed_at":"2026-08-08T16:38:09.776101Z","title":"Mimo: Controllable character video synthesis with spatial decomposed modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.776101Z"},"links":{"cited_paper":"/paper/2409.16160","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:6e6df15f4dc88ecad2cf562191547f3fcdfc50e24e7b447e61a992bbdabd7bad","observation_id":"2564cd13-f748-4cd7-b071-b952f7d2dacf","resolution":{"observed_at":"2026-08-08T16:38:09.776101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.313924Z","title":"Synthesizing environment-specific people in pho- tographs","venue":null,"work_id":"01fdae3d-4385-4dab-85f5-2c437ba8bf3d","year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.780493Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:a8e7b199c1961dddac81f9584a2bf0c8339806c3b605c72d2ca62c573d7940e1","observation_id":"ee40887f-4054-4e1e-a49f-1420d9a23d34","resolution":{"observed_at":"2026-08-08T16:38:10.317856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.303513Z","title":"Text2place: Affordance-aware text guided human placement","venue":null,"work_id":"f17a7f0f-cf7f-4976-a142-e5316da3ff63","year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.784035Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:471ba84fb5818d8b96bc5fba694f53969e4b7a376b326c6789d5b000dd7867dd","observation_id":"02078141-3e56-41d2-9024-99867eeff225","resolution":{"observed_at":"2026-08-08T16:38:10.307153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20974","last_updated":"2025-01-13T05:06:17Z","snapshot_observed_at":"2026-07-06T19:40:44.012201Z","submitted_at":"2024-10-28T12:46:05Z","title":"MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20974","snapshot_observed_at":"2026-08-08T16:38:09.787589Z","title":"Moviecharacter: A tuning- free framework for controllable character video synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.787589Z"},"links":{"cited_paper":"/paper/2410.20974","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:d2f74c604d3c55953b6806c2a8b3dd84a6d17ee62aa0835db36fd8d58ce675f6","observation_id":"96a7cbb2-c228-4021-8849-3598a2854fe4","resolution":{"observed_at":"2026-08-08T16:38:09.787589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-08T16:38:09.791150Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.791150Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:692d39430a6e050724cd52a83f1a4e2c72ff84ff82fedbc1f98cb901c2ea076b","observation_id":"5f35385f-d87d-4565-ac08-af8651c91b81","resolution":{"observed_at":"2026-08-08T16:38:09.791150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.293220Z","title":"Deep spa- tial transformation for pose-guided person image generation and animation","venue":null,"work_id":"9fae1342-7936-46d5-b76f-77762bf3787a","year":2020},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.794868Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:90ec272985794e2a2740163f6301c5ffe1929fadd98ee5fcd2f9da27cbc27ccd","observation_id":"3450db02-35e1-4091-bedb-bb832164c7a8","resolution":{"observed_at":"2026-08-08T16:38:10.296782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.798649Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.798649Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:0b16662b1b91adabd2ef2856a3c1f0b9eb7fb35e79ad4e5abb1932900ad50e39","observation_id":"52bab400-0541-431b-90c3-5cb12af96513","resolution":{"observed_at":"2026-08-08T16:38:09.798649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.802594Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.802594Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:1eb526a0158c406e42a5de921ba1c13eef42d4d38a6c1b7eee92ed56f079d2e2","observation_id":"70f7776a-06d8-4a4b-a4f7-350f2af67dd0","resolution":{"observed_at":"2026-08-08T16:38:09.802594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10958","last_updated":"2024-07-15T17:55:09Z","snapshot_observed_at":"2026-07-06T18:46:39.497352Z","submitted_at":"2024-07-15T17:55:09Z","title":"InVi: Object Insertion In Videos Using Off-the-Shelf Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10958","snapshot_observed_at":"2026-08-08T16:38:09.805979Z","title":"Invi: Object insertion in videos using off-the-shelf diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.805979Z"},"links":{"cited_paper":"/paper/2407.10958","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:d1929c225e6376435ab48ff237fece637403c4f8d3f6ae17e2b05aa98ded49cf","observation_id":"8913c9af-a5b9-4b0b-bb33-c09286853804","resolution":{"observed_at":"2026-08-08T16:38:09.805979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.809469Z","title":"First order motion model for image animation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.809469Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:fe8e81c610425464a4a3ae0e98ca1991a22b39317168280d760a3d3221d5a21d","observation_id":"46230a34-612e-47a2-8775-6f4968476c8c","resolution":{"observed_at":"2026-08-08T16:38:09.809469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.265538Z","title":"Animating arbitrary objects via deep motion transfer","venue":null,"work_id":"1026dd29-9c80-431c-9057-33ae0eb59d2d","year":2019},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.812866Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:2e2b6b54e4706100d02ecd00231f4d7fbead61ff932c453279839d398cc86b49","observation_id":"5ecf5a28-42f5-4c1f-bb59-ad172a562161","resolution":{"observed_at":"2026-08-08T16:38:10.269226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.255177Z","title":"Motion representations for ar- ticulated animation","venue":null,"work_id":"c3922dc1-cf0a-48fe-b6b1-b16fcfe6b2f5","year":2021},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.816302Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:8af3b7fe382e609fdcfca74399da0ae05974d2e5bf8cb4d71e3378f7fb149d33","observation_id":"186b1797-7208-48e3-881a-27c28deb4ca7","resolution":{"observed_at":"2026-08-08T16:38:10.258873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.245309Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":"1a16386b-1aad-4a0e-bb42-ff44326875d3","year":2021},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.819477Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:e26c1d736857e18e51e7a4c6494d14de594fe988ffaa81777f6ab17fef251c19","observation_id":"9d880783-f4d8-4012-b557-240ef3d4927e","resolution":{"observed_at":"2026-08-08T16:38:10.248823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.235239Z","title":"Emo: Emote portrait alive generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":"36a912d3-fb4e-47fa-bd16-8dc20ec56e78","year":2025},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.822763Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:fbe9904ff45cd5147a609ea4a551e9b375b267ac2b35def0e819dee89e679c12","observation_id":"eb493018-ef29-400d-81af-96ecf351c439","resolution":{"observed_at":"2026-08-08T16:38:10.238918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-08T16:38:09.826113Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.826113Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:cb49e0b2d24771eb83fb3188069ccfdde40252ab1f327f9d2b065562039a9118","observation_id":"2cdec7d7-81e7-4bf6-b621-9bb47e0624f8","resolution":{"observed_at":"2026-08-08T16:38:09.826113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.829739Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.829739Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:0cac002555dd5ffcbeb9b3871148b9fa3b6e0862a6fdde50f67b6e997316dd4c","observation_id":"7ecf2f73-65de-4577-b9fe-3ecf5980da73","resolution":{"observed_at":"2026-08-08T16:38:09.829739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.833083Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.833083Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:7c679ce097304f367e8e1558501609702949e937d0e9191265eaacc51f1eeaae","observation_id":"2440c87b-b0f8-4581-a233-7d9f54088483","resolution":{"observed_at":"2026-08-08T16:38:09.833083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00040","last_updated":"2024-04-04T19:41:09Z","snapshot_observed_at":"2026-07-06T15:48:59.545602Z","submitted_at":"2023-06-30T17:37:48Z","title":"DisCo: Disentangled Control for Realistic Human Dance Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00040","snapshot_observed_at":"2026-08-08T16:38:09.836446Z","title":"Disco: Disentangled control for referring human dance generation in real world","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.836446Z"},"links":{"cited_paper":"/paper/2307.00040","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:7eb67986b655590ec75a1e42ceecd1d4a7a0efa4f09586f3cbd81fbdf0fb6040","observation_id":"490fd76d-1f82-4236-8a80-7af48816634b","resolution":{"observed_at":"2026-08-08T16:38:09.836446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-08T16:38:09.840436Z","title":"Cogvlm: Visual expert for pretrained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.840436Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:c479b9b8ead861aca26bba44ade546463124e57134648195000a6be7ecb77fdd","observation_id":"bb2464dd-4628-4751-a494-465575e88afc","resolution":{"observed_at":"2026-08-08T16:38:09.840436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01188","last_updated":"2024-06-03T10:51:10Z","snapshot_observed_at":"2026-07-06T18:24:17.711867Z","submitted_at":"2024-06-03T10:51:10Z","title":"UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01188","snapshot_observed_at":"2026-08-08T16:38:09.844244Z","title":"Unianimate: Taming unified video diffusion mod- els for consistent human image animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.844244Z"},"links":{"cited_paper":"/paper/2406.01188","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:4531039d43f169a1bd7a53fe4ceadc1c1dbc7d3818ad09581c681fc6c8f53c02","observation_id":"12e51c84-e9fd-41e8-be47-9afde70b3051","resolution":{"observed_at":"2026-08-08T16:38:09.844244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.848170Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.848170Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:6bb4fb1b8b9da2390e202b3f1604975e3a434c74ce28dabe71977a79c1bb9e93","observation_id":"10b586d2-3ec9-4a5f-b844-2e30b412ba9d","resolution":{"observed_at":"2026-08-08T16:38:09.848170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.207182Z","title":"Deep spatial gradient and temporal depth learning for face anti-spoofing","venue":null,"work_id":"e14d514f-26ac-4f23-b738-b180122cba87","year":2020},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.851725Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:bea68e4cd6552413fdec4d9eb67413f03b62f256209df2140fe1a87d1d6a18f7","observation_id":"7550af44-e819-4d43-bff8-8251c53a86f8","resolution":{"observed_at":"2026-08-08T16:38:10.210905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17383","last_updated":"2025-06-23T06:27:21Z","snapshot_observed_at":"2026-07-06T19:57:14.289258Z","submitted_at":"2024-11-26T12:42:13Z","title":"AnchorCrafter: Animate Cyber-Anchors Selling Your Products via Human-Object Interacting Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17383","snapshot_observed_at":"2026-08-08T16:38:09.855482Z","title":"Anchorcrafter: Animate cyberanchors saling your products via human-object interacting video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.855482Z"},"links":{"cited_paper":"/paper/2411.17383","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:388e4c92b296caf5b1d83f1abef0ec52e72eb6ac0ec25cfb2bcdfcc3f4c8e965","observation_id":"c917ca61-f287-4f80-85e7-2ed68c7fe30e","resolution":{"observed_at":"2026-08-08T16:38:09.855482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.196321Z","title":"Magicanimate: Temporally consistent human im- age animation using diffusion model","venue":null,"work_id":"ba3358ed-a32b-4474-b440-e3804b02be13","year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.859597Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:01edcc87a21e5a8da0308e12c7c83f8641ac939946c84ad36bfa77d6e3712720","observation_id":"56d8886c-6e54-453c-826e-6a43f52fde24","resolution":{"observed_at":"2026-08-08T16:38:10.200150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24037","last_updated":"2025-04-14T09:02:09Z","snapshot_observed_at":"2026-07-06T19:43:00.571297Z","submitted_at":"2024-10-31T15:34:49Z","title":"TPC: Test-time Procrustes Calibration for Diffusion-based Human Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24037","snapshot_observed_at":"2026-08-08T16:38:09.863458Z","title":"Tpc: Test-time procrustes calibration for diffusion-based human image animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.863458Z"},"links":{"cited_paper":"/paper/2410.24037","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:c988a1db731f3cd3f5ed8b7d08961cc507c8b115685ae66be528f628d04965d8","observation_id":"c054b9b5-6cac-4625-a8fb-0ffcc64d27ba","resolution":{"observed_at":"2026-08-08T16:38:09.863458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.185154Z","title":"Bidirectionally deformable motion modu- lation for video-based human pose transfer","venue":null,"work_id":"249870ab-e643-4854-a304-88e1e3d19042","year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.867361Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:98bf6cadcda58edf75f890c85daea45d4fa1ad13f61ffde7ac419bd61d11cf49","observation_id":"cda341ba-3d35-4bc4-950d-0d62a34504b5","resolution":{"observed_at":"2026-08-08T16:38:10.189644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.174358Z","title":"Searching central difference convolutional networks for face anti-spoofing","venue":null,"work_id":"b6cf79c7-4ea3-4d2c-95b5-5c0069d5f200","year":2020},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.871007Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:912f1d2c7a43429f7ba9d0905cb895dfad5bdb3be7e7af244dd37f8c551e9d7d","observation_id":"39d67c19-11f8-4a45-aa5d-87627fd21fbf","resolution":{"observed_at":"2026-08-08T16:38:10.178227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.163737Z","title":"Addme: Zero-shot group-photo synthesis by inserting people into scenes","venue":null,"work_id":"a9c3b5a1-ebdb-4552-a53d-f146395c078a","year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.874702Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:4dc1e78e5a4469cdfe757b870fc9ff46657ec3043927029ab017887a0c040727","observation_id":"0cd0249b-fdc9-49ea-a185-daa943caf33c","resolution":{"observed_at":"2026-08-08T16:38:10.167397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09139","last_updated":"2019-10-21T03:56:51Z","snapshot_observed_at":"2026-08-05T10:08:16.256542Z","submitted_at":"2019-10-21T03:56:51Z","title":"DwNet: Dense warp-based network for pose-guided human video generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.09139","snapshot_observed_at":"2026-08-08T16:38:09.878203Z","title":"Dwnet: Dense warp-based network for pose-guided human video generation","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.878203Z"},"links":{"cited_paper":"/paper/1910.09139","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:5a5858c8c69dc8854e02427f6bc21f82e14697cdef849bcf808c86df35177269","observation_id":"0367873d-85bc-498b-9820-dd650b47bb11","resolution":{"observed_at":"2026-08-08T16:38:09.878203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.151879Z","title":"Exploring dual-task correlation for pose guided person image generation","venue":null,"work_id":"21a22f26-6851-4f92-a0c2-dfa24018837a","year":2022},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.882102Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:17db499f674480608c1df6d3abd4db39e1cb635d4b514fd93634f43cd1470f7d","observation_id":"002e5388-6b19-4743-961e-a3885a8312d2","resolution":{"observed_at":"2026-08-08T16:38:10.155635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.885635Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.885635Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:aa1485c5634e2f5614e235afb4dbc56b527b839e409036f5d8a5491e785eebd5","observation_id":"5b3050fd-4236-404c-b877-a943055796f4","resolution":{"observed_at":"2026-08-08T16:38:09.885635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19680","last_updated":"2025-06-27T10:06:13Z","snapshot_observed_at":"2026-08-04T16:03:06.733403Z","submitted_at":"2024-06-28T06:40:53Z","title":"MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19680","snapshot_observed_at":"2026-08-08T16:38:09.889237Z","title":"Mim- icmotion: High-quality human motion video generation with confidence-aware pose guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.889237Z"},"links":{"cited_paper":"/paper/2406.19680","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:c84fd566db31145b8ace8ca0fb1a8c1bf10f9f490a50723f7868419a2754af6e","observation_id":"6daa8970-1a14-40dc-991a-ee1350cb9e43","resolution":{"observed_at":"2026-08-08T16:38:09.889237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:09.892915Z","title":"Thin-plate spline motion model for image animation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.892915Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:1406fe3b71bde666cf600a9487f97f26b2a1dc0e3eb2c56bce8d832ba1c8d18e","observation_id":"134a0fe4-27f9-4be3-ace5-a01a6415f680","resolution":{"observed_at":"2026-08-08T16:38:09.892915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14424","last_updated":"2025-02-24T08:35:58Z","snapshot_observed_at":"2026-07-06T19:19:24.759288Z","submitted_at":"2024-09-22T12:51:32Z","title":"Dormant: Defending against Pose-driven Human Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14424","snapshot_observed_at":"2026-08-08T16:38:09.896336Z","title":"Dormant: Defending against pose-driven human image animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.896336Z"},"links":{"cited_paper":"/paper/2409.14424","citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:1c93b38f518ea1a15d9e7fefad615cb7566bb9ab7f3294f554188467b14dfa87","observation_id":"c38133af-f107-4acf-9eca-cdf65579464f","resolution":{"observed_at":"2026-08-08T16:38:09.896336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.128162Z","title":"Propainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":"fd28ba00-96bb-422a-9972-6a1a0d4f8e1d","year":2023},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.900533Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:9a74d0ffd8b200787e02e76979844fdcdef3c1da05f3529a5a03cc7c60927b37","observation_id":"4ee98102-e261-4bfa-8d23-9f1dcf36dcb8","resolution":{"observed_at":"2026-08-08T16:38:10.131810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:38:10.115200Z","title":"Champ: Controllable and consistent human image an- imation with 3d parametric guidance","venue":null,"work_id":"b24e1d2f-0a87-4d77-883d-6eeb00f48359","year":2025},"citing_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T16:38:09.903880Z"},"links":{"citing_paper":"/paper/2502.06145"},"observation_digest":"sha256:2e39b1e3207af2e41be9d2fda95cfd2659f0697ccb4778e2b57dbdb043f47af8","observation_id":"851f8b6a-5c00-4bda-bece-81733c4f176b","resolution":{"observed_at":"2026-08-08T16:38:10.120654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T16:33:13.977887Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 25 inbound Pith citation observations for arXiv:2502.06145."}