{"as_of":"2026-08-12T10:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc0ab88331c71a51874d3b39eb126ca84e3e2ff5414df882036d05eb395fc216","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:03:44.901612Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:29:01.567275Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23143","snapshot_observed_at":"2026-08-03T15:29:01.567275Z","title":"X-nemo: Expressive neural motion reenact- ment via disentangled latent attention.arXiv preprint arXiv:2507.23143, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.16893","last_updated":"2026-06-26T16:02:20Z","snapshot_observed_at":"2026-08-09T14:59:21.358895Z","submitted_at":"2025-12-18T18:53:28Z","title":"Instant Expressive Gaussian Head Avatars at Over 100 FPS","version":2},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:01.567275Z"},"links":{"cited_paper":"/paper/2507.23143","citing_paper":"/paper/2512.16893"},"observation_digest":"sha256:b20aaa2b46d254a5cbe4f25d747a94b9c682bd38aa8b4ad92afe547c852732da","observation_id":"2def528a-25ce-447d-83ba-88db5dcf2823","resolution":{"observed_at":"2026-08-03T15:29:01.567275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23143","snapshot_observed_at":"2026-08-03T00:16:32.123354Z","title":"X-nemo: Expressive neural motion reenactment via disentangled latent attention.arXiv preprint arXiv:2507.23143,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11117","last_updated":"2026-07-09T17:52:46Z","snapshot_observed_at":"2026-08-03T00:16:29.647890Z","submitted_at":"2026-02-11T18:31:47Z","title":"HairWeaver: Few-Shot Photorealistic Hair Motion Synthesis with Sim-to-Real Guided Video Diffusion","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T00:16:32.123354Z"},"links":{"cited_paper":"/paper/2507.23143","citing_paper":"/paper/2602.11117"},"observation_digest":"sha256:454d9645925488655c4abee765066688f33bfa863d9480d6e945a3dcb2edf7ce","observation_id":"3d8c62fb-9148-407e-929d-d174f7b6ed97","resolution":{"observed_at":"2026-08-03T00:16:32.123354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23143","snapshot_observed_at":"2026-07-31T19:45:23.837054Z","title":"arXiv preprint arXiv:2507.23143 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28039","last_updated":"2026-07-30T11:23:36Z","snapshot_observed_at":"2026-08-07T20:51:45.711047Z","submitted_at":"2026-07-30T11:23:36Z","title":"TongueReenact: Geometry-Anchored Tongue Synthesis for Face Reenactment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T19:45:23.837054Z"},"links":{"cited_paper":"/paper/2507.23143","citing_paper":"/paper/2607.28039"},"observation_digest":"sha256:66bd6413d6485ace1550ee93eb258af1e7990b5354f741927898ea460676d0b1","observation_id":"e32fcf5b-487f-43fe-80ea-b495a3e93beb","resolution":{"observed_at":"2026-07-31T19:45:23.837054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23143/citation-record","integrity":"/paper/2507.23143/integrity","json":"/paper/2507.23143/citation-record.json","paper":"/paper/2507.23143"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:03:45.138353Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"1d59c743-7c36-4a41-94dc-9692d97cc6a3","year":2025},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.839224Z"},"links":{"citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:30a37aae5af7df348f84855347f7f6791de1c9d73116112301b942bcfb6b4aa3","observation_id":"46fccae4-08e1-4c74-91a7-cf01bf0e5ffa","resolution":{"observed_at":"2026-08-06T11:03:45.141882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:03:45.085553Z","title":"Angry” 91th frame42th frame … … … … EmotionCondition: “Happy","venue":null,"work_id":"94a460de-bec0-4ade-b0e3-691109f634b5","year":2020},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.901612Z"},"links":{"citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:7dc2ddc427fba4cf896ce6819e46858147c53976b99a7669ec7243c3223a2940","observation_id":"7e22577a-de3d-4ab2-a91f-57e3e7b3020f","resolution":{"observed_at":"2026-08-06T11:03:45.088831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17117","last_updated":"2024-06-13T06:37:20Z","snapshot_observed_at":"2026-08-10T23:27:53.135054Z","submitted_at":"2023-11-28T12:27:15Z","title":"Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17117","snapshot_observed_at":"2026-08-06T11:03:44.854157Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.854157Z"},"links":{"cited_paper":"/paper/2311.17117","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:78d3251bd6898cc1cca89a48879cb6f14bfe7180511ac3123ec349629b6e1481","observation_id":"16f056ab-2420-4e2c-851a-f092a64869f4","resolution":{"observed_at":"2026-08-06T11:03:44.854157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08172","last_updated":"2019-06-14T05:49:22Z","snapshot_observed_at":"2026-08-05T19:15:35.517082Z","submitted_at":"2019-06-14T05:49:22Z","title":"MediaPipe: A Framework for Building Perception Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08172","snapshot_observed_at":"2026-08-06T11:03:44.858002Z","title":"Mediapipe: A framework for building perception pipelines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.858002Z"},"links":{"cited_paper":"/paper/1906.08172","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:00e83e733883e920cbbc49d2a0592c0e8cc6495e4c3b5168539d7568c8745881","observation_id":"9c1696c9-37a7-456c-af7f-2642897d3661","resolution":{"observed_at":"2026-08-06T11:03:44.858002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-10T22:24:05.831832Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T11:03:44.864989Z","title":"Animating arbitrary objects via deep motion transfer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.864989Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:78d2f99c5cc62ca95c062b725c6d96c7eb2f7d75445d33cc52b2acdaaa3e9ef5","observation_id":"fc613e22-9525-4d9a-b30f-9a44868ce06a","resolution":{"observed_at":"2026-08-06T11:03:44.864989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T11:03:44.868328Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.868328Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:d7e7398e696481b1cde44192788742ee66f56ca04d95de13b342791b0e8a57b7","observation_id":"a3a2b03d-505a-471e-b128-6124e4cada8e","resolution":{"observed_at":"2026-08-06T11:03:44.868328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-07T10:46:08.274157Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-06T11:03:44.872036Z","title":"The information bottleneck method","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.872036Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:6cdc0eb3d917477063650b9e03cb76d066a34ed8ac25733f36dddbcae259ac5d","observation_id":"da168eaf-fa4c-4390-b71e-b9c383f688dd","resolution":{"observed_at":"2026-08-06T11:03:44.872036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20175","last_updated":"2024-07-25T18:29:48Z","snapshot_observed_at":"2026-08-10T11:04:52.553577Z","submitted_at":"2024-07-25T18:29:48Z","title":"Towards Localized Fine-Grained Control for Facial Expression Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20175","snapshot_observed_at":"2026-08-06T11:03:44.878456Z","title":"Towards localized fine-grained control for facial expression generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.878456Z"},"links":{"cited_paper":"/paper/2407.20175","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:4a86064374b80beb27ba2b2f2f57b2393d27e031181b8e1906819bd48588e43e","observation_id":"486b4f1e-5733-4416-9093-56661317f0ec","resolution":{"observed_at":"2026-08-06T11:03:44.878456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02511","last_updated":"2024-06-04T17:32:52Z","snapshot_observed_at":"2026-08-11T02:21:49.599854Z","submitted_at":"2024-06-04T17:32:52Z","title":"V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02511","snapshot_observed_at":"2026-08-06T11:03:44.881560Z","title":"V-express: Conditional dropout for progressive training of portrait video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.881560Z"},"links":{"cited_paper":"/paper/2406.02511","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:f40bca3df5def1deb176f3a0feab7b790a1e7fc4ae786e0405b878c917e4e5c5","observation_id":"d3878481-826b-487f-ba06-d17730e39e9b","resolution":{"observed_at":"2026-08-06T11:03:44.881560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17694","last_updated":"2024-03-26T13:35:02Z","snapshot_observed_at":"2026-08-07T20:48:39.175359Z","submitted_at":"2024-03-26T13:35:02Z","title":"AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17694","snapshot_observed_at":"2026-08-06T11:03:44.884845Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.884845Z"},"links":{"cited_paper":"/paper/2403.17694","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:6d859fb1e59d3056d4e56131c1a072e0537b8961dcfc895e9baf243b768ffd36","observation_id":"57b2f6d9-df91-483c-b7ec-79d5c4258cc8","resolution":{"observed_at":"2026-08-06T11:03:44.884845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-08-10T18:20:34.522853Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-06T11:03:44.888102Z","title":"Facechain-imagineid: Freely crafting high-fidelity diverse talking faces from disentangled audio","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.888102Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:ea9cf22b2b0475578bcfa4bf56c5c4fd6515356caaff7463f862505967adde3e","observation_id":"f42f9ad9-2c8b-4f31-b1c6-2c9b39b12e6c","resolution":{"observed_at":"2026-08-06T11:03:44.888102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:03:45.116906Z","title":"Styleheat: One-shot high-resolution editable talking face generation via pre-trained stylegan","venue":null,"work_id":"0b9d8bd8-1785-4bf3-a476-d29c53219f8e","year":2025},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.891511Z"},"links":{"citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:c60ba5903f2bee54e6ff7d9e5423d31f85eee5980716512f9082b96b78bd04f8","observation_id":"4b58f517-6b3f-4d8d-b45a-6ce0c7099e3d","resolution":{"observed_at":"2026-08-06T11:03:45.120536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:03:45.106462Z","title":"Following Burkov et al","venue":null,"work_id":"66565858-7901-4c8c-be89-617ba40b52cd","year":2020},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.894600Z"},"links":{"citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:52f29df12115fb6af33358d9a4641c39a413c24b2f52d1faea5459d8945b0c07","observation_id":"00e50487-2eb4-43d2-81a2-af9452f2e624","resolution":{"observed_at":"2026-08-06T11:03:45.110192Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:03:45.096262Z","title":"These results underscore the robustness and identity disentanglement of our motion latent embedding","venue":null,"work_id":"6b6786c5-5119-4e4a-8542-dd19f59bcb51","year":2023},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.898482Z"},"links":{"citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:c9ab00bfc89d89fad6dace266c600a08f99c62cfbe5b0d86ed8fcef3d719902f","observation_id":"6417222f-b6b9-427e-a0f0-a3128b37d329","resolution":{"observed_at":"2026-08-06T11:03:45.099623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-08-08T10:55:01.205999Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-08-06T11:03:44.843224Z","title":"Liveportrait: Efficient portrait animation with stitching and retargeting control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.843224Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:ffe0b6ec4635b0bd758810b06b44e6d274f3eac3c0be631f88fe80a1f8711fc7","observation_id":"090cbec0-35ff-40ae-adf9-c21d330f45b4","resolution":{"observed_at":"2026-08-06T11:03:44.843224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01900","last_updated":"2024-06-07T02:57:36Z","snapshot_observed_at":"2026-08-11T18:28:21.774537Z","submitted_at":"2024-06-04T02:05:57Z","title":"Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01900","snapshot_observed_at":"2026-08-06T11:03:44.861446Z","title":"Follow-your-emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.861446Z"},"links":{"cited_paper":"/paper/2406.01900","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:1acc4e310043e887a7bbfab6cdc4d2b0b7bc867554c9b75c9812aa954ea8b060","observation_id":"11820d34-46a2-49ac-bae6-5e66d3eb62b6","resolution":{"observed_at":"2026-08-06T11:03:44.861446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08465","last_updated":"2023-04-17T17:42:19Z","snapshot_observed_at":"2026-08-10T11:06:15.842306Z","submitted_at":"2023-04-17T17:42:19Z","title":"MasaCtrl: Tuning-Free Mutual Self-Attention Control for Consistent Image Synthesis and Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08465","snapshot_observed_at":"2026-08-06T11:03:44.831421Z","title":"Mas- actrl: Tuning-free mutual self-attention control for consistent image synthesis and editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.831421Z"},"links":{"cited_paper":"/paper/2304.08465","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:e7ad3ccdedca957543cc1a076f345f4f5ca0f1e95c573c430b3c149fa0134c89","observation_id":"8141e7bc-3981-4a0a-8172-81462fb93dce","resolution":{"observed_at":"2026-08-06T11:03:44.831421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:03:45.127677Z","title":"13 Published as a conference paper at ICLR 2025 Jonathan Tseng, Rodrigo Castellon, and C","venue":null,"work_id":"f9150996-2c58-4f98-a1f2-39094692ce1e","year":2025},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.875352Z"},"links":{"citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:70936c32cbebafa387ca531f4cab27298c126ac13e5c9b36322927b3133ff05c","observation_id":"c8f1fa18-8cb6-45b3-8952-a273a6e39adb","resolution":{"observed_at":"2026-08-06T11:03:45.131168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T11:03:44.850545Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.850545Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:7d4ab7539c85fec8833c1ffd9f52f6a8cbf5d46d44169b78324b6f71f57cb60f","observation_id":"6819bc30-11b2-4f83-a6c3-2025057fd7a2","resolution":{"observed_at":"2026-08-06T11:03:44.850545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00551","last_updated":"2023-12-31T17:41:48Z","snapshot_observed_at":"2026-08-10T11:04:27.176079Z","submitted_at":"2023-12-31T17:41:48Z","title":"A Generalist FaceX via Learning Unified Facial Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00551","snapshot_observed_at":"2026-08-06T11:03:44.846982Z","title":"Animatediff: Animate your personalized text-to-image diffu- sion models without specific tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.846982Z"},"links":{"cited_paper":"/paper/2401.00551","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:fa0665d3ee4e4f06690daf3d3137717bfef6e4421e62f35224302021687987f0","observation_id":"8b506816-c6d2-4e44-9099-efd97952972e","resolution":{"observed_at":"2026-08-06T11:03:44.846982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13272","last_updated":"2024-12-02T12:18:12Z","snapshot_observed_at":"2026-08-10T11:06:01.240347Z","submitted_at":"2024-06-19T07:08:48Z","title":"AniFaceDiff: Animating Stylized Avatars via Parametric Conditioned Diffusion Models","version":2},"cited_work":{"arxiv_id":"2406.13272","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13272","snapshot_observed_at":"2026-08-06T11:03:45.062059Z","title":"AniFaceDiff: Animating Stylized Avatars via Parametric Conditioned Diffusion Models","venue":"cs.CV","work_id":"cd580a73-0267-4ac1-a2e3-29b7e383114a","year":2024},"citing_paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:44.835513Z"},"links":{"cited_paper":"/paper/2406.13272","citing_paper":"/paper/2507.23143"},"observation_digest":"sha256:7a91c745d29bf4d1394637780d06960989a4455f5dddf1d0a891e5cbf398ebdf","observation_id":"0f874d8f-1be6-4c34-89bb-8be15be85905","resolution":{"observed_at":"2026-08-06T11:03:45.067717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23143","last_updated":"2025-07-30T22:46:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:50:58.945663Z","submitted_at":"2025-07-30T22:46:52Z","title":"X-NeMo: Expressive Neural Motion Reenactment via Disentangled Latent Attention"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 3 inbound Pith citation observations for arXiv:2507.23143."}