{"as_of":"2026-08-23T12:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b4e71ea8ea70e5bef0ff4d0739883c792459261310f7d1df4c08df6df32b1a22","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:21:12.348163Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12107/citation-record","integrity":"/paper/2608.12107/integrity","json":"/paper/2608.12107/citation-record.json","paper":"/paper/2608.12107"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.794773Z","title":"Sadtalker: Learningrealistic3dmotioncoefficientsforstylizedaudio-drivensingleimagetalkingfaceanimation","venue":null,"work_id":"ed05aec4-0060-423f-9ab3-6c15dd218254","year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.030393Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3679427c25479fa22041a26b79daf12446ab5bf69fcd351af8bb3012f30b336b","observation_id":"90cd8ea8-3005-468f-8ca2-699e73b4fdea","resolution":{"observed_at":"2026-08-16T00:21:13.799437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.780102Z","title":"Latentsync: Audio conditioned latent diffusion models for lip sync.arXiv e-prints, pages arXiv–2412, 2024","venue":null,"work_id":"f4727312-a674-4bcc-815e-532ea1e9b283","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.036059Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:aef7cb5bff7ae8afb13b25fdaac52dba1336edf272fec0d16e79cc1b45434fb6","observation_id":"618a305f-6689-4f40-b2a8-f058bc22732b","resolution":{"observed_at":"2026-08-16T00:21:13.784914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-08-20T08:43:15.720979Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-16T00:21:12.041570Z","title":"Emo: Emote portrait alive: Generating expressive portrait videos with audio2video diffusion model under weak conditions.arXiv preprint arXiv:2402.17485, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.041570Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:20b99f4fd1b90e4c3f13eff231136428aed6c4b34c6c802931bf70f446058dbc","observation_id":"7b6f2e13-f60a-4832-ad28-9fd1b8622004","resolution":{"observed_at":"2026-08-16T00:21:12.041570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-19T04:53:25.142828Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-16T00:21:12.047702Z","title":"Seedance 2.0: Advancing video generation for world complexity.arXiv preprint arXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.047702Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:4cbcac3dc856dc5f8f4ee4603dd5015fb19881c775a30f4890a0985149fc26cd","observation_id":"fdad2762-73a8-4444-9ded-843be592acdb","resolution":{"observed_at":"2026-08-16T00:21:12.047702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-16T00:21:12.055000Z","title":"Wan: Openandadvancedlarge-scalevideogenerativemodels.arXivpreprintarXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.055000Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:6d83700820906e3980b9048024a1290dcce61b68d97fb40d99664c0919a23004","observation_id":"f26f6fed-c8e4-43e0-8430-9837f46bb40a","resolution":{"observed_at":"2026-08-16T00:21:12.055000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-08-21T07:01:40.887307Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-16T00:21:12.066046Z","title":"Ltx-2: Efficient joint audio-visual foundation model","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.066046Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:014fc9cebe137e8713b0f0ccbd7df2fc6f67d2de55724d2d5198e03b37558010","observation_id":"ecf31078-0af0-41eb-9bcb-f416835758ec","resolution":{"observed_at":"2026-08-16T00:21:12.066046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.073048Z","title":"Many-for-many: Unify the training of multiple video and image generation and manipulation tasks.arXiv preprint arXiv:2506.01758, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.073048Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:1ae9cb17f85af1bdffd3e39807f5acee65e16cf19e497287cb4f4a5555fbd961","observation_id":"f9f675ff-4c71-42f0-952e-4d99f4517a21","resolution":{"observed_at":"2026-08-16T00:21:12.073048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.079436Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.079436Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:2694dfb14d45a046f22805d9484220264e018108e92382e9ba52d891a26e4caa","observation_id":"d62fafee-c74f-4e7f-80f3-9e3c92e771b9","resolution":{"observed_at":"2026-08-16T00:21:12.079436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.084992Z","title":"Arig: Autoregressive interactive head generation for real-time conversations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.084992Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:f5ee0087c56b1ba296a87b2a10e47cfbccbffa6d8e6208e5680db10644e574b4","observation_id":"e62645fd-4876-41a8-a455-9d0ddbc6c3eb","resolution":{"observed_at":"2026-08-16T00:21:12.084992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.754828Z","title":"Ditto: Motion-space diffusion for controllable realtime talking head synthesis","venue":null,"work_id":"3653f00e-ca60-4640-a27c-25ec30386fc5","year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.090273Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:0943709e74615834406f680c764ae0839faf796be94445f4e5da4a593e9e7c7a","observation_id":"39bc82e2-0472-416d-8b3f-9ad5572fa5b4","resolution":{"observed_at":"2026-08-16T00:21:13.759589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03099","last_updated":"2025-06-03T17:29:28Z","snapshot_observed_at":"2026-08-18T10:31:42.604879Z","submitted_at":"2025-06-03T17:29:28Z","title":"TalkingMachines: Real-Time Audio-Driven FaceTime-Style Video via Autoregressive Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03099","snapshot_observed_at":"2026-08-16T00:21:12.095443Z","title":"Talkingmachines: Real-time audio-driven facetime-style video via autoregressive diffusion models.arXiv preprint arXiv:2506.03099, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.095443Z"},"links":{"cited_paper":"/paper/2506.03099","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:14621268523a91213828ea7aa9e8d0c6d1a9423e91cba76c87c97eb7e7c0e68e","observation_id":"8eb8e918-304f-4e40-8570-7394b01ae850","resolution":{"observed_at":"2026-08-16T00:21:12.095443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.100874Z","title":"Avatarforcing: One-step streaming talking avatars via local-future sliding-window denoising.arXiv preprint arXiv:2603.14331, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.100874Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:893e8a37a4d683d5a96824c69e215f1b09cc10953ced65253e5f32fb27fe5421","observation_id":"ad22e35a-f5ce-4676-acb2-d0bfa848c2fe","resolution":{"observed_at":"2026-08-16T00:21:12.100874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.105881Z","title":"From slow bidirectional to fast autoregressive video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.105881Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:40efe07194284657f8b0d41f353b0ed48926cfe6585acc8b003647375ea08799","observation_id":"e30ab339-5b55-4a96-b8c5-5d40fa2a9c79","resolution":{"observed_at":"2026-08-16T00:21:12.105881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.110194Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.Advances in Neural Information Processing Systems, 38:167283–167308, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.110194Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a013be626a1422d76847f5f4b47120826dcc777fa555ad0847c5c2ed07f89fca","observation_id":"764de3f2-471f-4c22-9da4-40c1d0adeb9d","resolution":{"observed_at":"2026-08-16T00:21:12.110194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.114842Z","title":"Streamavatar: Streaming diffusion models for real-time interactive human avatars.arXiv preprint arXiv:2512.22065, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.114842Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:46bd1f8868b2e2525dfabb0905a631f7853f2eb8c66dffad1d4d59142ba0dc32","observation_id":"6fd224b0-3a27-4159-8068-740421c39671","resolution":{"observed_at":"2026-08-16T00:21:12.114842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.22622","last_updated":"2025-10-13T22:41:26Z","snapshot_observed_at":"2026-08-20T21:21:54.424645Z","submitted_at":"2025-09-26T17:48:24Z","title":"LongLive: Real-time Interactive Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.22622","snapshot_observed_at":"2026-08-16T00:21:12.119524Z","title":"Longlive: Real-time interactive long video generation.arXiv preprint arXiv:2509.22622, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.119524Z"},"links":{"cited_paper":"/paper/2509.22622","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:70ba4a6965f8243f2af15dcb02b2be8b0e5cdc9f9028bc3d432ab728c0cc1829","observation_id":"b7c9e462-2470-45e9-a20f-dbe923b636a2","resolution":{"observed_at":"2026-08-16T00:21:12.119524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.714195Z","title":"Reward forcing: Efficient streaming video generation with rewarded distribution matching distillation","venue":null,"work_id":"67ff0ed4-e0cf-46f8-9b22-74dcc77ddb7e","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.124098Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:db131e44a2d8b3a8fd5d2759c7a7c386657a4ae3d59f20f7d1549520864f12a0","observation_id":"1aee4f68-01ae-4eca-ad98-b265ed3bc14e","resolution":{"observed_at":"2026-08-16T00:21:13.724164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.129120Z","title":"Stable video infinity: Infinite-length video generation with error recycling.arXiv preprint arXiv:2510.09212, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.129120Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:f937008d17d1c6555f81a14ebea345dfdc06efcab66f41e93af5da6a07e03115","observation_id":"dc812a9b-08cc-46af-ad35-c90d6ad53e44","resolution":{"observed_at":"2026-08-16T00:21:12.129120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-17T22:01:08.736822Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02214","snapshot_observed_at":"2026-08-16T00:21:12.133863Z","title":"Causal forcing: Autoregressive diffu- sion distillation done right for high-quality real-time interactive video generation.arXiv preprint arXiv:2602.02214, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.133863Z"},"links":{"cited_paper":"/paper/2602.02214","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:8dc9669292b728e76a6a1feea92cb624cc6dc7f01d73efdd0e93580662237a31","observation_id":"c5036238-6655-409f-b957-2a8aac9fe464","resolution":{"observed_at":"2026-08-16T00:21:12.133863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.697986Z","title":"Infinity-rope: Action-controllable infinite video generation emerges from autoregressive self-rollout","venue":null,"work_id":"3432e06f-08c3-4ecd-b6d4-878f30ef6893","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.139765Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:985c51034a2dcb40e8f87a4d375e816878e963a3b266f476f405f38d3a32cf1a","observation_id":"d42b35fc-e772-4623-acb2-cb93084164b8","resolution":{"observed_at":"2026-08-16T00:21:13.703045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.144832Z","title":"Helios: Real real-time long video generation model.arXiv preprint arXiv:2603.04379, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.144832Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:e2f3adee62a3b11690ab74fc29153ababdb7328275a877a2370cbc150ea006f2","observation_id":"20bf3793-c4c4-4892-af18-b210139c2f30","resolution":{"observed_at":"2026-08-16T00:21:12.144832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18739","last_updated":"2026-05-19T17:46:12Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:57:03Z","title":"LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18739","snapshot_observed_at":"2026-08-16T00:21:12.149933Z","title":"Longlive-2.0: An nvfp4 parallel infrastructure for long video generation.arXiv preprint arXiv:2605.18739, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.149933Z"},"links":{"cited_paper":"/paper/2605.18739","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:83b3a2ec0234c463df0923ce0d06bf647527e16bfe815918c618685be3789caa","observation_id":"e9eff270-f3c1-47d5-ac4f-304309c95a4a","resolution":{"observed_at":"2026-08-16T00:21:12.149933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07823","last_updated":"2026-04-14T22:09:01Z","snapshot_observed_at":"2026-08-12T18:55:29.657974Z","submitted_at":"2026-04-09T05:26:09Z","title":"LPM 1.0: Video-based Character Performance Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07823","snapshot_observed_at":"2026-08-16T00:21:12.155161Z","title":"Lpm 1.0: Video-based character performance model.arXiv preprint arXiv:2604.07823, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.155161Z"},"links":{"cited_paper":"/paper/2604.07823","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:d4d68a5e318e5fb3be001d7cd4563c919e5eb00fe689df6edf30cf1146dece4d","observation_id":"f36093aa-6eb9-4129-a7a4-3c65de403f76","resolution":{"observed_at":"2026-08-16T00:21:12.155161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.160212Z","title":"Soulx-flashtalk: Real-time infinite streaming of audio-driven avatars via self-correcting bidirectional distillation.arXiv preprint arXiv:2512.23379, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.160212Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a4ff97fc2d476b801064efc32a63c44c93b457fe3aa8b358256b0534d60722ff","observation_id":"9e44b0d0-da37-4eee-b5c2-b1d572d05ea7","resolution":{"observed_at":"2026-08-16T00:21:12.160212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02283","last_updated":"2025-10-02T17:55:42Z","snapshot_observed_at":"2026-08-13T04:00:21.942422Z","submitted_at":"2025-10-02T17:55:42Z","title":"Self-Forcing++: Towards Minute-Scale High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02283","snapshot_observed_at":"2026-08-16T00:21:12.164936Z","title":"Self-forcing++: Towards minute-scale high-quality video generation.arXiv preprint arXiv:2510.02283, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.164936Z"},"links":{"cited_paper":"/paper/2510.02283","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:22728c5bb91f029d5bd86f72fb798b020f1c8159a12cea8995a51f8c836028de","observation_id":"96efb50d-98b5-4749-b213-c292a111abba","resolution":{"observed_at":"2026-08-16T00:21:12.164936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14033","last_updated":"2025-08-19T17:55:23Z","snapshot_observed_at":"2026-08-18T04:45:00.241729Z","submitted_at":"2025-08-19T17:55:23Z","title":"InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14033","snapshot_observed_at":"2026-08-16T00:21:12.170183Z","title":"Infinitetalk: Audio-driven video generation for sparse-frame video dubbing.arXiv preprint arXiv:2508.14033, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.170183Z"},"links":{"cited_paper":"/paper/2508.14033","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:c77c9612859db73179d8e6adb79bb28427429d216d15f951cb87ca79f5b01387","observation_id":"7f8f4b10-de11-45d0-8722-507d9acc7dfd","resolution":{"observed_at":"2026-08-16T00:21:12.170183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04677","last_updated":"2026-07-31T10:43:50Z","snapshot_observed_at":"2026-08-13T11:03:16.956715Z","submitted_at":"2025-12-04T11:11:24Z","title":"Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.04677","snapshot_observed_at":"2026-08-16T00:21:12.175287Z","title":"Live avatar: Streaming real-time audio-driven avatar generation with infinite length.arXiv preprint arXiv:2512.04677, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.175287Z"},"links":{"cited_paper":"/paper/2512.04677","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:da652a810a2b86a2b1d495b7cef78bf7eebeb3485792bea29bfbc17be4e13ab6","observation_id":"86f23342-35e0-4206-9ea2-62d1a78b32b6","resolution":{"observed_at":"2026-08-16T00:21:12.175287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.682201Z","title":"Style transfer for 2d talking head generation","venue":null,"work_id":"9a28277f-d52c-4fc9-bcbf-c82eaa3aed98","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.180388Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:cf7ac6bea6d766043b75e7e51479ddc713f00cdf6ec4fae525e045bec84705e0","observation_id":"a7c37c01-35c7-4189-aa1d-9d0e8f35c80a","resolution":{"observed_at":"2026-08-16T00:21:13.687449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.666922Z","title":"Disentangledandcontrollablefaceimagegeneration via 3d imitative-contrastive learning","venue":null,"work_id":"112dad55-f272-411d-8c93-bdc960ca3ac2","year":2020},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.184975Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ef18e279d2ccf4babad2648c0930959db50a85d2d2385428107ce9d437bd3b80","observation_id":"20795f95-83ad-41ad-8dfd-a348fa910f9b","resolution":{"observed_at":"2026-08-16T00:21:13.671952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.189441Z","title":"Capture, learning, and synthesis of 3d speaking styles","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.189441Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:cbe8e9cfaba575a8966edd8bcbfef364d669170104133e259fd167643b583b72","observation_id":"1e4d0bfc-b0b0-4729-a4e7-86fac01d7642","resolution":{"observed_at":"2026-08-16T00:21:12.189441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.639221Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"ccb239a0-96e8-4c4d-b3ab-223a05bfc122","year":2020},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.194118Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a02b43837d5c78a3cae6c3efe5ff2d6e4c98906ce8e4c72e32fa8e0d345e1c6a","observation_id":"d2aaee70-5473-4139-8e8e-682d813f32b4","resolution":{"observed_at":"2026-08-16T00:21:13.645011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.621724Z","title":"Dreamavatar: Text-and-shape guided 3d human avatar generation via diffusion models","venue":null,"work_id":"4a397f7a-d6e8-4c52-8f9f-ba4ebd78a524","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.198723Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ecebf691996efced60b86ef8addbe47d3302fa2348fdc091ecf246bdb7271616","observation_id":"eb470aa7-d2f7-468e-8299-0bd0f347a809","resolution":{"observed_at":"2026-08-16T00:21:13.627224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.605415Z","title":"Latentavatar: Learninglatentexpressioncodeforexpressiveneuralheadavatar","venue":null,"work_id":"d1dde2b2-471f-408d-b691-c444b9f09f3a","year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.203513Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3cac1e89f0858d329060c74604f1693dba6dbe56463923c308a0fb7e8584edb2","observation_id":"1b572d5c-2d21-4821-ba3f-d7cd1d486aca","resolution":{"observed_at":"2026-08-16T00:21:13.610490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.588387Z","title":"Denoisingdiffusionprobabilisticmodels.Advancesinneuralinformation processing systems, 33:6840–6851, 2020","venue":null,"work_id":"827e64b7-4519-4109-8aca-03f06c9d36fe","year":2020},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.208581Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:29f0cd1398a798722bcc4dc1e0bfdd64473c1e92bbabc9728c94d454f6783140","observation_id":"1f82974d-2bf1-4f9f-b5f5-360f2038fcbd","resolution":{"observed_at":"2026-08-16T00:21:13.593784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-16T00:21:12.213693Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.213693Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:db20593ac2782e9ee9b7ca3dd8b2883dfba76d33c032444a523131fcd9d2fd23","observation_id":"0c0782c3-3df7-413e-8ce3-2a88e6fdced6","resolution":{"observed_at":"2026-08-16T00:21:12.213693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.218419Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.218419Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:50a02510d5180ab8bbf4700d651d34a426c04134cfb57d98a05e402c5f428218","observation_id":"5138590f-5e18-45a2-a2dc-a08aebe60401","resolution":{"observed_at":"2026-08-16T00:21:12.218419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.562300Z","title":"Difftalk: Crafting diffusion models for generalized audio-driven portraits animation","venue":null,"work_id":"1d8d00ce-74e9-4d5d-9fc9-6d1e62d4f8c1","year":1982},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.222740Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:7a116ccfb614c38931ce6ca4aa84b366410af5b0eeadfc0595ade1aced52846d","observation_id":"8fd17803-5805-4049-bec2-d69e2882cad5","resolution":{"observed_at":"2026-08-16T00:21:13.567513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-08-18T10:23:27.377504Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-16T00:21:12.227373Z","title":"Hallo: Hierarchical audio-driven visual synthesis for portrait image animation.arXiv preprint arXiv:2406.08801, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.227373Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:67c9c9664b8141d1ffea160a3f3bd576b0d7385d44cf388bfcefa041f6a2ad1f","observation_id":"17c45409-c629-412d-be9b-6d1f7be09bc5","resolution":{"observed_at":"2026-08-16T00:21:12.227373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17694","last_updated":"2024-03-26T13:35:02Z","snapshot_observed_at":"2026-08-18T10:29:36.587877Z","submitted_at":"2024-03-26T13:35:02Z","title":"AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17694","snapshot_observed_at":"2026-08-16T00:21:12.231872Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animation.arXiv preprint arXiv:2403.17694, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.231872Z"},"links":{"cited_paper":"/paper/2403.17694","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:df3a8c4505a08badfe8a1858c2976af3125e7f239141fa80650b857f1995028a","observation_id":"1b2d76ed-79bb-4259-85b8-49a434c4dc5c","resolution":{"observed_at":"2026-08-16T00:21:12.231872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08136","last_updated":"2024-07-12T02:41:51Z","snapshot_observed_at":"2026-08-17T16:30:00.213972Z","submitted_at":"2024-07-11T02:26:51Z","title":"EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08136","snapshot_observed_at":"2026-08-16T00:21:12.236636Z","title":"Echomimic: Lifelike audio-driven portrait animations through editable landmark conditioning.arXiv preprint arXiv:2407.08136, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.236636Z"},"links":{"cited_paper":"/paper/2407.08136","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:6ccdf5a95d58f570ce10d4b86ece8946e1a59d075d48fe2bbd3f5f959a5ec811","observation_id":"9aca3269-b7df-4d30-9a35-692ee4781302","resolution":{"observed_at":"2026-08-16T00:21:12.236636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-08-18T19:56:03.713377Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-16T00:21:12.241690Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.241690Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:2843690b329284c26f06029a59a64a658908abc9c1c5a688767aa0df7aaacf55","observation_id":"5b7568ba-9217-44e8-88be-f4c2c46d83ce","resolution":{"observed_at":"2026-08-16T00:21:12.241690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.546272Z","title":"Video generation models as world simulators","venue":null,"work_id":"32f05f11-e284-4c29-83c7-ce1cb29dbab7","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.247704Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3e9985ec40c99628ae6547cca51015d1a76198cb01aeb286fc050e4774e8d9fa","observation_id":"c7a1b3da-b90e-4b8b-bc53-12ef7590362d","resolution":{"observed_at":"2026-08-16T00:21:13.551489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.530336Z","title":"Freeman, and Taesung Park","venue":null,"work_id":"66e3060a-fce9-44ca-88ec-73a3004eed98","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.252293Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:8a0565c2fa8aa594173c6726c5552d430b7ee2889c1635084985702378de858a","observation_id":"a5f19dca-31fa-47f0-920b-43afb5f6df00","resolution":{"observed_at":"2026-08-16T00:21:13.535426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14867","last_updated":"2024-05-24T17:08:32Z","snapshot_observed_at":"2026-08-19T20:05:57.346957Z","submitted_at":"2024-05-23T17:59:49Z","title":"Improved Distribution Matching Distillation for Fast Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14867","snapshot_observed_at":"2026-08-16T00:21:12.257149Z","title":"Freeman, and Taesung Park","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.257149Z"},"links":{"cited_paper":"/paper/2405.14867","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:e5e74a7b6346302362746480f94bdc7c5e166e01f4c7d8acdb655f33af26ee27","observation_id":"d4754a20-ae4e-4f10-99f0-9dd07f957558","resolution":{"observed_at":"2026-08-16T00:21:12.257149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.514287Z","title":"Adversarial diffusion distillation","venue":null,"work_id":"4e63769d-29bb-458a-9f3c-8bea3204d27b","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.262291Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:49d4add8656ccbb073be006766a815baecaf03eb297ba678cbe3b003b5369064","observation_id":"ed2c87ef-4e9a-44bb-b312-fd1dd2300fef","resolution":{"observed_at":"2026-08-16T00:21:13.519277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-08-20T13:49:06.053430Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-16T00:21:12.266993Z","title":"Latent consistency models: Synthesizing high-resolution images with few-step inference.arXiv preprint arXiv:2310.04378, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.266993Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ea319e8ab23a5fd277dbe49bb305ab683f4422f14d759001d1374cc092081ada","observation_id":"9317226e-16d5-4697-95ce-17057e92034b","resolution":{"observed_at":"2026-08-16T00:21:12.266993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.497858Z","title":"Phased consistency models","venue":null,"work_id":"245a0233-36d8-4049-ac47-7349bd2751fb","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.272001Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:dd5e791c33556076d3f8c2b3131b6f76fbe1e17863a4a2581d8a2bc83a69106a","observation_id":"27550522-1b35-4bc6-848e-61eaf90c7e27","resolution":{"observed_at":"2026-08-16T00:21:13.502786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03139","last_updated":"2026-05-19T12:34:41Z","snapshot_observed_at":"2026-08-14T18:45:39.954413Z","submitted_at":"2026-02-03T05:45:25Z","title":"Diversity-Preserved Distribution Matching Distillation for Fast Visual Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.03139","snapshot_observed_at":"2026-08-16T00:21:12.276476Z","title":"Diversity-preserveddistributionmatchingdistillationforfastvisual synthesis.arXiv preprint arXiv:2602.03139, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.276476Z"},"links":{"cited_paper":"/paper/2602.03139","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:bddd5b84f485dc5c4312ac3d497c2e347aff7e28885968786f90010c68451708","observation_id":"9a423730-100a-4d15-bef0-c949c03d51b8","resolution":{"observed_at":"2026-08-16T00:21:12.276476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-15T15:02:59.826496Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-16T00:21:12.281657Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.281657Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3bce94243a30e440ab78648cdc4a636b28da071932e6d9652690609b4a97e48a","observation_id":"3ac0be64-ce07-488f-b185-4f423d656b90","resolution":{"observed_at":"2026-08-16T00:21:12.281657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10103","last_updated":"2026-04-28T08:33:18Z","snapshot_observed_at":"2026-08-18T01:13:11.751860Z","submitted_at":"2026-04-11T08:54:07Z","title":"Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.10103","snapshot_observed_at":"2026-08-16T00:21:12.287157Z","title":"Long-horizon streaming video generation via hybrid attention with decoupled distillation.arXiv preprint arXiv:2604.10103, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.287157Z"},"links":{"cited_paper":"/paper/2604.10103","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:54faece47181888201912e84b37e3801e5193a54372b8b89ec6c3f1daf5a25e9","observation_id":"38fc14af-b7b2-403b-8769-03738a8c4d4a","resolution":{"observed_at":"2026-08-16T00:21:12.287157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25161","last_updated":"2025-09-29T17:57:14Z","snapshot_observed_at":"2026-08-09T09:15:39.740119Z","submitted_at":"2025-09-29T17:57:14Z","title":"Rolling Forcing: Autoregressive Long Video Diffusion in Real Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25161","snapshot_observed_at":"2026-08-16T00:21:12.292341Z","title":"Rolling forcing: Autoregressive long video diffusion in real time.arXiv preprint arXiv:2509.25161, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.292341Z"},"links":{"cited_paper":"/paper/2509.25161","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:564a0ee1eee32ed264dbe14ad7bfabd18211bd43b6a7d1b730d77c5c3beb808a","observation_id":"125da127-580f-4c48-9cb4-a5602e9cfad1","resolution":{"observed_at":"2026-08-16T00:21:12.292341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18866","last_updated":"2025-06-23T17:33:03Z","snapshot_observed_at":"2026-08-20T08:51:50.797362Z","submitted_at":"2025-06-23T17:33:03Z","title":"OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18866","snapshot_observed_at":"2026-08-16T00:21:12.297641Z","title":"Omniavatar: Efficient audio-driven avatar video generation with adaptive body animation.arXiv preprint arXiv:2506.18866, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.297641Z"},"links":{"cited_paper":"/paper/2506.18866","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:4a252d3259d989adec347171610a869628de66deb907c93abede6b2cd89c66c9","observation_id":"0343a79b-8544-47a7-97d1-105b4e95489e","resolution":{"observed_at":"2026-08-16T00:21:12.297641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20156","last_updated":"2025-06-03T15:15:31Z","snapshot_observed_at":"2026-08-19T03:06:29.083756Z","submitted_at":"2025-05-26T15:57:27Z","title":"HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20156","snapshot_observed_at":"2026-08-16T00:21:12.302668Z","title":"Hunyuanvideo-avatar: High-fidelity audio-driven human animation for multiple characters.arXiv preprint arXiv:2505.20156, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.302668Z"},"links":{"cited_paper":"/paper/2505.20156","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:1213371d5ad3f6487a44b2924cc118c009245b1aa0efac4f835e86f42e39de92","observation_id":"08990fbb-5c71-46f1-bfd7-354b05afb300","resolution":{"observed_at":"2026-08-16T00:21:12.302668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.481024Z","title":"Evaluating prerequisite qualities for learning end-to-end dialog systems, 2016","venue":null,"work_id":"09a60ea2-e51e-45a3-9176-0a6f6931c7eb","year":2016},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.307628Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a593f68f959e24971b0513cba12ac4ef3d92f566516e99f9f60b58e890186006","observation_id":"0152f6cf-3747-4f1c-b86b-5c67c7b6f478","resolution":{"observed_at":"2026-08-16T00:21:13.486572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.465476Z","title":null,"venue":null,"work_id":"b946115b-d393-424f-bad5-6932e40cf8bb","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.312343Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:e4b63fdf1f4467248cc042d295e89e53cb22d6bf2c6c852a861cd5664dded65a","observation_id":"efa924e2-d089-488b-a4d6-8348cfc93c8e","resolution":{"observed_at":"2026-08-16T00:21:13.470285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.316501Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.316501Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:b80a64bad9da772f02fb1179b8b3a3dd242d9cf10a74a2eef69d2a5a0687d34c","observation_id":"b8c68e1a-69f6-481a-8621-f2ff52c058ae","resolution":{"observed_at":"2026-08-16T00:21:12.316501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.438243Z","title":"Large- scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation","venue":null,"work_id":"c8065788-912c-4103-8bb7-6a139d5f6b35","year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.320678Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a811bfbfde1d683a5384809963344e72ddbca12effd03655d71d6c75ded42390","observation_id":"09082a70-3b25-4f36-8902-db0ba61286fb","resolution":{"observed_at":"2026-08-16T00:21:13.443117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-08-20T00:42:38.595341Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-08-16T00:21:12.325127Z","title":"Unified reward model for multimodal understanding and generation.arXiv preprint arXiv:2503.05236, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.325127Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:de0d3756a006307a3d828e2c18f3d131dc3012d8f537f4b93d31072250116627","observation_id":"3eebf83b-8724-4865-8117-9d00d1ef082d","resolution":{"observed_at":"2026-08-16T00:21:12.325127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.422383Z","title":"Gemini 3.5 flash","venue":null,"work_id":"ad9ecac3-1917-45bf-b20e-0d64d9c0183a","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.329523Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ac97ab97309f1d6069fb93148dc02c0eef727877ecf22b3ad4b59b13cd12bf75","observation_id":"cdb83860-187a-47b5-b690-9d7ac1c4cd0b","resolution":{"observed_at":"2026-08-16T00:21:13.427426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.406124Z","title":"Lora: Low-rank adaptation of large language models.Iclr, 1(2):3, 2022","venue":null,"work_id":"3b4c7781-f913-43a4-afd0-900ebcc30492","year":2022},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.333634Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:903dc54f889d5f3d708023253e077d3f4c1f0a5ddc3cf2ce2c5c4c86053b23f2","observation_id":"852ac723-d1cc-4591-9d32-879c5d6c9596","resolution":{"observed_at":"2026-08-16T00:21:13.411140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.388918Z","title":"Talkvid: A large-scale diversified dataset for audio-driven talking head synthesis","venue":null,"work_id":"c3335f9c-16c4-43a5-a54a-0faae22014b4","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.338605Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a3d308bee1d3c9c2dd11bc2b5ffd559f9904e91324a7231a40a2948a6d3dc274","observation_id":"6ec32269-823b-431c-ab8e-67288dc46b4e","resolution":{"observed_at":"2026-08-16T00:21:13.394868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.343399Z","title":"Echomimicv2: Towards striking, simplified, and semi-body human animation.arXiv preprint arXiv:2411.10061, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.343399Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3f6143961a20ae22599709c328cde428490bfda8346f2fb44f9c901176c9f933","observation_id":"b4d2fa8f-271a-4e50-ae96-76768cf8b6a7","resolution":{"observed_at":"2026-08-16T00:21:12.343399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.371617Z","title":"audio_visual_consistency","venue":null,"work_id":"0e81605f-cbd5-4b63-8c39-adef7446f5d3","year":2021},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.348163Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:8e388e7b192c50830d059806e385d32477cde187a24d09218429ef78e2c4f431","observation_id":"e136beb3-fdc4-49eb-bcd6-a4b75e9685c3","resolution":{"observed_at":"2026-08-16T00:21:13.377783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-22T12:59:18.379935Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2608.12107."}