{"as_of":"2026-08-18T04:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fea2671cbf191bf76c14e9f2e8e83cfdc7158a4da258d8232b1a30df3ba92d55","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T22:42:31.529313Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03964/citation-record","integrity":"/paper/2607.03964/integrity","json":"/paper/2607.03964/citation-record.json","paper":"/paper/2607.03964"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:b0548ca2b7df7f944fa4b207301692eefb442c69e2aa641db5788b1c5f025a01","observation_id":"0b4086ac-1b3d-45f8-8ac0-af023b4e6fc9","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18870","last_updated":"2025-11-25T02:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T08:22:07Z","title":"HunyuanVideo 1.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.18870","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Hunyuanvideo 1.5 technical report.arXiv preprint arXiv:2511.18870, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2511.18870","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:392cecba66e7d4a3c9e35879a6e57d8aa1821be39b8bf99199edf0f5c3013204","observation_id":"713685f0-0768-4bc2-abdd-126c5f9b0bb2","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:7a9ee6443824d249b305cada5da8f2047ff7813b76e59ee30f455eb94a9388d7","observation_id":"d216fdb6-9a81-4786-8b2d-5d7fb0e88706","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Understanding world or predicting future? a comprehensive survey of world models.ACM Computing Surveys, 58(3):1–38, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:80cdd0c4f1ca2fec267e6cf4c8d0ca629f2e3bd42a6571d90ec0a6b0c7a9707e","observation_id":"aec85767-4cec-46ae-8a81-2a6490e9960b","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Gigaworld-0: World models as data engine to empower embodied ai.arXiv preprint arXiv:2511.19861, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:a168b1e72ee0dce1daf86fdba677e9823becc6a13c3bf4636ace3b7596f988d1","observation_id":"61b89b2c-4a51-40bd-a711-b9f210da6298","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:9b9042ef0a11c0aaea071d7fe5be08ac09e1ee95733a2686280c5fd44177cab3","observation_id":"f664b062-935a-4ff8-9fba-85ca613271dc","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13009","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model.arXiv preprint arXiv:2508.13009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2508.13009","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:23363bad119b49020863c9c8c9f7a70b863eaf2a7c5edd65de34a00ce08ddfd3","observation_id":"d3539834-cc0f-4e3c-a3a2-9fc77528685a","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-08-13T14:43:54.028587Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08995","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Matrix-game 3.0: Real-time and streaming interactive world model with long-horizon memory.arXiv preprint arXiv:2604.08995, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2604.08995","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:046c57ebf6b290c262712562c8c4eb02c488d1e521c62257c4a9ac31ba91ccaf","observation_id":"5cc7477b-ea41-443a-90ae-96e93f396235","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18701","last_updated":"2025-06-23T14:40:49Z","snapshot_observed_at":"2026-08-13T01:07:40.530562Z","submitted_at":"2025-06-23T14:40:49Z","title":"Matrix-Game: Interactive World Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18701","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Matrix-game: Interactive world foundation model.arXiv preprint arXiv:2506.18701, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2506.18701","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:801beb5e258b18651ecef24dcebe4a884410ced5245473387b018b27be253103","observation_id":"c38dd666-f8a0-43f3-b671-c2106f59734f","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-14T16:23:20.854858Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14614","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Worldplay: Towards long-term geometric consistency for real-time interactive world modeling.arXiv preprint arXiv:2512.14614, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2512.14614","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:ba196de25fad202a21ada43001032a6443ea0b15df88dec10aafd2ed28090b47","observation_id":"779477c4-27ef-4f96-98b5-b50279587fc7","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14268","last_updated":"2026-04-15T17:59:17Z","snapshot_observed_at":"2026-08-12T17:33:25.813833Z","submitted_at":"2026-04-15T17:59:17Z","title":"HY-World 2.0: A Multi-Modal World Model for Reconstructing, Generating, and Simulating 3D Worlds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14268","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Hy-world 2.0: A multi-modal world model for reconstructing, generating, and simulating 3d worlds.arXiv preprint arXiv:2604.14268, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2604.14268","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:b396ddc471b53b53b8926a1505aaa0fc04a6332205cae2105534106043b4dbf6","observation_id":"be78357e-501c-42b6-b3c8-f32d25a34194","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10125","last_updated":"2026-03-01T08:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T09:13:10Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.10125","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Ctrl-world: A controllable generative world model for robot manipulation.arXiv preprint arXiv:2510.10125, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2510.10125","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:b0aa9a3ff23d578faa921b3dc1c4814dfbf8cf34a1bf7dc369aab54595d8d173","observation_id":"e338d536-6a5b-412f-b1d7-4c0eaf18b924","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00062","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"World simulation with video foundation models for physical ai.arXiv preprint arXiv:2511.00062, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2511.00062","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:b1a8fd9269b19fb4e633ac4d106c27340676d898326e58e06e1b297c4d0889ae","observation_id":"400567b6-6133-4a8e-9be3-288d644b9e82","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Worldarena: A unified benchmark for evaluating perception and functional utility of embodied world models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:df222a90ac6eb818271b56da10f862f8e75088d4b9777c36e3e5e90c58906125","observation_id":"52d25937-3aee-4447-adb1-f889cc5409c7","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Hand2world: Autoregressive egocentric interaction generation via free-space hand gestures.arXiv preprint arXiv:2602.09600, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:e24bc12c76f50d402f0c24da193f0044b3e5374f7a2c991396ff9bb4434b44ba","observation_id":"85515c64-292e-4a67-bf31-606495093bf1","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Generated reality: Human-centric world simulation using interactive video generation with hand and camera control.arXiv preprint arXiv:2602.18422, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:9e7c36b5dbada4030b6958617809bae7a55a108cc5c81fbac79fa64f30aa6394","observation_id":"ed1a2964-0a9c-4ab9-a0d9-b84d422e297c","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-08-16T00:52:41.730888Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Stereo magni- fication: Learning view synthesis using multiplane images.arXiv preprint arXiv:1805.09817, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:c4aef0c38d7c5f4a9aa63779173a4c799a1818d288d6b1c76b52f9c634457385","observation_id":"93141c7b-a1ff-49d7-b789-35732ae5c4ff","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:ba0608225b8f39159b68a1d435fc3629cc6169fe3e1db4b1615d93ffe8163f2f","observation_id":"43408b0d-437c-4ce0-907d-7c18663b5c7f","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03941","last_updated":"2026-05-06T03:38:55Z","snapshot_observed_at":"2026-08-01T17:24:01.202701Z","submitted_at":"2026-05-05T16:30:03Z","title":"iWorld-Bench: A Benchmark for Interactive World Models with a Unified Action Generation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03941","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"iworld-bench: A benchmark for interactive world models with a unified action generation framework.arXiv preprint arXiv:2605.03941, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2605.03941","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:11ac901abce8c441ff99ef0ca8521a45723f0d25f2bc31f1ae9d1435bc5c4d3f","observation_id":"02da2ea4-04f5-4372-963f-84cddfcd05a9","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Sekai: A video dataset towards world exploration.arXiv preprint arXiv:2506.15675, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:30c0d33aee8722b28992ad2f36ebee1189c2d1a170c95bacb9bb60c16a429269","observation_id":"f7a64def-198f-4a9e-9ba0-71f093f0daa7","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Spatialvid: A large-scale video dataset with spatial annotations.arXiv preprint arXiv:2509.09676, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:13228fd8597f9fc1afadbcf83ae6b0e3f918317d7e26c32edfd803b95ba5aeda","observation_id":"1ce94bd8-79ec-4d58-a143-b41dc2b1f96b","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-08-14T06:25:22.731553Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Vipe: Video pose engine for 3d geometric perception.arXiv preprint arXiv:2508.10934, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:e5b32ef98c3db856fee765e443abc6a3729c5083aea984b34ab6b032abb501cc","observation_id":"f03ed958-acec-4046-9f5b-a3ccd858fc16","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Robotwin: Dual-arm robot benchmark with generative digital twins","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:1fe678cdf307642bbe8fdcd39aa53c18ab37cd56bda0e25e35fe912c3cca4472","observation_id":"3dec1557-3b45-4cd7-856c-e242963b777a","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Robotwin 2.0: A scalable data generator and benchmark with strong domain randomization for robust bimanual robotic manipulation.arXiv preprint arXiv:2506.18088, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:3a11e8c9b767f9f0eeb85eb17989fa863d64354f546647c807f1fa4f57da121d","observation_id":"3518406e-154c-4edf-a43a-e06754d7e317","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-16T18:58:56.056540Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Seedance 2.0: Advancing video generation for world complexity.arXiv preprint arXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:ff59c02ac8f073ec255650136fa14b430a8a2a825f86bbf2e13ef381d98eacd6","observation_id":"b9a66042-2bc0-44b6-a58b-79cf79346677","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Qwen3.6-Plus: Towards real world agents, April 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:743b9fd4729ab8333479376d61f77e652233de319c0d65dcd1c73c3b943d459d","observation_id":"7a83f413-bfcb-43f0-9488-c68adaba831a","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03310","last_updated":"2023-10-14T15:52:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T23:32:26Z","title":"LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03310","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning.arXiv preprint arXiv:2306.03310, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2306.03310","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:54b5233d74f10a38a6c4940896efee5c6508dff5eb40b187524fb410ea16aa82","observation_id":"55cbb9c8-861f-468b-82de-c94ba676aef6","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11709","last_updated":"2026-03-09T06:44:42Z","snapshot_observed_at":"2026-08-12T03:35:51.024147Z","submitted_at":"2025-05-16T21:34:47Z","title":"EgoDex: Learning Dexterous Manipulation from Large-Scale Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11709","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Egodex: Learning dexterous manipulation from large-scale egocentric video.arXiv preprint arXiv:2505.11709, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2505.11709","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:a98963cb3d80b242e0d4ec1795aa780e5c6af7841e9beb3b2d10e36151e6ca51","observation_id":"ea6ab282-5884-484a-9624-2b7bfa29e033","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:801d852cdc0feeb8920ce10474ba4c6c76a2750b777773024a03cc63ea857d56","observation_id":"8b3472a2-77da-4124-ac60-049718d8f22d","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Reconstructing hands in 3d with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:2f374a5f30deb362c2a3134796e94855cd0102a70281a5c46df8ed5d10710dc7","observation_id":"9175c8e8-7eee-4032-998b-bed2ee06a7b5","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14492","last_updated":"2025-04-01T21:14:20Z","snapshot_observed_at":"2026-08-16T12:48:53.261368Z","submitted_at":"2025-03-18T17:57:54Z","title":"Cosmos-Transfer1: Conditional World Generation with Adaptive Multimodal Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14492","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Cosmos-transfer1: Conditional world generation with adaptive multimodal control.arXiv preprint arXiv:2503.14492, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2503.14492","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:3f2660ba867af16887a2ff98bd0ce21e24e6a5d698f9bdd90ed6da38498a51c3","observation_id":"1452d2f7-5f44-4469-9bff-9ac11d4998d7","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Cameractrl: Enabling camera control for video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:37e191507e9d0eb134d096eee80060007969eee9878af1090c7ac5878d3546e6","observation_id":"2e5afe1e-df47-4b59-88d7-12cf58c5d348","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:46e1334d3080b93029c5f22ac085cb62b97700cbccc925233c3061cdfc8e29c6","observation_id":"0fc17834-4be5-452c-b867-5e64699a85d1","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-08-16T13:07:25.626052Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Cami2v: Camera-controlled image-to-video diffusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:08afc791c810f6cb72e49ac210f8ee8fa5c463e8a029d7897ac48a4b4cba82ac","observation_id":"4fd69936-7f3e-41ea-930f-e85b26ad3a84","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Realcam-i2v: Real-world image-to-video generation with interactive complex camera control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:23fc9e2bac073dec494f98a5dfcb125bab00d1eb673706b77eb8e017a96e2486","observation_id":"3a40cf11-5925-4da6-9e3f-e723cb2536db","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Videox-fun: A flexible framework for video generation at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:e5a6315c45492365e66b43f6f0f1df9f78eca1fd5360068afd0e0040d87a9ed6","observation_id":"af75196a-b394-474d-a036-71f20dabffb2","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:44cc805fd39bdaf1c78dd506999a9512205a2209f1b65b64ceb32b860fd832c4","observation_id":"098b3704-9b4a-4dc7-ba9f-295dce351183","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19680","last_updated":"2025-06-27T10:06:13Z","snapshot_observed_at":"2026-08-16T13:38:51.127960Z","submitted_at":"2024-06-28T06:40:53Z","title":"MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19680","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Mimicmotion: High-quality human motion video generation with confidence-aware pose guidance.arXiv preprint arXiv:2406.19680, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2406.19680","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:5578a17b3174f549ce356725068a59afb77c56562412814398b2b7422543e797","observation_id":"a03b2586-9354-4685-a4d5-1aa24c79a6ae","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12052","last_updated":"2024-05-05T05:07:34Z","snapshot_observed_at":"2026-08-16T14:42:12.868645Z","submitted_at":"2023-11-18T10:22:44Z","title":"MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12052","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Magicpose: Realistic human poses and facial expressions retargeting with identity-aware diffusion.arXiv preprint arXiv:2311.12052, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2311.12052","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:8610760d8f2b018f13635569a0fa6b262cb2aeb5a53d081469422a84f07613b4","observation_id":"5b8a0288-61d2-40cd-9cb7-ac29163bda68","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Lome: Learninghuman-object manipulation with action-conditioned egocentric world model.arXiv preprint arXiv:2603.27449, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:195a721a119a348ec380f3347c54aa6d87c3732e7da079ef3774bf7bf0002f59","observation_id":"43ab904e-fd82-4904-860e-955755a12c3e","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Adaptive mixtures of local experts.Neural computation, 3(1):79–87, 1991","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:f7a52163191b6ddcfe67cc610bd01068282d9b5c201cfccbe2af0ddd1c982622","observation_id":"c57f85c0-dbba-4239-a3b2-96555f420350","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:721d04588641496a93596605dadd7d9e3935c79e1a9bcf6c660ddee8bceeeb28","observation_id":"1569bfac-3d8a-41ef-a2c3-4e8b84e77068","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-08-07T09:27:36.420559Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding.arXiv preprint arXiv:2006.16668, 2020","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:0d57cd73248b816184565273766c64d5414c07591e6cfcd7072c07e3567268aa","observation_id":"82f5eb89-ee90-48a7-ab2c-75755c98404a","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03961","last_updated":"2022-06-16T20:36:07Z","snapshot_observed_at":"2026-08-14T22:45:56.335948Z","submitted_at":"2021-01-11T16:11:52Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.03961","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.arXiv preprint arXiv:2101.03961, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2101.03961","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:210b7e4d941a28112b27e86be8bb939523f382990078ec59d3e948dc38916aba","observation_id":"4f9e6fc1-fa4d-4742-9e9e-f9fe3c91905a","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-08-13T15:18:04.411100Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:2ec27f7ec1474cbd8843ba8c78a374fb13d70435841d385620a2d7b0e24dd1b2","observation_id":"47ae7383-3610-4d62-9549-4df3dcaac835","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15947","last_updated":"2024-12-23T08:05:14Z","snapshot_observed_at":"2026-08-06T02:31:58.372974Z","submitted_at":"2024-01-29T08:13:40Z","title":"MoE-LLaVA: Mixture of Experts for Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15947","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Moe-llava: Mixture of experts for large vision-language models.arXiv preprint arXiv:2401.15947, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2401.15947","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:4490b8fd3317a6c061bc750d5d32df424d2bc0e96d259fe6c31d9c1e70a6056f","observation_id":"7b240004-b637-43f6-9cbf-e502be4f47e8","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Deepseek-vl2: Mixture-of-experts vision- language models for advanced multimodal understanding.arXiv preprint arXiv:2412.10302, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:df4257e9fe130986b98ca310fd4ad5a9d4c9487ac03a6ed5aa903629b9e20531","observation_id":"7416791b-bf0f-4d42-bfc8-cbe1f200a988","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12163","last_updated":"2026-04-14T00:43:23Z","snapshot_observed_at":"2026-08-12T17:07:41.210961Z","submitted_at":"2026-04-14T00:43:23Z","title":"Nucleus-Image: Sparse MoE for Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12163","snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Nucleus-image: Sparse moe for image generation.arXiv preprint arXiv:2604.12163, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"cited_paper":"/paper/2604.12163","citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:c6ef9ec41628d306f3fb63f5dbdb3b6526b0928ff15d50676a419afb9d84d89e","observation_id":"f31695f0-1df5-433f-97cc-37f6743b7d03","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Astra: General interactive world model with autoregressive denoising.arXiv preprint arXiv:2512.08931, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:54f479cc6afe0e29975549e2d0a91ad490d942d8536aac4f8d6e59fd99078158","observation_id":"08146e63-8c8d-4eda-87e7-a6d02a6d6c24","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"Wan-animate: Unified character animation and replacement with holistic replication.arXiv preprint arXiv:2509.14055, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:aaef968db8ff077bc2895421b6f789227ad9939745444b165a8df389869e661e","observation_id":"7ae4ffdf-a2a5-4619-8b3c-89f82d2750e5","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:f525c16a5409ba70b86b0d578dd772858f4eb4833088195dabf610fd5fc09a7d","observation_id":"b39771b3-7fe2-4f53-9502-226d0c2a7add","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T22:42:31.529313Z","title":"It uses a large-scale Vision 21 Transformer backbone and a Transformer decoder to regress hand parameters from a monocular RGB image","venue":null,"work_id":null,"year":2083},"citing_paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T22:42:31.529313Z"},"links":{"citing_paper":"/paper/2607.03964"},"observation_digest":"sha256:786d8c07a4e78488cac4ee3d1afd40ecdf352059a4755c156763a732702b9ec5","observation_id":"164de189-e011-47f3-9a76-a6a5ed657965","resolution":{"observed_at":"2026-07-11T22:42:31.529313Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03964","last_updated":"2026-07-04T17:45:38Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T22:12:00.834791Z","submitted_at":"2026-07-04T17:45:38Z","title":"Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2607.03964."}