{"as_of":"2026-08-21T00:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d27451e5fbacb130395851fc4c6b594f0f08a5bbc9fa029111f4f4853f50eb5b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:07:40.017607Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T00:14:27.930151Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-12T11:05:32.833113Z","title":"Diffusion 2: Dynamic 3D Content Generation via Score Composition of Orthogonal Diffusion Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18613","last_updated":"2024-12-18T21:21:07Z","snapshot_observed_at":"2026-08-20T08:18:02.465597Z","submitted_at":"2024-11-27T18:57:16Z","title":"CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T11:05:32.833113Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2411.18613"},"observation_digest":"sha256:08b89c48508e4ccf0582bb9e8f30a7b9baffcb032fbb039c677f0017d4acb2d6","observation_id":"ec7e7c1a-bcd9-4e5a-8634-0ec89c39d7da","resolution":{"observed_at":"2026-08-12T11:05:32.833113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-12T11:07:40.017607Z","title":"Diffusion²: Dynamic 3d content generation via score composition of orthogonal diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18673","last_updated":"2025-05-06T13:11:14Z","snapshot_observed_at":"2026-08-16T08:18:45.331169Z","submitted_at":"2024-11-27T18:49:13Z","title":"AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers","version":4},"reference_index":169,"source":"pdf_text","source_observed_at":"2026-08-12T11:07:40.017607Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2411.18673"},"observation_digest":"sha256:4d53c280f98534855ecbf48b72a983010cfbdfffe6cb1c52a7236e65303276cb","observation_id":"e529a6a7-9fe4-4513-8601-71bcb0b02dd0","resolution":{"observed_at":"2026-08-12T11:07:40.017607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-11T17:26:29.161936Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09043","last_updated":"2024-12-12T08:10:31Z","snapshot_observed_at":"2026-08-16T11:10:59.137650Z","submitted_at":"2024-12-12T08:10:31Z","title":"DrivingRecon: Large 4D Gaussian Reconstruction Model For Autonomous Driving","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:29.161936Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2412.09043"},"observation_digest":"sha256:4796d41bfe99c3849f1eb66786958c280b359ad48b171b8ee9013750c502909a","observation_id":"ef519cdb-4db8-4d9a-a919-b40b0f38039c","resolution":{"observed_at":"2026-08-11T17:26:29.161936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-11T14:21:06.484897Z","title":"Diffusion 2: Dynamic 3D content generation via score composi- tion of orthogonal diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12091","last_updated":"2025-04-26T13:48:44Z","snapshot_observed_at":"2026-08-20T14:03:46.187786Z","submitted_at":"2024-12-16T18:58:17Z","title":"Wonderland: Navigating 3D Scenes from a Single Image","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-11T14:21:06.484897Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2412.12091"},"observation_digest":"sha256:9f9098f17fa6796ffa652ac9946bda4f455d7b2d38ca144fbb525b796555281a","observation_id":"09628f30-2422-407f-89a2-c14d2096435e","resolution":{"observed_at":"2026-08-11T14:21:06.484897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-10T22:25:55.475396Z","title":"Diffu- sion 2: Dynamic 3d content generation via score com- position of orthogonal diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01722","last_updated":"2025-01-03T09:27:36Z","snapshot_observed_at":"2026-08-15T17:05:07.009134Z","submitted_at":"2025-01-03T09:27:36Z","title":"AR4D: Autoregressive 4D Generation from Monocular Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T22:25:55.475396Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2501.01722"},"observation_digest":"sha256:7e06c25fef89552729d2805d0185e36a86a157ce3b159b35d4111d2bf71c95d1","observation_id":"2dd2a1b0-7d35-4cea-ae55-d6c32821eba2","resolution":{"observed_at":"2026-08-10T22:25:55.475396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":"2404.02148","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion 2: Dynamic 3d content generation via score composition of video and multi-view diffusion models","venue":null,"work_id":"04aebbf7-4dc2-460f-b004-88f973025012","year":2024},"citing_paper":{"arxiv_id":"2507.01099","last_updated":"2026-05-17T19:33:54Z","snapshot_observed_at":"2026-08-15T09:59:21.724087Z","submitted_at":"2025-07-01T18:01:41Z","title":"Geometry-aware 4D Video Generation for Robot Manipulation","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T00:12:39.787489Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2507.01099"},"observation_digest":"sha256:f77759a4a1cbc3b59b4583cb1ce172eae14951f2d4c0966ddec91835a9836475","observation_id":"485c2479-39b6-452b-85e4-fb7e43431184","resolution":{"observed_at":"2026-05-22T00:14:27.932836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-06T10:30:16.592938Z","title":"Diffusion 2: Dynamic 3d content generation via score composition of video and multi-view diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.592938Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:749b23823a36154737587d8d65faa09a80b953d7422747bb5671e7eb6c36eba9","observation_id":"35b2e7a4-a6c0-4936-b9ca-13f27665cb42","resolution":{"observed_at":"2026-08-06T10:30:16.592938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-06T00:02:34.692369Z","title":"arXiv preprint arXiv:2404.02148 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04467","last_updated":"2025-08-06T14:08:36Z","snapshot_observed_at":"2026-08-18T09:36:33.208605Z","submitted_at":"2025-08-06T14:08:36Z","title":"4DVD: Cascaded Dense-view Video Diffusion Model for High-quality 4D Content Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:02:34.692369Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2508.04467"},"observation_digest":"sha256:10baf98c99c08d3e45906b65e8e452378b17a5692e1be7087b0c93d783693a46","observation_id":"b31f0e2e-790f-43d2-9bd9-4903f9f3d76d","resolution":{"observed_at":"2026-08-06T00:02:34.692369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-05T22:13:13.799644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07409","last_updated":"2025-08-10T16:15:04Z","snapshot_observed_at":"2026-08-19T17:54:16.825374Z","submitted_at":"2025-08-10T16:15:04Z","title":"CharacterShot: Controllable and Consistent 4D Character Animation","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T22:13:13.799644Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2508.07409"},"observation_digest":"sha256:03408623972ed81825b87f4d8fdd2d97ab53b1e216bce8dc9288d622defcbb33","observation_id":"c8ebee01-ec70-401a-a30b-bcbe19ebc45b","resolution":{"observed_at":"2026-08-05T22:13:13.799644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-05T13:42:49.174036Z","title":"Diffusion 2: Dynamic 3d content generation via score composition of video and multi-view diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00403","last_updated":"2025-08-30T08:06:16Z","snapshot_observed_at":"2026-08-18T18:18:52.104030Z","submitted_at":"2025-08-30T08:06:16Z","title":"DevilSight: Augmenting Monocular Human Avatar Reconstruction through a Virtual Perspective","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:49.174036Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2509.00403"},"observation_digest":"sha256:45783bae2679d58582cfba69d4760e61f4039950ae2792224a8b2735cb302044","observation_id":"63c97e40-ae82-4831-92ac-52f9fb1454ae","resolution":{"observed_at":"2026-08-05T13:42:49.174036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-03T02:45:08.624991Z","title":"Diffusion 2: Dynamic 3d content generation via score composition of video and multi-view diffusion models.arXiv preprint arXiv:2404.02148, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09878","last_updated":"2026-05-26T17:06:15Z","snapshot_observed_at":"2026-08-16T10:59:13.335731Z","submitted_at":"2026-02-10T15:19:17Z","title":"MVISTA-4D: View-Consistent 4D World Model with Test-Time Action Inference for Robotic Manipulation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T02:45:08.624991Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2602.09878"},"observation_digest":"sha256:83cef9133526a6fb93fad353fdabaef638ee9f3f5ceaa361e145e263242fca20","observation_id":"d43b435f-d38a-4e9f-bfb4-c6413f003705","resolution":{"observed_at":"2026-08-03T02:45:08.624991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.02148/citation-record","integrity":"/paper/2404.02148/integrity","json":"/paper/2404.02148/citation-record.json","paper":"/paper/2404.02148"},"outbound":[],"paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T14:04:13.088918Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2404.02148."}