{"as_of":"2026-08-15T09:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b5f2111aa8e33450de17c568f29079bf9a39b9e18267179c5f283007673938a","coverage":[{"denominator":100,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:30:17.965855Z","state":"measured"},{"denominator":108,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":108,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:42:49.207199Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:38:29.386344Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-08-05T13:42:49.207199Z","title":"Gaussian vari- ation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00403","last_updated":"2025-08-30T08:06:16Z","snapshot_observed_at":"2026-08-13T08:56:30.310391Z","submitted_at":"2025-08-30T08:06:16Z","title":"DevilSight: Augmenting Monocular Human Avatar Reconstruction through a Virtual Perspective","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:49.207199Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2509.00403"},"observation_digest":"sha256:1c9ce127116c7187e42182c6792681a731c936a842064102667497066ac9daad","observation_id":"bf1675b6-1a77-417b-b711-35f3586e196d","resolution":{"observed_at":"2026-08-05T13:42:49.207199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":"2507.23785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-07-03T14:38:29.386344Z","title":"Gaussian vari- ation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":"ce28b7c4-8736-4e76-b367-7856f97b098b","year":2025},"citing_paper":{"arxiv_id":"2602.04876","last_updated":"2026-05-20T07:57:24Z","snapshot_observed_at":"2026-08-14T17:56:33.901362Z","submitted_at":"2026-02-04T18:58:55Z","title":"PerpetualWonder: Long-Horizon Action-Conditioned 4D Scene Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-21T13:26:57.909496Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2602.04876"},"observation_digest":"sha256:512c211d36fbb7fe0c0425767da765a374af3077e89ea214fd8fe076343640b9","observation_id":"88bb431e-6332-4b02-97f0-cf42829a6256","resolution":{"observed_at":"2026-05-21T13:30:12.708343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":"2507.23785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-07-03T14:38:29.386344Z","title":"Gaussian vari- ation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":"ce28b7c4-8736-4e76-b367-7856f97b098b","year":2025},"citing_paper":{"arxiv_id":"2605.04527","last_updated":"2026-05-06T06:12:19Z","snapshot_observed_at":"2026-08-13T12:20:41.457904Z","submitted_at":"2026-05-06T06:12:19Z","title":"Velox: Learning Representations of 4D Geometry and Appearance","version":1},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-05-08T17:19:58.259824Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2605.04527"},"observation_digest":"sha256:a5e7cec9da7179ca06ae2d4fd9201f681041ec4cb227f95597dd66258141e396","observation_id":"a93738b1-2833-41c8-a323-6e8047add7cc","resolution":{"observed_at":"2026-05-11T17:41:07.535051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":"2507.23785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-07-03T14:38:29.386344Z","title":"Gaussian vari- ation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":"ce28b7c4-8736-4e76-b367-7856f97b098b","year":2025},"citing_paper":{"arxiv_id":"2605.19786","last_updated":"2026-05-19T12:51:50Z","snapshot_observed_at":"2026-08-15T01:09:30.876847Z","submitted_at":"2026-05-19T12:51:50Z","title":"Fast 4D Mesh Generation by Spatio-Temporal Attention Chains","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-20T06:51:05.710817Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2605.19786"},"observation_digest":"sha256:36cf9d4f8b66d90796ea2ff709e12173adacfaf8be1e4a0117e3566b01087a97","observation_id":"21f49a8b-9835-404f-bc24-d99645a95040","resolution":{"observed_at":"2026-05-20T06:53:05.838038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":"2507.23785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-07-03T14:38:29.386344Z","title":"Gaussian vari- ation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":"ce28b7c4-8736-4e76-b367-7856f97b098b","year":2025},"citing_paper":{"arxiv_id":"2605.26109","last_updated":"2026-05-25T17:59:22Z","snapshot_observed_at":"2026-07-30T09:25:16.493692Z","submitted_at":"2026-05-25T17:59:22Z","title":"Helix4D: Complex 4D Mesh Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T22:17:54.684366Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2605.26109"},"observation_digest":"sha256:0d850b2e7aa4c8b0f92c6979927bc473085c2fcbe31856364e7a69f1bbb69c5c","observation_id":"2a6df47d-c49e-4f2f-b942-1869eb7d8600","resolution":{"observed_at":"2026-06-29T22:24:00.578249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":"2507.23785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-07-03T14:38:29.386344Z","title":"Gaussian vari- ation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":"ce28b7c4-8736-4e76-b367-7856f97b098b","year":2025},"citing_paper":{"arxiv_id":"2606.13652","last_updated":"2026-06-11T17:52:48Z","snapshot_observed_at":"2026-08-12T10:09:00.560073Z","submitted_at":"2026-06-11T17:52:48Z","title":"World Tracing: Generative Pixel-Aligned Geometry Beyond the Visible","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-27T06:56:46.694079Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2606.13652"},"observation_digest":"sha256:a73d43f530320498e5f4ce65817786c5c4a2cc23639bb419eb7659da686012ce","observation_id":"8a89ac8d-640a-4218-ad7f-a315f3d82d88","resolution":{"observed_at":"2026-07-03T14:38:29.387963Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":"2507.23785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-07-03T14:38:29.386344Z","title":"Gaussian vari- ation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":"ce28b7c4-8736-4e76-b367-7856f97b098b","year":2025},"citing_paper":{"arxiv_id":"2606.28215","last_updated":"2026-06-26T16:05:58Z","snapshot_observed_at":"2026-08-07T08:50:21.361337Z","submitted_at":"2026-06-26T16:05:58Z","title":"HAT-4D: Lifting Monocular Video for 4D Multi-Object Interactions via Human-Agent Collaboration","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T04:18:02.341742Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2606.28215"},"observation_digest":"sha256:a178627ff47050ab4883ae2e611115a8158677bc4310ab2f9231af228d899914","observation_id":"8d03971e-12b6-4dfd-90bc-8853001d67fb","resolution":{"observed_at":"2026-07-01T17:05:50.591194Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23785","snapshot_observed_at":"2026-08-01T15:09:46.551421Z","title":"video-to-4D feedforward","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18539","last_updated":"2026-07-20T22:14:03Z","snapshot_observed_at":"2026-08-14T01:13:16.232639Z","submitted_at":"2026-07-20T22:14:03Z","title":"AniGS: Bridging Rendering and Diffusion Prior for 3D Scene Animation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T15:09:46.551421Z"},"links":{"cited_paper":"/paper/2507.23785","citing_paper":"/paper/2607.18539"},"observation_digest":"sha256:7ffe8ceb0b90f87df3477a31fbe965c509eeb44f1de4b43f25d5153139b775e7","observation_id":"8a18e280-af35-4a2e-809d-c5a420f0179a","resolution":{"observed_at":"2026-08-01T15:09:46.551421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23785/citation-record","integrity":"/paper/2507.23785/integrity","json":"/paper/2507.23785/citation-record.json","paper":"/paper/2507.23785"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.088897Z","title":"4d-fy: Text-to-4d generation using hybrid score distillation sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.088897Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:81a5f74a694cc09e186e7b872b75e49e5df1fc7d930485af50ffb4a0019174f1","observation_id":"a38320a6-29e0-4612-83ca-de9fdfdcf4a1","resolution":{"observed_at":"2026-08-06T10:30:09.088897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T10:30:09.143892Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.143892Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:af34372af6dfc07a745cb7289ab64afde50526541bd48797091eb0e7b8b694ef","observation_id":"67e934eb-e8ea-47bb-9be7-cfd5c6fae33b","resolution":{"observed_at":"2026-08-06T10:30:09.143892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.204531Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.204531Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:518fbb115c18ea343f3acb5a2ef646c25c1d26baf6a2daced670453966ce0090","observation_id":"f24bd908-726a-40d2-8ac0-de0738952581","resolution":{"observed_at":"2026-08-06T10:30:09.204531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.273229Z","title":"Hexplane: A fast representa- tion for dynamic scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.273229Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:19e897bb628c6dad5625c5ab28547fdb90c3dfc6e06b758b647d3fc1da387135","observation_id":"89e53528-1a8d-4b9a-b8f5-61f4df2e5f30","resolution":{"observed_at":"2026-08-06T10:30:09.273229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.309262Z","title":"Motion2vecsets: 4d latent vector set diffusion for non-rigid shape reconstruction and tracking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.309262Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:ad364d5eba726ec88b097b847e5b6d33880059206060679077402cf4a31b4933","observation_id":"7835e152-ea43-488d-80fd-bd2ae152225b","resolution":{"observed_at":"2026-08-06T10:30:09.309262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07920","last_updated":"2023-09-15T07:56:34Z","snapshot_observed_at":"2026-08-13T10:13:26.816075Z","submitted_at":"2023-09-14T17:59:53Z","title":"Large-Vocabulary 3D Diffusion Model with Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07920","snapshot_observed_at":"2026-08-06T10:30:09.366363Z","title":"Large-vocabulary 3d diffusion model with transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.366363Z"},"links":{"cited_paper":"/paper/2309.07920","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:9dbb2d2adbcce98cabb517af2753bb548eb90834511f936254b5eb6337738dd2","observation_id":"885f6cfa-b688-4aa5-bc67-cc3812fb1e27","resolution":{"observed_at":"2026-08-06T10:30:09.366363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.465921Z","title":"Efficient geometry-aware 3d generative adversarial networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.465921Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:f4d7c1610ce760aa1720d578f091c42d72da27ddb1d4fd0c679fe59669ade9c3","observation_id":"5cb4a86c-4843-4895-861f-c26601a6e538","resolution":{"observed_at":"2026-08-06T10:30:09.465921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13873","last_updated":"2023-09-27T10:35:49Z","snapshot_observed_at":"2026-08-13T12:17:50.971831Z","submitted_at":"2023-03-24T09:30:09Z","title":"Fantasia3D: Disentangling Geometry and Appearance for High-quality Text-to-3D Content Creation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13873","snapshot_observed_at":"2026-08-06T10:30:09.572055Z","title":"Fantasia3d: Disentangling geometry and appearance for high-quality text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.572055Z"},"links":{"cited_paper":"/paper/2303.13873","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:384ff0da290690dfb5b23237cc0b5e8ce5113e65e1aa546d028649fb88652061","observation_id":"c888ddde-0908-4600-8652-94b12d6dbd0a","resolution":{"observed_at":"2026-08-06T10:30:09.572055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.646191Z","title":"Primdiffusion: V olumetric primitives diffusion for 3d human generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.646191Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:7d267e2b776503989665a1504438684d542b18e3c65c3739416877463c930172","observation_id":"e05860c2-a4e6-4dec-a77b-05da1a01394e","resolution":{"observed_at":"2026-08-06T10:30:09.646191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12957","last_updated":"2025-03-17T07:20:02Z","snapshot_observed_at":"2026-08-13T06:27:33.404551Z","submitted_at":"2024-09-19T17:59:06Z","title":"3DTopia-XL: Scaling High-quality 3D Asset Generation via Primitive Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12957","snapshot_observed_at":"2026-08-06T10:30:09.688932Z","title":"3dtopia-xl: Scaling high- quality 3d asset generation via primitive diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.688932Z"},"links":{"cited_paper":"/paper/2409.12957","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:f991cf75cf67143604f88313e3f2f59655fe8080efc97503ec4458965e26cddc","observation_id":"f6a54f3d-9548-4672-ad24-36bb0ac3f6d5","resolution":{"observed_at":"2026-08-06T10:30:09.688932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.747115Z","title":"Dynamic gaussian splatting from markerless motion capture reconstruct infants movements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.747115Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:77beb9a7422f38fbcbd414e55921e9cc331b9c3b064fd651d21875f58798e4ed","observation_id":"4138544e-24c0-4612-803f-da422166da5a","resolution":{"observed_at":"2026-08-06T10:30:09.747115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.837278Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.837278Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:aa6e57cc37ab952787c1d27825529ef71efd210c9e625a3e824390efe0016831","observation_id":"ba862383-c716-4925-91dd-ce612a848890","resolution":{"observed_at":"2026-08-06T10:30:09.837278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.893935Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.893935Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:fb20027da251f459699b99ac9ff933abc354ab6009d4c524ce41c8a52506f8df","observation_id":"053254fd-a710-4052-81b8-138c0fd698b0","resolution":{"observed_at":"2026-08-06T10:30:09.893935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:09.967325Z","title":"Gram: Generative radiance manifolds for 3d-aware image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:09.967325Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:5ae17016f90405ff5585899efbd5dc38b661a3eba908f4ec172eb0ed677137b0","observation_id":"4e88fd47-d1ae-420b-be9f-7631e3366aea","resolution":{"observed_at":"2026-08-06T10:30:09.967325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:10.014688Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.014688Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:d5d899af7e0bd68e388d50b16a35f2f49d3775e7078151d2860ec2005b54e6f7","observation_id":"a2f6d8cb-e4a4-46ba-98ed-e72ef79f077d","resolution":{"observed_at":"2026-08-06T10:30:10.014688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:10.084291Z","title":"K-planes: Explicit radiance fields in space, time, and appearance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.084291Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:913494f924ff6088a58d7b0c5a4d4009923f62bd869a67b50811616184d4a72a","observation_id":"3d7e6f41-f152-471d-a82c-7791c97975fa","resolution":{"observed_at":"2026-08-06T10:30:10.084291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11163","last_updated":"2022-09-22T17:16:19Z","snapshot_observed_at":"2026-08-13T17:47:31.054666Z","submitted_at":"2022-09-22T17:16:19Z","title":"GET3D: A Generative Model of High Quality 3D Textured Shapes Learned from Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11163","snapshot_observed_at":"2026-08-06T10:30:10.164281Z","title":"Get3d: A generative model of high quality 3d textured shapes learned from images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.164281Z"},"links":{"cited_paper":"/paper/2209.11163","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:95d9777afcc5621a632bc9ee95ace9eec7a6e360018fc0b07c220955f23653a0","observation_id":"9fb798b2-5f29-4c8f-9813-3e7ff5610ef3","resolution":{"observed_at":"2026-08-06T10:30:10.164281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:10.248599Z","title":"Factorizing text-to-video generation by explicit image conditioning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.248599Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:966cff8e0458ad30ac1fb501ab406554fe59a702dfbda6c9e242e1ad894a5a9b","observation_id":"c7a75ebb-484a-452d-8c43-631403bca5be","resolution":{"observed_at":"2026-08-06T10:30:10.248599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T10:30:10.310599Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.310599Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:a5461f323e9b632707c0fbb7bb8fed9be84c3cf08e97a7679925aff259c8b824","observation_id":"3c949698-d3be-455d-8daf-9a3bf281495c","resolution":{"observed_at":"2026-08-06T10:30:10.310599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05371","last_updated":"2023-03-27T18:04:20Z","snapshot_observed_at":"2026-08-13T12:28:14.198004Z","submitted_at":"2023-03-09T16:18:14Z","title":"3DGen: Triplane Latent Diffusion for Textured Mesh Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05371","snapshot_observed_at":"2026-08-06T10:30:10.399939Z","title":"3dgen: Triplane latent diffusion for textured mesh generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.399939Z"},"links":{"cited_paper":"/paper/2303.05371","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:1204a68c14afef11e5a1060d2edcef815263d88c68205c4128758849098ae51d","observation_id":"7ad8a02e-05cc-4402-982b-85c229ecee8e","resolution":{"observed_at":"2026-08-06T10:30:10.399939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09556","last_updated":"2024-03-11T04:01:34Z","snapshot_observed_at":"2026-08-15T09:07:20.948147Z","submitted_at":"2023-03-16T17:59:56Z","title":"Efficient Diffusion Training via Min-SNR Weighting Strategy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09556","snapshot_observed_at":"2026-08-06T10:30:10.460050Z","title":"Efficient diffu- sion training via min-snr weighting strategy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.460050Z"},"links":{"cited_paper":"/paper/2303.09556","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:78867470db392d092534e53eec83374d390a3d90cb835928f872dc4150e62679","observation_id":"d69554e3-9c7a-4a14-9770-3eb69d3d1088","resolution":{"observed_at":"2026-08-06T10:30:10.460050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12957","last_updated":"2024-07-16T15:54:46Z","snapshot_observed_at":"2026-08-13T00:50:06.051585Z","submitted_at":"2024-03-19T17:57:52Z","title":"GVGEN: Text-to-3D Generation with Volumetric Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12957","snapshot_observed_at":"2026-08-06T10:30:10.514015Z","title":"Gvgen: Text-to-3d generation with volumetric representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.514015Z"},"links":{"cited_paper":"/paper/2403.12957","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:c84a9b855406cfcc888d24c60bbc00e8d4907482058795e17cc9d7dc47db0b73","observation_id":"a7f3d501-ab3f-437e-92fc-c19fbc5b3f43","resolution":{"observed_at":"2026-08-06T10:30:10.514015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-06T10:30:10.574815Z","title":"Imagen video: High definition video generation with diffusion mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.574815Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:b33bff54b015151fa4a937921a677624233a25e67d5fa7d122dcf0565d9d2a36","observation_id":"86087511-533e-4751-8c95-90daf90df4f1","resolution":{"observed_at":"2026-08-06T10:30:10.574815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-08-06T10:30:10.672021Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.672021Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:9e34876bde9cf4d297c4cf671deb54d8fac40d3ddddd548bc041c10bcb37679e","observation_id":"752ec71e-907c-4018-9792-9c061f487ccf","resolution":{"observed_at":"2026-08-06T10:30:10.672021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:10.756325Z","title":"Sc-gs: Sparse-controlled gaussian splatting for editable dynamic scenes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.756325Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:9abb897a916aa56b0f527f8fc040060aef3645ea0fa6549d13343183107b3cc6","observation_id":"bbd94df3-5d8d-43df-af56-af4a3acc2907","resolution":{"observed_at":"2026-08-06T10:30:10.756325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14795","last_updated":"2022-03-15T22:37:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-30T17:53:34Z","title":"Perceiver IO: A General Architecture for Structured Inputs & Outputs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14795","snapshot_observed_at":"2026-08-06T10:30:10.810962Z","title":"Perceiver io: A general architecture for structured inputs & outputs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.810962Z"},"links":{"cited_paper":"/paper/2107.14795","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:86b5f3b87c58911c8a81d9f33a0a7605ad8ff375e8d9ada72bf71dcee5e295c6","observation_id":"08c04824-d78a-4bc6-830d-921b9c26e064","resolution":{"observed_at":"2026-08-06T10:30:10.810962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:10.904953Z","title":"Perceiver: General perception with iterative attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.904953Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:f981a603b4724dbd1e891862bbb581908ac47c0131ec79e89de7be1206ddc041","observation_id":"c0a2fbe5-98b8-4a79-b1a2-789b3be0623d","resolution":{"observed_at":"2026-08-06T10:30:10.904953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02848","last_updated":"2023-11-06T03:26:43Z","snapshot_observed_at":"2026-08-14T13:35:00.270778Z","submitted_at":"2023-11-06T03:26:43Z","title":"Consistent4D: Consistent 360{\\deg} Dynamic Object Generation from Monocular Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02848","snapshot_observed_at":"2026-08-06T10:30:10.983369Z","title":"Consistent4d: Consistent 360 {\\deg} dynamic ob- ject generation from monocular video","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:10.983369Z"},"links":{"cited_paper":"/paper/2311.02848","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:8fc2f21b1a57cfd0e8aaf3a4854176927dac38b397fdf9ceebcf8b77242a44ad","observation_id":"8e5d060f-6017-4539-9e78-8c5059950faa","resolution":{"observed_at":"2026-08-06T10:30:10.983369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02463","last_updated":"2023-05-03T23:59:13Z","snapshot_observed_at":"2026-08-12T18:09:04.196531Z","submitted_at":"2023-05-03T23:59:13Z","title":"Shap-E: Generating Conditional 3D Implicit Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02463","snapshot_observed_at":"2026-08-06T10:30:11.061289Z","title":"Shap-e: Generat- ing conditional 3d implicit functions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.061289Z"},"links":{"cited_paper":"/paper/2305.02463","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:0c01619559f899aaee2090161cc5ceea6d119a6e8de61fe2be87cf6582baecad","observation_id":"4155f9ee-1e5b-4a11-b7bb-29831d5f7ab7","resolution":{"observed_at":"2026-08-06T10:30:11.061289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:11.122967Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.122967Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:aa950c86fdcd2809123b9e178a21d1c77327cbc13ab74a02611e373f9c107fa6","observation_id":"9d7d3c5c-d5c4-40c3-88ec-fae2877e8226","resolution":{"observed_at":"2026-08-06T10:30:11.122967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:11.164999Z","title":"Analyzing and improv- ing the image quality of stylegan","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.164999Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:619eae339d6cb2545af58cac9198682256f718f5b3352fb14680e80deff216cb","observation_id":"591f381a-b422-41ee-9d67-fda4da751a64","resolution":{"observed_at":"2026-08-06T10:30:11.164999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:11.225330Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.225330Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:dd3686cc99e2f3c76b36db7377dfe1e02950a55397685649240654ae16b7dd33","observation_id":"d2c460c2-2504-4d8c-97e9-a5c0a5f2eaba","resolution":{"observed_at":"2026-08-06T10:30:11.225330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:11.327250Z","title":"Hunyuanvideo: A systematic framework for large video generative models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.327250Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:bcfe03a06da35029d35b65f0fc0bfb2971e017b119bce6c203e9a0367333ebf3","observation_id":"35e78d8c-ac1d-4896-ab24-f27439f0c57c","resolution":{"observed_at":"2026-08-06T10:30:11.327250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:11.382038Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.382038Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:7885089fb87e603902d47a2cc19d1db97faf623b6139e97ce1cd3bb12a430655","observation_id":"8cc89a81-b02c-4704-a4b4-2985645a731a","resolution":{"observed_at":"2026-08-06T10:30:11.382038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.438029Z","title":"Ln3diff: Scalable latent neural fields diffusion for speedy 3d generation","venue":null,"work_id":"cf704892-2540-4bcd-b03f-a5f2df7cfd38","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.441664Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:9fb4641523108b07ce62bc75bbe79adac3df601bf908c85bdb5a3e5dd27283a6","observation_id":"fe96c0b8-5a9f-4984-a40b-ffe3a1505185","resolution":{"observed_at":"2026-08-06T10:30:20.444565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09720","last_updated":"2024-01-27T06:54:18Z","snapshot_observed_at":"2026-08-13T04:40:10.034227Z","submitted_at":"2024-01-18T04:48:13Z","title":"GaussianBody: Clothed Human Reconstruction via 3d Gaussian Splatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09720","snapshot_observed_at":"2026-08-06T10:30:11.535792Z","title":"Gaussianbody: Clothed human re- construction via 3d gaussian splatting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.535792Z"},"links":{"cited_paper":"/paper/2401.09720","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:00bbd4b6aa134af27dfc98851a48f5dfd1f58d30edf256fc8a95b569be97bc2e","observation_id":"d5c25645-a339-46c3-b7a1-35155c4fb201","resolution":{"observed_at":"2026-08-06T10:30:11.535792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14979","last_updated":"2025-05-30T10:22:03Z","snapshot_observed_at":"2026-08-12T23:59:26.256718Z","submitted_at":"2024-05-23T18:30:12Z","title":"CraftsMan3D: High-fidelity Mesh Generation with 3D Native Generation and Interactive Geometry Refiner","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14979","snapshot_observed_at":"2026-08-06T10:30:11.563776Z","title":"Craftsman: High-fidelity mesh generation with 3d native generation and interactive geometry refiner","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.563776Z"},"links":{"cited_paper":"/paper/2405.14979","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:a0a2a6f953a64b42fe4acd8266aa183eadbbad85eed6550a920d9e9301df47ce","observation_id":"6fe3e04e-d3fa-42e1-9b57-b5eb4f9c8b27","resolution":{"observed_at":"2026-08-06T10:30:11.563776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16645","last_updated":"2024-05-26T17:47:34Z","snapshot_observed_at":"2026-08-14T09:37:35.917439Z","submitted_at":"2024-05-26T17:47:34Z","title":"Diffusion4D: Fast Spatial-temporal Consistent 4D Generation via Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16645","snapshot_observed_at":"2026-08-06T10:30:11.653629Z","title":"Diffusion4d: Fast spatial-temporal consis- tent 4d generation via video diffusion models.arXiv preprint arXiv:2405.16645, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.653629Z"},"links":{"cited_paper":"/paper/2405.16645","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:bfd8e75c7f1a3d2cfb1e46f148d29651084b64d5c30f62a9126e46816392b4d8","observation_id":"5bd0abfd-ecab-4be5-919b-64f56f69cb8d","resolution":{"observed_at":"2026-08-06T10:30:11.653629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.414596Z","title":"Luciddreamer: Towards high- fidelity text-to-3d generation via interval score matching","venue":null,"work_id":"3a397166-6267-4cbf-b42b-dce8e2eb7dd0","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.741610Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:6ff47b6f6991173447c359be56dbb79c456e50fd17248441d6e79a38316f0233","observation_id":"d72399e1-a862-409c-ab0f-4b72cc03c658","resolution":{"observed_at":"2026-08-06T10:30:20.426111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:11.812493Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.812493Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:39a4a7a3264f9f05eb715e78cc2bbafb22124910994af0b2372949a5dc3702ab","observation_id":"98955e07-81a2-4692-9510-5197de180329","resolution":{"observed_at":"2026-08-06T10:30:11.812493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.377332Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":"9406c1ab-1f4f-4072-9997-9434d6f33871","year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:11.925274Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:f08a859cede20dde0bbf01fd16e45b786c3dae150732a465fe947fbb20d13071","observation_id":"d88f5a08-0013-4318-a4a5-b7739f160903","resolution":{"observed_at":"2026-08-06T10:30:20.384796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09713","last_updated":"2023-08-18T17:59:21Z","snapshot_observed_at":"2026-08-13T10:32:10.871509Z","submitted_at":"2023-08-18T17:59:21Z","title":"Dynamic 3D Gaussians: Tracking by Persistent Dynamic View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09713","snapshot_observed_at":"2026-08-06T10:30:12.002299Z","title":"Dynamic 3d gaussians: Tracking by persistent dynamic view synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.002299Z"},"links":{"cited_paper":"/paper/2308.09713","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:c1e822783af84c7a0bb3298fe802f5fc4b30a835e5bf76d7bf17f5edcd7a82cd","observation_id":"f99652c7-6070-4a20-963d-dc79096d2904","resolution":{"observed_at":"2026-08-06T10:30:12.002299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:12.090362Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.090362Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:c75a154e6aaf85a2e424924b2bd36f455c82d000c36abe48e802f3b8eae7030c","observation_id":"fbd760a1-c3d3-4ede-a321-d8da8e23b987","resolution":{"observed_at":"2026-08-06T10:30:12.090362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:12.190261Z","title":"Diffrf: Rendering-guided 3d radiance field diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.190261Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:f7810eede7dcc8d9697d20001e3986beffcd9f1531e041b582315e0685107863","observation_id":"3871d4d4-699a-46c7-b4ef-45aab2754036","resolution":{"observed_at":"2026-08-06T10:30:12.190261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:12.262089Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.262089Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:cbebd447240f1981314374b48d126e83d6f2e9b1726bfab1004cb4cb7d1d2e8d","observation_id":"89d5dbb3-6119-4d60-bec2-5ab356851ef3","resolution":{"observed_at":"2026-08-06T10:30:12.262089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05445","last_updated":"2023-07-07T17:59:14Z","snapshot_observed_at":"2026-08-13T11:00:05.184752Z","submitted_at":"2023-07-07T17:59:14Z","title":"AutoDecoding Latent 3D Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05445","snapshot_observed_at":"2026-08-06T10:30:12.350612Z","title":"Autodecoding latent 3d diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.350612Z"},"links":{"cited_paper":"/paper/2307.05445","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:1ed2f13190d6df9ba851a879accb28c9eddb8d915b67dfeff0b5eacd2099699e","observation_id":"1eb6d573-3c5d-46bd-b19b-4395249f5599","resolution":{"observed_at":"2026-08-06T10:30:12.350612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.272209Z","title":"Video generation models as world simula- tors","venue":null,"work_id":"8a2a63eb-fe5b-4f7c-b4ee-0796e04d7066","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.460095Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:b8b56e2477b9aaa19904aa7c9fbad2bffc538dfac84797344d2b708d8dc7c6a3","observation_id":"12ffe024-2028-4464-abfa-34b98113c11a","resolution":{"observed_at":"2026-08-06T10:30:20.281474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T10:30:12.550524Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.550524Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:95a89ac2bde5cfb4452a7b742df5c5bf35e92edbce9e546a89006d59b5b84332","observation_id":"d30c4270-b73f-468c-a1eb-7e3c424a351b","resolution":{"observed_at":"2026-08-06T10:30:12.550524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:12.672117Z","title":"Effi- cient4d: Fast dynamic 3d object generation from a single- view video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.672117Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:d9e5b028c253017efb1b563fe752818477b49438b3b05032f2f9c7cf16161074","observation_id":"cd3e3a5d-774c-4009-9b6f-15a423f2469c","resolution":{"observed_at":"2026-08-06T10:30:12.672117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.237133Z","title":"Nerfies: Deformable neural radiance fields","venue":null,"work_id":"df5af83c-b769-42c3-8993-ffdee0f15bde","year":2021},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.750064Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:040f4c572bc8e5ee9741540806d1b8dfe05e2d810470a197c4d11264c4fc7739","observation_id":"1da3777a-bca5-4c04-8914-82197edc97dd","resolution":{"observed_at":"2026-08-06T10:30:20.248945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13228","last_updated":"2021-09-10T06:34:46Z","snapshot_observed_at":"2026-08-09T08:50:52.811232Z","submitted_at":"2021-06-24T17:59:03Z","title":"HyperNeRF: A Higher-Dimensional Representation for Topologically Varying Neural Radiance Fields","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13228","snapshot_observed_at":"2026-08-06T10:30:12.858954Z","title":"Hypernerf: A higher- dimensional representation for topologically varying neural radiance fields","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.858954Z"},"links":{"cited_paper":"/paper/2106.13228","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:3633ca94b6b6f694e2d94c598aa6538612f2ea408db6173cb054bb3d3ffbd95b","observation_id":"9d9e8a53-7d50-4865-966e-1ac48507438f","resolution":{"observed_at":"2026-08-06T10:30:12.858954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.206944Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"55ea5bfe-3dbe-4d9a-88dc-7a7bac6a9c06","year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:12.968499Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:674890e159f5ce2940d0564b30c098742be8d39f20c8c3fffb5baa9f682f78e5","observation_id":"caa91890-20c2-44c5-b14d-08862e47670c","resolution":{"observed_at":"2026-08-06T10:30:20.220021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-06T10:30:13.034255Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.034255Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:977df81cd96fd4acd6a434cf588241a8ba9314a41f9ecb060b9a4cc608347e09","observation_id":"b4233693-2e24-4769-a254-5360bfd6e2fd","resolution":{"observed_at":"2026-08-06T10:30:13.034255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.178459Z","title":"D-nerf: Neural radiance fields for dynamic scenes","venue":null,"work_id":"e130fd98-7cd5-4ef9-80d9-631097c9bae4","year":2021},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.110442Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:c5aa0be297e3be9aa636ea6035e81f6c894f11e9a8b6e2413186608ff6cce9fd","observation_id":"7b8c7c41-05b5-4d2f-b4b4-8f5de6543bc3","resolution":{"observed_at":"2026-08-06T10:30:20.185763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-06T10:30:13.205520Z","title":"Hierarchical text-conditional image genera- tion with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.205520Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:3a6cd548d849b4def4d6a6a9f8a1b782617ef31f36bb5d13b79ab87295e59c1b","observation_id":"8174cff8-709a-42bc-967e-6c54e999a5ea","resolution":{"observed_at":"2026-08-06T10:30:13.205520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17142","last_updated":"2024-06-10T14:07:53Z","snapshot_observed_at":"2026-08-13T04:52:45.023757Z","submitted_at":"2023-12-28T17:16:44Z","title":"DreamGaussian4D: Generative 4D Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17142","snapshot_observed_at":"2026-08-06T10:30:13.349706Z","title":"Dreamgaussian4d: Generative 4d gaussian splatting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.349706Z"},"links":{"cited_paper":"/paper/2312.17142","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:f4489514fb484fe979dffcc8e7b18bfedf2aed42665e3bc6c449f9f9a03d5fea","observation_id":"50564a71-cb36-424a-ab8f-52faaefc8295","resolution":{"observed_at":"2026-08-06T10:30:13.349706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.144320Z","title":"L4gm: Large 4d gaussian reconstruction model","venue":null,"work_id":"cde903c3-a94a-4a06-bc12-7bc6effac75b","year":2025},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.442058Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:2988814d94fb0dcd1c6c48c4f3abf24b17fcd2309a3ae363f910200e885bfd21","observation_id":"7ab528d3-b541-4f97-9f73-f9951729da80","resolution":{"observed_at":"2026-08-06T10:30:20.153976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.119149Z","title":"Xcube: Large-scale 3d generative modeling using sparse voxel hierarchies","venue":null,"work_id":"aa845f04-79bf-4350-b7d1-926ce978ee67","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.593256Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:608cef253a6f8312093a832999edc66bbd5e9589883de5c09b59c6eae3011f88","observation_id":"14e88d72-7cdb-431a-9fac-17eb6a6c1e62","resolution":{"observed_at":"2026-08-06T10:30:20.130171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.100023Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"8131a208-b584-4f0e-b04a-7ebdcbc7ee4f","year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.648226Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:93a9871518e7df8045cd075c3f60cbad51c1e1ac931fad9c155c442c45d6e56f","observation_id":"59776f9f-2442-40ca-94c7-96f770871355","resolution":{"observed_at":"2026-08-06T10:30:20.106132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-08-15T06:11:26.743203Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-06T10:30:13.748825Z","title":"Zero123++: a single image to consistent multi-view diffusion base model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.748825Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:72f9ba62e46f44b4c173fae7fef2a2aee0f17f3f4268931a3f0971be1fd56291","observation_id":"352cd99a-d79d-4ba6-8c16-a718d64e37b1","resolution":{"observed_at":"2026-08-06T10:30:13.748825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-08-14T19:33:54.756989Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-06T10:30:13.868655Z","title":"Mvdream: Multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:13.868655Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:fffef1ab60398850ac7d5fba44d5d437d450e4811cb577c0d23c1294dec16a2d","observation_id":"2bb457d8-372d-4e48-a87e-dafa750f3484","resolution":{"observed_at":"2026-08-06T10:30:13.868655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.076660Z","title":"3d neural field generation using triplane diffusion","venue":null,"work_id":"865bf17b-723f-47da-a255-573c0c4dc90f","year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:14.040253Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:fd162f86e70b95bff733363a065dee68b7e8f330ca282f88a1fb9711731b4c89","observation_id":"e73af816-bb76-406b-ad27-02528e48eedb","resolution":{"observed_at":"2026-08-06T10:30:20.083763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11280","last_updated":"2023-01-26T18:14:32Z","snapshot_observed_at":"2026-08-14T09:37:36.773540Z","submitted_at":"2023-01-26T18:14:32Z","title":"Text-To-4D Dynamic Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11280","snapshot_observed_at":"2026-08-06T10:30:14.197008Z","title":"Text-to-4d dy- namic scene generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:14.197008Z"},"links":{"cited_paper":"/paper/2301.11280","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:b4853769115e1df57893a1e7fe76d054ef9eae3ad99e3086cdf9e2582e8b5d71","observation_id":"5597d53e-78e4-4764-9540-6d73aa9a1b8c","resolution":{"observed_at":"2026-08-06T10:30:14.197008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01416","last_updated":"2023-03-02T17:06:57Z","snapshot_observed_at":"2026-08-13T14:30:50.405843Z","submitted_at":"2023-03-02T17:06:57Z","title":"3D generation on ImageNet","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01416","snapshot_observed_at":"2026-08-06T10:30:14.367135Z","title":"3d generation on imagenet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:14.367135Z"},"links":{"cited_paper":"/paper/2303.01416","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:809ee9fb9c6dfc86107587a39d02deafc0d3e1cd9f092f94aa6ce96060638805","observation_id":"03e9ef80-a155-4672-8c5c-5c6cb2802546","resolution":{"observed_at":"2026-08-06T10:30:14.367135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16818","last_updated":"2023-10-26T06:54:22Z","snapshot_observed_at":"2026-08-14T11:12:41.791244Z","submitted_at":"2023-10-25T17:50:10Z","title":"DreamCraft3D: Hierarchical 3D Generation with Bootstrapped Diffusion Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16818","snapshot_observed_at":"2026-08-06T10:30:14.458767Z","title":"Dreamcraft3d: Hierarchi- cal 3d generation with bootstrapped diffusion prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:14.458767Z"},"links":{"cited_paper":"/paper/2310.16818","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:c8e65cce4eecf1ba6aa44db1bd82e2832ea3ba9febc52e85fa13124a35a28d75","observation_id":"e683472c-8bf0-4615-bf3f-454711b500d1","resolution":{"observed_at":"2026-08-06T10:30:14.458767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-06T10:30:14.617202Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:14.617202Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:1049a6774b6f19d8963f597539a65a0bd43b123963012d24412790d54fc54831","observation_id":"b011c6c0-6379-48dd-b2c6-44b80382126c","resolution":{"observed_at":"2026-08-06T10:30:14.617202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.044799Z","title":"Make-it-3d: High-fidelity 3d creation from a single image with diffusion prior","venue":null,"work_id":"cf7fd0df-292c-4118-bee3-58eabbfbf6ce","year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:14.763276Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:0827f03a44caae87328f378c4694e279d64ce742dc3a7a0476281927f29a2645","observation_id":"e7f18b66-b9ce-42f8-afd4-ec130d7262c5","resolution":{"observed_at":"2026-08-06T10:30:20.054511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05054","last_updated":"2024-02-07T17:57:03Z","snapshot_observed_at":"2026-08-13T04:24:03.548014Z","submitted_at":"2024-02-07T17:57:03Z","title":"LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05054","snapshot_observed_at":"2026-08-06T10:30:14.881594Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation.arXiv preprint arXiv:2402.05054, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:14.881594Z"},"links":{"cited_paper":"/paper/2402.05054","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:a9c5154bc008322b6ac0663b0845db6d4aedc6f378bbe81b0e80e5fc612bf02e","observation_id":"9c2f0074-737b-4667-b5e1-c79511a8bfd7","resolution":{"observed_at":"2026-08-06T10:30:14.881594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11459","last_updated":"2024-08-13T04:35:02Z","snapshot_observed_at":"2026-08-13T04:59:13.239410Z","submitted_at":"2023-12-18T18:59:05Z","title":"VolumeDiffusion: Flexible Text-to-3D Generation with Efficient Volumetric Encoder","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11459","snapshot_observed_at":"2026-08-06T10:30:15.034544Z","title":"V olumediffu- sion: Flexible text-to-3d generation with efficient volumetric encoder","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.034544Z"},"links":{"cited_paper":"/paper/2312.11459","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:ffe765151a5d2b478060372a68f69f09c65989b45d879662af0561a04b0c75db","observation_id":"5b85da8b-22e2-4d50-a803-adb0c9afa250","resolution":{"observed_at":"2026-08-06T10:30:15.034544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:15.126647Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.126647Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:f6de8e3ddbe9e884761f337a2e363a81a8180bc7eb40d0b5c3cf0169c3f8e44e","observation_id":"acb5cb8f-8065-4112-b345-643a9eacd3a2","resolution":{"observed_at":"2026-08-06T10:30:15.126647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:20.002585Z","title":"Lion: Latent point diffu- sion models for 3d shape generation","venue":null,"work_id":"5e591d6a-609e-49d9-862f-b3da8057dd14","year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.267733Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:2b9c6b9852c73745ac5568b3155ec6ff11a4c13bb8d98d51fcbb108d59564ac2","observation_id":"11011fdc-7d8a-4d65-9182-f8f5e1646c43","resolution":{"observed_at":"2026-08-06T10:30:20.008989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.977057Z","title":"Attention is all you need","venue":null,"work_id":"d32909f9-6380-4c29-a100-4a7ca5ee61b1","year":2017},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.415891Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:8e60917e39b53674d669ee2b6128019abe9db85800ebb71ddb723926bb10fdc1","observation_id":"7bce1245-0b79-4b34-9e8a-1f9f0fa7121c","resolution":{"observed_at":"2026-08-06T10:30:19.986699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-13T05:11:47.980346Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-06T10:30:15.521882Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.521882Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:bd76520ff64951e1884ff546434bf7ceb6635b6c37df1cc19eee093b79904316","observation_id":"35faf239-1f57-43cc-97a0-58d498aff9ee","resolution":{"observed_at":"2026-08-06T10:30:15.521882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.949973Z","title":"Rodin: A generative model for sculpting 3d digital avatars using diffusion","venue":null,"work_id":"539cfaaa-95bd-4921-8a7d-7d87849c3423","year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.609838Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:e071afebf8a780d48d7b707948385357b7545c9743023c714fa8a56c7103f715","observation_id":"8be8c0f6-19ae-45e7-9f69-1326e59300e9","resolution":{"observed_at":"2026-08-06T10:30:19.959314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16213","last_updated":"2023-11-22T07:34:38Z","snapshot_observed_at":"2026-08-14T12:46:11.893653Z","submitted_at":"2023-05-25T16:19:18Z","title":"ProlificDreamer: High-Fidelity and Diverse Text-to-3D Generation with Variational Score Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16213","snapshot_observed_at":"2026-08-06T10:30:15.691035Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score dis- tillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.691035Z"},"links":{"cited_paper":"/paper/2305.16213","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:1ef2b4725ef4e29041c08ccea0a44e03450ba21346fc23c6d62f4a189ffeb2c1","observation_id":"1ae8526e-707b-4536-b3e9-5196b0b49159","resolution":{"observed_at":"2026-08-06T10:30:15.691035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.916654Z","title":"4d gaussian splatting for real-time dynamic scene rendering","venue":null,"work_id":"23a0761e-f889-4ca3-94ea-da539bcab343","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.779070Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:ac189c514158aff17e045d85112eedffedd87832fcf9805bbdd2b7e6f6176d52","observation_id":"a44bdc01-8112-419a-acf2-da82bbbe55d1","resolution":{"observed_at":"2026-08-06T10:30:19.929793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.882773Z","title":"Learning a probabilistic latent space of object shapes via 3d generative-adversarial modeling","venue":null,"work_id":"0ddad8e7-9f12-496d-8beb-f6e5d352ced4","year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.857594Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:4ed66f376780e87c26f33e34dbb4e26f885bf5d7caa12579189977a4ff3d3650","observation_id":"123c8d58-e794-4e57-a4c0-a6676b53c7f7","resolution":{"observed_at":"2026-08-06T10:30:19.890712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14832","last_updated":"2024-06-01T16:18:53Z","snapshot_observed_at":"2026-08-12T23:59:32.733928Z","submitted_at":"2024-05-23T17:49:37Z","title":"Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14832","snapshot_observed_at":"2026-08-06T10:30:15.918137Z","title":"Direct3d: Scalable image-to-3d generation via 3d latent diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:15.918137Z"},"links":{"cited_paper":"/paper/2405.14832","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:604b88b7caf434afd2301f20fdf0e24968be50eaa5b1c0ccebd1bec66c05823c","observation_id":"c4e5e105-5f30-43a7-8e1b-d6fad8f9c9a9","resolution":{"observed_at":"2026-08-06T10:30:15.918137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.854687Z","title":"Sc4d: Sparse-controlled video-to-4d generation and motion transfer","venue":null,"work_id":"d305dc7a-7ee8-4646-9986-3fa988f22eab","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.045808Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:8f791f03a94c45aea9200c21a190ad667f7c9ac120574871b9f6923b5b6f3aa6","observation_id":"1b73d6d2-14ed-4790-8d23-1be8009e534f","resolution":{"observed_at":"2026-08-06T10:30:19.862867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07255","last_updated":"2023-10-11T08:41:34Z","snapshot_observed_at":"2026-08-13T15:23:43.275906Z","submitted_at":"2022-06-15T02:35:51Z","title":"GRAM-HD: 3D-Consistent Image Generation at High Resolution with Generative Radiance Manifolds","version":2},"cited_work":{"arxiv_id":"2206.07255","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.07255","snapshot_observed_at":"2026-08-06T10:30:18.288874Z","title":"GRAM-HD: 3D-Consistent Image Generation at High Resolution with Generative Radiance Manifolds","venue":"cs.CV","work_id":"0919a0b1-8075-4774-8552-202732550531","year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.108593Z"},"links":{"cited_paper":"/paper/2206.07255","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:42d84c4565cf4caf3cf8fb6be7483fa526db78e90ceafc4d1e4d22647f875e85","observation_id":"f7021bd2-856b-4f3a-a4ac-77a23d9d6635","resolution":{"observed_at":"2026-08-06T10:30:18.309663Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01506","last_updated":"2025-05-30T11:13:13Z","snapshot_observed_at":"2026-08-12T21:21:00.340696Z","submitted_at":"2024-12-02T13:58:38Z","title":"Structured 3D Latents for Scalable and Versatile 3D Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01506","snapshot_observed_at":"2026-08-06T10:30:16.248032Z","title":"Structured 3d latents for scalable and versatile 3d generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.248032Z"},"links":{"cited_paper":"/paper/2412.01506","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:a7a90347f5ec38b5ec836cbfc6d406b51be7dd01d98178d55da2e6122206f12c","observation_id":"e9e502aa-a621-4e8f-b670-cf9214b84fab","resolution":{"observed_at":"2026-08-06T10:30:16.248032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17470","last_updated":"2025-02-27T21:52:39Z","snapshot_observed_at":"2026-08-12T23:15:26.209419Z","submitted_at":"2024-07-24T17:59:43Z","title":"SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17470","snapshot_observed_at":"2026-08-06T10:30:16.358928Z","title":"Sv4d: Dynamic 3d content generation with multi-frame and multi-view consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.358928Z"},"links":{"cited_paper":"/paper/2407.17470","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:dde817e8979537753368c134fcf119e68351b3a878aff8a4492cd48c312ebee3","observation_id":"21424c9c-228b-4012-95a7-ce9c96ebcf5a","resolution":{"observed_at":"2026-08-06T10:30:16.358928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14732","last_updated":"2025-06-08T16:51:04Z","snapshot_observed_at":"2026-08-12T22:56:57.803398Z","submitted_at":"2024-08-27T01:55:40Z","title":"OctFusion: Octree-based Diffusion Models for 3D Shape Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14732","snapshot_observed_at":"2026-08-06T10:30:16.462539Z","title":"Octfusion: Octree- based diffusion models for 3d shape generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.462539Z"},"links":{"cited_paper":"/paper/2408.14732","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:7c74444f94aeef9082bf3844f6d4d024b644e05d0babb17acaba280dbafd41b1","observation_id":"d96a7f3f-f8b2-429f-8273-14a46a30a45d","resolution":{"observed_at":"2026-08-06T10:30:16.462539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13055","last_updated":"2025-04-09T14:27:31Z","snapshot_observed_at":"2026-08-12T22:58:40.302117Z","submitted_at":"2024-08-23T13:27:27Z","title":"Atlas Gaussians Diffusion for 3D Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13055","snapshot_observed_at":"2026-08-06T10:30:16.525461Z","title":"Atlas gaussians diffusion for 3d generation with infinite number of points","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.525461Z"},"links":{"cited_paper":"/paper/2408.13055","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:b5f764c2e878d6809d1387c428a222d2170c29356afe08d4998a8e8c8058088b","observation_id":"518be106-8597-451a-abac-917922c2984d","resolution":{"observed_at":"2026-08-06T10:30:16.525461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02148","last_updated":"2024-10-02T14:07:04Z","snapshot_observed_at":"2026-08-14T09:37:04.031957Z","submitted_at":"2024-04-02T17:58:03Z","title":"Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02148","snapshot_observed_at":"2026-08-06T10:30:16.592938Z","title":"Diffusion 2: Dynamic 3d content generation via score composition of video and multi-view diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.592938Z"},"links":{"cited_paper":"/paper/2404.02148","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:02ad6a67303e3f50c442de5be2b90c9d8bdf6ac12ed6b65006db87d0c1da65a9","observation_id":"35b2e7a4-a6c0-4936-b9ca-13f27665cb42","resolution":{"observed_at":"2026-08-06T10:30:16.592938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.826783Z","title":"Mosaic-sdf for 3d generative models","venue":null,"work_id":"bde3f009-e097-40fb-9755-806e4539a06a","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.676125Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:4708a0792cf54c4ca89ba006227c1d1fd331c2ada6489663715a802d80b0833b","observation_id":"a8219727-ae72-45cf-911b-561872e14389","resolution":{"observed_at":"2026-08-06T10:30:19.839134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17225","last_updated":"2024-12-04T06:11:50Z","snapshot_observed_at":"2026-08-13T06:08:10.974090Z","submitted_at":"2023-12-28T18:53:39Z","title":"4DGen: Grounded 4D Content Generation with Spatial-temporal Consistency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17225","snapshot_observed_at":"2026-08-06T10:30:16.788575Z","title":"4dgen: Grounded 4d content gener- ation with spatial-temporal consistency","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.788575Z"},"links":{"cited_paper":"/paper/2312.17225","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:66f65da5f1dbe9d533b7a295c29ec44aa60d9fa5ed15c095b8e0ec2f0312b18d","observation_id":"abfb242d-89ac-4f0d-a38c-db60446c1686","resolution":{"observed_at":"2026-08-06T10:30:16.788575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.807040Z","title":"Stag4d: Spatial-temporal anchored generative 4d gaussians","venue":null,"work_id":"487269bc-881b-45af-943a-57f6fe0442f3","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:16.907021Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:d746f015c9db1a098e9a6c6ef4d5023a68a2aa6dd50e7e000a492192a5c279de","observation_id":"c16d3789-0191-444f-807c-66bad93937ff","resolution":{"observed_at":"2026-08-06T10:30:19.814480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:17.009712Z","title":"Root mean square layer normalization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.009712Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:ba459f0948ce4d62df3a67b98b9175b6bc86d479631f9b3c764f5e6e12567725","observation_id":"590df092-0286-4d19-83a6-bb653f5d307d","resolution":{"observed_at":"2026-08-06T10:30:17.009712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.744625Z","title":"Styleswin: Transformer-based gan for high-resolution image generation","venue":null,"work_id":"e66c9e51-43a4-4b1c-a299-f95faaa999de","year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.134457Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:c848f17412c1e3b2d3d3dbdd1389e3ec079d343eb91b75c7bedcb27ad8a00357","observation_id":"679724a5-cd13-487e-829f-47490233ad6a","resolution":{"observed_at":"2026-08-06T10:30:19.756195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:17.208548Z","title":"3dshape2vecset: A 3d shape representation for neural fields and generative diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.208548Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:5a5aba1578f2c52566242bf8c9add33eb3698e44145aa4bfca27813ed4da7414","observation_id":"7ff07045-92bb-4bfe-8cf3-8d83ae48b74c","resolution":{"observed_at":"2026-08-06T10:30:17.208548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06938","last_updated":"2024-07-11T03:46:45Z","snapshot_observed_at":"2026-08-12T23:25:46.139743Z","submitted_at":"2024-07-09T15:14:45Z","title":"RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06938","snapshot_observed_at":"2026-08-06T10:30:17.341354Z","title":"Rodinhd: High-fidelity 3d avatar generation with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.341354Z"},"links":{"cited_paper":"/paper/2407.06938","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:63a38684edf4f5037406d4126205483a26cf9178d1430dba3d61ab646a7de8cd","observation_id":"7b548030-257a-4def-b939-d2140ef6b4a0","resolution":{"observed_at":"2026-08-06T10:30:17.341354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19655","last_updated":"2024-10-31T03:33:30Z","snapshot_observed_at":"2026-08-14T11:53:55.991219Z","submitted_at":"2024-03-28T17:59:50Z","title":"GaussianCube: A Structured and Explicit Radiance Representation for 3D Generative Modeling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19655","snapshot_observed_at":"2026-08-06T10:30:17.399564Z","title":"Gaussiancube: A structured and explicit radiance rep- resentation for 3d generative modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.399564Z"},"links":{"cited_paper":"/paper/2403.19655","citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:10bc79d891ea8ec7eac9c2b37704423b36fd860f1d4cbacd7c13c976067afd9a","observation_id":"c7a5da9e-90e3-4cff-bd4c-af3a7c066be6","resolution":{"observed_at":"2026-08-06T10:30:17.399564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.704565Z","title":"4diffusion: Multi-view video diffusion model for 4d generation","venue":null,"work_id":"ad1ab272-d197-4083-a06d-2c472bb43a86","year":2025},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.489077Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:a70cd5941b7dd4b68ad580a8303a3f5c6f7723aad4117a4a734776aba61b9e38","observation_id":"383f9b82-4389-4704-8794-6bc1c629fa9d","resolution":{"observed_at":"2026-08-06T10:30:19.713186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.676657Z","title":"Clay: A controllable large-scale generative model for creat- ing high-quality 3d assets","venue":null,"work_id":"91ea0995-cacd-4c86-8162-b8facc214718","year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.555169Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:05798efdc658b767f26140de069491b18e384f15f0a075db04eb5f4d7ffcf779","observation_id":"48e1c9db-9cca-4248-81ad-677ef8d682fd","resolution":{"observed_at":"2026-08-06T10:30:19.683680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.646568Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"7e694d2a-266b-4244-b980-8d4cca2faf83","year":2018},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.614342Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:ed57e1ec737d9165043efd0166478be5b0796fa25fbd200e4011a5c76fdc3b13","observation_id":"e0918b9c-f0e1-48fd-9ca0-ad6032f647c4","resolution":{"observed_at":"2026-08-06T10:30:19.657435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:17.711064Z","title":"Michelangelo: Conditional 3d shape generation based on shape-image-text aligned latent representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.711064Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:fa8d06d7d861b279d495fde02b2170b10bb48eacae6d4ca6441b2e888963322d","observation_id":"259245e3-acd8-4703-8f48-0ff92fa2e906","resolution":{"observed_at":"2026-08-06T10:30:17.711064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.608025Z","title":"Sdf-stylegan: Implicit sdf-based stylegan for 3d shape gen- eration","venue":null,"work_id":"2e1fe762-c787-4e06-bb35-369b02cf1d3e","year":2022},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.776093Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:1454ab2f9a86577776a409d186cdd5e20a994d86628ebc742535e76678e08a29","observation_id":"50c4f88a-3771-4069-878a-ef1ae4f8e84b","resolution":{"observed_at":"2026-08-06T10:30:19.618173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.578561Z","title":"Locally attentional 12 sdf diffusion for controllable 3d shape generation","venue":null,"work_id":"20cc28a3-f870-413d-90a7-906d2c6441ee","year":2023},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.888948Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:e3489a27eb6a7089db65ef5772df68eb1342648d33c8fad59ff090dbdaabed32","observation_id":"55288707-35ac-4797-b038-963ed7fd3429","resolution":{"observed_at":"2026-08-06T10:30:19.586835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:30:19.546279Z","title":"Shifted Window","venue":null,"work_id":"c672fca8-fe84-47b3-90d5-551953014cd2","year":2018},"citing_paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T10:30:17.965855Z"},"links":{"citing_paper":"/paper/2507.23785"},"observation_digest":"sha256:ee5e90bd01fcc63f024f6e0f2867c1016eed347e0d7a85c6adeb060ce8f3f50e","observation_id":"6a0c1e39-2719-4748-8f71-b7fd2a7709ab","resolution":{"observed_at":"2026-08-06T10:30:19.551933Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23785","last_updated":"2025-07-31T17:59:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T09:40:09.220190Z","submitted_at":"2025-07-31T17:59:51Z","title":"Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":100},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 100 outbound references and 8 inbound Pith citation observations for arXiv:2507.23785."}