{"as_of":"2026-08-13T00:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:698714c54886f80d1aa4a03c30a40277a6e6e8ea619a277672bbdc9a427ed862","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:27:51.840638Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.04471/citation-record","integrity":"/paper/2412.04471/integrity","json":"/paper/2412.04471/citation-record.json","paper":"/paper/2412.04471"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.778208Z","title":"Natural language input for scene generation","venue":null,"work_id":"7dbfb237-2234-4344-bb45-7a56166bb4fd","year":1983},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.394646Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:d823dc6e14a5706fcd3cb5595a526409476d17db4530bc0a5a27ee365a6f7752","observation_id":"e6217122-08dc-4513-b16e-d83640a34e9d","resolution":{"observed_at":"2026-08-11T21:27:52.782474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.766082Z","title":"4D-fy: Text-to-4d generation using hybrid score distillation sampling","venue":null,"work_id":"fe432bc5-82ed-4296-ac32-29bc2d199757","year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.401264Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:3e594c0591cc3e32b73088be61f34369151872af281db21a5a153fbbc235531d","observation_id":"e54db141-8c46-4ece-8649-04c329948ab9","resolution":{"observed_at":"2026-08-11T21:27:52.770574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.753336Z","title":"TC4D: Trajectory- conditioned text-to-4d generation","venue":null,"work_id":"310e577b-1bd2-4e5c-a3c4-91bb2e3c8e9c","year":2025},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.412406Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:c03555572aa5f57c74d98e8078f9ce3bd48c60748f4b76107ee55b110e74d356","observation_id":"ce7c03d4-809d-4fea-8727-1a21c1b83463","resolution":{"observed_at":"2026-08-11T21:27:52.757907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.739908Z","title":"HexPlane: A fast representa- tion for dynamic scenes","venue":null,"work_id":"653c25a9-b441-4edb-8364-6f144df5c967","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.421979Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:8e9f0b166e3ab733939fc7f85186fdc86ccd92ae5b33a2c19af5634184da5b66","observation_id":"d81ebca6-a0fa-4080-879b-e328e187c79b","resolution":{"observed_at":"2026-08-11T21:27:52.744888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.727442Z","title":"Generative novel view synthesis with 3D-aware diffusion models","venue":null,"work_id":"9e71a7b7-1680-4c6b-9ab0-6e0f3a3ef212","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.429610Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:04179ba65a678696eeb838bd2bf4068699ac2de97195a61ef3dd15e05777893e","observation_id":"8c899d7f-ceec-49cd-b1bc-d090c271a413","resolution":{"observed_at":"2026-08-11T21:27:52.730915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.716088Z","title":"Learning spatial knowledge for text to 3D scene generation","venue":null,"work_id":"640f987a-0e15-4fc3-905c-900fc206781a","year":2014},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.436497Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:b372a9834afe5876299f5c6484254567383cecb14e324067c6a354a5fe262908","observation_id":"c47d0ba4-7478-44a6-a203-56a81f87e77e","resolution":{"observed_at":"2026-08-11T21:27:52.719906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.702397Z","title":"Text2shape: Generating shapes from natural language by learning joint embeddings","venue":null,"work_id":"c5cbbeaa-6958-4e7a-a12a-a0aec9405f2a","year":2018},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.442451Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:115e5698894e3361faa90c75ac02a81bbd5dfadc9040417265acc899d0ae9a33","observation_id":"8fe7af8f-ff80-4269-a56e-ed5515e2f64b","resolution":{"observed_at":"2026-08-11T21:27:52.706606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.688021Z","title":"WordsEye: An automatic text-to-scene conversion system","venue":null,"work_id":"d91c2b96-3e6a-43f8-b2e4-5e1fdae95cc5","year":2001},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.450198Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:213636fbc611c66a582bf4bc8dd87685c3a9782924ca987a87e2af94a21b3e06","observation_id":"e8d113d0-7919-4294-b9e5-a7bd6c264d7f","resolution":{"observed_at":"2026-08-11T21:27:52.692732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.674447Z","title":"Objaverse: A universe of annotated 3D objects","venue":null,"work_id":"dad7ce1d-f24d-4b37-b955-8763916d5c69","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.456147Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:361e2bbfb9cfbb45577c1f0f91313aa12f786529f966a89c23d82a04e9fd8083","observation_id":"75b03b6b-9500-42d3-a441-ea4edd98406a","resolution":{"observed_at":"2026-08-11T21:27:52.678224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.661629Z","title":"Depth-image-based rendering, compres- sion, and transmission for a new approach on 3D-TV","venue":null,"work_id":"c6e44f22-8228-4cce-b33e-16d04eea73df","year":2004},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.461709Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:b76a3398b55998675bf1e481ade0173c7e06102076b0d02766d755156876d1a1","observation_id":"b2130181-cc18-4527-ae7a-bee63b74c7c5","resolution":{"observed_at":"2026-08-11T21:27:52.666416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.648725Z","title":"Textdeformer: Geometry manipu- lation using text guidance","venue":null,"work_id":"8e29a4dd-8466-42dc-8dfc-6a6efe83ed01","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.467783Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:57e7148474b4127f6b3b453a4fb043a6a3ca6abe6366e814dcdcaf59ff2860fa","observation_id":"ed7217d2-78a8-4b4d-9a73-1ffb91cf6fdd","resolution":{"observed_at":"2026-08-11T21:27:52.652995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.636346Z","title":"NeRFDiff: Single-image view synthesis with NeRF-guided distillation from 3D-aware diffusion","venue":null,"work_id":"a6ea8df1-56a5-4387-8825-5c4ae43dd011","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.474238Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:1e6307cd52498afc3290b57dbf4478b6dc6f7ee18b16665b639380f9d539ab42","observation_id":"8309c804-5301-4edf-bcf1-d4e394d3fcdf","resolution":{"observed_at":"2026-08-11T21:27:52.640556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-11T21:27:51.480970Z","title":"AnimateDiff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.480970Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:b726197db12422a57f42a0c4af282be82c43359beaf3d590f9242c0fd1f3e961","observation_id":"2efa5e13-7e18-47cc-84f9-209995c27f22","resolution":{"observed_at":"2026-08-11T21:27:51.480970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.621910Z","title":"Text2Room: Extracting textured 3D meshes from 2D text-to-image models","venue":null,"work_id":"6259227e-3b54-4d2f-a626-6adcbe3f0f4a","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.494821Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:468071abbbbff09a0708626c87f6b1ecee873f23928ff0dcd486de07dfd45348","observation_id":"e655f85f-2dff-46e2-864d-3a0ee90fbd56","resolution":{"observed_at":"2026-08-11T21:27:52.626925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15506","last_updated":"2025-01-03T15:39:16Z","snapshot_observed_at":"2026-08-12T19:23:53.741047Z","submitted_at":"2024-03-22T02:30:46Z","title":"Metric3Dv2: A Versatile Monocular Geometric Foundation Model for Zero-shot Metric Depth and Surface Normal Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15506","snapshot_observed_at":"2026-08-11T21:27:51.504974Z","title":"Metric3D v2: A versatile monocular geomet- ric foundation model for zero-shot metric depth and surface normal estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.504974Z"},"links":{"cited_paper":"/paper/2404.15506","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:ae656a9472cea1b58f2020e20463d50648d120fd3b31e8df8d9a382a2bf4b78b","observation_id":"9da77803-d262-4aa3-b92e-49ad6de14846","resolution":{"observed_at":"2026-08-11T21:27:51.504974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02095","last_updated":"2024-11-27T07:59:25Z","snapshot_observed_at":"2026-08-12T22:52:07.327467Z","submitted_at":"2024-09-03T17:52:03Z","title":"DepthCrafter: Generating Consistent Long Depth Sequences for Open-world Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02095","snapshot_observed_at":"2026-08-11T21:27:51.510678Z","title":"DepthCrafter: Generating consistent long depth sequences for open-world videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.510678Z"},"links":{"cited_paper":"/paper/2409.02095","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:3e3098e444995682ae1c27bb3357f1214d016fc54d95aeb14b0312552b6334ee","observation_id":"1a34145c-6570-4c91-907b-8b2d8ae885cb","resolution":{"observed_at":"2026-08-11T21:27:51.510678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:51.517764Z","title":"Zero-shot text-guided object gen- eration with dream fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.517764Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:230eeda2d863fef4ad7c02ea2a4b6ccc9011d9e03fa6e644f8aa08a3008958f9","observation_id":"e16c0f3a-524b-4505-a3c9-fae9caad2c25","resolution":{"observed_at":"2026-08-11T21:27:51.517764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12922","last_updated":"2021-09-27T10:11:35Z","snapshot_observed_at":"2026-08-11T01:45:45.260589Z","submitted_at":"2021-09-27T10:11:35Z","title":"ClipMatrix: Text-controlled Creation of 3D Textured Meshes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.12922","snapshot_observed_at":"2026-08-11T21:27:51.525862Z","title":"Clipmatrix: Text-controlled creation of 3D textured meshes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.525862Z"},"links":{"cited_paper":"/paper/2109.12922","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:b24661d639623eb6e92e08279b01583398b6b3e07eb80263aeb1046b92d9f8d2","observation_id":"5e61b124-f9f5-48f4-94f0-40079224cc9d","resolution":{"observed_at":"2026-08-11T21:27:51.525862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02848","last_updated":"2023-11-06T03:26:43Z","snapshot_observed_at":"2026-08-12T07:20:58.205254Z","submitted_at":"2023-11-06T03:26:43Z","title":"Consistent4D: Consistent 360{\\deg} Dynamic Object Generation from Monocular Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02848","snapshot_observed_at":"2026-08-11T21:27:51.532678Z","title":"Consistent4D: Consistent 360 degree dynamic ob- ject generation from monocular video","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.532678Z"},"links":{"cited_paper":"/paper/2311.02848","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:bb3ff8e07a154e14d7d5ce93d328e50110743d804e56157b43b837ec25f75590","observation_id":"3a3d43da-076f-4e65-afce-2837268ea623","resolution":{"observed_at":"2026-08-11T21:27:51.532678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.600942Z","title":null,"venue":null,"work_id":"fa5d5b07-ac46-4288-90d6-25d19f1ee781","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.542794Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:f3a7003ae94f24209a88f53f35d376c102c0f4c591a958f2954b0e8e8a4d1046","observation_id":"7aa9d1c9-ee43-49e4-81d3-6f6020a743f6","resolution":{"observed_at":"2026-08-11T21:27:52.605124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20334","last_updated":"2024-05-30T17:59:24Z","snapshot_observed_at":"2026-08-12T23:53:52.700287Z","submitted_at":"2024-05-30T17:59:24Z","title":"VividDream: Generating 3D Scene with Ambient Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20334","snapshot_observed_at":"2026-08-11T21:27:51.546894Z","title":"Vividdream: Generating 3D scene with ambient dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.546894Z"},"links":{"cited_paper":"/paper/2405.20334","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:9a67fe99af248d954d5974374545e638dd740db4cb7c08016de1ed816c0d7a80","observation_id":"af27ed2c-fc15-4b74-9eab-3d28f50e6bb4","resolution":{"observed_at":"2026-08-11T21:27:51.546894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.587721Z","title":"Magic3D: High-resolution text-to-3D content creation","venue":null,"work_id":"63e9f3ce-c3d2-4689-b45e-45df39e2e48b","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.553193Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:4fbe865a2978e1d81cadf0c17a1efd2febbc37a4cd318f7423b5b86a2c03b657","observation_id":"808f97b5-5be8-492a-aef2-2bdbbc7d7f38","resolution":{"observed_at":"2026-08-11T21:27:52.592275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:51.558527Z","title":"Magic3D: High-resolution text-to-3D content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.558527Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:dc44dc2ed2c011d4321a5542167f8dc33ac18b8792b27d6789a4e8582924a0dc","observation_id":"673a058b-a2bd-411b-af9f-208cd95ebb24","resolution":{"observed_at":"2026-08-11T21:27:51.558527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17261","last_updated":"2024-02-20T14:33:54Z","snapshot_observed_at":"2026-08-11T20:47:26.650902Z","submitted_at":"2023-09-29T14:13:07Z","title":"Consistent123: One Image to Highly Consistent 3D Asset Using Case-Aware Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17261","snapshot_observed_at":"2026-08-11T21:27:51.565659Z","title":"Consistent123: One image to highly consistent 3D asset using case-aware diffusion priors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.565659Z"},"links":{"cited_paper":"/paper/2309.17261","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:1b318c2739a24443396cb665cc3627839968786845dfb6cdc92d21333f6f82ea","observation_id":"d9d4ce55-96c0-4561-bc73-fcefbd77a21c","resolution":{"observed_at":"2026-08-11T21:27:51.565659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13763","last_updated":"2024-01-03T09:40:56Z","snapshot_observed_at":"2026-08-11T06:32:25.469727Z","submitted_at":"2023-12-21T11:41:02Z","title":"Align Your Gaussians: Text-to-4D with Dynamic 3D Gaussians and Composed Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13763","snapshot_observed_at":"2026-08-11T21:27:51.570128Z","title":"Align your gaussians: Text-to-4D with dynamic 4D gaussians and composed diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.570128Z"},"links":{"cited_paper":"/paper/2312.13763","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:75a277b3ce32d773ece69f9520d9c574e3126b64e571ad0520969dcadace56df","observation_id":"ced51a46-d9f3-4d2a-828c-15db9a57c17c","resolution":{"observed_at":"2026-08-11T21:27:51.570128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.565368Z","title":"Align your gaussians: Text-to-4D with dynamic 3D gaussians and composed diffusion models","venue":null,"work_id":"61699c04-3bd5-4b7e-8fd8-969d64eb8ae2","year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.574413Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:32fc08de602295cdbb6d48cad7ffd331ab06df0ecad3bed45f32534be9feed05","observation_id":"e8868dd8-9c92-4544-b69a-64f8f85e58cf","resolution":{"observed_at":"2026-08-11T21:27:52.570267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.551567Z","title":"Infinite Na- ture: Perpetual view generation of natural scenes from a sin- gle image","venue":null,"work_id":"bbf93f83-6e7d-4855-9c6b-134362d79fa9","year":2021},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.581381Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:0bbe9bc06ada831592aaa0ad77d744e10d34c05e210f199d6895cc13453aa948","observation_id":"fb2082b1-f5d4-487a-9c8b-698180449913","resolution":{"observed_at":"2026-08-11T21:27:52.555973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.536430Z","title":"Zero-1-to-3: Zero-shot one image to 3D object","venue":null,"work_id":"92c7af63-15db-4df1-a79e-42337904fbc9","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.586230Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:139440bc3c0548c2aa2f1342b39be45d261c6feedcf1ab66efd133762a93f9bc","observation_id":"e5fb9e90-beec-4a3c-8cb5-e3942bf83600","resolution":{"observed_at":"2026-08-11T21:27:52.541768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-08-12T22:52:54.817720Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-11T21:27:51.596197Z","title":"SyncDreamer: Learning to generate multiview- 9 consistent images from a single-view image","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.596197Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:6bd2aafb73e4fabccb64f252325168a6cae82425e0b1dc66b9b636a06d181d97","observation_id":"cdf31827-7e76-4a19-aa1a-0d8c7c968259","resolution":{"observed_at":"2026-08-11T21:27:51.596197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-11T21:27:51.602247Z","title":"VideoFusion: Decomposed diffusion mod- els for high-quality video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.602247Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:a9166ef855312601f92cb54ba3b0003f52b708d3cb80cf63444ccfdc2d4c609d","observation_id":"df007f65-a541-4a99-a471-b57a163c13ea","resolution":{"observed_at":"2026-08-11T21:27:51.602247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.521568Z","title":"Latent-NeRF for shape-guided generation of 3D shapes and textures","venue":null,"work_id":"a4fa53df-4224-4c04-bb1d-59c279bf2d8e","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.607855Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:7376b961ec86cca94a08b7709a32687fda0622e6c5a1b9a2c3561b0152eb0706","observation_id":"f08ae594-daaf-43b9-8704-25c9924917a3","resolution":{"observed_at":"2026-08-11T21:27:52.526300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.508092Z","title":"Benchmark for compositional text-to- image synthesis","venue":null,"work_id":"78c7ae27-8300-4619-a546-03a596cf5202","year":2021},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.615230Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:d7989634c3eed06d26f4c77c3fa217ee72b4cf4487bf3fc1011c9c9048bbce56","observation_id":"4d031207-78dc-401e-8135-f9b7112a15dd","resolution":{"observed_at":"2026-08-11T21:27:52.512097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:51.622693Z","title":"Barron, and Ben Milden- hall","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.622693Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:6cae2764ecf24a162d19e2141095b24e77519afce6c3328e68f3e2ea465beb2a","observation_id":"055f55d4-4115-4635-8c55-37425315134f","resolution":{"observed_at":"2026-08-11T21:27:51.622693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17843","last_updated":"2023-07-23T21:27:30Z","snapshot_observed_at":"2026-08-07T04:14:20.139990Z","submitted_at":"2023-06-30T17:59:08Z","title":"Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17843","snapshot_observed_at":"2026-08-11T21:27:51.631252Z","title":"Magic123: One image to high-quality 3D object generation using both 2D and 3D diffusion priors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.631252Z"},"links":{"cited_paper":"/paper/2306.17843","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:dcbbf57508e8fc33bdac5d91be893878c0336b66e5c3da7661dff54b9005befd","observation_id":"43aabef0-0d80-46d9-bc26-b9145b17525c","resolution":{"observed_at":"2026-08-11T21:27:51.631252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.486594Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"44a720c2-167d-4f3f-bb02-6d79bdf92421","year":2021},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.639190Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:c2e537ba974244f2c63bd3c40a1ebd78247abc27c5c4c6390bfc5d52f1c9b273","observation_id":"07d9d864-f386-4afd-af71-478949385bf6","resolution":{"observed_at":"2026-08-11T21:27:52.491547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17142","last_updated":"2024-06-10T14:07:53Z","snapshot_observed_at":"2026-08-01T13:37:17.913862Z","submitted_at":"2023-12-28T17:16:44Z","title":"DreamGaussian4D: Generative 4D Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17142","snapshot_observed_at":"2026-08-11T21:27:51.648368Z","title":"DreamGaussian4D: Generative 4D Gaussian splatting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.648368Z"},"links":{"cited_paper":"/paper/2312.17142","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:b13b067dc2b5dc0c9b7bd5fce8f5f78a253e5bca50afd690fe0dfb71eace1c2f","observation_id":"88b12e8b-e2a5-427c-9180-5660793aeb1c","resolution":{"observed_at":"2026-08-11T21:27:51.648368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-11T21:27:51.654488Z","title":"Grounded SAM: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.654488Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:4c78df64ac6fcd39fdf3ea7517ca017edab96d8d1b1cccce07605588139b4eba","observation_id":"6380973a-412e-4d5a-8d5d-1a3bb1404b4a","resolution":{"observed_at":"2026-08-11T21:27:51.654488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:51.659309Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.659309Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:8e99dc5e99ebcc65c8291dc300eaa3e086051a27409d886e28e5cf4a608e1272","observation_id":"a458ba24-ad3c-4a46-a026-612117a44ea3","resolution":{"observed_at":"2026-08-11T21:27:51.659309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.462858Z","title":"Photorealistic text-to-image diffusion models with deep lan- guage understanding","venue":null,"work_id":"c3ba049a-512a-44cb-ae79-1e373654cc44","year":2022},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.666154Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:2c610a887cda3560fd95c79af19af991f19283ec3689d165bb7f86c45a278990","observation_id":"f443b3f9-d6f0-41e9-b03a-ea0c88f36277","resolution":{"observed_at":"2026-08-11T21:27:52.467608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.449469Z","title":"CLIP-Forge: Towards zero-shot text-to-shape genera- tion","venue":null,"work_id":"9b2a5667-195d-4130-a316-edf6a8771bfd","year":2022},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.672187Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:f18d453c1f7b53b2a29606a93e8224f5eb9d4451115cfbbdc14fe8ae68d9d25e","observation_id":"7870adca-73dc-4b1b-a9cf-661a72b5b4be","resolution":{"observed_at":"2026-08-11T21:27:52.453965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-08-11T13:07:00.745167Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-11T21:27:51.678905Z","title":"Zero123++: A single image to consistent multi-view dif- fusion base model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.678905Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:0c47e86098add32aec53b3140b1f3014728e0fe92efb8333f05462657b2a7ab3","observation_id":"c3ea0c5c-414f-4479-a4ac-eaae5ba24fc3","resolution":{"observed_at":"2026-08-11T21:27:51.678905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-11T21:27:51.685602Z","title":"Mvdream: Multi-view diffusion for 3D gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.685602Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:b520dd74061e35611554e31c7e51a414be69c9e5b9a8c726dbf27d365748eb9a","observation_id":"540a38dd-9908-4639-a144-0868fe0cbf3f","resolution":{"observed_at":"2026-08-11T21:27:51.685602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-11T21:27:51.693919Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.693919Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:f40f6637c5fea685d8f92193948a556197543ad06d592f95114b86675fde4ad4","observation_id":"793b1cae-20e6-43e4-9b7b-9cdbfa3c3acd","resolution":{"observed_at":"2026-08-11T21:27:51.693919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.436937Z","title":"Text-to-4D dynamic scene generation","venue":null,"work_id":"1c4954ed-b5c0-49bc-907c-8d53d752e964","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.700373Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:2e89a070722f54dadba59c010ee04a9d3922ec4cfeb243863649bb360bd38ff5","observation_id":"3d5ca253-b79b-4d04-a3fa-72f0ea056e9c","resolution":{"observed_at":"2026-08-11T21:27:52.441300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14184","last_updated":"2023-04-03T07:18:27Z","snapshot_observed_at":"2026-07-06T15:07:45.408464Z","submitted_at":"2023-03-24T17:54:22Z","title":"Make-It-3D: High-Fidelity 3D Creation from A Single Image with Diffusion Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14184","snapshot_observed_at":"2026-08-11T21:27:51.705724Z","title":"Make-it-3D: High-fidelity 3D creation from a single image with diffusion prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.705724Z"},"links":{"cited_paper":"/paper/2303.14184","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:dfbba03dbe8fc920eccc5ee5eb0e7958c652a4477ec08f854f1ca29340bc0371","observation_id":"8985a227-eba3-49f3-9cb8-9cbfa9b5340d","resolution":{"observed_at":"2026-08-11T21:27:51.705724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.424180Z","title":"An image inpainting technique based on the fast marching method","venue":null,"work_id":"050c1fa4-044e-4dcd-ba01-79c92e957067","year":2004},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.712314Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:2c503f411108736eb261fc00829a535ffa153c883d7ab0bda6768fc0d5c85f46","observation_id":"911dfae0-f398-46cc-975d-f8322717b73d","resolution":{"observed_at":"2026-08-11T21:27:52.428016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11719","last_updated":"2023-11-17T04:17:34Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:53:00Z","title":"Diffusion with Forward Models: Solving Stochastic Inverse Problems Without Direct Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11719","snapshot_observed_at":"2026-08-11T21:27:51.717515Z","title":"Diffusion with forward models: Solving stochastic inverse problems without direct supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.717515Z"},"links":{"cited_paper":"/paper/2306.11719","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:8d5dd21f0e22957f92571f22f82b56010e77e1273c81eea75ae81bc5a1819166","observation_id":"28ebf17a-70f3-4c9f-8d1d-373d68b80781","resolution":{"observed_at":"2026-08-11T21:27:51.717515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.412649Z","title":"CLIP-NeRF: Text-and-image driven manipu- lation of neural radiance fields","venue":null,"work_id":"e9b97d06-710a-4395-a0b8-e177ea2266f6","year":2022},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.723180Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:2a103d26f072ab2a40bd2b65f139f73ce2eb811ea989eef3e164c72c4b2f9d8c","observation_id":"d9348a7e-610c-4ba3-9af6-f4905b08eda2","resolution":{"observed_at":"2026-08-11T21:27:52.416573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-10T01:52:30.999213Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-11T21:27:51.731444Z","title":"Modelscope text-to-video technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.731444Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:494c9d5b91507fc787402b1a928a8062d93c341e2faffb9c7e5af3c96cad8c07","observation_id":"fee7e082-2084-4bcc-b92f-6d7435c3cfb3","resolution":{"observed_at":"2026-08-11T21:27:51.731444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.401027Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3D generation with variational score distilla- tion","venue":null,"work_id":"201e7897-28fc-4a02-82ad-2ba8425b8d88","year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.737441Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:eb14cbe3a6cad7b7b099b91b2aa494ac31b36c0b89c64b25c8741a5fead46fcb","observation_id":"432a9a17-7613-4144-a965-1238baf31ee5","resolution":{"observed_at":"2026-08-11T21:27:52.405318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.386940Z","title":"4D Gaussian splatting for real-time dynamic scene render- ing","venue":null,"work_id":"efd489fb-7307-4c6b-b381-293ca4d172c2","year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.743509Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:cb1e7fe036a4a32119de29546bd20d17f76bc8bff36c16145a86db65fc6c0724","observation_id":"d2b62b7a-75ab-40e3-b824-61f6712d58c4","resolution":{"observed_at":"2026-08-11T21:27:52.391600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18613","last_updated":"2024-12-18T21:21:07Z","snapshot_observed_at":"2026-08-12T19:46:51.576955Z","submitted_at":"2024-11-27T18:57:16Z","title":"CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18613","snapshot_observed_at":"2026-08-11T21:27:51.755330Z","title":"Cat4d: Create anything in 4D with multi-view video diffusion mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.755330Z"},"links":{"cited_paper":"/paper/2411.18613","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:e3239dec9d07538775830cee73c0bc774ac819a662ef705629e23dff29d63164","observation_id":"b9cb3bb2-c9c7-4bc6-92eb-14f18d4c1537","resolution":{"observed_at":"2026-08-11T21:27:51.755330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17470","last_updated":"2025-02-27T21:52:39Z","snapshot_observed_at":"2026-08-12T23:15:26.209419Z","submitted_at":"2024-07-24T17:59:43Z","title":"SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17470","snapshot_observed_at":"2026-08-11T21:27:51.762593Z","title":"SV4D: Dynamic 3D content generation with multi-frame and multi-view consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.762593Z"},"links":{"cited_paper":"/paper/2407.17470","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:a8496c9f3a2f2b8d8bc46ab2be5bba77723df1c84a08f2037f06efdc5581552a","observation_id":"88953b78-3c18-4c78-9e55-d4518e09998d","resolution":{"observed_at":"2026-08-11T21:27:51.762593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16993","last_updated":"2024-03-25T17:55:52Z","snapshot_observed_at":"2026-08-11T04:36:35.874072Z","submitted_at":"2024-03-25T17:55:52Z","title":"Comp4D: LLM-Guided Compositional 4D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16993","snapshot_observed_at":"2026-08-11T21:27:51.768671Z","title":"Comp4D: LLM-guided compositional 4D scene generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.768671Z"},"links":{"cited_paper":"/paper/2403.16993","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:1a96c6f9a518d66f6a3f984201fd2cedffadbf38c0df9c3de283d68ac07bf535","observation_id":"f6f7716f-87d3-42ba-bbc7-216088f3648e","resolution":{"observed_at":"2026-08-11T21:27:51.768671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-11T21:27:51.774500Z","title":"CogVideoX: Text-to-video dif- fusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.774500Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:131355328dc08e0faad6b60992bdcf31f0bf27f40f7bc79838c22173b2a94d83","observation_id":"df07b041-0db0-4d8f-94ab-2fe6a34607ca","resolution":{"observed_at":"2026-08-11T21:27:51.774500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17225","last_updated":"2024-12-04T06:11:50Z","snapshot_observed_at":"2026-08-11T16:22:58.556149Z","submitted_at":"2023-12-28T18:53:39Z","title":"4DGen: Grounded 4D Content Generation with Spatial-temporal Consistency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17225","snapshot_observed_at":"2026-08-11T21:27:51.779232Z","title":"4DGen: Grounded 4D content gener- ation with spatial-temporal consistency","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.779232Z"},"links":{"cited_paper":"/paper/2312.17225","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:af70d982d83599d6651f83e345da36ab48df712a3fe3eb15c180fc726862a293","observation_id":"e4d5f5fc-199e-4fe9-b0a5-d12c45eb1276","resolution":{"observed_at":"2026-08-11T21:27:51.779232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03414","last_updated":"2023-06-16T15:10:28Z","snapshot_observed_at":"2026-08-03T14:58:53.656002Z","submitted_at":"2023-06-06T05:26:26Z","title":"DreamSparse: Escaping from Plato's Cave with 2D Frozen Diffusion Model Given Sparse Views","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03414","snapshot_observed_at":"2026-08-11T21:27:51.783473Z","title":"DreamSparse: Escaping from plato’s cave with 2D diffusion model given sparse views","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.783473Z"},"links":{"cited_paper":"/paper/2306.03414","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:36065df3d3ec45f0db2967d6e851082700ac981b3b48ef275ecc5d596e821302","observation_id":"4f15f79d-8255-40a7-ba86-d157898048d0","resolution":{"observed_at":"2026-08-11T21:27:51.783473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07472","last_updated":"2024-11-20T01:32:48Z","snapshot_observed_at":"2026-08-12T23:45:20.258560Z","submitted_at":"2024-06-11T17:19:26Z","title":"4Real: Towards Photorealistic 4D Scene Generation via Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07472","snapshot_observed_at":"2026-08-11T21:27:51.791848Z","title":"4Real: Towards photorealis- tic 4D scene generation via video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.791848Z"},"links":{"cited_paper":"/paper/2406.07472","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:53daa633e3d64e8c27ee59fd934d72844e300b7061f2dbca5c76640cf335c865","observation_id":"5aab6bee-9a91-43b9-b8f5-0ade581b1aa0","resolution":{"observed_at":"2026-08-11T21:27:51.791848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.372805Z","title":"Text2NeRF: Text-driven 3D scene generation with neural radiance fields","venue":null,"work_id":"a175cb25-5ab8-42cb-833e-b8f825125efb","year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.798864Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:036a822716a081c8fb01d8c0f7e0c1381de84bab3948cab5b07a2691ea4a74f6","observation_id":"b6591c1c-04ff-48e8-a10a-bccbb11cad00","resolution":{"observed_at":"2026-08-11T21:27:52.377833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.358662Z","title":"3D- SceneDreamer: Text-driven 3D-consistent scene generation","venue":null,"work_id":"b8c121cf-e768-47f1-8832-b833e0cc5bad","year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.803817Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:84e8d388b8a6128b4031a20e1c079592390b8a99bcf40aafc294398897bec522","observation_id":"19910976-b323-464e-9ee6-040acec46f0f","resolution":{"observed_at":"2026-08-11T21:27:52.363363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14603","last_updated":"2024-02-19T02:30:14Z","snapshot_observed_at":"2026-08-12T02:58:01.071932Z","submitted_at":"2023-11-24T16:47:05Z","title":"Animate124: Animating One Image to 4D Dynamic Scene","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14603","snapshot_observed_at":"2026-08-11T21:27:51.810327Z","title":"Animate124: Animating one im- age to 4D dynamic scene","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.810327Z"},"links":{"cited_paper":"/paper/2311.14603","citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:5d70fe909645d13bae9e9a3ed60a7dceaa6c4a3bbd6841eb4efb04022191adcb","observation_id":"aefdaea2-a755-46ab-8f3e-ba033cd4ed4f","resolution":{"observed_at":"2026-08-11T21:27:51.810327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.344926Z","title":"A unified approach for text- and image-guided 4D scene generation","venue":null,"work_id":"66826861-ac0d-4138-977b-4b42496f465c","year":2024},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.815676Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:0a91fcf3fc6e384db3a92fa550e7392d61d0bd2264b07b919b30617840938254","observation_id":"2be3b4ff-6c56-419a-bd36-fb6b56b03c1e","resolution":{"observed_at":"2026-08-11T21:27:52.348747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.332460Z","title":"Comparison with additional text-to-4D methods","venue":null,"work_id":"af8c71a4-13e5-41d8-a9bc-c438259205af","year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.822086Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:76eabe9eb20e0821a25b7617bf7e46a98a1ed4d7429a1bb770a0a8a758a017ab","observation_id":"1120a457-b980-43c8-9353-54c80d7e3c68","resolution":{"observed_at":"2026-08-11T21:27:52.336284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.318578Z","title":null,"venue":null,"work_id":"6896f47f-0a1c-4faf-9144-a4b95a0878e5","year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.831281Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:8d10f9e65d4b479ff58ad96247338722087da1ff0452cdec4408e344649b83aa","observation_id":"537e6591-1d9e-447c-a307-2b3a0be75131","resolution":{"observed_at":"2026-08-11T21:27:52.322984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.303650Z","title":"Ad- vancements in this area would likely enhance the ren- dering quality of our method and enable better handling of fast motion","venue":null,"work_id":"39484a05-7aac-4391-bb06-f8e7296b0fd1","year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.836232Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:0d9ce5741598b94d2b6983b7ccc2f47881082c356026a92382948ee0c67c544b","observation_id":"5a54641d-41da-40bf-8239-9441a987311d","resolution":{"observed_at":"2026-08-11T21:27:52.308821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:27:52.284769Z","title":"A fox building a sandcastle on a beach in the evening","venue":null,"work_id":"78ac874e-30e7-4bd4-b343-d9776be1a826","year":null},"citing_paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T21:27:51.840638Z"},"links":{"citing_paper":"/paper/2412.04471"},"observation_digest":"sha256:63d562f74f08b4f538a56913e1f5dc7d37fba501f28909e32acd3c87338430a6","observation_id":"e8572fc1-adfb-452a-ac23-e598584d0a77","resolution":{"observed_at":"2026-08-11T21:27:52.293027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.04471","last_updated":"2025-03-29T00:26:04Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T02:58:37.285367Z","submitted_at":"2024-12-05T18:59:57Z","title":"PaintScene4D: Consistent 4D Scene Generation from Text Prompts"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2412.04471."}