{"as_of":"2026-08-20T20:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c013b154036071c6de74583e5f111e49861deecb35e380e74c199b3cc50bb2bf","coverage":[{"denominator":103,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:58:48.669334Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.11457/citation-record","integrity":"/paper/2412.11457/integrity","json":"/paper/2412.11457/citation-record.json","paper":"/paper/2412.11457"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.330010Z","title":"Omni3d: A large benchmark and model for 3d object detection in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.330010Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:10e2ea3dbd2ec6efa53c708fa2ae1d26b9fb96c2f404f813a227c4e7e6165ac1","observation_id":"cfe392d6-d1a0-477f-9ff1-b66e91a50d8e","resolution":{"observed_at":"2026-08-11T14:58:48.330010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.334088Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.334088Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:620a6883eba522658b56c1400f8b032d90fd6e49a524c66393a9aa401e38330a","observation_id":"e05a6b54-cdc7-4927-a298-dff066d135e6","resolution":{"observed_at":"2026-08-11T14:58:48.334088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.337797Z","title":"Scenetex: High-quality texture synthesis for indoor scenes via diffusion priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.337797Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c7e679288696d57090855f6844bfdb747602c084c0706a2b743a98a09172dc23","observation_id":"761bb293-54b3-4b63-b5bd-e59551720448","resolution":{"observed_at":"2026-08-11T14:58:48.337797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10972","last_updated":"2023-05-21T07:07:55Z","snapshot_observed_at":"2026-08-17T13:04:22.753084Z","submitted_at":"2023-01-26T07:37:22Z","title":"On the Importance of Noise Scheduling for Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10972","snapshot_observed_at":"2026-08-11T14:58:48.341462Z","title":"On the importance of noise scheduling for diffu- sion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.341462Z"},"links":{"cited_paper":"/paper/2301.10972","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f2d3640fc644b61e2f54fa28a0277911b7382210380089767f3edf77fefe1229","observation_id":"b5a0119d-6323-4acc-af23-6ab7f5203d03","resolution":{"observed_at":"2026-08-11T14:58:48.341462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.346354Z","title":"Cascade-zero123: One image to highly consistent 3d with self-prompted nearby views","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.346354Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:57f3a310914ac7bf6c1462b78ddc27c2a1f76d6451e693ec0bab03c0a02c8388","observation_id":"a7b307e3-4069-48ae-807e-79fd96d22be8","resolution":{"observed_at":"2026-08-11T14:58:48.346354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.350012Z","title":"Single-view 3d scene reconstruc- tion with high-fidelity shape and texture","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.350012Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:422aaec2580c1fccfee34bca22a0f190baebcd151ce537733ecac2bf5d1d732b","observation_id":"6a017c17-90d4-4a84-80d9-1d3de1f24d2c","resolution":{"observed_at":"2026-08-11T14:58:48.350012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.353805Z","title":"Comboverse: Compositional 3d assets creation using spatially-aware diffusion guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.353805Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e60953c0836d09053428a12b07373fc0b27f62ccc82019789be3abde159b6669","observation_id":"5f06ef78-75d6-47c9-a151-0822fb6f7c89","resolution":{"observed_at":"2026-08-11T14:58:48.353805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.357673Z","title":"Mvsplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.357673Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:8662bbca68329d49d0e33f86b218555de042679e695b2c77a6631ad52a5c2c3c","observation_id":"e9caf5f5-4a9c-4918-a0b4-3dd10b719da2","resolution":{"observed_at":"2026-08-11T14:58:48.357673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.361517Z","title":"Blender - a 3D modelling and rendering package","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.361517Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:26538bd2c41c079ab73e960f41564cc9e08c51c9fb849401bce3f217353348ec","observation_id":"2780389a-47cf-4d35-992f-66e4c24ee143","resolution":{"observed_at":"2026-08-11T14:58:48.361517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.365164Z","title":"Anyskill: Learning open- vocabulary physical skill for interactive agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.365164Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:75aa0e0478ad4a8ed272a8b72cc683dd8038666cc991ea8bbccab1f14ae7ee78","observation_id":"c85672b5-934f-4e0e-b518-ea060b0302ca","resolution":{"observed_at":"2026-08-11T14:58:48.365164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.368889Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.368889Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:9e3538a04d80e33c523b56a71afcb7c347439295e2812f85666c5f8a6b8e3ee9","observation_id":"36922264-6607-44fc-9666-d1709079124a","resolution":{"observed_at":"2026-08-11T14:58:48.368889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.372311Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.372311Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:9abe85b128e35662c40743bce72b1b2cfef335d6c1e06cad0906482419e5b392","observation_id":"b7f2ed2d-e08e-4fd9-a838-a981c076199b","resolution":{"observed_at":"2026-08-11T14:58:48.372311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.375588Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.375588Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:908cc34577872b74461e5bb84b64a9f76b1d7f0c8f699b781ceea9db0c075e50","observation_id":"2ed6a432-7503-43e1-82b3-e820e759b342","resolution":{"observed_at":"2026-08-11T14:58:48.375588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03421","last_updated":"2025-03-31T13:42:34Z","snapshot_observed_at":"2026-08-20T07:00:15.443671Z","submitted_at":"2024-04-04T12:58:46Z","title":"Gen3DSR: Generalizable 3D Scene Reconstruction via Divide and Conquer from a Single View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03421","snapshot_observed_at":"2026-08-11T14:58:48.379565Z","title":"General- izable 3d scene reconstruction via divide and conquer from a single view","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.379565Z"},"links":{"cited_paper":"/paper/2404.03421","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3e14dce2bc58a4c892a160bd92132a41e4a5f7d931c1ea5ac5ae36a6073d4af0","observation_id":"c7543ed9-31e4-46e3-8c0c-01d3cae2c39c","resolution":{"observed_at":"2026-08-11T14:58:48.379565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.383250Z","title":"3d-front: 3d furnished rooms with layouts and semantics","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.383250Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f8f42147dbab786a5de95e5673d4b7d2898fa1f60d9ab3b7faaae82b05fa1bc4","observation_id":"7783aeff-3ec5-4897-8ece-6895bb24e113","resolution":{"observed_at":"2026-08-11T14:58:48.383250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.386784Z","title":"3d-future: 3d fur- niture shape with texture","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.386784Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:067bac836198e22fc166a1b4e02253ff61deeba38ff95fad6a74f5474428c1ea","observation_id":"19c1d0b1-2f6e-4dbb-9c23-09bdbd86deac","resolution":{"observed_at":"2026-08-11T14:58:48.386784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04321","last_updated":"2023-09-11T11:27:53Z","snapshot_observed_at":"2026-08-16T15:41:42.531662Z","submitted_at":"2023-04-09T21:42:57Z","title":"ARNOLD: A Benchmark for Language-Grounded Task Learning With Continuous States in Realistic 3D Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04321","snapshot_observed_at":"2026-08-11T14:58:48.390173Z","title":"Arnold: A benchmark for language-grounded task learning with continuous states in realistic 3d scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.390173Z"},"links":{"cited_paper":"/paper/2304.04321","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:590f4252c1032b349004818df0ddd102698c04fb8d16e7162db00ffecb607770","observation_id":"b7fbf83e-5c97-4025-a0aa-13971d367bec","resolution":{"observed_at":"2026-08-11T14:58:48.390173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13788","last_updated":"2024-12-19T17:51:42Z","snapshot_observed_at":"2026-08-16T14:07:56.863581Z","submitted_at":"2024-03-20T17:51:53Z","title":"DepthFM: Fast Monocular Depth Estimation with Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13788","snapshot_observed_at":"2026-08-11T14:58:48.393874Z","title":"Depthfm: Fast monocular depth estimation with flow matching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.393874Z"},"links":{"cited_paper":"/paper/2403.13788","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:49618e5ce47cfcb73c3ed6c274abb4f5b1885cfcb464018bfbc2d4b3e6cdc61f","observation_id":"20173af1-b389-4458-82f1-830fba100cb8","resolution":{"observed_at":"2026-08-11T14:58:48.393874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.397520Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.397520Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:399b0fc106cd8e03b46a613e2e7761a69053118f1db76ee0f4284f0286dc308d","observation_id":"9bf00527-d096-4cf6-9740-469d181fd149","resolution":{"observed_at":"2026-08-11T14:58:48.397520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.400996Z","title":"Text2room: Extracting textured 3d meshes from 2d text-to-image models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.400996Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:51fa568319a991ba4796bf4359942d3f5e1b744dac1f8a448fb3e786023eb67d","observation_id":"130053ed-8ace-49d2-8c55-bcdb2bac4b85","resolution":{"observed_at":"2026-08-11T14:58:48.400996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.404267Z","title":"An embodied generalist agent in 3d world","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.404267Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b4ac22f3ab7b50ca0cb190337fbd726c86561593f64ec441e1392353510f2345","observation_id":"d80e61b6-b9ad-423a-bd80-2b6910a6ec8f","resolution":{"observed_at":"2026-08-11T14:58:48.404267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.407228Z","title":"Unveiling the mist over 3d vision-language under- standing: Object-centric evaluation with chain-of-analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.407228Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:a39c256b6a067275c5e2b6cb56f607c9a590a12a0b5a56227122b834fa553e87","observation_id":"3e94c9a1-c2db-48ed-89b7-902a3d03fe44","resolution":{"observed_at":"2026-08-11T14:58:48.407228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.410450Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.410450Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:cbfa8af58d40230d4212d8a436c06df4b05f9f9eb8bb301486ea38c801b8ea59","observation_id":"0c2eb99e-c551-4b28-92e2-e32b3665b605","resolution":{"observed_at":"2026-08-11T14:58:48.410450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16778","last_updated":"2025-03-28T21:52:16Z","snapshot_observed_at":"2026-08-16T21:56:43.058161Z","submitted_at":"2024-12-21T21:22:01Z","title":"RoomPainter: View-Integrated Diffusion for Consistent Indoor Scene Texturing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16778","snapshot_observed_at":"2026-08-11T14:58:48.413761Z","title":"Roompainter: View-integrated diffusion for consistent indoor scene texturing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.413761Z"},"links":{"cited_paper":"/paper/2412.16778","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e32948e1ba6ea3953ce83fc7cda1e3e346addf25d73088f9ef622888c6cfe286","observation_id":"6b46e4d0-6ac1-480c-a5ac-ce0fe76b6f6a","resolution":{"observed_at":"2026-08-11T14:58:48.413761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.417268Z","title":"Putting nerf on a diet: Semantically consistent few-shot view synthe- sis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.417268Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b9de575151944c12d359c7f3f83c292707f63be83a59f230b46d5d022ada7eb3","observation_id":"98a1eb1a-50f6-45e4-9160-a17856a00be4","resolution":{"observed_at":"2026-08-11T14:58:48.417268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.420261Z","title":"Zero-shot text-guided object gener- ation with dream fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.420261Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:9e8e515ccc376a27c2117516616013ccfc6bfe528ad9d030502ac5ca003237f5","observation_id":"35c7acd4-5281-487b-9da9-444b0705e171","resolution":{"observed_at":"2026-08-11T14:58:48.420261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.423617Z","title":"Sceneverse: Scaling 3d vision-language learning for grounded scene understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.423617Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:bae7b9bee7cd825385d0135856baf08f311ce7884a9b45a204d0c69266f4c385","observation_id":"b51a8801-74c9-4bbf-a9c0-6cf6ddd05430","resolution":{"observed_at":"2026-08-11T14:58:48.423617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.427111Z","title":"Autonomous character-scene interaction synthesis from text instruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.427111Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:27aa2ca75db1d884c56bc865b2a51683ddd3a7efff9f8d9a5c7d8368994088a6","observation_id":"a1645a1b-a5b9-4c3d-b969-5b228bae92c3","resolution":{"observed_at":"2026-08-11T14:58:48.427111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.491999Z","title":"Scaling up dynamic human-scene interaction model- ing","venue":null,"work_id":"db31d7ea-3157-4f7d-913c-4d3cda164226","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.430444Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:825c6f6b4bddaa9274d6c59a96ed717ab444a430537b544da2bf14939072a8f8","observation_id":"685787a8-d1d8-4690-b097-f6c15c8c12f9","resolution":{"observed_at":"2026-08-11T14:58:49.495024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03015","last_updated":"2023-10-04T17:57:07Z","snapshot_observed_at":"2026-08-16T14:55:02.012457Z","submitted_at":"2023-10-04T17:57:07Z","title":"Efficient-3DiM: Learning a Generalizable Single-image Novel-view Synthesizer in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03015","snapshot_observed_at":"2026-08-11T14:58:48.433548Z","title":"Efficient- 3dim: Learning a generalizable single-image novel-view synthesizer in one day","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.433548Z"},"links":{"cited_paper":"/paper/2310.03015","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e0d5834bb91928554e7d50feb2844024a0aad21e26f2019d827264ac845724b1","observation_id":"0063f61d-a1d8-4f60-b5f7-c29d63c10f19","resolution":{"observed_at":"2026-08-11T14:58:48.433548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.482197Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":"956f9951-0300-4987-9678-06712fa18c63","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.437488Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:685ac76744e2fddce249cc86dd3f8e4bb52985d370349ba8e34215950490191a","observation_id":"208223de-9171-4092-b746-8b743597257b","resolution":{"observed_at":"2026-08-11T14:58:49.485869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.472130Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"a8b80e97-dfea-4bbf-9aa8-2962115cdb84","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.440936Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e8f5d3084d6c80d8da98380d080aef58ae346160373d894fdfb02fc402c363f8","observation_id":"8b7ae2e3-f9f0-4d65-bc91-1e3e56cf7836","resolution":{"observed_at":"2026-08-11T14:58:49.475969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.462500Z","title":"Segment anything","venue":null,"work_id":"f4d855f6-7e66-4d9b-91e4-6ef40bd9f1f7","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.444622Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:31fec9f4e91e6b290b010b3cfa1bb00c8d469a044197d280fed284f9f47b4c12","observation_id":"ed37adfc-3dc3-493c-982d-7ec90d7f1524","resolution":{"observed_at":"2026-08-11T14:58:49.465995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.452692Z","title":"Eschernet: A generative model for scalable view synthesis","venue":null,"work_id":"2e3cea28-c815-4057-9fc0-096140064459","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.447978Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:12392f9de2f8e4d64871941bd1aaab66399f36c871cb8b5beb49ae16012c1fc5","observation_id":"6f523239-9369-4096-855c-2986ccfb97c7","resolution":{"observed_at":"2026-08-11T14:58:49.456336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.443137Z","title":"Ground- ing image matching in 3d with mast3r","venue":null,"work_id":"24dc42ba-ac65-4d63-876f-0b434705c590","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.451211Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:77ac477a6a8a8125ae2c3e86b443b3f7951b49a4760f9d433bfe9d97f53599da","observation_id":"02e71eb2-54a7-4309-976b-a167601daed0","resolution":{"observed_at":"2026-08-11T14:58:49.446586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.432840Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"0864f3c4-66b1-4699-be23-31973ed8c2e4","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.454551Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c354f5f628476283f94881b7647457ba77a49ed5c33100dcaed798583a2be97f","observation_id":"0176c219-3939-4b3d-b98c-5553bf5d4c74","resolution":{"observed_at":"2026-08-11T14:58:49.436690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.421877Z","title":"Gendexgrasp: General- izable dexterous grasping","venue":null,"work_id":"2b1b1305-6c6c-40ca-8aa0-02ce1f29ba45","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.457978Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:54bff08f2671f3f1bfb1f82cf906fa8bea825f72dfcafc5e54d58326b343b0c3","observation_id":"cba8d3bb-dcb8-44ce-9e47-64bb6d38b4f5","resolution":{"observed_at":"2026-08-11T14:58:49.425588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.411222Z","title":"Ag2manip: Learning novel manipulation skills with agent- agnostic visual and action representations","venue":null,"work_id":"45117084-78b7-40ae-bad3-e8609ea3ba45","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.461251Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3c4b6d24818a90f5edee43f8b7f460ecf322883a8e068c0fbbe8a21c27fe3f35","observation_id":"6112a08e-bc9b-4597-a601-a8f1452894ca","resolution":{"observed_at":"2026-08-11T14:58:49.415047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07078","last_updated":"2024-12-28T05:41:37Z","snapshot_observed_at":"2026-08-16T13:11:00.698374Z","submitted_at":"2024-10-09T17:23:04Z","title":"FlowBotHD: History-Aware Diffuser Handling Ambiguities in Articulated Objects Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07078","snapshot_observed_at":"2026-08-11T14:58:48.464582Z","title":"Flowbothd: History-aware diffuser handling ambiguities in articulated objects manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.464582Z"},"links":{"cited_paper":"/paper/2410.07078","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:05d25ac61a13ae001b1a6f915d90b7ce185ebac7eb67b260cecdb88c5c2c9fe2","observation_id":"f20bc489-37f5-4492-9ac8-4d0dd6899a5e","resolution":{"observed_at":"2026-08-11T14:58:48.464582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.401137Z","title":"Grasp multi- ple objects with one hand","venue":null,"work_id":"9bec7384-b4d4-4239-ba69-cc8c384fbbda","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.468335Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:ce09edb31cf585a23d4a9d89a1ac0a2d35028cb60ccdad0570150ea3bf2c4b70","observation_id":"fedc6044-715e-4d5d-83ad-34acd74d0acb","resolution":{"observed_at":"2026-08-11T14:58:49.405115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.390795Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":"6bb8dccb-dfde-4c52-8faa-4782d62d3bee","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.471427Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:8dcae8d8f8b24733f744e1cee6304db594b9787885102dce4dd167353889eac3","observation_id":"77b051b8-d0d5-4a96-86f1-e5690f900ae2","resolution":{"observed_at":"2026-08-11T14:58:49.394351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.381219Z","title":"Consistent123: One image to highly consistent 3d asset using case-aware diffusion priors","venue":null,"work_id":"e28e8c12-3d02-47b2-9273-ca8273c0d619","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.474635Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e468e1800e7ea7ee031e4784bc9049acc17c7404f00bf9612bc93a93d65ce397","observation_id":"95f2e7da-807d-4261-9939-e971f2e47b63","resolution":{"observed_at":"2026-08-11T14:58:49.384719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.371120Z","title":"Multi-modal situated reasoning in 3d scenes.Advances in Neural Information Pro- cessing Systems (NeurIPS), 2024","venue":null,"work_id":"905bb65b-baf3-4c6e-98ac-8baec3799e66","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.477902Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:7a52f18c79b3702c26bf545021d8cb7cc93f147f82080afb9b5ef086f22c9741","observation_id":"fd675dd1-24b5-41a4-a001-748cbb07fcb1","resolution":{"observed_at":"2026-08-11T14:58:49.374512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.361632Z","title":"One-2-3-45: Any single image to 3d mesh in 45 seconds without per-shape optimiza- tion","venue":null,"work_id":"fed8f927-7e66-4149-88d4-f61aab6f0bc3","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.480982Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:12c7d6a5e66db85f81084e4cc4b586ea4d90cc26ccd7e7d85027718dd088626c","observation_id":"f5425424-61ee-496d-91a2-c9ecedf947e3","resolution":{"observed_at":"2026-08-11T14:58:49.365019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.351277Z","title":"One-2-3-45++: Fast single image to 3d objects with consistent multi-view generation and 3d diffusion","venue":null,"work_id":"1a128dd8-40c4-4c80-a704-ee5d9d3c4eaa","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.484247Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:4c1a6ebd775cac4eb97c9f5bb0b1fb35136af2cc2a000c8cd0bd278e9b43dfd9","observation_id":"db482454-0462-4fc3-a62a-18154f29abf7","resolution":{"observed_at":"2026-08-11T14:58:49.355018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.339993Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"2e2c8e36-e967-45ae-94d4-90eb18e51f99","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.487419Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0f274b78e3d5f14e9d529726e6a10aa56601331d9040d8c72a88a51fba1239c1","observation_id":"2ed4584e-0ab3-4894-8333-80ad551befd3","resolution":{"observed_at":"2026-08-11T14:58:49.344072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-08-12T22:52:54.817720Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-11T14:58:48.490863Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.490863Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3baef5a7c22d3169ff25341d3244e2512e6471d91d1844bc2fd57a77146aa8f8","observation_id":"3f7ff390-6cff-4686-8d8a-acd2f62c39c3","resolution":{"observed_at":"2026-08-11T14:58:48.490863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.329365Z","title":"Slotlifter: Slot-guided feature lifting for learning object- 10 centric radiance fields","venue":null,"work_id":"0a90fdf3-4c20-4af1-9f66-1119e140a508","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.494617Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:71a8500af329e3621a8949e5baa1d7ac40bdb31ca94fad234d5e429f7b36d69e","observation_id":"c707ed77-cf9a-4808-898b-fa9a27c8b2ac","resolution":{"observed_at":"2026-08-11T14:58:49.333050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19459","last_updated":"2025-03-19T08:43:16Z","snapshot_observed_at":"2026-08-16T12:55:03.802443Z","submitted_at":"2025-02-26T10:25:32Z","title":"ArtGS: Building Interactable Replicas of Complex Articulated Objects via Gaussian Splatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19459","snapshot_observed_at":"2026-08-11T14:58:48.497863Z","title":"Building interactable replicas of complex articulated objects via gaussian splatting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.497863Z"},"links":{"cited_paper":"/paper/2502.19459","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e7dc02f1b2f5bc77ab1d64a239a143143a3628c9b3439193a40a1edf42320339","observation_id":"cc661913-f8b4-4729-aa81-9bb746e73427","resolution":{"observed_at":"2026-08-11T14:58:48.497863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.501483Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.501483Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:767f1c52d3fdb4a9380f8a39659f82c363958dabaa78c945a33e231f2587ff52","observation_id":"6700387f-f707-4047-bff9-ba6949ee4ad1","resolution":{"observed_at":"2026-08-11T14:58:48.501483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.312452Z","title":"Manigaussian: Dynamic gaus- sian splatting for multi-task robotic manipulation","venue":null,"work_id":"ba3e23bd-29e2-4da3-ad29-a056131d2bab","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.504696Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:dc1af6b5a1dfd04204a62eeefcd742d9fffe6375c89267af230d11823d2c2d8d","observation_id":"7f55ae47-31e7-4285-aac8-c7945be34766","resolution":{"observed_at":"2026-08-11T14:58:49.316239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12049","last_updated":"2025-08-04T14:59:28Z","snapshot_observed_at":"2026-08-19T18:03:43.506070Z","submitted_at":"2025-03-15T08:47:45Z","title":"TACO: Taming Diffusion for in-the-wild Video Amodal Completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12049","snapshot_observed_at":"2026-08-11T14:58:48.507473Z","title":"Taco: Taming diffusion for in-the-wild video amodal completion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.507473Z"},"links":{"cited_paper":"/paper/2503.12049","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b00fb380fe3e3d9550d864c74239b76770480db424c6dc6905a56b089846c6f8","observation_id":"bf918113-275c-4ba9-9cb9-cb1d3adccc7c","resolution":{"observed_at":"2026-08-11T14:58:48.507473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.301803Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":"8e6ec828-2a38-47b9-bc6e-df07509a60a0","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.510496Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:77978a5b3adbb0584f306729c06bb1772fa92cd858723706850b914fdf09d9b8","observation_id":"d87f0023-53eb-4f46-94c7-7ff6aaa5273d","resolution":{"observed_at":"2026-08-11T14:58:49.305917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07376","last_updated":"2025-02-14T22:53:14Z","snapshot_observed_at":"2026-08-16T14:19:28.619754Z","submitted_at":"2024-02-12T02:16:59Z","title":"Unsupervised Discovery of Object-Centric Neural Fields","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07376","snapshot_observed_at":"2026-08-11T14:58:48.513419Z","title":"Unsuper- vised discovery of object-centric neural fields.arXiv preprint arXiv:2402.07376, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.513419Z"},"links":{"cited_paper":"/paper/2402.07376","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:10150ad5206872f5cb56ec7507e88fecf80cd93f79959b4c7665ffa3f59498f3","observation_id":"3b7ba7ae-faa0-47e3-8e2e-39d3d5ebbc9d","resolution":{"observed_at":"2026-08-11T14:58:48.513419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.291133Z","title":"Realfusion: 360deg reconstruction of any object from a single image","venue":null,"work_id":"f5f8b789-7eef-4017-95bd-f1a9cbc084c9","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.516282Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:1ac36fdc4f714f550014701b02607845b29e04fa13deeb3120b0250f0f4cd545","observation_id":"05184574-3ee2-48e6-bf35-fe02f7fd8767","resolution":{"observed_at":"2026-08-11T14:58:49.295177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.519191Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.519191Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:48f4cb35aba9a89c2495fd201bd8d80242fe88e4618b3bab3f941c618c35f590","observation_id":"c8644b56-0ccc-4504-b6eb-1c61c3704174","resolution":{"observed_at":"2026-08-11T14:58:48.519191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.274411Z","title":"Phyrecon: Physically plausible neural scene recon- struction","venue":null,"work_id":"eb8624c1-8bd0-401a-8688-b4cfd9b98d61","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.521872Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f4e27329b408baa2ee57ca2c86c36983e89adc1fba510a977d2ea1ad21f50d53","observation_id":"d9665b85-672a-47fd-8a38-3c8022831e11","resolution":{"observed_at":"2026-08-11T14:58:49.278029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.253475Z","title":"Decompositional neu- ral scene reconstruction with generative diffusion prior","venue":null,"work_id":"49cedf97-68aa-469e-a76d-72eea01bc5e6","year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.524558Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:a67ebfa2270901c31b4849266fed8816fd2874fba532acd8eee591152dc84ed4","observation_id":"b50f9bcf-7ca8-4619-b811-15c8c8bc6254","resolution":{"observed_at":"2026-08-11T14:58:49.257488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.243050Z","title":"Total3dunderstanding: Joint lay- out, object pose and mesh reconstruction for indoor scenes from a single image","venue":null,"work_id":"51e1e8ed-e679-4b87-83cd-0a946707b2da","year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.527263Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:27d7e256cf74ab3ad3c4963d7c066916d221f6a87a4dc7baca526063c1f469ad","observation_id":"bd254085-f9c5-446f-908d-cdc70b2be567","resolution":{"observed_at":"2026-08-11T14:58:49.247010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-11T14:58:48.530488Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.530488Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:997b9119ce97c2a33964c1afb92976aa95ef9296024503869a08012492fb04c8","observation_id":"02fdfef7-c6ae-4abc-bf2b-0e37a971a7bd","resolution":{"observed_at":"2026-08-11T14:58:48.530488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.232976Z","title":"pix2gestalt: Amodal segmentation by synthesizing wholes","venue":null,"work_id":"78cdb1b4-8ba5-418a-bc4d-5cedc9e06474","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.534370Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:1d99c11f2b95667e13398765fe7c3ed49cd82babc6ed94fc4284c994a2eba60f","observation_id":"48184d54-c8e1-482a-b634-e000fe00e3fb","resolution":{"observed_at":"2026-08-11T14:58:49.236181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-11T14:58:48.537644Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.537644Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:242ade840378dbcdf22e817b884e4590b1db26b0090e7b748749ecbc19616c8c","observation_id":"e4448c60-fe82-4e09-a3e8-0fc8dad97d26","resolution":{"observed_at":"2026-08-11T14:58:48.537644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17843","last_updated":"2023-07-23T21:27:30Z","snapshot_observed_at":"2026-08-20T12:03:29.864144Z","submitted_at":"2023-06-30T17:59:08Z","title":"Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17843","snapshot_observed_at":"2026-08-11T14:58:48.540876Z","title":"Magic123: One image to high-quality 3d object generation using both 2d and 3d diffusion priors.arXiv preprint arXiv:2306.17843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.540876Z"},"links":{"cited_paper":"/paper/2306.17843","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:78195713da50a910c0c139f0ebeb60a9436fb04fcf542a101ba427b38b13c31c","observation_id":"3368c432-0813-41e0-a9fb-635dd46383c6","resolution":{"observed_at":"2026-08-11T14:58:48.540876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.223174Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"948c3817-dc2d-4bdb-92bb-a6e2cfb1805b","year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.544636Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:8dd5175b229974bbfefcac5732e95df766af0046a1a619c2db4dcce8d60611d5","observation_id":"ad3b527e-31d1-413b-9f14-aa3a75afb20e","resolution":{"observed_at":"2026-08-11T14:58:49.226775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.213348Z","title":"Language embedded radiance fields for zero-shot task- oriented grasping","venue":null,"work_id":"8338ceb8-004b-4883-91b4-14bb1c55cb04","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.547846Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c8e189c0996c8b9271d1fca166b53d7ded1c938faf2de12016315de420f48508","observation_id":"7ca5c1cf-145d-4a37-81d1-9ddeb4181ecc","resolution":{"observed_at":"2026-08-11T14:58:49.216984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.204187Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"024a2065-f8e8-4358-a77f-7f8cb1a9e725","year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.551090Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:061e4a208efafaf88eb2c7eaa1c29f6879e740775166ab2423ae40f343ad5fb8","observation_id":"4d42f4b3-170c-4d70-acba-37801d0f3133","resolution":{"observed_at":"2026-08-11T14:58:49.207844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.194716Z","title":"Zeronvs: Zero-shot 360- degree view synthesis from a single image","venue":null,"work_id":"5083f86a-bf34-4289-b2f1-c1a26b0f304c","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.554302Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:21a1c98aa7c220f61ba50b59478c66e6fa140404bab54a0d4ee4e18b944dab7c","observation_id":"295bea2a-8d77-4762-bb1a-d7cebdcf0492","resolution":{"observed_at":"2026-08-11T14:58:49.198123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-08-15T06:11:26.743203Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-11T14:58:48.557616Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.557616Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:4bdb943047d077b89f0d873bb17c7757a63f61bd83762dfff8b4b697b2bea981","observation_id":"7b6ea471-9e84-4e20-ab68-ab782135a2e5","resolution":{"observed_at":"2026-08-11T14:58:48.557616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-08-17T23:11:03.362702Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-11T14:58:48.561316Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.561316Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:54ce58f2f0dbcdbb1e60a3adde1d244dfc6a59616cadcf45f89bfbaf31502d14","observation_id":"748f95ab-cd5d-41e0-bfbd-d39d316c40d3","resolution":{"observed_at":"2026-08-11T14:58:48.561316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.184924Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":"99837768-a869-45d4-8300-d8d5d989f42e","year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.565002Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:067219fd14e0299566667599682034816cbd57ec9b2fa928c3ba440d25c4ecd0","observation_id":"574bb7aa-5438-4fc0-bbb9-0dcde12f5c09","resolution":{"observed_at":"2026-08-11T14:58:49.188527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.174530Z","title":"Sun rgb-d: A rgb-d scene understanding benchmark suite","venue":null,"work_id":"8d3c3a58-d125-4a5f-9dad-498a9696820a","year":2015},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.568189Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:bf462b1594956c3f15500d3e0031acdd584db739fe9c1a830ac460d67d8e68d1","observation_id":"1793577b-26c8-4e74-9375-296d17c526bf","resolution":{"observed_at":"2026-08-11T14:58:49.178133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-11T14:58:48.571738Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.571738Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:58702ef6b90ac90975c0bb45568a88d9a4ee6de91f49f50fdce3f825aeb9fc5c","observation_id":"418a93e9-3ddb-4c46-8154-49584fe6cc4c","resolution":{"observed_at":"2026-08-11T14:58:48.571738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.164660Z","title":"Make-it-3d: High-fidelity 3d 11 creation from a single image with diffusion prior","venue":null,"work_id":"d25279b4-4e0c-488a-8e62-7bf2dfc700db","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.575426Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:879b37a3edfe0f4f7eee7d1f5e732c063ee56fdb039326bfd657b91948c14cc3","observation_id":"e4cba9ce-f1ce-45ad-a2f1-7fbfd8a9f1a6","resolution":{"observed_at":"2026-08-11T14:58:49.168149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.154728Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation","venue":null,"work_id":"5121bd62-a433-41af-8ddf-bc7c9f58da15","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.578569Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e22246f2a4e411afa943cbdc44480a28482684e033b54a68fadf35e2f4c01f92","observation_id":"f10dfbe5-3576-479d-b608-7b5e3c19f7e5","resolution":{"observed_at":"2026-08-11T14:58:49.158294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11878","last_updated":"2024-03-18T15:31:57Z","snapshot_observed_at":"2026-08-19T05:28:57.571074Z","submitted_at":"2024-03-18T15:31:57Z","title":"InTeX: Interactive Text-to-texture Synthesis via Unified Depth-aware Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11878","snapshot_observed_at":"2026-08-11T14:58:48.581729Z","title":"Intex: Interactive text-to-texture syn- thesis via unified depth-aware inpainting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.581729Z"},"links":{"cited_paper":"/paper/2403.11878","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:86b9eadae1c50d06de7e67d79ad2802561ce6fbccf85055d819ab68bab1910e4","observation_id":"1eb99b16-c34b-4b90-ac3b-1bb3494b5c33","resolution":{"observed_at":"2026-08-11T14:58:48.581729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.144945Z","title":"Megascenes: Scene-level view synthesis at scale","venue":null,"work_id":"95426871-2fec-49cd-8966-a32725725cc7","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.585629Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:6b6d7fc179daff831167298c63847faf20cdd562d577c5e985f9027abb9bcbe5","observation_id":"6554471f-8a6c-48e4-be37-b04ee0a0ff91","resolution":{"observed_at":"2026-08-11T14:58:49.148520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.134912Z","title":"Tracking through containers and occlud- ers in the wild","venue":null,"work_id":"c8ebb3ad-6ea7-4ee5-8014-069bf4995704","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.588952Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c0c068bdc3817d403cdbee604490382e2cb16c874d287a922361d9dd0785a547","observation_id":"31dc5386-0707-42a5-a91d-9c47ba3c988c","resolution":{"observed_at":"2026-08-11T14:58:49.138622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.124636Z","title":"Generative camera dolly: Ex- treme monocular dynamic novel view synthesis","venue":null,"work_id":"8db91b37-f93a-4b48-8670-9ce222fdb665","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.592356Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:da4ca95e1cd583e92226d62fdb5bef2e6341396cef8e2329a4e33387a7d1427c","observation_id":"cd9fbace-c39d-46b4-9996-984d99c609b1","resolution":{"observed_at":"2026-08-11T14:58:49.128510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-18T09:35:49.318861Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-11T14:58:48.595830Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.595830Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:331a9b701bd92cbeeb5de5e74ee5716ead820ea07b4ab4b82fbc2a957588960c","observation_id":"93732e78-57c9-40aa-82c0-7e6fa12dd893","resolution":{"observed_at":"2026-08-11T14:58:48.595830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.114306Z","title":"Barron, Ricardo Martin- Brualla, Noah Snavely, and Thomas Funkhouser","venue":null,"work_id":"8cda1675-1337-470f-9adb-711436fc17b2","year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.599922Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:83be0cb568d1a07b6c7eebebf697dcd7d095e9d232065762190c67a17c3e6135","observation_id":"1ee6d54c-9c73-40e7-a8b3-08a34412bfb9","resolution":{"observed_at":"2026-08-11T14:58:49.117975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.105305Z","title":"Roomtex: Textur- ing compositional indoor scenes via iterative inpainting","venue":null,"work_id":"5bd57a67-7751-40af-9e18-26baf8e21999","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.603509Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:86dac77c8ea23a388d259f6c973c6dee5c458f56d924a4b5c7a2db08e9db09b4","observation_id":"ade5204e-fd4a-40e8-8310-68c75590b803","resolution":{"observed_at":"2026-08-11T14:58:49.108215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.096471Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"87bbb67a-a6f6-45cf-b684-8bc8746c7630","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.606679Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:32965bf7c2b6a28261a08d476c057b736b4defcfd04b5f3bb4cf60db9c14ff83","observation_id":"32bf660f-43d3-48b0-80a5-8f7967963a71","resolution":{"observed_at":"2026-08-11T14:58:49.099439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04628","last_updated":"2022-10-06T16:59:56Z","snapshot_observed_at":"2026-08-16T19:00:06.320422Z","submitted_at":"2022-10-06T16:59:56Z","title":"Novel View Synthesis with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04628","snapshot_observed_at":"2026-08-11T14:58:48.609903Z","title":"Novel view synthesis with diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.609903Z"},"links":{"cited_paper":"/paper/2210.04628","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:9b577e12ffa08dd738f4db147e53bd9e30db9c2679e10358e9a827a330de8762","observation_id":"5ff3d477-a737-4177-9bfe-ac2a9fa99a59","resolution":{"observed_at":"2026-08-11T14:58:48.609903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08092","last_updated":"2023-10-12T07:38:28Z","snapshot_observed_at":"2026-08-16T14:52:48.407828Z","submitted_at":"2023-10-12T07:38:28Z","title":"Consistent123: Improve Consistency for One Image to 3D Object Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08092","snapshot_observed_at":"2026-08-11T14:58:48.613293Z","title":"Consistent123: Improve consistency for one image to 3d object synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.613293Z"},"links":{"cited_paper":"/paper/2310.08092","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:4503f8a5932bd0da84e136a75f6f1484c31826b78ff72c2d84eddfdebe10e9d7","observation_id":"979043d8-df58-4cec-ac59-7d22f8f52298","resolution":{"observed_at":"2026-08-11T14:58:48.613293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.087795Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"62cd8ac6-bbac-4178-beaa-1935618be95c","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.616683Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:241291bf36e91d5f3c40410dabe03a57b0c68e7b287ddbea10a011528bddb00d","observation_id":"e5a304b2-d1c1-4372-a9c7-598f543c5805","resolution":{"observed_at":"2026-08-11T14:58:49.090898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.078846Z","title":"Unique3d: High-quality and efficient 3d mesh generation from a single image","venue":null,"work_id":"cd644d49-c435-4bbf-bd1c-e3455fba3bf6","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.619689Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f9cb08e5ceea1f132f830e71c1f241dc87619293950e966755ab40d710123fba","observation_id":"30533397-6522-47a7-b7e8-12cb87a62c2d","resolution":{"observed_at":"2026-08-11T14:58:49.082145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01506","last_updated":"2025-05-30T11:13:13Z","snapshot_observed_at":"2026-08-17T11:46:18.301015Z","submitted_at":"2024-12-02T13:58:38Z","title":"Structured 3D Latents for Scalable and Versatile 3D Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01506","snapshot_observed_at":"2026-08-11T14:58:48.622808Z","title":"Structured 3d latents for scalable and versatile 3d gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.622808Z"},"links":{"cited_paper":"/paper/2412.01506","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c94e8a7de5e2c6d676ead82fb8df3a5f08b68958fb8a161ad393ecc8c56e768d","observation_id":"cb95fd6c-f9f5-4d10-9f51-3e37d6f4b862","resolution":{"observed_at":"2026-08-11T14:58:48.622808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.069058Z","title":"Neurallift-360: Lifting an in-the-wild 2d photo to a 3d object with 360deg views","venue":null,"work_id":"09c41a72-7270-4553-a7dd-b7b4b1adf442","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.626866Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:bcbd04741c24c44c541429d4c756171a2ffbaf609649f7fe005ba2516f911e4b","observation_id":"9339b4ab-8dee-4140-94fc-78dfdbf4e0de","resolution":{"observed_at":"2026-08-11T14:58:49.072569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.059595Z","title":"Amodal com- pletion via progressive mixed context diffusion","venue":null,"work_id":"197b1d94-fbe7-4e53-92d0-e02d682d817b","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.630365Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0638f00db8ce231dcb45d498ecbc810ae034885d2cd0d90bb7a35548d891e2ac","observation_id":"b31d01f0-f17d-4f9a-9db6-6f29126009a3","resolution":{"observed_at":"2026-08-11T14:58:49.063096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.049482Z","title":"Consistnet: Enforcing 3d consistency for multi- view images diffusion","venue":null,"work_id":"18ee9a28-75eb-4f1a-9eb4-fae7eb1d861e","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.634026Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:21772f62c4de1ad5f62adc09f5fee75e70bfbd7bf2c858ec1b95293b950799b7","observation_id":"77426d66-82eb-4f1d-9d0e-f48054b28651","resolution":{"observed_at":"2026-08-11T14:58:49.053306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.039589Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"ec357649-e0e8-4ec0-a0ea-e013960a4c59","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.637476Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:ec0100390912154655ef5d765de4cb4096404df028254edd68ea4ce73f04ffef","observation_id":"7407d7a4-ea6d-41cc-9075-c38e6892875b","resolution":{"observed_at":"2026-08-11T14:58:49.043299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.029939Z","title":"Physcene: Physically interactable 3d scene synthe- sis for embodied ai","venue":null,"work_id":"22c794dc-bbc2-48cb-9a9f-0fdf573220ed","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.641195Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:8457829f67ea589c202dfb9bd3c4c69682e7084a7332323fdecc54f44b1763d8","observation_id":"e9632b82-250d-4b8e-b99a-64eda2a6d401","resolution":{"observed_at":"2026-08-11T14:58:49.033516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.019137Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":"7e9f2f23-34da-44b0-875d-11da578f7bc1","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.644665Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:fefb513ba0c277c20d88b966ba4fabdd02812074a2923977978e6a1341388ab3","observation_id":"f1518f66-0c17-4a08-bfb0-8aad199bffb0","resolution":{"observed_at":"2026-08-11T14:58:49.023150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.009294Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":"ed382297-270e-4988-9de8-cb2a3ca312d2","year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.648128Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:691ac8bd1d337d0d844e39fcedc671f5170cc2f39acdb878b27180761ce1e44b","observation_id":"a42f2a69-7ce5-4e76-9bbe-8f2f8f7d5c44","resolution":{"observed_at":"2026-08-11T14:58:49.012955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.998850Z","title":"Amodal ground truth and completion in the wild","venue":null,"work_id":"124d49ab-5dfc-40eb-af98-472b72e49d70","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.651357Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e9ca0b1c71954d697aeae3e93cd65e0ca6dad4578752a5d82d62482ff512b519","observation_id":"188be821-c2a2-43d6-9d64-6411a7a30c08","resolution":{"observed_at":"2026-08-11T14:58:49.002748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.987432Z","title":"Self-supervised scene de- occlusion","venue":null,"work_id":"53caece0-0f2f-43f5-88e1-64feb94fcccf","year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.655218Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:000b00e3d45a79c8ba778d8148c36ca2d7095174f950def546e6efa30cee52f9","observation_id":"cc2493df-8b02-4fd0-ae64-d00fd3d9613c","resolution":{"observed_at":"2026-08-11T14:58:48.991592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.976935Z","title":"Free3d: Consistent novel view synthesis without 3d representation","venue":null,"work_id":"d3136ad1-f158-4b8a-8ecd-b88bce4f91b5","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.658439Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:12421d597b6e012f5dc71fe4a9e0ae41b0e0db7017e21a26ed7d8018a9f0350b","observation_id":"776ce211-69ab-4880-aff9-bee3decc3deb","resolution":{"observed_at":"2026-08-11T14:58:48.980739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.966904Z","title":"Stereo magnification: Learning view syn- thesis using multiplane images","venue":null,"work_id":"38b22ad8-81fe-4a8e-b711-c560ae0cee09","year":2018},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.661667Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:721363c22ed2a5b8301d3d7b6303e3aab4174f25cdab499964c153d4fa33ba77","observation_id":"35406f09-c3e8-47cc-a8e5-09683bf59bf1","resolution":{"observed_at":"2026-08-11T14:58:48.970571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.957021Z","title":"norm patchtokens","venue":null,"work_id":"ecafbbb8-24bc-4e08-bcf8-042db4fd3df8","year":2017},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.665187Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b27c9b023515c483bb0b8d7133b4970c0a1c107ee8a4bb906719838df59d08e7","observation_id":"78360498-42cb-4dca-99d4-b8d3f040e20e","resolution":{"observed_at":"2026-08-11T14:58:48.960185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.947598Z","title":"FXRvdpBKje59HAj3tIVdwRQpPk0=","venue":null,"work_id":"3573dfc8-99ee-406d-a9ee-d9b269710639","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.669334Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3df3378b51f9a05f5f0e7cb3f627083bded941d298967045e66071b0000b99d9","observation_id":"a4f13b81-4ad0-421e-99bd-8ec2b0f5f62c","resolution":{"observed_at":"2026-08-11T14:58:48.950713Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T13:33:33.768528Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":52},"total_outbound_references":103},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 100 of 103 outbound references and 0 inbound Pith citation observations for arXiv:2412.11457."}