{"as_of":"2026-08-14T16:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48faad8dd4ff62ed2f0c60a81498dfad69a4f053cffe4429dc54eee87b3b93bb","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T19:57:00.411944Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16805/citation-record","integrity":"/paper/2607.16805/integrity","json":"/paper/2607.16805/citation-record.json","paper":"/paper/2607.16805"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.336216Z","title":"Jones, Rajinder Sodhi, Michael Murdock, Ravish Mehra, Hrvoje Benko, Andrew D","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.336216Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:2ee9e404126252c8c956095abee5c6daf32b067640bcb9be31b0afbae573257b","observation_id":"a59c2d0c-525d-4bc3-bde9-71febf26328d","resolution":{"observed_at":"2026-08-01T19:56:54.336216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.452336Z","title":"Loop, Qin Cai, Philip A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.452336Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:ffbbe24d07028be0415174852a43525e1335857ed5a28315dae07caeee843662","observation_id":"ad7284b5-6178-4849-a829-e017717a1035","resolution":{"observed_at":"2026-08-01T19:56:54.452336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.563783Z","title":"Newcombe, Shahram Izadi, Otmar Hilliges, David Molyneaux, David Kim, An- drew J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.563783Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:a65d68f2269e16215f664e8bacc3602230f3574d172c03b0aa197a20defb6c08","observation_id":"a363e52d-ff5e-4fa3-85eb-96eb868f4647","resolution":{"observed_at":"2026-08-01T19:56:54.563783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.733318Z","title":"Oasis: Procedurally generated social virtual spaces from 3d scanned real spaces.IEEE Trans","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.733318Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:d22ae88ce3fe56280b97bd9570a6e5f333f1ceaa71c46fbc1de0dfce75ff22a5","observation_id":"3cf7632c-8e17-48c0-b7c4-60b5ca080a3b","resolution":{"observed_at":"2026-08-01T19:56:54.733318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.019269Z","title":"VR-NeRF: high- fidelity virtualized walkable spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.019269Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:5412ec22e0a6ce02392b3fbcae416e99701bdf048dfc44f1e8474c5abc23f284","observation_id":"ccc4e2da-6556-4c67-961a-e0d74a54a377","resolution":{"observed_at":"2026-08-01T19:56:55.019269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.069783Z","title":"Litereality: Graphics-ready 3d scene reconstruction from RGB-D scans.Ad- vances in Neural Information Processing Systems, 38:162794–162827, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.069783Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:0c642259f20f98659dd3a17f2bb27ef6d096324508d60aa3f8e3a54ebb553cc6","observation_id":"b016486b-5d1e-465d-9d84-65985f9f9a68","resolution":{"observed_at":"2026-08-01T19:56:55.069783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.126006Z","title":"Robogen: Towards unleashing infinite data for automated robot learning via generative simulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.126006Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:087b1b1602e4b5914437af0f7553faf848a2c91cd3ad97758f8960b71beebff6","observation_id":"07d5e443-13ed-4806-90a0-9cd166888785","resolution":{"observed_at":"2026-08-01T19:56:55.126006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.198223Z","title":"Maniskill2: A unified benchmark for generalizable manipulation skills","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.198223Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:8548c52b1720f13d20e7ed97748703924dbaa0dcfd605cb694d6b73e177e7e94","observation_id":"0a903fc2-843c-46f9-8ec3-1d1d0dd3e236","resolution":{"observed_at":"2026-08-01T19:56:55.198223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.274216Z","title":"Chang, and Manolis Savva","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.274216Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:adb006f6fc343f5125a5e0ef0457969ee35e04dcddf29444124350124d2e47bb","observation_id":"6b991f87-774d-4c3f-8201-281d20267ba1","resolution":{"observed_at":"2026-08-01T19:56:55.274216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.418801Z","title":"Turner, Oleksandr Maksymets, Zsolt Kira, Mrinal Kalakrishnan, Jitendra Malik, Devendra Singh Chaplot, Unnat Jain, Dhruv Batra, Ak- shara Rai, and Roozbeh Mottaghi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.418801Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:88d392754a97d2de121dee778dbecd0b953853b6690e2484e04103ff54166186","observation_id":"68a89fa2-4f7a-4b1a-8677-fe83d736aab4","resolution":{"observed_at":"2026-08-01T19:56:55.418801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.529323Z","title":"SQA3D: situated question answering in 3d scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.529323Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:96c1a767aec05634a6ad6d3ad3d1136791347c9b29072b822b5837673272b5c7","observation_id":"489493e2-fac3-4ea3-8ed5-6581a1b67c42","resolution":{"observed_at":"2026-08-01T19:56:55.529323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.716067Z","title":"Openeqa: Embodied question answering in the era of foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.716067Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:bbcfa9b6a4818fdba0e587b2d790c5480bb2941c96bb6507606c488e1ed0d610","observation_id":"c85a2062-edf2-4dbd-9d14-ee7746f82974","resolution":{"observed_at":"2026-08-01T19:56:55.716067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.816755Z","title":"Structured 3d latents for scalable and versatile 3d generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.816755Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:b80b86b41b69b24578284a454d2c0a6e5b79d7713b4ca6b8f488f8aedc6fcc68","observation_id":"424c6d23-31f8-476b-abe9-73927676d422","resolution":{"observed_at":"2026-08-01T19:56:55.816755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12202","last_updated":"2026-05-14T15:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-21T15:16:54Z","title":"Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12202","snapshot_observed_at":"2026-08-01T19:56:55.924884Z","title":"Hunyuan3d 2.0: Scaling diffusion models for high resolution textured 3d assets generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.924884Z"},"links":{"cited_paper":"/paper/2501.12202","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e79926e088cc7f48da9d224ced478ebbf302300794c569cae4c69d9c18ce4af2","observation_id":"6f6c35f7-4bf4-42b5-b043-5af772be2832","resolution":{"observed_at":"2026-08-01T19:56:55.924884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.067836Z","title":"TriposG: high-fidelity 3d shape synthesis using large-scale rectified flow models.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.067836Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:5d1f4dcc7a046772f62df65f861882c3d32d8f9671061ec17d9221084e68a815","observation_id":"e4e9d686-74fb-4ea1-9046-2262bc06da59","resolution":{"observed_at":"2026-08-01T19:56:56.067836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-08-13T19:30:37.668913Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-01T19:56:56.183385Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.183385Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:0256f531cfebae3fc7fb87efe7dd45af7c6d3c5434d37d69cb87699d74da5b61","observation_id":"18f7b8d0-6c5c-40c6-ade2-2e8ddefce8b4","resolution":{"observed_at":"2026-08-01T19:56:56.183385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.350417Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.350417Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:96ef2937f9a50d91ad99e5cbc7b046c58020e867dd2649c5d8390b9f0b9d40a5","observation_id":"4bf7b04d-a278-457d-8322-4fc682eec9e1","resolution":{"observed_at":"2026-08-01T19:56:56.350417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.484172Z","title":"Reconviagen: Towards accurate multi-view 3d object reconstruction via generation.CoRR, abs/2510.23306, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.484172Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:4d7df7e399c75a289d428cee75e89b0ccb20f6c9c890911a4d9665535bfe5719","observation_id":"3bbb8f48-dccf-4cf9-b935-987774abd147","resolution":{"observed_at":"2026-08-01T19:56:56.484172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.605684Z","title":"Besl and Neil D","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.605684Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:47a166ff21fac71affa18d618513d79bb7027d7b33ff58eec8b970ab94dd35ff","observation_id":"0a41b0bc-0356-4491-8aea-3bc955eed8c0","resolution":{"observed_at":"2026-08-01T19:56:56.605684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-01T13:51:16.469557Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-01T19:56:56.756917Z","title":null,"venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.756917Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:77399a2074b0c73f82b45a72ffc5e3d76abe53bd41b5215f983d877f2ad2cf39","observation_id":"5746d648-abc9-4e1b-8f50-1b3dd95baf02","resolution":{"observed_at":"2026-08-01T19:56:56.756917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.910692Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.910692Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:dc77f377543c63dc37cc8792a9fce67042c3b4d328671ded74def28912589979","observation_id":"01a6e1e6-7641-4bf7-8499-e9692c0271fe","resolution":{"observed_at":"2026-08-01T19:56:56.910692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.015372Z","title":"Amodal3r: Amodal 3d reconstruction from occluded 2d images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.015372Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:2db3a360cdc8c4b055ccc7b25043676a797fbc0999cb8a8ccff27c7ecd94f6e4","observation_id":"7c1f0bb9-e443-48eb-8bb9-2f51d028de21","resolution":{"observed_at":"2026-08-01T19:56:57.015372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07191","last_updated":"2024-04-14T16:54:24Z","snapshot_observed_at":"2026-08-13T18:57:44.379289Z","submitted_at":"2024-04-10T17:48:37Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07191","snapshot_observed_at":"2026-08-01T19:56:57.092983Z","title":"In- stantmesh: Efficient 3d mesh generation from a single image with sparse-view large reconstruc- tion models.CoRR, abs/2404.07191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.092983Z"},"links":{"cited_paper":"/paper/2404.07191","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:0493cb1fd7ea4822bfc480c2f634fb90c5f214445d356a634a7c15017949f479","observation_id":"d3472d3b-0e37-4a73-b515-3882d5a66cf6","resolution":{"observed_at":"2026-08-01T19:56:57.092983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.191837Z","title":"Pixel2mesh: Generating 3d mesh models from single RGB images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.191837Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:7700d02fc5a76635ad055844bc14368da14439215af4983b9a664e4a85270162","observation_id":"8b36c8d3-6884-4430-ae85-c162530b107c","resolution":{"observed_at":"2026-08-01T19:56:57.191837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.05567","last_updated":"2019-01-23T00:32:24Z","snapshot_observed_at":"2026-08-08T04:59:23.418695Z","submitted_at":"2019-01-17T00:00:58Z","title":"Soft Rasterizer: Differentiable Rendering for Unsupervised Single-View Mesh Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.05567","snapshot_observed_at":"2026-08-01T19:56:57.272294Z","title":"Soft rasterizer: Differentiable rendering for unsupervised single-view mesh reconstruction.CoRR, abs/1901.05567, 2019","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.272294Z"},"links":{"cited_paper":"/paper/1901.05567","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:b23a2aa51161e09cdaecd22acc838103b798b3ea4e0b83ad3782e1a8aff8ff5c","observation_id":"ef954fae-d0dd-4330-9a9f-48c68afe7c33","resolution":{"observed_at":"2026-08-01T19:56:57.272294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.341700Z","title":"Neural 3d mesh renderer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.341700Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:ad4eff82f5e3d33a5fc33b523044dc0d09dfae005f7c162edca262bf0f2158b0","observation_id":"d17d56a2-2bf0-4bcf-bbfa-a100a154b066","resolution":{"observed_at":"2026-08-01T19:56:57.341700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.399071Z","title":"DISN: deep implicit surface network for high-quality single-view 3d reconstruction","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.399071Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:84496418c963915967a33a28d627a887f886fdf5397642292283d57b5c55c1ef","observation_id":"789ac4af-6254-40a1-8826-c0cd89871fbe","resolution":{"observed_at":"2026-08-01T19:56:57.399071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.481640Z","title":"LRM: large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.481640Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:5ee33bc282675cec6a3ec1cc22cbba8d7ab5494bd131baf7fe51b9d70eb26644","observation_id":"a358c1e2-cc09-45fd-9a70-f7834a6b64da","resolution":{"observed_at":"2026-08-01T19:56:57.481640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.565127Z","title":"Direct3d: Scalable image-to-3d generation via 3d latent diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.565127Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:f61774462ee4d10638d618d30f79e20502f14b386f2fdd4280268d783d06c982","observation_id":"c9fd54ea-450d-4f7b-9e77-2dfebe8fcb41","resolution":{"observed_at":"2026-08-01T19:56:57.565127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.622102Z","title":"One-2-3-45: Any single image to 3d mesh in 45 seconds without per-shape optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.622102Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:dd2ee151e535ad7fa32f34e2e4a02be97442e2fd35850be7d37cb4d1e3566d8a","observation_id":"43ee7758-4615-4d92-b6cf-9d7e2d85ba0c","resolution":{"observed_at":"2026-08-01T19:56:57.622102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.724329Z","title":"CRM: single image to 3d textured mesh with convolutional reconstruction model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.724329Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:1c889974b872c39b72b6c4a71332a3ad7b8e8ba31c8668441ed4b1d73dba088f","observation_id":"cdd750f0-5f7d-4529-ba75-20da92d8f0aa","resolution":{"observed_at":"2026-08-01T19:56:57.724329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.780214Z","title":"Wonder3d: Single image to 3d using cross-domain diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.780214Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:36e2369bad6606a8eb2b60edeec5b2f0f2eedf93cdeaa5e6a782cd29a2bc2d6f","observation_id":"dd2d2445-71da-4ccd-b8a3-c61ee363d44a","resolution":{"observed_at":"2026-08-01T19:56:57.780214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.884576Z","title":"Unique3d: High-quality and efficient 3d mesh generation from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.884576Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:65dc312388f97c91bf4e6f720d35513c25a0cb3aa4bc0ddcca40d4ed54b06bc4","observation_id":"1eb67e45-42c0-4180-994d-57487e71c125","resolution":{"observed_at":"2026-08-01T19:56:57.884576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.963894Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.963894Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:12ea269fecb29904d5fd43eeaa31d3e3383fa3ba448cb9bedc88dba9ff42eb1a","observation_id":"9dd810ee-73e1-410f-ba95-6583da469200","resolution":{"observed_at":"2026-08-01T19:56:57.963894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.021067Z","title":"Yago Vicente, Thomas Dideriksen, Himanshu Arora, Matthieu Guillaumin, and Jitendra Malik","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.021067Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:bc6ca8ebc1aaa31a496459e2a8427791f07d6767d0177ec5330c5d2266e078fd","observation_id":"8f57855d-c8a7-489b-b08a-6cf49f915b68","resolution":{"observed_at":"2026-08-01T19:56:58.021067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.102918Z","title":"MIDI: multi-instance diffusion for single image to 3d scene generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.102918Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:c69c22d4f42ed8b95f1e3e44695d6723cb3b4823be1ab158fc2882e7a1024348","observation_id":"b60a0c1e-2d5c-413d-959e-9cc899aebcf7","resolution":{"observed_at":"2026-08-01T19:56:58.102918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.172260Z","title":"Scenegen: Single-image 3d scene generation in one feedforward pass.CoRR, abs/2508.15769, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.172260Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:5d2976a9f63399cc08456ca57e089cdd4621255f0ee64a3d3590b5fcad3de7ee","observation_id":"b1244045-889b-4e53-bb49-5ef2eda1af10","resolution":{"observed_at":"2026-08-01T19:56:58.172260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.250180Z","title":"Scenemaker: Open-set 3d scene generation with decoupled de-occlusion and pose estimation model.CoRR, abs/2512.10957, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.250180Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:d9296ad34aeffa499f4c074fbe48f8a36eb27e59978327a074a298dbfbb5517e","observation_id":"0f11126f-a38b-4162-b0f8-3efa70366b5e","resolution":{"observed_at":"2026-08-01T19:56:58.250180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.333232Z","title":"I-scene: 3d instance models are implicit generalizable spatial learners.CoRR, abs/2512.13683, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.333232Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:8fcaacfbdb4b9bf852361539e3fd1232dc2812cd872b3eae6f965bd8a197448a","observation_id":"8823df9a-adc9-4d26-92e0-85138c9103d0","resolution":{"observed_at":"2026-08-01T19:56:58.333232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.412055Z","title":"Syncdreamer: Generating multiview-consistent images from a single-view image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.412055Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:4c4c12c7891ed92cc4a56b1220cda836115dd0c0aff49e1929e940b743b0e2a9","observation_id":"316db057-259b-40df-8f56-bdb175ca19e7","resolution":{"observed_at":"2026-08-01T19:56:58.412055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.488086Z","title":"SV3D: novel multi-view synthesis and 3d generation from a single image using latent video diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.488086Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:db07a76528a8f6c3211d83157fdbbe64c59fdbacaa1c383a89d444b4e04d9de8","observation_id":"4edbe80e-217f-4d94-89f4-c45376fcf1c0","resolution":{"observed_at":"2026-08-01T19:56:58.488086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.564972Z","title":"Ouroboros3d: Image- to-3d generation via 3d-aware recursive diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.564972Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e0263723b9d6eba3ce2bab5e9dd4ced1e51443619b5f7c6d60efaeebb6856904","observation_id":"846d04ea-37e6-42e0-baf1-8a064ada965a","resolution":{"observed_at":"2026-08-01T19:56:58.564972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.01479","last_updated":"2026-04-03T02:02:55Z","snapshot_observed_at":"2026-08-08T07:52:55.097673Z","submitted_at":"2026-04-01T23:35:40Z","title":"UniRecGen: Unifying Multi-View 3D Reconstruction and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.01479","snapshot_observed_at":"2026-08-01T19:56:58.643810Z","title":"Unirecgen: Unifying multi-view 3d reconstruction and generation.arXiv preprint arXiv:2604.01479, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.643810Z"},"links":{"cited_paper":"/paper/2604.01479","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:dabe988fec1440f5b4be8ec9a9f0a886b6afb47d1f18cbd67b52ec7d691af5bc","observation_id":"f3d2c40d-316b-4a52-ba77-ce38debc712a","resolution":{"observed_at":"2026-08-01T19:56:58.643810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.718399Z","title":"Frost, Samir Aroudj, Armen Avetisyan, Henry Howard-Jenkins, Daniel DeTone, Pierre Moulon, Qirui Wu, Zhengqin Li, Julian Straub, Richard A","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.718399Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:b054b5ae37a9cb42075f6e43703f1dff6b88f24b1d499dd1e6008e0a55df5ea5","observation_id":"fa58a553-52e7-4ca8-9ccc-95766bcb30a9","resolution":{"observed_at":"2026-08-01T19:56:58.718399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.790224Z","title":"VGGT: visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.790224Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:59e8ef7d3408e4e64cde6aefffdaabdf8528435be21fea0b728902085b11934f","observation_id":"0cc8073a-888a-446b-8d43-02f90a55be88","resolution":{"observed_at":"2026-08-01T19:56:58.790224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.11633","last_updated":"2026-04-09T09:02:54Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T07:53:35Z","title":"MV-SAM3D: Adaptive Multi-View Fusion for Layout-Aware 3D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.11633","snapshot_observed_at":"2026-08-01T19:56:58.847558Z","title":"MV- SAM3D: adaptive multi-view fusion for layout-aware 3d generation.CoRR, abs/2603.11633, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.847558Z"},"links":{"cited_paper":"/paper/2603.11633","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:c9bfc2b199e56a77a7ed3e9518a36f9fa66d98461c84597c0cc242db08afca99","observation_id":"bc07c80f-2b51-4cf2-b4ce-f0d80aac3016","resolution":{"observed_at":"2026-08-01T19:56:58.847558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.931951Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.931951Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:b0dc8ebbc4e329eebada7996f70971382e3c040f276f49a52a5eaa87f89bc97a","observation_id":"09d9dbca-f372-4b3f-9afd-db3f2057c504","resolution":{"observed_at":"2026-08-01T19:56:58.931951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.059177Z","title":"Flex3d: Feed-forward 3d generation with flexible reconstruction model and input view curation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.059177Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:6dc5ef66302df4c8dcc68dee2e28170112a250af98bed821a52d089616377a87","observation_id":"af591367-65a2-4175-bb16-5b546068cccc","resolution":{"observed_at":"2026-08-01T19:56:59.059177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.164800Z","title":"A solution to the next best view problem for automated surface acquisition.IEEE Trans","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.164800Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:1e392f172e59bfa515fdb3d8eceea3a238ff2f7e71d277a2a634554682dcdfe3","observation_id":"bf0fa398-28d7-4b3c-a0f1-4d6d93ce551d","resolution":{"observed_at":"2026-08-01T19:56:59.164800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.333769Z","title":"Gammell, and Paul Newman","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.333769Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:371dca05e4ff5937b1bc18bd740d6784d57452a89b4ffd0031f820a3acfba554","observation_id":"d061eb67-c598-4730-8f65-fd9e90fc80f2","resolution":{"observed_at":"2026-08-01T19:56:59.333769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.441055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.441055Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:1ae7834d8999a4078a90066f80bfb263bfaddaadc72bcf7e78a4758fce08a195","observation_id":"db88b412-033a-46e4-99ee-4f9564a65889","resolution":{"observed_at":"2026-08-01T19:56:59.441055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.546214Z","title":"Fisherrf: Active view selection and mapping with radiance fields using fisher information","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.546214Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:98ff8c00c352ae13d2b05d2d43b53620d857dfdf6f78f84911e41bc4d5619641","observation_id":"8c71992f-8ffe-494c-bf95-683afb53eb4b","resolution":{"observed_at":"2026-08-01T19:56:59.546214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.552386Z","title":"Pop-gs: Next best view in 3d- gaussian splatting with p-optimality","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.552386Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:35778f93eeefaa555f0861dde9de765a8aa745afc226cefd061972bdde759ca8","observation_id":"0806e89a-dd62-4723-8ef3-b0e071c8e993","resolution":{"observed_at":"2026-08-01T19:56:59.552386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.622202Z","title":"Next-best view policy for 3d reconstruction","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.622202Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:8944461dffb784216982b93315648d1425abc5f4ef5f0e8c2105ad8af14761b4","observation_id":"1564e217-5b7f-439e-9b05-1c2073c0b295","resolution":{"observed_at":"2026-08-01T19:56:59.622202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.770128Z","title":"Gennbv: Generalizable next-best-view policy for active 3d reconstruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.770128Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:21736363de30555ed60f633c073f8c47184d17133ce28a34f5d14a085347c567","observation_id":"15572ef6-1305-4bf6-8e4b-f89bd90ddc0f","resolution":{"observed_at":"2026-08-01T19:56:59.770128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06219","last_updated":"2025-08-25T17:56:25Z","snapshot_observed_at":"2026-08-07T15:48:22.658581Z","submitted_at":"2025-05-09T17:54:10Z","title":"VIN-NBV: A View Introspection Network for Next-Best-View Selection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06219","snapshot_observed_at":"2026-08-01T19:56:59.902728Z","title":"VIN-NBV: a view introspection network for next-best-view selection for resource-efficient 3d reconstruction.CoRR, abs/2505.06219, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.902728Z"},"links":{"cited_paper":"/paper/2505.06219","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:43c4ee9ab1b66fed70f7965ccebbea4d533a4249f510b6743abefc794764d515","observation_id":"ccfa3443-de43-4632-a7b4-218e634e6fe6","resolution":{"observed_at":"2026-08-01T19:56:59.902728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:57:00.096647Z","title":"Decompositional neural scene reconstruction with generative diffusion prior","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T19:57:00.096647Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:add400570d069408b34ddfa64b297d077899bfcb15821d9911a4072da7e6b135","observation_id":"0f0dac64-9d3c-44ff-a1f8-7aeca779cfaa","resolution":{"observed_at":"2026-08-01T19:57:00.096647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:57:00.252781Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T19:57:00.252781Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:0d527f940b3c8550449cb3d7ff4186e87da606b789c39068958dda493966fb10","observation_id":"e90c35e9-2f56-4831-8248-3d9897c1fe95","resolution":{"observed_at":"2026-08-01T19:57:00.252781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:57:00.411944Z","title":"k-means++: the advantages of careful seeding","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T19:57:00.411944Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:f24f9ee3677aa4b032772d93812d26a77bcad7165c0542fe5c66704ad83b6c21","observation_id":"b3dbbfbe-44e2-423a-a1d1-cba0b16125f9","resolution":{"observed_at":"2026-08-01T19:57:00.411944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T09:16:14.723076Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2607.16805."}