{"as_of":"2026-08-13T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:859162c7b657d07b96014c83201cfde6025cfbe5a997d3131ee4954be4614533","coverage":[{"denominator":100,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:11:49.782513Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:45:17.233257Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19492","snapshot_observed_at":"2026-08-04T08:45:17.233257Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19255","last_updated":"2026-06-15T21:42:55Z","snapshot_observed_at":"2026-08-12T13:45:45.050504Z","submitted_at":"2025-10-22T05:22:20Z","title":"Advances in 4D Representation: Geometry, Motion, and Interaction","version":3},"reference_index":299,"source":"arxiv_source","source_observed_at":"2026-08-04T08:45:17.233257Z"},"links":{"cited_paper":"/paper/2411.19492","citing_paper":"/paper/2510.19255"},"observation_digest":"sha256:3bf5b5b564a5fb08a31ce6fc408a4129d7884662279804172212819a97c36aa9","observation_id":"946354f0-d8de-47df-80b8-e47a1d45a800","resolution":{"observed_at":"2026-08-04T08:45:17.233257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.19492/citation-record","integrity":"/paper/2411.19492/integrity","json":"/paper/2411.19492/citation-record.json","paper":"/paper/2411.19492"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.493918Z","title":"SATR: Zero-shot semantic segmentation of 3D shapes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.493918Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:b8e19ceab09b0419517c919a6df29b7880d18e98bc760a99ea11adcf748f2dbe","observation_id":"c10ed52d-ecbc-492b-a1d2-bede40549c6a","resolution":{"observed_at":"2026-08-12T10:11:49.493918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.498994Z","title":"SceneCom- plete: Open-world 3D scene completion in complex real world environments for robot manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.498994Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:599c9dab88e9f23cf18956c47688b9d415d3bfd3f158d1080aaa089be4bca185","observation_id":"b0fc3940-b544-4ef7-b7e4-e7d03103bcb2","resolution":{"observed_at":"2026-08-12T10:11:49.498994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09675","last_updated":"2024-02-05T01:59:31Z","snapshot_observed_at":"2026-08-13T07:17:33.016347Z","submitted_at":"2024-02-05T01:59:31Z","title":"Open-Universe Indoor Scene Generation using LLM Program Synthesis and Uncurated Object Databases","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09675","snapshot_observed_at":"2026-08-12T10:11:49.502353Z","title":"Open-universe indoor scene generation using LLM program synthesis and uncurated object databases","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.502353Z"},"links":{"cited_paper":"/paper/2403.09675","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:75f21bf5b076e21666de4f2af4a9b6febe52f51646adca6f69eb212b5c1e8f48","observation_id":"1f4f9780-9735-48f0-b581-eaa8adef76f4","resolution":{"observed_at":"2026-08-12T10:11:49.502353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.505334Z","title":"Scan2CAD: Learning CAD model alignment in RGB-D scans","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.505334Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:65c775ac9e1ed203f2a86797f556e352b8e9f3f2832d4bb911903e5c60d418d7","observation_id":"4569fd82-0eb5-4ccf-8408-1bcf034bcbb4","resolution":{"observed_at":"2026-08-12T10:11:49.505334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.507805Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.507805Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:dd7bb85a3394fa3d46b3e8912bdfb1b8edf52af643758d49f6a2812d307124d3","observation_id":"e2900653-dc28-4d3e-bff9-dcf7312b8ac8","resolution":{"observed_at":"2026-08-12T10:11:49.507805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-13T14:41:45.148742Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-12T10:11:49.511213Z","title":"ShapeNet: An information-rich 3D model repository","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.511213Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:6fe0303a5afc29f6e7fda14f451eca10aaba6c8fe413eaf24846da9b8c2c81b7","observation_id":"7da11930-16d1-4549-9077-4548384cca77","resolution":{"observed_at":"2026-08-12T10:11:49.511213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.514058Z","title":"CLIP2Scene: Towards label-efficient 3D scene un- derstanding by CLIP","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.514058Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5ae595f2e8dc7005ef5125f7a9017977f665d93bc169a99b62379c3fcdfdc986","observation_id":"6fa30b9e-676e-459b-9dad-b82ad1ec18d5","resolution":{"observed_at":"2026-08-12T10:11:49.514058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.516584Z","title":"Single-view 3D scene reconstruc- tion with high-fidelity shape and texture","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.516584Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:360ed8a8fe07f581c6cd8c8be846c3c4fff88eaa0cba5867c8478d296183a2bb","observation_id":"3461e84d-5a87-42d0-8f08-242c6964026d","resolution":{"observed_at":"2026-08-12T10:11:49.516584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11656","last_updated":"2024-05-31T16:44:06Z","snapshot_observed_at":"2026-08-13T00:04:13.152464Z","submitted_at":"2024-05-19T20:01:29Z","title":"URDFormer: A Pipeline for Constructing Articulated Simulation Environments from Real-World Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11656","snapshot_observed_at":"2026-08-12T10:11:49.518832Z","title":"Urdformer: A pipeline for constructing articulated simulation environments from real-world images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.518832Z"},"links":{"cited_paper":"/paper/2405.11656","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:15a737ceecae29ac0532b5e1bdf2797dfccac74c5e8ab358ec8fcfe3a66eef8c","observation_id":"d1a26e7b-6693-4eaf-a69e-a43ad1dc52d4","resolution":{"observed_at":"2026-08-12T10:11:49.518832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.521898Z","title":"ScanNet: Richly-annotated 3D reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.521898Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:47a9456f20d791f7f66d6f0637d9b056a5da2c14e870d7145e935edd5b76aefc","observation_id":"c152bf9f-fd1c-4877-9db7-f4ef625b6bb6","resolution":{"observed_at":"2026-08-12T10:11:49.521898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07408","last_updated":"2024-10-19T00:08:19Z","snapshot_observed_at":"2026-08-13T07:24:14.336097Z","submitted_at":"2024-10-09T20:17:58Z","title":"Automated Creation of Digital Cousins for Robust Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07408","snapshot_observed_at":"2026-08-12T10:11:49.524207Z","title":"ACDC: Automated creation of digital cousins for robust policy learn- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.524207Z"},"links":{"cited_paper":"/paper/2410.07408","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:99de98c4b75f5df829f664eeb33a0f822ea2e17912ef524284fd31ac3f9d8294","observation_id":"6b6e1817-d7fd-48a5-805d-f8c3b396e0e0","resolution":{"observed_at":"2026-08-12T10:11:49.524207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.527276Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.527276Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:3d06a9e005e465e1c0a2a73d6d575c1375f255702a8b72f90819070285ef558a","observation_id":"4b986f3b-c3e1-4058-93f5-6e6687f99228","resolution":{"observed_at":"2026-08-12T10:11:49.527276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.530240Z","title":"SceneFun3D: Fine-grained functionality and affordance un- derstanding in 3D scenes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.530240Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:0ae3c363f9a1455dad8851c69252595321ff8a095af588f97ab413b3d7d0c9c1","observation_id":"90fe9c9d-96ce-4944-81a5-ffad12978faa","resolution":{"observed_at":"2026-08-12T10:11:49.530240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.532957Z","title":"PLA: Language-driven open- vocabulary 3D scene understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.532957Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:d2d480f2af08e27016c895bb6eca48dc8f7321891540464d82e89d44c1b345b5","observation_id":"f034f4e7-ed66-4761-82f8-d719e5bb0389","resolution":{"observed_at":"2026-08-12T10:11:49.532957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.535892Z","title":"PanoContext-Former: Panoramic total scene understanding with a transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.535892Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:afec7893aa859d94640890822590e0dba9981a809ad9298bc4ba188464ee2a49","observation_id":"2ac572d8-4fd1-4b72-b3ac-7d1c6df8ec1c","resolution":{"observed_at":"2026-08-12T10:11:49.535892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.538456Z","title":"CLIP- Away: Harmonizing focused embeddings for removing ob- jects via diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.538456Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:7316faa12bcf29d0435486716d8812fcb1a36dafd5c2e13816bbae40f85a47b9","observation_id":"eaaf686a-693b-4f76-8ab8-5e89260c4f29","resolution":{"observed_at":"2026-08-12T10:11:49.538456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.540729Z","title":"Prob- ing the 3D awareness of visual foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.540729Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:9165ca054f37fb1786f7fb7d5dcacaf3c20d31604070faa27c01afe6ef4077eb","observation_id":"a4b66764-a5ea-4d09-8c3f-6eb2e3eed339","resolution":{"observed_at":"2026-08-12T10:11:49.540729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.543346Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.543346Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5aef630549d41df8d6f0412e48646abb90eed2d6c1194eb632129e8a69dd3958","observation_id":"4307cfc7-8e60-4dc0-bb28-44d4669cff56","resolution":{"observed_at":"2026-08-12T10:11:49.543346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.546454Z","title":"Fischler and Robert C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.546454Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:4dacdf952b5ad75a79864805107dfaf3a9c3f6aea84bd34d51f3b5f8f1c3c6db","observation_id":"4b65af23-3c8f-4cbc-94a4-b502f79ca123","resolution":{"observed_at":"2026-08-12T10:11:49.546454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.549432Z","title":"Example-based synthesis of 3d object arrangements","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.549432Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:00c9b7613d213324861538b802a474c1ccc012d4d3712ce39cb2b8beb3dec056","observation_id":"36b5064f-c43d-45c7-b707-0bb01a285626","resolution":{"observed_at":"2026-08-12T10:11:49.549432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.551727Z","title":"3d-front: 3d furnished rooms with layouts and semantics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.551727Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:2c9bdf53965f28ba1a128fc20b5e24ed66bfd83367ab873d4a40446cd0679f2f","observation_id":"7f63adc0-3367-483c-8376-984dc9be9b26","resolution":{"observed_at":"2026-08-12T10:11:49.551727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11401","last_updated":"2024-03-22T18:52:51Z","snapshot_observed_at":"2026-08-13T00:52:19.292622Z","submitted_at":"2024-03-18T01:18:48Z","title":"Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11401","snapshot_observed_at":"2026-08-12T10:11:49.554635Z","title":"Scene-LLM: Extending language model for 3D visual understanding and reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.554635Z"},"links":{"cited_paper":"/paper/2403.11401","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:2a2ef854a80af5dab8a88d3b2cc8930f22e39ef5a6527a8e0517caf16a1a5790","observation_id":"a4cc9940-54dc-4f87-85a2-32d1c84734fe","resolution":{"observed_at":"2026-08-12T10:11:49.554635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.558068Z","title":"Any- home: Open-vocabulary generation of structured and tex- tured 3d homes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.558068Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5a43121d16c6e3653744a6b19dd0d4d983037207f732a04c5989677c455a335d","observation_id":"4cc51535-0c6e-4a92-87c1-4c6e61dea9bb","resolution":{"observed_at":"2026-08-12T10:11:49.558068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.560446Z","title":"DiffCAD: Weakly-supervised probabilistic CAD model retrieval and alignment from an RGB image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.560446Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:e6dc0dd5b50cc4402466fdb38bea73badaa8e58096c03dd646f513ccf72d1d6f","observation_id":"11432c41-d44e-4321-9968-19ef40bb787c","resolution":{"observed_at":"2026-08-12T10:11:49.560446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.563920Z","title":"GraphDreamer: Compositional 3D scene synthesis from scene graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.563920Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:e05a8b6aa723c5b6b60d46ce599e3cb84a146268b37541e52caa3cfb7bbacc43","observation_id":"b99148ee-bb8a-4528-840f-8e326469b597","resolution":{"observed_at":"2026-08-12T10:11:49.563920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.568274Z","title":"Zero-shot category-level object pose estimation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.568274Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:1a9037aacbcfcd1dfc30da58ed900f40a6100e0a709cb0b68882aa786314dd95","observation_id":"aa3bb3ee-95c7-442f-a61e-50183eddfc04","resolution":{"observed_at":"2026-08-12T10:11:49.568274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.506344Z","title":"ROCA: Robust CAD model retrieval and alignment from a single image","venue":null,"work_id":"a0a428bd-4db5-470c-9df2-5e099adc3460","year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.571479Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:a935205c44a80ed895c8a186173c259430a98fc0231799fe865048e4eb5f57c3","observation_id":"44c9488f-8f54-4e50-a6e5-e4f699ea6f0d","resolution":{"observed_at":"2026-08-12T10:11:50.509037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.498660Z","title":"3D-LLM: In- jecting the 3D world into large language models","venue":null,"work_id":"b892f0b2-b6f0-4d45-80c9-92df668f5794","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.573680Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:deae2c869769772a576cab89fbd4744c5ba08a39da55c0d7597901e83bc32ad8","observation_id":"1389a93c-938b-429c-93de-ea4f091f3eb5","resolution":{"observed_at":"2026-08-12T10:11:50.501591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15506","last_updated":"2025-01-03T15:39:16Z","snapshot_observed_at":"2026-08-13T07:17:16.417419Z","submitted_at":"2024-03-22T02:30:46Z","title":"Metric3Dv2: A Versatile Monocular Geometric Foundation Model for Zero-shot Metric Depth and Surface Normal Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15506","snapshot_observed_at":"2026-08-12T10:11:49.576177Z","title":"Metric3D v2: A versatile monocular geomet- ric foundation model for zero-shot metric depth and surface normal estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.576177Z"},"links":{"cited_paper":"/paper/2404.15506","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:d031f8585473bdcfdeeebe4308232913c4a420001ea2d2710f3346b0e78fdc40","observation_id":"eadedfa4-e170-4b51-94f0-c1486f70a6ed","resolution":{"observed_at":"2026-08-12T10:11:49.576177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06212","last_updated":"2023-06-09T19:24:39Z","snapshot_observed_at":"2026-08-13T11:20:04.476763Z","submitted_at":"2023-06-09T19:24:39Z","title":"Aladdin: Zero-Shot Hallucination of Stylized 3D Assets from Abstract Scene Descriptions","version":1},"cited_work":{"arxiv_id":"2306.06212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.06212","snapshot_observed_at":"2026-08-12T10:11:50.008186Z","title":"Aladdin: Zero-Shot Hallucination of Stylized 3D Assets from Abstract Scene Descriptions","venue":"cs.CV","work_id":"5d709b51-2ec6-42cb-9fb3-8ed892b4af54","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.579347Z"},"links":{"cited_paper":"/paper/2306.06212","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:83db54aa7e7a30433fd7299aac95942203b2a66c955455af372cd645f65ea167","observation_id":"3914b068-dd94-433a-9877-e4b1564c8537","resolution":{"observed_at":"2026-08-12T10:11:50.011876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.490520Z","title":"Holistic 3D scene parsing and re- construction from a single RGB image","venue":null,"work_id":"ccc3521b-deac-4170-9aad-cfe59e3452c3","year":2018},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.582343Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:38e13e5bd1dfd1d39a36373750b59e9bb3ef240a3f9accd9a7f46cdfb5f22d40","observation_id":"b1682dc6-5c43-417d-963c-0c57922a5317","resolution":{"observed_at":"2026-08-12T10:11:50.493482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00616","last_updated":"2024-08-12T16:58:33Z","snapshot_observed_at":"2026-08-13T10:22:27.582030Z","submitted_at":"2023-09-01T17:59:56Z","title":"OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00616","snapshot_observed_at":"2026-08-12T10:11:49.584612Z","title":"OpenIns3D: Snap and lookup for 3D open-vocabulary instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.584612Z"},"links":{"cited_paper":"/paper/2309.00616","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:9997086a6567f05cf4baa363e4933e826604339df081b7943ca80b0ae208bfad","observation_id":"f40c009a-a11c-4b74-b560-43cc7a141fc7","resolution":{"observed_at":"2026-08-12T10:11:49.584612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.482439Z","title":"CenterSnap: Single-shot multi-object 3D shape reconstruction and categorical 6D pose and size estimation","venue":null,"work_id":"ff3ba96b-45eb-4548-964f-d623b00af6bc","year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.587024Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:60f9987c3f0341a30d252080b264aeacc1f83b5c72759db6f5a6d2677f14d02d","observation_id":"e0d13309-f173-4a11-aa4c-20ffb32777b9","resolution":{"observed_at":"2026-08-12T10:11:50.485608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.590378Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.590378Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:0a096b47d4720540fa0ed73733299e938c31fc830f1585dccece7e56523b67a1","observation_id":"4029bd80-e635-4220-9332-c665f271c800","resolution":{"observed_at":"2026-08-12T10:11:49.590378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07241","last_updated":"2023-10-23T14:56:15Z","snapshot_observed_at":"2026-08-13T12:44:32.987980Z","submitted_at":"2023-02-14T18:40:26Z","title":"ConceptFusion: Open-set Multimodal 3D Mapping","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07241","snapshot_observed_at":"2026-08-12T10:11:49.592608Z","title":"ConceptFusion: Open-set multimodal 3D mapping","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.592608Z"},"links":{"cited_paper":"/paper/2302.07241","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:0a8d2998b8d77c532e1f9dfe2c3b04c192b092448211c289abdaec0a69231154","observation_id":"c4df1580-0934-4c3e-ab63-e5cae16d210a","resolution":{"observed_at":"2026-08-12T10:11:49.592608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.470919Z","title":"SceneVerse: Scaling 3D vision-language learning for grounded scene understanding","venue":null,"work_id":"4394a3bf-b8c8-43f4-9ed5-3003454041ea","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.595695Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:0811b134470d46bb6774bb20d92180191d6cb42bb3e0fb5bc49f7e83842f3520","observation_id":"8d8df2bf-ae13-4266-b896-c28c4e3f334a","resolution":{"observed_at":"2026-08-12T10:11:50.473781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.464464Z","title":"LERF: Language embed- ded radiance fields","venue":null,"work_id":"df69ec61-0cba-414a-b746-78448b369f20","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.598600Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:40efc35dcd213569f3c9e53b499dc08f6f49d4cb0571ab418c742bd29bb38bb0","observation_id":"9fd86233-c5dd-4801-b59e-9f150ccc453d","resolution":{"observed_at":"2026-08-12T10:11:50.466992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.457113Z","title":"Habitat synthetic scenes dataset (HSSD-200): An analysis of 3D scene scale and realism tradeoffs for objectgoal naviga- tion","venue":null,"work_id":"e79bffcf-6d3d-49c3-9aab-8dec8450702a","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.600942Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:be3a6766550cdb56fcb114968671680e8b4bc25b3b0adb40d443fd8762e79ce1","observation_id":"fbf60058-fe52-4163-9c27-40d3938ce0a2","resolution":{"observed_at":"2026-08-12T10:11:50.460093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-12T10:11:49.604227Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.604227Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:b6fd76b25ba0ebf79b5fbf4da84e910ab7d31cb0a60923335189777c573a6eb9","observation_id":"78cb8e7f-801f-44dc-aa8b-676e4c882697","resolution":{"observed_at":"2026-08-12T10:11:49.604227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.450123Z","title":"Mask2CAD: 3D shape prediction by learning to seg- ment and retrieve","venue":null,"work_id":"dc98e2e9-cfca-4704-bf4d-753695a059b9","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.607531Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:34502edc0f305120f8534372b70fea3ae4c5a7b3fe86b430f9cc40be3e8e37bc","observation_id":"63ef7ff9-186c-42a7-95a2-83510ec31c31","resolution":{"observed_at":"2026-08-12T10:11:50.452832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.442437Z","title":"Patch2cad: Patchwise embedding learning for in-the- wild shape retrieval from a single image","venue":null,"work_id":"a9262d93-155d-4727-9e08-1e05fab6e4a9","year":2021},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.609993Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:d85e653a97ef38c94d37772a23292af51945dc922c5b33940ee1533166c5ea71","observation_id":"b19deefe-7550-41d4-8e8a-3d8bba338e28","resolution":{"observed_at":"2026-08-12T10:11:50.445461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.434826Z","title":"Langer, G","venue":null,"work_id":"10eb380d-67ea-4d94-9159-c6608ff254ef","year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.613122Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:89c2295a4bae142677f6853882a820079817e65702748b86ff8f21ced1056ab6","observation_id":"49a26a17-6fdb-4f7a-9957-55c070ed88bc","resolution":{"observed_at":"2026-08-12T10:11:50.438477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15161","last_updated":"2024-03-22T12:20:23Z","snapshot_observed_at":"2026-08-13T00:47:56.119335Z","submitted_at":"2024-03-22T12:20:23Z","title":"FastCAD: Real-Time CAD Retrieval and Alignment from Scans and Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15161","snapshot_observed_at":"2026-08-12T10:11:49.617182Z","title":"FastCAD: Real-time CAD re- trieval and alignment from scans and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.617182Z"},"links":{"cited_paper":"/paper/2403.15161","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:eab3f1e685929315162930a253d935a60fb49b0d3c3e38336cc6a7ef7b07fee0","observation_id":"ad0699e8-db43-43c7-8977-55b4a505aef9","resolution":{"observed_at":"2026-08-12T10:11:49.617182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11579","last_updated":"2025-03-19T23:55:24Z","snapshot_observed_at":"2026-08-12T23:41:02.739677Z","submitted_at":"2024-06-17T14:16:12Z","title":"Duoduo CLIP: Efficient 3D Understanding with Multi-View Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11579","snapshot_observed_at":"2026-08-12T10:11:49.619909Z","title":"Duoduo CLIP: Efficient 3D understanding with multi-view images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.619909Z"},"links":{"cited_paper":"/paper/2406.11579","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:d9064c910291dd3e2cff5d4403fcb21cbc673a218a13027582301717451a9c30","observation_id":"141f1074-31b5-42c3-ad5e-6632d1020d50","resolution":{"observed_at":"2026-08-12T10:11:49.619909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05941","snapshot_observed_at":"2026-08-12T10:11:49.622478Z","title":"Evaluating real-world robot manipulation policies in simulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.622478Z"},"links":{"cited_paper":"/paper/2405.05941","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:7e43a6edf4e685f824c995905d75136247508f305cda023badea7dc66293ad7c","observation_id":"51b90bbf-2d31-4901-abb9-0b501532ab37","resolution":{"observed_at":"2026-08-12T10:11:49.622478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04717","last_updated":"2024-02-07T10:09:00Z","snapshot_observed_at":"2026-08-13T04:24:26.174172Z","submitted_at":"2024-02-07T10:09:00Z","title":"InstructScene: Instruction-Driven 3D Indoor Scene Synthesis with Semantic Graph Prior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04717","snapshot_observed_at":"2026-08-12T10:11:49.625257Z","title":"InstructScene: Instruction- driven 3D indoor scene synthesis with semantic graph prior","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.625257Z"},"links":{"cited_paper":"/paper/2402.04717","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:2e24da13540134c3c97c90426b6473c7a45b061ec329c68d5e258090922e94cc","observation_id":"08c3a02c-a967-425e-889e-8e411437f904","resolution":{"observed_at":"2026-08-12T10:11:49.625257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.428262Z","title":"Towards high-fidelity single-view holistic reconstruction of indoor scenes","venue":null,"work_id":"c27b1e35-437a-4277-8460-d9538e2ea4df","year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.628147Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:a2833a4fe10bb44f892fece85b3c0997d0ae88e6a5bbb2411b3766722c313e68","observation_id":"33e30b14-43ea-407b-af39-8b59d8bfdcd7","resolution":{"observed_at":"2026-08-12T10:11:50.430827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12418","last_updated":"2023-12-19T18:50:10Z","snapshot_observed_at":"2026-08-13T04:58:16.594282Z","submitted_at":"2023-12-19T18:50:10Z","title":"LASA: Instance Reconstruction from Real Scans using A Large-scale Aligned Shape Annotation Dataset","version":1},"cited_work":{"arxiv_id":"2312.12418","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.12418","snapshot_observed_at":"2026-08-12T10:11:49.949521Z","title":"LASA: Instance Reconstruction from Real Scans using A Large-scale Aligned Shape Annotation Dataset","venue":"cs.CV","work_id":"b57f77e5-9922-4ef3-96e7-2ae1d9dc8370","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.630597Z"},"links":{"cited_paper":"/paper/2312.12418","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:151ead302bbd2de79991e8acccb2f2408b1c44a94054c8d68871eec6698a3892","observation_id":"5afda80b-60e8-4cef-a612-0b847c5398af","resolution":{"observed_at":"2026-08-12T10:11:49.953020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.419915Z","title":"PartSLIP: Low-shot part segmentation for 3D point clouds via pretrained image- language models","venue":null,"work_id":"755ac0b1-5382-4782-94cd-29d6b93b2321","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.633616Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:51c6fb1ceb4cace43a164208a19d7a5b4a294a000c3d095aeca37501de02ed9c","observation_id":"05e95c9d-3b13-421d-b51b-dfc76d29ae6b","resolution":{"observed_at":"2026-08-12T10:11:50.422596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.412754Z","title":"OpenShape: Scaling up 3D shape representation towards open-world understanding","venue":null,"work_id":"cdcd3a42-d6dc-4f26-8531-d46fcf468a34","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.637708Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:e445281d2e4d33f63730d44e7b022b001ec8894cfc37da574e3a48f1d0daa2c2","observation_id":"a4aa060b-a51c-4e72-ae46-90abf372a5c4","resolution":{"observed_at":"2026-08-12T10:11:50.415948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.405865Z","title":"Open-vocabulary point-cloud object detection without 3D annotation","venue":null,"work_id":"2e39b478-8ef4-480b-b19b-a8dc2644977e","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.640419Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:53ff65cb11c2c32bbae9e726eb55fd1b5bbd9d484b378ce984621435913676c4","observation_id":"899abf58-de0f-4be0-92c4-72564e622cab","resolution":{"observed_at":"2026-08-12T10:11:50.408637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.397426Z","title":"Vid2CAD: CAD model alignment using multi-view constraints from videos","venue":null,"work_id":"f4267ea8-a998-4434-bca9-eeaec6abad71","year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.642820Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:101372443cb552643dee7a7f19cb85d5afd6fd2cd5e4f3d7ab3fcd34f04b1fb3","observation_id":"299a2f2d-ca6e-4ec6-a677-6b5b8c355a71","resolution":{"observed_at":"2026-08-12T10:11:50.400234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.390137Z","title":"Cad-estate: Large-scale cad model annota- tion in rgb videos","venue":null,"work_id":"62283d2e-6649-4a6d-847e-ffff38f03a9a","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.645585Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:f421d4cc0a256f0e9ff84b9b64a5d9dbff5a6ba21cade4e468a5b2a3534b37e9","observation_id":"5c630e24-16f8-4a04-8cc6-96b3964b67d9","resolution":{"observed_at":"2026-08-12T10:11:50.393160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.383299Z","title":"Scaling open-vocabulary object detection","venue":null,"work_id":"5cf708ac-f0a1-4ffa-9578-c27495d553dc","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.648858Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:7883ce01f4f26215e9bc0597a277ab1f9cb910bcfa89b84ce8025c4bd86adafc","observation_id":"01ecffa7-6669-4a6e-9d06-1f38217748c9","resolution":{"observed_at":"2026-08-12T10:11:50.386021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.375721Z","title":"Open3DIS: Open-vocabulary 3D instance segmentation with 2D mask guidance","venue":null,"work_id":"9ff6cb45-1b81-4d2d-9129-c4a210d41afd","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.651350Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:0ce3769949c894f14e2ad6a6d87bdc841ae61a4f2c9999213213b789d67a52dc","observation_id":"aef7d29d-6dd1-4f0a-ad72-4fc34ac6a4bb","resolution":{"observed_at":"2026-08-12T10:11:50.378614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.365528Z","title":"GigaPose: Fast and Robust Novel Ob- ject Pose Estimation via One Correspondence","venue":null,"work_id":"09d91a2e-769c-45df-8480-08ce34f5e82c","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.653661Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5569bc77d7937c2e15335ffc2f7f46a372db757dc35ca5ef8a338958b6328c4f","observation_id":"2bf060e5-9f48-423b-aa8b-4477f6de6072","resolution":{"observed_at":"2026-08-12T10:11:50.369090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.357270Z","title":"Total3DUnderstanding: Joint layout, object pose and mesh reconstruction for indoor scenes from a single image","venue":null,"work_id":"099b343b-b8b7-4fdd-b121-e630a7b23c8d","year":2020},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.656294Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5aefdacb0d1b577173632dbdcabc1fba88cdc50deac453aea64be9ddbcc96cf6","observation_id":"dea198db-3ebb-431c-89e1-4664d7dd54ea","resolution":{"observed_at":"2026-08-12T10:11:50.360211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-12T10:11:49.658751Z","title":"DINOv2: Learning robust visual features without supervi- sion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.658751Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:4fb85db15e7e6d280821a256429e0ea79fa1e137bf2bb35b87b27c97b73588b1","observation_id":"8e93a9eb-b3e8-4bb6-85ec-f0c01fb757b6","resolution":{"observed_at":"2026-08-12T10:11:49.658751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.348322Z","title":"ATISS: Autore- gressive transformers for indoor scene synthesis","venue":null,"work_id":"ed1332af-c3aa-4793-880c-f5b2bfca52e0","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.661845Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:53ca21b609014112f39b9e3764509a4fbeac1aba32a8fee74e8a3946a3a3bb06","observation_id":"13524e66-3cc2-4a6e-92c3-956d93cbd301","resolution":{"observed_at":"2026-08-12T10:11:50.351186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.340611Z","title":"OpenScene: 3D scene understanding with open vocabular- ies","venue":null,"work_id":"2fb24474-b1c7-4ae2-af0a-667876ee4803","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.665002Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:8d4271d946a4c41111046b8f238a1e4c9c22a0c5204747b62db103f6f525964d","observation_id":"264b8f0a-3f84-4350-b2bf-25d1fbaa5973","resolution":{"observed_at":"2026-08-12T10:11:50.344077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.333617Z","title":"LangSplat: 3D language gaussian splat- ting","venue":null,"work_id":"d510d7ed-e7df-4c85-bea9-5ce555b9f24f","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.668569Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:89f3118d212f2445783a5ba3b18f91061f70d3085c433665799d9f9a0aa7cb0d","observation_id":"d82d9222-8027-40e7-98db-82eb806064aa","resolution":{"observed_at":"2026-08-12T10:11:50.336354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.671433Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.671433Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:819652a4124e4f93f234ff1e0dae476da83657fd908fb556bd3e4adc7b2282ad","observation_id":"8d9bafd8-7cf4-4c13-8d8a-7564cbd35969","resolution":{"observed_at":"2026-08-12T10:11:49.671433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.322426Z","title":"Fast and flex- ible indoor scene synthesis via deep convolutional genera- tive models","venue":null,"work_id":"b1f8d6dc-ea11-4d01-bcb1-975a4607dd1e","year":2019},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.674137Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:f33856d92f4ef5edd937a2422f336e09123dc0526cda97441a942e90fe0348cf","observation_id":"e3a9a5f5-90cc-4ae7-b497-2e2fe0b355e9","resolution":{"observed_at":"2026-08-12T10:11:50.325043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.315367Z","title":"Hypersim: A photorealistic syn- thetic dataset for holistic indoor scene understanding","venue":null,"work_id":"a8a62e69-8449-4636-94f5-028fdb88ec13","year":2021},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.677118Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5f7061eb256a0ffeed2558645f32cef84242e878a21e2d890ebf3388b6a70fa9","observation_id":"787cabb3-1af9-40d0-81f9-3dbcd1c2acb4","resolution":{"observed_at":"2026-08-12T10:11:50.318328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.305929Z","title":"Estimating generic 3D room structures from 2D annotations","venue":null,"work_id":"349afb8a-b52f-4e73-9491-a70e06b62dc9","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.680491Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:f26ef91bb098a4dfcfcec41feae42efddfc863cf484328cd9c3b0f5ff9d3531e","observation_id":"880af085-46f0-4a31-b380-5f96591c318d","resolution":{"observed_at":"2026-08-12T10:11:50.309562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.299220Z","title":"Computational geometry","venue":null,"work_id":"556d6789-b94d-459f-9f4b-a0bd0e43d111","year":1978},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.683425Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:6b1e3e47c2f2a4d5315b9047d69dbf507d2b908aa3e56d57efe2048348584902","observation_id":"2676c924-eef1-447c-8041-2becce7e76e2","resolution":{"observed_at":"2026-08-12T10:11:50.301546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.292727Z","title":"PlaneRecTR: Uni- fied query learning for 3D plane recovery from a single view","venue":null,"work_id":"70b33abb-254f-4d21-bdec-6c6a3c1c0f77","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.685824Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:e4b436a19b16d0b2ec863abf4119c0b0486ab87fc08e4dd72171acba063c23bd","observation_id":"ae21a2f4-160a-4e51-9794-8c91025c928d","resolution":{"observed_at":"2026-08-12T10:11:50.295397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.284336Z","title":"General 3D room layout from a single view by render-and-compare","venue":null,"work_id":"eba5b77d-e07d-4afa-95d8-23112ac196bc","year":2020},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.688793Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:7e579b121ff942341650b6683469c528caa0b767149341ebc030d9f997039bfa","observation_id":"ff8537de-ce15-41b0-82eb-07afa53accbf","resolution":{"observed_at":"2026-08-12T10:11:50.287652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.277648Z","title":"Lempitsky","venue":null,"work_id":"769264d6-959a-46d6-91b2-8d0200a58494","year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.691376Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:b8d18f847a69a545adaf1b7d1fd613e68421508342f3610fbfb2ec31605a4fc8","observation_id":"7d498c06-3dfd-46a6-b560-7a03cd10f95b","resolution":{"observed_at":"2026-08-12T10:11:50.280447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.270562Z","title":"Habitat 2.0: Training home assistants to rearrange their habitat","venue":null,"work_id":"1d6ae427-409c-46ad-b973-b94a411d4a4a","year":2021},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.693691Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:50a6f0238a794ea869ca5f74df1c72eecc057d9644cccf6189012d2dfc2c7d1d","observation_id":"c8d8126c-03d9-4792-a825-8a3a4f38bf44","resolution":{"observed_at":"2026-08-12T10:11:50.273410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13631","last_updated":"2023-10-29T14:04:25Z","snapshot_observed_at":"2026-08-13T11:10:28.688404Z","submitted_at":"2023-06-23T17:36:44Z","title":"OpenMask3D: Open-Vocabulary 3D Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13631","snapshot_observed_at":"2026-08-12T10:11:49.697493Z","title":"Open- Mask3D: Open-vocabulary 3D instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.697493Z"},"links":{"cited_paper":"/paper/2306.13631","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:f013a0afded431dfa2f695624cf2ae0b0ec539913704e77289b0b24d84a17686","observation_id":"54f70c6a-f0bf-47ed-b740-f7e59808c83c","resolution":{"observed_at":"2026-08-12T10:11:49.697493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02211","last_updated":"2025-06-03T10:28:20Z","snapshot_observed_at":"2026-08-12T23:08:44.700735Z","submitted_at":"2024-08-05T03:24:45Z","title":"SceneMotifCoder: Example-driven Visual Program Learning for Generating 3D Object Arrangements","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02211","snapshot_observed_at":"2026-08-12T10:11:49.700931Z","title":"SceneMotifCoder: Example-driven visual program learning for generating 3D object arrangements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.700931Z"},"links":{"cited_paper":"/paper/2408.02211","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:bee1037ccd68134c4dd277451162bf4da178d0055de929d89867e4c2191b3645","observation_id":"cabec119-1f50-43de-a3f9-688cb1002400","resolution":{"observed_at":"2026-08-12T10:11:49.700931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.261737Z","title":"DiffuScene: Denoising diffu- sion models for generative indoor scene synthesis","venue":null,"work_id":"85aebe13-1e8b-4b71-a6f9-440832d18c88","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.703907Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:ecd4da5f93be78f8f0f01e01c1bc3f7753768b0dc338385d32d46f1dd54d2975","observation_id":"7d6a11eb-53e0-4c2a-a996-ecd22a6e70e4","resolution":{"observed_at":"2026-08-12T10:11:50.266035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.255445Z","title":"Least-squares estimation of transforma- tion parameters between two point patterns","venue":null,"work_id":"0917f3b4-a1a7-4741-866f-caa7db8ca178","year":1991},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.707342Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:92b79274f1caf5ccb90edb78897a043bbc3d5d90555826922a2212f112941375","observation_id":"41f804fa-f2cc-4271-812a-cb9dc1345bda","resolution":{"observed_at":"2026-08-12T10:11:50.257927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.248410Z","title":"Deep convolutional priors for indoor scene syn- thesis","venue":null,"work_id":"6ae3b241-2bd4-4be4-b78e-e25979bbe60b","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.709763Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:d070445a2aaa82140c9f83b60f779f78f90fb1fcc62eb6aacdfa6db5f935a5f8","observation_id":"aa30b035-e05d-4931-b51e-827bac432aa7","resolution":{"observed_at":"2026-08-12T10:11:50.251260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.241265Z","title":"PlanIT: Planning and in- stantiating indoor scenes with relation graph and spatial prior networks","venue":null,"work_id":"165063b1-994a-419f-83b2-b3dd80de4a4a","year":2019},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.712598Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:ff269082876e9212a8ffa3884c39bb902cabd77686964c8367a1de28a27e9097","observation_id":"0815e5db-bc2b-483d-97d8-b42e5d68612d","resolution":{"observed_at":"2026-08-12T10:11:50.244285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.234877Z","title":"Lift3D: Zero-shot lifting of any 2D vi- sion model to 3D","venue":null,"work_id":"5d99e650-5fc9-4e56-83fb-5e6993195dc2","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.715682Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:c5407e98fc9e1d331346686c6d23719f2db9b6ad5c607097217213b7d052e5dc","observation_id":"3a365394-dbd9-407f-8cd0-cdf9e83bc041","resolution":{"observed_at":"2026-08-12T10:11:50.237503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.228391Z","title":"SceneFormer: Indoor scene generation with transformers","venue":null,"work_id":"29569626-7b3e-4ad7-b4f5-867cbcbfa8e7","year":2021},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.718055Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:eeae9ce4d9788f49bbb967b54772d53d7d45f19d97f43b454cf0b65b409f541f","observation_id":"a4d9314b-7d34-466e-b97b-048b3bb45935","resolution":{"observed_at":"2026-08-12T10:11:50.230954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.221153Z","title":"Lego-net: Learning regular rearrangements of ob- jects in rooms","venue":null,"work_id":"344069fb-d934-4b2d-b2e6-b65b7112b640","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.720297Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:f83e51c88e70893b4d7715d5805bd684e40b608c4776c6b2278e3d648e0b94a7","observation_id":"5d969a9a-5799-4b47-ad3b-779e1785e78a","resolution":{"observed_at":"2026-08-12T10:11:50.224002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.214150Z","title":"R3ds: Reality-linked 3d scenes for panoramic scene understanding","venue":null,"work_id":"bd998ed1-e110-437b-a3e0-67bf6ff90141","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.722620Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:c1168eeb7717d164dd2c86f50686626fbda25208b92c1ef1e9c55189a217a107","observation_id":"85a496ba-cd1d-4b62-9b6f-182dd497fc87","resolution":{"observed_at":"2026-08-12T10:11:50.217254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.206308Z","title":"Generalizing single-view 3D shape retrieval to occlu- sions and unseen objects","venue":null,"work_id":"77d16fb3-95b5-4e89-9816-6e28c8f5be3a","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.725620Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:88c4c746bc2e4f27301e0e3ded77d690c9b15bc8afd0a48ef481ae49735f00a6","observation_id":"a7760160-f15f-44c5-b27c-5c3f8fe3d692","resolution":{"observed_at":"2026-08-12T10:11:50.209991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.198797Z","title":"ULIP-2: Towards scal- able multimodal pre-training for 3D understanding","venue":null,"work_id":"1cafcab3-4f44-4d3f-b3b7-49f2c793f002","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.728700Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:ea3e02b2fe1183ec2fd8e052e4e47850b6e99e5a3aa48492bfd923b8538e2fe1","observation_id":"e18b82c3-98e4-4f11-89d0-3f068ae12108","resolution":{"observed_at":"2026-08-12T10:11:50.201800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.191801Z","title":"Learning to reconstruct 3d non-cuboid room layout from a single rgb image","venue":null,"work_id":"902eefe7-6e3f-4838-96aa-bcc4322bb70c","year":2022},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.731710Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:ae18d8714d8d67f6992ed91fc9b647dba011c2314021bbae4d638a620e326f30","observation_id":"02d3f13e-c7db-4f0a-82b0-1d96e5be249b","resolution":{"observed_at":"2026-08-12T10:11:50.194470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-12T21:25:32.312122Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-12T10:11:49.734860Z","title":"Set-of-mark prompting unleashes extraordinary visual grounding in GPT-4V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.734860Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5dba8d4537bd0b5bc5acf4417fc5b2cbd1df36822b39225a7f7bad8cef857cb8","observation_id":"d06723d3-9339-40d2-ad98-66f40cf7dde5","resolution":{"observed_at":"2026-08-12T10:11:49.734860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09414","last_updated":"2024-10-20T11:24:09Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:56Z","title":"Depth Anything V2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09414","snapshot_observed_at":"2026-08-12T10:11:49.737583Z","title":"Depth any- thing v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.737583Z"},"links":{"cited_paper":"/paper/2406.09414","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:bc6199628e2e1d67a443c3bc552a84fe2ff8d0fc86ec2c3e49107ab986595a94","observation_id":"11ce0f39-aab4-4e95-a6de-e8952184a690","resolution":{"observed_at":"2026-08-12T10:11:49.737583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24001","last_updated":"2024-10-31T15:02:05Z","snapshot_observed_at":"2026-08-12T22:10:41.589386Z","submitted_at":"2024-10-31T15:02:05Z","title":"ImOV3D: Learning Open-Vocabulary Point Clouds 3D Object Detection from Only 2D Images","version":1},"cited_work":{"arxiv_id":"2410.24001","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.24001","snapshot_observed_at":"2026-08-12T10:11:49.913279Z","title":"ImOV3D: Learning Open-Vocabulary Point Clouds 3D Object Detection from Only 2D Images","venue":"cs.CV","work_id":"f8946dd0-e4ef-4fd1-b0ae-5aaa5702e861","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.740308Z"},"links":{"cited_paper":"/paper/2410.24001","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:11b08755c3890900e54f8dd128e267157762321b3e193d74933d68c269f04a67","observation_id":"dd72d8e8-af42-4cde-aa27-6e12c9c63ac3","resolution":{"observed_at":"2026-08-12T10:11:49.916053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.183006Z","title":"Holodeck: Language guided gen- eration of 3D embodied AI environments","venue":null,"work_id":"71012d07-e3d0-493a-8f29-ebde47c9835c","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.743249Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:20094f15f85db9752261f9a55f5af6dae4508e32ef6e8ed1086cf481a3c8484f","observation_id":"ae042157-ac9d-4eac-a7dd-24e250697efa","resolution":{"observed_at":"2026-08-12T10:11:50.186658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07445","last_updated":"2024-04-11T03:00:00Z","snapshot_observed_at":"2026-08-13T00:32:59.627961Z","submitted_at":"2024-04-11T03:00:00Z","title":"Multi-view Aggregation Network for Dichotomous Image Segmentation","version":1},"cited_work":{"arxiv_id":"2404.07445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07445","snapshot_observed_at":"2026-08-12T10:11:49.901317Z","title":"Multi-view Aggregation Network for Dichotomous Image Segmentation","venue":"cs.CV","work_id":"013fc9be-03e8-460e-8a82-0b5f1c8e02e2","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.745506Z"},"links":{"cited_paper":"/paper/2404.07445","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:daa608acd0828d180f826b7b568eaf2ee05521ea9c58f6152c3f9a10eabe2184","observation_id":"cf604c72-7298-4844-9d0f-897e80fac004","resolution":{"observed_at":"2026-08-12T10:11:49.905489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06790","last_updated":"2023-04-13T19:23:52Z","snapshot_observed_at":"2026-08-13T12:03:18.164407Z","submitted_at":"2023-04-13T19:23:52Z","title":"Inpaint Anything: Segment Anything Meets Image Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06790","snapshot_observed_at":"2026-08-12T10:11:49.748866Z","title":"Inpaint anything: Segment anything meets image inpainting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.748866Z"},"links":{"cited_paper":"/paper/2304.06790","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:347e38884f3953064cbaa3460156c379ab4cd62e02c7826827e569a45d99c69b","observation_id":"d35df8f3-c6fb-426b-86db-10310aa4bad0","resolution":{"observed_at":"2026-08-12T10:11:49.748866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.174354Z","title":"Improving 2D feature representations by 3D-aware fine-tuning","venue":null,"work_id":"be0c7e3c-84ab-44c2-b46e-ea134dc6a971","year":2025},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.751681Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:f814cc7933da74a840aa397ce8d524535d9b5e6446d46ef7504f4011fb41213b","observation_id":"096e0f4b-243d-4d72-a29f-042671238d5e","resolution":{"observed_at":"2026-08-12T10:11:50.178196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.167247Z","title":"DeepPanoCon- text: Panoramic 3D scene understanding with holistic scene context graph and relation-based optimization","venue":null,"work_id":"c69a9f17-8734-401f-a8d6-5166ceb462c5","year":2021},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.754700Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:4d573ad4555443c4b557b58a5d63386ba48e63fea52aeeaafd2ba75b361abda9","observation_id":"c9c5a416-f891-4c26-9f76-9ce0382ff57d","resolution":{"observed_at":"2026-08-12T10:11:50.170172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.159991Z","title":"CLIP-FO3D: Learning free open-world 3D scene representations from 2D dense CLIP","venue":null,"work_id":"b3f8a4f9-ba43-40a1-8acf-8ebd82a50438","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.757458Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:edd39e28045276b4c921992a922e3ccd3d742def79811e591128d6433ec771b6","observation_id":"8bb5fafc-8cf4-4e2e-939d-5b266b049bb5","resolution":{"observed_at":"2026-08-12T10:11:50.162667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.151948Z","title":"Structured3D: A large photo-realistic dataset for structured 3D modeling","venue":null,"work_id":"3ba3ac0c-7c3c-4882-96f7-4118664150c2","year":2020},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.759672Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:5935c7c2cb5433ffee07c6a1254476daebd4bab1f771e079881f5ae2c6e88aee","observation_id":"5a632b2e-c84f-44a5-b1b9-8c367523e5e8","resolution":{"observed_at":"2026-08-12T10:11:50.155290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.144222Z","title":"Bilateral refer- 12 ence for high-resolution dichotomous image segmentation","venue":null,"work_id":"ba9e9731-a969-4f61-9dad-c6d5b8c7cb8f","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.761875Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:90f1aab12875d67446dd0e6c8a5545c029f9983c366a9fa49f03d28112dce949","observation_id":"8dc8a302-6b17-4eb6-a682-4dddcdc1ae71","resolution":{"observed_at":"2026-08-12T10:11:50.147406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15971","last_updated":"2024-10-21T12:58:19Z","snapshot_observed_at":"2026-08-12T22:18:36.962449Z","submitted_at":"2024-10-21T12:58:19Z","title":"Zero-Shot Scene Reconstruction from Single Images with Deep Prior Assembly","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15971","snapshot_observed_at":"2026-08-12T10:11:49.764963Z","title":"Zero-shot scene reconstruction from single images with deep prior as- sembly","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.764963Z"},"links":{"cited_paper":"/paper/2410.15971","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:add6a0abb466dc93b15102a9a3ab5fefacc79774cd848b8d44cdc26c1ff2a948","observation_id":"ff514cac-978c-4aae-a9e8-ff68e3efb5e8","resolution":{"observed_at":"2026-08-12T10:11:49.764963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.09847","last_updated":"2018-01-30T04:33:20Z","snapshot_observed_at":"2026-07-06T06:20:51.245757Z","submitted_at":"2018-01-30T04:33:20Z","title":"Open3D: A Modern Library for 3D Data Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.09847","snapshot_observed_at":"2026-08-12T10:11:49.769541Z","title":"Open3D: A modern library for 3D data processing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.769541Z"},"links":{"cited_paper":"/paper/1801.09847","citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:a01842411313f3cf5a10d01960507c74bdc447049d8b8a85d7154f1a0a011f8d","observation_id":"601a6c67-5a14-4e0a-b27a-c02bae60cec9","resolution":{"observed_at":"2026-08-12T10:11:49.769541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.135224Z","title":"Point- CLIP v2: Prompting CLIP and GPT for powerful 3D open- world learning","venue":null,"work_id":"2a97805f-3ec2-481b-bc30-2908a367ba91","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.772565Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:35ddf5cfca7c1a9856272a5ca2cad0f2e88698619115262cc63adf280dfb4173","observation_id":"0326cd5a-3ce0-4e48-8e58-c24586f365e0","resolution":{"observed_at":"2026-08-12T10:11:50.138459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.15536","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:49.866043Z","title":"GRS: Generating robotic simulation tasks from real-world images","venue":null,"work_id":"e62a7849-8996-4ba6-a50a-41fadc5f6be0","year":2024},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.775705Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:281674b6440085ed100a8883e9b32bb06211a4b588bb356fd65258de83835fd4","observation_id":"843593dc-c620-4229-a2c7-860359cbced8","resolution":{"observed_at":"2026-08-12T10:11:49.871719Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.126076Z","title":"gpt-4o-2024-08-06","venue":null,"work_id":"4c931014-9bf6-4c42-aaeb-08d558cf8bf6","year":2023},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.778819Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:17c1c1f8ff2e0790596988857863c1b90578e368360c5cbe7f29580aa52c64f2","observation_id":"ae5943dc-7d99-4022-ab7e-5ce3bce352b7","resolution":{"observed_at":"2026-08-12T10:11:50.128905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:50.117185Z","title":"a photo of CLASS","venue":null,"work_id":"ef3c2959-16b2-4ee2-85ca-3eaba032eba3","year":null},"citing_paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:49.782513Z"},"links":{"citing_paper":"/paper/2411.19492"},"observation_digest":"sha256:49c9c616c95ddb7390ca4757f5aade2375beb73af609063f9f9ac144b2e453c6","observation_id":"775dd22d-dda3-4b03-8033-b0e597ed2b6c","resolution":{"observed_at":"2026-08-12T10:11:50.120553Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.19492","last_updated":"2025-03-14T22:54:30Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T19:24:09.240473Z","submitted_at":"2024-11-29T06:19:04Z","title":"Diorama: Unleashing Zero-shot Single-view 3D Indoor Scene Modeling"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":5,"verified_fuzzy":50},"total_outbound_references":100},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 100 outbound references and 1 inbound Pith citation observation for arXiv:2411.19492."}