{"as_of":"2026-08-18T05:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0404afd3b75d0b0e6d8065c2a46f09687b5859c9c51c388067488680442467e0","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:22:40.727671Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:37:23.620325Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15373","snapshot_observed_at":"2026-08-04T09:37:23.620325Z","title":"RAZER: Robust Accel- erated Zero-Shot 3D Open-V ocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14546","last_updated":"2026-08-03T08:20:35Z","snapshot_observed_at":"2026-08-12T10:37:29.235202Z","submitted_at":"2025-10-16T10:41:31Z","title":"QuASH: Using Natural-Language Heuristics to Query Visual-Language Robotic Maps","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T09:37:23.620325Z"},"links":{"cited_paper":"/paper/2505.15373","citing_paper":"/paper/2510.14546"},"observation_digest":"sha256:984aac2e6aa6338c3e3022ba31d80044b72e2a2cd8c08b9bb84cc14cea0cee50","observation_id":"07970442-5f5d-4679-9db3-a5267545ce27","resolution":{"observed_at":"2026-08-04T09:37:23.620325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15373/citation-record","integrity":"/paper/2505.15373/integrity","json":"/paper/2505.15373/citation-record.json","paper":"/paper/2505.15373"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.599959Z","title":"Associatively segmenting instances and semantics in point clouds,","venue":null,"work_id":"5cf7369e-8f16-4594-a873-6016b8083800","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.471423Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:1dd4a097a7e4b0bedfad7ce83b9bebd9a52803bc62967ada2df9e33339d8a89c","observation_id":"4b0788c1-a971-4feb-b35d-9c2ee91a7e76","resolution":{"observed_at":"2026-08-07T15:22:50.714251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.466088Z","title":"3d bird’s-eye- view instance segmentation,","venue":null,"work_id":"74afb31a-ad0f-4fca-99b6-f5c4a5b1ed0d","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.532385Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:dccfed07ce1fec35ea4b1a496754ceb3816766b442a54a7fc34a133a84dafd57","observation_id":"ec814e19-d84b-4f3f-81a2-17df41d296e9","resolution":{"observed_at":"2026-08-07T15:22:50.517654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.280445Z","title":"3d instance segmentation via multi-task metric learning,","venue":null,"work_id":"038a687a-1989-43cd-a5fc-bc26458fabdb","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.632848Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:274106435e921a9a3ba562d65dae06b25f88320aa8fdb852055f88e2e7aa0f87","observation_id":"1327f7c7-4d62-40a7-8952-be35231d81ec","resolution":{"observed_at":"2026-08-07T15:22:50.352130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.035695Z","title":"3d-sis: 3d semantic instance segmen- tation of RGB-D scans,","venue":null,"work_id":"0407c95f-d95c-4b92-b9b3-cb196a360392","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.707090Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7dfd02df8b7ccdee06bdb08c2c3b739a215a7c383c8a5260fa92ae4f7ddc721a","observation_id":"ca31287c-0b03-4b01-b3c9-e8de8dfb0abd","resolution":{"observed_at":"2026-08-07T15:22:50.147933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.893407Z","title":"Learning object bounding boxes for 3d instance segmenta- tion on point clouds,","venue":null,"work_id":"c12a2880-15ad-40b9-bbda-04985ce5feef","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.785996Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:c6845a1d33f802e2a94247ac08a638edbe9668b59711c6fe36346c7c89b83405","observation_id":"3fbaa1aa-b9f5-43bc-9024-44db559db760","resolution":{"observed_at":"2026-08-07T15:22:49.955507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.660430Z","title":"Towards open vocabulary learning: A survey,","venue":null,"work_id":"1a8e2fb2-d936-4e7f-bbd9-d2f1cd110138","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.892207Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:fab41240bd7e104474d78b494dcedf6e020a440821d388a4f20d139a6020dbe6","observation_id":"4402cdb0-31b9-47fa-a817-1ba5fdeeb1f0","resolution":{"observed_at":"2026-08-07T15:22:49.788515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.436680Z","title":"A survey on open-vocabulary detection and segmentation: Past, present, and future,","venue":null,"work_id":"737622d3-7b8b-499e-b86b-a8787d19f674","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.012584Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:a9f571ac70b894632fae859e3ac1ab368d8221b7bff539c49248cd3bc5de6574","observation_id":"2eb2db16-493b-4a7a-9cdb-5360c760324a","resolution":{"observed_at":"2026-08-07T15:22:49.527652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.238528Z","title":"A simple baseline for open-vocabulary semantic segmentation with pre-trained vision-language model,","venue":null,"work_id":"b02d38c5-a4d4-49d5-a995-46c7318f42ca","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.103621Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e72d9b3fc7137b6359b9f4c755d519c5a2ff9348536dcd34fa861aa118bf6f3c","observation_id":"4e7456dc-8c26-40c2-9751-fe80498dc5a6","resolution":{"observed_at":"2026-08-07T15:22:49.297891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:36.158720Z","title":"Clio: Real-time task-driven open-set 3d scene graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.158720Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:fd39c98d950f583b320c076e861f42e0cda54434c6ed21a31049bbf6cd1a2518","observation_id":"dc4c9fc9-ac96-48b2-9eac-85887ed6543a","resolution":{"observed_at":"2026-08-07T15:22:36.158720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.095434Z","title":"V olumetric Instance-Aware Semantic Mapping and 3D Object Discovery,","venue":null,"work_id":"6d788d7d-f3fb-41e3-9232-8c76b70904b5","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.237805Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e6f8b50d7fa8eff3e65eab10623b12cc9f9a2f798763175709049ce0bddcaf48","observation_id":"d27f2663-8d84-40ce-a83b-c476c8d758ec","resolution":{"observed_at":"2026-08-07T15:22:49.171116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.936392Z","title":"Panopticfusion: Online volumetric semantic mapping at the level of stuff and things,","venue":null,"work_id":"55266b3a-ea67-4fb2-85f4-8b253f53f112","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.320785Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5cca64c192d439bca3aa78e7de309129d85df4621012921552f05e7d536fb021","observation_id":"d4756706-6dee-4d2b-a5f7-99f0ad6de78b","resolution":{"observed_at":"2026-08-07T15:22:49.038867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:36.382205Z","title":"Maskfusion: Real-time recog- nition, tracking and reconstruction of multiple moving objects,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.382205Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:152e42ec87a9ea1088e468dd7d7c53e7e76c991ceb8c5e940919cc5eba30f635","observation_id":"b324e760-a772-41e9-a98a-f5ad9d4af53b","resolution":{"observed_at":"2026-08-07T15:22:36.382205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.815956Z","title":"Occuseg: Occupancy-aware 3d instance segmentation,","venue":null,"work_id":"df2e859f-75c5-4cf0-bc4d-9bcba1a2bfeb","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.454734Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:d8dc9ca39b95c026de22533b4ccbc346a2ea9e0436840ae9b0f05270218dc750","observation_id":"462eef91-2b34-445e-a6bc-1c923e4e6d5a","resolution":{"observed_at":"2026-08-07T15:22:48.852768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.666097Z","title":"Hierarchical aggre- gation for 3d instance segmentation,","venue":null,"work_id":"acec0ea6-c21e-4d98-8c11-44278d9a54c6","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.531340Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:501a60e4c5fe096989b772a8db58f9a2ebcf1dcc5750323258ac5e8c002112d3","observation_id":"833c5088-f5ee-4bfe-9a7c-d989f9511227","resolution":{"observed_at":"2026-08-07T15:22:48.734605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.467160Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":"e21090f6-c882-464d-8b59-9305d6dd94dd","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.602573Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:afca8b9c44a13b8fc97b40632dfcd6e45a2e715647a66be35903e727b8ccf61a","observation_id":"c5bf2e45-c4b7-4fdd-9ae0-b0040cfa7dbf","resolution":{"observed_at":"2026-08-07T15:22:48.548443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.276754Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"2cbe63b8-3066-4445-b4a4-5132b9657c9b","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.653890Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:77c96f028c095cc01ef62f1373cfb3815f5f5b3d4245022c4352845ab556548d","observation_id":"bb58a6d7-1ed3-4ed7-8961-2c6171f81756","resolution":{"observed_at":"2026-08-07T15:22:48.350475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.070354Z","title":"Pointclip: Point cloud understanding by CLIP,","venue":null,"work_id":"20b0af89-52b0-4661-a619-d553bed679fc","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.694252Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:491f4de423332e8b3532d37e2f3e6340ad42abc3529739db7faeb12f29bd8310","observation_id":"db120c11-e55f-475b-9973-a965960dfd4c","resolution":{"observed_at":"2026-08-07T15:22:48.196885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.769394Z","title":"ULIP: learning a unified representation of language, images, and point clouds for 3d understanding,","venue":null,"work_id":"a3bcead9-9d9d-468d-abf4-dfa10f30b8e3","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.734433Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5a1596a931c4627b2b7eb414fe8a19c3d9c29d208470f2be6d083017191c8a05","observation_id":"c1ab0514-4cfe-4522-a5f2-657626a19113","resolution":{"observed_at":"2026-08-07T15:22:47.918903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.699885Z","title":"Con- ceptgraphs: Open-vocabulary 3d scene graphs for perception and plan- ning,","venue":null,"work_id":"5bf31ba2-26a5-4bef-b2f2-274f12b98d14","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.773536Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:20d51fb31646e5d660844bd8848fc98257ab8fecc68abca326be08e7459909e6","observation_id":"39a64823-4908-45b9-a961-84b4add1920b","resolution":{"observed_at":"2026-08-07T15:22:47.704740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.586046Z","title":"Ins-conv: Incremental sparse convolution for online 3d segmentation,","venue":null,"work_id":"3deed6f0-19de-4b81-8678-d4392486a0cd","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.802466Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:60ed231d79255779618ec01868b2cfbacf3f61c537e4d278d04ceaf68199b509","observation_id":"d01f0e2d-061b-43c4-82ee-b0e414d7e613","resolution":{"observed_at":"2026-08-07T15:22:47.690904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.447615Z","title":"PLA: language- driven open-vocabulary 3d scene understanding,","venue":null,"work_id":"fde0bd7c-20f2-4e51-8f64-48ce65775983","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.886820Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:8a91d1166fb9efa5ade170bca402e910c61416fded04d373a1ba06d5cf1d48ad","observation_id":"0680cacd-3f64-4cf4-bc22-b2543216deb6","resolution":{"observed_at":"2026-08-07T15:22:47.532315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.331036Z","title":"Context-aware alignment and mutual masking for 3d-language pre-training,","venue":null,"work_id":"abc2a6ea-6b0d-47ea-9e76-90dc1c05f368","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.965831Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:94001dad34770c1422b07e80cb9bf4209352d9e90fef56c9e5c24815b9485559","observation_id":"5340ce07-8502-4f37-92b2-182b949e1c1a","resolution":{"observed_at":"2026-08-07T15:22:47.385633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.218195Z","title":"3d-vista: Pre- trained transformer for 3d vision and text alignment,","venue":null,"work_id":"2df82959-7508-4acd-ab63-7d5af280790c","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.049703Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:8aed24f76d29be69ddfeb864a6a2fae7b18ec918b66d2c0a5eec73d2cabd6b73","observation_id":"1c42f3b5-5cc3-4191-bedb-e6f934954ed6","resolution":{"observed_at":"2026-08-07T15:22:47.278458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.092842Z","title":"V ote2cap-detr++: Decoupling localization and describing for end-to-end 3d dense captioning,","venue":null,"work_id":"02b51ec1-b361-48e7-ad30-69e92b6dc51c","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.127649Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:8cbcdef5174239cea0514db9428576850e560ef0bae19aafae9816d401029450","observation_id":"03bcb883-5144-48c4-8d25-35f60503e6bc","resolution":{"observed_at":"2026-08-07T15:22:47.145039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.943603Z","title":"Scan2cap: Context-aware dense captioning in RGB-D scans,","venue":null,"work_id":"fc03748a-55dd-4eb6-84cf-33bb8c001a84","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.191655Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:9338598129e3429cbae0e3f9cad7e02f51faf4c9af752d06da96d1ece0268ce5","observation_id":"174ef342-3f43-42c1-99a8-f33a840d8f8b","resolution":{"observed_at":"2026-08-07T15:22:47.025195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.788197Z","title":"Scanrefer: 3d object localization in RGB-D scans using natural language,","venue":null,"work_id":"e5dbb523-2d93-491a-b329-5689697514af","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.257609Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:3e4a699db18f885666a3f3467cbcc3fd317f013ee0806f5928a1608e88edb09e","observation_id":"6f1d9cff-261b-4a5c-9cdc-040ca6c17289","resolution":{"observed_at":"2026-08-07T15:22:46.861919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.645804Z","title":"Mask3d: Mask transformer for 3d semantic instance segmentation,","venue":null,"work_id":"22dcb285-cc73-404f-8bd5-de42cf873a88","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.416332Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:27cdd196006673ebe79da8255b8af82645532ad0c508d0d5760ef15569d7fe9d","observation_id":"dde8a880-9efc-4790-86d8-b68f26d5ac69","resolution":{"observed_at":"2026-08-07T15:22:46.729120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.541109Z","title":"AGILE3D: attention guided interactive multi-object 3d segmentation,","venue":null,"work_id":"c53c41b2-b351-4475-9b28-07fba6a06cb2","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.477212Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:84ee13a4193937fb0778afbf7b34bc2f26011319fad050a401190d7f4aac92b0","observation_id":"d3e0b8d0-3a69-43f6-a14e-8705a198a9f4","resolution":{"observed_at":"2026-08-07T15:22:46.590863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.358515Z","title":"Uni3d: Exploring unified 3d representation at scale,","venue":null,"work_id":"1ef3f326-5a5f-4f8b-88da-b49d8eb0a4fa","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.504814Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:dcad8ff6244333a546fdce07fb4d6918fc53908a0da207e8f18ca5104b82facf","observation_id":"5af2ed09-0ab5-4938-b052-a6432b548dce","resolution":{"observed_at":"2026-08-07T15:22:46.460899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.227939Z","title":"LERF: language embedded radiance fields,","venue":null,"work_id":"28757b33-f49c-4a9d-ab14-e0a59906bd6b","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.526429Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e37b2d4c89e731a9b23f7965de6550931de27d736a6769aa71aba9235aeafb61","observation_id":"a6367960-f0d5-4867-be02-f21755b94fe2","resolution":{"observed_at":"2026-08-07T15:22:46.286703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.078302Z","title":"Open-nerf: Towards open vocabulary nerf decomposition,","venue":null,"work_id":"856b0fc0-13a4-4735-b78a-97c8eb2c2ab6","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.556498Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7b2d5138e926a03e7c056ad086637c7759a56c91532e3d6ffa91edc86f6ff5a4","observation_id":"1ebf5ee5-7739-43c2-be04-5a5f3f741c45","resolution":{"observed_at":"2026-08-07T15:22:46.145930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.001529Z","title":"Gov-nesf: Generalizable open- vocabulary neural semantic fields,","venue":null,"work_id":"5a401bd5-0ea5-4329-be2d-c606d6662a25","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.589635Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:03707b19c8fb0c0f8422973e25b17320a3d7f543fda4d4e8bdc7f2c0d34c3f7e","observation_id":"4ce5aff7-cbbd-4212-9dfa-eb0720b61700","resolution":{"observed_at":"2026-08-07T15:22:46.044116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11141","last_updated":"2024-02-17T00:15:09Z","snapshot_observed_at":"2026-08-16T14:17:49.235212Z","submitted_at":"2024-02-17T00:15:09Z","title":"Semantically-aware Neural Radiance Fields for Visual Scene Understanding: A Comprehensive Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11141","snapshot_observed_at":"2026-08-07T15:22:37.611786Z","title":"Semantically-aware neural radiance fields for visual scene understand- ing: A comprehensive review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.611786Z"},"links":{"cited_paper":"/paper/2402.11141","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:03c8122d491c6fc67bc0e6f9832bd8996947d728b8620268b84c9c713880f38a","observation_id":"a742f79b-67e0-43aa-824f-b9f7c096f313","resolution":{"observed_at":"2026-08-07T15:22:37.611786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.880771Z","title":"Kimera: From SLAM to spatial perception with 3d dynamic scene graphs,","venue":null,"work_id":"82f9dc79-fe76-49ea-b83c-df706a5039fc","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.640523Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:3234b62ef53d372867e73d93b16f8ee5b0a7c40b404152c5e71beb97702540d0","observation_id":"dc95b1c2-1b80-4700-8fa1-23d2afa44bed","resolution":{"observed_at":"2026-08-07T15:22:45.917354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.752576Z","title":"Mid-fusion: Octree-based object-level multi-instance dynamic SLAM,","venue":null,"work_id":"b2124e0b-dabc-4866-a842-1dc4974ba88e","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.679335Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:06f4be55c73ff71de2fcbd3017737741bc7e0090d332e626a19abd5ad5c5756a","observation_id":"2179a4f0-55a8-4f2c-bed6-58d2cd5c7a74","resolution":{"observed_at":"2026-08-07T15:22:45.834189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.600724Z","title":"Quadricslam: Dual quadrics from object detections as landmarks in object-oriented SLAM,","venue":null,"work_id":"64256283-e39d-478c-8621-80b61a874158","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.719308Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e36d8054b4e84d076c781b6033b6c8a36546ab7affc9b97a1ec9c9e335097ee8","observation_id":"ca011e25-00f4-4b29-8f48-2a45c2574ef3","resolution":{"observed_at":"2026-08-07T15:22:45.655941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.431464Z","title":"Semantic segmentation guided slam using vision and lidar,","venue":null,"work_id":"6c1dc033-125c-4115-a026-6c418cdd782a","year":2018},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.760364Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:72c60667f1515a336bf72a38c15fdef47148d01282862c3021d9878e59e4a594","observation_id":"2b346505-10d3-48fc-a25f-057bfbd80b55","resolution":{"observed_at":"2026-08-07T15:22:45.549884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.315366Z","title":"SLAM++: simultaneous localisation and mapping at the level of objects,","venue":null,"work_id":"e5b6b666-0556-43d4-b16e-1b64e2469ef8","year":2013},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.800164Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:29ff5d1248d516441ca3c04b2e0082c2d597b068c79eb75b5cca048c0625e58d","observation_id":"1119398b-5e04-4849-a3b2-6bdfe7cb5f9a","resolution":{"observed_at":"2026-08-07T15:22:45.379886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.173077Z","title":"vmap: Vectorised object mapping for neural field SLAM,","venue":null,"work_id":"934b2b71-fe06-40ff-966f-2ad37fbb35a8","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.829092Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:151b3d6b741d898e1ce6353f59e760f59a76f1a9f48de3cf54f0730ead49ec05","observation_id":"be73c05f-9191-4662-a799-8d51121f17d1","resolution":{"observed_at":"2026-08-07T15:22:45.266814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.059964Z","title":"Tightly coupled semantic RGB-D inertial odometry for accurate long-term localization and mapping,","venue":null,"work_id":"f4bfd8ce-abf9-4e1a-9d5c-4892e11b38e4","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.848026Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:cf548e0d4910f11f85dbcabf9fd85563cdc5b24b555aeb085e8ed808c3df44b6","observation_id":"77e96657-9eb6-439f-b088-ec30998b66ab","resolution":{"observed_at":"2026-08-07T15:22:45.100754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.870845Z","title":"RO-MAP: real-time multi-object mapping with neural radiance fields,","venue":null,"work_id":"58b0efa8-f165-45b2-852f-79308f8355f2","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.886184Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:4212aa108fd0c3e03ff835bc8104140849536ad6bff27934164ed8ad3cf857b6","observation_id":"1baec478-43a8-44b5-af09-db67a4a13906","resolution":{"observed_at":"2026-08-07T15:22:44.961101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.731125Z","title":"Fusion++: V olumetric object-level SLAM,","venue":null,"work_id":"f46031a3-b170-4d25-b443-3ca40585f90e","year":2018},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.953885Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5297d7ce514ea956067994115bea512f33587358ed6dd73a99e91bad310742b5","observation_id":"09adcbe4-128b-4370-b379-1ecbca49b60b","resolution":{"observed_at":"2026-08-07T15:22:44.789161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.574503Z","title":"Scenegraph- fusion: Incremental 3d scene graph prediction from rgb-d sequences,","venue":null,"work_id":"acf6e582-44a8-412c-a840-3eb8a3abc163","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.037892Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:86aee7cb0e55001526a4416122fd1c87d420f5c462d02586852bd4623ea76d9d","observation_id":"79feeaa0-5e41-4dec-a909-3cde8b29c583","resolution":{"observed_at":"2026-08-07T15:22:44.681051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.512881Z","title":"Hi- erarchical Open-V ocabulary 3D Scene Graphs for Language-Grounded Robot Navigation,","venue":null,"work_id":"e09a952d-be2c-4d65-b2f5-af49f6f4d42b","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.085663Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:3431f2bf95e7fa1d346037ab396ba7ce1e2ac47203bd25c259be1b56e13b457a","observation_id":"b05a4e2e-2635-48e7-9197-30829766d262","resolution":{"observed_at":"2026-08-07T15:22:44.536995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.351598Z","title":"Llm-seg: Bridging image segmentation and large language model reasoning,","venue":null,"work_id":"2811f96a-5957-46f9-8722-d7b16a001a6c","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.133526Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:b281523abc27615413b9c594016ddb22a72b186739adda1c69fcd0d304113788","observation_id":"bc261b03-a5aa-47c0-9adb-72f3fb2225f7","resolution":{"observed_at":"2026-08-07T15:22:44.455263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.223537Z","title":"Llmformer: Large language model for open-vocabulary semantic segmentation,","venue":null,"work_id":"107ef948-3a93-4208-bb43-13b3d31251f7","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.196140Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:154975f8efc6d95cd8aa7c078f623a3c25416b29e8a06b85b6879eee968f2bfc","observation_id":"b0e22997-5ddb-47fb-a938-4d22e4c30123","resolution":{"observed_at":"2026-08-07T15:22:44.296504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.064437Z","title":"SQA3D: situated question answering in 3d scenes,","venue":null,"work_id":"03247ad4-e8ed-4b32-92c9-c2eb8a137e7b","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.300867Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:bc33054ba0f4dc5865e0450b10b2812abc324e2511cfc83eeb3db0b57fa5aacd","observation_id":"26f0bf3d-7abc-4212-80f7-5a90330c061d","resolution":{"observed_at":"2026-08-07T15:22:44.146281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.892439Z","title":"Scanqa: 3d question answering for spatial scene understanding,","venue":null,"work_id":"95aaf3ce-1468-487c-b813-5edd225c6dc6","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.427208Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e4c7a1a1eae227e8b6bd81dfd07f7177af6556288b1c2aa15ae861140bfd6630","observation_id":"39f39f71-9875-4150-b47a-948eb1e65ef0","resolution":{"observed_at":"2026-08-07T15:22:43.973881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.670200Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes,","venue":null,"work_id":"45d8273a-43a2-4534-8a97-b6baa4195ada","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.554792Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:ba188af9ed707b4010f390febce264e61ef85126ba5058601c8563b59598641f","observation_id":"4ab3e50a-cbb9-495f-8022-d4116f691f6d","resolution":{"observed_at":"2026-08-07T15:22:43.789543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10370","last_updated":"2024-11-18T08:29:08Z","snapshot_observed_at":"2026-08-16T13:52:03.833161Z","submitted_at":"2024-05-16T18:03:41Z","title":"Grounded 3D-LLM with Referent Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10370","snapshot_observed_at":"2026-08-07T15:22:38.641610Z","title":"Grounded 3d-llm with referent tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.641610Z"},"links":{"cited_paper":"/paper/2405.10370","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:c76bb47ea65f792f7b81e71c29af320d1620b15a6e050217c5856bae85465e72","observation_id":"1e132501-0529-491e-abee-8a279aa49919","resolution":{"observed_at":"2026-08-07T15:22:38.641610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.480637Z","title":"3d-llm: Injecting the 3d world into large language models,","venue":null,"work_id":"8cf08118-3ecf-4e47-9e86-4051db812b79","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.725747Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:cf96cf9407ee0563972c95fe1264de0df1d79e1e3792878cddcd733007cd5ac7","observation_id":"722e0fd3-7eba-4ddb-809b-100e21b8c641","resolution":{"observed_at":"2026-08-07T15:22:43.570868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.333551Z","title":"Ll3da: Visual interactive instruction tuning for omni-3d understanding reasoning and planning,","venue":null,"work_id":"98586311-480f-4005-b318-3408b748816b","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.848978Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:a075e8ceff0146d6b85b59cb6f6a7239dc896f4001b840a8da773059803b47eb","observation_id":"1797064e-d44f-419f-b836-d4a18ed7d697","resolution":{"observed_at":"2026-08-07T15:22:43.385449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.140687Z","title":"LLM-Grounder: Open-vocabulary 3d visual grounding with large language model as an agent,","venue":null,"work_id":"465a1aca-b5da-481c-82a2-f9dc4fd8e1b3","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.964761Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:9c869460e44d90e30a6acc559e8b3fbb7cd978441fccf9733af339026f2490a7","observation_id":"e24f7baf-3af7-4aab-bc09-7090d5938393","resolution":{"observed_at":"2026-08-07T15:22:43.232237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:39.060210Z","title":"Multi-object hallucination in vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.060210Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:ee1caab8ae65ead91ad44a8794cb46767e32dfc50a529756a92b93af1ec06589","observation_id":"a35e7804-8e7c-4725-8d49-efe99e070996","resolution":{"observed_at":"2026-08-07T15:22:39.060210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:22:39.197156Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.197156Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:4f46880472caca323f2a01f8727240fa5ae72ce863d7883f82a9b3a0ad1d4710","observation_id":"f5d6dc99-a140-4730-8f27-d883b362e6cc","resolution":{"observed_at":"2026-08-07T15:22:39.197156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.923756Z","title":"Open3DSG: Open-vocabulary 3d scene graphs from point clouds with queryable objects and open-set relationships,","venue":null,"work_id":"e69af4a4-f1a4-41dd-a642-c14adaaf903d","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.329139Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5612f314954c3dfa5f1089f0975c605f285ec16a9b48509864a3ba71289be9c9","observation_id":"8cdfc10f-e501-431c-b60e-c999646e1a7e","resolution":{"observed_at":"2026-08-07T15:22:43.030317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:39.430313Z","title":"The hungarian method for the assignment problem,","venue":null,"work_id":null,"year":1955},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.430313Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:991a0f1d2c30c2bb5256c31f28b4b9c18ded321ff603d3612a0ee7e40ce7472f","observation_id":"4531bd7a-3a80-412a-9665-1b7e9a225cac","resolution":{"observed_at":"2026-08-07T15:22:39.430313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.729144Z","title":"Scenenn: A scene meshes dataset with annotations,","venue":null,"work_id":"4613a20e-518f-4d43-82c0-8e93dc02f8c0","year":2016},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.520091Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:639de79756d02d2d2f9eb6f8855cb710afac25a6090b5d79715d98ff775af104","observation_id":"3f52e759-6c93-4bc7-a1a1-dce4c01d0a62","resolution":{"observed_at":"2026-08-07T15:22:42.838258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.533321Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes,","venue":null,"work_id":"e18de131-0390-47c3-8b17-8aae5a4e8ccc","year":2017},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.670356Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:81d0faecedce6ac61a357ce84edcb05ac36c6649f98b1f51fbaf5fad6724e2ce","observation_id":"d0f8a6fc-5b47-4c92-a2ec-64d96f214198","resolution":{"observed_at":"2026-08-07T15:22:42.611250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.291065Z","title":"Scannet++: A high- fidelity dataset of 3d indoor scenes,","venue":null,"work_id":"d1e17fa6-820b-4203-96a0-620a416e585a","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.804187Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:d49c211c85f1a3c4744de7070ecfa0b771cce03451cdba6f4c974fe4327e23ca","observation_id":"bb754713-ab9e-419a-ae19-04b065f337ed","resolution":{"observed_at":"2026-08-07T15:22:42.403542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.131821Z","title":"Language-grounded indoor 3d semantic segmentation in the wild,","venue":null,"work_id":"095bf481-7ad7-48d4-abbc-192a52ba1e03","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.896850Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:02fe8f8ad7f256d05839f30147caa7ad5c773d5412df642b533f76d46afd577a","observation_id":"73f3b243-a8b4-4fcb-8667-c56720acb85d","resolution":{"observed_at":"2026-08-07T15:22:42.215221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-16T20:27:41.336890Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-07T15:22:39.972152Z","title":"The Replica dataset: A digital replica of indoor spaces,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.972152Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e1a269985f2440673f2cf1457c688a231f6bb5746ba7eabe337cf020f59a40a5","observation_id":"15810e38-0f8a-4aa5-a8a4-100c81035074","resolution":{"observed_at":"2026-08-07T15:22:39.972152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.907854Z","title":"V olumetric instance-level seman- tic mapping via multi-view 2d-to-3d label diffusion,","venue":null,"work_id":"eab6fae2-c074-4328-9132-e82564aaae07","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.086075Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:dd63c25a9d72c881c2e456f6a76ba7e170c0c70923773c1878beccaad7644422","observation_id":"84791a6d-fb38-44f4-9744-f8c049a006bf","resolution":{"observed_at":"2026-08-07T15:22:42.017279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.672891Z","title":"Reconstructing interactive 3d scenes by panoptic mapping and CAD model alignments,","venue":null,"work_id":"1a00d9f1-ebe4-4e55-ab49-6cd627edd57f","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.226975Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:3775399e5fe2d378ddaf17eb5748aa91ba38f83d9dfaa8aadfb95560cd4c9d64","observation_id":"9131ee45-4c85-458f-b76c-844822d0826f","resolution":{"observed_at":"2026-08-07T15:22:41.816365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.460525Z","title":"Multi-view fusion-based 3d object detection for robot indoor scene perception,","venue":null,"work_id":"4be09754-9783-425c-823d-981a7e709030","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.329151Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:997dde4c94b74b0b3ce14469c7bde3562b852167d8bf2e786dcf42856701472c","observation_id":"704a7737-9c43-405d-bc9a-20d9e6d8a25f","resolution":{"observed_at":"2026-08-07T15:22:41.547600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.259948Z","title":"Incremental instance-oriented 3d semantic mapping via rgb-d cameras for unknown indoor scene,","venue":null,"work_id":"b86d8bc3-c00b-4c4b-9fd9-8efe6a0f047b","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.436907Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:fff14bc95aebe63086e4b70079840aadffc769f895c0af8294d8134d6cdd109c","observation_id":"2edf28c1-51f9-4378-8089-8073e8569949","resolution":{"observed_at":"2026-08-07T15:22:41.354254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.099808Z","title":"V olumetric semanti- cally consistent 3d panoptic mapping,","venue":null,"work_id":"2cce5e76-2797-4c15-a447-db987d57a674","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.546225Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:ed2c1248c8d617f94ec787cce3e0aa6c104f2dc4083a7bf1c2839e7095076e95","observation_id":"ad5464f7-a2ce-43f4-937d-a380e4b6e129","resolution":{"observed_at":"2026-08-07T15:22:41.173056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:40.635796Z","title":"Orb-slam3: An accurate open-source library for visual, visual– inertial, and multimap slam,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.635796Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:b39647f7beadd19e76e6058ce0933c7eb9145a4e2c1cb2712770a5f9e85062c9","observation_id":"7cd7d39f-beae-44a9-bde2-73d7f02c59ae","resolution":{"observed_at":"2026-08-07T15:22:40.635796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:40.917581Z","title":"Openins3d: Snap and lookup for 3d open-vocabulary instance segmen- tation,","venue":null,"work_id":"6a5e5bb6-44a9-4112-831d-57adf6587b64","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.727671Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:6e51f697c6f65bc43588ef01fe21d4765d6a35b925dca3f8e4e65091416df168","observation_id":"070d3c4c-7378-4b07-9b30-fbd7e517e808","resolution":{"observed_at":"2026-08-07T15:22:40.994241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T14:35:24.473883Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":60},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2505.15373."}