Pith. sign in

Paper Citation Record · LEDGER

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding

As of 13 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 0 inbound Pith citation observations for arXiv:2512.23020.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2512.23020 v3

Coverage vector

measured 76 of 76 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T13:46:30.742617Z

measured 76 of 76 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-13T06:32:02.005865+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

76 of 76 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved76
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 4b346241-e0e1-43ec-88bb-c7892aeca65f · outbound

This paper cites Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.639077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.639077Z digest=sha256:790fe3e118fd5c82181b6ae09d2048af933e7a62f9162b52f820f9df75cc4dee

Observation 7cb64a59-1787-46a4-b295-ad60e12ceb72 · outbound

This paper cites Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.676297Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.676297Z digest=sha256:ec8de6fc7d6495a402f08afe8a6e4d11ab41645f22632b429e01edf59d552bee

Observation 55fef07d-a12e-4b20-8630-3ea9ee537b29 · outbound

This paper cites Qwen2.5-VL Technical Report.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen2.5-VL Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.725953Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.725953Z digest=sha256:fe888ecd4cc8d0eb9f00c62f8c96fc9be8688ab9eb51f9b5d7d5e20e25450922

Observation 313e7e72-8f17-4ead-8cf0-73b5e44adc38 · outbound

This paper cites ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.796692Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.796692Z digest=sha256:eb28425191d72eb062c16d76cbf71faddda47aac245fa1bdf94408642eb38eec

Observation 1ea61447-7beb-4efd-b01a-dfde39e94a8e · outbound

This paper cites V olcengine, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding V olcengine, 2025

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.853650Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.853650Z digest=sha256:bf45dd0a3dc2a3698aa9b8e33631ae737bfa44971b1f6e6c2320a1a24c1b73be

Observation 1e65dbb5-7e34-4f5f-8fff-e0fc2d88a324 · outbound

This paper cites Scanrefer: 3d object localization in rgb-d scans using natural language.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scanrefer: 3d object localization in rgb-d scans using natural language

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.916811Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.916811Z digest=sha256:30343dae2d5f5f8d9df2e1fe7b43f05309c3279caf65acb523712a4e069cdff3

Observation 365da19f-3f5b-44f5-a20d-e35d17c5ccec · outbound

This paper cites Clip2scene: Towards label-efficient 3d scene understanding by clip.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Clip2scene: Towards label-efficient 3d scene understanding by clip

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.997144Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.997144Z digest=sha256:13f0c5aea650336de73a77ef90388d5a25a339a5830b3d09c184c5172d2b7ef4

Observation 5105a9ff-fdc1-4b41-9095-839b7250849b · outbound

This paper cites Internvl: Scaling up vision founda- tion models and aligning for generic visual-linguistic tasks.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Internvl: Scaling up vision founda- tion models and aligning for generic visual-linguistic tasks

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.071306Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.071306Z digest=sha256:310bfa7180f998b27665b6a2abc28bac22db672bbb97ea98c0efc6cf741fec49

Observation 0ff6566a-fc14-4ad6-b5c3-323be97cdb00 · outbound

This paper cites Scannet: Richly-annotated 3d reconstructions of indoor scenes.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scannet: Richly-annotated 3d reconstructions of indoor scenes

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.129168Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.129168Z digest=sha256:d6c632dfc203d4181a79142e88ddffd3b077dc92b5cd35086aa34cdadadb95c7

Observation 46ad6a8a-70b9-49da-b652-3cc48b0672d0 · outbound

This paper cites Text-guided sparse voxel prun- ing for efficient 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Text-guided sparse voxel prun- ing for efficient 3d visual grounding

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.187733Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.187733Z digest=sha256:b9664e15a182d8a1fec90bb1e74d790b7dd870f1134f57d29d39f4ac4dd39494

Observation 79ffd427-3678-4b2a-8168-4a7734fab0cf · outbound

This paper cites Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.254469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.254469Z digest=sha256:cacc804e984c24d1f62c7a9f765ad806bf44fc7c60c35d711acd1c9dcedcbc1b

Observation aba550f1-ed45-4a81-abaa-ad820e307ae1 · outbound

This paper cites Visual Language Maps for Robot Navigation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Visual Language Maps for Robot Navigation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.397049Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.397049Z digest=sha256:5be722a103836d30abc443f56ce3f1a9a4ec0eb03a4ac9e23ab6d3c4e4efbe2a

Observation d8f4c378-cc0b-43cc-9bca-b2f04d685a82 · outbound

This paper cites Viewsrd: 3d vi- sual grounding via structured multi-view decomposition.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Viewsrd: 3d vi- sual grounding via structured multi-view decomposition

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.547384Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.547384Z digest=sha256:f58229541b165700154148365bcc9c4f362fdf87ad9bbe60e737f32778d05b18

Observation ae655177-e249-4e1d-a798-b8d92ac04e86 · outbound

This paper cites Real-time object detection meets dinov3.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Real-time object detection meets dinov3

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.615188Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.615188Z digest=sha256:ee8634b55ee96b0f737d3cb1ce62cb4a15586a29099b9ac9f7d8313d61421493

Observation 0cdf0053-1cc4-41c5-a688-a9bc2a70ff88 · outbound

This paper cites 3D-R1: Enhancing Reasoning in 3D VLMs for Unified Scene Understanding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding 3D-R1: Enhancing Reasoning in 3D VLMs for Unified Scene Understanding

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.731371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.731371Z digest=sha256:151c8903e95f6f470f1536a860fa8173973fc83e401731d23c2bbaef22d542d3

Observation 3d8791ce-1010-443c-b94b-10369b914744 · outbound

This paper cites Assister: As- sistive navigation via conditional instruction generation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Assister: As- sistive navigation via conditional instruction generation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.801754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.801754Z digest=sha256:7e47c4230651c3bebc19803520f783aefaf075f578b1fc592403ba8697e5165e

Observation 4376230b-4c53-4e26-a8f6-b0ff8ffbf535 · outbound

This paper cites Bottom up top down detection transform- ers for language grounding in images and point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Bottom up top down detection transform- ers for language grounding in images and point clouds

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.845804Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.845804Z digest=sha256:32647b5ba04bd024d8f287d399bd6f93f771e60c7053aa4a23d185c575db57dc

Observation 0ea278d1-3707-465b-9906-d3296915f07b · outbound

This paper cites Pointgroup: Dual-set point grouping for 3d instance segmentation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Pointgroup: Dual-set point grouping for 3d instance segmentation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.912211Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.912211Z digest=sha256:eb044214c80e45e3c0cf26c9f7e0a82d7a8d9091c1bfec09158a3c26501ef38c

Observation 8d28f72c-da0d-45f4-bbc5-e6f807603ee0 · outbound

This paper cites Spazer: Spatial- semantic progressive reasoning agent for zero-shot 3d visual grounding, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Spazer: Spatial- semantic progressive reasoning agent for zero-shot 3d visual grounding, 2025

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.960605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.960605Z digest=sha256:19c75cd90252c50ecb6f2e94a176431a78f4c113ae74762efeeb61b8e6235bc3

Observation 94f518d9-4b48-49ab-802d-b24c4340eb6e · outbound

This paper cites Segment Anything.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Segment Anything

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.060718Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.060718Z digest=sha256:6d1e1d27945a301b58867d1facfac69ad2ff6fe540f58e2b44573932872e1d51

Observation 2060021a-bdac-4969-9613-d3b9a9a896d4 · outbound

This paper cites Robo3d: Towards robust and reliable 3d perception against corruptions.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Robo3d: Towards robust and reliable 3d perception against corruptions

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.160300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.160300Z digest=sha256:59f6547293fcdcb60ddb1fd597f6ab782322eb97ce5604e8694e6f4fe3cc2c95

Observation 9869603a-e889-42c3-9a27-33295ed45466 · outbound

This paper cites Binary coors capable or ‘correcting dele- tions, insertions, and reversals.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Binary coors capable or ‘correcting dele- tions, insertions, and reversals

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.184051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.184051Z digest=sha256:58701ff287e45208c2d1b68d4ac16dc6094dc6f32f21af2de3b5c812f748b9ea

Observation 9daaeccf-04d9-44ef-8393-d9f33e95ee1a · outbound

This paper cites Cityanchor: City-scale 3d visual grounding with multi-modality llms.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Cityanchor: City-scale 3d visual grounding with multi-modality llms

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.351052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.351052Z digest=sha256:d167397274911d8338b93039962f973ff511f4d322271c8ae21941392d225a62

Observation 0aa3d14f-4e59-4823-883b-658530d8641d · outbound

This paper cites Seeground: See and ground for zero-shot open-vocabulary 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Seeground: See and ground for zero-shot open-vocabulary 3d visual grounding

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.509898Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.509898Z digest=sha256:43c09363ba8e00c0f7e2e0486513fe9d5d2eccfc7e58816b3f71015e6cfdc3fb

Observation aebef689-f72b-4ddc-8853-94e5b34d856d · outbound

This paper cites Seqvlm: Proposal- guided multi-view sequences reasoning via vlm for zero- shot 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Seqvlm: Proposal- guided multi-view sequences reasoning via vlm for zero- shot 3d visual grounding

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.629243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.629243Z digest=sha256:0697f60234a513d0a330884f0070655b5522b5b7ecae1af0ca7155946824c6da

Observation 9e22817d-c8bc-4075-b897-a3ae1548164a · outbound

This paper cites Groundflow: A plug-in module for temporal reasoning on 3d point cloud sequential grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Groundflow: A plug-in module for temporal reasoning on 3d point cloud sequential grounding

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.799701Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.799701Z digest=sha256:56638e28786fadf222815e065b80ea22a12c4d5fd47ea54528934255ad789ee9

Observation dc85aebc-4eba-4633-b6fc-e820d97724f9 · outbound

This paper cites Improved baselines with visual instruction tuning, 2023.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Improved baselines with visual instruction tuning, 2023

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.973422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.973422Z digest=sha256:67c170682d4997475bed4b24d9756fae3de68308fb588688ffec5102903732d0

Observation 4f273e61-c111-4dfc-83c1-c1dc8b131b5c · outbound

This paper cites Visual instruction tuning, 2023.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Visual instruction tuning, 2023

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.091001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.091001Z digest=sha256:4c1552a26a6670570141532b5934f83bf20d6fbc174e197478b577f66bee0483

Observation 625178ca-ae18-4280-b076-d97ccc34447b · outbound

This paper cites Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.233532Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.233532Z digest=sha256:f92e42490529b176b0bb8f8a9a3bcd85c6e3d92c1d38efab62b57310509b2e8b

Observation dcca793a-e749-461c-8723-89250657945e · outbound

This paper cites Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.376732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.376732Z digest=sha256:3d6e7c98411ebfd9ee82012a5103db481368cdb9c71eb21f978a03d1c81c5e03

Observation 0436e47e-bb4e-443f-af38-a90c8ec9db68 · outbound

This paper cites Aligning cyber space with physical world: A comprehensive survey on embodied ai.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Aligning cyber space with physical world: A comprehensive survey on embodied ai

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.593660Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.593660Z digest=sha256:eedcabcc89f42b8c880ca6b22d28f3f332053d048f0aaa1e6297df2cf5b804e0

Observation 609dd445-8d22-4c7d-a296-3472a44a633b · outbound

This paper cites Group-free 3d object detection via transformers.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Group-free 3d object detection via transformers

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.638770Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.638770Z digest=sha256:662cfe9d9f93123bb698518cd8bf71d73e0f5b376a3e757b612116ae1ef14807

Observation 7ad903ff-af64-4bf5-ae6f-cd74ad7cce1f · outbound

This paper cites Rea- songrounder: Lvlm-guided hierarchical feature splatting for open-vocabulary 3d visual grounding and reasoning.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Rea- songrounder: Lvlm-guided hierarchical feature splatting for open-vocabulary 3d visual grounding and reasoning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.714644Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.714644Z digest=sha256:e992e0531f1f8a678e8562d31b3e649e8d5862d544fc9c36cc8f55056b11ee8d

Observation 61b1d477-c84d-4d3e-9fb2-c3ae3b292bad · outbound

This paper cites An Examination of the Compositionality of Large Generative Vision-Language Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding An Examination of the Compositionality of Large Generative Vision-Language Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.883179Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.883179Z digest=sha256:64866f2efafd6fbe454d40bdcabbfa9200195a892a7e2a051e829700601a364f

Observation dd930adc-d263-4ca4-9785-2d0317dbd7a4 · outbound

This paper cites A guided tour to approximate string matching.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding A guided tour to approximate string matching

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.983279Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.983279Z digest=sha256:3a26adeaed5d9804eece07ba25ff3ddea56a15ff64c4dc0bc798b2f1be247c3a

Observation f0860b1e-8f69-4d8c-aacb-33e8803e4aab · outbound

This paper cites Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.053097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.053097Z digest=sha256:7b30fabfd18b65d0a631aa5a43fadb466bb28d9604efdc571cfa341f3ddb4419

Observation 32c978b5-73d8-4424-82b2-d4e30651184c · outbound

This paper cites Gpt-4 technical report, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Gpt-4 technical report, 2024

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.121495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.121495Z digest=sha256:0884ff40c7d208e57c06eb8cbbdf87eec1178d62efa9220f30c568aca4ca9c78

Observation e6481afa-a945-489a-9415-830dd543b5bd · outbound

This paper cites GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.179433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.179433Z digest=sha256:60fcdb20bda7e5ef4232dfb991159f050dfc291aaac684f462c06445b23c79ac

Observation 9eb4c277-9824-4e43-97cb-0256e0b9ea0f · outbound

This paper cites Multi-branch collabora- tive learning network for 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Multi-branch collabora- tive learning network for 3d visual grounding

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.243595Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.243595Z digest=sha256:fb3f606f6c13dddd8214cbbea7f669b9b51b9eb414fd2709e80d013330dffe1e

Observation 70dc88a2-54c0-40d3-ac7d-dd9c867f6c76 · outbound

This paper cites Learning transferable visual models from natural language supervision, 2021.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Learning transferable visual models from natural language supervision, 2021

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.297223Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.297223Z digest=sha256:ae376b8d9db52c17501d2cde36ac70804d5c22242070b4ca003d3dca1b000a00

Observation d5b20ee0-b1e6-49f0-8540-80afdd41453b · outbound

This paper cites SAM 2: Segment Anything in Images and Videos.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding SAM 2: Segment Anything in Images and Videos

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.346656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.346656Z digest=sha256:dff3a37828d5324c5f50ba25201dc59299956006849faba3c5713129356cf527

Observation 57964a5f-e6fc-4aef-91ef-31deb606b288 · outbound

This paper cites Grounding dino 1.5: Ad- vance the ”edge” of open-set object detection, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Grounding dino 1.5: Ad- vance the ”edge” of open-set object detection, 2024

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.393825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.393825Z digest=sha256:6273e48573dfbf2bd47baa8ef6d2d9b4afcd521ba84bac60894f1a6cc4409691

Observation 32008338-e2d5-4e3f-a618-5dc97d6e26ca · outbound

This paper cites Grounded sam: Assembling open-world models for diverse visual tasks,.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Grounded sam: Assembling open-world models for diverse visual tasks,

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.424535Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.424535Z digest=sha256:861c5ea96af17b27a6be2349cee87f1fe83685fe039b9db4c359d0083f483f58

Observation daf0f72f-dfe0-4e2b-a1ff-767a1fdd28f1 · outbound

This paper cites Mask3D: Mask Transformer for 3D Semantic Instance Segmentation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Mask3D: Mask Transformer for 3D Semantic Instance Segmentation

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.502891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.502891Z digest=sha256:7a7d658ddae7f67c01ff3ce50e1110c07ac614f5ad286949879d42c6cef382e2

Observation e3503738-9962-483a-a2b3-9a578d223cfc · outbound

This paper cites an unresolved cited work.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Unresolved cited work

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.607897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.607897Z digest=sha256:cb94f24d8a105d49f9de3ae19e025486c105ff5cb059b701429aded5a5eb17af

Observation a9395ac1-3912-48b4-82d0-acf97ae44f8f · outbound

This paper cites Chain of semantics programming in 3d gaussian splatting representation for 3d vision grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Chain of semantics programming in 3d gaussian splatting representation for 3d vision grounding

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.748376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.748376Z digest=sha256:233b8a989de191a2a816af7669d062cd9466ee30d5537e971e3df78ab1d065a2

Observation 3472fcdf-5afe-46c1-be4d-3509521c0783 · outbound

This paper cites Scanverse: An extended reality authoring platform for in- dustrial digital twins.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scanverse: An extended reality authoring platform for in- dustrial digital twins

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.854787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.854787Z digest=sha256:8a21a02692cd9248b4203095ca45c7e7f8b4fe69158ba58f1cadc6ce87fbc7b6

Observation a6820240-1a67-4ba2-b240-7f044a4c3e72 · outbound

This paper cites Toronto-3D: A large-scale mobile lidar dataset for semantic segmenta- tion of urban roadways.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Toronto-3D: A large-scale mobile lidar dataset for semantic segmenta- tion of urban roadways

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.908564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.908564Z digest=sha256:a6537a43ff80ba3f2b9f5479b27fbdbf3537b7ced16dab01741302b43edcc2c5

Observation 3be4b7ec-5f81-4755-833d-1eea1eb25418 · outbound

This paper cites Qwen3 technical report, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen3 technical report, 2025

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.957516Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.957516Z digest=sha256:6ebfa5f982350395091c52342165e91786737e52a5ad6b0ca0e0efc78a3248a1

Observation 07a0aecb-96b9-4ac7-862a-76df66962e74 · outbound

This paper cites Step-3 is large yet affordable: Model-system co-design for cost-effective decoding, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Step-3 is large yet affordable: Model-system co-design for cost-effective decoding, 2025

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.034955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.034955Z digest=sha256:9d39d2e0515a8fe9eaacc6e33cdf5b30ef746a5bcc2b6c6acccf30c339cce141

Observation cc8f7e8d-a0aa-46cc-9b4f-f250c82245aa · outbound

This paper cites Glm-4.5v and glm-4.1v-thinking: Towards versatile multi- modal reasoning with scalable reinforcement learning, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Glm-4.5v and glm-4.1v-thinking: Towards versatile multi- modal reasoning with scalable reinforcement learning, 2025

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.130473Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.130473Z digest=sha256:a18e9a07e133f3b7bd92937c75d058829cb87041bc41a053297416089969a686

Observation 814571d9-400c-4c26-8d44-9d44c9a40a71 · outbound

This paper cites Four ways to improve verbo-visual fusion for dense 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Four ways to improve verbo-visual fusion for dense 3d visual grounding

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.154289Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.154289Z digest=sha256:8e0dc4774a3a7b7d6ff9a8ddf51e07435f1ff871ecd78fb7a825806a134bacac

Observation 7c244af7-a5db-4e14-b8ce-6532c0111468 · outbound

This paper cites Four ways to improve verbo-visual fusion for dense 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Four ways to improve verbo-visual fusion for dense 3d visual grounding

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.223924Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.223924Z digest=sha256:2baa0d18910caf4cebafb3887b86ec848beaa67aed950eaa5ff362c50cad3968

Observation f5708c28-47ae-43e2-9ff4-f8244763b1e0 · outbound

This paper cites Softgroup for 3d instance segmentation on point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Softgroup for 3d instance segmentation on point clouds

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.325058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.325058Z digest=sha256:8b1df81becc670d16952aefcd6fee5d7aa40a21281aad6a248fbb5567eadd3ae

Observation 72d1996a-a531-4851-a608-fcfaf610fc9f · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.369610Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.369610Z digest=sha256:08bd41d92b7ac388d8a53d8e0772348c3e8e86183fa6d20411ce4dfe18c813b6

Observation 045eac86-d014-4d93-aa85-b015f2ab480d · outbound

This paper cites InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.439667Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.439667Z digest=sha256:53668fa0367ef123a932044ab0c150cb16c4f6cb28b890e8e5400350c987fa1b

Observation 6beead42-ee3b-461e-ac78-166077ee50b2 · outbound

This paper cites Gˆ 3-lq: Marry- ing hyperbolic alignment with explicit semantic-geometric modeling for 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Gˆ 3-lq: Marry- ing hyperbolic alignment with explicit semantic-geometric modeling for 3d visual grounding

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.489388Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.489388Z digest=sha256:8d05bbf02faff7169dde946e653367de2a98fe8685df31b931ab30fb28a95b57

Observation f9c39b50-f675-4731-a626-01bfe58e9bc4 · outbound

This paper cites Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal understanding, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal understanding, 2024

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.550904Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.550904Z digest=sha256:4ad65354d26015e3f223ff3cf277654c5abf76b07464ddeead175dbdd2f51747

Observation 382c87ca-ec19-4a3e-afa8-9f25ababd34a · outbound

This paper cites Vlm-grounder: A vlm agent for zero-shot 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Vlm-grounder: A vlm agent for zero-shot 3d visual grounding

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.609114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.609114Z digest=sha256:cd9749b571f38dabff931d0ab04228e48df3f1d7e0374862bca27e49bc2451b2

Observation fe98ea70-968a-4796-96d3-57bdbcdeb287 · outbound

This paper cites Pointllm: Empowering large language models to understand point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Pointllm: Empowering large language models to understand point clouds

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.707101Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.707101Z digest=sha256:4d3370d31365084c10b7a3d8443b11bee40931260c5cd96e0f8abc2a9e8d59b5

Observation 6cc2d2db-73c8-4542-ac51-40b761f4fc84 · outbound

This paper cites Llm- grounder: Open-vocabulary 3d visual grounding with large language model as an agent.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Llm- grounder: Open-vocabulary 3d visual grounding with large language model as an agent

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.770251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.770251Z digest=sha256:cfb6cca008fbe50ce8e9f5450bbdc691c25e1fc25249dc472ceb2027b29884c9

Observation fdb310ac-5857-4264-ad30-debb3c91e2b7 · outbound

This paper cites Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.832565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.832565Z digest=sha256:bdf911d2896fde7489e5b43a134c235d4470b5d01df278efa2eadb82f9f1ff20

Observation 82175457-2fca-4ac1-bbc9-7a6120e388a5 · outbound

This paper cites Scannet++: A high-fidelity dataset of 3d in- door scenes.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scannet++: A high-fidelity dataset of 3d in- door scenes

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.888749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.888749Z digest=sha256:6f11d50c1ac1ef2cc6ee2d984f0d922c96f0683acc28ffebf4e360af099fdfb5

Observation 71713700-8dca-4192-9004-f57fff4b2e6d · outbound

This paper cites Visual programming for zero-shot open-vocabulary 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Visual programming for zero-shot open-vocabulary 3d visual grounding

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.914190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.914190Z digest=sha256:1642c1e67632aef748a38ba31dd5c4140b738112d6dd416de2b9c0fb70cfc60d

Observation 265e5e3c-adee-4ff5-b8a5-50ee03ade4ff · outbound

This paper cites SORT3D: Spatial Object-centric Reasoning Toolbox for Zero-Shot 3D Grounding Using Large Language Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding SORT3D: Spatial Object-centric Reasoning Toolbox for Zero-Shot 3D Grounding Using Large Language Models

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.976578Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.976578Z digest=sha256:51fb8bf89d375cf18a9868267ac7609781f118c53c81740e5a54825057427f5b

Observation 8c9db673-f821-44de-9a2f-029057679638 · outbound

This paper cites Freeq-graph: Free-form querying with semantic con- sistent scene graph for 3d scene understanding, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Freeq-graph: Free-form querying with semantic con- sistent scene graph for 3d scene understanding, 2025

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.037104Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.037104Z digest=sha256:48a64be5edfa6d67c53e592365e951cc851b9516dc7cfd6a81b5b99cadc6d0b9

Observation 9d4a9856-247b-4feb-a670-6463b978ce0d · outbound

This paper cites Multi3drefer: Grounding text description to multiple 3d objects.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Multi3drefer: Grounding text description to multiple 3d objects

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.093670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.093670Z digest=sha256:7dd47a241e273a6020f11707fb7f20673c6825665c6f6212b39bb08702604b1f

Observation b9a73137-451c-4659-b58b-157ebbdc473f · outbound

This paper cites Prototype correlation matching and class- relation reasoning for few-shot medical image seg- mentation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Prototype correlation matching and class- relation reasoning for few-shot medical image seg- mentation

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.163068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.163068Z digest=sha256:4419bda5156d207ca8cec47e41cb8376de14a7c12a89265e2df6b5efd7665dcc

Observation 918a850a-c282-4b16-bc5f-4a8add1d2a3f · outbound

This paper cites Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.233495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.233495Z digest=sha256:64df65471d6614db29ae9bcdebc32e351bf7a539c64e4ee108283b881993ae91

Observation e42712d6-cb06-45aa-8643-30e1a0e2ef7c · outbound

This paper cites 3dvg- transformer: Relation modeling for visual grounding on point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding 3dvg- transformer: Relation modeling for visual grounding on point clouds

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.307236Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.307236Z digest=sha256:2f27d06cf96fc70edfdf95007e141ed10f88c4dd948c0a74f56339eb4c6d724d

Observation 81f17d1f-e9b9-44ab-bf37-731031f23fee · outbound

This paper cites DenseGrounding: Improving Dense Language-Vision Semantics for Ego-Centric 3D Visual Grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding DenseGrounding: Improving Dense Language-Vision Semantics for Ego-Centric 3D Visual Grounding

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.353680Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.353680Z digest=sha256:679448d4f0234a35255bc15d67915f540779896ecd4af0b63fe390ea728eb2eb

Observation 7420f87d-4a26-45cd-b82a-55daeed10fef · outbound

This paper cites Point-SAM: Promptable 3d segmentation model for point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Point-SAM: Promptable 3d segmentation model for point clouds

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.422883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.422883Z digest=sha256:9b0e82f267836df93893bf6865d204c079d5589d967c950445e2c059e768212c

Observation 725628d7-5b50-4f3c-9e4c-88091d41cc87 · outbound

This paper cites LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.457026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.457026Z digest=sha256:39607fff91efa55cc65ba7aaa0a66cc50485b8671de948c7362f57bc8f4d44d2

Observation ceaeb973-e054-41e8-9cbb-b6551fc49d41 · outbound

This paper cites Struct2d: A perception-guided framework for spatial reasoning in large multimodal models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Struct2d: A perception-guided framework for spatial reasoning in large multimodal models

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.520895Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.520895Z digest=sha256:16321c8f3f740da7fa17fcba58cfd5f5f6119e48e8bf1cb004a99f521ef68fdf

Observation 098fbfdd-eb2e-48db-9b07-8b01ae14249d · outbound

This paper cites 3d-vista: Pre-trained transformer for 3d vision and text alignment.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding 3d-vista: Pre-trained transformer for 3d vision and text alignment

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.657126Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.657126Z digest=sha256:78345db1a0109bb2950b36438ffce797efcfa072358256f85f0e92f3329e97c0

Observation f93a6b4e-bca8-4850-a1ac-808aa1fd3e24 · outbound

This paper cites Move to understand a 3d scene: Bridg- ing visual grounding and exploration for efficient and versa- tile embodied navigation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Move to understand a 3d scene: Bridg- ing visual grounding and exploration for efficient and versa- tile embodied navigation

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.742617Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.742617Z digest=sha256:df57ce4c46cc783e0840304821a180825cb1fa54604d6d386ffeb79efdcbd797

Pith citing papers

No inbound Pith citation observations are available.