Pith. sign in

Paper Citation Record · LEDGER

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model

As of 10 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 3 inbound Pith citation observations for arXiv:2506.04837.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.04837 v1

Coverage vector

measured 16 of 16 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T10:38:52.289632Z

measured 19 of 19 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T22:00:13.802598Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-22T10:31:25.365391Z

Reference resolution

16 of 16 outbound references displayed

  • verified exact1
  • verified fuzzy11
  • unresolved4
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 938b140a-ae7c-4a69-8125-7e1cae4193f3 · outbound

This paper cites Henriques, Andrew Zisser- man, and Andrea Vedaldi.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Henriques, Andrew Zisser- man, and Andrea Vedaldi

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:54.616520Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:50.250747Z digest=sha256:a4635225258742810a9a0e6501a91c749a1cac3aec669a449018c5c1997cd57d

Observation 8dc444f3-b219-45cf-9fb4-dcf35f7b2d9e · outbound

This paper cites Coda: Col- laborative novel box discovery and cross-modal alignment for open-vocabulary 3d object detection.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Coda: Col- laborative novel box discovery and cross-modal alignment for open-vocabulary 3d object detection

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:54.436610Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:50.327719Z digest=sha256:230ddc339ad4816e8c0ea381d2e5bf4284a0ac03af31b97a554309c9c8952e00

Observation e5d3c5f8-78b3-4bb6-83ae-68ecd6c7a3d6 · outbound

This paper cites Image Token Acc@0.25 Acc@0.50 mIoU ✗ 51.4 35.5 36.7 ✓ 55.1 40.2 40.3 (b) 2D Features for Segmentation.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Image Token Acc@0.25 Acc@0.50 mIoU ✗ 51.4 35.5 36.7 ✓ 55.1 40.2 40.3 (b) 2D Features for Segmentation

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:54.296577Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:50.442838Z digest=sha256:8f6460027179fb20d2f3e2eaad4881be79aec97daf192b1ccbf52b0e0a116664

Observation a982400b-1dc2-4216-8e16-98deb750aeff · outbound

This paper cites Openins3d: Snap and lookup for 3d open-vocabulary instance segmentation.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Openins3d: Snap and lookup for 3d open-vocabulary instance segmentation

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:54.143351Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:50.614827Z digest=sha256:8c94b334de04440082075c4bcf6ef67fd2b9f937239075fe7ba6ab5a52870145

Observation 5f6d4232-9cb1-4c9b-9aaf-790f9c9b5bf0 · outbound

This paper cites Lerf: Language embedded radiance fields.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Lerf: Language embedded radiance fields

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:53.997837Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:50.724330Z digest=sha256:2e4800a2a91562535f5e5707d9fe9d567d6c98f2b292e85abfe88872f45b45f4

Observation ed87ee76-174d-415f-995f-af7a93b8c9ed · outbound

This paper cites Decomposing nerf for editing via feature field dis- tillation.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Decomposing nerf for editing via feature field dis- tillation

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:53.851299Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:50.822720Z digest=sha256:1b14a97e7c834a738fcc81ca2f7c4c06b7562980e2240cef7b7b6329fc3d451a

Observation 72cbf191-f244-4f98-81e8-5a3eb246a52c · outbound

This paper cites Weakly supervised 3d open- vocabulary segmentation.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Weakly supervised 3d open- vocabulary segmentation

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:53.714392Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:50.935217Z digest=sha256:58e42aa9ee8a97559cb79a3b8ee09e7aa2a9608bc6bc38867e7f0da957b418e9

Observation 2fb5fc72-94f4-4212-986c-122e471e3611 · outbound

This paper cites Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:53.490044Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:51.039850Z digest=sha256:0444d348964e964402bd52f997aa276f3633e07333d292534f3598462d7f10df

Observation c30d6fbc-d8c7-4272-bbad-818e7f978504 · outbound

This paper cites Openscene: 3d scene understanding with open vocabularies.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Openscene: 3d scene understanding with open vocabularies

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:53.230575Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:51.137020Z digest=sha256:94506ac262ba8f6574d614dd5368d13e7e2830d8d90a866b8bc6110212e0c477

Observation 2b807271-8275-475a-b801-63742fdc18a8 · outbound

This paper cites LangSplat: 3D Language Gaussian Splatting.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model LangSplat: 3D Language Gaussian Splatting

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T10:38:51.322064Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:38:51.322064Z digest=sha256:62527d470ccfa3f40393540099f3330a0b6f18956b11063f15d72cf7f5eb878c

Observation b4b4e6a2-546a-46a9-bff2-2d96dd175d5a · outbound

This paper cites Learning transferable visual models from natural language supervi- sion.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Learning transferable visual models from natural language supervi- sion

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T10:38:51.420204Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:38:51.420204Z digest=sha256:31793932197da99d263e7c521e20a0710be55035fc3f93dbd2db127713577fe7

Observation 31366615-60c0-44ce-9604-9bfc4052eef5 · outbound

This paper cites Sumner, Marc Pollefeys, Federico Tombari, and Francis Engelmann.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Sumner, Marc Pollefeys, Federico Tombari, and Francis Engelmann

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:53.066921Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:51.542471Z digest=sha256:f56637a3f97509164545b78eea2189632bf1eff3fb0ce7bd610ccd674fe1db46

Observation 166a6fdf-be22-4ab2-9254-7f4ec7a554a4 · outbound

This paper cites VL-Fields: Towards Language-Grounded Neural Implicit Spatial Representations.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model VL-Fields: Towards Language-Grounded Neural Implicit Spatial Representations

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-08-07T10:38:52.698058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:51.702038Z digest=sha256:ab38accc8b1db43450c3c6a145f216a4929dae77d8254848ba663f26ef637b57

Observation ba7513b3-55e8-412c-8168-c208336dd54f · outbound

This paper cites Open-Fusion: Real-time Open-Vocabulary 3D Mapping and Queryable Scene Representation.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Open-Fusion: Real-time Open-Vocabulary 3D Mapping and Queryable Scene Representation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T10:38:51.869988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:38:51.869988Z digest=sha256:dcd4632aaf61b08289b5edcf864f1c2e9b227cbbe4d201f5990150cae337686b

Observation e51fb179-e8d9-4678-b368-8d8c863744ab · outbound

This paper cites RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T10:38:52.071377Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:38:52.071377Z digest=sha256:5f02d3bef18c1e93fa823c322bad65b9c4ae690365158d37cbbe340ff80fb577

Observation 0568b568-42fb-49ea-af52-aa847b8874db · outbound

This paper cites Clip-fo3d: Learning free open-world 3d scene representations from 2d dense clip.

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model Clip-fo3d: Learning free open-world 3d scene representations from 2d dense clip

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:38:52.867422Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T10:38:52.289632Z digest=sha256:f05c55d6ece7ce9d916fa8b6526c06601699e674b9fa2563c5af8aab7b65706d

Pith citing papers

Observation e8f1562a-0e30-4ebd-8319-587ecf1edfff · inbound

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs cites this paper.

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model

Reference 100

Resolution
verified exact
arxiv_id, observed 2026-05-15T20:16:34.740516Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T20:12:46.385646Z digest=sha256:9bacb2768a782bb5af154bd41cec5ee5371a754f29b29a49e4c53818d5d2ff2d

Observation a95306e0-ac56-4181-be9d-bea87b5a387f · inbound

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs cites this paper.

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model

Reference 100

Resolution
verified exact
arxiv_id, observed 2026-05-22T10:31:25.368092Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-22T10:30:06.829915Z digest=sha256:7697892ef093ea01efd7edbf15908061c745e971b62ab48b06f6399286543c33

Observation 6e32a0b0-e437-430c-b73f-cb9f38343f12 · inbound

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs cites this paper.

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model

Reference 99

Resolution
unresolved
no resolver link, observed 2026-08-02T22:00:13.802598Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T22:00:13.802598Z digest=sha256:60efd758576d58ccd428a75ba540a23fc758b2383d5ac33d0b9dbe5e99381652