Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-06T21:11:41.568355Z
Paper Citation Record · LEDGER
As of 8 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 5 inbound Pith citation observations for arXiv:2507.00886.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-06T21:11:41.568355Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-06T10:49:46.879382Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-05-21T17:10:25.176606Z
56 of 56 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation dce48ee3-72fe-4174-bb03-8dda3ca37c9c · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Unresolved cited work
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 62b8e6e7-efdf-4bbd-b2c9-46f03abdc469 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Spice: Semantic propositional image caption evaluation
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 7345b4a3-45b0-46f8-802c-2a20cb98c5c5 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Scanqa: 3d question answering for spatial scene understanding
Reference 3
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 63977d52-5bb8-497e-af86-33f3fba9f4a6 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Meteor: An automatic metric for mt evaluation with improved correlation with human judgments
Reference 4
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation fb36ee04-3b55-4ebc-a842-1b153aa26830 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond $\pi_0$: A Vision-Language-Action Flow Model for General Robot Control
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 13f21252-f815-425b-8616-7b3393f11190 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Language models are few-shot learners
Reference 6
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 938ebc67-bb16-43c6-92a2-f630aa023d6a · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Language models are few-shot learners.NeurIPS, 33, 2020
Reference 7
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 76d5bb44-0d64-418a-86bc-5c6d05a5182c · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Scanrefer: 3d object localization in rgb-d scans using natural language.ECCV, 2020
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 47304348-91cd-4ef2-a326-a47b8119f6e6 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Ll3da: Visual interactive instruction tuning for omni-3d understanding reasoning and planning
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation fe9ce82c-b4e2-4712-89ae-142ba3d732c0 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond End-to-end 3d dense captioning with vote2cap-detr
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 5928badd-048a-4be5-bdec-2c371d8eddf5 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Grounded 3D-LLM with Referent Tokens
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ece94938-dc4b-4c4e-89b9-0e712b158100 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Scan2cap: Context-aware dense captioning in rgb-d scans
Reference 12
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 6f6573d0-446f-477c-b46b-aae6a6e9aad2 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality.See https://vicuna
Reference 13
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 6b3e5da4-443a-404e-a6b8-04ed9476a780 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Rouge: A package for automatic evaluation of summaries
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation b5621d6d-b740-4be6-9474-c0eeb9c74ea0 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Scannet: Richly-annotated 3d reconstructions of indoor scenes
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1bc32700-92e8-43ff-8734-bd62b9a88cf2 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Embodied question answering
Reference 16
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation e07ac790-46a6-4e77-ac8e-1e736886849e · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond SceneFun3D: Fine-Grained Functionality and Affordance Understanding in 3D Scenes
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation ef2b0ee1-703c-4e38-9f4a-9f9b863e2498 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Scene- llm: Extending language model for 3d visual reasoning
Reference 18
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 9544d30b-4cbb-40ce-85a4-d77c5feccaa2 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Perla: Perceptive 3d language assistant
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 5c77d981-2f04-439c-bbce-603aafd41b13 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond 3d-llm: Injecting the 3d world into large language models.NeurIPS, 2023
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 630f55f1-fbec-4517-b1a3-fbe858d17414 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Lora: Low-rank adaptation of large language models.ICLR, 1(2), 2022
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation f23b6634-9732-42de-a357-9d2f251845f4 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Chat-scene: Bridging 3d scene and large language models with object identifiers
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation fb659d84-9e73-4fad-92b7-a75ccb24b7e3 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond An embodied generalist agent in 3d world
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 1b6958b3-d123-4be1-855f-265e1d28ba07 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Less is more: Clipbert for video-and-language learning via sparse sampling
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation f6a37ab2-ae31-4632-97ba-2e40621a4375 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bee4ddeb-8720-473d-b8a2-b0134860b0de · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond M3dbench: Towards omni 3d assistant with interleaved multi-modal instructions
Reference 26
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation cab475ff-1491-4357-bb41-e7d10d80fc1a · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond SceneSplat: Gaussian Splatting-based Scene Understanding with Vision-Language Pretraining
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ede946ef-01c0-4c02-b54a-5fb3e29f890a · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Visual instruction tuning
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 724f85b0-b6d3-4c1f-9cc7-f69445974593 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Robomp 2: A robotic multimodal perception-planning framework with mutlimodal large language models
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 5066d224-b78d-4b15-b019-0b5bee7fc1f6 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Sqa3d: Situated question answering in 3d scenes
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation e5e51994-6877-48f5-9e18-e05552774e67 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Situational awareness matters in 3d vision language reasoning
Reference 31
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation fc7af682-c423-4ae7-a067-232cceb64d2e · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Bleu: a method for automatic evaluation of machine translation
Reference 32
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 520415f3-da78-419e-afde-e6821d753227 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Openscene: 3d scene understanding with open vocabularies
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f9a149be-8300-4397-ae53-08ed8e1386ce · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Learning transferable visual models from natural language supervision
Reference 34
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 438b0917-0e25-42a8-a935-22ef8c85c414 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of Machine Learning Research, 21(140), 2020
Reference 35
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 71fa2693-091e-4163-bbe7-59e4e9eef479 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Sayplan: Grounding large language models using 3d scene graphs for scalable task planning
Reference 36
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation ca57a215-ab1f-4e44-a3a3-87d767deba3f · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Sentence-BERT: Sentence embed- dings using Siamese BERT-networks
Reference 37
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation ef392936-ef1a-48bd-9d4f-ae7f2987b106 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Structure-from- motion revisited
Reference 38
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation fc9d63c4-4a88-49e3-b8be-6d0aec5795b4 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Pixelwise view selection for unstructured multi-view stereo
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation ad03dfc2-3f01-4d59-9498-a50e8c5933ee · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Splat-mover: Multi-stage, open-vocabulary robotic manipulation via editable gaussian splatting
Reference 40
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 8e019016-dff5-43f2-97e2-b140d1b7666e · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Habitat 2.0: Training home assistants to rearrange their habitat
Reference 41
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 6dfa22b6-948a-417c-830f-1e1ad4564e8c · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Llama 2: Open Foundation and Fine-Tuned Chat Models
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a2a34dc7-ff9e-4ee3-990d-5e24b3f707a1 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features
Reference 43
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation eb9e799b-df73-4312-b8f3-a83af7481982 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Cider: Consensus-based image description evaluation
Reference 44
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation d2f5a8ba-a8e4-4895-8388-3b4f1e16a624 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Chat-3d: Data-efficiently tuning large language model for universal dialogue of 3d scenes, 2023
Reference 45
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 7467322e-e05c-4dc6-8602-88dd22716ae1 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Embodied question answering in photorealistic environments with point cloud perception
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 5821b62b-36f7-475b-a2c8-8f516a4957ac · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Tidybot: Personalized robot assistance with large language models
Reference 47
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 082210d5-5156-446f-846e-b2e69e8d03a2 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond 3D Vision and Language Pretraining with Large-Scale Synthetic Data
Reference 48
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9b9e34a3-bae8-453e-8ca3-30f12c17e50b · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Scannet++: A high-fidelity dataset of 3d indoor scenes
Reference 49
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7d7b2030-b090-4bd6-9119-af0a1bebda9f · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Deep modular co-attention networks for visual question answering
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 392a3eda-69b0-437a-934f-f03aabed6c19 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond Sigmoid loss for language image pre-training
Reference 51
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1b9bf275-139b-4dd7-94bb-40a60bd0d958 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond OPT: Open Pre-trained Transformer Language Models
Reference 52
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9ce69592-f7d9-440f-84b4-907a3b850874 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond SPARTUN3D: Situated Spatial Understanding of 3D World in Large Language Models
Reference 53
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5587a349-bc45-4921-9800-e501f3c2a3f7 · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond LSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences
Reference 54
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 563e7a67-45a9-4d5b-ab49-1aafb27fae0f · outbound
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond 3d-vista: Pre-trained transformer for 3d vision and text alignment
Reference 55
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 6640cf24-8cb2-4049-83d1-940a79869b70 · outbound
Reference 56
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 7e82155e-5898-499c-9fd8-871245e418e0 · inbound
3D-R1: Enhancing Reasoning in 3D VLMs for Unified Scene Understanding GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 941fcaf6-8663-445f-965e-9853f84b77fd · inbound
Nav-R1: Reasoning and Navigation in Embodied Scenes GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f079f03d-4b14-4c66-bf24-7bbb12e19578 · inbound
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 86b7e462-9ced-4beb-bd69-2583450238f1 · inbound
GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.
Observation 869fa4ab-31e3-4435-aeb5-d27c8362e560 · inbound
Motion-Enabled Tomography via Gaussian Mixture Models GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.