{"as_of":"2026-08-09T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e56b282c312913f9cb3614394f91b6fee767672f2ed5689c0c1e5606d53b924a","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:38:52.289632Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:00:13.802598Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T10:31:25.365391Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"cited_work":{"arxiv_id":"2506.04837","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04837","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openmaskdino3d: Reasoning 3d segmentation via large language model","venue":null,"work_id":"e8f9b7d2-8aa1-434a-937b-3328825bc9e6","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-15T20:12:46.385646Z"},"links":{"cited_paper":"/paper/2506.04837","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:b9b4a7284bbcb205ab93145d6f276673cf94e73fdebed7c7aa0895afe8e9f959","observation_id":"e8f1562a-0e30-4ebd-8319-587ecf1edfff","resolution":{"observed_at":"2026-05-15T20:16:34.740516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"cited_work":{"arxiv_id":"2506.04837","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04837","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openmaskdino3d: Reasoning 3d segmentation via large language model","venue":null,"work_id":"e8f9b7d2-8aa1-434a-937b-3328825bc9e6","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:06.829915Z"},"links":{"cited_paper":"/paper/2506.04837","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:11ee96e2d249a12ab3fe9af41803fb767ef33028eaf6b4d555276ce2b1a0271e","observation_id":"a95306e0-ac56-4181-be9d-bea87b5a387f","resolution":{"observed_at":"2026-05-22T10:31:25.368092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04837","snapshot_observed_at":"2026-08-02T22:00:13.802598Z","title":"Openmaskdino3d: Reasoning 3d segmentation via large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":5},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-02T22:00:13.802598Z"},"links":{"cited_paper":"/paper/2506.04837","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:60efd758576d58ccd428a75ba540a23fc758b2383d5ac33d0b9dbe5e99381652","observation_id":"6e32a0b0-e437-430c-b73f-cb9f38343f12","resolution":{"observed_at":"2026-08-02T22:00:13.802598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04837/citation-record","integrity":"/paper/2506.04837/integrity","json":"/paper/2506.04837/citation-record.json","paper":"/paper/2506.04837"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.505316Z","title":"Henriques, Andrew Zisser- man, and Andrea Vedaldi","venue":null,"work_id":"af62d3ab-3f52-4026-82b8-afe70a0c6ca2","year":2024},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.250747Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:3064622a136e72a84d7d8e061bfc2067216a29fb77d00684b72f9d3792204290","observation_id":"938b140a-ae7c-4a69-8125-7e1cae4193f3","resolution":{"observed_at":"2026-08-07T10:38:54.616520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.369792Z","title":"Coda: Col- laborative novel box discovery and cross-modal alignment for open-vocabulary 3d object detection","venue":null,"work_id":"5971711b-ec90-452c-b27f-49fec8b5f510","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.327719Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:3aa24bc571087775ba2776429591dceb92bc3445b2ccaf745ccb5ede51ad5d36","observation_id":"8dc444f3-b219-45cf-9fb4-dcf35f7b2d9e","resolution":{"observed_at":"2026-08-07T10:38:54.436610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.213862Z","title":"Image Token Acc@0.25 Acc@0.50 mIoU ✗ 51.4 35.5 36.7 ✓ 55.1 40.2 40.3 (b) 2D Features for Segmentation","venue":null,"work_id":"20ea7609-2f22-4022-b7c3-39ddb162c0c7","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.442838Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:61f643689fe1fc6ed407229a20b54f8900980a41d201965dc39db9c88b96009d","observation_id":"e5d3c5f8-78b3-4bb6-83ae-68ecd6c7a3d6","resolution":{"observed_at":"2026-08-07T10:38:54.296577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.072744Z","title":"Openins3d: Snap and lookup for 3d open-vocabulary instance segmentation","venue":null,"work_id":"9b8bf1fc-f752-45ab-a5bd-6a85bc96913f","year":null},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.614827Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:d9bfd18eaf9eb1d8be2af49ee3cae3b93c3afceb8aabb50934884072332e9abc","observation_id":"a982400b-1dc2-4216-8e16-98deb750aeff","resolution":{"observed_at":"2026-08-07T10:38:54.143351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.935471Z","title":"Lerf: Language embedded radiance fields","venue":null,"work_id":"e438195e-c345-4569-a392-0694fcd1c45c","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.724330Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:728e86f04b14ec10571f977be000d09d47121e2996db9cec2ffbdae5d012bbd7","observation_id":"5f6d4232-9cb1-4c9b-9aaf-790f9c9b5bf0","resolution":{"observed_at":"2026-08-07T10:38:53.997837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.786229Z","title":"Decomposing nerf for editing via feature field dis- tillation","venue":null,"work_id":"2330d6d2-2f11-4dda-a0a6-859cdc6c8b85","year":2022},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.822720Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:638d9e9ef5a32a537c5b9b1ec245eceb06d5d7cef3062c22dd11eab969347492","observation_id":"ed87ee76-174d-415f-995f-af7a93b8c9ed","resolution":{"observed_at":"2026-08-07T10:38:53.851299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.583301Z","title":"Weakly supervised 3d open- vocabulary segmentation","venue":null,"work_id":"f873cd46-f452-44ed-89a0-af6ad91b292a","year":2024},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.935217Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:75fc98df4d339b7d5646c4499f775495948a356999440d17d2b21b1671f6be6a","observation_id":"72cbf191-f244-4f98-81e8-5a3eb246a52c","resolution":{"observed_at":"2026-08-07T10:38:53.714392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.350826Z","title":"Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data","venue":null,"work_id":"eb55fbb0-4ca5-41ea-87fb-1e3e9659ed01","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.039850Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:ec51f6580757541aab4a7bd29f9690eb0b75080d0a3776af1e8d370fcc6fc524","observation_id":"2fb5fc72-94f4-4212-986c-122e471e3611","resolution":{"observed_at":"2026-08-07T10:38:53.490044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.180710Z","title":"Openscene: 3d scene understanding with open vocabularies","venue":null,"work_id":"4e7861dd-3d8f-4736-ba31-e54bec28467f","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.137020Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:615ac4e3f65f7eb48470dadc8e4ed758d7ae0e0bbd973fb827a65ceefb0d68b6","observation_id":"c30d6fbc-d8c7-4272-bbad-818e7f978504","resolution":{"observed_at":"2026-08-07T10:38:53.230575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16084","last_updated":"2024-03-31T04:45:58Z","snapshot_observed_at":"2026-07-06T17:08:08.775293Z","submitted_at":"2023-12-26T15:14:37Z","title":"LangSplat: 3D Language Gaussian Splatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16084","snapshot_observed_at":"2026-08-07T10:38:51.322064Z","title":"Langsplat: 3d language gaussian splatting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.322064Z"},"links":{"cited_paper":"/paper/2312.16084","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:62527d470ccfa3f40393540099f3330a0b6f18956b11063f15d72cf7f5eb878c","observation_id":"2b807271-8275-475a-b801-63742fdc18a8","resolution":{"observed_at":"2026-08-07T10:38:51.322064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:51.420204Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.420204Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:31793932197da99d263e7c521e20a0710be55035fc3f93dbd2db127713577fe7","observation_id":"b4b4e6a2-546a-46a9-bff2-2d96dd175d5a","resolution":{"observed_at":"2026-08-07T10:38:51.420204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:52.943498Z","title":"Sumner, Marc Pollefeys, Federico Tombari, and Francis Engelmann","venue":null,"work_id":"8894dfbc-cdcc-477e-a5da-710698680c44","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.542471Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:f111d3519ee7df3c7cf61bda5b634eaf5370cb3efe6b3aa9c371993ef57cdf54","observation_id":"31366615-60c0-44ce-9604-9bfc4052eef5","resolution":{"observed_at":"2026-08-07T10:38:53.066921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12427","last_updated":"2023-05-25T08:38:52Z","snapshot_observed_at":"2026-07-06T15:30:14.400809Z","submitted_at":"2023-05-21T10:55:27Z","title":"VL-Fields: Towards Language-Grounded Neural Implicit Spatial Representations","version":2},"cited_work":{"arxiv_id":"2305.12427","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12427","snapshot_observed_at":"2026-08-07T10:38:52.519035Z","title":"VL-Fields: Towards Language-Grounded Neural Implicit Spatial Representations","venue":"cs.CV","work_id":"bc61e7cb-94a8-4df4-9848-49fa9ed9ff1a","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.702038Z"},"links":{"cited_paper":"/paper/2305.12427","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:ddbf636e0e6dceae15ba0f6b09665c11fa01bd50a5b502374823bafc6c86507c","observation_id":"166a6fdf-be22-4ab2-9254-7f4ec7a554a4","resolution":{"observed_at":"2026-08-07T10:38:52.698058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03923","last_updated":"2023-10-05T21:57:36Z","snapshot_observed_at":"2026-08-05T23:33:55.326516Z","submitted_at":"2023-10-05T21:57:36Z","title":"Open-Fusion: Real-time Open-Vocabulary 3D Mapping and Queryable Scene Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03923","snapshot_observed_at":"2026-08-07T10:38:51.869988Z","title":"Open-fusion: Real-time open-vocabulary 3d map- ping and queryable scene representation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.869988Z"},"links":{"cited_paper":"/paper/2310.03923","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:dcd4632aaf61b08289b5edcf864f1c2e9b227cbbe4d201f5990150cae337686b","observation_id":"ba7513b3-55e8-412c-8168-c208336dd54f","resolution":{"observed_at":"2026-08-07T10:38:51.869988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00962","last_updated":"2024-05-05T04:44:55Z","snapshot_observed_at":"2026-07-06T15:11:24.863362Z","submitted_at":"2023-04-03T13:30:04Z","title":"RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00962","snapshot_observed_at":"2026-08-07T10:38:52.071377Z","title":"Regionplc: Regional point-language contrastive learning for open-world 3d scene understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:52.071377Z"},"links":{"cited_paper":"/paper/2304.00962","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:eb0bfb0b758d593cc6618e0fc392e1b0c672f005862cc6c3fa70970501f97c97","observation_id":"e51fb179-e8d9-4678-b368-8d8c863744ab","resolution":{"observed_at":"2026-08-07T10:38:52.071377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:52.817425Z","title":"Clip-fo3d: Learning free open-world 3d scene representations from 2d dense clip","venue":null,"work_id":"389171d8-5c96-4b36-945c-7ba10905a944","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:52.289632Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:ca8baf7c9f8e1e8ca14122ee8ca37dc6427385d36f92e1cee423583a56c75be0","observation_id":"0568b568-42fb-49ea-af52-aa847b8874db","resolution":{"observed_at":"2026-08-07T10:38:52.867422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T23:14:00.841222Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 3 inbound Pith citation observations for arXiv:2506.04837."}