{"as_of":"2026-08-09T15:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cab1aa7e2cc97c92d0056acc6b7a9a4c6b1b167a0c5f11ffccfca6d02480dfb2","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:28:42.407268Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19115/citation-record","integrity":"/paper/2607.19115/integrity","json":"/paper/2607.19115/citation-record.json","paper":"/paper/2607.19115"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.286633Z","title":"Scanrefer: 3d object localization in rgb-d scans using natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.286633Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:001db8a7c0d2dab20801a399eafc2087a6488b6632da3d66421b5f04cce21173","observation_id":"0870830a-f7cd-40de-b6bc-01e49a68ac89","resolution":{"observed_at":"2026-08-01T13:28:39.286633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.398186Z","title":"Multi3drefer: Grounding text description to multiple 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.398186Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:d8b56405a3822ac7d582df4a75ac8fb25c4e347ed760a9f810233a29bf700f30","observation_id":"7617525e-6502-4e84-9f78-c5d8a203ec24","resolution":{"observed_at":"2026-08-01T13:28:39.398186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.528280Z","title":"Image retrieval on real-life images with pre-trained vision-and-language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.528280Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:cf77bc8e54c5aee830b2454bbebfb4efede032e3ec79a037309a8bc24cb4c496","observation_id":"59913f7c-1d99-49d3-a783-8603cd588000","resolution":{"observed_at":"2026-08-01T13:28:39.528280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.675882Z","title":"Zero-shot composed image retrieval with textual inversion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.675882Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:b8cafc8528c764e21537e77f9a0db1a318435e7002a946ff15999aadb0d73232","observation_id":"1cca4f9c-5298-47e7-8dcc-cee93cf69c06","resolution":{"observed_at":"2026-08-01T13:28:39.675882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07119","last_updated":"2018-12-18T00:57:03Z","snapshot_observed_at":"2026-08-09T00:22:17.451271Z","submitted_at":"2018-12-18T00:57:03Z","title":"Composing Text and Image for Image Retrieval - An Empirical Odyssey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.07119","snapshot_observed_at":"2026-08-01T13:28:39.782804Z","title":"Composing text and image for image retrieval - an empirical odyssey, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.782804Z"},"links":{"cited_paper":"/paper/1812.07119","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:4812af55e69a568f80493813d855d66950c46eee5fdb71469b05a54883855b4e","observation_id":"7254a2ab-5857-4fd0-8ac4-9ca21928b1f2","resolution":{"observed_at":"2026-08-01T13:28:39.782804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.918250Z","title":"Effective conditioned and composed image retrieval combining clip-based features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.918250Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:285ccfa37f4027747f5bd00c3733ea5c1b11225fb67c857788122b4f66c46520","observation_id":"16a9d165-5614-450a-be5c-53b5dde88ea7","resolution":{"observed_at":"2026-08-01T13:28:39.918250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09291","last_updated":"2024-02-26T18:59:49Z","snapshot_observed_at":"2026-08-08T20:12:12.510339Z","submitted_at":"2023-10-13T17:59:38Z","title":"Vision-by-Language for Training-Free Compositional Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09291","snapshot_observed_at":"2026-08-01T13:28:40.030166Z","title":"Vision-by- language for training-free compositional image retrieval.arXiv preprint arXiv:2310.09291, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.030166Z"},"links":{"cited_paper":"/paper/2310.09291","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:8d3fa7710492bb22d2998567a03fde224ee89799e572b133dff003d5d3843343","observation_id":"bbc903ec-637b-47e2-b7f3-8f0cebfa60bc","resolution":{"observed_at":"2026-08-01T13:28:40.030166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.180474Z","title":"Pic2word: Mapping pictures to words for zero-shot composed image retrieval","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.180474Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:c50d467f2fce6d7f9af6ac63f95210bcf38a65873321c108dc621e0d949ccfb0","observation_id":"ce7a457b-6b7c-4c74-bc47-1c9694e50564","resolution":{"observed_at":"2026-08-01T13:28:40.180474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.307489Z","title":"Compodiff: Versatile composed image retrieval with latent diffusion, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.307489Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:8cc83f2258bbda7c724ddbe4a4e34c53821774f90fc3ffc4c519a8aa9069877b","observation_id":"8b9756ba-0473-4e46-8cc1-8f3e7f13d6c2","resolution":{"observed_at":"2026-08-01T13:28:40.307489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01998","last_updated":"2024-03-31T22:58:09Z","snapshot_observed_at":"2026-07-06T16:56:38.112343Z","submitted_at":"2023-12-04T16:22:06Z","title":"Language-only Efficient Training of Zero-shot Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01998","snapshot_observed_at":"2026-08-01T13:28:40.438064Z","title":"Language-only efficient training of zero-shot composed image retrieval, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.438064Z"},"links":{"cited_paper":"/paper/2312.01998","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:c4d113c0b3504765b54a3829b0b43c6f7ce30d31541b609ceb8359fd8ea4df5c","observation_id":"91c3b21e-d9f5-4d32-b4b4-9d8fee6dfdcd","resolution":{"observed_at":"2026-08-01T13:28:40.438064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.02413","last_updated":"2021-12-04T19:42:40Z","snapshot_observed_at":"2026-08-05T22:07:34.807277Z","submitted_at":"2021-12-04T19:42:40Z","title":"PointCLIP: Point Cloud Understanding by CLIP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.02413","snapshot_observed_at":"2026-08-01T13:28:40.550894Z","title":"Pointclip: Point cloud understanding by clip, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.550894Z"},"links":{"cited_paper":"/paper/2112.02413","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:be1085dcba5316006c35477347909971cc7f0c6bdbc4f63c0d9eb47522c60e4e","observation_id":"47c939c2-f339-4be8-bb12-35839b2f50b7","resolution":{"observed_at":"2026-08-01T13:28:40.550894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.684540Z","title":"Openshape: Scaling up 3d shape representation towards open-world understanding.Advances in neural information processing systems, 36:44860–44879, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.684540Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:f0aa9b2063a5fde31fea2e80916af29bd25859a817cfc3687683dd5148435f0e","observation_id":"44399a56-962c-4aab-baf2-d1eea2a84a52","resolution":{"observed_at":"2026-08-01T13:28:40.684540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06773","last_updated":"2023-10-10T16:49:21Z","snapshot_observed_at":"2026-08-07T09:42:09.287521Z","submitted_at":"2023-10-10T16:49:21Z","title":"Uni3D: Exploring Unified 3D Representation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06773","snapshot_observed_at":"2026-08-01T13:28:40.804760Z","title":"Uni3d: Exploring unified 3d representation at scale.arXiv preprint arXiv:2310.06773, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.804760Z"},"links":{"cited_paper":"/paper/2310.06773","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:11efaf517e252bb0e5cf644a0bed4a581048152d55bd978931166484bea7be31","observation_id":"827edf0b-279a-4246-acc1-54979f537bd6","resolution":{"observed_at":"2026-08-01T13:28:40.804760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.969347Z","title":"Ulip-2: Towards scalable multimodal pre-training for 3d understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.969347Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:7146955280fe83a3d42cb0cf5f70b21e3eb23e0b8aa9039d85364509a227bfe3","observation_id":"2f27b992-a45f-4ce0-b2e8-28f684b727e4","resolution":{"observed_at":"2026-08-01T13:28:40.969347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04352","last_updated":"2023-08-08T15:59:17Z","snapshot_observed_at":"2026-08-08T14:39:26.580635Z","submitted_at":"2023-08-08T15:59:17Z","title":"3D-VisTA: Pre-trained Transformer for 3D Vision and Text Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04352","snapshot_observed_at":"2026-08-01T13:28:41.116997Z","title":"3d-vista: Pre-trained transformer for 3d vision and text alignment, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.116997Z"},"links":{"cited_paper":"/paper/2308.04352","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:b034837913ca0d430cbb0d90af8ad6555e6e764a20685bee493f0f263ba2ba3e","observation_id":"d7e7e5be-d45e-46a3-8b8c-08614967c8ad","resolution":{"observed_at":"2026-08-01T13:28:41.116997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12981","last_updated":"2023-07-24T17:59:02Z","snapshot_observed_at":"2026-08-03T03:13:48.042761Z","submitted_at":"2023-07-24T17:59:02Z","title":"3D-LLM: Injecting the 3D World into Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12981","snapshot_observed_at":"2026-08-01T13:28:41.240174Z","title":"3d-llm: Injecting the 3d world into large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.240174Z"},"links":{"cited_paper":"/paper/2307.12981","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:346b35abe983c78ad05114e2789f8e3298d4739fec2f2f70fb48d243a97669b1","observation_id":"a8a3588e-322f-449d-81cb-443cfa3d2159","resolution":{"observed_at":"2026-08-01T13:28:41.240174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-07-06T16:12:55.132006Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-01T13:28:41.335244Z","title":"Pointllm: Empowering large language models to understand point clouds, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.335244Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:275bc19874f5addecdadc0075b1d36ac9a11205ba030e64091200c11ada7ed02","observation_id":"8d5cbfb9-d64d-4d45-8f92-dad97c174035","resolution":{"observed_at":"2026-08-01T13:28:41.335244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00469","last_updated":"2024-07-12T09:00:03Z","snapshot_observed_at":"2026-08-08T23:43:37.274576Z","submitted_at":"2024-03-30T20:25:16Z","title":"SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00469","snapshot_observed_at":"2026-08-01T13:28:41.481839Z","title":"Scenegraphloc: Cross-modal coarse visual localization on 3d scene graphs, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.481839Z"},"links":{"cited_paper":"/paper/2404.00469","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:dac72d82daf39a4d7d236a43e7d937d14ca8aa3ee6f2b20f671193ad9e2367a0","observation_id":"7efccbba-2d19-40f6-9947-1cc66cdec931","resolution":{"observed_at":"2026-08-01T13:28:41.481839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.598350Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.598350Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:0aa76619df01c6d91314ac06e19a6686ac09d9bd7c54a93d4bb666a7e5dea317","observation_id":"addb6ed4-e83c-4ecc-a596-0d4ffe757260","resolution":{"observed_at":"2026-08-01T13:28:41.598350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.696371Z","title":"Scanqa: 3d question answering for spatial scene understanding, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.696371Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:992fcbbc24e75cd8f3c4d01ea6245ae31e35173ac4a5b0eade25c611819ce940","observation_id":"28bc1e2e-7037-4e1c-bb04-e7e2851c6c7f","resolution":{"observed_at":"2026-08-01T13:28:41.696371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.808263Z","title":"Sceneverse: Scaling 3d vision-language learning for grounded scene understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.808263Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:098a05b700aec4da6f09c8d9a58b2d64d53b492244ea144c23ae41b7c04ab59e","observation_id":"f1099b5a-e6ea-4ba9-a303-c352bf1441e3","resolution":{"observed_at":"2026-08-01T13:28:41.808263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.899560Z","title":"Shapetalk: A language dataset and framework for 3d shape edits and deformations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.899560Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:ea10cfa1fe310656e326f8eb7ed39375ac6323185b446274520363847cf16af6","observation_id":"8441237e-ef62-4668-a223-6e209038fd8b","resolution":{"observed_at":"2026-08-01T13:28:41.899560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14207","last_updated":"2024-03-12T15:40:08Z","snapshot_observed_at":"2026-07-06T15:07:45.408464Z","submitted_at":"2023-03-24T18:00:15Z","title":"DiffuScene: Denoising Diffusion Models for Generative Indoor Scene Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14207","snapshot_observed_at":"2026-08-01T13:28:42.012546Z","title":"Diffuscene: Denoising diffusion models for generative indoor scene synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.012546Z"},"links":{"cited_paper":"/paper/2303.14207","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:34e199921323548358ba8c9e72be861fa559c93bc40db4007787f54f651d727c","observation_id":"1b18aabd-8815-45e8-9619-2e5a6d2b21ed","resolution":{"observed_at":"2026-08-01T13:28:42.012546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04717","last_updated":"2024-02-07T10:09:00Z","snapshot_observed_at":"2026-08-07T11:38:11.276214Z","submitted_at":"2024-02-07T10:09:00Z","title":"InstructScene: Instruction-Driven 3D Indoor Scene Synthesis with Semantic Graph Prior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04717","snapshot_observed_at":"2026-08-01T13:28:42.153220Z","title":"Instructscene: Instruction-driven 3d indoor scene synthesis with semantic graph prior, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.153220Z"},"links":{"cited_paper":"/paper/2402.04717","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:6cd16fd805acbb8c69967b0583a7c422e0ab55e154c611f0c50301153b23b630","observation_id":"9b561c93-6303-40a3-b87d-a6f9383e3b56","resolution":{"observed_at":"2026-08-01T13:28:42.153220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12836","last_updated":"2025-04-01T23:38:07Z","snapshot_observed_at":"2026-08-05T00:28:51.279803Z","submitted_at":"2024-10-03T17:42:24Z","title":"EditRoom: LLM-parameterized Graph Diffusion for Composable 3D Room Layout Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12836","snapshot_observed_at":"2026-08-01T13:28:42.290808Z","title":"Editroom: Llm-parameterized graph diffusion for composable 3d room layout editing, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.290808Z"},"links":{"cited_paper":"/paper/2410.12836","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:ae9802424c82657271fdf0351b42fdd193c57b2de53c0eac6c2947e5ba7e9f29","observation_id":"742f1192-4473-402d-922f-36058ee7ea7f","resolution":{"observed_at":"2026-08-01T13:28:42.290808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:42.407268Z","title":"in roughly the same layout","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.407268Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:2471d697459921802cb1f0c576008360a406297db7fa06869b9a73aa8f26d35a","observation_id":"61ead812-5d1c-44d6-8afe-c0cf88181cde","resolution":{"observed_at":"2026-08-01T13:28:42.407268Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:34:02.204161Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.19115."}