{"as_of":"2026-08-08T23:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed1d0335f5d4b714063667281a56d182801163581dae5543a272e86073e57a24","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:25:31.066786Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.29513/citation-record","integrity":"/paper/2606.29513/integrity","json":"/paper/2606.29513/citation-record.json","paper":"/paper/2606.29513"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"C3G: Learning compact 3D representations with 2K gaussians","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:061b22cfd661015329a6d3e16939436c70cabed9b3e348d2db6f59e77f269362","observation_id":"c2c552cf-02ff-41cd-add9-005a78a88fef","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Barron, Ben Mildenhall, Dor Verbin, Pratul P","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:305a8855d00882ec70915b33dcefeba50c687acea4ff820ca0be6d76193b752f","observation_id":"9bc8c2f5-8db6-445f-9127-416118b2fe5e","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:c3ed950f0d435ee1c948c7b8a975253098a276da587ac78437ad55c52b18a1a1","observation_id":"a6f95fe9-b2cd-4e8f-8a2a-e4a0245380cf","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Lifting by gaussians: A simple, fast and flexible method for 3D instance segmentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:3365838c52600d9f71433b1204b1ae52969704d0af77b36d4c16689bf1757e55","observation_id":"d5015bf9-e2e3-4df1-a46a-e59d7b075cfa","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:f59d3e593faad50797257d61365bcf52c5ae445ca02512f66a731cfd18a70857","observation_id":"524f377a-869f-4a4f-a254-d822d6ff4cb0","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Mvsplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:904a6c8cefec46f2451cdd6a8ea7936254b013e6e214c2042f673e093562e116","observation_id":"2f8966ba-aca9-434c-bff0-f1713cdb7f14","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Schwing, Alexander Kirillov, and Rohit Girdhar","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:dfa6c1ae50d9aa61b75ef8b85428cbcebcd81e173d26fc31815b4957afe6f228","observation_id":"33771025-4bfe-4a1f-8e20-16b1bd7dcd71","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:53b40677d07b59d92bd3617197e3f5b5675243a37d662edb5d4ad689a3d1d61a","observation_id":"c05dd16f-6035-4cc4-8cb2-8bf448478c00","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Large spatial model: End-to-end unposed images to semantic 3d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:310512402de8c1f5dd7d85d7c9fb0edd1d7c7e44b7ce496df04b893761c9d6ff","observation_id":"ee73b5fc-7ae2-4599-86e8-90de98c9c548","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09045","last_updated":"2026-04-10T07:07:10Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T07:07:10Z","title":"Scene-Agnostic Object-Centric Representation Learning for 3D Gaussian Splatting","version":1},"cited_work":{"arxiv_id":"2604.09045","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.09045","snapshot_observed_at":"2026-06-30T07:34:22.078901Z","title":"Scene-Agnostic Object-Centric Representation Learning for 3D Gaussian Splatting","venue":"cs.CV","work_id":"98816d98-296c-423d-9de0-485a53ff9c81","year":2026},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"cited_paper":"/paper/2604.09045","citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:4a8800f5f0ad9e362a1298ccb78e6125ec15c876477698605750931da0c77983","observation_id":"703c8053-6dad-4342-ae5d-6ab97df0e74c","resolution":{"observed_at":"2026-06-30T07:34:22.080372Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Anysplat: Feed-forward 3d gaussian splatting from unconstrained views.ACM Transactions on Graphics (TOG), 44(6):1–16, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:5f786aa994446e9206ec82218d6c5de17705619d8d74dd241e3a0e3a15a23010","observation_id":"af82ab69-c39f-4f49-b6aa-69bd1905ecd0","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:a338864e1f1b8d02e513b8edb2eb6adb3b5334e6c8cc90e3e021f9e21a224160","observation_id":"d88d6897-9317-4409-9019-d30e644a4d00","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Grounding image matching in 3d with mast3r","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:ff2946d66f0d9001b13e400abd1aca528f686772be6b5deae8dfd27dcce44f7d","observation_id":"345b8c84-6815-4805-83c5-ccbad3f4c9a7","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Language-driven semantic segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:69b95cbaafd8b1ed9c7f49e8afff1318ccd638a2289fd08b7537e42a09dfe701","observation_id":"ba8509a7-1783-43c4-a790-b034ce69b2aa","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"IGGT: Instance-grounded geometry transformer for semantic 3D reconstruction","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:0cd0b62078e87cb85438936609c04c28269469b0869827c7498394744b401525","observation_id":"7d672dcc-4128-43a6-8ac0-cb601b2c6da3","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"SlotLifter: Slot-guided feature lifting for learning object-centric radiance fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:25e178bfbc72455cf1b5b5545d1dc8c5239210e9a32c748905c949a338ad413a","observation_id":"f3b7b5a3-1b5e-417f-9694-bc14265f3235","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Object-centric learning with slot attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:7a44ca9bceefc25e1172cc4aae2230ec12af4542ed2620c57be0214796de18ed","observation_id":"3a184519-7442-4382-aef1-cd9b55bc3b0e","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"LUDVIG: Learning- free uplifting of 2D visual features to gaussian splatting scenes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:bd681e019ccf3a490a02956e6e754a250f339a0484c38581a5b558db36bf0f69","observation_id":"95a4e091-4873-4c78-9837-1ea1f445e064","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"V-net: Fully convolutional neural networks for volumetric medical image segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:80fe236e4d73f79e33a89ace7a98feb584d4d3436e98c72501f08c9e3ec05ecf","observation_id":"9cbc4155-04fc-49b6-a5af-15cffb9458bc","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Any3DIS: Class-agnostic 3D instance segmentation by 2D mask tracking","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:6db1fcac3b2de81edd158d90b04d4842f6b6916235d5407320306668c021fc63","observation_id":"d5138a93-e013-4a9d-9cb5-6c0664372f7b","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":"2408.00714","doi":"10.1038/s41598-025-97590-3","metadata_source":"pith","pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 2: Segment Anything in Images and Videos","venue":"cs.CV","work_id":"acc13f66-d814-44f9-9688-375688bf2d4a","year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:86abb17b2bdeaa5682669f7d62ab09c3b219799b13451bf7a0340769dbcbb718","observation_id":"9e5b7126-3921-45bb-bd40-283a9d56dc93","resolution":{"observed_at":"2026-06-30T07:34:22.085620Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Schönberger and Jan-Michael Frahm","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:5506be87197d6ab3e444076ae62a792c9bbb5b5de6cb3db343754ceb4b7359ac","observation_id":"f512e97b-11ca-4877-8298-eaaf8dd33115","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Trace3D: Consis- tent segmentation lifting via gaussian instance tracing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:21b13491708268649108532e2f4c42ebadf87cdbbd062dfb4c207dea48adc7bf","observation_id":"d2a1894d-dd54-44af-913b-80c4630ee8dc","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13912","last_updated":"2024-08-27T19:06:57Z","snapshot_observed_at":"2026-08-05T11:12:55.434512Z","submitted_at":"2024-08-25T18:27:20Z","title":"Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs","version":2},"cited_work":{"arxiv_id":"2408.13912","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.13912","snapshot_observed_at":"2026-07-04T13:49:51.641963Z","title":"Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs","venue":"cs.CV","work_id":"3950c9e4-deb4-4280-ac8f-08754c3ccf34","year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"cited_paper":"/paper/2408.13912","citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:7e92008ab933809bb8389ea0bf477edc77ebb3c08f082ad71cb66ffebf24723d","observation_id":"fe1cb805-0a53-4fdf-ae2d-d1684925eaec","resolution":{"observed_at":"2026-06-30T07:34:22.083023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Uni3R: Unified 3D reconstruction and semantic understanding via generalizable gaussian splatting from unposed multi-view images","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:90c12d1377a7b381775e389a4ab1f04c49b362a6705447ffc19498c4c3832939","observation_id":"cf0eb017-9388-4e11-9045-86d263849aa0","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Sumner, Marc Pollefeys, Federico Tombari, and Francis Engelmann","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:542265e4e855c510dabccc6a8cb521c7587bb7b20e5af0042a34adb2b54e2ee1","observation_id":"24aa1ef5-6f99-4ced-b454-725167659a5f","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:77e3e59f0fd7fdf7996c995157bed2e9d3019204b0b2c262b7b9d2bf5f1d057e","observation_id":"b1902f8b-32cc-49d1-9ff4-95e9f42c2939","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:c658a32cfee2cddbd2bc0b521840e100680fe2401b6f19e1e62276673670a3e1","observation_id":"71b32977-b18d-4d30-ac4a-d1d241d94121","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03908","last_updated":"2023-06-06T17:59:51Z","snapshot_observed_at":"2026-08-07T21:29:04.973616Z","submitted_at":"2023-06-06T17:59:51Z","title":"SAM3D: Segment Anything in 3D Scenes","version":1},"cited_work":{"arxiv_id":"2306.03908","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.03908","snapshot_observed_at":"2026-07-04T20:00:07.715806Z","title":"Sam3d: Segment anything in 3d scenes","venue":null,"work_id":"0fce1f54-3699-443e-b6d6-ebe0674ea983","year":2023},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"cited_paper":"/paper/2306.03908","citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:d6f1f66de16fa5d0f292b8b985de51488cb05fd2d83daa796c490594d3b3c66e","observation_id":"c0fef94e-fc9c-47b1-ae1e-1819b0488218","resolution":{"observed_at":"2026-06-30T07:34:22.088631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"No pose, no problem: Surprisingly simple 3d gaussian splats from sparse unposed images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:97d1552279d584cd05510e1432a2d69894895ba7eab5a86ddd83e40cec4c99bf","observation_id":"a6b284b4-7955-46ee-a410-e287f1918c62","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Gaussian grouping: Segment and edit anything in 3d scenes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:354a417084072eb734e9baf741cd704ac77eb8d9780b568a50c45a7f95651baf","observation_id":"45548888-0590-48c4-9054-3799e43836d1","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"gsplat: An open-source library for gaussian splatting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:eacd14535ed4bf74175ea2f5a850be24af6056640a502e05b25c3ceb7c9f6032","observation_id":"75467a71-f315-4f43-8b59-74d134c7530f","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"kMaX-DeepLab: k-means mask transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:b69a2817f172c10989de06c8b50f23345d985c9b24c21c247ef456a21df67c19","observation_id":"b98364ff-4275-4fef-93f0-a45f32ea3ff1","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:628eb5ae7c794fd14e6da83af2184aa10cbddfaec166e112cf93807af6e7477e","observation_id":"a0dc898f-2125-4968-beec-fb3650182909","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"ObjectGS: Object-aware scene reconstruction and scene understanding via gaussian splatting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:c01f22b329e286448720180df2c86e59e08ef8c208b25d44294f9173d20e3e19","observation_id":"cf253710-3ab2-44f2-946f-d24eec4e45b1","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:25:31.066786Z","title":"PanSt3R: Multi-view consistent panoptic segmentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T07:25:31.066786Z"},"links":{"citing_paper":"/paper/2606.29513"},"observation_digest":"sha256:5f05ab0e4f6e28942b0cd25bbd6cd902991b1b0de47c1f42adb0a94d92114ad9","observation_id":"2d7fab7b-4030-45f5-8e05-c72cda092415","resolution":{"observed_at":"2026-06-30T07:25:31.066786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.29513","last_updated":"2026-06-28T17:21:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-07T00:03:27.045821Z","submitted_at":"2026-06-28T17:21:45Z","title":"Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2606.29513."}