{"as_of":"2026-08-09T20:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5324fe4048f04a2917512f5eed558639edb5d067c7d372c7c0befc61a17e16d9","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:40:03.873727Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T17:23:44.758186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-13T18:15:01.652422Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"cited_work":{"arxiv_id":"2508.01464","doi":"10.48550/arxiv.2508.01464","metadata_source":"pith","pith_arxiv_id":"2508.01464","snapshot_observed_at":"2026-07-13T18:15:01.652422Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","venue":"cs.CV","work_id":"4a3c43c6-c214-4703-94aa-f63c5f94c696","year":2025},"citing_paper":{"arxiv_id":"2603.26661","last_updated":"2026-07-01T17:46:52Z","snapshot_observed_at":"2026-07-13T17:23:44.301154Z","submitted_at":"2026-03-27T17:58:05Z","title":"GaussianGPT: Towards Autoregressive 3D Gaussian Scene Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T17:23:44.758186Z"},"links":{"cited_paper":"/paper/2508.01464","citing_paper":"/paper/2603.26661"},"observation_digest":"sha256:48c8d07793cd8357ff658691bea9e49beb1f3b31c1ab94bb7c4b716c4a7757d3","observation_id":"13a40408-9e9e-4c77-a287-34393393b63d","resolution":{"observed_at":"2026-07-13T17:29:46.707882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.01464/citation-record","integrity":"/paper/2508.01464/integrity","json":"/paper/2508.01464/citation-record.json","paper":"/paper/2508.01464"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.048789Z","title":"Multilayer perceptrons","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.048789Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:3f227e283f391b65bea3da9243ca4efd3f414fb18b9df7604fadcbd622860c90","observation_id":"ade452fb-e9c5-4694-97e8-cdfefb20f62a","resolution":{"observed_at":"2026-08-06T05:40:03.048789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.104806Z","title":"Distributions of the kullback–leibler divergence with applications","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.104806Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:cdaaa72589e413076adc42b62e6cda1ce6e76d9515376b6ba0929649b92f77c6","observation_id":"023b8b38-2388-4759-878f-787bb348aa66","resolution":{"observed_at":"2026-08-06T05:40:03.104806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.04236","last_updated":"2016-08-16T08:06:24Z","snapshot_observed_at":"2026-07-06T05:07:01.679054Z","submitted_at":"2016-08-15T11:14:35Z","title":"Generative and Discriminative Voxel Modeling with Convolutional Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.04236","snapshot_observed_at":"2026-08-06T05:40:03.225661Z","title":"Generative and discriminative voxel mod- eling with convolutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.225661Z"},"links":{"cited_paper":"/paper/1608.04236","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:36402fdbde1c2b789270f07ef7c803c6aecbc2536df9cc961be0e22ec0786a30","observation_id":"496659cd-2b27-4b97-b682-d5a522bebf00","resolution":{"observed_at":"2026-08-06T05:40:03.225661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.385970Z","title":"Pythae: Unifying generative autoencoders in python - a benchmarking use case","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.385970Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:7e63349e4a52cd1ecedc6f8f5a1017acacd1c8e42ed307db95c30ae7b8569920","observation_id":"09ba7605-1d71-4a39-aaa5-16b431967c5f","resolution":{"observed_at":"2026-08-06T05:40:03.385970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-07T11:28:03.211074Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-06T05:40:03.431448Z","title":"Shapenet: An information-rich 3d model repository","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.431448Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:9883719a32d497804e9dc4f7739766f7320406340b7ce3fa3b149ded4873da21","observation_id":"12e7cc7d-b285-436a-b611-84bf121c83c0","resolution":{"observed_at":"2026-08-06T05:40:03.431448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10163","last_updated":"2024-10-09T05:00:16Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T16:30:25Z","title":"MeshAnything: Artist-Created Mesh Generation with Autoregressive Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10163","snapshot_observed_at":"2026-08-06T05:40:03.436882Z","title":"Meshanything: Artist-created mesh generation with au- toregressive transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.436882Z"},"links":{"cited_paper":"/paper/2406.10163","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d6d41fdf60ad93a8a89888d4d4b5302eb66a0498e059cee53bf0b3fe5b8c5e98","observation_id":"6c8a98e7-4270-4ff2-9da0-fed938adb9ba","resolution":{"observed_at":"2026-08-06T05:40:03.436882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.442343Z","title":"Gaussianpro: 3d gaussian splatting with progressive propagation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.442343Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:b11e13052bae7e4bd3c58a6db3a4dc781239d354a6341ad0690ce4cf3c5f698b","observation_id":"c6020f08-3734-47da-af5a-4eb2928dee34","resolution":{"observed_at":"2026-08-06T05:40:03.442343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.447539Z","title":"4d spatio-temporal convnets: Minkowski convolutional neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.447539Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:e5e88f21649f1258cdc0ec2e3ab9b1dff9a26618ce9bc425033109736b11791a","observation_id":"62746139-3a85-4283-abe3-44b82be68420","resolution":{"observed_at":"2026-08-06T05:40:03.447539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13384","last_updated":"2023-11-23T11:40:16Z","snapshot_observed_at":"2026-08-09T05:30:44.065605Z","submitted_at":"2023-11-22T13:27:34Z","title":"LucidDreamer: Domain-free Generation of 3D Gaussian Splatting Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13384","snapshot_observed_at":"2026-08-06T05:40:03.452250Z","title":"Luciddreamer: Domain-free gen- eration of 3d gaussian splatting scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.452250Z"},"links":{"cited_paper":"/paper/2311.13384","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:35b087788417db6aac70ba6725483261d63646f1dbfb22a20e0f1430bb35051c","observation_id":"efa55b27-6d37-4e61-b4d8-ccb10b6d65d5","resolution":{"observed_at":"2026-08-06T05:40:03.452250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.457495Z","title":"Spconv: Spatially sparse convolu- tion library","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.457495Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:11d43c831b4f151b168785bb9bf0d40e0731c3e9673f618d61f2a573c5bdc04b","observation_id":"2099a656-76b5-44f3-8c3a-01bfdd9b631e","resolution":{"observed_at":"2026-08-06T05:40:03.457495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.462086Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R´e","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.462086Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:5d99a677f123d8ba8102051644d028de266f5a1fb4c8db5ff293fa8228afc16c","observation_id":"89fe8348-5639-4c75-acda-6ae6be271c0c","resolution":{"observed_at":"2026-08-06T05:40:03.462086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.466986Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.466986Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:c51ac14e1e104aea1a278c57c7e27018b05fb86e23767789e96b901229f946e1","observation_id":"4fe76e6f-a265-4706-aceb-033c3f6ccf98","resolution":{"observed_at":"2026-08-06T05:40:03.466986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T05:40:03.472046Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.472046Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:80902760eee13b046f901b50d1dad3194c6f4cfd12741237c4940c0de16ee4bc","observation_id":"8cab9c38-8427-44ed-bb1b-bedc96ddba8b","resolution":{"observed_at":"2026-08-06T05:40:03.472046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20309","last_updated":"2025-07-03T22:28:07Z","snapshot_observed_at":"2026-08-06T20:09:51.889461Z","submitted_at":"2024-03-29T17:29:58Z","title":"InstantSplat: Sparse-view Gaussian Splatting in Seconds","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20309","snapshot_observed_at":"2026-08-06T05:40:03.476687Z","title":"Instantsplat: Un- bounded sparse-view pose-free gaussian splatting in 40 sec- onds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.476687Z"},"links":{"cited_paper":"/paper/2403.20309","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:78f4690fa0a65ac0b5dfc86fa0afd50443bcadbbf08ce2e541d26a7988914746","observation_id":"d49d3394-ce2f-41c4-a3fc-2257e9f8c139","resolution":{"observed_at":"2026-08-06T05:40:03.476687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.481931Z","title":"Scenescape: Text-driven consistent scene generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.481931Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:1f0792f4d5dd935486079798fd2e9b05525c4b477156bf9a907ef74130b9d500","observation_id":"f6d2a99f-df3b-4fa6-8f7c-ee09c4b379ae","resolution":{"observed_at":"2026-08-06T05:40:03.481931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.486267Z","title":"Get3d: A generative model of high quality 3d tex- tured shapes learned from images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.486267Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:24f739f7b7d4ea1c07e0c9c78c4223c0b4edaae12b587b6bed8e0c05dcdc46e2","observation_id":"c28b0003-e277-44d6-a5f3-6c14ac1e36e8","resolution":{"observed_at":"2026-08-06T05:40:03.486267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.490648Z","title":"Vfusion3d: Learning scalable 3d generative models from video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.490648Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:35c5d7cab9723f0d16da9200fca85b1469519ef8f5f62ce4a4bf3c208c35cb0f","observation_id":"fda0f968-a72e-45b6-83ae-46ea0f4210b9","resolution":{"observed_at":"2026-08-06T05:40:03.490648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.496700Z","title":"Text2room: Extracting textured 3d meshes from 2d text-to-image models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.496700Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:28272113a65683f1cd73acef456b0bd89640327d061fcefee4a4b5f87008c300","observation_id":"fb019e7c-45d0-46ba-ac02-791b3236f3d1","resolution":{"observed_at":"2026-08-06T05:40:03.496700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-08-06T05:40:03.501550Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.501550Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:e6f578e85f92e576b085b3017be499269dc142ff35465963bfa644ad741ed7b9","observation_id":"1ab6946e-1969-4931-aaaf-e6a2414e183a","resolution":{"observed_at":"2026-08-06T05:40:03.501550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.506250Z","title":"Mvd-fusion: Single-view 3d via depth-consistent multi-view generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.506250Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:a2f8a9d8807fff64eab043073615ac9ea56a0c25daec4a7a03050d88e27ccf30","observation_id":"0e6afee0-c86d-4a48-9ee7-b67fc269e166","resolution":{"observed_at":"2026-08-06T05:40:03.506250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14795","last_updated":"2022-03-15T22:37:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-30T17:53:34Z","title":"Perceiver IO: A General Architecture for Structured Inputs & Outputs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14795","snapshot_observed_at":"2026-08-06T05:40:03.511481Z","title":"Perceiver io: A general architecture for structured inputs & outputs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.511481Z"},"links":{"cited_paper":"/paper/2107.14795","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d368524555cee05cb21b02af6f5fc184e862f11bb5eff81d5b9fe620af3d3078","observation_id":"8cf3ff54-2f13-4926-a318-bfebfc014cc0","resolution":{"observed_at":"2026-08-06T05:40:03.511481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.516201Z","title":"Perceiver: General perception with iterative attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.516201Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:4e3dbb842a0d09ae31278a539e476859574e08db0ccd9095700b6e359b978d60","observation_id":"3efe8cf1-7abf-4ef0-963d-8cf724c9472d","resolution":{"observed_at":"2026-08-06T05:40:03.516201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01410","last_updated":"2023-10-02T17:59:37Z","snapshot_observed_at":"2026-08-05T13:28:51.810225Z","submitted_at":"2023-10-02T17:59:37Z","title":"LEAP: Liberate Sparse-view 3D Modeling from Camera Poses","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01410","snapshot_observed_at":"2026-08-06T05:40:03.521050Z","title":"Leap: Liberate sparse-view 3d modeling from camera poses","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.521050Z"},"links":{"cited_paper":"/paper/2310.01410","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d532d773b8ed56c0011a9a6caed6664b73d3aae34c6016656c4186acef319c1f","observation_id":"cab6230d-1623-4ba1-b5b6-d17af05badd2","resolution":{"observed_at":"2026-08-06T05:40:03.521050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02463","last_updated":"2023-05-03T23:59:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-03T23:59:13Z","title":"Shap-E: Generating Conditional 3D Implicit Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02463","snapshot_observed_at":"2026-08-06T05:40:03.527010Z","title":"Shap-e: Generat- ing conditional 3d implicit functions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.527010Z"},"links":{"cited_paper":"/paper/2305.02463","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:4c14bcece5169dad777f32f931856fd80dc28d252f541236a54cae466e4fc617","observation_id":"f5fb7fdc-f3a0-46ed-bade-ce2f0ec93a19","resolution":{"observed_at":"2026-08-06T05:40:03.527010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.531725Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.531725Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:65e8d00e2d0ff07035f648f9cd0a0089db495e1c346894bfb6df031a24761d14","observation_id":"437589df-77f4-4abb-8f92-351468aa712a","resolution":{"observed_at":"2026-08-06T05:40:03.531725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.544591Z","title":"9 A hierarchical 3d gaussian representation for real-time ren- dering of very large datasets.ACM Transactions on Graphics (TOG), 43(4):1–15, 2024","venue":null,"work_id":"c923a0ad-5389-4e05-8c8f-59a4b5d8896c","year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.537128Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:1b86aca2adf2f01b68d94b44e53a131ca0311658c920ba6506971876384c6f9a","observation_id":"72fcf7bf-885f-46f1-a285-e9e870bcff4b","resolution":{"observed_at":"2026-08-06T05:40:05.549373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T05:40:03.542270Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.542270Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:bf2d4168f7b3d903e3f00d1b286b320b1b17ad2f313eab1e36833b2398b818da","observation_id":"6d7118ea-e134-4f17-aead-d47ee34674b4","resolution":{"observed_at":"2026-08-06T05:40:03.542270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.529233Z","title":"Segment any- thing","venue":null,"work_id":"288c27f3-492a-4b66-bea3-08dbe50cfe38","year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.547345Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:23fd0a55c0865bda1085aeb65aa3a25867954292de26889d71084d00eb561390","observation_id":"9f35262f-b92d-4892-8831-f2feb60bb843","resolution":{"observed_at":"2026-08-06T05:40:05.533680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.513424Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"cb9ebc67-8a9a-47c5-818b-51a1b9b330be","year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.551977Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:69ef309ce168d4b90d6d12532f12a7a209f1e5f18a1e25907ee6afbbdda8e8d4","observation_id":"2dc3e813-5c99-4db9-bcb6-2ad387bfca0b","resolution":{"observed_at":"2026-08-06T05:40:05.518186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06214","last_updated":"2023-11-23T08:55:49Z","snapshot_observed_at":"2026-07-06T16:45:47.395736Z","submitted_at":"2023-11-10T18:03:44Z","title":"Instant3D: Fast Text-to-3D with Sparse-View Generation and Large Reconstruction Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06214","snapshot_observed_at":"2026-08-06T05:40:03.557093Z","title":"Instant3d: Fast text-to-3d with sparse-view generation and large reconstruction model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.557093Z"},"links":{"cited_paper":"/paper/2311.06214","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:4070864684fdbfb0815ea0447908d74849fb443a0b68d41d01058afba686ccf1","observation_id":"810dd91f-cfbd-49cc-9f75-5b22f988582d","resolution":{"observed_at":"2026-08-06T05:40:03.557093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.495471Z","title":"Infinitenature-zero: Learning perpetual view generation of natural scenes from single images","venue":null,"work_id":"209a79fa-b85d-444b-8497-7b512081bc41","year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.562097Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:aceffe8cf14caa6484008b9b8be13ac0fde9c8e7c2be7eb309f00996e99c8c1a","observation_id":"4578ced1-93ea-4352-8706-8864439b6d8f","resolution":{"observed_at":"2026-08-06T05:40:05.501036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11056","last_updated":"2024-04-03T04:00:53Z","snapshot_observed_at":"2026-07-06T17:45:47.803735Z","submitted_at":"2024-03-17T02:06:03Z","title":"Analytic-Splatting: Anti-Aliased 3D Gaussian Splatting via Analytic Integration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11056","snapshot_observed_at":"2026-08-06T05:40:03.566659Z","title":"Analytic-splatting: Anti-aliased 3d gaussian splatting via analytic integration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.566659Z"},"links":{"cited_paper":"/paper/2403.11056","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:1bb982a4c34b93820c780c359b4ce42dd4d0e141d7c474df48a06366e0d28163","observation_id":"a68b8336-dcc7-4569-a929-219152bdb894","resolution":{"observed_at":"2026-08-06T05:40:03.566659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.476354Z","title":"Infinicity: Infinite-scale city synthesis","venue":null,"work_id":"0cc4fb27-8ce6-4474-b4b2-805f8cda489f","year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.572196Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:83be9f6469fa2b72fd99a625af739570a38955f6d6a525a9a77b4ff26341753a","observation_id":"f6bb1280-0788-443a-8a16-3aa92dadee76","resolution":{"observed_at":"2026-08-06T05:40:05.481920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.457929Z","title":"Vastgaussian: Vast 3d gaussians for large scene reconstruction","venue":null,"work_id":"f20d42e9-6de9-41ef-809d-31cfee193d84","year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.577045Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8c355a8f349b741879bb926af55ebf657944b346cf007f53e5db7fa2920540ad","observation_id":"4b013dee-0750-4d5c-b847-82a3debca4fd","resolution":{"observed_at":"2026-08-06T05:40:05.463222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.440219Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":"f2d7b1f0-f3b1-45ab-8df7-42fb0e6d4dd2","year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.581742Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:2bb842ba5995b487bddc0fb214164d7b3fa72778041b28985077b98f7c4b0113","observation_id":"a7d45d92-ba02-4a5d-9962-d83ce799e55d","resolution":{"observed_at":"2026-08-06T05:40:05.445521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.423473Z","title":"Infinite na- ture: Perpetual view generation of natural scenes from a sin- gle image","venue":null,"work_id":"7582b27f-446a-4757-ab30-ab8489c54ada","year":2021},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.586488Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:211409fea57776acf27144f05edd214ba3c976f9ece510efac9ded16b288f34f","observation_id":"472fedf4-85c1-4912-961d-72d058c481b9","resolution":{"observed_at":"2026-08-06T05:40:05.428747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.404766Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":"27b05cb8-f96c-4203-a08b-23ab48cf16f3","year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.591134Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:618ceb0c980a8fad129a011edec4881d8f06a2479a33a42d1e4745df847cc9d8","observation_id":"f8f12821-eb1a-4a8e-8445-316c67277e3d","resolution":{"observed_at":"2026-08-06T05:40:05.410680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.596157Z","title":"Scaffold-gs: Structured 3d gaussians for view-adaptive rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.596157Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:e57734d13e6c1d436b1cfcef431563b60a6e017c351160214db60852e9800373","observation_id":"1d4aa7ab-a045-42f3-b94b-7afe827f26fd","resolution":{"observed_at":"2026-08-06T05:40:03.596157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08152","last_updated":"2019-06-29T04:29:48Z","snapshot_observed_at":"2026-07-06T08:01:27.238962Z","submitted_at":"2019-06-19T15:25:29Z","title":"Learning Disentangled Representations of Timbre and Pitch for Musical Instrument Sounds Using Gaussian Mixture Variational Autoencoders","version":2},"cited_work":{"arxiv_id":"1906.08152","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.08152","snapshot_observed_at":"2026-08-06T05:40:04.419644Z","title":"Learning Disentangled Representations of Timbre and Pitch for Musical Instrument Sounds Using Gaussian Mixture Variational Autoencoders","venue":"cs.LG","work_id":"94e8426e-617e-4a48-961c-cf5824cb63b9","year":2019},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.601086Z"},"links":{"cited_paper":"/paper/1906.08152","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:91c42558e28776324dc72fe45526b8a0555853c71dc71f5be52e34757d42ae2b","observation_id":"b1f4153d-2bdf-487c-bb04-eceb53bebb42","resolution":{"observed_at":"2026-08-06T05:40:04.427452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10906","last_updated":"2025-09-06T20:06:14Z","snapshot_observed_at":"2026-07-06T19:03:30.963245Z","submitted_at":"2024-08-20T14:49:14Z","title":"ShapeSplat: A Large-scale Dataset of Gaussian Splats and Their Self-Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10906","snapshot_observed_at":"2026-08-06T05:40:03.606488Z","title":"Shapes- plat: A large-scale dataset of gaussian splats and their self- supervised pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.606488Z"},"links":{"cited_paper":"/paper/2408.10906","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:853fc4ef2def302fe38d8d3914a36f1190926d1c2775ba36da08609e0fc78a27","observation_id":"ed333991-0534-4922-a591-a516b4a7ad54","resolution":{"observed_at":"2026-08-06T05:40:03.606488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.375826Z","title":"Normalized image representation for efficient coding","venue":null,"work_id":"33aa6d20-f031-4d14-8092-7fc4c1e71316","year":2003},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.611458Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:28468fd5bee6ff0d7851535d9c23e0c49eb8c983fe4a0643e135591ebd055cc6","observation_id":"a1e728a5-2d3f-4890-b9ba-94110db0d790","resolution":{"observed_at":"2026-08-06T05:40:05.381013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.359660Z","title":"Text2mesh: Text-driven neural stylization for meshes","venue":null,"work_id":"bedd8cac-3f14-4e0c-a8bc-de37c679583c","year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.616496Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:f8e706a923246a401cd062e019ec761e23da36a4f9a3b8d2171080a925f4326c","observation_id":"b4a7c29c-9b54-4ebc-b001-a5fcf01b8746","resolution":{"observed_at":"2026-08-06T05:40:05.364513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.342331Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":"e0b2a45a-c410-47f7-b7c6-05c9344e38df","year":2020},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.621366Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d7c45bd81c530ba84104a20e1dd7a680187d8783ec189c75aad38b4842d19dcd","observation_id":"09816c25-23ce-4a7c-ace4-847c01a4b2e7","resolution":{"observed_at":"2026-08-06T05:40:05.347659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.325456Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":"0eda9393-7857-4142-843c-be4c42b73aa8","year":2021},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.625704Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:4fc8dc1d2b96b00ab7f8491d9ffda9b136592dbb7ad8cb8d1b74b05ca5d10c5a","observation_id":"d1e57c8d-f6a7-4787-84b7-15b7e9642349","resolution":{"observed_at":"2026-08-06T05:40:05.330413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08751","last_updated":"2022-12-16T23:22:59Z","snapshot_observed_at":"2026-07-06T14:31:54.932806Z","submitted_at":"2022-12-16T23:22:59Z","title":"Point-E: A System for Generating 3D Point Clouds from Complex Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08751","snapshot_observed_at":"2026-08-06T05:40:03.630311Z","title":"Point-e: A system for generat- ing 3d point clouds from complex prompts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.630311Z"},"links":{"cited_paper":"/paper/2212.08751","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:c207beef80cf04687d644c8786733f5470f4e13dcff9633ae06d3184eb58e751","observation_id":"c85d9587-b574-4e03-9f4e-357b3cd0920d","resolution":{"observed_at":"2026-08-06T05:40:03.630311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13806","last_updated":"2025-03-31T07:56:03Z","snapshot_observed_at":"2026-07-06T17:47:51.284226Z","submitted_at":"2024-03-20T17:59:55Z","title":"RadSplat: Radiance Field-Informed Gaussian Splatting for Robust Real-Time Rendering with 900+ FPS","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13806","snapshot_observed_at":"2026-08-06T05:40:03.635392Z","title":"Radsplat: Radiance field-informed gaussian splat- ting for robust real-time rendering with 900+ fps","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.635392Z"},"links":{"cited_paper":"/paper/2403.13806","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:bb28c9b40e42c4e1dabab683d4c6aa13b256328ffb36844222747c0264c0f81f","observation_id":"d89d24f1-cf36-49e0-8046-ec460767c623","resolution":{"observed_at":"2026-08-06T05:40:03.635392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.640434Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.640434Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:4e727dc0c5c5c91fdc18734ec3384f80dec9608f0957dded0d51251b52402412","observation_id":"0d47e623-4ec9-4fee-9ccf-74502c821c11","resolution":{"observed_at":"2026-08-06T05:40:03.640434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-06T05:40:03.645160Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.645160Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:ee72071a4e6fe3ede8da2f5851d0c9379aea87e0103f6b15ef19a290767e6029","observation_id":"ff760e60-3f2b-407f-ba3b-16fb0dbfaa22","resolution":{"observed_at":"2026-08-06T05:40:03.645160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.00593","last_updated":"2017-04-10T22:25:25Z","snapshot_observed_at":"2026-07-06T05:21:06.342737Z","submitted_at":"2016-12-02T08:40:40Z","title":"PointNet: Deep Learning on Point Sets for 3D Classification and Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.00593","snapshot_observed_at":"2026-08-06T05:40:03.650167Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.650167Z"},"links":{"cited_paper":"/paper/1612.00593","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:885d8117ca32d5050e569479c799e726bf3f96227094b6149ef534850e6327d7","observation_id":"be18c55e-aab9-4ea1-83ee-2516cfa635d8","resolution":{"observed_at":"2026-08-06T05:40:03.650167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.655993Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.655993Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8f87b4af20ec4a4a4ad582bf593418494a5775cd1a4b8731a25e44860570b926","observation_id":"e7174681-dd9c-4636-bfa0-e7a236832d27","resolution":{"observed_at":"2026-08-06T05:40:03.655993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02413","last_updated":"2017-06-07T23:37:44Z","snapshot_observed_at":"2026-07-06T05:46:01.107746Z","submitted_at":"2017-06-07T23:37:44Z","title":"PointNet++: Deep Hierarchical Feature Learning on Point Sets in a Metric Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02413","snapshot_observed_at":"2026-08-06T05:40:03.661798Z","title":"Point- net++: Deep hierarchical feature learning on point sets in a metric space","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.661798Z"},"links":{"cited_paper":"/paper/1706.02413","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:ab7b00f3b26fc7b3a4f011c88d8f08a52e66ab41bdc39f4e328703ceeb788a26","observation_id":"655f993d-3f31-4595-9de9-0ebd6633efa3","resolution":{"observed_at":"2026-08-06T05:40:03.661798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.666531Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.666531Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:7c51c77dc0126a7fee7ce892b60c1ed6c73c5bddd9fe87fd8d7072e51cfb82d5","observation_id":"9e772010-722b-40b4-8457-735a734f7839","resolution":{"observed_at":"2026-08-06T05:40:03.666531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13530","last_updated":"2024-10-17T13:19:32Z","snapshot_observed_at":"2026-08-04T10:10:41.326647Z","submitted_at":"2024-10-17T13:19:32Z","title":"L3DG: Latent 3D Gaussian Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13530","snapshot_observed_at":"2026-08-06T05:40:03.671111Z","title":"L3dg: Latent 3d gaussian diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.671111Z"},"links":{"cited_paper":"/paper/2410.13530","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:00ffcbb04a334d1587dcde289606de2295ec671487909194e93c2e7149fcbc8f","observation_id":"b1a82b3a-c634-4f46-a61a-5a0f17bfa062","resolution":{"observed_at":"2026-08-06T05:40:03.671111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.676036Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.676036Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:512c576d31925f8079feefe2379edfdda83d0b93a65f78ce9c55eaa053ecbe5b","observation_id":"ba95d573-68d7-4e9c-9b3c-61752b6d6945","resolution":{"observed_at":"2026-08-06T05:40:03.676036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.250731Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"0e7cc5d6-bc1d-46d4-bf84-9a3ec6a34605","year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.681212Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:4a490dc1f1a8adeda5e8176ee51503406bafa7d592426895482d02c668b46b4c","observation_id":"d360c3fe-e629-4b93-82ae-d81d1781652b","resolution":{"observed_at":"2026-08-06T05:40:05.255627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.230860Z","title":"Structure-from-motion revisited","venue":null,"work_id":"51f4d22c-9a48-4802-92a5-8e5d3f2751db","year":2016},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.685774Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:12651c94f6628ec618b5a9380d84ed6364ba21fe361add328cbeaa22a960f177","observation_id":"1f9e8531-9ea7-4d9b-8bd3-0ec54dd563f5","resolution":{"observed_at":"2026-08-06T05:40:05.238128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.213512Z","title":"Structure- from-motion revisited","venue":null,"work_id":"3e3e83f0-b983-49c1-a77f-740e7bc16780","year":2016},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.690128Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:b5f67bf09fdbf2731218a4798b5b512fd299fd457284de81638b3690b30e69c9","observation_id":"880dcc3d-4c07-4cf1-8e3d-99e4786a7593","resolution":{"observed_at":"2026-08-06T05:40:05.219205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-06T05:40:03.695673Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.695673Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:9026a507fe064849cc999dead79a69af59d3bcc8d3933306446d7c6368cbf347","observation_id":"8654c724-b509-4a25-8e77-5bf7dc29bab9","resolution":{"observed_at":"2026-08-06T05:40:03.695673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1404.1100","last_updated":"2014-04-03T21:16:49Z","snapshot_observed_at":"2026-07-06T03:40:19.607628Z","submitted_at":"2014-04-03T21:16:49Z","title":"A Tutorial on Principal Component Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1404.1100","snapshot_observed_at":"2026-08-06T05:40:03.700583Z","title":"A tutorial on principal component analysis","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.700583Z"},"links":{"cited_paper":"/paper/1404.1100","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:2c5a528fdd328c8ffb1f037187a25267978b277d6614484d84d7632d76712261","observation_id":"e441c834-65d7-4c12-97ed-0dec8a2a415d","resolution":{"observed_at":"2026-08-06T05:40:03.700583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.194974Z","title":"Meshgpt: Generating triangle meshes with decoder-only transformers","venue":null,"work_id":"c4928579-eec5-4278-bb82-5d433cd098c0","year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.705631Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d6a5b5ab974ae426d4318d3134ee296da2b3eb3c29f7225461feaa25ebcc4734","observation_id":"d5afa075-99b5-43a5-b83b-5d9c80a06a79","resolution":{"observed_at":"2026-08-06T05:40:05.201546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04343","last_updated":"2025-06-01T06:23:12Z","snapshot_observed_at":"2026-08-09T03:13:31.431570Z","submitted_at":"2024-06-06T17:59:56Z","title":"Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04343","snapshot_observed_at":"2026-08-06T05:40:03.710315Z","title":"Flash3d: Feed-forward gener- alisable 3d scene reconstruction from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.710315Z"},"links":{"cited_paper":"/paper/2406.04343","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:7913c1ee00d10565ee879e9dfc04f646f4412a7cbca1b012018d71d24c2c6a0e","observation_id":"800bfc10-c584-4bea-991f-cb1a6dde5a65","resolution":{"observed_at":"2026-08-06T05:40:03.710315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.171375Z","title":"Splatter image: Ultra-fast single-view 3d recon- struction","venue":null,"work_id":"67734d84-5b23-4740-a86f-386fba854adf","year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.715736Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:9ab6cda3baa847a37d22a5b332012740c00dda0351ca9aa2c1bc912a284ae529","observation_id":"7689cadd-88f5-4789-b159-fd12638e3b7e","resolution":{"observed_at":"2026-08-06T05:40:05.179695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.720173Z","title":"Bolt3d: Generating 3d scenes in seconds","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.720173Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8c57535f6990231b12ac57c5dc76b0c874346d9320207eae53a7ef9f3267a9f9","observation_id":"6ef4870b-8a2f-473a-9072-3b8ca9271c83","resolution":{"observed_at":"2026-08-06T05:40:03.720173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.152668Z","title":"Fourier features let networks learn high frequency functions in low dimen- sional domains","venue":null,"work_id":"f4ec3f13-fa3d-430f-9772-9e6e7d5cc010","year":2020},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.725159Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8577c73ec118f4a07c350a6d4692c38b50154c4996d04744206870e037296eb2","observation_id":"46c7ef1d-a59a-4dc9-a82f-a8e278370c52","resolution":{"observed_at":"2026-08-06T05:40:05.157906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-06T05:40:03.729815Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.729815Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d9d75c921b8463eb8a7baeefdee4f35dddddf507757f413e1c1e45458bcb26b8","observation_id":"389c69bb-f1bf-4678-8fdd-1a1527444e22","resolution":{"observed_at":"2026-08-06T05:40:03.729815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.132019Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation","venue":null,"work_id":"a9e5c094-9adb-440f-a0b0-9b2730e83c0c","year":2025},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.735850Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d77935b5674ea15557c7f8a80eb0bda5d55e633fe3b29aa9c2f0a66085eabdca","observation_id":"864783cb-2e63-4a65-aa49-8f99e4d4d607","resolution":{"observed_at":"2026-08-06T05:40:05.139746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.109646Z","title":"Learning spatiotemporal features with 3d convolutional networks","venue":null,"work_id":"956f8333-9d01-40fb-bad9-61ebb841fc9f","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.740483Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:e24ad42bfc61901a9871b7a2a62150ad8be10c525b6224b9fba57fab5a20570a","observation_id":"c3402165-9428-4b73-a476-1e49f995d8a2","resolution":{"observed_at":"2026-08-06T05:40:05.116960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.089069Z","title":"NV AE: A deep hierarchical variational autoencoder","venue":null,"work_id":"5e150a5a-0242-4a3c-9d1e-0f30f3ea7713","year":2020},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.745731Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:0684bdda09c5aba9b5be854e072858892d1a661228f9f4122d02312076c0d480","observation_id":"e5d8dcb8-f2d7-439a-884b-0a7727a4788a","resolution":{"observed_at":"2026-08-06T05:40:05.095050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.068081Z","title":"Visualizing data using t-sne","venue":null,"work_id":"f08774a5-b761-4472-93ef-33e803511d53","year":2008},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.750291Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:7d745e6b5d7ebc4386f3b14ebfcba72aef3d976ba32464aaac3b58ca3763fe07","observation_id":"ffef42a3-b7a9-4ec7-8142-31937b787adf","resolution":{"observed_at":"2026-08-06T05:40:05.074908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.754762Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.754762Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:15ebfd6eeafc2172e1384fc3542b18bb4317b622ed5fddb5fe128d0e274a3506","observation_id":"7a479ea5-e4d2-459a-aa2f-eecc8cc335cf","resolution":{"observed_at":"2026-08-06T05:40:03.754762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.029069Z","title":"Attentive normalization for conditional image generation","venue":null,"work_id":"c927d71b-4d61-4486-a104-f40fbfd02497","year":2020},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.760159Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:abedbbaa207331de05f77c62617d9796f45939417df63071a22c2a8d63e03a81","observation_id":"be6d9391-b11c-4b4b-bfe9-10f299eaf454","resolution":{"observed_at":"2026-08-06T05:40:05.034413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:05.011444Z","title":"Multimodal token fusion for vision transformers","venue":null,"work_id":"24adbedb-6402-4b90-bea2-d61e42c2cc37","year":2022},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.765586Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:f7873b1a0d61151183b3b52f3613eab27553e89ed8df4a94a778bc51748047ce","observation_id":"308b95f0-7914-45b9-bcc8-49faf60e8f19","resolution":{"observed_at":"2026-08-06T05:40:05.016471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.771362Z","title":"Mio: A foundation model on multimodal tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.771362Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:e5f9627479d3d6bc283d689ce27bbcddbd714ea369af039101d36ed95c9c44a3","observation_id":"d51641dd-2d35-4fe0-98ab-aaad3c7f177a","resolution":{"observed_at":"2026-08-06T05:40:03.771362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.992419Z","title":"Synsin: End-to-end view synthesis from a sin- gle image","venue":null,"work_id":"a538c126-f802-4574-b489-063fa5f2a795","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.777116Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:e081a6908eb38f8b0ace5fa405f4588f17d9d501224ad50eb56a427ba67d9f45","observation_id":"184e5407-d039-4cf4-b678-dc5ffbe31a0a","resolution":{"observed_at":"2026-08-06T05:40:04.998607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09217","last_updated":"2023-11-15T18:58:41Z","snapshot_observed_at":"2026-08-05T20:14:58.727218Z","submitted_at":"2023-11-15T18:58:41Z","title":"DMV3D: Denoising Multi-View Diffusion using 3D Large Reconstruction Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09217","snapshot_observed_at":"2026-08-06T05:40:03.782181Z","title":"Dmv3d: Denoising multi-view diffu- sion using 3d large reconstruction model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.782181Z"},"links":{"cited_paper":"/paper/2311.09217","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:3c5c126fdd54e23d47f1c701c906e15774dc5bcb523c177b6df881eaa63bf7c3","observation_id":"c2ac9a19-5d1d-4f99-92a7-957996242c55","resolution":{"observed_at":"2026-08-06T05:40:03.782181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08529","last_updated":"2024-05-13T14:12:23Z","snapshot_observed_at":"2026-08-08T09:48:16.449024Z","submitted_at":"2023-10-12T17:22:24Z","title":"GaussianDreamer: Fast Generation from Text to 3D Gaussians by Bridging 2D and 3D Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08529","snapshot_observed_at":"2026-08-06T05:40:03.787111Z","title":"Gaussian- dreamer: Fast generation from text to 3d gaussian splatting with point cloud priors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.787111Z"},"links":{"cited_paper":"/paper/2310.08529","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:10e14b501a3c38d9057edb8ccb3c447d374b1683da952c312d33a5b14461cdd4","observation_id":"f385edd4-5504-4c06-a826-f69f12cf3d4a","resolution":{"observed_at":"2026-08-06T05:40:03.787111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09394","last_updated":"2025-03-25T01:00:11Z","snapshot_observed_at":"2026-08-05T13:55:59.682067Z","submitted_at":"2024-06-13T17:59:10Z","title":"WonderWorld: Interactive 3D Scene Generation from a Single Image","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09394","snapshot_observed_at":"2026-08-06T05:40:03.792126Z","title":"Wonderworld: Interactive 3d scene generation from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.792126Z"},"links":{"cited_paper":"/paper/2406.09394","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8fe054e042bf8057599bc7bafa5c0e1a4afc3e465adec9e68bb4ef761f008d47","observation_id":"8023790f-ebaa-4222-a7cc-48e74919bcec","resolution":{"observed_at":"2026-08-06T05:40:03.792126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.975237Z","title":"Wonderjourney: Going from anywhere to everywhere","venue":null,"work_id":"a06886c2-2acf-46f0-80be-2feef1068b82","year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.797444Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:94419a76fbaf94417fa1b50bf8f581ee9b06b7af57ed7db0ffbc3ace5009b477","observation_id":"c0548f45-576d-451f-bbbb-e1b66750237a","resolution":{"observed_at":"2026-08-06T05:40:04.980977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.958259Z","title":"Mvimgnet: A large-scale dataset of multi-view images","venue":null,"work_id":"25ed7ab4-e6a5-4b71-b2e0-362c6df9832f","year":2023},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.802009Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:0028f05ef92284561c8f8f4d22e910ed97a055c76c56378cada4afc44ff223b4","observation_id":"ffbffcb8-a41f-4aa4-b6d3-54d2f7c77583","resolution":{"observed_at":"2026-08-06T05:40:04.963244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.806763Z","title":"Mip-splatting: Alias-free 3d gaussian splat- ting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.806763Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:e03ddcebe2e5e8b11381d73c499f1e394539677925bb973c30d763f8e10f2a2e","observation_id":"c7f5b902-c19e-4816-ba5e-9cd129ee0972","resolution":{"observed_at":"2026-08-06T05:40:03.806763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19655","last_updated":"2024-10-31T03:33:30Z","snapshot_observed_at":"2026-08-07T01:29:57.643382Z","submitted_at":"2024-03-28T17:59:50Z","title":"GaussianCube: A Structured and Explicit Radiance Representation for 3D Generative Modeling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19655","snapshot_observed_at":"2026-08-06T05:40:03.812830Z","title":"Gaussiancube: Structuring gaussian splatting using opti- mal transport for 3d generative modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.812830Z"},"links":{"cited_paper":"/paper/2403.19655","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:9fc8bdff8a32c818ccf3f4c78c1eff6e9cc471e1622f16a0a447bbb6960a0dfe","observation_id":"377d8018-1edd-4e57-bc92-2441b99e5035","resolution":{"observed_at":"2026-08-06T05:40:03.812830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:03.818205Z","title":"Gs-lrm: Large recon- struction model for 3d gaussian splatting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.818205Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:be4779069720ce470ef465ec5c6761e7230cec09ea705d5276f585dd0458e3b9","observation_id":"1ccaec45-27ef-4f44-b1ca-154e0ed79baf","resolution":{"observed_at":"2026-08-06T05:40:03.818205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.915633Z","title":"Point transformer","venue":null,"work_id":"56586c98-0583-4a0c-b18e-871671f357c3","year":2021},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.822684Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:3946eaef622b4284cc2ea15386cb49db879cabb41aca1684eeb685f7f4a150e1","observation_id":"dedc7ccf-7714-4e97-918b-d3c5dbc888fd","resolution":{"observed_at":"2026-08-06T05:40:04.920672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20279","last_updated":"2024-10-23T02:38:44Z","snapshot_observed_at":"2026-07-06T18:22:53.072592Z","submitted_at":"2024-05-30T17:33:10Z","title":"CV-VAE: A Compatible Video VAE for Latent Generative Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20279","snapshot_observed_at":"2026-08-06T05:40:03.827247Z","title":"Cv-vae: A compatible video vae for latent generative video models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.827247Z"},"links":{"cited_paper":"/paper/2405.20279","citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:d963782c235af39898c9fdea2672fb74d052b6b44409ec535bb3351de8a01555","observation_id":"a9e58314-9994-4bde-b334-7b66a04ba59a","resolution":{"observed_at":"2026-08-06T05:40:03.827247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.896107Z","title":"Michelangelo: Conditional 3d shape generation based on shape-image-text aligned latent representation","venue":null,"work_id":"bebe4ba3-11f9-48f6-a884-27d42ca24e24","year":2024},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.832101Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:00d5fa58e037f934f46b20a250047dfaf32b69ef574f3d0d02349b58d387a286","observation_id":"ca6dc4fc-fa22-485a-be8b-936ef24e5b2b","resolution":{"observed_at":"2026-08-06T05:40:04.902743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.878882Z","title":null,"venue":null,"work_id":"5bdaed28-20b2-4e1f-b1b6-1a3fa474bdd3","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.836610Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:20b3fbba28f2f42564635d2bf378fec13706ae36fb20125415be2e525acc44a2","observation_id":"d6cd2609-1226-48b4-b6ac-18a2214dc6f4","resolution":{"observed_at":"2026-08-06T05:40:04.884663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.857328Z","title":null,"venue":null,"work_id":"9d8d7f56-378b-4342-b664-bc8dd343980b","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.840919Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:cafda843b72d5cdd2013165b0eea4e83719dc7b48299ed9482b38a7dd8d35258","observation_id":"700fe0d0-ed9d-4a4f-8d90-00ca0a5f42ab","resolution":{"observed_at":"2026-08-06T05:40:04.862807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.840052Z","title":"Both Tab.2 and Fig","venue":null,"work_id":"018b64df-5322-44aa-bb66-7c9a21eefb0e","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.845254Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:9ea34b37d3ed08f1c1c4e6671255bb5e58eefe86721cac3d2b2e0ff7c462b8bf","observation_id":"d8a4fc10-ebaf-4fd0-9de2-b8252e747bfd","resolution":{"observed_at":"2026-08-06T05:40:04.845243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.819268Z","title":null,"venue":null,"work_id":"345bf8ff-887c-4dbc-bf54-b2e5fabafee5","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.850023Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8c88c176f43008271ca469d25c59cd89a6183b36a1aa4d11497efd126cf48311","observation_id":"0fd2ac06-a670-4ef6-833a-0220ba19cf2a","resolution":{"observed_at":"2026-08-06T05:40:04.826826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.799523Z","title":"Instead, we append the positional embed- ding only from 3DGS’s position","venue":null,"work_id":"aeb76664-1912-4cee-bdd8-f0f37430fa14","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.854815Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8dadf35444077a59bf27b8fbb4c065e47a3e0dfec8f3684efcc4900147d81a9a","observation_id":"c1d055e3-7fd5-404e-9f03-417964634248","resolution":{"observed_at":"2026-08-06T05:40:04.804581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.780751Z","title":null,"venue":null,"work_id":"a94fd650-84f8-4de1-aace-73c96044d8df","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.858984Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:7d28b9c3efa283300407669bff218f77eead8769fa2b50bb04e376b54cbad26f","observation_id":"1f49fa39-f321-48f4-8658-db266acdcf7f","resolution":{"observed_at":"2026-08-06T05:40:04.786515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.759666Z","title":"19, we demonstrate more results from our Can3Tok with various test scenes","venue":null,"work_id":"b2a83f0c-f7b9-4c15-acd9-2c757f7e66ef","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.863906Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:2d0ed0e5a429df4b819cce5ea64b3235a0620f113a15a305d6f403ac7e06f5dd","observation_id":"f9c0a4bd-b15a-419b-8a13-d0ebc82a621f","resolution":{"observed_at":"2026-08-06T05:40:04.766468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.740455Z","title":"Ground-Truth 3D Gaussian la- tents","venue":null,"work_id":"492dda87-2326-40ff-8dee-c8858a1d70b6","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.868920Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:8a7967a8493cee1c20e6654e382be3359e7a75fc6d4637d85c61701a21e73199","observation_id":"ec3709b4-2056-4d90-964b-11d62aa3ae8f","resolution":{"observed_at":"2026-08-06T05:40:04.745741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:40:04.720792Z","title":null,"venue":null,"work_id":"51e22d8c-71ac-47ce-90e3-7288283e7729","year":null},"citing_paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T05:40:03.873727Z"},"links":{"citing_paper":"/paper/2508.01464"},"observation_digest":"sha256:2045fcffbd4e4b4511ac663bfec68085fb7120383c2d86cfb231997d0ca6ee27","observation_id":"7af35ee7-a0d4-4860-94e9-047aa5539341","resolution":{"observed_at":"2026-08-06T05:40:04.726919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.01464","last_updated":"2025-08-02T18:43:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T00:40:24.027928Z","submitted_at":"2025-08-02T18:43:45Z","title":"Can3Tok: Canonical 3D Tokenization and Latent Modeling of Scene-Level 3D Gaussians"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 1 inbound Pith citation observation for arXiv:2508.01464."}