{"as_of":"2026-08-22T18:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:63299b376972cc0cfe162f312e49a56d2003061373e47aa0134f7b38781aaf8e","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:39:39.094935Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:23:00.474963Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T13:20:26.035267Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12906","snapshot_observed_at":"2026-08-06T15:23:00.474963Z","title":"Catsplat: Context-aware transformer with spatial guidance for generalizable 3d gaus- sian splatting from a single-view image.arXiv preprint arXiv:2412.12906, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16144","last_updated":"2025-07-22T01:43:51Z","snapshot_observed_at":"2026-08-18T02:46:10.855189Z","submitted_at":"2025-07-22T01:43:51Z","title":"LongSplat: Online Generalizable 3D Gaussian Splatting from Long Sequence Images","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:23:00.474963Z"},"links":{"cited_paper":"/paper/2412.12906","citing_paper":"/paper/2507.16144"},"observation_digest":"sha256:b687b3d4c214ed030f81865ddf81d0d9c7c220159e98028704117b1e7e6ae53c","observation_id":"453592e5-1da4-48f1-942a-d4abe5ccb37a","resolution":{"observed_at":"2026-08-06T15:23:00.474963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12906","snapshot_observed_at":"2026-08-05T18:37:01.726566Z","title":"W.; Lee, S.; Yoo, I.; Lugmayr, A.; Chi, S.; Ramani, K.; and Kim, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14443","last_updated":"2025-08-20T05:58:07Z","snapshot_observed_at":"2026-08-13T12:25:40.354322Z","submitted_at":"2025-08-20T05:58:07Z","title":"Reconstruction Using the Invisible: Intuition from NIR and Metadata for Enhanced 3D Gaussian Splatting","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T18:37:01.726566Z"},"links":{"cited_paper":"/paper/2412.12906","citing_paper":"/paper/2508.14443"},"observation_digest":"sha256:94265f1cec0678f6e2526df3d28d9e77d06930b91f15607c2fa7c343e6d3310b","observation_id":"ef291725-01dd-4152-839b-1b9b5f9b695f","resolution":{"observed_at":"2026-08-05T18:37:01.726566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"cited_work":{"arxiv_id":"2412.12906","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12906","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catsplat: Context-aware transformer with spatial guidance for generalizable 3d gaussian splatting from a single-view image","venue":null,"work_id":"a6ff0d81-5d60-4566-aa96-d4b906f264e0","year":2024},"citing_paper":{"arxiv_id":"2604.14025","last_updated":"2026-04-15T16:07:18Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T16:07:18Z","title":"Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-10T13:13:42.052386Z"},"links":{"cited_paper":"/paper/2412.12906","citing_paper":"/paper/2604.14025"},"observation_digest":"sha256:0b7a6dd32d5a05032b8f85b0c60d23673d3f83a213f46d8deb14a4efeeee7dfb","observation_id":"96487200-cd14-4d77-9884-f0d5ed94ddc6","resolution":{"observed_at":"2026-05-10T13:20:26.038681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.12906/citation-record","integrity":"/paper/2412.12906/integrity","json":"/paper/2412.12906/citation-record.json","paper":"/paper/2412.12906"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T13:39:38.819023Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.819023Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0f1731ba63001df06da2ae85e1ff67eb8754ee207bde1895ab13a7ed2ee75ba2","observation_id":"908e4164-d7e6-477e-931a-69ad7da2b18e","resolution":{"observed_at":"2026-08-11T13:39:38.819023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.815297Z","title":"Vision-only robot navigation in a neural ra- diance world","venue":null,"work_id":"5902bed0-2c6b-4b17-9c43-6b3ff89e0f52","year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.823745Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f3a9dcecfa28cb6dd75699e8d2d0e3e5c7ba4a0d7adb2fe4009a0b98f1a7b1e5","observation_id":"6984006e-011b-4fae-a9d7-6d1818cf4fb3","resolution":{"observed_at":"2026-08-11T13:39:39.819093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.827720Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.827720Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:382a17f84064633cf4eac90677fe0bbf090368d55e9716953a5ced68b0af3e93","observation_id":"4a620873-b70f-4a12-85f5-84be5fd18e69","resolution":{"observed_at":"2026-08-11T13:39:38.827720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-11T13:39:38.831904Z","title":"Palm 2 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.831904Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:3ed5d30fea16c81aa23b1ae1b1c68161638994a555b3d962d40f94b8a198de6f","observation_id":"5360e644-0c70-428e-85b7-e521044474c4","resolution":{"observed_at":"2026-08-11T13:39:38.831904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01390","last_updated":"2023-08-07T17:53:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-02T19:10:23Z","title":"OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01390","snapshot_observed_at":"2026-08-11T13:39:38.836191Z","title":"Openflamingo: An open- source framework for training large autoregressive vision- language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.836191Z"},"links":{"cited_paper":"/paper/2308.01390","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c85e571c4077ff2d65039e3d4920c3479f78cc24c26ba7b256e27534953ba0e9","observation_id":"0ec392dc-6398-405b-b18b-4bf97d243667","resolution":{"observed_at":"2026-08-11T13:39:38.836191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.841291Z","title":"Mip-nerf: A multiscale representation for anti-aliasing neu- ral radiance fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.841291Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:e5cdd6942855e5b2814f619c5eff266430c18737457c5afbfe50746fdb13c525","observation_id":"c47b1e46-40b3-41b5-88b2-7cd3650ade03","resolution":{"observed_at":"2026-08-11T13:39:38.841291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T13:39:38.845053Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.845053Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:e9cf9ab8d9731a7190a94b9a6878c0a9659b9518bccef4f5263c1988866dc6cf","observation_id":"784fea98-0bd9-4999-9298-4541114f8153","resolution":{"observed_at":"2026-08-11T13:39:38.845053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.791238Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":"1fb6cf9c-045e-4461-ae10-e2c11c4c6606","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.849426Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f543e05f11b5dd02513f152d416a2a6df5a7e9e546a54a0e09055e7e63e1cf84","observation_id":"1e87f656-f50a-47d2-8320-4284dbed6bb6","resolution":{"observed_at":"2026-08-11T13:39:39.795315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.853283Z","title":"Tensorf: Tensorial radiance fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.853283Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:8f26855d28b3214db20ce2406c2d99bde3660afecfc34f86b5b197918aa79057","observation_id":"da38b39c-1019-4138-9976-621b6587e501","resolution":{"observed_at":"2026-08-11T13:39:38.853283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14627","last_updated":"2024-07-18T13:10:22Z","snapshot_observed_at":"2026-08-18T09:51:43.724737Z","submitted_at":"2024-03-21T17:59:58Z","title":"MVSplat: Efficient 3D Gaussian Splatting from Sparse Multi-View Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14627","snapshot_observed_at":"2026-08-11T13:39:38.857481Z","title":"Mvsplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.857481Z"},"links":{"cited_paper":"/paper/2403.14627","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:b7f992094916c9f39926d1eb30e5780cd7d2dbad1fcd0782f998b55777e427d8","observation_id":"00e1703b-2b86-484b-b528-e63d823758c3","resolution":{"observed_at":"2026-08-11T13:39:38.857481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.862332Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.862332Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:62b8e5ef156149de4b80bc8cbbde9ae819bfed6a8ea6eec279878cc4e92f2199","observation_id":"12aa9588-47df-4ad3-ad01-e8f92ff26f30","resolution":{"observed_at":"2026-08-11T13:39:38.862332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.768788Z","title":"Scaling instruction- finetuned language models","venue":null,"work_id":"6a7dd475-0b21-47dc-9e00-4b2940edd2a7","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.866105Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:7542c56da34e9d251939dd314da8ec14bd83bb99e4681d4e037187b0650cf004","observation_id":"d4bc92a4-9cd6-4b38-8ec5-29d871661eab","resolution":{"observed_at":"2026-08-11T13:39:39.772590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.870007Z","title":"Gaussian splatting: 3d reconstruction and novel view synthesis, a review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.870007Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ff1b92aab814206395f325952d6bf16af41ccb07d2e573df572d674ef63d8d26","observation_id":"1a13ef0d-b8f8-47aa-bca5-e95dcf82308c","resolution":{"observed_at":"2026-08-11T13:39:38.870007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.752003Z","title":"Learning to render novel views from wide-baseline stereo pairs","venue":null,"work_id":"388c7480-5f5a-4304-acd0-b97a59464819","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.873866Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:911f3e85142e25435683137c76d2467fc7a0b136f35670c52d346da1faf34beb","observation_id":"78e48487-1ac2-49b4-b411-f2c0af137b31","resolution":{"observed_at":"2026-08-11T13:39:39.755824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.741249Z","title":"The farthest point strategy for progres- sive image sampling","venue":null,"work_id":"dc01acbd-0fb4-4020-8167-0a669b39b053","year":1997},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.878017Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ba3c69bf0d1ad7aa3dbcc6a08e0c055bc73565d33a0168ac29d1ed28cc385c2e","observation_id":"e5037ab3-0dee-439f-807b-54c5f0a2f807","resolution":{"observed_at":"2026-08-11T13:39:39.745254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.729170Z","title":"Vision-language pre-training: Basics, re- cent advances, and future trends","venue":null,"work_id":"ba2869c4-c289-4cd8-ac03-29f7230623f4","year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.882504Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c4983023ffdf00c118d35da0ba4681847c23341d45ab1f3e5a1f16c4a9967be2","observation_id":"1d5ca7d3-a313-4699-90bf-d4a7ea96b858","resolution":{"observed_at":"2026-08-11T13:39:39.733471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.718228Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"17f4380f-64cf-442f-9389-214950922ca7","year":2012},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.887339Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f41e386f44a4e915288a1515677cb504fc391688ddc54f00377e1c92270ca737","observation_id":"a9a069b0-e871-4fbf-8461-9ddf11542d8f","resolution":{"observed_at":"2026-08-11T13:39:39.722259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.702586Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"24dab005-249d-47c9-8aef-aa429cb41509","year":2016},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.892610Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:94a1ffb3e4b7ddcc0d69884f92134d967c9486906bba4215146d9d8fa1121044","observation_id":"2bb959e9-fe8f-41e6-8315-7c8505b732e9","resolution":{"observed_at":"2026-08-11T13:39:39.707829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.690437Z","title":"Promptcap: Prompt-guided im- age captioning for vqa with gpt-3","venue":null,"work_id":"76feb3a3-b347-40e8-8841-7178e25e3960","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.897812Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:1bd68a29ba779ef6792ad6d10b11582b60aa82f76d5965ff7801d4d57b84b55d","observation_id":"c69172dd-f696-4767-ae3a-d3f3851d7c56","resolution":{"observed_at":"2026-08-11T13:39:39.694807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.677703Z","title":"Language is not all you need: Aligning perception with language mod- els","venue":null,"work_id":"33d8b930-511e-4a8f-acf2-55f0f525a7d0","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.901700Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:4df4fbd1a71eaf3daf0a91b6a65796b36b9c6c95d9ffd7726ee6f314578077b7","observation_id":"1e7e39a6-bc99-48da-951d-308b7b4ae41b","resolution":{"observed_at":"2026-08-11T13:39:39.681903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.905386Z","title":"Scaling up visual and vision-language representa- tion learning with noisy text supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.905386Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:d41acae8a3780badca00944b603607e8cbb673f1c2fc2407cf1f5aa0ec9952e4","observation_id":"01d0d8ce-7c77-4806-b89d-aabfa74a9464","resolution":{"observed_at":"2026-08-11T13:39:38.905386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.909543Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.909543Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:2fc9984019e31eaf980c5d63c0f956a0e90810cce1cd0a8d04512b9c2f290169","observation_id":"e3d67b9f-da93-42be-a7e0-ee8bd805e851","resolution":{"observed_at":"2026-08-11T13:39:38.909543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.913568Z","title":"Gen- erating images with multimodal language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.913568Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:8819098140beb9b101b51c612f8bad4f7add078a4342c09fcf260bbc110dd594","observation_id":"acf8ee5d-133e-4880-9523-e0b49c84b8d1","resolution":{"observed_at":"2026-08-11T13:39:38.913568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.916975Z","title":"Lisa: Reasoning segmentation via large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.916975Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:66b77c6a12307932478024f70a1165e0f4a1ce536c2f06aa8744ef574965449f","observation_id":"1018ffe2-2860-4b47-b99b-6618497fa324","resolution":{"observed_at":"2026-08-11T13:39:38.916975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.640325Z","title":"Mine: Towards continuous depth mpi with nerf for novel view synthesis","venue":null,"work_id":"e25bd7e9-847e-4431-8579-9a5308b81a00","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.921055Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:a5c069e09d22217be0db944f51ca568d737ce5b909987552084ad2796e40a1ca","observation_id":"5c74d4ed-d4d7-44df-9d78-96779b053164","resolution":{"observed_at":"2026-08-11T13:39:39.643920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.924530Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.924530Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:084e7cee0fbeb680f059da7209bf15213df856806f39f57ee5aca675a9c6baa0","observation_id":"ca88e672-2ed5-4a17-ae35-f20b81d362aa","resolution":{"observed_at":"2026-08-11T13:39:38.924530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.622645Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"ce4cf53c-fe09-498d-8f8a-35c4752ae5d0","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.928747Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:2bb4c31f09416727e51b7cba6f39749fa6710a11bdab4bd02b6dc3fc43dcd20e","observation_id":"de219c11-abb8-45c9-b838-103f3c447947","resolution":{"observed_at":"2026-08-11T13:39:39.626517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.611987Z","title":"Infinite na- ture: Perpetual view generation of natural scenes from a sin- gle image","venue":null,"work_id":"d0d766d5-85f7-4ff5-8a31-dfa7bff84453","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.932441Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:909643888600629b069fec789818a322bfd4adcbd9d758b46cd1acba452a1f9e","observation_id":"a49e2c53-e90b-4c4c-bdd3-fe9f6815e7e4","resolution":{"observed_at":"2026-08-11T13:39:39.615850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09625","last_updated":"2024-03-14T17:57:04Z","snapshot_observed_at":"2026-08-16T14:09:43.119784Z","submitted_at":"2024-03-14T17:57:04Z","title":"Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09625","snapshot_observed_at":"2026-08-11T13:39:38.936371Z","title":"Make-your-3d: Fast and consis- tent subject-driven 3d content generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.936371Z"},"links":{"cited_paper":"/paper/2403.09625","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:eb97bc80355ff3d320c47fac0b72726e8ba782fdfc4d0bf7b736369500be84ff","observation_id":"b3f36c8d-075c-40da-b4c1-f4c731aeb5b9","resolution":{"observed_at":"2026-08-11T13:39:38.936371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.600429Z","title":"Visual instruction tuning","venue":null,"work_id":"98fbf71c-9550-41bc-b7ab-b81b7a5132cf","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.940640Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:1824ab87116e68499db551f6fa91fe7734c91e73be9d05365f251bf2c0c079a1","observation_id":"4ef8705c-dfe9-41fc-8cd3-7134fb8d607f","resolution":{"observed_at":"2026-08-11T13:39:39.604369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07751","last_updated":"2019-06-18T18:21:46Z","snapshot_observed_at":"2026-08-14T16:13:43.526790Z","submitted_at":"2019-06-18T18:21:46Z","title":"Neural Volumes: Learning Dynamic Renderable Volumes from Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07751","snapshot_observed_at":"2026-08-11T13:39:38.944421Z","title":"Neural vol- umes: Learning dynamic renderable volumes from images","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.944421Z"},"links":{"cited_paper":"/paper/1906.07751","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:a3158ec397e728cb0c6cab08b8a553be3d6f7afcd022b2323a397f6b79ac13ec","observation_id":"ea9b7f52-77bc-44b2-9c39-7df4ec57220d","resolution":{"observed_at":"2026-08-11T13:39:38.944421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07356","last_updated":"2022-05-03T21:31:58Z","snapshot_observed_at":"2026-08-16T17:06:46.101297Z","submitted_at":"2022-04-15T07:33:06Z","title":"Vision-and-Language Pretrained Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.07356","snapshot_observed_at":"2026-08-11T13:39:38.948299Z","title":"Vision-and-language pretrained models: A survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.948299Z"},"links":{"cited_paper":"/paper/2204.07356","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c2a2f183b1809b959fb0b18f2adfdde53ef8eabe3fefb86f136dcb5e8121d346","observation_id":"79f379a9-7f8b-4a4e-ba82-20d597e5b7f4","resolution":{"observed_at":"2026-08-11T13:39:38.948299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.588476Z","title":"Cots: Collaborative two-stream vision- language pre-training model for cross-modal retrieval","venue":null,"work_id":"a623edaf-c44e-4e1f-b9ac-669994a21516","year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.952375Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:3240253bedeed1f6c353d4e65ad715fa8792a0728a0a3dc7b244d839af2de446","observation_id":"31e4748b-d10c-4f61-8834-a842a73ad383","resolution":{"observed_at":"2026-08-11T13:39:39.593069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.576268Z","title":"Nerf in the wild: Neural radiance fields for uncon- strained photo collections","venue":null,"work_id":"273883ca-d3cf-4839-a8f7-01e264f29688","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.955368Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:070fb6bc7d5cb1e29203ff1661e53e921eb225d05e7a822f9ddf279a29003f6d","observation_id":"38a3b9ab-1f99-4800-8e8b-ad4adf19676e","resolution":{"observed_at":"2026-08-11T13:39:39.580892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.959168Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.959168Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:67d5b35cbd90c4dd6000bfdd5cf6442213ba07772403f7685b1dcc2cc95c84cc","observation_id":"1b9c4201-17d0-499a-be1c-ec445ddac3dc","resolution":{"observed_at":"2026-08-11T13:39:38.959168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.962215Z","title":"Ocr-vqa: Visual question answering by reading text in images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.962215Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:04e4093cc8279c03d7edd8473cdfcbfc363dd7a304cc2e81c12b8a753be64fc2","observation_id":"e6420b45-0cc6-4f1d-8e5b-b09aca9f5c88","resolution":{"observed_at":"2026-08-11T13:39:38.962215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.552595Z","title":"Improving multimodal datasets with image captioning","venue":null,"work_id":"a999fa10-05e0-45b1-bc9f-6a47d32d0368","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.965227Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:68c9b84390c86a396a65b4c2c1e894cd643134b2a7d5fcbf8f109c27bb0bcbbd","observation_id":"41be9556-44a9-46cc-9a22-64ecdfca567a","resolution":{"observed_at":"2026-08-11T13:39:39.556628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.541752Z","title":"Nerfies: Deformable neural radiance fields","venue":null,"work_id":"83d2bba7-ce19-4b88-842a-eab2c959d7dc","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.968096Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:2b7b6794d96c9b4e7667a111d4a80913f46abe90c292fc414b50ada855befaaf","observation_id":"aea87d3d-cf3a-4263-8493-03ba52afef8e","resolution":{"observed_at":"2026-08-11T13:39:39.545516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.531014Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":"f4baa963-e1c8-4869-a6ea-1c3d77028d9b","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.971173Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:2a76060dbaa91ba5189eb0ba4e3ef8d1ed13fffa56522d2cecdbf3aa23907e25","observation_id":"bfbfd61e-5caf-4fed-b58f-1f7caf512a82","resolution":{"observed_at":"2026-08-11T13:39:39.534789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.973955Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.973955Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:aaff34b123072af24e4bb674aed04ca613a33114ad34a9a9ca960dbd422956dd","observation_id":"9474adf2-c525-4cfe-ba7c-4a1387a33c53","resolution":{"observed_at":"2026-08-11T13:39:38.973955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.977213Z","title":"Nuscenes-qa: A multi-modal visual ques- tion answering benchmark for autonomous driving scenario","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.977213Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:559009280b5bef579c55b47eb669c56043dfe561842841126371049c46812c29","observation_id":"a6e771d4-749f-40be-8079-0038eded3ab5","resolution":{"observed_at":"2026-08-11T13:39:38.977213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.980260Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.980260Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0dcd4bdb4f45a1859cedb68b4833f1b3b56e7e16ea31bc4ae67ecbbbe42e7821","observation_id":"d0aaaedc-e740-434c-a811-466bc2c37a24","resolution":{"observed_at":"2026-08-11T13:39:38.980260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.498460Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"82d71456-3c64-41c0-b930-7e3a83a3e695","year":2012},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.984141Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:70975332460214bafa6fad9c85f507d4c65f97a241f31e1d27af365b8dd0d58b","observation_id":"37f695aa-2a91-4c6e-ac17-88999e5891f5","resolution":{"observed_at":"2026-08-11T13:39:39.502565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.487131Z","title":"Implicit neural representa- tions with periodic activation functions","venue":null,"work_id":"3e35f013-54be-4c3f-8180-8799c3237347","year":2020},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.987568Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:fc87d803603a13fdfbba7c75865d7a66d9f000c00170c2c4cc87073f02fbc5ed","observation_id":"feadb00c-089b-4d48-a632-b865b2633744","resolution":{"observed_at":"2026-08-11T13:39:39.491541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04343","last_updated":"2025-06-01T06:23:12Z","snapshot_observed_at":"2026-08-18T09:49:17.163809Z","submitted_at":"2024-06-06T17:59:56Z","title":"Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04343","snapshot_observed_at":"2026-08-11T13:39:38.990916Z","title":"Flash3d: Feed-forward gener- alisable 3d scene reconstruction from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.990916Z"},"links":{"cited_paper":"/paper/2406.04343","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:7fc880800973107b863137930708864db25dc16bfeecafe2264d74c2e7eb60b2","observation_id":"64df25a9-32f5-4a3b-8369-0a3ca7f25d83","resolution":{"observed_at":"2026-08-11T13:39:38.990916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.471847Z","title":"Splatter image: Ultra-fast single-view 3d recon- struction","venue":null,"work_id":"8ac7e751-c172-45cc-a119-7b9e75a021aa","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.994752Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:b731f1f64f1a5ada597894c0bdda7a51fca3c904f87c8d2a429e93d6955baf8f","observation_id":"aac36db2-a900-48e8-8feb-538f21a1199e","resolution":{"observed_at":"2026-08-11T13:39:39.476978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.02417","last_updated":"2022-08-29T15:46:14Z","snapshot_observed_at":"2026-08-18T16:27:31.843737Z","submitted_at":"2022-08-29T15:46:14Z","title":"Volume Rendering Digest (for NeRF)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.02417","snapshot_observed_at":"2026-08-11T13:39:38.998184Z","title":"V olume rendering digest (for nerf)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.998184Z"},"links":{"cited_paper":"/paper/2209.02417","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:4f502f0e395ef6bfe1b2511ad040462201196d9c0ce3d5435a3477fba13d6f8c","observation_id":"31947d4d-4376-4a64-9531-929858f70efc","resolution":{"observed_at":"2026-08-11T13:39:38.998184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T13:39:39.001898Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.001898Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c54deb44a1949db9f7126a29fbe6f271c436bec591c7ef030877dd78e0f846e1","observation_id":"63a58f62-cf5e-44e6-8fa8-674571b047ff","resolution":{"observed_at":"2026-08-11T13:39:39.001898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.460350Z","title":"Single-view view synthe- sis with multiplane images","venue":null,"work_id":"0500734b-69dd-47dc-85e4-869bb4e1ae59","year":2020},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.005460Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:87c4e11f93a0df56b0e7786d01971c4dd845bcb8defebae3f74f7099ca28f0ce","observation_id":"3af008f9-a64b-4ba3-a92a-269b425c830c","resolution":{"observed_at":"2026-08-11T13:39:39.464440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.448181Z","title":"Layer-structured 3d scene inference via view synthesis","venue":null,"work_id":"2eb35fa1-f8ab-4bf3-8fc3-d5bee95c1f4f","year":2018},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.009048Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0ab1a88cb76f3b6b73b447ab5b095ced8110b30e7c021a3008b479b90bc788df","observation_id":"1235899f-aef5-470d-b13e-0938d6a42d60","resolution":{"observed_at":"2026-08-11T13:39:39.452868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.013045Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.013045Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c6b8cd6969d284138a2137817c7118ff2735136a0c3eab0e81e7cf83f293f0d7","observation_id":"041f44e0-52a4-40b9-a65f-a3cf7e12e373","resolution":{"observed_at":"2026-08-11T13:39:39.013045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16292","last_updated":"2024-07-30T12:12:00Z","snapshot_observed_at":"2026-08-21T09:30:09.996958Z","submitted_at":"2024-03-24T20:48:36Z","title":"latentSplat: Autoencoding Variational Gaussians for Fast Generalizable 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16292","snapshot_observed_at":"2026-08-11T13:39:39.016371Z","title":"latentsplat: Autoencoding variational gaussians for fast generalizable 3d reconstruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.016371Z"},"links":{"cited_paper":"/paper/2403.16292","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:830ef0d3474cf10e19ceff242272045db3db3b6050905c0b5366ed15bb2caede","observation_id":"32022cd0-0d7d-4246-b5b1-4502c6508fe5","resolution":{"observed_at":"2026-08-11T13:39:39.016371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.019963Z","title":"Synsin: End-to-end view synthesis from a sin- gle image","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.019963Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ef88a23dae83a491e8c0d364f3fdd351a499fdfd124a022be1acbd52f7d9cd34","observation_id":"bba07e37-95dd-4cd8-aeb7-2b7158bba642","resolution":{"observed_at":"2026-08-11T13:39:39.019963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.419455Z","title":"Behind the scenes: Density fields for single view reconstruction","venue":null,"work_id":"ee9c4ff8-b577-4283-872b-a175b603a1a1","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.024248Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:4ab190f50c48581a51044e6b4032f858e2356ffd727c1be73d9895dde57b2316","observation_id":"36053200-60ff-4474-b5fc-89a0d232e2ec","resolution":{"observed_at":"2026-08-11T13:39:39.424683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.028194Z","title":"Neural fields in visual computing and beyond","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.028194Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ac43ffbaf6e6b5e354cfa82e8eb88ca3e6b7a59b8efb63577cd6ca18aea497e0","observation_id":"cc74f264-9ca2-443c-bc44-4ee4bc8fc976","resolution":{"observed_at":"2026-08-11T13:39:39.028194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.031724Z","title":"Freenerf: Im- proving few-shot neural rendering with free frequency reg- ularization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.031724Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:fe4cab843be077ecf33be39e2bcb8fd9a46331bf60df804d86c7e1cf2f55b68b","observation_id":"d3eff62e-473d-46e7-b34e-cbc08d8dffa8","resolution":{"observed_at":"2026-08-11T13:39:39.031724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.396572Z","title":"Deformable 3d gaussians for high- fidelity monocular dynamic scene reconstruction","venue":null,"work_id":"1a9feaca-179a-4339-b1d5-776b40a90b3c","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.035991Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f2934889528bd10e9fcaa7de07b1f69cadadaafb7df1423922708194b2d91abc","observation_id":"83cfffc1-f225-4ea3-9a50-e7b75c8210e9","resolution":{"observed_at":"2026-08-11T13:39:39.400283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.385907Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":"bfcc5ac2-7b41-406a-93f7-7f1f5519ebf6","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.039082Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:e01ac070c8a7d6ea3897a8b3bcc21a23b1e1cb9c066d23f1b5b0d13aec265b90","observation_id":"ab8c75c9-5a8f-43e4-8c37-0c2a2f6a68dd","resolution":{"observed_at":"2026-08-11T13:39:39.389665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-13T15:12:42.567441Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-11T13:39:39.042630Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.042630Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:e7701f3057dff235450c5ae6061e209855e271789483beff935b14662c25a675","observation_id":"68958d69-dc04-4de4-9179-3794dde4978a","resolution":{"observed_at":"2026-08-11T13:39:39.042630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.046122Z","title":"Mip-splatting: Alias-free 3d gaussian splat- ting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.046122Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:25e725d50d3c4fb759ae4fb28532d7db4f3ab40987a6cf695baa999233d5034e","observation_id":"a3527777-bd63-423b-bb90-5cb9d0af4620","resolution":{"observed_at":"2026-08-11T13:39:39.046122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13770","last_updated":"2024-08-25T08:37:57Z","snapshot_observed_at":"2026-08-16T13:24:03.020051Z","submitted_at":"2024-08-25T08:37:57Z","title":"TranSplat: Generalizable 3D Gaussian Splatting from Sparse Multi-View Images with Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13770","snapshot_observed_at":"2026-08-11T13:39:39.048884Z","title":"Transplat: Generalizable 3d gaussian splatting from sparse multi-view images with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.048884Z"},"links":{"cited_paper":"/paper/2408.13770","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ef8779a0a9809d971fd582d305e9cdfca56ae007a61f24eed831c24ca8aca79f","observation_id":"5399fbc6-fd5e-421e-b653-624566fb1629","resolution":{"observed_at":"2026-08-11T13:39:39.048884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.052522Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.052522Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:1267bfc2e6cb7257217282dbcf385a603186cc0d97a18671da44b8d6c2169b89","observation_id":"70ccf237-83e3-42c6-8f5b-3831aed01842","resolution":{"observed_at":"2026-08-11T13:39:39.052522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-11T13:39:39.055848Z","title":"Opt: Open pre-trained trans- former language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.055848Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:40fecf89fc15a6e3c576cf39870029d86aabb1fd3378d8c6fdb85db42375b2b6","observation_id":"9dff31ac-6b09-4d84-9ac9-e2e3dd8f43ae","resolution":{"observed_at":"2026-08-11T13:39:39.055848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.360774Z","title":"User: Unified semantic enhancement with momentum contrast for image-text retrieval","venue":null,"work_id":"9f21b308-0a07-4684-8216-510dc5591c14","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.060243Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:53f40dca6ff8b4838c19f54ecf44d7170528b454db6e245e2ee23259527ab3c7","observation_id":"33088fb0-1234-48bc-af78-205923204f50","resolution":{"observed_at":"2026-08-11T13:39:39.364492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-08-16T00:52:41.730888Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-11T13:39:39.064477Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.064477Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:8ed98ccd3215b71d7665afb99aa9ab37a83955369c9c7c7f60403d8f136d4cd7","observation_id":"e586970a-15f2-475f-9f97-e082891168b8","resolution":{"observed_at":"2026-08-11T13:39:39.064477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-11T13:39:39.068664Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.068664Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:41b757c23b24ce6d601af25a207755edb259ece89680cc612a3eb24e76e3f14d","observation_id":"219ce9ae-465c-446e-a782-1b9b12ddf79f","resolution":{"observed_at":"2026-08-11T13:39:39.068664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.349533Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Gen- eralizable 3D Gaussian Splatting from A Single-View Im- age","venue":null,"work_id":"4e4440e6-a632-4a1a-8b06-1e5fc030313e","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.073112Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:6de8a1c96a317a1fbe13b41236dc30dd6723e60e9af1954c5b2b8e60de0dd583","observation_id":"a516c8dc-6e83-49ce-a3e0-ea6bc82fa643","resolution":{"observed_at":"2026-08-11T13:39:39.353457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.334859Z","title":"Which of the two images predicts the target image better in terms of visual quality, such as object appearance, shapes, colors, and textures?","venue":null,"work_id":"b5320a6e-87d1-489d-bed0-2f97828c9f4b","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.078751Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:cd163449d6ce68bc5c9c0764a900c23980924244a7aa9240d8957542855179d5","observation_id":"08da7982-e48c-438d-9539-9615d557cca0","resolution":{"observed_at":"2026-08-11T13:39:39.340809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.323293Z","title":null,"venue":null,"work_id":"99194bc7-a8ce-4132-b76f-50d2dab91d93","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.083485Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:965a729e30039d1c638d8e4e372b3842939a11c8b7e65602d6e2ad05feb38616","observation_id":"761b3030-0030-4452-8ffc-9118baa1fce6","resolution":{"observed_at":"2026-08-11T13:39:39.327361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.311077Z","title":"Datasets RealEstate10K","venue":null,"work_id":"70c13aae-a8fe-4f22-b44d-686d007f7bb3","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.087260Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:14319f58993964c81b154f982bb79b5d24a7bada581ead65039721ab38ed96a1","observation_id":"9a45f0dd-9de5-4305-8d2a-bf0ff4705541","resolution":{"observed_at":"2026-08-11T13:39:39.314965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.298969Z","title":"Baseline","venue":null,"work_id":"656abd92-c087-4861-a6f8-cee59b1f8356","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.091411Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:3f447740ce3fa81d997426676b95ea5c8141de4f40745a2fe3ed54d4497d638a","observation_id":"7a68ef83-e07b-495a-af9a-152b6d525a7e","resolution":{"observed_at":"2026-08-11T13:39:39.302881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.286566Z","title":"Failure cases of CATSplat","venue":null,"work_id":"c585cbb5-5276-4b6f-b6d8-053c1748c2c6","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.094935Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:120c9589d55b93a13d89aad6d85994cbbd4c4b7c8d407ebd6410d60066783c3a","observation_id":"3d3b335e-dd81-47f0-9d54-b13d2e3ec33a","resolution":{"observed_at":"2026-08-11T13:39:39.291214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T09:49:45.226481Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 3 inbound Pith citation observations for arXiv:2412.12906."}