{"as_of":"2026-08-13T11:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:043728066be28e8a2a82d59cc912fb2e10be6a48d4f61bffed64cc39a6b93a6f","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:14:05.016060Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-15T10:49:28.959330Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:08:22.645266Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2412.11210","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11210","snapshot_observed_at":"2026-07-03T14:08:22.645266Z","title":null,"venue":null,"work_id":"707f3ac3-a7fd-4cfc-a92d-08a6a1ffba0f","year":2024},"citing_paper":{"arxiv_id":"2606.13460","last_updated":"2026-08-06T16:08:38Z","snapshot_observed_at":"2026-08-09T23:12:16.573866Z","submitted_at":"2026-06-11T15:15:34Z","title":"VISA: VLM-Guided Instance Semantic Auditing for 3D Occupancy World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T07:08:41.071757Z"},"links":{"cited_paper":"/paper/2412.11210","citing_paper":"/paper/2606.13460"},"observation_digest":"sha256:5908424252e101df1cb8c6f05ad9ca16d39c157e43aa5266fd62f2a8b1a58ee3","observation_id":"5fa41f78-919d-4190-9299-043c2ded2ed0","resolution":{"observed_at":"2026-07-03T14:08:22.646606Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11210","snapshot_observed_at":"2026-07-15T10:49:28.959330Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.13460","last_updated":"2026-08-06T16:08:38Z","snapshot_observed_at":"2026-08-09T23:12:16.573866Z","submitted_at":"2026-06-11T15:15:34Z","title":"VISA: VLM-Guided Instance Semantic Auditing for 3D Occupancy World Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-15T10:49:28.959330Z"},"links":{"cited_paper":"/paper/2412.11210","citing_paper":"/paper/2606.13460"},"observation_digest":"sha256:5c4def0b6dbec582ef2ed226afa0e8d4177bb95b005d6dfcb0b151fbda0d6293","observation_id":"c8a91825-72fe-4f8a-8cd5-55ac035ccb32","resolution":{"observed_at":"2026-07-15T10:49:28.959330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11210/citation-record","integrity":"/paper/2412.11210/integrity","json":"/paper/2412.11210/citation-record.json","paper":"/paper/2412.11210"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.515855Z","title":"Unsupervised Scale-Consistent Depth and Ego-Motion Learning from Monocular Video.Advances in Neural Information Processing Systems (NeurIPS) , 32,","venue":null,"work_id":"9b49ed06-4320-49e5-875c-c5263f721544","year":null},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.752447Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:8894176e578e8ee48fa1e5be67e441bb78ec2fd23e1c80b0f80f6d0bf3ae4751","observation_id":"383dadf1-89b8-418c-a874-4544d5805305","resolution":{"observed_at":"2026-08-11T15:14:06.524555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.447232Z","title":"MonoScene: Monocular 3D Semantic Scene Completion","venue":null,"work_id":"49103af0-476e-40a9-ac89-51de180badd1","year":2022},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.758788Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:06fb5d0c7bd03d13411365ed5616ae9d2c0ca1ec40a4bdca152d8bc3bb5b4026","observation_id":"1d5fb942-73b5-4481-b9fa-8ed9de002316","resolution":{"observed_at":"2026-08-11T15:14:06.475687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.408509Z","title":"Self-Supervised Monocular Depth Esti- mation: Solving the Edge-Fattening Problem","venue":null,"work_id":"342e9146-25f2-464b-b531-8305bee64b32","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.764842Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:bc23336157c2c3cc4de37d1972cd3c71e2c35026f05891233d024289d5e2139b","observation_id":"507c5887-5654-47fe-9aef-b5a702045d12","resolution":{"observed_at":"2026-08-11T15:14:06.431056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.368989Z","title":"The Cityscapes Dataset for Semantic Ur- ban Scene Understanding","venue":null,"work_id":"ccc7ea6a-ee8b-40a8-9db9-806d6185d9cd","year":2016},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.771647Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:52c965a1f44f5105ac0f2619c4b443b47416f147cd3599ed1d0efa04b51c2073","observation_id":"828bf54d-0621-4c2f-b07b-619e0429be7c","resolution":{"observed_at":"2026-08-11T15:14:06.377686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.342453Z","title":"ImageNet: A large-scale hierarchical im- age database","venue":null,"work_id":"8239db9f-0c49-4129-b91c-7eb2ecb792e1","year":2009},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.777744Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:0aa085580b4c6eb1cae383a4d09b3079f408fba716a8e7cbb472b8c18d51e6fe","observation_id":"9d88cb73-3b2a-4666-94ea-397c63b2fe66","resolution":{"observed_at":"2026-08-11T15:14:06.350767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.319677Z","title":"Vision Meets Robotics: the KITTI Dataset","venue":null,"work_id":"4c35e705-08f4-4fc0-aad8-036d52ca215a","year":2013},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.784184Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:d65187f5ebe03e8cc44c622043241acc87b9fbe719b6ef059003344675a99652","observation_id":"a25db425-2587-4117-97f4-2a19571dc478","resolution":{"observed_at":"2026-08-11T15:14:06.327419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.291246Z","title":"Digging into Self-Supervised Monoc- ular Depth Estimation","venue":null,"work_id":"eefc8c7f-e21c-4c7c-bc8f-5bdb485fe39d","year":2019},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.793484Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:e094bdfdb8d5577b54deaf4bd97e5e28a79b8cf48ad60048eb697eac33a68c06","observation_id":"8bdf8e45-1769-40c5-85e5-3f60f88d354c","resolution":{"observed_at":"2026-08-11T15:14:06.301242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.267530Z","title":"3D Packing for Self-Supervised Monocular Depth Estimation","venue":null,"work_id":"eee97a42-16dc-4c5c-932f-09d2c776995a","year":2020},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.800140Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:d98576c916a79a5222785d08c3f566d98756d0fd99fc6853c681851c6eb80196","observation_id":"623dbdfe-8990-493f-ae4e-d810185188c0","resolution":{"observed_at":"2026-08-11T15:14:06.278237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.12319","last_updated":"2020-02-27T18:40:10Z","snapshot_observed_at":"2026-08-03T03:52:20.819259Z","submitted_at":"2020-02-27T18:40:10Z","title":"Semantically-Guided Representation Learning for Self-Supervised Monocular Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.12319","snapshot_observed_at":"2026-08-11T15:14:04.805243Z","title":"Semantically-Guided Representa- tion Learning for Self-Supervised Monocular Depth","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.805243Z"},"links":{"cited_paper":"/paper/2002.12319","citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:41ec1e4aba0b356d7c73cc2e98a997c4b48298fd9001feb8bf3b2dd6787b676e","observation_id":"03dfcf2e-c253-42cd-bfc8-f1cbaa0e7302","resolution":{"observed_at":"2026-08-11T15:14:04.805243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.236552Z","title":"Boosting Self-Supervision for Single- View Scene Completion via Knowledge Distillation","venue":null,"work_id":"54ea8b61-ea60-4b1d-96d8-f64541b49d27","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.810536Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:70dbb0333c71ef640919e30d90deeba16e8976e1b33fdb499afae203b476e8e7","observation_id":"afee6274-9f2a-49e0-9890-e498bbe52152","resolution":{"observed_at":"2026-08-11T15:14:06.245627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.213735Z","title":"Deep Residual Learning for Image Recog- nition","venue":null,"work_id":"fcc53921-c4db-4b5b-8eb8-eccea62787d4","year":2016},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.819157Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:6684c187e7537c289e2e8f5fdb8df5f0d625fa3eac743c7e3261b9b82c402a89","observation_id":"e64153ca-8f24-48d2-bf0c-942f722efdf7","resolution":{"observed_at":"2026-08-11T15:14:06.219032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.197890Z","title":"Tri-Perspective View for Vision- Based 3D Semantic Occupancy Prediction","venue":null,"work_id":"a48fdd04-a91d-4463-8d2e-6a92067cc55a","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.825967Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:bc3c3e255c7ab8900a0ebcb902fda4dd8aafae207664767927d3a31ec3e2f0c8","observation_id":"4c187b64-dc8e-462c-be4e-2d90ea5e22c0","resolution":{"observed_at":"2026-08-11T15:14:06.202816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.168728Z","title":"SelfOcc: Self-Supervised Vision- Based 3D Occupancy Prediction","venue":null,"work_id":"8496a5a9-d16b-47d9-ac45-a992d689aa61","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.835149Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:3ff15d52c2efbb9fe865aced2f22a9161d2a9e5d7e9c2e2d7bb6f22a357b453c","observation_id":"b4288378-f893-4ef7-bb9a-4af97d91370e","resolution":{"observed_at":"2026-08-11T15:14:06.175814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.123933Z","title":"Fine-Grained Semantics-Aware Representation Enhancement for Self-Supervised Monocu- lar Depth Estimation","venue":null,"work_id":"6ee157df-b7fe-4900-a5c6-407ef1917289","year":2021},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.839617Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:c13bf69b2b9c248cc7560a6b4cb6eb509b4f6fad55e3fa21485d00e8fc40b0ff","observation_id":"73d5e894-4dd9-425e-aa45-482620d1edfd","resolution":{"observed_at":"2026-08-11T15:14:06.135894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.081471Z","title":"LERF: Language Embedded Radiance Fields","venue":null,"work_id":"f9e14ea6-09c1-4877-997f-a0f0e44ae6a8","year":null},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.844250Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:db1f6f1cb64c5e78d41a50358252e05d020b919fda117bcfd7995d30986ef97a","observation_id":"950ec73f-dbf5-479b-b456-50ac1482a5cb","resolution":{"observed_at":"2026-08-11T15:14:06.091540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:06.033182Z","title":"Segment Anything","venue":null,"work_id":"9de39dac-c9f0-47ae-9b96-d482a68b7416","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.850788Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:6fe3598f3da54868bc2f5e61ebc1d656ca48bf64b76548bfd8190c64ac142136","observation_id":"5dc71dc9-8739-4c5e-804f-f6477c920d5e","resolution":{"observed_at":"2026-08-11T15:14:06.039709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09414","last_updated":"2024-10-20T11:24:09Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:56Z","title":"Depth Anything V2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09414","snapshot_observed_at":"2026-08-11T15:14:04.855807Z","title":"Yang et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.855807Z"},"links":{"cited_paper":"/paper/2406.09414","citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:665b9356016f3f8a72d0ab771c54e47f6999d47c3659a419834d30bc7e495390","observation_id":"fbae4a32-baca-4080-b738-644b3665ba3d","resolution":{"observed_at":"2026-08-11T15:14:04.855807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.971416Z","title":"Know Your Neighbors: Improving Single- View Reconstruction via Spatial Vision-Language Reason- ing","venue":null,"work_id":"d479e1f8-b904-4839-a5c1-852252673d22","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.862083Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:03c6d1b71be219b4fc36de6080692fc9b7bdf38552778395f846aa7430188a04","observation_id":"3c3a6df3-86a9-4195-8d04-5b46ef947b32","resolution":{"observed_at":"2026-08-11T15:14:05.981019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.946127Z","title":"KITTI-360: A Novel Dataset and Bench- marks for Urban Scene Understanding in 2D and 3D","venue":null,"work_id":"3f77b76e-d94a-4586-932c-332641cf64e1","year":2022},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.867019Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:c61284cc9334404fdddba4613fd98f48829e11040e14227bd59474cb3f7b9eee","observation_id":"b2c4d5ab-96e3-40ce-9420-a579e5b3644d","resolution":{"observed_at":"2026-08-11T15:14:05.952131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.912604Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","venue":null,"work_id":"c3c93f38-2dba-4c9e-8bed-84ef2caa6c0c","year":2025},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.879525Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:a3b634b23c75aa7e581da0567ab2979e055e49888f2a97079c16b3d18e48dc06","observation_id":"149737aa-7f49-4e75-af71-90b8bc0d5bf0","resolution":{"observed_at":"2026-08-11T15:14:05.923135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.844013Z","title":"OpenScene: 3D Scene Understanding with Open V ocabularies","venue":null,"work_id":"6113c538-2f51-4f84-bdb5-823a2d02c8c8","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.884307Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:094e665bb5fb60173221d12247faeb38d60db9e3ff0cc069e57c315f4aea6b15","observation_id":"32f5e122-33fd-4b1e-846e-81826614309e","resolution":{"observed_at":"2026-08-11T15:14:05.866469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-11T15:14:04.889131Z","title":"Grounded SAM: Assembling Open- World Models for Diverse Visual Tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.889131Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:1ff52c7069d52f3b10b8c795cf1ff4caf64257e001f8dd4693e91299aeb72a3a","observation_id":"ff5c56d5-730a-4b61-92fc-cc430c418957","resolution":{"observed_at":"2026-08-11T15:14:04.889131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.808368Z","title":"R3D3: Dense 3D Reconstruction of Dynamic Scenes from Multiple Cameras","venue":null,"work_id":"eabc8f84-2c4b-4664-a03b-5102b6d2756f","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.894219Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:f291f97f759c78a31d4fa377ec97b9557801687338b7339264f2956670f7e40d","observation_id":"52e71ed8-71a9-4a71-af90-d60f8d446dde","resolution":{"observed_at":"2026-08-11T15:14:05.820147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.767624Z","title":"SwinDepth: Unsuper- vised Depth Estimation Using Monocular Sequences via Swin Transformer and Densely Cascaded Network","venue":null,"work_id":"2323104a-bd8b-4b8c-84e0-c9a2683ed71c","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.904046Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:5bdbe0ee53262419f30ee05774572363199b65e74932eafb2e9543ce8388ec7c","observation_id":"52acc328-5195-4c7f-bb5d-722de6b7dc2f","resolution":{"observed_at":"2026-08-11T15:14:05.785130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.730499Z","title":"SC-DepthV3: Robust Self-Supervised Monocular Depth Estimation for Dynamic Scenes","venue":null,"work_id":"c48f2159-6da7-4afc-bf1c-c6463069e64f","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.908920Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:cd1f8a0a8c0fbf8e029bd445ee66cd6c63b0e30d1a4b4ba457cf762ee839a2ae","observation_id":"345d6de2-6513-49f9-8f46-7fd03da93e34","resolution":{"observed_at":"2026-08-11T15:14:05.739100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.709338Z","title":"Dynamo-Depth: Fixing Unsupervised Depth Estimation for Dynamical Scenes","venue":null,"work_id":"a2b419f4-2cdc-4e2e-a473-d10d51b40e79","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.913812Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:ed2e8a73cca9c400f1021cdeac017cf27417961ea1d30de5547171928beccf27","observation_id":"8ce26d9f-4b8f-4d90-b913-77a032e619ae","resolution":{"observed_at":"2026-08-11T15:14:05.715727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.675070Z","title":"Occ3D: A large-scale 3d occupancy pre- diction benchmark for autonomous driving","venue":null,"work_id":"a6e766b3-3ba4-4868-90e8-427118238937","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.918926Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:42e5c010c0ff7e7950f342803769e26159c2f5f0d050e76b592e307fbc1fd911","observation_id":"048263ec-d8ac-4416-8ebc-e464a43b1a78","resolution":{"observed_at":"2026-08-11T15:14:05.690598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.656815Z","title":"InternImage: Exploring Large-Scale Vi- sion Foundation Models with Deformable Convolutions","venue":null,"work_id":"2fd5c2f6-4185-40ff-b880-8928a280da47","year":null},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.924323Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:730741872d8a40f59d9c354397ed4e093a7b8948e4b584725f5538435748f64d","observation_id":"c0b6a51c-4045-482a-8f2a-dee95fddf3e3","resolution":{"observed_at":"2026-08-11T15:14:05.663348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.620267Z","title":"SQLdepth: Generalizable Self- Supervised Fine-Structured Monocular Depth Estimation","venue":null,"work_id":"3c7b9843-22fe-43a4-a23a-84b6429c4a28","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.930391Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:458e73def3e594224e41fee18ef324c9a697815d1fd77cdffb2fc26d41104eee","observation_id":"6069beed-6421-402b-b7d4-362034b350ef","resolution":{"observed_at":"2026-08-11T15:14:05.630170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.581540Z","title":"The Temporal Opportunist: Self- Supervised Multi-Frame Monocular Depth","venue":null,"work_id":"ad5eca4a-58a7-45d5-a5fd-f0d69eda699b","year":2021},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.936755Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:306413b73d12955f0a8031b76916132c112802747ed3d92a86de191107565e0f","observation_id":"ce09b5b1-21a3-4634-84f2-4c9a7e2ea98f","resolution":{"observed_at":"2026-08-11T15:14:05.586737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.554433Z","title":"SurroundOcc: Multi-Camera 3D Occupancy Prediction for Autonomous Driving","venue":null,"work_id":"22d9222d-edaf-481c-85f3-a17eeb60675d","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.942740Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:240abf1d86aee91140442c7469a9f1e793ac89d8c0e0b9627372722ec09f0839","observation_id":"5da6d643-9469-4db3-b18d-769e4eccc918","resolution":{"observed_at":"2026-08-11T15:14:05.561169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.529516Z","title":"Behind the Scenes: Density Fields for Single View Reconstruction","venue":null,"work_id":"fb8b8d71-6e9a-4472-9bce-04882f5465eb","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.952016Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:4daf80a96a39f3bdebcea77a9ee24c410af3f2ac8e4be1b1523a65766c496ddd","observation_id":"2974ad1a-bc81-4931-9d9d-2d1b32ce4f0e","resolution":{"observed_at":"2026-08-11T15:14:05.543067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.489378Z","title":"Depth Anything: Unleashing the Power of Large-Scale Unlabeled Data","venue":null,"work_id":"dfe6b508-f9cb-40de-a484-57e9ca30432a","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.957182Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:996d31139814556e5b131450d13d8d7cab60eae3fe6118d482f6a022282b0ce6","observation_id":"b339f777-a486-4f05-9a4d-9a6adba28086","resolution":{"observed_at":"2026-08-11T15:14:05.498280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.468279Z","title":"Learning to Recover 3D Scene Shape from a Single Image","venue":null,"work_id":"f795a66a-c51c-4029-a50e-61479ffe927f","year":2021},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.961946Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:6309c586ae25519a46b281816d8bffe03aac0109d95d0e32e585f8388df86183","observation_id":"6bab17d8-a746-488d-830d-e63ded73274f","resolution":{"observed_at":"2026-08-11T15:14:05.474054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.438271Z","title":"GeoNet: Unsupervised Learning of Dense Depth, Optical Flow and Camera Pose","venue":null,"work_id":"178101ba-56b6-4af8-b44f-e6caa6938a09","year":1983},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.968525Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:1295cff81ceea81f2aab060f011c46a843e638f03887a3a7f3e829ecbaada845","observation_id":"fac9fe48-b630-4433-95a1-7f73d15b8b8e","resolution":{"observed_at":"2026-08-11T15:14:05.450814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.405790Z","title":"PixelNeRF: Neural Radiance Fields from One or Few Images","venue":null,"work_id":"ffdcf4a3-b911-4c87-83d6-2e6b2809e748","year":2021},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.977170Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:e0c0fe94dbff6d684362ad720517ea08c8ed74325a36941877bf1829e9583456","observation_id":"3032c79d-b99d-4ae3-b885-27e52f8a3c80","resolution":{"observed_at":"2026-08-11T15:14:05.414425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09243","last_updated":"2024-08-21T12:24:49Z","snapshot_observed_at":"2026-08-13T05:02:10.084220Z","submitted_at":"2023-12-14T18:58:52Z","title":"OccNeRF: Advancing 3D Occupancy Prediction in LiDAR-Free Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09243","snapshot_observed_at":"2026-08-11T15:14:04.984044Z","title":"OccNeRF: Self-Supervised Multi- Camera Occupancy Prediction with Neural Radiance Fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.984044Z"},"links":{"cited_paper":"/paper/2312.09243","citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:6d9c823b3c9b4122edbf6f6d1d10dfbf1fcf5cf8187bb08264cd9b843da17a53","observation_id":"dc334caf-654e-4fb7-8939-19c4e735fd66","resolution":{"observed_at":"2026-08-11T15:14:04.984044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.378510Z","title":"Lite-Mono: a Lightweight CNN and Transformer Architecture for Self-Supervised Monocular Depth Estimation","venue":null,"work_id":"7fab85cc-7e0c-4cf2-812f-ed9577a139ec","year":2023},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.989515Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:c3a8a2c499556a7f14d9cee38a1c10913a872e6827039fd247d87f5ba3918d8f","observation_id":"bcd080bb-726a-4685-bf65-bcb02e96611a","resolution":{"observed_at":"2026-08-11T15:14:05.386201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02595","last_updated":"2024-07-08T06:30:01Z","snapshot_observed_at":"2026-08-13T00:14:58.016726Z","submitted_at":"2024-05-04T07:39:25Z","title":"Vision-based 3D occupancy prediction in autonomous driving: a review and outlook","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02595","snapshot_observed_at":"2026-08-11T15:14:04.994318Z","title":"Vision-Based 3D Occupancy Predic- tion in Autonomous Driving: A Review and Outlook","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:04.994318Z"},"links":{"cited_paper":"/paper/2405.02595","citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:0c13f7dabcb7f0e3cc0b23a251d2079ef4e89ea13b18ac6a1010dbeacdde90a7","observation_id":"e380db5f-84ed-4926-994e-725929123f2a","resolution":{"observed_at":"2026-08-11T15:14:04.994318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.327403Z","title":"MonoOcc: Digging into Monocu- lar Semantic Occupancy Prediction","venue":null,"work_id":"dcfe2c30-f0a1-4353-822c-a48f198c35af","year":2024},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:05.000448Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:e2652e7aecacb7df952811c61b5dc1fab474b117a6ba793748768fa0b4116708","observation_id":"68f47aec-3bcb-404d-9341-53989d01d523","resolution":{"observed_at":"2026-08-11T15:14:05.353980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.224980Z","title":"bridge” and “tunnel","venue":null,"work_id":"50c9d91b-4711-4f8e-8903-045117475da6","year":2017},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:05.005232Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:c6092676ef4fbb5050c14067f98625dbf718c33955aa1c78129bca03c15d8c98","observation_id":"e781505e-ec56-49c6-960e-2b15a7155ae6","resolution":{"observed_at":"2026-08-11T15:14:05.271796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:14:05.184153Z","title":"The stereo image pairs with adjacent timestamps are fed into the network for image ren- dering and photometric reconstruction","venue":null,"work_id":"bde55629-995c-43e7-9307-497e9bd3f076","year":null},"citing_paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:05.016060Z"},"links":{"citing_paper":"/paper/2412.11210"},"observation_digest":"sha256:c34346942078e0bccf1bf9dbaf293ea5ba8b46d52556fff7b2f9941acd7fe673","observation_id":"d96982f8-4f84-4080-8d39-3a86f2bf47cd","resolution":{"observed_at":"2026-08-11T15:14:05.193349Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11210","last_updated":"2025-01-10T07:26:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T21:15:17.744936Z","submitted_at":"2024-12-15T15:04:27Z","title":"ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":36},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2412.11210."}