{"as_of":"2026-08-14T16:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5563e572f7a76cc985e12d09ab28b0e211b0783e87818d0607f42fc14902cfe3","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:10:29.220185Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03851/citation-record","integrity":"/paper/2608.03851/integrity","json":"/paper/2608.03851/citation-record.json","paper":"/paper/2608.03851"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.14460","last_updated":"2023-07-26T19:01:49Z","snapshot_observed_at":"2026-08-13T10:47:18.882919Z","submitted_at":"2023-07-26T19:01:49Z","title":"MiDaS v3.1 -- A Model Zoo for Robust Monocular Relative Depth Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14460","snapshot_observed_at":"2026-08-05T11:10:29.045805Z","title":"Midas v3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.045805Z"},"links":{"cited_paper":"/paper/2307.14460","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:1cc62887b39cddfac28e092e20ff5248b86e6a5770255e5f5d1c1e024e17367b","observation_id":"d816899c-f40e-42f0-b90b-311051521ca4","resolution":{"observed_at":"2026-08-05T11:10:29.045805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.977961Z","title":"Transformerfusion: Monocular rgb scene reconstruction using transformers.Advances in Neural In- formation Processing Systems, 34:1403–1414, 2021","venue":null,"work_id":"f75d3094-4d8d-4eb8-a2bf-71ee81ae6612","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.051238Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:f20522c3579695faaa149339960aae53934d6e1877cb03d73e8cfe0c1ef745f3","observation_id":"9995b2a9-7359-4a09-8ad1-7b5c60b91dc4","resolution":{"observed_at":"2026-08-05T11:10:29.985163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11673","last_updated":"2024-01-22T03:22:49Z","snapshot_observed_at":"2026-08-14T14:13:00.430674Z","submitted_at":"2024-01-22T03:22:49Z","title":"MVSFormer++: Revealing the Devil in Transformer's Details for Multi-View Stereo","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11673","snapshot_observed_at":"2026-08-05T11:10:29.055982Z","title":"Mvsformer++: Revealing the devil in transformer’s details for multi-view stereo.arXiv preprint arXiv:2401.11673, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.055982Z"},"links":{"cited_paper":"/paper/2401.11673","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:b996b496c8f09ee37f925eda2124951328d393af446acde8837258b2a4a48e09","observation_id":"d204dec7-71a4-471f-892c-5df9c752cf99","resolution":{"observed_at":"2026-08-05T11:10:29.055982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-08-05T11:10:29.061950Z","title":"Robotwin 2.0: A scalable data gen- erator and benchmark with strong domain randomization for robust bimanual robotic manipulation.arXiv preprint arXiv:2506.18088, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.061950Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:75522d89a02ff0ce3d3eb5494c82f696097c6d3bcedca9a50e834f4a6a612cc3","observation_id":"6faf7283-a2ec-46de-95ae-9ca25da4c454","resolution":{"observed_at":"2026-08-05T11:10:29.061950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.067528Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.067528Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:4a0ab126320ac070dde9da22440ef18348a3d2229225bf1d541ba021265d4181","observation_id":"49f28371-44c7-4cd8-aa6f-1687a1b5ae04","resolution":{"observed_at":"2026-08-05T11:10:29.067528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.945025Z","title":"Deep- videomvs: Multi-view stereo on video with recurrent spatio- temporal fusion","venue":null,"work_id":"2179999a-2d52-4e24-8858-abde46ce598e","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.072612Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:57c45851f5b96cb0973b2fca3c857cdd9a399cbab87c7d3a2f42e13577c94df9","observation_id":"be67dd5b-6a92-4423-b771-5e6c26768152","resolution":{"observed_at":"2026-08-05T11:10:29.951471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.925246Z","title":"Predicting depth, surface nor- mals and semantic labels with a common multi-scale con- volutional architecture","venue":null,"work_id":"2a11c2e4-1917-4453-8632-f6980cb07413","year":null},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.077971Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:6363d409944813a90e72314400e92bb3cf9bdf511f7ee748c025eae8f5f98b74","observation_id":"83dacb93-e4b7-41b7-86ea-e19ec5a05f86","resolution":{"observed_at":"2026-08-05T11:10:29.930718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.905776Z","title":"Depth map prediction from a single image using a multi-scale deep net- work.Advances in neural information processing systems, 27, 2014","venue":null,"work_id":"8a0a3a62-1a5f-4b24-a429-d0dc509fbcd1","year":2014},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.083023Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:3ccfe2e32481e9947bf8dd466e11b7dd7b7f595d192e47d1deffa899f7e03994","observation_id":"63a40deb-f677-464c-b378-a85139493eb8","resolution":{"observed_at":"2026-08-05T11:10:29.911566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.889100Z","title":"Rpr-net: A point cloud-based rotation-aware large scale place recognition network","venue":null,"work_id":"00dfd2be-8b7a-46c4-833d-cc47bc980725","year":2022},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.087855Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:8cf85a81e6ec1b98f75827130a4171eeff64672c45ad46760c2e5965c80ca3dd","observation_id":"7175e3a0-9b7c-4ce4-8527-dcf2c5066c21","resolution":{"observed_at":"2026-08-05T11:10:29.894529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.871891Z","title":"Multi-view stereo: A tutorial.Foundations and trends® in Computer Graphics and Vision, 9(1-2):1–148, 2015","venue":null,"work_id":"beea9e89-2abe-478c-9c6c-0a21d92297ed","year":2015},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.092647Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:8550961886a7498578e81044b27c87adab599d77b60358a845e7a74941b08575","observation_id":"af88f880-4e63-430c-beab-a68e991d471f","resolution":{"observed_at":"2026-08-05T11:10:29.877525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.855172Z","title":"Multi-view stereo by temporal nonparametric fusion","venue":null,"work_id":"e0c24776-6a2b-4018-91e3-977860116ed4","year":2019},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.097773Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:c953a622a85021e198ad6e704d9883f5326ef99eb84705644e4acfe9ee750bbc","observation_id":"eaffe0f9-c9c6-4a9c-95e1-a76311284113","resolution":{"observed_at":"2026-08-05T11:10:29.860377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00538","last_updated":"2019-05-02T00:59:31Z","snapshot_observed_at":"2026-07-06T07:49:52.652287Z","submitted_at":"2019-05-02T00:59:31Z","title":"DPSNet: End-to-end Deep Plane Sweep Stereo","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00538","snapshot_observed_at":"2026-08-05T11:10:29.102749Z","title":"Dpsnet: End-to-end deep plane sweep stereo.arXiv preprint arXiv:1905.00538, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.102749Z"},"links":{"cited_paper":"/paper/1905.00538","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:c9a02c3420933d59f84e6b34d78cfb0cb7d3f452607d52a931ea1b09142fb124","observation_id":"2ea18035-e0d3-40e1-8acd-11e8671016cc","resolution":{"observed_at":"2026-08-05T11:10:29.102749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.838468Z","title":"Mvsanywhere: Zero-shot multi-view stereo","venue":null,"work_id":"4aaa46b5-a656-4145-be7e-1bd55411a747","year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.108730Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:40aaed87e3f428c5edc8e3f7dd9265798b7f7d816075e919eb732723dd06a69b","observation_id":"3624e518-6e4c-4cec-a431-cadaaada4a44","resolution":{"observed_at":"2026-08-05T11:10:29.844222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-08-14T04:21:39.686714Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-05T11:10:29.114403Z","title":"Fine-tuning vision-language-action models: Optimizing speed and suc- cess.arXiv preprint arXiv:2502.19645, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.114403Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:0e6b35aef93dcae00d84ccb52278912cba19c00915d1f84194e492921f798362","observation_id":"e2d0d5a0-9018-4463-91ff-4719925bbe1b","resolution":{"observed_at":"2026-08-05T11:10:29.114403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.119910Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.119910Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:f8950c6ecd6ae00daf01b5f3eec96c3a5597225d9bbd4d3750f282bbc4af5412","observation_id":"36f7a18b-a4f3-441f-b5bd-41f316396f5a","resolution":{"observed_at":"2026-08-05T11:10:29.119910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.125020Z","title":"Spatial forcing: Implicit spatial representation align- ment for vision-language-action model.arXiv preprint arXiv:2510.12276, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.125020Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:03f53ae972a20b36d5badf5ecf29ba62346c6545aea913f9b0a6318a91287e5c","observation_id":"a383b989-caff-462f-8f60-8e8c344311b4","resolution":{"observed_at":"2026-08-05T11:10:29.125020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.809108Z","title":"Libero: Benchmarking knowl- edge transfer for lifelong robot learning.Advances in Neural Information Processing Systems, 36:44776–44791, 2023","venue":null,"work_id":"9d900444-2bb4-44f5-9c2c-776c5b80982a","year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.130166Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:ee65692dc48e179de0be48e79771e23c38d798356cb1ff34f728f82182e30a86","observation_id":"06c19f4b-d283-438f-8831-6a94d2b8a05d","resolution":{"observed_at":"2026-08-05T11:10:29.814993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.791053Z","title":"Mixture of ex- perts: a literature survey.Artificial Intelligence Review, 42 (2):275–293, 2014","venue":null,"work_id":"e0479356-fc49-4c11-bc0e-be716c8c50e0","year":2014},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.135654Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:99b683edfb4fcdaea886805cd34ba66411b63ab53b5199e0f3ec97e1d930a7d0","observation_id":"c646e42a-d21e-4bed-9cc0-483e5f9eb10b","resolution":{"observed_at":"2026-08-05T11:10:29.797191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T11:10:29.141909Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.141909Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:c31c57172a8df3cc9e445b01c2b05e4219f2c2165af50035a6768c70a8ec71cb","observation_id":"c789e0ba-4cfa-4707-bb96-0458094f892c","resolution":{"observed_at":"2026-08-05T11:10:29.141909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.774760Z","title":"Simplere- con: 3d reconstruction without 3d convolutions","venue":null,"work_id":"59e74080-94d2-4848-96b5-9208047ae84e","year":2022},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.147201Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:90e11ad1c7a48246329f32c569d86a237f3ff143bfc96e04ac3cd17e1e3ab1d6","observation_id":"76db3f21-27c8-48dc-b316-e7e14395619c","resolution":{"observed_at":"2026-08-05T11:10:29.780019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.758286Z","title":"Doubletake: Geometry guided depth estimation","venue":null,"work_id":"f19056f3-fc26-4e04-8308-d5dede441edf","year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.154568Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:23308e93fccc1ee40e0d33adc5f4efa9bd464cd7341f492891bc1f1d3e133c2f","observation_id":"9d23dc17-7e3a-4c56-9d02-a833f6841d48","resolution":{"observed_at":"2026-08-05T11:10:29.764157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.741137Z","title":"Scene co- ordinate regression forests for camera relocalization in rgb-d images","venue":null,"work_id":"7014bd5d-94b4-40a6-8a0a-02ed5669c115","year":2013},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.159997Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:74478efa9d3a56c07ed2811540aaec21fad6b67a13a34099d7402cb3957075e2","observation_id":"2ce235a6-5087-4e5c-88b2-7fc31155977d","resolution":{"observed_at":"2026-08-05T11:10:29.746926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.723269Z","title":"V ortx: V olumetric 3d reconstruction with trans- formers for voxelwise view selection and fusion","venue":null,"work_id":"c9a159b7-362f-4946-9151-1d235c33d221","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.165860Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:797eab9afb328b6af1bbffa20f4b54db40b2166c1e3055c5f020ba7a492e14cf","observation_id":"71067505-83e1-4cf5-983b-2ef1109e789d","resolution":{"observed_at":"2026-08-05T11:10:29.728683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.705073Z","title":"Neuralrecon: Real-time coherent 3d re- construction from monocular video","venue":null,"work_id":"99b5fac1-4a7f-4281-9e20-5e5076812779","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.170560Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:316c04ebc8945fa89d27a5ac22d68cdfe82d2370111ee8b0fbe566299d6edee1","observation_id":"caf10882-c026-46ba-abaf-1893e31ef27d","resolution":{"observed_at":"2026-08-05T11:10:29.711453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.687843Z","title":"Depth from motion for smartphone ar.ACM Transactions on Graphics (ToG), 37(6):1–19, 2018","venue":null,"work_id":"09c356f0-acf5-41e1-a74c-6c104c4a1c26","year":2018},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.175604Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:2fd2b9e50e4bc4d20d837f8174b2d02d4652f07dd9e30b5f44c58b857635f4e2","observation_id":"bb826d9b-0abb-48cc-b56b-d34ff07256ad","resolution":{"observed_at":"2026-08-05T11:10:29.693815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.670716Z","title":"Vggt: Vi- sual geometry grounded transformer","venue":null,"work_id":"b265d652-c0f2-4a83-8891-15911042c0ea","year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.180429Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:ed71bf64195faeaedd0413b7223d17d1055bf84c8438db7501b6208542a91c38","observation_id":"9512cbed-47d7-4124-a9b0-58ece4c9846f","resolution":{"observed_at":"2026-08-05T11:10:29.676093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.651292Z","title":"Mvdepthnet: Real-time multiview depth estimation neural network","venue":null,"work_id":"cf26de8f-ccd5-42bd-8613-93527d3274c5","year":null},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.185545Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:9e4a605227bd8d83e9066bf22a364f9dd6f26c372d068058c2255d7ff5b95e68","observation_id":"e7388717-a1eb-412b-917d-0595ef5e160a","resolution":{"observed_at":"2026-08-05T11:10:29.657677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.190381Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.190381Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:01f2ac311db4a7a6dc582647052c120cacad3e17017b079a031ad90901207461","observation_id":"0de56fb5-1b57-43e2-8df7-0cafe9757f82","resolution":{"observed_at":"2026-08-05T11:10:29.190381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.617859Z","title":"Depth any- thing v2.Advances in Neural Information Processing Sys- tems, 37:21875–21911, 2024","venue":null,"work_id":"1d2e307d-2201-4c01-9d2c-6db838d76f13","year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.195444Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:211398a0267294e1309caeedcd69eb654a73f6cacf116314c683cfec1ff572ab","observation_id":"e2f8c282-f936-4d47-8c1b-38547b5b1141","resolution":{"observed_at":"2026-08-05T11:10:29.623688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.598638Z","title":"Mvsnet: Depth inference for unstructured multi-view stereo","venue":null,"work_id":"33303b06-1bd0-436a-b036-ebc747d37462","year":2018},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.200915Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:ec8222cb630832c27b37a36c096db70dddef311f9d9950be2efb431604ca57d0","observation_id":"0378cfd1-0e97-42ea-b911-560b669e5d01","resolution":{"observed_at":"2026-08-05T11:10:29.604009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.579090Z","title":"Stablenormal: Reducing diffusion variance for stable and sharp normal.ACM Transactions on Graphics (TOG), 43(6):1–18, 2024","venue":null,"work_id":"fab04ca7-bad2-4951-822e-3c764ae969e7","year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.205653Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:7de9e8e0462888157a543d45d27e4a32b21f041ecb3c1e1c043e38c0f1a6c37c","observation_id":"1968908e-f1df-4a93-8b4e-c2cb9bb79411","resolution":{"observed_at":"2026-08-05T11:10:29.585186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.558151Z","title":"Scannet++: A high-fidelity dataset of 3d in- door scenes","venue":null,"work_id":"6308d130-dd55-4fa7-8b9a-3e155d255f3d","year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.210240Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:de71a10aba022927907e71cc7196c8f26657ba91b954fecfb14b604404ff3fc3","observation_id":"1cf5216d-145c-4a31-a20f-d76757a0db71","resolution":{"observed_at":"2026-08-05T11:10:29.564327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.535322Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"0dd4aa19-2276-4dfa-a298-db3ec1722ef4","year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.215446Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:9459ec833946516f9caa9207663328666b23aef4560d26d3185d383fb0c4a090","observation_id":"9c625a1d-907e-4a65-8856-2f07d5651d3a","resolution":{"observed_at":"2026-08-05T11:10:29.543100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09579","last_updated":"2023-12-15T07:21:12Z","snapshot_observed_at":"2026-08-13T05:01:52.002912Z","submitted_at":"2023-12-15T07:21:12Z","title":"MobileSAMv2: Faster Segment Anything to Everything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09579","snapshot_observed_at":"2026-08-05T11:10:29.220185Z","title":"Mobilesamv2: Faster segment anything to everything.arXiv preprint arXiv:2312.09579, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.220185Z"},"links":{"cited_paper":"/paper/2312.09579","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:014fbdfe5711e96b41ecfa9dbd21380cc0eca484d98e1e79800cdb4c2d57b730","observation_id":"1376e2ce-61eb-4b83-9661-6a4a3a35b0f7","resolution":{"observed_at":"2026-08-05T11:10:29.220185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T18:02:35.194556Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.03851."}