{"as_of":"2026-08-09T22:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7d3565d769543cf1368963e64f5ef8896f1f96ee940f8f32f0f368632bc7e4e","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:35:49.944005Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:13:51.829966Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T08:15:32.522311Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02112","snapshot_observed_at":"2026-08-03T16:13:51.829966Z","title":"Sab3r: Semantic-augmented backbone in 3d reconstruction.arXiv preprint arXiv:2506.02112, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14364","last_updated":"2026-06-01T12:40:47Z","snapshot_observed_at":"2026-08-08T11:23:54.955713Z","submitted_at":"2025-12-16T12:49:35Z","title":"Unified Semantic Transformer for 3D Scene Understanding","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T16:13:51.829966Z"},"links":{"cited_paper":"/paper/2506.02112","citing_paper":"/paper/2512.14364"},"observation_digest":"sha256:f38b75778eea7070aaff9f454f526b051fc25868f3ad287fdcf346f770603068","observation_id":"ef85ed60-9e7b-4dc6-8349-a9adae6951d7","resolution":{"observed_at":"2026-08-03T16:13:51.829966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02112","snapshot_observed_at":"2026-08-03T06:33:36.869530Z","title":"arXiv preprint arXiv:2506.02112 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.22615","last_updated":"2026-06-24T05:37:55Z","snapshot_observed_at":"2026-08-06T02:53:10.366194Z","submitted_at":"2026-01-30T06:14:42Z","title":"TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T06:33:36.869530Z"},"links":{"cited_paper":"/paper/2506.02112","citing_paper":"/paper/2601.22615"},"observation_digest":"sha256:c254257c0074f58e34716a4243ce37d953d467ca000af41f710056339c39c8ab","observation_id":"1278ddf7-bae3-4d93-ba3d-87f7e99ade77","resolution":{"observed_at":"2026-08-03T06:33:36.869530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2506.02112","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02112","snapshot_observed_at":"2026-07-01T08:15:32.522311Z","title":"arXiv preprint arXiv:2506.02112 (2025)","venue":null,"work_id":"bfc4c294-c3b1-4346-b572-7d6eda9971c3","year":2025},"citing_paper":{"arxiv_id":"2606.14307","last_updated":"2026-06-30T10:03:58Z","snapshot_observed_at":"2026-07-31T03:54:17.412804Z","submitted_at":"2026-06-12T09:43:13Z","title":"Pano3D: Unified 3D Reconstruction and Panoptic Segmentation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T07:23:24.807344Z"},"links":{"cited_paper":"/paper/2506.02112","citing_paper":"/paper/2606.14307"},"observation_digest":"sha256:e2d925c7a260e920a029f1c93a543b185a3ab41cd09717241f05905e52b2a5ae","observation_id":"37e1b8f6-e3ad-4f94-a91d-ddac6652ad0e","resolution":{"observed_at":"2026-07-01T08:15:32.524449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02112/citation-record","integrity":"/paper/2506.02112/integrity","json":"/paper/2506.02112/citation-record.json","paper":"/paper/2506.02112"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:43.114483Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.114483Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:83411fe57890364125d1581abb66c78d2b24b7e0fbae90fec502a6c6972ade7b","observation_id":"91311425-7fa2-4c96-818b-f00ce3f8788e","resolution":{"observed_at":"2026-08-07T11:35:43.114483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.116335Z","title":"Building rome in a day","venue":null,"work_id":"3421f108-249b-4244-a599-24b23e9623f3","year":2011},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.221639Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:c75598d19630ce9ca04ec227ea682d3042448d61aefb82768be98efd50bd4d19","observation_id":"9b521cc4-0b51-4e70-8c47-ec7bec96f947","resolution":{"observed_at":"2026-08-07T11:35:52.121352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.103046Z","title":"ARK- itscenes - a diverse real-world dataset for 3d indoor scene understanding using mobile RGB-d data","venue":null,"work_id":"d45ed9f2-eab7-4acf-a214-679f3980e8b8","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.331448Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:ad6be83d47cf203bf80e43fb874b3991fd08b60cc842d2bb8cb211d4a85917b2","observation_id":"eeed7202-b3ef-4371-a5ec-043c682bd6ef","resolution":{"observed_at":"2026-08-07T11:35:52.107623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.087682Z","title":"Auto-rectify network for unsupervised indoor depth estimation, 2021","venue":null,"work_id":"0d06c66e-b464-4c80-8ce8-220f50eff82b","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.434902Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:b4b093867feae649c3825168ee6eb828e9a137bba38ffb989344d6fe4068549f","observation_id":"12ff697c-f277-43a0-858f-bde6fde3fbba","resolution":{"observed_at":"2026-08-07T11:35:52.092754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.073625Z","title":"Unsupervised scale-consistent depth learning from video.In- ternational Journal of Computer Vision (IJCV), 2021","venue":null,"work_id":"5547447d-7a4e-4e44-92fa-9e633699dbc0","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.518248Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:1399b83414110761dcad8e44dc5de86ee53cc7968c5b0933812289932ab6182a","observation_id":"76e9ef6a-95cc-4ebf-b402-87e05fab2f51","resolution":{"observed_at":"2026-08-07T11:35:52.077925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.059307Z","title":null,"venue":null,"work_id":"dc1784fd-fe56-402d-b34c-199606763d50","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.626746Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:16b00257a1029e3645685c3e59f221d92e65c6a07aaef244cb2b329dd80de086","observation_id":"648f101a-fd2f-44fb-9553-8ba0d5ad7ef2","resolution":{"observed_at":"2026-08-07T11:35:52.064605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:43.700295Z","title":"Emerg- ing properties in self-supervised vision transformers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.700295Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:b37d8a0c885fb0c4d5be6a0bf8972db15a6c8ab5da2c049c10abaeed209b3091","observation_id":"7d09f927-9b3c-4f9f-ad20-d2f2ffe31fec","resolution":{"observed_at":"2026-08-07T11:35:43.700295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.037982Z","title":"Learn- ing to generate text-grounded mask for open-world semantic segmentation from only image-text pairs","venue":null,"work_id":"fc904701-e8cb-42c2-9c71-d4f28ba7e7b3","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.799199Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e3f679704a44056f0c96a91605243786ee8d6bcbd3b4f6fcf8aa4f03711fa8f1","observation_id":"c6f31c4f-3b70-4a23-a397-8c11c08ddd01","resolution":{"observed_at":"2026-08-07T11:35:52.042548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.025053Z","title":"Scanrefer: 3d object localization in rgb-d scans using natural language","venue":null,"work_id":"d91b09e2-66f1-4d90-b78d-fe4caa93b223","year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.887582Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:2e74d664212481176d6b40670c1538d131ee3d474c64b07589d53bf3810008e6","observation_id":"b72797c4-c933-437e-9f89-6d23cb2dd066","resolution":{"observed_at":"2026-08-07T11:35:52.029188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.013082Z","title":"Chang, Manolis Savva, Maciej Hal- ber, Thomas Funkhouser, and Matthias Nießner","venue":null,"work_id":"50a2c53a-a466-4b58-bd0c-d6635ec8da58","year":2017},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.964579Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:0c2a3ec0949d1645c344a1aaf78b0f14bc60fe0339bbaa814a9999d066f06e2e","observation_id":"66f56ef5-635a-4cfb-ba5a-cdd142a33075","resolution":{"observed_at":"2026-08-07T11:35:52.017097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.000232Z","title":"Superpoint: Self-supervised Interest Point Detection and Description","venue":null,"work_id":"370acc3f-cb38-4172-9907-7d899e499c7c","year":2018},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.065817Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:c458a64de95ed53d0adee3b8fac2f7d2065d1dad8e0ebee19551b1f11b109523","observation_id":"81f91954-5485-441d-91c3-566f8310cf6d","resolution":{"observed_at":"2026-08-07T11:35:52.004163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.989210Z","title":"Maskclip: Masked self-distillation advances contrastive language-image pretraining, 2023","venue":null,"work_id":"7388cbc5-87f7-4645-8d36-f16374385891","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.143065Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:b021d53f9f026d0fd04856d6ddb61dd51d426b9841caa9b708207505b0165019","observation_id":"bbfbaa83-eca2-40b4-b503-c41f59022517","resolution":{"observed_at":"2026-08-07T11:35:51.993301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:44.242334Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.242334Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:99a909fd1ca04cfeb2c9857255eae29a1f318fb31f4e7b12d8ca8f08524d22c8","observation_id":"71f46731-491b-45f1-854b-e4dfc38f2636","resolution":{"observed_at":"2026-08-07T11:35:44.242334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.967605Z","title":"Everingham, S","venue":null,"work_id":"c73b6fc1-2ba2-4183-ae8f-0c0351a91b59","year":2015},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.334729Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:6480972c313e8e0b7a2864970087f1eb045efae1c2488d2eb81d80c2eb88fffb","observation_id":"ec8317ee-bf60-4e7d-9007-84154e3e42cb","resolution":{"observed_at":"2026-08-07T11:35:51.971639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.953999Z","title":"Nerf-sos: Any-view self- supervised object segmentation on complex scenes, 2022","venue":null,"work_id":"0dd6af55-70b7-419e-89f4-d83ba49a0e9c","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.485180Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:8c0854ad37d54448fab5ad7177730d619ba021504eae7a315665d5ea7ce35d9a","observation_id":"e4354394-2539-4e8a-9351-b78158a9defc","resolution":{"observed_at":"2026-08-07T11:35:51.959509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.929576Z","title":"Large spatial model: End-to-end unposed images to semantic 3d, 2024","venue":null,"work_id":"54d33daa-2c04-4e1e-a86b-bc1417436188","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.582649Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3079ec4988388f6a92ca3d17363c01c19c1f7f8fb3b072489e4fa13f25d6b775","observation_id":"f5d3233f-751e-49a0-a702-bdfb55f384d0","resolution":{"observed_at":"2026-08-07T11:35:51.934276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.916798Z","title":null,"venue":null,"work_id":"8ca354ce-c66a-4bee-9921-d17f883c578a","year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.676908Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:7f08c891e06887e979c3d188ef10df7c7baf24588b08be23d771f88fb8ee8dc1","observation_id":"1445ac99-5cbd-480e-8f14-a00413f52447","resolution":{"observed_at":"2026-08-07T11:35:51.921150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.905794Z","title":"Brandt, Axel Feld- mann, Zhoutong Zhang, and William T","venue":null,"work_id":"b0b55226-25ad-402f-8964-95bd5d7a4507","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.784954Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e835e9d38d548d0f3f312a82311d141bb9e94acfdc58412c800152051badc78e","observation_id":"4982176a-1beb-4372-87ad-70740d14f0bf","resolution":{"observed_at":"2026-08-07T11:35:51.908954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.894919Z","title":"Vision meets robotics: The kitti dataset","venue":null,"work_id":"2f5ebd73-c4d7-4cb4-b211-2cf6f2970dfb","year":2013},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.888834Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:433596a56e75690dbca4ef089fe3f0dc8167893972a38a70210ca7b4cbe0e2c1","observation_id":"1b376e47-611e-488d-ad8a-93ea0534c891","resolution":{"observed_at":"2026-08-07T11:35:51.898351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.884689Z","title":null,"venue":null,"work_id":"541edbfe-2b9b-4acd-9f51-1efe4be4ff30","year":2019},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.981550Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:9326112953d7960ed39a277aad740639cd1f8e52c14b87e07170d59448741d54","observation_id":"6998c1d7-0f65-4027-a0a0-62f1a2471fe9","resolution":{"observed_at":"2026-08-07T11:35:51.888143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.873264Z","title":"3d-llm: Inject- ing the 3d world into large language models, 2023","venue":null,"work_id":"cfb9ba1e-ac64-4399-aac0-986193ef0579","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.070769Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:9c46d25d665928005ec577915a79e6ffc409323a56ed55b46ac03b9612441b46","observation_id":"ddf4164e-7e08-406f-be5a-662e8a66b557","resolution":{"observed_at":"2026-08-07T11:35:51.877035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.863064Z","title":"Open- CLIP, 2021","venue":null,"work_id":"e17d6d47-87fa-429b-9b1c-141a5e8bff48","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.165900Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:266953c1afb53af95df0e66b8a5a3d5ff5f3bbdbf8b37c52e47c280e1580eb80","observation_id":"cc789746-3e24-48bc-ae90-4a4f50e0dcce","resolution":{"observed_at":"2026-08-07T11:35:51.866307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.851992Z","title":"Harley, Gabriel Sarch, Kriti Aggarwal, Vishrav Chaudhary, and Katerina Fragkiadaki","venue":null,"work_id":"0c8b5e76-582d-442e-bbda-ca437dcf0278","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.240879Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:58e7fca33367ce549b743b0481ad0b630c9cecfb78f3e5e52cb5e3504e1788fd","observation_id":"c98a0c46-02c7-45b9-bd95-7a2af6da0b7a","resolution":{"observed_at":"2026-08-07T11:35:51.856170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.841591Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"b8a643dc-5698-4ff5-b0ac-c436e3c75add","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.327215Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:78435562be231f810114843e4eefac63755e75332c4e83b77477f165fb359f5c","observation_id":"46dec75a-b4c1-4e1c-8b59-eed4098e7dd9","resolution":{"observed_at":"2026-08-07T11:35:51.845026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.830050Z","title":"Lerf: Language embedded radiance fields, 2023","venue":null,"work_id":"e435be81-e141-4179-8d93-594ec7ec5244","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.411674Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:5a0c2fb15e79b9f397c4d27a87373bf7cb6d9f278f51025332c73b26cc366612","observation_id":"bff80c38-3d24-4ce7-8d6d-5bea5bdeb378","resolution":{"observed_at":"2026-08-07T11:35:51.834398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.819339Z","title":"Anthony Movshon","venue":null,"work_id":"95d78585-f18d-4402-adc7-a1a27b11bf65","year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.521549Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e25b7ce10f8cc8889b3ce4c66c36246da1d684b7d0347225004ab8c32cc0ed43","observation_id":"75926e39-fe1c-4c71-ac69-89e09bcdc01c","resolution":{"observed_at":"2026-08-07T11:35:51.822636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.808858Z","title":"Large-scale localization datasets in crowded indoor spaces, 2021","venue":null,"work_id":"a20638a3-d812-4259-84c5-3286c9e8daa9","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.608495Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e37532f164731b95ff4cc64481fc11c818f3bc526c79d62f2cfd993105d1afbf","observation_id":"212030af-bd50-46f5-9de4-3ad79b432e4d","resolution":{"observed_at":"2026-08-07T11:35:51.811945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.798036Z","title":"Ground- ing image matching in 3d with mast3r, 2024","venue":null,"work_id":"394e1dde-6669-4d13-bad9-fabff7bda42a","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.685445Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:80ae87cc588e26c2aaab438c63d38da224d9d0622a42e404babcfff119e9a77c","observation_id":"58d3f9e7-e71a-4275-a80b-bb801834372b","resolution":{"observed_at":"2026-08-07T11:35:51.801736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.786737Z","title":"Ground- ing image matching in 3d with mast3r, 2024","venue":null,"work_id":"b61c2d89-5cea-4664-ad7e-ef48a6226ee4","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.760538Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:cf6a40a2f43ec4088f8d12eea4c26e5f8ffa710d7ece01cd2074b5a1401addd5","observation_id":"e2c5bc62-3fc1-44d9-801b-fdaeab25e133","resolution":{"observed_at":"2026-08-07T11:35:51.790495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.776343Z","title":"Weinberger, Serge Belongie, Vladlen Koltun, and Ren ´e Ranftl","venue":null,"work_id":"f282d1e2-eccf-47de-b08b-72d5139dafcb","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.833477Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:2535611bb2cb9e812927c85c97ec342961e7f35855a428a4a464bbd0506bb6ad","observation_id":"cbe6ccfa-1493-48eb-98af-650d0b09caaa","resolution":{"observed_at":"2026-08-07T11:35:51.779500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.764916Z","title":"Megadepth: Learning single- view depth prediction from internet photos","venue":null,"work_id":"ff80cdea-b682-47f1-b340-b0a77383b6b5","year":2018},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.903609Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:74430e70c7cfd345d18bb0c6e5f62ee7b07b37246b122fd0361b9c4e929e22c0","observation_id":"d7dd1132-a60f-4e54-9997-2de0e29fbd69","resolution":{"observed_at":"2026-08-07T11:35:51.768986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04926","last_updated":"2023-12-18T15:49:22Z","snapshot_observed_at":"2026-07-06T15:24:42.200476Z","submitted_at":"2023-05-08T17:59:58Z","title":"RelPose++: Recovering 6D Poses from Sparse-view Observations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04926","snapshot_observed_at":"2026-08-07T11:35:45.979580Z","title":"Zhang, and Shubham Tulsiani","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.979580Z"},"links":{"cited_paper":"/paper/2305.04926","citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e400ae7e24ed149cb240fe56db8d071cb8ce2dc31a8e7d9123fff9a8893ce31d","observation_id":"71b139c9-a07e-4ee0-89a3-4593acd345a4","resolution":{"observed_at":"2026-08-07T11:35:45.979580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.753393Z","title":"Pixel-perfect structure-from-motion with featuremetric refinement","venue":null,"work_id":"e2cbd182-cfa1-43ca-a9c3-187c8df40223","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.053268Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:780ee03e5c9b3c3e9d7fc849f908acdd4475acbfccc2f035b06e55d8f4309f5c","observation_id":"ab17ba16-b4d7-48d5-9a06-3a6170fe24fb","resolution":{"observed_at":"2026-08-07T11:35:51.756987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.742895Z","title":"Open-world semantic seg- mentation via contrasting and clustering vision-language embedding","venue":null,"work_id":"66544d91-9439-46df-aaee-b0eb9da2009c","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.132322Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:db32f5f27c2dc459836ea110535b0c2981f51beaaf04291fec6bf1234fa638ee","observation_id":"3ee27f1f-bd83-4b24-80cb-933c245fe13e","resolution":{"observed_at":"2026-08-07T11:35:51.746661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.732504Z","title":"Segclip: Patch aggregation with learnable centers for open-vocabulary semantic segmentation","venue":null,"work_id":"f3eb28e3-e25d-4880-81ed-52a4643f3679","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.226037Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:40a744b6e40ddfcac9e223843bbcf2a02ddc5eaf4345869b972b9a42f6b3bb3f","observation_id":"cd8054c0-2939-479a-a8e1-42d6e6ef5b55","resolution":{"observed_at":"2026-08-07T11:35:51.736390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.721713Z","title":"The three r’s of computer vision: Recognition, recon- struction and reorganization","venue":null,"work_id":"eaa15ebc-4f84-4049-975c-dd2afaf8941a","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.295263Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e39ca897c2da54d188aef340657801d3cd1e8dd2af6efb2e31948dcde07a86a5","observation_id":"c978e32f-fd38-486f-8538-76ed963cb51c","resolution":{"observed_at":"2026-08-07T11:35:51.725246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.709027Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":"0676c07f-a20e-48a9-b327-af68a4590e09","year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.365232Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:8190b4fa5ff7f9d53a52b2526b56523c329d61d6be2b2075182ae431b63384db","observation_id":"d5e0645c-6434-4826-8ea2-7271f6656253","resolution":{"observed_at":"2026-08-07T11:35:51.712736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.698350Z","title":null,"venue":null,"work_id":"891c6ac5-10f1-4dea-afe0-4c1439a8d19d","year":2015},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.456062Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:8c16bc5ae5e16870851669a2da63bf60d6d09af9ed0891bae82a2b7bfe3da075","observation_id":"cacb7a0e-e132-4398-99b4-650e20148149","resolution":{"observed_at":"2026-08-07T11:35:51.701391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.687269Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"1e3e7476-f5f6-466e-8cd9-916bca6405c9","year":2012},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.547443Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d9bcab278586516fcced79e0150f349e599af0fc3994ccdf5f4bc41aa196c8de","observation_id":"c321aa01-776b-4f72-a2e3-aeaaaf74ced5","resolution":{"observed_at":"2026-08-07T11:35:51.691158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.677010Z","title":"Robustmix: Improving robust- ness by regularizing the frequency bias of deep nets, 2024","venue":null,"work_id":"f880af40-c43b-473d-80f2-8f1d3a49e8ca","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.632356Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:5102a7d7c36a2f2a28bfbda947c6394957e00f82b3186674b9c97eefdbb5e4dc","observation_id":"dd3041f9-ba11-41ec-b63c-868c2e6818b1","resolution":{"observed_at":"2026-08-07T11:35:51.680581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.666452Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":"944c5c75-51d8-41b7-8909-5be353bd0a2b","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.730974Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3a194fa022ec6d4d28e8c97f86d9e102d2fb698c76f67cd370eb6f854654ad73","observation_id":"ed04bc09-a3fb-4921-a16e-9745ee5975fa","resolution":{"observed_at":"2026-08-07T11:35:51.669859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.656489Z","title":"Openscene: 3d scene understanding with open vocabularies","venue":null,"work_id":"4b5bf6e9-c607-42f7-983c-0fc0aa8f7479","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.817471Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3e47fc0de5257b03f8e6b5314c597c7ba3da6839d782a4cb9a8c5d3ae23a5849","observation_id":"c0c917d0-5824-4ee3-b730-1e04675e772a","resolution":{"observed_at":"2026-08-07T11:35:51.659929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.645538Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":"f2028203-426e-407c-a20f-e6c1d25611dd","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.908966Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:2b34f8e0706a5637cdbf70beb5c7f9d886db695078874124f46eb1dc07292779","observation_id":"31498249-1d4b-4d96-84dd-e646b0d1a080","resolution":{"observed_at":"2026-08-07T11:35:51.649173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.635464Z","title":"Per- ceptual grouping in contrastive vision-language models","venue":null,"work_id":"8b440a0d-65f9-47a9-ba25-88bd8315dd43","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.988812Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:35f6036d1c849113323ad55a6a8fc0bc38624882688d8f34efa57b00c5bb8745","observation_id":"e07deae9-8a06-4e7e-bb97-44d4ff4cc3e1","resolution":{"observed_at":"2026-08-07T11:35:51.638696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.625309Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"30454103-fd44-469e-bef5-d41f713148b1","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.087326Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d25bdacf644f7956f4af0824bd218c47b8d602e0155ebe2782c02afee4d38802","observation_id":"b5dabd5c-a84a-47e0-81bd-d28f07156c8f","resolution":{"observed_at":"2026-08-07T11:35:51.628723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.612894Z","title":"Com- mon objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":"aba24c16-ba55-4a34-80c4-4ef6cefead3e","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.179526Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:2f60d11f2da9fa0ae2bc179f4a26f6947931571146c33acce59ec5023aeabfd5","observation_id":"1c17a856-ef85-47f0-af46-69351b368b22","resolution":{"observed_at":"2026-08-07T11:35:51.617057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10307","last_updated":"2023-01-31T01:57:52Z","snapshot_observed_at":"2026-07-06T14:53:53.017634Z","submitted_at":"2023-01-31T01:57:52Z","title":"ViewCo: Discovering Text-Supervised Segmentation Masks via Multi-View Semantic Consistency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10307","snapshot_observed_at":"2026-08-07T11:35:47.274591Z","title":"Viewco: Discovering text-supervised segmentation masks via multi-view semantic consistency","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.274591Z"},"links":{"cited_paper":"/paper/2302.10307","citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:58eddcaa9afdda3556f4da418b3e3d336e10a847a550f8159dc139da9e5adfe3","observation_id":"3354fdec-2137-40b4-9653-b04915109701","resolution":{"observed_at":"2026-08-07T11:35:47.274591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.602606Z","title":null,"venue":null,"work_id":"a0dcd02e-b663-47d0-b64a-1d31afd728ad","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.349849Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d5bf9e097af7a37a9cd8c6fed30c4a80e7d34b833c39d27b9aaebf5d495ad823","observation_id":"83e3212d-177e-4c20-a25e-730457ea16b3","resolution":{"observed_at":"2026-08-07T11:35:51.605826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.591879Z","title":"SuperGlue: Learning feature matching with graph neural networks","venue":null,"work_id":"cdb242ec-285d-4fdc-9e0c-fc611fbd775b","year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.442494Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:f36b00d842f9c42d5f3f1c47aae367a489186e0f5c50d935dafed68c926efeb4","observation_id":"602488e9-cc86-4626-8d08-03be4624deec","resolution":{"observed_at":"2026-08-07T11:35:51.595625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.580776Z","title":"Habitat: A platform for embodied ai research, 2019","venue":null,"work_id":"f54b28fa-a99a-4a29-95aa-5538db3366b3","year":2019},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.538373Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:66fbf9eee600af7c2b7fd471d23d4ab26ce99b42120aa622d328b5bceb442f6d","observation_id":"bafcf3c0-138b-4617-b9ea-0aed6df42576","resolution":{"observed_at":"2026-08-07T11:35:51.584564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.569589Z","title":"Mask3D: Mask Trans- former for 3D Semantic Instance Segmentation","venue":null,"work_id":"c6f22927-4b41-4bbd-b9e3-5734919e2ff9","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.633748Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:12e6e62f24b874739805abafd279753eca3afdb823fb1c2c95155d85d3ba7193","observation_id":"993df610-cc53-48bf-8026-c902bc876f0e","resolution":{"observed_at":"2026-08-07T11:35:51.573942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.557914Z","title":"Sch ¨onberger and Jan-Michael Frahm","venue":null,"work_id":"f1e6dba9-97c4-4cfc-8ca6-dfb78aae18c0","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.704786Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e819fd1424c443e4ca8e87963365701f68ea7bdfb186d1eac137f8448b32dd79","observation_id":"ee8d8273-67e1-405b-8607-002af681d759","resolution":{"observed_at":"2026-08-07T11:35:51.561843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.546392Z","title":"Distilled feature fields enable few-shot language-guided manipulation, 2023","venue":null,"work_id":"2febd0c7-e47d-48ae-b35c-5c4c15f434e4","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.790089Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:5e920c5d80600592f898ee7e0e64828440f8a038c05f35081bc7221b6dfb6c63","observation_id":"36ac2833-a36e-4cb9-9295-3442efdfe612","resolution":{"observed_at":"2026-08-07T11:35:51.549888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.534559Z","title":"Panoptic lifting for 3d scene understanding with neural fields","venue":null,"work_id":"2ec9bc35-3e8a-4567-b1ac-418ec62f8d89","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.858399Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:406aa62376e3e13ea7acd98c3d4d8c62c125e44857c387ec47c4b63f513546de","observation_id":"402149f4-5e7a-42c7-9dbb-1d0990659894","resolution":{"observed_at":"2026-08-07T11:35:51.538401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.523527Z","title":"Kick back & relax: Learning to reconstruct the world by watching slowtv, 2023","venue":null,"work_id":"1a7ffeaa-337a-4238-8c70-da85b58a37cc","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.952230Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:858240e275f332eba8d2f9cfdaeaf8c572042e18a615f25f1a10a484bb3754d2","observation_id":"63bf56d6-f2b7-4b7b-8cb4-97968ac3d51c","resolution":{"observed_at":"2026-08-07T11:35:51.527064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.512209Z","title":"Efm3d: A bench- mark for measuring progress towards 3d egocentric founda- tion models, 2024","venue":null,"work_id":"ee19d4bb-5aae-45f9-9ea0-b513742965ee","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.064366Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:7436b466904174ed9eaa27ea8712e045c91ae82ab094cf2e4faa363096d77ac3","observation_id":"52204596-e21f-4107-94d0-58bdade8744d","resolution":{"observed_at":"2026-08-07T11:35:51.515908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.497835Z","title":"Sc-depthv3: Robust self- supervised monocular depth estimation for dynamic scenes","venue":null,"work_id":"490a096b-e374-4e7d-ae36-d3e17e685e88","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.151209Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:9c1cad2ef2466f57a11c61228e07ce3f789758363489629ca5d8a90d2b00df4a","observation_id":"bba1807c-2e3b-4dc7-858d-2029f398f9e5","resolution":{"observed_at":"2026-08-07T11:35:51.502696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:48.232906Z","title":"Habitat 2.0: Training home assistants to rearrange their habitat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.232906Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:fb4c04c5565d2f301196afda6ff6d2c2e66d0e22eef5d9c01da5905251dc83c8","observation_id":"5c6a23e0-9d7c-458b-9a3c-d4c7168458ba","resolution":{"observed_at":"2026-08-07T11:35:48.232906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.479289Z","title":"Droid-slam: Deep visual slam for monocular, stereo, and rgb-d cameras, 2021","venue":null,"work_id":"b6b8787c-fd0b-4616-9f20-4a91ac219e8e","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.306033Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:b348b47404cd02f7182fb3eaebfca2c52ec5fe85eebc8c7f4e67017566bf01a3","observation_id":"a90fefae-cc5a-49e2-8f3a-cfd4f8e0b2cb","resolution":{"observed_at":"2026-08-07T11:35:51.482810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.467002Z","title":"Neural feature fusion fields: 3d distillation of self- supervised 2d image representations, 2022","venue":null,"work_id":"4570c751-ed68-4091-9238-55070b0ebe09","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.404391Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:72ce179727ffe1d2c3a02fd42ade90129c53c2461e3fe7514480925cd13d8cf5","observation_id":"71f09928-7998-4e88-bd2e-9b574bd85da7","resolution":{"observed_at":"2026-08-07T11:35:51.471887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.449270Z","title":"Sam-clip: Merging vision foundation models towards semantic and spatial understanding, 2024","venue":null,"work_id":"3c87d970-0071-491e-a9f2-6ad5c7bf10ee","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.494754Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:68b9e19ff666947fcfb9578c16335d1a84e38dd9d5780b8c95edbfba9a1bb1cc","observation_id":"fbd8f1eb-ce5b-47a4-85ac-5c1b9bc995c5","resolution":{"observed_at":"2026-08-07T11:35:51.456446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.433421Z","title":"PoseDiffusion: Solving pose estimation via diffusion-aided bundle adjustment","venue":null,"work_id":"754e201b-1b85-47ad-9174-2385cbc9940a","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.604741Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:752e4d431502495e0c70ec621591645b517fd1f3a65ef19f6bad74fcfaa0f456","observation_id":"51eee655-0e7a-43c7-9ec9-6cba9806fc3e","resolution":{"observed_at":"2026-08-07T11:35:51.437354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.422440Z","title":"Vggsfm: Visual geometry grounded deep structure from motion","venue":null,"work_id":"fc860c22-5277-4539-a525-38003df4e93f","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.664786Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e8b630e4f92f331a5292764704432021b9495f7c76a879933d4d8ffdc198a1f1","observation_id":"342b5654-9e6f-4b1b-97c9-7411addd9de3","resolution":{"observed_at":"2026-08-07T11:35:51.426003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.410052Z","title":"Dust3r: Geometric 3d vi- sion made easy, 2023","venue":null,"work_id":"968db443-8435-4553-913f-c4142bd582b3","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.739432Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:afd591385f07e151708eca2b21b28628d2bade6d85217f21ef0b718c2258229e","observation_id":"731c0cf9-5d80-493c-9aed-4c20630e7ceb","resolution":{"observed_at":"2026-08-07T11:35:51.414362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.396970Z","title":"Point transformer v3: Simpler, faster, stronger","venue":null,"work_id":"d3a668f5-f1a7-406e-b9d2-cd9328bbf81a","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.793780Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:afc6f3e3675e575238243686f94a729dd50e0640428558606bf2c725706e7bba","observation_id":"1581f975-0c54-4994-9fcd-301dc7f3f454","resolution":{"observed_at":"2026-08-07T11:35:51.402094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.381111Z","title":"Groupvit: Semantic segmentation emerges from text supervision","venue":null,"work_id":"2a5709e5-5b90-41c6-a37b-4c1d053f1ef6","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.871079Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:594b9ce67d17c386c071e9d2ad3f2f1eb840eca40ad6be784672d1a141cdb2f5","observation_id":"68466f5e-102b-4f46-8db6-599f1391d35f","resolution":{"observed_at":"2026-08-07T11:35:51.384928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.369457Z","title":"Learning open-vocabulary semantic segmentation models from natural language supervision","venue":null,"work_id":"a2f7d16a-d73f-46e9-95f4-36f91311c982","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.947884Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:cfc8b3f77883f6606abf99d4f923b2f48a0d2513b77f06fe0f060a11dc736ef0","observation_id":"2c8031f5-711d-4aac-bdec-228c17792feb","resolution":{"observed_at":"2026-08-07T11:35:51.373074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.356651Z","title":"Llm- grounder: Open-vocabulary 3d visual grounding with large language model as an agent","venue":null,"work_id":"1d30b21d-1202-426f-82e9-c957658d32f4","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.008506Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:68a16e44f4e3494b9ddfe23eb1826a90d5e3463a6006fa00149449d342f0ae16","observation_id":"fec7c169-a3ad-4daa-aad6-4eadf6b50dbd","resolution":{"observed_at":"2026-08-07T11:35:51.360804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.345218Z","title":"Sat: 2d semantics assisted training for 3d visual grounding, 2021","venue":null,"work_id":"ee6891d3-0d6e-4a97-bdc7-7f1ed9d471c5","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.061222Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:bfce42c9bc469f0f2161270470e761779106e4894cebb2109d87bd7064fbcd3e","observation_id":"cf9feebb-3ee1-4493-9a27-2c0f6f7ad6ee","resolution":{"observed_at":"2026-08-07T11:35:51.349073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.331447Z","title":"Blendedmvs: A large-scale dataset for generalized multi-view stereo net- works","venue":null,"work_id":"caf60dee-68ac-4500-bba1-0acab3891e7a","year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.147726Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:c67b3570e897c9dd1e8350deef5b3ff86743deb1b035bec286a0e6b8c12f0359","observation_id":"f0c6f2a5-87a2-4e79-b06a-7cea8f1c596e","resolution":{"observed_at":"2026-08-07T11:35:51.336116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.315906Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes, 2023","venue":null,"work_id":"1fc1d9f8-0bcf-4ede-9102-994079c96c66","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.219678Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:636770717bb25e09c71ff0cdcc69a8a4097a18df19188c8d3ce1c216f14da254","observation_id":"4ef1f692-4f6d-43c3-8bed-f55d0b5599df","resolution":{"observed_at":"2026-08-07T11:35:51.320866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:49.316205Z","title":"New crfs: Neural window fully-connected crfs for monocular depth estimation, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.316205Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:b612e4d8c4106496af03631801e8ac0f83e2a017064f9d2848093485a95160b3","observation_id":"f130ae27-5b59-42c1-ba7a-9ca63ac4efd0","resolution":{"observed_at":"2026-08-07T11:35:49.316205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.289614Z","title":"Improving 2d feature representations by 3d-aware fine-tuning, 2024","venue":null,"work_id":"bd196471-00b9-4d8f-9b4c-ed15a017eb95","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.388161Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:96706e22fb45a99436414df7105e52cd56f1fdbe2a0747995aa0d27e57f76e7f","observation_id":"ff6e42f5-5f0c-4c82-a3fb-b7d84035d502","resolution":{"observed_at":"2026-08-07T11:35:51.294574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.272328Z","title":"Zamir, Tilman Wekel, Pulkit Agrawal, Colin Wei, Jitendra Malik, and Silvio Savarese","venue":null,"work_id":"a422b20b-d3d0-46fd-b3fe-32c590518eb9","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.461661Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3dfd515a493bb0930c82e58bbb67ca370a9b359f7e0e417be77b086c573ae8bb","observation_id":"c3477780-b666-48fd-92a9-a4e6c7550ec0","resolution":{"observed_at":"2026-08-07T11:35:51.278843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.229246Z","title":"Zhang, Deva Ramanan, and Shubham Tulsiani","venue":null,"work_id":"cf4d0527-954c-47ff-b176-d58b77d1401a","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.530204Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:ff7609ad5184674039c3fa8e409fd0d931c25e8efca30876a01e19847273bfce","observation_id":"7c8f82a9-6386-4afb-badc-a3cc518651a4","resolution":{"observed_at":"2026-08-07T11:35:51.241625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.182128Z","title":"Cameras as rays: Pose estimation via ray diffusion","venue":null,"work_id":"e8375e96-47f6-4003-bcc1-ffec4c297aa1","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.618703Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:03f7f3648c6e8841da83bd87db5f58205f2994e93c82a3059015b73679a80a7d","observation_id":"4a679178-7764-4e0d-9c3f-1c9544f914b9","resolution":{"observed_at":"2026-08-07T11:35:51.204739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.116129Z","title":"Monovit: Self-supervised monocular depth estimation with a vision transformer","venue":null,"work_id":"5b29a135-e55b-4d6e-b5b1-6673a5c66c24","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.678188Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:ba71b3b1b9a44569ac335bf1dac3606ad3a02c6492b93994dd70b9591b6bb3f7","observation_id":"c34ee000-bb65-4a4f-99a4-4e10a142b695","resolution":{"observed_at":"2026-08-07T11:35:51.155613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.858340Z","title":null,"venue":null,"work_id":"f2968a9d-f37b-476f-b992-2d235152f995","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.750319Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d7268a86be74b522fb664e8a98f75e75c92911a79904baa73b421e2d253f7a8e","observation_id":"f46042ae-3e9e-4065-b4ce-91a53ff9c3bf","resolution":{"observed_at":"2026-08-07T11:35:50.995357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.620079Z","title":"Semantic under- standing of scenes through the ade20k dataset","venue":null,"work_id":"8471c671-51d5-452c-8bf3-24c4648fc358","year":2019},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.807390Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:f6d105f5924be77e58c37c9a57b0a01754d399e4c317e8a35917ff87dbf17f22","observation_id":"d58f5ee6-3b8a-4d44-ad59-6f0897c399e0","resolution":{"observed_at":"2026-08-07T11:35:50.734147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:49.818911Z","title":"Feature 3dgs: Supercharging 3d gaussian splatting to enable distilled feature fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.818911Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:eecac7b8456a2ba8663cb89c13261460c7af02aedc63b81da54a3f501c2d8605","observation_id":"57d42441-85e5-4d14-8087-adb632a3a73a","resolution":{"observed_at":"2026-08-07T11:35:49.818911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.311291Z","title":"Unifying 3d vision-language understanding via prompt- able queries","venue":null,"work_id":"7b49d846-1c3a-4b87-9e2a-10663a1423a4","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.944005Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:fe189e623f055aa2a32927fc6cbc5aea0ef16fa77eefc4e3ea61bc1eef0c3896","observation_id":"8394186b-dede-41e1-9929-ef57c11e795d","resolution":{"observed_at":"2026-08-07T11:35:50.438211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":67},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 3 inbound Pith citation observations for arXiv:2506.02112."}