{"as_of":"2026-08-15T19:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22d46105e74308e27033f1eed9cd41dc01c77f41502491b7c52d80a6a403c6ee","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:16:33.517034Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:02:09.805290Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T11:16:10.727860Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"cited_work":{"arxiv_id":"2501.08982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08982","snapshot_observed_at":"2026-07-21T02:21:16.180868Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descrip- tions in Large-Scale Scenes with Gaussian Representation","venue":null,"work_id":"681aa6b5-714d-4d33-abb4-98ef614d8d7a","year":2025},"citing_paper":{"arxiv_id":"2604.11668","last_updated":"2026-04-13T16:14:49Z","snapshot_observed_at":"2026-08-15T18:58:34.450374Z","submitted_at":"2026-04-13T16:14:49Z","title":"UNIGEOCLIP: Unified Geospatial Contrastive Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:02:09.805290Z"},"links":{"cited_paper":"/paper/2501.08982","citing_paper":"/paper/2604.11668"},"observation_digest":"sha256:391debbe3869f5945edfd3167af3c956f49691a7532a92a515c8116adb8a52ac","observation_id":"323f6002-05bd-4913-9564-f5e7df1c8ac9","resolution":{"observed_at":"2026-07-21T02:21:16.180868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.08982/citation-record","integrity":"/paper/2501.08982/integrity","json":"/paper/2501.08982/citation-record.json","paper":"/paper/2501.08982"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:16:33.410526Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.410526Z"},"links":{"citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:df6935e5cef204f0ad4aa61c5f0624e41593bd0180f66730ae426fd8b5c19ab1","observation_id":"2f10ed4e-8564-4d68-bdab-656695e0afcb","resolution":{"observed_at":"2026-08-10T20:16:33.410526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-08-14T21:59:49.734209Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-10T20:16:33.418709Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.418709Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:a44b239f82352a0f2ab2ab26e53b513393dbe51e0a1010c264978305ed3c00d7","observation_id":"f3cd72d8-3b5c-4dfa-b850-c7a770d6e0c1","resolution":{"observed_at":"2026-08-10T20:16:33.418709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-10T20:16:33.422676Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.422676Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:ca73a282578ac7000f6faa40ffdcac95af66f4baaaa68fc1a85bad1be426e1ac","observation_id":"b3884f55-1d00-4b8c-b12f-3a49f40de958","resolution":{"observed_at":"2026-08-10T20:16:33.422676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-10T20:16:33.435623Z","title":"S., Yvon, F., Gallé, M., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.435623Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:e9c4037f69affa675e7447e41e51f563e1fcd6878a771789f3314efb94799c41","observation_id":"84dd559d-153f-4a57-a6b5-00a115b64aae","resolution":{"observed_at":"2026-08-10T20:16:33.435623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14217","last_updated":"2022-05-27T20:12:09Z","snapshot_observed_at":"2026-08-14T18:17:30.019563Z","submitted_at":"2022-05-27T20:12:09Z","title":"Diffusion-LM Improves Controllable Text Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14217","snapshot_observed_at":"2026-08-10T20:16:33.438807Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.438807Z"},"links":{"cited_paper":"/paper/2205.14217","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:36062e637341e5e913f77062de7d44d5216caa345eddb70142ce8af0c48a2b24","observation_id":"dd5fa7b8-53b6-44e7-aab3-31d7e9dd46cb","resolution":{"observed_at":"2026-08-10T20:16:33.438807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15947","last_updated":"2024-12-23T08:05:14Z","snapshot_observed_at":"2026-08-06T02:31:58.372974Z","submitted_at":"2024-01-29T08:13:40Z","title":"MoE-LLaVA: Mixture of Experts for Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15947","snapshot_observed_at":"2026-08-10T20:16:33.442729Z","title":"Matrixcity: A large-scale city dataset for city-scale neural rendering and beyond","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.442729Z"},"links":{"cited_paper":"/paper/2401.15947","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:f023463413b3bd4dff7ae92b3a8c9d02e6510b8522a2077c4662af15f19b7d55","observation_id":"5185af5a-df5c-40c4-9e85-39081a8202c8","resolution":{"observed_at":"2026-08-10T20:16:33.442729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-10T20:16:33.447148Z","title":"Spatio- temporal graph diffusion for text-driven human motion generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.447148Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:35ac49cd70477d7caf79345fd4a085ceceaee24dafa40d02b73e6649071780a9","observation_id":"0f061913-bce5-4c27-b813-55ead73fe6ae","resolution":{"observed_at":"2026-08-10T20:16:33.447148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.03530","last_updated":"2022-03-21T03:27:47Z","snapshot_observed_at":"2026-08-13T22:20:53.114955Z","submitted_at":"2021-12-07T06:59:06Z","title":"A Conditional Point Diffusion-Refinement Paradigm for 3D Point Cloud Completion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.03530","snapshot_observed_at":"2026-08-10T20:16:33.451097Z","title":"A conditional point diffusion-refinement paradigm for 3d point cloud completion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.451097Z"},"links":{"cited_paper":"/paper/2112.03530","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:8e0bb93ec54c32683c3e4950381d561c285068d4e4ae598548ad6ac8415fa07a","observation_id":"c8b84f47-5041-4918-8cb2-d4cadc978bc0","resolution":{"observed_at":"2026-08-10T20:16:33.451097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:16:33.455018Z","title":"URL https: //doi.org/10.1145/3528223.3530127","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.455018Z"},"links":{"citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:f298040eba801bcf86c415a2497eff8ea675e091bef9ce278e6a264f01777ab5","observation_id":"5d7d2848-b481-4976-b6a9-08c9a1c91498","resolution":{"observed_at":"2026-08-10T20:16:33.455018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-10T20:16:33.458582Z","title":"Ramesh, A., Pavlov, M., Goh, G., Gray, S., V oss, C., Rad- ford, A., Chen, M., and Sutskever, I","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.458582Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:aa98c60249fae723e559a3d91e713bfff38599b741abf5b2b3ed669828e3312c","observation_id":"ff343bd6-7914-4b52-a7c4-65efbfe9dea9","resolution":{"observed_at":"2026-08-10T20:16:33.458582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-10T20:16:33.462899Z","title":"Ren, B., Liu, M., Ding, R., and Liu, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.462899Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:da78b90992e7087d2754e50ba459619236517bcd5b292689db6de7c2e340a89b","observation_id":"df07b8d1-83e3-4e44-b311-ef02de45d24d","resolution":{"observed_at":"2026-08-10T20:16:33.462899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-10T20:16:33.466799Z","title":"Make-a- video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.466799Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:4f59384639988b5382d2399b477dc10399d2eedf199d69891cb69299a9890e25","observation_id":"08c60393-fdc2-420b-bf0e-0f80fdad4f3f","resolution":{"observed_at":"2026-08-10T20:16:33.466799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09031","last_updated":"2024-03-20T12:00:59Z","snapshot_observed_at":"2026-08-15T18:11:42.901130Z","submitted_at":"2023-12-14T15:31:33Z","title":"iComMa: Inverting 3D Gaussian Splatting for Camera Pose Estimation via Comparing and Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09031","snapshot_observed_at":"2026-08-10T20:16:33.477253Z","title":"icomma: Inverting 3d gaussians splatting for camera pose estimation via comparing and matching","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.477253Z"},"links":{"cited_paper":"/paper/2312.09031","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:24453669afdd40465909648d74bc6a0d94c840b6d207a61c021cad763266a556","observation_id":"a198f219-8f6a-42d4-b882-ca69f72b5e47","resolution":{"observed_at":"2026-08-10T20:16:33.477253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T20:16:33.482149Z","title":"Llama: Open and efficient foundation lan- guage models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.482149Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:ee3132a50e1212f8348db57d322eb4f8d7bed5c87764561d36dd29809df7a170","observation_id":"cb5367d4-7b0b-47d1-9e0b-3f7a23714875","resolution":{"observed_at":"2026-08-10T20:16:33.482149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00676","last_updated":"2024-05-01T17:59:45Z","snapshot_observed_at":"2026-08-14T15:11:12.049326Z","submitted_at":"2024-05-01T17:59:45Z","title":"Spectrally Pruned Gaussian Fields with Neural Compensation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00676","snapshot_observed_at":"2026-08-10T20:16:33.486595Z","title":"Spectrally pruned gaus- sian fields with neural compensation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.486595Z"},"links":{"cited_paper":"/paper/2405.00676","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:0f8b9d7ee37cb1a4654bc55ece79f7e320064330b2c5c1c3a4ec97a2ae74a51c","observation_id":"a0f22d12-23a6-4fc8-9beb-2c981c3e1ba7","resolution":{"observed_at":"2026-08-10T20:16:33.486595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-08-13T08:24:19.015641Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-10T20:16:33.490388Z","title":"mplug-owl: Modulariza- tion empowers large language models with multimodality","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.490388Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:cdcb74bca1338f8a410854d13d17fa1f33cdf9af8d438e9afc9b37de499e140b","observation_id":"376a3296-06c7-4991-a7e5-e58240abdf23","resolution":{"observed_at":"2026-08-10T20:16:33.490388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-10T20:16:33.498033Z","title":"A survey on multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.498033Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:796e9121b80be6e33585ce1442a71d39bb7c1ab4dc0b95bd99c5814b75ac2b6b","observation_id":"97158ab2-8b8d-4312-a4a7-7d60be11266b","resolution":{"observed_at":"2026-08-10T20:16:33.498033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07704","last_updated":"2023-10-11T17:55:15Z","snapshot_observed_at":"2026-08-12T17:07:18.793418Z","submitted_at":"2023-10-11T17:55:15Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07704","snapshot_observed_at":"2026-08-10T20:16:33.501832Z","title":"Ferret: Refer and ground anything anywhere at any granularity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.501832Z"},"links":{"cited_paper":"/paper/2310.07704","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:29c1d23f61faa4496828839470f9704bf5802c8e1ef86f6b36c1c88559ab2ede","observation_id":"f6c832f3-0148-4508-9cd8-2acb00edb7b9","resolution":{"observed_at":"2026-08-10T20:16:33.501832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04498","last_updated":"2023-12-18T12:15:26Z","snapshot_observed_at":"2026-08-13T05:30:05.715696Z","submitted_at":"2023-11-08T07:15:05Z","title":"NExT-Chat: An LMM for Chat, Detection and Segmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04498","snapshot_observed_at":"2026-08-10T20:16:33.505694Z","title":"Next-chat: An lmm for chat, detection and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.505694Z"},"links":{"cited_paper":"/paper/2311.04498","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:13cd45a365a35a562d4a8e2812860a027feaddaa3d4ca2fdc9288f9e6aadaeb0","observation_id":"3470eee5-4f32-451f-96d3-38bd064a9e36","resolution":{"observed_at":"2026-08-10T20:16:33.505694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:16:33.907661Z","title":"Denois- ing diffusion probabilistic models for action-conditioned 3d motion generation","venue":null,"work_id":"a9e07d29-ba3d-41e6-94dc-3173af1de851","year":2024},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.509589Z"},"links":{"citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:ef6d76fb046265906b297b786d88c1836fa1316f128052753999e44d0b53b2cf","observation_id":"25756e36-1633-46f7-b6a2-43d506ea5f0d","resolution":{"observed_at":"2026-08-10T20:16:33.913561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09637","last_updated":"2024-03-14T17:59:46Z","snapshot_observed_at":"2026-08-13T00:54:02.079090Z","submitted_at":"2024-03-14T17:59:46Z","title":"GaussianGrasper: 3D Language Gaussian Splatting for Open-vocabulary Robotic Grasping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09637","snapshot_observed_at":"2026-08-10T20:16:33.513420Z","title":"Gaussiangrasper: 3d language gaussian splatting for open-vocabulary robotic grasping","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.513420Z"},"links":{"cited_paper":"/paper/2403.09637","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:3dacfb20f62108b24d0d31d857895c5f800d5d8f921d8bd6e44f14bd406fe13a","observation_id":"bc9f89c8-ea6b-4992-84bf-329ad21cfc2d","resolution":{"observed_at":"2026-08-10T20:16:33.513420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-10T20:16:33.517034Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.517034Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:aa9ecd6f09e2ed00b7f18be86cc1596b72593bf44a650c74cf2956d52500301c","observation_id":"0c13b326-5a80-46c1-9117-41666341011d","resolution":{"observed_at":"2026-08-10T20:16:33.517034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-10T20:16:33.471953Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.471953Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:153442815a060664c14908042f7ea568de5367eb352bea0492b0021c7c6a00d8","observation_id":"4360e26d-7dde-40fb-a98f-9dbf5669683c","resolution":{"observed_at":"2026-08-10T20:16:33.471953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.05909","last_updated":"2016-02-18T13:30:25Z","snapshot_observed_at":"2026-08-14T22:31:40.976994Z","submitted_at":"2015-09-19T16:01:05Z","title":"Modelling Uncertainty in Deep Learning for Camera Relocalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.05909","snapshot_observed_at":"2026-08-10T20:16:33.426724Z","title":"Kendall, A., Grimes, M., and Cipolla, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.426724Z"},"links":{"cited_paper":"/paper/1509.05909","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:b0185202a0aa77c6acc558168b00d728d07c8abe172fac607ff09584602aed8b","observation_id":"25117963-00c0-49e1-84c7-0ebba65f032f","resolution":{"observed_at":"2026-08-10T20:16:33.426724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-08-13T14:42:26.982679Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-10T20:16:33.414800Z","title":"Shikra: Unleashing multimodal llm’s referential dialogue magic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.414800Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:6fca63ebf483716cdd20f89790cd8a1d2ef1c48bba8a9de82a0d686d13bc40ca","observation_id":"a87a513f-d453-4157-a3b7-70040ee15fba","resolution":{"observed_at":"2026-08-10T20:16:33.414800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T20:16:33.405260Z","title":"Qwen-vl: A frontier large vision- language model with versatile abilities","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.405260Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:a12cc9b7a5783df2a2399042d8e137d37adcbefe852bf6e6a649ba9af2b1d3fe","observation_id":"df772cc5-87ea-4661-8830-4188054c8779","resolution":{"observed_at":"2026-08-10T20:16:33.405260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00390","last_updated":"2022-09-07T04:14:48Z","snapshot_observed_at":"2026-08-13T17:24:02.447783Z","submitted_at":"2021-12-01T10:17:25Z","title":"SegDiff: Image Segmentation with Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00390","snapshot_observed_at":"2026-08-10T20:16:33.399901Z","title":"Segdiff: Image segmentation with diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.399901Z"},"links":{"cited_paper":"/paper/2112.00390","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:a926ba1d2f73ec102c4bdfc6328a37b4103824a29ec70b686ca86203a3918b54","observation_id":"22299a99-6eeb-40d8-a75f-cb8be1779926","resolution":{"observed_at":"2026-08-10T20:16:33.399901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:16:33.921237Z","title":"T., Rodriguez, A., Isola, P., and Lin, T.-Y","venue":null,"work_id":"df177221-0937-4cce-9f1d-bdb17142e71d","year":2021},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.494160Z"},"links":{"citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:ab1bdedd90eb01a385952218d0f1ef608883ec05f63e15c4b48c640fe8d64f8b","observation_id":"9199591f-6a8b-4840-afaa-643c369501d8","resolution":{"observed_at":"2026-08-10T20:16:33.925589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12080","last_updated":"2024-06-17T20:40:18Z","snapshot_observed_at":"2026-08-12T23:40:38.234311Z","submitted_at":"2024-06-17T20:40:18Z","title":"A Hierarchical 3D Gaussian Representation for Real-Time Rendering of Very Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12080","snapshot_observed_at":"2026-08-10T20:16:33.431529Z","title":"Kolmet, M., Zhou, Q., Ošep, A., and Leal-Taixé, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T20:16:33.431529Z"},"links":{"cited_paper":"/paper/2406.12080","citing_paper":"/paper/2501.08982"},"observation_digest":"sha256:56e2820273542a1fc71b6870f5c9e1d96adbade39ea53f152ec282542ac6981c","observation_id":"8c567c8e-004a-4a76-8eaa-87e7db3adb4e","resolution":{"observed_at":"2026-08-10T20:16:33.431529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.08982","last_updated":"2026-07-20T09:21:17Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T21:57:37.675916Z","submitted_at":"2025-01-15T17:59:32Z","title":"CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:2501.08982."}