{"as_of":"2026-08-10T15:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65385e295fa674a7e9555d17388a17a930637e4cee9ff21f441ee3586da07c62","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:59:58.397834Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.04107/citation-record","integrity":"/paper/2507.04107/integrity","json":"/paper/2507.04107/citation-record.json","paper":"/paper/2507.04107"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.236762Z","title":"Cross- view geo-localization via learning disentangled geometric layout correspondence","venue":null,"work_id":"bb8dedfd-bf76-42a1-adec-b2b72301377e","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.170788Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:4a5ce8d10787428e8fb50420df86cc236b1252cd43468108507c7524d0eed448","observation_id":"78d3db44-97ca-4a42-a1f0-3dda4a40c54d","resolution":{"observed_at":"2026-08-06T20:00:02.282733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.138315Z","title":"Geodtr+: Toward generic cross-view geolocalization via geometric disentan- glement.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46(12):10419–10433, 2024","venue":null,"work_id":"7bb2bb1c-8dcc-491b-b7c9-09b2ba7f711f","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.265962Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:9743344afc70a4fc7fdeac611ad8c95d064b1dd1fd65076e893a3cbc320299f0","observation_id":"cc0a21ac-81be-46bb-9afe-55a87596eb27","resolution":{"observed_at":"2026-08-06T20:00:02.188211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.040339Z","title":"Sample4geo: Hard negative sampling for cross-view geo-localisation, 2023","venue":null,"work_id":"c58f667c-8333-409d-83ab-457a79168f10","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.366124Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:de8139ae1bbd9dc56b6b42bafa3ef8837a2b08edcd78f93e7bc93704755c1113","observation_id":"51535e6a-28ab-4516-a5e4-9da5197844d4","resolution":{"observed_at":"2026-08-06T20:00:02.085988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.894114Z","title":null,"venue":null,"work_id":"f2854c82-4dab-4191-9e59-171278c569b6","year":2020},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.457914Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:3e57ccf2ce8fb150fdc1c2992603f3f0cb76122975f89f27386a74e0f193d867","observation_id":"361e91e4-cfe7-45d2-a9b6-d504d1ebfd6a","resolution":{"observed_at":"2026-08-06T20:00:01.961848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.798180Z","title":"Simple, effective and general: A new backbone for cross-view image geo-localization, 2023","venue":null,"work_id":"7edd2587-0ad8-4084-8be6-75372e275042","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.567986Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:096c7bdae95d3a55a9b2c8460908528d071bb2321c36ea64574fbd8acabb54e1","observation_id":"08c2283b-36de-49ba-9179-1720f3eeb2da","resolution":{"observed_at":"2026-08-06T20:00:01.845653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.679407Z","title":"Cross-view image sequence geo-localization","venue":null,"work_id":"218df7c4-8833-470a-9e16-a2246d505a7c","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.662245Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:b1bcbaf712bdc2371af2720b9bb579742ff213767e51b78d6006f390e0488b52","observation_id":"15c5e641-33ff-40a3-923b-a7725dab6186","resolution":{"observed_at":"2026-08-06T20:00:01.739880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.565746Z","title":"Image and object geo-localization.International Journal of Computer Vision, 132(4):1350– 1392, 2024","venue":null,"work_id":"c20d54e1-5cf1-4b7c-9f10-8530db0abc11","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.732852Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:0814f43baafe401eb81afe1aa61d0f758b280d55e22c967b6438e54ea646cfdd","observation_id":"64749e2a-c4be-4d07-beb1-8d7ccdc0439c","resolution":{"observed_at":"2026-08-06T20:00:01.601861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.464495Z","title":"Congeo: Robust cross-view geo-localization across ground view variations","venue":null,"work_id":"821a707d-dde4-4b11-9ff5-47b4f1cea589","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.814147Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:3310c9410b00f153621e2c5c46f14bfb525ca184f97d523d3f39e1f57776e4b4","observation_id":"e214fb86-14c0-4985-b373-a48b0b33222c","resolution":{"observed_at":"2026-08-06T20:00:01.521389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.341650Z","title":"Where am i looking at? joint location and orientation estimation by cross-view matching","venue":null,"work_id":"55c7496e-c77d-4334-b29b-6dc51ee31c38","year":2020},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.900623Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:dcca9b42a9dc687ad8d05c63245b67116934e108e61be68d41d06b188ebc3974","observation_id":"b143a93e-034e-4227-81d5-b048bed5413c","resolution":{"observed_at":"2026-08-06T20:00:01.401813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.260919Z","title":"ChatGPT (july 5 version)","venue":null,"work_id":"ffd19981-1f26-4d4b-9eca-1886ad17801e","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.991079Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:84f86a032b38bb40b12fb66ec695cc84a189e9ef95282177bf679c988f9d9a53","observation_id":"0dd338d3-d795-4666-91e6-8f095baa6b9f","resolution":{"observed_at":"2026-08-06T20:00:01.304730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T19:59:56.090989Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.090989Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:8e5ff885483402e3eb5f67f9f78ca12a4339a66f300dce74a5db94bb25ed8ebd","observation_id":"8b730e93-6573-4d0f-bb63-d9289990f747","resolution":{"observed_at":"2026-08-06T19:59:56.090989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T19:59:56.185649Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.185649Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:f6234e6f7ea2ad622e5123c9fa33996613873a3e81dc9476b821e95b932a61f1","observation_id":"5e90a634-5ac6-45c5-bcd8-60a795198268","resolution":{"observed_at":"2026-08-06T19:59:56.185649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:56.285551Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.285551Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:bced2aa5dd5e5fe51d2f182331534bd4fac4643262fef56c4976237aa9c569a4","observation_id":"95c3f64f-b752-492e-9237-71b047f20534","resolution":{"observed_at":"2026-08-06T19:59:56.285551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.112445Z","title":"Bliva: A simple multimodal llm for better handling of text-rich visual questions","venue":null,"work_id":"e641e600-4f5e-4f5f-82a2-33e4347c37fb","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.375098Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:14e4c691fdb44302c282122e0b1c2991d646f31e6277c546183eab4395086b37","observation_id":"67a06082-dd56-4bd1-a519-07a2b9552059","resolution":{"observed_at":"2026-08-06T20:00:01.179598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:56.478898Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.478898Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:4de33d13c0de0b07be08d9110fbde2ec521ba7b67632f07672027705df22c331","observation_id":"268beff7-fb3d-47f0-a2c5-424e88e6ea37","resolution":{"observed_at":"2026-08-06T19:59:56.478898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.024317Z","title":"On the location dependence of convolutional neural network features","venue":null,"work_id":"181f5dfe-8449-464f-99fe-8ca5879c37ef","year":2015},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.584382Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:cc6ead1d88a9bcdae20fdeadffc2e3f0ecaa90b3bc96c5fda5db82e2bf478dba","observation_id":"6296c40b-d18d-4f95-a8d7-d23286ddb2a6","resolution":{"observed_at":"2026-08-06T20:00:01.060929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.871926Z","title":"Wide-area image geolo- calization with aerial reference imagery","venue":null,"work_id":"e7f3f652-2e92-464b-a494-154ca29b2eba","year":2015},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.684377Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:1a84566b89747072fa61aa5597144d1044b0a2404d5ff96e538fa4b785139992","observation_id":"2568873d-c0b2-4bce-af41-aee88d5decbf","resolution":{"observed_at":"2026-08-06T20:00:00.944050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.690433Z","title":"Lending orientation to neural networks for cross-view geo-localization","venue":null,"work_id":"e4ab63f0-8acf-4349-b250-ef21a8a7b809","year":2019},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.790502Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:7446f77199fe422b9a5127c9bd037189926f822d3f24e022b1db2765940e2002","observation_id":"964d0994-66d9-4fbf-a81a-aef3ffffb0a8","resolution":{"observed_at":"2026-08-06T20:00:00.781560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.502328Z","title":"Vigor: Cross-view image geo- localization beyond one-to-one retrieval","venue":null,"work_id":"85281de1-1e3c-4c5a-aab9-5f9c356c7395","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.854526Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:54b97859fe298cff782681cc56a246a44f853fe8cc0e4d05c4677038c82a60e6","observation_id":"1e53de9a-74e4-49f3-85b8-755e36f55040","resolution":{"observed_at":"2026-08-06T20:00:00.593733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.388206Z","title":"Spagbol: Spatial-graph-based orientated localisation","venue":null,"work_id":"052a7bbe-dae1-4a78-b716-0a507470ae7c","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.971164Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:29d0617ab1ae4b03e7335df3d0bd086c7e6be1a1ac9ae8aa5e54d40140de7d13","observation_id":"208ed397-bad6-4a5c-942c-191a7004b300","resolution":{"observed_at":"2026-08-06T20:00:00.445431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.215505Z","title":"Peng: Pose-enhanced geo- localisation.IEEE Robotics and Automation Letters, 10(4):3835–3842, 2025","venue":null,"work_id":"8a881dd4-987f-482c-9010-4290f4cfc67c","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.054535Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:39c9e7c53eec13a1c2d8d9d88727f16b0a3df6b529e9c82ec12474d4d1479534","observation_id":"1c714b9a-035b-496f-b641-407bfa26b0e9","resolution":{"observed_at":"2026-08-06T20:00:00.295591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.032479Z","title":"Cv-cities: Ad- vancing cross-view geo-localization in global cities.IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing, 18:1592–1606, 2025","venue":null,"work_id":"334f4e30-b8a8-45e6-904c-8b64a427a7de","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.122545Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:a84c08e4a4aa7caa87719d9e0b8bb2d1e55ff76a8461ac04c4f6335a0923b802","observation_id":"aa69a88d-430e-4b7c-ac21-a09805f02dd6","resolution":{"observed_at":"2026-08-06T20:00:00.121176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:57.231091Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.231091Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:85e14aa4c08a851302ccd8c00669edf86e22026803231d5629568ea53518b5fb","observation_id":"ba34a03d-365a-46a3-9ec2-07fbc5e6df3d","resolution":{"observed_at":"2026-08-06T19:59:57.231091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.862184Z","title":null,"venue":null,"work_id":"7cb81dfa-39e9-4061-8d09-1dea89bd0605","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.328530Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:18bcb389d249bf22a68790e08ad232ea501a0179dc39b81f14f401f4e4712286","observation_id":"263785b6-2d95-49bd-abed-4f5e4520ee05","resolution":{"observed_at":"2026-08-06T19:59:59.935333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.704487Z","title":"Transgeo: Transformer is all you need for cross-view image geo-localization.2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 1152–1161, 2022","venue":null,"work_id":"ced298fb-181a-467a-a672-c313713b2947","year":2022},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.416773Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:f969ca24db823809e8131bd7ab200366d18afa6ba3c73b41d6a70f8c5f26c37e","observation_id":"09edb0d9-aef4-48b1-9fbf-76083357cc32","resolution":{"observed_at":"2026-08-06T19:59:59.788307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.502850Z","title":"Georeasoner: Geo-localization with reasoning in street views using a large vision-language model","venue":null,"work_id":"52550d2b-1c8b-42b7-928a-cd00bd95a200","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.519350Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:1bb0fa1bbf5ff0941beebf45ca4bd928add66afe94e97221328d58670566e2fc","observation_id":"c6c453c7-b884-4586-aeb0-74aaff52b92a","resolution":{"observed_at":"2026-08-06T19:59:59.599049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17007","last_updated":"2025-04-01T02:48:45Z","snapshot_observed_at":"2026-08-05T15:59:34.691624Z","submitted_at":"2024-12-22T13:13:10Z","title":"Where am I? Cross-View Geo-localization with Natural Language Descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17007","snapshot_observed_at":"2026-08-06T19:59:57.592877Z","title":"Where am i? cross-view geo-localization with natural language descriptions.arXiv preprint arXiv:2412.17007, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.592877Z"},"links":{"cited_paper":"/paper/2412.17007","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:afb7163c7bfb14eb442730d41e0fc9f92ff21d18a4989e6e4aaecd7fbd61483a","observation_id":"cfae7852-d323-4a8b-a5a8-700d0e4b85e6","resolution":{"observed_at":"2026-08-06T19:59:57.592877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.326441Z","title":"Geovlm: Improving auto- mated vehicle geolocalisation using vision-language matching, 2025","venue":null,"work_id":"911d1b1c-a9bf-40b5-add0-cd17012f76cb","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.642433Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:71bc2ae690cef63170c77a179b0e0fbb0d2f99a2e281f1c3087b4953119013fd","observation_id":"fadb36bf-8e72-44e0-855a-acc0f2658900","resolution":{"observed_at":"2026-08-06T19:59:59.441361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.148935Z","title":"University-1652: A multi-view multi-source benchmark for drone-based geo-localization.ACM Multimedia, 2020","venue":null,"work_id":"e747bc2d-2c84-4202-9b0c-0ba89290a2e8","year":2020},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.714391Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:eae80e245796e18b8fed2ca3a1fca5a4489a62dc2828c20325e34190f5188da4","observation_id":"c173afdc-5d5f-48d6-beab-948de82bc91d","resolution":{"observed_at":"2026-08-06T19:59:59.264201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:57.801432Z","title":"Pytorch: An imperative style, high-performance deep learning library.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.801432Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:4850f37f77b907bc84cc4d6c815421081a94fb072da0d266eecb860d195a599b","observation_id":"3b477a0d-92a7-4331-9d9b-57a3049401f0","resolution":{"observed_at":"2026-08-06T19:59:57.801432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T19:59:57.882093Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.882093Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:7f9de3a6db888e4585618eeaa5bd4849723fd36c6646f48e51cf962216625f71","observation_id":"ff09ffc5-e158-420f-8e01-a88c9650c701","resolution":{"observed_at":"2026-08-06T19:59:57.882093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.994900Z","title":"A convnet for the 2020s","venue":null,"work_id":"c40a9ecd-8c97-46e3-b4c5-d7358c0c0fae","year":2022},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.950810Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:c4de1ce923860b6f9bc24bd1cc80cb45b3beca05f2c4ddba9ae4ef8a36ce0409","observation_id":"73ccb25b-20a6-471e-b241-f75b5abcdd48","resolution":{"observed_at":"2026-08-06T19:59:59.069807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.849213Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"08ce221f-b539-40fd-9ea6-031588b6513c","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.015952Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:170e7b10d9421c903b687aa004749749f4f9fc36c99ee1d8fa2fc9a64ca032c4","observation_id":"5d3ecda2-c1fc-4f6d-9486-5639d152c223","resolution":{"observed_at":"2026-08-06T19:59:58.918815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T19:59:58.117869Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.117869Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:e25d9d07ae84bfe392e7e87724f07e99425ab5040a516151247a9e494606c30c","observation_id":"9c6108aa-ef18-46e4-acc7-ea998b83655d","resolution":{"observed_at":"2026-08-06T19:59:58.117869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.671599Z","title":"Gemini 2.5 flash model","venue":null,"work_id":"6d36a4ef-df06-48aa-98c1-a2cc4de8804d","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.221790Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:4235e570a1593f96e0eb9c08f7f065d6808ff8fe18cafca0114be13fb8ad3688","observation_id":"37d4a756-5276-45ff-a840-7cda54c051af","resolution":{"observed_at":"2026-08-06T19:59:58.760454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.552399Z","title":"Each part matters: Local patterns facilitate cross-view geo- localization.IEEE Transactions on Circuits and Systems for Video Technology, 32(2):867–879, 2021","venue":null,"work_id":"7ba011bf-b0d9-4f36-888e-30bc003aa3ac","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.292306Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:69148d9dfc78468c6cc88615595940376da8b2cedb15e73545addff99b3cc7fa","observation_id":"d08068cb-dd39-491d-9b6a-b0d5d0a909cd","resolution":{"observed_at":"2026-08-06T19:59:58.577202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.350716Z","title":"The 3rd workshop on uavs in multime- dia: Capturing the world from a new perspective","venue":null,"work_id":"300686a1-33e8-48e7-9d8d-beaba7c16b49","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.397834Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:c79733ac279ca8d920972f96557b93a6e1e91acf78ba2f93bbc03d26523c144d","observation_id":"90fd5245-df34-4d0f-a600-484aec3b024b","resolution":{"observed_at":"2026-08-06T20:00:02.416141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2507.04107."}