{"as_of":"2026-08-19T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37f2e72262c9673be0bcb2d8f299cca74f824018d1cd78745cb63db840f38fc0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:06:07.603723Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:47:38.680188Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-08-18T12:12:42.503422Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T04:55:20.362512Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2402.15852"},"observation_digest":"sha256:804d4c6686814b9b9326e981a2130d5154a0697f3d0819b09c148c6831a91ede","observation_id":"f2017848-d5f4-41bb-b0da-dac0c2f3a1e2","resolution":{"observed_at":"2026-05-18T04:55:20.433292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-12T04:35:36.793861Z","title":"A2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01292","last_updated":"2025-02-02T11:49:25Z","snapshot_observed_at":"2026-08-19T10:09:56.914941Z","submitted_at":"2024-12-02T09:07:57Z","title":"LSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T04:35:36.793861Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2412.01292"},"observation_digest":"sha256:0e72b458472d0a1ef5fefd9a41b7889e6df550cf61285075bd637f9b5e3ccd7b","observation_id":"99481ef7-81e6-43aa-8a80-6e604f803d84","resolution":{"observed_at":"2026-08-12T04:35:36.793861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-16T16:28:01.153501Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T19:51:36.137985Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2412.06224"},"observation_digest":"sha256:a9a4255c166b32d45e7e5845434946c1a929edc6ec20f3f1162e22741b3ca150","observation_id":"cd1733aa-5086-416d-a059-a6243cda204f","resolution":{"observed_at":"2026-05-16T19:51:36.210974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-11T16:24:58.053040Z","title":"A 2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10137","last_updated":"2025-04-15T02:20:35Z","snapshot_observed_at":"2026-08-15T01:58:30.067821Z","submitted_at":"2024-12-13T13:38:41Z","title":"Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T16:24:58.053040Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2412.10137"},"observation_digest":"sha256:f7a211a0e620c38bcffdd0489332b94acf13eda441ea00a809fd271c206e42eb","observation_id":"8d2e54c0-530f-4eb5-a782-e854735386fb","resolution":{"observed_at":"2026-08-11T16:24:58.053040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-09T20:11:13.070999Z","title":"Monte Carlo localization in hand-drawn maps,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00114","last_updated":"2025-04-28T18:14:08Z","snapshot_observed_at":"2026-08-18T09:12:16.408023Z","submitted_at":"2025-01-31T19:03:33Z","title":"Mobile Robot Navigation Using Hand-Drawn Maps: A Vision Language Model Approach","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T20:11:13.070999Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2502.00114"},"observation_digest":"sha256:1c44f136047929d79f05b404e839c5cb75991215f3aa83eaa425342a3a73961e","observation_id":"26d07516-a634-4b97-aeb6-84e2968c057e","resolution":{"observed_at":"2026-08-09T20:11:13.070999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-16T11:06:07.603723Z","title":"Li, Gaowen Liu, Mingkui Tan, and Chuang Gan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16516","last_updated":"2025-04-24T19:36:09Z","snapshot_observed_at":"2026-08-18T14:44:46.063293Z","submitted_at":"2025-04-23T08:41:27Z","title":"Think Hierarchically, Act Dynamically: Hierarchical Multi-modal Fusion and Reasoning for Vision-and-Language Navigation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:06:07.603723Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2504.16516"},"observation_digest":"sha256:2de0ea00b85357e944994ec89014e4c4da8a39560b6e342b9c19e411310ead1c","observation_id":"07456b5e-b80a-434b-b619-dce90441f859","resolution":{"observed_at":"2026-08-16T11:06:07.603723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-07T13:52:04.892845Z","title":"a2 nav: Action-aware zero-shot robot navigation by exploiting vision-and-language ability of foundation models.arXiv preprint arXiv:2308.07997, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20897","last_updated":"2025-06-22T13:53:33Z","snapshot_observed_at":"2026-08-17T05:28:55.208146Z","submitted_at":"2025-05-27T08:40:20Z","title":"Cross from Left to Right Brain: Adaptive Text Dreamer for Vision-and-Language Navigation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:52:04.892845Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2505.20897"},"observation_digest":"sha256:0b6f2cc055a5d11acc3963d46be20d1cf9eb84bca437f219b3fbb504d77a011f","observation_id":"a354b9cd-0b2f-4b18-80ab-d78d4c53e4a9","resolution":{"observed_at":"2026-08-07T13:52:04.892845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-15T19:31:53.491759Z","title":"A2nav: Action-aware zero-shot robot navigation by exploiting vision-and-language ability of foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16652","last_updated":"2025-06-19T23:42:03Z","snapshot_observed_at":"2026-08-16T12:04:08.888942Z","submitted_at":"2025-06-19T23:42:03Z","title":"CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:53.491759Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2506.16652"},"observation_digest":"sha256:5db11cbda0f9a5f77a02e17e79c2f7d97a068c4e1c5502a13d5c3d42c285aa67","observation_id":"5dbc5a12-f24c-4ba0-a699-c9bbb0bad00d","resolution":{"observed_at":"2026-08-15T19:31:53.491759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-06T21:48:23.962892Z","title":"A2 nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.962892Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4295d6ab76c101558bf906ab5059d7203108eee093ea16e1b60d68825b791316","observation_id":"bd6145f8-ef79-49a9-8f3a-5e4d394bf0ce","resolution":{"observed_at":"2026-08-06T21:48:23.962892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-06T22:45:22.470253Z","title":"a2 nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models.arXiv preprint arXiv:2308.07997, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02929","last_updated":"2025-06-26T05:57:06Z","snapshot_observed_at":"2026-08-14T23:45:53.313986Z","submitted_at":"2025-06-26T05:57:06Z","title":"OBSER: Object-Based Sub-Environment Recognition for Zero-Shot Environmental Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:45:22.470253Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2507.02929"},"observation_digest":"sha256:d4606549915c4880cd8184c7637b2fa20535720cc15f2b50eba680ade714b873","observation_id":"a7887672-18db-407a-8b76-953b46a3a374","resolution":{"observed_at":"2026-08-06T22:45:22.470253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-06T19:37:06.419946Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-18T02:14:46.902275Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:37:06.419946Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2507.05240"},"observation_digest":"sha256:5a9cce89753595423b9afd9704bab9b423274f816d513547f00a0f9ce2d8df58","observation_id":"7320402f-b533-4006-9ce7-6023d1c394ab","resolution":{"observed_at":"2026-08-06T19:37:06.419946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-15T15:57:22.880205Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10454","last_updated":"2025-09-12T17:59:58Z","snapshot_observed_at":"2026-08-17T16:48:11.398137Z","submitted_at":"2025-09-12T17:59:58Z","title":"GC-VLN: Instruction as Graph Constraints for Training-free Vision-and-Language Navigation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T15:57:22.880205Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2509.10454"},"observation_digest":"sha256:81566af9f220bfa71064ab26bb82598e2119539a48439eaa594150d399ca00ce","observation_id":"f35be150-ebfb-4927-adf6-9618299e681b","resolution":{"observed_at":"2026-08-15T15:57:22.880205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2511.17097","last_updated":"2026-04-14T15:21:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-21T09:52:07Z","title":"Progress-Think: Semantic Progress Reasoning for Vision-Language Navigation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T21:02:38.013115Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2511.17097"},"observation_digest":"sha256:272db3c3048d8c07515dc5356e3d52ac793c26bee0760d5b138951b201b2e5fa","observation_id":"a7fa8149-ecd8-415c-ad33-30a5191c59d9","resolution":{"observed_at":"2026-05-17T21:05:15.967379Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2604.16298","last_updated":"2026-04-17T17:59:48Z","snapshot_observed_at":"2026-08-11T10:42:04.784310Z","submitted_at":"2026-04-17T17:59:48Z","title":"FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T08:13:12.029402Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2604.16298"},"observation_digest":"sha256:8b3016c70cfa9198a4c3e45bbc38d6f8007e08b927694ccf5ff246d83e46d0ef","observation_id":"af29c0ea-c9a8-4f73-8142-d5139a3ddd77","resolution":{"observed_at":"2026-05-10T08:22:37.623967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-15T08:15:33.417798Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:d6d0e57753ee2b33599834ae997e59d890a09d2b90cb8b537d4b634164e084ec","observation_id":"a7d11f88-d4fd-4bce-93c9-5fddcb0893e1","resolution":{"observed_at":"2026-05-22T04:46:04.595494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2606.00095","last_updated":"2026-05-25T08:53:21Z","snapshot_observed_at":"2026-08-02T11:09:28.452176Z","submitted_at":"2026-05-25T08:53:21Z","title":"Bridging the 2D-3D Gap: A Hierarchical Semantic-Geometric Map for Vision Language Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T22:33:32.671550Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2606.00095"},"observation_digest":"sha256:7c0f6d3c340f7705567aefdd1a81a67612dbc5ea544e1ff17fef6657979c5a6f","observation_id":"520c74aa-25d3-4f63-9b9f-ba79d56c1df5","resolution":{"observed_at":"2026-06-29T22:34:01.371249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2606.10577","last_updated":"2026-07-26T11:04:02Z","snapshot_observed_at":"2026-08-18T09:12:12.704853Z","submitted_at":"2026-06-09T08:43:05Z","title":"AgenticNav: Zero-Shot Vision-and-Language Navigation as a Tool-Calling Harness","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T13:35:34.630980Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2606.10577"},"observation_digest":"sha256:549bb9d261be80a444a7d94808e4214af286da0709329f57c234f59f11208be8","observation_id":"e1aea1c4-aadd-4e44-b126-5a3c6a49b030","resolution":{"observed_at":"2026-07-03T04:47:38.682296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-02T11:56:28.498296Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10577","last_updated":"2026-07-26T11:04:02Z","snapshot_observed_at":"2026-08-18T09:12:12.704853Z","submitted_at":"2026-06-09T08:43:05Z","title":"AgenticNav: Zero-Shot Vision-and-Language Navigation as a Tool-Calling Harness","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T11:56:28.498296Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2606.10577"},"observation_digest":"sha256:bb38f8a4a18b635da0fec77dc7b1b7095810a56771d2761c5a47e92b951e9ebd","observation_id":"8e2fd2c4-b015-4b8a-87a6-ae31fb7b106f","resolution":{"observed_at":"2026-08-02T11:56:28.498296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2308.07997/citation-record","integrity":"/paper/2308.07997/integrity","json":"/paper/2308.07997/citation-record.json","paper":"/paper/2308.07997"},"outbound":[],"paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T09:11:51.936392Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2308.07997."}