{"as_of":"2026-08-09T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2935e205a540e6e9a35f10b663e7a9af54eda49605468094250ef358d79dfed0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:02:51.260957Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T11:26:54.066214Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-07-06T17:34:57.509162Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T04:55:20.362512Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2402.15852"},"observation_digest":"sha256:d7cc0b1759381bf23cbcf34f397fde3ab157a340e03786cd8a3381a3a5a02da6","observation_id":"ebe58894-a4b8-4119-b457-6a51c6b8dfba","resolution":{"observed_at":"2026-05-18T04:55:20.409420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-07T15:02:51.260957Z","title":"Bevbert: Topo-metric map pre-training for language-guided navigation.arXiv preprint arXiv:2212.04385, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16663","last_updated":"2025-05-22T13:27:54Z","snapshot_observed_at":"2026-08-07T14:55:11.946052Z","submitted_at":"2025-05-22T13:27:54Z","title":"CoNav: Collaborative Cross-Modal Reasoning for Embodied Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:51.260957Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2505.16663"},"observation_digest":"sha256:54a7c68cad73cf10364856792962cce784dceecaa588f315bb410ec5c501e69c","observation_id":"6c700b45-057a-4f36-b138-e8092009fdce","resolution":{"observed_at":"2026-08-07T15:02:51.260957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-07T13:52:03.792370Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation.arXiv preprint arXiv:2212.04385, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20897","last_updated":"2025-06-22T13:53:33Z","snapshot_observed_at":"2026-08-08T02:45:56.557199Z","submitted_at":"2025-05-27T08:40:20Z","title":"Cross from Left to Right Brain: Adaptive Text Dreamer for Vision-and-Language Navigation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:52:03.792370Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2505.20897"},"observation_digest":"sha256:3f7670d93bd116e1d054d706c9d4097d2d8578d3347f6c8d4e53c2cc04e25997","observation_id":"8515c56d-e73d-4b7b-be09-c17388a5d911","resolution":{"observed_at":"2026-08-07T13:52:03.792370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-06T21:48:22.838916Z","title":"Bevbert: Topo-metric map pre-training for language-guided navigation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-09T01:32:12.891389Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:22.838916Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:b368f153695c3016c159e40ad2e0ce0270a9a30552ce35287da4f7c1cc3f1643","observation_id":"6844dbe5-9679-49a8-bc10-f4558754dd79","resolution":{"observed_at":"2026-08-06T21:48:22.838916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2511.17097","last_updated":"2026-04-14T15:21:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-21T09:52:07Z","title":"Progress-Think: Semantic Progress Reasoning for Vision-Language Navigation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T21:02:38.013115Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2511.17097"},"observation_digest":"sha256:47898dc4050ff120f0c8265958d186bdd5228a38d241980462b66c7cd7caa021","observation_id":"701d898e-fdc6-4ed5-9054-0438f6046e46","resolution":{"observed_at":"2026-05-17T21:05:15.982288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-02T18:10:13.897082Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14807","last_updated":"2026-07-26T09:06:12Z","snapshot_observed_at":"2026-08-09T06:12:38.322290Z","submitted_at":"2026-03-16T04:23:29Z","title":"HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T18:10:13.897082Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2603.14807"},"observation_digest":"sha256:b0b8e620df2608cad6a2d83f00d932e7b203b427b425d3ece0dc5e54ac1cfb9a","observation_id":"cb1db964-b710-47fe-b6d4-6105fbb5ae35","resolution":{"observed_at":"2026-08-02T18:10:13.897082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2603.16947","last_updated":"2026-05-16T14:04:23Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-16T14:07:51Z","title":"LightZeroNav: Zero-Shot Vision Language Navigation in Continuous Environments Based on Lightweight VLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T10:41:47.297072Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2603.16947"},"observation_digest":"sha256:7eb069fd670b295918102da8ddc3aa99b5028236e4f16c0ab4ff7eb496dbe02e","observation_id":"7665012f-0536-40e8-8e37-b36cd17bb917","resolution":{"observed_at":"2026-05-21T10:44:07.845806Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2604.15823","last_updated":"2026-04-17T08:22:14Z","snapshot_observed_at":"2026-07-06T23:03:16.345488Z","submitted_at":"2026-04-17T08:22:14Z","title":"Watching Movies Like a Human: Egocentric Emotion Understanding for Embodied Companions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T08:49:33.107658Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2604.15823"},"observation_digest":"sha256:2d833327b167e2e7581ad611976785b9adecc144cee5044b3e3be3d35799e998","observation_id":"0fade2b9-56f9-4a89-84ed-b91860c0a2d5","resolution":{"observed_at":"2026-05-10T08:53:04.305421Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2604.17473","last_updated":"2026-06-23T08:05:53Z","snapshot_observed_at":"2026-08-01T16:55:52.786011Z","submitted_at":"2026-04-19T15:03:38Z","title":"Dual-Anchoring: Addressing State Drift in Vision-Language Navigation","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-10T06:50:34.310831Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2604.17473"},"observation_digest":"sha256:b580da878601550b900eed96badb7700059971afe2cbdb9257374ab44d010cbd","observation_id":"403e845d-de07-482b-894d-78bf9f1d6f2d","resolution":{"observed_at":"2026-05-10T06:51:45.893511Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2605.09053","last_updated":"2026-05-09T16:56:38Z","snapshot_observed_at":"2026-08-02T10:23:06.582386Z","submitted_at":"2026-05-09T16:56:38Z","title":"LCGNav: Local Candidate-Aware Geometric Enhancement for General Topological Planning in Vision-Language Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T02:04:57.627160Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2605.09053"},"observation_digest":"sha256:74c05f7c1dd333dd99baeeb683c0d45124e2eebe988f0b91dcaf98de4128ce4a","observation_id":"6ff4f4a3-6243-4179-bf13-6ef065173d82","resolution":{"observed_at":"2026-05-12T02:06:14.900560Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2605.22036","last_updated":"2026-05-21T06:20:17Z","snapshot_observed_at":"2026-08-03T01:34:12.134807Z","submitted_at":"2026-05-21T06:20:17Z","title":"GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T06:45:35.920991Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2605.22036"},"observation_digest":"sha256:45ebda93257eba7e72f9b0b850e43fe7eab527daacfe63401e57c7df8b944356","observation_id":"989c518d-6a76-4494-8fa5-8735a378b2e9","resolution":{"observed_at":"2026-05-22T06:46:10.657852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2605.30115","last_updated":"2026-05-28T15:50:29Z","snapshot_observed_at":"2026-08-06T14:09:49.697101Z","submitted_at":"2026-05-28T15:50:29Z","title":"Large Depth Completion Model from Sparse Observations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T08:19:01.715788Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2605.30115"},"observation_digest":"sha256:35190fd8ef0ff8f9d6f441cd15ae79d7672bfac81fb06d4026ac491070406ffa","observation_id":"f4749ee8-2d9f-46e1-be8a-9d0851fd3236","resolution":{"observed_at":"2026-06-29T08:23:15.260029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2606.03175","last_updated":"2026-06-03T03:34:51Z","snapshot_observed_at":"2026-08-06T03:40:21.903218Z","submitted_at":"2026-06-02T05:31:03Z","title":"Ask When It Pays: Cost-Aware Open-Ended Interaction for Instance Goal Navigation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T11:01:08.668612Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2606.03175"},"observation_digest":"sha256:efa0fc147bf155abd8e9a02ec1fbe1323798ee473620540b606958f28e7d0207","observation_id":"7edd71a2-9bbb-4ff3-809e-b820123e3123","resolution":{"observed_at":"2026-07-02T02:26:26.147588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2606.27807","last_updated":"2026-06-26T07:45:45Z","snapshot_observed_at":"2026-07-07T00:01:59.695342Z","submitted_at":"2026-06-26T07:45:45Z","title":"SpikeVLA: Vision-Language-Action Models with Spiking Neural Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T04:42:23.040915Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2606.27807"},"observation_digest":"sha256:5dbb573c7479a12367d4c43e8608c2febb55d1fd29318921b09ff663b0194c92","observation_id":"0561c1c0-5f30-4094-854e-45aaba081f13","resolution":{"observed_at":"2026-06-29T19:33:54.610574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":"2212.04385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-07-02T11:26:54.066214Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"2e7611d2-6a27-42d2-91c4-f10463a0e026","year":2022},"citing_paper":{"arxiv_id":"2607.01043","last_updated":"2026-07-23T09:16:43Z","snapshot_observed_at":"2026-08-08T14:49:24.438244Z","submitted_at":"2026-07-01T15:07:07Z","title":"DART-VLN: Test-Time Memory Decay and Anti-Loop Regularization for Discrete Vision-Language Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-02T11:17:26.529397Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2607.01043"},"observation_digest":"sha256:73719d85c269d5aaef78008de77a08821d18856c55dd782a0ece69bf1a10bfbf","observation_id":"56c6f726-63d1-4d18-99e4-d6a3e14cc72d","resolution":{"observed_at":"2026-07-02T11:26:54.068087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-01T03:26:19.022152Z","title":"Bevbert: Topo-metric map pre-training for language-guided navigation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23181","last_updated":"2026-07-25T12:26:47Z","snapshot_observed_at":"2026-08-08T10:33:38.504727Z","submitted_at":"2026-07-25T12:26:47Z","title":"Towards Dual-Brain Minimal Sufficient Representation for Vision-Language Navigation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T03:26:19.022152Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2607.23181"},"observation_digest":"sha256:1d25bcff9002b7eaf18bf161c16e5812388f0da72ad5957ad98a474fb6a3d05e","observation_id":"0899cc28-37fb-4e2e-b629-ba12eccde1ed","resolution":{"observed_at":"2026-08-01T03:26:19.022152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2212.04385/citation-record","integrity":"/paper/2212.04385/integrity","json":"/paper/2212.04385/citation-record.json","paper":"/paper/2212.04385"},"outbound":[],"paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T09:14:26.834264Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2212.04385."}