{"as_of":"2026-08-18T05:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6e957c4553090eeb07958ada74ebeb999ab60a2db9a23e14de0c2282c1e2233","coverage":[{"denominator":86,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":86,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:48:29.816737Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T05:05:56.065261Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T15:44:49.430234Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"cited_work":{"arxiv_id":"2506.23468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23468","snapshot_observed_at":"2026-06-30T15:44:49.430234Z","title":"Nav- morph: A self-evolving world model for vision-and- language navigation in continuous environments","venue":null,"work_id":"9717596c-f08a-4968-829c-3f2da619ceed","year":2025},"citing_paper":{"arxiv_id":"2511.17097","last_updated":"2026-04-14T15:21:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-21T09:52:07Z","title":"Progress-Think: Semantic Progress Reasoning for Vision-Language Navigation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-17T21:02:38.013115Z"},"links":{"cited_paper":"/paper/2506.23468","citing_paper":"/paper/2511.17097"},"observation_digest":"sha256:840201f8a346569f280ef633a7cc2fc839fc84556f2b1019f1f9f766084cde21","observation_id":"e7b4099c-5ee7-4553-a8a4-b934959aab09","resolution":{"observed_at":"2026-05-17T21:05:15.937992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"cited_work":{"arxiv_id":"2506.23468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23468","snapshot_observed_at":"2026-06-30T15:44:49.430234Z","title":"Nav- morph: A self-evolving world model for vision-and- language navigation in continuous environments","venue":null,"work_id":"9717596c-f08a-4968-829c-3f2da619ceed","year":2025},"citing_paper":{"arxiv_id":"2604.17473","last_updated":"2026-06-23T08:05:53Z","snapshot_observed_at":"2026-08-11T07:26:07.831204Z","submitted_at":"2026-04-19T15:03:38Z","title":"Dual-Anchoring: Addressing State Drift in Vision-Language Navigation","version":1},"reference_index":134,"source":"arxiv_source","source_observed_at":"2026-05-10T06:50:34.310831Z"},"links":{"cited_paper":"/paper/2506.23468","citing_paper":"/paper/2604.17473"},"observation_digest":"sha256:b72f940b680512463aa103f3f9584efe04d72c0bc70b1fbab7f62ed5ee106f2c","observation_id":"ca49afd5-45b9-477f-af3f-229f61fb68da","resolution":{"observed_at":"2026-05-10T06:51:45.882823Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"cited_work":{"arxiv_id":"2506.23468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23468","snapshot_observed_at":"2026-06-30T15:44:49.430234Z","title":"Nav- morph: A self-evolving world model for vision-and- language navigation in continuous environments","venue":null,"work_id":"9717596c-f08a-4968-829c-3f2da619ceed","year":2025},"citing_paper":{"arxiv_id":"2604.27620","last_updated":"2026-04-30T09:09:40Z","snapshot_observed_at":"2026-08-11T04:56:25.116086Z","submitted_at":"2026-04-30T09:09:40Z","title":"SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-07T05:05:33.606975Z"},"links":{"cited_paper":"/paper/2506.23468","citing_paper":"/paper/2604.27620"},"observation_digest":"sha256:cc49b6ac91b1995335ea13455a2012a2c84a4617f651153e1bda20b4b9f4e516","observation_id":"bb7c7f8d-69fe-4f05-8ea2-54f7b403e448","resolution":{"observed_at":"2026-05-12T10:36:31.349836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"cited_work":{"arxiv_id":"2506.23468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23468","snapshot_observed_at":"2026-06-30T15:44:49.430234Z","title":"Nav- morph: A self-evolving world model for vision-and- language navigation in continuous environments","venue":null,"work_id":"9717596c-f08a-4968-829c-3f2da619ceed","year":2025},"citing_paper":{"arxiv_id":"2606.30367","last_updated":"2026-06-29T14:33:03Z","snapshot_observed_at":"2026-08-06T15:33:36.109677Z","submitted_at":"2026-06-29T14:33:03Z","title":"FutureNav: Unified World-Action Modeling for Vision-and-Language Navigation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T05:05:56.065261Z"},"links":{"cited_paper":"/paper/2506.23468","citing_paper":"/paper/2606.30367"},"observation_digest":"sha256:c203f223834b540ce1a4d12796d0fa610f88a91babca7b480526074b1079ccf9","observation_id":"679c2a5b-dfbb-4492-b407-3d55cc1f1195","resolution":{"observed_at":"2026-06-30T15:44:49.431645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23468/citation-record","integrity":"/paper/2506.23468/integrity","json":"/paper/2506.23468/citation-record.json","paper":"/paper/2506.23468"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-16T16:10:00.769704Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-06T21:48:22.838916Z","title":"Bevbert: Topo-metric map pre-training for language-guided navigation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:22.838916Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:9f2422e48cd0de13ce23cab4dd2d770d221d79c82b44708a0a69c3dc38d68872","observation_id":"6844dbe5-9679-49a8-bc10-f4558754dd79","resolution":{"observed_at":"2026-08-06T21:48:22.838916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11610","last_updated":"2022-06-26T14:37:08Z","snapshot_observed_at":"2026-08-16T16:50:55.701350Z","submitted_at":"2022-06-23T10:36:53Z","title":"1st Place Solutions for RxR-Habitat Vision-and-Language Navigation Competition (CVPR 2022)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11610","snapshot_observed_at":"2026-08-06T21:48:22.894546Z","title":"1st place so- lutions for rxr-habitat vision-and-language navigation com- petition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:22.894546Z"},"links":{"cited_paper":"/paper/2206.11610","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:43fa44a0395e547ad634dcdc070c7a54fae950c7a97dba208c440e46cb051414","observation_id":"8247c70a-d986-4fe8-8b5d-3dcb921cc471","resolution":{"observed_at":"2026-08-06T21:48:22.894546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:22.979942Z","title":"Etpnav: Evolving topo- logical planning for vision-language navigation in continu- ous environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:22.979942Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:fad794e8c2533540d7149d56aac1ef9154cc05594a1797d4d2e3b3255c21d52c","observation_id":"2d997bef-53d5-4075-9ba6-8966cecd68a0","resolution":{"observed_at":"2026-08-06T21:48:22.979942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.06757","last_updated":"2018-07-18T03:28:02Z","snapshot_observed_at":"2026-08-14T11:12:04.949259Z","submitted_at":"2018-07-18T03:28:02Z","title":"On Evaluation of Embodied Navigation Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.06757","snapshot_observed_at":"2026-08-06T21:48:23.023346Z","title":"On evaluation of embodied navigation agents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.023346Z"},"links":{"cited_paper":"/paper/1807.06757","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:499942fc3ec6a3a4bc6b8893105c2e617c0d5261fe7d3a7b62645ab15c42b214","observation_id":"e2d05800-1b23-4689-afe1-4125a8b12a0d","resolution":{"observed_at":"2026-08-06T21:48:23.023346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:23.090126Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.090126Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:b62046a8f73dc1be72e4cddb1e6480b75402bb87b40bfc8f9ba7276e279b1674","observation_id":"a94def36-fecf-4951-80c4-072858dfd9b0","resolution":{"observed_at":"2026-08-06T21:48:23.090126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:23.184982Z","title":"Sim- to-real transfer for vision-and-language navigation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.184982Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:95d5288ef4572843217b32941c6b133a59f05463f595efb5824edfe858ce24f7","observation_id":"652175bc-3d6a-432d-837e-26365d491059","resolution":{"observed_at":"2026-08-06T21:48:23.184982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:23.313120Z","title":"Robot-assisted navigation for visually impaired through adaptive impedance and path planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.313120Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:71d285d1d31aef6474903975b779c185073f49daf512ef729ad840bb361673c3","observation_id":"5ae5e0cb-d8b4-4024-a2e4-504c53cf4c3a","resolution":{"observed_at":"2026-08-06T21:48:23.313120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:23.369011Z","title":"The robotslang benchmark: Dialog-guided robot localization and navigation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.369011Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:d069843496a44d756c08c45ef6df9a9ec63666979c1dd37abd1d3190e41596ab","observation_id":"62c7e772-3985-4a0e-8634-0a245193d520","resolution":{"observed_at":"2026-08-06T21:48:23.369011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:23.437415Z","title":"Navigation world models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.437415Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:cf2a0912eb4c3e8f555dcbf9247bc26d8848b0ec426bb2ab25f8406aad57a388","observation_id":"e0adab19-15dc-467e-8e2d-35793732868b","resolution":{"observed_at":"2026-08-06T21:48:23.437415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.06158","last_updated":"2017-09-18T20:34:48Z","snapshot_observed_at":"2026-08-18T04:48:01.891163Z","submitted_at":"2017-09-18T20:34:48Z","title":"Matterport3D: Learning from RGB-D Data in Indoor Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.06158","snapshot_observed_at":"2026-08-06T21:48:23.516539Z","title":"Matterport3d: Learning from rgb-d data in indoor environments","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.516539Z"},"links":{"cited_paper":"/paper/1709.06158","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:9103d44f5895cf828ed83d149675e9bdef4e5b8f523bef7f8792fd491acd6e1d","observation_id":"22fa1a77-0104-4eab-8d27-3faa0cfc2d98","resolution":{"observed_at":"2026-08-06T21:48:23.516539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:40.839460Z","title":"Reinforced structured state-evolution for vision-language navigation","venue":null,"work_id":"e9b39b02-dc60-4771-91dd-d7d87bdd88b2","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.597762Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:8965be0bd9396add993dbb542db56f21ecf97117669e02aad865a2591bd4290a","observation_id":"134e9cb5-4121-47b9-9fbd-f0e0c2a9f5c4","resolution":{"observed_at":"2026-08-06T21:48:40.971819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05890","last_updated":"2024-08-20T14:51:04Z","snapshot_observed_at":"2026-08-16T13:36:11.028983Z","submitted_at":"2024-07-08T12:52:46Z","title":"Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05890","snapshot_observed_at":"2026-08-06T21:48:23.684003Z","title":"Affordances-oriented planning using foundation models for continuous vision-language naviga- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.684003Z"},"links":{"cited_paper":"/paper/2407.05890","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:5ed1b87bbea7f2e4a18e23844ba262e8ff0072be6d126788336a10a775f375b3","observation_id":"2414d0a1-5f12-468f-b170-c230a1d6782c","resolution":{"observed_at":"2026-08-06T21:48:23.684003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:40.549123Z","title":"Topological planning with transformers for vision-and-language navigation","venue":null,"work_id":"9eb0d556-cfe5-403e-bc06-e84dbe92f865","year":2020},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.774139Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:7b307c8731d0b138b7a8b65be89e9234d4463858ea017cefbd3acc6135068dd4","observation_id":"dcc70ade-80aa-414e-b2f1-974a1bee4a3f","resolution":{"observed_at":"2026-08-06T21:48:40.662130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:40.258340Z","title":"Li, Mingkui Tan, and Chuang Gan","venue":null,"work_id":"41dca297-f5fe-4f78-a97a-bb013aa225c2","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.855757Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:e32bf59722ed02c44d1b66d4e7c7c791d039bba2e2c20bf3e827288c714f7a4c","observation_id":"fe5596e7-238f-45f6-9873-1b0e95fb8533","resolution":{"observed_at":"2026-08-06T21:48:40.351550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-16T15:08:16.170695Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-08-06T21:48:23.962892Z","title":"A2 nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:23.962892Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:1fd58e8b9e8c7d26e972872a4a7e82aa4b6d73084e7039eee17448cf0b6e54c3","observation_id":"bd6145f8-ef79-49a9-8f3a-5e4d394bf0ce","resolution":{"observed_at":"2026-08-06T21:48:23.962892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:40.016221Z","title":"Think global, act local: Dual-scale graph transformer for vision-and-language navi- gation","venue":null,"work_id":"87a0cf2a-2604-4cf2-9d09-e3ec7268476e","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.057455Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:de72ac3756ed4a803b71679838d5f31088d805b809c20ffa07cd9d3957f91c13","observation_id":"5f2340ea-1be0-4739-a0d1-6840422aa5c6","resolution":{"observed_at":"2026-08-06T21:48:40.129425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16053","last_updated":"2025-03-16T10:43:31Z","snapshot_observed_at":"2026-08-13T08:17:56.618613Z","submitted_at":"2024-11-25T02:44:59Z","title":"UnitedVLN: Generalizable Gaussian Splatting for Continuous Vision-Language Navigation","version":2},"cited_work":{"arxiv_id":"2411.16053","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16053","snapshot_observed_at":"2026-08-06T21:48:30.328665Z","title":"UnitedVLN: Generalizable Gaussian Splatting for Continuous Vision-Language Navigation","venue":"cs.CV","work_id":"1b55688c-2ca9-44d4-a68a-9070a9b8badd","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.098327Z"},"links":{"cited_paper":"/paper/2411.16053","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:8a5e7cf226756d5686083f210803da784df0db4db7ecac14aa7ddc6f87ae4ee7","observation_id":"32adf075-a83d-4efd-9797-23527afb1878","resolution":{"observed_at":"2026-08-06T21:48:30.383053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T21:48:24.217549Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.217549Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:6773224b69a19a196e56fd42ddce24e3d238c6329d4b6a2e6479691ff21e4a9b","observation_id":"0468d40a-0aac-4595-8563-55a08e53eddb","resolution":{"observed_at":"2026-08-06T21:48:24.217549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:39.819639Z","title":"Fast-slow test- time adaptation for online vision-and-language navigation","venue":null,"work_id":"92aa9b63-8a96-465e-9465-0b88fff0b8c5","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.287615Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:d575b4c42dc529529ba3c2358874b4a8319707fa6c80c8118b423675c97f34f6","observation_id":"062e0da3-4c77-4336-a448-e5096203687f","resolution":{"observed_at":"2026-08-06T21:48:39.893466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:39.627818Z","title":"Cross-modal map learning for vision and language navigation","venue":null,"work_id":"8e388714-b792-4bc5-81b4-43a783e457b4","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.352914Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:23994b6222058916eaefc541acdd651e41c8a3383b75f9b983aaf38bf76ca7d3","observation_id":"8b6b47b7-c074-480b-94f4-f060cf65ab52","resolution":{"observed_at":"2026-08-06T21:48:39.704397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:39.500886Z","title":"Note: Robust continual test- time adaptation against temporal correlation","venue":null,"work_id":"48a54743-18e0-47aa-9303-3302a1930b12","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.479422Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:42db4d2cbd63cf6ba9e040baa6f36ec45fadef6b635ebbfe2566d487d6729f1c","observation_id":"76bdc75e-c61a-4f4d-86c2-2422e6118835","resolution":{"observed_at":"2026-08-06T21:48:39.573051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:39.298690Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"969f6fda-a74c-48ca-92aa-768303ba30ab","year":2018},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.554658Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:455cb19e751e3f76d9d0799049df991903baa4b25c5e5b2d4dedceafaa9bcbc5","observation_id":"81465e26-11d9-4be0-aaa3-941fafc6df8a","resolution":{"observed_at":"2026-08-06T21:48:39.373160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:39.018644Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":"e06c11e3-5a6d-457a-b294-c6016a7a0920","year":2019},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.638473Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:7192234b1092c7383081ace9ab3544bc10f78fd56f1cb93caf18726519388493","observation_id":"7a1d94f6-ce05-45cf-9b4a-da8f3803bc0e","resolution":{"observed_at":"2026-08-06T21:48:39.162120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:38.761698Z","title":"Dream to control: Learning behaviors by la- tent imagination","venue":null,"work_id":"e18ca988-cf90-41e8-a430-d13635d69524","year":2020},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.722017Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:720c52c56f4a4ba6442d08c9c581e14dcdc3517bbbde6939abb6fb7760cef64e","observation_id":"c426819e-53cb-402f-95bf-aa650507ebae","resolution":{"observed_at":"2026-08-06T21:48:38.885526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-06T21:48:24.795647Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.795647Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:c561950e1e523ae8f60fb4255d298ef37c50e29c99b132fc72001bb422b05273","observation_id":"0e6697f6-c8ed-42d7-817a-48bb7134649e","resolution":{"observed_at":"2026-08-06T21:48:24.795647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-08-15T11:39:07.998070Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-06T21:48:24.931829Z","title":"Reasoning with language model is planning with world model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.931829Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:8b9b0ce92a6e27e0c1ff19210abd3e2df80272c8de959f4a571bf7a6883e5291","observation_id":"33bd8586-ebec-49e2-bda8-7ea783ab4aa9","resolution":{"observed_at":"2026-08-06T21:48:24.931829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:24.977237Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:24.977237Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:ca9573842da4d4db25e49e91e2c84d7429add2b058bc27038575b94cdf17c603","observation_id":"327af284-5a05-4193-8296-7f2baca2f148","resolution":{"observed_at":"2026-08-06T21:48:24.977237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:38.494417Z","title":"Frequency-enhanced data augmentation for vision-and-language navigation","venue":null,"work_id":"ba6717b6-183c-4fec-a4ce-2650975ac1cb","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.033103Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:0b0888faf647848aea5832ab4441ede766962f39c0cc02e27ec944be38bbd8bb","observation_id":"663b4034-48b0-48b1-85a9-fe10e2291d5d","resolution":{"observed_at":"2026-08-06T21:48:38.613863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:38.274318Z","title":"Bridg- ing the gap between learning in discrete and continuous en- vironments for vision-and-language navigation","venue":null,"work_id":"bae9d0d4-a19a-49ec-b9cb-ed3570155767","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.096190Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:b178413904fc13a60a358ed1887809d1b2e57e72391321efad11d6ffc4eeecce","observation_id":"bcd495a4-80e1-4c3c-9b6e-e95fb8be9ca4","resolution":{"observed_at":"2026-08-06T21:48:38.391745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:38.013491Z","title":"Learning navigational visual representations with semantic map super- vision","venue":null,"work_id":"d8f901b7-dd76-4c84-97a8-7a9977cc96e6","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.183286Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:09dcf4eaa97555b70fd352044b76a7d075c66332a69f50eb64bb4d59b6a89f7e","observation_id":"7d00ddc5-7e52-43a7-aa76-a33fa23c402a","resolution":{"observed_at":"2026-08-06T21:48:38.143374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:37.763613Z","title":"Learning navigational visual representations with semantic map super- vision","venue":null,"work_id":"24a927f4-6707-4c89-b8e4-69207c03e082","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.318746Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4d63f0a2a181369b0e740f76d8530bef0f74cb514b15e50b675f5f4059ab3c20","observation_id":"687d6635-794f-44f2-a5ab-1b5a8959c950","resolution":{"observed_at":"2026-08-06T21:48:37.905934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:37.504443Z","title":"Model-based imitation learning for urban driving","venue":null,"work_id":"b48b9292-4d29-445c-981f-7a67cea60c81","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.425514Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:73aba1f9efa2068cf1de6ad81a2a06fccd5b55082f36083eac368ee7d4293065","observation_id":"8239993e-03ef-407f-b7de-5c2a686131dc","resolution":{"observed_at":"2026-08-06T21:48:37.644305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05446","last_updated":"2019-11-28T16:59:52Z","snapshot_observed_at":"2026-08-16T23:37:49.987594Z","submitted_at":"2019-07-11T18:42:03Z","title":"General Evaluation for Instruction Conditioned Navigation using Dynamic Time Warping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05446","snapshot_observed_at":"2026-08-06T21:48:25.572413Z","title":"General evaluation for instruction con- ditioned navigation using dynamic time warping","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.572413Z"},"links":{"cited_paper":"/paper/1907.05446","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:08c56d1fb116dc113038e3b9439566d30faedce248c8758834d238dd468fec3e","observation_id":"48b65aed-c577-49c2-af0f-5bb29c9bbc1e","resolution":{"observed_at":"2026-08-06T21:48:25.572413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:37.226912Z","title":"Semantically-aware spatio-temporal rea- soning agent for vision-and-language navigation in continu- ous environments","venue":null,"work_id":"25c28ffa-72cb-4f4d-ae0d-a356c67f22fc","year":2021},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.691685Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:70afb5443fa4f0248b80a5ecc5c1a3334c4f88c2cd2809f9efa6d64434703157","observation_id":"2c6803eb-cd9b-4c04-9207-f91df401b2cf","resolution":{"observed_at":"2026-08-06T21:48:37.356009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:37.011665Z","title":"Semantically-aware spatio-temporal rea- soning agent for vision-and-language navigation in continu- ous environments","venue":null,"work_id":"80a985eb-81a6-44c2-b341-f91518ae0162","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.787186Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:a4042d9ea48e1547451e1e2ef86ce7c43b1fbe6aa2c1e5fbe3627b55c4435c48","observation_id":"67a9cf19-89d6-47e6-9063-469cff3ca4db","resolution":{"observed_at":"2026-08-06T21:48:37.096167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:36.757267Z","title":"Sur les fonctions convexes et les in ´egalit´es entre les valeurs moyennes","venue":null,"work_id":"221a7f79-b23f-46da-afaf-6c5d895afa5c","year":1906},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.847161Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:2f527bf835fe3177dee73f9a0e52d662ccdff8e604339fb5ea5a84104a89af06","observation_id":"b4b26c17-fa42-4915-bc54-95690ab67c65","resolution":{"observed_at":"2026-08-06T21:48:36.901378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:36.478098Z","title":"A new path: Scaling vision- and-language navigation with synthetic instructions and im- itation learning","venue":null,"work_id":"076dae49-fb1f-4671-8a7e-c2ac1205ea03","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.919991Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:a1fee74e4cf58aeceedf393a4860c119c03be3d4b0e7c74dce2473395968fa6d","observation_id":"f4ce2090-2571-4c90-ae99-cc744811fdb3","resolution":{"observed_at":"2026-08-06T21:48:36.635377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:36.190314Z","title":"Enhancing blind visitor’s autonomy in a science museum using an autonomous navigation robot","venue":null,"work_id":"e0e200fc-b43e-4fe1-a036-1ccc5d7015f8","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:25.984250Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:88d893bb34b73b5d39a53cf9bca65e79f575e00b5164e908a7ce2bf7d139c5c6","observation_id":"17486a5a-6508-48c8-905a-1a2f4624596f","resolution":{"observed_at":"2026-08-06T21:48:36.343318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.990419Z","title":"Pathdreamer: A world model for indoor navigation","venue":null,"work_id":"2cc6eda5-85c2-4e44-9252-889bcea44e3e","year":2021},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.054539Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:363550be1bb10d7b6387667ee50f1ec61eef3f2373ecf39b5c7c0141243ed625","observation_id":"4cb71249-2f2e-400b-8240-ba66f27acb9a","resolution":{"observed_at":"2026-08-06T21:48:36.118633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.819695Z","title":"Sim-2-sim transfer for vision- and-language navigation in continuous environments","venue":null,"work_id":"e90a6753-8372-40d1-b0bc-28b994245720","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.120957Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:5d71ed36d61e39fc2e2333e9e50223a0a11779e7af839f99c78996af16768c05","observation_id":"e16c8a71-b597-4ccc-b607-4dc7ff03fc78","resolution":{"observed_at":"2026-08-06T21:48:35.904536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.608034Z","title":"Beyond the nav-graph: Vision-and- language navigation in continuous environments","venue":null,"work_id":"61bb401f-f5bc-4e1c-ac2f-c03e28c183df","year":2020},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.175489Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:810a67e300ce8c6180c4413c7700b0f1a4116451b5ea6a779bd8f7403b625d3f","observation_id":"99879bdb-ea16-45dd-ba5c-22102dd45fc3","resolution":{"observed_at":"2026-08-06T21:48:35.699192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.541442Z","title":"Waypoint models for instruction- guided navigation in continuous environments","venue":null,"work_id":"be8bf00a-586e-4ede-865d-57dfe562d972","year":2021},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.249070Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:df547d5a662a56fd19262a274f1ecce78a9def09509aa74117f2e9332e1b1592","observation_id":"cd83d487-b0ac-4ba7-9069-cce0e6a81eb0","resolution":{"observed_at":"2026-08-06T21:48:35.569776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.431413Z","title":"Room-across-room: Multilingual vision- and-language navigation with dense spatiotemporal ground- ing","venue":null,"work_id":"dda3d504-fe64-4daa-bedf-257b450892f4","year":2020},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.340875Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:7a7ad52cfc3f2acf7ad38f3e48dbcf4ee159598716d0b0b622b5ce36b02f823c","observation_id":"d18653d4-0ee1-4992-a813-82385d261be4","resolution":{"observed_at":"2026-08-06T21:48:35.480696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:26.412471Z","title":"Memory- maze: Scenario driven benchmark and visual language nav- igation model for guiding blind people","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.412471Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4baa8e736302421b3d816f96119856a523c81b4eeac0cf3a4380106719c02cb3","observation_id":"fb8bedc6-2a8f-47c9-9961-2a9c8b6ac6b4","resolution":{"observed_at":"2026-08-06T21:48:26.412471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:26.551761Z","title":"A path towards autonomous machine intelli- gence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.551761Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:dc0c4796969b356e86c1814720c7423d7144efce2725eb52b2b8e9c217e6c71f","observation_id":"7663fd18-2a1e-409f-b76f-534539484837","resolution":{"observed_at":"2026-08-06T21:48:26.551761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.289356Z","title":"Improving vision-and-language navigation by generating future-view image semantics","venue":null,"work_id":"262505d8-4e9c-4671-a848-150d97a60ed8","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.662887Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:af1b1b4bcf58b131563ea80258b7fa994f4068fbbea8b63270ab6c86531a16d7","observation_id":"b2f891d4-d235-4095-810d-d60d59255797","resolution":{"observed_at":"2026-08-06T21:48:35.339916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.159471Z","title":"Panogen: Text-conditioned panoramic environment generation for vision-and-language navigation","venue":null,"work_id":"f8079c24-f912-4bea-8bd7-e3bf5f9e3224","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.797335Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4a3a2db5dd88f74f47e29f6920c7f52596f4f8cf1c97617378a1348985d64eec","observation_id":"692ad3aa-eae4-476c-a38c-8750bb82ce17","resolution":{"observed_at":"2026-08-06T21:48:35.199561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:35.064743Z","title":"Vida: Homeostatic visual domain adapter for continual test time adaptation","venue":null,"work_id":"26189105-4be9-4fa4-8518-1ac92017614e","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.845342Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:6977cb0f6c40acc93d624c0accfe2faf6d468912ddcc08c42387bbb772ed2fc3","observation_id":"756369b3-4e22-4218-a047-1bd21f56b454","resolution":{"observed_at":"2026-08-06T21:48:35.103816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T21:48:26.907061Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.907061Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:1f58febdaf612e8ca64d5803f6e00aca71b9a51010fb39d3572ce1eb7a3226f7","observation_id":"62035935-7177-4b71-8151-aca6c6dc1d26","resolution":{"observed_at":"2026-08-06T21:48:26.907061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:34.969382Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"cb48135f-6df6-4b4c-b203-7d5e5a54888f","year":2017},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:26.984687Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:8a31b2bffb0e03be750939eef1b96d503ecc3aba3a5e471b12095975b5a5bb04","observation_id":"d484bfd8-fe5f-4eef-9701-d0510aa25d9e","resolution":{"observed_at":"2026-08-06T21:48:35.010762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:34.806618Z","title":"Openeqa: Embodied question answering in the era of foun- dation models","venue":null,"work_id":"f5117e13-be7f-4c88-8392-591523c8d551","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.031933Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:792bf3430a33bb0e552f6df09553e14c6482df25edbcb3d74a0e6fc5c8a74b10","observation_id":"43e12e39-d23e-457a-9ec9-a90cbf0afb0b","resolution":{"observed_at":"2026-08-06T21:48:34.866264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:27.109406Z","title":"Driveworld: 4d pre-trained scene understanding via world models for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.109406Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:a136bdcabba01f9e6581fa189ba1371986cb472f5719087bf5f23b19b0dec2e3","observation_id":"ecdf9628-16a6-4f65-962d-d89ecc1a54c3","resolution":{"observed_at":"2026-08-06T21:48:27.109406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:34.592475Z","title":"Embodiedgpt: Vision-language pre-training via embodied chain of thought","venue":null,"work_id":"9b5919b2-20a8-47fe-8784-953ba154fa10","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.178186Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:765d1bac80d6525d6a22e19b56c295eeba6cfaec47882c4445babfcb660fcfd7","observation_id":"137c7f23-75b0-4a4f-b53b-f813b609dc67","resolution":{"observed_at":"2026-08-06T21:48:34.681674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:34.470608Z","title":"Towards stable test-time adaptation in dynamic wild world","venue":null,"work_id":"37ff9bca-a152-46bc-adfc-f1445494b036","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.232073Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:b347c011b11cc4c2a8884f138d55e1d5154d60126920cfd13a34087818adacda","observation_id":"a2ebf214-e861-41d0-b2ee-ba3cf17fcc0e","resolution":{"observed_at":"2026-08-06T21:48:34.525299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:34.363314Z","title":"Dreamingv2: Re- inforcement learning with discrete world models without re- construction","venue":null,"work_id":"3ac7ec8b-ed1c-45a9-9585-8bffc848dd87","year":2022},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.306426Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:cc037d5f3a5ef410746c744fd78dd947de39a32ff13f37c0a1f5332f67441aa7","observation_id":"8f4dece5-715a-41e5-9257-48c1de7b831f","resolution":{"observed_at":"2026-08-06T21:48:34.408644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:34.247572Z","title":"Agronav: Autonomous navigation framework for agricul- tural robots and vehicles using semantic segmentation and semantic line detection","venue":null,"work_id":"dc33720b-5d13-4e7c-b159-4c6805ee4420","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.359442Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:e7cda5995b38d13f37b15b6829fd3fe37cf0fef2e1bf6cda8cf9e1692bd5aca1","observation_id":"ff51161e-13ba-4af5-b805-33e27a41d81e","resolution":{"observed_at":"2026-08-06T21:48:34.294342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:34.098492Z","title":"Visual language navi- gation: A survey and open challenges","venue":null,"work_id":"6a76db0d-fe94-4c56-aad6-c7ff99e11016","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.475460Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:94c18fc9eb1cc2dcb5f7384c000d67131525ba903ad2a4a51731b522d3c119f9","observation_id":"1d942554-139c-4a7e-905f-d9de104bfefd","resolution":{"observed_at":"2026-08-06T21:48:34.178168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:27.553513Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.553513Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:40862cb4b20f65797902b2ee6341cae0c11f3a7306b35cb7036b9c7de1c9940d","observation_id":"3e529199-b2d5-4221-b9e5-fd1bfbdc3a4c","resolution":{"observed_at":"2026-08-06T21:48:27.553513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:33.904382Z","title":"Recore: Regularized contrastive represen- tation learning of world model","venue":null,"work_id":"d65f3f37-2db8-435a-a73b-ce0df5a273f2","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.621253Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:5403cd0d3c8d5a8e95908c422d70368e20061975068dad83e8e14f54f81850e8","observation_id":"fee49297-4d16-497e-a833-ec45b18ed80f","resolution":{"observed_at":"2026-08-06T21:48:33.974033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:33.736879Z","title":"Reverie: Remote embodied visual referring expres- sion in real indoor environments","venue":null,"work_id":"dd15858e-84d2-42c7-83aa-30fd75fc7499","year":2020},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.670605Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:aac543b9a16f4708d7ebeab55347a282ca5c33782148b20629fe4a74826693b7","observation_id":"90ac3952-0043-474f-9787-0e3d964a25d0","resolution":{"observed_at":"2026-08-06T21:48:33.813190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:33.526084Z","title":"Hop+: History-enhanced and order- aware pre-training for vision-and-language navigation.IEEE TPAMI, 45(7):8524–8537, 2023","venue":null,"work_id":"d50e2573-f6bb-4561-bb57-5fbb0ab11a62","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.766348Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:755dbfaf1fd03d5521560b697d55d2ff1e26da33eb0803ed33f54da79b6b05ad","observation_id":"417bc8fc-de8d-4171-9cd2-2b17b118bb99","resolution":{"observed_at":"2026-08-06T21:48:33.635958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:33.292521Z","title":null,"venue":null,"work_id":"8e18e839-66d1-43ef-b112-cb63d1c98cf5","year":2021},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.828105Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:5634a520dae80639430e2a5870095778c0490ee8e381435684c4fc5753abe702","observation_id":"16425093-9021-4324-b938-6dbc45af3fa0","resolution":{"observed_at":"2026-08-06T21:48:33.392709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:33.043633Z","title":"A re- duction of imitation learning and structured prediction to no- regret online learning","venue":null,"work_id":"85cfdebc-f965-49eb-ac08-73003985b203","year":2011},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:27.945469Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:021ae624d529cc4a3d598c73227971212aeb99e834a28728c746d46127cef476","observation_id":"aa135900-966e-4eb3-a01c-fa8951602c4c","resolution":{"observed_at":"2026-08-06T21:48:33.170224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:28.037797Z","title":"Habitat: A plat- form for embodied ai research","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.037797Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4735c528a0658199f4bfb4a44a95b7f342a1fd754240eae720d14f67920813a2","observation_id":"16004511-98f3-4a11-b741-eb7c58648781","resolution":{"observed_at":"2026-08-06T21:48:28.037797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-17T10:15:40.814612Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-06T21:48:28.107508Z","title":"Lxmert: Learning cross- modality encoder representations from transformers","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.107508Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:bdf18716ac5ad5795e482e90f658df04d41914f74e2584d307be406ebf75bf98","observation_id":"6d81a9de-1613-4213-bc71-9f7748760389","resolution":{"observed_at":"2026-08-06T21:48:28.107508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:32.805946Z","title":"A framework towards ambient assisted living en- hanced by service robots","venue":null,"work_id":"dc623e10-6908-4918-8c08-05f85a91295c","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.202824Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:ea72dd85fb6fed82f8032ee2ade4f96bb7278143f861c0065222f5c09da62419","observation_id":"2ed62401-4794-4f66-b750-aabb1c6baa5c","resolution":{"observed_at":"2026-08-06T21:48:32.934548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:32.580969Z","title":"Using interoper- ability between mobile robot and knx technology for occu- pancy monitoring in smart home care","venue":null,"work_id":"0b181cbd-9863-4ef4-96bc-5f6be5c8cde3","year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.275124Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:c4ebd2643b73de44fa812368f8da139eb765201d20d1b2270d3c1d0e20a08a33","observation_id":"51eec46d-05db-4856-988a-cf7dcd957d32","resolution":{"observed_at":"2026-08-06T21:48:32.681566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:32.440975Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":"0c581cbf-9816-489b-a06e-569ec2f3dd63","year":2021},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.331923Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:d397f178273db132de9881cd869bf32036fbbfc87fc6f2a733ca2ee278bc857c","observation_id":"842041c1-b552-4256-be89-f9b2353543e2","resolution":{"observed_at":"2026-08-06T21:48:32.505027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:32.295912Z","title":"Dreamwalker: Mental planning for continuous vision-language navigation","venue":null,"work_id":"558bce5a-4958-4f01-88b6-a14824e33f65","year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.398993Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4412219e1a84f57bee91f19f784880b5dc89595df845c711a0d33f1443c80c9e","observation_id":"141036ed-5b23-4e3f-a0f9-3c40e8881e4b","resolution":{"observed_at":"2026-08-06T21:48:32.367901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:32.143867Z","title":"Embodiedscan: A holistic multi- modal 3d perception suite towards embodied ai","venue":null,"work_id":"ed1d87b1-a034-4e19-8880-e9a5c4f4a968","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.512798Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:f32a045e72940708a5fdcd3856b496917fb8531d627a63a2c080b64e8e2c0f51","observation_id":"d6399e6b-e747-4d71-b326-8121da700e8d","resolution":{"observed_at":"2026-08-06T21:48:32.214474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:32.022226Z","title":"Graph-based environment representation for vision-and- language navigation in continuous environments","venue":null,"work_id":"fdf5c8ee-e381-44e7-adc1-9dc65cad2347","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.583220Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:6bf0fe93596a4efbed74c86602c8f850d8e753118473ee774ffe5732657e098e","observation_id":"b506efcb-0f15-48d1-8b6a-420d4a651461","resolution":{"observed_at":"2026-08-06T21:48:32.072782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.881612Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for au- tonomous driving","venue":null,"work_id":"7effde3b-d5be-4081-91d3-ebfa6cfd662b","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.694865Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:1d47444cd7c586a07f2c9e4295b750d175ec82e71f56841d6d322e7533d1307c","observation_id":"12d46c33-e234-4b71-a877-0ab22ef68848","resolution":{"observed_at":"2026-08-06T21:48:31.950289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.705518Z","title":"Scaling data generation in vision-and-language navigation","venue":null,"work_id":"480d751b-0694-4bf3-ba5c-d97f16ea5927","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.780539Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:ab3b500301d80c2635a98e0fd66063b42983bf2463e2024f16b70c97ad98fb85","observation_id":"f1bf21e8-81f6-4e5f-9dbc-f1318a49d76e","resolution":{"observed_at":"2026-08-06T21:48:31.775716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.584868Z","title":"Gridmm: Grid memory map for vision-and- language navigation","venue":null,"work_id":"6226c97f-78b7-4b94-8f51-bf3e332a48c7","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:28.912329Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:3d6f670a425fa67b5bd4893bce6684524b80481b6ca6ca3608c18d1145013dda","observation_id":"b30e3b20-d677-4259-baee-2a4ee6746641","resolution":{"observed_at":"2026-08-06T21:48:31.620197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.485794Z","title":"Sim-to-real transfer via 3d feature fields for vision- and-language navigation","venue":null,"work_id":"c8496ded-ee35-4879-995a-86763e19070d","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.026081Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:507842389796618a16b660888d19559189f694b139738d53c6dd0e46a203e7b7","observation_id":"d2049781-371f-4de7-bc25-0190a5f03781","resolution":{"observed_at":"2026-08-06T21:48:31.544698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.374741Z","title":"Lookahead exploration with neural radiance representation for continuous vision- language navigation","venue":null,"work_id":"c89d6fca-6368-4652-a7b8-def6cbf49e3d","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.113951Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:6f0d3c4b999a791af35c3da5727f956a248f58ff8686604259d3996da7f03fe6","observation_id":"68f439d1-fbb8-460c-8ab6-aaf7bd6858c3","resolution":{"observed_at":"2026-08-06T21:48:31.432453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.300072Z","title":"Daydreamer: World models for physical robot learning","venue":null,"work_id":"21a98d42-638a-4c62-892e-3cf84858b6c4","year":2023},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.199300Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:d3c08aa24f5cedbd03a0981026c92b8a8dd1b39303254c8971e59beb372d1e45","observation_id":"ed3268a5-e5b9-49f3-878c-9bc521abe318","resolution":{"observed_at":"2026-08-06T21:48:31.331096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.218807Z","title":"Vision-language navigation: a survey and tax- onomy","venue":null,"work_id":"514b6303-8df0-4a1a-b499-84c7705d9465","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.266190Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4cec0989f973fde35b808182b7c4a010efae1fc2833b2c6e25e43ab6430b4453","observation_id":"63df4f8d-01bf-4720-a8d0-f85f57ceccea","resolution":{"observed_at":"2026-08-06T21:48:31.254586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.113296Z","title":"Holodeck: Language guided gen- eration of 3d embodied ai environments","venue":null,"work_id":"e4a4ffe5-47a9-4a37-bf17-ffd5952a23bf","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.330730Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:cc327df03f46767d6fe5b3ef1eb2c574c213141c8bc5eec28381d2bcf3cfccce","observation_id":"ba1942ec-f0c2-4ad8-abcb-530b198512e5","resolution":{"observed_at":"2026-08-06T21:48:31.155899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:31.038445Z","title":"Navid: Video-based vlm plans the next step for vision-and-language navigation","venue":null,"work_id":"dc2e98e9-0d4d-4d59-a01a-d9e61a8e1d55","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.399402Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:6a04711a0cf5def808bd80801061b513940fcf756cd4dcad4caa238f06bde6f6","observation_id":"4f86ed74-e7f1-43a6-8b6a-6fad86a3bdc9","resolution":{"observed_at":"2026-08-06T21:48:31.071875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:30.928933Z","title":"Storm: Efficient stochastic transformer based world models for reinforcement learning","venue":null,"work_id":"a624d81c-453d-4f54-9aae-8130ce64cd48","year":2024},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.508145Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:cf17ecad23bfd1a7599c0f931b1beb5e9e5f009077947a1c5ae454acf0ac8a21","observation_id":"d988d08e-5784-4811-abe4-c2ed133f2cc0","resolution":{"observed_at":"2026-08-06T21:48:30.984648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:30.834011Z","title":"There- fore, we need to infer the latent variables s1:T","venue":null,"work_id":"51bd6e9c-e689-4a71-ac12-846d8999d2f1","year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.568059Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:4e2b5c8019ac06a7ebffa7c06d93974c5c0aa28c23f9137ac4bae13722de4ff9","observation_id":"3f811f49-44b8-457a-8a2a-cef5621ff939","resolution":{"observed_at":"2026-08-06T21:48:30.873315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:30.729906Z","title":"• NE (Navigation Error) measures the average distance (in meter) between the agent’s final position in the pre- dicted trajectory and the target in the ground truth","venue":null,"work_id":"37b75714-e9c4-4cf9-bc40-b4a04575c2a6","year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.628071Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:904d196ed89c23cff51eb169d1f2fba3e31d6ac793a4f9cd165b9787d33a72e5","observation_id":"92c18f38-f5f2-45f1-890e-892466cbbfd3","resolution":{"observed_at":"2026-08-06T21:48:30.787316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:30.629037Z","title":"In conventional panoramic VLN-CE frameworks [3, 74], the agent perceives its sur- roundings through multi-view RGB-D panoramas captured at 30-degree intervals at each timestep t","venue":null,"work_id":"e7581305-4036-44b5-b043-9a7af377484b","year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.683648Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:cbbf352e6959f8651d6937d9124f493ef5bcc541f42a8640d402d2bc4e31677b","observation_id":"6c6be17a-0df2-4f23-ac73-a559e6351612","resolution":{"observed_at":"2026-08-06T21:48:30.659127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8740.5427","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:30.032898Z","title":"Walk out of the room with the bed on your right. Go through the doorway on your left, entering the bathroom","venue":null,"work_id":"c3c94d6f-a35a-4a87-b381-0be81a5d1134","year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.732777Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:84ed29ad7aa3572878f740c7b666066369af7e1c7bc69d62d5741bf62f3f61c3","observation_id":"47390b49-8379-49ba-a347-4fd9c0183908","resolution":{"observed_at":"2026-08-06T21:48:30.090088Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:48:30.543628Z","title":"Since our world model encodes high-level features instead of raw images, direct visualization of latent states remains non-trivial","venue":null,"work_id":"1b506fc4-a38f-41f0-a58b-1020b50e693a","year":null},"citing_paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:29.816737Z"},"links":{"citing_paper":"/paper/2506.23468"},"observation_digest":"sha256:460971b1cd51dd26862c3c0b4ee520eb423d3b389b935fd4bf963f15f9932fb7","observation_id":"ba99d0bc-7d22-4d0e-941c-5098d0df3bc3","resolution":{"observed_at":"2026-08-06T21:48:30.578501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23468","last_updated":"2025-07-22T03:03:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T15:49:27.296472Z","submitted_at":"2025-06-30T02:20:00Z","title":"NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments"},"reference_resolution":{"displayed":86,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":59},"total_outbound_references":86},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 86 of 86 outbound references and 4 inbound Pith citation observations for arXiv:2506.23468."}