{"as_of":"2026-08-20T06:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d779545ef50dd86e1789267be71e61945a1edcb7af6d9b7a162273bd5170c45","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:53:42.217995Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12860/citation-record","integrity":"/paper/2608.12860/integrity","json":"/paper/2608.12860/citation-record.json","paper":"/paper/2608.12860"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.195854Z","title":"Optimization based full body control for the atlas robot,","venue":null,"work_id":"6485e00a-1763-4460-ba13-cba0ee31c16e","year":2014},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:38.741342Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:dac3c09af23eedd328802dd0df1fe1680739c00e92aa1f83747c620ec95db071","observation_id":"8850e181-aad4-4053-9f61-02f71174eb1c","resolution":{"observed_at":"2026-08-15T21:53:46.207260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02116","last_updated":"2025-04-19T18:59:07Z","snapshot_observed_at":"2026-08-16T12:59:45.278940Z","submitted_at":"2025-01-03T22:00:53Z","title":"Humanoid Locomotion and Manipulation: Current Progress and Challenges in Control, Planning, and Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02116","snapshot_observed_at":"2026-08-15T21:53:38.795320Z","title":"Humanoid locomotion and manipulation: Current progress and challenges in control, planning, and learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:38.795320Z"},"links":{"cited_paper":"/paper/2501.02116","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:874b4a05d5699aece9d38ac0dbc42fde322fe80223440d0786fdfed8f2d058e6","observation_id":"2d6431bb-e558-4c02-9709-0d0f72844df9","resolution":{"observed_at":"2026-08-15T21:53:38.795320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.163925Z","title":"Vision-and-language nav- igation: Interpreting visually-grounded navigation instructions in real environments,","venue":null,"work_id":"2a8b67d0-bd4e-4c78-8756-79da86eff392","year":2018},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:38.915937Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:09235c7225c4a08b79a268b1c5a1c43702f40be6bebafe82f6ef9f19e2d604d1","observation_id":"c72effe9-40d0-47d6-892b-8d021f9c246d","resolution":{"observed_at":"2026-08-15T21:53:46.170518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.122000Z","title":"Collaborative dialogue in minecraft,","venue":null,"work_id":"4460444b-58b5-43d1-8b3e-43506fb5ce81","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:39.042928Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:0925cb7a0682f7951825e67e8cbe3e0224c495147dfe034b22946aaf4119b344","observation_id":"7d35e317-e2c9-4066-96ad-42c5d38922c1","resolution":{"observed_at":"2026-08-15T21:53:46.144448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.06158","last_updated":"2017-09-18T20:34:48Z","snapshot_observed_at":"2026-08-18T04:48:01.891163Z","submitted_at":"2017-09-18T20:34:48Z","title":"Matterport3D: Learning from RGB-D Data in Indoor Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.06158","snapshot_observed_at":"2026-08-15T21:53:39.260005Z","title":"Matterport3d: Learning from rgb-d data in indoor environments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:39.260005Z"},"links":{"cited_paper":"/paper/1709.06158","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:3af40cff46c9bf3e458ea54cbcab252d930045f5bba6551cb1ad8012a526e7ec","observation_id":"284ff9fe-ab1a-4322-9d99-262398b8b2e6","resolution":{"observed_at":"2026-08-15T21:53:39.260005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.002905Z","title":"Grutopia: Dream general robots in a city at scale,","venue":null,"work_id":"53ce4444-52e8-4dc8-ae17-1e3369b034cf","year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:39.677646Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:0cbb3d78fd55a96fc2c626892ad32f5d1349259158f1244cfde8b54b2e601808","observation_id":"cf0ae7f2-c4b7-46ab-861c-8e39cd55f7b1","resolution":{"observed_at":"2026-08-15T21:53:46.059005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.251850Z","title":"Towards physically executable 3d gaussian for embodied navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.251850Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:904223846b48c4100cba34c9177bb9ad3c2898a7a75ae5af433dd390d8a75271","observation_id":"ee48fd50-ad43-4c4f-a530-4a2f3caa6c63","resolution":{"observed_at":"2026-08-15T21:53:40.251850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.942649Z","title":"3d gaussian splatting for real-time radiance field rendering.,","venue":null,"work_id":"e6e79df6-8b9b-4b32-b29a-e7ac75c50a50","year":2023},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.262586Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:7ce856ab2fac79ae9fbe3b66b75c1a63c0329441826f0425ef12482f77466e18","observation_id":"401b6f31-2e04-4ee6-b32f-20121411f00f","resolution":{"observed_at":"2026-08-15T21:53:45.956921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.307907Z","title":"Vlnverse: A benchmark for vision- language navigation with versatile, embodied, realistic simulation and evaluation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.307907Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:71b38358009795321f2db1af270ad34a9a28a38ddb866244c862138f63d8c186","observation_id":"5f507701-020b-47e7-9c2f-ddabcac489bf","resolution":{"observed_at":"2026-08-15T21:53:40.307907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.886711Z","title":"Habitat: A platform for embodied ai research,","venue":null,"work_id":"241db653-46b4-4542-8783-aca4f3087d8d","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.380281Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:7b6b5c914c2c544a42959a3a5959d93afbca251bcd0ca55facb480b98d76c8f5","observation_id":"82971a8e-b263-4150-aa02-0ba94042015d","resolution":{"observed_at":"2026-08-15T21:53:45.905574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-15T21:53:40.422070Z","title":"Ai2-thor: An inter- active 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.422070Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:1d813ab73e7681add8f78943938570ecf9387d333299c1f60eb929ad44011adc","observation_id":"9e39a8b9-e8f2-40ce-9f38-fd9a7cf82318","resolution":{"observed_at":"2026-08-15T21:53:40.422070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.436241Z","title":"Airsim: High-fidelity visual and physical simulation for autonomous vehicles,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.436241Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:2d1ead7d8d600b3f4cea7e3dcfcdab9a4e6af5b5638a14dc304be4fd5eba8edf","observation_id":"99171fbb-ea7b-4ddf-90c6-a1eb574df9aa","resolution":{"observed_at":"2026-08-15T21:53:40.436241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.611780Z","title":"Rethinking the embodied gap in vision- and-language navigation: A holistic study of physical and visual disparities,","venue":null,"work_id":"b3b26a40-cb01-41e8-b5eb-b4814ad5b0b2","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.449711Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:b7b99ea748a14bae14bd02c12a500b048fb341876e0cdcfb1bc760be2f31771d","observation_id":"455b3844-d0da-43f4-a43a-8970991fe07c","resolution":{"observed_at":"2026-08-15T21:53:45.707651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.508184Z","title":"3d gaussian ray tracing: Fast tracing of particle scenes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.508184Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:c62c9d408e8595e9fbb6f7f29e618b100ed2a7d84b4c7883c7ef24f53b4a7505","observation_id":"3d5023b3-f65d-4cbf-ab5c-e76f34f59398","resolution":{"observed_at":"2026-08-15T21:53:40.508184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.600968Z","title":"3dgut: Enabling distorted cameras and secondary rays in gaussian splatting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.600968Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:ee640d89484c57edb7ca1bf835af70494a3717882cfe2f3f4c59dfa53274fbdb","observation_id":"a44b9be2-50de-4cca-9cbf-7640990ecf7d","resolution":{"observed_at":"2026-08-15T21:53:40.600968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.383997Z","title":"Stay on the path: Instruction fidelity in vision-and-language naviga- tion,","venue":null,"work_id":"628b077d-446c-4a73-abbf-c82e95a2e27e","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.668543Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:e9ceec48c0fdb487096ae68acd008cfef23887fc00eb542ca16f0864c76a787a","observation_id":"3005c6ab-9e84-4492-b42e-13803102626f","resolution":{"observed_at":"2026-08-15T21:53:45.456070Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.236274Z","title":"Room- across-room: Multilingual vision-and-language navigation with dense spatiotemporal grounding,","venue":null,"work_id":"c221b2f5-cb58-4d13-b8ea-e93ee07cf11b","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.757992Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:ed04d93275b7ad2ab89165364c4a991d62a3264507673851efd2c3ff4257da4b","observation_id":"445bcd59-c57b-480b-99e2-a906cee2e13e","resolution":{"observed_at":"2026-08-15T21:53:45.316660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.170184Z","title":"Reverie: Remote embodied visual referring expression in real indoor environments,","venue":null,"work_id":"93fb5e6f-e8b8-48ab-aebc-38d56987173e","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.795980Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:374d54321e4e77d9ff487ae59e8cb201cd3b040edb03610e06ab648ffccebe3d","observation_id":"7845e6b2-444e-4849-a5b0-be2de87bfc11","resolution":{"observed_at":"2026-08-15T21:53:45.195203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.111724Z","title":"Soon: Scenario oriented object navigation with graph-based exploration,","venue":null,"work_id":"c1cea4a7-5c2f-4b5e-8030-ac132c2319e4","year":2021},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.807155Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:067a88eda6e814441adfebdf577dc2cc176abbcf9362832de03d60eaf69438d8","observation_id":"ea9e9ecb-1c18-47f7-8ab5-991b19810827","resolution":{"observed_at":"2026-08-15T21:53:45.126219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.969187Z","title":"Vision- and-dialog navigation,","venue":null,"work_id":"79c27488-7b70-400a-8508-856e3bfbef17","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.814475Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:61a8dc41251759f1b5b3717a22e02255bf5bf279f1131625a138de13660ac7a2","observation_id":"24a58abe-0f6d-4bae-9e95-f4717c89fa8d","resolution":{"observed_at":"2026-08-15T21:53:45.021923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.885554Z","title":"Vision-based nav- igation with language-based assistance via imitation learning with indirect intervention,","venue":null,"work_id":"c6405cc9-6bef-4a08-961d-0c006c1a9fe1","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.919868Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:9087fd9a97f66a627f679e7301df9ba9e2c4e5e19c288566c14617d5ff14a4d6","observation_id":"41cdb3ca-c7c2-4579-b1b5-3983b9f1f9ed","resolution":{"observed_at":"2026-08-15T21:53:44.919953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.746081Z","title":"Beyond the nav-graph: Vision-and-language navigation in continuous environ- ments,","venue":null,"work_id":"1d0af0d6-7475-44ef-9c9b-1dcc53e024ee","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.982003Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:6ee5b353c51b1c28dbc16cd8e7390204e895aad1263e7f01bca60ba1cd8ecb90","observation_id":"0c8167d4-abdb-4e61-8204-fb2080361841","resolution":{"observed_at":"2026-08-15T21:53:44.809907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.635789Z","title":"Towards long-horizon vision-language navigation: Platform, benchmark and method,","venue":null,"work_id":"8ce52958-92ae-485f-a81b-05e46bc91a66","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.005738Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:ea4de1e4f2dda69c9975bfdd27f8c05c62f5c224a719cae7350d5c31f5156772","observation_id":"f2724438-cef8-4751-93fc-46fa9fbcb815","resolution":{"observed_at":"2026-08-15T21:53:44.652701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.512822Z","title":"Human-aware vision-and-language navigation: Bridging simulation to reality with dynamic human inter- actions,","venue":null,"work_id":"5fd89216-2072-4298-893c-930681807607","year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.101358Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:5567f56e9a269431e003e99f2a88870707f39ff8234bafb000d637d52a9b45dc","observation_id":"da9166cf-390c-46ec-9276-53e50e6944cd","resolution":{"observed_at":"2026-08-15T21:53:44.574348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17403","last_updated":"2025-01-29T03:57:56Z","snapshot_observed_at":"2026-08-19T15:06:15.286138Z","submitted_at":"2025-01-29T03:57:56Z","title":"General Scene Adaptation for Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17403","snapshot_observed_at":"2026-08-15T21:53:41.192201Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.192201Z"},"links":{"cited_paper":"/paper/2501.17403","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:e5039c0baafe7ee8d6ec65eb84dbafaee1d0369ed27f6cf80e5ce5d4ec123bc0","observation_id":"3039ad18-0c5a-42f4-8c0a-9379d0803090","resolution":{"observed_at":"2026-08-15T21:53:41.192201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:41.245454Z","title":"gsplat: An open-source library for gaussian splatting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.245454Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:c460de244aaedceb47d847cdb2e4d47c64d36a053b6656076b22507fda380c0f","observation_id":"cd93fdd8-7cea-455c-8990-9390df0771e1","resolution":{"observed_at":"2026-08-15T21:53:41.245454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.415813Z","title":"2d gaussian splatting for geometrically accurate radiance fields,","venue":null,"work_id":"efd6d801-468c-40a1-8228-66b3782ceec5","year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.257585Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:35d586082f582f136fabb9195a65e6ccbc8a1f86da819c61e3ca133fc639cbcf","observation_id":"e4c8d764-5863-403e-bdac-f9fb1fc55874","resolution":{"observed_at":"2026-08-15T21:53:44.431882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.309704Z","title":"Sparse voxels ras- terization: Real-time high-fidelity radiance field rendering,","venue":null,"work_id":"7b539aaf-5bce-4eba-a935-e0dc7ebfdf50","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.558475Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:d5adc017e2be9a4f5ede7a1d7f456246d546a3d51f85e99aa6153287627f501a","observation_id":"7755b901-2c53-4546-8fb7-399bdc0a7eb8","resolution":{"observed_at":"2026-08-15T21:53:44.375549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.242732Z","title":"Habitat-gs: A high-fidelity navigation simulator with dynamic gaussian splatting,","venue":null,"work_id":"29da5d96-5041-4922-9d43-3a1d7868c617","year":2026},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.666703Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:5d6bde4047d327a0724a08b433f7e6a38192c6a99093a53c06e64c5c02505eee","observation_id":"9df11dcf-1329-49a9-88a1-1c4e02ca8fd3","resolution":{"observed_at":"2026-08-15T21:53:44.255424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.186202Z","title":"Pgsr: Planar-based gaussian splatting for efficient and high-fidelity surface reconstruction,","venue":null,"work_id":"b5eb4ba7-8721-4e9c-85b8-a295017448e1","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.716801Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:f784074fbf8153763b19f3e7b41175f664d86e672da5c014cabd9f1aa02558c1","observation_id":"f03a4f04-39d1-4a26-a4f1-1d9a40fdd819","resolution":{"observed_at":"2026-08-15T21:53:44.197702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.029212Z","title":"Kinectfusion: Real-time dense surface mapping and tracking,","venue":null,"work_id":"3353c4b1-e551-4708-be28-5e66f649c73f","year":2011},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.775904Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:977f3d74d537caf8f13597ddd4a52c0317d0a0bf669d79e75466223ba7844310","observation_id":"cf251642-b136-40fe-b9dc-7c0b1b48a33d","resolution":{"observed_at":"2026-08-15T21:53:44.106979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:41.827041Z","title":"Structure-from-motion revisited,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.827041Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:7c744136a43844df8498ae8941f58bf6b2248f3d163f58fd01d51b166a7f69d8","observation_id":"ee2e69a0-8667-41d2-abbc-631579574f3a","resolution":{"observed_at":"2026-08-15T21:53:41.827041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:41.853446Z","title":"Pixel- wise view selection for unstructured multi-view stereo,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.853446Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:6e2b3dfec2a8667ba2eabbc352b907bf363ff8cd69f4ee2aeccdd8aad9a09567","observation_id":"0e807059-22c0-4ab2-abed-1617b862943c","resolution":{"observed_at":"2026-08-15T21:53:41.853446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-15T21:53:41.879726Z","title":"Qwen3-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.879726Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:af029adfbe15519ded18335252bba5a4385630fbf0d668b70e44fd89013a2467","observation_id":"2252faf0-c937-488f-ae50-342aceb6ed2c","resolution":{"observed_at":"2026-08-15T21:53:41.879726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:43.663384Z","title":"Gemma 4 technical report,","venue":null,"work_id":"f499f6a3-5feb-4e55-ab7f-b82265c9a15e","year":2026},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.888286Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:c819c432a80feb587e8223ad78970c06d8604728548bbe6dfe6e77638e0c25f6","observation_id":"a9f0e1fd-9c48-4eb8-a481-0f7972137409","resolution":{"observed_at":"2026-08-15T21:53:43.767393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-15T21:53:41.894860Z","title":"Internvl3. 5: Advancing open-source multi- modal models in versatility, reasoning, and efficiency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.894860Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:627bc53517517dfa8bc94cdf97d5d48cfb78937353b664cd7e1185c98d526dbd","observation_id":"d37620a3-9ece-416d-97c6-2f40844c1318","resolution":{"observed_at":"2026-08-15T21:53:41.894860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-17T17:58:31.496050Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-08-15T21:53:41.907818Z","title":"Navila: Legged robot vision-language- action model for navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.907818Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:bb75e33ebc13e30917fcd7ff82abe4cba6b64483d4b7708fabf95e5984dece5a","observation_id":"a860a33c-fd01-4431-890e-a63af14b9b69","resolution":{"observed_at":"2026-08-15T21:53:41.907818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-18T02:14:46.902275Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-08-15T21:53:41.980807Z","title":"Streamvln: Streaming vision-and- language navigation via slowfast context modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.980807Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:1c8b71a15b84391636e5eecfc62fc9c173ff7c429f4706768c663faefcf10130","observation_id":"bd6b9e4f-7f68-4b38-a83b-b6bfe5d8cc8a","resolution":{"observed_at":"2026-08-15T21:53:41.980807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:42.073287Z","title":"Ground slow, move fast: A dual-system foundation model for generalizable vision-and-language navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:42.073287Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:9ce01267241f1804d6cb96394ffe5cd7a6ae5b5907299da5e873e96d578b599f","observation_id":"3d88c808-1b09-4f91-9ce3-ebc4aa291b6b","resolution":{"observed_at":"2026-08-15T21:53:42.073287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:42.217995Z","title":"Janusvln: Decoupling semantics and spatiality with dual implicit memory for vision-language navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:42.217995Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:029a68e5dcba88a7c151923af5a0e43235fa922b562e60d3622e32da75cbc418","observation_id":"2af89980-7f63-49cc-839b-5b7231469be7","resolution":{"observed_at":"2026-08-15T21:53:42.217995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-19T15:06:55.276064Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2608.12860."}