{"as_of":"2026-08-22T21:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4319e8890ef853f3a0e526761abac10991512825adc28190c1a29fc4776c7a6a","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:34:35.346330Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08596/citation-record","integrity":"/paper/2608.08596/integrity","json":"/paper/2608.08596/citation-record.json","paper":"/paper/2608.08596"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-20T08:33:24.257852Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-14T04:34:34.982299Z","title":"arXiv preprint arXiv:2212.04385 Goal-oriented Navigation Instruction Generation with Tour Video Priors 15 (2022) 4","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.982299Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:80180cc138d998b117d541e957f536c3e9215b2a10297c53579796b0ba1f37e8","observation_id":"1b1b750b-06c1-43b7-8017-1a3d444161e0","resolution":{"observed_at":"2026-08-14T04:34:34.982299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.814167Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024) 3, 4","venue":null,"work_id":"c04a5809-b2ac-472d-a67c-c6cfca88dd07","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.987921Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:0e9b70cfdddc4f521aae0b83575f9540edff6fbf42ba913c47c691ac699a10fe","observation_id":"4145de4f-f2a2-456a-aa2e-9d7891835e44","resolution":{"observed_at":"2026-08-14T04:34:36.819200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:34.992562Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.992562Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:444e177869768cf980a85f6df81e52d4ad52fe758e38f69a1b825f97b8821383","observation_id":"343d3836-d28d-480e-9acb-580b79f79325","resolution":{"observed_at":"2026-08-14T04:34:34.992562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.789176Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":"4270f54f-0ddb-4c64-9e47-1225a70e63ae","year":2018},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.997155Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:4db2b2a931e7e8c11ece06e661ec9f983af89a0a6d66a02210dc7ef2e3a210a0","observation_id":"78268c00-a435-46d8-997b-fbcaf0198e8a","resolution":{"observed_at":"2026-08-14T04:34:36.794186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.002037Z","title":"In: 2025 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.002037Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:9bb66692de5e72e9094dbca1a256e6101be3adf34b89b3030e8f8a9f3e048ded","observation_id":"13bc2c65-0afc-47bf-a12e-d4760247563a","resolution":{"observed_at":"2026-08-14T04:34:35.002037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-14T04:34:35.007050Z","title":"5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.007050Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:8897de73722ea5e3edbcca50495b53349318c1df326cc16970b773053b7e31ee","observation_id":"098e7442-39f5-402f-8120-38b34efbc6ae","resolution":{"observed_at":"2026-08-14T04:34:35.007050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.765244Z","title":"(2025) 5, 10, 11, 6, 7","venue":null,"work_id":"7082da40-955d-4567-a121-1f1157ea66a6","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.012021Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:19cb8af3367603fd25c2a2ab7081584e82119c114c07f5ec9d09efe189aa682e","observation_id":"e3e8ee37-16da-4104-86aa-4c0d56cab0b6","resolution":{"observed_at":"2026-08-14T04:34:36.770018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.750659Z","title":"In: Pro- ceedings of the 26th annual international conference on machine learning","venue":null,"work_id":"7efdccc9-8d91-4d4b-97eb-84981f8ecbeb","year":2009},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.016888Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:df5a5f120010bcdb36da01831019eb952bb057d8655146a8de962bb347052661","observation_id":"ffce5103-1612-4216-8ee0-57ec55d2a49a","resolution":{"observed_at":"2026-08-14T04:34:36.755262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.735605Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"f2b65c07-3ca8-4c85-b8c3-2cdd5d3edc2f","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.021485Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:7a0a1263a6146169c2986a01cdb3651e644266714405e7dd2f23203dbe8fee8d","observation_id":"c0054c01-0dce-4209-916d-f6dc7da54b8a","resolution":{"observed_at":"2026-08-14T04:34:36.740365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-08-14T04:34:35.026213Z","title":"arXiv preprint arXiv:2402.11684 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.026213Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:04e8ffc5c670ecd29bc377d3e8cc8f6b6342b68700a1111b1b1196e5e8f6e201","observation_id":"a21391c9-4b25-48ca-a07e-fd9afd0f1f17","resolution":{"observed_at":"2026-08-14T04:34:35.026213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.720380Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"007865c7-e839-44af-9809-d01dcdbf61ee","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.031104Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:cbb13edecc4fcf288d8f1aed826372652639cabffbd94232584f87410a9b5092","observation_id":"000c1d06-5843-41ce-bd00-d5f3a4db4004","resolution":{"observed_at":"2026-08-14T04:34:36.725457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.705021Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"9650b100-a179-4d96-8625-d8f8d441e7e7","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.035480Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:45e09af66a63c815f343d3def7e776d53098f5d343c616c3fa9e622b3c7d2853","observation_id":"376622d5-2708-4c36-8f63-77fc8bdb67f6","resolution":{"observed_at":"2026-08-14T04:34:36.709747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-17T17:58:31.496050Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-08-14T04:34:35.040088Z","title":"arXiv preprint arXiv:2412.04453 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.040088Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:d50082aa8ddf08cc8fdb51154cdb2669ce85e13868c46b58332eca07f5b155f6","observation_id":"11c936a4-78c7-458d-821f-0029b6b698df","resolution":{"observed_at":"2026-08-14T04:34:35.040088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-16T13:35:23.650773Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-14T04:34:35.044831Z","title":"arXiv preprint arXiv:2407.07775 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.044831Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:ecc7a953b1057e64b7f4a931f312c0afb0d4de697f6c377cce650622fd9926d4","observation_id":"f35ef524-a1b3-4784-83b3-6507948d0003","resolution":{"observed_at":"2026-08-14T04:34:35.044831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.689998Z","title":"Li et al","venue":null,"work_id":"d2d153c1-3547-421d-9e5a-0922353478b6","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.049468Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:130a40d3db1193477ccdae68b5cc35aa2ecd6f7f6ad9210f511d42e42205e36e","observation_id":"efd37d8d-28d3-4251-9028-fc67088cf198","resolution":{"observed_at":"2026-08-14T04:34:36.694736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08566","last_updated":"2025-06-10T08:36:51Z","snapshot_observed_at":"2026-08-14T15:09:54.897942Z","submitted_at":"2025-06-10T08:36:51Z","title":"Generating Vision-Language Navigation Instructions Incorporated Fine-Grained Alignment Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08566","snapshot_observed_at":"2026-08-14T04:34:35.053699Z","title":"arXiv preprint arXiv:2506.08566 (2025) 2, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.053699Z"},"links":{"cited_paper":"/paper/2506.08566","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:783f63dfc6ecd86f4e9fbc96378cffcffea1a09168097d8c37268b0ba5d9a7aa","observation_id":"bbd2b0e3-7b33-4aa2-bc60-009a975a2a50","resolution":{"observed_at":"2026-08-14T04:34:35.053699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11487","last_updated":"2024-04-02T04:27:55Z","snapshot_observed_at":"2026-08-16T14:08:56.613792Z","submitted_at":"2024-03-18T05:38:07Z","title":"Can LLMs Generate Human-Like Wayfinding Instructions? Towards Platform-Agnostic Embodied Instruction Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11487","snapshot_observed_at":"2026-08-14T04:34:35.058564Z","title":"arXiv preprint arXiv:2403.11487 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.058564Z"},"links":{"cited_paper":"/paper/2403.11487","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:0e0db0d0717a3dd08e5b9afc239e2331a4869284cc08aabf2d50b865ba35d2b7","observation_id":"40aa80d8-e2d0-4a6b-8264-ef2b4ef4f743","resolution":{"observed_at":"2026-08-14T04:34:35.058564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.676228Z","title":"In: European Conference on Computer Vi- sion","venue":null,"work_id":"54dbd031-10bb-4230-9873-072c8621704c","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.063348Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:45ebc8724d456fbe18beb3af7276ab1d1eed4a8c040a27a49f92769a69950442","observation_id":"58f9e7c0-abf1-40cf-bfad-1bca45befccc","resolution":{"observed_at":"2026-08-14T04:34:36.680704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.662022Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"46ca8cd5-4a6e-408e-b012-01e09cdc2cdb","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.067618Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:65a89d208b261c9286134fcdda96eebb061609a4c4c8e0e30dd65e5c8c862640","observation_id":"9de90e1a-2e34-4c67-8298-aa4c4f77d1da","resolution":{"observed_at":"2026-08-14T04:34:36.666896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.647673Z","title":"Communi- cations of the ACM24(6), 381–395 (1981) 7","venue":null,"work_id":"d51a832a-cf38-4c39-83c7-a406155eac79","year":1981},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.071752Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:91f265b518e2c4225b0c0750a900da4cd7237e162a4557587d6faece4fb2b47e","observation_id":"869207c1-4f19-4e5d-8b07-138abc644e0e","resolution":{"observed_at":"2026-08-14T04:34:36.652467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.632922Z","title":"Advances in neural information processing sys- tems31(2018) 2, 4","venue":null,"work_id":"07202e7f-10bd-41e2-a237-5a28f2814f04","year":2018},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.075921Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:68ab336392e31b94f519df49713cbb4846662c1a7348c5f9959c6c3f5a91b75a","observation_id":"45b49681-a4bb-4f63-a638-000152dc29a0","resolution":{"observed_at":"2026-08-14T04:34:36.637759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.617956Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"c49e4b5f-3f45-449a-b602-964bef6bb9c8","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.080055Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:5789399c156802e7e156223e1fdbacef720b5bbc3e2c39d3e8a9464c2c5c1042","observation_id":"ac860cc6-4ea8-4928-a31d-62c14b767f22","resolution":{"observed_at":"2026-08-14T04:34:36.622896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.602473Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"4dca4ed7-ddba-4f06-ad23-b09e4065c951","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.084334Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:eec7a264bbcb11197489f4ce64c282d24ef74d46d403e2f1f4c405e9a06ec0ba","observation_id":"201f4bfa-bc28-4833-bd49-67c9e949a794","resolution":{"observed_at":"2026-08-14T04:34:36.607576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03603","last_updated":"2024-10-04T17:03:14Z","snapshot_observed_at":"2026-08-19T21:38:50.538146Z","submitted_at":"2024-10-04T17:03:14Z","title":"LeLaN: Learning A Language-Conditioned Navigation Policy from In-the-Wild Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03603","snapshot_observed_at":"2026-08-14T04:34:35.088481Z","title":"arXiv preprint arXiv:2410.03603 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.088481Z"},"links":{"cited_paper":"/paper/2410.03603","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:76a1fede1e44a8dd442e18afeba72029b11a506a3541dd960542ebb7f6e0c6ab","observation_id":"3e0e5581-a064-44d2-b06c-f706abe9e6d8","resolution":{"observed_at":"2026-08-14T04:34:35.088481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17403","last_updated":"2025-01-29T03:57:56Z","snapshot_observed_at":"2026-08-19T15:06:15.286138Z","submitted_at":"2025-01-29T03:57:56Z","title":"General Scene Adaptation for Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17403","snapshot_observed_at":"2026-08-14T04:34:35.092927Z","title":"arXiv preprint arXiv:2501.17403 (2025) 1, 2, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.092927Z"},"links":{"cited_paper":"/paper/2501.17403","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:95470eb3604e296b45e05a39e1eb0c3241492798b069be167b21a167b063387f","observation_id":"ed1f94d9-d410-4390-b6f3-3e4750141163","resolution":{"observed_at":"2026-08-14T04:34:35.092927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.097876Z","title":"arXiv preprint arXiv:2506.01946 (2025) 2, 5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.097876Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:c12e2989dad444c65ce520dd1e017308e7395d9b32c6c46e03e117f245a182db","observation_id":"baf2d2cf-c1f8-431f-b703-c29a3e2a2bf0","resolution":{"observed_at":"2026-08-14T04:34:35.097876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.587915Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"bd49eb21-2ad2-4e53-ba23-b2ea42687f2d","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.101980Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:a3689d82342bb5f531cfc0c20c937b89cee54c27aedd6b6221086d0cf9857b20","observation_id":"47219645-6818-472b-89b6-4b39b51a1afe","resolution":{"observed_at":"2026-08-14T04:34:36.592418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05446","last_updated":"2019-11-28T16:59:52Z","snapshot_observed_at":"2026-08-21T11:38:42.494787Z","submitted_at":"2019-07-11T18:42:03Z","title":"General Evaluation for Instruction Conditioned Navigation using Dynamic Time Warping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05446","snapshot_observed_at":"2026-08-14T04:34:35.106278Z","title":"arXiv preprint arXiv:1907.05446 (2019) 6","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.106278Z"},"links":{"cited_paper":"/paper/1907.05446","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:3ef6eb2ca4b4a9903697701cc8353630a2fbad482bbf23df6be154a200804960","observation_id":"3b9a1193-8073-40b4-937b-0bf9864444a9","resolution":{"observed_at":"2026-08-14T04:34:35.106278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.573570Z","title":"In: European Confer- ence on Computer Vision","venue":null,"work_id":"854bcf09-1c60-48f7-b8b6-4fe951faff21","year":2020},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.111206Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:f548b8e24175559c94d269d917977b15c1cb3d6d5b00cf2b347d84b6ba70c9df","observation_id":"6199eb5e-3557-48b5-abcd-3a55e07c504e","resolution":{"observed_at":"2026-08-14T04:34:36.578354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.07954","last_updated":"2020-10-15T18:01:15Z","snapshot_observed_at":"2026-08-20T08:38:25.415514Z","submitted_at":"2020-10-15T18:01:15Z","title":"Room-Across-Room: Multilingual Vision-and-Language Navigation with Dense Spatiotemporal Grounding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.07954","snapshot_observed_at":"2026-08-14T04:34:35.115493Z","title":"arXiv preprint arXiv:2010.07954 (2020) 1, 2, 4, 6, 7","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.115493Z"},"links":{"cited_paper":"/paper/2010.07954","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:f05c75c1a61a7da7f0028d4fe7ce6808766ed3170741158ef2968de0f7459de0","observation_id":"50370e0f-fdbc-4726-9b82-d38f282ff8c4","resolution":{"observed_at":"2026-08-14T04:34:35.115493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.559284Z","title":"In: Proceedings of the ACM SIGOPS 29th Symposium on Operating Systems Principles (2023) 10 Goal-oriented Navigation Instruction Generation with Tour Video Priors 17","venue":null,"work_id":"db700b10-4689-4052-9d22-654d5b384947","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.120189Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:b25034de9009f40e9188807ae79c67351e8fff1392a217eeb06244fda89efcb9","observation_id":"39b0ac29-bbd1-47eb-a0aa-16f48aca1d06","resolution":{"observed_at":"2026-08-14T04:34:36.563953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19024","last_updated":"2025-02-26T10:30:40Z","snapshot_observed_at":"2026-08-18T11:19:38.812251Z","submitted_at":"2025-02-26T10:30:40Z","title":"Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments","version":1},"cited_work":{"arxiv_id":"2502.19024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.19024","snapshot_observed_at":"2026-08-14T04:34:35.846643Z","title":"Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments","venue":"cs.RO","work_id":"886b2034-34a2-47aa-9c09-2cf6b372dc62","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.124639Z"},"links":{"cited_paper":"/paper/2502.19024","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e5473b5ec4cb489508cf4c369cf5276f6201571c16f541db5c99025058a38ea9","observation_id":"6af576d7-c101-4855-ad38-5218a0ac5a18","resolution":{"observed_at":"2026-08-14T04:34:35.853735Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.544594Z","title":"In: Text sum- marization branches out","venue":null,"work_id":"62d76559-2d88-4744-9193-07afabcb0f93","year":2004},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.129338Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:46821f3615d5a73100adfb90cd6025ada4ba2c4869affa5b078a04e8f87bd446","observation_id":"13334bd9-ff18-456f-8c77-6e86e717aa0d","resolution":{"observed_at":"2026-08-14T04:34:36.549506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.529315Z","title":"In: Proceedings of the IEEE/CVF In- ternational Conference on Computer Vision","venue":null,"work_id":"309f4542-e440-4339-97c2-9ed50752cb08","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.134115Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:c8a40c32f988d717b70cd78e7b0fad745d5104a32ba3f8e51b5bf12967722cea","observation_id":"5035417e-a662-4b64-8a85-a5b8d9243558","resolution":{"observed_at":"2026-08-14T04:34:36.534345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.513932Z","title":null,"venue":null,"work_id":"d5e29820-bb9c-4aa0-9ad7-53da6e6b09a2","year":2008},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.138566Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:870ab892562ac3b6ef4d1344f67ca3010e2d8340086b797edeb7e5aeef821bdc","observation_id":"7be0a82a-2e00-4e58-ae10-9ae15bde24d5","resolution":{"observed_at":"2026-08-14T04:34:36.518836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.498656Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"68f2a8e0-ca43-452e-b061-fbcf01e6e139","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.142977Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:dbc8c85a90e35529d7356898ea8da94a1ef141c7c5033d8243b1d2bc1c03041b","observation_id":"5383acfb-6e5b-4ab2-8e4a-03c8c8c50eb8","resolution":{"observed_at":"2026-08-14T04:34:36.503353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04882","last_updated":"2024-06-07T12:26:34Z","snapshot_observed_at":"2026-08-16T13:45:10.310910Z","submitted_at":"2024-06-07T12:26:34Z","title":"InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04882","snapshot_observed_at":"2026-08-14T04:34:35.147506Z","title":"arXiv preprint arXiv:2406.04882 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.147506Z"},"links":{"cited_paper":"/paper/2406.04882","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:46d39132c76d145286e31b5c828a5e81058834d3a20e4c7a7771292d5c3eaba1","observation_id":"2f4b9f71-157b-4c93-9465-8e3ebd044a3f","resolution":{"observed_at":"2026-08-14T04:34:35.147506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-16T14:17:49.494789Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-08-14T04:34:35.152287Z","title":"arXiv preprint arXiv:2402.14830 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.152287Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:80fd5c7dd9b422533e3178c945b88f1fe74115b8cab3fa10db57d763e968e4de","observation_id":"61dae913-21d8-4ef3-898d-32aa91fc1e9e","resolution":{"observed_at":"2026-08-14T04:34:35.152287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01805","last_updated":"2025-05-21T09:38:44Z","snapshot_observed_at":"2026-08-16T19:57:59.994547Z","submitted_at":"2025-04-02T15:12:17Z","title":"SpaceR: Reinforcing MLLMs in Video Spatial Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01805","snapshot_observed_at":"2026-08-14T04:34:35.157051Z","title":"arXiv preprint arXiv:2504.01805 (2025) 10","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.157051Z"},"links":{"cited_paper":"/paper/2504.01805","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:00de7fff12a13329e8d06a8a2b95865ffdd0161e709f1af58a3d05058d33ed74","observation_id":"f0dd3dbb-4720-4487-9afb-870f8e928d93","resolution":{"observed_at":"2026-08-14T04:34:35.157051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.484034Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"27584ca7-03bc-4fb9-8d18-e78ccbf6d65f","year":2020},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.161752Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:22744debfd2ecab5ad441903b9d51bb775a4212136dfe8215ed5342399df293d","observation_id":"5c98a439-1e7d-4dce-8e9f-bfd4926b35af","resolution":{"observed_at":"2026-08-14T04:34:36.488839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01031","last_updated":"2025-06-01T14:21:02Z","snapshot_observed_at":"2026-08-13T21:47:20.221397Z","submitted_at":"2025-06-01T14:21:02Z","title":"NavBench: Probing Multimodal Large Language Models for Embodied Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01031","snapshot_observed_at":"2026-08-14T04:34:35.166153Z","title":"arXiv preprint arXiv:2506.01031 (2025) 8","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.166153Z"},"links":{"cited_paper":"/paper/2506.01031","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:a96ab719e0084905fcd5fe788107e18c8b2d433d0ad50be77940ab9f98620793","observation_id":"81cd374f-3024-449e-aadb-4a19f7f1b7ae","resolution":{"observed_at":"2026-08-14T04:34:35.166153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.171068Z","title":"arXiv preprint arXiv:2504.00907 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.171068Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:49b1c2540b726f8700597629de198b7b6b8b4283aa3af7e3d02056f11ac17d00","observation_id":"86620621-84ee-4fb0-aa71-d10860b8aa81","resolution":{"observed_at":"2026-08-14T04:34:35.171068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.470591Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"f8b225a1-781a-41e0-9c35-01007c97279e","year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.175601Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e60e850b845fdf1ae028b6d0a534e0521a10e9a014130ca265fa33c708c538ba","observation_id":"9f612b35-8093-4fe1-8984-33a1678d2cd9","resolution":{"observed_at":"2026-08-14T04:34:36.475091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.456297Z","title":"In: Conference on robot learning","venue":null,"work_id":"19deca8e-8e36-45d2-90f2-8a39cc1c0601","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.179854Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:35092f64b488ceaf939c094f8e1a6e7807b566e23a480321b572b09fc36f12e1","observation_id":"f352e6a8-dbd4-494c-b522-d39978e18cf3","resolution":{"observed_at":"2026-08-14T04:34:36.460991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-14T04:34:35.184480Z","title":"arXiv preprint arXiv:2402.03300 (2024) 9, 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.184480Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:dcecdf5f6a915b1033c980935e8cda24df2eef6c49778d68d9633dc1c4598e17","observation_id":"25f856a5-ee88-4b32-9fd2-0f8137e1a00b","resolution":{"observed_at":"2026-08-14T04:34:35.184480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.442593Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"520ee061-2657-4323-a556-570e8499777e","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.189061Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:ef447bedb266645ecb439023afba9b00b6336e56c9b9d2ae04bac66124333622","observation_id":"608b2a8e-62f5-4983-a686-0dfb33a708f9","resolution":{"observed_at":"2026-08-14T04:34:36.447335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.04195","last_updated":"2019-04-08T17:14:52Z","snapshot_observed_at":"2026-08-17T14:44:30.657958Z","submitted_at":"2019-04-08T17:14:52Z","title":"Learning to Navigate Unseen Environments: Back Translation with Environmental Dropout","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.04195","snapshot_observed_at":"2026-08-14T04:34:35.193857Z","title":"arXiv preprint arXiv:1904.04195 (2019) 2, 4","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.193857Z"},"links":{"cited_paper":"/paper/1904.04195","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:7fc471751edc590ca4c97d0944fc6a61402ebaee5d0c411babc2c256d32ce373","observation_id":"f744108d-89ec-4dc7-802d-34cc8dbf3043","resolution":{"observed_at":"2026-08-14T04:34:35.193857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.428104Z","title":"Li et al","venue":null,"work_id":"a1173d20-7ba2-4ecb-98ae-2843aeee91b9","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.198623Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:cf9e233f5041d718c5fc87ab83009118c7a1831725bf0bb032b639f8b59af89c","observation_id":"8a88bfb0-39c2-4235-83f2-6ea352d38a8c","resolution":{"observed_at":"2026-08-14T04:34:36.432957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.413437Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pat- tern recognition","venue":null,"work_id":"f6e25f8f-3eb4-4bba-90ac-696a28b826e2","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.203035Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:395a088f8ae5d565e546cd4f75bd38b336fa670abed8ad352d5e0486c255b9f2","observation_id":"a2106c67-19e7-4cf8-97a3-c1917f455ea4","resolution":{"observed_at":"2026-08-14T04:34:36.418115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.397891Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"401a17d9-6353-4ccd-b290-ed63f1aab3de","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.208088Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:55b0a329e73b808ffd01c7615f1a0501545daca418e995d07f45b38e6a78338c","observation_id":"d3da8b0f-e371-48ec-a88f-9fd2030daf9d","resolution":{"observed_at":"2026-08-14T04:34:36.403330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.267695Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"93bf5904-e7df-40f8-8b5b-370610aff44c","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.212527Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:b47fed318378e0ffa0596d13765ae738f4960414019cbb5d33f8412a5ba194d8","observation_id":"f1659e2b-913c-4889-be9f-90b9af9e51bc","resolution":{"observed_at":"2026-08-14T04:34:36.272243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.253292Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"c5b67402-7530-4732-bb4b-06f2e2513acf","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.216891Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:42d4c018ffecff857721ee61d287b4f6309f1818feffdd74767c755567faa44a","observation_id":"149f1919-7790-4702-98ed-25939dfc7aec","resolution":{"observed_at":"2026-08-14T04:34:36.257821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.237109Z","title":"Advances in Neural Information Processing Systems37, 121475–121499 (2024) 10","venue":null,"work_id":"d383b778-8a0c-43de-bf31-f438e706e45e","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.221223Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:5e1fcd357d9507e6c8b00f7706576cf8cc8a7fa3adef0da1d88621ccd61ea835","observation_id":"abdb614d-f28b-43ff-8da1-e0a38d43229b","resolution":{"observed_at":"2026-08-14T04:34:36.243288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-08-13T18:24:04.904767Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10442","snapshot_observed_at":"2026-08-14T04:34:35.225816Z","title":"arXiv preprint arXiv:2411.10442 (2024) 10, 5","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.225816Z"},"links":{"cited_paper":"/paper/2411.10442","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e9ea3ae3f75ad196df0d050cbcafc58bd2b27c8a433de91caa0806bf89c46b44","observation_id":"603a7637-d6a6-441b-bec4-eeab0d8714b2","resolution":{"observed_at":"2026-08-14T04:34:35.225816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-14T04:34:35.230585Z","title":"5: Advancing open-source multimodal models in versatility, reasoning, and efficiency","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.230585Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:6b61ff7d9898f51fb6e0e17441e5c9a216b2b5d6410421cf798ee58cba0bd08a","observation_id":"4f8c77f6-2eaf-43d5-badc-3671d5865ef3","resolution":{"observed_at":"2026-08-14T04:34:35.230585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.222209Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"b41b07b9-d53c-4302-8505-f7e1bd513081","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.235172Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:7d02cae2b0f3ce38a0a9a3848a2bc15733fdc7632318f167272a4e962a4f8696","observation_id":"b093d542-fc31-4580-8351-244c0ff51eb0","resolution":{"observed_at":"2026-08-14T04:34:36.226824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11142","last_updated":"2025-03-07T06:06:29Z","snapshot_observed_at":"2026-08-19T21:41:31.067983Z","submitted_at":"2025-02-16T14:17:36Z","title":"NavRAG: Generating User Demand Instructions for Embodied Navigation through Retrieval-Augmented LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11142","snapshot_observed_at":"2026-08-14T04:34:35.239654Z","title":"arXiv preprint arXiv:2502.11142 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.239654Z"},"links":{"cited_paper":"/paper/2502.11142","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:96920606840d565793805d27540a1c4ea0f3e043449184fe75c9cddf66a2c94c","observation_id":"bf8f2bfc-cdf9-4e74-85b9-26d8a94918e5","resolution":{"observed_at":"2026-08-14T04:34:35.239654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08467","last_updated":"2025-02-28T08:06:39Z","snapshot_observed_at":"2026-08-16T05:34:46.091084Z","submitted_at":"2024-12-11T15:32:24Z","title":"Bootstrapping Language-Guided Navigation Learning with Self-Refining Data Flywheel","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08467","snapshot_observed_at":"2026-08-14T04:34:35.244441Z","title":"arXiv preprint arXiv:2412.08467 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.244441Z"},"links":{"cited_paper":"/paper/2412.08467","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:11247ed86244185f18ee191f284bc50949ac55149c2a374ebeda19e9099fb316","observation_id":"71b87891-78e3-4e1e-bd4d-19f698ca34ac","resolution":{"observed_at":"2026-08-14T04:34:35.244441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.207205Z","title":"In: Proceed- ings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"cca1b03f-19fb-41dc-b883-e1aae8bd4f2c","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.249070Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:cc2e75d82a68b37bfd5587d6440dcf6788902190b507db59c26e1f909543dc99","observation_id":"27cde5e7-8c3c-4309-a8ed-11a7f7693f02","resolution":{"observed_at":"2026-08-14T04:34:36.211900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.253523Z","title":"arXiv preprint arXiv:2512.08186 (2025) 9, 13","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.253523Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e2ccb65a81cf5e7a1d5fae89921ff48ba6c7fd1aba722c711085e0d0d56ade7f","observation_id":"b3d94491-d362-41fa-9680-2718fabf024d","resolution":{"observed_at":"2026-08-14T04:34:35.253523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-18T02:14:46.902275Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-08-14T04:34:35.257974Z","title":"arXiv preprint arXiv:2507.05240 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.257974Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:5bdfca433ce52eb607425e2b6375513ce6d8b3b45a2ec6ea34d57a39dad357ff","observation_id":"831a9937-39e5-4609-9668-f3f9f85f7332","resolution":{"observed_at":"2026-08-14T04:34:35.257974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.191723Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"0bcd2a8f-771b-4271-b96e-ee133971ea6c","year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.262808Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:4a0558e3f96a2a7a0962ca661a9ba12ddb2aa37d3cc6fdfe5de1ff48eb25b5ab","observation_id":"36a0d711-48c7-49e5-a7ae-6cdb7ea2a566","resolution":{"observed_at":"2026-08-14T04:34:36.196567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09547","last_updated":"2026-04-29T01:36:59Z","snapshot_observed_at":"2026-08-11T15:57:30.241116Z","submitted_at":"2025-08-13T07:05:17Z","title":"GoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09547","snapshot_observed_at":"2026-08-14T04:34:35.267252Z","title":"arXiv preprint arXiv:2508.09547 (2025) 2, 3, 5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.267252Z"},"links":{"cited_paper":"/paper/2508.09547","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:3bf21f73c197dddebc56620885cf4c638c55ceffcce1f644d6b5daa177f108ed","observation_id":"fa12c939-bcda-4fa3-a653-d3149ed5cf70","resolution":{"observed_at":"2026-08-14T04:34:35.267252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.176705Z","title":"In: Pro- ceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"42b9257e-167d-4f50-aac8-0870dd006fb9","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.271796Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e8f85662312c5ec0dd1df752ceee6d4f702dcabe951d9961bf6e60703588d8d1","observation_id":"07453ca9-bf2b-4332-8f69-0a0415bc4794","resolution":{"observed_at":"2026-08-14T04:34:36.182130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.161933Z","title":"In: 2024 IEEE International Con- ference on Robotics and Automation (ICRA)","venue":null,"work_id":"632d8a39-2ef6-4ad2-bb8a-268102b705ae","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.276064Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e9011daa3958e223834bc8676df1f5028f561d79666e44ab8c36431b80a8544a","observation_id":"accc630d-9750-46a3-a68f-7d1eeb0bd6f8","resolution":{"observed_at":"2026-08-14T04:34:36.166985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.145564Z","title":"In: 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)","venue":null,"work_id":"abb29dd2-28a1-4f28-8aec-23a6f60e21e2","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.280607Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:f29fd649cddea26b29d5d76ca3e9d81e92e2d260eadd3d4983f85e5c164ec2c5","observation_id":"289156a2-d1f2-417d-9f3a-f25b8e5dfe7a","resolution":{"observed_at":"2026-08-14T04:34:36.150183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-14T04:34:35.285162Z","title":"arXiv preprint arXiv:2309.12284 (2023) 10","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.285162Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:15e0cbe66bd9b26e22e9a8de60329036ee575b6c6857f54ac3bdc83acea8c1f4","observation_id":"aae6a15f-04ed-42f6-b78c-c1089de197c9","resolution":{"observed_at":"2026-08-14T04:34:35.285162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-18T06:58:51.738907Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-14T04:34:35.289705Z","title":"arXiv preprint arXiv:2309.05653 (2023) 10","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.289705Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:4fc9ae3a3451aab7837bf818e0a36fa2416ca6aa345f4c7c41a6a67206bcf358","observation_id":"67e71dfd-cca6-4c0d-be03-48c67cbc23f2","resolution":{"observed_at":"2026-08-14T04:34:35.289705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-16T16:28:01.153501Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06224","snapshot_observed_at":"2026-08-14T04:34:35.294644Z","title":"arXiv preprint arXiv:2412.06224 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.294644Z"},"links":{"cited_paper":"/paper/2412.06224","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:40ea5ca888ce976b5e51198421599541fcec99e673b4aaa563e3bc9d834ed6ea","observation_id":"6a882902-92c9-400f-963a-90e592a8bcaf","resolution":{"observed_at":"2026-08-14T04:34:35.294644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-08-18T12:12:42.503422Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15852","snapshot_observed_at":"2026-08-14T04:34:35.299539Z","title":"arXiv preprint arXiv:2402.15852 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.299539Z"},"links":{"cited_paper":"/paper/2402.15852","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:0006ae3f2b65f2d3e98e7a07ec3a35776bf6e1061da0520ea612bb230f81623e","observation_id":"2f63341b-19f8-493b-ba49-39f1741476db","resolution":{"observed_at":"2026-08-14T04:34:35.299539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13451","last_updated":"2026-05-09T11:40:06Z","snapshot_observed_at":"2026-08-16T21:44:26.869362Z","submitted_at":"2025-02-19T05:52:34Z","title":"MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13451","snapshot_observed_at":"2026-08-14T04:34:35.304762Z","title":"arXiv preprint arXiv:2502.13451 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.304762Z"},"links":{"cited_paper":"/paper/2502.13451","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:53f18b3f06d2998c982b43f6d3ba16f4c3aef8db389c275c41a5287884a9fdbf","observation_id":"c9497d46-7d08-4d32-a1bf-0dd7905432f0","resolution":{"observed_at":"2026-08-14T04:34:35.304762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14254","last_updated":"2025-06-10T21:36:52Z","snapshot_observed_at":"2026-08-20T13:08:53.492159Z","submitted_at":"2025-02-20T04:41:40Z","title":"Mem2Ego: Empowering Vision-Language Models with Global-to-Ego Memory for Long-Horizon Embodied Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14254","snapshot_observed_at":"2026-08-14T04:34:35.309557Z","title":"arXiv preprint arXiv:2502.14254 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.309557Z"},"links":{"cited_paper":"/paper/2502.14254","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:9f9e3938d6435a8d6180c731a862321251bc80e13b7325557af7345fb6097179","observation_id":"bd50a817-4396-4a93-8e9d-eaeeb67c883d","resolution":{"observed_at":"2026-08-14T04:34:35.309557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07035","last_updated":"2024-12-29T23:16:37Z","snapshot_observed_at":"2026-08-18T08:47:06.860781Z","submitted_at":"2024-07-09T16:53:36Z","title":"Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07035","snapshot_observed_at":"2026-08-14T04:34:35.314057Z","title":"arXiv preprint arXiv:2407.07035 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.314057Z"},"links":{"cited_paper":"/paper/2407.07035","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:9ade10c9995772372f99e9122554a9aef56f8fb2b053e69b93f6f2fae0973453","observation_id":"0a6533d1-cd21-4d58-a848-990739e88371","resolution":{"observed_at":"2026-08-14T04:34:35.314057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.10504","last_updated":"2021-01-26T01:03:49Z","snapshot_observed_at":"2026-08-18T09:28:10.726816Z","submitted_at":"2021-01-26T01:03:49Z","title":"On the Evaluation of Vision-and-Language Navigation Instructions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.10504","snapshot_observed_at":"2026-08-14T04:34:35.318996Z","title":"arXiv preprint arXiv:2101.10504 (2021) 8","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.318996Z"},"links":{"cited_paper":"/paper/2101.10504","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e7029503529f8bc57560976ae71ff9dfd3ff21a1a42c45a00c21c7a27152329e","observation_id":"19d4d347-8cb3-42c8-a3d5-1b33a7f8a959","resolution":{"observed_at":"2026-08-14T04:34:35.318996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.130882Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"087b0388-89d1-47b1-afa5-ac89a19c8935","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.323716Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:f0737a47575f2285c861adee2340bb035bbae1509cff95f8fc6e2f56bb65009c","observation_id":"4d7aca7c-31a6-4262-a3a1-4463a88b4f8f","resolution":{"observed_at":"2026-08-14T04:34:36.135480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-16T14:16:11.955412Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-14T04:34:35.328264Z","title":"arXiv preprint arXiv:2402.14658 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.328264Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:c636ef6a733ce912d7b13e437d0cbba19424c281d1de15b0acd160902833941e","observation_id":"c2c6c45d-3825-4974-85e0-8382c27e4d5f","resolution":{"observed_at":"2026-08-14T04:34:35.328264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.115622Z","title":"In: European Confer- ence on Computer Vision","venue":null,"work_id":"39cac431-87bb-469c-8fda-b089e1810c9e","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.332989Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:fefe634f041db0167275141244a32c51cb4512fdfbb080484755188561a7618e","observation_id":"871fc483-fc46-40cf-8938-d9efe4bdbfe0","resolution":{"observed_at":"2026-08-14T04:34:36.120528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.099782Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"c1390ab6-92e6-4cd1-bc68-df4848dda95f","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.337472Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:a3b21b207bc31f4fa73b510beb0c8dd1a465745dba9fc6caa283901d8b54f7bd","observation_id":"5ecec553-9d79-4bf5-a8ba-e9b4ff26f1d6","resolution":{"observed_at":"2026-08-14T04:34:36.104469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.085160Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"c993dfe5-e489-4ad9-926f-b40d178476d6","year":2021},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.341982Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:623847a9ca515457d86968de2d8609ee08baa84746e10fc01870a232930b87e3","observation_id":"df603f53-2adf-4e88-a6ba-4f5f0a28c4ff","resolution":{"observed_at":"2026-08-14T04:34:36.089812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-14T04:34:35.346330Z","title":"Move forward 100 cm","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.346330Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:20ec22a8591d6812a965511ebb15dda5a84113a97a43f784c52734231d8c170a","observation_id":"ef5ee8ff-0585-499b-8afa-4d0fa6f5d9f8","resolution":{"observed_at":"2026-08-14T04:34:35.346330Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T08:47:30.146792Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2608.08596."}