{"as_of":"2026-08-15T15:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71aa3c1153a1edc83520a195a5667e17ceea2547836b0bccc99e7fe03310f524","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:34:35.044831Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T04:29:35.802946Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-12T18:42:53.105491Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11323","last_updated":"2024-11-18T06:33:05Z","snapshot_observed_at":"2026-08-13T08:44:31.384895Z","submitted_at":"2024-11-18T06:33:05Z","title":"SayComply: Grounding Field Robotic Tasks in Operational Compliance through Retrieval-Based Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:42:53.105491Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2411.11323"},"observation_digest":"sha256:3c738c5044bee026739e3b001ecfa22778893279611df41e63a794860d70d572","observation_id":"dbab5946-d683-4b65-9bcc-d5e1fd584c9f","resolution":{"observed_at":"2026-08-12T18:42:53.105491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-12T18:51:16.353817Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs.arXiv preprint arXiv:2407.07775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13587","last_updated":"2025-08-01T03:41:06Z","snapshot_observed_at":"2026-08-14T09:36:11.008492Z","submitted_at":"2024-11-18T01:52:20Z","title":"Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:51:16.353817Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2411.13587"},"observation_digest":"sha256:e3a86db85efea9b510a38675ee2cac25c07479889fee14d7ead17b973833516b","observation_id":"58da1932-d45a-4aef-96fa-4b9dcf45d918","resolution":{"observed_at":"2026-08-12T18:51:16.353817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-12T14:41:10.406746Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15018","last_updated":"2024-11-22T15:47:42Z","snapshot_observed_at":"2026-08-15T02:59:45.449511Z","submitted_at":"2024-11-22T15:47:42Z","title":"Neural 4D Evolution under Large Topological Changes from 2D Images","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:41:10.406746Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2411.15018"},"observation_digest":"sha256:956d8091d23cd6f3e0b8d78800955594752d0ca73ee6fc97fbc9a49b62be4c91","observation_id":"377329ab-0abf-4a49-ae71-30697c46578d","resolution":{"observed_at":"2026-08-12T14:41:10.406746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-12T04:35:32.629919Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01250","last_updated":"2025-03-18T16:09:20Z","snapshot_observed_at":"2026-08-12T23:22:46.762873Z","submitted_at":"2024-12-02T08:16:38Z","title":"Collaborative Instance Object Navigation: Leveraging Uncertainty-Awareness to Minimize Human-Agent Dialogues","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T04:35:32.629919Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2412.01250"},"observation_digest":"sha256:b20006e9e6e4163a2c23051f144447b842811d91e872cf4c14d29cd0227e8052","observation_id":"5051ee7d-f1c8-47ea-a058-f3c6afcdff71","resolution":{"observed_at":"2026-08-12T04:35:32.629919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-11T16:58:02.947998Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09616","last_updated":"2024-12-13T04:58:33Z","snapshot_observed_at":"2026-08-14T18:32:28.081516Z","submitted_at":"2024-12-12T18:59:46Z","title":"V2PE: Improving Multimodal Long-Context Capability of Vision-Language Models with Variable Visual Position Encoding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T16:58:02.947998Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2412.09616"},"observation_digest":"sha256:afff7ac507ae0719c67142b5d597aa96000c3acdfc550f25b8e0094391e1c4f5","observation_id":"24f56ff0-e31c-4fa0-86c8-56cd84871e9f","resolution":{"observed_at":"2026-08-11T16:58:02.947998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-10T23:18:21.196144Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20742","last_updated":"2024-12-30T06:34:18Z","snapshot_observed_at":"2026-08-13T13:55:29.561149Z","submitted_at":"2024-12-30T06:34:18Z","title":"UniRS: Unifying Multi-temporal Remote Sensing Tasks through Vision Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T23:18:21.196144Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2412.20742"},"observation_digest":"sha256:875f41d40053584fd645ce9d2f06b44b36ebb964e32ecf117ea27706ad634039","observation_id":"f0d34255-e33e-49db-837d-38721ecf3295","resolution":{"observed_at":"2026-08-10T23:18:21.196144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-07T14:23:17.645992Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs.arXiv preprint arXiv:2407.07775,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19080","last_updated":"2025-05-25T10:24:44Z","snapshot_observed_at":"2026-08-13T23:10:23.707893Z","submitted_at":"2025-05-25T10:24:44Z","title":"ReFineVLA: Reasoning-Aware Teacher-Guided Transfer Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:17.645992Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2505.19080"},"observation_digest":"sha256:0f8d8b5c04a4a0412df6c92c99aea4356503432e23e57a3a92f5fb0bcbf80180","observation_id":"a4ad4753-659c-4dfb-9d7b-f3adf0084e78","resolution":{"observed_at":"2026-08-07T14:23:17.645992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-07T11:55:47.755002Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01174","last_updated":"2025-06-01T21:13:38Z","snapshot_observed_at":"2026-08-15T10:01:25.974659Z","submitted_at":"2025-06-01T21:13:38Z","title":"GraphPad: Inference-Time 3D Scene Graph Updates for Embodied Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:47.755002Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2506.01174"},"observation_digest":"sha256:0a35a82019a9ca364a9dfea0bba38da52f3279ec7feee03d25cd483e4f3b10e6","observation_id":"8350be29-6b15-4fc8-91eb-b4463f5830ee","resolution":{"observed_at":"2026-08-07T11:55:47.755002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-07T11:11:40.301692Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs.arXiv preprint arXiv:2407.07775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03350","last_updated":"2025-06-03T19:43:58Z","snapshot_observed_at":"2026-08-10T20:18:21.272344Z","submitted_at":"2025-06-03T19:43:58Z","title":"Adversarial Attacks on Robotic Vision Language Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:11:40.301692Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2506.03350"},"observation_digest":"sha256:e6768ed3b135bed4335253bc6d8e4b8ab4c7ea0b64a20562480a6f785c9bd1ca","observation_id":"5f28870d-87a9-47b5-aef3-fddf90adbc18","resolution":{"observed_at":"2026-08-07T11:11:40.301692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":"2407.07775","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-04T04:29:35.802946Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":"20157d68-0547-45da-993b-cd020498a498","year":2024},"citing_paper":{"arxiv_id":"2506.13456","last_updated":"2026-05-13T10:49:00Z","snapshot_observed_at":"2026-08-13T09:24:06.315929Z","submitted_at":"2025-06-16T13:14:58Z","title":"Block-wise Adaptive Caching for Accelerating Diffusion Policy","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T09:36:09.790248Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2506.13456"},"observation_digest":"sha256:e7c7d2064d43537e614bcd2b6cb3813bd8c3672348d2db53a12297e1a3fc589a","observation_id":"55fdb703-89ad-4f8d-9e8f-1c51f6a336d8","resolution":{"observed_at":"2026-05-19T09:37:14.003506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-06T13:14:24.028400Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20892","last_updated":"2025-07-28T14:44:36Z","snapshot_observed_at":"2026-08-09T17:38:22.661790Z","submitted_at":"2025-07-28T14:44:36Z","title":"PixelNav: Towards Model-based Vision-Only Navigation with Topological Graphs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:14:24.028400Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2507.20892"},"observation_digest":"sha256:7af5ce1ea7a9be46b57832a0cd88a9b9a83e104b9d16f3965e67e0b64b3994c1","observation_id":"48c744a6-e738-4f39-860f-39c49c376a46","resolution":{"observed_at":"2026-08-06T13:14:24.028400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-05T20:31:38.266231Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10399","last_updated":"2025-08-14T06:56:16Z","snapshot_observed_at":"2026-08-10T16:57:45.636309Z","submitted_at":"2025-08-14T06:56:16Z","title":"Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:38.266231Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2508.10399"},"observation_digest":"sha256:86f9174870181e832697be222e0185779807596578fa2844fed70a41a0070d19","observation_id":"7129e8ec-9491-4168-a591-702f1a8d6c4a","resolution":{"observed_at":"2026-08-05T20:31:38.266231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-05T19:06:28.522220Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13446","last_updated":"2026-06-08T21:52:42Z","snapshot_observed_at":"2026-08-07T21:58:57.623091Z","submitted_at":"2025-08-19T02:01:06Z","title":"CAST: Counterfactual Labels Improve Instruction Following in Vision-Language-Action Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T19:06:28.522220Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2508.13446"},"observation_digest":"sha256:6f544396939a569d16062a2b1a67e563f5f90edb85a81091fc6878238533aa8b","observation_id":"cdabf6ff-271d-431b-a380-6a3f1b806017","resolution":{"observed_at":"2026-08-05T19:06:28.522220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-04T20:21:06.273621Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08699","last_updated":"2025-09-10T15:43:32Z","snapshot_observed_at":"2026-08-10T15:53:21.964477Z","submitted_at":"2025-09-10T15:43:32Z","title":"TANGO: Traversability-Aware Navigation with Local Metric Control for Topological Goals","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T20:21:06.273621Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2509.08699"},"observation_digest":"sha256:06c344fde23918bc9dbe482b52e8930e8ff33ccb34e4c646fc1d62ede989bc26","observation_id":"40206fad-ff53-4f74-ac6b-af18c1a46502","resolution":{"observed_at":"2026-08-04T20:21:06.273621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-03T05:38:47.862434Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topo- logical graphs.arXiv preprint arXiv:2407.07775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.01662","last_updated":"2026-05-31T01:44:31Z","snapshot_observed_at":"2026-08-07T05:31:58.364563Z","submitted_at":"2026-02-02T05:30:14Z","title":"PLanAR: Planning-Language-Grounded Agentic Reasoning for Robot Manipulation","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T05:38:47.862434Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2602.01662"},"observation_digest":"sha256:4681b55357acea19ff9b89872c284da08bd06b9fbdfc1da7d2816804cc17194a","observation_id":"53337fc5-e3d7-4525-bbde-5a132cb8dad7","resolution":{"observed_at":"2026-08-03T05:38:47.862434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":"2407.07775","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-04T04:29:35.802946Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":"20157d68-0547-45da-993b-cd020498a498","year":2024},"citing_paper":{"arxiv_id":"2602.10698","last_updated":"2026-02-11T09:57:32Z","snapshot_observed_at":"2026-08-11T15:16:51.530916Z","submitted_at":"2026-02-11T09:57:32Z","title":"AugVLA-3D: Depth-Driven Feature Augmentation for Vision-Language-Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T06:01:30.803128Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2602.10698"},"observation_digest":"sha256:4b2cbcc36443359cfc19f52d4625dfc26ac35cfb1250e46a738db33fe14cc1ae","observation_id":"fcd62f20-31ea-499e-88b0-c225289c880e","resolution":{"observed_at":"2026-05-16T06:02:24.984071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":"2407.07775","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-04T04:29:35.802946Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":"20157d68-0547-45da-993b-cd020498a498","year":2024},"citing_paper":{"arxiv_id":"2604.17800","last_updated":"2026-04-20T04:46:20Z","snapshot_observed_at":"2026-08-13T00:43:49.688771Z","submitted_at":"2026-04-20T04:46:20Z","title":"ReFineVLA: Multimodal Reasoning-Aware Generalist Robotic Policies via Teacher-Guided Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T05:06:38.517652Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2604.17800"},"observation_digest":"sha256:f15e0d60ad9eb1921ea640361e08a40fbe29985c951c539370d0de72156fd318","observation_id":"4ac5f567-ed9d-4263-a439-31daf93ddfe7","resolution":{"observed_at":"2026-05-10T09:48:48.404041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":"2407.07775","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-04T04:29:35.802946Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":"20157d68-0547-45da-993b-cd020498a498","year":2024},"citing_paper":{"arxiv_id":"2604.19034","last_updated":"2026-04-21T03:35:31Z","snapshot_observed_at":"2026-08-13T20:53:03.100797Z","submitted_at":"2026-04-21T03:35:31Z","title":"Explore Like Humans: Autonomous Exploration with Online SG-Memo Construction for Embodied Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T03:20:35.854120Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2604.19034"},"observation_digest":"sha256:692e84cbe826d986642fa51572f1e3181d45ed09d3a6cfb7bbe6d5c2f018f5a9","observation_id":"ae1f6571-fa03-45f7-a9f2-0a36ddadcb6d","resolution":{"observed_at":"2026-05-11T12:41:01.504124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":"2407.07775","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-04T04:29:35.802946Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":"20157d68-0547-45da-993b-cd020498a498","year":2024},"citing_paper":{"arxiv_id":"2604.24086","last_updated":"2026-04-27T06:20:15Z","snapshot_observed_at":"2026-08-03T03:51:20.015005Z","submitted_at":"2026-04-27T06:20:15Z","title":"AsyncShield: A Plug-and-Play Edge Adapter for Asynchronous Cloud-based VLA Navigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T03:18:03.855477Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2604.24086"},"observation_digest":"sha256:4921c47b2b1eb3d2afd02317bc74a16e646945b37e2bdbbea1e972cb5c7559c3","observation_id":"b936bc5a-ff0e-4026-92a9-ec9cf81b77c8","resolution":{"observed_at":"2026-05-11T22:11:13.809789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":"2407.07775","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-04T04:29:35.802946Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs","venue":null,"work_id":"20157d68-0547-45da-993b-cd020498a498","year":2024},"citing_paper":{"arxiv_id":"2606.20905","last_updated":"2026-06-18T20:01:32Z","snapshot_observed_at":"2026-08-03T03:13:19.923134Z","submitted_at":"2026-06-18T20:01:32Z","title":"Vesta: A Generalist Embodied Reasoning Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T16:55:12.518255Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2606.20905"},"observation_digest":"sha256:65383954a78a8fe97edbeede9dcf2dcc8d77a95edd6499f92c364ede1a3f8a39","observation_id":"2ea5df08-0ac6-4e8d-930a-515e476863d0","resolution":{"observed_at":"2026-07-04T04:29:35.804604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-11T08:29:01.477958Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topo- logical graphs.arXiv preprint arXiv:2407.07775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05122","last_updated":"2026-07-06T14:11:27Z","snapshot_observed_at":"2026-08-14T00:00:40.513858Z","submitted_at":"2026-07-06T14:11:27Z","title":"Green for Go, Red for No: Visual Grounding via Semantic Segmentation for VLA Navigation Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T08:29:01.477958Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2607.05122"},"observation_digest":"sha256:1a29492e5735d9d854e9f805be531d9965396964ea7b651d83c606a0fff6e4c9","observation_id":"e010aa7e-79b6-4b1e-9885-a936b56077a3","resolution":{"observed_at":"2026-07-11T08:29:01.477958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-07-14T12:10:21.115628Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs.arXiv preprint arXiv:2407.07775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10383","last_updated":"2026-07-17T07:17:10Z","snapshot_observed_at":"2026-08-15T04:55:37.663058Z","submitted_at":"2026-07-11T16:21:03Z","title":"ABot-N1: Toward a General Visual Language Navigation Foundation Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T12:10:21.115628Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2607.10383"},"observation_digest":"sha256:83a09e933c44087f1eec95c2772435ce9b5a24932c91f65800bb953476cd88d5","observation_id":"1b64d142-7b55-4f65-9f47-11f48f6b09ad","resolution":{"observed_at":"2026-07-14T12:10:21.115628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-02T07:19:38.021123Z","title":"Mobility vla: Multimodal instruction navigation with long-context vlms and topological graphs.arXiv preprint arXiv:2407.07775, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10383","last_updated":"2026-07-17T07:17:10Z","snapshot_observed_at":"2026-08-15T04:55:37.663058Z","submitted_at":"2026-07-11T16:21:03Z","title":"ABot-N1: Toward a General Visual Language Navigation Foundation Model","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T07:19:38.021123Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2607.10383"},"observation_digest":"sha256:966cb2527c80da24642a54b13cdbfa956a52bc1a438156701dd0a6fceba78e67","observation_id":"b23e3ce2-1839-463e-808a-8e25af104d0d","resolution":{"observed_at":"2026-08-02T07:19:38.021123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-14T04:34:35.044831Z","title":"arXiv preprint arXiv:2407.07775 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-15T01:51:24.183934Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.044831Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:73af62b87c396e63a678126bbb2e98d4709cf44ad3dc4c21ea35e9486561d3b6","observation_id":"f35ef524-a1b3-4784-83b3-6507948d0003","resolution":{"observed_at":"2026-08-14T04:34:35.044831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.07775/citation-record","integrity":"/paper/2407.07775/integrity","json":"/paper/2407.07775/citation-record.json","paper":"/paper/2407.07775"},"outbound":[],"paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2407.07775."}