{"as_of":"2026-08-09T21:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fdbbb94c728a66b61015e988a4e8d6cd6340adf9324dbb56371157223f067130","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T13:31:23.364399Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:09:59.557766Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-07-30T06:39:40.880794Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-18T14:25:58.876978Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2401.03568"},"observation_digest":"sha256:0ae1e54ca25926aab6ac3405bc2f866b3c8885a1630fc0f722c5c8a6eae310bd","observation_id":"02e1bf55-4766-44e9-b8df-eae642b669fc","resolution":{"observed_at":"2026-05-18T14:25:59.157170Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-06T17:32:08.916929Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T19:51:36.137985Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2412.06224"},"observation_digest":"sha256:e36ed013b5dedf8d89389b1e987fff4eff85daf45df268c2a026a473613ba91d","observation_id":"28af2476-28df-4681-af85-cadd6162b821","resolution":{"observed_at":"2026-05-16T19:51:36.288054Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-09T13:31:23.364399Z","title":"Clip- nav: Using clip for zero-shot vision-and-language naviga- tion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02069","last_updated":"2025-02-04T07:40:26Z","snapshot_observed_at":"2026-08-09T13:24:52.848723Z","submitted_at":"2025-02-04T07:40:26Z","title":"LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:23.364399Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2502.02069"},"observation_digest":"sha256:0dc03fb1279add8f8f6582d94600913df96743c8a55c33e157399462e0d236b9","observation_id":"d12c190c-8d2f-45ff-83d0-4fc9f528a92b","resolution":{"observed_at":"2026-08-09T13:31:23.364399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-08T19:38:00.276632Z","title":"CLIP- Nav: Using CLIP for Zero-Shot Vision-and-Language Navi- gation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05384","last_updated":"2025-04-24T17:16:47Z","snapshot_observed_at":"2026-08-09T14:03:58.549990Z","submitted_at":"2025-02-07T23:43:34Z","title":"Demonstrating CavePI: Autonomous Exploration of Underwater Caves by Semantic Guidance","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T19:38:00.276632Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2502.05384"},"observation_digest":"sha256:f0adee4786ddf9d8defdf676f45b65ebe6df1d5a0a0cbd47aaf03845012fea56","observation_id":"9be30479-98b8-44f2-a96e-87b6c3783f3a","resolution":{"observed_at":"2026-08-08T19:38:00.276632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-08T13:14:30.081511Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation.arXiv preprint arXiv:2211.16649, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07306","last_updated":"2025-06-09T21:25:31Z","snapshot_observed_at":"2026-08-09T14:03:11.460832Z","submitted_at":"2025-02-11T07:09:37Z","title":"TRAVEL: Training-Free Retrieval and Alignment for Vision-and-Language Navigation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T13:14:30.081511Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2502.07306"},"observation_digest":"sha256:e338d8c766a6c25e8cdaefe72c11832fd3a6e76aa49e21776a4348c17ac737ae","observation_id":"3d7e7b90-3d0c-463d-a931-6e44fc8ac08d","resolution":{"observed_at":"2026-08-08T13:14:30.081511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-07T00:23:00.698604Z","title":"Sukhatme","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14507","last_updated":"2025-06-17T13:31:05Z","snapshot_observed_at":"2026-08-09T03:57:16.083004Z","submitted_at":"2025-06-17T13:31:05Z","title":"Can Pretrained Vision-Language Embeddings Alone Guide Robot Navigation?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:00.698604Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2506.14507"},"observation_digest":"sha256:e821eac8c42fc3dc5c8a0bb67896cf5ba409e9afbb927ddeeb1918c5935278e9","observation_id":"3c22e683-59c9-4af2-9a43-b6de6d942bcc","resolution":{"observed_at":"2026-08-07T00:23:00.698604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-06T22:45:23.231918Z","title":"Clip- nav: Using clip for zero-shot vision-and-language naviga- tion.arXiv preprint arXiv:2211.16649, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02929","last_updated":"2025-06-26T05:57:06Z","snapshot_observed_at":"2026-08-09T14:03:50.335818Z","submitted_at":"2025-06-26T05:57:06Z","title":"OBSER: Object-Based Sub-Environment Recognition for Zero-Shot Environmental Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:45:23.231918Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2507.02929"},"observation_digest":"sha256:6d45149f8461f071c02b8c728b9cd5feba099406b32e04147e3e39a1ef22fda1","observation_id":"d9b511d7-f51c-44ef-bfff-bcde7103d964","resolution":{"observed_at":"2026-08-06T22:45:23.231918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2512.24985","last_updated":"2026-05-12T10:54:09Z","snapshot_observed_at":"2026-07-06T22:40:27.178487Z","submitted_at":"2025-12-31T17:31:29Z","title":"DarkQA: Benchmarking Vision-Language Models on Visual-Primitive Question Answering in Low-Light Indoor Scenes","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T18:42:01.266249Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2512.24985"},"observation_digest":"sha256:abe7876fb0a20b16e6f475e1b2b358ac1e9851d600acc3b323b20cda6152515e","observation_id":"2647ea3d-4f34-44d7-9f22-98653abaa3d0","resolution":{"observed_at":"2026-05-16T18:43:16.523905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2604.07973","last_updated":"2026-04-09T08:37:20Z","snapshot_observed_at":"2026-07-06T22:57:09.435331Z","submitted_at":"2026-04-09T08:37:20Z","title":"How Far Are Large Multimodal Models from Human-Level Spatial Action? A Benchmark for Goal-Oriented Embodied Navigation in Urban Airspace","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:09:39.510770Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2604.07973"},"observation_digest":"sha256:0c3d1fc4b61d5abb73663e84d3be9ce41e554f747b76dfd6dd527fcaa57a85c6","observation_id":"ae29507b-a075-4f3f-818d-cc19d812ecfb","resolution":{"observed_at":"2026-05-11T05:25:57.266116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2604.16298","last_updated":"2026-04-17T17:59:48Z","snapshot_observed_at":"2026-07-06T23:03:39.351412Z","submitted_at":"2026-04-17T17:59:48Z","title":"FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T08:13:12.029402Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2604.16298"},"observation_digest":"sha256:80e80d9dece4cda37dc6a8ed91ef881572789139663b3d79b0e952a5dec7daf6","observation_id":"7ae10c10-5436-48a9-b4e9-38ce84c6f502","resolution":{"observed_at":"2026-05-10T08:17:37.783102Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2605.16979","last_updated":"2026-05-16T12:58:03Z","snapshot_observed_at":"2026-07-06T23:28:02.429673Z","submitted_at":"2026-05-16T12:58:03Z","title":"NORM-Nav: Zero-Shot Mobile Robot Navigation with Natural Language Behavioral Constraints","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T20:11:52.658283Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2605.16979"},"observation_digest":"sha256:0d075d66307bf6c355df59c7f66e3f4f165a1d71200cf7dad226af4fe97d36c5","observation_id":"4f670a4a-86c0-4cd4-9a19-9c12edc3ff19","resolution":{"observed_at":"2026-05-19T20:12:44.705181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:0bb688cbdeb8ebd1588f592bfef57e10b5b2fc3a6c738c194b27f61dd431f142","observation_id":"bf3fa07c-7c51-4b30-a3e2-ec3b920608f4","resolution":{"observed_at":"2026-06-29T11:53:23.904587Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2606.25136","last_updated":"2026-06-23T20:07:23Z","snapshot_observed_at":"2026-07-06T23:59:37.533078Z","submitted_at":"2026-06-23T20:07:23Z","title":"Memory Retrieval in Visuomotor Policies for Long-Horizon Robot Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-25T23:51:39.882029Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2606.25136"},"observation_digest":"sha256:aa450eaf9928a3576a0373f7608107b47a3ac21bcc02ee035dac5f1559ea029e","observation_id":"3ba348a1-0196-4ec2-90ea-b11d30a25461","resolution":{"observed_at":"2026-07-04T17:09:59.559277Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-05T04:17:18.712661Z","title":"arXiv:2211.16649 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04009","last_updated":"2026-08-04T17:59:56Z","snapshot_observed_at":"2026-08-09T09:39:43.748587Z","submitted_at":"2026-08-04T17:59:56Z","title":"SocietyBench: Forecasting Counterfactual Social-World Evolution","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-05T04:17:18.712661Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2608.04009"},"observation_digest":"sha256:2f6bd56b3e5b199f767eafccad6abf9c64ed12dc25691932fbd3a9b576acf109","observation_id":"8d2c8d4b-e06d-4a01-93ba-54e93aa04528","resolution":{"observed_at":"2026-08-05T04:17:18.712661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2211.16649/citation-record","integrity":"/paper/2211.16649/integrity","json":"/paper/2211.16649/citation-record.json","paper":"/paper/2211.16649"},"outbound":[],"paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T14:02:28.817684Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2211.16649."}