{"as_of":"2026-08-04T14:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:690b99fad22f5815d5bf21e9c45df40df6c63eaca17038bfe4a1cef0ae8f2e97","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T20:00:20.895672Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T17:47:00.822691Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T17:56:25.534098Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"cited_work":{"arxiv_id":"2511.17792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17792","snapshot_observed_at":"2026-07-09T17:56:25.534098Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","venue":"cs.CV","work_id":"9175e6fc-4bb4-45e3-805b-08d56112a397","year":2025},"citing_paper":{"arxiv_id":"2604.07957","last_updated":"2026-04-09T08:21:58Z","snapshot_observed_at":"2026-07-06T22:57:09.435331Z","submitted_at":"2026-04-09T08:21:58Z","title":"WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T18:23:44.198943Z"},"links":{"cited_paper":"/paper/2511.17792","citing_paper":"/paper/2604.07957"},"observation_digest":"sha256:93ffe96ec11485b7488c69d019e695a6b8c015163e7d5f7e2337a286189d8e31","observation_id":"4c328b02-8534-4e26-848a-e40aea0c2f9a","resolution":{"observed_at":"2026-05-11T00:41:05.794467Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"cited_work":{"arxiv_id":"2511.17792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17792","snapshot_observed_at":"2026-07-09T17:56:25.534098Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","venue":"cs.CV","work_id":"9175e6fc-4bb4-45e3-805b-08d56112a397","year":2025},"citing_paper":{"arxiv_id":"2607.07196","last_updated":"2026-07-08T09:30:31Z","snapshot_observed_at":"2026-07-11T23:18:59.407134Z","submitted_at":"2026-07-08T09:30:31Z","title":"Validate the Dream Before You Trust Its Verdict: Admissibility for World-Model Simulators","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-09T17:47:00.822691Z"},"links":{"cited_paper":"/paper/2511.17792","citing_paper":"/paper/2607.07196"},"observation_digest":"sha256:541dbf464ee5f94b153bc3517fb28d83874283c9013995c6b6213cdee35c7a95","observation_id":"e1753fda-f8fa-45a9-ac42-1e21a4967246","resolution":{"observed_at":"2026-07-09T17:56:25.536427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2511.17792/citation-record","integrity":"/paper/2511.17792/integrity","json":"/paper/2511.17792/citation-record.json","paper":"/paper/2511.17792"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21282","last_updated":"2026-04-19T13:43:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-27T14:51:34Z","title":"EgoWalk: A Multimodal Dataset for Robot Navigation in the Wild","version":2},"cited_work":{"arxiv_id":"2505.21282","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21282","snapshot_observed_at":"2026-07-03T17:58:47.410606Z","title":"EgoWalk: A Multimodal Dataset for Robot Navigation in the Wild","venue":"cs.RO","work_id":"02230cd0-3610-45ca-80e9-8adac327d793","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2505.21282","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:ed23649a793dfddb7dc71913760b4e918ff248e4a4c5b786cff353d3cc5c8f0c","observation_id":"c7915670-d168-4786-8e70-7a01f70ec324","resolution":{"observed_at":"2026-05-17T20:02:04.165482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion for world modeling: Visual details matter in atari","venue":null,"work_id":"f0039dcb-68fd-4bd0-8df2-89843f78c5bd","year":2024},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:0e6bbcf1fbf856367a4be57dd99b7d07ec3b72e883d0b303fcae35168bbb9c7e","observation_id":"0e846d1c-fed1-41de-994d-979432838b30","resolution":{"observed_at":"2026-05-17T20:02:04.684788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V-jepa 2: Self-supervised video models enable understanding, prediction and planning","venue":null,"work_id":"b2657eff-cb70-4f4b-8984-1d498a9b2781","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:b4e79fe529484c0701fd7d710bcfd5af6bc6dd5a2c484e853930dfeea734e183","observation_id":"fe3a98df-c051-4185-a46e-ba98e964bfb5","resolution":{"observed_at":"2026-05-17T20:02:04.698700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"354529ab-45b1-4d5d-ab79-4bf69fb63049","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:1169b4559f8b21380095e9c8ff621a03a29f91a35a17e975c71940876bebd34e","observation_id":"b96247be-4946-4918-a011-6af790185c67","resolution":{"observed_at":"2026-05-17T20:02:04.687810Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video generation models as world simulators","venue":null,"work_id":"775c18a1-70c0-4557-8352-9608c63bdd24","year":null},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:fc32a29e26781c1635bc3ac5d9b8d82210ea033cd7b4433b11ec2c3c43d193d6","observation_id":"88c36411-580e-4ede-82a4-f10f2c07ab8d","resolution":{"observed_at":"2026-05-17T20:02:04.654462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Genie: Gener- ative interactive environments","venue":null,"work_id":"d22e5060-0458-43ca-ac7e-ec2cfa688982","year":null},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:e3063ec2bc3eddfa16a220a755f7ec728b7e6353e6efd65a1051d1553e15311a","observation_id":"e14be53c-18a5-4b96-a3a9-c2c4e788c25b","resolution":{"observed_at":"2026-05-17T20:02:04.670054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Veo 3: Advanced controllable video gen- eration with physics-aware dynamics","venue":null,"work_id":"16caeab0-224d-4d8a-b96c-c3e378d13f26","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:0b399622ea5ffb3d3d585d523d0066311d791bde6eb3382a703aca626f8a61f2","observation_id":"e879c631-951f-4154-8cd8-6b3f64b7a575","resolution":{"observed_at":"2026-05-17T20:02:04.649495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.00983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.342857Z","title":"Worldscore: A unified evaluation benchmark for world generation","venue":null,"work_id":"ad14fa35-72b1-4530-b01a-6d41cd35888d","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:784875bbff878eb3f6b7855e34986928b30d441c66f217f552b83e292ee02f60","observation_id":"4d2239f3-8704-4835-b50d-3f300e7aba46","resolution":{"observed_at":"2026-05-17T20:02:04.200481Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.11526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T02:59:26.725426Z","title":"Foundation models in autonomous driving: A survey on scenario generation and scenario analysis","venue":null,"work_id":"0ae840a3-8e64-41d1-96e6-016fa1d533c9","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:9e448552ce6e008be875423ccc54c65716b229b6c29adf6aa74c1cd905c98c0b","observation_id":"086c6f0b-c1f9-47ab-a456-8f32bc0a2ce3","resolution":{"observed_at":"2026-05-17T20:02:04.216915Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"0c2d20f2-0305-4f41-99b0-3e9345f12cbb","year":2018},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:938ae873ed0bfe290b3e42dfa57677b94d4675ccf306700313c16c35502593ea","observation_id":"af496ad0-0cfc-42f6-85f5-ed1a6091a0a2","resolution":{"observed_at":"2026-05-17T20:02:04.667103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dream to control: Learning behaviors by la- tent imagination","venue":null,"work_id":"e87ef977-ffc2-49cc-a1bb-493f7a8e5065","year":2020},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:12a3d9fd9dbc644d72b9dab8fa1119e19360f0335ee25df7cfe645e16dd8c86d","observation_id":"9941beed-b716-476e-8166-dc1f0b4093f6","resolution":{"observed_at":"2026-05-17T20:02:04.678141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sacson: Scalable autonomous control for social nav- igation.IEEE Robotics and Automation Letters, 9(1):49–56","venue":null,"work_id":"9398f1ae-8be3-4346-be5c-6146c3007cde","year":null},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:60fcdcbad8a741e9cfc3a00d18be827160f0a30e88a5ea690ff0277e999584af","observation_id":"10a9036d-ee5b-4987-9185-1060f1ce7f35","resolution":{"observed_at":"2026-05-17T20:02:04.679193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lelan: Learning a language-conditioned navigation policy from in-the-wild video","venue":null,"work_id":"d7991740-33a3-498c-8111-8d36ee5a94aa","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:713b34a10ccf71943a56fe63e8cfc43581bc02f7dc24df9de884a780475b9fc8","observation_id":"fd0351b4-3e71-4b13-8bfe-53faba1b370f","resolution":{"observed_at":"2026-05-17T20:02:04.690396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:aa7155e6c694b7b04188a967a9e741ad18303ddd92a64ab1348de73ecdb4215a","observation_id":"cdce8967-421a-45db-97ec-d4585303b9ab","resolution":{"observed_at":"2026-05-17T20:02:04.189139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":"589fcc98-f443-4140-ae58-35359195f22b","year":2024},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:8c398a848520291faa0206f70bdd1fcc6a59cdd5d625511f417e4044b1d5ea53","observation_id":"d4d09d6f-958d-4766-9894-2e84dff4a948","resolution":{"observed_at":"2026-05-17T20:02:04.628964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Socially compliant navigation dataset (scand): A large-scale dataset of demonstrations for social navigation.IEEE Robotics and Automation Letters, 7 (4):11807–11814","venue":null,"work_id":"62e8d6dc-ee5f-441d-b1a9-6a5528b1783c","year":2022},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:08b8c457cd5ac839934f17ec2884781df24a64fb8fceda692d73d5d10454fd50","observation_id":"6c2a9b9f-f9c2-4bf5-875f-cffdd79ec5a2","resolution":{"observed_at":"2026-05-17T20:02:04.658225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"G2o: A general framework for graph optimization","venue":null,"work_id":"cea090b2-1c3f-4a11-8a79-45c3ca8bf86a","year":2011},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:05aaf9bb5502d9146e0a5a98ea5bd339903f45fbf3b9103a056815e7555c9748","observation_id":"ad3e4651-87c4-4783-9ef0-7e89f8a46caa","resolution":{"observed_at":"2026-05-17T20:02:04.634720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A path towards autonomous machine intelli- gence version 0.9","venue":null,"work_id":"bd5fa8ce-0a86-46f2-8885-8ac0407a0779","year":2022},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:d0e6bd52b52e4dbd8bc5f1f7a6af212621ab2f5424992ef1cc80fb9d54ff6f05","observation_id":"262abffb-45bf-404e-ad0f-3848f3245baa","resolution":{"observed_at":"2026-05-17T20:02:04.664609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.10100","doi":"10.48550/arxiv.2501.10100","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:37:34.121670Z","title":"Robotic world model: A neural network simulator for robust policy optimization in robotics.arXiv preprint arXiv:2501.10100, 2025a","venue":null,"work_id":"ac3336e1-7457-4dee-b71a-7507f1830a90","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:58bdf555296139a7a5c73eee7f29194dae442cd78584b8d991eb5265a6d8ee12","observation_id":"946087ec-6f39-4e6b-9692-9a9f9439eb45","resolution":{"observed_at":"2026-05-17T20:02:04.177714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20694","last_updated":"2025-02-28T03:58:23Z","snapshot_observed_at":"2026-07-06T20:44:08.651242Z","submitted_at":"2025-02-28T03:58:23Z","title":"WorldModelBench: Judging Video Generation Models As World Models","version":1},"cited_work":{"arxiv_id":"2502.20694","doi":"10.48550/arxiv.2502.20694","metadata_source":"pith","pith_arxiv_id":"2502.20694","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Li, S., Wu, K., Zhang, C., and Zhu, Y","venue":"cs.CV","work_id":"33a5087c-1633-4d52-b891-f34d10b9e7c8","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2502.20694","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:320cc410f2f99d0240e1ccdf723a34828e811063a07b5c210c11317895129cbc","observation_id":"f984ec2a-c375-422a-8221-dcdd0497b531","resolution":{"observed_at":"2026-05-17T20:02:04.206212Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.214081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.214081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Citywalker: Learning embodied urban navigation from web-scale videos","venue":null,"work_id":"5dae2d3a-de66-4ca4-8808-3df2b0d6c157","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:2916f2a79cdea1813fcbfc79fdc78b37a63223290aa5ab4a738467847d0c2d9f","observation_id":"672f31fe-a14f-4da4-80b5-f86b490cdb0b","resolution":{"observed_at":"2026-05-17T20:02:04.666394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00917","last_updated":"2025-09-03T01:44:58Z","snapshot_observed_at":"2026-07-06T21:50:35.488353Z","submitted_at":"2025-07-01T16:23:00Z","title":"A Survey: Learning Embodied Intelligence from Physical Simulators and World Models","version":3},"cited_work":{"arxiv_id":"2507.00917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.00917","snapshot_observed_at":"2026-07-08T13:14:53.255674Z","title":"A survey: Learning embodied intelligence from physical simulators and world models","venue":"cs.RO","work_id":"5811fe6a-47c9-417e-9cd7-dbd39f7ddd64","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2507.00917","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:0dca2c13a28c96abbf68a105176cb3971d56dc943f5dc34d21bb4678c9d75646","observation_id":"ac6a3000-994e-48ad-a416-f3e6d447c620","resolution":{"observed_at":"2026-05-17T20:02:04.230977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffsynth-studio: examples/wanvideo","venue":null,"work_id":"7f534c9b-964d-4a60-a4b8-e90a0a9f71d3","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:69e3e9ee64dcb8fa1ad32182b36987d77d58c68485712cdde5d159e5081e477f","observation_id":"8e4df65d-ec4f-46d9-81b1-f84dcdd8e9a5","resolution":{"observed_at":"2026-05-17T20:02:04.663589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toward human-like social robot navigation: A large-scale, multi-modal, social human navigation dataset","venue":null,"work_id":"188e6f8b-d064-4b48-85a1-319b63b7924a","year":null},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:5fc45b69a431af542fa8be08a41a179675eb4ba9b932a3577be4091becdf0cd3","observation_id":"43edeea1-a160-40b7-becb-a817ee85595f","resolution":{"observed_at":"2026-05-17T20:02:04.695735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-07-11T00:07:42.711856Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:132777f8518dbeddc52ffa992f9034cb0c6e8461a1bc3ce2bd085ab19489f973","observation_id":"77cee43b-b4bb-4bf9-b536-b608f6e86948","resolution":{"observed_at":"2026-05-17T20:02:04.183417Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning view-invariant world models for vi- sual robotic manipulation","venue":null,"work_id":"1efd550d-4cb5-4f61-bb2a-3e6cf2eaff18","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:ab30b960abb7cf863ded705efd93f1c84364321b7f3a35814eed28af2149f069","observation_id":"c9187cbf-13f0-48ad-b32f-b99bd3bfa30f","resolution":{"observed_at":"2026-05-17T20:02:04.669512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Genie 2: A large-scale foundation world model","venue":null,"work_id":"f4464610-d754-4a63-8192-af261b617f6b","year":2024},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:390f9f4c75191cca4e83232a0694b331187dfdaeb11ac1ef4a3de1586cc4f8f0","observation_id":"f3370505-bdaf-4c06-ab7d-851b57d11176","resolution":{"observed_at":"2026-05-17T20:02:04.672430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generalized-ICP","venue":null,"work_id":"ad71d68c-366a-461b-a9f0-e6f5b4a0aeaf","year":2009},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:1c63242eaeeede52d989b5a7b0f2dbd0e7555e5701441834e7372bc6a073b893","observation_id":"825d86bc-1db2-446d-b177-f204352a4314","resolution":{"observed_at":"2026-05-17T20:02:04.692826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sora 2 is here: Our latest video generation model is more physically accurate, realistic, and more controllable than prior systems","venue":null,"work_id":"b1d8c0a6-28e4-4e5a-b8ab-962939f32fa9","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:d8776a5f025800df253df3bd754650552a374c43a2f14aa13e7c1dfe18b25e7c","observation_id":"4c8275e4-6df4-4bf8-ba8d-9169ea0f8b5c","resolution":{"observed_at":"2026-05-17T20:02:04.661604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unifolm-wma-0: A world-model-action (wma) framework under unifolm family","venue":null,"work_id":"c8961a46-ac79-46b7-af88-0fba56f3af09","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:a197ef4c1e818ad352dd53af22fcf066b6ea8d4d5b974891952d7fcc3ece41a6","observation_id":"cd948287-2d84-4021-a16c-45ef7b27bdf3","resolution":{"observed_at":"2026-05-17T20:02:04.651951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sanpo: A scene understanding, accessibility and human navigation dataset","venue":null,"work_id":"fbacb7de-7a43-4ce4-bb03-bb0bcf37e65e","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:65e9638e36d0d7b463d211f3cb3582727aeb243c0c2fad31cbafa17a93ff5eb4","observation_id":"175c0f5a-ae36-416d-b8b2-9333249bdf55","resolution":{"observed_at":"2026-05-17T20:02:04.637759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:b92c82b6de64917ea5a462be16f80213ec06cd6c7b0a647cd5c8f205601ae0ab","observation_id":"c5cdb0dc-c67d-41ee-815e-7cc3cd5d1e1b","resolution":{"observed_at":"2026-05-17T20:02:04.159116Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.12437","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:47:30.168916Z","title":"Enhancing physical consistency in lightweight world models.arXiv preprint arXiv:2509.12437","venue":null,"work_id":"a4f5e5de-5fe1-498c-8834-f0aae0d9c062","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:cd2a0d263970aa87913f72c1ffcfbbe738c237c5ac29b30bd3a54c8ee2bada01","observation_id":"ffdaadea-1e8c-48dd-b5a8-7fcd81636743","resolution":{"observed_at":"2026-05-17T20:02:04.195187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":"8e1f389a-dcf1-4b14-b7e3-ee78eaa2bc15","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:9ceb750ad6b02a0b0e2bb7aa4c6a7d8db314ae2d95f1e40c11cad75ed70c628e","observation_id":"542bac8c-6443-4746-b0c1-09db983269d7","resolution":{"observed_at":"2026-05-17T20:02:04.681831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20328","last_updated":"2025-09-29T20:44:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-24T17:17:27Z","title":"Video models are zero-shot learners and reasoners","version":2},"cited_work":{"arxiv_id":"2509.20328","doi":"10.48550/arxiv.2509.20328","metadata_source":"pith","pith_arxiv_id":"2509.20328","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Video models are zero-shot learners and reasoners","venue":"cs.LG","work_id":"6ef44b1c-944f-4648-b3a3-e5c320f385c1","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2509.20328","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:2d5a5a9ac51f6bf88cd2d13c69820c35aa0a8d163807d660df081a4246ac0ea0","observation_id":"6e03a2a8-bdb5-47e1-b374-98b9b0fffd5d","resolution":{"observed_at":"2026-05-17T20:02:04.211945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:32.351277+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:32.351277+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialtrackerv2: 3d point tracking made easy","venue":null,"work_id":"002c0ceb-ae8e-405c-a1be-170a8b876ce7","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:82dd96b943fefbf05fd880c1b9e82b50cdae4a9c7858b12da5906b8ed2083436","observation_id":"edfd56d0-f3c3-4f32-8b4f-81a2bb0096f4","resolution":{"observed_at":"2026-05-17T20:02:04.676536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03141","last_updated":"2025-08-12T02:27:56Z","snapshot_observed_at":"2026-07-06T21:36:01.328140Z","submitted_at":"2025-06-03T17:59:05Z","title":"Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval","version":2},"cited_work":{"arxiv_id":"2506.03141","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03141","snapshot_observed_at":"2026-07-03T17:58:47.760773Z","title":"Context as memory: Scene-consistent interactive long video generation with memory retrieval.arXiv preprint arXiv:2506.03141","venue":null,"work_id":"e279c098-3b79-4f32-a246-d51ad9df6c2a","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2506.03141","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:f6dafc770a738f8c41a172126fd5c9f2da0cb0dff91f9f6aaede15a2be9ee475","observation_id":"d1ff0185-3f70-425f-a363-857e497202a6","resolution":{"observed_at":"2026-05-17T20:02:04.221770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:25.556592Z","title":"World-in-world: World models in a closed-loop world","venue":null,"work_id":"d4fadcbc-8645-49fa-8453-d804810c3428","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:49faa070f6922cbf96d3328d675dea4b2bf54bc4ad8fc478a64ea333a822496a","observation_id":"1f833be3-3dce-4e70-ad2e-3f4c45f63ce1","resolution":{"observed_at":"2026-05-17T20:02:04.171696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"cited_work":{"arxiv_id":"2504.02792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.02792","snapshot_observed_at":"2026-07-10T18:47:31.709153Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","venue":"cs.RO","work_id":"c181dcf1-e774-4216-a30e-e55c3f3a766c","year":2025},"citing_paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-17T20:00:20.895672Z"},"links":{"cited_paper":"/paper/2504.02792","citing_paper":"/paper/2511.17792"},"observation_digest":"sha256:26b27b44a7daf9f98c52b285637a39e3413bbf049d988810f2ebbcf1c0f4061f","observation_id":"f73a1f6a-9c56-4204-8e57-c48f88417622","resolution":{"observed_at":"2026-05-17T20:02:04.226613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2511.17792","last_updated":"2026-04-15T17:49:12Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T16:58:42.389912Z","submitted_at":"2025-11-21T21:36:02Z","title":"Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":13,"verified_fuzzy":24},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 2 inbound Pith citation observations for arXiv:2511.17792."}