{"as_of":"2026-08-18T02:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a61b8151d4ffd25c2718aba55c9d7d46baa6bd5ad61603d235b813ff14dc372","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:18:26.321884Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T06:04:18.694737Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.01729","snapshot_observed_at":"2026-08-05T06:04:18.694737Z","title":"PosePilot: Steering camera pose for generative world models with self-supervised depth.arXiv preprint arXiv:2505.01729, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-17T01:42:27.928087Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-05T06:04:18.694737Z"},"links":{"cited_paper":"/paper/2505.01729","citing_paper":"/paper/2509.07996"},"observation_digest":"sha256:f79704f9f28c44679daa0c7ca2e0aff477857d499516c08314a873e2c945abae","observation_id":"7be77090-e6f2-46f3-9685-261b3488ecd5","resolution":{"observed_at":"2026-08-05T06:04:18.694737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.01729/citation-record","integrity":"/paper/2505.01729/integrity","json":"/paper/2505.01729/citation-record.json","paper":"/paper/2505.01729"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:24.875269Z","title":"Planning-oriented autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.875269Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:cd1fbf6a256bb6822ef415bd1911e4b61cacb1f9d9ec22724eec507acdb31ea7","observation_id":"d0b9f937-8cb9-4772-a7ea-d4bf2c897223","resolution":{"observed_at":"2026-08-16T04:18:24.875269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:28.539323Z","title":"Unipad: A uni- versal pre-training paradigm for autonomous driving,","venue":null,"work_id":"a6a6907f-f99a-4657-9d96-94da9a48d48f","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.928459Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:b61b638c61c4145cf6a42c31af5aa0239cfea1de5f52312f2a6b9bc42e668d12","observation_id":"2220247f-e894-4f63-bb95-8a44be236b32","resolution":{"observed_at":"2026-08-16T04:18:28.544765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:28.522551Z","title":"P-mapnet: Far-seeing map gen- erator enhanced by both sdmap and hdmap priors,","venue":null,"work_id":"7bf28fb5-2a74-4865-8427-a05915df836a","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.966548Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:f6c59272736ae25f822508f1423c2b8edf26313babde9dc921ee4a5e301aba3e","observation_id":"68c80e70-6c3f-429a-b138-9880249c42dd","resolution":{"observed_at":"2026-08-16T04:18:28.528086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:28.503752Z","title":"Lode: Locally conditioned eikonal implicit scene completion from sparse lidar,","venue":null,"work_id":"2581f963-2bb2-4c4b-b730-415b8e1c7142","year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.971670Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:5d352392e5ea9bd2d7e913074928f24de100f5f0acc00fc50478a5d8e177fa59","observation_id":"6c20a22a-232d-4147-b1ee-2abfeb375ec6","resolution":{"observed_at":"2026-08-16T04:18:28.509244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:28.362373Z","title":"Monoocc: Digging into monocular semantic occupancy prediction,","venue":null,"work_id":"c76349e6-3fcc-422f-8381-ea63f9130784","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.977088Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:eb321abf622e7d05e29242781f53f3a83ee9933a765a9a4da2f18961fe43b691","observation_id":"b2e106d1-d8c0-430a-9c64-81dd0f82538a","resolution":{"observed_at":"2026-08-16T04:18:28.491967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:28.153209Z","title":"Unsupervised road anomaly detection with language anchors,","venue":null,"work_id":"e343b3c4-61f0-4ecb-a8f6-1cddd223244f","year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.983137Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:287e8142273adb80fcdb6bad33c1c444a1545885d916e0977bebaa6e3ac92c1e","observation_id":"d36a9073-2cbf-41c5-bc39-06c20e1dab11","resolution":{"observed_at":"2026-08-16T04:18:28.263748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.955920Z","title":"Tod3cap: Towards 3d dense captioning in outdoor scenes,","venue":null,"work_id":"bc2dbbe2-0955-4df6-a66a-071fd1f27843","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.991133Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:826b09a8f4734fd7fd28ff5416e3715618955f1a0f7814ad5dd6ce20612dbaea","observation_id":"c7a091f1-d52c-444e-94bb-a7e9b2dcdc88","resolution":{"observed_at":"2026-08-16T04:18:28.054631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.883592Z","title":"Uniscene: Unified occupancy-centric driving scene generation,","venue":null,"work_id":"98194199-b179-43bb-8846-9799f4aa31ac","year":2025},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:24.996600Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:2d77810a1c42f6fcf4e8d6263a9e7df6a06b9237ad70da5704fc1e350872586f","observation_id":"52dbd232-e09f-494f-98e0-8af719dc224e","resolution":{"observed_at":"2026-08-16T04:18:27.889091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06702","last_updated":"2024-09-10T17:59:40Z","snapshot_observed_at":"2026-08-16T13:19:40.293566Z","submitted_at":"2024-09-10T17:59:40Z","title":"Hint-AD: Holistically Aligned Interpretability in End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06702","snapshot_observed_at":"2026-08-16T04:18:25.001865Z","title":"Hint-ad: Holis- tically aligned interpretability in end-to-end autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.001865Z"},"links":{"cited_paper":"/paper/2409.06702","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:fff02de7a407916922b912d97f43df612928727d26367b99d37df4ff5313c28a","observation_id":"68e2975e-89a0-4b18-95e9-964da30eaf6a","resolution":{"observed_at":"2026-08-16T04:18:25.001865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:25.008003Z","title":"Model- based imitation learning for urban driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.008003Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:deffed23bf9db79de0f1753a7d799f70fa312ba781ded4e5b44dabee5da78fae","observation_id":"abb38e74-21a6-4d08-be40-84386559d30e","resolution":{"observed_at":"2026-08-16T04:18:25.008003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.856062Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for autonomous driving,","venue":null,"work_id":"c7fc4317-a0f5-4c0a-b891-85da5188dc55","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.025704Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:40b97fe77ac97451d350fc4e5c0a8071772d740ee9d7ac02edd2681713818e50","observation_id":"f18702c0-e0e4-4db0-9b9f-8ce6000e6ea5","resolution":{"observed_at":"2026-08-16T04:18:27.861457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09777","last_updated":"2023-11-27T05:09:29Z","snapshot_observed_at":"2026-08-16T14:59:48.218608Z","submitted_at":"2023-09-18T13:58:42Z","title":"DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09777","snapshot_observed_at":"2026-08-16T04:18:25.082648Z","title":"Drivedreamer: Towards real-world-driven world models for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.082648Z"},"links":{"cited_paper":"/paper/2309.09777","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:afd8409c56ccedcef41617fb7ef315e76802fb2cead9f02ebf39cffae6d58abf","observation_id":"cdb84a7b-4e80-45a9-84fa-a30c26b82172","resolution":{"observed_at":"2026-08-16T04:18:25.082648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01661","last_updated":"2023-09-23T06:59:18Z","snapshot_observed_at":"2026-08-16T15:11:06.034826Z","submitted_at":"2023-08-03T09:56:31Z","title":"BEVControl: Accurately Controlling Street-view Elements with Multi-perspective Consistency via BEV Sketch Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01661","snapshot_observed_at":"2026-08-16T04:18:25.142175Z","title":"Bevcontrol: Accurately controlling street-view elements with multi-perspective consistency via bev sketch lay- out,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.142175Z"},"links":{"cited_paper":"/paper/2308.01661","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:d815dd054927d75cb6f59d9051dc136330a5c2433bcef6723de86a88f2e6736a","observation_id":"c1fa35cb-ef5a-4ff6-a98c-0193e8f87431","resolution":{"observed_at":"2026-08-16T04:18:25.142175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02601","last_updated":"2024-05-03T04:50:27Z","snapshot_observed_at":"2026-08-17T10:41:51.380790Z","submitted_at":"2023-10-04T06:14:06Z","title":"MagicDrive: Street View Generation with Diverse 3D Geometry Control","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02601","snapshot_observed_at":"2026-08-16T04:18:25.242114Z","title":"Magicdrive: Street view genera- tion with diverse 3d geometry control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.242114Z"},"links":{"cited_paper":"/paper/2310.02601","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:30a2a94983c5e0504af0bdafa61eea316d36871682319deaf0e4e65a1e47a1b6","observation_id":"097fa55c-425b-46f8-9928-803a641d404c","resolution":{"observed_at":"2026-08-16T04:18:25.242114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.840750Z","title":"Panacea: Panoramic and controllable video generation for au- tonomous driving,","venue":null,"work_id":"2d2507e6-61a6-4f17-a8c9-069ac5deae94","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.247901Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:f747a8e815fd41d1f50d47ff8e47c4470f177d261b0cdd5d64944f8b1885afd9","observation_id":"abc94007-f54a-4d9e-8401-ada4d12d25a7","resolution":{"observed_at":"2026-08-16T04:18:27.845330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19438","last_updated":"2024-12-26T10:33:31Z","snapshot_observed_at":"2026-08-17T11:56:12.119196Z","submitted_at":"2024-03-28T14:07:13Z","title":"SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19438","snapshot_observed_at":"2026-08-16T04:18:25.252453Z","title":"Subjectdrive: Scaling generative data in autonomous driving via subject control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.252453Z"},"links":{"cited_paper":"/paper/2403.19438","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:968c2dfabc96458f91b7da657bcf519c4017d3c3937eb3ff7b7d5447034e365e","observation_id":"5609a65b-0af6-4c4f-8509-4b033e71728a","resolution":{"observed_at":"2026-08-16T04:18:25.252453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17398","last_updated":"2024-10-28T05:53:17Z","snapshot_observed_at":"2026-08-16T13:48:56.802800Z","submitted_at":"2024-05-27T17:49:15Z","title":"Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17398","snapshot_observed_at":"2026-08-16T04:18:25.257948Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controlla- bility,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.257948Z"},"links":{"cited_paper":"/paper/2405.17398","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:c15658020d6a0466fb675b752c9a1e0939d65f124af661136c0e55e1f00f20ea","observation_id":"c1be9b42-d98b-44bf-9e88-dc8ebc4b74d7","resolution":{"observed_at":"2026-08-16T04:18:25.257948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.630873Z","title":"Motionctrl: A unified and flexible motion controller for video generation,","venue":null,"work_id":"77c9a8cd-bb2a-4978-9675-d61348ec5ef1","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.263395Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:9af28cb4ef376e70682bc547da33c01af5a1d6bc8844c6f1f82399a50e2fc231","observation_id":"c3842a00-66fb-4417-9f58-e3985250eddd","resolution":{"observed_at":"2026-08-16T04:18:27.774760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.551677Z","title":"Direct-a-video: Customized video generation with user-directed camera movement and object motion,","venue":null,"work_id":"6b698fd5-d358-4661-9457-83d71d090efc","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.268270Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:7046bef24875ce12a73f1be07160e265700d27d7919ad15ee7a693daf86ebf17","observation_id":"07c9566a-3f23-4ff1-a529-a4b70dad7da3","resolution":{"observed_at":"2026-08-16T04:18:27.557248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-16T17:39:09.604516Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-16T04:18:25.273255Z","title":"Cameractrl: Enabling camera control for text- to-video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.273255Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:b65ee8d2aa3f0146e06919f80cceb7cee98a36ab9a41d7638c88c43ab3692c1d","observation_id":"0de58162-7554-4a7d-a295-0e5c4f8b9961","resolution":{"observed_at":"2026-08-16T04:18:25.273255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-17T14:04:31.230742Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-16T04:18:25.280565Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.280565Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:c3fc1f1b06f38a144fb8ef2f0c2cb93531b33e5f5a1c87cee5224f8f68dc936f","observation_id":"f02c3dce-ee33-42b4-a942-a49f8d1bb818","resolution":{"observed_at":"2026-08-16T04:18:25.280565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.534202Z","title":"Unsu- pervised learning of depth and ego-motion from video,","venue":null,"work_id":"18559d2a-875e-44ba-98d5-b2afab4bb7ee","year":2017},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.341750Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:37a335f504b358e42680417743a4688d257961fe1f51db7acce2621f30f507b0","observation_id":"a5994da4-ed3e-4729-b4d7-7b189547e168","resolution":{"observed_at":"2026-08-16T04:18:27.539900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.517817Z","title":"Unsuper- vised learning of depth and ego-motion from monocular video using 3d geometric constraints,","venue":null,"work_id":"a4e595aa-384f-4db2-b6ec-4ba0db1951f5","year":2018},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.460878Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:42dcae8f3c35c8c773c159121418eba3c42510dde56383ae7c7163f465a8274b","observation_id":"24d5a49e-0a34-4f66-91e4-818ce0c28a73","resolution":{"observed_at":"2026-08-16T04:18:27.523519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.501154Z","title":"Unsupervised scale-consistent depth and ego-motion learning from monocular video,","venue":null,"work_id":"89b0d1c0-294b-45d4-b78e-3787dc00111a","year":2019},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.535748Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:3299cfa9c51bab8a3c943473fe2f81a3ed0311c4c43b8f8f1db67b4f93afea9c","observation_id":"40106678-e772-42ff-aee6-bb2aef04f8b4","resolution":{"observed_at":"2026-08-16T04:18:27.506661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.484852Z","title":"Unsuper- vised cnn for single view depth estimation: Geometry to the rescue,","venue":null,"work_id":"baef5362-ef96-4f77-883c-edf11e5b9af0","year":2016},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.541618Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:495cb40f4170e2597ea16220c84308039be79cdd9a43c5fbb3d3399abc8ccb93","observation_id":"f133852c-53b1-464e-bed8-a6bbb148e17f","resolution":{"observed_at":"2026-08-16T04:18:27.490127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.272442Z","title":"Unsupervised scale-consistent depth learning from video,","venue":null,"work_id":"8062eb27-6dd9-432f-bd19-89915294887c","year":2021},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.547835Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:12c45c8cef206a0d037d61ce90ffc2ecfc6c5d8fd107642a47c2db844886e90d","observation_id":"63136b1b-e3a6-43c7-9b26-a05fe4c8e6d7","resolution":{"observed_at":"2026-08-16T04:18:27.419828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-08-16T09:13:51.664817Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11260","snapshot_observed_at":"2026-08-16T04:18:25.552710Z","title":"A survey of world models for autonomous driving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.552710Z"},"links":{"cited_paper":"/paper/2501.11260","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:93fb6670de9cab62480e9a43a44d4a4d580e13865512c694f39346de6e009ffc","observation_id":"7ac30406-5f83-47ee-880c-ff72da263438","resolution":{"observed_at":"2026-08-16T04:18:25.552710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:25.648613Z","title":"End-to-end autonomous driving: Challenges and frontiers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.648613Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:475fccb4d4abdb41750c3dd6977fbb58db52fb4667226dd532ae922111e8f4d6","observation_id":"93bcaf3d-bd91-4105-a262-c5368cd4ee2e","resolution":{"observed_at":"2026-08-16T04:18:25.648613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10429","last_updated":"2024-10-14T12:24:32Z","snapshot_observed_at":"2026-08-17T04:21:53.833074Z","submitted_at":"2024-10-14T12:24:32Z","title":"DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10429","snapshot_observed_at":"2026-08-16T04:18:25.692226Z","title":"Dome: Taming diffusion model into high-fidelity controllable occupancy world model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.692226Z"},"links":{"cited_paper":"/paper/2410.10429","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:b3255898e6731ddae3c8edc29ac815788550bd6885a038dffd53bb5ed5b8da0b","observation_id":"4c292dd5-dc3a-479b-9e32-bd51206cdc9f","resolution":{"observed_at":"2026-08-16T04:18:25.692226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-08-16T04:18:25.774194Z","title":"World4drive: End- to-end autonomous driving via intention-aware physical latent world model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.774194Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:cf77377290460c42799934ea934d6338e6f4cd00c2b69e947550a1c3a13b0a45","observation_id":"85990901-eb2a-46ef-ae95-b0b67864392a","resolution":{"observed_at":"2026-08-16T04:18:25.774194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.097038Z","title":"Int2: Interactive trajectory pre- diction at intersections,","venue":null,"work_id":"96349bf0-172b-4f38-b2e7-4b162299f076","year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.789180Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:c37736e42e54a1cb9f9b0c39a8bf8245d19be795e48aa1d1329b540f2d8b489d","observation_id":"c0d0452f-72f8-4faf-ba04-4a4c4bdba3df","resolution":{"observed_at":"2026-08-16T04:18:27.101830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.079975Z","title":"Transfusion: Robust lidar-camera fusion for 3d object detection with transformers,","venue":null,"work_id":"198d222d-0887-4b78-99ad-d7ae052dca62","year":2022},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.795222Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:877bec4f5b4d4f29690d79d11cce44a547ef811ed73ecb31d4ec76103db679db","observation_id":"33e6ab5d-973c-488e-b263-3129b6f3d63b","resolution":{"observed_at":"2026-08-16T04:18:27.086036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:27.020232Z","title":"Pivotnet: Vectorized pivot learning for end-to-end hd map con- struction,","venue":null,"work_id":"8cc4d9c1-4e4a-4fb9-8828-ab3a26ff770c","year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.799577Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:218db2bb70fc2feb82119b186fe0046a099da457a3fe5f221caf71f6f93ea031","observation_id":"082817f6-a619-4e8f-8449-246d7c3dbb2e","resolution":{"observed_at":"2026-08-16T04:18:27.067809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-16T04:18:25.805171Z","title":"Gaia-1: A generative world model for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.805171Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:16a922d8a8ed232d0a8f44e65198c34ab1304105d72734e34c69d11dd7feb930","observation_id":"51bf9803-1309-42c7-b4d9-7533474f45ea","resolution":{"observed_at":"2026-08-16T04:18:25.805171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:26.828767Z","title":"Drivedreamer: Towards real-world-drive world models for autonomous driving,","venue":null,"work_id":"6fd595e0-da97-4afe-9889-5d0101738f21","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.810356Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:115dd4ddc6307191a9c61951909881247900e0024e2f7898547c7380359e8167","observation_id":"acc0e849-302a-48e8-b94a-b8ea27adac97","resolution":{"observed_at":"2026-08-16T04:18:26.880196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09985","last_updated":"2024-01-18T14:01:20Z","snapshot_observed_at":"2026-08-16T14:26:27.599253Z","submitted_at":"2024-01-18T14:01:20Z","title":"WorldDreamer: Towards General World Models for Video Generation via Predicting Masked Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09985","snapshot_observed_at":"2026-08-16T04:18:25.814646Z","title":"Worlddreamer: Towards general world models for video generation via predicting masked tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.814646Z"},"links":{"cited_paper":"/paper/2401.09985","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:3943adf727e342aecd7b391f03d04709c09fc2c979fd7ccace728a046cacef2b","observation_id":"ae15b249-dd66-4f6e-8c6c-842c24b81e53","resolution":{"observed_at":"2026-08-16T04:18:25.814646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11762","last_updated":"2025-04-24T13:08:08Z","snapshot_observed_at":"2026-08-16T14:41:51.630604Z","submitted_at":"2023-11-20T13:40:40Z","title":"MUVO: A Multimodal Generative World Model for Autonomous Driving with Geometric Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11762","snapshot_observed_at":"2026-08-16T04:18:25.831067Z","title":"Muvo: A multimodal world model with spatial rep- resentations for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.831067Z"},"links":{"cited_paper":"/paper/2311.11762","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:19e6b06c5233aabcc8cb4d4a119bb6c7780d8d0da5db17f83901fe0485dc48e8","observation_id":"f22adbba-0cc8-4771-983e-2568c74624ec","resolution":{"observed_at":"2026-08-16T04:18:25.831067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:26.810945Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving,","venue":null,"work_id":"fd790c40-b0ca-47d2-8778-0322d54e5bcf","year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:25.931424Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:c28e4a5204e6c6491fabb6d0901d4572178ff99dcfb8ec850ac185bbe76144a7","observation_id":"119e7ef6-ebb0-4b3a-aeb3-9a109fedaca5","resolution":{"observed_at":"2026-08-16T04:18:26.816905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:26.793223Z","title":"Motionbooth: Motion-aware customized text-to-video generation,","venue":null,"work_id":"60f690b5-1524-4a2e-97fd-c0c48854cfa5","year":2025},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.063521Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:368bae4215da88887a5dd45593cd4edc87874121bd332c1fede0e8894db9839d","observation_id":"3b6152e7-6f08-4166-8575-878239903a5c","resolution":{"observed_at":"2026-08-16T04:18:26.798749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10126","last_updated":"2025-02-25T00:32:29Z","snapshot_observed_at":"2026-08-16T13:42:54.369415Z","submitted_at":"2024-06-14T15:33:00Z","title":"Training-free Camera Control for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10126","snapshot_observed_at":"2026-08-16T04:18:26.068471Z","title":"Training- free camera control for video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.068471Z"},"links":{"cited_paper":"/paper/2406.10126","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:39003456f918146451f3816b6a9aec0e0e44bcfbc6b4cde5e6a9c5580d886e05","observation_id":"eefe5b7f-468a-47d6-8702-1b66136b57d2","resolution":{"observed_at":"2026-08-16T04:18:26.068471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06006","last_updated":"2025-01-31T17:26:57Z","snapshot_observed_at":"2026-08-17T23:53:03.536257Z","submitted_at":"2025-01-10T14:37:32Z","title":"CamCtrl3D: Single-Image Scene Exploration with Precise 3D Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06006","snapshot_observed_at":"2026-08-16T04:18:26.073739Z","title":"Camctrl3d: Single-image scene explo- ration with precise 3d camera control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.073739Z"},"links":{"cited_paper":"/paper/2501.06006","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:20c11af54cf294c58940585b00f720b495230a015924128a4bcbaf675932fde6","observation_id":"8d131752-e731-4bce-997a-5b3167178583","resolution":{"observed_at":"2026-08-16T04:18:26.073739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-08-16T13:07:25.626052Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-16T04:18:26.078737Z","title":"Cami2v: Camera-controlled image-to-video diffusion model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.078737Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:79034bd7335a2eeb6ca5618979258b7ebef564d294a926f510b895e911912ac6","observation_id":"86c30a36-b022-4746-ac38-02d390094fb1","resolution":{"observed_at":"2026-08-16T04:18:26.078737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06525","last_updated":"2025-02-28T06:40:38Z","snapshot_observed_at":"2026-08-17T23:53:04.160559Z","submitted_at":"2024-11-10T16:59:39Z","title":"I2VControl-Camera: Precise Video Camera Control with Adjustable Motion Strength","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06525","snapshot_observed_at":"2026-08-16T04:18:26.084748Z","title":"I2vcontrol-camera: Precise video camera control with adjustable motion strength,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.084748Z"},"links":{"cited_paper":"/paper/2411.06525","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:a13e697d924db367ee1eec2ffe80b3d9921455619e1c3c81788b20ea70ace084","observation_id":"6cb9c08b-6887-43d7-b1ed-6cef6b5a4e2b","resolution":{"observed_at":"2026-08-16T04:18:26.084748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01595","last_updated":"2024-09-03T04:29:59Z","snapshot_observed_at":"2026-08-16T13:21:54.546194Z","submitted_at":"2024-09-03T04:29:59Z","title":"DiVE: DiT-based Video Generation with Enhanced Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01595","snapshot_observed_at":"2026-08-16T04:18:26.091366Z","title":"Dive: Dit-based video generation with enhanced control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.091366Z"},"links":{"cited_paper":"/paper/2409.01595","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:0b6bc9490a38bd108611929a21f58775cc7598baa213c07717034cfea4cbb908","observation_id":"dbc67455-d2c9-480b-a162-616f7fe3619a","resolution":{"observed_at":"2026-08-16T04:18:26.091366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-17T12:36:13.030381Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-16T04:18:26.096340Z","title":"Drivingworld: Constructingworld model for autonomous driving via video gpt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.096340Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:750e2f01b767d393a7a2edfc21f33b30bf53b6b35448bc8bd70448d846d3fc00","observation_id":"c3c39100-9998-42e8-96aa-a59ba53efb26","resolution":{"observed_at":"2026-08-16T04:18:26.096340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:26.717619Z","title":"Image quality assessment: from error visibility to struc- tural similarity,","venue":null,"work_id":"80535127-78d2-419a-a266-2e788675b480","year":2004},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.150773Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:bf598331fc95b4fd3b52d97f0f132e4724f2cdd776fd98f9040dfed26851df16","observation_id":"61b0939e-94aa-42ce-b30f-6314d97e3429","resolution":{"observed_at":"2026-08-16T04:18:26.780118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:26.269401Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.269401Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:100dbf6ce19b9d45c6d877deff25b1e45e77097029623a9cc7d136ed22a2adeb","observation_id":"67a12022-cc92-46b4-add0-aff028746541","resolution":{"observed_at":"2026-08-16T04:18:26.269401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:26.315681Z","title":"Stereo magnification: Learning view synthesis using multiplane images,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.315681Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:d35efc648fb194ed62ae82fce61bebbf9dd1dfc005d9e6c6ebebbe3b77b33abe","observation_id":"e9bf8e4d-a2b6-4058-8652-c04c31f50c82","resolution":{"observed_at":"2026-08-16T04:18:26.315681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:18:26.321884Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T04:18:26.321884Z"},"links":{"citing_paper":"/paper/2505.01729"},"observation_digest":"sha256:2fce9a45bbe3e93b2b95ba60ddf24da7e812db3ae55ad60e81329edb93f7452c","observation_id":"9db2c7cf-78ee-4789-8bd6-c4ebb664d404","resolution":{"observed_at":"2026-08-16T04:18:26.321884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.01729","last_updated":"2025-07-18T07:43:15Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T23:52:26.116658Z","submitted_at":"2025-05-03T07:51:46Z","title":"PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2505.01729."}